内容栏目

AI产品评测

介绍和评测不同 AI 产品的功能、使用体验与适用场景。

深度体验 LibTV Agent:忘记工具,进入 AI 创作的心流

深度体验 LibTV Agent:忘记工具,进入 AI 创作的心流(在新窗口打开)

开始忘记软件以后,创作才真正开始。 三个月前,我第一次体验 LibTV。它更像一套专业的视频制作工具。我花了很多时间理解 Workflow、节点和模型之间如何协作,最后得出的判断是:只要掌握了 LibTV,就能完成过去一个影视团队才能完成的事情。 三个月后,LibTV 上线了 Agent 和 Skill 功能。我决定重新体验一次。 这一次,我给自己设了一个限制:不学习任何功能,不切换任何面板,全程只和 Agent 对话,来做出 AI 视频。 做到第三个 Demo 时,我突然意识到,我开始想的,不再是下一步该怎么操作,而是这个故事还能怎么发展。 这时,软件退出了,创作进入了。 过去大家讨论 AI

AI产品评测
0
实测 PixVerse Game:当游戏可以「随玩随做」,是什么体验

实测 PixVerse Game:当游戏可以「随玩随做」,是什么体验(在新窗口打开)

最近有三个女孩火了。 起因是市面上的乙游总缺她们真正想看的角色和剧情,她们干脆用 AI 做了一支快穿乙游 PV,视频发出后迅速引发热议,获得全网万赞。 比点赞更说明问题的,是评论区那一串追问:「这是什么游戏?」「什么时候能玩?」 严格来说,这个内部代号「万千」的项目还算不上一款真正的游戏。但三个女孩没等游戏做完,就先验证了一件过去往往要拖到开发后期才敢确认的事:这套角色和故事,真有人想玩。 更有意思的是 PV 里那两次醒目的输入框:女孩们敲进角色的剧情描述,AI 顺着这些要求,把接下来的画面生成出来。 这正是她们动手的理由,既然现有乙游里想看的角色和情节不够,那就用 AI 自己补。 传统流程里

AI产品评测
0
Kimi K3 一手开发实测,前端、Agentic、长任务全面拉满 !

Kimi K3 一手开发实测,前端、Agentic、长任务全面拉满 !(在新窗口打开)

发布之前,我在 X 上看到有人说,测 K3 的感觉就像在测 Fable 5。虽然离 Fable 5 还差一点点 🤏,但超过 Opus 4.8 和 GPT 5.5 基本没有问题。在前端能力,K3 的提升非常明显,我已经用它复刻了前段时间爆火的独立工作室 Abeto 推出的一款 3D 网页游戏 《 Messenger》(ps. 音乐手动配的,主角模型是 K3 自己判断、自主去游戏官网找的)

AI产品评测
0
Step 3.7 Flash、DeepSeek、MiniMax、Gemini、GPT 的 Agent 评测,谁更适合Agent?

Step 3.7 Flash、DeepSeek、MiniMax、Gemini、GPT 的 Agent 评测,谁更适合Agent?(在新窗口打开)

最近这段时间,国内外模型更新得很快。 如果只看发布会和榜单,大家都会觉得每个模型都很强。参数更大、上下文更长、推理更强、价格更低,听起来都挺猛。 但真正用到工作流里,会发现另一件事:模型强不强,不只看它会不会回答问题,还要看它能不能把一个任务完整跑完。 尤其是 Agent 场景。 一个复合任务需要大模型去调用多个工具,比如让模型做一份 PPT,它并不是简单写几页文字。中间要先理解需求,再去搜索资料,阅读网页,提取关键信息,整理成汇报结构,必要时还要生成代码或调用插件,最后产出一个可以正常使用的PPT文件。 下面测试两个Agent任务,使用同样的提示词,相同的Agent工具-Trae Work。

AI产品评测
0
我们让DuMate当了一天采购员,结果差点拿着假报价去砍价

我们让DuMate当了一天采购员,结果差点拿着假报价去砍价(在新窗口打开)

阿辉又跟我们吐槽了。 他在消费电子公司干了三年采购,每次吃饭必带三个话题:BOM里同一颗料写法不一样,眼睛看瞎;供应商报价币种不同,算错就是真金白银;月底写采购报告,整理数据比写内容还累。 我们照例嘲笑了他十分钟:都2026年了,你还在Excel里手动对齐? 嘲笑完,于心不忍。我们正好拿他的这个过程,看看在制造业这种传统行业,能不能被AI辅助到。DuMate是百度团队做的AI助手,主打能操作电脑、读Excel、联网搜索。。我们找了个周末,拉着阿辉一起,把他吐槽最多的场景重现了一遍。 阿辉不用当测试员,他只管凭三年经验判断结果靠不靠谱。 准备:一上午的"埋雷" 周六上午,我们和阿辉在咖啡馆坐了一

AI产品评测
0

参与交流

查看 AINRK 交流群说明

了解加入交流群的方式,阅读内容无需登录。

查看交流群说明(在新窗口打开)