
视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石(在新窗口打开)
视频世界模型跑久了容易“散架”——要么人不动了,要么场景崩了。
内容栏目
分享不同 AI 工具、模型与相关技术的使用方法和实践文章。

视频世界模型跑久了容易“散架”——要么人不动了,要么场景崩了。

很多人以为,给Agent装上更多Skill,它就会变得更强。

Agent 的持续学习和自我进化是最近行业内的讨论热点。

本文是北京大学彭宇新教授团队在视觉定位方向的最新研究成果,相关论文已被顶级国际期刊 IEEE TPAMI 接收。为视觉定位模型赋予「自知之明」能力 —— 通过自监督的关联校正与验证模块,在训练过程中动态识别、衰减并纠正错误的监督信号。大量实验证明,让模型学会「自我纠错」,是突破弱监督视觉定位瓶颈的有效途径。

最近沉迷 VibeCoding 哎嘿,做了非常多有意思的小工具,工具太多也还没来得及整理,等有时间再分享下。

大模型写代码这件事,越来越像「既能写片段,又离真实工程差一截」。

AI模型只看了一串纯数字序列,就能继承另一个模型的危险偏好,即使删掉敏感词没有用,合成数据时代最隐蔽的安全裂缝,被撕开了。

有这样一种 “模型玄学”:明明是同一个 Prompt,仅仅换一种说法,模型的回答可能就天差地别。

我和周围朋友都特别爱玩《星露谷物语》。 这个游戏特别上头。种菜、钓鱼、挖矿、跟村里的人聊天,日出而作日落而息,有一种田园牧歌的治愈感,跟我的日常生活极其反差。是我个人爱好榜第三,(第一老头环,第二塞尔达) 但玩久了会发现一个问题,NPC 太呆了。 他们永远只有那几句台词,今天问他「今天过得怎么样」,明天再问,答案一模一样。你送他礼物,他说谢谢,你不送,他也不记得。你没法真的跟阿比盖尔聊天,只能看固定的动画。 我跟朋友吐槽了好几次:这 NPC要是能「活」过来就好了。 前几天 Hermes Agent 发布之后,我突然想到一件事,能不能给星露谷的 NPC 都接入 Hermes Agent? 29

蚂蚁灵波,下了盘大棋。 今年 1 月,蚂蚁灵波一口气开源了 4 款大模型,包括高精度空间感知模型 LingBot-Depth、具身大模型 LingBot-VLA 与具身世界模型 LingBot-VA,以及世界模型 LingBot-World。 其中,LingBot-Depth 负责从图像中估算深度、感知空间距离,LingBot-World 负责对环境进行模拟和理解,LingBot-VLA/VA 负责机器人的决策和动作控制。 这四款模型「各司其职」,分别覆盖感知底层、环境理解和行动输出,但中间一直缺少一个关键环节,就是如何把连续的感知数据实时构建成稳定的三维空间模型,让后续模块有据可依。 现在,

质量和成本只能二选一?通过大脑+小脑分层、场内+场外双轮驱动,数据堂给出了具身智能数据难题的解。

当强化学习后训练的大规模 rollout 已经被证明能够提升图像生成模型的偏好对齐能力,推理负担就成了制约训练速度的核心瓶颈。来自 NVIDIA、港大和 MIT 的团队提出的 Sol-RL,通过「FP4 先探索、BF16 再训练」的后训练框架,将达到等效 reward 水平的收敛速度最高提升到 4.64x,在训练速度与对齐效果之间给出了一条更具工程可行性的解法。

大模型写代码这件事,越来越像「既能写片段,又离真实工程差一截」。

最新研究提出合成数据的全新分类框架,突破「生成模型=合成数据」的传统认知,涵盖反演、仿真与数据增强等方法,并按应用层次划分为数据中心AI、模型中心AI、可信AI和具身AI。

为什么你的“AI优先”战略可能大错特错?一文读懂。

我们很荣幸地宣布 CloudBase CLI V3 正式上线,这是一个面向 AI Agent 重新设计的 CloudBase 命令行工具。

如何工业化生产AI漫剧。 根据《AI 漫剧视频模型行业白皮书 - v1.0》,2025 年市场规模预计达 168 亿元,同比增长超 80%,高速增长的市场吸引大量从业者进入,月度内容供给量从 2024 年的约 0.3 万部,激增至约 1.8 万部。与此同时,AI 技术在漫剧生产环节的渗透率已提升至 60%-85%,制作成本下降 50%-75%,生产周期缩短至传统模式的 1/3,进一步搅动市场。 在供给极大丰富的当下,AI 漫剧行业也从“产能井喷期”迈入“质量竞争与价值深化期”,依托 Vidu 在 AI 漫剧行业的引领性实践经验,结合 AI 漫剧行业发展现状与核心痛点,AI 新榜联合生数科技旗下

一个在 AI 社区广泛流传的架构思路,正在让大量团队走弯路。

Hermes Agent最近在AI圈彻底火了。

全球最强编程模型,中国造。 你可以从同事.skill 的爆火中看到两种截然不同的时代情绪,其一固然是对 Markdown 文件“大变活人”这一魔幻现实的试探,而反面则是如今对模型能力的评价,已经离不开工作级任务的场景。 “AI 能不能替代程序员”的老生常谈之下,今天的真问题是,国产大模型能在多大程度上接管开发工作流。 这背后是一个被反复验证的痛点:当 AI Agent 被放进真实项目,它并没有想象中那么“能扛活”。它能开始任务,但执行过程反复中断,多轮对话后上下文丢失,结果前后不一致。面对非标准需求时,工具调用也频频失误。你一觉醒来,发现流程早已卡死,标准结局总是如此。 问题的根源不在 Age
参与交流
了解加入交流群的方式,阅读内容无需登录。