
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

速递|AI音乐黑马Klay融资千万美元签约三大唱片公司,不做歌曲生成做“歌曲改编”(在新窗口打开)
阿蒂从洛杉矶飞来,谈论他的初创公司上周发布的重磅消息。Klay 已与各大唱片公司——环球音乐集团、华纳音乐集团和索尼音乐—— 达成批准上市许可/注册协议 ,成为首家与这三巨头全部签约的人工智能初创企业。

656行代码5小时搞定,Axiom AI自主完成两项Erdős猜想形式化证明(在新窗口打开)
近日,AI 初创公司 Axiom 宣布其模型在没有人类干预的情况下,自动完成了两个数学猜想的证明——埃尔德什问题(Erdős Problem)中的 481 号和 124 号。据称,481 号问题仅用时 5 小时,代码量为 656 行;124 号问题则耗时超 24 小时。值得关注的是,这些证明均通过 Lean 验证,Lean 的特点是其形式化证明过程无需人工干预,为数学正确性提供了保障。

Anthropic官宣PTC突破,中国开发者一年前就实现了(在新窗口打开)
Anthropic发布了Programmatic Tool Calling(PTC)特性,让Claude通过代码编排工具执行,降低token消耗、减少延迟并提升准确性。

Ilya刚预言完,世界首个原生多模态架构NEO就来了:视觉和语言彻底被焊死(在新窗口打开)
全球首个可大规模落地的开源原生多模态架构(Native VLM),名曰NEO。要知道,此前主流的多模态大模型,例如我们熟悉的GPT-4V、Claude 3.5等,它们的底层逻辑本质上其实玩的就是拼接。

AGI新路径!谷歌神作!NIPS大会现场谷歌新模型架构被疯狂围观:模型本身就是记忆系统!网友:Transformer到头了(在新窗口打开)
当地时间12月4日下午,谷歌研究员的一篇论文在现场引来了超多AI爱好者的围观。甚至,被业界专家视为“为AGI发展提供了新框架”,一位人士评价为:这篇论文将成为逐步推动实现AGI的5~10篇论文中的一篇。

谷歌IMO金牌级Gemini 3深夜上线!华人大神挂帅,OpenAI无力反击(在新窗口打开)
太劲爆了!不过半月,谷歌DeepMind终于放出了IMO最强金牌模型——Gemini 3 Deep Think。今天,Gemini 3 Deep Think已在Gemini App上线,所有Ultra用户即可体验。

独家丨视频生成产品 Pollo AI 获 1400 万美元融资,一个没有大厂与海外背景的 “草根” 创始人(在新窗口打开)
游戏进入下半场,阿彪说,他想让 Pollo AI 成为 AI 时代的剪映。

前安克全球CMO王时远入局AI录音硬件,拿下红杉种子融资|硬氪独家(在新窗口打开)
硬氪独家获悉,前安克创新全球CMO、中国区总裁王时远离职后创业,成立「穗升科技」;公司聚焦AI录音硬件赛道,依托软硬件结合方案实现记忆管理与行动的闭环。

“豆包手机”在二手市场价格都翻倍了……(在新窗口打开)
“豆包手机”刚发售,火到3万台首批备货被一抢而空。

他给普通人配了个 “AI 剧组”丨100 个 AI 创业者(在新窗口打开)
“帮助全世界 40 万人成为导演,这种成就感,比我自己拍一部电影要大得多。”

他们用AI和老旧笔记本,给非洲开发救命药(在新窗口打开)
在过去几年里,AI 技术经历了爆发式的增长,它正以极快的速度影响各行各业。然而,这场技术浪潮并未平等地惠及每一个人。

估值 7 亿美元的 AI 语音输入产品:语音输入的关键问题是听写,不是转录(在新窗口打开)
键盘作为人机交互的主要工具,实质上是一个巨大且不自然的「输入、输出瓶颈」。在「后键盘时代(post-keyboard future)」,语音或许才是最好地交互方式。

不到2分钟,6岁小孩用AI建了个网站!律师老爸当场「破防」:“我阻止了十多年的事,他随手就做到了”(在新窗口打开)
在生成式 AI 的新时代,人们一直在讨论它会不会颠覆教育、改变编程、重塑工作方式——但你可能没想到:现在连 6 岁的小孩都能通过AI 变成“侵权生成器”了。

Nature重磅:智能的尽头是算力!谷歌大佬承认「预测下一个词即智能」(在新窗口打开)
芯片速度触顶,AI却在疯狂跃迁。摩尔定律不管用了!Nature最新文章给出一个颠覆直觉的解释:智能的增长不靠芯片,而是结构被重新组织,更多单元被接入同一套协作网络。

复盘2025:这49家美国AI公司拿走上亿美元融资 | AI加速垂直分化,重划行业版图(在新窗口打开)
去年,美国有49家AI创业公司完成了1亿美元以上的融资。按常理,这样的数字意味着高基数、难再现。但今年的市场依旧火热,据TechCrunch的最新发布,进入年底前的最后几周,2025年已经追平去年,甚至出现更多的头部公司连续获得多轮 1亿美元以上的融资。

大模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力(在新窗口打开)
大模型总是无法理解空间,就像我们难以想象四维世界。

DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了(在新窗口打开)
DeepSeek 一发布模型,总会引起业内的高度关注与广泛讨论,但也不可避免的暴露出一些小 Bug。

从失控到共舞:如何让游戏中的AI更像人类? | 43 Talks(在新窗口打开)
想象一下这个场景: 一个寂静的深夜,你满怀期待对游戏里的AI说:“去睡觉吧”,它却径直走向餐厅,在椅子坐下了;你再次尝试:“帮我暖一下被窝?”它用合成语音温柔地回应“好的”,身体却僵在洗手间,纹丝不动。

超越π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架(在新窗口打开)
Vision–Language–Action(VLA)策略正逐渐成为机器人迈向通用操作智能的重要技术路径:这类策略能够在统一模型内同时处理视觉感知、语言指令并生成连续控制信号。

年轻人不语,手动搓出自己的「应用工厂」(在新窗口打开)
AI时代,年轻人都在忙着做builder。



