
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

《麦肯锡2025 AI报告》|附下载(在新窗口打开)
麦肯锡刚刚发布了2025年AI最新报告,一组数据让人“破防”:88%的组织都在用AI,但只有39%的组织吃出了“真金白银”。这份《The state of AI in 2025》回答了AI时代大家都很关心的一个问题:

又一 AI Coding 黑马,后端能力更强的 ZOER.AI 发布!(在新窗口打开)
天下 AI Coding 产品如过江之鲫。正当我们在策划「Vibe Coding 产品千千万,谁是你的 No.1」活动时,我们发现了 ZOER.AI,让我们眼前一亮。ZOER.AI 是一个主打「Database-First」(数据库优先)的全栈应用构建平台,旨在解决当前 AI Coding 工具「前端能力强、后端能力弱」的结构性问题。

6666!NeurIPS满分论文来了(在新窗口打开)
四个审稿人全给6分,NeurIPS唯一满分论文炸了!

苏姿丰又收购一家AI公司!马斯克朋友创办(在新窗口打开)
AMD半年发起4笔AI收购。 芯东西11月11日报道,今日,AMD宣布完成对美国AI推理创企MK1的收购。MK1团队将加入AMD AI事业部,将其软件创新与AMD计算能力相结合,在推进AMD的高速推理和企业级AI软件栈方面发挥关键作用。 MK1由埃隆·马斯克的朋友、Neuralink联合创始人保罗·梅罗拉(Paul Merolla)领导。在Neuralink,梅罗拉曾协助领导芯片设计工作,并开发能够解码大脑活动的算法。他与曾任Neuralink团队负责人、致力于脑神经信号处理系统开发的Thong Wei Koh在2023年1月共同创立了MK1。 MK1拥有一支专注于高速推理和基于推理的AI技术

杨植麟回复:Kimi K2训练用的H800!但“只花了460万美元”嘛…(在新窗口打开)
Kimi K2 Thinking训练真的只花了460万美元?杨植麟亲自带队,月之暗面创始团队出面回应了。这不是官方数据。训练成本很难计算,因为其中很大一部分用于研究和实验。他们还透露训练使用了配备Infiniband的英伟达H800,GPU数量也比巨头的少,但充分利用了每一张卡。

AI下乡,重伤老头老太太(在新窗口打开)
一场针对四五线城市老年人的“AI围猎”正在上演。

打破显存墙:谢赛宁团队提出CLM,单卡RTX 4090「撬动」1亿高斯点(在新窗口打开)
3D Gaussian Splatting (3DGS) 是一种日益流行的新视角合成方法,给定 3D 场景的一组带位姿的图像(即带有位置和方向的图像),3DGS 会迭代训练一个场景表示,该表示由大量各向异性 3D 高斯体组成,用以捕捉场景的外观和几何形状。

飞书的第一个双十一:以 AI 参与电商效率战(在新窗口打开)
工具解放人,人去创造。 电商行业已经变成一场没有喘息的马拉松:平台越来越多,货越来越难卖。 和五年前相比,加入电商战场的玩家增加了不少。抖音、视频号、小红书,甚至美团闪购、淘宝闪购都想卖一切。大公司们希望从电商业务中获取更多利润,看似给商家提供了更多选择,但消费变得不容易——消费者三餐都在缩,等到国补才愿意买大件,商家不敢放过每个有流量的渠道。 每个平台都有自己的规则、玩法、业态竞争,以及用户画像,之间的差异足以让商家们应接不暇。他们要在八九个电商平台上,管理数百种产品。每个产品上新,都需要反复测试封面图、标题、详情页文案、买赠活动以及相关的搜索关键词。 为了更多流量,他们还要对接成百上千个

英伟达铁幕之后,谷歌AI芯片已成气候(在新窗口打开)
英伟达在聚光灯下狂飙,谷歌却在幕后悄悄造出自己的AI基建帝国系统。当别人还在抢GPU时,它早已自给自足、闭环生长——闷声干大事,从未如此谷歌。

上交×蚂蚁发布 DiagGym:以世界模型驱动交互式医学诊断智能体(在新窗口打开)
临床诊断并非一次性的「快照」,而是一场动态交互、不断「探案」的推理过程。然而,当下的大模型大多基于静态数据训练,难以掌握真实诊疗中充满不确定性的多轮决策轨迹。如何让AI学会「追问」、选择检查,并一步步抽丝剥茧,迈向正确诊断?

谷歌192亿买他回来,现在只想让他闭嘴(在新窗口打开)
谷歌花27亿美元(约192亿人民币)挖来的Transformer“贡献最大”作者Noam Shazzer,现在点燃了火药桶。

中美AI竞赛下半场:能源瓶颈成比芯片更紧迫的挑战(在新窗口打开)
11 月初,英伟达 CEO 黄仁勋在接受《金融时报》采访时称中国将在 AI 竞赛中击败美国,其中一个原因在于中国的能源成本更低。而在做出这样的直白表态之后,黄仁勋又在另一份简短声明中做了补充说明,他说中国在 AI 技术领域只落后美国一点点,并指出对于美国而言保持领先地位至关重要。

谷歌的两个5天课程都讲了什么,介绍一下这9+N份白皮书 |最新(在新窗口打开)
2025年末,谷歌通过Kaggle平台,以前所未有的力度,连续推出了两个为期五天的线上强化课程。这不仅仅是两次普通的线上分享,更像是一场由谷歌顶级机器学习(ML)研究员和工程师亲自引领的、深入探索生成式AI及其前沿应用——AI Agents(人工智能代理)的集训。

ICCV 2025 Highlight | 大规模具身仿真平台UnrealZoo(在新窗口打开)
你是否曾为搭建具身仿真环境耗费数周学习却效果寥寥? 是否因人工采集海量交互数据需要高昂成本而望而却步? 又是否因找不到足够丰富真实的开放场景让你的智能体难以施展拳脚?

从 IROS 2025谈起,智能机器人何时迎来「GPT式爆发」? | GAIR Live 019(在新窗口打开)
机器人觉醒:控制范式退场,认知时代降临 2025年10月,IROS(国际智能机器人与系统会议)在全球机器人从业者的目光中落幕。作为行业最具影响力的学术与产业盛会,本届在杭州召开的IROS的“中国印记”与“具身智能转向”尤为醒目——展台上,国产具身智能企业扎堆亮相,灵巧手、低成本机械臂等硬件技术刷新全球认知;会场内,“Learning驱动具身智能”的论文占比突破60%,标志着机器人从“传统控制工具”向“智能认知主体”的范式转移。 当“具身智能”从实验室热词走向产业实践,当硬件迭代与大模型技术碰撞出真实的商业可能,雷峰网AI科技评论特别邀请三位横跨学界与业界的嘉宾:上海交通大学计算机学院助理教授、

从VLA到RoboOmni,全模态具身新范式让机器人察言观色、听懂话外音(在新窗口打开)
复旦⼤学、上海创智学院与新加坡国立⼤学联合推出全模态端到端操作⼤模型 RoboOmni,统⼀视觉、⽂本、听觉与动作模态,实现动作⽣成与语⾳交互的协同控制。开源 140K 条语⾳ - 视觉 - ⽂字「情境指令」真机操作数据,引领机器⼈从「被动执⾏⼈类指令」迈向「主动提供服务」新时代。

硅谷GPU蒙尘,马斯克一言成谶:美国AI被电卡脖子(在新窗口打开)
AI万丈高楼,终究要建在物理世界的地基之上。没有电,再强的GPU也只是一堆沙子。

「紫荆智康」获近亿元天使轮融资,加速AI医院系统开发及落地(在新窗口打开)
「紫荆智康」日前完成近亿元天使轮融资,由星连资本领投,英诺天使和尚势资本跟投,本轮融资将主要用于紫荆AI医院(Agent Hospital)系统的研发、迭代与升级。紫荆智康成立于2024年9月,由清华大学智能产业研究院(AIR)孵化,清华大学计算机系教授、智能产业研究院执行院长刘洋发起

MIT融合新旧视觉技术,破解救援机器人导航瓶颈,无需标定,数秒生成3D场景(在新窗口打开)
在一场矿难救援中,时间意味着生命。想象一台搜救机器人在部分坍塌的矿井中穿行:浓烟、碎石、扭曲的金属梁。它必须在险象环生的环境中迅速绘制地图,识别路径,并精准定位自己的位置。

翻译界的ChatGPT时刻!Meta发布新模型,几段示例学会冷门新语言(在新窗口打开)
在7000多种人类语言中,只有少数被现代语音技术听见,如今这种不平等或将被打破。Meta发布的Omnilingual ASR系统能识别1600多种语言,并可通过少量示例快速学会新语言。以开源与社区共创为核心,这项技术让每一种声音都有机会登上AI的舞台。



