
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

全球首个「导航大脑」上线!一句话让机器人自己找路回家(在新窗口打开)
银河通用联合多所大学发布了全球首个跨本体全域环视导航基座大模型NavFoM,让机器人能自己找路,而不再依赖遥控,从而推动具身智能向规模化商业落地演进。

比NanoBanana更擅长中文和细节控制!兔展&北大Uniworld V2刷新SOTA(在新窗口打开)
比Nano Banana更擅长P细节的图像编辑模型来了,还是更懂中文的那种。

具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据(在新窗口打开)
当前机器人领域,基础模型主要基于「视觉-语言预训练」,这样可将现有大型多模态模型的语义泛化优势迁移过来。但是,机器人的智能确实能随着算力和数据的增加而持续提升吗?我们能预测这种提升吗?

扩散不死,BERT永生!Karpathy凌晨反思:自回归时代该终结了?(在新窗口打开)
谷歌遗珠与IBM预言:一文点醒Karpathy,扩散模型或成LLM下一步。

Gemini 的 PPT 生成:使用技巧及模板提示词(在新窗口打开)
Gemini APP 前几天上线了 PPT 生成的能力,我昨天尝试了一下发现相当可以啊。

清北联合推出Motion Transfer,比肩Gemini Robotics,让机器人直接从人类数据中端到端学习技能(在新窗口打开)
近期,Google DeepMind 发布新一代具身大模型 Gemini Robotics 1.5,其核心亮点之一便是被称为 Motion Transfer Mechanism(MT)的端到端动作迁移算法 —— 无需重新训练,即可把不同形态机器人的技能「搬」到自己身上。不过,官方技术报告对此仅一笔带过,细节成谜。

谷歌Dreamer大神离职!「辛顿门徒」自曝错过Transformer(在新窗口打开)
谷歌世界模型大牛Danijar Hafner宣布离任!他自2016年起开始在Google Brain实习,后又在DeepMind、Brain Team工作。他的经历颇具传奇色彩,曾获辛顿指导,还与Łukasz Kaiser、Ashish Vaswani等Transformer大佬有过交集。

用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率大幅提升(在新窗口打开)
扩散大语言模型得到了突飞猛进的发展,早在 25 年 2 月 Inception Labs 推出 Mercury—— 第一个商业级扩散大型语言模型,同期人民大学发布第一个开源 8B 扩散大语言模型 LLaDA,5 月份 Gemini Diffusion 也接踵而至。

OpenAI合纵亚马逊,微软连横Anthropic,硅谷只有利益没有盟友(在新窗口打开)
OpenAI的1.4万亿算力订单,正式开启大甩卖。

地球「养不起」英伟达GPU(在新窗口打开)
地球现在连显卡都供不起了,微软的GPU插不进机房。英伟达的H100直接飞向太空。

AI太空竞赛?英伟达H100刚上天,谷歌Project Suncatcher也要将TPU送上天(在新窗口打开)
11 月 2 日,英伟达首次把 H100 GPU 送入了太空,参阅报道《英伟达发射了首个太空 AI 服务器,H100 已上天》。而刚刚谷歌宣布,他们也要让 TPU 上天。

20 岁大学生靠 Vibe Coding,把课程作业卷上 GitHub 热榜第一(在新窗口打开)
今天翻 GitHub Trending 的时候,看到一个不怎么眼熟的项目占据榜单第一。 仔细一看,是个多 Agent 舆情分析助手,名字叫「微舆 BettaFish」。再往下拉,发现它 star 已经过万了,而且还是最近十几天突然暴涨。

医疗AI独角兽Hippocratic AI拿下8亿融资,估值250亿,谷歌英伟达都投了(在新窗口打开)
智东西11月4日消息,11月3日,美国生成式AI医疗独角兽Hippocratic AI宣布完成1.26亿美元(约合人民币8.97亿元)的C轮融资,谷歌母公司Alphabet旗下独立成长基金CapitalG参投。此轮融资也让该公司的估值达35亿美元(约合人民币249.24亿元),总融资额达到4.04亿美元(约合人民币28.77亿美元)。

产品还是个文件夹,投资人抢着砸钱:只因她是「前OpenAI」?(在新窗口打开)
十年前,「黑手党」这个词还属于PayPal。十年后,它成了OpenAI。那些离开OpenAI的人,没有远去,而是在外部重建另一个OpenAI。他们互相投资、互相背书,从算法到资本,织出一张无形的权力网。AI的故事,看似在讲技术,其实是在讲权力的继承。当算法学会模仿人类,人类也在用算法,复制自己的帝国。

横扫拉美、力压字节系,「AI届的4399」成为出海AI应用新王?(在新窗口打开)
不是最强 AI,却最懂用户刚需?在 Sensor Tower 发布的 Q3 应用出海榜单中,我们注意到了一个特别的 AI 应用「Seekee」。它空降下载榜 Top9,是当季度在海外获得最多下载量的出海 AI 应用,而由字节跳动出品、近一段时间炙手可热的「Cici」尽管排名上涨,但仅位列第 13。

最强开源0.9B级OCR模型!PaddleOCR-VL本地一键部署,私密性拉满【喂饭级教程】(在新窗口打开)
前不久我写了一篇百度最新的OCR模型(PaddleOCR-VL)的文章反响还不错。

震荡股市中的AI交易员:DeepSeek从从容容游刃有余? 港大开源一周8k星标走红(在新窗口打开)
2025 年 10 月,美股经历了一轮典型的震荡行情:月初科技股强势反弹,月中通胀数据扰动市场,10 月 10 日前后纳指单日波动超过 3%。就在这波谲云诡的市场环境中,港大黄超教授团队的开源 AI-Trader 项目正式启动实盘测试。该项目上线一周时间在 GitHub 上获得了近 8K 星标,展现了社区对 AI 自主交易技术和金融市场分析的能力高度关注。

清华AI数学家系统攻克均匀化理论难题!人机协同完成17页严谨证明(在新窗口打开)
当AI不再只是解题机器,而能与人类并肩完成严谨的科研证明,这意味着什么?

大部分人不知道的 AI 抖音,居然是最「反抖音」的产品(在新窗口打开)
前段时间,有媒体爆料说 OpenAI 打算推出一个 AI 抖音,没想到隔天,这个「AI 抖音」Sora 就上线了。

开发者生产力“平替”?MiniMax M2全面测评:代码、速度与迁移成本(在新窗口打开)
生成式AI技术的成熟,让智能编程逐渐成为众多开发者的日常,然而一个大模型API选型的“不可能三角”又随之而来:追求顶级、高速的智能(如GPT-4o/Claude 3.5),就必须接受高昂的调用成本;追求低成本,又往往要在性能和稳定性上做出妥协。开发者“既要又要”的正义,谁能给?



