
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

Llama 4造假丑闻幕后:小扎豪赌143亿,却为中国AI「做了嫁衣」(在新窗口打开)
Llama4性能造假丑闻,OpenAI烧钱的速度远超过了盈利能力;另外一方面:国产模型凭借足够强大的性能与超高性价比,迅速占领了国际开源模型市场。是时候再次为国产AI鼓掌了!

用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能(在新窗口打开)
当前视频检索研究正陷入一个闭环困境:以MSRVTT为代表的窄域基准,长期主导模型在粗粒度文本查询上的优化,导致训练数据有偏、模型能力受限,难以应对真实世界中细粒度、长上下文、多模态组合等复杂检索需求。

一个模型读懂所有医学数据,Hulu-Med探索医学大模型开源新范式 | 浙大x上交xUIUC(在新窗口打开)
从影像诊断到手术指导,从多语言问诊到罕见病推理—— 医学AI正在从“专科助手”进化为“全能型选手”。

王小川的“AI医生梦”,要被蚂蚁做成了?(在新窗口打开)
AI医疗不是一门新生意,但确是一个“性感”的赛道。

2.4万亿参数原生全模态,文心5.0一手实测来了(在新窗口打开)
刚刚,文心5.0正式发布了!全新一代主打原生全模态,最开始就把语言/图像/视频/音频放在同一套自回归统一架构里,做统一的理解与生成训练。所以,最终模型能够做到支持全模态输入(文字/图片/音频/视频)+全模态输出(文字/图片/音频/视频),创意写作、指令遵循、智能体规划方面也更强了。

阿里将向AI C端市场投入一枚重磅(在新窗口打开)
虎嗅独家获悉,9月后,从北京、广东等地“调”来的超过百位核心工程师,汇聚到了阿里巴巴杭州西溪园区C4楼。此后,C4楼封闭了两层办公楼层,员工需要刷工牌及特殊的安保审批,方能进入。

Nature公开谷歌IMO金牌模型技术细节!核心团队仅10人,一年给AI编出8000万道数学题训练(在新窗口打开)
谷歌DeepMind的IMO金牌模型,完整技术全公开了!

【首发】医疗大模型企业全诊医学获1亿元B轮融资,创投行业期待中国的Abridge(在新窗口打开)
中国最早进行医疗大模型后训练的创新企业之一 ——杭州全诊医学科技有限公司(以下简称“全诊医学”)正式宣布完成1亿元B轮融资:2024年4季度由A股上市公司“创新医疗”(SZ.002173)完成战略轮投资;2025年2季度由中国医药工业百强“好医生集团”完成B轮投资,探针资本担任本轮融资的独家财务顾问。

AI 时代,印度崛起了(在新窗口打开)
大家好,我是 Ai 学习的老章 最近 GitHub 发布了 2025 年度开发者趋势报告

李飞飞3D世界模型公测,网友已经玩疯了(在新窗口打开)
就在今天,李飞飞发布了全新的世界模型,开启公测,人人可玩。

Claude Skills 新玩法:用 skill-creator 10 分钟搞定 Excel 报表自动化,职场人必学(在新窗口打开)
skill‑creator 是 Anthropic 在 Claude Skills 体系中提供的“元技能”。它本身是一个可直接在 Claude 对话中调用的 Skill,专门用于 帮助用户快速创建、编辑、打包其他自定义 Skill,从而让 Claude 能够在特定业务场景下拥有专业化的能力。

百度连甩两款自研AI芯片!昆仑芯五年路线图公开(在新窗口打开)
目标2030年百万卡集群点亮。 芯东西11月13日报道,今日,在百度世界大会上,百度发布两款全新AI芯片昆仑芯M100和昆仑芯M300,以及两款全新超节点百度天池256超节点与百度天池512超节点,并公布昆仑芯未来五年路线图。 根据最新披露的路线图,今年昆仑芯已实现单集群三万卡点亮,并发布了百度天池32超节点和64超节点,明年昆仑芯M100、百度天池256超节点、百度天池512超节点上市,2027年昆仑芯M300上市,2028年百度天池千卡级超节点上市,2029年昆仑芯N系列上市,2030年百度百舸百万卡昆仑芯单集群点亮。 昆仑芯M100面向大规模推理做优化,预计在2026年初上市;昆仑芯M3

速递|Anthropic豪掷500亿美元联手Fluidstack,自建AI计算基础设施新纪元开启(在新窗口打开)
Anthropic 周三宣布与英国新锐云服务商 Fluidstack 达成一项雄心勃勃的数据中心合作协议,将投入 500 亿美元在美国多地建设设施以满足其不断增长的计算需求。

从 NBA 到奥运会,全球顶级赛事为何都选择阿里 AI ?(在新窗口打开)
答案藏在阿里 AI + 云的全栈布局里。2025 年 11 月 12 日,杭州阿里全球总部的访客登记系统跳出一串特殊信息——柯丝蒂·考文垂,国际奥委会首位非洲籍、女性主席。

审美、镜头、视听语言……TapNow是我见过最像导演的AI(在新窗口打开)
在这个AI生成视频泛滥的时代,我们习惯看到“AI一键出片”“模版复刻”,却少有真正能触碰商业大片质感的作品。

2M大小模型定义表格理解极限,清华大学崔鹏团队开源LimiX-2M(在新窗口打开)
提到 AI 的突破,人们首先想到的往往是大语言模型(LLM):写代码、生成文本、甚至推理多模态内容,几乎重塑了通用智能的边界。但在一个看似 “简单” 的领域 —— 结构化表格数据上,这些强大的模型却频频失手。

稚晖君最新188机器人,阅后即焚(在新窗口打开)
具身智能机器人太火了。 火到连原本做复合材料的公司,都开始造机器人。 而且凭这个方向,在A股市场上,短短4个月股价飙升了1500%。 这听着有点离谱,但如果这家公司叫上纬新材,而且它刚刚被稚晖君联合创办的智元机器人拿下控股权。 是不是就瞬间合理了? “智元上纬”出手,两张图带飞一只股 11月11日,11点11分,公众号智元上纬发布了一篇名为《上纬新材 来了!》的文章。 文章只有两张图:一张是写着“大有可为”的1.88米高机器人;一张是写着“静观其变”的四足机器人。 紧接着,智元机器人联创、CTO、B站百大稚晖君也对外预告了新产品。 (ps:稚晖君(彭志辉)在11月6号成为上纬新材的董事候选人)

一句话,我用豆包 AI 做出《红楼梦》互动游戏(在新窗口打开)
“一位老师,用 AI 做了个《林黛玉初进贾府》的互动游戏。”

让AI精准操作网页:CAMEL Hybrid Browser Toolkit深度解析(在新窗口打开)
本文档分析 CAMEL 项目中 hybrid_browser_toolkit 的技术实现,覆盖其架构设计、核心功能与通信协议。

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!(在新窗口打开)
我们都知道 LLM 中存在结构化稀疏性,但其底层机制一直缺乏统一的理论解释。为什么模型越深,稀疏性越明显?为什么会出现所谓的「检索头」和「检索层」?



