
Know AI. See What’s Next.
第 1 张,共 5 张:微软和 a16z 投了一家 AI 催收公司
最新资讯流

仅需10%思维链标注,等同全量性能!计算所发布推理监督新范式(在新窗口打开)
大语言模型(LLMs)推理能力近年来快速提升,但传统方法依赖大量昂贵的人工标注思维链。中国科学院计算所团队提出新框架PARO,通过让模型学习固定推理模式自动生成思维链,只需大模型标注1/10数据就能达到全量人工标注的性能。这种方法特别适合像金融、审计这样规则清晰的领域,为高效推理监督提供了全新思路。

用「进化+压力测试」自动生成的竞赛级编程题,各家大模型谁更hold住?(在新窗口打开)
在当前评测生成式模型代码能力的浪潮中,传统依赖人工编写的算法基准测试集,正日益暴露出可扩展性不足与数据污染严重两大瓶颈。

VaseVQA:考古领域实现专家级,诊断+补弱RL框架(在新窗口打开)
在文化遗产与人工智能的交叉处,有一类问题既美也难:如何让机器「看懂」古希腊的陶器——不仅能识别它的形状或图案,还能推断年代、产地、工坊甚至艺术归属?有研究人员给出了一条实用且富有启发性的答案:把大型多模态模型(MLLM)放在「诊断—补弱—精细化评估」的闭环中训练,并配套一个结构化的评测基准,从而让模型在高度专业化的文化遗产领域表现得更接近专家级能力。

融资1100万美金,华人团队打造Agent基础层,5 行代码搞定 AI Agent(在新窗口打开)
直到我看到 Dedalus Labs 宣布完成 1100 万美元种子轮融资的消息,才意识到有人正在系统性地解决这个问题。这家由 Cathy Di 和 Windsor Nguyen 创立的公司,正在构建一个基础设施层,让开发者能够用 5 行代码就搭建起一个功能完整的 AI agent。这不是夸张的营销话术,而是他们真正在做的事情。

刚刚,OpenAI股改完成,非营利主体更名(在新窗口打开)
刚刚,OpenAI宣布已完成资本结构重组。这就意味着,OpenAI上市的道路已经铺平,而软银前几天刚批准的225亿美元投资,也将顺利到账。具体来说,OpenAI重组后,非营利主体(即原本的OpenAI Nonprofit)改名为OpenAI Foundation,继续掌控营利实体——

蚂蚁新报告!全盘公开Ling 2.0训练细节,性能突破的四大关键曝光(在新窗口打开)
蚂蚁集团这波操作大圈粉!智东西10月28日报道,10月25日,蚂蚁集团在arXiv上传了一篇技术报告,一股脑将自家2.0系列大模型训练的独家秘籍全盘公开。今年9月至今,蚂蚁集团百灵大模型Ling 2.0系列模型陆续亮相,其万亿参数通用语言模型Ling-1T多项指标位居开源模型的榜首

弑母分尸案震惊世界,AI伪造语音骗过警察!(在新窗口打开)
母亲被杀,尸体藏进洗衣机,女儿却用AI伪造她的声音、假扮她的样子,让世界以为她还活着。十天后,真相才浮出水面,竟是亲生女儿弑母,后用AI伪造母亲声音!AI没有杀人,却做了帮凶。我们该害怕的,是机器的失控,还是人性的冷酷?

华为世界模型来了!单卡30分钟生成272㎡场景(在新窗口打开)
AI大house真来了。 华为联合上海交通大学、华中科技大学推出了世界模型WordGrow,可以生成1800㎡超大室内场景(19x39块),单卡30分钟就跑了272㎡。 里面的虚拟人还能顺畅导航,不带迷路的。(小声说:大平层确实需要导航) 并且场景具备连贯的几何拓扑和照片级真实感外观,智能体的导航则是在复杂空间布局中自主规划路径。 这可以说是走到哪建到哪了,那场景是怎么搭的? 具备连贯的几何拓扑和照片级真实感外观 以前想造个像样的3D大场景,坑不少。 比如有些技术先靠2D模型画张图,再硬掰成3D,结果换完视角一看,沙发腿歪了、墙壁纹理断了…… 还有一些方法最多只能造单个房间,扩展成套房就卡壳;

每周 100 多万人跟 ChatGPT 聊自杀,OpenAI 紧急更新「救命」(在新窗口打开)
凌晨三点,一个用户在 ChatGPT 的对话框里输入,「我已经没有办法再坚持了。」

DeepMind再登Nature:AI Agent造出了最强RL算法!(在新窗口打开)
当AI开始「自己学会学习」,人类的角色正在被重写。DeepMind最新研究DiscoRL,让智能体在多环境交互中自主发现强化学习规则——无需人类设计算法。它在Atari基准中击败MuZero,在从未见过的游戏中依旧稳定高效。

马斯克推出Grokipedia叫板维基百科,内容却大量照搬(在新窗口打开)
当地时间 10 月 27 日,埃隆·马斯克为互联网带来了一个新的知识工具。这位亿万富翁名下的人工智能公司 xAI 推出了 Grokipedia,一个由 AI 生成的在线百科全书平台。马斯克在社交媒体 X 上宣称,这将是对维基百科(Wikipedia)的“巨大改进”,甚至称其为实现 xAI“理解宇宙”目标的“必要步骤”。但这个雄心勃勃的项目在上线几小时后就引发了争议。

首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式(在新窗口打开)
当强大的多模态大语言模型应用于地球科学研究时,它面临着无法忽视的 「阿克琉斯之踵」

超越英伟达Describe Anything!中科院 & 字节联合提出「GAR」,为DeepSeek-OCR添砖加瓦(在新窗口打开)
近期,DeepSeek-OCR提出了“Vision as Context Compression”的新思路,然而它主要研究的是通过模型的OCR能力,用图片压缩文档。

新型「验证码」诞生?这张图让 ChatGPT、Claude、Gemini 都翻了车(在新窗口打开)
人眼秒懂,AI抓瞎!网友用光学错觉玩坏大模型,全网百万人围观。

相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作(在新窗口打开)
能看懂相机参数,并且生成相应视角图片的多模态模型来了。

MiniMax,可能是今年最大的黑马。(在新窗口打开)
周日晚上,都准备去睡觉了。结果在 X 上刷到一条消息,有个国外的博主说,MiniMax 的 M2 模型将会成为中国最好的模型,与 Sonnet 4.5 旗鼓相当。 我当时心里咯噔一下。MiniMax?

大模型在具身推理上「翻车」了?4496 道题全面揭示短板(在新窗口打开)
具身智能是近年来非常火概念。一个智能体(比如人)能够在环境中完成感知、理解与决策的闭环,并通过环境反馈不断进入新一轮循环,直至任务完成。这一过程往往依赖多种技能,涵盖了底层视觉对齐,空间感知,到上层决策的不同能力,这些能力便是广义上的具身智能。

高通入局AI芯片,两款新品瞄准数据中心(在新窗口打开)
今日(10 月 28 日),高通正式宣布推出两款全新芯片——高通 AI200 和高通 AI250,以及相应的机架级解决方案。此举直接挑战了由英伟达和超威半导体长期主导的 AI 芯片领域。消息宣布后,高通股价依然应声飙升,涨幅超 11%,创 2024 年 7 月以来新高。

地理学的AlphaEvolve?MIT斯坦福让AI自我生长、懂地理、懂世界(在新窗口打开)
让AI懂地理,它才会走得更远。GeoEvolve让AI从助理变成「地理学博士生」,自己修bug、改算法、进化模型——这下,科学家可能真的要有个AI同事了。MIT和斯坦福学者提出了GeoEvolve,尝试了这样一种探索:

AI不再「炫技」,淘宝要让技术解决用户每一个具体问题(在新窗口打开)
近日,在 CNCC2025 大会上,郑波首次公开了淘宝全模态大模型的最新进展,并系统介绍了多模态智能在淘宝 AIGX 技术体系的研究应用。另外,结合 AI 模型技术在淘宝应用中的实践,他认为,「狭义 AGI 很可能在 5-10 年内到来。」



