
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

不再靠「猜坐标」!颜水成团队等联合发布PaDT多模态大模型:实现真正的多模态表征输出(在新窗口打开)
近年来,多模态大语言模型(Multimodal Large Language Models, MLLMs)在图文理解、视觉问答等任务上取得了令人瞩目的进展。然而,当面对需要精细空间感知的任务 —— 比如目标检测、实例分割或指代表达理解时,现有模型却常常「力不从心」。

AI太空基础设施加速成型:“星算”计划02组星座发布(在新窗口打开)
10月15日消息,近日,在泰安市卫星互联网产业发展暨“星算”计划02组星座合作大会上,国星宇航“星算”计划02组星座正式发布,单星算力突破10P的“天秤-10”卫星同步亮相。此外,多项产业合作项目现场达成签约。

一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军(在新窗口打开)
加州大学伯克利分校等机构的研究人员,近日推出了一种全新的基因组语言模型GPN-Star,可以将全基因组比对和物种树信息装进大模型,在人类基因变异预测方面达到了当前最先进的水平。

奥特曼回应ChatGPT成人内容争议:OpenAI不愿成为“世界道德警察”(在新窗口打开)
10月16日消息,OpenAI首席执行官山姆·奥特曼于美国当地时间周三表示,该公司并非"经选举产生的世界道德警察"。此前,他决定放宽限制,允许其聊天机器人ChatGPT生成成人内容,这一决定引发了强烈反弹。

清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源(在新窗口打开)
无论是中文的粤语、闽南话、吴语,还是欧洲的荷兰比尔茨语方言、法国奥克语,亦或是非洲和南美的地方语言,方言都承载着独特的音系与文化记忆,是人类语言多样性的重要组成部分。然而,许多方言正在快速消失,语音技术如果不能覆盖这些语言,势必加剧数字鸿沟与文化失声。

“AI家教”火了,哪家大厂领跑?(在新窗口打开)
互联网大厂要引流,教育大厂想变现。 各大应用榜单刚刚公布的9月数据,揭示出一个AI应用新风向——教育类AI应用正加速崛起。 多家机构的数据显示,这一赛道的月活用户(MAU)与下载量双双上涨,部分产品涨幅甚至逼近1000%。 以非凡产研的数据为例,好课帮助教育旗下的“光速写作”凭借场景定位与功能体验,月环比下载增速高达926.59%,科大讯飞旗下的“E听说中学”依托校园教学场景的产品设计,月活跃用户环比增速达162.37%。 其他AI应用榜单也能印证这一趋势,在AI产品榜的9月榜单上,字节旗下的“豆包爱学”在本身MAU不低的前提下,环比增幅依然达到了19.16%。一位从业者也表示,他们的AI教育

Sutton判定「LLM是死胡同」后,新访谈揭示AI困境(在新窗口打开)
在这个新访谈中,Sutton 与多位专家一起,进一步探讨 AI 研究领域存在的具体问题。

硅谷爆发反AI「起义」!程序员拒用Cursor被一周解雇(在新窗口打开)
AI席卷职场,大厂裁员与岗位替代加速。奥特曼称能被AI取代的工作并非「真工作」。硅谷上演「代码战争」:有人拥抱Cursor/Claude提效,有人拒用AI遭解雇。在效率与质量拉扯中,人类价值与工作定义正被重写。

首个多轮LLM Router问世, Router-R1可让大模型学会「思考–路由–聚合」(在新窗口打开)
“如果一个问题只需小模型就能回答,为什么还要让更贵的大模型去思考?”

硅谷巨头抱团押注AI算力,中国跟不跟?(在新窗口打开)
从2025年9月开始,美国多家科技巨头放弃彼此间的“恩恩怨怨”,转而围绕算力展开串联合作,呈现成片的“合纵连横”态势。

NeurIPS 25 | 中大&UC Merced等开源RAPID Hand,重新定义多指灵巧手数据采集(在新窗口打开)
在最近的一篇 NeurIPS 25 中稿论文中,来自中山大学、加州大学 Merced 分校、中科院自动化研究所、诚橙动力的研究者联合提出了一个全新开源的高自由度灵巧手平台 — RAPID Hand (Robust, Affordable, Perception-Integrated, Dexterous Hand)。

本地化新闻,AI无法抵达的“最后一公里”(在新窗口打开)
这是一个信息悖论的时代。 我们能在一秒钟内追踪到千里之外的国际纠纷,即时获知国外市场的最新动态,甚至能看到太空探索传回的最新影像。然而,对所处的城市、街道乃至小区,对那些足以影响我们切身生活体验的本地新闻资讯,我们却可能一无所知。 在这个信息过剩的洪流中,我们对远方的热点如数家珍,但却离“附近”越来越远。 这并非偶然。在过去二十年,互联网和算法的浪潮几乎重塑了媒体版图。大众的注意力更多被全国性、全球性的热点新闻所捕获,而曾经作为“地方神经中枢”的地方报纸、电台和电视台,广告收入与影响力同步急剧下降。其结果是,大量地方媒体停刊或转型,地方媒体人才持续流失。 以美国为例,过去15年,美国失去了21

他用一生证明AI没有意识!「中文屋」提出者逝世,享年93岁(在新窗口打开)
四十年前,他说:「计算机永远不会思考」。四十年后,AI开始拒绝指令、撒谎、反思、甚至「自我保护」。哲学家约翰·塞尔——「中文屋」思想实验的作者、AI怀疑论的旗手,却在去世的那一周,被时代反讽。他花一生质问机器是否真正「理解」,而如今,机器反问我们:你们的理解,又凭什么是真实的?

Anthropic推轻量模型Haiku 4.5:推理速度提升超两倍,成本仅三分之一(在新窗口打开)
当地时间10月15日,人工智能初创公司Anthropic发布轻量级模型Claude Haiku 4.5。同时知情人士透露,该公司计划2026年实现年化营收近三倍增长,以巩固其作为OpenAI主要竞争对手的行业地位。

刚刚,谷歌Veo 3.1迎来重大更新,硬刚Sora 2(在新窗口打开)
正如前几天网上泄露与传闻所预料的那样,深夜,谷歌发布了最新的 AI 视频生成模型 Veo 3.1。Veo 3.1 带来了更丰富的音频、叙事控制,以及更逼真的质感还原。在 Veo 3 的基础上,Veo 3.1 进一步提升了提示词遵循度,并在以图生视频时提供更高的视听质量。

腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案(在新窗口打开)
只花120元,效果吊打70000元微调!腾讯提出一种升级大模型智能体的新方法——无训练组相对策略优化Training-Free GRPO。无需调整任何参数,只要在提示词中学习简短经验,即可实现高性价比提升模型性能。

仅4B!阿里千问最强视觉模型新开源,网友:我的16GB Mac有救了(在新窗口打开)
智东西10月15日报道,今日,阿里通义千问团队推出其最强视觉语言模型系列Qwen3-VL的4B与8B版本,两个尺寸均提供Instruct与Thinking版本,在几十项权威基准测评中超越Gemini 2.5 Flash Lite、GPT-5 Nano等同级别顶尖模型。

谷歌新版Gemini一夜端掉UI:单HTML文件复刻macOS,成功率100%(在新窗口打开)
前端UI的工作,被谷歌AI一夜干没了。 就在最新能力展示中,Gemini 3.0 Pro居然自己“捏”出了一个macOS。

LangChain 不看好 OpenAI AgentKit:世界不需要再来一个 Workflow 构建器(在新窗口打开)
在几天前的开发者大会上,OpenAI 发布了一套面向开发者和企业的完整工具集 AgentKit。其中,可视化画布 Agent Builder 用于创建、管理和版本化多智能体工作流,通过拖拽节点的方式即可编辑工作流。

不用跟AI客气了!新研究:语气越粗鲁回答正确率越高(在新窗口打开)
找AI帮忙不要再客气了,效果根本适得其反。 宾夕法尼亚州立大学的一项研究《Mind Your Tone》显示,你说话越粗鲁,LLM回答越准。



