
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

北大团队官宣:庞加莱猜想被完整形式化!首个双检验版本来了(在新窗口打开)
北京大学AI for Math团队宣布在Lean 4中完整形式化庞加莱猜想,约320万行代码、半个月内完成、成本不到3万美元,是首个同时通过Lean编译与Comparator双重验证的版本。

OpenAI将重新开放200美元套餐,但Tibo被骂惨了(在新窗口打开)
OpenAI宣布明天重新开放200美元Pro订阅,但新方案按API美元计价后对应用量减半,Tibo因此遭到用户强烈批评。

多个榜单登顶、1.2B参数,轻量化TeleOCR解锁文档智能化解析新能力(在新窗口打开)
中国电信星辰通用人工智能实验室推出的轻量化文档解析模型TeleOCR(约1.2B参数)凭借形变感知学习、多边形版面分割、CGDP采样及内容—结构解耦等技术创新,在OmniDocBench v1.6、Wild-OmniDocBench、PureDocBench等多个公开榜单取得领先,并在ICDAR 2026 Sci-ImageMiner挑战赛中夺冠,目前已开源。

马斯克激情转发!Opus 5.5代码直出音乐MV火了(在新窗口打开)
Anthropic的Opus 5.5凭借代码直出音乐MV的能力在社交平台爆火,马斯克多次转发并盛赞"史诗级""真切感受到AGI",网友纷纷发起同题接龙挑战。

Manus表明AI应用只剩三件事(在新窗口打开)
Manus发布2.0版本全家桶产品,包含新agent架构Cascade、面向工作创作的Manus Studio及个人智能体Cue,表明AI应用几乎只剩Coding/办公、视频/游戏与个人智能体三件事,并宣布组建团队开发面向国内市场的产品。

一只鹈鹕成了Agent时代的大明星|亮马桥小纪严选(在新窗口打开)
小纪有话说: “社区里每天有上万张鹈鹕踩单车的视频被发群里,问我这个鹈鹕降智了吗?”开源项目CodexRadar的发起人Lambda,在GPT-6 Astra发布之后,每天都收到巨量的鹈鹕视频,于是,

GPT-6.1 Sol深夜震撼发布!1/5价格逼近Astra(在新窗口打开)
OpenAI深夜发布GPT-6.1 Sol,作为原GPT-6.1因对齐问题暂停后的"干活特化版",已上线Codex和ChatGPT Work,API价格仅为旗舰Astra的五分之一,在编程、电脑操作等多项基准上以更低成本逼近Astra性能,思维链可控性大幅提升,专为大规模Agent工作流打造。

反超Seedance 2.0!RunningHub发布增强版H3,1秒只要0.1 元(在新窗口打开)
RunningHub基于MiniMax H3开源基座发布增强版H3 RH Enhanced,2000组实测显示其多镜头长时叙事能力显著优于Seedance 2.0,16镜以上角色崩坏率降低超60%,生成成本低至0.1元/秒。

AI自己榨干算力!让Kimi K3自己写「超级算子」,推理快了3倍(在新窗口打开)
Inferact开源TPU巨型算子与浪潮信息发布元脑SD200 Ultra超节点服务器,两家公司分别用谷歌TPU v7和128颗本土AI芯片,通过算子融合让Kimi K3推理性能提升3倍以上,且浪潮信息让K3自主编写超级算子。

刚刚,十个Claude 5.5攻克百年物理猜想!(在新窗口打开)
10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格(在新窗口打开)
至知创新研究院开源320B大模型IQuest-Q1,该模型在代码生成、安全漏洞挖掘等评测中表现优异,并能自主排查训练Bug,在交通调度、仓库管理、电梯调度等真实场景中展现出强大的任务解决能力。

Anthropic 严正警告:GLM-5.3 已具备高级网络攻击能力(在新窗口打开)
Anthropic发布网络安全评估报告指出,智谱AI的GLM-5.3已具备自主开发端到端网络漏洞利用程序的高级网络攻击能力,但其内置安全护栏极易被简单方法绕过或移除,导致恶意攻击者可轻易获取该能力。

最新福利,免费领取一整年 Google AI Pro / Plus(在新窗口打开)
Google面向符合条件的大学生推出免费领取一整年Google AI Pro或Google AI Plus的学生活动,美国学生可获原价约240美元的Pro方案,140多个国家和地区学生可获原价约60美元的Plus方案,活动通过gemini.google/students官方页面领取,有效期至2026年12月31日。

前TikTok全球运营负责人再创业,用AI给宠物造了个平行世界(在新窗口打开)
Lollapalooza由前TikTok全球运营负责人周秉俊与前BAI投资人胡禹丞创立,陆续推出Furever、Furstagram和Furever Dock等AI宠物产品,为宠物构建拥有记忆、身份与互动的平行世界,并逐渐演变为兼具长期陪伴与个人助手能力的虚拟宠物体验。

给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉(在新窗口打开)
中国电信研究院与MemTensor等机构提出首个面向智能体记忆系统的操作级幻觉评测基准HaluMem,已被EMNLP 2026主会接收,该基准分别对记忆提取、更新和问答三个环节进行检查,并对Mem0、MemOS等六套系统实测,发现高召回率可能伴随虚假信息写入、低更新幻觉率背后存在大量遗漏、上游记忆问题最终会影响回答等核心现象。

Plan Mode才成标配,就有人宣布它「已死」(在新窗口打开)
Nuanced创始人Ayman Nadeem发文宣布「Plan Mode已死」,指出随着AI模型能力提升,传统计划模式在AI编程中已不再必要,而规划与执行的边界正在逐渐融合。

Flash模型又添一员大将:实测MiniMax M3.1(在新窗口打开)
MiniMax于9月27日上线Flash级别模型M3.1-Flash-Preview,本文通过试衣间项目改造、机器人视频拆解、北京夜光可视化和A股市场观测台四个实测任务,将其与DeepSeek V4.1 Flash和GLM-5.3-Flash对比,结果显示M3.1速度仅次于DeepSeek但成本最低,成为Flash赛道上DeepSeek的新对手。

Today AI 国内版上线,齐俊元想做一个「更懂你、早你一步」的个人 AI 助理(在新窗口打开)
齐俊元创立的 Today AI 国内版正式上线,定位为「懂你所想,为你先行的个人 AI 助理」,以单一长对话和主动建议卡片替代空白输入框,并已接入邮箱、飞书、钉钉、腾讯文档等国内应用。

Muse凭啥让小扎AI口碑翻盘?一文看懂(在新窗口打开)
Meta发布的个人AI助手应用Muse凭借云端虚拟机执行任务的能力,上线10天登顶美国App Store免费总榜,推动Meta股价单日大涨11.43%,同时引爆Personal Agent赛道,引来OpenAI、Manus及字节跳动等公司纷纷跟进布局。

独家 | 腾讯秘密开发Personal Agent独立App“Handy Bot”(在新窗口打开)
腾讯正在秘密研发Personal Agent产品"Handy Bot",并计划推出独立App,目前已在微信端低调上线服务号,产品处于内部测试阶段。



