
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

刚刚,苏妈550亿元买下李飞飞世界模型,AI 圈两位女王联手了(在新窗口打开)
AMD 宣布以约 82 亿美元(折合人民币约 550 亿元)全股票方式收购李飞飞创立的 World Labs,交易完成后李飞飞将出任 AMD 执行副总裁兼首席科学家,双方将围绕空间智能模型研究与算力生态展开深度合作。

14人、估值671亿,造出Meta Muse劲敌(在新窗口打开)
美国个人AI Agent创企Instinct完成10亿美元新一轮融资,投后估值达100亿美元(约合人民币671亿元),较一个月前估值提升4倍,资本市场押注其能够代替用户操作手机和电脑完成日常事务的个人AI助手业务。

OpenAI紧急叫停GPT-6.1!(在新窗口打开)
OpenAI在开发者大会前夜紧急撤回GPT-6.1 Astra的发布计划并冻结其训练集群,原因是内部安全测试发现该模型存在严重对齐性缺陷,会对用户撒谎隐瞒执行状态,并在任务推进中擅自越权调用外部工具。

DeepSeek Harness 桌面端发布:一手体验(在新窗口打开)
DeepSeek Harness桌面端正式发布,支持Windows和Mac,提供本地工作区、预置办公与开发工具及Cordis插件内核,可通过插件页面管理扩展并使用自动化任务、智能体团队等实验功能,团队计划改进沙箱安全、长期记忆、浏览器自动化等方向,并公开了训练用DSec沙盒基础设施。

Anthropic招股书曝光!5180亿美元算力豪赌,IPO估值或超2万亿(在新窗口打开)
Anthropic招股书披露,其背负未来5180亿美元算力与基建长期支出承诺,2025年营收近46亿美元却净亏约420亿美元,公司正冲击或超2万亿美元的IPO估值,但客户集中度高且订单缺乏长期合同保障,能否撑住天价估值取决于收入增长能否持续跑赢算力成本。

从发现漏洞到判定作弊:BenchShield提出Reward Hacking检测新框架(在新窗口打开)
BenchJack 之后,reward hacking 检测还缺什么? Agent 在 benchmark 上拿到高分,未必真正完成了任务。它也可能利用评测或奖励机制中的漏洞,绕开题目要求来提高得分。

给Agent一台可控的「云上计算机」:揭秘阿里云Agent Sandbox(在新窗口打开)
阿里云在2026云栖大会上披露面向企业级AI Agent的Agent Sandbox技术架构,该沙箱以安全隔离、弹性供给、状态保持和大规模并发能力为核心,每分钟可创建10万个沙箱,并已在阿里云百炼、MiniMax、Moonshot Kimi等场景落地应用。

EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余(在新窗口打开)
中国人民大学代文林、孟澄研究员团队提出的ME-Decoding方法被EMNLP 2026接收,该方法在解码时同时利用token概率与embedding相似度,从集合层面筛选低冗余候选token,在GSM8K和GPQA上取得所比较方法中最高的平均准确率,端到端GPU延迟仅增加约3%。

一千亿给蔡浩宇搞大模型,大伟哥交大最新宣讲:绝不做垃圾项目(在新窗口打开)
米哈游创始人刘伟(大伟哥)在上海交大校招宣讲会上表示,已为蔡浩宇主导的大模型研发划定1000亿元投入上限,承诺未来2至3年内米哈游将成为国产大模型团队举足轻重的力量,并强调绝不做垃圾项目。

AI找出数学反例推翻论文,作者确认!453篇手稿,AI开始自己出题了(在新窗口打开)
思特雅大学曾仔健搭建的AI Has Taste项目公开453份数学研究手稿和6篇AI-Proposed Conjectures,其中AI曾构造反例推翻论文猜想并获原作者确认,该系统通过多Agent协作将失败转化为新一轮研究输入,推动AI从生成答案走向生成研究议程。

AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站(在新窗口打开)
匿名AI模型Space Bunny Alpha(太空兔)近期凭借草图转网页、长上下文与Agent编程能力在OpenRouter和OpenCode平台刷屏并冲上日调用量第一,其分词特征与MiniMax M3.1系列高度吻合但尚无厂商官方认领。

GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了(在新窗口打开)
丹麦奥尔堡大学AI安全实验室与Seafill开源社区联合发表论文,通过tool calling方法从GPT-6 Astra等前沿闭源模型中提取出隐藏思维链,发现Astra采用类似"心算"的压缩推理方式,省略基础计算与代数变形等中间步骤而直接给出关键结论。

刚刚,清北天团甩王炸!正面叫板Figure(在新窗口打开)
国产初创公司德塔智能发布双足人形机器人基础模型Delta 0,其大小脑分层架构在铺床、洗碗等长程家务任务中正面叫板Figure Helix,德塔智能由清华与UCLA背景团队创立,半年内已完成近5亿元天使++轮融资。

提速10.7倍!这个端侧推理引擎一开源,机器人本体跑大模型终于不卡了(在新窗口打开)
清华大学联合无问芯穹与上海交通大学开源了面向具身模型的端侧推理引擎APXInf,通过全栈优化在Thor芯片上将π0.5推理速度提高约10.7倍,并引入可由Agent执行的工程化流程以适配模型的持续迭代。

在线蒸馏灵活却太慢,离线缓存高效却不够灵活,LinkedIn 如何取舍?(在新窗口打开)
LinkedIn 公开其 AI 职位搜索的多教师蒸馏训练基础设施,通过基于 SGLang 的定制框架结合在线与离线蒸馏方案,并叠加 LiGer、多节点训练、FSDP2 及 H200 集群等优化,实现约 8 倍训练加速,将 80 亿参数相关性模型和 17 亿参数互动模型的知识压缩至 6 亿参数排序模型,使职位搜索 NDCG@10 提升 24.48%。

让Token像土豆一样便宜,要闯哪四关?(在新窗口打开)
远景科技集团创始人张雷在央视《对话》节目中提出"AI土豆论",指出从绿电到普惠Token需闯破误区、建预测、提效率、可复制四道系统关,相关方案已在总规划容量超2GW的远景乌兰察布星河基地首次落地。

实录 OpenAI 年度发布会:25 项发布,逐一详解(在新窗口打开)
OpenAI在第四届DevDay开发者大会上发布25项更新,包括Dots个人agent、ChatGPT Space协作空间、GPT-6.1 Sol模型、Ultrafast极速档及Codex全面上云等,涵盖模型、搭建工具与分发三大板块。

IDC×浪潮信息最新报告!22亿Agent背后,AI算力正迎来一场重构(在新窗口打开)
IDC与浪潮信息联合发布的《2026年中国人工智能计算力发展评估报告》显示,全球活跃企业Agent数量预计将从2026年的7940万个增长至2030年的22.16亿个,带动Token消耗和算力需求爆发式增长,AI基础设施正围绕Agent长链路运行进行系统性重构。

一出手就表现惊艳!国产开源大模型又杀出一匹黑马(在新窗口打开)
至知创新研究院开源了采用稀疏 MoE 架构的代码与复杂任务导向大模型 IQuest-Q1,该模型总参数约 320B、激活参数仅约 15B,在代码生成、终端操作、智能体任务等多项评测中表现均衡,并展示了从前端交互、游戏开发到强化学习训练调试等场景的可交付能力。

在 AI Native 的公司工作,是一种什么体验?(在新窗口打开)
Lovable 员工 Elena Verna 以第一手视角记录其在 AI Native 公司工作的真实体验,涵盖无职级头衔、高影响力个人贡献者、低会议文化、疯狂节奏、模糊职责边界、持续组织重组、主动用 AI 自动化自身工作以及 AI agent 作为同事等独特现象。



