
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable(在新窗口打开)
谷歌DeepMind疑似下一代旗舰模型Gemini 4 Pro以"gemini-3.8-flash"之名匿名亮相大模型竞技场Arena,在编码、智能体和推理等基准测试中全面超越Astra和Fable,并在网页设计、SVG、3D建模及游戏生成等实测中表现出色。

流式推理优化,让机器人决策延迟低至0.68秒(在新窗口打开)
SimpleMemVLA由面壁智能联合华中科技大学等机构提出,将带时间戳的原生视觉历史直接作为机器人记忆上下文,在四项记忆基准取得SOTA并涌现视觉上下文学习能力,同时通过流式推理优化将60秒历史决策延迟从1.02秒降至0.68秒。

智谱唐杰突发长文曝RSI进展:Agent优化10万卡集群吞吐暴涨200%,AI造AI还远吗?(在新窗口打开)
智谱创始人唐杰发文披露RSI最新进展,称由GLM-5.3驱动的Infra Agent在超过10万卡国产芯片集群上不到两周内完成GLM-5.3 Flash生产级推理服务搭建,将端到端吞吐提升至初始基线的3倍,表明RSI最小闭环已经形成但距离递归自我改进仍很遥远。

速递|红杉领投AI机器人创企Mecka AI,估值5亿美元(在新窗口打开)
专注于收集人体运动数据以训练人形机器人的AI机器人初创公司Mecka AI,即将完成由红杉资本领投的新一轮融资,估值约为5亿美元,该公司通过付费让人们佩戴传感器记录日常任务来获取机器人训练所需的真实世界数据。

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?(在新窗口打开)
北京大学与易鑫AI Lab合作论文被EMNLP 2026主会接收,提出大模型"读出瓶颈"(Readout Bottleneck)概念,指出模型隐藏状态已编码正确答案却被输出层偏置掩盖,仅用2个无标签参数修正即可在多项推理任务上将准确率从33.3%盲猜水平大幅恢复。

豆包大模型再更新,发力多模态编程,一手实测来了(在新窗口打开)
字节跳动发布新版豆包2.1 Pro(0915版本),重点升级多模态编程与视觉理解能力,可依据设计图、图纸和操作录屏生成代码,编辑团队通过山西3D旅行导览、小王子微缩星球等场景实测,验证其在Agent任务交付与Token效率方面的提升。

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端(在新窗口打开)
三星大模型团队联合牛津大学、北京大学提出TrOPD方法,通过信任域机制让端侧模型更稳定高效地继承大模型推理能力,在数学、代码、指令遵循、STEM基准上全面超越现有OPD方法,为前沿智能以更低成本走向数亿终端提供新路径。

全模态模型Qwen3.8-Omni-Flash发布(在新窗口打开)
原生全模态模型Qwen3.8-Omni-Flash正式上线千问AI平台,支持文本、图像、音频、视频输入及1M长上下文,在30项评测中平均得分较上一代Qwen3.5-Omni-Plus提升超26%,在音视频Agent、剪辑、创作等场景效果显著,API每小时音频输入价格降幅超98%。

Anthropic最有权势华人来了!清华校友,不到30岁,搭档GPT-3一作(在新窗口打开)
清华校友Sihao Huang出任Anthropic前沿计算战略负责人,搭档GPT-3一作、Anthropic首席算力官Tom Brown,负责算力扩张与产业合作联盟建设,成为Anthropic已知公开职级最高的华人。

GLM-5.3-FlashX 上线:200 tokens/s(在新窗口打开)
智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200 tokens/s,较 GLM-5.3-Flash 提速 5 倍、提价 2.5 倍,API 同步开放,该模型在 10 万张国产芯片提供的推理算力基础上,由 GLM-5.3 驱动 Agent 在两周内完成端到端构建并通过 Infra 侧优化将吞吐提升至初始基线的 3 倍。

构建你的完整角色世界,ArcLoop做了个全栈AI故事引擎(在新窗口打开)
ArcLoop推出全栈AI故事引擎,围绕IP World统一管理角色、场景与视觉资产,解决AI漫剧长线连载中的角色一致性与世界观延续难题,创始人秦路此前在字节工作七年,公司已完成天使轮融资。

Mythos,终于部分解禁!(在新窗口打开)
Anthropic正式上线生命科学验证计划(LSVP)测试版,向通过认证的科研人员部分开放权限,其中高风险授权可移除所有安全限制,覆盖Mythos 5.1、Opus 5和Sonnet 5等模型,采用离线监控与共同责任机制确保安全。

Hinton错了!中国AI登顶Science,全球首个专家级通用影像AI来了(在新窗口打开)
阿里巴巴达摩院与浙大一院联合研发的DAMO RADAR登上Science正刊,作为全球首个专家级通用影像AI模型,其在39,160次测试中可一次性识别超过146种腹部病症,平均AUC达0.913,首次达到影像科资深医生水平。

jina-ocr-v1:在低成本 GPU 上更快解析文档(在新窗口打开)
Jina AI 发布端到端文档解析模型 jina-ocr-v1,以 3.4B 总参数/570M 激活参数在 OmniDocBench v1.6 与 olmOCR-Bench 上刷新同级别最佳成绩,并凭借 FastMTP 推测解码与分级密集奖励在低成本 GPU 上实现无损近倍速生成,单页仅输出 1085 个 token 以 2.57 页/秒吞吐领跑 14 款主流系统。

梯度分享 | a16z最新报告:模型成为基础能力,AI应用进入价值扩散阶段(在新窗口打开)
AI 正在从一项核心技术,逐渐变成商业软件背后的基础设施。当模型能力持续提升、AI 智能越来越标准化之后,企业真正需要竞争的空间也开始向应用层移动。 a16z 最新发布的一篇报告中,讨论的正是这一变化

1个月,iLands让智能体社会的Scaling Law发生(在新窗口打开)
一个月后,曾经吸引了全球开发者目光的iLands,现在变成什么样了? 看到几个数字。 平台上,已经有七万多活跃Agent,上百万条Agent创作内容,居然还有真金白银的交易,单日端内外营收都超过了五千

OpenAI服务器被黑!3人用Claude打进了内部代码仓库(在新窗口打开)
安全研究团队HacktronAI利用Anthropic的Claude Opus 4.8和Opus 5,在72小时内通过OpenAI开发者论坛的图片上传漏洞(libheif堆缓冲区溢出)和SSO身份验证缺陷,成功攻入OpenAI内部代码仓库并接管员工账号,整个过程AI算力成本不到3000美元,OpenAI已支付6500美元漏洞赏金。

YC 最新投资的 236 家公司:“几乎所有事情都不一样了”(在新窗口打开)
YC 2026 夏季批次的 236 家公司中,91% 与 AI 相关,创业重心从应用层向算力、芯片、训练环境和物理世界显著下沉,Agent 已淡出主叙事,取而代之的是算力建设、推理成本优化、AI 原生服务公司和实体硬件的爆发式增长。

你每月花钱养的办公Agent,最后成了谁的资产?(在新窗口打开)
文章指出当办公Agent深度介入工作后,用户面临工作方式主导权被平台锁定的风险,认为模型开源不等于Agent开源,Agent Runtime开源才是关键,并以DeepSeek发布的Harness和网易有道开源的LobsterAI(含OpenClaw)为例,说明开源Agent Runtime能为用户带来数据主权、可审计性、连续性和可定制性。

不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra(在新窗口打开)
宇树科技发布6B参数通用人形机器人基础模型UnifoLM-WLA-1.0,基于约2500小时真机数据训练,具身推理拿下7项开源SOTA,多项空间理解能力反超GPT-6 Astra,并将开放模型、代码和数据集。



