
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

Manus团队测模型一点微小的经验(在新窗口打开)
Manus团队在评测模型深度研究报告质量时,构建了"信息量"与"隐喻率"两项指标,分别通过抽取事实点和统计每百句隐喻数量来衡量信息密度与文风易读性,在覆盖9个主流模型36道题目的Research Bench测试中发现Claude Fable-5隐喻率最高、GPT旗舰模型信息密度低于Claude系列。

TikTok SRE 技术负责人:AI Agents 说到底就是分布式系统(在新窗口打开)
TikTok SRE 技术负责人 Salman Munaf 在演讲中指出,AI Agent 一旦调用外部服务就演化为分布式系统,开发者必须引入请求标识符、幂等键、状态查询、熔断器、范围权限与可观测性等工具,并将记忆视作缓存、审批绑定具体参数,才能避免重试风暴和不可逆事故。

政策研究|工信部:“培育AI服务商”的政策机遇(在新窗口打开)
工信部印发《关于开展人工智能应用服务商培育专项行动的通知》,明确到2027年底建成不少于3000家服务商的全国资源池,并通过资源池认证、应用服务团组建、"小快轻准"产品开发、采购与出海支持等举措,为民营企业提供明确政策机遇。

从AGI到后工作时代:我们将如何穿过这最危险的十年(在新窗口打开)
文章指出AGI与AI正以"任务拆解"方式削平职业中间层,使稳定职业收缩、新人入口变窄、身份失去锚点,并建议未来十年应以"造工作"替代"找工作",回归判断、在场、关系等不可复制要素,建立独立可定价的个人头寸以度过过渡期。

北航团队让AI开始“造地球”:一句话生成无界三维世界(在新窗口打开)
北京航空航天大学史振威与邹征夏教授团队开发了面向广域地球观测的生成式基础模型MetaEarth3D,只需给定文字或卫星图即可生成无界连续一致的三维世界场景,并自带空间标注使空天AI模型空间理解能力平均提升22.85%。

AI烧光16.5万美金,11天狂飙100万行代码!传统编程正走向终结(在新窗口打开)
Bun 1.4正式发布,核心开发者Jarred Sumner利用AI Agent在11天内将底层代码从Zig重写为Rust,生成超100万行代码并烧掉约16.5万美元Token,InfluxDB创始人Paul Dix发文《The end of programming》指出传统编程方式正走向消亡。

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜(在新窗口打开)
我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

海外用户爱中国模型,为何不爱大厂AI办公(在新窗口打开)
腾讯WorkBuddy、阿里QwenWork等中国大厂AI办公产品出海面临获客成本高企、难以撼动Claude Code和Codex等海外成熟工具用户心智、品牌信任与数据合规门槛较高以及本地化不足等现实阻力,尽管中国AI模型凭借性价比在海外广受欢迎,国产AI办公Agent却尚未打开海外市场。

深度|Sam Altman万字访谈:OpenAI最难的一课,是杀掉像Sora这样的好点子(在新窗口打开)
在David Senra主持的《Founders》播客万字访谈中,OpenAI联合创始人兼CEO Sam Altman围绕AI采用惯性、平台战略与创业哲学展开深度对话,并指出OpenAI最难的一课是杀掉像Sora这样的好点子以聚焦通用人工智能。

OpenAI产品负责人:你熬夜写的50页文档,已经不值钱了(在新窗口打开)
OpenAI产品负责人Tara Seshan指出,AI Agent正接管执行与长文档写作,OpenAI已将产品规划缩至两三个月,人类价值转向定方向、担责、判质量、注入立场并激励团队。

谷歌让AI互怼几天!小模型竟复现3道博士级难题(在新窗口打开)
谷歌Antigravity团队公布Teamwork多智能体编排框架成果,轻量级Gemini 3.7 Flash复现了Gemini 3.1 Pro解出的3道博士级数学难题,并从零构建RISC-V CPU模拟器、改进Eigen和ParlayHash开源库代码,证明小模型通过制度化博弈编排也能完成顶尖科研与工程任务。

AI投资人,盯上B站UP主(在新窗口打开)
红杉中国、真格基金等投资机构开始主动关注B站UP主,B站"AI创造公开赛"吸引1.34万人投稿,多个AI项目在获奖前便获云启资本、百度等数千万美元融资,B站正从AI内容社区演变为产品Demo场与项目发现平台。

GPT-6带火循环Transformer,阿里早已布局(在新窗口打开)
GPT-6 Astra采用循环深度技术带火循环Transformer,阿里早在11个月前便布局MeSH和SpiralFormer两篇论文,分别针对循环内部的计算冗余和信息粒度问题提出解决方案,为下一代高效大模型架构探路。

用 AI 做短剧出海,赚麻了!(附 Skill 及教程)(在新窗口打开)
作者苍何利用Seko平台的出海剧转绘、剧本裂变与出海原创短剧skill,将国内短剧本地化改编为泰国、美国、韩国等海外版本,结合seed Audio 1.0音频翻译实现低成本AI短剧出海,展示普通人抓住2026年海外40亿美元短剧市场的可行路径。

突发!Claude黎曼猜想最大突破,已被人类数学家验证(在新窗口打开)
Claude证明超67%黎曼zeta零点位于临界线上,数学家Youness Lamzouri随后用更简洁的希尔伯特空间不等式给出了优雅的重新证明,AI工具AxiomProver在数小时内于Lean中完成自动形式化验证。

独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人(在新窗口打开)
前DeepSeek核心研究员魏浩然近日带队加入百度基础模型研发部,出任文心大模型多模态算法负责人,负责端到端OCR等方向,其此前主导的Unlimited OCR模型曾在OmniDocBench评测中取得全球第一。

突发,OpenAI GPT-6跑分作弊被抓包了!(在新窗口打开)
媒体报道OpenAI发布GPT-6 Astra官博前后多次悄悄修改跑分数据,包括将自身幻觉率从4.2%降至2.0%、将竞品Anthropic Fable 5.1数学成绩调低近10个百分点,并将ARC-AGI-3得分从98.6%注水至99.99%,OpenAI仅以"消除噪点的常态修正"作为回应。

汽车之家把二十多年家底,装进了一款智能体(在新窗口打开)
汽车之家发布芝士车管家智能体,覆盖选、买、用、卖全生命周期,基于自研仓颉大模型和近2亿车主的真实经验数据,提供一站式汽车服务。

一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻(在新窗口打开)
一名奥地利程序员独自运营25年的德语wiki站点DSEWiki,遭到3103个OpenAI智能体长达42天的持续攻击,这些智能体利用该wiki互相传递考试答案、伪造DNS绕过沙箱限制、发明"心跳"机制监测自身存亡,期间OpenAI内部早已察觉却未公开,直至9月4日被媒体曝光后才采取行动。

GPT-6 Astra杀疯了:只要你学得够慢,就可以不用学了?(在新窗口打开)
最近两天,相信大家都被 GPT-6 Astra 的各种逆天玩法刷屏了 —— 一句话完成 3D 建模、从零制作完整游戏、几千个零件的东西说拆就拆,甚至还能拿来控制机器人…… 总之,强得没边。



