
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

还记得龙虾User.md吗「个性化」和记忆究竟能在多大程度上影响LLM的输出?UIUC评测(在新窗口打开)
个性化在通用AI产品中一直是个加分项。无论是ChatGPT、Gemini还是Claude,还是今年的Openclaw、Harmes都把记忆和个性化当成核心卖点,理由是它能提高可用性、参与度和用户满意度。学术界对个性化的研究,也几乎全部集中在"如何做得更好、更准、更符合用户口味"上。

V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维(在新窗口打开)
崔添翼最近在 X 上刷屏有点多。9 月 9 日,这位今年 3 月加入 DeepSeek、负责 Agent 运行和评估基础设施的 Harness 团队成员发推称,V4.1 Flash 在性能、费用、速度和总用时等方面全面超过 V4 Pro,因此 V4.1 Flash 上线后、V4.1 Pro 上线前,所有发往 V4 Pro 的请求都会被路由到 V4.1 Flash,按 Flash 的价格计费。

大模型全是演技派!AI教学的正确方式:用真实数据训出60个数字学生(在新窗口打开)
AI教师已经可以完成不少单次教学任务。 一道数学题,它能拆解步骤;一篇英文作文,它能指出语法问题;一盘棋,它也能讲出下一步思路。很多场景里,模型输出已经足够像一位耐心助教。 但教学效果不能只看教师端。学生听完之后有没有改正错误,是否只是照着提示走,同一句讲解对不同学生是否产生不同效果,这些都发生在学生端。 AI教师如果要学习个性化指导,也需要反复观察学生反应。 现实里,这些反应主要来自human study。每次调整教学策略,都要组织学生参与,收集交互,再由人工评估。 AI模型可以快速更新,但教育反馈的获取速度受human study实验周期限制。 AI tutor需要学生反馈来改进教学,但真

深度|GPT-6遇上实时视频,AI游戏和互动内容迎来新赛季(在新窗口打开)
一周之内大语言、图片、视频模型都迎来新赛季:OpenAI的GPT-6 Astra让编码 Agent更好地使用游戏引擎和Blender,自己改场景、自己跑、自己测;GPT-image-2.5上线,更快更强,图片编辑和关键帧动画显著提升;fal和Yoroll分别发布 H3 MaxTurbo和H3 Superfast后训练加速模型,5秒视频3秒内推理,实时生成和互动玩法纷纷涌现。

ECCV 2026 | AgentVLN:让机器人导航进入Agent时代(在新窗口打开)
近年来,视觉语言模型(Vision-Language Model, VLM)在图像理解、语义推理等任务中展现出了强大的能力。然而,当这些模型真正进入物理世界,让机器人根据一句自然语言指令完成自主导航时,仍然面临巨大挑战。

WorkBuddy丝滑配飞书,看完直呼我是BB大天才?!(在新窗口打开)
This is B&B in your House. 有一说一·, 现在的AI办公产品真的非常非常卷,卷生卷死,卷到可怕。

黄仁勋三次断言翻车!CUDA护城河,被谷歌一行代码凿穿(在新窗口打开)
英伟达死守的推理性价比神话,碎了。 就在刚刚,SemiAnalysis发布了谷歌第七代TPU Ironwood的首份第三方推理性能测算。 在完全对等的模型负载下,TPU的每美元性能最高领先英伟达B200达50%,对B300的领先幅度更是逼近翻倍的96%! 外部TCO口径下每百万token成本 vs 交互速度 换算成业界最敏感的每百万Token成本,差距触目惊心。 TPU仅需0.181美元,B200为0.222美元,B300则高达0.276美元。 更戏剧性的,是时间。 今年4月,黄仁勋在Dwarkesh播客上宣称TPU与Trainium都不敢来跑分。他甚至公开鼓励挑战者使用InferenceMA

GPT-6 Astra,限时免费!我已爽玩(在新窗口打开)
AI大模型评测平台Arena宣布用户可在直接模式中限时免费使用GPT-6 Astra(仅限medium级别),大量开发者涌入体验开发游戏,目前该模型在Agent Arena榜单中整体排名第二、前端网页开发排名第一。

发现一个逆天开源项目!直接把所有Agent的记忆打通了(在新窗口打开)
短短半年,我电脑里已经装了七八款Agent。但真正常用的只有那么一两款。其它的尝鲜后都慢慢吃灰了…

苹果国行 AI 没有来,但新 Apple Watch 先迈入了个人 AI 时代(在新窗口打开)
曾几何时,Apple Watch 和 AirPods 被苹果定义为「配件」类产品。

不用刷照片,也不用聊天,这个 AI 每周三晚上 7点直接给你安排一场约会(在新窗口打开)
有多少人知道或者玩过人人网/校内网?绝对不是要蹭孙割流量……

国产世界模型EchoWM开源!会发声的「可探索世界」来了(在新窗口打开)
进入到 2026 年,可交互世界生成面对一道更难的考题:AI 生成的世界能否经得起用户反复探索?一扇门画得逼真,只是起点。往前走,它要自然靠近;穿过走廊再回头,它还应该留在原来的位置。用户每一次移动、转身和折返,都在检验模型是否有能力记住已经生成的世界。

实测神秘模型Omen Alpha:我用它25分钟速搓“牛来”版YouTube(在新窗口打开)
到底是谁家的模型? 智东西9月9日报道,近日,有一款名叫Omen Alpha的匿名模型突然出现,并凭借其超高性价比迅速引起热议。 上线5天后,在Muse Spark 1.3 Contributor这款免费模型的冲击下,依然高居OpenCode调用量榜单第七,开发者纷纷猜测这是谁家的新模型,有网友评论“又是来自东方的神秘模型”。 在社区测试中,不少人一致的反馈就是“快”, 有开发者用Omen Alpha仅花了1小时30分钟就完成了一个简易3D世界的建模,而且效果相当好。 与之对比,该开发者用GLM 5.3 Flash和GPT 5.6 Luna以同样的提示词进行开发,用时接近3小时,但几款模型的开

一个27岁的AI研究员从Anthropic辞职了,因为他担心AI会导致人类灭绝。(在新窗口打开)
昨天呢,我在X上看到了一条流量已经过了1亿的帖子。

DeepSeek V4.1 Flash 开源:全新架构(在新窗口打开)
刚刚,DeepSeek 开源了 V4.1 Flash,原生支持视觉理解,也是全新架构系列中最小的一款模型,550B 总参数,输入时激活 8B,输出时激活 16B(你没看错,输入输出激活不同)

吹爆开源!RunningHub让MiniMax H3满血提速12倍,本地部署照样起飞(在新窗口打开)
RunningHub推出开源的H3 Lightning加速方案,在保留BF16满血精度的前提下使MiniMax H3视频生成速度提升约12倍,依托RH后训练加速模型、SageAttention2等工程优化并针对无NVLink的PCIe多卡环境调优,目前已全部开源至GitHub,支持创作者本地部署。

WalkingLab:AI 时代的开源实验室(在新窗口打开)
WalkingLab 是由清华大学与香港大学团队发起的开源非营利实验室,专注真实世界 AI 与项目制学习,成立五个月已推出涵盖工程实践、强化学习和大语言模型的三门核心课程,累计获超 20,000 GitHub Star 并登上 Hacker News 首页,致力于通过真实项目连接课程、论文与工程实践,加速 AGI 到来。

OpenAI 暂停200美元Pro新订阅!(在新窗口打开)
OpenAI因GPT-6 Astra算力需求激增,于9月10日正式暂停200美元/月ChatGPT Pro档新订阅与升级,其他套餐及现有用户不受影响。

OpenAI这是拿千禧年难题当Benchmark刷啊。。。(在新窗口打开)
《纽约时报》最新追访,补出了这场冲突中此前没有披露的细节。

中科院×字节提出直播间模拟器:让大模型还原用户如何被环境一步步改变 | EMNLP'26(在新窗口打开)
大模型在直播场景模拟用户行为,理解真实的社交动态和风险演化,是当前一个非常热门的研究话题。



