
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

灵巧手能帮女友拧瓶盖了!同济清华上海交大等新成果 | CoRL 2025(在新窗口打开)
灵巧手技能+1,能帮女友拧瓶盖了! 不仅如此,还能帮忙挤牙膏、插充电器。 来自同济大学、清华、上海交大、香港大学等研究团队提出面向灵巧操作任务的示教与策略学习新方法KineDex框架—— 真·手把手指导的方式,让人类动作直接传递到灵巧手,并同步采集高保真触觉信息。 结果让星动纪元灵巧手星动XHAND 1成功解锁了各种复杂精细操作。 在瓶盖旋紧、牙膏挤压、注射器按压等九项复杂任务中,KineDex平均成功率达74.4%,且数据采集效率相较于遥操提升两倍以上。 该论文已被CoRL 2025接收。 真·手把手引导灵巧操作学习 当前,机器人学习精细操作(尤其那种需要精确力度控制的任务)的难点在于缺乏高

真正的AI竞争力,藏在大模型“后训练”这一步(在新窗口打开)
当全球的目光还在聚焦基座模型的参数竞赛时,一场更为深刻的变革正在悄然发生——后训练(Post-Training)。

产品经理必读:AI Agent 架构指南(在新窗口打开)
这是一份为正在开发 AI Agent 的产品经理准备的完整指南,介绍了 Agent 架构、编排模式等话题。

AI女演员勇闯好莱坞,却遭全行业怒怼!他们在害怕什么?(深度观察)(在新窗口打开)
这位女演员刚出道 同行就对她大喊:“F**k off!” 文 | 羊羊 编辑 | 羊羊、小小树 在上周的SNL节目中,联合主持人科林·乔斯特讲了一个关于AI的笑话。 据报道,好莱坞的经纪公司有意签约一

后果真实且残酷!哈佛研究揭示AI如何冲击就业市场(在新窗口打开)
两位哈佛学者通过研究6200万份简历和近2亿条招聘职位数据,揭示了AI对就业带来的真实、残酷的冲击:它不是无差别地针对所有人,而是在大量“吞噬”初级岗位,让那些刚刚踏入社会的年轻人,面临着空前陡峭、狭窄的职业起跑线。与此同时,为数众多的普通院校毕业生群体受到的冲击更为显著。

Being-VL的视觉BPE路线:把「看」和「说」真正统一起来(在新窗口打开)
为此,北大、UC San Diego 和 BeingBeyond 联合提出一种新的方法——Being-VL 的视觉 BPE 路线。Being-VL 的出发点是把这一步后置:先在纯自监督、无 language condition 的设定下,把图像离散化并「分词」,再与文本在同一词表、同一序列中由同一 Transformer 统一建模,从源头缩短跨模态链路并保留视觉结构先验。

腾讯开源世界第一生图模型,我总结了16个邪修玩法(在新窗口打开)
讲真,AI生图圈的内卷速度简直离谱。8月底的Nano Banana、9月中的即梦4.0已经把画质和效果卷到了一个新高度,但我还在纠结到底该把谁设为主力工具,因为总觉得他们差点什么:不是出错就是不懂场景。

OpenAI官宣自研首颗芯片,AI界「M1时刻」九个月杀到!联手博通三年10GW(在新窗口打开)
OpenAI终于官宣了!联手芯片巨头博通下场造AI芯片,预计2029年底部署10GW算力。内部已秘密研发18个月,首颗芯片9个月后量产,AI领域的M1时刻将至。

前端危!Gemini 3内测结果获网友一致好评,“有史以来最强前端开发模型”(在新窗口打开)
谷歌下一代旗舰模型Gemini 3未发布便已悄然走红!原因很简单:强,实在是太强了。在国外社交媒体平台𝕏上,一大波网友激动地分享了Gemini 3的内测结果——从曝光的这些案例来看,Gemini 3尤为擅长前端、SVG矢量图生成,而且多模态能力变得更强。

为什么谷歌搜不到「没有条纹的衬衫」|AI 上新(在新窗口打开)
极客公园最近体验了一款叫做 Websets 的 AI 搜索工具。与谷歌搜索不同,Websets 试图理解人类的复杂意图。它并非为日常查询设计,而是专门处理传统搜索引擎难以完成的复杂任务,例如寻找具备特定复合经验的专业人士,或筛选符合多重标准的公司实体。

Zenlayer推出分布式推理平台,加速AI创新全球落地 | Alpha Family(在新窗口打开)
新加坡时间 10 月 9 日,Zenlayer 于新加坡科技周——云与 AI 基础设施展正式发布 Zenlayer 分布式推理平台(Zenlayer Distributed Inference)。该平台作为一站式 AI 即时部署解决方案,专注于在全球范围内为大规模 AI 推理提供高性能支持。

又一批AI社交产品悄悄「死亡」了(在新窗口打开)
又一批AI社交公司与产品悄悄「死亡」了。今年9月,一批AI社交公司发布关停或通知,这之中,既包括大模型明星公司、社交公司等中型企业,如阶跃星辰To C产品「冒泡鸭」、Soul旗下的AI应用「异世界回响」等,也包括一批垂直领域的初创产品,如定位AI情感分析的Lumi、由前苹果设计师Jason Yuan创立的情感陪伴应用Dot等。

大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金(在新窗口打开)
人工智能真是日新月异。早上看到网友的评论:我们已经 0 天没有吸引注意的 AI 领域新突破了。记得三个月前,OpenAI 官宣了他们的推理模型在国际数学奥林匹克(IMO)竞赛中获得了金牌。

告别「解码器饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星(在新窗口打开)
在中国科学院计算技术研究所入选NeurIPS 2025的新论文中,提出了SpaceServe的突破性架构,首次将LLM推理中的P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,系统性地解决了MLLM推理中的行头阻塞难题。

ICLR 2026惊现SAM 3,分割一切的下一步:让模型理解「概念」(在新窗口打开)
说出概念,SAM 3 就明白你在说什么,并在所有出现的位置精确描绘出边界。 Meta 的「分割一切」再上新? 9 月 12 日,一篇匿名论文「SAM 3: SEGMENT ANYTHING WITH CONCEPTS」登陆 ICLR 2026,引发网友广泛关注。

抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o(在新窗口打开)
2B模型在多个基准位列4B参数以下开源第一。 抖音SAIL团队与LV-NUS Lab联合推出的多模态大模型SAIL-VL2。

Bug变奖励:AI的小失误,揭开创造力真相!(在新窗口打开)
扩散模型本该只是复制机器,却一次次画出「六指人像」甚至是陌生场景。最新研究发现,AI的「创造力」其实是架构里的副作用。有学者大胆推测人类的灵感或许也是如此。当灵感成了固定公式,人类和AI的差别还有多少?

为MoE解绑:全新「专家即服务」推理架构发布,超细粒度扩展锐减37.5%成本(在新窗口打开)
近年来,大型语言模型的参数规模屡创新高,随之而来的推理开销也呈指数级增长。如何降低超大模型的推理成本,成为业界关注的焦点之一。Mixture-of-Experts (MoE,混合专家) 架构通过引入大量 “专家” 子模型,让每个输入仅激活少数专家,从而在参数规模激增的同时避免推理计算量同比增长。

腾讯开源强化学习新算法!让智能体无需专家示范就“自学成才”,还即插即用零成本接入(在新窗口打开)
让智能体自己摸索新方法,还模仿自己的成功经验。腾讯优图实验室开源强化学习算法——SPEAR(Self-imitation with Progressive Exploration for Agentic Reinforcement Learning)。

NeurIPS 2025 Spotlight | GeoSVR:稀疏体素的新潜力——超越3DGS系列的高精度三维表面重建(在新窗口打开)
近年来,NeRF、SDF 与 3D Gaussian Splatting 等方法大放异彩,让 AI 能从图像中恢复出三维世界。但随着相关技术路线的发展与完善,瓶颈问题也随之浮现:



