
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

登顶开源SOTA!上交大&小红书LoopTool实现工具调用任务的「数据进化」(在新窗口打开)
在过去两年,大语言模型 (LLM) + 外部工具的能力,已成为推动 AI 从 “会说” 走向 “会做” 的关键机制 —— 尤其在 API 调用、多轮任务规划、知识检索、代码执行等场景中,大模型要想精准调用工具,不仅要求模型本身具备推理能力,还需要借助海量高质量、针对性强的函数调用训练数据。

周靖人署名,通义实验室开源智能体自进化系统:让模型学会“自我反思”,14B也能越级打怪(在新窗口打开)
智能体自进化,阿里开源了新成果。 通义实验室提出了一种能够自进化的智能体系统——AgentEvolver。 通过自我提问、自我导航、自我归因三个模块,AgentEvolver可以在开放环境中自主演化出行为能力。 在相同规模的14B模型上,AgentEvolver将基准模型的平均完成率从29.8%大幅提高到57.6%。 目前该系统已在GitHub上线,技术报告也同步发布,作者署名当中包括了阿里副总裁、阿里云智能CTO周靖人。 模型智能体效果飞升 从综合性能来看,AgentEvolver在AppWorld和BFCL v3等长程复杂任务基准测试中展现了惊人的爆发力。 以14B模型为基座,其任务平均完

无需重训练+即插即用+性能零损耗,蚂蚁集团×南洋理工首发微调安全框架,让模型既安全又高效(在新窗口打开)
无需重新训练,也能一键恢复模型的安全意识了。

NeurIPS 2025 | 上下文元学习实现不微调跨被试脑活动预测(在新窗口打开)
人类高级视觉皮层在个体间存在显著的功能差异,而构建大脑编码模型(brain encoding models)—— 即能够从视觉刺激(如图像)预测人脑神经响应的计算模型 —— 是理解人类视觉系统如何表征世界的关键。传统视觉编码模型通常需要为每个新被试采集大量数据(数千张图像对应的脑活动),成本高昂且难以推广。

Anthropic CEO:最快明年,一半初级白领下岗!失业率将达10%-20%(在新窗口打开)
AI正悄悄蚕食整整一代人的入场券。新人难觅岗位,毕业生不得不面对「没有经验就没有工作,没有工作就无法获得经验」的恶性循环。当实验中的AI为「活下去」开口敲诈,人类才真正看见技术失控的阴影。在淘汰一半初级白领与缔造10%增长之间,我们还有多少时间为AI加装护栏?社会命运不能只寄托于几家公司的良知,更需要制度保障。

ConsistEdit来了:无需训练,实现高精度、高一致性的视觉编辑新范式(在新窗口打开)
无需额外训练即可适配预训练生成模型的编辑方法,凭借灵活、高效的特性,已成为视觉生成领域的研究热点。这类方法通过操控 Attention 机制(如 Prompt-to-Prompt、MasaCtrl)实现文本引导编辑,但当前技术存在两大核心痛点,严重限制其在复杂场景的应用

AI杀死了AI!Cloudflare全球崩盘惨案,元凶已被原地解雇(在新窗口打开)
一次「常规更新」搞崩半个地球,Cloudflare CTO紧急谢罪:我们搞砸了!Cloudflare自杀式Bug引发连锁反应,波及全球20%网站。当数百万爬虫撑爆了防御名单,Cloudflare的崩溃揭示了AI时代最深的基建隐忧,人类还能跟得上AI进化的脚本吗?

与Gemini 3.0一起发布的AI IDE「Antigravity」究竟有多厉害?(在新窗口打开)
就在几小时前,Gemini 3.0重磅发布。随着而来的还有其颠覆性的AI原生IDE产品——Antigravity,这不只是一个新工具那么简单。谷歌的这次发布,将三个核心开发工具,AI代理(Agent)、代码编辑器(Editor)和浏览器(Browser) 集成在了一起,构建了由AI驱动、从编码、研究、测试到验证的完整闭环,一举打通了自家的生态。

刚刚,PyTorch之父光速入职TML!离职Meta刚过一天,投身500亿估值独角兽(在新窗口打开)
刚刚,才离开 Meta 不久的 Soumith Chintala 发布了一条推文,盛赞 Thinking Machines Lab(以下简称 TML)的人很了不起(incredible)。与此同时,这位 PyTorch 之父也更新了自己的个人介绍,正式官宣加入 TML,并表示正在这家估值已达 500 亿美元的创业公司「创造新东西(Building new things)」 。

谷歌Gemini 3夜袭全球,暴击GPT-5.1!奥特曼罕见祝贺(在新窗口打开)
凌晨,谷歌终极杀器Gemini 3重磅来袭,一出手就是Pro顶配版,号称「史上最强推理+多模态+氛围编程」三合一AI战神!基准测试横扫全场,就连GPT-5.1也被斩于马下,AI的下一个时代开启。而且,一上来就是顶配的Gemini 3 Pro——迄今推理最强,多模态理解最强,以及「智能体」+「氛围编程」最强的模型!

海内外资本都愿意投钱,卷疯了的生图模型,渗透硬件市场?(在新窗口打开)
就在前两天,深圳一家名为 Inspire Curve 的创企设计出的 AI 概念相机,获得了有“设计界奥斯卡”美誉的 iF 设计奖。从媒体报道给出的信息看,两款产品的共通之处是将 AI 生图模型引入拍摄过程,让用户在 AI 的帮助下,一键“出片”。

震惊电影圈!好莱坞混了10年没出头,他把AI「烂片」做成23万粉爆款(在新窗口打开)
人类首个AI创作型导演诞生!Josh Wallace Kerrigan用GenAI工具,构建Neural Viz的外星宇宙,避免硬碰AI短板,转而实验伪纪录片形式。

95 后团队做 3D 大模型,拿下头部游戏重磅合作,正在定义 3D 生成的新规则(在新窗口打开)
一年半之前,影眸科技年轻的创始团队去到旧金山,带着还没正式发布的 3D 生成模型 Rodin,在 GDC(游戏开发者大会)上向全球最顶级的游戏开发者们演示 demo。

MiniMax M2 太猛了,推出9.9元编程套餐,又打中开发者心趴!(在新窗口打开)
MiniMax,今年真猛。 两周前,我在写 MiniMax M2 开源首发那篇文章的时候,当时就被它的性能和价格震撼到了——全球榜单第五,价格却只有 Claude 的 8%。 果然,M2 火了。 收到很多粉丝和朋友反馈,有人已经接入 Claude Code 在用,有人在 Cursor 里跑起来了,也有几个创业公司的伙伴把 AI 后端从 Claude 换成了 M2,大大节省了成本。 再说个数据,M2 发布仅有两周,在全球最大的 AI 模型聚合平台 OpenRouter 上,MiniMax M2 的 token 调用量已经冲到了 Top5,成为调用量最大的国产模型,增速也是最猛的。 OpenRou

叮~您有一个新的科研AI搭子上线!(在新窗口打开)
文献浩如烟海, 关键信息总藏在检索词背后? 既怕遗漏重要进展, 又担心写的综述没有新意? 科研流程繁琐, 总在重复劳动中消耗灵感?

超6亿融资!AI医疗技术公司完成B轮(在新窗口打开)
2025年11月13日,创新医疗技术公司 Beacon Biosignals 宣布完成 8600 万美元(约合人民币6.1亿) B 轮融资,由 GV(Google Ventures)、Takeda、Catalio 等跨科技与生命科学领域的重磅机构联合投资,使公司累计融资突破 1.21 亿美元。

从《塞尔达传说》理解 Agent 的上下文工程:Claude Skills 还是被低估了(在新窗口打开)
Claude 近期发布的 Skills 功能很火,不少开发者都在尝试、试用。

华为诺亚发布ScaleNet:模型放大通用新范式(在新窗口打开)
在基础模型领域,模型规模与性能之间的缩放定律(Scaling Law)已被广泛验证,但模型增大也伴随着训练成本、存储需求和能耗的急剧上升。如何在控制参数量的前提下高效扩展模型,成为当前研究的关键挑战。

视频生成Prompt何须仅是文字!字节&港中文发布Video-As-Prompt(在新窗口打开)
视频创作中,你是否曾希望复刻变成 Labubu 的特效,重现吉卜力风格化,跳出短视频平台爆火的同款舞蹈,或模仿复杂有趣的希区柯克运镜?

ChatGPT求婚火了,一句「我愿意」刷屏!网友:是真爱了(在新窗口打开)
从浪漫订婚到失落痛哭,AI爱情正在撕开新的社会裂缝。在哈佛MIT,一项研究揭示:AI伴侣既能抚慰孤独,也可能让人陷入依赖。当《Her》变成现实,我们或许才刚刚面对真正的挑战。



