
Know AI. See What’s Next.
第 1 张,共 5 张:MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做
最新资讯流

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元(在新窗口打开)
LLaVA 于 2023 年提出,通过低成本对齐高效连接开源视觉编码器与大语言模型,使「看图 — 理解 — 对话」的多模态能力在开放生态中得以普及,明显缩小了与顶级闭源模型的差距,标志着开源多模态范式的重要里程碑。

只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题(在新窗口打开)
对于大模型的强化学习已在数学推理、代码生成等静态任务中展现出不俗实力,而在需要与开放世界交互的智能体任务中,仍面临「两朵乌云」:高昂的 Rollout 预算(成千上万的 Token 与高成本的工具调用)和极其稀疏的「只看结果」的奖励信号。

别被提示词优化困住!用DSPy.GEPA把Prompt做成可演进的工程(万字长文)(在新窗口打开)
写给正在落地 AI 产品的工程师。一些代码直接可改造复用;另一些,是我踩坑后的经验之谈。

推理速度10倍提升,蚂蚁集团开源业内首个高性能扩散语言模型推理框架dInfer(在新窗口打开)
近日,蚂蚁集团正式开源业界首个高性能扩散语言模型(Diffusion Large Language Model,dLLM)推理框架 dInfer。

英伟达AI超算3999开售,「掌心之中」可部署所有大参数开源模型!(在新窗口打开)
英伟达面向个人的AI超算DGX Spark已上市!128GB统一内存(常规系统内存+GPU显存),加上允许将两台DGX Spark连起来,直接可以跑起来405B的大模型(FP4精度),而这已经逼近目前开源的最大模型!如此恐怖的实力却格外安静优雅,大小与Mac mini相仿,3999美元带回家!

谢赛宁新作:VAE退役,RAE当立(在新窗口打开)
谢赛宁团队最新研究给出了答案——VAE的时代结束,RAE将接力前行。其中表征自编码器RAE(Representation Autoencoders)是一种用于扩散Transformer(DiT)训练的新型自动编码器,其核心设计是用预训练的表征编码器(如DINO、SigLIP、MAE 等)与训练后的轻量级解码器配对,从而替代传统扩散模型中依赖的VAE(变分自动编码器)。

别Claude Code了,一个国产免费命令行就够了(在新窗口打开)
Claude Code没法用了后,国内大厂纷纷推出国产平替。最近,阿里心流研究团队就悄咪咪地发布了一款终端AI智能体——iFlow CLI,号称是Claude Code最强平替!iFlow CLI可以使用自然语言命令行的形式直接在终端运行,最重要的一点是,专为国内开发者设计,面向个人用户永久免费,没有限流!

Karpathy「疯狂之作」:100美元、4小时,就能训练你自己的「小型GPT」(在新窗口打开)
AI传奇人物、前特斯拉AI总监Karpathy重磅推出全新开源项目「nanochat」,以不到8000行代码复现ChatGPT全流程,只需一台GPU、约4小时、成本仅百美元。该项目在GitHub上线不到12小时即获4.2k星标!

时隔 9 年,黄仁勋再次给马斯克送货上门,跳票大半年的 AI 个人超算终于来了(在新窗口打开)
今天星舰第十一飞圆满收官,没想到黄仁勋也闪现到了现场。 原来,黄仁勋亲自飞到了德州的星际基地(Starbase),在冲天的星舰旁边,就是为了把一台刚出炉的新「核弹」交到了马斯克手上。 这就是大家从年初

OpenAI奥特曼:能被ChatGPT消灭的工作不是真正的工作(在新窗口打开)
你今天的工作,或许并不是真正的工作。这句耸人听闻的言论出自奥特曼与Rowan Cheung最新的采访。在这场长达30分钟的对谈里,除了自己对AI与工作的思考,奥特曼还分享了GPT-6的进展、ChatGPT是否会成为美国版微信、AGI的设想变化、AI未来的交互模式,以及自己被恶搞成Sora热梗的感受。

AI产品在亚洲疯狂增长,开发者们如何抓住注意力涣散的年轻人(在新窗口打开)
根据 Sensor Tower 数据显示,2025 H1 AI 应用的下载量达到 17 亿次,增长 67%,IAP 收入总计达到 19 亿美元,增幅达到 100.6%。在走过了概念验证阶段后,AI 应用正成为一股很强的增长动力,给已经相对平静的应用市场注入了活力。

人类遗忘的难题解法,被GPT-5重新找出来了(在新窗口打开)
人类遗忘的难题解法,被GPT-5 Pro重新找出来了!这事儿聚焦于埃尔德什问题#339,这是著名数学家保罗・埃尔德什提出或转述的近千道问题之一,收录于erdosproblems.com网站。该网站记录了每道题目的当前状态,其中约三分之一已解决,大部分仍待解。

LiblibAI 2.0颠覆上新,目前最全面的一站式AI创作空间来了!(在新窗口打开)
嗨大家好!我是阿真! 7月份我写了一篇关于每个AI生图模型的优劣势的总结,因为工作需要,我针对不同需求会切换很多工具,另外产品更新需要及时测评时不时买个月度会员,单月买的不算在内,当时我经常消费的几个

我去看 NBA 中国赛,结果被阿里云 AI 变成了球队「第六人」(在新窗口打开)
朋友们,以后谁再跟我炫耀他去看 NBA 比赛,只是晒门票和山顶照,我都会笑而不语。 NBA 中国赛时隔六年回归,作为一个老球迷,原本我只想一睹球星的风采,买几件球衣和纪念品在朋友圈炫耀一番。 但接下来

Sora2“复活”已故名人,家属强烈反对(在新窗口打开)
Sora 2的迅速走红,让肖像权问题再次成为焦点。

AI养老,一场针对空巢老人的「精准骗局」?(在新窗口打开)
从“AI围猎”到“AI守护”,这才是AI打开中老年的正确方式。

AI技术滥用调查:“擦边”内容成流量密码,平台能拦却不拦?(在新窗口打开)
一段“AI换脸”的不雅视频,让一位高校导师突然陷入诈骗危机;一张“近乎复刻”的AI克隆照,让白领小雅担心自己的照片被用来制作色情内容;青岛保时捷女销冠和台球运动员王思诺则深陷恶意AI造“黄谣”风波……他们都是AI技术被滥用的受害者。

剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了(在新窗口打开)
为什么大模型,在执行长时任务时容易翻车?这让一些专家,开始质疑大模型的推理能力,认为它们是否只是提供了「思考的幻觉」。近日,剑桥大学等机构的一项研究证明:问题不是出现在推理上,而是出在大模型的执行能力上。

拒绝“熵崩塌”和“熵爆炸”!这项研究让大模型学会“精确探索”,推理成绩飙升(在新窗口打开)
大语言模型在RLVR训练中面临的“熵困境”,有解了!

Z Product|“让AI问出每一个关键问题”:红杉连投两轮的Listen Labs如何用AI重塑400亿市场研究行业(在新窗口打开)
源于真实一线需求,Listen Labs聚焦传统定性调研低效痛点,以AI主持访谈、自动生成报告的方式,重构用户研究工作流。



