
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

独家丨千问 app,阿里要怎么做中国的 “ChatGPT”(在新窗口打开)
今年阿里第三次集中力量办大事。 在科技公司大建 AI 的叙事里,阿里之前更像美国的亚马逊、微软 —— 没有微信、抖音那样的全民流量入口,AI 投入选择偏向企业客户,不断买卡建算力中心,以云计算业务抓住千行百业对 AI 的渴望。 过去几年,阿里在 AI 方面的主要进展也不在应用层 —— 入股多家中国头部大模型创业公司、自研的 Qwen 系列大模型在诸多测试赢过其他开源模型、阿里云加速增长。但 AI 助理 “千问 app” 在 11 月 17 日正式宣布公测说明阿里想要更大的剧本。 新的千问应用明确对标 ChatGPT 最新的 5.1 版本。它由此前的通义 app 和夸克 AI 对话助手升级而来,

这些大神在Meta的论文看一篇少一篇了(在新窗口打开)
离开Meta的大佬们,留下作品还在陆续发表,今天轮到田渊栋。

GPT-5败下阵,这款中国AI拿下全球第一,众多医生已在用它做诊断(在新窗口打开)
在多数基层门诊里,一个医生往往要从早忙到晚,患者一拨接一拨。

用AI帮用户自信开口,AI教育产品Voice Image ARR破千万美元(在新窗口打开)
「Voice Image」创始人 Nick Lahoika 出生在白俄罗斯,后来移民到爱沙尼亚才开始学习英语,跨语言的生活环境让他在很长一段时间内都对表达缺乏自信,直到遇到了一位专业声音教练。他才意识到表达是可以训练的,这也成为其创业的起点。

前字节算法负责人陈志杰创业项目Verdent AI完成融资,估值或高达2亿美元(在新窗口打开)
根据投资实习所的报道,前字节跳动算法负责人陈志杰创立的 Verdent AI 近期完成了由腾讯领投、红杉中国等老股东跟投的 A 轮融资,金额在数千万美元,估值或已突破 2 亿美元。这使 Verdent

18岁华人开源成果,火爆具身智能赛道(在新窗口打开)
具身智能的Scaling Law正蓄势待发。

入侵30家大型机构、Claude自动完成90%?Anthropic 被质疑,Yann LeCun:他们利用可疑的研究来恐吓所有人(在新窗口打开)
上周,来自 Anthropic 的研究人员表示,他们最近观察到“首个由 AI 协同操作的网络攻击行动”,在一次针对数十个目标的攻击活动中,他们检测到有黑客使用该公司的 Claude AI 工具参与行动。不过,外部研究人员对 Anthropic 这一发现的评价要谨慎得多。

李飞飞站队LeCun,AGI全是炒作!80分钟重磅爆料出炉(在新窗口打开)
世界模型,着实有点火!今天,李飞飞重磅访谈放出,从AI革命兴起到下一个智能前沿——具备空间智能的世界模型。一场访谈,可以窥见AI教母关于AI未来的深刻洞察。

AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出(在新窗口打开)
在号称「史上最严管控AI」的顶级会议ICLR 2026上,评审区却悄悄被大模型攻占。每五条审稿意见里,就有一条几乎全由AI一键生成。当作者怀疑评审是机器人写的、审稿人又怀疑论文是模型拼的,同行评审这台「科学秩序的发动机」,正一点点滑向一场没人承认、却无处不在的自动化实验。

Google 年度最强 AI 偷跑!一个电风扇动画引发疯传,Gemini 3要给GPT-5.1上强度了(在新窗口打开)
前几天 nano banana 2 的泄漏版本,正在网上被疯狂转载,奥特曼眼看着流量不能被 Google 再抢了去,一点预告都没有,直接就发布了 GPT-5.1。

深度|00后AI明星初创Cluely CEO谈传播:初创公司死于无人发现(在新窗口打开)
那时候我已经知道——我真的懂得怎么让一群人看到某个东西,所以我们想:“那就选一个最宏大的idea来做吧。”于是,就有了Cluely。

Nature子刊:港大等首提下一代AI硬件系统,能耗锐减57.2%(在新窗口打开)
港大、港科大与西电团队登上Nature子刊,破解AI芯片核心难题。他们攻克存算一体架构中模数转换器(ADC)这个占能耗87%的「黑洞」,利用忆阻器可编程特性打造能自适应数据分布的「智能标尺」,使AI芯片功耗锐减57.2%,面积缩小30.7%,为下一代高效AI硬件系统开辟新路。

不懂绘画也能做动画,OiiOii AI 玩法抢先分享!(在新窗口打开)
嗨大家好!我是阿真! 继续为大家带来一些有趣的好玩的工具分享。

两个月破 300 万用户,Agnes AI 刷新 Instagram 与 Snapchat 增长纪录(在新窗口打开)
Agnes AI 在 9 月移动端 App 推出后,增长势能全面爆发:短短两个月新增注册用户 300 万,日活跃用户突破 20 万。而作为对比,Instagram 达到首个百万用户用了 2.5 个月,Snapchat 则耗时 10.5 个月。

解决特斯拉「监督稀疏」难题,DriveVLA-W0用世界模型放大自动驾驶Data Scaling Law(在新窗口打开)
在自动驾驶领域,VLA 大模型正从学术前沿走向产业落地的 “深水区”。近日,特斯拉(Tesla)在 ICCV 的分享中,就将其面临的核心挑战之一公之于众 ——“监督稀疏”。

从好莱坞特效到AI芯片的十年之约:SIGGRAPH Asia 2025登陆香港!(在新窗口打开)
十年前,我们是国际顶会的仰望者;十年后,SIGGRAPH Asia重返家门,中国已从技术跟跑者变为AI与图形融合新时代的定义者之一,这场盛会不仅是一次技术复盘,更是一次面向全球的实力宣言。

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解(在新窗口打开)
上海人工智能实验室推出了一款革新的多模态生成理解一体化的扩散语言模型 ——Lumina-DiMOO。基于离散扩散建模(Discrete Diffusion Modeling),Lumina-DiMOO 打破了多模态任务之间的壁垒,在同一离散扩散框架下,完成从 文本→图像、图像→图像、图像→文本的全栈能力闭环。

偶然刷到的一个逆天项目:AI黑客...(在新窗口打开)
做过独立开发的朋友都清楚,虽然现在 AI 已经能写出相当不错的前端,后端也有成熟的 BaaS 服务,但应用开发并不仅仅只是写份代码。

SIGGRAPH Asia 2025 | 让3D场景生成像「写代码」一样灵活可控(在新窗口打开)
随着生成式 AI 的快速发展,从文本生成图像、视频,到构建完整的三维世界,AI “创造空间” 的能力正以前所未有的速度突破边界。然而,现有 3D 场景生成方法仍存在明显局限:模型往往直接输出每个物体的几何参数(位置、大小、方向等),结果容易出现漂浮、重叠、穿模等问题;场景结构缺乏逻辑一致性,难以编辑或复用,更无法像程序那样精确控制空间关系与生成逻辑。

VinciCoder:多模态统一代码生成框架和视觉反馈强化学习,数据代码模型权重已开源(在新窗口打开)
长期以来,多模态代码生成(Multimodal Code Generation)的训练严重依赖于特定任务的监督微调(SFT)。尽管这种范式在 Chart-to-code 等单一任务上取得了显著成功 ,但其 “狭隘的训练范围” 从根本上限制了模型的泛化能力,阻碍了通用视觉代码智能(Generalized VIsioN Code Intelligence)的发展 。



