
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

通用脑机接口时代要来了?跨尺度脑基础模型CSBrain真正读懂脑信号(在新窗口打开)
脑机接口(Brain-Computer Interface, BCI)被视为连接人类智能与人工智能的终极界面。要真正实现这一愿景,核心在于高精度的脑信号解码,即让通用 AI 模型能够真正「读懂」复杂多变的脑活动。

NeurIPS 2025放榜:阿里Qwen门控注意力获最佳论文,何恺明Faster R-CNN获时间检验奖(在新窗口打开)
刚刚,NeurIPS 2025最佳论文奖、时间检验奖出炉!

Adam的稳+Muon的快?华为诺亚开源ROOT破解大模型训练「既要又要」的两难困境(在新窗口打开)
在 LLM 优化领域,有两个响亮的名字:Adam(及其变体 AdamW)和 Muon。

速递|AI编程工具收入突破31亿美元,Cursor、Claude Code与Devin成三大引擎(在新窗口打开)
由Anysphere 的 Cursor 和 Anthropic 的 Claude Code 等 AI 编程工具共同创造的收入已突破 31 亿美元。据直接了解 Cognition 财务状况的人士透露,这其中包括 Cognition 的 Devin 编程代理产生的近 4 亿美元年化收入——这一数字此前未被报道过。

没有身体就没有AGI!Hillbot苏昊对谈千寻高阳:具身智能泡沫很大但进展真实(在新窗口打开)
两位长期站在具身智能第一线的亲历者,给出了罕见清晰的判断。

谷歌用Gemini 3同时革了OpenAI和英伟达两家的命(在新窗口打开)
当所有人都以为AI发展的剧本是「英伟达卖铲子,OpenAI挖金矿」时,谷歌用Gemini 3告诉世界:如果我自己造了一台全自动挖掘机,还需要买谁的铲子,谁能挖得过我?

为何你的 AI 没人味?全球顶尖科技公司都在做一件事:为 AI 注入品味|AI 实践派(在新窗口打开)
AI闹推出了新栏目 AI 实践派(AI Practitioners)

Gyges Labs会是AI+AR眼镜的未来答案吗?(在新窗口打开)
对于硬件,对于AR,应该都不甚了解的某知名投资人朱啸虎,对自己出手的第一个AI硬件也是AI眼镜项目是如此评价:“Gyges Labs的DigiWindow技术相比其他等方案,有着一个非常重要的优势:它的显示模组隐形,能把内容投到眼睛,

无问芯穹完成近5亿元A+轮融资,深度布局智能体时代的Agentic Infra(在新窗口打开)
近日,无问芯穹完成近 5 亿元 A+ 轮融资,本轮融资由珠海科技集团、孚腾资本(元创未来基金)领投,惠远资本、尚颀资本和弘晖基金跟投,老股东洪泰基金、达晨财智、尚势资本&海棠基金、联想创投、君联资本、申万宏源、徐汇科创投、元智未来持续追投。此次融资阵容汇聚国家产业资本与头部市场化基金,“国资+市场”的双重认可,既肯定了公司面向国家重大战略需求的技术创新,也充分鼓励着无问芯穹,

ROCK & ROLL!阿里给智能体造了个实战演练场 | 开源(在新窗口打开)
智能体终于拥有了可以海量复制的“实战演练场”。阿里此次开源的新项目ROCK,解决了无法在真实环境中规模化训练的难题。有了ROCK,开发者想要训练AI执行复杂任务时可以不再“手搓”环境,直接进行标准化的一键部署。

日本人工智能招聘平台HelloBoss完成A轮融资,由BAI Capital领投(在新窗口打开)
近日,总部位于东京的初创企业 NGA 宣布,旗下亚洲领先的人工智能招聘平台 HelloBoss 完成 A 轮融资,由 BAI Capital 领投。这笔交易也是贝塔斯曼集团通过 BAI Capital 在日本市场完成的首笔创新风险投资。

爆发力超越波士顿动力液压机器人,PHYBOT M1实现全球首次全尺寸重型电驱人形机器人完美拟人态后空翻(在新窗口打开)
乖乖,反正我是被“震”到了。 后空翻不稀奇,但看到一个身高近1米8、体重近70公斤的大家伙来这么一下还是有些震惊。 毕竟,就连专业的体操运动员都有身高体重限制,你一个机器人能这么翻多少有点离谱了。 而这,就是动易科技全新的全尺寸人形机器人——PHYBOT M1。 据说,这是全球首个实现完美拟人态后空翻的全尺寸重型电驱机器人,其爆发力表现甚至超越了以液压驱动著称的波士顿动力Atlas。 △动易科技 PHYBOT M1 后空翻 那么,问题来了,翻跟头确实很强,有什么用呢? 对于动易科技而言,选择让PHYBOT M1这款全尺寸“巨人”去完成后空翻这一难点动作,绝非为了简单的视觉炫技。 其根本目的,是

突破学术成果整理瓶颈:AMiner亮点正式开放使用(在新窗口打开)
AMiner 团队依托十余年学术数据挖掘经验,推出的“AMiner 亮点”功能,以其底层创新的作者消歧技术和全方位的学术服务能力,为学者提供了高效解决方案。 本文将从技术原理与产品实践双维度,深度解析“AMiner 亮点”在传统学术成果整理上的突破。

马斯克将用最强Grok 5,挑战LOL最强战队T1!(在新窗口打开)
马斯克主动为Grok 5戴上「纯视觉感知」与「拟人延迟」的双重镣铐,彻底告别API读数据与暴力手速的作弊时代,向传奇战队T1发起挑战。这是一场终极图灵测试,AI不再靠微操碾压,而是像人类一样通过「看」屏幕理解像素、依靠阅读战术与其后的逻辑推理来博弈。

谢赛宁与Jaakkola团队重磅研究:无数据Flow Map蒸馏(在新窗口打开)
前些天,一项「AI 传心术」的研究在技术圈炸开了锅:机器不用说话,直接抛过去一堆 Cache 就能交流。让人们直观感受到了「去语言化」的高效,也让机器之心那条相关推文狂揽 85 万浏览量。参阅报道《用「传心术」替代「对话」,清华大学联合无问芯穹、港中文等机构提出 Cache-to-Cache 模型通信新范式》。

预测下一个像素还需要几年?谷歌:五年够了(在新窗口打开)
既然语言可以当序列来学,那图像能不能也当序列来学?

全新稀疏注意力优化!腾讯最新超轻量视频生成模型HunyuanVideo 1.5核心技术解密(在新窗口打开)
腾讯混元大模型团队正式发布并开源HunyuanVideo 1.5。

AI隐私警报已拉响,南大团队实现AI本地化部署破局,支持国产显卡(在新窗口打开)
2023 年,三星公司在接入 ChatGPT 不久之后,接连发生数起内部机密泄露事件。事件起因是三星员工将半导体设备参数、产品源代码和生产良率等商业机密直接输入对话系统,导致敏感信息被录入 ChatGPT 的训练数据库。

超级APP的AI战略:中国互联网巨头的流量保卫战与Agent新物种(在新窗口打开)
Xsignal AI Holo(AI 全息)数据库显示,中国移动互联网的AI落地已彻底分化为两条路径:以微信、抖音的AI搜索为代表的“AI Overview (AIO)”旨在筑起认知的长城,将决策锁定在生态内部;而以QQ浏览器QBot为代表的“Agent in App (AIA)”则正演变为主动式的“数字员工”,重构服务分发的主权。

突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知(在新窗口打开)
视觉-语言-动作模型(VLA)在机器人操控领域展现出巨大潜力。通过赋予预训练视觉-语言模型(VLM)动作生成能力,机器人能够理解自然语言指令并在多样化场景中展现出强大的泛化能力。然而,这类模型在应对长时序或精细操作任务时,仍然存在性能下降的现象。



