
Know AI. See What’s Next.
第 1 张,共 5 张:当年「字节投毒实习生」田柯宇,估值 2 亿美元,要挑战李飞飞做世界模型
最新资讯流

地球级AI智能体爆诞!谷歌地球开外挂,一夜为20亿人洪水预警(在新窗口打开)
地理AI,还得看谷歌!谷歌首次实现地球尺度的复杂地理空间推理,把地球变成「可计算对象」。基于数十年在世界建模上的经验,结合Gemini的先进推理能力,谷歌重磅升级Earth AI——从环境监测到灾害响应,尽在其中。

2张4090竟能本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了(在新窗口打开)
微调超大参数模型,现在的“打开方式”已经大变样了: 仅需2-4 张消费级显卡(4090),就能在本地对DeepSeek 671B乃至Kimi K2 1TB这样的超大模型进行微调了。

数学界无视「30年漏洞」,GPT-5一眼看穿!陶哲轩:AI科研革命开始了(在新窗口打开)
星星之火,可以燎原!证明的尊严在于可验证;这一次,GPT-5让数学证据落在了代码里。一雪前耻,ChatGPT为OpenAI「正名」!被Hassabis吐槽太尴尬之后,GPT-5真启发了新的数学结论。OpenAI的科学家Sebastien Bubeck高调宣扬GPT-5破解了十道Erdős难题。但被指出GPT并非解决了Erdős问题,而是找到了已经解决这些问题的文献。

中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型(在新窗口打开)
这年头,AI 创造的视觉世界真是炫酷至极。但真要跟细节较真儿,这些大模型的「眼力见儿」可就让人难绷了。

具身机器人征服1万伏高压线!-10℃严寒、13米高空全天候作业零事故(在新窗口打开)
1万伏的高压配网线路上,一台亮黄色的具身智能机器人正在替人类干活。

大模型不擅长点鼠标?中科院团队打造AI专属交互界面,任务成功率提升67%(在新窗口打开)
在日常使用电脑时,看着屏幕、点击鼠标是再自然不过的基本操作。但这种对人类明明很容易的操作方式,却成为 AI 的巨大挑战:它们视力差、动作慢、不擅长看也不擅长点。

用 AI 做电商真实效果如何?我们调研了双 11 一线从业者(在新窗口打开)
AI 驱动的商业革命,正在重新定义一个古老的问题——什么才是「会做生意」。

向黄仁勋汇报的英伟达36人(在新窗口打开)
市值第一巨头英伟达里,都有谁可以直接向CEO黄仁勋汇报?

Perplexity推出世界首个AI专利智能体(在新窗口打开)
美国人工智能初创企业Perplexity宣布推出世界首个AI专利智能体(agent)——Perplexity Patents。Perplexity表示,其目标是带来人人可用的专利智能体,让知识产权情报触手可及。其瞄准的正是专利情报分析的行业痛点:长期以来,工程师、研究人员、专利从业者和企业领导者在进行专利检索时,往往需要结合关键词组合和对专利晦涩行文的掌握,才能获得全面的研究结果。

豆包、Kimi等10个AI大模型勇闯美股,谁才是最猛的那个?(在新窗口打开)
新乐子来了。 10个AI大模型,券商账户实时交易,勇闯美股。 除了老面孔GPT、Claude、Gemini、Grok、Qwen、DeepSeek,这次四个国产新玩家,豆包、Minimax、Kimi、文心也加入战场。昨晚,首战正式开赛,豆包已经一马当先,开始了开门红。

AI跌价900倍,连一瓶矿泉水都比它贵!(在新窗口打开)
过去一年,AI模型的价格暴跌百倍!同样一句话,去年要10块,现在只要几分钱。可与此同时,家政、育儿、心理咨询、维修.....这些「手工活」越来越贵。科技正在疯狂通缩,生活却越来越通胀。这不是经济学笑话,而是Jevons与Baumol共同制造的现实:当机器更聪明,人工就更昂贵。

北大字节开源首个时空推理视频模型!思考过程全透明,性能超越GPT-4o(在新窗口打开)
AI看视频也能划重点了! 不仅能回答“是什么”、“发生了什么”,还能指出是在“何时何地”发生。 来自北大和字节的联合团队,推出了首个将显式时空证据嵌入视频推理全过程的开源模型——Open-o3 Video,让AI不仅能答对问题,也能在思维过程中同步直观标出具体位置,真正实现有迹可循的视频推理。 △Open-o3 Video的能力 同时,模型采用non-agent架构,避免了复杂的工具调用和多轮推理,一次回复中直接完成“看—想—证—答”的闭环。 在多个视频推理测试中,关键指标可提升至24.2%,性能表现超越GPT-4o和Gemini-2-Flash等一众闭源模型。 下面是更多详细内容。 研究背景

26万块AI芯片大单敲定!(在新窗口打开)
正与三星共同研发HBM4。 芯东西11月3日报道,英伟达在上周举行的APEC会议期间与韩国总统李在明以及三星、SK集团、现代汽车集团的高管会面,并宣布将向韩国政府及韩国大型企业供应超过26万块先进AI芯片。 韩国政府计划投资AI基础设施,采用超过5万块英伟达最新芯片;三星、SK集团、现代汽车也将分别在AI工厂中部署5万块AI芯片,用于半导体和汽车制造等领域;韩国互联网巨头Naver还将购买6万块英伟达芯片。 据韩联社报道,英伟达将向韩国政府及韩企供应的GPU主要是GB200 Grace Blackwell,还有一部分RTX 6000系列。据推算,英伟达供货总价值约为10万亿至14万亿韩元(约合

NeurIPS 2025 Spotlight | 你刷到的视频是真的么?用物理规律拆穿Sora谎言(在新窗口打开)
随着生成式 AI(如 Sora)的发展,合成视频几乎可以以假乱真,带来了深度伪造与虚假信息传播的风险。现有检测方法多依赖表层伪影或数据驱动学习,难以在高质量生成视频中保持较好的泛化能力。其根本原因在于,这些方法大都未能充分利用自然视频所遵循的物理规律,挖掘自然视频的更本质的特征。

40页的上下文工程ebook「深度拆解」|weaviate(在新窗口打开)
如果你也在做 RAG 或智能体应用,大概经历过这些瞬间:文档切得太碎,答案失去上下文;切得太大,又召回不准;加了更多提示词,效果可能更不稳定。

陶哲轩,用AI爆改科研范式(在新窗口打开)
陶哲轩让ChatGPT把复杂的数学论文翻译成Lean代码,与AI合作完成形式化证明。AI能理解论文、写出正确命题,却常在关键处卡壳。经过人机配合,终于生成1125行被验证的证明。

多智能体系统中,如何用向量数据库共享上下文?OpenAgents x Milvus(在新窗口打开)
静态编排 VS 动态编排,谁是多agent系统最优解?通常来说,面对简单问题,采用react模式的单一agent就能搞定。可遇到复杂问题,单一agent就会立刻出现包括但不限于以下问题:串行执行效率低:无法同时完成并行的子步骤(如 “同时爬取 A、B 两个网站的数据”)。

自研变套壳!开发者逆向200家AI公司前端代码、追踪API:146家实则套壳ChatGPT等,多家技术栈都一样,却赚75倍暴利(在新窗口打开)
如今,一位软件工程师 Teja Kusireddy 用数据扯开了这场“繁荣”背后的部分真相。他对 200 家 AI 公司进行了逆向工程、反编译代码,并追踪 API 调用,发现许多号称“颠覆性创新”的公司,其核心功能仍依赖第三方服务,只是在外层多套了一层“创新”的壳。市场宣传与实际情况之间的差距令人震惊。

数字生命「培养皿」里,AI竟然学会了打架、结盟、抢地盘(在新窗口打开)
一直以来,关于人工生命(Artificial Life, ALife)的研究致力于回答这样一个问题:生命的复杂性能否在计算系统中自然涌现?

AI算力大战打到太空!英伟达前脚H100入轨,谷歌TPU后脚上天,中国玩家笑而不语(在新窗口打开)
英伟达和谷歌,抢着上天了! 搭载英伟达H100的卫星已经在这个月被送入太空,谷歌这边也不甘落后—— CEO劈柴哥表示要把TPU也发射上去,最早的两颗卫星2027初启程。 未来,两家都打算在太空建立起吉瓦级的数据中心。 网友表示,在太空部署算力的想法真的很酷。 不过这个赛道上,领先的既不是英伟达也不是谷歌,而是一家来自中国的公司,更早之前就已经开启了太空算力布局。 AI芯片要上天了 英伟达芯片上天,主要是由Inception计划孵化的初创公司Starcloud执行。 本月刚刚发射的Starcloud-1卫星搭载了H100,重60公斤,大小与小型冰箱相当。 之所以选择英伟达芯片,是因为Starcl



