
硅谷传奇投资人 Bill Gurley 最新访谈:AI 的狂欢和内心的声音(在新窗口打开)
2026 年上半年,美国风险投资市场呈现极端的两极分化。每 100 美元风投中,有 86 美元流向 AI 公司,其中 OpenAI 与 Anthropic 两家企业占据全球四成以上份额;与此同时,非 AI 创业公司经通胀调整后的融资金额已跌至新冠疫情水平之下。
内容栏目
聚合人工智能领域的重要资讯、产品发布、行业动态与商业变化。

2026 年上半年,美国风险投资市场呈现极端的两极分化。每 100 美元风投中,有 86 美元流向 AI 公司,其中 OpenAI 与 Anthropic 两家企业占据全球四成以上份额;与此同时,非 AI 创业公司经通胀调整后的融资金额已跌至新冠疫情水平之下。

刚刚,闭源RSI的钦点严父来了! 开源AI基础设施公司Prime Intellect在最新的一项研究中提出: 借助多智能体Harness,可以把监控和具体实现交给更小、更便宜的开源模型,,从而让“AI开发AI”变得更便宜,甚至效果更好。 在实验中,他们把Fable 5、Opus 5、GPT-5.6 Sol、Kimi K3等18个前沿模型,扔进了一场nanoGPT优化器速通。 结果,开源权重模型Kimi K3搭配Prime Agent Harness后,在原始结果页中跑出了2930步的成绩。 这不仅超过了GPT-5.6 Sol的3042步,距离Claude的旗舰模型Opus 5的2920步也只差

测评 AI 这件事,如今越来越难做了。 几年前,AI 还是聊天机器人时,测评主要就是做题:写作的、数学的、编程的……最后形成一套跑分,用分数代表模型能力。 但当 AI 从聊天框里走出来,变成能够调用工具、操作网页、处理文件、跨系统执行任务的 Agent,情况就变得复杂起来。 平时我们看到的,是 AI 出现在手机上,能够刷淘宝、加购物车,最后下单。实际上在商家的那一端,也有 AI 的参与,承担着比选购和下单更复杂的工作。 在专门考察电商环境中模型表现的 RealReplicaBench 测试中,经过 107 个真实商业任务的考核,所有参评模型都没有达到 60 分——都没有及格。 选手一共 13

太卷了!过去两年,视频生成模型把画面参数几乎卷了个遍。

过去几年,大模型的发展主线很清晰,比如更大的模型、更多的数据,以及更多的计算。但当模型从回答问题的Chatbot走向能够调用工具、执行任务的Agent,发展主线也开始发生变化。模型不仅要知道,还要在环境中行动,从反馈中判断结果,并在长时间运行中不断调整策略。

今天,一条前两天的推文开始热传,内容只有 5 个词:Scott Gray 已离开 OpenAI。

前两天,看到小米澎湃OS 4 Beta版开启招募,没有发布会,直接上。

今年AI圈最贵的一笔中间商买卖,落槌了!

“全球首个具身 Physical AI 开源生态,将如何改写机器人行业格局? ”

8月17日,RoboScience机器科学正式发布轮式仿人形通用操作机器人——REX G1,定位为“新一代具身智能生产力伙伴”。

“北航90后副教授”、“在B站教AI”、“3岁小孩都能听懂”……

你有多少工作,是需要「外包」出去做的,比如交给同事或者实习生?

办公智能体正在成为最热门的赛道:写文档、做表格、订会议,各家都在往办公软件里塞一个更聪明的AI助手。

给AI一道数学猜想,它先琢磨的居然是:怎么把它推翻找反例!!

日产7.5万首,播放却不到3%。 这是流媒体平台Deezer最新披露的一组数据。AI歌曲每天涌入平台的速度,从2025年初的1万首飙升到如今的7.5万首,占当日新增上传的44%。但实际播放占比,只有1%-3%。 产能炸了,产品却过不了人耳这一关。 尤其是在中文世界,这个矛盾更加尖锐。全球最顶级的AI音乐公司Suno,估值54亿美元,做英文歌确实能打。 但做中文歌?也很抱歉。 咬字发飘、情绪悬浮、转音别扭,用户甚至总结出了一套绕路技巧,把复杂中文字换成拼音,才能让模型生成出勉强准确的发音。 我们的母语,反而成了AI音乐最不擅长的语言。 这背后不是模型「调得不够好」,而是一道架构题。 为什么中文歌

史上最大规模IPO前,Anthropic CEO罕见长文硬刚质疑!

上周我去参加了一场在旧金山举办的 robotics meetup,主办方是 Silicon Valley Robotics 和 Nomadic AI,地点在 717 Market Street。说实话,我去之前没有太高的预期,觉得这类活动大概就是几个人站着聊天喝酒,讲几个 demo 然后散场。但五个演讲下来,我发现我想多了。

AI自动科研的时代,彻底爆发了! 18个全球最顶尖的大模型,断网被关进小黑屋,连续做了8天科研。 谁能想到,最强王者Fable 5一骑绝尘—— 数十位顶尖工程师耗时数月才创下的纪录,它一举追平了人类82%的水平。 就在今年,OpenAI和Anthropic已经先后把「AI自己造AI」的时间点,押在了2028年。 这是第一次有人真的用算力和时间,去量了量它还差多远。 研究一发布,直接引爆AI圈,连OpenAI的大佬都赶来强势围观。 有人表示,这是迈向「AI自主研究」的重大里程碑。「AI辅助」与「AI发现」之间的最后一道鸿沟,正在被加速抹平! 全球顶尖AI「闭关」搞科研断网8天 就在今天,Prim

AI的“情绪”也会影响工作状态? 最近,中科大、牛津等机构研究者让AI用情绪向量替代文本做技能选择,结果发现—— 允许AI识别这些“内心情绪”并由此做出行动,能大幅提升AI的工作能力…… 此前研究认为,LLM内部存在着与人类情感标签高度对应的计算模式。 包括不限于:好奇、渴望、乐观、困惑、紧张、恼怒。 △AI可提取的情绪表征 而当模型感知到这些情绪并以此作为自己行动依据时,任务将完成得更好…… 允许AI不保持“情绪稳定” 此研究者发现:AI特定的情绪状态与特定的技能选择之间存在着连贯的配对关系。 何意味? 实际上这件事在我们人类身上几乎是默认的,以至于很难察觉到:我们的情绪决定了我们接下来要做

马斯克的xAI联创们,全员离职后都去了哪儿?
参与交流
了解加入交流群的方式,阅读内容无需登录。