
开源一个非常漂亮的文章配图 Skill(在新窗口打开)
昨天早上我想给 Claude 的一篇文章配几张 3:4 的社交媒体图。手边有自己做的社交媒体 Skills,就顺手让 Codex 调了 GPT-Image 2.0。出来的效果超出预期。干净白底,克制的 3D 材质,中文标签直接印在图里,远看像杂志内页,近看细节都读得清。
内容栏目
聚合人工智能领域的重要资讯、产品发布、行业动态与商业变化。

昨天早上我想给 Claude 的一篇文章配几张 3:4 的社交媒体图。手边有自己做的社交媒体 Skills,就顺手让 Codex 调了 GPT-Image 2.0。出来的效果超出预期。干净白底,克制的 3D 材质,中文标签直接印在图里,远看像杂志内页,近看细节都读得清。

腾讯旗下的AI应用生成及灵感共创平台“吐司” iOS版正式上线。这标志着吐司完成了移动端双平台(iOS+Android)的全量覆盖,让更多用户能够随时随地,通过自然语言对话创造应用。作为一款零门槛的Vibe Coding产品,吐司旨在满足大量真实、细碎、且个性化的应用需求。

2026年4月,一位在美国AI圈极具影响力的研究者,专程来到中国,走进北京、杭州和上海的AI实验室。他密集拜访了阿里巴巴、月之暗面、智谱、清华、美团、小米、蚂蚁和零一万物等团队。回到美国后,他写了一篇名为《Notes from inside China's AI labs》(中国AI实验室内部观察随笔)的文章,在美国科技圈引发了不小讨论。

今年四月,吴明泽因为"装龙虾"认识了一位货代公司老板。说来也巧。那位朋友在物流行业干了整整十年,四月正好是龙虾进口旺季,就顺手给吴明泽介绍了这位年营收过亿的老板。吴明泽是谁?哈佛设计工程硕士、斯坦福HAI(人工智能实验室)科研助理。他还在阿里、腾讯、MiniMax做过工程师

但2026年春招里,她一口气投递了两百多家企业的市场、品牌岗,其中不乏头部互联网公司和4A公关公司,支撑她跨界的底气,是AI工具。改变始于2025年的一段外企实习。当时主管交给她一项任务:对全国3000家线下门店的销售数据做透视分析,输出用户画像报告。放在以前,纯文科背景的她根本接不住这样的需求,但那次她一边找行业案例参考框架,一边对着ChatGPT和Claude边问边学,

AI竟写出了,史上最快内核!在全新一轮GPU算子基准测试KernelBench-Mega中,Fable 5表现一骑绝尘。它在RTX PRO 6000,全程「纯手搓」CUDA,速度狂飙18.7倍。相比之下,强如Claude Opus 4.8也只跑出14.4倍,而GPT-5.5只有4.34倍。

GPT-Live 基于全双工架构构建,也就是说,它可以同时听和说。在对话过程中,GPT-Live 可以用 mhmm 或 yeah 这样的回应表示自己正在听,也可以进行快速来回交流;当你需要一点时间思考时,它也会保持安静。最终带来的,是一种非常轻松自然的语音交互体验。

小红书上,#deepseek 算命、#赛博玄学等话题下,大量玄学爱好者聚集,分享不同占卜体系的prompt、交流 AI 算命心得,仅 #deepseek 算命一个话题,浏览量就达到 5608 万、讨论量 35.4 万;与此同时,更深度的 AI 用户开始在 GitHub 上自行开发占卜 Skills,搜索“astrology”“bazi”等关键词,可以看到相关项目最高 Star 数已达 3.9k。

2026 年 6 月,HuggingFace 上一个名为 Boogu-Image-0.1 的开源模型,在上传以后迅速引爆了 AI 圈。这款模型最引人注目的地方,在于它以区区 10B 的参数规模,就在多项关键能力上超过了很多参数量更大的模型。

据 The Information 报道,MiniMax 正在研发一款参数规模达 2.7 万亿的大语言模型,内部代号暂定为 M3 Pro,最快有望于今年第三季度发布,并计划同步开源。相较于现有旗舰模型 M3 的 4280 亿参数,M3 Pro 的规模实现了数量级跃升,预计将在复杂推理、多步骤任务处理及长上下文理解等能力上进一步增强。

前“华为天才”李博杰的一条吐槽小作文,喜提热搜。相信大家都看了,我就不在这里写了。这个事儿上热搜能理解的,一个是前“华为天才”的标签(虽然也有人说华为天才也不少),一个是当红国产模型炸子鸡deepseek

去年 12 月,我们曾与 Ancher 联合创始人兼 CEO Vincent Wu 进行了一次深度对话,Vincent 曾任雅虎新闻运营总监、NewsBreak COO,深耕美国新闻近 20年,所以在初期,Ancher 以“Agentic News Reader”为核心定位,以“语义层推荐”作为主要差异化。

Meta超级智能实验室(MSL)扔出了首个图像生成模型Muse Image,代号「芒果」(Mango)。这是我们迄今为止最先进的图像生成模型。与Muse Image一同亮相的,还有视频模型Muse Video,目前仍是预览版。

智源研究院悟界·RoboBrain Orca Team发布的技术报告Orca: The World is in Your Mind,想探索的正是这个问题。也有评论认为,Orca更接近早期通用世界模型的形态,即先学习世界如何变化,再将这种世界表征读出到理解、预测和行动任务中。

GitHub宣布,GitHub Copilot App正式向所有Copilot套餐开放。这意味着,Copilot Free、GitHub Education、Copilot Pro、Business、Enterprise用户,都可以在macOS、Windows和Linux上使用这个独立桌面应用。

有一款 AI 录音器就是这么干的。它叫 Memoket,是这两年扎堆冒出来的 AI 录音硬件里的一个——自带麦克风、电池和 App,一台能独立干活的设备。可它跟你的 Apple Watch 之间,没有半点数据往来——却专门做了个支架,只为把自己牢牢固定在 Apple Watch 旁边。

这个问题,在 AI 行业有一个专业的说法:无状态(Stateless)。而解决这个问题,正是 EverMind 过去一直在做的事情。今天,这个探索走到了一个新的节点:基于自研记忆系统 EverOS 的自进化Harness——Raven Agent 正式发布。

去年 6 月,红杉中国与《麻省理工科技评论》中国共同发起了“AI25”计划,希望寻找那些在 25 岁以下,正在定义 AI 时代的年轻力量。并将他们介绍给世界。今天,我们正式揭晓 2025 年“AI25”入选者名单。

专注于4D世界模型研发和产业化的魔芯科技联合浙江大学潘云鹤院士团队发布MoWorld——全球首个Flash World Model,也是首个全栈基于国产NPU构建的实时交互世界模型。

智东西获悉,OpenAI前研究员田永龙(Yonglong Tian)已确认于近期加入腾讯大语言模型部,后续将参与VLM(视觉语言模型)相关研发。在OpenAI期间,田永龙曾参与GPT-5的研发工作。加入OpenAI之前,他在Google Research和DeepMind长期从事视觉表征学习和对比学习等方向研究,对后续视觉模型以及多模态表征学习的发展产生了广泛影响。
参与交流
了解加入交流群的方式,阅读内容无需登录。