
几千人催我蒸馏的X冷启动Skill,开源了!(在新窗口打开)
大家好,我是袋鼠帝 几天前我尝试做了一个相对粗糙的视频,是关于我开源的仓颉Skill的 没想到居然爆火了!(全网将近50万播放)。
内容栏目
分享不同 AI 工具、模型与相关技术的使用方法和实践文章。

大家好,我是袋鼠帝 几天前我尝试做了一个相对粗糙的视频,是关于我开源的仓颉Skill的 没想到居然爆火了!(全网将近50万播放)。

昨天刚完成2亿美元Pre-IPO轮融资,逐际动力没有急着讲资本故事,而是立马甩出一段全尺寸人形机器人Oli全自主做家务的视频:

WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。

基于可验证奖励的强化学习(Reinforcement Learning with Verifiable Rewards,RLVR)正在成为大模型后训练的关键技术。数学题能判对错,代码能跑测试,可验证奖励让大模型可以通过强化学习持续提升推理能力。

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

最近我在给 Codex 折腾一只自己的桌宠。

扩散语言模型(DLM)正逐渐成为自回归(Autoregressive, AR)语言模型之外一种新兴的建模范式。

80年前,阿根廷作家博尔赫斯写过一个寓言,叫《博闻强记的富内斯》。博尔赫斯笔下的富内斯,拥有过目不忘、堪称完美的记忆,却无法思考,因为思考依赖于遗忘和抽象。

这年头,提示词工程也能发ICML了???

过去两年,人形机器人赛道的竞争焦点,正从整机硬件进一步延伸到模型能力。

如果想开发一个视频理解应用,你会怎么做?

这两天网上冲浪的时候,发现有人用 Claude 复刻了一个类似《魔兽世界》的在线多人游戏。

近年来,多模态大语言模型(MLLM)在视觉问答、图表理解、科学推理等任务上取得了令人瞩目的进展。

3D空间数据的瓶颈,从来不是算法,而是标注。

近日,自监督学习新工作 VISReg(Variance-Invariance-Sketching Regularization)获图灵奖得主 Yann LeCun 连续转发并给予高度认可 —— 他在转发时评价道「VICReg begat SIGReg which begat VISReg」(VICReg 孕育了 SIGReg,SIGReg 又孕育了 VISReg),

7月6日,腾讯混元Hy3正式版发布。 同一天,几乎没有人注意到另一件事:微信AI团队在GitHub上 quietly 放出了Hidden Decoding at Scale的正式论文,WeLM技术博客同步更新。不仅如此,WeLM的官方技术团队还开设了小红书账号,开始对外宣传WeLM的技术成果。 信号的导火索在几个月前。据《中国企业家》报道,2026年腾讯年会上,微信高层公开表态,希望自己训练大模型,集团给予更多GPU支持。 在腾讯集团层面,混元是无可争议的「正规军」。前OpenAI研究员姚顺雨空降半年,AI Lab被整体并入,数百亿研发投入押注于此。 但在这条主线之外,微信事业群也正在悄悄发力

曾经我们对 AI 的期待还比较朴素,写邮件、翻译论文、聊天搭子……那时候,AI 像一个初出茅庐的实习生,你指哪它打哪,但也经常一本正经地胡说八道。

大家好,我是极客杰尼。 今天,md2wechat 正式发布 3.0.0 大版本,这次最重要的变化,是普通创作者也能让 Agent 帮自己完成多图和 SVG 排版。

近日,新基石研究员、北京大学集成电路学院教授、深圳研究生院信息工程学院院长杨玉超团队,联合中国科学院上海微系统与信息技术研究所宋志棠研究员团队等,在国际顶级学术期刊《科学》发表最新成果,在新型神经动力学计算芯片领域取得重大突破。
参与交流
了解加入交流群的方式,阅读内容无需登录。