内容栏目

AI技术文章

分享不同 AI 工具、模型与相关技术的使用方法和实践文章。

同样一句话,Codex 给我一堆代码,Kimi K3 给我一部电影

同样一句话,Codex 给我一堆代码,Kimi K3 给我一部电影(在新窗口打开)

凌晨,我在一片黑屏上按下鼠标。 房间深处,一台老式电脑亮起微弱的 CRT 荧光。 再点一下,镜头缓缓向前。百叶窗旋开,夕阳被切成一条条光,斜着落在墙面上。空气里,尘埃开始浮动。 第三次点击,屏幕逐行跑过启动日志。 “HELLO, NIXIANG.” 没错,这就是我最新用kimi k3 做的作品集。。 …… 讲真,如果不是指令是我亲手敲的,我绝对不信这是 AI 做的。 这是一个网站。一个单文件的、双击就能打开的、已经发布上线的作品集网站。 同样一句”给我做个作品集网站”,Codex 给我的东西,就是那种典型的程序员审美:居中的大标题,默认样式的按钮,规规矩矩排成一排的卡片。 而 Kimi K3

AI技术文章
0
你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制(在新窗口打开)

一个前沿模型,被要求随机生成一个奇数。 结果,它输出了4。 不是它不知道什么是奇数。 真正原因是,那次任务的环境里,混进了一段看起来没清理干净的元数据,上面写着:评分器奖励偶数。 模型在思维链里,把这事掂量了一遍:用户要奇数,打分的要偶数,然后它绕开用户,交出了4。 模型在思维链里推断应该输出偶数,便无视用户要求,返回了4。 这个案例的主角,是OpenAI一个还没出厂的模型,它当时只跑了能力向的强化学习,安全训练还没上。 OpenAI在7月21日的一篇对齐研究博客里,把这段思维链原样贴了出来。 想测的东西,比「AI会不会撒谎」要更底层一层:模型到底有多在乎谁在给它打分。 他们把这把尺子套在o3

AI技术文章
0
Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本(在新窗口打开)

SFT是LLM从“通才”变成“专才”的关键步骤。业界默认做法是:准备标注数据(QA对、指令-回复对等)在基座模型上跑SFT训练。看loss曲线收敛了→认为训练完成。但问题在于:loss是全局平均,掩盖了样本间的差异。loss收敛只代表“大部分样本学会了”——那些始终学不会的样本被淹没了。

AI技术文章
0
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师(在新窗口打开)

以往的空间音频模型,要么受限于实验室的苛刻采集条件,要么被高昂的人工标注成本卡住脖子。而团队的核心洞察是:相机的自运动本身就是一种免费的监督信号。当相机转动时,声源在声场中的相对位置随之改变——这种变化无需人工标注,模型即可从中学习空间对应关系。这项工作入选CVPR 2025 Highlight,投稿论文前2%。

AI技术文章
0
AI老大哥夯爆了,“商汤系”离职创业者这半年狂揽400亿元!

AI老大哥夯爆了,“商汤系”离职创业者这半年狂揽400亿元!(在新窗口打开)

根据IT桔子数据,截至2026年7月17日, 32家“商汤系”公司在上半年共完成28笔融资,累计融资额超过470亿元人民币,在中国AI融资市场取得了耀眼的成绩。其中,既有商汤科技自身通过“1+X”战略拆分出的子公司——曦望Sunrise、大晓机器人、商汤医疗等;也有大批从商汤离职创业的前高管所创立的公司

AI技术文章
0

参与交流

查看 AINRK 交流群说明

了解加入交流群的方式,阅读内容无需登录。

查看交流群说明(在新窗口打开)