内容栏目

AI技术文章

分享不同 AI 工具、模型与相关技术的使用方法和实践文章。

CVPR 2026 | 告别倾听「扑克脸」,UniLS框架来了,刷新数字人对话SOTA

CVPR 2026 | 告别倾听「扑克脸」,UniLS框架来了,刷新数字人对话SOTA(在新窗口打开)

在游戏 NPC、虚拟主播、在线客服等数字人对话场景中,倾听时的 “扑克脸” 问题一直是行业长期痛点 —— 虚拟人说话时口型可以做到精准同步,但倾听时却表情僵硬、毫无反应,严重影响对话的自然感和沉浸感。盛大 AI 研究院(东京)与东京大学联合提出 UniLS(Unified Listening and Speaking),首个仅凭双轨音频即可端到端同时驱动说话和倾听面部动作的统一框架。

AI技术文章
0
突破算力瓶颈!港大俞益洲团队发布首篇「高效视频世界模型」全面综述

突破算力瓶颈!港大俞益洲团队发布首篇「高效视频世界模型」全面综述(在新窗口打开)

还记得两年前,AI 生视频可谓是「鬼畜专区」—— 人物多一根手指算基操,走路自带鬼步舞才是常态。结果转眼间,从 OpenAI 的 Sora 到字节跳动的 Seedance,这些模型已经开始一本正经地「模拟世界」了:水会流、球会弹、光影能追踪,俨然一副要当「物理引擎」的架势。

AI技术文章
0
27B秒了自家397B旗舰,Qwen3.6-27B开源,智能体编程全面超越前代

27B秒了自家397B旗舰,Qwen3.6-27B开源,智能体编程全面超越前代(在新窗口打开)

我秒了我自己?? 阿里Qwen团队刚开源的Qwen3.6-27B,直接把自家前代旗舰Qwen3.5-397B给卷没了。 在四大智能体编程基准上全面超越,只用了前代大概1/15的参数量。 从成绩单来看,除了智能体编程基准的集体领先,单项差距也比较明显,SkillsBench从老旗舰的30.0直接干到48.2,差距拉开超60%。 而且,和Qwen3.5-397B的MoE不同,Qwen3.6-27B采用的是纯密集架构。 架构简洁、部署简单、推理稳定,普通开发者拿过来就能跑,不用折腾一堆配置。 27B也不虚 Qwen3.6-27B专门对智能体编程做了一波狠优化。 模型在训练中强化了代码库理解、跨文件编

AI技术文章
0

参与交流

查看 AINRK 交流群说明

了解加入交流群的方式,阅读内容无需登录。

查看交流群说明(在新窗口打开)