大模型榜单周报(2026/1/17)
1. 本周概览本周大模型领域继续保持快速发展态势,各大厂商在医疗AI、视频生成、代码能力等多个领域取得显著进展。OpenRouter模型调用量排名发生重要变化,Claude系列模型表现抢眼,百度新模型ERNIE-5.0-0110在全球LMArena文本排行榜上排名第八,展现了中国模型的强劲实力。
2. 重点关注事件
[*]DeepSeek与北京大学合作发表关于条件记忆(conditional memory)的新论文,提出Engram模块,有望提升模型检索效率
[*]Anthropic推出工作场景智能体Claude Cowork,由Claude Code自主开发,体现了AGI在实际应用中的潜力
[*]谷歌发布新一代开源医疗AI模型MedGemma 1.5及MedASR语音识别模型,进一步扩展在医疗AI领域的布局
[*]谷歌Veo 3.1更新支持9:16竖屏视频和4K分辨率,视频生成能力持续提升
[*]智谱与华为合作开源图像生成模型GLM-Image,登顶复杂视觉文字生成和长文本渲染双榜首
[*]阿里千问APP上线超400项AI办事功能,接入阿里生态,成为全球首个能完成真实生活复杂任务的AI助手
[*]OpenAI推出独立翻译页面ChatGPT Translate,拓展应用场景
[*]百度ERNIE-5.0-0110在全球LMArena文本排行榜上排名第八,超越多个领先模型
3. 榜单变化
[*]OpenRouter模型调用量排名:
[*]整体调用量方面,Claude Opus 4.5超越上周榜首Claude Sonnet 4.5,位列第1;MiMo-V2-Flash(free)上升两名,排名第3;Gemini 3 Flash Preview由第4名下降至第5名
[*]模型市占率方面,Google保持第1;Anthropic市占率上升4.2%(17.2% → 21.5%),连续两周上升8.5%;OpenAI市占率上升3.1%(8.0% → 11.1%);Qwen上升至第8名,替代了上周MiniMax的位置
[*]编程调用量方面,Claude Opus 4.5保持第1;Claude Sonnet 4.5排名上升2名,排名第3;DeepSeek V3.2重回前十,排名第8
[*]大语言模型榜单:ERNIE-5.0-0110新上榜,排名第8,超过GPT-5.1(high),相比ERNIE-5.0-preview-1203版本上升了6名,该模型基于预发布测试,评分可能随着公开发布后的反馈而变化
[*]图像编辑能力榜单:flux-2-max和flux-2-pro新上榜,分别排名第8、第9
[*]文生图能力榜单:FLUX.2 Turbo新上榜,排名第10
[*]GAIA榜单:JoinAI V2.2登顶榜首,得分达90.7%
4. 排行榜
测评类型第一名第二名第三名模型调用量Claude Opus 4.5Claude Sonnet 4.5MiMo-V2-Flash(free)公司市占率GoogleAnthropicOpenAI编程模型调用量Claude Opus 4.5Grok Code Fast 1Claude Sonnet 4.5各公司按不同能力领域排名汇总
测评类型领先公司大语言模型 Text ArenaGoogle、xAI、Anthropic、百度、OpenAI、智谱、阿里巴巴、月之暗面编程能力 LMArenaAnthropic、OpenAI、Google、智谱、MiniMax编程能力 LiveCodeBenchOpenAI、Anthropic、Google代码工程任务能力 SWE-benchLite基于Claude、Gemini、GPT、Qwen、DeepSeek开发的开源系统图像编辑和生成能力 Image Edit ArenaOpenAI、Google、字节、Black Forest Labs、Reve文生图能力 Text-to-Image ArenaOpenAI、Google、Black Forest Labs、腾讯、字节文生图能力 Text to Image LeaderboardOpenAI、Google、Black Forest Labs、字节、ImagineArtGPQAOpenAI、Google、xAI、Anthropic、阿里巴巴FrontierMathOpenAI、Google、DeepSeek、月之暗面、Anthropic、xAIHumanity's Last ExamGoogle、OpenAI、AnthropicGAIAJoinAI、Nvidia、Suzhou AI Lab&Shuqian Tech、Microsoft AI Asia -Ads关注我,第一时间掌握更多AI前沿资讯!
来源:程序园用户自行投稿发布,如果侵权,请联系站长删除
免责声明:如果侵犯了您的权益,请联系站长,我们会及时删除侵权内容,谢谢合作! 前排留名,哈哈哈 很好很强大我过来先占个楼 待编辑 分享、互助 让互联网精神温暖你我 喜欢鼓捣这些软件,现在用得少,谢谢分享! 鼓励转贴优秀软件安全工具和文档! 这个好,看起来很实用 收藏一下 不知道什么时候能用到 热心回复! 这个好,看起来很实用 谢谢楼主提供! 不错,里面软件多更新就更好了 谢谢分享,辛苦了 新版吗?好像是停更了吧。 感谢分享,学习下。 东西不错很实用谢谢分享 感谢分享,下载保存了,貌似很强大 谢谢分享,试用一下 喜欢鼓捣这些软件,现在用得少,谢谢分享! 收藏一下 不知道什么时候能用到
页:
[1]
2