让 AI 按一句需求做出能运行的网页,看似简单,实际要同时处理界面、交互和浏览器端逻辑。9月2日,阿里更新旗舰模型 Qwen3.8-Max,并称它在前端编程评测 CodeArena 中提升22分,以1691分升至总榜第一,领先 Claude Opus5、Kimi K3。前端编程评测通常要求模型生成或修改网页,再比较实际结果。
这次提升来自专项后训练——模型完成大规模预训练后,再用示例、反馈或强化学习加强特定能力,重点面向编程与专业办公。阿里还称,新版在 CodeArena 的性价比榜单上进入 Pareto Frontier,即性能与价格较难同时被其他方案超越;其每百万 Tokens 综合均价为5美元。模型现已通过千问 AI 平台提供 API,并接入千问办公、Qoder 和千问 APP。需要注意的是,相关成绩来自阿里供稿并由量子位转载,材料未披露独立复测结果。