千问正式开源 Qwen3.8-27B,官方跑分显示该模型在 8 项可直接对比测试中全部超过 Meta 的 30B 模型 Muse Glimmer。Qwen3.8-27B 在 Terminal-Bench 2.1 中得分 73.0,Muse Glimmer 为 51.7;SWE-bench Pro 得分 61.7 对 51.2;OSWorld-Verified 则为 84.3 对 65.9。通用推理、文档和视觉测试也均领先。与 Claude Opus 4.6 的对比中,Qwen3.8-27B 在 19 项测试中赢得 15 项,SWE-bench Pro、LiveCodeBench、OSWorld、AndroidWorld 和多项视觉任务已反超,Terminal-Bench、GPQA、HLE 和 NL2Repo 仍落后。该 27B 模型的官方跑分已接近上一代闭源旗舰的水平。
本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。

















