通义千问Qwen3-4B-2507双料更新：手机能轻松跑，体积小、性能强

IT之家 8 月 7 日消息，通义千问 Qwen 昨日（8 月 6 日）发布公告，宣布，推出 Qwen3-4B-Instruct-2507 和 Qwen3-4B-Thinking-2507 两个模型，大幅提升性能。

官方表示，SML（Small Language Models）对 Agentic AI 的发展极具价值，“2507”版本的 Qwen3-4B 模型，体积小，性能强，对手机等端侧硬件部署尤为友好。

IT之家援引博文介绍，在非推理（non-thinking）领域，Qwen3-4B-Instruct-2507 显著提升通用能力，目标成为更全能的端侧利器。

该模型掌握更多语言和长尾知识，上下文理解扩展至 256K，小模型也能处理长文本。该模型通用能力超越了闭源的小尺寸模型 GPT-4.1-nano，性能接近等规模的 Qwen3-30B-A3B（non-thinking）。

官方表示该模型更像一位高效的“执行专家”，遵循指令、迅速响应，更适合用于内容创作、工具调用等。

在推理（thinking）领域，Qwen3-4B-Thinking-2507 大幅提升了推理能力，AIME25 高达 81.3 分。Qwen3-4B-Thinking-2507 的推理表现可媲美中等模型 Qwen3-30B-Thinking，在聚焦数学能力的 AIME25 测评中，以 4B 参数量斩获惊人的 81.3 分的好成绩。

官方表示该模型像一位严谨的“学术专家”，面对复杂问题逐步推理，完成任务更深入可靠。

正文

通义千问Qwen3-4B-2507双料更新：手机能轻松跑，体积小、性能强

相关阅读

无敌了！国产手机上的这个散热技术，居然能让iPhone性能暴涨

项改进：9to5Mac 首周体验苹果 M5 iPad Pro 报告出炉

打算换手机的再等等，一大批旗舰已经在路上了

史上最强！华为Mate 80系列首发麒麟9030：性能有望提升20%

发表评论取消回复

还没有评论，来说两句吧...

目录[+]