阿里开源两款4B小模型：手机电脑都能用，比GPTnano还强

智东西

作者 | 王涵

编辑 | 漠影

智东西8月7日报道，今天上午，通义千问Qwen宣布推出两款更小尺寸的新模型：Qwen3-4B-Instruct-2507和Qwen3-4B-Thinking-2507。

其中，Qwen3-4B-Thinking-2507的推理能力可媲美中尺寸模型；Qwen3-4B-Instruct-2507在知识、推理、编程、对齐以及agent能力上全面超越了闭源的小尺寸模型GPT-4.1-nano。

此次发布的“2507”版本的Qwen3-4B模型对手机等端侧硬件部署较为友好，目前已在魔搭社区和Hugging Face正式开源。

已在Hugging Face开源（来源：Hugging Face）

魔搭社区：
https://modelscope.cn/collections/Qwen3-9743180bdc6b48

Hugging Face：https://huggingface.co/Qwen

一、性能比肩中尺寸模型，agent能力超越GPT-4.1-nano

Qwen3-4B-Instruct-2507与Qwen3-4B-Thinking-2507的上下文理解能力都扩展到了256K，可处理长文本，能支持更复杂的文档分析、长篇内容生成以及跨段落推理等场景。

性能方面，Qwen3-4B-Thinking-2507在复杂问题推理能力、数学能力、代码能力以及多轮函数调用能力上的表现大幅领先Qwen3同尺寸小模型。在Arena-Hard v2基准测试上，Qwen3-4B-Instruct-2507取得43.4分的成绩，更胜一筹。

在非推理领域，Qwen3-4B-Instruct-2507在知识、推理、编程、对齐以及agengt能力上全面超越了闭源的小尺寸模型GPT-4.1-nano，且与中等规模的Qwen3-30B-A3B（non-thinking）性能接近。

该模型覆盖了更多语言的长尾知识，在主观和开放性任务中与人类偏好的对齐性增强，能够提供更符合需求的答复。

在推理领域，Qwen3-4B-Thinking-2507表现突出，推理能力可媲美中等模型Qwen3-30B-Thinking。特别是在聚焦数学能力的AIME25测评中，以4B参数量取得了81.3分的成绩。

其通用能力也显著提升，Agent分数超越了更大尺寸的Qwen3-30B-Thinking模型。

结语：小尺寸模型加速AI端侧落地

通义千问此次推出的Qwen3-4B系列新模型，以更小的尺寸实现了性能上的优化，在通用能力上展现出超越同级别模型甚至逼近中大规模模型的实力，并且，小尺寸模型展现出了对端侧硬件的更高的友好度。

无论是腾讯、阿里还是OpenAI等AI老玩家，都开始推出小尺寸模型，并且在agent能力上下功夫。这在一定程度上反映出目前主流市场认为小型语言模型（SLM）对Agentic AI的发展具有重要价值。

这类高性能小模型的开源与普及，将有望加速AI技术在端侧设备的渗透，进而推动更多轻量化、场景化的智能应用落地。

展开阅读全文

更新时间：2026-02-06

标签：科技阿里能用模型电脑手机能力尺寸性能知识友好场景成绩规模领域

1 2 3 4 5

阿里开源两款4B小模型：手机电脑都能用，比GPTnano还强

一、性能比肩中尺寸模型，agent能力超越GPT-4.1-nano

结语：小尺寸模型加速AI端侧落地

站在DeepSeek肩膀上，小红书开源首款多模态模型：看懂表情包与数学题，一手实测

“饿了么崩了”冲上热搜！网友吐槽：超时、无法退单，昨天的订单显示备餐状态

华为开源 CANN，向英伟达 CUDA “宣战”？

从青铜器到元宇宙华裔青少年玩转北京

美团Keeta中东提速，阿联酋卡塔尔开城在即

京东被判赔500万，刘强东怒了：背后万亿市场正被巨头疯抢

苏妈出马稳投资者信心：AMD(AMD.US)AI芯片需求强劲市场增量高达千亿级美元

微信：从一开始就没有“已读”功能，以后也不会有

第26次，启动

跟苹果打官司太烧钱！Masimo公司五年砸近2亿美元

大动作！注资1亿，深圳成立一央企子公司，什么信号

特朗普2记重拳！药品250%关税，半导体也不放过？但有一个例外

洲长有约：第二期“垃圾洲”会客厅在昆明举行，王云讲述唤青精神

中广核贝谷与海康威视达成战略合作

因建设工程合同纠纷，新疆建筑科学研究院起诉麦趣尔等

站在DeepSeek肩膀上，小红书开源首款多模态模型：看懂表情

沃尔核材(002130.SZ)：机器人线、电子线、信号线等电线

球队出线在望！梅西第85分钟被拍到在场边玩手机

小米发布HyperOS安全应用2025年8月更新，你的手机收到了

Q2小米手机欧洲市场份额第二卢伟冰：下一步核心战略是

vivo先听劝，旗下首款8000mAh手机登场，千元价位+顶级处理

天玑9400+携8000mAh降临！iQOO Z10 Turbo+改写性能续航

旷达科技：机器人皮肤产品尚未获得正式订单

2025硬核芯云展览：此芯科技高性能通用AI CPU引领端侧AI

财联社8月6日电，马斯克表示，特斯拉正在训练新的FSD模型，