Qwen 3.6-35B-A3B 开源:30 亿活跃参数模型在 nexu 平台落地,SWE-bench 验证率超 73%

ADK nexu官方 / ADK编译 2026-04-20 5 分钟 53 次浏览
速览导读 / Summary

阿里通义千问团队于 2026 年 4 月 16 日开源了 Qwen 3.6-35B-A3B 模型,该模型拥有 350 亿总参数但仅 30 亿活跃参数,在 SWE-bench Verified 上达到 73.4% 的卓越表现。作为首个在 nexu 平台落地的开源 MoE 模型,它凭借稀疏架构和超长上下文支持,为开发者提供了高性价比的本地化 Agent 推理方案,标志着开源模型在智能体工作流中正式取代闭源 API 成为默认选择。

活跃参数 3B 稀疏 MoE 架构,推理成本接近 3-4B 稠密模型
SWE-bench Verified 73.4% 超越闭源模型 Claude Sonnet 4.6
原生上下文 262K tokens 支持超长文档与复杂任务规划
扩展上下文 ~1M tokens 通过 YaRN 技术实现

Key Insights / 核心看点

  • 1 Qwen 3.6-35B-A3B 开源,30 亿活跃参数实现 SWE-bench 73.4% 的卓越性能,超越 Claude Sonnet。
  • 2 采用稀疏 MoE 架构与 Gated Attention 机制,原生支持 26 万 token 上下文,显著降低推理成本与显存压力。
  • 3 在 nexu 平台无缝集成,支持本地化部署,为开发者提供高性价比的隐私优先 Agent 解决方案。
  • 4 标志着开源模型正式取代闭源 API 成为智能体工作流的默认选择,推动 Agent 经济模型发生根本性转变。

Qwen 3.6-35B-A3B 开源:30 亿活跃参数模型在 nexu 平台落地,SWE-bench 验证率超 73%

更新背景与核心突破

2026 年 4 月 16 日,阿里通义千问团队正式发布了 Qwen 3.6-35B-A3B,这是 Qwen 3.6 系列中首个开源权重的模型。该模型的发布标志着 AI 智能体(Agent)领域的一次重要范式转移:开源模型不再仅仅是实验性尝试,而是具备了在真实 GitHub 问题修复和代码审查任务中超越闭源旗舰模型(如 Claude Sonnet)的实战能力。

与以往不同,Qwen 3.6-35B-A3B 采用了创新的 Sparse MoE(稀疏混合专家) 架构,在保持 350 亿总参数量的同时,将活跃参数(Active Parameters)压缩至仅 30 亿。这一架构特性使得模型在推理成本上接近 3-4B 的稠密模型,却拥有接近 35B 模型的性能表现,彻底打破了“高参数=高成本”的传统认知。

关键技术指标与架构亮点

该模型在技术规格上实现了多项突破,特别针对 Agent 场景进行了深度优化:

  • 稀疏 MoE 架构:包含 256 个专家网络,采用 8 个路由专家 + 1 个共享专家的结构,显著降低了计算负载。
  • 超长上下文支持:原生支持 262,144 tokens,并通过 YaRN 技术扩展至约 1.01M tokens,完美适配长文档分析与复杂任务规划。
  • KV Cache 优化:采用 Gated DeltaNet + Gated Attention 机制,查询头(Query Heads)为 16,键值头(KV Heads)仅为 2,极大缓解了显存压力,使 64K 上下文任务在消费级显卡上也能流畅运行至 128K+。
  • SWE-bench Verified 表现:达到 73.4% 的验证率,超越闭源模型 Claude Sonnet 4.6(约 71%),在代码生成与调试任务中表现强劲。

在 nexu 平台的应用价值

Qwen 3.6-35B-A3B 的发布与 nexu(OpenClaw 桌面客户端)的深度集成,为开发者提供了极佳的本地化 Agent 部署方案。

  1. 无缝集成:nexu 用户无需修改提示词(Prompt),直接配置模型标识符为 qwen3.6-35b-a3b 即可使用。支持通过 Ollama、vLLM、SGLang 等本地运行时,或 DashScope、OpenRouter 等云端端点运行。
  2. 本地优先策略:对于需要数据隐私合规(如医疗、法律行业)或希望避免 API 费用的场景,该模型允许开发者在本地 GPU 或 M 系列 Mac 上运行复杂的代码审查(Code Review)和 PR 分诊任务。
  3. 混合部署策略:建议开发者采用“混合模式”——将 80% 的常规 Agent 任务(如总结、草案生成)路由至本地 Qwen 3.6-35B-A3B,仅将高难度推理任务路由至闭源旗舰模型(如 Qwen 3.6-Max-Preview),以平衡成本与性能。

行业意义与展望

Qwen 3.6-35B-A3B 的发布打破了开源模型在智能体领域的“性能天花板”。随着 DeepSeek V3.5、Llama 4.2 Scout 等模型相继突破 70% 的 SWE-bench 门槛,闭源模型在“模型质量”上的护城河已不复存在。未来的竞争焦点将转向产品化能力(如 Claude Code 的特定工作流、ChatGPT Pulse 的集成度)。

对于独立开发者而言,这意味着可以构建完全自主可控的 Agent 栈,无需依赖昂贵的 API 调用。随着社区对 GGUF/MLX 量化版本的支持以及 vLLM/SGLang 对该 MoE 架构的适配,Qwen 3.6-35B-A3B 有望成为下一代本地智能体生态的基石。

"Open-weight models crossing the 70% SWE-bench Verified line was the moment the agent-stack economics flipped." —— 官方团队关于开源模型改变智能体经济学的总结

Open-weight models crossing the 70% SWE-bench Verified line was the moment the agent-stack economics flipped.

官方团队

同主题深度资讯

查看更多 →
模型发布 2026-09-08

Framer AI 发布 CMS List Field:重构重复内容管理,赋能动态网站构建

Framer 于 2026 年 9 月正式发布 CMS List Field,彻底革新了重复内容(如 FAQ、产品特性)的管理方式。该更新引入原生列表字段,支持通过 Framer Agent 一键迁移旧数据,并优化了编辑器的内容复用与排序能力。此次更新不仅解决了垂直视频嵌入等长期存在的 Bug,还显著提升了大型 CMS 集合的滚动性能,为开发者提供了更强大的动态内容构建工具。

Framer AI官方 / ADK编译 4 分钟
模型发布 2026-09-08

Ajelix 自研 GPU 基础设施并推出企业级 Agentic 平台,解决数据主权与生产落地难题

Agentic AI 平台 Ajelix 宣布投资自建 GPU 计算基础设施,并正式发布面向企业的 Ajelix Enterprise Platform。此举旨在解决企业级 AI 落地中数据不可控、审计困难及中断风险等痛点。新平台提供从智能体编排、RAG 知识库到严格治理的全栈能力,支持私有化部署,助力企业将 AI 从实验阶段平稳过渡到生产运营。

Ajelix官方 / ADK编译 4 分钟
AI 工具 2026-09-08

DreamFace 发布 AI 直播生成器:零设备打造虚拟主播,重塑内容创作流程

DreamFace 正式推出 AI 直播生成功能,彻底消除传统直播对相机、灯光及推流软件的依赖。用户仅需上传照片或选择虚拟形象,配合脚本即可在数分钟内生成具备真实直播节奏与能量的视频。该工具支持游戏、带货、播客等多种模板,让创作者无需露脸即可测试新内容形式,大幅降低内容生产的门槛与试错成本。

DreamFace官方 / ADK编译 3 分钟
技术解读 2026-09-08

Accio Work 发布 F1 电视转播技术深度解析:8K 流媒体与超低延迟架构揭秘

Accio Work 深度编译 F1 TV 如何永久改变体育转播的历程,聚焦于日本市场策略、8K 流媒体技术革新及超低延迟架构。文章揭示了现代体育直播对带宽、编码及 CDN 的极致要求,包括 45% 的带宽消耗增长和亚 200ms 延迟标准。同时探讨了数字观众如何驱动 23 亿美元的周边销售,为开发者与架构师提供了从传统广播向数字化、智能化转型的宝贵案例与技术指标参考。

Accio Work官方 / ADK编译 3 分钟
agent · 免费
★ 5.0 · 120评测
n

nexu

免费开源的 OpenClaw 桌面客户端

nexu 是免费开源的OpenClaw桌面客户端,用户可通过图形界面将 AI Agent 接入微信、飞书、Slack 和 Discord。nexu 采用本地优先架构,数据 100% 本地保留,支持 Gemini、Claude、ChatGPT等多模型一键切换,可自带 API Key 免登录使用。nexu 作为最快接入Seedance 2.0的开源龙虾,nexu无需命令行,双击即用,适合个人开发者和小团队打造”一人公司”的 AI 工作流。

查看 nexu 使用教程与功能