GLM-5.2 正式入驻 Ajelix:1M 上下文窗口与代码能力双重飞跃

ADK Ajelix官方 / ADK编译 2026-07-23 3 分钟 122 次浏览
速览导读 / Summary

Ajelix 宣布引入 Z.ai 最新旗舰模型 GLM-5.2,该模型基于 MIT 开源协议,拥有业界领先的 100 万 token 稳定上下文窗口。相比前代 GLM-5.1,其在 Terminal-Bench 等代码与智能体基准测试中提升显著(Terminal-Bench 提升 17.5 分),专为复杂工作流、长文档分析及高级编程任务设计,旨在强化企业级 AI 自动化能力。

上下文窗口 1M Tokens 稳定且可靠的超长上下文处理能力
Terminal-Bench 2.1 81.0 (+17.5) 代码与终端任务性能显著提升
DeepSWE 46.2 软件工程问题解决能力翻倍
授权协议 MIT License 全球无限制开源

Key Insights / 核心看点

  • 1 GLM-5.2 正式入驻 Ajelix,带来业界领先的 100 万 token 稳定上下文窗口,彻底解决长文档与代码库处理难题。
  • 2 代码与智能体能力实现飞跃,Terminal-Bench 得分提升 17.5 分,DeepSWE 得分翻倍,成为处理复杂编程任务的首选开源模型。
  • 3 基于 MIT 开源协议,无地域限制,专为 Ajelix 的多步骤自动化工作流和高级代理任务量身打造。
  • 4 引入灵活的推理努力级机制,允许用户根据任务复杂度在性能与延迟之间动态平衡。

GLM-5.2 正式入驻 Ajelix:1M 上下文窗口与代码能力双重飞跃

7 月 23 日,AI 工作流自动化平台 Ajelix 宣布正式引入 Z.ai 的最新旗舰模型 GLM-5.2。作为 GLM-5.1 的直接继任者,GLM-5.2 在保持开源开放性的同时,在上下文处理能力和代码生成性能上实现了质的飞跃,标志着企业级 AI 代理在复杂任务执行上的新高度。

核心突破:从“支持”到“稳定”的 1M 上下文

GLM-5.2 最引人注目的特性是其 100 万 token 的上下文窗口。不同于许多模型仅在参数层面宣称支持长文本,GLM-5.2 通过其独特的 IndexShare 架构,真正实现了在超长文档、庞大代码库及多轮对话历史中保持性能不衰减。

  • 全量上下文处理:能够无损耗地处理数万字的技术文档或大型项目代码库。
  • IndexShare 架构:确保在超长上下文中信息检索与推理的稳定性,解决了以往长文本任务中的“遗忘”或“幻觉”问题。

代码与智能体能力的显著跃升

对于开发者而言,GLM-5.2 在编程领域的表现尤为突出。官方数据显示,该模型在关键基准测试中取得了突破性进展:

  • Terminal-Bench 2.1:得分从 63.5 跃升至 81.0,提升幅度超过 17 分。这直接反映了模型在终端操作、自动化脚本编写及多步骤任务完成上的巨大进步。
  • DeepSWE:得分从 18 飙升至 46.2,超过前代两倍,展现了极强的软件工程问题解决能力。
  • SWE-Bench Pro:保持在 62.1 的高位,与顶尖私有模型在专业软件开发任务上保持竞争力。

此外,GLM-5.2 引入了 灵活的推理努力级(Flexible Effort Levels),允许用户根据任务复杂度在性能与延迟之间进行动态平衡,进一步优化了开发体验。

为何选择 GLM-5.2 在 Ajelix?

Ajelix 团队 CTO Arturs 指出:

"GLM-5.2 再次拉高了行业标杆。从 5.1 到 5.2 的跳跃在代码和智能体基准测试中非常显著,特别是在 Terminal-Bench 上。对于那些推动 Ajelix 处理高难度、多步骤工作流的用户来说,这是必须拥有的模型。"

Ajelix 选择 GLM-5.2 主要基于三大标准:

  1. 能力广度:在复杂工作流和多工具编排中表现卓越。
  2. 推理可靠性:在逻辑推理和科学问题解答上表现稳健(AIME 2026 得分 99.2,GPQA-Diamond 得分 91.2)。
  3. 开放可用性:基于 MIT 开源协议,无地域限制,为全球用户提供了最自由的模型选择。

适用场景与切换指南

GLM-5.2 特别适合以下场景:

  • 长链路自动化:涉及多个工具调用、链式决策的复杂代理工作流。
  • 高级编程任务:API 集成、公式逻辑生成、Excel 自动化及数据管道构建。
  • 重型文档分析:跨大代码库检索、密集的多文档分析及全量仓库生成。

用户可在 Ajelix Chat 顶部的模型下拉菜单中随时切换至 GLM-5.2,无需重新训练或配置,即刻享受其带来的生产力提升。


关键指标 (Metrics)

指标 数值 说明
模型参数 753 Billion 混合专家模型规模
上下文窗口 1,000,000 Tokens 业界领先的稳定长上下文
Terminal-Bench 2.1 81.0 较前代提升 17.5 分
DeepSWE 46.2 超过前代两倍
License MIT Open Source 无地域限制,全球可用

"GLM-5.2 raises the bar again. The jump from 5.1 to 5.2 in coding and agentic benchmarks is significant, especially on Terminal-Bench, where the improvement is over 17 points. For our users who push Ajelix on demanding, multi-step workflows, this is the model to be on."

Arturs, CTO at Ajelix

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
模型发布 2026-09-08

Ajelix 自研 GPU 基础设施并推出企业级 Agentic 平台,解决数据主权与生产落地难题

Agentic AI 平台 Ajelix 宣布投资自建 GPU 计算基础设施,并正式发布面向企业的 Ajelix Enterprise Platform。此举旨在解决企业级 AI 落地中数据不可控、审计困难及中断风险等痛点。新平台提供从智能体编排、RAG 知识库到严格治理的全栈能力,支持私有化部署,助力企业将 AI 从实验阶段平稳过渡到生产运营。

Ajelix官方 / ADK编译 4 分钟
AI 工具 2026-09-08

Accio Work 2026 安全剃须刀刀片评测指南发布:覆盖敏感肌与硬茬胡须的全场景解决方案

Accio Work 于 2026 年 9 月发布最新评测指南,针对 2026 年湿剃市场的演变,深度解析了 8 款最佳安全剃须刀刀片。指南涵盖从 Astra Superior Platinum 的全能王者到 Feather Hi-Stainless 的极致锋利,特别强调了针对敏感肌肤(如 Derby Extra Super Stainless)和环保需求(如 Personna Lab Blue)的专项解决方案,为不同肤质与胡须类型的用户提供精准选型建议。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 发布厨房研磨工具智能指南:材料选择与性能优化解析

Accio Work 发布了一篇关于研磨钵(Mortar and Pestle)最佳材料选择的深度指南。文章详细对比了花岗岩、大理石、陶瓷、木材及不锈钢等主流材质在研磨性能、耐用性、维护难度及美学风格上的差异。该指南旨在帮助消费者及零售商根据烹饪需求(如香料粉碎、酱汁制作)做出精准决策,体现了 Accio Work 在垂直领域知识库构建与搜索优化方面的技术实力。

Accio Work官方 / ADK编译 3 分钟
productivity · 免费+付费
★ 5.0 · 120评测
A

Ajelix

处理Excel和Google Sheets表格的AI工具

Ajelix 是基于人工智能的Excel工具平台,能帮助用户高效处理数据和自动化工作流程。Ajelix 支持创建自定义表单、自动化电子表格任务、智能数据分析、数据清理及构建定制解决方案。用户能轻松连接Excel、Google Sheets或SQL等数据源,生成可视化仪表板,通过AI驱动的分析获得即时洞察。Ajelix提供多语言支持和文件格式兼容性,帮助用户减少手动错误、优化工作流程并提升数据质量。

查看 Ajelix 使用教程与功能