Felo Search 集成 GPT-6 Astra:首个获“关键级”认证的开源数学难题求解者

ADK Felo官方 / ADK编译 2026-09-03 5 分钟 48 次浏览
速览导读 / Summary

Felo Search 正式集成 OpenAI 最新旗舰模型 GPT-6 Astra,该模型在数学领域首次解决了十个长期悬而未决的难题,并首次获得 OpenAI 预备性框架下的“关键级(Critical)”安全评级。Astra 拥有 105 万 token 的上下文窗口,支持多模态输入与软件操作,旨在处理需要深度推理、跨语言合成及复杂验证的研究级任务。

上下文窗口 1,050,000 tokens 支持超长文档与多轮对话
数学难题解决数 10 涵盖非索菲群、刚性猜想等
安全评级 Critical OpenAI 预备性框架最高级
Jailbreak 拒绝率 91.5% 显著高于前代 GPT-5.6 Sol
API 定价 $10/$50/百万 输入/输出 token 价格

Key Insights / 核心看点

  • 1 GPT-6 Astra 首次解决数学与理论计算机科学领域十个长期未解难题,并附带 Lean 4 机器验证证明。
  • 2 成为首个获得 OpenAI 预备性框架“关键级(Critical)”安全评级的模型,在漏洞发现与攻击链构建测试中表现卓越。
  • 3 支持 105 万 token 上下文窗口,具备软件操作能力,OSWorld 测试得分 72.6%,显著优于前代旗舰。
  • 4 Felo Search 用户可无缝切换至 Astra,享受无需人工分步指导的深度推理与多步任务处理能力。

Felo Search 集成 GPT-6 Astra:开启深度推理与“关键级”安全新纪元

OpenAI 于 9 月 3 日发布了其最新旗舰模型 GPT-6 Astra,并宣布将其集成至 Felo Search 平台。此次发布具有双重历史意义:Astra 不仅解决了数学与理论计算机科学领域十个自 1999 年以来未解的难题,更首次跨越了 OpenAI 预备性框架中的“关键级(Critical)”安全阈值,成为首个达到此级别的 OpenAI 模型。

核心突破:从理论到实践的跨越

GPT-6 Astra 被定位为端到端工作的终极工具,涵盖代码生成、深度研究、计算机操作及文档创建。其技术规格公开透明,支持高达 1,050,000 tokens 的上下文窗口,最大输出可达 128,000 tokens,知识截止日为 2026 年 4 月 30 日。

十道数学难题的破局

Astra 的首次公开披露展示了其在纯逻辑推理上的惊人能力。它成功解决了包括“首个已知非索菲群(first known non-sofic group)”在内的十个长期悬案,并推翻了 Alain Connes 于 1980 年提出的刚性猜想。尤为值得一提的是,所有结果均附带由 Lean 4 机器验证的证明 artifacts,实现了“人类策展、机器验证”的严谨闭环。

“关键级”安全评级:信任但需验证

OpenAI 的预备性框架将模型评级从低到高分为多个层级,Astra 是首个获得“Critical”评级的模型。这一评级意味着模型具备在无人工分步指导的情况下,发现未知漏洞、构建攻击链并绕过防御系统的能力。

官方数据佐证了其在安全测试中的表现:

  • ExploitBench 评分:100%(满分)
  • ExploitGym 评分:42.4%(GPT-5.6 Sol 为 30.3%)
  • Jailbreak 拒绝率:91.5%(GPT-5.6 Sol 为 59%)
  • 内部分级漏洞测试:在特定高权限环境下,Astra 表现出约 39% 的任意代码执行率(注:此为内部基准测试数据,非默认生产配置,且 OpenAI 已部署自动化审查与监控机制以限制其实际风险)

Felo Search 用户价值:重塑搜索与推理边界

将 GPT-6 Astra 引入 Felo Search,意味着搜索引擎的能力从简单的信息检索升级为复杂的逻辑推理与事实核查。

  1. 多步推理链的完整性:Astra 能够处理需要长链条推断的任务,如跨语言合成、多跳事实验证及复杂数学推导,确保推理过程不出现断点。
  2. 软件操作与自主执行:在 OSWorld V2-Offline 测试中,Astra 得分 72.6%,优于 GPT-5.6 Sol 的 65.7%。它能像人一样操作浏览器、电子表格及终端,平均任务耗时从 75 分钟缩短至 40 分钟。
  3. 自我反思与上下文保持:在 Codex 任务中,Astra 保留了跨上下文窗口的自我反思笔记,确保任务执行的连贯性。

开发者与用户指南

Felo Search 允许用户通过搜索框旁的模型选择器一键切换至 GPT-6 Astra。无论用户订阅何种计划,均可访问该模型。对于开发者而言,Astra 提供了强大的 API 支持(输入 $1/百万,输出 $50/百万),适合构建需要高精度推理与代码生成的应用。

“Astra 代表了我们在端到端工作流上的最新一步,它不仅解决了数学界的古老谜题,更在安全与能力之间找到了新的平衡点。” —— OpenAI 团队

尽管拥有“关键级”能力,OpenAI 与 Felo Search 均强调责任使用。在生产环境中,高级安全功能(如自动化预执行审查、行动监控)将默认启用,以平衡强大能力与潜在风险。

Astra is the first OpenAI model to cross the 'Critical' threshold of the Preparedness Framework — a level GPT-5.6 Sol, the previous flagship, did not reach.

OpenAI Official Announcement

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
AI 工具 2026-09-08

Accio Work 2026 安全剃须刀刀片评测指南发布:覆盖敏感肌与硬茬胡须的全场景解决方案

Accio Work 于 2026 年 9 月发布最新评测指南,针对 2026 年湿剃市场的演变,深度解析了 8 款最佳安全剃须刀刀片。指南涵盖从 Astra Superior Platinum 的全能王者到 Feather Hi-Stainless 的极致锋利,特别强调了针对敏感肌肤(如 Derby Extra Super Stainless)和环保需求(如 Personna Lab Blue)的专项解决方案,为不同肤质与胡须类型的用户提供精准选型建议。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 发布厨房研磨工具智能指南:材料选择与性能优化解析

Accio Work 发布了一篇关于研磨钵(Mortar and Pestle)最佳材料选择的深度指南。文章详细对比了花岗岩、大理石、陶瓷、木材及不锈钢等主流材质在研磨性能、耐用性、维护难度及美学风格上的差异。该指南旨在帮助消费者及零售商根据烹饪需求(如香料粉碎、酱汁制作)做出精准决策,体现了 Accio Work 在垂直领域知识库构建与搜索优化方面的技术实力。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 2026 年迷你喷射快艇设计趋势:电动化与模块化重塑水上运动

Accio Work 发布 2026 年迷你喷射快艇设计趋势报告,展示了 9 款重新定义水上运动的新概念。核心亮点包括革命性的充气式电动快艇、热插拔电池系统的通勤者设计、以及专为家庭安全优化的模块化构建方案。这些设计利用先进复合材料与零排放电动动力,解决了传统水上运动便携性差、续航焦虑及安全性不足的问题,为个人娱乐与商业租赁市场提供了全新灵感。

Accio Work官方 / ADK编译 3 分钟
search · 免费
★ 5.0 · 120评测
F

Felo

免费AI智能搜索引擎,支持社交联网搜索和多语种问答结果

Felo是免费AI智能搜索引擎,支持社交联网搜索和多语种问答结果。用户可以自然语言提问,Felo能理解并分解问题,同时提供中文和英文搜索结果。Felo以分块形式展示答案,每块都有详细内容和来源链接。Felo还提供社交搜索、专业搜索和主题问答功能,满足不同用户的需求。Felo Pro订阅服务每月14.99美元,提供100次专业搜索和多种AI模型选择。

查看 Felo 使用教程与功能