模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Qodo 发布 Gen 1.0:引入 Agent 模式,重塑企业级 AI 开发工作流
Qodo 正式推出 Qodo Gen 1.0,核心引入全新的 Agent 模式,将 AI 从简单的代码生成工具升级为具备自主规划能力的智能体。该版本通过 LangGraph 构建基础设施,支持 Model Context Protocol (MCP) 实现动态工具调用,并深化了测试生成能力。对于企业开发者而言,这意味着 AI 能自主拆解复杂任务、串联多步逻辑,显著提升了全栈开发与调试效率。
ElevenLabs 发布 Flows:构建统一的多模态创意流水线
ElevenLabs 正式推出 Flows,这是一个基于节点的创意画布,旨在解决当前多模态创作流程碎片化的痛点。Flows 将图像生成、视频、文本转语音、唇形同步、音效及音乐整合至单一工作区,支持端到端的流水线构建与批量执行。开发者可复用节点结构进行无限变体测试,并即将开放 API 以支持自动化集成,标志着 AI 创作从单点工具向系统化基础设施的转型。
GoEnhance 发布 AI 图像编辑新范式:从局部重绘到智能语义理解
GoEnhance 于 2026 年 8 月 25 日推出其新一代 AI 图像编辑能力,标志着从传统的局部重绘(Inpainting)向基于语义理解的智能编辑转变。此次更新引入了基于 Qwen-Image 架构的上下文感知编辑引擎,支持自然语言指令直接修改图像内容,并实现了像素级精准控制。对于设计师和开发者而言,这意味着无需繁琐的遮罩操作,即可通过自然语言完成复杂的图像合成与修复任务。
Shortcut 发布 Pivot 0.5:27B 参数模型以 1/3 成本逼近 Sonnet 4.5 金融建模能力
Shortcut 正式推出其首款自研模型 Pivot 0.5,这是一个基于 Qwen3.5-27B 微调的垂直领域大模型。该模型在金融与电子表格任务上实现了显著突破,在 ShortcutBench v1 基准测试中得分达 64.4%,性能逼近 Sonnet 4.5,但任务成本仅为后者的 1/3。文章详细披露了其基于真实用户数据的训练集构建、OPD 蒸馏与 RLVR 强化学习训练流程,以及自研的 Mog 环境加速技术,展示了小团队构建前沿垂直模型的可能性。
CREAO 集成 Claude Opus 4.7:多步任务执行效率提升 56%,图像解析分辨率突破 2576 像素
CREAO 正式集成 Anthropic 最新发布的 Claude Opus 4.7 模型。此次升级针对复杂多步工作流进行了深度优化,任务完成率提升 14%,工具错误率降低至三分之一。同时,模型支持高达 2576 像素的长边图像解析,并在多 Agent 并行运行场景下实现了 56% 的模型调用减少和 24% 的响应速度提升,显著降低了企业级 AI 应用的运营成本。
IBM Watson 发布新一代智能语音引擎:从 AI 测试到真实商业突破
IBM Watson 在 Think 2026 峰会上正式推出其最新一代智能语音引擎,标志着从实验室 AI 测试向真实商业场景应用的重大跨越。此次更新不仅大幅提升了语音合成的自然度与情感表达,更引入了基于 Agent 的自适应交互能力,解决了传统 TTS 在复杂业务场景下的僵化问题。该引擎通过优化 Context Window 与多模态对齐技术,实现了零样本(Zero-shot)场景下的精准语音生成,为金融、医疗及客服等行业提供了全新的数字化沟通解决方案。
Miro 发布 Canvas 26 与 MCP 服务器:AI 协作新范式与零成本企业级增强
Miro 正式推出 Canvas 26,将个人 AI 愿景转化为组织级影响力,并开源 MCP 服务器以深度集成开发工作流。企业版用户可免费获得新增的 AI 能力,无需额外付费。此次更新标志着 Miro 从协作白板向智能画布(Intelligent Canvas)的转型,通过上下文感知与结构化数据管理,重新定义 AI 时代的团队协作模式。
Label Studio 发布生产环境 AI 智能体评估新范式:从黑盒结果到全链路轨迹审计
Label Studio 发布深度指南,针对生产环境中 AI 智能体(Agent)的评估痛点提出三大核心策略。文章指出传统仅关注最终输出的“黑盒”评估方式存在严重缺陷,强调需转向基于轨迹(Trajectory)的“玻璃盒”评估。通过引入经济导向指标、软失败阈值机制,并利用 Label Studio Enterprise 将嵌套 JSON 日志转化为可视化树状结构,结合领域专家校准自动化 LLM 裁判,构建可解释、可审计的智能体评估闭环。
LTX Studio 发布 Cinemagraph LoRA:将静态帧转化为动态循环视频
LTX Studio 最新推出 Cinemagraph LoRA 功能,利用 LoRA(Low-Rank Adaptation)技术将静态图像帧转化为流畅的循环动态视频。该更新显著降低了视频生成的门槛,使开发者与创作者能够以极低的计算成本实现高质量的视频动画效果,适用于广告、社交媒体及交互式应用等场景。
字节跳动 Seedance 2.5 发布:30 秒原生生成与多模态参考重塑 AI 视频工作流
字节跳动 Seed 团队正式发布 Seedance 2.5,标志着 AI 视频生成从“碎片化剪辑”迈向“原生长视频生产”的关键转折。该模型支持单轮生成 30 秒高质量叙事视频,并引入多模态参考(支持 50 个资产)、亚秒级时间戳编辑及绿幕/白模渲染能力。实测显示,其在复杂场景一致性、物理光影渲染及后期可控性上显著提升,大幅降低企业级视频制作门槛。
Chroma1-HD 开源模型发布:基于 FLUX.1 架构的 89 亿参数高清生成新突破
Lodestone AI 正式推出 Chroma1-HD,一款基于 FLUX.1-schnell 架构的开源图像生成模型。该模型拥有 89 亿参数,支持 1024×1024 高分辨率输出,并在消费级显卡(如 RTX 3080)上实现比量化版本快 2.5 倍的生成速度。文章详细解析了其 Rectified Flow Transformer 架构优势、部署指南及性能基准,为开发者提供了在本地高效运行专业级 AI 绘图的新方案。
LocalBanana 发布多面板 AI 图像生成指南:实现漫画分镜与角色一致性
LocalBanana 官方发布深度指南,详解如何在单张图像中生成多面板内容(如漫画、故事板)。文章揭示了 Nano Banana Pro 模型在保持跨面板角色一致性方面的优势,并提供了基于“网格定义、主体锚定、变量隔离、不变量锁定”的四步核心提示词结构。同时,文章分析了不同网格尺寸(2x2 至 3x3)的可靠性差异,为开发者与创作者提供了可落地的多面板生成策略。