模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Airbrush 发布 AI 人像重光技术:重塑自然肖像光影,赋能创作者
Airbrush 最新博客文章深入解析其核心 AI 功能——AI Photo Relighting(智能人像重光)。该技术利用先进算法自动分析面部结构,重新分配光照以消除阴影、提亮肤色,实现比传统修图更自然的肖像效果。文章不仅展示了技术原理,还提供了详细的操作教程,标志着 Airbrush 从基础修图向高阶 AI 创作工具的跨越。
Writer 发布 Palmyra X6 与代理工作流升级:低成本、高规模的企业级 AI 新范式
Writer 正式推出旗舰模型 Palmyra X6 及全面升级的 WRITER Agent,旨在解决企业级 AI 代理工作流中成本不可控与效率低下的痛点。Palmyra X6 在保持前沿性能的同时,将单任务成本与延迟减半,支持长达 8 小时不间断运行。配合新架构的 WRITER Agent,整体任务成本降低 52%,速度提升 48%。新增的 AI Studio 治理功能让管理员能实时监控 Token 消耗并灵活调度多模型,实现规模化部署下的预算可控与 ROI 最大化。
DomoAI 发布多模态动态化引擎:让静态图像在任意设备上‘开口说话’
DomoAI 近期重磅推出新一代图像动态化解决方案,支持将静态图片转化为具有口型同步、自然运镜的短视频。该工具基于先进的 AI 视频生成模型,兼容移动端与 PC 端,核心突破在于实现了高精度的人物口型匹配与背景动态渲染。开发者可通过 API 快速集成该能力,内容创作者可一键制作Talking Head 视频,极大降低了 AI 视频内容的生产门槛。
Viggle V3 助力 Massive Studios 打造百万级病毒营销广告:角色一致性革命
Viggle V3 正式发布,成功协助 Massive Studios 打造首个病毒级 AI 广告。该广告通过 parody 苹果 1984 经典广告,推广 Sally's Pizza 与 Beckham 的辣椒酱联名。面对通用视频生成工具难以维持动态中角色与服饰一致性的痛点,Viggle V3 凭借强大的全身体动控制与视觉连贯性技术,成为核心引擎。此次合作标志着 AI 从演示走向真实商业叙事,展示了 GenAI 与传统影视制作深度融合的巨大潜力。
Felo 发布 GPT-6 Astra 模型:105 万上下文窗口与完整 API 生态升级
Felo 正式通过 OpenAPI 接口集成 GPT-6 Astra 模型,该模型具备 1.05M 上下文窗口和 128K 最大输出长度,并完全兼容 Chat Completions、Responses 及 Messages 端点。此次更新显著提升了长文档处理与复杂任务规划能力,为开发者提供了更强大的 Agent 构建基础。
CyberRealistic XL 8.0 发布:AI 生成写实人像新标杆,手眼细节突破
Cyberdelia 推出的 CyberRealistic XL 8.0 基于 SDXL 架构,专为生成高保真写实图像设计。该模型在 v7.0 基础上进一步优化,显著解决了 AI 生成中手部与眼部常见的扭曲问题,并大幅降低了显存需求。通过混合数据集训练与迭代微调,它成为目前生成高质量人像、肖像及复杂场景的可靠工具,支持 SFW 及 NSFW 内容创作。
Xiaohongshu dots-note-3.0 在 IMO 2026 斩获满分:AI 证明写作迈入新纪元
Xiaohongshu 推出的 dots-note-3.0 模型在国际数学奥林匹克(IMO)2026 比赛中首次实现完美 42/42 的官方满分成绩。该模型不仅给出了正确答案,更完成了六道难题的完整逻辑证明,涵盖代数、几何、组合数论四大领域。此次突破标志着 AI 从“答案生成”向“严谨逻辑推导”的质变,展示了其在长链条自我验证与多领域跨模态推理上的新高度。
Nafy AI 进阶指南:参数微调与提示工程实战,解锁七项隐藏创作功能
Nafy AI 发布深度创作指南,详解如何通过参数微调、提示工程及结构化提示词优化 AI 音乐生成。核心亮点包括精细控制段落结构(如 Intro/Verse/Bridge)、实现多声部合唱与说唱无缝切换、精确设定 BPM 与情感基调,并解锁了包括独奏乐器指定、和弦符号控制在内的七项隐藏功能,助力开发者与创作者从基础生成迈向专业级音乐制作。
WatermarkRemover 发布:AI 驱动的高效去水印工具,重塑图像版权与分享体验
WatermarkRemover 推出全新 AI 驱动的去水印解决方案,旨在解决传统裁剪法无法保留原图质量及水印影响专业度的痛点。该工具无需安装,支持一键上传与自动检测,承诺在去除水印的同时完美保留图像分辨率与细节。文章强调,去除水印不仅是技术操作,更是保护摄影师声誉、提升社交媒体互动率及避免版权纠纷的关键策略。
DeepMind 发布 AlphaGenome:突破百万碱基长序列预测,重塑基因组功能理解
DeepMind 正式推出 AlphaGenome,一款旨在全面解析基因组功能的新一代 AI 模型。该模型支持长达 100 万碱基对的输入,实现了单碱基分辨率的预测,突破了传统模型在序列长度与预测精度之间的权衡。AlphaGenome 不仅继承了 Enformer 的架构优势,还显著提升了计算效率,为基因调控机制、疾病变异评分及剪接位点建模提供了前所未有的高精度工具,现已通过 API 向非商业科研开放。
Qodo 自托管 DeepSeek-R1:开源推理模型赋能 IDE 开发工作流
Qodo 正式在 IDE 插件中支持自托管 DeepSeek-R1,填补开源领域与闭源推理模型(如 OpenAI o1)之间的能力鸿沟。该模型具备系统 2 级推理能力,在复杂代码审查与架构设计任务中表现卓越,同时提供高达 30 倍的成本优势和 5 倍的速度提升。开发者可通过 VSCode 和 JetBrains 插件无缝集成,享受安全、私有的 AI 编码辅助体验。
Kimi K3 发布:全球首个开源 2.8T 参数模型,重塑长程推理与自主智能体边界
Kimi 正式推出 Kimi K3,作为全球首个开源 2.8T 参数模型,基于 Kimi Delta Attention 与 Attention Residuals 架构,配备原生视觉能力与 100 万 token 上下文窗口。该模型在长程代码生成、GPU 编译器构建、芯片设计及科学计算等前沿任务中展现出自主智能体能力,部分任务效率超越传统专家系统。