模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
DeepSeek V4 Flash 评测:284B 参数架构下的极致性价比与长上下文突破
DeepSeek 正式发布 V4 Flash 版本,采用 MoE 架构(总参 284B,激活参 13B),支持 100 万 token 超长上下文。在保持 GPT-4.1 级推理能力的同时,输入输出成本大幅降低,SWE-bench Verified 得分 79.0%。评测显示其在代码生成与逻辑推理上表现优异,但在超长文档综合任务中存在轻微连贯性下降,是追求极致性价比开发者的理想选择。
二狗 PPT 2.0 深度解析:中式工作场景下的 AI 演示新范式
二狗 PPT 针对中文职场场景推出深度优化,内置中式专用模板库,AI 智能识别内容排版意图,支持 PPTX 双向导入导出及主题三维度微调。相比 Gamma、Tome 等国际竞品,二狗 PPT 在本地化适配与办公兼容性上表现卓越,成为职场述职、方案汇报的首选工具。
Ajelix 发布多语言语音交互功能:支持 36 种语言,打破 AI 使用壁垒
Agentic AI 平台 Ajelix 正式推出 Text-to-Speech (TTS) 与 Speech-to-Text (STT) 功能,支持全球 36 种语言。该更新旨在消除语言障碍,提升无障碍访问体验,允许用户通过麦克风输入指令并聆听 AI 语音回复。作为欧盟总部企业,Ajelix 此举标志着其致力于构建真正包容性 AI 生态的重要一步,覆盖欧洲、亚洲、美洲及中东地区,让非英语母语用户也能无障碍使用 AI 工具。
Listnr.ai 2026 发布:AI 语音克隆重塑社媒视频创作新范式
在 2026 年社媒视频竞争白热化的背景下,Listnr.ai 推出全新 AI 语音克隆与定制音频解决方案,填补了 Invideo、CapCut 等主流工具在深度音频定制上的空白。通过生成式语音技术,Listnr 帮助品牌打造专属配音,实现低成本、高效率的视频叙事升级,成为创作者与营销团队的新宠。
Google I/O 2026 前瞻:Gemini Omni 视频编辑与 Antigravity 2.0 性能突破
Google I/O 2026 大会聚焦 Gemini 生态的全面升级,核心亮点包括支持物理模拟与视频编辑的 Gemini Omni 模型、12 倍加速的 Antigravity 2.0 编程工具,以及全天候运行的 Gemini Spark 智能助手。此次更新不仅强化了 Google 搜索与硬件(Android XR 眼镜)的 AI 融合,更通过 MCP 协议为开发者提供了更流畅的跨应用自动化工作流,显著提升了内容创作与生产力效率。
Suno 发布 Persona 功能:让音乐拥有独立灵魂,开启风格化创作新纪元
Suno 正式推出 Persona 功能,允许用户将喜爱歌曲的音色、风格和氛围“固化”为独立的创作资产。该功能支持公开/私有设置,用户可基于特定音乐特质生成无限变体,并邀请他人协作。目前面向 Pro/Premier 用户开放 Beta 测试,每首生成消耗 10 积分,旨在通过社区反馈优化 AI 音乐生成体验。
LTX Studio 发布对话导演指南:精准控制角色台词、停顿与情感节奏
LTX Studio 最新技术指南深入解析了如何通过提示词工程(Prompt Engineering)精准控制 AI 视频生成中的角色表现。文章详细阐述了针对角色台词、自然停顿及情感高潮点的导演级指令技巧,帮助开发者在 LTX-2.5 等新一代模型中实现从‘生成视频’到‘演绎视频’的跨越,显著提升内容创作的叙事质感。
Captions 24 小时 AI 新闻直播实验:Avatar X 在连续生成中的身份保持与音频挑战
Captions 团队于 2024 年 11 月 1 日发起了一项名为'Mirage News Network'的 24 小时 AI 新闻直播实验,旨在测试 Avatar X 模型在长时间连续运行下的身份保持(Identity Preservation)能力。实验由单台机器编排,消耗约 5 万美元 Token 成本,生成了 100 多个原创片段。尽管在视频连贯性上表现优异,但音频节奏仍显机械。该实验吸引了超过 5 万人观看,验证了 AI 视频在长时程场景中的潜力与当前局限。
Higgsfield 发布 Higgsfield Supercomputer:以 Agentic AI 重构内容生产全流程
Higgsfield 正式推出 Higgsfield Supercomputer,一款基于 Agentic AI 架构的内容生产中枢。该工具摒弃了传统 AI 工具需用户手动操作的模式,通过智能编排(Orchestration)自动规划任务、选择模型并交付成品。Supercomputer 整合了 Anthropic、OpenAI 等前沿推理模型及 Veo、Kling 等生成式模型,并引入“AI 员工”与“技能(Skills)”机制,让创作者仅需描述目标即可自动生成视频、广告或产品图,大幅降低内容生产的门槛与成本。
Higgsfield 发布 Popcorn:AI 驱动的电影级分镜生成与编辑新范式
Higgsfield 正式推出 Higgsfield Popcorn,一款革命性的 AI 分镜生成工具。它支持手动与全自动两种模式,利用多输入场景理解和角色一致性引擎,将文本或图片提示转化为连贯、可编辑的电影级分镜。该工具解决了传统 AI 生成中角色崩坏和场景割裂的痛点,支持多种画幅比及实时编辑,为影视、广告及教育领域的创作者提供了前所未有的预可视化能力。
Higgsfield 发布 Seedance 2.0 与 Claude Fable 5 工作流,打造电影级 AI 短视频
Higgsfield 联合 Seedance 与 Claude Fable 5 推出全新影视化工作流,通过标准化的资产生成(Character Sheet)与多阶段渲染策略,解决 AI 视频生成中角色一致性难题。该方案利用 Seedance 2.0 实现高质量短片制作,结合 Claude Fable 5 的脚本能力,为开发者提供从概念到成片的完整自动化路径。
Claude Fable 5 发布与紧急下架:Anthropic 首次因出口管制暂停商业旗舰模型
Anthropic 发布了其 Mythos 级旗舰模型 Claude Fable 5,拥有 100 万 token 上下文窗口和自适应思考能力,SWE-bench Verified 高达 95%。然而,该模型在发布仅 3 天后即因美国政府出口管制令被强制下架 19 天,随后重新上线并增加访问控制。此次事件标志着商业 AI 模型首次因监管原因被暂停,引发了关于模型能力、安全机制及合规风险的深刻讨论。