)
文章目录9月2日【多模态大模型】全球最强模型 Claude Fable 5.1 发布【重要】9月3日【多模态大模型】Meta 发布新模型 Muse Spark 1.3【重要】【多模态大模型】谷歌发布新模型 Gemini 3.8 Flash【重要】9月4日【多模态大模型】OpenAI 发布最强模型 GPT-6 Astra【重要】9月8日【端侧大模型】面壁智能发布超强端侧大模型 MiniCPM5-2B9月9日【图像生成模型】OpenAI 发布最强图像生成模型 Images 2.5【重要】9月10日【多模态大模型】DeepSeek V4.1 Flash 正式发布9月15日【视频生成/编辑模型】生数科技发布新模型 Vidu S29月21日【多模态大模型】阶跃星辰发布新一代基础模型 Step 5 Preview【重要】【图像生成模型】阿里发布最强开源生图模型 Qwen-Image-2.19月22日【多模态大模型】小米发布最强开源大模型 MiMO V2.6【重要】【多模态大模型】SpaceAI 发布新款旗舰模型 Grok 4.7【重要】9月23日【多模态大模型】最强模型 Claude Opus 5.5 发布【重要】【多模态大模型】GPT-6 系列新模型发布【重要】9月29日【多模态大模型】Anthropic 发布 Claude Sonnet 5.5【重要】9月30日【多模态大模型】OpenAI 发布 GPT-6.1 Sol【重要】9月2日【多模态大模型】全球最强模型 Claude Fable 5.1 发布【重要】今天Anthropic 发布了新一代大模型Claude Fable 5.1以及模型Claude Mythos 5.1。Claude Fable 5.1被 Anthropic 称为目前最强大的公开可用模型专为复杂推理、长周期任务和智能体工作流打造而Claude Mythos 5.1则代表他们探索的更高能力边界。Claude Fable 5.1在多项基准测试上的表现均超越了Claude Fable 5但是价格却更便宜了在保持基础价格相同的情况下缓存读取的成本比Claude Fable 5还降低了 75%这使得在实际情况中的高度智能体化的工作负载成本最高可以降低 45%。另外Anthropic 提出Claude Fable 5.1的一项变化是更愿意追踪问题的根本原因也更适合执行数小时甚至数十小时的复杂任务Claude Fable 5.1面向普通用户、开发者和企业开放而Claude Mythos 5.1则面向经过审核的高风险领域合作伙伴开放保持更严格的访问限制。9月3日【多模态大模型】Meta 发布新模型 Muse Spark 1.3【重要】刚刚Meta 发布了新的旗舰模型Muse Spark 1.3该模型的综合能力超越了目前所有的国产模型也超越了Grok 4.6 (high)和GPT-5.6 (max)达到了和Claude Opus 5同样的水平。在具体的评测中Muse Spark 1.3已经在编程和智能体任务上部分超越了Claude Opus 5 (max)。另外官方还宣称Muse Spark 1.3比Muse Spark 1.2平均减少了 20% 的工具调用和 25% 的 Token 消耗同时也会少浪费一些无效轮次在长程任务中也更容易记住一开始的要求。Muse Spark 1.3的 API 价格仍然和Muse Spark 1.2保持一致为 1.25美元 / 1M 输入token 和 4.25 美元 / 1M 输出token缓存输入价格更是降低到 0.15 美元 / 1M token。另外Muse Spark 还宣称即将在后续开放权重。【多模态大模型】谷歌发布新模型 Gemini 3.8 Flash【重要】今天谷歌正式发布了新的旗舰模型Gemini 3.8 Flash这是谷歌在短短六周内推出的第三款 Flash 系列模型。根据介绍Gemini 3.8 Flash在保持了和Gemini 3.7 Flash相同的速度和成本的优势上进一步提升了推理、编程能力重点强化了软件工程、智能体任务和复杂多步骤推理的场景。Gemini 3.8 Flash分为普通版和网络安全领域的专用版Gemini 3.8 Flash Cyber后者被认为是谷歌当前能力最强的网络安全模型之一重点提升了漏洞发现和自动化补丁修复的能力并通过谷歌推出的 Fairwind Program 向经过认证的安全防御人员开放。定价方面Gemini 3.8 Flash当前的价格为 0.75美元 / 1M 输入 token3.75 美元 / 1M 输出 token。9月4日【多模态大模型】OpenAI 发布最强模型 GPT-6 Astra【重要】今天OpenAI 正式发布了新一代前沿模型GPT-6 Astra更是基于此模型宣称已经到达了 AGI。GPT-6 Astra在众多评测榜单中刷榜在 ARC-AGI-3 上拿到了 99% 的分数相比之下GPT-5.6 Sol只有 7.8% 的分数而Claude Opus 5的分数为 30.2%在更难的 FrontierMath Tier 4 上也大幅领先了GPT-5.6 Sol等模型在网络安全测试榜单 ExploitBench 上更是达到了 100%。GPT-6 Astra的一大能力是操作电脑并号称世界上使用电脑最强的模型。GPT-6 Astra可以自己填写网页表单、整理日历、进行网络研究再把结果写进邮件或文档。在更复杂的场景中它可以分析科学数据、生成图表、搭建网站、执行前端 QA甚至自主安装和测试软件并根据屏幕上出现的问题进行排查。而且GPT-6 Astra并没有消耗更多的 TokenOpenAI 表示在最高分设置下其消耗的 Token 比Claude Opus 5少了 65%且输出速度明显提升。除此之外GPT-6 Astra针对真实工作环境进行了专门训练可以完成多步骤任务并直接产出文档、电子表格和演示文稿。OpenAI 还宣称GPT-6 Astra是目前软件工程领域最好的模型其在 Terminal-Bench 4.0 中显著超越了GPT-5.6 Sol甚至超越了Claude Fable 5.1。GPT-6 Astra的定价为10 美元 / 1M 输入token50 美元 / 1M 输出 token在 Fast Mode 下最高可以达到标准模式 2.5 倍的速度但是需要支付两倍的价格。9月8日【端侧大模型】面壁智能发布超强端侧大模型 MiniCPM5-2B今天面壁智能发布并开源了新一代端侧语言基础模型MiniCPM5-2B。该模型将工具调用、深度搜索、代码生成等智能体核心能力引入端侧为复杂任务在设备侧运行提供了新的可能。根据 Artificial Analysis Intelligence IndexMiniCPM5-2B在端侧大模型评测中排名第一超越Gemma 4 12B和Qwen3.5 9B等参数规模更大的模型在衡量智能体工作流的榜单中MiniCPM5-2B 也排名第一。此次团队不仅开源了模型权重和算法还包括部分训练框架、自研的强化学习框架、强化学习策略和一批数据。9月9日【图像生成模型】OpenAI 发布最强图像生成模型 Images 2.5【重要】今天OpenAI 发布了新一代图像生成模型Images 2.5。该模型主打的卖点是生成速度更快相较于Images 2Images 2.5的生成延迟最多可以降低 50%、生成细节更好图像编辑也越来越像真正的修图了。面向开发者OpenAI 这次开发了两个 API 接口。一个是GPT-Image-2.5 Flare该接口强调的是生成质量、编辑能力和速度之间的平衡也是官方推荐大多数应用默认使用的版本适合社交内容、快速视觉模型和大批量图像生成等场景另外一个是GPT-Image-2.5 Sunburst它主打的是更精细的创作和编辑需求以及对画质要求更高的视觉内容但是其价格仍然和GPT-Image-2.5 Flare相同。9月10日【多模态大模型】DeepSeek V4.1 Flash 正式发布今天DeepSeek V4.1 Flash正式发布并且在网页端、APP 和 API 中全面上线。根据官方介绍DeepSeek V4.1 Flash是一款总参数规模达到 552B 的 MoE 模型采用了全新架构从而大幅降低了推理成本并在性能、响应速度、效率等核心指标上都全面超越了DeepSeek V4 Pro且原生支持多模态。根据基准测试DeepSeek V4.1 Flash在软件工程、网络安全环境和自动化任务等测试中表现较强综合实力和Kimi K3、GLM-5.3、Claude Opus 5、GPT-5.6 Sol接近同一层次。另外OpenDesign 对DeepSeek V4.1 Flash的基准测试表示其在设计任务中的表现仅次于GPT-6 Astra超过了Claude Fable 5.1等众多竞争对手。9月15日【视频生成/编辑模型】生数科技发布新模型 Vidu S2今天生数科技推出了一套专为实时交互和实时编辑而设计的视频生成模型Vidu S2覆盖了实时数字人、离线数字人和实时视频编辑三类核心能力。Vidu S2-Avatar负责实时数字人生成支持 720P、25-42 FPS 输出可以处理舞蹈等更大幅度的动作并允许用户在生成过程中继续加入人物、服装、道具或场景参考图Vidu S2-Editing则支持持续接收摄像头或源视频流让新规则即时作用于后续画面在保留原有的姿态、肢体动作、镜头轨迹和时间顺序的同时实时改变风格、服装、人物主体或背景。9月21日【多模态大模型】阶跃星辰发布新一代基础模型 Step 5 Preview【重要】今天阶跃星辰发布了新一代基座模型Step 5 Preview该模型的综合能力超过了DeepSeek V4.1 Pro 0813、Gemini 3.8 Flash、GLM-5.3-Flash等一批模型达到了和Kimi K3同等的水平成为全球开源模型的前三。Step 5 Preview的性价比极高其完成任务的平均花费大约只有Kimi K3和GLM-5.3的三分之一。同样的智能水平下没有比它更便宜的模型同样的价格下没有比它更强的模型。【图像生成模型】阿里发布最强开源生图模型 Qwen-Image-2.1今天阿里千问正式开源了最新的图像生成模型Qwen-Image-2.1该模型以小体量解决了大部分的图像生产难题实现了文生图和图像编辑的一体化原生支持透明图像生成最高可以接受10张参考图还进一步强化了局部编辑、人像和商品保真。Qwen-Image-2.1是千问图像系列最平衡和性价比最高的模型公开测评结果显示该模型在开源模型中获得第一得分甚至超过了Nano Banana 2.0。9月22日【多模态大模型】小米发布最强开源大模型 MiMO V2.6【重要】今天小米正式发布了MiMO V2.6系列模型。MiMO V2.6 Pro模型有 1.02 万亿参数在 AA 榜单上获得开源模型第一名并且在大多数的智能体评测中成绩已经逼近Claude Opus 5和GPT-5.6 Sol。尽管能力大幅提升但是MiMO V2.6继续采用和MiMO V2.5相同的定价。对于MiMO V2.6 Pro模型价格为 3元 / 1M 输入 token、6 元 / 1M 输出 tokenMiMO V2.6 Flash模型的价格是 Pro 模型的三分之一。相较于同日发布的同等智能水平的Grok 4.7MiMO V2.6 Pro完成相同任务的价格要低得多。另外MiMO V2.6还上线了 UltraSpeed 模式在该模式下其最高输出速度可以达到 900 TPS。【多模态大模型】SpaceAI 发布新款旗舰模型 Grok 4.7【重要】今天SpaceXAI 发布了新一代旗舰模型Grok 4.7。该模型的宣传是面向编程和知识工程的最强模型速度可以达到可比模型的两倍但是价格只有一半。相较于上一代的Grok 4.6Grok 4.7更换了更大的基础模型强化了长时间任务、自我检查和长上下文管理能力并且把文档、演示文稿、法律、医疗和工程等专业工作纳入重点测试。它针对的场景是让模型在持续数小时的任务中少走弯路交出可以直接使用的结果。9月23日【多模态大模型】最强模型 Claude Opus 5.5 发布【重要】今天Anthropic 正式发布了新模型Claude Opus 5.5该模型在代码、知识工作、计算机操作等多项基准测试中取得 SOTA同时输出速度也比Claude Opus 5快了 30% 以上。在价格上Claude Opus 5.5的输入、输出价格分别为 4 美元 / 1M token 和 20 美元 / 1M token但是完成同一任务的步骤和消耗的 Token 数量减少据估算任务的总成本可以下降 40%。并且Claude Opus 5.5的缓存读取价格相较于上一代的Claude Opus 5直接下降了 60%更加适用于大型编程项目。Claude Opus 5.5推出了 Fast Mode在该模式夏的输出速度最高可以达到标准模式的 2.5 倍但是价格也翻倍适合于对延迟敏感的场景。【多模态大模型】GPT-6 系列新模型发布【重要】今天OpenAI 正式发布了GPT-6 Sol和GPT-6 Luna价格相较于之前的模型直接减半。在当前的系列中GPT-6 Astra负责当之前的 Sol 模型Sol 模型负责当 Terra 模型GPT-6 Luna还是直接的 Luna 模型。相较于GPT-5.6系列GPT-6系列的 API 定价直接降低了至少 50%。9月29日【多模态大模型】Anthropic 发布 Claude Sonnet 5.5【重要】今天Anthropic 正式发布了新模型Claude Sonnet 5.5并宣称相较于Claude Sonnet 5Claude Sonnet 5.5有了明显提升运行速度提升了超过 30%在大多数工作中的成本最高可以降低 30%。相较于Claude Sonnet 5Claude Sonnet 5.5在各个领域都有了显著提升在 max 模式下甚至能够取得和Claude Opus 5.5相当的表现。模型在编程能力上的提升最为明显。Claude Sonnet 5.5和Claude Opus 5.5形成了明确分工前者擅长处理范围明确的日常任务、修复代码问题、制作精美的各类文档而后者专为需要谨慎判断的复杂工作打造。目前Claude Sonnet 5.5已经在所有平台上线开发者可以进行调用。模型的调用价格在输入、输出和缓存写入价格上都只需要Claude Opus 5.5模型的一半。9月30日【多模态大模型】OpenAI 发布 GPT-6.1 Sol【重要】今天OpenAI 正式发布了新模型GPT-6.1 Sol并宣称该模型在智能体编程、电脑操作和专业工作任务上接近GPT-6 Astra而标准 API 输入、输出单价都只需GPT-6 Astra的五分之一输入 2 美元 / 输出 10 美元缓存输入更是只需要 GPT-6 Astra 的十分之一。与此同时OpenAI 开放了有史以来最贵的个人订阅 Pro价格高达每个月 500 美元。Pro 500 的显著差异是可以使用 Astra Ultrafast其在 Codex 中的 Token 生成速度可以达到普通速度的八倍但是也会更快地消耗额度。