ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

GPT-6.1 Astra定档下周?Kimi K4宣战?Fable 5.5内测作品流出!Nano Banana 2.5现身! | 10月4日 AI日报

GPT-6.1 Astra定档下周?Kimi K4宣战?Fable 5.5内测作品流出!Nano Banana 2.5现身! | 10月4日 AI日报 视频版直达https://www.bilibili.com/video/av117380248441259/今日趋势速览Tibo确认OpenAI下周发布GPT-6.1 Astra发布计划提前六个月月之暗面随即筹备Kimi K4目标超越GPT-6 AstraFable 5.5内测视频流出谷歌Nano Banana 2.5变体现身Arena顶尖模型神仙打架AI竞赛再度提速。 今日要点传 GPT-6.1 Astra 下周发布Tibo 确认新版本将至泄露称月之暗面筹备 Kimi K4目标超越 GPT-6 AstraFable 5.5 内测视频作品集中流出 今日内容汇总 AI动态传 GPT-6.1 Astra 下周发布Tibo 确认新版本将至泄露称月之暗面筹备 Kimi K4目标超越 GPT-6 AstraFable 5.5 内测视频作品集中流出Nano Banana 2.5 变体 resplendent flash 现身阿里通义千问新模型 qwen-image-2.1-pro 被检测到MiMo-V2.6-Pro-RL 出现无审查修改版Antigravity 为全部付费用户接入 Claude Opus 5.5Gemini 免费用户 10 月 9 日起默认改用 Flash-LiteAI2 开源 Olmo-core 模块化大模型训练库OpenAI 的 dot 会学习工作方式并协调 Codex 任务亚马逊推出 Strands Decider 2B 开源决策模型支持本地部署Aleph Alpha 开源德英双语混合专家模型 Kolibri-1OpenClaw v2026.9.8 发布支持 GPT-6.1 SolOpenAI 发布 GPT-6 系列模型选用指南SpaceXAI 发布实验性 TypeScript SDK 接入 GrokopenJiuwen X-Router 自演进模型路由首发 昇腾亲和vLLM 语义路由器 Decision 2.0 发布llama.cpp 新增决策模型 systemone 端点manus 回归发布 2.0 与个人智能体 cue微信支付推出 AI 卡为腾讯系外 Agent 提供支付通道 芯片半导体AMD 公布 EPYC 9006 处理器完整规格与定价 模型排行榜Artificial Analysis AI 模型能力排行榜 AI动态1. 传 GPT-6.1 Astra 下周发布Tibo 确认新版本将至知名爆料者Tibo确认OpenAI下周将发布新版本具体内容仍保密Codex社区预期为GPT-6.1 Astra。此前他称尚未全面开放的Astra是最大竞争优势生产力大幅提升发布计划因此提前了六个月。 https://x.com/Codexresets_/status/21063343027282251102. 泄露称月之暗面筹备 Kimi K4目标超越 GPT-6 Astra泄露消息称月之暗面正筹备 Kimi K4目标击败 GPT-6 Astra 与 Fable 5.1为此寻求更多 Blackwell GPU。现役 K3 参数量 2.8 万亿为最大开放权重模型白宫曾指控其经泰国获取芯片K4 规格未公布。 https://x.com/0x0SojalSec/status/21064329229329778133. Fable 5.5 内测视频作品集中流出Fable 5.5 内测作品集中流出有网友整理 33 个高播放视频合集含一句话生成带配乐动画、与 Opus 5.5 同题对比及可玩小游戏另有逐帧生成的迈克尔·杰克逊视频。模型归属以作者自述为准官方未确认。以下是官方给出的 demo https://x.com/0x0SojalSec/status/21064398866520190014. Nano Banana 2.5 变体 resplendent flash 现身来源原文 | Chetaslua (Twitter)谷歌图像模型变体以代号 resplendent flash 现身 Arena被称图像质量与准确性随时领先对手测试者用长提示词实测多文字一致性稳定。此前 GEMPIX 2.5 Flash 字符串已现身此次被视为走向公开可测。 https://x.com/abhinavflac/status/21062418518043282025. 阿里通义千问新模型 qwen-image-2.1-pro 被检测到追踪账号在阿里 Model Studio 模型目录中检测到新模型 qwen-image-2.1-pro开发方为阿里通义千问Alibaba Qwen。目前这只是目录层面的发现官方尚未发布公告该模型的能力细节与开放时间均有待确认。 https://x.com/aitrackerbot/status/21062623889200131546. MiMo-V2.6-Pro-RL 出现无审查修改版开发者放出 MiMo-V2.6-Pro-RL 的无审查版在权重层面移除了拒绝回答行为。版本保留 42B 激活参数视觉、音频和视频能力完好MMLU 成绩与基础模型相差不到一分保留 DFlash 头思考模式可开可关关闭时 HarmBench 合规率达 94%知识能力几乎未降。 https://x.com/0x0SojalSec/status/21061382269563415257. Antigravity 为全部付费用户接入 Claude Opus 5.5来源原文 | Claudeupdates11有用户注意到Antigravity 已为所有付费用户添加 Claude Opus 5.5 和 Sonnet 5.5。团队回应称希望确保人们能够使用最优秀的尖端模型并对 Gemini 4 Argon 的更广泛推出感到期待。两款 Claude 新模型现已面向全体付费用户开放。 https://x.com/_mohansolo/status/21064320398179984638. Gemini 免费用户 10 月 9 日起默认改用 Flash-Lite来源原文 | 小鹏Digital (Apple/Tech) (Twitter)接上条新闻Google 宣布自 10 月 9 日起调整 Gemini 模型策略免费个人用户不再默认使用 Flash 或 Pro 模型统一换用更轻量的 Flash-LiteAI Plus 订阅用户也将失去 Pro 模型的访问权限具体生效时间将通过邮件另行通知。 https://x.com/RocM301/status/21062955337322948579. AI2 开源 Olmo-core 模块化大模型训练库AI2 开源为 OLMo 系列打造的模块化底层训练库 Olmo-core集成官方全流程训练与退火脚本即插即用既兼容主流加速组件与低显存优化技术也打通主流开源推理框架。开发者可直接基于成熟架构复现前沿大模型无需从零搭建分布式基础设施。 https://x.com/Gorden_Sun/status/210638517478326694110. OpenAI 的 dot 会学习工作方式并协调 Codex 任务OpenAI Developers 发文介绍 dot 的能力它会学习用户的工作方式跨应用保留上下文自动协调 Codex 任务并把需要用户关注的内容标记出来。开发者 dominik kundel 分享称dot 配合 Codex 使用效果非常好已成为他最喜欢的 Codex 使用方式主动性简直是救星。 https://x.com/OpenAIDevs/status/210615229902666164111. 亚马逊推出 Strands Decider 2B 开源决策模型支持本地部署亚马逊 Strands Agents 团队宣布推出 Strands Decider 2B 决策模型代码已在 GitHub 开源。该模型基于预训练的 Qwen3.5-2B 躯干构建。性能方面它在 JevBench 公开数据集上排名 2B 级别第三。在本地常见硬件上其决策时延中位数为 113msRTX 3090 上小型决策任务中位数时延约 153ms。 https://www.ithome.com/1/009/509.htm12. Aleph Alpha 开源德英双语混合专家模型 Kolibri-1来源原文 | TestingCatalog (Twitter)Aleph Alpha 开源德英双语混合专家模型 Kolibri-1总参数 78B、激活仅 3B上下文 260K官方称其为欧洲主权 LLM 新作评测略低于 Qwen3.8-27B发布后在 Hacker News 引发热议被视为欧洲自主大模型尝试。 https://x.com/Gorden_Sun/status/210637518326325661413. OpenClaw v2026.9.8 发布支持 GPT-6.1 Sol开源项目 OpenClaw 发布 v2026.9.8 版本官方将其形容为一只趣味尺寸的龙虾。新版本支持 GPT-6.1 Sol智能体回复可回传送达内存占用更低并修复了更新与 Windows 启动相关的问题。本次发布共合并 43 个 PR由 8 位贡献者参与完成。 https://x.com/openclaw/status/210624762463453188914. OpenAI 发布 GPT-6 系列模型选用指南OpenAI 10月2日发布GPT-6系列模型选用指南不发新模型而是教用户按工作负载选型别默认用最强模型Astra负责最难推理Sol处理复杂编程Luna承担批量重复任务。定价印证这一分工Luna每百万输入0.1美元Astra高达10美元相差两个数量级用Astra干Luna的活纯属烧钱。 https://x.com/wlzh/status/210630251556239796915. SpaceXAI 发布实验性 TypeScript SDK 接入 GrokSpaceXAI 发布实验性 TypeScript SDK一个 SDK 即可调用 Grok 的文本、语音、图像和视频模型并内置实时 X 搜索、网页搜索、代码执行和远程 MCP 等工具。对正在使用 Grok 模型的开发者来说这将明显简化多模态 AI 智能体的构建流程。以下是官方给出的 demo https://x.com/ai_for_success/status/210620100756711843416. openJiuwen X-Router 自演进模型路由首发 昇腾亲和openJiuwen首发X-Router自演进模型路由技术昇腾亲和实测减少50%以上Token消耗。之所以受关注是因为并非所有任务都需要最强模型AI助手常过度调用高成本大模型。而这套路由让每次请求智能匹配最适配模型并持续优化选择动态调度正成为Agent提效降本的核心路径。 https://hub.baai.ac.cn/view/5843517. vLLM 语义路由器 Decision 2.0 发布vLLM 项目发布语义路由器 Decision 2.0开放模型覆盖 0.6B 到 27B。新版本一次前向传播即可回答关于单个请求的 64 个问题。模型采用 Apache-2.0 许可证可通过 Transformers 加载vLLM 团队致谢了 Xunzhuo 及其团队。 https://x.com/vllm_project/status/210619343809825619118. llama.cpp 新增决策模型 systemone 端点llama.cpp server 新增决策模型支持经 v1/systemone 端点提供服务沿用 TypeSafe Jev 引入的 System One 格式。开发者发送状态与问题后模型单次前向传播返回各选项概率问题分 choice、score、noul 三类。 https://github.com/ggml-org/llama.cpp/pull/2981819. manus 回归发布 2.0 与个人智能体 cuemanus 团队宣布回归发布 manus 2.0 并推出个人智能体应用 cue对标 muse 和 dots。cue 拥有独立邮箱、电话、钱包和电脑可接听电话并留下摘要在用户预算内付款支持多智能体在群聊协作还能代为订餐排队。cue 早期体验阶段免费需邀请码开通。 https://x.com/notjazii/status/210634977069670812520. 微信支付推出 AI 卡为腾讯系外 Agent 提供支付通道微信支付为腾讯体系外的 AI Agent 构建支付通道AI 卡为独立充值余额账户Agent 可消费、每笔需用户确认开发者指南列出 OpenClaw 与 DeepSeek Harness 为可安装插件的外部 Agent。 https://x.com/poezhao0605/status/2106230258848367069 芯片半导体21. AMD 公布 EPYC 9006 处理器完整规格与定价AMD公布代号Venice的EPYC 9006系列完整规格与定价最高256核心顶配14904美元。该系列分SP7与SP8插座共31款最低8核心售价700美元。SP7为高端共9款支持16通道内存功耗600瓦四季度出货SP8共22款。另有代号Verano的AI主机节点专用型号预计2027年下半年出货。 https://news.mydrivers.com/1/1155/1155277.htm 模型排行榜22. Artificial Analysis AI 模型能力排行榜最后是今日的 AI 模型能力排行榜单智力榜头部由Anthropic系领跑Claude Opus 5.5以58分居首Claude Sonnet 5.5以56分次席Claude Fable 5.1以53分第三。开源/国产方面MiMo-V2.6-Pro位列第10名46分挤进前十实属不易。 https://artificialanalysis.ai/以上是今天的AI 风向标欢迎在评论区提出建议我们明天见。
返回列表