ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Ox Alpha 模型火爆全网,完全免费使用,开发者狂喜,附使用教程

Ox Alpha 模型火爆全网,完全免费使用,开发者狂喜,附使用教程 最近两天突然出现一个叫Ox Alpha的匿名模型直接免费开放还带 100 万 token 的上下文窗口。作为一个平时主要靠 AI写代码、跑 agent 的独立开发者我第一时间就去试了也把大家的讨论整理了一下跟大家分享一下目前能确认的信息。它到底是什么Ox Alpha 是 2026 年 8 月 20 日左右悄然上线的“stealth”隐身模型。官方描述很直接面向高效编码、持续 agent 工作流和真实生产场景的 frontier 推理模型。核心参数目前公开的是上下文窗口1,048,576 tokens约 100 万最大输出约 131,072 tokens多模态输入文本 图像 视频目前价格免费预览期预计持续约一周到 8 月 27 日前后可能结束声称服务能力每日约 100 万亿 tokensrate limit 非常宽松推特上大家在猜什么推特上讨论非常热闹核心问题只有一个谁做的目前最主流的观点指向智谱Zhipu AI / Z.ai的下一代 GLM 系列可能性较高的是 GLM-5.x 相关版本有人推测是 GLM-5.3 Flash 或更强的统一多模态版本。依据主要来自社区指纹分析Tokenizer 在多个 prompt 上的 token 计数几乎与 GLM-5.3 完全一致仅存在固定偏移。视频编码器的帧采样、分辨率缩放等行为与 GLM-5V 系列高度吻合。对音频输入的拒绝方式也与智谱现有模型一致。也有人提过小米 MiMo 或其他国内实验室的可能性但目前证据链更偏向智谱。官方尚未认领一切仍属社区推断。Manifold 等预测市场也把智谱的概率压得较高。实际表现如何从社区分享的测试来看在部分 DeepSWE真实代码库漏洞修复子集任务上有人测出约 80% 的平均分高于同期部分 Claude 和 GPT 变体。Kingbench 等榜单上约 87.5%接近或略低于公开的 GLM-5.3。编码和长上下文推理表现亮眼尤其在需要理解完整代码库、规划多步任务时。缺点也有反馈速度偏慢、工具调用偶有不稳定、部分场景还有小 bug。我个人的体感是它更适合做“硬核推理 长上下文编码”的场景比如一次性喂完整项目、让它规划架构或找深层 bug。如果是需要高频快速迭代、重度工具调用的 agent 工作流目前可能还需要配合其他模型使用。怎么快速使用国内的中转平台也已经上架 访问 https://tokenra.io 找到Ox Alpha模型选择模型IDstealth/ox-alpha 通过OpenAI 格式调用即可具体以当前文档为准。写在最后对独立开发者来说最大的价值就是在官方正式发布前能低成本摸到接近前沿的能力尤其是 100 万上下文 多模态对做复杂 agent 或代码理解类工具的人来说很有吸引力。如果你已经试用过可以评论区交流一下经验比如和Claude或其他模型对比怎么样
返回列表