Z.ai GLM-5.3 通过 1M 代币上下文和已发布的 API 定价到达 OpenRouter
Z.ai 的 GLM-5.3 现已在 OpenRouter 上上市,具有 OpenAI 兼容访问、1M 代币上下文窗口和已发布的代币定价。对于网关和编码代理团队来说,该版本添加了另一个长上下文推理模型来测试 - 但直接 Z.ai API 的可用性仍然需要单独确认。
阅读新闻 →以读者为中心,涵盖人工智能模型、API、基础设施、开发人员工具以及实践中重要的变化。客户服务公告保留在经过身份验证的帐户区域内。
Z.ai 的 GLM-5.3 现已在 OpenRouter 上上市,具有 OpenAI 兼容访问、1M 代币上下文窗口和已发布的代币定价。对于网关和编码代理团队来说,该版本添加了另一个长上下文推理模型来测试 - 但直接 Z.ai API 的可用性仍然需要单独确认。
阅读新闻 →DeepSeek 的 V4 API 定价现在包括高峰和非高峰计费,为模型成本规划添加了时间维度。对于网关、代理和大容量团队来说,这一变化使得调度和缓存经济性成为路由策略的一部分。
阅读新闻 →OpenAI 正在 API 中预览 GPT-5.6 Sol Ultrafast,承诺通过 Cerebras 支持的推理大幅降低延迟。访问权限受到限制,但此举为 AI API 网关和企业团队提供了新的路由维度来管理:速度层资格。
阅读新闻 →Google 的 Imagen 4 标准、超快速 Gemini API 端点计划于 2026 年 8 月 17 日关闭。仍然固定到这些模型 ID 的应用程序和网关需要在图像请求开始失败之前更改路由。
阅读新闻 →GitHub 已使 Agent Plugins 1.0 在关键 Copilot 界面上普遍可用,将代理技能和 MCP 服务器的共享打包格式引入 VS Code、Copilot CLI、Copilot SDK 和 Copilot 应用程序中。
阅读新闻 →DeepSeek V4-Pro 现已上市,可供 API 使用,具有 1M 代币上下文窗口、非常大的输出限制、OpenAI 和 Anthropic 格式端点以及已发布的代币价格,使缓存行为成为成本规划的核心。
阅读新闻 →Google 为开发人员和企业推出了 Gemini 3.7 Flash,Gemini API 可用性和介绍性代币定价将持续到 2026 年底。对于运行编码代理和大容量工作流程的团队来说,此次发布既是定价事件,也是模型事件。
阅读新闻 →SpaceXAI 发布了 Grok 4.6,提供 API 访问、兼容 OpenAI 的聊天示例、500K 上下文窗口,并发布了每百万代币 2/6 美元的定价,为开发人员和 AI 网关提供了另一个前沿模型来评估长上下文代理和编码工作负载。
阅读新闻 →Notion Workers 现在在免费测试期结束后需要 Notion 积分,将后台工作区自动化转变为管理员需要与自定义代理和自动填充一起监控的计量资源。
阅读新闻 →OpenAI 将 Daybreak 访问分为蓝色和红色层,并为经过批准的防御者添加了 GPT-5.6-Cyber,从而为 API 中的网络安全 AI 工作流程创建了更正式的访问模型。
阅读新闻 →GitHub 已在 Copilot 中普遍提供 Kimi K3,并提供基于使用情况的计费,为开发人员工作流程添加了另一种模型选择,并加强了对企业策略、成本可见性和模型选择控制的需求。
阅读新闻 →AWS Agent Registry 正在从 Bedrock AgentCore 公共预览命名空间移入其自己的代理注册表命名空间,需要更新终端节点、IAM 策略、SDK 客户端、CLI 脚本和注册表数据。
阅读新闻 →