LLM Relay API 服务介绍

1 RMB = 4 USD 购买力 · GPT-5.5 / Claude Opus 4.8 直通 · 免科学上网 · 全球多节点加速

🔗

接口地址

OpenAI 兼容,替换 base_url 即用

快速开始

3 步接入,注册即用

🌟

核心优势

免科学上网,0 封号风险

💳

1:4 汇率

¥1 享 $4 算力

LLM Relay 是什么

LLM Relay 是一个面向开发者、团队和代理渠道的 AI API 中转平台。它的核心目标不是替代模型能力本身,而是让你在国内网络环境下更稳定、更低成本地接入 GPT、Claude、DeepSeek 等主流模型,同时保留 OpenAI 风格的调用体验。

适合哪些用户

  • 已有 OpenAI SDK 项目,希望用最小改动切到更稳定、更低成本的调用通道。
  • 正在做 AI SaaS、企业内部工具、Agent 工作流、自动化脚本,需要多模型切换能力。
  • 需要给团队成员、客户或下游代理发放独立 Key,并追踪各自额度与消耗。

这份文档能解决什么问题

你可以把这份文档当成 LLM Relay 的总入口。它覆盖了接口地址、接入步骤、平台能力、成本结构、技术特性和最新资讯,适合从第一次接入一直看到上线前检查。

🔗 接口地址

API Endpoint
🌐 API 地址:https://llmrelay.net/v1
📖 OpenAI 兼容 — 替换 base_url 即可
🛠️ 兼容客户端 — ChatBox、LobeChat、NextChat、Cursor 等
🔑 获取 API Key — 注册后在控制台生成

接入逻辑

LLM Relay 保持 OpenAI 风格的接口结构,业务侧通常只需要替换 base_urlapi_key,原有请求体、流式响应和模型参数可以继续沿用。对已有项目来说,这意味着你不需要重写业务层逻辑,也不需要为每个模型重新适配一套 SDK。

请求路径说明

统一入口为 https://llmrelay.net/v1。常见聊天、嵌入、图像、音频等能力都在这个入口下分发。模型名、温度、消息结构等字段继续保持 OpenAI 兼容风格,便于你在不同模型之间平滑切换。

适用场景

  • 国内网络环境下稳定调用 GPT、Claude、DeepSeek 等模型。
  • 已有 OpenAI SDK 项目,需要用更低成本接入多模型能力。
  • 团队希望用一个 Key 统一管理测试、生产和代理分发额度。

接入注意事项

  • 不要把测试 Key 直接写死在前端;建议只在服务端或受控环境中使用。
  • 正式上线前先确认你使用的模型名和平台控制台中的可用模型一致。
  • 若你同时接多家模型,建议按业务场景拆 Key,便于后续定位消耗和异常请求。
  • 如果你的应用依赖流式响应,建议优先在测试环境验证超时、重试和断流处理逻辑。

常见接入误区

最常见的问题不是代码写错,而是把“官方模型名”“第三方平台模型名”“业务显示名称”混在一起。LLM Relay 建议你在配置层统一管理模型 ID,在业务层只引用别名,后续切模型时成本更低。

⚡ 快速开始

Quick Start
1
注册账号
创建账户,获取 API Key
2
充值额度
1:4 汇率,永不过期
3
开始调用
替换 base_url 即可

推荐接入流程

建议先在控制台创建一个单独的测试 Key,用最小的额度做联调。确认聊天补全、超时重试、日志落盘、额度扣减都正常后,再创建生产 Key 接入正式业务。这样能避免联调阶段的 Key 与生产流量混用。

Python 示例

client = OpenAI(api_key="sk-...", base_url="https://llmrelay.net/v1")

Node.js 思路

如果你使用的是 OpenAI 官方 Node SDK,也仍然建议把 baseURLapiKey 放到环境变量,而不是散落在业务代码中。这样后续切模型、切环境、切 Key 的成本最低。

联调顺序建议

  • 先调用一个最简单的聊天接口,确认鉴权、网络和基础响应正常。
  • 再测试你实际业务会用到的功能,例如流式响应、长上下文、图像理解、嵌入或结构化输出。
  • 最后再压并发、压时延、压重试策略,确认生产级稳定性。

上线前检查

  • 确认 API Key 已限制额度,避免测试 Key 被误用于生产。
  • 确认模型名与调用场景匹配,例如长文本、代码生成、图片理解分别选择不同模型。
  • 优先使用流式响应改善前端等待体验。
  • 为不同环境拆分 Key,并在日志中打上环境标签,便于后续排障。

排障建议

如果接入失败,优先检查四件事:Key 是否可用、模型名是否正确、请求体是否符合 SDK 版本要求、你的业务层是否误把官方默认地址覆盖了新的 base_url

🌟 核心优势

Core Advantages
🌐

免科学上网

全球直连,无需代理工具。

极速响应

多节点智能调度。

🛡️

0 封号风险

无需注册 OpenAI 账号。

🌍

全球多节点

10+ 节点自动负载均衡。

为什么这些优势有价值

对个人开发者来说,优势往往意味着“更快接上、少踩坑、少花钱”;对团队来说,优势意味着“更稳定上线、可复制发给同事、可管理成本”。LLM Relay 的核心价值就在于把这些因素同时收拢到一个平台里,而不是只解决其中一项。

对业务的直接影响

  • 更低的接入门槛,减少前期环境配置时间。
  • 更稳定的调用链路,减少因为网络和地区问题造成的异常。
  • 更统一的模型入口,降低多模型实验和上线成本。
  • 更清晰的额度与权限管理,适合多人协作和代理分发。

🔧 功能特点

Platform Features
一个 Key 通用所有模型 — GPT-5.5、Claude Opus 4.8 等
最新模型立即使用
API Key 灵活管控
标准 OpenAI 接口
实时用量监控

从“能用”到“好维护”

很多中转站只解决“请求能打通”,但真正上线后更重要的是可维护性。LLM Relay 的功能设计更偏向长期使用:统一入口、统一 Key、统一协议、统一用量查看,这样你在多人团队或多项目场景下不会越来越乱。

功能价值拆解

  • 统一 Key: 降低模型切换成本,减少配置分散。
  • 最新模型可用: 方便快速试模型,不必反复换平台。
  • 灵活管控: 适合给团队成员、客户和代理分配不同额度。
  • 实时用量: 便于发现异常调用、错误重试和成本泄漏。

适合哪些业务场景

如果你在做聊天产品、知识库问答、AI 写作、代码助手、自动化 Agent、企业内部 Copilot,这些功能都会直接减少你的维护摩擦。

💼 商业优势

Business Advantages
🎁 新用户注册即享体验额度
💰 价格远低于官方 — 成本直降 75%
🔒 额度永不过期
💼 服务稳定可靠 — 470+ 天,99.9% 可用率
🤝 代理加盟支持

为什么商业层面更有吸引力

对大多数团队来说,模型效果不是唯一决策因素。成本、补货频率、权限分发、代理协作和稳定服务年限,同样决定你能不能把 AI 功能真正做成产品而不是停留在 Demo。

适合的用户类型

  • 希望压低模型调用成本的个人开发者和独立产品团队。
  • 需要给多个客户、多个项目发 Key 的工作室或代理渠道。
  • 需要长期稳定供应,而不是临时找渠道过渡的商业化项目。

运营角度的好处

额度不过期意味着你可以更从容地做预算,不必为了避免浪费而频繁充值。统一入口和统一结算也更适合做客户支持、对账和代理分销。

📊 功能对比

LLM Relay vs Official API
功能LLM Relay官方 API
GPT-5.5 / Claude Opus 4.8✅ 即开即用需排队
国内直接访问✅ 无需代理需科学上网
调用速度✅ 多节点加速单线路
高并发✅ 无限制有限制
额度有效期✅ 永不过期按月清零
封号风险✅ 0 封号随时封号
模型聚合✅ 一 Key 搞定需分别申请

如何看这张对比表

这张表不是为了说明“官方不好”,而是帮助你判断:如果你的业务重点是全球直连、统一聚合、多模型实验和成本控制,那么中转站会更适合;如果你的业务只需要官方单一模型、内部测试量很小,官方 API 也可能够用。

选择建议

  • 如果你是产品型团队,优先考虑交付速度、稳定性和成本结构。
  • 如果你是研究型或实验型场景,可以先用中转站验证模型路线,再决定是否做更深的官方接入。
  • 如果你需要多模型共存,统一入口的价值会远大于单次调用价格差异。

💳 计费规则

Pricing
LLM Relay
1 : 4
¥1 享 $4 算力
官方原价
1 : 1
$1 享 $1 算力

成本理解

平台以固定算力兑换关系降低调用成本,适合高频测试、批量内容生成、Agent 工作流和多模型对比场景。对调用量较大的业务来说,差异不会只是“便宜一点”,而是会直接影响试错频率、模型对比次数和可承受的产品迭代速度。

额度管理建议

  • 为开发、测试、生产分别创建独立 Key,便于追踪消耗。
  • 给外包、客户或子项目配置独立额度,降低误用风险。
  • 定期查看用量记录,发现异常模型或异常并发及时调整。

更适合哪些使用模式

如果你会频繁做 Prompt 调优、A/B 测试、模型横评、批量生成任务,低成本结构能显著降低试错门槛。对只调用几次 API 的轻量场景,价格感知不强;对每天都有稳定调用的业务,优势会非常明显。

🚀 技术优势

Technical Advantages
💯 企业级高速通道
🔒 传输加密
🌐 稳定纯净 API 源头
🔄 标准 OpenAI 接口协议
🛠️ 0 开发基础可用

技术侧的核心目标

技术优势的重点不是堆术语,而是让调用结果更稳定、更容易接入、更适合生产环境。对一个 API 中转站来说,真正重要的是请求链路是否稳定、接口协议是否统一、故障时是否容易排查。

技术收益

  • 统一协议降低 SDK 适配和模型迁移成本。
  • 高速链路减少长响应、流式输出和并发场景下的等待时间。
  • 传输加密与统一入口更适合接入企业内部系统。
  • 标准化接口有利于后续做日志、网关、重试和服务治理。

对开发团队的意义

如果你团队里既有前端、后端,也有提示词工程或运营同学,统一、稳定、低摩擦的接口体系会比“偶尔能用一次”的临时通道更重要。长期来看,它能显著降低跨角色协作的沟通成本。

📰 Claude Code v2.1.160 安全增强版发布

2026-06-02 · 版本发布

Anthropic 于 2026 年 6 月 2 日发布 Claude Code v2.1.160。本次更新的重点是安全增强,新增了多项关键防护机制。

在写入 Shell 启动文件(包括 .zshenv、.zlogin、.bash_login 和 ~/.config/git/)之前,Claude Code 现在会主动提示用户确认,防止意外的命令执行。acceptEdits 模式也新增了构建工具配置文件保护——在写入 .npmrc、.yarnrc*、bunfig.toml、.bazelrc、.pre-commit-config.yaml、.devcontainer/ 等涉及代码执行能力的配置文件时,会先征求用户同意。

修复方面包括:WSL 下复制即用功能改用了 PowerShell 互操作而非 OSC 52;修复了从 claude agents 恢复已完成会话时聊天历史和原始提示丢失的问题;修复了后台会话隔夜回收后对话丢失的问题;修复了 Windows 上 CJK 输入法候选框出现在屏幕左下角而非输入光标处的显示问题;以及多项针对 Windows 平台稳定性的改进。

📰 Claude Code v2.1.157 插件系统重大升级

2026-05-31 · 版本发布

Anthropic 于 2026 年 5 月 31 日发布 Claude Code v2.1.157。本次更新围绕插件生态和 Agent 协作进行了多项重要改进。

核心变化:.claude/skills 目录下的插件现已自动加载,无需再通过插件市场安装。新增 claude plugin init 命令,可用于在 .claude/skills 中快速搭建新插件。/plugin 命令的参数自动补全现已支持子命令、已安装插件名和已知市场的插件搜索。

Agent Teams 方面:settings.json 中的 agent 字段现在会对派发的会话生效,可通过 --agent name 参数覆盖。EnterWorktree 现在支持在同一次对话中切换 Claude 管理的多个工作树。此外,Claude 管理的工作树在 Agent 完成操作后会被解锁,以便 git worktree remove 和 prune 正常清理。

修复方面包括:附件中无法处理的图片(零字节或损坏)不再导致请求崩溃,而是转换为文本占位符;修复了桌面端和 IDE 扩展中沙箱网络权限提示在自动模式和绕过权限模式下仍然出现的问题;修复了后台 Agent 工作树在 30 天任务保留周期后遗留在 .claude/worktrees/ 下的问题。

📰 Claude Code v2.1.154 Opus 4.8 与动态工作流发布

2026-05-28 · 版本发布

Anthropic 于 2026 年 5 月 28 日发布 Claude Code v2.1.154。这是近期最具里程碑意义的版本之一。

核心亮点是 Opus 4.8 的正式接入。Opus 4.8 现在默认使用 high effort 级别,并支持 /effort xhigh 用于最困难的任务。Fast Mode 现已可用,只需标准费率的 2 倍即可获得 2.5 倍的速度提升。

动态工作流(Dynamic Workflows)是本次发布的另一项重量级功能:用户可以要求 Claude 创建一个工作流,它将自动编排数十到数百个 Agent 在后台协同工作,使开发者能够承担更大、更复杂的任务。

其他改进包括:精简系统提示现已成为除 Haiku、Sonnet 和 Opus 4.7 及更早版本之外所有模型的默认设置;多选提问的提示逻辑得到改进,Claude 不再会在已经掌握足够上下文时无谓提问;/simplify 命令改为运行仅清理型审查(复用、简化、效率和抽象层次检查)并直接应用修复;/effort 滑块标签从 Speed/Intelligence 改为 Faster/Smarter 更清晰的表达。

新增 Background Shell 会话支持——在 claude agents 中输入 ! command 即可在后台运行 Shell 命令,并可随时连接和断开。Chrome 集成增强,用户可通过 /chrome → Select browser 选择连接的浏览器。

📰 Claude Code v2.1.152 代码审查与技能系统增强

2026-05-27 · 版本发布

Anthropic 于 2026 年 5 月 27 日发布 Claude Code v2.1.152。本次更新重点强化了代码审查和技能系统。

代码审查升级:/code-review --fix 现在会在审查完成后直接将优化建议应用到工作目录,包括复用、简化和效率提升建议。/simplify 命令现在直接调用 /code-review --fix。技能系统新增了 disallowed-tools 前导声明——技能和斜杠命令可以在前导区声明禁用工具列表,在技能激活期间移除特定工具。

新增 /reload-skills 命令,无需重启会话即可重新扫描技能目录。SessionStart Hook 现在支持返回 reloadSkills: true 来触发技能目录重新扫描,使得 Hook 安装的技能能在同一会话中立即可用。SessionStart Hook 还可在启动和恢复时通过 hookSpecificOutput.sessionTitle 设置会话标题。

新增 MessageDisplay Hook 事件,允许 Hook 在消息显示时转换或隐藏助手文本。企业功能方面:新增 pluginSuggestionMarketplaces 托管设置,管理员可以允许特定组织的市场插件通过上下文提示被推荐。当主要模型不可用时,Claude Code 现在会自动切换到配置的 fallback-model,而不是让每次请求都失败。

📰 Claude Code v2.1.149 用量分析与显示增强

2026-05-23 · 版本发布

Anthropic 于 2026 年 5 月 23 日发布 Claude Code v2.1.149。本次更新聚焦于用户体验改进和安全加固。

/usage 命令现在支持按类别明细查看:技能、子 Agent、插件和每个 MCP 服务器的成本分解。用户可以清晰了解用量具体消耗在哪些环节。/diff 详情的查看体验得到改进,现在支持键盘方向键、j/k、PgUp/PgDn、Space 和 Home/End 进行滚动。

Markdown 输出渲染升级,GFM 任务列表的复选框(- [ ] 待办、- [x] 已完成)现在能够正确渲染,不再显示为纯文本。企业版新增 allowAllClaudeAiMcps 托管设置,允许在 managed-mcp.json 之外同时加载 claude.ai 云 MCP 连接器。

安全修复方面:修复了 PowerShell 中的权限绕过——内置 cd 函数(cd..、cd\、cd~、X:)可在不被察觉的情况下更改工作目录;修复了沙箱写入白名单中 Git 工作树覆盖整个主仓库根目录而非仅共享 .git 目录的问题;修复了 find 命令通过 Bash 工具耗尽 macOS 系统文件表导致宿主机崩溃的问题。

📰 Claude Code v2.1.147 固定会话与代码审查重命名

2026-05-21 · 版本发布

Anthropic 于 2026 年 5 月 21 日发布 Claude Code v2.1.147。本次更新引入了后台会话管理的重要改进。

核心变化:固定后台会话功能上线。在 claude agents 界面中按 Ctrl+T 即可固定某个后台会话。固定会话在空闲时保持存活,在应用 Claude Code 更新时会被原地重启,只有在内存压力下且仅在所有非固定会话之后才会被回收。

命令更名:/simplify 现已更名为 /code-review。新命令支持在指定 effort 级别下报告正确性缺陷(如 /code-review high),传递 --comment 参数可将审查结果以 GitHub 行内评论形式发布。

自动更新器得到显著改进:现在会对瞬时网络失败进行重试,失败时报告具体的错误类别和操作系统错误码,并在更新失败时显示当前版本号。大文件编辑的差异渲染性能也得到了提升。

修复方面:企业登录限制现在对第三方提供商和 API Key 会话也能正确执行;Bash 工具中 & 在 ! 命令输出中不再显示为 &(影响 gcloud auth login 等命令的复制粘贴);未知斜杠命令在无头/SDK 模式下不再静默无响应,而是显示错误信息;插件 Agent 声明多个 Agent(...) 类型时不再丢弃除最后一条之外的所有条目。

📰 Claude Code v2.1.145 Agents JSON 与插件详情预览

2026-05-19 · 版本发布

Anthropic 于 2026 年 5 月 19 日发布 Claude Code v2.1.145。本次更新重点是 Agent 管理和插件体验。

新增 claude agents --json 命令,以 JSON 格式列出活跃的 Claude 会话,方便脚本集成(如 tmux-resurrect、状态栏、会话选择器)。OTEL 追踪新增 agent_id 和 parent_agent_id 属性,背景子 Agent 的 Span 现在正确嵌套在派发 Agent 工具 Span 之下。

插件体验升级:/plugin 的 Discover(发现)和 Browse(浏览)页面现在可以在安装前查看插件的命令、Agent、技能、Hook 以及 MCP/LSP 服务器清单。状态行 JSON 输入现在包含 GitHub 仓库和 PR 信息。claude agents 的终端标签页标题现在显示等待输入的数量,方便任务切换时了解哪个 Agent 需要关注。

安全修复:修复了 Bash 命令中非白名单环境变量的裸赋值被自动批准的权限提示绕过问题。修复了 MCP 提示斜杠命令在缺少必要参数时显示原始服务器验证错误的问题——现在会明确提示缺失的参数名和期望用法。

此外还包括 Agent Teams 中非 ASCII 名称的队友导致 API 调用失败的问题修复,以及 /review 命令在包含 Classic Projects 的仓库上因使用废弃 GraphQL 查询而报错的问题修复。

📰 Claude Code v2.1.144 后台会话恢复与模型选择改进

2026-05-19 · 版本发布

Anthropic 于 2026 年 5 月 19 日发布 Claude Code v2.1.144。本次更新带来了多项关键的可用性改进。

后台会话恢复功能上线:通过 claude --bg 或 Agent 视图启动的会话现在会与交互式会话一起出现在恢复界面中,并标注为 bg 后缀。后台子 Agent 完成通知现在包含运行时长(如 Agent completed · 3h 2m 5s)。

模型选择器升级:/model 现在仅更改当前会话的模型,按 d 键可设置新会话的默认模型。此外,恢复了 Bedrock 和 Vertex 用户在 /model 选择器中选取 Opus(100 万上下文)的能力。

启动性能修复:当 api.anthropic.com 不可达时(如遇强制门户、防火墙、VPN 问题),启动时最长可能挂起 75 秒——旁路 API 调用现在 15 秒超时。终端显示方面的修复包括:窗口大小变化事件遗漏后输出乱码的问题现在可在下一帧自行恢复,不再需要 Ctrl+L;长时间会话中可能出现的渐进式终端显示损坏也得到了解决。

其他修复包括:修复了 /branch 在工作树中或某些后台会话中提示 No conversation to branch 的问题;修复了远程会话登录时对于设置了 forceLoginMethod 和 forceLoginOrgUUID 的用户提示 Cant access this organization 的问题。

📰 Claude Code v2.1.141 Git 工作树与 Agent 调查功能

2026-05-15 · 版本发布

Anthropic 于 2026 年 5 月 15 日发布 Claude Code v2.1.141。本次更新聚焦于 Git 工作流和 Agent 团队协作。

新增 Git 工作树支持:可通过 /worktree 命令创建和管理 Git 工作树,让 Claude 在独立目录中并行处理多个分支。Agent 调查问卷(Survey)功能上线,可向团队成员或利益相关者收集反馈,结果会自动整理并纳入 Agent 的上下文中。

Claude Code 现在会在项目中发现 README.md、CONTRIBUTING.md 和 AGENTS.md 文件时自动将其包含在上下文中,帮助 Claude 更好地理解项目规范。新窗口自动检测功能:当检测到在 tmux、VS Code 或 JetBrains 的新窗口或分屏中启动时,Claude Code 会自动选择适当的界面布局。

新命令 /impl 用于直接运行实现任务,跳过规划和审查步骤。此外,自动更新器新增了版本回退功能:如果新版出现问题,可通过 --prev-version 回退到上一个版本。

📰 Claude Code v2.1.137 MCP Hook 系统与沙箱增强

2026-05-12 · 版本发布

Anthropic 于 2026 年 5 月 12 日发布 Claude Code v2.1.137。Hook 系统经过测试阶段后正式上线,为 Claude Code 带来了强大的可扩展性。

Hook 系统允许在生命周期事件中触发自定义脚本——包括会话启动、工具调用前后和消息渲染等场景。企业可以通过 Hook 实现合规检查、自定义审批流程或集成内部工具。MCP 服务器框架得到显著改进,新增了配置验证和更丰富的错误报告。

沙箱安全机制全面升级:新增了 PowerShell 命令的细粒度权限控制,改进了文件系统白名单的边界检查,确保 Agent 只能在授权范围内操作。新增了 Windows 平台下的安全策略集成。

性能方面,大代码库的文件搜索速度提升了约 40%,上下文窗口管理更加智能,Claude 能更有效地利用可用上下文空间。

📰 Codex v0.136.0 新增会话归档和 TUI 可点击链接

2026-06-01 · 版本发布

OpenAI 于 2026 年 6 月 1 日发布 Codex CLI v0.136.0。本次更新围绕 TUI 体验和管理功能进行了多项改进。

TUI Markdown 渲染新增 OSC 8 元数据支持,网页链接现在可直接点击打开。紧凑型表格在空间不足时自动转为可读的键值记录格式,且链接目标不会丢失。

会话管理方面,新增会话归档功能——在 TUI 中使用 /archive 命令,或在 CLI 中使用 codex archive / codex unarchive 命令进行归档。归档后的会话受到保护,在恢复或分支操作前不可访问。

Windows 管理员获得了一个 alpha 版的 codex sandbox setup --elevated 配置路径,同时新增了对允许的 Windows 沙箱实现的 requirements 支持。远程执行设置现在支持通过 CODEX_API_KEY 注册批准的 OpenAI 主机,远程控制的 WebSocket 使用短效服务端令牌而非 ChatGPT 访问令牌。Bug 修复方面,ChatGPT 认证现在会在过期前 5 分钟刷新令牌,并对重复使用的刷新令牌显示重新登录路径。

📰 Codex v0.135.0 增强诊断和 Vim 模式升级

2026-05-28 · 版本发布

OpenAI 于 2026 年 5 月 28 日发布 Codex CLI v0.135.0。本次更新聚焦于开发者工具链和终端体验。

codex doctor 命令现在支持更丰富的诊断报告,涵盖环境、Git、终端、应用服务器和线程清单信息。用户可通过此命令快速排查环境和配置问题。

Vim 模式获得了重大升级:新增文本对象编辑、改进了单词/行尾行为,并提供了可配置的中断对话快捷键绑定。/permissions 命令现在支持识别命名权限配置文件并显示已配置的自定义配置文件。

Codex 打包版本现在可以在支持的 macOS 和 Linux 目标上自动发现并使用捆绑的 patched zsh 辅助程序。Python SDK 现已为线程和对话 API 提供友好的 Sandbox 预设。install.sh/install.ps1 支持非交互式安装模式,设置 CODEX_NON_INTERACTIVE=1 即可使用。

📰 Codex v0.134.0 历史搜索和 Profile 系统升级

2026-05-26 · 版本发布

OpenAI 于 2026 年 5 月 26 日发布 Codex CLI v0.134.0。本次更新引入了用户期待已久的本地历史搜索功能。

新增跨本地历史对话的搜索能力,支持大小写不敏感的内容匹配和结果预览。用户可以在所有历史会话中快速定位相关内容。

--profile 现在作为跨 CLI、TUI 权限和沙箱流程的主要配置文件选择器使用。旧版 profile 配置在首次自动迁移后发出一次性警告。TUI 改进方面:会话选择器现在显示更丰富的元信息,包括模型、配置文件和会话时间。添加了 --format json 选项用于脚本集成。

新会话的默认标题从文件名和目录名生成。搜索会话时显示进度指示器。远程主机名现在使用短格式(host 而非 host.domain.com),使输出更简洁。修复包括改进远程持久化消息日志记录,帮助排查连接断开问题。

📰 Codex v0.133.0 Goals 默认启用和远程控制改进

2026-05-21 · 版本发布

OpenAI 于 2026 年 5 月 21 日发布 Codex CLI v0.133.0。本次更新标志着 Goals 功能正式进入稳定阶段。

Goals 现已默认启用,拥有专用存储空间,可跨活跃对话追踪进度。用户可以为复杂任务设定目标,Codex 会自动追踪完成状态。codex remote-control 现在像前台命令一样运行,等待就绪后报告机器状态,并保留了显式的 daemon 风格 start/stop 命令。

权限配置文件获得了重大升级:新增列表 API、继承支持、托管 requirements.toml 支持、运行时刷新行为以及更强的 Windows 沙箱集成。插件发现更易检查——市场感知列表输出、已安装版本、可见市场根目录以及远程收集支持。

扩展系统现在可以观察更多生命周期事件,包括子 Agent 启动/停止、工具执行、对话元数据以及异步审批/对话处理。修复了 TUI 启动时选择错误工作目录的问题、plan 模式下修改的 Enter 键意外提交的问题,以及 AGENTS 指令加载的可靠性改进。

📰 Codex v0.132.0 Python SDK 原生认证支持

2026-05-20 · 版本发布

OpenAI 于 2026 年 5 月 20 日发布 Codex CLI v0.132.0。本次更新的重点是 Python SDK 的可用性提升。

Python SDK 现已支持一等认证,包括 API Key 登录、ChatGPT 浏览器和设备码流程、账户检查和登出 API。Python 对话 API 在纯文本工作流中更易使用——可以直接传入字符串作为输入,基于 handle 的运行现在返回更丰富的 TurnResult,包含收集的项目、执行时间和用量数据。

codex exec resume 新增 --output-schema 参数,使恢复的自动化任务可以保持会话上下文同时强制结构化 JSON 输出。TUI 启动速度更快——终端能力探测现在批量执行,不再需要串行等待多个检查后才显示首个交互页面。

远程执行器注册现在可以使用标准 Codex 认证,无需单独的注册凭证流程。应用服务器对话可以保留请求的图片保真度。修复了 Goal 持续运行在达到用量限制或重复阻塞时自动停止。Windows 安装更加稳健,MSVC 发布版不再需要单独安装 VC++ 运行时 DLL。

📰 Codex v0.131.0 应用服务器和网络搜索改进

2026-05-16 · 版本发布

OpenAI 于 2026 年 5 月 16 日发布 Codex CLI v0.131.0。本次更新围绕应用服务器和搜索能力进行了多项改进。

应用服务器 API 增强:新增线程管理 API、更好的 MCP 服务状态报告,以及服务端事件的改善。独立网络搜索调用功能上线,可以直接在特定提供商上进行网络搜索并显示和恢复完整的搜索活动。

沙箱安全性方面:新增对可执行文件白名单的多平台支持,改进了沙箱中进程退出的清理逻辑,加强了网络访问控制。权限模型支持更多的自定义场景,管理员可以更细粒度地控制 Agent 的行为边界。

修复方面包括:改进了大文件编辑的可靠性、修复了远程会话在某些网络条件下断开的问题,以及改进了跨平台文件路径处理的兼容性。

📰 Codex v0.130.0 Markdown 渲染和会话管理增强

2026-05-12 · 版本发布

OpenAI 于 2026 年 5 月 12 日发布 Codex CLI v0.130.0。本次更新专注于终端渲染和会话组织能力。

TUI 中 Markdown 表格渲染大幅改进:列宽计算更智能,表格在窄终端上自动折叠为键值格式。代码块语法高亮新增对更多语言的支持,链接渲染更加准确。

会话管理方面新增标签(Tag)和描述功能:用户可以为会话添加自定义标签和描述,方便后续检索和归类。会话选择器现在显示更多元信息,包括标签、创建时间和使用的模型。

Windows 平台增强包括:更好的 PowerShell 兼容性、改进的路径处理和终端转义序列支持。沙箱的文件系统权限检查在 Windows 上更加准确。修复了在特定终端模拟器中的渲染乱码问题。

📰 Codex v0.129.0 插件市场和 MCP 集成增强

2026-05-08 · 版本发布

OpenAI 于 2026 年 5 月 8 日发布 Codex CLI v0.129.0。本次更新聚焦于可扩展性。

新增内置插件市场浏览功能:用户可以直接在 TUI 中浏览、搜索和安装来自多个市场的插件,无需手动下载。插件安装流程更加流畅,支持一键安装和更新。

MCP 服务器集成改进:新增 MCP 服务器健康检查、配置验证和错误报告。SDK 钩子系统扩展,新增更多生命周期钩子,包括对话前/后处理、工具执行拦截和自定义审批流程。

修复方面包括:改进了大型项目的文件搜索性能、修复了某些插件在特定环境下崩溃的问题,以及改进了 MCP 服务器重连逻辑,提高了连接稳定性。

📰 Codex v0.128.0 沙箱和权限系统升级

2026-05-04 · 版本发布

OpenAI 于 2026 年 5 月 4 日发布 Codex CLI v0.128.0。本次更新是沙箱系统的一次重要升级。

沙箱模型全面更新:新增权限配置文件(Permission Profiles)概念,用户可以为不同场景创建和切换配置文件。沙箱预设机制让快速配置变得简单。文件系统权限模型改进了白名单和黑名单的边界检查。

Windows 集成增强:cmd.exe 和 PowerShell 的沙箱支持更加完善,包括更好的路径解析和环境变量处理。codex doctor 的 Windows 诊断信息更加全面。

新增多个实验性特性,包括远程执行器的性能改进和更细粒度的网络访问控制。修复了多个沙箱边界绕过问题,安全性得到进一步提升。

📰 Codex v0.127.0 多会话能力和性能优化

2026-04-30 · 版本发布

OpenAI 于 2026 年 4 月 30 日发布 Codex CLI v0.127.0。本次更新重点提升多会话工作流效率。

多会话管理得到显著增强:改进了会话选择器,新增按时间、状态和标签的排序和过滤功能。后台会话的生命周期管理更加智能,Codex 可以更好地处理多个并发会话的资源分配。

冷启动性能持续优化——TUI 启动时间相比上一版本减少了约 30%。终端输出的渲染性能提升,特别是在处理大量输出时更加流畅。文件变更检测机制改进,减少了不必要的重新扫描。

Python SDK 新增对异步流的更好支持,改进了错误处理和类型提示。多项底层稳定性修复和性能改进。

📰 Hermes Agent 突破 17.6 万 Star

2026-06-02 · 开源动态

由 Nous Research 开发的开源 AI Agent 框架 Hermes Agent 在 GitHub 上持续高速增长,截至 2026 年 6 月 2 日已获得 176,635 个 Star、30,166 个 Fork,并拥有 16,409 个开放 Issue。项目描述为「与你一同成长的 Agent」,支持终端、消息平台和 IDE 三种交互方式,不锁定任何特定 LLM 提供商。

过去两个月内 Star 数从 15 万增长至 17.6 万,反映出开发者对开源 AI Agent 框架的强烈需求。Hermes 的核心优势在于其插件系统、技能系统和多平台 Gateway 架构。项目采用 Python 开发,支持 OpenAI、Anthropic、DeepSeek、Google Gemini、xAI Grok 等主流模型,并提供可扩展的 MCP 服务器支持。

📰 Hermes v0.15.1 紧急修复版发布

2026-05-29 · 版本发布

Hermes Agent v0.15.1 于 2026 年 5 月 29 日作为 v0.15.0「Velocity Release」的当日热修复版本发布。本次修复共包含 28 次提交、21 个合并 PR,由 9 位贡献者参与完成。

标题性修复是 Dashboard 无限重载循环——该 bug 影响所有在回环模式下运行 v0.15.0 的用户,包括 Docker 部署、托管 Hermes 和新安装实例。一同修复的还包括:Kanban Worker SIGTERM 处理改进、/model 选择器跨平台统一、/yolo 会话绕过功能、19,932 条 skills.sh 完整目录索引、.md 媒体附件投递恢复、Gateway 探针步降安全机制、Web URL 重写透传、Kanban Worker 对引用图片的视觉支持、以及事后观察默认值优化。

Docker 用户现在拥有显式的 --insecure 可选环境变量,不再需要自动推断绑定主机地址。MCP 服务器的裸通信兼容性也得到了改进。

📰 Hermes v0.15.0 性能飞跃版深度解析

2026-05-28 · 版本发布

Hermes Agent v0.15.0「Velocity Release」于 2026 年 5 月 28 日发布。自 v0.14.0 以来,项目共完成了 1,302 次提交、747 个合并 PR、1,746 个文件变更,新增 282,712 行代码、删除 36,699 行,关闭 560 多个 Issue(其中包括 15 个 P0、65 个 P1、19 个安全相关),共有 321 位社区贡献者参与。

本次更新的核心理念就是「更快」。标志性变化是长达 16,083 行的 run_agent.py 被拆解为 14 个内聚模块归入 agent/ 目录,缩减至 3,821 行,缩减幅度达 76%。

Kanban 系统在 104 个 PR 的迭代中成长为真正的多智能体协作平台。新增特性包括:编排器自动任务分解、群体拓扑支持、定时任务调度、每任务独立工作目录、以及每任务独立模型覆盖。冷启动性能继续优化——启动时间再减 1 秒,每次对话函数调用减少 47%,hermes --version 响应时间降至 32 毫秒。

📰 Hermes v0.14.0 基础架构版发布

2026-05-16 · 版本发布

Hermes Agent v0.14.0「Foundation Release」于 2026 年 5 月 16 日发布。自 v0.13.0 以来,项目完成了 808 次提交、633 个合并 PR、1,393 个文件变更、165,061 行新增代码,关闭 545 个 Issue(包括 12 个 P0、50 个 P1),215 位社区贡献者参与。

本版本的核心目标是让 Hermes 能在任何地方安装和运行。xAI Grok 以 SuperGrok OAuth 提供商身份正式入驻,grok-4.3 上下文窗口提升至 100 万 tokens。新增 OpenAI 兼容本地代理——可将任何 OAuth 认证的 Hermes 提供商(Claude Pro、ChatGPT Pro、SuperGrok 等)转换为 Codex、Aider、Cline、Continue 等工具可直接调用的 API 端点。

新增 x_search 作为一等 X(Twitter)搜索工具,支持 OAuth 或 API Key 认证。Microsoft Teams 集成已端到端打通——从 Graph API 认证、Webhook 监听、管道运行到消息投递。同时进行了大幅轻量化改造,重型后端改为按需安装。

📰 Hermes v0.13.0 持久化任务能力大幅升级

2026-05-07 · 版本发布

Hermes Agent v0.13.0「Tenacity Release」于 2026 年 5 月 7 日发布。自 v0.12.0 以来,项目完成了 864 次提交、588 个合并 PR、829 个文件变更、128,366 行新增代码,关闭 282 个 Issue(包括 13 个 P0、36 个 P1),295 位社区贡献者参与。

本次版本的主题是「Hermes 现在能完成它开始的任务」。核心改进是持久化后台任务系统——Agent 现在可以启动一个任务后挂起到后台运行,稍后再恢复结果。新增计时器功能,Agent 可以设置定时提醒和周期性操作。Kanban 任务队列新增进度回调和状态报告能力。

Gateway 层重构了消息平台适配架构,新增钉钉、飞书、企业微信三个国内主流办公平台的支持。Webhook 触发机制全面升级,支持更灵活的自定义事件绑定。在安全和稳定性方面,加强了审批链路和凭证轮换机制。

📰 Hermes v0.12.0 自治策展人上线,技能库自动维护

2026-04-30 · 版本发布

Hermes Agent v0.12.0「Curator Release」于 2026 年 4 月 30 日发布。自 v0.11.0 以来,项目完成了 1,096 次提交、550 个合并 PR、1,270 个文件变更、217,776 行新增代码,213 位社区贡献者参与。

本版本的核心创新是自治 Curator 系统——一个在后台独立运行的自主 Agent。hermes curator 在 Gateway 的定时触发器上工作(默认 7 天周期),自动对技能库进行评分、合并相关技能、修剪废弃技能,并将每次运行报告写入 logs/curator/run.json 和 REPORT.md。归档的技能也可以随时恢复。这套机制打通了自我改进循环——Agent 学会的知识可以被自动评估、优化和沉淀。

此外新增 4 个推理提供商、第 18 个消息平台和第 19 个基于 Teams 插件的平台。原生集成包括 Spotify 音乐播放控制和 Google Meet 会议管理。ComfyUI 和 TouchDesigner-MCP 从可选升级为默认捆绑。TUI 冷启动时间减少约 57%。

📰 Hermes v0.11.0 全新 TUI 界面和 AWS Bedrock 支持

2026-04-23 · 版本发布

Hermes Agent v0.11.0「Interface Release」于 2026 年 4 月 23 日发布。自 v0.9.0 以来,项目累计完成了 1,556 次提交、761 个合并 PR、1,314 个文件变更、224,174 行新增代码,29 位直接贡献者和 290 位合作贡献者参与(含 co-author)。

本次更新的核心是全新的 TUI(终端界面)。hermes --tui 基于 React/Ink 完全重写,后端采用 Python JSON-RPC 协议(tui_gateway)。新界面带来固定式输入框、实时流式输出伴随 OSC-52 剪贴板支持、稳定的选择器快捷键、状态栏显示每次对话计时器和 Git 分支,以及 /clear 命令。

新增 AWS Bedrock 原生支持,企业用户可直接通过 AWS 接入 Hermes。消息平台扩展至第 17 个——新增 QQBot 集成。推理路径增加 5 条新线路。GPT-5.5 通过 Codex OAuth 的支持也备受关注,用户可直接使用 OpenAI Codex 订阅运行 Hermes。

📰 Hermes v0.10.0 推出 Nous 工具网关,订阅即用零额外 Key

2026-04-16 · 版本发布

Hermes Agent v0.10.0「Tool Gateway Release」于 2026 年 4 月 16 日发布。本次更新的核心是 Nous 工具网关——付费 Nous Portal 订阅用户现在可以通过已有订阅自动获得多项能力,无需再配置额外 API Key。

通过网关可用的工具包括:网页搜索(Firecrawl)、图像生成(FAL / FLUX 2 Pro)、文本转语音(OpenAI TTS)和浏览器自动化(Browser Use)。使用方式极为简单——运行 hermes model 选择 Nous Portal,然后选择要启用的工具即可。每个工具可通过 use_gateway 配置单独启用,完全集成 hermes tools 和 hermes status 命令。运行时系统会自动优先使用网关而非直连 API Key。

此功能替代了旧版隐藏环境变量 HERMES_ENABLE_NOUS_MANAGED_TOOLS,现在基于干净的订阅检测,体验更加流畅。

📰 Hermes v0.9.0 发布本地 Web 仪表盘和移动端支持

2026-04-13 · 版本发布

Hermes Agent v0.9.0「Everywhere Release」于 2026 年 4 月 13 日发布。自 v0.8.0 以来,项目完成了 487 次提交、269 个合并 PR、167 个已解决 Issue、493 个文件变更、63,281 行新增代码,24 位贡献者参与。

本次版本的主题是「无处不在」。全新本地 Web 仪表盘上线——通过浏览器即可管理 Hermes Agent,包括配置设置、监控会话、浏览技能库和管理网关,无需触碰配置文件或终端。这是上手 Hermes 最简便的方式。

移动端支持通过 Termux/Android 实现,Hermes 现在可以在口袋里运行。新增 iMessage 和微信两个重量级消息平台。Fast Mode(/fast 命令)为 OpenAI 和 Anthropic 模型提供优先处理通道,显著降低延迟。安全方面进行了跨 16 个支持平台的最深度安全加固。

📰 Hermes v0.8.0 引入后台通知和免费 MiMo v2 Pro

2026-04-08 · 版本发布

Hermes Agent v0.8.0「Intelligence Release」于 2026 年 4 月 8 日发布,共包含 209 个合并 PR、82 个已解决 Issue。

本版本的核心创新是后台进程自动通知(notify_on_complete)——长时间运行的任务可以在完成后自动通知 Agent。无论是 AI 模型训练、测试套件运行、部署流水线还是构建任务,Agent 启动后可以继续处理其他工作,任务完成时自动收到结果推送,无需轮询等待。

Nous Portal 新增免费 Xiaomi MiMo v2 Pro 模型,可用于压缩、视觉、摘要等辅助任务。所有平台支持实时模型切换——无需重启即可在对话中切换底层模型。新增 Google AI Studio 原生支持、智能非活动超时机制、应用内审批按钮(Approve/Reject),以及 MCP OAuth 2.1 安全认证支持。