有人把 OpenAI Codex 的独立搜索接口逆向了出来,做成插件让 Gemini、Claude、本地模型白嫖一套零 token 的网页搜索。本文复盘这次逆向的四步手法,以及它暴露出的 Codex 架构观:搜索服务,其实早就独立于推理了。
逆向 Codex 的网页搜索:原来搜索和推理早就分家了


有人把 OpenAI Codex 的独立搜索接口逆向了出来,做成插件让 Gemini、Claude、本地模型白嫖一套零 token 的网页搜索。本文复盘这次逆向的四步手法,以及它暴露出的 Codex 架构观:搜索服务,其实早就独立于推理了。

OpenAI 给 Codex 的 app-server 协议加了一个实验性的 thread/revert 请求,可以把分页线程的持久化历史替换成某个 turn 之前的「前缀」。它回滚的是「对话记忆」,不是「改过的文件」。本文拆解这个新能力的设计细节,以及它背后透出的信号。

有人让 Codex 连续自主工作 14 天、提交上千次,把一段 GPU 矩阵分解内核提速了 232 倍。本文复盘这套「自动研究」方法论:什么样的任务值得放养、/goal 与 /btw 怎么用、如何用「候选束」帮模型逃离局部最优。

用 Codex 这类编程智能体干活时,真正拖慢进度的往往不是模型写错代码,而是它在无数个小节点上替你做了默认决定。本文拆解隐性假设带来的三个代价,介绍「结构化舵轮」的思路:用一个更便宜的观察者子代理把隐形决策捞出来,变成可勾选、可下拉、可固定的开关。

切换成 API Key 之后,Codex 桌面端的 Fast 模式开关突然消失,TOML 配置也完全失效。一位开发者写了个本地测速工具,跑了一组对照实验,发现桌面端渲染层会悄悄把 service_tier=fast 剥掉、传成 None,导致 API Key 用户的吞吐只有 CLI Fast 档位的六成左右。本文还原这场降速取证的完整过程。