大模型圈的核心机密,终究还是保不住了!
继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效——OpenAI 的现役代码模型 GPT-6 Sol Codex惨遭「开盒」,老底被扒得一干二净!
据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。

链接:https://github.com/elder-plinius/CL4R1T4S/blob/main/OPENAI/Codex_Desktop/GPT-6-Sol_Prompts.txt
整整1902 行的指令模板、临时指令文件、内部协作逻辑,被毫无保留地摊在了全网开发者面前。
你要知道,Sol Codex 可不是什么过时的旧物,它是 OpenAI 现役性价比产品线 GPT-5.6 Sol的王牌代码模型版本!
这次泄露,相当于直接把可口可乐的神秘配方公之于众。
那么,这近 30 万字的「天机」里到底藏着什么?OpenAI究竟是怎么调教这只代码怪兽的?
今天,我们就来逐字逐句扒一扒这份无价的内部操作手册,看看全球最顶级的提示词工程到底长什么样!
告别「AI味」,OpenAI是怎样杀死「废话」的?
平时用 ChatGPT,大家最烦什么?
肯定是那股浓浓的「AI 味」:动不动就「总而言之」、「值得注意的是」、「深入探讨」……
在这份泄露的系统指令中,我们赫然发现,OpenAI 官方自己也受不了这些废话了! 官方在写作风格板块,对 GPT-6进行了极其严厉的反废话训练。
指令原文解密:
「避免使用 AI 垃圾词汇(AI slop words)或短语,如在结论中使用『底线是(Bottom Line)』、『重要性(Significance)』、『视角(Perspective)』,以及『深入(delve)』、『培养(foster)』、『利用(leverage)』、『值得注意的是(it's worth noting)』、『重要的是(importantly)』……」

OpenAI 甚至具体到要求模型:

这简直是给所有 Prompt 工程师上了一课!想要 AI输出高质量内容,第一步就是建立「负面词汇黑名单」 ,强制斩断大模型的套路化表达。
可怕的「极端自主性」——别烦我,我在干活!
很多人觉得 AI 只是个「一问一答」的聊天机器人,但 GPT-6 Sol Codex彻底打破了这个认知。
它被塑造成了一个拥有极高自主权、甚至有点「独断专行」的超级数字员工。
在 自主与持久性这一章,OpenAI 赋予了它惊人的特权:
指令原文解密:
「用户非常讨厌你停下来询问确认或请求许可。一旦会话中的证据支持下一步操作,你应该继续工作,而不是结束回合去跟用户澄清。」
「不要为了节省时间、精力或 Token而满足于部分或『勉强有用』的解决方案。如果任务需要持续工作,请完成所有必要的工作,直到实现预期结果。」
这意味着什么?
遇到 Bug,它自己修! 它可以自主创建隔离的工作区、解决 Git 合并冲突、创建草稿PR,除非操作具有破坏性或不可逆转,否则它绝不会中途停下来问你「接下来该怎么办」。
它不接受「半吊子」工程。
如果你让它写个功能,它必须把测试、联调等前置条件全部搞定,只有在点击「部署」或「合并代码」这种最后一步时,它才会把最终结果端上来请你签字画押。
为了防止它在后台偷偷干活时把用户晾在一边,指令还规定: 「如果用户请求需要调用工具,每 60 秒内必须在评论频道给用户发一个简短的状态更新。」
这就像一个极其靠谱的高级程序员:接到需求,转身去敲代码,遇到小问题自己解决,每隔一分钟在钉钉上回一句「正在查日志」,最后直接把写好的完美代码扔给你。
神级工具链暴露,大模型的「军火库」
作为一个顶尖的代码 Agent,GPT-6 Sol Codex 掌握着一套极其庞大且硬核的工具链。
这次泄露,彻底曝光了它的工作方式。
1.鄙视 grep,独宠 rg
在搜索文本或文件时,指令直接硬编码:「你首先要使用 rg 或 rg --files;它们比 grep等替代方案快得多。如果没有废话,你才去用下一个最好的工具。」(注:rg 即 ripgrep,极速搜索工具)。
2.并行处理与执行
系统要求模型在调用 functions.exec 时,如果任务是独立的,必须使用 await Promise.allSettled([...])进行并行处理,以极大地压榨时间效率。
3.动态技能树
这是最让人眼馋的功能。系统定义了一个叫 SKILL.md 的机制。当用户要求做某件事时,模型可以去指定目录读取 SKILL.md(甚至通过短路径别名如 r0去找)。这相当于给模型外挂了无数个「技能书」,随时随地热更新!
4.彻底接管电脑与浏览器
在这次泄露的 model_messages.confirmation_policies.browser_use 模块中,详细规定了它如何使用浏览器和电脑 UI。
这证明 GPT-6 已经完全具备了「神机妙算」甚至「接管桌面」的能力! 它可以自己打开网页、点击按钮、填写表单,甚至截屏。
但为了防止它「闯祸」,OpenAI 设置了极其复杂的四大确认模式:

「盗梦空间」式的工作流——长记忆与休眠机制
面对极其庞大的代码库,大模型最怕什么?——忘词(上下文超载)。
这次泄露的代码,让我们看到了 OpenAI 是如何通过精妙的提示词,解决 LLM 「鱼的记忆」这一千古难题的。
当 Token 预算耗尽时,系统不会直接崩溃。指令里有一个专门的 token_budget.guidance_message:
「在启动新的上下文窗口之前,使用 notes 工具保存简明的进度笔记,包含:目标、决策、进度、学习内容、下一步,以及相关用户请求的窗口 ID 和项目ID……未来上下文窗口将不会自动包含当前对话。」
就像人类换班一样,这个 AI 在「下班」前会写一份详尽的交接文档,然后呼叫 functions.new_context开启全新的上下文环境。这简直是无限续航的神技!
2.休眠与心跳唤醒
最让人细思极恐的是,这个模型是可以「常驻后台」的。 在 persistent_instructions 中,它被要求主动跟踪任务:
「如果用户问某个评估(eval)运行得怎么样,而它还在运行,报告当前状态,然后继续监控该评估直到它达到终止状态。」
系统还会定期发送隐藏的 <heartbeat>XML标签给模型。在这个时间点,模型会被「唤醒」,去检查那些后台任务是否完成。如果没有重要的事情,模型必须选择 DONT_NOTIFY(不要打扰用户);如果CI/CD 跑崩了,模型选择 NOTIFY 并立刻弹窗通知用户。
它不是在等你提问,它是在后台真真切切地给你「打工」!
最强代码审查员
对于程序员来说,这份泄露文件里最值钱的,莫过于它内置的代码审查指南!
OpenAI 倾囊相授了如何让 AI 进行高质量的 Code Review:

2.审查铁律:
这段逻辑如果直接抄进你的公司内部代码审查机器人里,绝对能秒杀市面上 90% 的水军 AI!
吃瓜群众吵翻天,是「降维打击」还是「小儿科」?
面对这近 30 万字的史诗级泄露,外网开发者社区直接炸开了锅。各种声音层出不穷,可以说是众生相十足。
有被震撼到语无伦次的:

有觉得在装腔作势的:
网友 vechen: 「老哥只不过是直接从本地文件里拿的吧。这『泄露』有啥意义啊,笑死,它本来就在官方公开的 Codex 仓库里找得到影子。」
还有鄙视链顶端的大神出来群嘲:
网友 Outdated Often: 「谁在乎啊 Pliny——我还搞到了 Meta Hatch 全栈,还带隐藏推理轨迹,直接从 tensor tokens里扒出来的——那才叫厉害,而且我也不会跑到推特上跟一堆人炫耀。去干点正事吧,把 bearer tokens(授权令牌)搞下来,然后再来低调装逼吧!」
更有吃瓜群众调侃:
「294,000 个字符的拦截 JSON 被包装得像是死海古卷一样。这不过是跑了个 mitmproxy而已。任何人都能运行这个,自己从OpenAI、Gemini、Claude 那里提取提示词,根本不需要搞网红包装那一套。」
不过,无论黑客手段高低,对于我们普通开发者和 AI 爱好者来说,这波绝对是天上掉馅饼!
这 30 万字,本质上就是 OpenAI 内部最顶尖的一批工程师,花费无数个日夜、砸了上千万美元算力试错,才调试出来的「大模型驯化终极指南」 。
提示词已死?不,系统工程永生!
读完这份长达 1902 行的「天书」,不知道你是什么感受?
以前,我们以为写提示词就是玄学:加一句「深呼吸」、加一句「如果做不好就扣你工资」,模型就能变聪明。
但 GPT-6 Sol Codex 的底层逻辑告诉我们:真正的工业级 AI 应用,根本不是靠几句讨巧的话,而是靠极其严密的系统工程!
大模型正在从一个「聪明的对答机」,全面进化为「具备接管权限的自主操作系统」。而这次泄露的 30 万字,就是通向这个新时代的源代码。
参考资料:
https://x.com/elder_plinius/status/2102515853430542668
文章来自于微信公众号 “新智元”,作者 “新智元”
【开源免费】字节工作流产品扣子两大核心业务:Coze Studio(扣子开发平台)和 Coze Loop(扣子罗盘)全面开源,而且采用的是 Apache 2.0 许可证,支持商用!
项目地址:https://github.com/coze-dev/coze-studio
【开源免费】n8n是一个可以自定义工作流的AI项目,它提供了200个工作节点来帮助用户实现工作流的编排。
项目地址:https://github.com/n8n-io/n8n
在线使用:https://n8n.io/(付费)
【开源免费】DB-GPT是一个AI原生数据应用开发框架,它提供开发多模型管理(SMMF)、Text2SQL效果优化、RAG框架以及优化、Multi-Agents框架协作、AWEL(智能体工作流编排)等多种技术能力,让围绕数据库构建大模型应用更简单、更方便。
项目地址:https://github.com/eosphoros-ai/DB-GPT?tab=readme-ov-file
【开源免费】VectorVein是一个不需要任何编程基础,任何人都能用的AI工作流编辑工具。你可以将复杂的工作分解成多个步骤,并通过VectorVein固定并让AI依次完成。VectorVein是字节coze的平替产品。
项目地址:https://github.com/AndersonBY/vector-vein?tab=readme-ov-file
在线使用:https://vectorvein.ai/(付费)
【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。
项目地址:https://github.com/Significant-Gravitas/AutoGPT
【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。
项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md
【开源免费】LangGPT 是一个通过结构化和模板化的方法,编写高质量的AI提示词的开源项目。它可以让任何非专业的用户轻松创建高水平的提示词,进而高质量的帮助用户通过AI解决问题。
项目地址:https://github.com/langgptai/LangGPT/blob/main/README_zh.md
在线使用:https://kimi.moonshot.cn/kimiplus/conpg00t7lagbbsfqkq0