OpenAI GPT-6 Sol 被破解,30 万字系统提示词已泄露

OpenAI GPT-6 Sol 被破解,30 万字系统提示词已泄露
2026年10月05日 08:14 IT之家

大模型圈的核心机密,终究还是保不住了!继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效 ——OpenAI 的现役代码模型 GPT-6 Sol Codex 惨遭「开盒」,老底被扒得一干二净!

据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。

整整 1902 行的指令模板、临时指令文件、内部协作逻辑,被毫无保留地摊在了全网开发者面前。

你要知道,Sol Codex 可不是什么过时的旧物,它是 OpenAI 现役性价比产品线 GPT-5.6 Sol 的王牌代码模型版本!

这次泄露,相当于直接把可口可乐的神秘配方公之于众。

那么,这近 30 万字的「天机」里到底藏着什么?OpenAI 究竟是怎么调教这只代码怪兽的?

今天,我们就来逐字逐句扒一扒这份无价的内部操作手册,看看全球最顶级的提示词工程到底长什么样!

平时用 ChatGPT,大家最烦什么?

肯定是那股浓浓的「AI 味」:动不动就「总而言之」、「值得注意的是」、「深入探讨」……

在这份泄露的系统指令中,我们赫然发现,OpenAI 官方自己也受不了这些废话了!官方在写作风格板块,对 GPT-6 进行了极其严厉的反废话训练。

指令原文解密:

OpenAI 甚至具体到要求模型:

这简直是给所有 Prompt 工程师上了一课!想要 AI 输出高质量内容,第一步就是建立「负面词汇黑名单」 ,强制斩断大模型的套路化表达。

很多人觉得 AI 只是个「一问一答」的聊天机器人,但 GPT-6 Sol Codex 彻底打破了这个认知。它被塑造成了一个拥有极高自主权、甚至有点「独断专行」的超级数字员工。

在自主与持久性这一章,OpenAI 赋予了它惊人的特权:

指令原文解密:

这意味着什么?遇到 Bug,它自己修!它可以自主创建隔离的工作区、解决 Git 合并冲突、创建草稿 PR,除非操作具有破坏性或不可逆转,否则它绝不会中途停下来问你「接下来该怎么办」。

它不接受「半吊子」工程。如果你让它写个功能,它必须把测试、联调等前置条件全部搞定,只有在点击「部署」或「合并代码」这种最后一步时,它才会把最终结果端上来请你签字画押。

为了防止它在后台偷偷干活时把用户晾在一边,指令还规定: 「如果用户请求需要调用工具,每 60 秒内必须在评论频道给用户发一个简短的状态更新。」

这就像一个极其靠谱的高级程序员:接到需求,转身去敲代码,遇到小问题自己解决,每隔一分钟在钉钉上回一句「正在查日志」,最后直接把写好的完美代码扔给你。

作为一个顶尖的代码 Agent,GPT-6 Sol Codex 掌握着一套极其庞大且硬核的工具链。这次泄露,彻底曝光了它的工作方式。

1.鄙视 grep,独宠 rg 在搜索文本或文件时,指令直接硬编码:「你首先要使用 rg 或 rg --files;它们比 grep 等替代方案快得多。如果没有废话,你才去用下一个最好的工具。」(注:rg 即 ripgrep,极速搜索工具)。

2.并行处理与执行系统要求模型在调用 functions.exec 时,如果任务是独立的,必须使用 await Promise.allSettled ([...]) 进行并行处理,以极大地压榨时间效率。

3.动态技能树这是最让人眼馋的功能。系统定义了一个叫 SKILL.md 的机制。当用户要求做某件事时,模型可以去指定目录读取 SKILL.md(甚至通过短路径别名如 r0 去找)。这相当于给模型外挂了无数个「技能书」,随时随地热更新!

4.彻底接管电脑与浏览器在这次泄露的 model_messages.confirmation_policies.browser_use 模块中,详细规定了它如何使用浏览器和电脑 UI。

这证明 GPT-6 已经完全具备了「神机妙算」甚至「接管桌面」的能力!它可以自己打开网页、点击按钮、填写表单,甚至截屏。但为了防止它「闯祸」,OpenAI 设置了极其复杂的四大确认模式:

面对极其庞大的代码库,大模型最怕什么?—— 忘词(上下文超载)。这次泄露的代码,让我们看到了 OpenAI 是如何通过精妙的提示词,解决 LLM 「鱼的记忆」这一千古难题的。

当 Token 预算耗尽时,系统不会直接崩溃。指令里有一个专门的 token_budget.guidance_message:「在启动新的上下文窗口之前,使用 notes 工具保存简明的进度笔记,包含:目标、决策、进度、学习内容、下一步,以及相关用户请求的窗口 ID 和项目 ID…… 未来上下文窗口将不会自动包含当前对话。」就像人类换班一样,这个 AI 在「下班」前会写一份详尽的交接文档,然后呼叫 functions.new_context 开启全新的上下文环境。这简直是无限续航的神技!

最让人细思极恐的是,这个模型是可以「常驻后台」的。在 persistent_instructions 中,它被要求主动跟踪任务:「如果用户问某个评估(eval)运行得怎么样,而它还在运行,报告当前状态,然后继续监控该评估直到它达到终止状态。」系统还会定期发送隐藏的 XML 标签给模型。在这个时间点,模型会被「唤醒」,去检查那些后台任务是否完成。如果没有重要的事情,模型必须选择 DONT_NOTIFY(不要打扰用户);如果 CI / CD 跑崩了,模型选择 NOTIFY 并立刻弹窗通知用户。它不是在等你提问,它是在后台真真切切地给你「打工」!

对于程序员来说,这份泄露文件里最值钱的,莫过于它内置的代码审查指南!OpenAI 倾囊相授了如何让 AI 进行高质量的 Code Review:

分级制度:

2.审查铁律:

面对这近 30 万字的史诗级泄露,外网开发者社区直接炸开了锅。各种声音层出不穷,可以说是众生相十足。有被震撼到语无伦次的:

有觉得在装腔作势的:网友 vechen: 「老哥只不过是直接从本地文件里拿的吧。这『泄露』有啥意义啊,笑死,它本来就在官方公开的 Codex 仓库里找得到影子。」

还有鄙视链顶端的大神出来群嘲:网友 Outdated Often: 「谁在乎啊 Pliny—— 我还搞到了 Meta Hatch 全栈,还带隐藏推理轨迹,直接从 tensor tokens 里扒出来的 —— 那才叫厉害,而且我也不会跑到推特上跟一堆人炫耀。去干点正事吧,把 bearer tokens(授权令牌)搞下来,然后再来低调装逼吧!」

更有吃瓜群众调侃:「294,000 个字符的拦截 JSON 被包装得像是死海古卷一样。这不过是跑了个 mitmproxy 而已。任何人都能运行这个,自己从 OpenAI、Gemini、Claude 那里提取提示词,根本不需要搞网红包装那一套。」

不过,无论黑客手段高低,对于我们普通开发者和 AI 爱好者来说,这波绝对是天上掉馅饼!

这 30 万字,本质上就是 OpenAI 内部最顶尖的一批工程师,花费无数个日夜、砸了上千万美元算力试错,才调试出来的「大模型驯化终极指南」 。

读完这份长达 1902 行的「天书」,不知道你是什么感受?以前,我们以为写提示词就是玄学:加一句「深呼吸」、加一句「如果做不好就扣你工资」,模型就能变聪明。但 GPT-6 Sol Codex 的底层逻辑告诉我们:真正的工业级 AI 应用,根本不是靠几句讨巧的话,而是靠极其严密的系统工程!

大模型正在从一个「聪明的对答机」,全面进化为「具备接管权限的自主操作系统」。而这次泄露的 30 万字,就是通向这个新时代的源代码。

新浪科技公众号
新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

创事记

科学探索

科学大家

苹果汇

众测

专题

官方微博

新浪科技 新浪数码 新浪手机 科学探索 苹果汇 新浪众测

公众号

新浪科技

新浪科技为你带来最新鲜的科技资讯

苹果汇

苹果汇为你带来最新鲜的苹果产品新闻

新浪众测

新酷产品第一时间免费试玩

新浪探索

提供最新的科学家新闻,精彩的震撼图片