《代码x》使用限制详解:五小时使用时段、每周上限和积分

代码书-使用-英雄

Codex 的使用并非固定数量的提示词。. 本地消息和云端聊天共享一个五小时的配额窗口,此外可能还存在每周配额限制。您消耗该配额的速度取决于模型、存储库上下文、推理过程、工具使用、数据检索以及缓存情况。.

同一套方案在针对性修改时可能显得宽松,而在全面审查时却可能显得局限。一条提示可能引发代码库搜索、命令执行、逻辑推演、代码修改和验证等操作。要问的是每条提示会触发哪些具体工作,而不仅仅是还有多少条提示待处理。.

当编码窗口具有价值时,, GlobalGPT 提供了一种实用的方法,用于处理无需访问代码库的工作。开发人员可以让 Codex 专注于代码,同时使用其他可用的模型,或利用 Yukie 提供的“幻灯片”、“文档”和“图像”引导式工作流来处理演示文稿、简报和多模态资产。这样既能保持编码上下文,又不会假装浏览器代理可以替代代码库中的执行。.

本指南将官方规则与我们在四项受控编码任务中观察到的情况区分开来。此外,它还介绍了如何制定计划、减少无效工作,以及如何判断哪些任务可以安全地转移到另一个工作流中。.

一分钟掌握 Codex 的使用方法

有四个不同的概念需要区分清楚。五小时的配额是受支持的本地和云端 Codex 工作共享的短期配额。 每周配额是一项可能同时适用的长期限制。购买的配额是符合条件的账户在包含的配额用完后,可通过付费方式继续使用的一种途径。API密钥调用是一项独立的按量付费产品,不应与ChatGPT订阅混用。.

边界层之间的相互作用

短时间窗口的重置并不一定能清除较长的约束条件。.

第1层五小时的时间窗口本地消息和云端聊天共享短期配额。.
第2层每周上限在空头窗口重置后,可能仍会适用另一项更长的限额。.
包含使用后已购买的积分符合条件的账户可通过单独的付费余额继续使用。.
订阅途径: 先计算应计金额,再计算符合条件的抵免额。.
API密钥路由: 单独的按量计费,不属于消费者套餐范围。.

该图表展示的是各种关系,并非保证的工作量或个人恢复时间。.

图层是什么意思这并不意味着什么
五小时的时间窗口针对受支持的本地和云端工作的共享短期津贴连续编程五小时,或保证达到指定提示词数量
每周上限可能还适用的更长的账户限额一项在短暂时间窗口重置后总会消失的限制
已购买的积分符合条件的用户在包含的流量用完后可继续付费使用免费额外订阅配额
API 密钥单独计费的开发者路线“Plus”或更高使用等级的消费者额度的一部分

“五小时《古籍》窗口”究竟意味着什么

这五小时的配额最好理解为一个共享的滚动工作配额。它并非仅在你输入时才开始计时的秒表,也不保证每条消息的消耗量都相同。本地消息和云端聊天都会从该共享配额中扣除,因此切换界面并不会生成独立的配额池。.

您启动一个会话,发送任务,并根据工作量消耗共享配额。该短暂时段随后会重置,但每周上限仍可能产生影响。“五小时”指的是配额周期,而非五小时的不间断执行时间。.

OpenAI Codex 五小时使用量估算值,相关限制已标出
OpenAI 按模型发布大致的五小时预测值,并指出可能适用额外的每周限额。.

此外,OpenAI 列出了大致的估算值:在每个五小时时间窗口内,Sol 约有 15–90 条本地消息,Terra 约有 20–110 条,Luna 约有 50–280 条。 这些范围的宽度正是关键所在。它们仅作为规划参考,既非个人特权,也并非对你当前仓库将允许多少条提示的预测。.

探索公布的五小时航程

选择一个模型和计划发送的消息数量。结果反映的是上下文情况——而非个人配额预测。.

模型15–90 条消息
45
您的计划
45
索尔 在五小时内的消息
在已公布的宽泛范围内

实际使用情况因模型、使用场景、任务复杂度、推理、工具、数据检索和缓存等因素而异。此处不提供剩余百分比、每周上限、积分或 API 费用的估算值。.

Official Plus 的估计值
索尔15–90
Terra20–110
露娜50–280
本地消息 / 5 小时前

对于明确且易于验证的任务,采用更简化的模型即可;而当存在模糊性、风险或跨文件影响等情况时,更严谨的推理便显得尤为重要。.

为什么两个 Codex 提示生成的数据量会相差很大

提示词的长度并不是一个可靠的预测指标。“审查此代码库并修复重要问题”这类提示词可能导致工作范围过于宽泛,因为其范围未明确界定。而一个更长的提示词——如果能指明具体组件、复现故障并定义成功标准——则能缩小搜索范围。.

模型选择会改变规划范围

不同模型的已公布使用量估算各不相同。实际决策并非单纯在质量与价格之间权衡,而是要在所需判断力与可用吞吐量之间权衡。对于具有客观检查机制的有限任务,应采用日常模型。而对于架构设计、涉及安全敏感的变更、模糊的缺陷以及评审等场景——在这些情况下,遗漏一个细微问题所造成的代价高于额外投入——则应保留更强大的推理能力。.

代码仓库和对话上下文共同构成了工作

Codex 可以阅读说明、检查代码树、追踪调用位置、理解测试用例,并回顾上下文。冗长的讨论可能会将过时的假设延续下去。明确标注的失败测试用例、具体的模块以及清晰的边界,能够缩小搜索范围。.

模糊性会促进探索

当预期行为明确且故障可重现时,智能体可以直接采取行动。而对于主观性需求、间歇性故障以及多种可能的修复方案,则需要进行更深入的探索。应消除可避免的歧义,同时不抑制必要的推理过程。.

工具和验证是有益的投入

搜索、命令、测试、代码检查工具和差异审查虽然增加了工作量,但能使结果更值得信赖。跳过测试可能会导致需要进行耗时的二次验证。应要求进行能够验证结果的针对性验证,并停止与之无关的探索。.

缓存输入并非配额百分比

当重复使用先前处理过的上下文时,Codex 会报告缓存输入字段。这些遥测数据有助于描述运行情况,但无法显示您节省的五小时配额所占的比例。此外,这既不是信用扣款,也不是 API 账单。 请将缓存输入视为一种能够提高效率的实现细节,而非可转换为剩余订阅容量的计量单位。.

任务形态可能面临的压力为什么
解释命名文件中的一项功能较低上下文范围狭窄,且没有“编辑-测试”循环
修复一个可通过失败的测试复现的错误中度针对性诊断、代码变更与验证
在多个文件中添加一个功能更高规划、跨文件编辑、测试和兼容性检查
全面审查一个不熟悉的代码库可能较高庞大的搜索范围、判断以及反复出现的语境

这些标签是方向性的,而非数值性的。代码库规模、代码质量、任务清晰度、可用的测试以及 编码模型的选择 可以将任何实际任务向上或向下移动。.

  • 低压作业 具有狭窄的上下文、指定的目标以及目标检查。.
  • 高压作业 结合了广泛的探索、模糊性、跨文件变更以及反复验证。.
  • 有用的工具调用并非浪费: 测试和差异检查可能会消耗配额,但能避免代价高昂的返工。.

四项受控存储库任务揭示了什么

我们在同一个紧凑的 Python 测试框架中运行了四个冻结任务:陌生仓库理解、多文件功能、夏令时错误修复以及代码审查与修复。 对于每个任务,我们都保留了第一个有效的结果。Codex 报告了输入、缓存输入、输出和推理输出字段,这使我们能够以一致的方式比较这四次运行,同时又不会让遥测数据变成一笔高昂的订阅费用。.

观察到的Codex CLI证据

四个存储库任务所使用的上下文量差异很大

CLI 生成的代币字段作为测试凭证显示——而非订阅时段的百分比或 API 账单。.

任务持续时间输入缓存输入输出推理结果
T1 · 理解108 秒147,420119,2963,7521,073
T2 · 专题115 秒228,681194,5603,6341,219
T3 · 错误修复99 秒146,412119,2962,820933
T4 · 评论223 秒496,865419,0727,5173,588
查看完整的受控运行摘要
# Codex T1-T4 正式运行摘要

## 运行状态

- 协议:1.0.1-codex
- 运行环境:macOS 上的 Codex CLI
- CLI 版本:0.146.0-alpha.3.1
- 模型:gpt-5.6-sol
- T1-T3 推理难度:中等
- T4 推理难度:高
- 有效的受控批次:第 3 次尝试
- 有效任务期间的人工干预:无
- 任务所需网络:无
- 提交、推送、部署或生产环境访问:无

## 有效首次输出结果

| 任务 | 耗时 | 目标结果 | 输入令牌数 | 缓存输入 | 输出令牌数 | 推理输出 |
|---|---:|---|---:|---:|---:|---:|
| T1 | 108 秒 | 基线测试通过;无文件更改 | 147,420 | 119,296 | 3,752 | 1,073 |
| T2 | 115 秒 | 通过 7 个公开测试和隐藏特征检查 | 228,681 | 194,560 | 3,634 | 1,219 |
| T3 | 99 秒 | 4 个公开测试和两个 DST 隐藏检查均通过 | 146,412 | 119,296 | 2,820 | 933 |
| T4 | 223 秒 | 修复了 2 个缺陷并进行了回归测试;4 个测试通过 | 496,865 | 419,072 | 7,517 | 3,588 |

令牌字段复现了 Codex CLI 输出的值。它们并非订阅窗口百分比、可计费 API 令牌或积分转换值。

## 保留的被排除尝试

- 尝试 1:由于批准选项被放置在 `exec` 子命令之后,导致在调用模型前发生基础设施故障。 所有事件文件均为空。已从模型评分中排除。
- 尝试 2:证据无效,因为可见输出并非纯英文,且隔离的 T2 运行器未收到用户已授予的文件修改授权。整个批次已保留,但从比较评分中排除。
- 尝试 3:使用了全新的隔离工作区和会话,先前输出被隐藏,仅英语验证通过。这是有效的受控批次。

## 按任务保留的证据

- 完整的可见最终答案
- 原始 JSONL 事件流
- 经过清理的 CLI 警告
- 开始和结束时间戳
- 退出代码
- 源代码差异
- 公开验证输出和退出代码
- 适用的隐藏验证输出和退出代码
- 包含模型、耗时、提示词哈希、持续时间、使用情况及人工干预的运行记录

不可变的原始最终答案以 `final.md` 格式保留。其正文为英文,但 Codex 生成的可点击链接中包含本地父目录的中文名称。因此,每个任务还包含 `final-sanitized.md` 文件,该文件仅将特定于该机器的绝对前缀替换为 `./`,并通过了严格的 CJK 扫描。 对外公开的证据必须使用经过清理的显示版本;原始文件仍可供审计使用。

T5 GlobalGPT 的集成与编码评分是分开的,目前已完成。有关 CLI、MCP、技能、模型锁定、就绪状态和限制条件的证据,请参见 `results/T5/SUMMARY.md`。.

请勿将这些字段转换为五小时百分比、每周上限百分比、信用额度或 API 费用。实际消耗量会因模型、任务、上下文、推理、工具、检索和缓存等因素而有所不同。.

“审查与修复”任务是观察到的耗时最长的运行:496,865个输入令牌(其中包括419,072个缓存输入),产生了7,517个输出令牌和3,588个推理输出令牌。 对于该测试用例而言,这合乎情理,因为该任务需要进行全面检查、识别两个缺陷、修改代码以及验证。但这并不能证明代码审查总是成本最高的任务类别。.

那个“理解代码库”的答案简洁明了,且未修改任何文件,却仍处理了大量上下文信息。可见的输出长度并不能很好地反映代码库的工作量。该功能和 bug 修复也通过了测试,同时生成了不同的遥测数据。.

可以得出的有限结论是,任务形式会实质性地改变观测到的活动水平,即使是在一个小型数据集上也是如此。该样本无法预测剩余百分比或普遍比率。.

  • 可见答案的长度并未反映实际处理的仓库上下文量。.
  • 这项大规模的检查与维修工作产生了本阶段最庞大的遥测数据。.
  • 缓存的输入显示了重复使用情况,但未显示五小时的折扣百分比。.

五小时重置、每周上限以及后续情况

五小时重置和每周重置分别针对不同的限制条件。较短的重置周期可在账户级限制仍生效的情况下恢复短期访问权限。如果五小时已过但您仍受限,应首先检查每周重置情况,而非直接认定重置失败。.

OpenAI 文档 /status 作为当前 CLI 会话中的配额检查。账户页面可显示配额限制、重置时间、积分以及各模型的独立余额。这些字段具有时效性;其他用户的百分比并不代表您的预期容量。.

当工作被中断时,请保留差异记录、最新测试结果、剩余目标以及未解决的风险。检查当前生效的限制条件。在完成相关重置或评估积分后,恢复有价值的仓库工作;将演示文稿、备忘录和图片移至其他位置。.

  • 查看当前状态 并将短期窗口与每周上限区分开来。.
  • 保存一个干净的交接 包括已验证的状态、下一步操作以及剩余的检查项。.
  • 将无关的工作移出 这不需要代码库。.
  • 仅包含一个职业目标的简历 在进行相关重置之后。.
  • 明智地购买积分 只有在现在完成的情况下,这笔开支才算值得。.

此外,$100 还是 $200——哪一种方案更适合您的工作?

对于个人用户,当前的定价方案以 Plus 套餐为起点,每月费用为 $20。OpenAI 还列出了针对高使用量的 5x 和 20x 消费者套餐,每月费用分别为 $100 和 $200。 这些价格描述的是订阅层级;这些标签并不保证消息数量会达到特定数值(5倍或20倍),且不应将其转换为API令牌使用率。.

OpenAI Codex 消费者套餐定价,其中 Plus 及更高使用量档位已突出显示
消费者订阅价格应与购买的积分及 API 密钥计费分开比较。.
计划每月价格最佳初始拟合重新考虑的信号
$20偶尔或范围有限的编码代理工作重要工作经常因固有的限制而受到干扰
高使用率 5x 等级$100每天使用代理,且每次使用时间较长所包含的津贴仍然会打乱正常的工作日
高使用率 20x 等级$200个人使用频率极高实际使用记录证明选择最高消费档位是合理的

您应该先了解哪个订阅档位?

选择一种工作模式。这是一个规划提示,并非容量保证或盈亏平衡计算器。.

$20每月
Pro 5x$100每月
Pro 20x$200每月

从 Plus 开始。. 对于偶尔使用的情况,最低消费档次显然是最值得优先考虑的方案。实际带宽仍存在波动。.

发布前必须立即重新核对价格和套餐名称。API 使用情况与已购买的积分是分开计算的。.

请根据实际观察到的中断情况进行选择,而非基于假设的提示次数。从能够支持您日常仓库工作的最低层级开始。 跟踪限制措施阻碍重要工作进展的频率,评估这些会话的范围是否合理,以及时间窗口中有多少时间被用于本可在其他地方完成的工作。当代理程序的运行已成为工作日的一部分,且中断造成的损失超过价格差额时,选择更高级别就更容易得到合理化。.

更高的配额并不能解决工作流程过于冗长的的问题。应首先优化任务边界;如果经过妥善管理的工程工作仍达到上限,那么升级到更高使用层级的理由就更容易成立。.

积分和 API 计费是两码事

包含的流量、购买的积分以及 API 密钥计费是三种不同的计费方式。符合条件的 Plus 和 Pro 用户在用完包含的流量配额后,可以购买积分,系统会优先消耗包含的流量。 已购买的信用额度属于付费余额,并非更大的免费配额。OpenAI 规定,已购买的信用额度有效期为 12 个月,通常不可退款且不可转让,但法律另有规定的情况除外。.

路线适用情况账单关系
包含的订阅津贴符合条件的常规 Plus 或更高使用级别的 Codex 工作包含在月度消费者套餐中
已购买的积分符合条件的账户在计入使用量后仍可继续使用预付余额单独计算;包含的流量将优先消耗
API 密钥一位开发者调用了该 API 路由单独的按使用量计费 API 计费

这也是为什么不应将我们订阅测试中的令牌字段直接输入到 API 计算器中,并将其作为实际账单展示。这些测试并未形成 API 购买行为,且本文并未使用未经核实的当前令牌费率。 如果您使用 API 密钥,请根据当前官方 API 定价和您的实际 API 遥测数据来估算该路线的费用,并将其与消费者套餐分开计算。.

一种既能节省配额又不会降低代码质量的工作流

目标并非让Codex减少有用的工作,而是要在保留确保代理结果安全可用的验证机制的同时,消除“重新发现”、范围漂移和任务不匹配的问题。.

跑步前:确定一个目标

请说明该功能或缺陷的名称、受影响的区域、必须满足的约束条件,以及用于验证完成的检查项。若已知,请附上导致失败的命令或指定文件。删除过期的日志和无关的指令。选择能够安全处理歧义和风险的、最简化的模型。.

在[范围]内实现[单一结果]。遵守[约束条件]。成功标准为:[测试/检查]。仅检查必要的附加文件,运行相关的验证,并报告已更改的文件、结果及剩余风险。.

运行过程中:保持专注,不要走捷径

让Codex检查足够的上下文并运行有用的测试。当任务演变为与主题无关的清理工作、在没有新证据的情况下重复已失败的方法,或者缺乏确保正确性所需的产品决策时,应予以干预。.

运行结束后:保持可重用状态

检查差异和测试结果,然后保存已修改的内容、已通过的测试、待处理的内容以及需要人工审核的内容。在新的上下文中开始无关的工作。保存状态可以减少重置后的重复排查工作。.

从该已验证状态恢复:[摘要]。下一个目标是[下一步]。在进行任何更改之前,请重新检查当前的差异及相关测试。请勿将任务范围扩展至[范围]之外。.

简短并不一定意味着更便宜。一个含糊的提示往往能激发更多的探索,而一个详细但范围受限的简报则未必如此。最高效的提示既能提供足够的依据以确保正确起步,又能设定明确的验收标准以便适时停止。.

哪些作品应该收录在《Codex》中——哪些作品可以移至其他地方?

当任务依赖于代码库状态时,请使用 Codex:例如分析不熟悉的代码库、多文件实现、调试、测试、代码审查,以及需要生成差异报告的更改。这些工作流程能够通过在同一环境中访问文件、执行终端命令以及进行验证而受益。.

当问题与代码库无关时,请将工作转移。演示文稿制作、结构化文档、摘要编写、, 创建图像, ,以及一些 研究任务 通常需要内容输入和明确的输出格式,而非 shell 访问权限。将它们重定向到其他地方既能保留编码窗口,通常还能为用户提供更直观的界面。.

何时“Codex”窗口至关重要

将合适的工作(而非存储库工程)转移到受引导的浏览器代理上

任务最优路线为什么
对代码库的理解《Codex》或“Claude”代码需要直接参考代码库上下文,并基于具体文件进行推理。.
多文件实现《Codex》或“Claude”代码需要协调修改、差异对比和可执行测试。.
错误修复和代码审查编码代理 + 人工审核需要重现、修复和验证。.
引导式演示Yukie 是一个实用的选择已验证“专用幻灯片”的添加、大纲查看、模板以及导出功能。1.
结构化非代码简报Yukie 是一个实用的选择专门的文档工作流和决策检查表已通过验证。.
创建图像Yukie 是一款具备输出审查功能的实用型产品图片处理流程运行正常,但“图片加说明”的混合请求仅部分完成。.

此路由方案并未声称能精确节省Codex配额,也不将Yukie定位为存储库编码代理的替代方案。.

GlobalGPT 适合放在这里作为 多模型、多模态工作区. 它可以将写作、研究、图像、音频和视频通过为交付物选定的模型或引导式工作流进行处理。这扩展了工作环境;但它不会复制代码库编辑、终端控制或 Codex 的所有原生功能。 请将代码库保留在编码代理中,仅将那些可以安全移出的任务转移出去。当编码主机内部需要使用第二个模型时, GlobalGPT CLI 是相关的整合途径。.

从三项由Yukie指导的任务中我们学到了什么

我们针对三个浏览器工作流,仅使用首个有效结果进行了测试,并未为展示目的而重新运行结果不佳的测试。下文中的数字统计的是已完成的固定标准项;这些数字并非通用产品品质评分。.

工作流程已满足标准实际结果
幻灯片5/6演示文稿流程清晰;无法核实所请求的讲稿内容
文档6/6包含明显出口管制条款的完整结构化简报
图片及图注5/6该图片虽符合要求,但缺少所需的图注

幻灯片:明确的指导方针,一项未经核实的可交付成果

“幻灯片”工作流提供了专用入口、目的选择、可编辑的五张幻灯片大纲、六个命名模板、预览、版本历史记录、质量状态标签以及导出路径。它满足了六项固定标准中的五项。虽然要求提供讲者备注,但在最终的幻灯片集或界面中无法验证该功能,因此结果仍为“部分通过”。.

Y1 · Yukie 浏览器测试

带讲解的五张幻灯片演示文稿

5/6部分通过
  • 专用幻灯片条目的选择及其用途
  • 正好五张幻灯片和可编辑的大纲
  • 六个命名模板;使用了Minimal Tech
  • 所请求的结构已基本涵盖
  • ×已确认存在演讲者讲稿
  • 预览、版本历史记录和导出路径
虽然要求提供演讲者讲稿,但在最终的演示文稿或界面中无法核实。.

本回合可见使用量:55.31 积分。这并非货币转换。.

在Yukie网页界面中,引导式五张幻灯片演示的结果
查看确切的冻结提示
为独立开发者制作一份题为《更快发布产品,避免精疲力竭》的五张幻灯片演示文稿。受众是开发人工智能产品的独立开发者。 采用简洁的深色科技风格。内容应包括:1) 标题和核心承诺;2) 工作流中的三大瓶颈;3) 一套实用的每周工作体系;4) 简单的“前后对比”;5) 简明扼要的行动号召。确保每张幻灯片内容简洁易读,使用具体明确的语言,并附上讲稿注释。.
查看输出结果
 — 引导式五张幻灯片演示文稿

### 工作流证据

- Yukie 公开了一个专用的 `Slides /ppt` 入口点。
- 它解析了请求中的标题、受众以及五张幻灯片的数量。
- 它提供了多种目的选项:说服、告知、教育和激励。最终选择了“教育”。
- 在渲染前,它生成了一个可编辑的五张幻灯片大纲。
- 它提供了六种命名模板:专业、咨询、初创公司路演、数据报告、教育和极简科技。
- 系统推荐并采用了“极简科技”模板。

### 首个有效输出

生成的演示文稿包含恰好五张幻灯片:

1. 更快交付而不耗尽精力
2. 速度的三大隐形杀手
3. 您的每周交付节奏
4. 转型工作流程:改造前与改造后
5. 立即开始可持续交付

最终界面显示了 `3/3 已完成`、`5 张幻灯片 · 极简科技 · 16:9`、预览、版本历史、`质量报告通过` 以及一个导出控件。

### 限制条件

- 提示词明确要求包含讲者备注。最终的 DOM 和可见预览中既未显示可验证的讲者备注,也未显示“备注不可用”的提示信息。因此,该标准仍处于未验证状态,导致无法完全通过评估。
- 尽管选择了英语,但可见的内部推理内容却混杂了中文和英语。经检查,公开的幻灯片内容为英语。
- 界面自身的“质量报告通过”标签是产品状态信号,而非独立的编辑评分。

### 证据

- 已发布的证据图片:`https://static.futureshareai.com/glb_features/Y1-slides-status-v2.webp`
- 最终页面已在 Chrome 中作为交付成果保留下来。.

其优势在于呈现工作流更加清晰,而非声称编码代理的推理能力更强。用户仍然需要选择目的和模板,且交付成果仍需进行核查。.

文档:路由最优的任务

“文档工作流”是将工作转移到 Codex 之外的最佳选择。它生成了所需的四种任务类型——价值、风险、证据和人工审核指南,并标注了假设条件,提供了决策检查表,以及可见的下载、打开、导出和版本历史记录控制功能。.

Y2 · Yukie 浏览器测试

结构化编码代理研究简报

6/6通过
  • 专用文档工作流
  • 所请求的全部四种任务类型
  • 价值、风险、证据及人工审核指南
  • 已标注的假设
  • 包含决策检查清单
  • 下载、打开、导出和版本历史记录
第一个有效结果满足了所有已锁定的成功标准。.

可见使用量:显示为 55.31 积分。这并非货币转换。.

Yukie 网页界面中结构化编码代理研究简报的结果
查看确切的冻结提示
撰写一份题为《独立开发者何时应使用编码代理?》的简明研究简报。读者是一名时间和预算均有限的独立开发者。 请对比四种任务类型:陌生代码库分析、多文件功能开发、错误修复以及代码审查。针对每种任务类型,说明其预期价值、主要风险、用户应要求提供的证据,以及何时必须由人工进行审查。最后附上一份决策检查清单。请明确标注所有假设,切勿捏造统计数据或来源。.
查看输出结果
 — 结构化研究文档

### 工作流证据

- Yukie 提供了一个专用的 `Document /doc` 入口点。
- 它执行了自动研究/搜索阶段,并呈现了大纲供确认。
- 该工作流在生成文档前需要进行“生成”确认。

### 首个有效输出

该文档包含:

- 假设
- 建议摘要
- 一项任务对比,涵盖陌生代码库分析、多文件功能开发、错误修复和代码审查
- 每项任务的预期价值、主要风险、需收集的证据以及人工审查指南
- 关于在不超支情况下使用编码代理的指导
- 决策检查表
- 结论部分

最终界面显示了“下载”、“打开”、“导出”、“版本历史”以及一个只读共享控件。共享功能保持关闭状态。

### 局限性

- 该文档在生成前需要点击确认,因此工作流属于引导式,而非完全一次性无人值守。
- 在审查的输出结果中未发现任何缺乏依据的数值主张。

### 证据

- 已发布的证据图片:`https://static.futureshareai.com/glb_features/Y2-document-result.webp`
- 最终页面已在 Chrome 中保存为可交付成果。.

即使一份简报必须引用存储库的行为,仍需提供存储库的证据。基于已提供需求编写的独立备忘录,可以利用引导式大纲和导出流程,而无需占用编码窗口。.

图片及说明:图像通过了,数据包未通过

该图像工作流推荐了一个图像模型,并提供了针对特定格式的控制选项。第一个有效的正方形结果采用了要求的深蓝色背景、青色点缀、60:00计时器图案以及完全一致的标题。但该结果未提供要求的60至90个单词的图片说明和行动号召,因此该综合任务在六项标准中满足了五项。.

Y3 · Yukie 浏览器测试

FocusDock 方形视觉元素及配套文字说明

5/6部分失败
  • 专用的图像处理工作流和可编辑的提示词
  • 1:1 视图
  • 海军蓝、青色、计时器和精确标题
  • ×要求配文60–90个单词
  • 没有真实客户的声明,也没有杜撰的统计数据
  • 可见的调整路径
该图片符合视觉要求,但未提供要求的60至90个单词的图片说明和行动号召。.

可见使用量:生成前显示为 320 个积分。这并非货币转换。.

FocusDock 在 Yukie 网页界面中显示的方形视觉效果及对应的说明文字
查看确切的冻结提示
为一款名为“FocusDock”的虚构效率应用设计一张方形社交媒体图片及配套文案。 视觉素材应采用海军蓝背景,搭配一种青色点缀色,包含简单的计时器图案,并配有标题“一项任务。一小时。搞定。”文案应为60至90个单词,面向独立开发者,并包含一个明确的行动号召。请勿使用商标、真实用户的评价或虚构的性能数据。.
查看输出结果
 — 多模态社交资产

### 工作流证据

- Yukie 提供了一个专用的 `Image /paint` 入口点。
- 它将请求重写为可编辑的图像生成提示词。
- 它推荐使用 GPT Image 2 进行排版。
- 生成前,模型和参数步骤显示了 GPT Image 2、1:1、2K 以及 320 个积分。

### 首个有效输出

生成的正方形图像中明显包含:

- 海军蓝背景
- 青色点缀
- 显示 `60:00` 的计时器图案
- 确切的标题 `一项任务。一小时。完成。`
- 没有明显的真实客户声明或虚构的性能统计数据

最终界面显示了 `根据此图像生成视频` 和 `调整图像` 控件。

### 保留失败结果

最终任务输出中未提供匹配的 60–90 词说明文字。最终 DOM 中与说明文字相关的唯一内容是用户最初的请求。未提交任何纠正性后续内容,因为后续操作属于人工干预,且既不会替换第一个有效结果,也不会替换其失败结果。

### 证据

- 已发布的证据图片:`https://static.futureshareai.com/glb_features/Y3-image-result.webp`
- 实时最终页面已作为交付成果保存在 Chrome 中。.

综合来看,这三项测试得出的结论较为有限:引导式提交可以减少非代码交付物的配置阻力,但这种引导并不能免除对每个请求输出进行验证的必要性。这些测试结果并不支持无限次调用 Yukie、将显示的积分转换为金钱,或将其视为代码仓库工程的替代方案。.

《法典》实用应用决策检查表

  1. 该任务是否需要代码库、Shell、diff 或测试? 如果是,请将其保存在Codex或其他编码工具中。.
  2. 目标函数是有界的吗? 在开始长时间运行之前,请先定义一个结果以及用于验证该结果的检查项。.
  3. 这项任务需要最严谨的推理吗? 在风险和不确定性允许的情况下,应采用更简化的模型。.
  4. 哪个限额生效? 将“五小时时段”、“每周上限”、“积分”和“API计费”分开处理。.
  5. 该作品能否安全地离开编码环境? 将演示文稿、独立文档、媒体文件以及其他非存储库任务分配给合适的模型或引导式工作流。.

当范围界定明确的代码库工作能持续创造价值时,应进行升级;而当中断造成的成本高于计划偏差时,则应限制中断。如果工作时间被耗费在广泛的重新探索、无关的交付物,或是本可在运行前就解决的反复澄清上,则应首先调整工作流程。.

《法典》使用常见问题解答

Codex 是否每五小时重置一次?

共享的短期配额窗口以五小时为周期重置,但可能仍受每周额外限额的限制。因此,五小时的重置并不能保证所有账户限制都会解除。.

我能获得多少个Codex提示?

目前尚无单一可靠的提示词计数标准。OpenAI 按模型发布了大致的估算值,而实际消耗量会因上下文、推理、工具、检索、缓存以及任务复杂度等因素而有所变化。.

为什么五小时后我仍然会受到限制?

可能还存在另一项每周配额限制。请查看当前账户使用情况视图或在活动会话中查阅已记录的配额信息,而非仅依赖短周期重置。.

如何在命令行界面(CLI)中查看 Codex 的使用情况?

OpenAI 文档 /status 用于在活动的 Codex CLI 会话中查看配额信息。其显示内容取决于当前的身份验证和账户状态。.

Plus 套餐或更高使用量的套餐中是否包含 Codex API 费用?

不。API密钥的使用量与用户订阅配额分开计费。.

我可以购买更多的Codex使用次数吗?

符合条件的用户在用完包含的流量后可购买流量。购买前请查看当前账户页面,了解可用情况及相关条款。.

缓存的输入令牌会显示我节省了多少订阅配额吗?

不。缓存输入遥测数据无法可靠地转换为五小时百分比、每周百分比、积分金额或 API 账单金额。.

由纪惠是无限的吗?

我们未发现任何可靠证据支持这一说法。请将Yukie视为适用于非代码库任务的推荐选项,而非经过验证的、可无限替代代码的工具。.

官方限额、价格和信用条款已于2026年7月29日核对。这些信息可能会发生变化,因此在做出购买决定前,请核实当前的OpenAI页面内容。.

请将代码库相关工作保存在 Codex 中。对于下一份演示文稿、研究简报或无需使用您的代码库的多模态资源,, 开盘 GlobalGPT 并选择针对该任务构建的模型或 Yukie 引导式工作流。.

分享帖子:

相关帖子