AREX Feed Article
Brockman 公布 Codex 报税试点:7,000 份申报,准备时间缩短约三分之一
OpenAI 总裁兼联合创始人 Greg Brockman 2026 年 8 月 20 日上午在 X 上发推宣布,一项基于 Codex 的税务申报试点处理了 7,000 份申报表,并将准备时间缩短约三分之一。只有两句话:「codex can power much more than coding tools: a tax-prep pilot processed 7,000 returns and cut preparation time by about a third. you can build your own products on our codex open-source harness:」即 Codex 能驱动的远不止编码工具,开发者可以在 Codex 的开源 harness 上构建自己的产品。
推文发布于 UTC 时间 2026 年 8 月 20 日 01:15,即北京时间 09:15。截至本文写作时,它获得约 700 次点赞、27 次转发、60 条回复和接近 8 万次浏览。试点由谁运营、覆盖哪些税表、「三分之一」如何统计,推文都没有交代。就本文可核对的材料而言,这些数字只有 Brockman 推文一个来源,推文没有附带试点报告或数据文档。
7,000 份申报与「约三分之一」
Brockman 的 X 账号简介为「President & Co-Founder @OpenAI」,这条推文是 OpenAI 高管本人的公开表态。推文把项目称为「a tax-prep pilot」,但运营主体、运行时段、申报类型、人工复核比例和错误率都没有出现,量化信息只有 7,000 份与「约三分之一」两组。
开源 harness 是什么,能拿来建什么
与「开源 harness」对应的是 GitHub 上的 openai/codex 仓库:自述为「Lightweight coding agent that runs in your terminal」(跑在终端里的轻量编码 agent),采用 Apache 2.0 许可,2025 年 4 月创建,现有约 10.7 万 star。 说明 Codex CLI 是 OpenAI 出品的本地编码 agent,可以登录 ChatGPT 账号使用。
OpenAI 维护者 etraut-openai 今年 1 月在回应社区时写道:核心 harness 开发全部在开源进行,代码以宽松的 Apache 许可发布;团队同时投资 non-interactive 模式和应用服务器 API 等扩展机制,让开发者可以在核心 harness 之上构建新体验。这正是 Brockman 说的「build your own products」所指的底座。
OpenAI 在 2 月 11 日发布的里展示了「harness」的具体用法:技术成员 Ryan Lopopolo 记录团队用 5 个月构建一个内部产品,全程 0 行手写代码,估计耗时约为手写方式的十分之一,最终仓库约一百万行代码、1,500 个 PR,最初只有 3 名工程师驱动。文章把分工概括为「Humans steer. Agents execute.」(人掌舵,agent 执行)。
中文用户 在 Brockman 推文下回复:「开源harness这点很关键,等于把底座给我们了,想怎么接都行。」
处理 7,000 份之后,从业者追问边界
回复区里出现了几组具体的技术追问。 在推文发布约一分钟后提问:Codex 是生成确定性代码来运行申报逻辑,还是在上下文里直接处理税务计算?
ModernTaxio 创始人兼 CEO 追问审计、修正、延期申报和长尾税务问题,说「Seriously curious」。另一位用户 关心歧义处理:「curious how it handles ambiguity like missing forms or vague client answers」(缺少表格、客户回答含糊时怎么办)。
也有从业者把报税看成通用模式的验证。BAM AI 创始人 说他用 agent harness 处理保险理赔,模式一致:「Document-heavy back office is the killer app here. The time cut is nice, the bigger unlock is that every edge case the harness learns becomes a permanent asset instead of tribal knowledge in one preparer's head.」(文档密集的后台是杀手级场景;时间缩短固然好,更大的解锁在于 harness 学会的每个边界案例都变成永久资产,而不是某位报税员脑子里的隐性知识。)
的评论把判断推得更远:如果产品各自掌控上下文、工具和审批,由 harness 负责执行,「Codex starts looking much more like general agent infrastructure than a coding tool」,即 Codex 越来越像通用 agent 基础设施,而非编码工具。
从读小字到报税:Codex 的「非编码」推销线
报税试点不是 Brockman 第一次把 Codex 带出编程场景。8 月 9 日他「Codex for saving money by reading the fine print:」,8 月 14 日又「chatgpt for saving you money」。近两周内,他连续用「读小字」「省钱」这类编码之外的用例做展示。区别在于:前两条是 Codex 和 ChatGPT 各自功能的演示,报税推文则直接邀请第三方在开源 harness 上自建产品。
试点的运营方、方法与准确率,仍未披露
把推文和回复放在一起,7,000 份与「约三分之一」之外的关键信息全部悬空:试点运营方、申报覆盖的国家与税表、人工介入程度、出错率、统计口径,Brockman 一项都没有给出。Parker 问的审计、修正与延期,GoNoGo 问的「代码还是上下文」,都落在推文没有覆盖的部分。整条推文的后半句在邀请开发者在开源 harness 上自建产品,前半句的试点数字却没有任何材料可供核对。