🎯 科技 · AI开源
一、OpenAI开源Codex Harness,引擎直接开放🔥 核心观点:OpenAI开源Codex Harness,DeepSeek持续推动开源生态,AI评测基准从"黑盒比拼"走向"透明可复现"
2026年8月20日,OpenAI正式宣布开源Codex Harness,这是其旗舰编程助手Codex背后的核心执行框架,以Apache-2.0许可证开放。该框架包含codex exec命令行工具、官方TypeScript/Python SDK以及app-server(JSON-RPC协议),涵盖了AI智能体的任务理解、上下文管理、工具调用、中断恢复和人机协同审批等完整执行链。这并非"代码首次公开"——底层Rust核心codex-rs自2025年4月起就已存在于GitHub仓库,但此次OpenAI首次正式承诺对第三方开发者提供支持,意味着企业可以基于同一套引擎构建自己的AI应用。
最值得关注的性能数据:仅通过Harness层面的优化(保留推理链+上下文压缩),GPT-5.6 Sol模型在ARC-AGI-3基准测试上的得分从13.3%跃升至38.3%,同时将输出Token消耗降低了六倍。Cisco和Thrive Holdings等已率先部署基于该Harness定制的内部AI Agent。
二、DeepSeek开源路线:模型开放,生态共赢与OpenAI开放执行引擎的路径不同,DeepSeek的开源策略更聚焦于模型本身。自2025年DeepSeek-V2发布以来,DeepSeek持续推动大模型开源化,其V4系列预览版同步开源的消息已引发业界广泛关注。DeepSeek的商业模式核心是"低成本+高可用"——API调用毛利率高达82.9%,远超OpenAI的39%和Anthropic的40%,这意味着其开源模型具备更强的商业可持续性。
值得注意的是,DeepSeek在开源社区的影响力与日俱增。合肥"词元世界"AI服务平台上线后,已聚合DeepSeek、通义千问、智谱等200余款主流大模型,用户一个账号即可通过统一API调用不同模型,大幅降低了企业接入门槛。
三、开源Harness的意义:让AI评测不再"各说各话"过去,大模型性能比拼常常陷入"各出各题、各算各分"的困局。OpenAI开源Codex Harness和DeepSeek持续开源模型权重,共同推动了一个趋势:AI评测基准正在从黑盒走向透明。开发者可以基于同一套Harness复现benchmark结果,企业可以基于开源框架自建评估体系,而不再依赖单一厂商的排名数据。
AI的终局竞争不是谁闭源更久,而是谁的生态更开放。OpenAI和DeepSeek选择了同一条路的不同分支,但目标一致:让开源成为AI行业的基础设施。
综合开源中国、澎湃新闻、广州日报报道 | 2026年8月30日