会懂网AI资讯获悉,OpenAI正式推出GPT-5.3-Codex,宣称其为迄今能力最强的智能体编程模型。该模型整合前沿编程能力与推理、专业知识能力,运行速度较前代提升25%,并用更少Token完成相同任务。模型已向付费ChatGPT用户开放,覆盖Codex应用、命令行界面、IDE扩展和网页端。

基准测试方面,GPT-5.3-Codex在SWE-Bench Pro取得56.8%,较前代的56.4%小幅提升;在Terminal-Bench 2.0取得77.3%,较前代的64.0%大幅跃升;在OSWorld-Verified桌面智能体任务上取得64.7%,较前代的38.2%提升了26.5个百分点。模型还支持用户在长时任务运行中随时插入指令纠偏的”中途转向”机制,提供频繁的进度更新,让开发者能在任务中途提问、调整或重定向。
值得关注的是,该模型是OpenAI首个在自身创建过程中发挥关键作用的模型——Codex团队曾使用其早期版本调试训练过程、管理部署与评估结果。OpenAI还同步发布了轻量级伙伴模型GPT-5.3-Codex-Spark,以每秒超1000 Token的速度提供近乎即时的响应,形成”重量级复杂推理+轻量级快速迭代”的双轨策略。
业内分析认为,GPT-5.3-Codex的发布,标志着AI编程助手正从”代码补全”转向覆盖软件全生命周期的自主智能体。同时OpenAI强调对破坏性操作的防范,相关评测得分从0.76提升至0.88,提示行业在推进自主编程智能体的同时,必须同步构建安全治理机制,让AI编程既高效又可靠。





























暂无评论内容