据综合彭博、CNBC及VentureBeat报道,OpenAI近日推出全新大型语言模型(LLM)GPT-5.5,同时发布了专为企业团队设计的工作区代理(Workspace Agents),旨在与Anthropic展开企业客户市场的竞争。
OpenAI共同创始人兼总裁Greg Brockman表示,GPT-5.5能够自主判断不明确问题的下一步操作,用户体验更加直观。在Terminal-Bench 2.0代理式编码基准测试中,GPT-5.5的准确率达到82.7%,超越了Anthropic Claude Opus 4.7的69.4%。而在OSWorld-Verified操作系统基准测试中,GPT-5.5的准确率也达到了78.7%。
然而,在纯学术推理测试Humanity's Last Exam(无工具版)中,GPT-5.5 Pro仅获得43.1%的分数,明显落后于Claude Opus 4.7的46.9%以及预览版Mythos的56.8%。这表明OpenAI在零样本学术知识领域仍与Anthropic存在差距。
在性能优化方面,GPT-5.5通过部署在NVIDIA GB200及GB300 NVL72系统上,利用AI自动生成的算法优化了GPU任务分配,使得token生成速度提升了20%以上。
网络安全是外界关注OpenAI与Anthropic竞争的重要领域。Anthropic的Claude Mythos具备强大的系统漏洞扫描能力,但近期发生了未授权访问事件。相比之下,GPT-5.5在OpenAI的风险预备架构中被评为高风险等级(High),但未达到关键风险等级(Critical)。针对网络安全相关的高级使用场景,OpenAI采取了分层处理策略。
GPT-5.5现已向ChatGPT Plus、Pro、Business及Enterprise用户开放,但网络安全能力的“解锁程度”因用户身份而异。负责关键基础设施的合法网络安全人员可通过“网络安全的受信任访问计划”(Trusted Access for Cyber)申请使用更宽松版本的GPT-5.5。
应用程序接口(API)服务预计将在稍后推出,届时标准版定价为每百万token输入5美元、输出30美元。
OpenAI的工作区代理直接对标Anthropic的Claude Managed Agents,同时与微软的Copilot Studio、Google的Agentspace及Salesforce的Agentforce展开竞争。工作区代理是Custom GPTs的升级版,由云端Codex引擎驱动,可在用户离线时持续执行工作流程,并整合Slack、Salesforce、Google Drive等90多种企业工具。
人力资源平台Rippling的AI工程主管Ankur Bhatt表示,OpenAI的工作区代理让非工程背景的销售顾问也能独立构建完整的自动化流程,从而全面自动化原本每周耗费5~6小时的人工作业。
工作区代理目前以研究预览形式开放给Business、Enterprise、Edu及Teachers方案用户,并免费提供至5月6日,之后将改为按积分计费。
据业内人士透露,OpenAI和Anthropic预计最快将在2026年内推动IPO,资本市场压力下,两家公司在企业客户市场的竞争将持续加剧。