近日,OpenAI发布了其最新模型GPT-6 Astra,宣称其为“全球最智能的模型”。该模型在多个领域的测试中表现优异,超越了前一代GPT-5.6,并在一些指标上超过了竞争对手Claude。Astra在FrontierMath Tier 4获得了97.6%的高分,ARC-AGI-3的最高得分达到99.9%,而在ExploitBench中更是完美达到了100%。在独立评测中,截至9月7日,Astra与Claude Fable 5.1并列第一。
此次发布被视为OpenAI与Anthropic之间竞争的关键时刻。自2020年底,OpenAI的一位副总裁Dario Amodei带领多个团队成员离开并成立Anthropic后,这两家公司之间的竞争便开始显现。最初,Anthropic更加侧重于追赶者的角色,但近一年局势发生逆转。Anthropic通过模型能力的提升、Claude Code的推出以及云渠道的拓展,实现了商业化的成功。
到今年5月,Anthropic的新融资估值已达9650亿美元,超过OpenAI同期的8520亿美元,成为独立大模型领域中的佼佼者。在中国,业界也开始关注“谁是中国的Anthropic”这一问题。
而OpenAI依靠GPT-6 Astra打回一城,但能否顺利抢占市场依然存在疑问。OpenAI虽在能力上实现了追赶,但其在Benchmark竞争中已失去了一部分领先地位。自GPT-4以来,OpenAI一直捍卫着模型能力和用户的优势,但到了2024年,这种关系开始显得脆弱。
Claude 3 Opus首次在Benchmark上对GPT-4发起挑战,后续的Claude 3.5 Sonnet在编码能力方面也跻身行业前列。在2025年推出的Claude Code则极大改变了竞争格局。随着企业在生成式AI上的支出大幅增长,Coding成为了市场上商业化最成熟的领域。
根据风险投资机构Menlo Ventures的估算,2025年企业在生成式AI上的支出将达到370亿美元,其中国内Coding支出达到40亿美元。而在相关市场份额中,Anthropic的上升幅度显著,达到54%,而OpenAI降至21%。真实的市场采购数据也显示,Anthropic在美国企业客户中的付费比例稍微领先于OpenAI。
财务数据的变化也反映出类似的趋势:截至7月底,Anthropic的年化收入运行率超过650亿美元,而OpenAI为400亿美元。尽管两者在统计口径上存在差异,但仍显示出Anthropic在收入方面的显著优势。
目前,OpenAI正在向Anthropic展开反攻,定位Astra为处理复杂任务的模型,强调其在编程、软件使用和专业工作等方面的能力。Astra的发布并非偶然,OpenAI今年加快了企业业务的布局,推出了多个相关产品,切入Anthropic构建的商业优势领域。