史上最强编程模型Claude 5泄露,最慌的是黄仁勋?

客服微996438436个月前财经知识83

_史上最强编程模型Claude 5泄露,最慌的是黄仁勋?_史上最强编程模型Claude 5泄露,最慌的是黄仁勋?

2月2日,X上一位的知名AI博主Pankaj Kumar (@pankajkumar_dev),爆料了Anthropic的下一代旗舰模型Claude Sonnet 5。

史上最强编程模型Claude 5泄露,最慌的是黄仁勋?_史上最强编程模型Claude 5泄露,最慌的是黄仁勋?_

这个模型代号为“Fennec”,可能在明天或者后天就要正式发布了。

事情的起因是Google Vertex AI的一条错误日志。

有人在调用API时发现了一个奇怪的模型ID:claude-sonnet-5@20260203。这个模型的日期指向了2026年2月3日。

虽然访问这个ID会返回404错误,但这也足以说明模型已经存在于 Google 的基础设施里,只是还没有激活。

泄露的资料显示,Claude Sonnet 5在性能上要比当前的Claude Opus 4.5更强,但价格却便宜了一半。这是因为Claude Sonnet 5是在Google的TPU上训练和优化的,所以其推理成本大幅降低。

Claude最让人在意的地方就是其编程能力

内部测试数据显示,Claude Sonnet 5在SWE-Bench上的得分超过了 80.9%。意味着它能独立完成大部分软件工程师日常会遇到的问题。

更有意思的是一个叫“Dev Team”模式的功能。

你给它一个需求简报,它会自动生成多个专门的子代理,分别负责后端开发、质量保证、需求研究等不同角色,然后这些代理在后台并行工作,像一个真实的开发团队那样协作完成整个功能。

这不再是简单的代码生成工具,而是在模拟整个软件开发流程。

Claude Sonnet 5保留了100万tokens的上下文窗口,而且运行速度提升。对于需要处理大量代码库或长文档的用户来说,这个更新是非常必要的。

现在用户可以把整个项目的代码都塞进Claude Sonnet 5里,让它理解全局再做修改。

_史上最强编程模型Claude 5泄露,最慌的是黄仁勋?_史上最强编程模型Claude 5泄露,最慌的是黄仁勋?

Claude Sonnet 5发布的时间节点也非常有意思,正好和OpenAI的Codex发布月撞车。

CodeX是一个能够独立完成长达24小时任务的自主软件工程agent。它可以处理多步骤重构、测试驱动迭代和自主调试,甚至在测试阶段发现了React框架中三个此前未知的零日漏洞。

除此以外,OpenAI还在这几天发布了Prism。

这是一个专门为科学研究设计的AI工作空间,把GPT-5.2直接嵌入到LaTeX编辑环境里。研究人员可以在一个界面里完成论文撰写、文献检索、公式编辑和实时协作,不用再在多个工具之间来回切换。

而科学和代码正是Claude的强项,Anthropic选择在此时间点发布模型,无疑是想和OpenAI进行正面较量。

Anthropic在资本市场上的动作也很激进。1月底,公司完成了一轮超过100亿美元的融资,估值达到3500 亿美元。

这轮融资的规模最终可能达到200亿美元,超过了最初计划的100亿。

根据Menlo Ventures在2025年Q4的统计,Anthropic现在占据了企业LLM支出的40%,超过了OpenAI的27%和谷歌的21%。

公司85%的收入来自企业客户,这个结构更健康稳定。

公司CEO达里奥·阿莫迪曾经表示,Anthropic过去三年,收入每年10倍增长。2023年从1亿美元,2024年10亿,2025年会在80到100亿之间。

不仅如此,Anthropic的开发者工具Claude Code在开放半年后,其年化收入就实现了突破10亿美元。

但高速增长的另一面是持续烧钱。Anthropic最近把实现正现金流的时间从2027年推迟到了2028年。

阿莫迪预计2026年会花掉大约120亿美元用于模型训练,另外70亿美元用于运行这些模型。

与此同时,Anthropic把2025年的毛利率预期从50%下调到了40%。

但是相对的,阿莫迪预计Anthropic在2026年的收入会达到180亿美元,2027年达到550亿美元。

如果这个增长能实现,到2028年单位成本会因为规模效应而下降,那时候才有可能实现盈利。

Anthropic的效率比OpenAI要快。后者预计要到2029年或更晚才能盈利。

Anthropic还表示,将自建约100万颗谷歌TPU v7芯片。英伟达最想吃下的客户之一,现已加入谷歌阵营。

同一时间,Anthropic已经聘请了律师事务所Wilson Sonsini为IPO做准备,时间定在了2026年的下半年。

相关文章

Meta"分割一切"模型强势升级!"听懂人话",处理含上百物体一张图仅需30毫秒

Meta"分割一切"模型强势升级!"听懂人话",处理含上百物体一张图仅需30毫秒

美东时间19日周三,Meta发布第三代"分割一切"模型Segment Anything Models(SAM)——SAM 3,实现了重大突破,首次支持用户通过自然语言描述和图像示例来识别、分割和追踪视...

OpenAI发布GPT-5.4 mini与nano,以更低成本逼近旗舰模型性能

OpenAI发布GPT-5.4 mini与nano,以更低成本逼近旗舰模型性能

OpenAI周二推出旗下迄今能力最强的两款小型模型GPT-5.4 mini与GPT-5.4 nano,以更低延迟和更低成本大幅缩小与旗舰模型的性能差距。 GPT-5.4 mini在编程、推理、多模态理...

谷歌Gemini 3模型获市场认可,Alphabet股价一度大涨超6%创新高

谷歌Gemini 3模型获市场认可,Alphabet股价一度大涨超6%创新高

Alphabet股价周三飙升5%,投资者看好谷歌最新发布的Gemini 3人工智能模型带来的竞争优势。 周二华尔街见闻提及,谷歌正式发布备受期待的AI模型Gemini 3,并于发布首日立即在谷歌搜索、...

营收增近50%却亏11亿元,昆仑万维钱花哪了

营收增近50%却亏11亿元,昆仑万维钱花哪了

营收持续增长,海外市场高歌猛进,AI模型密集迭代,商业化路径逐渐清晰——昆仑万维2025年上半年的成绩单,看起来充满进取的节奏感。 其最新半年报显示,公司上半年实现营收37.33亿元,同比增长49.2...

M1“超长记忆”吊打R1,MiniMax的好日子来了?

M1“超长记忆”吊打R1,MiniMax的好日子来了?

MiniMax 四处突围,终于撞上了自己的「好日子」。 昨天凌晨,MiniMax正式开源它们的第一个推理模型M1,这款模型虽然在各项基准测试中表现「相貌平平」,却拥有业界最长的上下文能力:100万t...

报道称马斯克旗下xAI按2000亿美元估值融资100亿美元,马斯克否认

报道称马斯克旗下xAI按2000亿美元估值融资100亿美元,马斯克否认

当地时间周五,据CNBC援引知情人士透露,马斯克的xAI正在从投资者那里筹集100亿美元,本轮融资对这家人工智能初创公司的估值达到2000亿美元。此次融资是在马斯克筹集100亿美元债务和股权后的几周内...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。
客服微信:BT86616点击复制并跳转微信