AREX Feed Article
一条财报电话炸穿 benchmark 信仰:Nemotron Ultra 裸跑超越 Frontier
93% 增速、155% Rule of 40,盘后暴涨 15%
Palantir 在 8 月 3 日盘后交出了一份被 CEO Alex Karp 称为"otherworldly"的 Q2 FY2026 成绩单。总营收 19.35 亿美元,同比增长 93%,超出华尔街一致预期约 7 个百分点。美国商业收入 7.64 亿美元,同比增长 149%,环比增长 28%。美国政府收入 8.09 亿美元,同比增长 90%。调整后运营利润 11.94 亿美元,利润率 62%;GAAP 净利润 10.62 亿美元,利润率 55%。Rule of 40 冲到 155%,在软件行业几乎找不到对手。
全年营收指引上调至 81.5-81.6 亿美元,美国商业收入指引调至 34.2 亿美元以上。
PLTR 在 2026 年前七个月累计下跌约 29-30%,交易在 ~125 美元附近。财报发布后,盘后股价跳涨 12-15%,冲至 142-145 美元区间。即便如此,按盘后价格计算的前瞻市盈率仍在 77 倍左右。市场已经把多年的完美执行贴现进去了。
但数字本身不是这篇报道要讲的故事。真正的引爆点藏在 CTO Shyam Sankar 的 QA 环节里。
五个客户任务到底赢在哪?
财报电话会上,Sankar 说了一段话,在 X 上被独立账号 @jawwwn_ 剪辑发布后,48 小时内获得超过 25.8 万次浏览、754 次点赞和 226 次收藏。Sankar 本人也转发了这条推文。
这段话的核心信息是:Palantir 团队把 NVIDIA 的 Nemotron 3 Ultra 模型,不做任何微调,不做任何 post-training,就是原原本本的 vanilla 版本,部署进自己的技术栈。24 小时内,它在 5 个客户生产任务上击败了所有 frontier 模型。
Sankar 的原话:"I literally almost felt gaslit when, within 24 hours of getting Nemotron up with no post-training, this is vanilla Nemotron Ultra, it did better than frontier."
他还补了一刀:"If you just looked at the numbers, you would say, 'It's nowhere near the Frontier. That shouldn't even be possible.' But of course, the benchmarks are wrong. I mean, the benchmarks are right for what the benchmark's measuring, but that's not my business. Those are not the tasks my customers had that they were trying to solve."
这番话立即引爆了争议。一派认为这证明了开源模型在真实企业场景中的竞争力被系统性低估。另一派指出,Nemotron Ultra 之所以能赢,很可能不是因为裸模型更强,而是因为 Palantir 的 Ontology 数据层和 RAG 管线在喂给模型时就已经完成了最难的认知工作。Sankar 自己在此前也多次说过"token minn-ing"(挖矿式堆 token)不是正确的游戏,真正的壁垒是拥有"别人没有的数据和逻辑"。
Hugging Face CEO Clément Delangue 转发了这条视频。NVIDIA 应用深度学习研究 VP Bryan Catanzaro 此前也多次为 Nemotron 开源路线站台,称其为"被低估的模型"。社区投资者和分析师则迅速将这条引用写进了对 PLTR 的做多逻辑。Sankar 的"gaslit"一词成了当天加密群和投资 Discord 里被引用最多的 meme。
值得注意的是,Sankar 并没有说 Nemotron 在所有任务上都赢了。他说的是"5 个客户生产任务",是 Palantir 自己的客户群体、自己的任务定义、自己的评估标准。这恰恰是他想表达的论点:benchmark 的"前沿"和客户的"前沿"是两个完全不同的坐标系。
开源模型的"主权时刻"
Sankar 的这组实验数据,时间点上打在 AI 行业的一个敏感神经上。
就在 Palantir 发布财报的同一天,关于 SpaceX 91,150 万股即将解锁的消息也在市场上发酵。更宏观的背景是:2026 年上半年,闭源 frontier 模型厂商,包括 OpenAI 和 Anthropic,正在面临来自开源阵营的空前压力。Google 的 Gemma、Meta 的 Llama 4、Mistral、DeepSeek、Kimi K2.6、Qwen 3.5,以及 NVIDIA 自己的 Nemotron 3 系列,在多个 benchmark 上已经追平甚至反超。价格战也在同步进行。frontier lab 们开始大幅降价以应对开源模型的竞争。
但 Sankar 的发言把竞争从"谁的 benchmark 分高"升级到了"谁在客户真实任务里管用"。Palantir 的 AI 平台策略,即所谓的"AI sovereignty",核心卖点就是模型无关(model-agnostic):客户应该拥有自己的数据、逻辑和安全边界,模型是可以随时替换的组件。如果 Nemotron Ultra 裸跑就能赢,那意味着企业客户在模型选择上的议价权和自由度比闭源厂商愿意承认的大得多。
竞争对手的反应目前以沉默和间接回应为主。Anthropic 和 OpenAI 尚未直接评论 Sankar 的发言。但 Palantir 的投资人社区已经在主动做对比。一位 Palantir 社区知名账号 @PLTRs_Palantir 在 NVIDIA 推文下贴了一张 meme 图,配文暗示 Palantir 在与 NVIDIA 的深度绑定中已经拿到了"制胜配方"。
"我几乎觉得自己被 gaslight 了"
Palantir CTO Shyam Sankar 在 8 月 3 日的 Q2 FY2026 财报电话会上说了一句话,直接炸穿了 AI 行业关于 benchmark 的集体信仰。
他说,Palantir 团队拿到 NVIDIA 的 Nemotron 3 Ultra 模型后,没有做任何 post-training,就是原原本本的 vanilla 版本,部署进自家平台。24 小时内,它在 5 个客户生产任务上,成绩超过了所有 frontier 模型。
Sankar 用了一个很重的词:gaslit。"我几乎觉得自己被 gaslight 了。"一个在公开 benchmark 上排名并不靠前的开源模型,到了真实客户场景里,居然把那些在 leaderboard 上遥遥领先的闭源前沿模型全部超了。
对 Sankar 来说,这不是魔法。这是因为他一直在用客户的尺子量模型,而不是用 benchmark 的尺子。
NVIDIA 亲自道谢,黄仁勋放话"最重要的企业级技术栈"
8 月 5 日,NVIDIA 官方账号在 X 上发帖,公开感谢 Sankar:"Thanks @ssankar for putting NVIDIA Nemotron 3 Ultra to the test with no post-training. 24 hours later, it was outperforming frontier models on the tasks @PalantirTech customers needed to solve."
这条推文在 6 小时内获得 36.9 万次展示、369 次点赞和 55 次转发。Palantir 的 Forward Deployed Architect Chad Wahlquist 在评论区回复了美国国旗 emoji。这类一线工程师的背书,在 Palantir 的投资人社群里比任何分析师报告都有分量。
与此同时,NVIDIA CEO 黄仁勋的一段视频也在同一天被 @jawwwn_ 发布。黄仁勋在视频中说,Palantir 是"the single most important enterprise stack in the world"(世界上唯一最重要的企业级技术栈),并透露自己"刚刚还在和 Alex Karp 通话"。他说 Palantir 正在与 NVIDIA 深度集成,"以便我们能够以光速和超凡规模处理数据"。
NVIDIA 的 Nemotron 3 Ultra 是 2026 年 6 月 4 日发布的开源 MoE 模型,550B 总参数、55B 活跃参数,采用 Hybrid Mamba-Attention 架构,支持 100 万 token 上下文。它在吞吐量上对标 GLM-5.1、Kimi K2.6 和 Qwen 3.5 分别有 5.9 倍、4.8 倍和 1.6 倍的优势。但在公开 benchmark 上,它并不是第一名。而这恰恰是 Sankar 整段发言的题眼。
benchmark 已死,客户任务永生
Sankar 的 5 个任务实验传递了一个不讨喜但很难反驳的信息:当前 AI 行业最主流的评估体系,即 benchmark leaderboard,在企业的真实世界里几乎没有参考价值。
Nemotron 3 Ultra 在公开 benchmark 上确实落后于 GPT-5 或 Claude 4 等闭源模型。但当一家年收入即将突破 80 亿美元、客户包括美国国防部和全球最大金融机构的企业级 AI 公司,即 Sankar 的客户群,用自己定义的任务评估时,vanilla Nemotron 赢了。
Sankar 这句话值得单独拉出来:"Those are not the tasks my customers had that they were trying to solve." 如果闭源 frontier 模型不能证明自己在客户自己的任务上有不可替代的优势,它们的定价权和护城河就建立在流沙之上。
Palantir 的股价暴涨有其基本面支撑——93% 的营收增速配上 62% 的利润率在软件行业是稀缺品。但盘后那 15% 的涨幅里,至少有一部分是市场在重新定价一个认知:AI 竞赛的下半场,比的不是谁的 benchmark 分更高,而是谁能在客户的真实任务里跑赢。
参考链接
- NVIDIA 官方推文:
- @jawwwn_ 剪辑的 Sankar 财报发言:
- 黄仁勋称 Palantir 为"最重要的企业级技术栈":
- CNBC: Palantir Q2 2026 earnings:
- LongYield: Palantir's "Otherworldly" Q2 2026:
- NVIDIA Nemotron 3 Ultra 技术博客:
- Seeking Alpha: Palantir Q2 earnings call insights:
- Analytics India Mag: Palantir pushes benchmarking over leaderboards:
- Digg: Palantir CTO Reports Unmodified Nemotron Ultra Beats Frontier Models:_