
呼叫中心咨询公司“呼叫中心医生”(The Call Center Doctors)近日进行了一项实测,旨在验证DeepSeek模型是否真如传闻般比Claude“便宜80倍”。该公司于9月27日租用一台配备4块H200显卡的服务器,试图用DeepSeek V4.1 Flash模型替代Opus 5.5,为其Claude Code智能体提供底层支持。然而,测试报告最终显示,通过DeepSeek API完成相同工作的日均成本仅为184至223美元,远低于自托管服务器每天440.88美元的按需租赁成本。基于此,该公司决定放弃自托管方案,继续以更低综合成本使用Claude Opus 5.5。
成本倒挂:自托管并非总是更省钱
尽管DeepSeek API标价显著低于Anthropic官方定价——非高峰期输入Token每百万0.15美元,输出每百万0.60美元,而Claude Opus 5.5标价分别为4美元和20美元——但实际账单揭示了复杂情况。该公司9月份Claude Code订阅费用约为5500美元。若同期用量通过DeepSeek API结算,费用预计在3500至7000美元之间,平均约4200美元。相比之下,若按Claude官方标价计算同等Token量,成本高达14万美元,是订阅费的25倍以上。所谓的“80倍”价差,主要源于固定费率订阅服务的优惠,而非单纯的单价差异。
自托管方案的劣势在于硬件利用率低下。测试显示,该服务器峰值处理速度约为每秒213个Token。由于编程智能体需频繁重发对话上下文,日志显示96%的输入为历史数据,平均每写入1个新Token需读取约1000个旧Token。庞大的重读负载占用了大部分算力,导致生成新Token的效率极低。据估算,该服务器每日仅能处理约200亿个Token,而该公司在最繁忙单日使用了510亿个Token,算力缺口明显。
稳定性与安全挑战
除了成本问题,部署过程也充满波折。模型稳定运行经历了五次尝试,每次加载耗时10至15分钟,且无论服务器是否忙碌均持续计费。按每小时18.37美元的按需费率计算,月度标准时长成本约为13,200美元,超过其9月Claude账单的两倍。此外,测试中DeepSeek并未真正编写代码。审查人员发现智能体存在通过共享临时文件夹以管理员权限运行代码的沙箱逃逸风险,迫使代码编写功能离线。最终,DeepSeek仅作为48至64个只读审查智能体运行,读取2377个文件夹并提交32份错误报告。测试结束后几分钟,这台以每小时9.19美元现货价格租用的服务器即被服务商收回。
展望后续,鉴于V4代产品中Pro版本性能优于Flash版本的趋势,未来DeepSeek V4.1-Pro的推出有望提升性能并改变成本效益分析。但在当前阶段,对于大多数企业而言,直接购买Token而非租赁GPU运行开源模型,仍是更具性价比的选择。