OpenAI 将 ChatGPT 访客响应成本削减过半,GPU 需求降至数百块
据 The Information 报道,OpenAI 通过模型优化将推理成本降低超过一半,并应用于 ChatGPT,使所需 Nvidia GPU 数量有时降至仅几百块。了解这一优化对免费用户和国内 AI 服务的影响。
一句话看懂
OpenAI 通过推理优化将 ChatGPT 访客模式的响应成本降低一半以上,所需 GPU 数量有时仅需数百块。
详细发生了什么
据 The Information 报道,OpenAI 近期对其 AI 模型的推理成本进行了大幅优化,削减幅度超过 50%。这些优化已应用于 ChatGPT 的访客模式(guest users),使得支撑该服务所需的 Nvidia GPU 数量在某些时段降至仅几百块。此前,为处理大量免费用户的请求,OpenAI 需要动用数千块 GPU。这一成本下降主要得益于模型架构改进、推理引擎优化以及更高效的 batch 处理策略。虽然具体技术细节未公开,但此举显著降低了 OpenAI 的运营支出,并可能为未来降低免费层使用门槛或扩大免费功能铺平道路。
中文圈视角
对国内用户而言,这一消息直接利好:ChatGPT 免费版(无需登录)的响应速度和可用性可能进一步提升。不过,国内访问 ChatGPT 仍需特殊网络环境,且免费版功能有限(如不支持文件上传、GPTs 等)。相比之下,国内替代品如 Kimi、豆包、通义千问等已提供免费且无需梯子的服务,部分模型在中文任务上表现不逊色。OpenAI 的成本优化也提醒国内厂商:推理效率是 AI 服务规模化竞争的关键。目前国产大模型多依赖 Nvidia GPU,但通过模型量化、蒸馏等技术同样可实现成本下降。此外,监管层面,国内免费 AI 服务需遵守内容安全法规,而 OpenAI 的访客模式可能面临数据出境风险,国内用户应谨慎使用。
几条值得记住的细节
- 成本削减幅度超过 50%,具体比例未公开。
- 优化后,支撑 ChatGPT 访客模式的 GPU 数量有时降至“几百块”。
- 该优化仅针对访客模式,付费用户(Plus/Team)可能未受影响。
- 报道来源为 The Information,引用内部人士消息。
- 优化技术包括模型架构和推理引擎改进,但未披露细节。
一句话总结
OpenAI 成本大降,免费 ChatGPT 可能更快更稳,但国内用户仍需权衡网络和合规问题。