据The Information,OpenAI工程师本月向部分同事透露,依靠数项全新研发的优化技术,已找到一套可将模型推理成本削减一半以上的方案。在面向无账户访客使用ChatGPT的场景中,相关技术一度把所需的英伟达GPU数量压缩至仅数百块,大幅降低算力开销。