BriefGPT.xyz
Ask
alpha
关键词
fault-tolerant inference algorithms
搜索结果 - 1
互联网上大规模语言模型的分布式推理和微调
本研究探讨了大型语言模型在成本高效的推理和微调方面的方法,并比较了本地和分布式策略。我们开发了特殊的容错推理算法和负载平衡协议,用于自动分配设备以最大化系统总吞吐量,并展示了这些算法在 Petals 中的应用,该分散式系统能够以比离线处理快
→
PDF
7 months ago
Prev
Next