6.0
关注
AI SCORE
技术实践2025-03-24 20:48
300B超大模型无高端GPU的训练方案
Hacker News · arxiv.org#LLM#训练优化
Editor brief · 编辑速览
研究论文展示用普通GPU高效扩展3000亿参数LLM的训练方法,降低大模型开发的基础设施成本。
研究论文展示用普通GPU高效扩展3000亿参数LLM的训练方法,降低大模型开发的基础设施成本。
当前浏览上下文:
参考文献与引用
BibTeX 格式的引用
arXivLabs 是一个框架,协作者可以借助它直接在我们的网站上开发和分享 arXiv 的新功能。
参与 arXivLabs 的个人和组织都认同并接受我们所秉持的开放、社区、卓越和用户数据隐私等价值观。arXiv 致力于坚守这些价值观,并且只与同样遵循这些价值观的合作伙伴开展合作。
如果你有能为 arXiv 社区创造价值的项目构想,可以进一步了解 arXivLabs。