46种多语言支持
BLOOM大模型支持46种自然语言和13种编程语言,涵盖英语、中文、阿拉伯语、法语、西班牙语等,在多样化多语言文本生成任务中表现卓越,打破英语中心化的AI模型局限。
从多语言理解到代码生成,BLOOM为研究者和开发者提供完整的开源大语言模型解决方案
BLOOM大模型支持46种自然语言和13种编程语言,涵盖英语、中文、阿拉伯语、法语、西班牙语等,在多样化多语言文本生成任务中表现卓越,打破英语中心化的AI模型局限。
拥有1760亿参数的大规模Transformer架构,采用decoder-only设计,在BigScience项目中经过大规模数据训练,提供强大的自然语言理解和生成能力。
创新采用Attention with Linear Biases (ALiBi)位置编码技术,替代传统正弦位置编码,有效提升长文本序列的外推能力,支持更长的上下文窗口和更稳定的训练过程。
作为BigScience项目的核心成果,BLOOM模型权重完全开源开放,遵循Responsible AI License,允许研究者和开发者在Hugging Face平台自由下载和使用,推动AI技术民主化。
支持问答、摘要、翻译、创意写作等多种自然语言处理任务。BLOOM多语言模型能够理解和生成高质量文本,为商业应用和学术研究提供可靠的AI语言技术支持。
支持13种编程语言包括Python、JavaScript、C++、Java等,具备代码补全、注释生成、代码解释等能力。开发者可利用BLOOM模型提升编程效率,实现智能代码辅助。
用数据展现BigScience大语言模型的技术实力
46+
自然语言支持
176B
模型参数量
13
编程语言
OSS
开放获取
加入全球数千名研究者和开发者的行列,使用BigScience开源的176B参数Transformer模型
立即获取模型