Dromedary
Dromedary 是 IBM 研究院的一个开源语言模型项目,旨在通过最少的人类标注训练出有用、合乎伦理且可靠的大型语言模型。该 GitHub 仓库提供训练代码、推理演示、提示词以及可添加到基础 LLaMA 检查点以本地运行 Dromedary 模型的增量权重。
大多数对齐流程依赖庞大的人类标注团队,而 Dromedary 遵循一套原则驱动的自我对齐方法,该方法作为 NeurIPS 2023 的重点论文发表。Dromedary-2 将原始的 SELF-ALIGN 流程简化为两个阶段,并从 ShareGPT、Dolly-15k、OpenAssistant 和 OpenOrca 中提取多样化提示词,随后在 LLaMA-2 上进行监督微调。
复制对齐方法的研究人员以及希望获得可检查的 IBM 对齐堆栈的开发者将从此仓库中受益最大。你需要自备 LLaMA 权重、用于推理的 GPU 硬件,并熟悉 Python 训练脚本,而非依赖托管 API。
基于原则的SELF-ALIGN管道,提供GitHub上的训练和推理代码
Dromedary-2监督微调使用ShareGPT、Dolly-15k、OpenAssistant和OpenOrca的提示
Dromedary-65b的LoRA增量权重已在Hugging Face的zhiqings/dromedary-65b-lora-delta-v0发布
Dromedary-2-70b合成SFT数据集已在Hugging Face的zhiqings/dromedary-2-70b-v2发布
推理文件夹中包含聊天机器人推理演示,支持模型并行GPU
NeurIPS 2023亮点论文链接在arxiv.org/abs/2305.03047
仓库显示1.1k GitHub星标和88个分支,采用GPL-3.0许可证
完整的训练和推理代码在GitHub上以GPL-3.0发布
NeurIPS 2023亮点研究,附带论文和合成数据集
增量权重分布允许在自己的硬件上运行模型
Dromedary-2简化了两个SFT阶段的对齐流程,提供公共提示源
包含聊天机器人演示和模型并行推理指南
需要单独的LLaMA基础权重,未包含在仓库中
主要分支的最后提交来自2023年,活跃维护有限
推理需要GPU设置和Python依赖
仓库中没有托管的API或商业支持渠道
IBM的Dromedary是什么?
Dromedary是IBM的开源项目,用于在最少人工监督下训练自我对齐的语言模型。GitHub仓库github.com/IBM/Dromedary发布了基于LLaMA基础的对齐代码、提示和模型权重。
Dromedary是免费使用的吗?
是的。Dromedary在GitHub上以GPL-3.0开源许可发布。你仍需拥有自己的LLaMA基础权重和计算资源来运行Dromedary模型,但IBM的对齐代码和增量权重可以免费下载。
Dromedary支持哪些模型?
Dromedary发布了基于LLaMA模型的增量权重,如Dromedary-65b和Dromedary-2-70b。Dromedary将IBM的LoRA增量权重添加到你单独获取的官方LLaMA检查点(Hugging Face格式)中。
Dromedary的权重托管在哪里?
Dromedary在Hugging Face上发布LoRA增量权重,包括zhiqings/dromedary-65b-lora-delta-v0和Dromedary-2-70b的SFT数据集zhiqings/dromedary-2-70b-v2。README文件详细介绍了如何将增量权重与基础LLaMA权重合并。
什么是Dromedary-2?
Dromedary-2是一个更新的SELF-ALIGN方案,采用两阶段有监督微调流程,基于LLaMA-2。Dromedary-2还指向IBM/SALMON仓库,用于带有原则遵循奖励模型的RLAIF训练。
谁应该使用Dromedary?
Dromedary面向研究对齐的机器学习研究人员和希望复现IBM对齐流程的开发者。Dromedary需要Python、GPU访问权限以及熟悉LLaMA权重设置,而非托管API。

