Codestral Mamba - Mistral AI
Codestral Mamba 是 Mistral AI 基于 Mamba 架构而非标准 Transformer 构建的开源权重代码模型。于 2024 年 7 月发布,旨在提升代码生产力,实现线性时间推理,并在长文本上下文中表现出色。
这款拥有 7.3B 参数的指令模型支持长达 256k 标记的上下文检索测试,非常适合本地编码助手和长代码库交互。模型权重已在 Hugging Face 上以 Apache 2.0 许可证发布,你可以通过 mistral-inference、TensorRT-LLM 部署,或在 Mistral la Plateforme 上测试,命名为 codestral-mamba-2407。
Mamba 的序列建模与 Transformer 不同,它通过线性扩展推理时间与输入长度相关,Mistral 认为这是在开发流程中处理大型提示时实现快速响应的优势。
Mamba架构实现长代码提示的线性时间推理
7.3B调优参数,专注于代码和推理任务
测试支持长达256k标记的大型代码库上下文检索
Apache 2.0开源权重,免费使用、修改和再分发
通过mistral-inference SDK、TensorRT-LLM或llama.cpp本地部署支持
在Mistral la Plateforme上提供,API测试名称为codestral-mamba-2407
设计为本地代码助手,支持任意输入长度的快速响应
由Mamba架构研究人员Albert Gu和Tri Dao共同开发
开放的 Apache 2.0 权重支持无商业许可证费用的自托管。
Mamba 线性推理在超长代码上下文中比许多 Transformer 具有更好的扩展性。
由 Mistral AI 支持,通过 Hugging Face 分发,提供多种部署路径。
公告页面是一个博客帖子,而不是专门的产品仪表盘。
较小的7.3B型号在复杂推理基准测试中可能落后于最大的Frontier模型。
什么是 Codestral Mamba?
Codestral Mamba 是 Mistral AI 基于 Mamba 架构的开放权重代码模型。它拥有 73 亿参数,针对代码生成和具有长上下文窗口的推理进行了优化。
Codestral Mamba 是免费的吗?
是的。模型权重在 Apache 2.0 许可证下发布,允许免费使用、修改和分发。在 la Plateforme 上的 API 访问则遵循 Mistral 的平台定价。
如何在本地运行 Codestral Mamba?
您可以从 Hugging Face 下载权重,并使用 mistral-inference SDK(基于 Mamba 参考实现)、TensorRT-LLM 或支持的本地运行器如 llama.cpp 部署。
Codestral Mamba 支持什么样的上下文长度?
Mistral 测试了高达 256k 令牌的上下文检索能力,使该模型适用于长代码文件和扩展的助手会话。
Codestral Mamba 与 Codestral 22B 有何不同?
Codestral Mamba 采用 Mamba 架构,权重采用 Apache 2.0 开放许可。Codestral 22B 是一个更大的基于 Transformer 的模型,依据 Mistral 的商业或社区许可提供。

