描述
Mistral-Large-Instruct-2411 是一个先进的高密度大型语言模型(LLM),旨在增强推理、知识和编码能力。它拥有 1230 亿参数,扩展了其前身 Mistral-Large-Instruct-2407 的功能,提供改进的长上下文处理、函数调用和系统提示支持。该模型设计为多语言,支持包括英语、法语、德语、西班牙语、意大利语、中文、日语、韩语、葡萄牙语、荷兰语和波兰语在内的多种语言。它在编码方面也表现出色,经过超过 80 种编程语言的训练,如 Python、Java、C、C++、JavaScript、Bash、Swift 和 Fortran。
Mistral-Large-Instruct-2411 以代理为中心,提供一流的代理能力,具备原生函数调用和 JSON 输出。它拥有最先进的数学和推理能力,适合复杂问题解决任务。该模型在 Mistral Research License 下提供,允许非商业用途和修改。
该模型的一个关键特性是其大 128k 上下文窗口,确保在检索增强生成(RAG)和大上下文应用中的强上下文遵循。根据社区反馈,系统提示功能得到了增强,以保持强大的遵循性并支持更可靠的系统提示。
该模型可以与 vLLM 库集成,以实现生产就绪的推理管道。它需要 vLLM 版本 0.6.4.post1 或更高版本,以及 mistral_common 版本 1.5.0 或更高版本。用户还可以利用在 Docker Hub 上提供的现成 Docker 镜像。在 GPU 上运行 Mistral-Large-Instruct-2411 需要超过 300 GB 的 GPU RAM,适合高性能计算环境。
Mistral-Large-Instruct-2411亮点
1230 亿参数
多语言支持
精通 80 种以上的编码语言
以代理为中心的能力
先进的推理
Mistral 研究许可证
128k 上下文窗口
改进的系统提示支持
Mistral-Large-Instruct-2411入门
访问页面:访问 Hugging Face 模型页面
加载模型:下载并配置模型
配置环境:安装 vLLM 和 mistral_common
集成:使用 vLLM 库进行推理管道
微调:调整模型参数以适应特定任务
Mistral-Large-Instruct-2411的使用案例
- 多语言应用
- 高级编码任务
- 复杂推理
- 以代理为中心的应用
- 大上下文处理






