Beschreibung
Mistral-Large-Instruct-2411 ist ein fortschrittliches, dichtes Large Language Model (LLM), das entwickelt wurde, um Denk-, Wissens- und Programmierfähigkeiten zu verbessern. Mit 123 Milliarden Parametern erweitert es die Funktionen seines Vorgängers, Mistral-Large-Instruct-2407, indem es eine verbesserte Handhabung langer Kontexte, Funktionsaufrufe und Unterstützung für Systemaufforderungen bietet. Dieses Modell ist von Natur aus mehrsprachig und unterstützt Dutzende von Sprachen, darunter Englisch, Französisch, Deutsch, Spanisch, Italienisch, Chinesisch, Japanisch, Koreanisch, Portugiesisch, Niederländisch und Polnisch. Es ist auch im Programmieren versiert und wurde auf über 80 Programmiersprachen wie Python, Java, C, C++, JavaScript, Bash, Swift und Fortran trainiert.
Mistral-Large-Instruct-2411 ist agentenzentriert und bietet erstklassige agentische Fähigkeiten mit nativen Funktionsaufrufen und JSON-Ausgaben. Es verfügt über modernste mathematische und Denkfähigkeiten, die es für komplexe Problemlösungsaufgaben geeignet machen. Das Modell ist unter der Mistral Research License verfügbar, die die Nutzung und Modifikation für nicht-kommerzielle Zwecke erlaubt.
Eine der Hauptmerkmale dieses Modells ist das große Kontextfenster von 128k, das eine robuste Kontexttreue für retrieval-augmented generation (RAG) und Anwendungen mit großen Kontexten gewährleistet. Die Funktion der Systemaufforderung wurde verbessert, um eine starke Treue und Unterstützung für zuverlässigere Systemaufforderungen basierend auf dem Feedback der Community aufrechtzuerhalten.
Das Modell kann mit der vLLM-Bibliothek integriert werden, um produktionsbereite Inferenzpipelines zu implementieren. Es erfordert vLLM Version 0.6.4.post1 oder höher und mistral_common Version 1.5.0 oder höher. Benutzer können auch ein einsatzbereites Docker-Image nutzen, das auf Docker Hub verfügbar ist. Das Ausführen von Mistral-Large-Instruct-2411 auf einer GPU erfordert über 300 GB GPU-RAM, was es für Hochleistungsrechenumgebungen geeignet macht.
Mistral-Large-Instruct-2411 im Überblick
123B Parameter
Mehrsprachige Unterstützung
Versiert in über 80 Programmiersprachen
Agentenzentrierte Fähigkeiten
Fortgeschrittenes Denken
Mistral Research License
128k Kontextfenster
Verbesserte Unterstützung für Systemaufforderungen
Erste Schritte mit Mistral-Large-Instruct-2411
Zugriff auf die Seite: Besuchen Sie die Hugging Face Modellseite
Modell laden: Laden Sie das Modell herunter und konfigurieren Sie es
Umgebung konfigurieren: Installieren Sie vLLM und mistral_common
Integrieren: Verwenden Sie die vLLM-Bibliothek für Inferenzpipelines
Feinabstimmung: Passen Sie die Modellparameter für spezifische Aufgaben an
Mistral-Large-Instruct-2411's Anwendungsfälle
- Mehrsprachige Anwendungen
- Fortgeschrittene Programmieraufgaben
- Komplexes Denken
- Agentenzentrierte Anwendungen
- Verarbeitung großer Kontexte






