설명
Mistral-Large-Instruct-2411은 추론, 지식 및 코딩 능력을 향상시키기 위해 개발된 고급 밀집형 대형 언어 모델(LLM)입니다. 1230억 개의 매개변수를 통해 이전 모델인 Mistral-Large-Instruct-2407의 기능을 확장하여 개선된 긴 컨텍스트 처리, 함수 호출 및 시스템 프롬프트 지원을 제공합니다. 이 모델은 설계상 다국어를 지원하며, 영어, 프랑스어, 독일어, 스페인어, 이탈리아어, 중국어, 일본어, 한국어, 포르투갈어, 네덜란드어 및 폴란드어를 포함한 수십 개의 언어를 지원합니다. 또한 Python, Java, C, C++, JavaScript, Bash, Swift 및 Fortran과 같은 80개 이상의 프로그래밍 언어에 대해 훈련되어 코딩에 능숙합니다.
Mistral-Large-Instruct-2411은 에이전트 중심으로, 기본 함수 호출 및 JSON 출력을 통해 최고의 에이전트 기능을 제공합니다. 이 모델은 최첨단 수학 및 추론 능력을 자랑하여 복잡한 문제 해결 작업에 적합합니다. 이 모델은 Mistral Research License 하에 제공되며, 비상업적 용도 및 수정이 가능합니다.
이 모델의 주요 기능 중 하나는 128k의 큰 컨텍스트 창으로, 검색 보강 생성(RAG) 및 대규모 컨텍스트 애플리케이션에 대한 강력한 컨텍스트 준수를 보장합니다. 시스템 프롬프트 기능은 커뮤니티 피드백을 기반으로 강력한 준수 및 보다 신뢰할 수 있는 시스템 프롬프트 지원을 유지하도록 개선되었습니다.
이 모델은 vLLM 라이브러리와 통합되어 생산 준비가 완료된 추론 파이프라인을 구현할 수 있습니다. vLLM 버전 0.6.4.post1 이상 및 mistral_common 버전 1.5.0 이상이 필요합니다. 사용자는 Docker Hub에서 사용할 수 있는 준비된 Docker 이미지를 활용할 수도 있습니다. Mistral-Large-Instruct-2411을 GPU에서 실행하려면 300GB 이상의 GPU RAM이 필요하여 고성능 컴퓨팅 환경에 적합합니다.
Mistral-Large-Instruct-2411 하이라이트
123B 매개변수
다국어 지원
80개 이상의 코딩 언어에 능숙
에이전트 중심 기능
고급 추론
Mistral Research License
128k 컨텍스트 창
개선된 시스템 프롬프트 지원
Mistral-Large-Instruct-2411 시작하기
접속 페이지: Hugging Face 모델 페이지 방문
모델 로드: 모델 다운로드 및 구성
환경 구성: vLLM 및 mistral_common 설치
통합: 추론 파이프라인을 위한 vLLM 라이브러리 사용
미세 조정: 특정 작업을 위한 모델 매개변수 조정
Mistral-Large-Instruct-2411의 사용 사례
- 다국어 애플리케이션
- 고급 코딩 작업
- 복잡한 추론
- 에이전트 중심 애플리케이션
- 대규모 컨텍스트 처리






