Mistral Large 4 문서

첫 작업, 응답 설정, 제공업체 연동 및 서비스 한도를 찾아보세요.

모델 사양 및 이 워크스페이스

공식 모델 카드는 1M 토큰 컨텍스트 창, 총 1.05T개 파라미터, 52B개 활성 파라미터를 설명합니다. 텍스트와 이미지를 지원합니다. 이러한 모델 사양은 이 워크스페이스의 요청 한도를 늘리지 않습니다. 계정을 사용하여 크레딧, 결제 및 대화를 관리하세요.

전체 가이드로 계속

첫 번째 대화

샘플 프롬프트를 선택하거나 플레이그라운드에 집중된 질문을 작성하세요. 소스 자료를 추가하고 설정을 조정하세요. 동일한 초안과 설정으로 채팅을 계속하세요. 요청 시 이메일과 비밀번호로 로그인하세요. 이메일 인증은 필요하지 않습니다. 스트리밍된 응답을 읽고 크레딧 및 토큰 사용량을 검토한 후 대화를 계속하세요.

전체 가이드로 계속

유용한 프롬프트 작성하기

목표, 출처, 출력을 지정하세요. 문서의 경우 단락에 번호를 매기고 인용된 증거를 요청하세요. 코드의 경우 실패한 검사, 예상 동작, 관련 함수를 포함하세요. 글쓰기의 경우 대상, 언어, 톤, 용어를 명시하세요. 붙여넣기 전에 PDF 텍스트를 추출하세요. 모델에게 빈 부분을 채우는 대신 누락된 증거를 표시하도록 요청하세요.

코드
Goal: explain this function to a new teammate.
Source: [paste the function and its caller]
Output: purpose, edge cases, one minimal fix, and checks.
If context is missing, state exactly what you need.
전체 가이드로 계속

응답, 초안 및 기록

Enter는 초안을 보내거나 계속하고, Shift + Enter는 줄을 추가합니다. 이미지 URL과 모델 설정은 플레이그라운드 초안과 함께 채팅으로 이동합니다. 완료된 채팅 대화는 이 브라우저에 저장되며 복사하거나 내보낼 수 있습니다. 채팅을 새로 고침해도 브라우저 기록이 유지됩니다. 라이브 사이트에서는 클라우드 동기화를 사용할 수 없습니다. 브라우저 저장소를 지우기 전에 내보내기를 보관하세요.

전체 가이드로 계속

제공자 API 호출

이 사이트의 예시는 이 워크스페이스에서 발급한 계정 API 키가 아닌 Mistral의 제공자 API를 사용합니다. 서버에 MISTRAL_API_KEY를 구성하세요. OpenAI 호환 클라이언트와 함께 https://api.mistral.ai/v1 을(를) 사용하거나 Mistral SDK를 사용하세요. 게시된 모델 별칭은 mistral-large-4.입니다. 예시를 애플리케이션에 맞게 조정하고 응답을 검증하세요.

코드
import os
from mistralai.client import Mistral

client = Mistral(api_key=os.environ["MISTRAL_API_KEY"])
response = client.chat.complete(
    model="mistral-large-4",
    messages=[{"role": "user", "content": "Explain retries."}],
    max_tokens=1024,
)
print(response.choices[0].message.content)
전체 가이드로 계속

요청 매개변수 및 제한

워크스페이스는 각각 1–24,000자인 1–24개의 사용자/어시스턴트 메시지를 허용합니다. 시스템 프롬프트는 최대 4,000자를 허용합니다. 출력은 64–4,096 토큰이며, 온도는 0–2입니다. 추론은 없음 또는 높음이며, 출력은 텍스트 또는 JSON입니다. 이는 애플리케이션 한도입니다. 제공자 API 한도는 엔드포인트와 모델에 따라 다릅니다. 더 높은 추론은 출력 예산을 더 많이 소비할 수 있습니다.

24 메시지24,000 자 / 메시지4,096 출력 토큰

스트리밍 응답 읽기

제공업체 API의 경우 스트림을 활성화하고 일반 텍스트와 구조화된 콘텐츠 청크를 모두 처리하세요. 완전한 이벤트가 도착할 때까지 원시 SSE 바이트를 버퍼링하세요. 중지는 로컬 요청을 닫습니다. 완료되지 않은 요청은 예약된 크레딧을 해제하고, 이미 완료된 요청은 실제 사용량을 정산합니다. 중지 후 크레딧 내역을 확인하세요. 부분 JSON과 도구 인수는 불완전한 것으로 처리하세요. 워크스페이스 엔드포인트는 자체 delta/done/error 이벤트를 사용하며, OpenAI 호환 공개 API가 아닙니다.

전체 가이드로 계속

이미지 및 구조화된 출력

자격 증명 없이 공개 HTTPS 이미지 URL을 첨부하세요. 이 워크스페이스는 PDF, 오디오 또는 비디오를 업로드하지 않습니다. 이미지 옆에 질문을 설명하고 작은 레이블은 원본과 대조하여 확인하세요. JSON 모드에는 JSON을 요청하는 프롬프트가 필요합니다. 사용하기 전에 응답을 구문 분석하고 유효성을 검사하세요. 유효한 JSON 객체만으로는 해당 주장이 올바르다는 것을 입증할 수 없습니다.

전체 가이드로 계속

도구 호출 및 에이전트

제공자 API 통합에서 함수를 정의하세요. 모델이 이름과 JSON 인수를 제안합니다. 서버는 함수 실행 전에 스키마, 액세스 및 부작용을 검증한 후 일치하는 tool_call_id를 사용하여 도구 결과를 반환합니다. 여기에 있는 채팅 프롬프트는 함수를 실행하거나 에이전트가 파일에 액세스하도록 하지 않습니다.

코드
# Configure your server environment
export MISTRAL_API_KEY="your-provider-key"
export MISTRAL_MODEL="mistral-large-4"

# For an OpenAI-compatible client
export OPENAI_BASE_URL="https://api.mistral.ai/v1"
export OPENAI_API_KEY="$MISTRAL_API_KEY"

# Keep execution and permissions in your application.
전체 가이드로 계속

크레딧, 요금제 및 비용

환영 크레딧은付与 시 계정에 표시됩니다. 가격 페이지에서 월간 플랜, 연간 플랜, 영구 일회성 크레딧 팩을 비교하세요. 크레딧 1개는 구성된 모델 비용 $0.0001에 해당하며, 완료된 사용량은 올림 처리됩니다. 완료되지 않은 요청은 예약된 크레딧을 해제합니다. 중지 후 크레딧 내역을 확인하세요. 제공자 API 비용은 별도입니다. 해당 예산은 계산기를 이용하세요.

전체 가이드로 계속

가중치 및 배포

출시 공지는 10월 말 2026.에 가중치 일정을 잡았습니다. 파일이 도착하면 실제 저장소, 라이선스 및 서빙 지원을 확인하세요. 총 파라미터 저장소, KV 캐시 및 런타임 오버헤드가 모두 중요합니다. 활성 파라미터 수는 가중치 메모리 추정치가 아닙니다. 하드웨어를 선택하기 전에 배포 가이드를 읽으세요.

전체 가이드로 계속

문제 해결 및 지원

401: 다시 로그인하고 초안을 유지하세요. 400: 메시지 길이, 이미지 URL 및 설정을 확인하세요. 429: 잠시 후 다시 시도하세요. 503: 서비스가 일시적으로 바쁘거나 사용할 수 없습니다; 초안을 유지하고 잠시 후 다시 시도하세요. 중단된 답변은 완료되지 않은 것입니다. 페이지, 시간 및 오류를 기록하세요; 지원에 문의할 때는 비밀번호, 키 및 개인 문서를 생략하세요.

전체 가이드로 계속
1차 출처 · 8,년 2026월 확인 완료Mistral model cardMistral API documentation