신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.
이 모델은 현행 카탈로그에서 내려갔습니다. 아래 정보는 아카이브된 내용입니다.

MiniMax M3

2026-06-01 출시

chat코드리즈닝도구 호출비전프롬프트 캐싱

MiniMax M3는 MiniMax의 프런티어 모델로, 코딩·에이전틱 추론·네이티브 멀티모달 이해라는 세 가지 프런티어 능력을 결합한 최초의 오픈 웨이트 릴리스로 포지셔닝됩니다.

입력
텍스트 이미지 비디오 $0.3/M
출력
텍스트 $1.2/M
캐시 읽기
$0.06/M
컨텍스트
1M
GPT-4o 대비
약 94% 저렴

가격의 위치

동종 60개 모델 중 가격 위치

입력$0.3/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
출력$1.2/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
캐시 읽기$0.06/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양) 1,000,000
최대 출력(벤더 스펙) 524,288

프롬프트 캐싱

캐싱 방식 자동
최소 프리픽스 512

사고

공급사 파라미터 thinking.type + reasoning_split
허용 값 thinking.type adaptive · disabled; reasoning_split boolean
기본값 adaptive: 사고는 켜져 있고, 추가 추론이 도움이 되는 시점은 모델이 판단 요청에서 지정하지 않을 때 적용
비활성화 가능 지원
사고 동작 reasoning_split은 트레이스의 위치만 옮깁니다. 켜면 reasoning_content와 reasoning_details로 반환되고, 끄면 think 태그로 감싸여 content 안에 그대로 남으며, 도구 호출 턴에서는 이를 포함한 어시스턴트 메시지 전체를 되돌려 보내야 합니다.
파라미터 reasoning_effort
minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다

모델

모달리티 텍스트 + 이미지 + 비디오 → 텍스트
파라미터 전체 428B · 활성 23B MoE
라이선스 MiniMax Community License
  • 1M 토큰 컨텍스트의 MSA 희소 어텐션(입력 512K까지는 표준 과금)
  • 약 428B/약 23B 활성 MoE
  • 네이티브 멀티모달(이미지 + 영상 입력), 컴퓨터 사용, 적응형 사고
  • 입력 512 토큰 이상부터 자동 프리픽스 캐싱

출처: MiniMax 공식 문서 ↗

30초 만에 MiniMax M3 사용하기

OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

MiniMax M3 소개

  • 자체 개발한 MiniMax Sparse Attention(MSA) 아키텍처 위에 구축되어 총 약 428B 파라미터에 약 23B가 활성화되며, 최대 1M 토큰의 컨텍스트 윈도우를 지원하면서 최소 512K를 보장하고, 롱 호라이즌 에이전트 과제와 코드베이스 전체 이해를 겨냥합니다.
  • MiniMax는 MSA가 최대 컨텍스트에서 토큰당 연산량을 이전 세대의 20분의 1로 줄였다고 밝히는데, 그 세대의 패밀리는 1M에 한참 못 미치는 상한을 가지고 있었습니다.
  • 나중에 덧붙이는 방식과 달리 멀티모달리티가 0단계부터 학습되어 텍스트와 시각 시맨틱이 깊이 정렬되어 있으며, API는 텍스트와 함께 이미지와 영상을 받아들입니다.
  • 사고는 다른 모델을 고르는 방식이 아니라 enabled, adaptive, disabled 설정을 갖는 thinking 객체로 제어하고, 별도의 reasoning_split 플래그가 체인 오브 소트를 reasoning_content와 reasoning_details로 반환할지 아니면 think 태그로 감싸 메시지 안에 그대로 둘지를 결정합니다.
  • 사고는 설계상 도구 호출과 인터리브되며, MiniMax의 도구 사용 가이드는 반환된 추론 필드를 다음 턴까지 보존할 것을 요구합니다.
  • 프리픽스 캐싱은 입력 512 토큰을 넘으면 자동으로 시작됩니다.
  • 가중치는 MiniMax Community License로 공개되어 있으며, 이 라이선스는 상업용 제품에 모델을 명시해 줄 것을 요청합니다.
  • Synthorai는 OpenAI 호환 엔드포인트로 MiniMax M3를 서빙합니다.

자주 묻는 질문

MiniMax M3 API는 무료로 사용해 볼 수 있나요?

네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $0.3/M 기준으로, 이 크레딧만으로도 MiniMax M3에 약 8K 토큰 규모의 요청을 대략 416회 보낼 수 있습니다.

MiniMax M3은 무엇에 가장 강한가요?

코딩·에이전트·멀티모달 결합 최초의 오픈 웨이트, 최대 1M 컨텍스트, 최소 512K 보장, 0단계부터 학습된 멀티모달리티. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

MiniMax M3의 가격은 얼마인가요?

Synthorai에서 MiniMax M3은 입력 토큰 100만 개당 $0.3, 출력 토큰 100만 개당 $1.2입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.06/M로 과금됩니다.

MiniMax M3은 프롬프트 캐싱을 지원하나요?

네, 자동으로 지원합니다. MiniMax에서 서빙되는 프롬프트는 코드 변경 없이 캐시됩니다. 캐시된 입력 토큰은 $0.06/M로 과금됩니다(미캐시 시 $0.3/M); 캐시되려면 프롬프트에 512 토큰 이상의 안정적인 프리픽스가 필요합니다. 프롬프트 캐싱 가이드 →

MiniMax M3은 어떻게 이용하나요?

기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="minimax-m3"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.

MiniMax M3은 오픈소스인가요?

네, 가중치가 MiniMax Community License 하에 공개되어 있습니다 (공식 저장소 링크는 소개 섹션 참고). GPU를 직접 마련할 필요도 없습니다: 여기서 제공되는 호스팅 버전은 종량제이며 운영할 인프라가 없습니다. 오픈 웨이트 모델 실행하기 →

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →