Glarity에서 MiMo-V2.6-Pro 사용하는 방법: 페이지 번역, 요약 및 유튜브 영상 요약

Glarity의 커스텀 모델 설정으로 샤오미 MiMo-V2.6-Pro를 연결해 멀티모달 요약과 번역에 활용하는 방법.

MiMo-V2.6-Pro는 샤오미(小米)의 플래그십 추론 모델입니다. 텍스트, 이미지, 영상, 오디오를 입력으로 받아 텍스트로 응답하는 옴니모달 모델로, 컨텍스트 윈도우는 100만 토큰, 최대 출력은 12.8만 토큰입니다. Glarity는 아직 MiMo를 기본 옵션으로 제공하지 않지만, 설정 화면에는 OpenAI 스타일의 /chat/completions 엔드포인트를 가진 벤더라면 누구나 연결할 수 있는 범용 "커스텀 모델" 항목이 있습니다. 이 항목을 샤오미 API로 연결하는 데는 약 5분이 걸리며, 설정 → 일반 → AI 연결에서 시작합니다.

MiMo-V2.6-Pro를 선택하는 이유

브라우저 확장 프로그램에 연결할 수 있는 대부분의 모델은 텍스트와 정지 이미지만 읽습니다. MiMo-V2.6-Pro는 영상과 오디오까지 입력으로 처리하며, 100만 토큰 컨텍스트를 갖추고 있어 긴 대화록이나 여러 페이지 문서를 다루거나, 더 복잡한 추론을 위해 딥 씽킹 모드를 켜야 하는 작업에 적합합니다(샤오미 문서에 따르면 요청 단위로 씽킹 모드를 끄고 더 빠르고 저렴한 응답을 받을 수도 있습니다). 툴 호출, 스트리밍, 웹 검색, 구조화된 출력, 컨텍스트 캐싱도 지원하므로, Glarity에서 동일한 시스템 프롬프트를 여러 페이지에 반복 적용하는 워크플로에도 유용합니다.

시작하기 전에 필요한 것

  • 샤오미 MiMo 콘솔에서 발급받은 API 키
  • 아래의 연결 정보

Glarity 설정 단계

  1. Glarity 확장 프로그램을 열고 설정 → 일반으로 이동한 뒤, "빠른 Glarity 요약 및 번역을 위한 AI 연결" 항목까지 스크롤합니다.
  2. 연결 유형을 OpenAI API 키로 설정합니다.
  3. API 키 항목에 샤오미 키를 붙여넣습니다.
  4. 모델을 커스텀 모델로 설정하고 mimo-v2.6-pro를 입력합니다.
  5. 모델 컨텍스트 윈도우를 MiMo의 공식 한도인 100만에 가장 가까운 값으로 설정합니다.
  6. API 호스트를 https://api.xiaomimimo.com/v1로 설정합니다.
  7. API 경로를 /chat/completions로 설정합니다.
  8. 온도(Temperature)는 일반적인 용도로 0.5(더 충실하고 변화가 적은 요약을 원하면 0.2로), 설정 후 테스트를 눌러 응답을 확인하고 저장합니다.

설정 한눈에 보기

항목

값

의미

연결 유형

OpenAI API 키

MiMo API는 OpenAI 채팅 완성 형식을 사용

API 키

사용자의 MiMo 키

MiMo 콘솔에서 발급

모델

커스텀 모델 → mimo-v2.6-pro

공식 모델 ID

모델 컨텍스트 윈도우

약 100만

MiMo-V2.6-Pro의 공식 입력 한도

API 호스트

https://api.xiaomimimo.com/v1

샤오미 공식 API 문서의 기본 URL

API 경로

/chat/completions

표준 OpenAI 호환 경로

온도

0.5(또는 0.2)

자연스러운 표현과 충실한 출력 사이의 균형

가격

샤오미 공식 가격 페이지(2026년 9월 22일 업데이트)에 따르면 해외 요금은 100만 토큰당 캐시 입력 $0.0036, 비캐시 입력 $0.435, 출력 $0.87입니다. 중국 내 요금은 동일한 세 단계에 대해 100만 토큰당 ¥0.025 / ¥3 / ¥6입니다. 페이지나 영상 대화록을 요약하는 일상적인 사용은 보통 수천 토큰 수준이므로, 1회 비용은 거의 무시할 수 있는 수준입니다. 신규 모델은 요금이 변경될 수 있으니 사용 전 공식 가격 페이지를 확인하세요.

MiMo를 연결한 Glarity로 할 수 있는 것

기능

현재 동작 방식

번역

MiMo의 다국어 추론을 활용해 페이지 텍스트나 선택 영역을 번역

페이지 요약

긴 글을 핵심 내용으로 압축, 100만 토큰 윈도우로 긴 페이지도 처리

유튜브 요약

더 작은 모델의 한도를 초과하는 긴 영상의 대화록까지 요약

영상 자막

대화록을 바탕으로 자막 텍스트를 생성 및 번역

빠른 이메일 답장

선택한 텍스트를 바탕으로 짧은 답장 작성

원클릭 프롬프트

저장한 커스텀 프롬프트를 기본 모델 대신 MiMo로 실행

문제 해결

  • 401 / 인증 오류 — API 키가 유효하지 않거나 저장되지 않았습니다. 다시 붙여넣고 테스트를 다시 눌러보세요.
  • "모델을 찾을 수 없음" — 모델이 정확히 mimo-v2.6-pro라는 ID의 커스텀 모델로 설정되어 있는지 확인하세요.
  • 매우 긴 입력에서 요청 실패 — MiMo의 한도는 입력 100만 토큰 / 출력 12.8만 토큰입니다. 초과 시 입력을 줄이거나 페이지를 분할하세요.
  • 예상보다 느린 응답 — 딥 씽킹 모드는 지연 시간을 늘립니다. 더 빠른 응답이 필요하면 요청 설정에서 비활성화하세요.
  • Glarity가 여전히 이전 모델을 사용 — 테스트가 성공한 후 저장을 눌러야만 설정이 반영됩니다. 테스트만으로는 저장되지 않습니다.

자주 묻는 질문

MiMo-V2.6-Pro는 Glarity에서 공식적으로 지원되나요? 아닙니다. Glarity는 MiMo를 기본 제공 옵션으로 나열하지 않습니다. 이 가이드는 OpenAI 호환 API라면 어떤 벤더든 동일하게 사용할 수 있는 Glarity의 범용 커스텀 모델 설정을 통해 연결하는 방법입니다.

영상과 오디오도 처리하나요, 아니면 텍스트만 가능한가요? MiMo-V2.6-Pro는 텍스트, 이미지, 영상, 오디오를 입력으로 받지만 응답은 텍스트로만 합니다. 영상의 시각 정보와 대화록을 함께 요약하는 작업에서는 텍스트 전용 모델보다 유리합니다.

일반적인 사용 비용은 얼마인가요? 비캐시 입력 100만 토큰당 $0.435, 출력 100만 토큰당 $0.87을 기준으로, 수천 토큰 수준의 페이지나 영상 요약은 비용이 거의 무시할 수 있는 수준입니다.

더 깊은 추론보다 빠른 응답이 필요하다면 어떻게 하나요? 샤오미 API는 요청 단위로 "씽킹" 모드를 끌 수 있습니다. Glarity 설정에서 이 옵션을 직접 제공하지 않는다면, 속도에 더 특화된 MiMo-V2.6-Flash나 MiMo-V2.6-Pro-UltraSpeed를 고려해 보세요.

매번 테스트를 눌러야 하나요? 설정을 변경했을 때만 필요합니다. 테스트는 저장 전에 연결이 정상인지 확인하는 절차이며, 저장 후에는 다시 변경하기 전까지 Glarity가 해당 설정을 계속 사용합니다.

Glarity 편집팀은 AI 검색, 영상 요약, 브라우저 활용 팁을 다룹니다.

Glarity는 AI 검색과 YouTube 요약을 지원하는 무료 브라우저 확장 프로그램입니다(glarity.app에서 사용 가능).