Glarity에서 MiMo-V2.6-Pro-UltraSpeed 사용하는 방법: 페이지 번역, 요약 및 유튜브 영상 요약

Glarity의 커스텀 모델 설정으로 샤오미 MiMo-V2.6-Pro-UltraSpeed를 연결해 거의 즉시 요약과 번역을 사용하는 방법.

MiMo-V2.6-Pro-UltraSpeed는 MiMo-V2.6-Pro의 고속 추론 모드입니다. 동일한 옴니모달 입력, 동일한 100만 토큰 컨텍스트와 최대 12.8만 토큰 출력을 유지하면서 출력 속도에 맞춰 조정되었으며, 샤오미는 표준 Pro보다 최대 20배 빠른 생성이 가능하다고 밝혔습니다. Glarity는 MiMo를 기본 옵션으로 제공하지 않지만, 설정 화면의 "커스텀 모델" 항목은 OpenAI 호환 /chat/completions 엔드포인트라면 어떤 것이든 연결할 수 있으며, 샤오미의 API도 이 형식에 맞습니다. 설정에는 약 5분이 걸리며, 설정 → 일반 → AI 연결에서 시작합니다.

MiMo-V2.6-Pro-UltraSpeed를 선택하는 이유

UltraSpeed는 응답을 기다리는 매 순간이 중요한 상황을 위해 존재합니다. 페이지를 읽는 동시에 요약을 받거나, 거의 실시간으로 자막을 생성하는 경우가 그렇습니다. 샤오미는 표준 Pro보다 최대 20배 빠르게 출력을 생성할 수 있다고 밝혔습니다(이는 공식적으로 제시된 상한선이며 모든 요청에서 보장되는 속도는 아니고, 실제 속도 향상은 요청 내용에 따라 달라집니다). 딥 씽킹, 툴 호출, 스트리밍, 웹 검색, 구조화된 출력, 컨텍스트 캐싱 등 Pro의 모든 기능을 그대로 유지하지만, 그 대가는 비용입니다. UltraSpeed의 토큰당 가격은 표준 Pro보다 약 10배 높으며, 속도 제한은 공개된 고정값이 아니라 계정별로 개별 설정됩니다.

시작하기 전에 필요한 것

  • 샤오미 MiMo 콘솔에서 발급받은 API 키
  • 아래의 연결 정보

Glarity 설정 단계

  1. Glarity 확장 프로그램을 열고 설정 → 일반으로 이동한 뒤, "빠른 Glarity 요약 및 번역을 위한 AI 연결" 항목까지 스크롤합니다.
  2. 연결 유형을 OpenAI API 키로 설정합니다.
  3. API 키 항목에 샤오미 키를 붙여넣습니다.
  4. 모델을 커스텀 모델로 설정하고 mimo-v2.6-pro-ultraspeed를 입력합니다.
  5. 모델 컨텍스트 윈도우를 100만에 가장 가까운 값으로 설정합니다.
  6. API 호스트를 https://api.xiaomimimo.com/v1로 설정합니다.
  7. API 경로를 /chat/completions로 설정합니다.
  8. 온도는 일반적인 용도로 0.5(더 충실한 요약을 원하면 0.2로), 테스트를 눌러 빠른 응답을 확인하고 저장합니다.

설정 한눈에 보기

항목

값

의미

연결 유형

OpenAI API 키

MiMo API는 OpenAI 채팅 완성 형식을 사용

API 키

사용자의 MiMo 키

MiMo 콘솔에서 발급

모델

커스텀 모델 → mimo-v2.6-pro-ultraspeed

공식 모델 ID(UltraSpeed의 S는 대문자)

모델 컨텍스트 윈도우

약 100만

표준 Pro와 동일한 입력 한도

API 호스트

https://api.xiaomimimo.com/v1

샤오미 공식 API 문서의 기본 URL

API 경로

/chat/completions

표준 OpenAI 호환 경로

온도

0.5(또는 0.2)

자연스러운 표현과 충실한 출력 사이의 균형

가격

샤오미 공식 가격 페이지(2026년 9월 22일 업데이트)에 따르면 해외 요금은 100만 토큰당 캐시 입력 $0.036, 비캐시 입력 $4.35, 출력 $8.70으로, 표준 Pro의 약 10배입니다. 중국 내 요금은 100만 토큰당 ¥0.25 / ¥30 / ¥60입니다. UltraSpeed에는 배치 요금제가 제공되지 않습니다. 이는 비용보다 속도가 중요할 때 선택하는 모델이며, 일상적인 대량 요약 작업에는 MiMo-V2.6-Flash가 더 경제적입니다.

UltraSpeed를 연결한 Glarity로 할 수 있는 것

기능

현재 동작 방식

번역

페이지 텍스트나 선택 영역을 거의 실시간으로 번역

페이지 요약

시간이 중요한 읽기 상황에서 빠른 요약 제공

유튜브 요약

영상 대화록 요약을 빠르게 생성

영상 자막

더 빠른 자막 생성 및 번역, 실시간에 가까운 작업 흐름에 유용

빠른 이메일 답장

선택한 텍스트를 바탕으로 거의 즉시 답장 초안 작성

원클릭 프롬프트

저장한 커스텀 프롬프트를 기본 모델 대신 UltraSpeed로 실행

문제 해결

  • 401 / 인증 오류 — API 키가 유효하지 않거나 저장되지 않았습니다. 다시 붙여넣고 테스트를 다시 눌러보세요.
  • "모델을 찾을 수 없음" — mimo-v2.6-pro-ultraspeed(대문자 S 포함)를 정확히 입력했는지 확인하세요.
  • 예상보다 높은 비용 — UltraSpeed의 토큰당 가격은 표준 Pro의 약 10배입니다. 시간에 덜 민감한 대량 작업에는 Flash나 Pro를 고려하세요.
  • 매우 긴 입력에서 요청 실패 — 한도는 입력 100만 토큰 / 출력 12.8만 토큰입니다.
  • Glarity가 여전히 이전 모델을 사용 — 테스트가 성공한 후 저장을 눌러야만 설정이 반영됩니다.

자주 묻는 질문

MiMo-V2.6-Pro-UltraSpeed는 Glarity에서 공식적으로 지원되나요? 아닙니다. 이 가이드는 Glarity의 범용 커스텀 모델 설정을 통해 연결하는 방법입니다.

실제로 얼마나 빠른가요? 샤오미는 표준 Pro보다 최대 20배 빠른 출력 생성이 가능하다고 밝혔습니다. 이는 공식적으로 제시된 상한선이며 모든 요청에서 보장되는 수치는 아니고, 실제 속도 향상은 프롬프트와 부하에 따라 달라집니다.

Flash나 Pro보다 왜 이렇게 비싼가요? UltraSpeed는 비용을 지연 시간과 교환합니다. 비캐시 입력 100만 토큰당 $4.35, 출력 100만 토큰당 $8.70으로 표준 Pro의 약 10배이며 Flash보다 훨씬 높습니다. 속도가 실제로 중요할 때만 사용하고, 일상적인 대량 요약에는 사용하지 마세요.

Pro와 비교해 기능이 떨어지나요? 아닙니다. 동일한 100만 토큰 컨텍스트, 멀티모달 입력, 딥 씽킹, 툴 호출 등의 기능을 그대로 유지합니다. 차이는 생성 속도와 가격에만 있으며 기능상의 차이는 없습니다.

대신 Flash를 사용해야 할 때는? 하루에 많은 페이지를 요약해야 하고 지연 시간이 중요하지 않다면, MiMo-V2.6-Flash가 UltraSpeed의 극히 일부 비용으로 동일한 컨텍스트 윈도우를 제공합니다.

Glarity 편집팀은 AI 검색, 영상 요약, 브라우저 활용 팁을 다룹니다.

Glarity는 AI 검색과 YouTube 요약을 지원하는 무료 브라우저 확장 프로그램입니다(glarity.app에서 사용 가능).