콘텐츠로 이동

AI 교정

받아쓴 원문을 AI가 다듬어 줍니다 — 띄어쓰기·문장부호·오인식 단어 교정부터, 필러 제거와 구조화까지. 설정 → LLM에서 프로바이더와 교정 모드를 고릅니다. 기본값은 없음(원문 그대로) 이라, 교정이 필요할 때만 켜면 됩니다.

프로바이더위치비전필요 조건
없음 (원문 사용) (기본)——없음. 받아쓴 그대로 삽입
로컬 MLX로컬 (Apple Silicon)모델에 따라모델 다운로드. 일부 MoE 모델은 uv 필요
OpenAI (GPT)클라우드✅Codex CLI 토큰 또는 OpenAI 로그인
OpenAI 호환 API클라우드/로컬토글Base URL (+ API Key, 로컬 서버는 생략 가능)
Groq Cloud클라우드Llama 4 Scout만Groq API 키(STT와 공유)
Claude (구독)로컬 claude CLI 경유✅Claude Code CLI 설치 + 로그인

완전 로컬 교정. 텍스트 모델(Qwen3, Gemma 4, GLM 등)과 비전 모델(Qwen3-VL-4B, DiffusionGemma 26B)을 지원하며, 모델은 설정 → 모델에서 받습니다. 비전 모델을 쓰면 화면 컨텍스트를 교정에 활용할 수 있습니다. 모델별 호환성은 모델 & 호환성 참고.

ChatGPT Responses API(SSE 스트리밍)를 사용합니다. 인증은 Codex CLI 토큰(~/.codex/auth.json)을 우선 재사용하고, 없으면 LLM 탭에서 OpenAI 로그인(브라우저 PKCE)으로 연결합니다. 모델: GPT-5.6 Sol(기본)·Terra·Luna·5.5·5.4·5.4 Mini·5.3 Codex·5.2. 비전 지원.

POST {Base URL}/chat/completions을 지원하는 모든 엔드포인트에서 동작합니다 — OpenRouter, DeepSeek, Together, vLLM, Ollama, LM Studio 등. Base URL(/v1 포함)과 모델 ID를 직접 입력하고, 필요하면 API Key를 넣습니다(로컬 서버는 생략 가능). 모델이 이미지 입력을 지원하면 Vision 지원 모델 토글을 켜서 화면 컨텍스트를 활용하세요.

OpenAI 호환 클라우드. 모델: Qwen3 32B(기본)·Llama 3.3 70B·Llama 3.1 8B·GPT-OSS 120B/20B, 그리고 비전은 Llama 4 Scout 만 지원. STT와 같은 Groq 키를 씁니다.

로컬 claude -p CLI를 호출해 Claude 구독을 그대로 재사용합니다(ToS상 허용되는 유일한 구독 경로). 모델: Haiku 4.5(기본)·Sonnet 4.6·Opus 4.8 — 전부 비전 지원. 응답은 보통 5–20초(콜드스타트 포함), 과금은 구독 크레딧 풀에서 처리됩니다.

프로바이더가 ‘없음’이 아닐 때 설정 → LLM에 나타납니다. 프롬프트는 한국어 기반이며 한↔영 코드스위칭 예시를 포함합니다.

모드하는 일
표준(Standard) (기본)명백한 STT 오류만 교정 — 띄어쓰기, 문장부호, 오인식 단어.
필러 제거표준 + “음/어/그러니까” 같은 군말 제거(내용은 유지).
구조화표준 + 필러 제거 + 두서없는 말을 불릿/번호로 정돈(요약 아님, 정리).
커스텀직접 작성한 시스템 프롬프트 사용.

커스텀 모드에서는 시스템 프롬프트를 직접 편집할 수 있습니다. 다른 모드에서는 현재 적용 중인 프롬프트를 읽기 전용으로 미리 볼 수 있어, 어떤 지침으로 교정되는지 확인할 수 있습니다.

한국어로 말하다 영어 기술 용어가 섞여도(예: “밸리데이션” → “validation”) 적절히 교정합니다. 설정의 언어 가 자동/한국어일 때 코드스위칭 프롬프트가 활성화됩니다.