ChatGPT TTS 작업 접수
tts_openai_createChatGPT gpt-audio-mini로 목소리·낭독 스타일·본문 또는 발화를 전달합니다. 기본 on 정규화는 합계 2,000자 한도와 스킬 요금이 적용됩니다. 꺼도 MP3·원문 ASS 결과 구조는 같습니다. [실제 토큰 원가×환율×1.4(작업당 기본요금 5P, 2026-11-06부터 · 소수점 올림) + 정규화 스킬 요금]
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| pace | No | 말 속도 배율 0.5~2.0. 1이 기본 | |
| text | No | utterances와 둘 중 하나 | |
| tone | No | 용도·톤. 생략 시 기본 | |
| pitch | No | 음높이 -12~12 반음. 0이 기본 | |
| style | No | 자유 서술 낭독 스타일 | |
| accent | No | 억양. 생략 시 표준어 | |
| emotion | No | 감정 표현. 생략 시 기본 | |
| speakers | No | 화자 이름 → {voice_id, style, emotion, tone, accent, pace, pitch, volume_gain_db} | |
| voice_id | No | 목소리. 기본 alloy | |
| utterances | No | 각 항목 text, voice_id, style, speaker, emotion, tone, accent, pace, pitch, volume_gain_db | |
| multi_speaker | No | 멀티화자. Gemini는 화자 2명까지 한 호출, ChatGPT는 발화별 목소리 대화 | |
| normalize_text | No | 기본 true, 정규화 추가 과금 | |
| volume_gain_db | No | 음량 보정 -12~12 dB. 0이 기본 | |
| idempotency_key | No | 같은 요청의 재접수 키 |