sapiens_helen
Convert text into spoken audio using ElevenLabs or Google Gemini. Explore recommended voices, adjust language and settings, then get audio as base64 with MIME type. Bring your own API key or use the deployed default.
Instructions
Helen Voice TTS via ElevenLabs ou Google Gemini (qualquer logado; cobra Sinapses). Sub-actions: list_presets (catálogo de voiceIds/voiceNames recomendados + stylePreambles), speak (sintetiza, retorna audioBase64+mimeType+sizeBytes). BYOK suportado via clientApiKey, senão usa env do deploy. Custo: ElevenLabs ~$0.30/500c, Google ~$0.01/500c. Max 5000 chars (quebra antes em chunks). text pré-processado pelo caller (sem em-dash, sem markdown).
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| text | No | Texto a falar (action=speak). Max 5000 chars. | |
| action | Yes | ||
| modelId | No | ElevenLabs: 'eleven_v3' (default) ou 'eleven_multilingual_v2'. Google: 'gemini-3.1-flash-tts-preview' (default). | |
| voiceId | No | ElevenLabs voice_id (obrigatório se provider=elevenlabs). Use list_presets pra ver opções. | |
| provider | No | elevenlabs (melhor natural, mais caro) ou google (Gemini TTS, mais barato). Default elevenlabs. | |
| clientApiKey | No | BYOK: chave do user. Se vazia, usa env default do deploy (ELEVENLABS_API_KEY ou GEMINI_API_KEY). | |
| languageCode | No | ElevenLabs: ex 'pt' pra PT-BR otimizado. | |
| outputFormat | No | ElevenLabs ex 'mp3_44100_128'. Default da provider. | |
| stylePreamble | No | Google: prefixo de instrução de mood ('Read this in a thoughtful tone:'). Não suportado em ElevenLabs. | |
| voiceSettings | No | ElevenLabs voice_settings. Default razoável: stability=0.45, similarity_boost=0.75, style=0.30. | |
| googleVoiceName | No | Google prebuilt voice (default Kore). Use list_presets pra ver opções. |