mcp-tools-for-agents
Server Configuration
Describes the environment variables required to run the server.
| Name | Required | Description | Default |
|---|---|---|---|
| MCP_DOMAINS | No | Comma-separated list of domains to enable (e.g., 'video,files'). Defaults to all domains. | |
| WORKSPACE_DIR | Yes | The workspace directory that bounds all file operations. Must be set. |
Instructions
Guidance the server publishes about itself, which clients place ahead of the tool catalog so the model reads it before choosing anything.
This server publishes no instructions, or was last inspected before Glama recorded them.
Capabilities
Features and capabilities supported by this server
Protocol revision2025-11-25
| Capability | Details |
|---|---|
| tools | {
"listChanged": false
} |
| prompts | {
"listChanged": false
} |
| resources | {
"subscribe": false,
"listChanged": false
} |
| experimental | {} |
Tools
Functions exposed to the LLM to take actions
| Name | Description |
|---|---|
| extract_audioA | Extrai a trilha de áudio de um vídeo para um arquivo separado. Args: path: Vídeo, relativo ao workspace. audio_format: mp3, wav, aac ou flac. background: Executa como job e devolve job_id. |
| transcribe_audioA | Transcreve a fala de um áudio ou vídeo, com tempos de cada trecho. Combine com cut_video para cortar por conteúdo falado. É lento, por isso roda em background por padrão. Args: path: Áudio ou vídeo, relativo ao workspace. model_size: Modelo whisper: tiny, base, small, medium ou large-v3. language: Código do idioma (pt, en). Detecta automaticamente se omitido. background: Executa como job e devolve job_id. |
| list_filesA | Lista os arquivos disponíveis no workspace. Chame primeiro para descobrir com o que trabalhar. Não altera nada. Args: directory: Subdiretório do workspace. Raiz por padrão. kind: Filtra por tipo: video, audio, image ou other. recursive: Inclui subdiretórios. |
| delete_fileA | Apaga permanentemente um arquivo do workspace. Use para limpar saídas intermediárias. Não há lixeira nem desfazer. Args: path: Arquivo, relativo ao workspace. |
| job_statusA | Informa se um job em background está pending, running, done ou failed. Quando estiver done, chame job_result para obter a saída. Args: job_id: Id devolvido pela tool que iniciou o job. |
| job_resultA | Obtém o resultado de um job que já terminou. Retorna erro job_not_finished se ainda estiver rodando. Args: job_id: Id devolvido pela tool que iniciou o job. |
| probe_videoA | Lê duração, resolução, fps, codecs e tamanho de um vídeo. Use antes de cortar ou concatenar para conhecer o arquivo. Não altera nada. Args: path: Caminho do vídeo, relativo ao workspace. |
| cut_videoA | Corta o trecho entre start e end (segundos) e salva um novo arquivo. O original não é modificado. Por padrão copia os streams sem re-encodar, o que é rápido mas corta no keyframe mais próximo. Use reencode=true para corte exato no frame. Para vídeos longos use background=true e acompanhe com job_status. Args: path: Vídeo de origem, relativo ao workspace. start: Início do trecho em segundos. end: Fim do trecho em segundos. reencode: Re-encoda para corte exato (mais lento). background: Executa como job e devolve job_id. |
| concat_videosA | Junta dois ou mais vídeos na ordem informada em um único arquivo. Os vídeos devem ter o mesmo codec e resolução (por exemplo, cortes do mesmo original). Os arquivos de entrada não são alterados. Args: paths: Lista de vídeos, relativa ao workspace, na ordem desejada. output_name: Nome do arquivo de saída. Gerado automaticamente se omitido. background: Executa como job e devolve job_id. |
| detect_scenesA | Detecta mudanças de cena e devolve os intervalos de cada cena. Use para decidir onde cortar. Percorre o vídeo inteiro, então em vídeos longos prefira background=true. Args: path: Vídeo, relativo ao workspace. threshold: Sensibilidade entre 0 e 1. Menor detecta mais cenas. background: Executa como job e devolve job_id. |
| extract_frameA | Extrai um único frame do vídeo no instante informado e salva como imagem. Útil para conferir visualmente o conteúdo antes de cortar. Args: path: Vídeo, relativo ao workspace. time: Instante em segundos. image_format: png ou jpg. |
Prompts
Interactive templates invoked by user choice
| Name | Description |
|---|---|
No prompts | |
Resources
Contextual data attached and managed by the client
| Name | Description |
|---|---|
No resources | |
TDQS
Scored across 11 tools
Each tool targets a distinct operation: audio extraction, transcription, video probing, cutting, concatenation, scene detection, frame extraction, file listing/deletion, and job status/result retrieval. There is no meaningful overlap that would cause an agent to select the wrong tool.
All tool names follow the snake_case verb_noun convention (extract_audio, cut_video, detect_scenes, list_files, delete_file) except job_status and job_result, which are noun_noun but still clearly patterned and consistent with the job subsystem. The style is uniform and predictable.
11 tools is well within the ideal range for a focused media-processing server. Each tool covers a distinct need in the workflow: file discovery, inspection, editing, extraction, cleanup, and async job handling. No tool feels redundant or unnecessary.
The tool surface covers the core video/audio processing lifecycle: inspect, cut, concat, detect scenes, extract audio/frame, and transcribe, plus file and job management. Minor gaps exist such as no job cancellation or listing, and no upload tool, but these do not block the primary workflows.