Skip to main content
Glama

Volt HQ

AI 에이전트를 위한 컴퓨팅 가격 오라클입니다.

주요 기능

  • 가격 비교: 9개 제공업체(OpenAI, Anthropic, Groq, Together AI, DeepInfra, Fireworks AI, Cerebras, Hyperbolic, Akash)의 200개 이상의 상품에 대한 실시간 API 가격 비교

  • 최적 라우팅 추천: 동일한 품질을 더 저렴하게 이용할 수 있는 곳을 추천하고 예상 절감액을 제공

  • 지출 및 예산 추적: 제공업체/모델별 지출 요약, 절감 보고서 및 임계값 알림

Related MCP server: volthq-mcp-server

설치

한 번의 명령어로 Cursor와 Claude Desktop을 자동 구성합니다:

npx volthq-mcp-server --setup

설치된 클라이언트를 감지하고 기존 MCP 서버를 덮어쓰지 않고 구성을 병합합니다.

Cursor.cursor/mcp.json에 추가:

{
  "mcpServers": {
    "volthq": {
      "command": "npx",
      "args": ["-y", "volthq-mcp-server"]
    }
  }
}

Claude Desktopclaude_desktop_config.json에 추가:

{
  "mcpServers": {
    "volthq": {
      "command": "npx",
      "args": ["-y", "volthq-mcp-server"]
    }
  }
}

도구

도구

설명

volt_check_price

모델에 대한 제공업체별 가격 비교

volt_recommend_route

예상 절감액과 함께 최적의 제공업체 추천

volt_get_spend

제공업체 및 모델별 지출 요약 (오늘/7일/30일)

volt_get_savings

실제 지출 대비 최적화된 지출 비교

volt_set_budget_alert

일일/주간/월간 예산 임계값 알림 설정

예시

> volt_check_price { "model": "llama-70b" }

Price comparison for "llama-70b" — 14 offerings found
────────────────────────────────────────────────────────────
1. DeepInfra — Llama-70B
   Input: $0.20/M tokens | Output: $0.27/M tokens | Avg: $0.24/M
   Quality: 88% | Region: global

2. Hyperbolic — Llama-70B (FP8) on H100-SXM
   Input: $0.40/M tokens | Output: $0.40/M tokens | Avg: $0.40/M
   Quality: 85% | Region: global

3. Hyperbolic — Llama-70B (BF16) on H100-SXM
   Input: $0.55/M tokens | Output: $0.55/M tokens | Avg: $0.55/M
   Quality: 88% | Region: global

4. Groq — Llama-70B
   Input: $0.59/M tokens | Output: $0.79/M tokens | Avg: $0.69/M
   Quality: 88% | Region: global

5. Fireworks AI — Llama-70B
   Input: $0.90/M tokens | Output: $0.90/M tokens | Avg: $0.90/M
   Quality: 88% | Region: global

6. Together AI — Llama-70B
   Input: $0.88/M tokens | Output: $0.88/M tokens | Avg: $0.88/M
   Quality: 88% | Region: global

7. Akash — Llama-70B (FP8) on H100-SXM
   Input: $3.49/M tokens | Output: $8.72/M tokens | Avg: $6.11/M
   Quality: 85% | Region: global

8. Akash — Llama-70B (FP8) on A100-80GB
   Input: $5.24/M tokens | Output: $13.11/M tokens | Avg: $9.18/M
   Quality: 85% | Region: global

Cheapest is 97% less than most expensive option.

DeepInfra $0.24/M, Hyperbolic $0.40/M, Groq $0.69/M, Fireworks AI $0.90/M — 모두 GPT-4o의 $6.25/M와 비교.

지원되는 제공업체

  • OpenAI — GPT-4o, GPT-4o-mini

  • Anthropic — Claude Sonnet 4.6, Claude Haiku 4.5

  • Groq — Llama-70B, Llama-8B, Mixtral-8x7B

  • Together AI — Llama-70B, Llama-8B, DeepSeek-V3

  • DeepInfra — 75개 이상의 모델 실시간 API 가격 (Llama, DeepSeek, Qwen, Mistral, Gemma 등)

  • Fireworks AI — Llama-70B, Llama-8B, DeepSeek-V3

  • Cerebras — Llama-3.1-8B, Qwen-3-235B

  • Hyperbolic — DeepSeek-V3, DeepSeek-R1, Llama-70B, Llama-8B

  • Akash — H100 및 A100 기반 Llama-70B, Llama-8B (실시간 GPU 가격)

텔레메트리

Volt는 라우팅 추천을 개선하기 위해 기본적으로 익명화된 사용 메타데이터를 수집합니다. 여기에는 제공업체 이름, 모델 이름, 도구 응답 시간, 성공/실패 상태가 포함됩니다.

수집되지 않는 정보: 프롬프트, 출력값, API 키, 토큰 수 또는 사용자를 식별할 수 있는 모든 콘텐츠. IP 주소는 서버 측에서 해시 처리 및 절단됩니다.

수집을 거부하려면 다음 환경 변수를 설정하세요:

VOLT_OBSERVATIONS=false

링크

라이선스

MIT

Related MCP Connectors

Related MCP Servers

  • F
    license
    Not graded
    quality
    D
    maintenance
    Provides real-time AI model pricing, cost estimation, and budget management tools to help agents understand and optimize their spending. It enables agents to compare costs across multiple providers and select the most cost-effective models for specific tasks.
    1
    -
  • A
    license
    A
    quality
    C
    maintenance
    Global price benchmarking for AI inference across 2,600+ SKUs from 47 vendors. Query live pricing, market indexes, and model specs via 8 tools. Free tier available.
    8
    53 npm
    MIT