Tous les modèles
MetaRapideDisponible

Llama 3.3 70B

meta-llama/llama-3.3-70b

Modèle fiable pour le chat et le RAG

rapideoutils
Entrée
0,11 $US
pour 1M de tokens
Sortie
0,34 $US
pour 1M de tokens
Réponse type
≈ 0,00028 $US
1k tokens en entrée, 500 en sortie
Contexte
128K
Contexte
Vitesse
120 tok/s
*
Jusqu’au premier token
0.5 s
*

* La vitesse et la latence sont indicatives.

Comment l’utiliser

Indiquez l’ID du modèle dans le champ model de n’importe quelle requête compatible OpenAI.

curl https://zelvimou.com/v1/chat/completions \
  -H "Authorization: Bearer sk-zelvimo-YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello! What can you do?"}]
  }'

Remplacez sk-zelvimo-YOUR_KEY par votre clé depuis la page Clés API.

Modèles similaires

  • Alibaba · Rapide

    Qwen3 Coder

    Modèle ouvert pour les agents dans votre IDE

    0,32 $US/ 1,05 $US

    Entrée / 1M · Sortie / 1M

    Contexte 256K140 tok/s
  • Anthropic · Rapide

    Claude Haiku 4.5

    Temporairement indisponible

    Un Claude rapide pour les gros volumes

    1,00 $US/ 5,00 $US

    Entrée / 1M · Sortie / 1M

    Contexte 200K150 tok/s