全部模型
Meta快速可用

Llama 3.3 70B

meta-llama/llama-3.3-70b

可靠的聊天与 RAG 主力模型

快速工具
输入
US$0.11
每 100 万 token
输出
US$0.34
每 100 万 token
典型回复
≈ US$0.00028
输入 1k token,输出 500
上下文
128K
上下文
速度
120 tok/s
*
首 token 延迟
0.5 秒
*

* 速度和延迟为近似值。

如何使用

在任何兼容 OpenAI 的请求中,把模型 ID 填入 model 字段即可。

curl https://zelvimou.com/v1/chat/completions \
  -H "Authorization: Bearer sk-zelvimo-YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello! What can you do?"}]
  }'

请将 sk-zelvimo-YOUR_KEY 替换为「API 密钥」页面中的密钥。

相似模型

  • Alibaba · 快速

    Qwen3 Coder

    适合 IDE 智能体的开源模型

    US$0.32/ US$1.05

    输入 / 1M · 输出 / 1M

    上下文 256K140 tok/s
  • Anthropic · 快速

    Claude Haiku 4.5

    暂时不可用

    快速版 Claude,适合大批量任务

    US$1.00/ US$5.00

    输入 / 1M · 输出 / 1M

    上下文 200K150 tok/s