Meta's flagship open-weight model with 70 billion parameters. Strong multilingual capabilities with competitive performance on reasoning and coding benchmarks. Available for self-hosting and through various inference providers.
131K tokens
15
Kullanılabilir
En ucuz
Inference.net
$0.60/1M tokens
En hızlı
Groq
141ms TTFT
Anyscale, Baseten, Cerebras, Fireworks, Groq, Hyperbolic, Inference.net, Lambda, Nebius, NLP Cloud, Novita, Perplexity, SambaNova, SiliconFlow, Together AI
Toplam maliyete göre sıralanır (1M token başına giriş + çıkış). Sağlayıcı ayrıntılarını görmek için bir satır seçin.
| Sağlayıcı | Fiyat (1M başına) | Hız sınırları | Bölgeler | Durum | Gecikme |
|---|---|---|---|---|---|
Giriş: $0.30Çıkış: $0.30 | 60 RPM / 200K TPM | us-east-1eu-west-1 | Sağlıklı | 0ms | |
Giriş: $0.20Çıkış: $0.40 | 200 RPM / 800K TPM | us-east-1us-west-2 | Sorunlu | 0ms | |
Giriş: $0.35Çıkış: $0.35 | 60 RPM / 200K TPM | us-east-1 | Sağlıklı | 0ms | |
Giriş: $0.35Çıkış: $0.35 | 600 RPM / 1.0M TPM | ap-east-1global | Sağlıklı | 0ms | |
Giriş: $0.40Çıkış: $0.40 | 60 RPM / 200K TPM | us-west-2 | Sağlıklı | 0ms | |
Giriş: $0.50Çıkış: $0.50 | 600 RPM / 1.0M TPM | us-east-1us-west-2 | Sağlıklı | 0ms | |
Giriş: $0.50Çıkış: $0.50 | 60 RPM / 300K TPM | eu-west-1 | Sağlıklı | 0ms | |
Giriş: $0.60Çıkış: $0.60 | 30 RPM / 60K TPM | us-east-1 | Sağlıklı | 0ms | |
Giriş: $0.60Çıkış: $0.60 | 100 RPM / 500K TPM | us-west-2 | Sağlıklı | 0ms | |
Giriş: $0.65Çıkış: $0.65 | 120 RPM / 500K TPM | us-east-1us-west-2 | Sağlıklı | 0ms | |
Giriş: $0.59Çıkış: $0.79 | 30 RPM / 100K TPM | us-east-1eu-west-1 | Sağlıklı | 141ms | |
Giriş: $0.88Çıkış: $0.88 | 600 RPM / 1.0M TPM | us-east-1us-west-2 | Sağlıklı | 0ms | |
Giriş: $0.90Çıkış: $0.90 | 600 RPM / 1.0M TPM | us-east-1us-west-2 | Sağlıklı | 0ms | |
Giriş: $1.00Çıkış: $1.00 | 100 RPM / 200K TPM | us-east-1us-west-2 | Sağlıklı | 0ms | |
Giriş: $1.20Çıkış: $1.20 | 60 RPM / 200K TPM | us-east-1eu-west-1 | Sağlıklı | 0ms |
Bu modeli Inference.net üzerinden OpenAI uyumlu bir SDK ile kullanın.
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.inference-net.com/v1",
apiKey: process.env.INFERENCE_NET_API_KEY,
});
const response = await client.chat.completions.create({
model: "meta-llama/Llama-3.3-70B-Instruct",
messages: [
{ role: "user", content: "Hello!" }
],
});
console.log(response.choices[0].message.content);Inference.net API kullanılıyor · OpenAI uyumlu SDK