Meta's flagship open-weight model with 70 billion parameters. Strong multilingual capabilities with competitive performance on reasoning and coding benchmarks. Available for self-hosting and through various inference providers.
Cheapest
Inference.net
$0.30 / $0.30
Anyscale, Baseten, Cerebras, Fireworks, Groq, Hyperbolic, Inference.net, Lambda, Nebius, NLP Cloud, Novita, Perplexity, SambaNova, SiliconFlow, Together AI
Sorted by total cost (input + output per 1M tokens). Select a row to view provider details.
| Provider | Pricing (per 1M) | Rate limits | Regions | Health | Latency |
|---|---|---|---|---|---|
In: $0.30Out: $0.30 | 60 RPM / 200K TPM | us-east-1eu-west-1 | Healthy | 0ms | |
In: $0.20Out: $0.40 | 200 RPM / 800K TPM | us-east-1us-west-2 | Unhealthy | 0ms | |
In: $0.35Out: $0.35 | 60 RPM / 200K TPM | us-east-1 | Healthy | 0ms | |
In: $0.35Out: $0.35 | 600 RPM / 1.0M TPM | ap-east-1global | Healthy | 0ms | |
In: $0.40Out: $0.40 | 60 RPM / 200K TPM | us-west-2 | Healthy | 0ms | |
In: $0.50Out: $0.50 | 600 RPM / 1.0M TPM | us-east-1us-west-2 | Healthy | 0ms | |
In: $0.50Out: $0.50 | 60 RPM / 300K TPM | eu-west-1 | Healthy | 0ms | |
In: $0.60Out: $0.60 | 30 RPM / 60K TPM | us-east-1 | Healthy | 0ms | |
In: $0.60Out: $0.60 | 100 RPM / 500K TPM | us-west-2 | Healthy | 0ms | |
In: $0.65Out: $0.65 | 120 RPM / 500K TPM | us-east-1us-west-2 | Healthy | 0ms | |
In: $0.59Out: $0.79 | 30 RPM / 100K TPM | us-east-1eu-west-1 | Healthy | 0ms | |
In: $0.88Out: $0.88 | 600 RPM / 1.0M TPM | us-east-1us-west-2 | Healthy | 0ms | |
In: $0.90Out: $0.90 | 600 RPM / 1.0M TPM | us-east-1us-west-2 | Healthy | 0ms | |
In: $1.00Out: $1.00 | 100 RPM / 200K TPM | us-east-1us-west-2 | Healthy | 0ms | |
In: $1.20Out: $1.20 | 60 RPM / 200K TPM | us-east-1eu-west-1 | Healthy | 0ms |
Use this model via Inference.net with an OpenAI-compatible SDK.
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.inference-net.com/v1",
apiKey: process.env.INFERENCE_NET_API_KEY,
});
const response = await client.chat.completions.create({
model: "meta-llama/Llama-3.3-70B-Instruct",
messages: [
{ role: "user", content: "Hello!" }
],
});
console.log(response.choices[0].message.content);Using Inference.net API · OpenAI-compatible SDK
Every price recorded for this model, per provider. Prices are per 1M tokens in USD.
No price changes recorded since Jan 10, 2025.
| Date | Provider | Input | Output |
|---|---|---|---|
| May 25, 2026Listed · Current | Lambda | $0.20 | $0.40 |
| May 11, 2026Listed · Current | SiliconFlow | $0.35 | $0.35 |
| May 11, 2026Listed · Current | Perplexity | $1.00 | $1.00 |
| May 11, 2026Listed · Current | Anyscale | $0.50 | $0.50 |
| May 1, 2026Listed · Current | Together AI | $0.88 | $0.88 |
| May 1, 2026Listed · Current | Groq | $0.59 | $0.79 |
| May 1, 2026Listed · Current | Cerebras | $0.60 | $0.60 |
| Jan 10, 2025Listed · Current | SambaNova | $0.60 | $0.60 |
| Jan 10, 2025Listed · Current | Novita | $0.35 | $0.35 |
| Jan 10, 2025Listed · Current | NLP Cloud | $1.20 | $1.20 |
| Jan 10, 2025Listed · Current | Nebius | $0.50 | $0.50 |
| Jan 10, 2025Listed · Current | Inference.net | $0.30 | $0.30 |
| Jan 10, 2025Listed · Current | Hyperbolic | $0.40 | $0.40 |
| Jan 10, 2025Listed · Current | Fireworks | $0.90 | $0.90 |
| Jan 10, 2025Listed · Current | Baseten | $0.65 | $0.65 |