{"source":"BenchGecko","url":"https://benchgecko.ai/model/llama-3-3-70b-instruct","as_of":"2026-10-05","license":"BenchGecko collected data (prices, provider offers, Gecko Tests) is CC BY 4.0 · https://creativecommons.org/licenses/by/4.0/. Benchmark scores belong to their original publishers (see sources) and are aggregated with attribution. Attribution required: \"Source: BenchGecko\" with a link.","attribution":"Source: BenchGecko · https://benchgecko.ai/model/llama-3-3-70b-instruct","cite":"Llama 3.3 70B Instruct · benchmarks, pricing and providers. BenchGecko, data as of 2026-10-05. https://benchgecko.ai/model/llama-3-3-70b-instruct","slug":"llama-3-3-70b-instruct","name":"Llama 3.3 70B Instruct","provider":{"name":"Meta","slug":"meta"},"model_type":"text","release_date":"2024-12-06","is_open_source":true,"status":"active","context_window":131072,"description":"The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). The Llama 3.3 instruction tuned text only model...","benchgecko_score":{"value":47.9,"rank":157,"of":312,"method":"Normalized average of public benchmark scores","method_url":"https://benchgecko.ai/methodology"},"avg_score":47.9,"list_price":{"input_usd_per_m":0.1,"output_usd_per_m":0.32,"source":"OpenRouter models API (checked daily)","as_of":"2026-10-05"},"pricing":{"input":0.1,"output":0.32},"providers":[{"provider":"DeepInfra","endpoint":"deepinfra/turbo","quantization":"fp8","context_tokens":131072,"input_usd_per_m":0.1,"output_usd_per_m":0.32,"cache_read_usd_per_m":null,"uptime_1d_pct":99.34,"as_of":"2026-10-05"},{"provider":"Novita","endpoint":"novita/bf16","quantization":"bf16","context_tokens":12288,"input_usd_per_m":0.135,"output_usd_per_m":0.4,"cache_read_usd_per_m":null,"uptime_1d_pct":95.68,"as_of":"2026-10-05"},{"provider":"AkashML","endpoint":"akashml/fp8","quantization":"fp8","context_tokens":131072,"input_usd_per_m":0.2,"output_usd_per_m":0.52,"cache_read_usd_per_m":0.1,"uptime_1d_pct":99.6,"as_of":"2026-10-05"},{"provider":"Parasail","endpoint":"parasail/fp8","quantization":"fp8","context_tokens":131072,"input_usd_per_m":0.22,"output_usd_per_m":0.5,"cache_read_usd_per_m":0.11,"uptime_1d_pct":99.41,"as_of":"2026-10-05"},{"provider":"Cloudflare","endpoint":"cloudflare/fp8","quantization":"fp8","context_tokens":24000,"input_usd_per_m":0.293,"output_usd_per_m":2.253,"cache_read_usd_per_m":null,"uptime_1d_pct":96.18,"as_of":"2026-10-05"},{"provider":"SambaNova","endpoint":"sambanova-turbo","quantization":null,"context_tokens":131072,"input_usd_per_m":0.45,"output_usd_per_m":0.9,"cache_read_usd_per_m":null,"uptime_1d_pct":99.43,"as_of":"2026-10-05"},{"provider":"Groq","endpoint":"groq","quantization":null,"context_tokens":131072,"input_usd_per_m":0.59,"output_usd_per_m":0.79,"cache_read_usd_per_m":0.295,"uptime_1d_pct":99.81,"as_of":"2026-10-05"},{"provider":"CoreWeave","endpoint":"coreweave/fp16","quantization":"fp16","context_tokens":128000,"input_usd_per_m":0.71,"output_usd_per_m":0.71,"cache_read_usd_per_m":0.71,"uptime_1d_pct":99.5,"as_of":"2026-10-05"},{"provider":"Google","endpoint":"google-vertex","quantization":null,"context_tokens":128000,"input_usd_per_m":0.72,"output_usd_per_m":0.72,"cache_read_usd_per_m":null,"uptime_1d_pct":null,"as_of":"2026-10-05"},{"provider":"Google","endpoint":"google-vertex/us-central1","quantization":null,"context_tokens":128000,"input_usd_per_m":0.72,"output_usd_per_m":0.72,"cache_read_usd_per_m":null,"uptime_1d_pct":null,"as_of":"2026-10-05"},{"provider":"Together","endpoint":"together","quantization":null,"context_tokens":131072,"input_usd_per_m":1.04,"output_usd_per_m":1.04,"cache_read_usd_per_m":null,"uptime_1d_pct":97.5,"as_of":"2026-10-05"}],"cheapest_provider":{"provider":"DeepInfra","endpoint":"deepinfra/turbo","quantization":"fp8","context_tokens":131072,"input_usd_per_m":0.1,"output_usd_per_m":0.32,"cache_read_usd_per_m":null,"uptime_1d_pct":99.34,"as_of":"2026-10-05"},"providers_source":"OpenRouter endpoints API, one row per provider, refreshed daily","scores":[{"benchmark":"Chatbot Arena Elo — Overall","benchmark_slug":"arena-elo-overall","score":1317.8,"unit":"elo","category":"arena","source":"LMArena","source_url":"https://lmarena.ai/leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/arena-elo-overall"},{"benchmark":"IFEval","benchmark_slug":"hf-ifeval","score":89.98,"unit":"%","category":"language","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-ifeval"},{"benchmark":"MMLU","benchmark_slug":"mmlu","score":81.73,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/mmlu"},{"benchmark":"Aider — Code Editing","benchmark_slug":"aider-edit","score":59.4,"unit":"%","category":"coding","source":"Aider leaderboards","source_url":"https://aider.chat/docs/leaderboards/","benchmark_url":"https://benchgecko.ai/benchmark/aider-edit"},{"benchmark":"BBH (HuggingFace)","benchmark_slug":"hf-bbh","score":56.56,"unit":"%","category":"general","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-bbh"},{"benchmark":"MATH Level 5","benchmark_slug":"hf-math-lvl5","score":48.34,"unit":"%","category":"math","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-math-lvl5"},{"benchmark":"MMLU-PRO","benchmark_slug":"hf-mmlu-pro","score":48.13,"unit":"%","category":"knowledge","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-mmlu-pro"},{"benchmark":"MATH level 5","benchmark_slug":"math-level-5","score":41.6,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/math-level-5"},{"benchmark":"Fiction.LiveBench","benchmark_slug":"fiction-livebench","score":33.3,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/fiction-livebench"},{"benchmark":"Dtbench","benchmark_slug":"dtbench","score":32.45,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/dtbench"},{"benchmark":"GPQA diamond","benchmark_slug":"gpqa-diamond","score":29.92,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/gpqa-diamond"},{"benchmark":"Balrog","benchmark_slug":"balrog","score":23,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/balrog"},{"benchmark":"Lmca","benchmark_slug":"lmca","score":20.61,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/lmca"},{"benchmark":"MUSR","benchmark_slug":"hf-musr","score":15.57,"unit":"%","category":"reasoning","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-musr"},{"benchmark":"WeirdML","benchmark_slug":"weirdml","score":14.44,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/weirdml"},{"benchmark":"GPQA","benchmark_slug":"hf-gpqa","score":10.51,"unit":"%","category":"knowledge","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-gpqa"},{"benchmark":"OTIS Mock AIME 2024-2025","benchmark_slug":"otis-mock-aime-2024-2025","score":5.04,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/otis-mock-aime-2024-2025"},{"benchmark":"SimpleBench","benchmark_slug":"simplebench","score":3.88,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/simplebench"}],"gecko_tests":null,"links":{"page":"https://benchgecko.ai/model/llama-3-3-70b-instruct","json":"https://benchgecko.ai/api/v1/models/llama-3-3-70b-instruct","price_history":"https://benchgecko.ai/api/v1/price-history/llama-3-3-70b-instruct","provider_prices":"https://benchgecko.ai/pricing/arbitrage/llama-3-3-70b-instruct"}}