Endpoint / deepinfra-meta-llama-meta-llama-3-1-70b-instruct-turbo

Meta Llama 3 1 70b Instruct Turbo

served by DeepInfra

Default workload estimate$0.801M input + 1M output tokens
Provider model ID
meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
Protocol
openai chat completions
Region
global
Status
active
Base URL
https://api.deepinfra.com/v1/openai

Current offers

Price components

Exact source values; no hidden currency conversion.

Standard on demandon demand
$0.80
input tokens$0.40per million tokens
output tokens$0.40per million tokens

Provider assertions

Claims

capability · reasoning

unsupported · 1 source assertion

compatibility · structured outputs

supported · 1 source assertion

compatibility · tools

supported · 1 source assertion

limits · context tokens

reported · 1 source assertion

runtime · quantization

reported · 1 source assertion

Independent checks

Observations

0

independent observations · probes begin in Stage 2

Immutable record

Pricing history

Newest observed values first.

ObservedOfferComponentPriceSnapshot
Standard on demandinput tokens$0.40bb193c809d
Standard on demandoutput tokens$0.40bb193c809d
Standard on demandinput tokens$0.4018b5cfc8cd
Standard on demandoutput tokens$0.4018b5cfc8cd
Standard on demandinput tokens$0.406a13d395e4
Standard on demandoutput tokens$0.406a13d395e4
Standard on demandinput tokens$0.40a0c2739383
Standard on demandoutput tokens$0.40a0c2739383