Modelle

5.748 Modelle angezeigt. Die Beträge gelten pro der in jeder Zeile angegebenen Einheit.
ModellAnbieterKontextPreise
replicate/openai/gpt-4.1replicate—
Input

2,00 $ pro 1M tokens

niedrig
Output

8,00 $ pro 1M tokens

niedrig
replicate/openai/gpt-4.1-nanoreplicate—
Input

0,10 $ pro 1M tokens

niedrig
Output

0,40 $ pro 1M tokens

niedrig
replicate/openai/gpt-4.1-minireplicate—
Input

0,40 $ pro 1M tokens

niedrig
Output

1,60 $ pro 1M tokens

niedrig
replicate/openai/gpt-5-nanoreplicate—
Input

0,05 $ pro 1M tokens

niedrig
Output

0,40 $ pro 1M tokens

niedrig
replicate/openai/gpt-5-minireplicate—
Input

0,25 $ pro 1M tokens

niedrig
Output

2,00 $ pro 1M tokens

niedrig
replicate/google/gemini-2.5-flashreplicate—
Input

0,30 $ pro 1M tokens

niedrig
Output

2,50 $ pro 1M tokens

niedrig
replicate/openai/gpt-oss-120breplicate—
Input

0,18 $ pro 1M tokens

niedrig
Output

0,72 $ pro 1M tokens

niedrig
replicate/deepseek-ai/deepseek-v3.1replicate163.840
Input

0,672 $ pro 1M tokens

niedrig
Output

2,02 $ pro 1M tokens

niedrig
replicate/xai/grok-4replicate—
Input

7,20 $ pro 1M tokens

niedrig
Output

36,00 $ pro 1M tokens

niedrig
replicate/deepseek-ai/deepseek-r1replicate65.536
Input

3,75 $ pro 1M tokens

niedrig
Output

10,00 $ pro 1M tokens

niedrig
Output (reasoning)

10,00 $ pro 1M tokens

niedrig
rerank-english-v2.0cohere4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,002 $ pro query

niedrig
rerank-english-v3.0cohere4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,002 $ pro query

niedrig
rerank-multilingual-v2.0cohere4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,002 $ pro query

niedrig
rerank-multilingual-v3.0cohere4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,002 $ pro query

niedrig
rerank-v4.0-fastcohere32.768
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,002 $ pro query

niedrig
rerank-v4.0-procohere32.768
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,0025 $ pro query

niedrig
nvidia_nim/nvidia/nv-rerankqa-mistral-4b-v3nvidia-nim—
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,00 $ pro query

niedrig
nvidia_nim/nvidia/llama-3_2-nv-rerankqa-1b-v2nvidia-nim—
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,00 $ pro query

niedrig
nvidia_nim/ranking/nvidia/llama-3.2-nv-rerankqa-1b-v2nvidia-nim—
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
Query

0,00 $ pro query

niedrig
sagemaker/meta-textgeneration-llama-2-13bmeta4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
sagemaker/meta-textgeneration-llama-2-13b-fmeta4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
sagemaker/meta-textgeneration-llama-2-70bmeta4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
sagemaker/meta-textgeneration-llama-2-70b-b-fmeta4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
sagemaker/meta-textgeneration-llama-2-7bmeta4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig
sagemaker/meta-textgeneration-llama-2-7b-fmeta4.096
Input

0,00 $ pro 1M tokens

niedrig
Output

0,00 $ pro 1M tokens

niedrig

Zuletzt aktualisiert 11.10.2026, 02:04