KI-Modell-Zeitleiste

2026-07-16

Kimi K3Mehr erfahren

Kimi / Moonshot AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,048,576 tokens
Max Output:128,000 tokens
Price:$0.003/1K input, $0.015/1K output
2026-07-16

Muse Spark 1.1Mehr erfahren

Meta AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,048,576 tokens
Max Output:128,000 tokens
Price:$0.00125/1K input, $0.00425/1K output
2026-07-10

KAT Coder Pro V2.5Mehr erfahren

KwaiPilot
Parameters
-
Context Length
256,000 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:256,000 tokens
Max Output:80,000 tokens
Price:$0.00074/1K input, $0.00296/1K output
2026-07-10

KAT Coder Air V2.5Mehr erfahren

KwaiPilot
Parameters
-
Context Length
256,000 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:256,000 tokens
Max Output:80,000 tokens
Price:$0.00015/1K input, $0.0006/1K output
2026-07-09

GPT 5.6 SolMehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.005/1K input, $0.03/1K output
2026-07-09

GPT 5.6 Sol ProMehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.005/1K input, $0.03/1K output
2026-07-09

GPT 5.6 TerraMehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.0025/1K input, $0.015/1K output
2026-07-09

GPT 5.6 Terra ProMehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.0025/1K input, $0.015/1K output
2026-07-09

GPT 5.6 Luna ProMehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.001/1K input, $0.006/1K output
2026-07-09

GPT 5.6 LunaMehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.001/1K input, $0.006/1K output
2026-07-08

Grok 4.5Mehr erfahren

xAI
Parameters
-
Context Length
500,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:500,000 tokens
Max Output:128,000 tokens
Price:$0.002/1K input, $0.006/1K output
2026-07-07

Aion 3.0Mehr erfahren

AionLabs
Parameters
-
Context Length
131,072 tokens
Response Speed
-
Input Speed
-
Chat
Max Input:131,072 tokens
Max Output:32,768 tokens
Price:$0.003/1K input, $0.006/1K output
2026-07-07

Aion 3.0 MiniMehr erfahren

AionLabs
Parameters
-
Context Length
131,072 tokens
Response Speed
-
Input Speed
-
Chat
Max Input:131,072 tokens
Max Output:32,768 tokens
Price:$0.0007/1K input, $0.0014/1K output
2026-07-06

Tencent Hy3Mehr erfahren

Tencent
Parameters
295B / 21B active
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:262,144 tokens
Max Output:131,072 tokens
Price:$0.0002/1K input, $0.0008/1K output
2026-07-02

Poolside Laguna XS 2.1Mehr erfahren

Poolside
Parameters
-
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:262,144 tokens
Max Output:32,768 tokens
Price:$0.00006/1K input, $0.00012/1K output
2026-06-30

Claude Sonnet 5Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.002/1K input, $0.01/1K output
2026-06-30

Nano Banana 2 LiteMehr erfahren

Google AI
Parameters
-
Context Length
65,536 tokens
Response Speed
-
Input Speed
-
Vision
Max Input:65,536 tokens
Max Output:65,536 tokens
Price:$0.00025/1K input, $0.0015/1K output
2026-06-24

Nex N2 MiniMehr erfahren

Nex AGI
Parameters
-
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:262,144 tokens
Price:$0.000025/1K input, $0.0001/1K output
2026-06-24

Fugu UltraMehr erfahren

Sakana AI
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.005/1K input, $0.03/1K output
2026-06-16

GLM 5.2Mehr erfahren

GLM / Z.ai
Parameters
-
Context Length
1,048,576 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:1,048,576 tokens
Max Output:131,072 tokens
Price:$0.0009016/1K input, $0.0028336/1K output
2026-06-12

Kimi K2.7 CodeMehr erfahren

Kimi / Moonshot AI
Parameters
-
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:262,144 tokens
Price:$0.00075/1K input, $0.0035/1K output
2026-06-09

Claude Fable 5Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.01/1K input, $0.05/1K output
2026-06-08

Nex N2 ProMehr erfahren

Nex AGI
Parameters
397B / 17B active
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:262,144 tokens
Price:$0.00025/1K input, $0.001/1K output
2026-06-04

Nemotron 3 UltraMehr erfahren

NVIDIA
Parameters
550B / 55B active
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.0006/1K input, $0.0036/1K output
2026-06-03

Qwen3.7 PlusMehr erfahren

Qwen / Alibaba Cloud
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:65,536 tokens
Price:$0.00032/1K input, $0.00128/1K output
2026-05-31

MiniMax M3Mehr erfahren

MiniMax
Parameters
-
Context Length
1,048,576 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,048,576 tokens
Max Output:512,000 tokens
Price:$0.0003/1K input, $0.0012/1K output
2026-05-28

Claude Opus 4.8Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.005/1K input, $0.025/1K output
2026-05-28

Step 3.7 FlashMehr erfahren

StepFun
Parameters
196B MoE
Context Length
256,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:256,000 tokens
Max Output:256,000 tokens
Price:$0.0002/1K input, $0.00115/1K output
2026-05-27

Claude Opus 4.8 FastMehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.01/1K input, $0.05/1K output
2026-05-21

Qwen3.7 MaxMehr erfahren

Qwen / Alibaba Cloud
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:1,000,000 tokens
Max Output:65,536 tokens
Price:$0.001475/1K input, $0.004425/1K output
2026-05-19

Gemini 3.5 FlashMehr erfahren

Google AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
200 tokens/s
Input Speed
20000 tokens/s
Chat
Vision
Code
Max Input:1,048,576 tokens
Max Output:65,536 tokens
Price:$0.0015/1K input, $0.009/1K output
2026-05-19

Grok Build 0.1Mehr erfahren

xAI
Parameters
-
Context Length
256,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:256,000 tokens
Max Output:65,536 tokens
Price:$0.001/1K input, $0.002/1K output
2026-05-12

Perceptron Mk1Mehr erfahren

Perceptron
Parameters
-
Context Length
32,768 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Max Input:32,768 tokens
Max Output:8,192 tokens
Price:$0.00015/1K input, $0.0015/1K output
2026-05-08

Ring 2.6 1TMehr erfahren

InclusionAI
Parameters
1T / 63B active
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.000075/1K input, $0.000625/1K output
2026-05-07

Gemini 3.1 Flash-LiteMehr erfahren

Google AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Max Input:1,048,576 tokens
Max Output:65,536 tokens
Price:$0.00025/1K input, $0.0015/1K output
2026-04-30

Mistral Medium 3.5Mehr erfahren

Mistral
Parameters
-
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.0015/1K input, $0.0075/1K output
2026-04-30

Grok 4.3Mehr erfahren

xAI
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:128,000 tokens
Price:$0.00125/1K input, $0.0025/1K output
2026-04-30

Granite 4.1 8BMehr erfahren

IBM
Parameters
8B
Context Length
131,072 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:131,072 tokens
Max Output:131,072 tokens
Price:$0.00005/1K input, $0.0001/1K output
2026-04-28

Poolside Laguna M.1Mehr erfahren

Poolside
Parameters
-
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:262,144 tokens
Max Output:32,768 tokens
Price:$0.0002/1K input, $0.0004/1K output
2026-04-27

Qwen3.6 FlashMehr erfahren

Qwen / Alibaba Cloud
Parameters
-
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:65,536 tokens
Price:$0.0001875/1K input, $0.001125/1K output
2026-04-27

Qwen3.6 27BMehr erfahren

Qwen / Alibaba Cloud
Parameters
27B
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.00045/1K input, $0.0027/1K output
2026-04-25

GPT 5.5Mehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
130 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.0025/1K input, $0.015/1K output
2026-04-24

DeepSeek V4 ProMehr erfahren

DeepSeek
Parameters
1.6T / 49B active
Context Length
1,000,000 tokens
Response Speed
130 tokens/s
Input Speed
14000 tokens/s
Chat
Code
Max Input:1,000,000 tokens
Max Output:65,536 tokens
Price:$0.000435/1K input, $0.00087/1K output
2026-04-24

DeepSeek V4 FlashMehr erfahren

DeepSeek
Parameters
284B / 13B active
Context Length
1,000,000 tokens
Response Speed
180 tokens/s
Input Speed
18000 tokens/s
Chat
Code
Max Input:1,000,000 tokens
Max Output:65,536 tokens
Price:$0.0001/1K input, $0.0003/1K output
2026-04-22

Claude Opus 4.7Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
105 tokens/s
Input Speed
8000 tokens/s
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:64,000 tokens
Price:$0.005/1K input, $0.025/1K output
2026-04-21

GPT Image 2Mehr erfahren

OpenAI
Parameters
-
Context Length
-
Response Speed
-
Input Speed
-
Max Input:-
Max Output:-
Price:$0.01/1K input, $0.04/1K output
2026-04-21

GPT-5.4 Image 2Mehr erfahren

OpenAI
Parameters
-
Context Length
272,000 tokens
Response Speed
-
Input Speed
-
Vision
Max Input:-
Max Output:-
Price:$0.008/1K input, $0.015/1K output
2026-04-20

Kimi K2.6Mehr erfahren

Kimi / Moonshot AI
Parameters
15T continued pretraining
Context Length
262,144 tokens
Response Speed
180 tokens/s
Input Speed
19000 tokens/s
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.00045/1K input, $0.0022/1K output
2026-04-18

Qwen3.6-35B-A3BMehr erfahren

Qwen / Alibaba Cloud
Parameters
35B / 3B active
Context Length
262,144 tokens
Response Speed
200 tokens/s
Input Speed
19000 tokens/s
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.0001625/1K input, $0.0013/1K output
2026-04-15

MiniMax M2.7Mehr erfahren

MiniMax
Parameters
-
Context Length
196,608 tokens
Response Speed
180 tokens/s
Input Speed
18000 tokens/s
Chat
Code
Max Input:196,608 tokens
Max Output:65,536 tokens
Price:$0.000295/1K input, $0.0012/1K output
2026-03-31

Grok 4.20Mehr erfahren

xAI
Parameters
-
Context Length
2,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:2,000,000 tokens
Max Output:128,000 tokens
Price:$0.00125/1K input, $0.0025/1K output
2026-03-31

Grok 4.20 Multi-AgentMehr erfahren

xAI
Parameters
-
Context Length
2,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Code
Max Input:2,000,000 tokens
Max Output:128,000 tokens
Price:$0.00125/1K input, $0.0025/1K output
2026-03-16

Mistral Small 4Mehr erfahren

Mistral
Parameters
119B / 6.5B active
Context Length
262,144 tokens
Response Speed
-
Input Speed
-
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.00015/1K input, $0.0006/1K output
2026-03-15

GLM 5 TurboMehr erfahren

GLM / Z.ai
Parameters
-
Context Length
202,752 tokens
Response Speed
180 tokens/s
Input Speed
16000 tokens/s
Chat
Code
Max Input:202,752 tokens
Max Output:65,536 tokens
Price:$0.00096/1K input, $0.0032/1K output
2026-03-05

GPT 5.4Mehr erfahren

OpenAI
Parameters
-
Context Length
1,050,000 tokens
Response Speed
120 tokens/s
Input Speed
11000 tokens/s
Chat
Vision
Code
Max Input:1,050,000 tokens
Max Output:128,000 tokens
Price:$0.0025/1K input, $0.015/1K output
2026-03-05

GPT 5.4 MiniMehr erfahren

OpenAI
Parameters
-
Context Length
400,000 tokens
Response Speed
180 tokens/s
Input Speed
15000 tokens/s
Chat
Vision
Code
Max Input:400,000 tokens
Max Output:128,000 tokens
Price:$0.00075/1K input, $0.0045/1K output
2026-03-05

GPT 5.4 NanoMehr erfahren

OpenAI
Parameters
-
Context Length
400,000 tokens
Response Speed
220 tokens/s
Input Speed
18000 tokens/s
Chat
Code
Max Input:400,000 tokens
Max Output:128,000 tokens
Price:$0.0002/1K input, $0.00125/1K output
2026-02-19

Gemini 3.1 Pro PreviewMehr erfahren

Google AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
140 tokens/s
Input Speed
14000 tokens/s
Chat
Vision
Code
Max Input:1,048,576 tokens
Max Output:65,536 tokens
Price:$0.002/1K input, $0.012/1K output
2026-02-18

Qwen3.5-35B-A3BMehr erfahren

Qwen / Alibaba Cloud
Parameters
35B / 3B active
Context Length
262,144 tokens
Response Speed
190 tokens/s
Input Speed
18000 tokens/s
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.0001625/1K input, $0.0013/1K output
2026-02-18

Qwen3.5-9BMehr erfahren

Qwen / Alibaba Cloud
Parameters
9B
Context Length
262,144 tokens
Response Speed
240 tokens/s
Input Speed
24000 tokens/s
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.0001/1K input, $0.00015/1K output
2026-02-17

Claude Sonnet 4.6Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
120 tokens/s
Input Speed
9000 tokens/s
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:64,000 tokens
Price:$0.003/1K input, $0.015/1K output
2026-02-12

Nano Banana 2Mehr erfahren

Google AI
Parameters
-
Context Length
-
Response Speed
-
Input Speed
-
Vision
Max Input:-
Max Output:-
Price:$0.0005/1K input, $0.003/1K output
2026-02-12

MiniMax M2.5Mehr erfahren

MiniMax
Parameters
-
Context Length
196,608 tokens
Response Speed
170 tokens/s
Input Speed
17000 tokens/s
Chat
Code
Max Input:196,608 tokens
Max Output:65,536 tokens
Price:$0.000295/1K input, $0.0012/1K output
2026-02-11

GLM 5Mehr erfahren

GLM / Z.ai
Parameters
-
Context Length
202,752 tokens
Response Speed
140 tokens/s
Input Speed
13000 tokens/s
Chat
Code
Max Input:202,752 tokens
Max Output:65,536 tokens
Price:$0.00072/1K input, $0.0023/1K output
2026-02-04

Claude Opus 4.6Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
100 tokens/s
Input Speed
8000 tokens/s
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:64,000 tokens
Price:$0.005/1K input, $0.025/1K output
2026-02-04

Qwen3 Coder NextMehr erfahren

Qwen / Alibaba Cloud
Parameters
80B / 3B active
Context Length
262,144 tokens
Response Speed
220 tokens/s
Input Speed
22000 tokens/s
Chat
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.00012/1K input, $0.00075/1K output
2026-02-01

GPT 5.3 CodexMehr erfahren

OpenAI
Parameters
-
Context Length
400,000 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Code
Max Input:400,000 tokens
Max Output:128,000 tokens
Price:$0.00175/1K input, $0.014/1K output
2026-01-27

Kimi K2.5Mehr erfahren

Kimi / Moonshot AI
Parameters
15T continued pretraining
Context Length
262,144 tokens
Response Speed
170 tokens/s
Input Speed
18000 tokens/s
Chat
Vision
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.00045/1K input, $0.0022/1K output
2026-01-19

GLM 4.7Mehr erfahren

GLM / Z.ai
Parameters
-
Context Length
202,752 tokens
Response Speed
160 tokens/s
Input Speed
15000 tokens/s
Chat
Code
Max Input:202,752 tokens
Max Output:65,536 tokens
Price:$0.0006/1K input, $0.0022/1K output
2026-01-19

GLM 4.7 FlashMehr erfahren

GLM / Z.ai
Parameters
-
Context Length
202,752 tokens
Response Speed
220 tokens/s
Input Speed
22000 tokens/s
Chat
Code
Max Input:202,752 tokens
Max Output:65,536 tokens
Price:$0.00006/1K input, $0.0004/1K output
2025-12-17

Gemini 3 Flash PreviewMehr erfahren

Google AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
190 tokens/s
Input Speed
18000 tokens/s
Chat
Vision
Max Input:1,048,576 tokens
Max Output:65,536 tokens
Price:$0.0005/1K input, $0.003/1K output
2025-12-11

GPT 5.2Mehr erfahren

OpenAI
Parameters
280B
Context Length
128,000 tokens
Response Speed
180 tokens/s
Input Speed
13000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:16,384 tokens
Price:$0.00025/1K input, $0.0005/1K output
2025-12-08

GLM 4.6VMehr erfahren

GLM / Z.ai
Parameters
-
Context Length
131,072 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Code
Max Input:131,072 tokens
Max Output:65,536 tokens
Price:$0.0003/1K input, $0.0009/1K output
2025-11-20

Nano Banana ProMehr erfahren

Google AI
Parameters
-
Context Length
65,536 tokens
Response Speed
-
Input Speed
-
Vision
Max Input:-
Max Output:-
Price:$0.002/1K input, $0.012/1K output
2025-11-06

Kimi K2 ThinkingMehr erfahren

Kimi / Moonshot AI
Parameters
1T MoE / 32B active
Context Length
131,072 tokens
Response Speed
130 tokens/s
Input Speed
13000 tokens/s
Chat
Code
Max Input:131,072 tokens
Max Output:81,920 tokens
Price:$0.00047/1K input, $0.002/1K output
2025-11-01

GPT 5.1Mehr erfahren

OpenAI
Parameters
250B
Context Length
128,000 tokens
Response Speed
170 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:8,192 tokens
Price:$0.0002/1K input, $0.0004/1K output
2025-10-15

Claude Haiku 4.5Mehr erfahren

Anthropic
Parameters
-
Context Length
200,000 tokens
Response Speed
170 tokens/s
Input Speed
14000 tokens/s
Chat
Vision
Code
Max Input:200,000 tokens
Max Output:64,000 tokens
Price:$0.001/1K input, $0.005/1K output
2025-09-29

Claude Sonnet 4.5Mehr erfahren

Anthropic
Parameters
-
Context Length
1,000,000 tokens
Response Speed
120 tokens/s
Input Speed
9000 tokens/s
Chat
Vision
Code
Max Input:1,000,000 tokens
Max Output:64,000 tokens
Price:$0.003/1K input, $0.015/1K output
2025-08-26

Nano BananaMehr erfahren

Google AI
Parameters
-
Context Length
-
Response Speed
-
Input Speed
-
Vision
Max Input:-
Max Output:-
Price:$0.0003/1K input, $0.0025/1K output
2025-08-21

DeepSeek V3.1Mehr erfahren

DeepSeek
Parameters
671B / 37B active
Context Length
131,072 tokens
Response Speed
180 tokens/s
Input Speed
18000 tokens/s
Chat
Code
Max Input:131,072 tokens
Max Output:65,536 tokens
Price:$0.00015/1K input, $0.00075/1K output
2025-08-09

GPT 5Mehr erfahren

OpenAI
Parameters
220B
Context Length
128,000 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:4,096 tokens
Price:$0.00015/1K input, $0.0003/1K output
2025-08-07

GPT 5 MiniMehr erfahren

OpenAI
Parameters
-
Context Length
400,000 tokens
Response Speed
180 tokens/s
Input Speed
15000 tokens/s
Chat
Vision
Code
Max Input:400,000 tokens
Max Output:128,000 tokens
Price:$0.00025/1K input, $0.002/1K output
2025-08-07

GPT 5 NanoMehr erfahren

OpenAI
Parameters
-
Context Length
400,000 tokens
Response Speed
220 tokens/s
Input Speed
18000 tokens/s
Chat
Code
Max Input:400,000 tokens
Max Output:64,000 tokens
Price:$0.00005/1K input, $0.0004/1K output
2025-08-05

gpt-oss-120bMehr erfahren

OpenAI
Parameters
117B / 5.1B active
Context Length
131,072 tokens
Response Speed
170 tokens/s
Input Speed
15000 tokens/s
Chat
Code
Max Input:131,072 tokens
Max Output:65,536 tokens
Price:$0.000039/1K input, $0.00019/1K output
2025-07-25

Qwen3 235B A22B Thinking 2507Mehr erfahren

Qwen / Alibaba Cloud
Parameters
235B / 22B active
Context Length
262,144 tokens
Response Speed
130 tokens/s
Input Speed
13000 tokens/s
Chat
Code
Max Input:262,144 tokens
Max Output:81,920 tokens
Price:$0.00011/1K input, $0.0006/1K output
2025-07-23

Qwen3 Coder 480B A35BMehr erfahren

Qwen / Alibaba Cloud
Parameters
480B / 35B active
Context Length
262,144 tokens
Response Speed
170 tokens/s
Input Speed
16000 tokens/s
Chat
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.00022/1K input, $0.001/1K output
2025-07-21

Qwen3 235B A22B Instruct 2507Mehr erfahren

Qwen / Alibaba Cloud
Parameters
235B / 22B active
Context Length
262,144 tokens
Response Speed
180 tokens/s
Input Speed
17000 tokens/s
Chat
Code
Max Input:262,144 tokens
Max Output:65,536 tokens
Price:$0.000071/1K input, $0.0001/1K output
2025-07-11

Kimi K2Mehr erfahren

Kimi / Moonshot AI
Parameters
1T MoE / 32B active
Context Length
131,072 tokens
Response Speed
200 tokens/s
Input Speed
20000 tokens/s
Chat
Code
Max Input:131,072 tokens
Max Output:65,536 tokens
Price:$0.00055/1K input, $0.0022/1K output
2025-06-17

Gemini 2.5 FlashMehr erfahren

Google AI
Parameters
-
Context Length
1,048,576 tokens
Response Speed
180 tokens/s
Input Speed
18000 tokens/s
Chat
Vision
Max Input:1,048,576 tokens
Max Output:65,536 tokens
Price:$0.0003/1K input, $0.0025/1K output
2025-05-28

DeepSeek R1 0528Mehr erfahren

DeepSeek
Parameters
671B / 37B active
Context Length
163,840 tokens
Response Speed
120 tokens/s
Input Speed
12000 tokens/s
Chat
Code
Max Input:163,840 tokens
Max Output:65,536 tokens
Price:$0.00055/1K input, $0.00219/1K output
2025-05-21

Claude 4 SonnetMehr erfahren

Anthropic
Parameters
230B
Context Length
200,000 tokens
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:128,000 tokens
Max Output:128,000 tokens
Price:$undefined/1K input, $undefined/1K output
2025-05-21

Claude 4 OpusMehr erfahren

Anthropic
Parameters
230B
Context Length
200,000 tokens
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:128,000 tokens
Max Output:128,000 tokens
Price:$undefined/1K input, $undefined/1K output
2025-04-28

Qwen3 235B A22BMehr erfahren

Qwen / Alibaba Cloud
Parameters
235B / 22B active
Context Length
131,072 tokens
Response Speed
160 tokens/s
Input Speed
15000 tokens/s
Chat
Code
Max Input:131,072 tokens
Max Output:65,536 tokens
Price:$0.000455/1K input, $0.00182/1K output
2025-04-16
Parameters
-
Context Length
200,000 tokens
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Vision
Code
Max Input:200,000 tokens
Max Output:100,000 tokens
Price:$0.002/1K input, $0.008/1K output
2025-04-16

O4 MiniMehr erfahren

OpenAI
Parameters
-
Context Length
-
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:200,000 tokens
Max Output:100,000 tokens
Price:$0.0011/1K input, $0.0044/1K output
2025-04-16

O4 Mini (High)Mehr erfahren

OpenAI
Parameters
-
Context Length
-
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:200,000 tokens
Max Output:100,000 tokens
Price:$0.0011/1K input, $0.0044/1K output
2025-04-10

GPT 4.1Mehr erfahren

OpenAI
Parameters
220B
Context Length
128,000 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:4,096 tokens
Price:$0.00015/1K input, $0.0003/1K output
2025-04-10

GPT 4.1 MiniMehr erfahren

OpenAI
Parameters
220B
Context Length
128,000 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:4,096 tokens
Price:$0.00015/1K input, $0.0003/1K output
2025-04-10

GPT 4.1 NanoMehr erfahren

OpenAI
Parameters
220B
Context Length
128,000 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:4,096 tokens
Price:$0.00015/1K input, $0.0003/1K output
2025-04-04

Llama 4 MaverickMehr erfahren

Meta AI
Parameters
70B
Context Length
100,000 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.0001/1K input, $0.0002/1K output
2025-04-04

Llama 4 ScoutMehr erfahren

Meta AI
Parameters
70B
Context Length
100,000 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.0001/1K input, $0.0002/1K output
2025-03-20

Gemini 2.5 ProMehr erfahren

Google AI
Parameters
120B
Context Length
1,000,000 tokens
Response Speed
-
Input Speed
-
Chat
Max Input:1,000,000 tokens
Max Output:1,000,000 tokens
Price:-
2025-03-13

Cohere Command AMehr erfahren

Cohere
Parameters
180B
Context Length
256,000 tokens
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:128,000 tokens
Max Output:128,000 tokens
Price:$0.0002/1K input, $0.0004/1K output
2025-01-31

O3 Mini (Medium)Mehr erfahren

OpenAI
Parameters
-
Context Length
-
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:200,000 tokens
Max Output:100,000 tokens
Price:$0.0011/1K input, $0.0044/1K output
2025-01-31

O3 Mini (High)Mehr erfahren

OpenAI
Parameters
-
Context Length
-
Response Speed
140 tokens/s
Input Speed
10000 tokens/s
Chat
Max Input:200,000 tokens
Max Output:100,000 tokens
Price:$0.0011/1K input, $0.0044/1K output
2025-01-30

Mistral Small 3Mehr erfahren

Mistral
Parameters
24B
Context Length
32,000 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:-
2025-01-23

Deepseek R1 Distill Llama 70BMehr erfahren

DeepSeek
Parameters
70B
Context Length
100,000 tokens
Response Speed
270 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:-
2025-01-20

Deepseek R1Mehr erfahren

DeepSeek
Parameters
67B
Context Length
100,000 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.0001/1K input, $0.0002/1K output
2025-01-14

Minimax 01Mehr erfahren

MiniMax
Parameters
45.9B
Context Length
131,072 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:-
2024-12-25

Deepseek V3Mehr erfahren

DeepSeek
Parameters
67B
Context Length
100,000 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.0001/1K input, $0.0002/1K output
2024-12-12

Phi 4Mehr erfahren

Microsoft
Parameters
14.7B
Context Length
131,072 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:-
2024-12-06

Llama 3.3 70BMehr erfahren

Meta AI
Parameters
70B
Context Length
100,000 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.0001/1K input, $0.0002/1K output
2024-09-19

Qwen 2.5 Coder 32BMehr erfahren

Qwen / Alibaba Cloud
Parameters
-
Context Length
-
Response Speed
-
Input Speed
-
Chat
Max Input:-
Max Output:-
Price:-
2024-09-19

Qwen 2.5 72BMehr erfahren

Qwen / Alibaba Cloud
Parameters
72B
Context Length
131,072 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:-
2024-09-19

Qwen 2.5 7BMehr erfahren

Qwen / Alibaba Cloud
Parameters
7B
Context Length
32,000 tokens
Response Speed
200 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:-
2024-08-01

FLUX.1-devMehr erfahren

Black Forest Labs
Parameters
-
Context Length
-
Response Speed
-
Input Speed
-
Max Input:-
Max Output:-
Price:-
2024-07-23

Llama 3.1 8BMehr erfahren

Meta AI
Parameters
8B
Context Length
100,000 tokens
Response Speed
180 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.00005/1K input, $0.0001/1K output
2024-07-18

GPT 4o MiniMehr erfahren

OpenAI
Parameters
220B
Context Length
128,000 tokens
Response Speed
150 tokens/s
Input Speed
12000 tokens/s
Chat
Vision
Max Input:128,000 tokens
Max Output:4,096 tokens
Price:$0.00015/1K input, $0.0003/1K output
2024-06-18

Mathstral 7BMehr erfahren

Mistral
Parameters
7B
Context Length
4,096 tokens
Response Speed
150 tokens/s
Input Speed
16000 tokens/s
Chat
Max Input:4,096 tokens
Max Output:4,096 tokens
Price:-
2024-04-30

Cohere Command R+Mehr erfahren

Cohere
Parameters
140B
Context Length
128,000 tokens
Response Speed
140 tokens/s
Input Speed
11000 tokens/s
Chat
Max Input:128,000 tokens
Max Output:4,096 tokens
Price:$0.00015/1K input, $0.0003/1K output
2024-03-30

Cohere Command RMehr erfahren

Cohere
Parameters
60B
Context Length
32,000 tokens
Response Speed
170 tokens/s
Input Speed
15000 tokens/s
Chat
Max Input:32,000 tokens
Max Output:4,096 tokens
Price:$0.0001/1K input, $0.0002/1K output
2024-03-09

Llama 3.1 70BMehr erfahren

Meta AI
Parameters
70B
Context Length
100,000 tokens
Response Speed
150 tokens/s
Input Speed
13000 tokens/s
Chat
Max Input:100,000 tokens
Max Output:100,000 tokens
Price:$0.00015/1K input, $0.0003/1K output