Datalight

Datalight

Единый API к лучшим LLM-моделям

Передовые модели

Claude Sonnet 4.6
Передовая модель Anthropic

Claude Sonnet 4.6

Высокоэффективная версия Claude 4.6, оптимизированная для скорости и низкой стоимости при хорошей производительности в кодировании и агентских задачах.

GPT-5 Нейросеть нового поколения

GPT-5

Флагманская языковая модель с продвинутыми возможностями рассуждения, программирования и анализа сложных контекстов.

Gemini 2.5 Pro Линейка Google DeepMind

Gemini 2.5 Pro

Мощная мультимодальная модель от Google, оптимизированная для сложных задач рассуждения, работы с кодом и анализа данных.

Чтобы сгенерировать ключ, авторизуйтесь и пополните баланс

Цены указаны за 1 млн токенов, за генерацию 1 изображения или за 1 минуту входного аудио.

Модель ID Цена Input Цена Output Контекст Latency (сек) Throughput (т/сек) Function
Calling
Подключение
gemini-3.1-pro-preview google/gemini-3.1-pro-preview 221 ₽ 1326 ₽ 1048576 15.32 36.76
qwen3.5-flash qwen/qwen3.5-flash 4 ₽ 44 ₽ 1000000 20.51 96.16
qwen3.6-flash qwen/qwen3.6-flash 26 ₽ 151 ₽ 1000000 17.36 131.89
qwen3.5-plus qwen/qwen3.5-plus 18 ₽ 105 ₽ 1000000 15.99 35.71
minimax-m3 minimax/minimax-m3 33 ₽ 133 ₽ 1000000 1.11 74.0
gpt-5.5 openai/gpt-5.5 552 ₽ 3315 ₽ 1050000 7.68 17.84
qwen3.8-27b qwen/qwen3.8-27b 55 ₽ 332 ₽ 1000000 0.79 50.0
qwen3.8-flash qwen/qwen3.8-flash 18 ₽ 52 ₽ 1000000 3.84 55.0
gemini-3.8-flash google/gemini-3.8-flash 83 ₽ 414 ₽ 1048576 1.48 185.2
gemini-3.7-flash google/gemini-3.7-flash 83 ₽ 414 ₽ 1048576 1.54 134.2
claude-opus-4.8 anthropic/claude-opus-4.8 552 ₽ 2762 ₽ 1000000 9.26 28.53
claude-opus-5 anthropic/claude-opus-5 552 ₽ 2762 ₽ 1000000 20.6 66.2
deepseek-v4-flash-0731 deepseek/deepseek-v4-flash-0731 49 ₽ 146 ₽ 1000000 21.54 115.65
claude-fable-5 anthropic/claude-fable-5 1105 ₽ 5525 ₽ 1000000 3.14 5.41
claude-opus-4.7 anthropic/claude-opus-4.7 552 ₽ 2762 ₽ 1000000 3.15 1.91
gemini-2.5-flash google/gemini-2.5-flash 33 ₽ 276 ₽ 1048576 1.01 30.65
kimi-k3 moonshotai/kimi-k3 332 ₽ 1658 ₽ 1048576 37.17 31.64
gpt-5.4-nano openai/gpt-5.4-nano 22 ₽ 138 ₽ 400000 1.95 22.82
qwen3.7-flash qwen/qwen3.7-flash 3 ₽ 14 ₽ 1000000 14.42 113.73
glm-5.3 z-ai/glm-5.3 155 ₽ 486 ₽ 1000000 0.0 0.0
claude-fable-5.1 anthropic/claude-fable-5.1 1105 ₽ 5525 ₽ 1000000 7.1 36.4
deepseek-v4.1-flash deepseek/deepseek-v4.1-flash 33 ₽ 133 ₽ 1000000 1.42 171.0
gpt-5.6-luna openai/gpt-5.6-luna 22 ₽ 133 ₽ 1050000 3.42 55.62
yandexgpt-5-lite yandexgpt-5-lite 260 ₽ 260 ₽ 32000 0.77 15.72
gpt-chat-latest openai/gpt-chat-latest 552 ₽ 3315 ₽ 1047576 1.86 28.99
gemini-3.5-flash-lite google/gemini-3.5-flash-lite 33 ₽ 276 ₽ 1048576 0.95 77.2
minimax-m2.7-highspeed minimax/minimax-m2.7-highspeed 66 ₽ 265 ₽ 205000 0.89 90.0
minimax-m2.7 minimax/minimax-m2.7 33 ₽ 133 ₽ 205000 2.72 51.0
gpt-oss-20b openai/gpt-oss-20b 11 ₽ 55 ₽ 131072 0.95 86.97
qwen3.8-2.4t-a95b qwen/qwen3.8-2.4t-a95b 221 ₽ 663 ₽ 1000000 1.86 41.0
glm-4.7-flash z-ai/glm-4.7-flash 8 ₽ 44 ₽ 202752 56.01 74.8
gpt-5.6-sol openai/gpt-5.6-sol 552 ₽ 3315 ₽ 1050000 5.3 20.47
deepseek-v4-pro-0813 deepseek/deepseek-v4-pro-0813 146 ₽ 438 ₽ 1000000 1.36 20.0
glm-4.6v z-ai/glm-4.6v 33 ₽ 99 ₽ 128000 1.76 41.74
gpt-5 openai/gpt-5 138 ₽ 1105 ₽ 400000 5.1 72.94
claude-sonnet-5 anthropic/claude-sonnet-5 221 ₽ 1105 ₽ 1000000 4.09 12.75
gpt-5.6-terra openai/gpt-5.6-terra 221 ₽ 1326 ₽ 1050000 104.0 54.57
qwen3-vl-235b-a22b-thinking qwen/qwen3-vl-235b-a22b-thinking 44 ₽ 439 ₽ 128000 2.74 48.95
llama-3.3-70b-instruct meta-llama/llama-3.3-70b-instruct 24 ₽ 55 ₽ 131072 0.47 74.7
gpt-5.2-codex openai/gpt-5.2-codex 194 ₽ 1547 ₽ 400000 1.84 15.93
glm-5.3-flash z-ai/glm-5.3-flash 17 ₽ 55 ₽ 1000000 3.46 47.2
gpt-5.3-codex openai/gpt-5.3-codex 194 ₽ 1547 ₽ 400000 110.37 53.56
qwen3.8-max qwen/qwen3.8-max 155 ₽ 465 ₽ 1000000 1.81 40.4
qwen3.6-plus qwen/qwen3.6-plus 42 ₽ 252 ₽ 1000000 4.32 49.05
mimo-v2.5-pro xiaomi/mimo-v2.5-pro 48 ₽ 96 ₽ 1048576 2.97 69.03
qwen3-vl-235b-a22b-instruct qwen/qwen3-vl-235b-a22b-instruct 44 ₽ 175 ₽ 128000 6.2 36.0
qwen3-235b-a22b qwen/qwen3-235b-a22b 44 ₽ 175 ₽ 128000 2.57 53.2
gemini-3-flash-preview google/gemini-3-flash-preview 55 ₽ 332 ₽ 1048576 3.45 62.76
deepseek-v4-flash deepseek/deepseek-v4-flash 21 ₽ 42 ₽ 1000000 1.35 191.1
kimi-k2.6 moonshotai/kimi-k2.6 105 ₽ 442 ₽ 256000 1.75 42.64
claude-opus-4.6 anthropic/claude-opus-4.6 552 ₽ 2762 ₽ 1000000 6.83 8.94
deepseek-v3.2 deepseek/deepseek-v3.2 44 ₽ 66 ₽ 128000 1.55 59.81
gemini-3.6-flash google/gemini-3.6-flash 83 ₽ 414 ₽ 1048576 2.29 21.0
kimi-k2.5 moonshotai/kimi-k2.5 66 ₽ 332 ₽ 262144 1.6 21.08
glm-4.5-air z-ai/glm-4.5-air 22 ₽ 122 ₽ 131072 5.36 29.0
deepseek-v4-pro deepseek/deepseek-v4-pro 192 ₽ 385 ₽ 1000000 1.64 120.76
qwen3-vl-flash qwen/qwen3-vl-flash 3 ₽ 33 ₽ 256000 1.04 30.71
gemini-2.5-pro google/gemini-2.5-pro 138 ₽ 1105 ₽ 1048576 76.1 121.16
gpt-5.4-pro openai/gpt-5.4-pro 3315 ₽ 19890 ₽ 1050000 200.95 33.04
mimo-v2.5 xiaomi/mimo-v2.5 15 ₽ 31 ₽ 1048576 3.52 115.73
qwen3-vl-8b-thinking qwen/qwen3-vl-8b-thinking 11 ₽ 110 ₽ 128000 3.78 53.19
gpt-4o-mini openai/gpt-4o-mini 17 ₽ 66 ₽ 128000 2.3 17.11
qwen3.6-35b-a3b qwen/qwen3.6-35b-a3b 38 ₽ 227 ₽ 256000 1.56 111.75
chatgpt-4o-latest openai/chatgpt-4o-latest 552 ₽ 1658 ₽ 128000 1.98 21.67
glm-5v-turbo z-ai/glm-5v-turbo 133 ₽ 442 ₽ 202752 5.4 14.07
glm-5.1 z-ai/glm-5.1 155 ₽ 486 ₽ 202752 11.5 67.12
glm-4.7 z-ai/glm-4.7 66 ₽ 243 ₽ 202752 14.47 93.2
gpt-4.1-nano openai/gpt-4.1-nano 11 ₽ 44 ₽ 1047576 1.58 94.07
text-embedding-3-large openai/text-embedding-3-large 14 ₽ - ₽ 8192 8.71 0.0
gemini-3.1-flash-lite google/gemini-3.1-flash-lite 28 ₽ 166 ₽ 1048576 1.84 72.28
claude-haiku-4.5 anthropic/claude-haiku-4.5 110 ₽ 552 ₽ 200000 4.68 25.71
glm-5 z-ai/glm-5 110 ₽ 354 ₽ 202752 5.12 29.71
gemini-3.5-flash google/gemini-3.5-flash 166 ₽ 994 ₽ 1048576 4.23 85.26
deepseek-chat-v3-0324 deepseek/deepseek-chat-v3-0324 55 ₽ 166 ₽ 163840 0.53 24.27
gpt5.1-pro yandex/gpt-5.1 1040 ₽ 1040 ₽ 32000 0.85 102.68
gpt-5.1 openai/gpt-5.1 138 ₽ 1105 ₽ 400000 1.71 40.09
gpt-5-mini openai/gpt-5-mini 28 ₽ 221 ₽ 400000 25.87 99.91
claude-sonnet-4.5 anthropic/claude-sonnet-4.5 332 ₽ 1658 ₽ 1000000 123.67 49.03
gpt-5-nano openai/gpt-5-nano 6 ₽ 44 ₽ 400000 0.98 24.91
qwen3-max-thinking qwen/qwen3-max-thinking 55 ₽ 219 ₽ 256000 1.51 11.13
glm-4.6v-flashx z-ai/glm-4.6v-flashx 4 ₽ 44 ₽ 128000 1.85 35.1
qwen3-vl-30b-a3b-thinking qwen/qwen3-vl-30b-a3b-thinking 16 ₽ 165 ₽ 128000 10.77 91.68
qwen3.6-max-preview qwen/qwen3.6-max-preview 190 ₽ 1136 ₽ 256000 7.49 18.16
gpt-oss-120b openai/gpt-oss-120b 17 ₽ 66 ₽ 131072 2.93 160.53
gemini-3.1-pro-preview-customtools google/gemini-3.1-pro-preview-customtools 221 ₽ 1326 ₽ 1048576 8.65 84.94
qwen3-vl-30b-a3b-instruct qwen/qwen3-vl-30b-a3b-instruct 16 ₽ 65 ₽ 128000 1.39 76.04
gpt-5.2 openai/gpt-5.2 193 ₽ 1547 ₽ 400000 10.2 47.49
qwen3-vl-8b-instruct qwen/qwen3-vl-8b-instruct 11 ₽ 44 ₽ 128000 12.03 23.22
qwen3-coder-next qwen/qwen3-coder-next 22 ₽ 88 ₽ 256000 0.96 23.6
claude-opus-4.5 anthropic/claude-opus-4.5 552 ₽ 2762 ₽ 200000 5.02 19.32
qwen3.7-max qwen/qwen3.7-max 252 ₽ 757 ₽ 1000000 3.58 39.6
qwen3.5-397b-a17b qwen/qwen3.5-397b-a17b 26 ₽ 158 ₽ 256000 5.05 54.44
glm-4.6 z-ai/glm-4.6 66 ₽ 243 ₽ 202752 4.42 32.1
deepseek-r1-distill-llama-70b deepseek/deepseek-r1-distill-llama-70b 88 ₽ 88 ₽ 131072 0.47 114.8
gpt5-pro yandex/gpt-5-pro 1560 ₽ 1560 ₽ 32000 0.75 45.85
gpt5-lite yandex/gpt-5-lite 260 ₽ 260 ₽ 32000 4.13 75.29
gpt-5.4 openai/gpt-5.4 276 ₽ 1658 ₽ 1050000 4.69 35.86
glm-5.2 z-ai/glm-5.2 155 ₽ 486 ₽ 1000000 0.0 0.0
gpt-4.1 openai/gpt-4.1 221 ₽ 884 ₽ 1047576 3.94 69.17
claude-sonnet-4.6 anthropic/claude-sonnet-4.6 332 ₽ 1658 ₽ 1000000 14.01 35.1
gpt-5.4-mini openai/gpt-5.4-mini 83 ₽ 497 ₽ 400000 1.32 58.82
gpt-4.1-mini openai/gpt-4.1-mini 44 ₽ 177 ₽ 1047576 2.02 13.69
qwen3.7-plus qwen/qwen3.7-plus 30 ₽ 122 ₽ 1000000 5.05 48.79
kimi-k2.7-code moonshotai/kimi-k2.7-code 99 ₽ 410 ₽ 262144 2.21 14.04
qwen3-vl-plus qwen/qwen3-vl-plus 22 ₽ 219 ₽ 256000 1.04 17.56

Скорость vs Цена Output

Оптимальное соотношение скорость/цена

Контекст vs Цена Output

Модели с лучшим контекстом за цену

Ключевые определения

Контекстное окно: максимальное общее количество входных и выходных токенов.
Throughput (скорость вывода): количество токенов в секунду, получаемых во время генерации токенов моделью.
Latency (задержка, время до первого токена): время до получения первого токена в секундах после отправки запроса к API.
Цена Output (вывода): цена за токен, сгенерированный моделью, выраженная в соответствующей валюте за миллион токенов.
Цена Input (ввода): цена за токен, включенный в запрос/сообщение, отправленное к API.