Многошаговые задачи, планирование, математика и глубокий анализ — модели с режимом рассуждений.
OpenAI: GPT-4
openai · с 05.2023 · 8K контекст
75 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 8 191 токенов.
OpenAI's flagship model, GPT-4 is a large-scale multimodal language model capable of solving difficult problems with greater accuracy than previous models due to its broader general knowledge and advanced reasoning...
Nous: Hermes 3 405B Instruct
nousresearch · с 08.2024 · 131K контекст
2,5 $ вход / 1М · 2,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов.
Hermes 3 is a generalist language model with many improvements over Hermes 2, including advanced agentic capabilities, much better roleplaying, reasoning, multi-turn conversation, long context coherence, and improvements…
Nous: Hermes 3 70B Instruct
nousresearch · с 08.2024 · 131K контекст
1,75 $ вход / 1М · 1,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов.
Hermes 3 is a generalist language model with many improvements over Hermes 2, including advanced agentic capabilities, much better roleplaying, reasoning, multi-turn conversation, long context coherence, and improvements…
Meta: Llama 3.2 3B Instruct
meta-llama · с 09.2024 · 131K контекст
0,125 $ вход / 1М · 0,825 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов.
Llama 3.2 3B is a 3-billion-parameter multilingual large language model, optimized for advanced natural language processing tasks like dialogue generation, reasoning, and summarization. Designed with the latest…
Cohere: Command R7B (12-2024)
cohere · с 12.2024 · 128K контекст
0,094 $ вход / 1М · 0,375 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 128 000 токенов.
Command R7B (12-2024) is a small, fast update of the Command R+ model, delivered in December 2024. It excels at RAG, tool use, agents, and similar tasks requiring complex reasoning...
OpenAI: o1
openai · с 12.2024 · 200K контекст · видит картинки · рассуждения
37,5 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
The latest and strongest model family from OpenAI, o1 is designed to spend more time thinking before responding. The o1 model series is trained with large-scale reinforcement learning to reason...
Microsoft: Phi 4
microsoft · с 01.2025 · 16K контекст
0,175 $ вход / 1М · 0,35 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 16 384 токенов.
Microsoft Research Phi-4 is designed to perform well in complex reasoning tasks and can operate efficiently in situations with limited memory or where quick responses are needed. At 14 billion...
DeepSeek: R1
deepseek · с 01.2025 · 64K контекст · рассуждения
1,75 $ вход / 1М · 6,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 64 000 токенов, поддерживает многошаговые рассуждения.
DeepSeek R1 is here: Performance on par with OpenAI o1, but open-sourced and with fully open reasoning tokens. It's 671B parameters in size, with 37B active in an inference pass....
DeepSeek: R1 Distill Llama 70B
deepseek · с 01.2025 · 8K контекст · рассуждения
2 $ вход / 1М · 2 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 8 192 токенов, поддерживает многошаговые рассуждения.
DeepSeek R1 Distill Llama 70B is a distilled large language model based on Llama-3.3-70B-Instruct, using outputs from DeepSeek R1. The model combines advanced distillation techniques to achieve high performance across...
OpenAI: o3 Mini High
openai · с 02.2025 · 200K контекст · рассуждения
2,75 $ вход / 1М · 11 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, поддерживает многошаговые рассуждения.
OpenAI o3-mini-high is the same model as o3-mini with reasoning_effort set to high. o3-mini is a cost-efficient language model optimized for STEM reasoning tasks, particularly excelling in science, mathematics, and...
Perplexity: Sonar Deep Research
perplexity · с 03.2025 · 128K контекст · рассуждения
5 $ вход / 1М · 20 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 128 000 токенов, поддерживает многошаговые рассуждения.
Sonar Deep Research is a research-focused model designed for multi-step retrieval, synthesis, and reasoning across complex topics. It autonomously searches, reads, and evaluates sources, refining its approach as it…
Perplexity: Sonar Pro
perplexity · с 03.2025 · 200K контекст · видит картинки
7,5 $ вход / 1М · 37,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения.
Note: Sonar Pro pricing includes Perplexity search pricing. See details here For enterprises seeking more advanced capabilities, the Sonar Pro API can handle in-depth, multi-step queries with added extensibility, like...
Perplexity: Sonar Reasoning Pro
perplexity · с 03.2025 · 128K контекст · видит картинки · рассуждения
5 $ вход / 1М · 20 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 128 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Note: Sonar Pro pricing includes Perplexity search pricing. See details here Sonar Reasoning Pro is a premier reasoning model powered by DeepSeek R1 with Chain of Thought (CoT). Designed for...
Google: Gemma 3 27B
google · с 03.2025 · 131K контекст · видит картинки
0,2 $ вход / 1М · 1,13 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения.
Gemma 3 introduces multimodality, supporting vision-language input and text outputs. It handles context windows up to 128k tokens, understands over 140 languages, and offers improved math, reasoning, and chat…
Google: Gemma 3 12B
google · с 03.2025 · 131K контекст · видит картинки
0,125 $ вход / 1М · 0,375 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения.
Gemma 3 introduces multimodality, supporting vision-language input and text outputs. It handles context windows up to 128k tokens, understands over 140 languages, and offers improved math, reasoning, and chat…
Google: Gemma 3 4B
google · с 03.2025 · 131K контекст · видит картинки
0,125 $ вход / 1М · 0,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения.
Gemma 3 introduces multimodality, supporting vision-language input and text outputs. It handles context windows up to 128k tokens, understands over 140 languages, and offers improved math, reasoning, and chat…
Mistral: Mistral Small 3.1 24B
mistralai · с 03.2025 · 128K контекст · видит картинки
0,877 $ вход / 1М · 1,39 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 128 000 токенов, понимает изображения.
Mistral Small 3.1 24B Instruct is an upgraded variant of Mistral Small 3 (2501), featuring 24 billion parameters with advanced multimodal capabilities. It provides state-of-the-art performance in text-based reasoning…
OpenAI: o1-pro
openai · с 03.2025 · 200K контекст · видит картинки · рассуждения
375 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
The o1 series of models are trained with reinforcement learning to think before they answer and perform complex reasoning. The o1-pro model uses more compute to think harder and provide...
OpenAI: o4 Mini
openai · с 04.2025 · 200K контекст · видит картинки · рассуждения
2,75 $ вход / 1М · 11 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient performance while retaining strong multimodal and agentic capabilities. It supports tool use and demonstrates competitive…
OpenAI: o4 Mini (batch)
openai · с 04.2025 · 200K контекст · видит картинки · рассуждения
1,38 $ вход / 1М · 5,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient performance while retaining strong multimodal and agentic capabilities. It supports tool use and demonstrates competitive…
OpenAI: o4 Mini High
openai · с 04.2025 · 200K контекст · видит картинки · рассуждения
2,75 $ вход / 1М · 11 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
OpenAI o4-mini-high is the same model as o4-mini with reasoning_effort set to high. OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient performance while retaining...
Qwen: Qwen3 235B A22B
qwen · с 04.2025 · 131K контекст · рассуждения
1,14 $ вход / 1М · 4,55 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Qwen3-235B-A22B is a 235B parameter mixture-of-experts (MoE) model developed by Qwen, activating 22B parameters per forward pass. It supports seamless switching between a "thinking" mode for complex reasoning, math,…
Qwen: Qwen3 32B
qwen · с 04.2025 · 131K контекст · рассуждения
0,2 $ вход / 1М · 0,7 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Qwen3-32B is a dense 32.8B parameter causal language model from the Qwen3 series, optimized for both complex reasoning and efficient dialogue. It supports seamless switching between a "thinking" mode for...
Qwen: Qwen3 14B
qwen · с 04.2025 · 131K контекст · рассуждения
0,3 $ вход / 1М · 0,6 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Qwen3-14B is a dense 14.8B parameter causal language model from the Qwen3 series, designed for both complex reasoning and efficient dialogue. It supports seamless switching between a "thinking" mode for...
Qwen: Qwen3 8B
qwen · с 04.2025 · 131K контекст · рассуждения
0,293 $ вход / 1М · 1,14 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Qwen3-8B is a dense 8.2B parameter causal language model from the Qwen3 series, designed for both reasoning-heavy tasks and efficient dialogue. It supports seamless switching between "thinking" mode for math,...
Qwen: Qwen3 30B A3B
qwen · с 04.2025 · 131K контекст · рассуждения
0,3 $ вход / 1М · 1,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Qwen3, the latest generation in the Qwen large language model series, features both dense and mixture-of-experts (MoE) architectures to excel in reasoning, multilingual support, and advanced agent tasks. Its unique...
Mistral: Mistral Medium 3
mistralai · с 05.2025 · 131K контекст · видит картинки
1 $ вход / 1М · 5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения.
Mistral Medium 3 is a high-performance enterprise-grade language model designed to deliver frontier-level capabilities at significantly reduced operational cost. It balances state-of-the-art reasoning and multimodal…
DeepSeek: R1 0528
deepseek · с 05.2025 · 164K контекст · рассуждения
1,25 $ вход / 1М · 5,38 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 163 840 токенов, поддерживает многошаговые рассуждения.
May 28th update to the original DeepSeek R1 Performance on par with OpenAI o1, but open-sourced and with fully open reasoning tokens. It's 671B parameters in size, with 37B active...
OpenAI: o3 Pro
openai · с 06.2025 · 200K контекст · видит картинки · рассуждения
50 $ вход / 1М · 2 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
The o-series of models are trained with reinforcement learning to think before they answer and perform complex reasoning. The o3-pro model uses more compute to think harder and provide consistently...
MiniMax: MiniMax M1
minimax · с 06.2025 · 1М контекст · рассуждения
1 $ вход / 1М · 5,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, поддерживает многошаговые рассуждения.
MiniMax-M1 is a large-scale, open-weight reasoning model designed for extended context and high-efficiency inference. It leverages a hybrid Mixture-of-Experts (MoE) architecture paired with a custom "lightning attention"…
Baidu: ERNIE 4.5 VL 424B A47B
baidu · с 06.2025 · 123K контекст · видит картинки · рассуждения
1,05 $ вход / 1М · 3,13 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 123 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
ERNIE-4.5-VL-424B-A47B is a multimodal Mixture-of-Experts (MoE) model from Baidu’s ERNIE 4.5 series, featuring 424B total parameters with 47B active per token. It is trained jointly on text and image data...
Tencent: Hunyuan A13B Instruct
tencent · с 07.2025 · 131K контекст · рассуждения
0,35 $ вход / 1М · 1,43 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Hunyuan-A13B is a 13B active parameter Mixture-of-Experts (MoE) language model developed by Tencent, with a total parameter count of 80B and support for reasoning via Chain-of-Thought. It offers competitive benchmark...
Qwen: Qwen3 235B A22B Thinking 2507
qwen · с 07.2025 · 131K контекст · рассуждения
0,575 $ вход / 1М · 5,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively…
Z.ai: GLM 4.5 Air
z-ai · с 07.2025 · 131K контекст · рассуждения
0,325 $ вход / 1М · 2,13 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
GLM-4.5-Air is the lightweight variant of our latest flagship model family, also purpose-built for agent-centric applications. Like GLM-4.5, it adopts the Mixture-of-Experts (MoE) architecture but with a more compact…
Z.ai: GLM 4.5
z-ai · с 07.2025 · 131K контекст · рассуждения
1,5 $ вход / 1М · 5,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
GLM-4.5 is our latest flagship foundation model, purpose-built for agent-based applications. It leverages a Mixture-of-Experts (MoE) architecture and supports a context length of up to 128k tokens. GLM-4.5 delivers…
Qwen: Qwen3 30B A3B Instruct 2507
qwen · с 07.2025 · 262K контекст
0,25 $ вход / 1М · 0,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов.
Qwen3-30B-A3B-Instruct-2507 is a 30.5B-parameter mixture-of-experts language model from Qwen, with 3.3B active parameters per inference. It operates in non-thinking mode and is designed for high-quality instruction…
OpenAI: gpt-oss-20b
openai · с 08.2025 · 131K контекст · рассуждения
0,045 $ вход / 1М · 0,225 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...
OpenAI: gpt-oss-20b (batch)
openai · с 08.2025 · 131K контекст · рассуждения
0,06 $ вход / 1М · 0,28 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...
OpenAI: gpt-oss-120b
openai · с 08.2025 · 131K контекст · рассуждения
0,375 $ вход / 1М · 1,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B parameters per forward…
OpenAI: gpt-oss-120b (batch)
openai · с 08.2025 · 131K контекст · рассуждения
0,074 $ вход / 1М · 0,34 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B parameters per forward…
OpenAI: GPT-5 Mini
openai · с 08.2025 · 400K контекст · видит картинки · рассуждения
0,625 $ вход / 1М · 5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5 Mini is a compact version of GPT-5, designed to handle lighter-weight reasoning tasks. It provides the same instruction-following and safety-tuning benefits as GPT-5, but with reduced latency and cost....
OpenAI: GPT-5 Mini (batch)
openai · с 08.2025 · 400K контекст · видит картинки · рассуждения
0,313 $ вход / 1М · 2,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5 Mini is a compact version of GPT-5, designed to handle lighter-weight reasoning tasks. It provides the same instruction-following and safety-tuning benefits as GPT-5, but with reduced latency and cost....
Z.ai: GLM 4.5V
z-ai · с 08.2025 · 66K контекст · видит картинки · рассуждения
1,5 $ вход / 1М · 4,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 65 536 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GLM-4.5V is a vision-language foundation model for multimodal agent applications. Built on a Mixture-of-Experts (MoE) architecture with 106B parameters and 12B activated parameters, it achieves state-of-the-art results…
DeepSeek: DeepSeek V3.1
deepseek · с 08.2025 · 164K контекст · рассуждения
0,625 $ вход / 1М · 2,38 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 163 840 токенов, поддерживает многошаговые рассуждения.
DeepSeek-V3.1 is a large hybrid reasoning model (671B parameters, 37B active) that supports both thinking and non-thinking modes via prompt templates. It extends the DeepSeek-V3 base with a two-phase long-context...
Nous: Hermes 4 405B
nousresearch · с 08.2025 · 131K контекст · рассуждения
2,5 $ вход / 1М · 7,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Hermes 4 is a large-scale reasoning model built on Meta-Llama-3.1-405B and released by Nous Research. It introduces a hybrid reasoning mode, where the model can choose to deliberate internally with...
Qwen: Qwen3 30B A3B Thinking 2507
qwen · с 08.2025 · 82K контекст · рассуждения
0,5 $ вход / 1М · 6 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 81 920 токенов, поддерживает многошаговые рассуждения.
Qwen3-30B-A3B-Thinking-2507 is a 30B parameter Mixture-of-Experts reasoning model optimized for complex tasks requiring extended multi-step thinking. The model is designed specifically for “thinking mode,” where internal…
Qwen: Qwen Plus 0728
qwen · с 09.2025 · 1М контекст
0,65 $ вход / 1М · 1,95 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов.
Qwen Plus 0728, based on the Qwen3 foundation model, is a 1 million context hybrid reasoning model with a balanced performance, speed, and cost combination.
DeepSeek: DeepSeek V3.1 Terminus
deepseek · с 09.2025 · 164K контекст · рассуждения
0,675 $ вход / 1М · 2,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 163 840 токенов, поддерживает многошаговые рассуждения.
DeepSeek-V3.1 Terminus is an update to DeepSeek V3.1 that maintains the model's original capabilities while addressing issues reported by users, including language consistency and agent capabilities, further optimizing…
Qwen: Qwen3 Max
qwen · с 09.2025 · 262K контекст
1,95 $ вход / 1М · 9,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов.
Qwen3-Max is an updated release built on the Qwen3 series, offering major improvements in reasoning, instruction following, multilingual support, and long-tail knowledge coverage compared to the January 2025 version.…
Qwen: Qwen3 VL 235B A22B Thinking
qwen · с 09.2025 · 131K контекст · видит картинки · рассуждения
1 $ вход / 1М · 10 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Qwen3-VL-235B-A22B Thinking is a multimodal model that unifies strong text generation with visual understanding across images and video. The Thinking model is optimized for multimodal reasoning in STEM and math....
DeepSeek: DeepSeek V3.2 Exp
deepseek · с 09.2025 · 164K контекст · рассуждения
0,675 $ вход / 1М · 1,02 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 163 840 токенов, поддерживает многошаговые рассуждения.
DeepSeek-V3.2-Exp is an experimental large language model released by DeepSeek as an intermediate step between V3.1 and future architectures. It introduces DeepSeek Sparse Attention (DSA), a fine-grained sparse attention…
Z.ai: GLM 4.6
z-ai · с 09.2025 · 205K контекст · рассуждения
1,07 $ вход / 1М · 4,38 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 204 800 токенов, поддерживает многошаговые рассуждения.
Compared with GLM-4.5, this generation brings several key improvements: Longer context window: The context window has been expanded from 128K to 200K tokens, enabling the model to handle more complex...
Qwen: Qwen3 VL 30B A3B Thinking
qwen · с 10.2025 · 262K контекст · видит картинки · рассуждения
0,5 $ вход / 1М · 6 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Qwen3-VL-30B-A3B-Thinking is a multimodal model that unifies strong text generation with visual understanding for images and videos. Its Thinking variant enhances reasoning in STEM, math, and complex tasks. It excels...
Qwen: Qwen3 VL 8B Instruct
qwen · с 10.2025 · 262K контекст · видит картинки
0,293 $ вход / 1М · 1,14 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, понимает изображения.
Qwen3-VL-8B-Instruct is a multimodal vision-language model from the Qwen3-VL series, built for high-fidelity understanding and reasoning across text, images, and video. It features improved multimodal fusion with…
Qwen: Qwen3 VL 8B Thinking
qwen · с 10.2025 · 131K контекст · видит картинки · рассуждения
0,45 $ вход / 1М · 5,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Qwen3-VL-8B-Thinking is the reasoning-optimized variant of the Qwen3-VL-8B multimodal model, designed for advanced visual and textual reasoning across complex scenes, documents, and temporal sequences. It integrates…
Anthropic: Claude Haiku 4.5
anthropic · с 10.2025 · 200K контекст · видит картинки · рассуждения
2,5 $ вход / 1М · 12,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Claude Haiku 4.5 is Anthropic’s fastest and most efficient model, delivering near-frontier intelligence at a fraction of the cost and latency of larger Claude models. Matching Claude Sonnet 4’s performance...
Anthropic: Claude Haiku 4.5 (batch)
anthropic · с 10.2025 · 200K контекст · видит картинки · рассуждения
1,25 $ вход / 1М · 6,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Claude Haiku 4.5 is Anthropic’s fastest and most efficient model, delivering near-frontier intelligence at a fraction of the cost and latency of larger Claude models. Matching Claude Sonnet 4’s performance...
Qwen: Qwen3 VL 32B Instruct
qwen · с 10.2025 · 131K контекст · видит картинки
0,26 $ вход / 1М · 1,04 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения.
Qwen3-VL-32B-Instruct is a large-scale multimodal vision-language model designed for high-precision understanding and reasoning across text, images, and video. With 32 billion parameters, it combines deep visual…
OpenAI: gpt-oss-safeguard-20b
openai · с 10.2025 · 131K контекст · рассуждения
0,188 $ вход / 1М · 0,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
gpt-oss-safeguard-20b is a safety reasoning model from OpenAI built upon gpt-oss-20b. This open-weight, 21B-parameter Mixture-of-Experts (MoE) model offers lower latency for safety tasks like content classification, LLM…
Perplexity: Sonar Pro Search
perplexity · с 10.2025 · 200K контекст · видит картинки · рассуждения
7,5 $ вход / 1М · 37,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Exclusively available on the API, Sonar Pro's new Pro Search mode is Perplexity's most advanced agentic search system. It is designed for deeper reasoning and analysis. Pricing is based...
Amazon: Nova Premier 1.0
amazon · с 11.2025 · 1М контекст · видит картинки
6,25 $ вход / 1М · 31,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения.
Amazon Nova Premier is the most capable of Amazon’s multimodal models for complex reasoning tasks and for use as the best teacher for distilling custom models.
OpenAI: GPT-5.1
openai · с 11.2025 · 400K контекст · видит картинки · рассуждения
3,13 $ вход / 1М · 25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.1 is the latest frontier-grade model in the GPT-5 series, offering stronger general-purpose reasoning, improved instruction adherence, and a more natural conversational style compared to GPT-5. It uses adaptive…
OpenAI: GPT-5.1 (batch)
openai · с 11.2025 · 400K контекст · видит картинки · рассуждения
1,56 $ вход / 1М · 12,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.1 is the latest frontier-grade model in the GPT-5 series, offering stronger general-purpose reasoning, improved instruction adherence, and a more natural conversational style compared to GPT-5. It uses adaptive…
DeepSeek: DeepSeek V3.2
deepseek · с 12.2025 · 164K контекст · рассуждения
0,672 $ вход / 1М · 1 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 163 840 токенов, поддерживает многошаговые рассуждения.
DeepSeek-V3.2 is a large language model designed to harmonize high computational efficiency with strong reasoning and agentic tool-use performance. It introduces DeepSeek Sparse Attention (DSA), a fine-grained sparse…
OpenAI: GPT-5.2
openai · с 12.2025 · 400K контекст · видит картинки · рассуждения
4,38 $ вход / 1М · 35 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.2 is the latest frontier-grade model in the GPT-5 series, offering stronger agentic and long context perfomance compared to GPT-5.1. It uses adaptive reasoning to allocate computation dynamically, responding…
OpenAI: GPT-5.2 (batch)
openai · с 12.2025 · 400K контекст · видит картинки · рассуждения
2,19 $ вход / 1М · 17,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.2 is the latest frontier-grade model in the GPT-5 series, offering stronger agentic and long context perfomance compared to GPT-5.1. It uses adaptive reasoning to allocate computation dynamically, responding…
OpenAI: GPT-5.2 Chat
openai · с 12.2025 · 128K контекст · видит картинки
4,38 $ вход / 1М · 35 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 128 000 токенов, понимает изображения.
GPT-5.2 Chat (AKA Instant) is the fast, lightweight member of the 5.2 family, optimized for low-latency chat while retaining strong general intelligence. It uses adaptive reasoning to selectively “think” on...
Upstage: Solar Pro 3
upstage · с 01.2026 · 131K контекст · рассуждения
0,375 $ вход / 1М · 1,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Solar Pro 3 is Upstage's powerful Mixture-of-Experts (MoE) language model. With 102B total parameters and 12B active parameters per forward pass, it delivers exceptional performance while maintaining computational…
StepFun: Step 3.5 Flash
stepfun · с 01.2026 · 262K контекст · рассуждения
0,25 $ вход / 1М · 0,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Step 3.5 Flash is StepFun's most capable open-source foundation model. Built on a sparse Mixture of Experts (MoE) architecture, it selectively activates only 11B of its 196B parameters per token....
Qwen: Qwen3 Max Thinking
qwen · с 02.2026 · 262K контекст · рассуждения
1,95 $ вход / 1М · 9,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Qwen3-Max-Thinking is the flagship reasoning model in the Qwen3 series, designed for high-stakes cognitive tasks that require deep, multi-step reasoning. By significantly scaling model capacity and reinforcement learning…
AionLabs: Aion-2.0
aion-labs · с 02.2026 · 131K контекст · рассуждения
2 $ вход / 1М · 4 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Aion-2.0 is a variant of DeepSeek V3.2 optimized for immersive roleplaying and storytelling. It is particularly strong at introducing tension, crises, and conflict into stories, making narratives feel more engaging....
OpenAI: GPT-5.4 Pro
openai · с 03.2026 · 1М контекст · видит картинки · рассуждения
75 $ вход / 1М · 45 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.4 Pro is OpenAI's most advanced model, building on GPT-5.4's unified architecture with enhanced reasoning capabilities for complex, high-stakes tasks. It features a 1M+ token context window (922K input, 128K...
OpenAI: GPT-5.4 Pro (batch)
openai · с 03.2026 · 1М контекст · видит картинки · рассуждения
37,5 $ вход / 1М · 225 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.4 Pro is OpenAI's most advanced model, building on GPT-5.4's unified architecture with enhanced reasoning capabilities for complex, high-stakes tasks. It features a 1M+ token context window (922K input, 128K...
NVIDIA: Nemotron 3 Super
nvidia · с 03.2026 · 262K контекст · рассуждения
0,2 $ вход / 1М · 1,13 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...
NVIDIA: Nemotron 3 Super (free)
nvidia · с 03.2026 · 262K контекст · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...
Z.ai: GLM 5 Turbo
z-ai · с 03.2026 · 203K контекст · рассуждения
3 $ вход / 1М · 10 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 202 752 токенов, поддерживает многошаговые рассуждения.
GLM-5 Turbo is a new model from Z.ai designed for fast inference and strong performance in agent-driven environments such as OpenClaw scenarios. It is deeply optimized for real-world agent workflows...
Mistral: Mistral Small 4
mistralai · с 03.2026 · 262K контекст · видит картинки · рассуждения
0,375 $ вход / 1М · 1,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Mistral Small 4 is the next major release in the Mistral Small family, unifying the capabilities of several flagship Mistral models into a single system. It combines strong reasoning from...
Mistral: Mistral Small 4 (batch)
mistralai · с 03.2026 · 262K контекст · видит картинки · рассуждения
0,188 $ вход / 1М · 0,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Mistral Small 4 is the next major release in the Mistral Small family, unifying the capabilities of several flagship Mistral models into a single system. It combines strong reasoning from...
OpenAI: GPT-5.4 Nano
openai · с 03.2026 · 400K контекст · видит картинки · рассуждения
0,5 $ вход / 1М · 3,13 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.4 nano is the most lightweight and cost-efficient variant of the GPT-5.4 family, optimized for speed-critical and high-volume tasks. It supports text and image inputs and is designed for low-latency...
OpenAI: GPT-5.4 Nano (batch)
openai · с 03.2026 · 400K контекст · видит картинки · рассуждения
0,25 $ вход / 1М · 1,56 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.4 nano is the most lightweight and cost-efficient variant of the GPT-5.4 family, optimized for speed-critical and high-volume tasks. It supports text and image inputs and is designed for low-latency...
MiniMax: MiniMax M2.7
minimax · с 03.2026 · 205K контекст · рассуждения
0,525 $ вход / 1М · 2,1 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 204 800 токенов, поддерживает многошаговые рассуждения.
MiniMax-M2.7 is a next-generation large language model designed for autonomous, real-world productivity and continuous improvement. Built to actively participate in its own evolution, M2.7 integrates advanced agentic…
SpaceXAI: Grok 4.20
x-ai · с 03.2026 · 1М контекст · видит картинки · рассуждения
3,13 $ вход / 1М · 6,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 2 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Grok 4.20 is a reasoning model from SpaceXAI with industry-leading speed and agentic tool calling capabilities. It combines the lowest hallucination rate on the market with strict prompt adherance, delivering...
SpaceXAI: Grok 4.20 Multi-Agent
x-ai · с 03.2026 · 1М контекст · видит картинки · рассуждения
3,13 $ вход / 1М · 6,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 2 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Grok 4.20 Multi-Agent is a variant of SpaceXAI’s Grok 4.20 designed for collaborative, agent-based workflows. Multiple agents operate in parallel to conduct deep research, coordinate tool use, and synthesize…
Arcee AI: Trinity Large Thinking
arcee-ai · с 04.2026 · 262K контекст · рассуждения
0,625 $ вход / 1М · 2 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Trinity Large Thinking is a powerful open source reasoning model from the team at Arcee AI. It shows strong performance in PinchBench, agentic workloads, and reasoning tasks. Launch video:
Anthropic: Claude Opus Latest
~anthropic · с 04.2026 · 1М контекст · видит картинки · рассуждения
10 $ вход / 1М · 50 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the Claude Opus family.
Tencent: Hy3 preview
tencent · с 04.2026 · 262K контекст · рассуждения
0,45 $ вход / 1М · 1,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Hy3 preview is a high-efficiency Mixture-of-Experts model from Tencent designed for agentic workflows and production use. It supports configurable reasoning levels across disabled, low, and high modes, allowing it to...
DeepSeek: DeepSeek V4 Flash 0423
deepseek · с 04.2026 · 1М контекст · рассуждения
0,117 $ вход / 1М · 0,235 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, поддерживает многошаговые рассуждения.
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...
OpenAI: GPT-5.5
openai · с 04.2026 · 1М контекст · видит картинки · рассуждения
12,5 $ вход / 1М · 75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.5 is OpenAI’s frontier model designed for complex professional workloads, building on GPT-5.4 with stronger reasoning, higher reliability, and improved token efficiency on hard tasks. It features a 1M+ token...
OpenAI: GPT-5.5 (batch)
openai · с 04.2026 · 1М контекст · видит картинки · рассуждения
6,25 $ вход / 1М · 37,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.5 is OpenAI’s frontier model designed for complex professional workloads, building on GPT-5.4 with stronger reasoning, higher reliability, and improved token efficiency on hard tasks. It features a 1M+ token...
OpenAI: GPT-5.5 Pro
openai · с 04.2026 · 1М контекст · видит картинки · рассуждения
75 $ вход / 1М · 45 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.5 Pro is OpenAI’s high-capability model optimized for deep reasoning and accuracy on complex, high-stakes workloads. It features a 1M+ token context window (922K input, 128K output) with support for...
OpenAI: GPT-5.5 Pro (batch)
openai · с 04.2026 · 1М контекст · видит картинки · рассуждения
37,5 $ вход / 1М · 225 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.5 Pro is OpenAI’s high-capability model optimized for deep reasoning and accuracy on complex, high-stakes workloads. It features a 1M+ token context window (922K input, 128K output) with support for...
Anthropic: Claude Sonnet Latest
~anthropic · с 04.2026 · 1М контекст · видит картинки · рассуждения
5 $ вход / 1М · 25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the Claude Sonnet family.
OpenAI: GPT Mini Latest
~openai · с 04.2026 · 400K контекст · видит картинки · рассуждения
1,88 $ вход / 1М · 11,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 400 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the GPT Mini family.
Anthropic: Claude Haiku Latest
~anthropic · с 04.2026 · 200K контекст · видит картинки · рассуждения
2,5 $ вход / 1М · 12,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 200 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the Claude Haiku family.
SpaceXAI: Grok 4.3
x-ai · с 05.2026 · 1М контекст · видит картинки · рассуждения
3,13 $ вход / 1М · 6,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Grok 4.3 is a reasoning model from SpaceXAI. It accepts text and image inputs with text output, and is suited for agentic workflows, instruction-following tasks, and applications requiring high factual...
SpaceXAI: Grok 4.3 (batch)
x-ai · с 05.2026 · 1М контекст · видит картинки · рассуждения
2,5 $ вход / 1М · 5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Grok 4.3 is a reasoning model from SpaceXAI. It accepts text and image inputs with text output, and is suited for agentic workflows, instruction-following tasks, and applications requiring high factual...
Anthropic: Claude Opus 4.8
anthropic · с 05.2026 · 1М контекст · видит картинки · рассуждения
12,5 $ вход / 1М · 62,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Claude Opus 4.8 is Anthropic's most capable generally available model in the Opus family. It supports text, image, and file inputs with text output, with reasoning support and a 1M-token...
Anthropic: Claude Opus 4.8 (batch)
anthropic · с 05.2026 · 1М контекст · видит картинки · рассуждения
6,25 $ вход / 1М · 31,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Claude Opus 4.8 is Anthropic's most capable generally available model in the Opus family. It supports text, image, and file inputs with text output, with reasoning support and a 1M-token...
Qwen: Qwen3.7 Plus
qwen · с 06.2026 · 1М контекст · видит картинки · рассуждения
0,8 $ вход / 1М · 3,2 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Qwen3.7-Plus is a cost-effective model in Alibaba's Qwen3.7 series. It supports text and image input with text output, building on the series' text capabilities with a comprehensive upgrade to its...
NVIDIA: Nemotron 3 Ultra
nvidia · с 06.2026 · 262K контекст · рассуждения
1,5 $ вход / 1М · 6 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
NVIDIA: Nemotron 3 Ultra (free)
nvidia · с 06.2026 · 1М контекст · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
NVIDIA: Nemotron 3.5 Content Safety
nvidia · с 06.2026 · 131K контекст · видит картинки · рассуждения
0,5 $ вход / 1М · 0,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3.5 Content Safety is a compact 4B-parameter multimodal guardrail model from NVIDIA, fine-tuned from Google Gemma-3-4B. It moderates both inputs to and responses from LLMs and VLMs, accepting...
NVIDIA: Nemotron 3.5 Content Safety (free)
nvidia · с 06.2026 · 128K контекст · видит картинки · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 128 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3.5 Content Safety is a compact 4B-parameter multimodal guardrail model from NVIDIA, fine-tuned from Google Gemma-3-4B. It moderates both inputs to and responses from LLMs and VLMs, accepting...
Anthropic: Claude Fable Latest
~anthropic · с 06.2026 · 1М контекст · видит картинки · рассуждения
25 $ вход / 1М · 125 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the Claude Fable family.
Sakana: Fugu Ultra
sakana · с 06.2026 · 1М контекст · видит картинки · рассуждения
12,5 $ вход / 1М · 75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Fugu Ultra is the higher-performance model in Sakana AI's Fugu family. Rather than a single monolithic model, Fugu is a learned multi-agent orchestration system: a language model trained to route...
Tencent: Hy3
tencent · с 07.2026 · 262K контекст · рассуждения
0,33 $ вход / 1М · 1,32 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-world production use. It supports a configurable reasoning…
AionLabs: Aion-3.0
aion-labs · с 07.2026 · 131K контекст · рассуждения
7,5 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Aion-3.0 is a multi-model roleplaying and storytelling system from AionLabs, built on the GLM family of models. It uses a collaborative generation process in which multiple specialized models each contribute...
AionLabs: Aion-3.0-Mini
aion-labs · с 07.2026 · 131K контекст · рассуждения
1,75 $ вход / 1М · 3,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, поддерживает многошаговые рассуждения.
Aion-3.0 Mini is a multi-model roleplaying and storytelling system from AionLabs, built on the DeepSeek family of models. It uses a collaborative generation process in which multiple specialized models each...
xAI: Grok Latest
~x-ai · с 07.2026 · 500K контекст · видит картинки · рассуждения
4 $ вход / 1М · 12 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 500 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest Grok model from xAI.
OpenAI: GPT-5.6 Luna
openai · с 07.2026 · 1М контекст · видит картинки · рассуждения
0,5 $ вход / 1М · 3 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.6 Luna is a fast, cost-efficient model in OpenAI's GPT-5.6 series. It is suited for high-volume, latency-sensitive tasks such as chat, classification, and lightweight agentic workflows, providing capable reasoning…
OpenAI: GPT-5.6 Luna (batch)
openai · с 07.2026 · 1М контекст · видит картинки · рассуждения
0,25 $ вход / 1М · 1,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-5.6 Luna is a fast, cost-efficient model in OpenAI's GPT-5.6 series. It is suited for high-volume, latency-sensitive tasks such as chat, classification, and lightweight agentic workflows, providing capable reasoning…
DeepSeek: DeepSeek V4 Flash Latest
~deepseek · с 08.2026 · 1М контекст · рассуждения
0,052 $ вход / 1М · 0,8 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 310 720 токенов, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the DeepSeek V4 Flash family.
Meta: Muse Glimmer 30B
meta · с 08.2026 · 131K контекст · видит картинки · рассуждения
0,75 $ вход / 1М · 3 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 131 072 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Muse Glimmer 30B is a dense, open-weight multimodal model from Meta Superintelligence Labs, distilled from Muse Spark and optimized for autonomous agents on consumer hardware. It is suited for long-horizon...
Upstage: Solar Pro 4
upstage · с 08.2026 · 524K контекст · рассуждения
0,225 $ вход / 1М · 0,9 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 524 288 токенов, поддерживает многошаговые рассуждения.
Solar Pro 4 is Upstage's cost-efficient large language model, featuring a 524K context window. It is built for long-horizon tasks and agentic workflows, with strong capabilities in office productivity,…
Sakana: Sakana Namazu
sakana · с 08.2026 · 262K контекст · видит картинки · рассуждения
2,38 $ вход / 1М · 10 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Sakana Namazu is a Japanese-specialized reasoning model from Sakana AI, based on Kimi K2.6 with additional training for Japanese language and business contexts. It is suited for Japanese instruction following,...
NVIDIA: Nemotron 3.5 Lightning
nvidia · с 08.2026 · 1М контекст · рассуждения
0,2 $ вход / 1М · 0,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...
NVIDIA: Nemotron 3.5 Lightning (free)
nvidia · с 08.2026 · 1М контекст · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, поддерживает многошаговые рассуждения.
NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...
DeepSeek: DeepSeek V4 Pro 0813
deepseek · с 08.2026 · 1М контекст · рассуждения
0,613 $ вход / 1М · 8,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, поддерживает многошаговые рассуждения.
DeepSeek V4 Pro 0813 is a large-scale mixture-of-experts model from DeepSeek. This is the GA release of DeepSeek V4 Pro.
Qwen: Qwen3.8 2.4T A95B
qwen · с 08.2026 · 1М контекст · рассуждения
5 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, поддерживает многошаговые рассуждения.
Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of Qwen3.8 Max, with 95 billion active parameters out of 2.4 trillion total. It is...
Dots Studio: Dots3-Note Preview (free)
dots-studio · с 08.2026 · 512K контекст · видит картинки · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 512 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Dots3-Note Preview is an open-weight mixture-of-experts model from Dots Studio, with 16B active parameters out of 280B total. It is the lightest model in the Dots 3 family and is...
Z.ai: GLM Latest
~z-ai · с 08.2026 · 1М контекст · рассуждения
0,684 $ вход / 1М · 6,43 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 310 720 токенов, поддерживает многошаговые рассуждения.
This model always redirects to the latest GLM model from Z.ai.
DeepSeek: DeepSeek V4 Flash Vision Exp
deepseek · с 08.2026 · 1М контекст · видит картинки · рассуждения
0,539 $ вход / 1М · 1,62 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, понимает изображения, поддерживает многошаговые рассуждения.
DeepSeek V4 Flash Vision Exp is an experimental vision-enabled version of DeepSeek V4 Flash 0731 from DeepSeek, adding image understanding while matching the base model on text capabilities including agents,...
inclusionAI: Ling 3.0 Flash Fin
inclusionai · с 08.2026 · 262K контекст · рассуждения
0,15 $ вход / 1М · 0,45 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Ling 3.0 Flash Fin is a finance-focused mixture-of-experts model from InclusionAI, built on Ling 3.0 Flash with 5.1B active parameters out of 124B total. It is designed for real-world investment...
inclusionAI: Ling 3.0 Flash Fin (free)
inclusionai · с 08.2026 · 262K контекст · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Ling 3.0 Flash Fin is a finance-focused mixture-of-experts model from InclusionAI, built on Ling 3.0 Flash with 5.1B active parameters out of 124B total. It is designed for real-world investment...
inclusionAI: Ling 3.0 Flash Sante (free)
inclusionai · с 09.2026 · 262K контекст · рассуждения · бесплатно
Бесплатно
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Ling 3.0 Flash Sante is a health and medicine-focused mixture-of-experts model from InclusionAI, built on Ling 3.0 Flash with 5.1B active parameters out of 124B total. It is designed for...
Sakana: Fugu Max
sakana · с 09.2026 · 1М контекст · видит картинки · рассуждения
5 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Fugu Max is the cost-performance model in Sakana AI's Fugu family. Rather than a single monolithic model, Fugu is a learned multi-agent orchestration system: a language model trained to route...
Sakana: Fugu Ultra v2
sakana · с 09.2026 · 1М контекст · видит картинки · рассуждения
12,5 $ вход / 1М · 75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Fugu Ultra v2 is the higher-performance model in Sakana AI's Fugu family. Rather than a single monolithic model, Fugu is a learned multi-agent orchestration system: a language model trained to...
OpenAI: GPT Luna Latest
~openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
0,25 $ вход / 1М · 1,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the GPT Luna family.
OpenAI: GPT Terra Latest
~openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
5 $ вход / 1М · 30 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the GPT Terra family.
OpenAI: GPT Sol Latest
~openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
5 $ вход / 1М · 25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the GPT Sol family.
OpenAI: GPT Astra Latest
~openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
25 $ вход / 1М · 125 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the GPT Astra family.
DeepSeek: DeepSeek Flash Latest
~deepseek · с 09.2026 · 1М контекст · видит картинки · рассуждения
0,088 $ вход / 1М · 0,725 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, понимает изображения, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the DeepSeek Flash family.
DeepSeek: DeepSeek Pro Latest
~deepseek · с 09.2026 · 1М контекст · рассуждения
0,61 $ вход / 1М · 1,83 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, поддерживает многошаговые рассуждения.
This model always redirects to the latest model in the DeepSeek Pro family.
OpenAI: GPT-6 Sol
openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
5 $ вход / 1М · 25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-6 Sol is the cost-efficient high-end model in OpenAI's GPT-6 series, positioned below the flagship GPT-6 Astra and above the fast GPT-6 Luna tier. It is suited for demanding professional...
OpenAI: GPT-6 Sol (batch)
openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
2,5 $ вход / 1М · 12,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-6 Sol is the cost-efficient high-end model in OpenAI's GPT-6 series, positioned below the flagship GPT-6 Astra and above the fast GPT-6 Luna tier. It is suited for demanding professional...
OpenAI: GPT-6 Luna
openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
0,25 $ вход / 1М · 1,25 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...
OpenAI: GPT-6 Luna (batch)
openai · с 09.2026 · 1М контекст · видит картинки · рассуждения
0,125 $ вход / 1М · 0,625 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 050 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...
Cohere: Command A+
cohere · с 09.2026 · 192K контекст · видит картинки · рассуждения
0,75 $ вход / 1М · 3,75 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 192 000 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Command A+ is Cohere's flagship model for enterprise agentic workflows. It accepts text and image inputs with a 192K context window, supports native tool calling with strict tool schemas, structured...
Upstage: Solar Mini 4
upstage · с 09.2026 · 524K контекст · рассуждения
0,125 $ вход / 1М · 0,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 524 288 токенов, поддерживает многошаговые рассуждения.
Solar Mini 4 is Upstage's compact, cost-efficient language model, a 35B-parameter mixture-of-experts with 3B active parameters and a 524K context window. It is built for agentic use cases where response...
AionLabs: Aion 3.5
aion-labs · с 09.2026 · 262K контекст · рассуждения
7,5 $ вход / 1М · 15 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Aion 3.5 is a multi-model roleplaying and storytelling system from AionLabs, built on the GLM family of models. It uses a collaborative generation process in which multiple specialized models each...
AionLabs: Aion 3.5 Mini
aion-labs · с 09.2026 · 262K контекст · рассуждения
1,75 $ вход / 1М · 3,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 262 144 токенов, поддерживает многошаговые рассуждения.
Aion 3.5 Mini is a multi-model roleplaying and storytelling system from AionLabs, built on the GLM family of models. It is the smaller, lower-cost sibling of Aion 3.5 and uses...
Z.ai: GLM 5.3 Prime
z-ai · с 09.2026 · 1М контекст · рассуждения
7 $ вход / 1М · 22 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 000 000 токенов, поддерживает многошаговые рассуждения.
GLM-5.3-Prime is the high-speed variant of Z.ai's GLM-5.3, inheriting its full capabilities while delivering 1.5–2× the output throughput through inference acceleration. It supports text input and output with a…
Fireworks: Ember-1
fireworks · с 09.2026 · 1М контекст · видит картинки · рассуждения
7,5 $ вход / 1М · 37,5 $ выход / 1М
Модель для сложных задач: многошаговые рассуждения, планирование, математика, анализ. Контекст 1 048 576 токенов, понимает изображения, поддерживает многошаговые рассуждения.
Ember-1 is a specialized reasoning model from Fireworks Research, built on Kimi K3. It is designed to make every token go further: it produces shorter reasoning traces, using roughly 40%...