> For the complete documentation index, see [llms.txt](https://docs.suvvy.ai/ru/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.suvvy.ai/ru/osnovnye-nastroiki/dopolnitelnye-nastroiki/vybor-llm.md).

# Выбор LLM

## Выбор LLM

LLM — «мозг» агента. От выбранной модели зависят качество и стабильность ответов, скорость, точность вызова функций, стоимость диалога и страна, где обрабатываются данные.

Модель выбирается в **Дополнительные настройки → Параметры LLM**.

{% hint style="success" %}
**Если не знаете, с чего начать — оставьте GPT-4.1.** Это модель закрывает большинство сценариев продаж и поддержки.
{% endhint %}

<figure><img src="https://1280958077-files.gitbook.io/~/files/v0/b/gitbook-x-prod.appspot.com/o/spaces%2FCfQs1g1wTlkieX5CuhTI%2Fuploads%2FJOj1sbDit91j5lvHJhsx%2Fimage.png?alt=media&amp;token=4890e48e-36ae-431c-ba2f-3f9f19c18491" alt=""><figcaption></figcaption></figure>

### Как читать таблицы

* **Размещение** — где физически обрабатываются данные: США, РФ или Китай.
* **Стоимость** — относительный расход токенов: `$` низкий, `$$` средний, `$$$` высокий. Это не цена в рублях, а порядок величины относительно других моделей списка.
* **(Reasoning)** в названии — та же модель в режиме рассуждений: перед ответом она отдельно «думает». Точнее на сложных задачах, но отвечает медленнее и расходует больше токенов, потому что размышления тоже тарифицируются. У части таких моделей глубину рассуждений можно настроить (низкая / средняя / высокая).

{% hint style="info" %}
**Почему в списке не все модели, о которых вы слышали**

Вендоры выпускают новые модели каждые несколько недель. Прежде чем модель появится в Савви, её нужно отладить: проверить, как она держит длинную инструкцию, вызывает функции, работает с базой знаний и не «фантазирует». Модели, не прошедшие отладку, в кабинет не выгружаются — поэтому список в Савви не повторяет один в один анонсы OpenAI, Anthropic или Google.

Источник истины — список в вашем кабинете: часть моделей может быть недоступна на вашем тарифе, а состав списка со временем меняется.
{% endhint %}

### Что выбрать

{% tabs %}
{% tab title="Универсальный старт" %}
**GPT-4.1** — вариант по умолчанию: быстрая, предсказуемая, аккуратно следует инструкции и стабильно вызывает функции.

**GPT-5.2** — дороже, чем GPT-4.1, но имеет более предсказуемый результат и лучше следует инструкциям в более сложных сценариях.&#x20;

Если сценарий сложный (много условий, ветвлений, функций) — попробуйте **GPT-5.4** или **Claude Sonnet 4.6**.
{% endtab %}

{% tab title="Экономия" %}
**GPT-4.1 mini**, **GPT-5.4 mini**, **Gemini 3 Flash Preview**, **Claude Haiku 4.5**, **DeepSeek-V4-Flash**.

Для совсем простых задач (короткие FAQ, приветствие, маршрутизация) подойдут **GPT-4.1 nano** и **GPT-5 nano**.

Помните: модели с `(Reasoning)` почти всегда дороже своих обычных версий — на простых диалогах режим рассуждений себя не окупает.
{% endtab %}

{% tab title="Сложные диалоги" %}
**Claude Opus 4.6**, **GPT-5.4 (Reasoning)**, **Claude Sonnet 4.6 (Reasoning)**.

Берите их, когда агент должен разбираться в длинных условиях, считать, сопоставлять данные из нескольких источников или вести переговорный диалог.
{% endtab %}

{% tab title="Данные в РФ" %}
**YandexGPT 5.1 Pro**, **YandexGPT-5 Pro**, **YandexGPT-5 Lite**, **Alice AI LLM**, **GigaChat-2-Max**.

Все они размещены в России. Взамен придётся принять ограничения: они не читают изображения и дают более короткий ответ, чем модели OpenAI или Anthropic.
{% endtab %}

{% tab title="Агент работает с фото" %}
Изображения понимают модели **OpenAI**, **Anthropic**, **Google** и **xAI**.

Не понимают: **YandexGPT**, **Alice AI LLM**, **GigaChat**, **Suvvy-GPT**, **DeepSeek** и **o3-mini**.
{% endtab %}
{% endtabs %}

### OpenAI

OpenAI — американская компания, чьи модели GPT стали отраслевым стандартом: на них ориентируются остальные вендоры, и под них написано большинство инструкций и приёмов промптинга. Для Савви это самая изученная линейка: по ней у нас больше всего наблюдений с реальных проектов, поэтому мы понимаем, как модель поведёт себя на длинной инструкции, при вызове функций и в диалоге, который клиент ведёт не по сценарию. Линейка широкая: от nano-моделей за копейки до рассуждающих GPT-5.x, поэтому под почти любой сценарий здесь есть подходящая по цене модель.

| Модель                   | Размещение | Стоимость | Описание                                                                                    |
| ------------------------ | ---------- | --------- | ------------------------------------------------------------------------------------------- |
| GPT-4.1                  | США        | $$        | Ставится по умолчанию новым агентам. Отвечает без этапа рассуждений — быстро и предсказуемо |
| GPT-4.1 mini             | США        | $         | Быстрая и дешёвая версия GPT-4.1 для несложных задач                                        |
| GPT-4.1 nano             | США        | $         | Самая быстрая и дешёвая версия GPT-4.1 для простейших задач                                 |
| GPT-4o                   | США        | $$$       | Модель, на которой работает значительная часть ранее запущенных проектов                    |
| GPT-4o mini              | США        | $         | Быстрая и дешёвая версия GPT-4o                                                             |
| GPT-5.4                  | США        | $$        | Старшая модель линейки GPT-5. Для сложных сценариев с большим числом условий                |
| GPT-5.4 (Reasoning)      | США        | $$        | GPT-5.4 в режиме рассуждений, с настраиваемой глубиной                                      |
| GPT-5.4 mini             | США        | $         | Быстрая и дешёвая версия GPT-5.4                                                            |
| GPT-5.4 mini (Reasoning) | США        | $         | GPT-5.4 mini в режиме рассуждений                                                           |
| GPT-5.2                  | США        | $$        | Поколение GPT-5.2. Ровное качество ответов на сложных диалогах                              |
| GPT-5.2 (Reasoning)      | США        | $$        | GPT-5.2 в режиме рассуждений                                                                |
| GPT-5.1                  | США        | $$        | Поколение GPT-5.1                                                                           |
| GPT-5.1 (Reasoning)      | США        | $$        | GPT-5.1 в режиме рассуждений                                                                |
| GPT-5                    | США        | $$        | Первое поколение GPT-5, рассуждающая модель                                                 |
| GPT-5 mini               | США        | $         | Быстрая и дешёвая версия GPT-5                                                              |
| GPT-5 nano               | США        | $         | Самая быстрая и дешёвая версия GPT-5 для простейших задач                                   |
| o4-mini                  | США        | $$        | Рассуждающая модель прошлого поколения. Предшественник GPT-5 mini                           |
| o3-mini                  | США        | $$        | Рассуждающая модель прошлого поколения. Предшественник o4-mini. Не читает изображения       |

#### GPT-4.1 и GPT-4o — на чём работает большинство агентов

**GPT-4o** — модель, с которой Савви прожил самый большой объём реальных диалогов. Значительная часть проектов запущена и отлажена именно на ней, поэтому её поведение хорошо предсказуемо: она мягко ведёт диалог, спокойно относится к разговорному стилю клиента и почти не «спорит» с инструкцией. Если проект давно работает на GPT-4o и вас всё устраивает — менять модель только ради обновления не нужно.

**GPT-4.1** — то, что мы ставим новым агентам по умолчанию. По сравнению с GPT-4o она:

* точнее следует инструкции — меньше «додумывает» шаги, которых в промпте нет;
* аккуратнее работает с функциями и структурированными ответами;
* держит вдвое больший объём ответа (32 768 против 16 384 токенов);
* обходится дешевле: в кабинете у GPT-4.1 уровень стоимости `$$`, у GPT-4o — `$$$`.

Ни та, ни другая модель не рассуждает перед ответом. Это их сильная сторона в поддержке и продажах: ответ приходит сразу, без задержки на «размышления», и токены не тратятся на скрытый ход мыслей.

{% hint style="warning" %}
**Переход с GPT-4o на GPT-4.1**

Смена модели почти всегда снижает стоимость диалога, но требует проверки промпта: GPT-4.1 понимает инструкцию буквальнее. Формулировки вида «постарайся уточнить» она может выполнить не так, как GPT-4o.

Порядок действий: переключите модель → прогоните 5–10 типовых диалогов в тестовом чате (включая «сложных» клиентов и вызов функций) → сравните ответы с прежними → при расхождениях уточните инструкцию, а не возвращайте старую модель.
{% endhint %}

### Anthropic

Anthropic — американская компания, создатель линейки Claude. Её модели отличаются дисциплиной: они читают инструкцию целиком и держатся её до конца диалога, реже нарушают прямые запреты и не съезжают с заданного тона, даже когда клиент провоцирует или уводит разговор в сторону. Это заметно на сложных промптах в сотни строк, где модели попроще начинают путать шаги. Взамен — самая высокая стоимость в списке: почти вся линейка идёт по уровню $$$, поэтому Claude обычно берут не на весь поток диалогов, а на сценарии, где цена ошибки выше цены токенов.

| Модель                        | Размещение | Стоимость | Описание                                                     |
| ----------------------------- | ---------- | --------- | ------------------------------------------------------------ |
| Claude Opus 4.6               | США        | $$$       | Старшая модель линейки Claude. Для самых сложных диалогов    |
| Claude Opus 4.6 (Reasoning)   | США        | $$$       | Claude Opus 4.6 в режиме рассуждений                         |
| Claude Sonnet 4.6             | США        | $$$       | Умная и быстрая модель, баланс качества и скорости           |
| Claude Sonnet 4.6 (Reasoning) | США        | $$$       | Claude Sonnet 4.6 в режиме рассуждений                       |
| Claude Opus 4.5               | США        | $$$       | Старшая модель поколения 4.5                                 |
| Claude Opus 4.5 (Reasoning)   | США        | $$$       | Claude Opus 4.5 в режиме рассуждений                         |
| Claude Sonnet 4.5             | США        | $$$       | Поколение 4.5. Предшественник Claude Sonnet 4.6              |
| Claude Sonnet 4.5 (Reasoning) | США        | $$$       | Claude Sonnet 4.5 в режиме рассуждений                       |
| Claude Haiku 4.5              | США        | $$        | Самая быстрая и дешёвая модель Anthropic для несложных задач |
| Claude Haiku 4.5 (Reasoning)  | США        | $$$       | Claude Haiku 4.5 в режиме рассуждений                        |

### Google AI Studio

Google AI Studio — платформа Google для доступа к моделям Gemini. Их сильная сторона — соотношение цены, качества и скороси: Gemini Flash отвечает на уровне старших моделей, но идёт по низкому уровню стоимости, поэтому годится как рабочая модель на большом потоке диалогов, а не только для простых задач. Модели читают изображения и умеют искать в интернете. Ограничение одно: часть моделей идёт со статусом Preview — вендор может менять их поведение без предупреждения, поэтому агента на такой модели стоит перепроверять в тестовом чате после каждого крупного изменения инструкции.

| Модель                       | Размещение | Стоимость | Описание                                                                           |
| ---------------------------- | ---------- | --------- | ---------------------------------------------------------------------------------- |
| Gemini 3.1 Pro Preview       | США        | $$$       | Старшая модель линейки Gemini. Понимает изображения и аудио                        |
| Gemini 3.5 Flash             | США        | $$        | Быстрая модель Google. Понимает изображения и аудио                                |
| Gemini 3.5 Flash (Reasoning) | США        | $$        | Gemini 3.5 Flash в режиме рассуждений                                              |
| Gemini 3 Flash Preview       | США        | $         | Дешёвая и быстрая модель с хорошим качеством ответов. Понимает изображения и аудио |

### xAI

xAI — американская компания Илона Маска, разработчик линейки Grok. В Савви доступны модели семейства Fast — они дешёвые и быстрые, умеют искать в интернете и понимают изображения. Это разумный выбор там, где нужен большой поток недорогих ответов: первичная квалификация лидов, ответы на однотипные вопросы, обработка обращений с картинками. На длинных инструкциях со множеством условий они уступают моделям OpenAI и Anthropic.

| Модель                        | Размещение | Стоимость | Описание                                     |
| ----------------------------- | ---------- | --------- | -------------------------------------------- |
| Grok 4.1 Fast (Non-Reasoning) | США        | $$        | Быстрая модель xAI без режима рассуждений    |
| Grok 4.1 Fast (Reasoning)     | США        | $         | Grok 4.1 Fast в режиме рассуждений           |
| Grok 4 Fast (Non-Reasoning)   | США        | $         | Поколение Grok 4 Fast без режима рассуждений |
| Grok 4 Fast (Reasoning)       | США        | $         | Поколение Grok 4 Fast в режиме рассуждений   |

### DeepSeek

DeepSeek — китайская компания, которая известна тем, что даёт качество старших моделей за деньги младших: обе Flash-версии идут по низкому уровню стоимости при высоком качестве ответов. Это разумный выбор, когда нужно удержать стоимость диалога, но не хочется терять связность на длинных переписках. Ограничения: модели не читают изображения, не вызывают несколько функций за один ход (агент делает это последовательно, что чуть медленнее), а данные обрабатываются в Китае.

| Модель                        | Размещение | Стоимость | Описание                                             |
| ----------------------------- | ---------- | --------- | ---------------------------------------------------- |
| DeepSeek-V4-Pro               | Китай      | $$$       | Старшая модель DeepSeek. Очень большой контекст      |
| DeepSeek-V4-Pro (Reasoning)   | Китай      | $         | DeepSeek-V4-Pro в режиме рассуждений                 |
| DeepSeek-V4-Flash             | Китай      | $         | Дешёвая и быстрая модель с хорошим качеством ответов |
| DeepSeek-V4-Flash (Reasoning) | Китай      | $         | DeepSeek-V4-Flash в режиме рассуждений               |

### Модели с размещением в России

Подходят, когда данные не должны покидать РФ. **Яндекс** предоставляет линейку YandexGPT и модель Алисы, **Сбер** — GigaChat. Общие ограничения группы: не читают изображения и заметно короче отвечают. Некоторые инструкции для привычных моделей могут работать нестабильно, модели ниже требуют прописывать их более детально.

| Модель            | Размещение | Стоимость | Описание                             |
| ----------------- | ---------- | --------- | ------------------------------------ |
| YandexGPT 5.1 Pro | РФ         | $$$       | Старшая модель Яндекса               |
| YandexGPT-5 Pro   | РФ         | $$$       | Модель Яндекса прошлого поколения    |
| YandexGPT-5 Lite  | РФ         | $$        | Быстрая и дешёвая версия YandexGPT-5 |
| Alice AI LLM      | РФ         | $$$       | Модель Алисы от Яндекса              |
| GigaChat-2-Max    | РФ         | $$$       | Старшая модель GigaChat от Сбера     |

### Отдельные модели

**Suvvy-GPT** — модель, которую мы предоставляем под собственным брендом. Даёт качество ответов на уровне старших моделей при средней стоимости, поэтому подходит, когда нужно уложиться в бюджет без потери связности диалога. Не читает изображения, обрабатывается в Китае, глубину рассуждений настроить нельзя.

**Perplexity Sonar Deep Research** — не универсальная LLM, а поисковый инструмент: модель сама ищет в интернете и собирает развёрнутый ответ со ссылками на источники. Это отдельный класс задач — ресёрч, подбор информации, ответы по внешним данным, которых нет в базе знаний. Для обычного диалогового агента она не годится: вызывать функции модель не умеет.

| Модель                         | Размещение | Стоимость | Описание                                                                                                             |
| ------------------------------ | ---------- | --------- | -------------------------------------------------------------------------------------------------------------------- |
| Suvvy-GPT                      | Китай      | $$        | Модель, которую Савви предоставляет под собственным брендом. Хорошее качество ответов при средней стоимости          |
| Perplexity Sonar Deep Research | США        | $$        | Модель поискового сервиса Perplexity с режимом глубокого исследования: ищет в интернете и выдаёт подробный результат |

{% hint style="danger" %}
**Perplexity Sonar Deep Research не поддерживает вызов функций.** Агент на этой модели не сможет пользоваться действиями, интеграциями с CRM, таблицами и другими функциями. Выбирайте её только для сценариев, где нужен один развёрнутый ответ с поиском в интернете.
{% endhint %}

### После смены модели

Разные LLM по-разному читают одну и ту же инструкцию, поэтому смена модели — это не переключатель, а небольшой цикл проверки:

1. Переключите модель и прогоните типовые диалоги в тестовом чате — обязательно те, где агент вызывает функции и обращается к базе знаний.
2. Сравните ответы с прежними: изменились ли тон, длина, точность, соблюдение запретов.
3. При расхождениях правьте инструкцию под новую модель — это почти всегда эффективнее, чем возвращаться к старой.

Чтобы сразу видеть, как модель влияет на расход токенов, включите флаг "**Отображать стоимость диалога в тестовом чате".**


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.suvvy.ai/ru/osnovnye-nastroiki/dopolnitelnye-nastroiki/vybor-llm.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
