Что такое токены в нейросети простыми словами

Токен — кусочек текста, с которым работает нейросеть: слово, часть слова, знак препинания. В токенах считают длину запроса и ответа и цену для разработчиков. По Сберу, в среднем токен — 3–4 символа. Один и тот же русский текст у разных моделей занимает разное число токенов: по примеру Яндекса — от 96 до 139.

Вагиз ХасановОснователь Seo Rezult
Обновлено
Чтение
4 минуты
Рубрика
SEO

Коротко о главном

  • Токен — кусочек текста. Слово, часть слова или знак препинания.
  • В среднем 3–4 символа. Так считает Сбер для GigaChat.
  • У разных моделей — разный счёт. Один текст: 96 токенов у Яндекса, 139 у Qwen.
  • У агрегаторов свои единицы. Искры у Chad AI, энергия у MashaGPT.
Нейросеть читает текст по кусочкам — токенам

Что такое токены простыми словами

Токен — кусочек текста, с которым работает нейросеть: целое слово, часть слова, знак препинания или пробел. Нейросеть читает и пишет не буквами и не словами, а токенами. В них же считают длину запроса и ответа, и за них платят разработчики. В русском тексте токен — в среднем от 3 до 5 символов.

В документации Яндекса это сказано так: нейросети работают с текстами, «представляя слова и предложения в виде токенов — смысловых отрывков или часто встречающихся последовательностей символов, характерных для естественного языка».

Сколько символов в одном токене

Точного правила нет: у каждой нейросети свой способ резать текст на токены — токенизатор. Разработчики дают ориентиры:

  • Сбер: «В среднем в одном токене 3—4 символа, включая пробелы, знаки препинания и специальные символы».
  • OpenAI для английского: «1 token is approximately 4 characters» — примерно 4 символа, или три четверти слова. Там же оговорка, что в других языках соотношение другое.
  • DeepSeek: один английский символ — около 0,3 токена, китайский — около 0,6.

Самый наглядный пример — в документации Яндекса. Один и тот же русский текст из 501 символа три модели разбили по-разному:

Один русский текст — разное число токенов у разных моделей

У модели Яндекса — 96 токенов, у Qwen3 235B — 139. Яндекс объясняет это так: «Модели Яндекса используют токенизатор, специально оптимизированный для работы с текстами на русском языке». На английском тексте разница почти исчезла: 89 токенов у модели Яндекса и 87 у двух других. Сам Яндекс оговаривает, что примеры приведены для иллюстрации.

Почему это важно

Длина запроса и ответа. У каждой нейросети есть предел — сколько токенов она удерживает за раз. Его называют контекстным окном. Например, у моделей DeepSeek, по их документации, контекст — 1 млн токенов, а ответ — до 384 тысяч. OpenAI пишет: «The context window limits the tokens a model can work with in a request» — окно ограничивает, сколько токенов модель учитывает в запросе. То, что в него не поместилось, модель учесть не может.

Цена. Разработчики, которые подключают нейросеть к своим сервисам, платят за токены. Например, у GigaChat API физлица получают «365 000 000 бесплатных токенов для генерации текста» на год, а дальше покупают пакеты: 20 млн токенов модели GigaChat 2 Lite — 1 300 ₽ на месяц. Сбер отдельно пишет, что повторяющиеся части запросов модель запоминает на время, и «кэшированные токены не подлежат тарификации».

Русский текст обходится дороже. На русском у многих моделей токенов выходит больше, чем на английском при том же смысле, — это видно по примеру Яндекса выше.

Искры, энергия и токены у агрегаторов

Если вы пользуетесь нейросетями через российские агрегаторы, токенов можете и не увидеть — там свои единицы.

  • MashaGPT считает текст в токенах и объясняет в ответах на вопросы: «1 токен ≈ 1 слово на русском». В тарифе Base — 20 млн токенов в месяц. Картинки и видео при этом считаются в отдельной единице — «энергии».
  • Chad AI слово «токен» в тарифах не использует. Его единица — искра, и она привязана к словам: у каждой модели свой курс, сколько искр стоит одно слово. Считаются слова запроса, ответа и контекста диалога, а слова длиннее 20 символов разбиваются на части.

Сравнивать тарифы разных сервисов напрямую поэтому сложно: слово, токен и искра — разные единицы.

Как тратить меньше токенов

  1. Шаг 1. Пишите запрос коротко и по делу: без повторов и лишних вступлений.
  2. Шаг 2. Для новой задачи начинайте новый чат. Вся прошлая переписка тоже занимает место в контекстном окне.
  3. Шаг 3. Длинный документ не вставляйте целиком, если нужна одна его часть.
  4. Шаг 4. Просите нужный объём ответа: «в 3 предложениях», «списком из 5 пунктов».

Как составить запрос, чтобы нейросеть отвечала по делу, — в статье о том, как написать промпт. Про тарифы GigaChat и DeepSeek — в отдельных статьях о GigaChat и DeepSeek.

Как это делаем мы

Мы используем нейросети в работе и видим, как быстро растёт расход, если отправлять в модель лишнее. Поэтому даём ей только нужные данные — это дешевле и точнее. Как ИИ помогает бизнесу разбирать обращения и отчёты, — на странице автоматизации с ИИ. Что такое ИИ вообще, — в статье что такое искусственный интеллект.

Токены — это не только про деньги разработчиков. Когда нейросеть вдруг «забывает», о чём вы договорились в начале разговора, одна из частых причин — переписка стала слишком длинной. Начните новый чат и коротко перескажите главное — ответы снова станут точными.

Вагиз Хасанов, основатель Seo Rezult

Читайте по теме:

SEO-продвижение сайта →

Частые вопросы о токенах

Сколько символов в одном токене?

Точного правила нет. Сбер пишет, что в среднем 3–4 символа, OpenAI для английского — около 4 символов.

Почему в русском тексте больше токенов?

Токенизаторы многих моделей режут русский текст на более мелкие куски. В примере Яндекса один русский текст дал 96 токенов у модели Яндекса и 139 у Qwen3 235B.

Что такое контекстное окно?

Предел токенов, которые модель учитывает за один запрос. У моделей DeepSeek, по документации, это 1 млн токенов.

Сколько стоят токены GigaChat?

Физлица получают 365 млн бесплатных токенов на год, дальше — пакеты, например 20 млн токенов GigaChat 2 Lite за 1 300 ₽ на месяц.

Что такое искры в Chad AI?

Внутренняя единица сервиса, привязанная к словам: у каждой модели свой курс, сколько искр стоит одно слово.

Как тратить меньше токенов?

Писать коротко, начинать новый чат под новую задачу, не вставлять лишний текст и просить нужный объём ответа.

Автор статьи

Вагиз Хасанов

Основатель Seo Rezult

Больше 10 лет в SEO. Основал Seo Rezult: сейчас в команде больше 10 специалистов и больше 280 проектов. В блоге пишет о продвижении сайтов в Яндексе и Google простыми словами.

В команде
Seo Rezult: 10 лет, 10+ специалистов, 280+ проектов
Впервые опубликовано
Все статьи автора

Читайте также

Все статьи блога

Первый шаг — бесплатно

Пришлите адрес сайта. Мы сами оценим его и пришлём план работ: где вы сейчас в Яндексе и Google и что сделать, чтобы росли позиции и трафик. Без обязательств.

Когда удобно, чтобы мы позвонили

Работаем с 9:00 до 18:00 по Москве.

Нажимая кнопку, вы соглашаетесь с политикой конфиденциальности.

План работ под ваш сайт — бесплатно

Посмотрим сайт и выдачу, пришлём план: где вы сейчас, что мешает росту и с чего начать. Без обязательств.

Когда удобно, чтобы мы позвонили

Работаем с 9:00 до 18:00 по Москве.

Нажимая кнопку, вы соглашаетесь с политикой конфиденциальности.