Как устроены ИИ-сервисы

Общие детали, которые есть почти у каждого ИИ-сервиса: лимиты, память, проекты, встроенные инструменты. Разобравшись в одном сервисе, вы узнаете остальные.

Дата составления: 2026-09-26
Статус: 💡 Актуально


Суть

Сервисы выглядят по-разному, но устроены похоже. За каждым стоит языковая модель, а вокруг нее — обвязка: интерфейс чата, память, хранилище файлов, встроенные инструменты, тарифы и лимиты. Именно обвязка определяет, как вам работается, и именно она у всех сервисов сошлась к набору похожих элементов.

На практике это означает, что не нужно изучать каждый сервис с нуля. Достаточно знать, какие детали бывают, — и в новом интерфейсе вы будете искать не «что здесь вообще есть», а «где здесь лежит уже знакомое».

Эта статья — это карта таких деталей. Конкретные цифры, названия пунктов меню и состав тарифов меняются каждые несколько месяцев, поэтому здесь описано только базовое устройство.


Сервис — это не модель

Самая частая путаница новичка: считать, что ChatGPT, Claude и Gemini — это модели. Это сервисы, а модели внутри них меняются, и обычно их несколько одновременно.

Что из этого следует:

  • Внутри сервиса есть переключатель моделей. Старшие модели умнее и медленнее, младшие быстрее и дешевле по лимитам.

  • У модели бывают режимы работы. «Думающий» режим, режим повышенного усилия, обычный быстрый ответ. Один и тот же вопрос в разных режимах расходует лимит по-разному.

  • Часто есть автоматический выбор. Сервис сам решает, какой моделью отвечать. Это удобно, но если ответ неожиданно слабый — проверьте, какая модель ответила.

  • Одна модель может жить в разных обвязках. Та же модель доступна в чате, в агентной среде, в надстройке к редактору и по API, и возможности вокруг нее будут разными.

Поэтому сравнивать «ChatGPT против Claude» имеет смысл только с оговоркой, какие модели и режимы сравниваются.


Лимиты: их всегда несколько

Лимит есть у всех, включая платные тарифы. Главное, что стоит понять: лимит не один. Сервис ограничивает вас сразу по нескольким независимым основаниям, и упираются пользователи обычно не в тот лимит, о котором думали.

Тип лимита

Что ограничивает

Объем общения за окно времени

Сколько вы успеваете сделать за период. Окон обычно два и они вложены друг в друга: короткое (часы) и длинное (неделя). Исчерпав короткое, вы ждете несколько часов; исчерпав длинное — ждете до конца недели

Расход по модели и режиму

Один запрос к старшей модели в режиме усиленного размышления «весит» многократно больше, чем к младшей. Лимит тратится неравномерно, и это главная причина, почему он кончается «внезапно»

Тяжелые функции

Глубокое исследование, генерация изображений и видео, агентные режимы. У них либо отдельный счетчик, либо кратно повышенный расход общего

Длина одного чата

Это не лимит использования, а контекстное окно: сколько текста помещается в один диалог. Упираются в него независимо от того, сколько лимита осталось

Загрузка файлов

Размер одного файла, количество файлов за период, число файлов в проекте, общий объем хранилища. Ограничения разные для текста, таблиц и изображений

Общий счет по всем поверхностям

Веб, мобильное приложение, десктоп, консольный агент и надстройки к редакторам обычно расходуют один и тот же лимит аккаунта. Работа в агентной среде способна выесть лимит, который вы планировали на чат

Это самый быстро устаревающий раздел этой статьи. Конкретные значения, окна сброса и состав тарифов вендоры меняют регулярно — уточняйте ситуацию для вашего сервиса в его интерфейсе или документации вендора.

Таким образом, если лимит кончается на середине задачи, то для дальнейшей работы может помочь смена модели на младшую, отключение режима усиленного размышления или ближайший сброс лимита.

Отдельная возможность — докупить объем поверх тарифа. У разных вендоров она называется по-разному — кредиты, дополнительное использование, — но механика общая: сначала расходуется включенный в тариф объем, а дальше списывается из докупленного баланса. До покупки стоит проверить две вещи: есть ли у кредитов срок годности (у OpenAI это год с момента покупки, неизрасходованное сгорает) и на какие функции распространяется баланс — он нередко общий для нескольких инструментов сервиса.

Докупка оправдана на разовом авральном объеме. Если лимит кончается регулярно, дешевле пересмотреть тариф или способ работы.

Сбросы лимитов — отдельная тема

Лимит восстанавливается не только по расписанию. Вендоры регулярно сбрасывают или расширяют лимиты вручную, и поводы бывают самые разные:

Отдельный механизм — отложенные сбросы (banked resets). Это разовый сброс лимита, который лежит на аккаунте, пока вы его не примените или пока он не истечет; применение обновляет и короткое, и недельное окно и сдвигает дату недельного сброса. Истекший сброс не восстанавливают и не заменяют.

За массовыми сбросами следят отдельные сервисы. Например, QuotaRadar — телеграм-бот и канал, который мониторит официальные аккаунты OpenAI и Anthropic и присылает уведомления о массовых сбросах и повышениях лимитов Codex и Claude Code.

Практический вывод: если вы уперлись в недельный лимит на важной задаче — перед покупкой более дорогого тарифа имеет смысл проверить, не объявлен ли сброс.


Организация памяти у сервисов

Слово «память» в интерфейсах означает минимум три разные вещи, и путаница между ними — источник большинства жалоб вида «он все забыл» и «он лезет в посторонние чаты».

  • Память внутри чата — это контекстное окно. Работает всегда, заканчивается вместе с чатом, ограничена объемом.

  • Память между чатами — профиль, который сервис ведет о вас сам: предпочтения, род занятий, повторяющиеся задачи. Подставляется в новые чаты автоматически.

  • Память проекта — отдельное пространство под конкретную задачу.

Рядом стоит поиск по прошлым чатам: сервис не держит старые диалоги в голове, но умеет найти в них нужное по запросу.

Проекты (у разных вендоров — проекты, пространства, гемы) — это папка с общей инструкцией и файлами, которые подставляются в каждый новый чат внутри нее. Способ не повторять брифинг руками. У фронтирных сервисов память проекта отделена от общей, поэтому рабочий проект не подмешивается в посторонние чаты, а личные обсуждения не всплывают в рабочем.

Важно иметь в виду:

  • Память между чатами — не инструмент экономии. Она избавляет от повторного представления, но добавляет токены в каждый новый чат и может подтянуть лишнее. Для разовой задачи чистый чат полезнее.

  • Память нужно иногда чистить. Она накапливает устаревшее: смененную должность, завершенный проект, случайную формулировку. Все сервисы дают просмотреть список сохраненного, отредактировать, поставить на паузу или удалить — это стоит делать хотя бы раз в несколько месяцев.

Для агентных сред память устроена сложнее — там она выносится в файлы рабочей папки. Об этом — в статьях Память агента и Хранение знаний.


Что можно принести в чат

Современные флагманские сервисы мультимодальны: понимают не только текст, но и изображения, документы, таблицы, аудио, иногда видео. Глубина различается — один сервис хорошо читает скан, другой теряет картинки внутри .pdf, третий силен в длинном аудио, — но общее правило работает везде: простой текст и Markdown принимает и корректно читает любой сервис. Если результат важнее оформления, перевод документа в .txt или .md — самый надежный способ донести содержание без потерь и лишнего расхода токенов (подробнее — в разделе о форматах файлов).

Ограничения на загрузку есть всегда и обычно многослойные: размер одного файла, число файлов за период, число файлов в проекте, общий объем хранилища. Отдельно стоит помнить, что загруженный файл почти всегда остается на серверах сервиса — со всеми последствиями для конфиденциальности.


Встроенные инструменты

Чат давно перестал быть только диалогом. Практически у всех флагманов внутри интерфейса есть набор инструментов, которые модель вызывает по ходу ответа:

  • Веб-поиск — модель ищет в интернете и отвечает по найденному. Снижает риск галлюцинаций в вопросах о фактах и свежих событиях.

  • Исполнение кода — сервис пишет и запускает скрипт, чтобы посчитать, отсортировать или построить график. Именно так стоит поручать модели точные вычисления, с которыми она плохо справляется «в уме».

  • Генерация изображений и схем.

  • Рабочее полотно — документ рядом с чатом, который модель редактирует по частям, а не переписывает целиком в каждом ответе.

  • Глубокое исследование — режим, где модель несколько минут самостоятельно обходит источники и собирает отчет. Как применять его в правовых задачах — в статье Инструменты исследования.

  • Подключения к внешним сервисам — почта, календарь, облачные хранилища, корпоративные системы. Это уже граница с агентным ИИ.

Новичку полезно знать, что эти инструменты нужно включать осознанно: часть из них работает только при явном выборе режима, а часть тихо расходует лимит быстрее обычного.


Управление диалогом и историей

Мелкие функции, которые сильно экономят время и есть почти везде:

  • Правка своего сообщения и перегенерация ответа. Вместо того чтобы спорить с моделью в длинной переписке, проще отредактировать исходный запрос — диалог пойдет заново с этой точки, без накопленного мусора.

  • Ветвление чата. Копия диалога от выбранного сообщения: побочный вопрос не оседает в основной ветке. Есть не у всех, подробнее — в разделе об инструментах работы с контекстом.

  • Поиск по истории, папки и закрепление чатов. Чем дольше вы работаете с сервисом, тем важнее: через полгода архив превращается в свалку.

  • Ссылка на чат. Способ показать коллеге ход работы целиком, а не пересказывать. Обратная сторона — по ссылке видно все содержимое диалога.

  • Экспорт данных. Выгрузка всех чатов, обычно через настройки аккаунта.


Приватность и передача данных сервису

У каждого сервиса есть набор переключателей, определяющих, что происходит с вашими данными. Названия различаются, суть одинакова:

  • Обучение на ваших данных. Отдельная настройка, которую стоит найти в первый же день. Политика вендоров менялась не раз, в том числе в сторону обучения по умолчанию, — проверять стоит периодически, а не однократно.

  • Временный чат. Режим, в котором диалог не сохраняется в историю и не обновляет память. Удобен для разового чувствительного вопроса.

  • Удаление истории и памяти. Отдельно чаты, отдельно память, отдельно файлы — удаление одного не означает удаления остального.

  • Срок хранения. Даже удаленные данные какое-то время живут в логах провайдера.

Ни один из этих переключателей не делает публичный сервис пригодным для защищаемой тайны. Что именно можно отправлять в облачный сервис и как готовить документы — в разделе Обезличивание документов.


«Ипостаси» сервисов

Один и тот же сервис доступен в нескольких средах, и функции в них не совпадают:

  • Веб-версия;

  • Мобильное приложение;

  • Десктопное приложение;

  • Надстройки к офисным редакторам;

  • Расширения браузера;

  • Агентная среда в терминале.

Мобильное приложение почти всегда беднее веба; надстройки умеют то, чего нет в чате, — например, править документ прямо в редакторе.


Где сервис сообщает о правилах

Раз конкретика устаревает, полезнее знать, где смотреть актуальное. Стандартный набор источников у всех вендоров одинаков:

  • Справочный центр (help center, support) — основной источник. Там лежат статьи о лимитах, загрузке файлов, памяти и приватности, обычно с датой обновления.

  • Страница тарифов — что входит в план. Формулировки там маркетинговые, точные ограничения ищите в справочном центре.

  • Заметки о выпусках (release notes, «что нового») — когда появилась функция и в каких средах она доступна.

  • Настройки аккаунта — счетчик расхода лимита, состав памяти, переключатели приватности. У части сервисов остаток лимита виден прямо в интерфейсе.

  • Официальные блоги и аккаунты в соцсетях — анонсы и разовые сбросы лимитов.

  • Страница статуса — если сервис ведет себя странно, сначала проверьте, нет ли сбоя.


Первые десять минут в новом сервисе

Чек-лист, который стоит пройти при знакомстве с любым ИИ-сервисом:

  1. Найти переключатель моделей и понять, какая стоит по умолчанию.

  2. Найти, где видно расход лимита и когда он обновится.

  3. Проверить настройку обучения на ваших данных и решить, оставлять ли ее включенной.

  4. Посмотреть, есть ли память между чатами, и заглянуть в список того, что сервис уже о вас записал.

  5. Найти проекты или их аналог — поместить туда повторяющиеся задачи.

  6. Проверить, какие встроенные инструменты есть и включаются ли они вручную.

  7. Загрузить типовой рабочий файл и посмотреть, как сервис его прочитал.

  8. Найти временный чат — пригодится для разового чувствительного вопроса.

  9. Открыть справочный центр и сохранить ссылку на статью о лимитах.

Эти девять шагов дают больше понимания сервиса, чем час чтения обзоров.


Связанные статьи

Дополнительные материалы


Теги: #концепция #обзор #новичок