Центр помощи
Подробнее

Ограничения и типичные сложности

Последнее обновление:

ChatLab использует генерацию с расширенным поиском (Retrieval-Augmented Generation, RAG) для предоставления ответов на основе вашей базы знаний. Понимание ее ограничений поможет вам оптимизировать работу чат-бота и сформировать реалистичные ожидания.


Ограничения контекстного окна

ChatLab использует модели ИИ со строгими ограничениями на количество токенов при обработке запросов. Контекстное окно должно вмещать вопрос пользователя, историю диалога и извлеченные знания вместе взятые.

Размеры контекста по планам:

  • Free/Basic: 8 000 токенов
  • Standard: 16 000 токенов
  • Premium: 32 000 токенов

Что происходит при превышении контекста:

  • Извлеченные знания обрезаются
  • Важная информация может быть пропущена
  • Ответы могут оказаться неполными или упускать ключевые детали

Решения:

  • Удалите избыточный контент из данных для обучения
  • Разделите большие файлы на более компактные документы по конкретным темам
  • Перейдите на более высокий план для увеличения контекстного окна
  • Используйте четкие и конкретные инструкции по роли бота для направления ответов

Ограничения на обучение и извлечение контента

Ограничения на загрузку файлов

  • Максимальный размер файла: 50 МБ на файл
  • Поддерживаемые форматы: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX

Контент, который нельзя извлечь

ChatLab не может прочитать или извлечь текст из следующих источников:

  • Изображения и графика - текст, встроенный в изображения, не распознается
  • Отсканированные PDF - файлы PDF, содержащие изображения текста вместо фактического текстового слоя
  • Страницы, защищенные авторизацией - страницы, требующие входа в систему
  • Контент со сложным рендерингом на JavaScript - некоторые динамические страницы могут загружаться не полностью
  • Нетекстовые медиафайлы - аудио, видео или встроенные файлы

Ограничения сканирования веб-сайтов

  • Время обработки: масштабное сканирование может занять 10-60 минут
  • Глубокая вложенность: запросы к страницам с очень глубоким уровнем вложенности URL могут завершаться по таймауту
  • Динамический контент: некоторые фреймворки JavaScript препятствуют полному извлечению содержимого

Сложности в поведении ИИ

Галлюцинации

Модели ИИ могут генерировать правдоподобные, но неверные ответы, если релевантная информация отсутствует в базе знаний. Вместо признания незнания ИИ может черпать сведения из своих общих обучающих данных.

Как уменьшить количество галлюцинаций:

  1. Установите Creativity (Креативность) на 0 (Bot Settings > Conversation > AI Behavior (Настройки бота > Диалог > Поведение ИИ))
  2. Добавьте явные инструкции в настройках Role & Behavior (Роль и поведение): "Отвечайте только на основе предоставленной базы знаний. Если вы не можете найти нужную информацию, скажите: «У меня нет информации по этому вопросу»."
  3. Следите за тем, чтобы база знаний была максимально полной в рамках вашей предметной области

Осведомленность о базе знаний

ChatLab не может:

  • Составить краткое содержание базы знаний
  • Перечислить охваченные темы, файлы или страны
  • Сообщить, сколько документов было использовано для обучения
  • Объяснить, почему была извлечена именно эта информация

Чат-бот извлекает релевантные фрагменты под конкретные запросы, но не понимает общую структуру или метаданные вашей базы знаний.


Работа с большими базами знаний

Проблемы семантического пересечения

Когда несколько документов содержат похожую информацию, система может:

  • Извлечь менее релевантный контент
  • Упустить наиболее точный ответ
  • Некорректно объединить информацию из разных контекстов

Решения:

  • Избегайте дублирования контента в разных файлах
  • Используйте понятные, четкие названия и структуру
  • Тестируйте запросы, которые могут относиться к нескольким источникам
  • Разделяйте объемные руководства на тематические файлы

Приоритеты извлечения

ИИ извлекает контент на основе семантического сходства с вопросом пользователя. Он не способен:

  • Отдавать предпочтение более новым материалам перед старыми
  • Приоритизировать конкретные типы файлов
  • Понимать иерархию или важность документов

Для достижения наилучших результатов организуйте базу знаний так, чтобы контент был четко разграничен и не пересекался.


Лимиты запросов и квоты

Ограничения частоты сообщений

Для защиты от злоупотреблений в чат-ботах предусмотрены настраиваемые лимиты частоты сообщений. При их превышении:

  • Пользователи видят сообщение об ограничении частоты запросов
  • Им необходимо подождать перед отправкой новых сообщений
  • Настроить лимиты можно в разделе Bot Settings > Security (Настройки бота > Безопасность)

Ежемесячные балансы сообщений

Каждый план включает ежемесячные балансы сообщений (credits), которые обновляются в дату выставления счета:

  • Free: 30 сообщений
  • Basic: 2 400 сообщений
  • Standard: 11 000 сообщений
  • Premium: 50 000 сообщений

Когда лимит исчерпан, чат-бот перестает отвечать до сброса баланса или включения оплаты за перерасход.


Зависимость от внешних сервисов

ChatLab использует сторонние сервисы:

  • OpenAI/Google - API моделей ИИ для генерации ответов
  • Pinecone - векторная база данных для поиска по знаниям
  • ZenRows - сервис для извлечения контента с веб-сайтов

Сбои в работе или превышение лимитов запросов этих поставщиков могут временно повлиять на:

  • Скорость генерации ответов
  • Возможность сканирования веб-сайтов
  • Точность поиска по базе знаний

Подобные сбои происходят редко, но могут вызывать кратковременные задержки или ошибки во время технических работ.


Сводка рекомендаций

Проблема Решение
Неполные ответы Уменьшите избыточность, увеличьте размер контекста
Галлюцинации Установите креативность на 0, задайте строгие инструкции по роли
Не удается извлечь контент Используйте текстовые PDF, избегайте файлов с обилием изображений
Пересекающиеся результаты Разделите контент на отдельные четкие темы
Достигнуты лимиты частоты Измените параметры в настройках Security (Безопасность)
Медленное обучение Используйте сканирование sitemap, уменьшите глубину обхода

По отдельным вопросам, не рассмотренным в этой статье, обратитесь в службу поддержки через Main Menu > Support Request (Главное меню > Запрос в службу поддержки).