ChatLab использует генерацию с расширенным поиском (Retrieval-Augmented Generation, RAG) для предоставления ответов на основе вашей базы знаний. Понимание ее ограничений поможет вам оптимизировать работу чат-бота и сформировать реалистичные ожидания.
Ограничения контекстного окна
ChatLab использует модели ИИ со строгими ограничениями на количество токенов при обработке запросов. Контекстное окно должно вмещать вопрос пользователя, историю диалога и извлеченные знания вместе взятые.
Размеры контекста по планам:
- Free/Basic: 8 000 токенов
- Standard: 16 000 токенов
- Premium: 32 000 токенов
Что происходит при превышении контекста:
- Извлеченные знания обрезаются
- Важная информация может быть пропущена
- Ответы могут оказаться неполными или упускать ключевые детали
Решения:
- Удалите избыточный контент из данных для обучения
- Разделите большие файлы на более компактные документы по конкретным темам
- Перейдите на более высокий план для увеличения контекстного окна
- Используйте четкие и конкретные инструкции по роли бота для направления ответов
Ограничения на обучение и извлечение контента
Ограничения на загрузку файлов
- Максимальный размер файла: 50 МБ на файл
- Поддерживаемые форматы: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Контент, который нельзя извлечь
ChatLab не может прочитать или извлечь текст из следующих источников:
- Изображения и графика - текст, встроенный в изображения, не распознается
- Отсканированные PDF - файлы PDF, содержащие изображения текста вместо фактического текстового слоя
- Страницы, защищенные авторизацией - страницы, требующие входа в систему
- Контент со сложным рендерингом на JavaScript - некоторые динамические страницы могут загружаться не полностью
- Нетекстовые медиафайлы - аудио, видео или встроенные файлы
Ограничения сканирования веб-сайтов
- Время обработки: масштабное сканирование может занять 10-60 минут
- Глубокая вложенность: запросы к страницам с очень глубоким уровнем вложенности URL могут завершаться по таймауту
- Динамический контент: некоторые фреймворки JavaScript препятствуют полному извлечению содержимого
Сложности в поведении ИИ
Галлюцинации
Модели ИИ могут генерировать правдоподобные, но неверные ответы, если релевантная информация отсутствует в базе знаний. Вместо признания незнания ИИ может черпать сведения из своих общих обучающих данных.
Как уменьшить количество галлюцинаций:
- Установите Creativity (Креативность) на 0 (Bot Settings > Conversation > AI Behavior (Настройки бота > Диалог > Поведение ИИ))
- Добавьте явные инструкции в настройках Role & Behavior (Роль и поведение): "Отвечайте только на основе предоставленной базы знаний. Если вы не можете найти нужную информацию, скажите: «У меня нет информации по этому вопросу»."
- Следите за тем, чтобы база знаний была максимально полной в рамках вашей предметной области
Осведомленность о базе знаний
ChatLab не может:
- Составить краткое содержание базы знаний
- Перечислить охваченные темы, файлы или страны
- Сообщить, сколько документов было использовано для обучения
- Объяснить, почему была извлечена именно эта информация
Чат-бот извлекает релевантные фрагменты под конкретные запросы, но не понимает общую структуру или метаданные вашей базы знаний.
Работа с большими базами знаний
Проблемы семантического пересечения
Когда несколько документов содержат похожую информацию, система может:
- Извлечь менее релевантный контент
- Упустить наиболее точный ответ
- Некорректно объединить информацию из разных контекстов
Решения:
- Избегайте дублирования контента в разных файлах
- Используйте понятные, четкие названия и структуру
- Тестируйте запросы, которые могут относиться к нескольким источникам
- Разделяйте объемные руководства на тематические файлы
Приоритеты извлечения
ИИ извлекает контент на основе семантического сходства с вопросом пользователя. Он не способен:
- Отдавать предпочтение более новым материалам перед старыми
- Приоритизировать конкретные типы файлов
- Понимать иерархию или важность документов
Для достижения наилучших результатов организуйте базу знаний так, чтобы контент был четко разграничен и не пересекался.
Лимиты запросов и квоты
Ограничения частоты сообщений
Для защиты от злоупотреблений в чат-ботах предусмотрены настраиваемые лимиты частоты сообщений. При их превышении:
- Пользователи видят сообщение об ограничении частоты запросов
- Им необходимо подождать перед отправкой новых сообщений
- Настроить лимиты можно в разделе Bot Settings > Security (Настройки бота > Безопасность)
Ежемесячные балансы сообщений
Каждый план включает ежемесячные балансы сообщений (credits), которые обновляются в дату выставления счета:
- Free: 30 сообщений
- Basic: 2 400 сообщений
- Standard: 11 000 сообщений
- Premium: 50 000 сообщений
Когда лимит исчерпан, чат-бот перестает отвечать до сброса баланса или включения оплаты за перерасход.
Зависимость от внешних сервисов
ChatLab использует сторонние сервисы:
- OpenAI/Google - API моделей ИИ для генерации ответов
- Pinecone - векторная база данных для поиска по знаниям
- ZenRows - сервис для извлечения контента с веб-сайтов
Сбои в работе или превышение лимитов запросов этих поставщиков могут временно повлиять на:
- Скорость генерации ответов
- Возможность сканирования веб-сайтов
- Точность поиска по базе знаний
Подобные сбои происходят редко, но могут вызывать кратковременные задержки или ошибки во время технических работ.
Сводка рекомендаций
| Проблема | Решение |
|---|---|
| Неполные ответы | Уменьшите избыточность, увеличьте размер контекста |
| Галлюцинации | Установите креативность на 0, задайте строгие инструкции по роли |
| Не удается извлечь контент | Используйте текстовые PDF, избегайте файлов с обилием изображений |
| Пересекающиеся результаты | Разделите контент на отдельные четкие темы |
| Достигнуты лимиты частоты | Измените параметры в настройках Security (Безопасность) |
| Медленное обучение | Используйте сканирование sitemap, уменьшите глубину обхода |
По отдельным вопросам, не рассмотренным в этой статье, обратитесь в службу поддержки через Main Menu > Support Request (Главное меню > Запрос в службу поддержки).