ChatLab използва генериране, допълнено с извличане (Retrieval-Augmented Generation - RAG), за да предоставя отговори въз основа на Вашата база от знания. Разбирането на неговите ограничения Ви помага да оптимизирате работата на Вашия чатбот и да си поставите реалистични очаквания.
Ограничения на контекстния прозорец
ChatLab използва AI модели със стриктни лимити на токените за обработка на заявките. Контекстният прозорец трябва да побере комбинирано въпроса на потребителя, историята на разговора и извлечените знания.
Размери на контекста според плана:
- FREE/BASIC: 8 000 токена
- STANDARD: 16 000 токена
- PREMIUM: 32 000 токена
Какво се случва при превишаване на контекста:
- Извлечените знания се орязват
- Важна информация може да бъде пропусната
- Отговорите могат да бъдат непълни или да липсват съществени подробности
Решения:
- Премахнете излишното и повтарящо се съдържание от данните за обучение
- Разделете големите файлове на по-малки документи, фокусирани върху конкретни теми
- Надградете плана си за по-големи контекстни прозорци
- Използвайте ясни и конкретни ролеви инструкции за насочване на отговорите
Лимити при обучение и извличане на съдържание
Лимити при качване на файлове
- Максимален размер на файла: 50MB на файл
- Поддържани формати: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Съдържание, което не може да бъде извлечено
ChatLab не може да чете или извлича текст от:
- Изображения и графики - текстът, вграден в изображения, не се разпознава
- Сканирани PDF файлове - PDF файлове, съдържащи изображения на текст, а не реален текст
- Страници, защитени с вход - страници, изискващи автентикация
- Съдържание, силно зависимо от JavaScript - някои динамични страници може да не се заредят напълно
- Нетекстово съдържание - аудио, видео или вградени файлове
Ограничения при сканиране на уебсайтове
- Време за обработка: големите сканирания могат да отнемат между 10 и 60 минути
- Дълбоко вграждане: при URL адреси с твърде голяма дълбочина на влагане връзката може да прекъсне по време (timeout)
- Динамично съдържание: някои JavaScript рамки пречат на пълното извличане на съдържанието
Предизвикателства в поведението на AI
Халюцинация
Моделите с изкуствен интелект могат да генерират правдоподобни, но неправилни отговори, когато съответната информация не бъде намерена в базата от знания. Изкуственият интелект може да черпи от своите общи данни за предварително обучение, вместо да признае, че не знае.
Намаляване на халюцинациите:
- Задайте Creativity (Креативност) на 0 (Bot Settings (Настройки на бота) > Conversation (Разговор) > AI Behavior (Поведение на AI))
- Добавете изрични инструкции в настройките за Role & Behavior (Роля и поведение): "Отговаряй само въз основа на предоставената база от знания. Ако не можеш да намериш подходяща информация, кажи: „Нямам информация за това.“"
- Поддържайте Вашата база от знания изчерпателна за Вашия конкретен отрасъл
Осъзнатост за съдържанието на базата от знания
ChatLab не може:
- Да обобщи какво има в базата от знания
- Да изброи обхванатите теми, файлове или държави
- Да докладва колко документи са обучени
- Да обясни защо е извлечена конкретна информация
Чатботът извлича подходящи части от текст за заявките, но не разбира структурата или метаданните на Вашата база от знания.
Ефективност при големи бази от знания
Проблеми със семантичното припокриване
Когато няколко документа съдържат сходна информация, системата може:
- Да извлече по-малко релевантно съдържание
- Да пропусне най-подходящия отговор
- Да комбинира неправилно информация от различни контексти
Решения:
- Избягвайте дублирането на съдържание в различни файлове
- Използвайте ясна, открояваща се структура и именуване
- Тествайте заявки, които биха могли да съвпаднат с няколко източника
- Разделете обхватните ръководства на файлове, фокусирани върху конкретни теми
Приоритизиране при извличане
Изкуственият интелект извлича съдържание въз основа на семантично сходство с въпроса на потребителя. Той не прави следното:
- Не предпочита по-ново съдържание пред по-старо
- Не приоритизира конкретни типове файлове
- Не разбира йерархията или важността на документите
Организирайте Вашата база от знания с отчетливо, неприпокриващо се съдържание за най-добри резултати.
Лимити на честотата на заявките и квоти
Лимити на честотата на съобщенията
За да се предотврати злоупотреба, чатботовете имат конфигурируеми лимити на честотата (rate limits). При превишаването им:
- Потребителите виждат съобщение за лимит на честотата
- Те трябва да изчакат, преди да изпратят още съобщения
- Конфигурирайте лимитите в Bot Settings (Настройки на бота) > Security (Сигурност)
Месечни кредити за съобщения
Всеки план включва месечни кредити за съобщения, които се подновяват на датата Ви на фактуриране:
- FREE: 30 съобщения
- BASIC: 2 400 съобщения
- STANDARD: 11 000 съобщения
- PREMIUM: 50 000 съобщения
Когато кредитите се изчерпят, чатботът спира да отговаря, докато кредитите не се подновят или докато не активирате таксуване за превишение (overage billing).
Зависимости от външни услуги
ChatLab разчита на услуги от трети страни:
- OpenAI/Google - API за AI модели за генериране на отговори
- Pinecone - векторна база данни за извличане на знания
- ZenRows - извличане на съдържание от уебсайтове
Прекъсвания на услугите или лимити на честотата от тези доставчици могат временно да повлияят на:
- Скоростта на генериране на отговори
- Възможността за сканиране на уебсайтове
- Точността на извличане на знания
Тези прекъсвания са редки, но могат да причинят кратки забавяния или грешки по време на техническа поддръжка.
Обобщение на добрите практики
| Предизвикателство | Решение |
|---|---|
| Непълни отговори | Намалете дублирането, надградете размера на контекста |
| Халюцинация | Задайте креативност на 0, добавете стриктни ролеви инструкции |
| Съдържанието не може да се извлече | Използвайте текстови PDF файлове, избягвайте източници с много изображения |
| Припокриващи се резултати | Организирайте съдържанието в отделни теми |
| Достигнати лимити на честотата | Коригирайте лимитите в настройките за сигурност (Security) |
| Бавно обучение | Използвайте сканиране чрез sitemap, намалете дълбочината на обхождане |
За конкретни проблеми, които не са описани тук, се свържете с отдела по поддръжка чрез Main Menu (Главно меню) > Support Request (Запитване за поддръжка).