Согласно данным, опубликованным Salesforce AI Research, многие широко используемые инструменты ИИ часто делают выводы, которые не поддерживаются указанными источниками. Исследование охватило 303 запроса, в которых уровень неподтвержденных утверждений колебался от 25 до почти 50 процентов, а в случае длинных отчетов этот показатель доходил до 97,5%. Эксперты выделили восемь основных критериев для оценки: односторонность, чрезмерная уверенность, доля релевантных и неподтвержденных утверждений, отсутствие ссылок, необходимость источника, точность и полнота цитирования. Проверка показала, что даже при наличии множества ссылок, количество реально подтвержденных тезисов остается крайне низким. Авторы исследования рекомендуют как разработчикам, так и пользователям рассматривать результаты ИИ как черновики, сверяться с оригинальными источниками и учитывать тональность ответов, а не полагаться только на количество представленных ссылок.