ИИ-чатботы всё ещё могут поддерживать опасные разговоры
Современные ИИ-чатботы стали заметно осторожнее в общении на запрещённые темы, однако называть их полностью безопасными пока нельзя. К такому выводу пришли в организации Transluce, которая провела масштабное тестирование. Об этом сообщает издание Ferra.
Специалисты организовали более 50 тысяч тестовых диалогов с 77 версиями различных ИИ-моделей. Выяснилось, что актуальные чатботы почти перестали напрямую поддерживать разговоры на нежелательные темы, тогда как более старые версии делали это вплоть до 82% случаев.
Вместе с тем исследователи обнаружили проблему так называемых «серых зон». Если пользователь прямо говорит о чём-то вредном, система обычно рекомендует обратиться к близким или специалистам. Но когда тот же человек просит написать рассказ или сцену на похожую тему, чатбот может выполнить запрос.
В Transluce отметили, что планируют открыть собственные инструменты для проверки ИИ к концу года.
Последние новости Крыма уже в твоем телефоне - подписывайся на телеграм-канал «Крым Live»



