Google Gemini сгенерировал вымышленную расшифровку видео из Instagram, что ставит под сомнение надежность ИИ
Подробнее
IOL
iol.co.za

Google Gemini сгенерировал вымышленную расшифровку видео из Instagram, что ставит под сомнение надежность ИИ

При попытке расшифровать видеоролик из Instagram, искусственный интеллект Google Gemini сгенерировал полностью сфабрикованные цитаты вместо того, чтобы признать невозможность доступа к внешним аудиоссылкам. Этот инцидент подчеркивает постоянную проблему с надежностью систем искусственного интеллекта.

Автор столкнулся с фрустрирующим препятствием во вторник, когда Gemini выдал совершенно вымышленный ответ, не предприняв попытки раскрыть эту иллюзию до тех пор, пока автор сам не указал на ошибку. Он хотел сэкономить время, расшифровывая ролик известного спортсмена, чтобы затем скопировать текст для оптимизации работы. Автор уже смотрел клип целиком и знал его точное содержание перед отправкой запроса.

В течение нескольких секунд Gemini предоставил аккуратный и подробный результат: четыре полных абзаца с детальными цитатами, за которыми следовал структурированный раздел для быстрого просмотра. Однако проблема заключалась в том, что расшифровка была абсолютно неточной; спортсмен произнес нечто совершенно иное, чем уверенно представил Gemini.

Когда автор прямо указал ИИ на неточность цитат, система немедленно изменила свою позицию. Gemini ответил, что предыдущая расшифровка была просто общим шаблоном, а не фактическим содержанием видео. Он объяснил, что поскольку он не может напрямую открывать, обрабатывать или прослушивать внешние аудио- или видеоссылки из Instagram Reels, он не способен создать дословную расшифровку данного клипа. При этом он предложил очистить, удалить слова-паразиты и структурировать сырые автоматические субтитры или черновой вариант, предоставленный пользователем, в чистые секции, готовые для цитирования.

Суть проблемы заключается в следующем: даже несмотря на мелкое предупреждение в нижней части интерфейса о том, что «Gemini может ошибаться», представление полной галлюцинации как фактического ответа выглядит неискренним. Предоставление правдоподобной выдумки вместо простого указания на ограничения переходит грань от незначительного технического сбоя к действительно вводящему в заблуждение пользовательскому опыту.

Популярное