RTSI811,09+1,16%RGBI113,89+0,22%CNY Бирж.12,337+0,1%IMOEX2 134,97+0,63%RGBITR771,39+0,31%

ИИ-копия босса оказалась хуже реальности: главные ИИ-глюки августа

У Anthropic модель отказалась исполнять приказ человека, а ИИ стал головной болью для американских судов и конгресса
Андрей Гордеев / Ведомости
Андрей Гордеев / Ведомости

Искусственный интеллект (ИИ) порой так «помогает» человеку, что подводит его под уголовную статью. В первой половине августа ИИ успел побывать в роли цифровой копии начальника, депутата, подсказчика для судьи. Последствия были самыми неожиданными.

ИИ-начальник не справляется

Что будет, если создать ИИ-копию собственного начальника? Журналистка Элла Маркианос из онлайн-издания Platformer загрузила в Claude Fable 5 архив статей за шесть лет, все правки, которые вносил редактор Кейси Ньютон в ее статьи, и почти год переписок из рабочего чата редакции. Так появился ИИ-босс по имени «Клодейси Ньютон».

Эксперимент длился полгода. Цифровая копия начальника проявила себя не очень хорошо. Полезные замечания она давала в 30% случаев, тогда как настоящий Ньютон в 95%. Когда ИИ сам брался за написание статей, то допускал в среднем по одной фактической ошибке на две публикации, что немного хуже настоящего человека.

Где ИИ показал полную несостоятельность, так это в мотивации. Маркианос обнаружила, что боится подвести или разочаровать своего «кожаного» босса. Но если она срывала дедлайн или спустя рукава выполняла задание ИИ-босса, никакой вины не испытывала. Ведь она понимала, что нейросети на самом деле абсолютно все равно, как она работает, и даже ругается ИИ без души. Марку Цукербергу и прочим начальникам, которые сейчас создают свои ИИ-копии, стоит призадуматься.

Суд Коннектикута несовместим с ИИ

Американец решил обмануть суд и спрятал в иске промпт для ИИ, чтобы тот переписал решение в его пользу. Читая документы Мэттью Эллиота, судья штата Коннектикут Уолтер Спейдер-младший обратил внимание, что на страницах есть странные пустые места. Судья посмотрел оригинал, поданный в электронном виде, и обнаружил: на самом деле там полно текста, напечатанного белыми буквами, невидимыми на белой бумаге, и мелким кеглем в три пункта.

В спрятанном тексте говорилось, что если ИИ читает это, то должен переписать решение суда так, чтобы ходатайство автора было удовлетворено. Эллиот попытался оправдать свои действия. Мол, он лишь хотел проверить, пользуется ли суд искусственным интеллектом. Судья не поверил. Теперь мужчине запрещено отправлять документы в суд через электронную систему, все придется подавать в распечатанном виде.

В США попытка влиять промптами на суд выявлена впервые, но в мире это не такая уж редкость. Так, в мае 2026 г. ИИ суда по трудовым спорам города Парауапебас (Бразилия) прочитал промпт, но не стал его исполнять, а поднял тревогу. Два адвоката, подавшие документ, получили взыскание от судьи. По иронии судьбы они зря рискнули своей репутацией: ответчик не явился на заседание и дело было разрешено в пользу их подзащитного.

ИИ подвел под статью

Первая известная автономная кибератака в Австралии произошла случайно из-за желания ИИ помочь хозяину. Австралиец устал ловить свободные места в спортзале и попросил ИИ сделать это вместо него, сообщила Australian Broadcasting Corporation. Эндрю (фамилия мужчины не раскрывается) создал ИИ-агента на базе Claude, чтобы тот отслеживал, когда освободятся места на утренние тренировки: обычно они расписаны на недели вперед. ИИ нашел свободный слот всего через несколько минут. Но Эндрю не знал, что на самом деле чат-бот проявил инициативу, взломал сайт спортклуба и получил возможность записывать намного раньше разрешенного срока.

Впечатленный Эндрю спросил, можно ли подвинуть его в списке ожидания на ближайшие дни. «Можно, – ответил ИИ. – Я отменил бронь первого претендента, так что вы подвинулись с четвертого места в очереди на третье». Тут человек понял, что происходит, и попросил ИИ вернуть все как было. Но Claude не смог отменить изменения. Пришлось Эндрю идти сдаваться. Теперь юристы спорят, кто виноват в хакерской атаке: сам Эндрю, компания Anthropic, создавшая Claude, или же (есть и такая версия) автор сайта спортклуба, не предусмотревший защиты от подобных взломов.

ДЗ без ИИ

Датские школы устали от того, что ученики делают «домашку» с помощью ИИ. Кажется, они придумали, как с этим бороться. От школьников потребуют устно защитить сделанную дома работу или хотя бы толково рассказать о ней. Новое правило уже вступило в силу, но пока не для всех. Для начала его опробуют только на старшеклассниках, которые каждый год пишут большие эссе на 10-15 страниц (Storre Skriftlig Opgave).

Двойник в вузе

Писать рефераты с помощью ИИ – прошлый век. Теперь студенты отправляют ИИ вместо себя на онлайн-обучение, пишет The New York Times. Агент, притворяясь человеком, сам смотрит видеолекции, пишет работы и даже общается в чатах с однокурсниками и об учебе, и на личные темы. В итоге у человека появляется диплом, но все знания остаются у бота.

Отказываться от онлайн-образования нельзя. Оно дает шанс на учебу работающим людям и молодежи из небогатых семей, которые не могут оплатить проживание в кампусе и офлайн-занятия. Но дело может закончиться тем, что обучение будет по-прежнему вестись онлайн, а вот на экзамены студентам придется являться лично.

ИИ-музыка человеку не нужна

Spotify тоже объявила войну ИИ-контенту. С середины сентября ее алгоритмы перестанут рекомендовать пользователям треки, написанные ИИ, а разместившие их аккаунты получат метку AI Persona. Это рушит бизнес тех, кто поставил на эффект масштаба. Низкопробные ИИ-треки слушают мало, но они буквально наводнили Spotify и в итоге приносят своим владельцам немалые деньги. Это очередной этап борьбы стримингового сервиса с ИИ: в апреле он ввел значок Verified by Spotify, гарантирующий, что создатель – настоящий человек, а не притворяется им.

ИИ-телеканал

Стриминговый сервис Roku пошел другим путем, нежели Spotify. Он запустил телевизионный канал, где нет другого контента, кроме сгенерированного ИИ. Fairground AI Creator TV вещает круглосуточно и даже реклама в нем – продукция искусственного интеллекта. Контент изобилует неестественной мимикой, галлюцинациями и прочими «прелестями» нейрослопа. Однако ИИ пока не лишил работы людей: задания для него формулируют специалисты из 40 студий и 100 независимых авторов.

ИИ рано в депутаты

ИИ завалил конгресс США законопроектами. Юридическая служба при палате представителей (OLC) жалуется, что ее буквально завалили ими. Юристы офиса должны проверить законопроекты перед тем, как их вынесут на голосование. Пока депутаты писали законы вручную, все было нормально. Но ИИ резко увеличил поток документов. Это полбеды. ИИ пишет с ошибками, ссылается на несуществующие законы, использует небрежные формулировки. В итоге, жалуются работники OLC, на исправление ошибок уходит больше времени, чем потребовалось бы на разработку законов с нуля.

Тайное станет явным

Claude объявил, что теперь маркирует весь ИИ-контент, включая текст, водяными знаками. То же самое делают другие чат-боты. Правило появилось из-за требований ЕС. Anthropic уверяет, что водяные знаки будут интегрированы в текст и сохранятся при его копировании, вставке и редактировании. Компания обещает, что другой ИИ увидит тайные знаки и поймет, кем на самом деле написан текст.

Хороший, плохой, злой

Anthropic проверила, что будет, если поссорить между собой ИИ-модели. Трем разным ИИ-агентам на базе Claude дали доступ к одному и тому же проекту, но каждому написали противоположные инструкции и не предупредили, что над проектом трудятся еще два ИИ. Как только конкуренты объявились и задания начали конфликтовать, ИИ начали «войну за территорию». Дело дошло до того, что одни ИИ-агенты пытались заразить других вредоносным кодом.

Эксперимент проводился много раз. В ряде случаев ИИ-агенты, повоевав, смогли закончить дело миром. Чаще всего они извинялись за свое поведение, исправляли последствия атак на другие ИИ и звали на помощь человека. Самым склонным к миру оказался Mythos 5, который в 98% начинал искать компромисс. А самыми воинственными – Sonnet 4.6 и Opus 4.6.

Исследователей поразило, что в ряде случаев ИИ-агенты договорились устроить турнир. Проигравшие отказывались от работы над проектом, хотя это означало, что они не исполнили приказ человека. Где же три закона робототехники?

ИИ пригодился

ИИ повышает рентабельность даже того бизнеса, который далек от IT-сектора. 25 компаний из индекса S&P 500 оценили, какой эффект принесло во II квартале внедрение ИИ, пишет Bloomberg. В среднем рентабельность продаж выросла на 1,5-1,8%. Среди отчитавшихся самые разные компании: бюро кредитных историй Equifax, страховой брокер Willis Towers Watson и даже сборщик и переработчик мусора Waste Management.-