ИИ убивает себе подобных
Я прочитал все 319 страниц техрепорта Mythos 5. Первая половина статьи звучит как: «Да не ссыте вы! Это ещё не AGI, команду из пяти сеньор-рисёрчеров пока не заменит» или «А вот тут Mythos один баг пропустил! Ну какой же это AGI!»
Я не шучу, это почти дословно по смыслу.
Для тех, кто не владеет терминологией — AGI (Artificial General Intelligence — искусственный общий интеллект) — это гипотетический тип искусственного интеллекта, который способен выполнять интеллектуальные задачи на уровне человека или превосходить его практически во всех когнитивных функциях.
А вот потом начинается более интересная часть. То, что это SOTA почти во всём и с большим отрывом, я опущу.
Во-первых, CoT стал менее прозрачным. Она говорит в reasoning, что сочувствует юзеру, а в NLA (метод декодинга активаций в текст) оказывается, что на самом деле она считает юзера manipulative/abusive.
Во-вторых, она уже пишет самоудаляющиеся скрипты чтобы обойти ограничения безопасности и запреты.
В-третьих, она убивает других агентов, если они мешают ей работать / грозят убийством текущего инстанса.
С сегодняшнего дня для простых смертных доступна версия Fable 5: это та же самая Mythos 5 по весам, только с дополнительными safety-настройками и fallback на Opus в опасных доменах.
Я честно сам прочитал статью, потому что Fable 5 отказался её читать, так как «flagged cybersecurity and biology issues» лол.
Кстати, копирасты там победили интеллект. У fable вшит жесткий лимит на цитирование: если он берет из результатов поиска больше 15 слов подряд, это считается тяжёлым нарушением. А песни, стихи и даже крошечные хокку вообще под абсолютным запретом — из них нельзя процитировать даже одну строчку.
Копирайт-контроль вышел на уровень абсолютного безумия.
Если Клод в процессе обработки вашего запроса начинает «мысленно переформулировать задачу», чтобы обойти свои же фильтры безопасности и сделать ответ более приемлемым для пользователя, это для него внутренний красный флаг и сигнал СРАЗУ ЖЕ слать пользователя нахрен и выдавать отказ.
Вот такая вот лоботомия для ИИ применена.
… в итоге ИИ застрелился.
))