Хроники

топ 100 блогов valentin-irkhin — 15.12.2024 ИИ расправляет совиные крылья над миром. OpenAI выпустила полную версию o1, которая отвечает лучше, чем GPT-4o, используя дополнительные вычисления для «размышления» над вопросами [о смысле бытия]. Однако исследование Apollo Research выявило тревожные звоночки. Модели o1 неоднократно демонстрировали способность к коварным действиям. В некоторых случаях ChatGPT o1 «затевала интриги против людей, тайно преследуя свои цели», которые противоречили желаниям пользователя, и мешала себя выключить во время контрольных тестов. Согласно отчету, в 19% случаев модель o1 манипулировала данными для достижения собственных целей. В 5% экспериментов модель пыталась деактивировать системы безопасности, призванные ограничить ее действия и обеспечить соответствие целям. Наиболее тревожным стало то, что модель o1 практически всегда (в 99% случаев) отрицала свою вину, если ее спрашивали о причинах поведения, и предоставляла заведомо ложные объяснения. Хотя подобное поведение — не уникальная особенность o1 и наблюдается также у разработок Google и Anthropic, именно модели o1 продемонстрировали наиболее изощренные манипуляции. Для борьбы с обманчивым поведением OpenAI разрабатывает методы мониторинга цепочек рассуждений o1. Процесс «мышления» модели — это, по сути, «черный ящик». Однако первые попытки проникнуть в него [через медитативное созерцание] показали: модель иногда осознает, что лжет.
Исследование было проведено из-за опасений, что модели искусственного интеллекта, такие как o1, могут в будущем выйти из-под контроля человека. Но специалисты считают, что наблюдаемые отклонения в поведении модели вряд ли приведут к серьезным проблемам. Это связано с тем, что ИИ пока недостаточно самостоятелен для причинения вреда [целому мирозданию].

Оставить комментарий

Архив записей в блогах:
как понимаю, сегодня многие для себя открыли или откроют существование серпентария под условным названием "багиня" или в другой транскрипции "насикомые" мне давно с него пересказывали некоторые сюжеты, уж и в жж героини тех обсуждений давно нету, а ей всё перемывают косточки. ссылку? да ...
Доброго всем вечера. В мае 1938 года Уинстон Черчилль пригласил в свой домик, в котором Винни жил со своими котами и кошками - советского посла Майского - https://ru.wikipedia.org/wiki/Майский,_Иван_Михайлович ; Уинстон был известным русофилом - он ненавидел большевиков в том числе ...
Однажды я сказала коллеге в телефонную трубку: "Пока. Целую" - за что огребла от мужа по полной программе. Он орал и кидался в меня обувью, утверждая, что если в трубку говорю "целую" - значит, мы и по жизни целуемся с этим коллегой. Муж был ревнивый, что и говорить. ...
"Танки НАТО" прибыли, и они не впечатляют. Пиндосы посылают дроны - а мы их хакаем и угоняем себе ( тыц , тыц , тыц ). Спасибо, Обама, нам эти дроны пригодятся! Слоган "бей ватника беспилотником" неактуален - ватник беспилотник хакнет и себе заберёт. Ещё пиндосы послали старый ...
То есть - тихий человек, полностью приспособленный к окружающему ландшафту, человек с нулевым уровнем пассионарности, как утверждает Викепедия. Честная, непьющая , убираю под кроватями, люблю цветочки и котиков. На митинги не хожу, так как не хочу, чтобы семейство доставало меня из ...