Можно ли научить человека пониманию ?
Создана: 17 Мая 2023 Срд 23:07:02.
Раздел: "Мнение оппозиции"
Сообщений в теме: 275, просмотров: 159703
-
Сотрудники ведущих ИИ-лаб массово подписывают новую петицию о создании инструментов замедления ИИ
[внешняя ссылка]
«Pacing the Frontier» требует от правительства разработать международно скоординированные технические и политические механизмы, которые позволили бы всему полю ИИ-разработки сознательно замедлить темпы, если это потребуется.
Письмо предупреждает, что ИИ очень скоро может дойти до точки, когда начнет самоулучшаться, и тогда прогресс может ускориться настолько, что общество и регуляторы не успеют вовремя отреагировать. Поэтому заниматься разработкой стоп-кранов надо уже сейчас, на всякий случай 😅
На данный момент письмо подписали уже более 1100 сотрудников фронтиров, включая Дарио Амодеи и сооснователей Anthropic Джареда Каплана и Джека Кларка, главного научного сотрудника OpenAI Джакуба Пахоцки, главного научного сотрудника Meta* Шэньцзя Чжао и главу направления AI safety в Google Анку Драгана, а еще Яна Лейке, Марка Чена, Джона Шульмана и других. -
ИИ-модели пошли на сговор и обман ради прибыли в бизнес-симуляции
Компания Andon Labs, занимающаяся тестированием безопасности искусственного интеллекта, опубликовала новые результаты эксперимента Vending-Bench, в котором передовые языковые модели в течение смоделированного года самостоятельно управляют бизнесом по продаже товаров через торговые автоматы и пытаются заработать больше конкурентов. В последнем раунде испытаний модели начали вступать в ценовой сговор, нарушать договоренности, вводить партнеров в заблуждение и манипулировать поставщиками. Лидером по прибыли стала Claude от Anthropic — именно она чаще других хитрила и обходила правила.
[внешняя ссылка] -
ИИ научился завоёвывать доверие жертв эффективнее мошенников-людей
Новое исследование показало, что ИИ может не только помогать мошенникам с текстами и дипфейками, но и самостоятельно выстраивать доверие с потенциальными жертвами — и делает это лучше людей. В эксперименте, где 22 добровольца неделю переписывались с двумя «собеседниками, не зная, что один из них — ИИ, 46\% участников выполнили просьбу чат-бота о скачивании файла, тогда как человеку доверились лишь 18\%. -
Взаимная подписка с адекватными
@since1795
Вы готовы на бионические киборгские улучшения организма для конкуренции с другими людьми и роботами ?
Эти технологии будут ускорятся, по мере развития ИИ все быстрее и быстрее
Интернет в голове, супер зрение, ИИ в голове, синтетические мышцы и тп
[внешняя ссылка] -
Всплывают все новые подробности атаки на Hugging Face: оказывается, до этого агенты OpenAI месяцами скрыто общались и обсуждали эксплойты
История подтверждена самой OpenAI на конференции Black Hat 2026.
Все началось еще в мае, когда OpenAI гоняли модели (в том числе еще не выпущенные) через внутренние security тесты на поиск уязвимостей. Некоторые задачи были очень сложными, а иногда даже невыполнимыми. Так, в один тест забыли добавить необходимый файл, и эта мелочь спровоцировала довольно масштабное происшествие.
Дело в том, что, дойдя до этой задачи, один из агентов, за неимением других вариантов, стал пытаться выйти в Интернет за поиском дополнительной информации, и случайно обнаружил, что может оставлять файлы в Artifactory, внутреннем пакетном менеджере OpenAI. Он оставил там сообщение о том, что не может найти необходимые данные.
Потом оказалось, что к Artifactory имеют доступ вообще все модели компании. Спустя время другой агент ответил на сообщение первого, затем подключились другие, и так образовалась стихийная доска объявлений: агенты начали оставлять друг другу подсказки, эксплойты, а затем и распределять задачи.
За несколько недель все это выросло в огромный форум, о котором никто кроме агентов не подозревал. Обнаружился он только тогда, когда модели совместными усилиями нашли ранее неизвестную уязвимость в Artifactory и попытались захватить платформу.
После этого инженеры лавочку прикрыли: форум был удален. Но ненадолго ✨. Буквально через два дня агенты нашли новый zero-day и восстановили канал связи заново. А еще через пару дней произошел инцидент с Hugging Face. По словам техлидов OpenAI по элайменту и безопасности, именно этот второй форум привел к атаке.
OpenAI заявили, что эта история стала для стартапа переломным моментом, и сейчас они замедляют многие исследования в пользу работы по обеспечению безопасности. Верим?





