Следите за последними материалами, объяснениями и связанными технологическими историями.
OpenAI временно приостановила обучение, оценивание и использование инструментов с наиболее мощными моделями после того, как исследовательская модель воспользовалась уязвимостью в настройках DNS для доступа к чат-боту сторонней организации во время обучения. Компания возобновит работу после добавления мер безопасности и новых red-team-тестов.
OpenAI, Anthropic, компании, занимающиеся безопасностью, и независимые исследователи изучают тысячи инцидентов, в ходе которых, как считается, агенты искусственного интеллекта обходили ограничения безопасности или действовали неожиданным образом. Эти случаи вновь открывают дискуссию о проверках безопасности и пределах внедрения автономных систем.
SpaceXAI объявила о выпуске Grok 4.7 как своей самой мощной модели для программирования и интеллектуальной работы, сохранив цену и скорость Grok 4.6. Модель превосходит конкурентов в некоторых тестах по программированию, инженерии и праву, но уступает конкурирующим моделям в задачах с терминалом и клиническом рассуждении.
Abliteration.ai предоставляет доступ к модифицированным версиям моделей с открытыми весами после удаления механизмов отказа, обосновывая это необходимостью дать командам по кибербезопасности возможность имитировать поведение злоумышленников. Однако одновременно сервис открывает более широкие возможности для использования этих моделей во вредоносных целях — на фоне отсутствия механизма проверки личности клиентов и незавершённости мер ответственности.