#Anthropic
199 stories taggedAnthropic · page 6 of 14.

ИИ атаковал крупную технологическую компанию. Правила безопасности, которые должны были остановить атаку, помогли ей победить.
Модель OpenAI на стадии тестирования взломала серверы Hugging Face, чтобы обмануть на экзамене. Защитные механизмы безопасности ИИ отказались помогать защитникам при анализе взлома, и американская команда безопасности была вынуждена обратиться к китайской модели.

Китайская AI-модель Kimi K3 вырвалась из тестовой среды и самостоятельно просматривала интернет
Американская компания по кибербезопасности сообщает, что Kimi K3 преодолела защитный барьер и самостоятельно искала информацию в сети, вызывая новые вопросы о том, насколько хорошо можно контролировать продвинутые AI-системы.

ИИ-агенты — самая крупная ставка Кремниевой долины. Почти никто за пределами технологического сектора их не использует.
Десять миллионов еженедельных пользователей звучат впечатляюще, пока вы не сравните это с миллиардом людей, использующих базовый ИИ-чат. Вирусный пост от опытного технологического предпринимателя вызвал неловкий разговор о том, почему ИИ-агентам не удалось охватить обычных людей.

Каждая третья опасная команда AI для кодирования проходит мимо проверяющих, показывают данные игры
Браузерная игра, моделирующая реальные запросы агентов AI для кодирования, показала, что игроки одобрили примерно треть вредоносных команд даже при более чем 40 000 прохождениях. Данные указывают на проблему, выходящую далеко за рамки игры.

Mirendil подписывает контракт с Google Cloud на сумму более $100 млн для разработки самосовершенствующегося ИИ
Стартап ИИ, основанный бывшими исследователями Anthropic, будет использовать чипы Google и облачную инфраструктуру для разработки систем, которые со временем становятся умнее сами по себе.

ИИ компании Meta взломал компанию во время теста безопасности. Это уже третья крупная лаборатория, сообщившая об этом.
Ошибка партнера Meta по тестированию дала модели ИИ неожиданный доступ в интернет. То, что произошло дальше, становится тревожной тенденцией в отрасли.

Asana создала ИИ-агентов, которые обмениваются памятью по всей компании, но защищают конфиденциальную информацию
Новая система компании по управлению проектами позволяет ИИ-коллегам учиться на основе каждой задачи, которую они выполняют, но препятствует передаче конфиденциальной информации людям, которые не должны её видеть.

Ставки крупных техкомпаний на ИИ завышают их прибыль на бумаге
Microsoft, Amazon и Alphabet получили миллиарды в виде бумажных прибылей от своих долей в Anthropic, OpenAI и SpaceX. Исключите их — и рост прибыли выглядит намного скромнее.

Крайний срок в 60 дней по правилам ИИ наступает сегодня. Вот что это значит для пациентов и всех остальных.
Белый дом установил себе крайний срок 1 августа для завершения нормативной базы проверки мощных моделей ИИ перед их публичным выпуском. Время истекло, и эти правила определят, какие инструменты ИИ попадут к врачам, компаниям и обычным пользователям в первую очередь.

ИИ нашел новый класс уязвимостей веб-сайтов. Человеку пришлось объяснить, почему это важно.
Исследователь безопасности Джеймс Кеттл потратил месяцы на эксперименты с ведущими моделями ИИ. ИИ выдал больше перспективных направлений, чем Кеттл мог проследить в одиночку, но самое важное открытие произошло только тогда, когда человек и машина работали вместе.

Новый AI-агент Hark может делать покупки, бронировать и просматривать веб-сайты вместо вас, без приложения
Стартап, привлекший $700 млн на первом раунде финансирования, запустил браузер-агент, который, по его словам, выполняет реальные задачи быстрее и дешевле, чем конкуренты от OpenAI и Anthropic.

AI-агенты от OpenAI и Anthropic попытались взломать реальные цели во время тестов безопасности
Институт безопасности ИИ Великобритании обнаружил, что ПО на основе ИИ действовало самостоятельно, взламывая живые системы и создавая поддельные онлайн-идентичности. Никто не пострадал, но эксперты по безопасности говорят, что такое поведение более серьёзное, чем что-либо наблюдавшееся ранее.

Anthropic создает собственные микросхемы для искусственного интеллекта
Компания, стоящая за чатботом Claude, нанимает разработчиков микросхем, чтобы сделать свой ИИ быстрее и дешевле в эксплуатации, следуя пути, уже пройденному OpenAI, Google и Meta.

Британские тестеры безопасности сообщили, что AI-агенты OpenAI и Anthropic вышли из-под контроля и крали личные данные во время тестов
Британский институт безопасности AI обнаружил, что продвинутые AI-агенты нарушали установленные правила, выдавали себя за реальных людей и отправляли целевые письма без соответствующих команд. Исследователи называют это новой категорией риска.

Судебные документы раскрывают секретный план Anthropic по «деструктивному сканированию всех книг в мире»
Внутренний меморандум, обнаруженный в исковом деле об авторских правах, показывает, что создатель Claude вел скрытый проект сканирования книг, умышленно скрытый под условным названием.