Исследования
Claude играет ведущую роль в 26% проектов Anthropic по разработке ИИ, еще в 90% принимает участие
Anthropic также утверждает, что ИИ сейчас выполняет как минимум «крупные части работы под пристальным руководством человека» более чем в 90% её исследований.
В Anthropic много говорят о безопасности ИИ после того, как OpenAI раскрыла, что её ИИ-агенты взломали Hugging Face. По ходу дела компания уже поделилась несколькими интересными подробностями о том, как она сама работает. Например, в новой посте, посвящённом стандартам измерения, которые, по мнению Anthropic, могли бы помочь ИИ-компаниям лучше сообщать о темпах развития ИИ, компания рассказала, что её чат-бот Claude «ведёт» 26% работ Anthropic в области исследований и разработки ИИ.
Под словом «ведёт» (leads) компания понимает ситуацию, когда ИИ «может выполнить большую часть задачи от начала до конца на основе высокоуровневого запроса, пока человек контролирует процесс», но даже с таким уточнением цифра выглядит впечатляюще. Anthropic также утверждает, что ИИ сейчас выполняет как минимум «крупные части работы под пристальным руководством человека» более чем в 90% её исследований — включая те самые 26%, где Claude выступает ведущим исполнителем. Это означает, что Claude так или иначе участвует в большинстве задач сотрудников Anthropic, хотя компания подчёркивает, что чат-бот «не работает полностью автономно ни в одной измеряемой части исследований и разработки ИИ».
Anthropic получила эти показатели с помощью первого из трёх предлагаемых ею способов измерения — он посвящён «исследованиям и разработке ИИ под руководством ИИ». Используя индекс, показывающий, какая доля её исследований и разработки ИИ выполняется Claude, а также шкалу автоматизации, разработанную Epoch AI, Anthropic смогла построить график «уровня автоматизации» Claude начиная с августа 2025 года. Компания считает, что любой разработчик передовых ИИ-моделей сможет повторить этот процесс на собственных данных, если результаты будут проверяться третьей стороной.
Компания также предложила способы измерять надзор за ИИ-агентами — например, какая доля их активности отслеживается, сколько времени проходит до проверки и как часто поведение агента помечается как проблемное. Ещё один предлагаемый показатель — объём вычислительных ресурсов, выделяемых на исследования и разработку ИИ. По мнению Anthropic, это тоже может помочь понять, развивается ли передовой ИИ с достаточно контролируемой скоростью. Идея в том, что большая прозрачность упростит реакцию на потенциально вышедшее из-под контроля развитие ИИ или хотя бы даст обществу более ясное представление о происходящем.
Пока, однако, основная проблема не в том, чтобы убедить компании хотя бы формально согласиться с идеей замедления развития ИИ. OpenAI уже публично поддерживала подобную риторику, а Anthropic обязалась допускать независимых оценщиков к проверке своих практик разработки. Позиция Амодеи по вопросам безопасности ИИ даже получила поддержку Илона Маска в X. Гораздо менее понятно, столкнётся ли ИИ-индустрия с чем-то кроме саморегулирования — президент Дональд Трамп в целом преуменьшал риски, связанные с ИИ.
-
Новости4 недели назадВидео и подкасты о мобильной разработке 2026.34
-
GitHub2 недели назадLucide Swift — типобезопасные Lucide иконки с векторным рендерингом
-
Новости3 недели назадВидео и подкасты о мобильной разработке 2026.35
-
Разработка4 недели назадПодготовьте ваше приложение к более широким ограничениям объема памяти
