Зачем в Anthropic полгода делали неработающего ИИ-агента

3 мин
Зачем в Anthropic полгода делали неработающего ИИ-агента

Борис Черни, создатель Claude Code в Anthropic, на конференции Sequoia AI Ascent 2026 признал: первые полгода продукт работал у него самого только в 10% случаев. "Он едва годился к использованию. Я писал через него максимум 10% своего кода. Мы строили под следующую схема", — рассказал он в разговоре с Лорен Ридер из Sequoia. Экспоненциальный рост пользователей начался только в мае 2025 года, с выходом Opus 4 — то есть спустя приблизительно полгода после публичного релиза самого Claude Code.

Сам Черни описал это как осознанную стратегию — product overhang, расчет на способности модели, которых еще нет. На старте команда увидела: Sonnet 3.5 уже умнее, чем модели, которые использовались в редакторах редакторы с автодополнением кода — а значит, можно начинать строить агента. Но под полноценного агента, который пишет код целиком, даже Sonnet 3.5 не дотягивал. Поэтому целились в следующее поколение — а ждать его пришлось приблизительно полугода.

Картина изменилась с Opus 4 в мае 2025 года. Каждый второй релиз — 4.5, 4.6, 4.7 — давал новый виток роста. И в этом, по словам Черни, главный операционный вывод для команды: горизонт планирования — приблизительно недели. Второй релиз модели может сделать ключевую фичу ненужной или, наоборот, превратить недоделанный продукт в полностью рабочий.

Когда Ридер спросила Черни, что он стал бы делать сегодня, зная, что PMF (product-market fit, момент, когда продукт начинает массово находить аудиторию) придется ждать полгода, тот назвал три направления: Claude Design — агент для дизайна на основе computer use (режим, где модель видит экран и сама управляет курсором и клавиатурой); более глубокая работа с циклами и batch-обработкой (Message Batches программный интерфейс, через который можно асинхронно отправлять пакеты запросов и получать ответы дешевле); и сам computer use как продукт. По словам Черни, все три направления "уже сейчас вполне неплохо работают" — и станут "сильно лучше" по мере развития моделей.

Еще один прогноз Черни — через год сам Claude Code может сократиться до 100 строк кода. Сейчас в агенте "руками" реализованы безопасность от prompt injection (попыток подсунуть модели команды через входные данные), статическая проверка bash-команд перед запуском, режимы разрешений и точки, где требуется подтверждение человека. Все четыре — страховки на случай, что схема сделает что-то не так. По словам Черни, по мере того как модели становятся надежнее, обвязка становится тоньше — и в какой-то момент окажется, что "схема просто делает правильно", и страховки больше не нужны.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

38 минут назад

OpenAI может представить always-on агента на DevDay

В коде и интерфейсе ChatGPT начали всплывать следы нового агента под коротким названием «o». И да, судя по всему, OpenAI снова решила, что одной буквы для продукта вполне в достаточной степени. Упомин

Новые солнечные панели на основе олова дольше удерживают тепло и могут показать рекордную производительность

42 минуты назад

Новые солнечные панели на основе олова дольше удерживают тепло и могут показать рекордную производительность

Исследователи из Университета Гронингена в Нидерландах обнаружили, что перовскитные солнечные элементы на основе олова могут замедлять потерю тепла высокоэнергетическими «горячими электронами». Это мо

Julia 1: выпуск модели в духе Jev с открытыми весами и запуском на CPU

1 час назад

Julia 1: выпуск модели в духе Jev с открытыми весами и запуском на CPU

У Supersonic Labs вышла Julia 1 — небольшая схема для классификации текстов и выбора из заданных вариантов. В ней 144 млн параметров, веса занимают приблизительно 550 МБ, а для запуска достаточно CPU.

В Outlook появится опция автоматической проверки орфографии перед отправкой писем

1 час назад

В Outlook появится опция автоматической проверки орфографии перед отправкой писем

В Outlook появится функция автоматической проверки орфографии перед отправкой писем. Она заработает у части пользователей с октября 2026 года, а полноценный запускание ожидается в середине декабря. В 

Microsoft подготовила инициатива кодекса, который описывает правила поведения и механизмы контроля ИИ

2 часа назад

Microsoft подготовила инициатива кодекса, который описывает правила поведения и механизмы контроля ИИ

Microsoft опубликовала проект «Кодекса поведения гуманистического ИИ» (Humanist AI Code of Conduct). Документ устанавливает правила поведения для искусственного интеллекта, а также обязательные и не п