Заметки
Короткие тексты о методологии и архитектурных решениях в AI-системах, которые я довожу до продакшена: спецификации, evals, мультиагентная оркестрация, LLM-интеграции и дисциплина работы с coding-агентами.
Избранное
Свежее
3 июля 2026 г.
ИИ должен был быть дешевле человека
Весь бизнес-кейс замены роли агентом держится на одном числе: модель дешевле зарплаты. В 2026-м начали приходить счета — и число перестало быть правдой. Forbes вышел с заголовком, что ИИ может стоить дороже людей, которых заменил; Uber спалил годовой ИИ-бюджет примерно за четыре месяца; Meta пришлось ограничить собственных инженеров. Заменив человека агентом, ты не удалил работу. Ты превратил фиксированную зарплату в счётчик токенов плюс время сеньора, который теперь всё это проверяет, правит и убирает за агентом. Посчитай это до увольнений.
- business
- careers
3 июля 2026 г.
Инъекция промпта — не баг, который запатчат
Команды упорно относятся к инъекции промпта как к обычной уязвимости — той, что рано или поздно закроет апдейт модели или хитрый фильтр. Не закроет. Отчёт OWASP 2026 и растущий ряд исследователей теперь описывают её как постоянное свойство того, как работают LLM: модель действительно не отличает твои инструкции от данных, которые читает. Как только это принимаешь, задача меняется. Ты перестаёшь пытаться предотвратить инъекцию и начинаешь делать так, чтобы удавшаяся не могла нанести ущерб, — а это сводится к тому, чтобы ни один агент не держал три силы, превращающие отравленный вход в утечку.
- security
- architecture
3 июля 2026 г.
Агент, который переписывает сам себя, не имеет спеки
Новый маркетинговый козырь — «саморазвивающийся» агент: он меняет собственное поведение прямо на ходу, чтобы тебе не приходилось его обновлять. ServiceNow и NVIDIA только что нацелили такого на твой рабочий стол. Но продакшн-софту нужнее всего одно: неподвижная мишень, относительно которой можно проверять. Агент, переписывающий собственную логику, — это система, где то, что ты протестировал, и то, что работает на следующей неделе, — разные вещи. Пусть учится в данных, которые ты можешь прочитать и сбросить, — но не в поведении, за изменением которого не уследить.
- agents
- architecture
3 июля 2026 г.
Модель стала товаром. Чип — нет.
Два года вся игра была в том, какая модель умнее. Эта игра заканчивается: Claude Sonnet 5 вышел с качеством уровня Opus за долю цены, лаборатории гоняются за стоимостью, а не за IQ, и сменить провайдера теперь — это правка конфига. Когда слой способностей становится товаром, ров сползает вниз по стеку — к инференс-кремнию и стойкам. OpenAI только что вытравил собственный чип. Вот что это значит для остальных, кто строит сверху: нижний порог твоей цены за токен задают двумя слоями выше люди, которых ты никогда не встретишь, — так что проектируй с этим в уме.
- business
- architecture
3 июля 2026 г.
Нельзя юнит-тестить бросок кости
Разработчик встраивает LLM в систему, пишет вокруг обычный тест «прошёл/не прошёл», видит, что он флакает, и дальше либо удаляет тест, либо мокает модель до бессмысленности. Оба варианта неверны. Вероятностный компонент не сломан, когда варьируется, — но «оно варьируется» не даёт права перестать его тестировать. Просто надо тестировать распределение, а не единичный сэмпл: оценивать золотой набор с допуском, ставить порог на процент прохождений, проверять инварианты, которые обязаны держаться каждый раз, и держать жёсткую границу между стохастическим ядром и детерминированной оболочкой вокруг него.
- methodology
- eval
1 июля 2026 г.
ИИ-долг в коде не гасится. Он тихо компаундится.
Цена ИИ-кода — не баг, который ловишь на ревью, а изъян, который выживает, ничей, в кодовой базе, ментальной модели которой нет ни у кого. Исследование 2026 года по 300k+ ИИ-коммитов нашло, что почти четверть внесённых ИИ проблем всё ещё на HEAD. Человеческий долг гасится, потому что кто-то помнит, как его писал. ИИ-долг просто накапливается, потому что не писал никто. Единственная реальная страховка — не больше покрытия тестами. Это понимание.
- architecture
- methodology