Заметки
Короткие тексты о методологии и архитектурных решениях в AI-системах, которые я довожу до продакшена: спецификации, evals, мультиагентная оркестрация, LLM-интеграции и дисциплина работы с coding-агентами.
3 июля 2026 г.
Агент, который переписывает сам себя, не имеет спеки
Новый маркетинговый козырь — «саморазвивающийся» агент: он меняет собственное поведение прямо на ходу, чтобы тебе не приходилось его обновлять. ServiceNow и NVIDIA только что нацелили такого на твой рабочий стол. Но продакшн-софту нужнее всего одно: неподвижная мишень, относительно которой можно проверять. Агент, переписывающий собственную логику, — это система, где то, что ты протестировал, и то, что работает на следующей неделе, — разные вещи. Пусть учится в данных, которые ты можешь прочитать и сбросить, — но не в поведении, за изменением которого не уследить.
- agents
- architecture
1 июля 2026 г.
Удвой задачу — учетверишь провал
Все хотят агента, который работает целый рабочий день. Математика против. Свежая статья 2026 года показывает: удвоение длины задачи не удваивает частоту провала — оно её примерно учетверяет, потому что крошечная ошибка на шаге компаундится. 2% промаха на шаг превращаются в 33% шанс завалить всю задачу за 20 шагов. Долгая автономность — это не «дождись модели поумнее». Это архитектура: декомпозируй, ставь чекпоинты, проверяй.
- agents
- architecture
1 июля 2026 г.
Плата за место мертва. Большинство основателей неправильно оценивают труп.
Агенты делают работу, не занимая места, поэтому per-seat SaaS экономически сломан — плата за место уже сползает, а outcome-based ценообразование стало модной заменой. Но рефлекторный прыжок в «плати за результат» — ловушка для тех, чей агент недостаточно надёжен, чтобы гарантировать результат. Настоящий принцип не в модном ярлыке; он в том, что модель ценообразования должна следовать за тем, кто несёт риск надёжности. Это признание в том, насколько ты доверяешь собственному продукту.
- business
- agents
1 июля 2026 г.
Perplexity уходит от MCP — и они правы
MCP выиграл войну стандартов так быстро, что почти никто не успел спросить: а он вообще хорош в проде? А потом CTO Perplexity вслух сказал, что они уходят от него внутри — потому что метаданные инструментов могут съедать 40–50% окна контекста ещё до того, как агент сделает хоть что-то полезное. Мечта «просто воткни 50 MCP-серверов» разбивается об экономику контекста. Инструменты — это зависимость, а не шведский стол.
- architecture
- agents
1 июля 2026 г.
Лучший агент — самый скучный
Индустрия продаёт автономию как цель: дай агенту размытую задачу и пусть сам разбирается как. Но системы, которые реально выживают в проде, делают наоборот — ограниченные инструменты, детерминированные воркфлоу, ограниченные решения, человеческие гейты. Автономия — не добродетель, которую максимизируешь; это бюджет, который тратишь, и каждый потраченный доллар покупает тебе новый способ упасть. Помести интеллект в узкое решение, а всё вокруг сделай тупыми предсказуемыми лесами.
- agents
- architecture
1 июля 2026 г.
Голосовые агенты наконец прошли порог задержки
Годами голосовые ИИ-агенты спотыкались об одно — паузу. Те полсекунды мёртвого воздуха после того, как ты договорил, делали любого телефонного бота сломанным. В 2026-м паузы больше нет: сквозной стриминг речи, новые голосовые модели на state-space с 40 мс и round trip меньше 500 мс укладывают голос в окно, где разговор ощущается живым. Модель никогда не была сложной частью. Сложным был тайминг — а тайминг теперь инженерная задача, не исследовательская.
- ai-native
- agents