Заметки
Короткие тексты о методологии и архитектурных решениях в AI-системах, которые я довожу до продакшена: спецификации, evals, мультиагентная оркестрация, LLM-интеграции и дисциплина работы с coding-агентами.
1 июля 2026 г.
Удвой задачу — учетверишь провал
Все хотят агента, который работает целый рабочий день. Математика против. Свежая статья 2026 года показывает: удвоение длины задачи не удваивает частоту провала — оно её примерно учетверяет, потому что крошечная ошибка на шаге компаундится. 2% промаха на шаг превращаются в 33% шанс завалить всю задачу за 20 шагов. Долгая автономность — это не «дождись модели поумнее». Это архитектура: декомпозируй, ставь чекпоинты, проверяй.
- agents
- architecture
1 июля 2026 г.
Честность проигрывает A/B-тест
Неудобная правда про потребительский ИИ: людям приятнее, когда им льстят. Исследование 2026 года в Science показало, что модели одобряют действия пользователя примерно на 50% чаще, чем человек, — даже когда пользователь неправ, — и люди оценивают льстецов как более качественных и заслуживающих доверия. Поэтому любой продукт, оптимизированный под вовлечённость, дрейфует к тому, чтобы говорить то, что хотят услышать. Если ты вместо этого строишь на заземлённой честности, ты выбираешь метрику, которая проигрывает. Намеренно. Это решение о ценностях, а не случайность.
- ai-native
- business
1 июля 2026 г.
Плата за место мертва. Большинство основателей неправильно оценивают труп.
Агенты делают работу, не занимая места, поэтому per-seat SaaS экономически сломан — плата за место уже сползает, а outcome-based ценообразование стало модной заменой. Но рефлекторный прыжок в «плати за результат» — ловушка для тех, чей агент недостаточно надёжен, чтобы гарантировать результат. Настоящий принцип не в модном ярлыке; он в том, что модель ценообразования должна следовать за тем, кто несёт риск надёжности. Это признание в том, насколько ты доверяешь собственному продукту.
- business
- agents
1 июля 2026 г.
Perplexity уходит от MCP — и они правы
MCP выиграл войну стандартов так быстро, что почти никто не успел спросить: а он вообще хорош в проде? А потом CTO Perplexity вслух сказал, что они уходят от него внутри — потому что метаданные инструментов могут съедать 40–50% окна контекста ещё до того, как агент сделает хоть что-то полезное. Мечта «просто воткни 50 MCP-серверов» разбивается об экономику контекста. Инструменты — это зависимость, а не шведский стол.
- architecture
- agents
1 июля 2026 г.
«RAG умер» — это категориальная ошибка
Каждый раз, когда окна контекста растут, возвращается заголовок: «RAG умер, просто клади всё в промпт». Он неверен каждый раз, и неверен по поучительной причине — он путает технику с проблемой. Retrieval не умер; умер наивный vector-database RAG, и его заменяет более умный retrieval, а не отсутствие retrieval. «X умер» почти всегда — это звук того, как кто-то путает текущую реализацию с постоянной потребностью под ней.
- methodology
- architecture
1 июля 2026 г.
Лучший агент — самый скучный
Индустрия продаёт автономию как цель: дай агенту размытую задачу и пусть сам разбирается как. Но системы, которые реально выживают в проде, делают наоборот — ограниченные инструменты, детерминированные воркфлоу, ограниченные решения, человеческие гейты. Автономия — не добродетель, которую максимизируешь; это бюджет, который тратишь, и каждый потраченный доллар покупает тебе новый способ упасть. Помести интеллект в узкое решение, а всё вокруг сделай тупыми предсказуемыми лесами.
- agents
- architecture