Заметки
Короткие тексты о методологии и архитектурных решениях в AI-системах, которые я довожу до продакшена: спецификации, evals, мультиагентная оркестрация, LLM-интеграции и дисциплина работы с coding-агентами.
14 июня 2026 г.
Теперь ваш ИИ-контент обязан говорить, что он ИИ
10 июня 2026 года Еврокомиссия опубликовала Кодекс практики по маркировке ИИ-контента — практическое руководство к требованиям прозрачности, которые становятся обязательными по Закону ЕС об ИИ со 2 августа. Дипфейки и сгенерированный ИИ текст по вопросам общественной значимости должны быть чётко помечены, а людям нужно сообщать, что они говорят с чат-ботом. Кодекс добровольный; обязанность за ним — нет. Раскрытие становится нормой по умолчанию, и это не просто бюрократия — это решение про доверие. Разбираем, что это значит для всех, кто выпускает ИИ-контент.
- business
- security
13 июня 2026 г.
Зелёная галочка может скрывать сломанную середину
Вот режим сбоя, что съедает ИИ-агентов в проде: агент выполняет многошаговую задачу, где-то в середине сворачивает не туда — и всё равно выдаёт финальный ответ, что проходит вашу проверку. Вывод выглядит чисто. Рассуждение было сломано. Исследователи нашли, что именно так и падают многошаговые агенты: ошибка на третьем шаге незаметно протекает в сводку на десятом, что читается нормально и при этом неверна. Если вы оцениваете только финальный ответ, вы слепы к большей части того, как агенты реально ломаются. Вот почему и что проверять вместо этого.
- methodology
- agents
13 июня 2026 г.
Агенты становятся фичей, а не продуктом
Gartner ждёт, что 40% корпоративных приложений встроят задачных ИИ-агентов к концу 2026-го — против менее 5% год назад. Агентный ИИ — самый быстрорастущий корпоративный приоритет, рост на 31,5% за год. Вместе эти цифры говорят нечто неуютное для многих стартапов: агент превращается в фичу внутри софта, которым люди уже пользуются, а не в отдельный продукт, на который они переходят. Если «мы построили агента, что делает X» — весь ваш питч, то приложение, что владеет X, вот-вот построит то же. Вот что это значит для того, что вы строите.
- business
- ai-native
13 июня 2026 г.
Сначала тянись к маленькой модели
Рефлекс — слать каждую задачу в самую большую, самую умную модель. Цифры говорят, что это обычно неверный дефолт. Маленькая модель на 7 миллиардов параметров работает в 10–30 раз дешевле, чем на 70–175B, Phi от Microsoft держит уровень GPT-3.5 при 98% меньшем вычислении, а больше двух миллиардов телефонов уже гоняют годные модели локально без всякого облака. Gartner ждёт, что задачные маленькие модели будут использоваться втрое чаще общих LLM к 2027-му. Вот почему «сначала маленькая» становится умным дефолтом — и когда всё же тянуться к большой.
- ai-native
- business
13 июня 2026 г.
Настоящий дедлайн AI Act — в августе
2 августа 2026-го вступают в силу обязательства AI Act ЕС для высокорисковых ИИ-систем — часть с настоящими зубами: документация, надзор, управление рисками и штрафы до 35 млн евро или 7% мирового оборота. Две вещи делают это запутанным. На март лишь 8 из 27 стран-членов вообще создали свою точку контакта для правоприменения. И ни у кого нет чистого ответа, кто отвечает, когда автономный агент действует сам. Если ваш софт касается пользователей из ЕС, вот что реально меняется и какой разрыв нужно закрыть.
- business
- security
13 июня 2026 г.
Самое большое окно контекста не побеждает
Каждый запуск модели хвастается окном контекста побольше — миллион токенов, два миллиона, вся кодовая база разом. Но анализ корпоративных внедрений нашёл, что почти 65% сбоев агентов шли от дрейфа контекста и потери памяти на многошаговой работе, а не от слишком маленького окна. Команды, что выпускают надёжных агентов в 2026-м, — не те, у кого окно больше. Это те, кто жёстче всех курирует то, что модель реально видит. Вот в чём разница и почему «больше» часто хуже.
- agents
- methodology