НЕДЕЛЯ · 31 АВГУСТА–7 СЕНТЯБРЯ 2026

AI-статьи недели
с Хабра

Одна статья с проверяемым рецептом и три разбора, которые полезно держать рядом, но не стоит выдавать за готовую инструкцию.

1 карточка3 на заметку289 статей просмотрено30 текстов вычитано
📝 О чём пишут

Неделя оказалась шумной: много статей обещают быстрый RAG, локальных агентов или общий шлюз к моделям. При строгой проверке большинство рецептов упирается в закрытый стек или пропущенные файлы. Рабочий сигнал дал другой приём: разделить исполнение и проверку так, чтобы агент не мог принять собственную работу.

01

Стоит попробовать

Карточка прошла проверку применимости: в тексте есть самостоятельные шаги и конкретная улика.

01

Поставьте независимый гейт между работой агента и её принятием

✍ Андрей ИльинХабр⏱ ≈12 минAI-агентыcode reviewCodex
О чём

Статья показывает, как не дать одному и тому же агенту и выполнить задачу, и поставить ей PASS. Результат работы живёт в файлах, а отдельный проверяющий проход получает только пути к ним и пишет свой вердикт.

🔑 Главное
  • Гейт держится на трёх условиях: отдельный проверяющий, файлы вместо пересказа и один владелец каждого файла.
  • Переход к следующей стадии возможен только после строки вердикта другого прохода.
  • Автор сообщает о 444 обращениях к модели за месяц: 167 исполняющих и 277 проверяющих; около каждой шестой задачи получила отказ.
  • Проверяйте сам гейт: тесты могут быть зелёными, а журнал прогонов — пустым.
⚡ Попробовать за вечер
  • Создайте в репозитории work.md, review.md и правило: исполнителю разрешена запись только в первый файл.
  • После работы запустите отдельного verifier без истории чата и передайте ему только пути к изменённым файлам и work.md.
  • Сделайте выпуск зависимым от строки PASS в review.md; при FAIL верните задачу исполнителю.
  • Метрика: за 10 задач посчитайте долю FAIL и время от начала работы до чужого вердикта.
02

На что обратить внимание

Эти материалы дают полезный вывод, но в них не хватает переносимого рецепта для карточки.

Как честно тестировать AI-ревью

Автор размечает 60 мутантов и показывает, что подсказка со строкой поднимает результат примерно на 20 процентных пунктов. Стенд привязан к TypeScript-монорепозиторию и не опубликован, поэтому берите метод проверки, а не цифры как универсальную норму.

Андрей Малышев · Хабр ↗

RAG требует гибридной проверки

В статье есть сравнение BM25, векторного поиска и RRF на 12 документах и 51 вопросе. Авторский код неполон, зато сам вывод пригоден: проверяйте поиск отдельно на перефразированных вопросах и точных кодах.

Зыков Иван · Хабр ↗

Правила для агента не заменяют актуальный контракт

Эксперимент с дизайн-системой показывает связку: устойчивые правила в skill, точные факты через MCP, затем typecheck и build. Сам MCP закрытый, но разделение источников правды можно перенести в свой проект.

Егор · Хабр ↗
03

Мой план на неделю

Взять одну задачу с агентом и отделить исполнителя от проверяющего через файлы результата.до среды
Добавить в гейт два намеренно неверных результата и проверить, что verifier их отклоняет.до пятницы
Собрать десять прогонов: PASS, FAIL, длительность и причину отказа.до воскресенья
04

Данные выпуска

ОКНО31 августа — 7 сентября 2026, Europe/Moscow
ИСТОЧНИКПостраничный API Хабра: профильные AI-хабы и top_weekly
СКАН289 статей; в дайджесте 4 материала: 1 карточка и 3 на заметку
ПОКРЫТИЕВсе три профильные ленты покрывают окно; top_weekly — штатный срез top-100
МЕДИА0 использовано: изображения не добавлялись, потому что не были нужны для понимания материалов
ДОКАЗАТЕЛЬСТВАselection-evidence.json