● TELEGRAM AI DIGEST · BACKEND / AGENTS

AI-дайджест недели

Практичные приёмы, релизы и сдвиги из AI/agent-каналов Telegram для Go-backend инженера: что попробовать или поменять в работе на этой неделе.

🗓 окно 3 — 10 августа 2026 ⚡ выводов: 7 👀 на радаре: 3 📡 сообщений прочитано: 18
💡 Что важно на этой неделе

Неделя вышла про обвязку вокруг Codex, а не про модели. Соседние треды научились договариваться о приоритетах, деплой простой веб-страницы уехал внутрь агента поверх Cloudflare Workers, а логи в ~/.codex/sessions оказались готовым журналом работы, из которого агент сам собирает недельный отчёт. Вторая линия — спеки. Full-stack BDD-набор, который гоняет тысячу спеков в секунду, сводит постановку задачи к двум шагам: «напиши спеки» → «реализуй спеки»; в подкасте про внедрение та же мысль заходит с другой стороны — агенту нужен онбординг, как новому сотруднику, а не промпт получше. Третья — деньги: Meta отдаёт миллион токенов за $0,1 вместо $1,25, если разрешить учиться на ваших данных, и для рабочего репозитория это уже не настройка, а разговор с юристами. И напоминание из чужого личного бенча: Kimi K3 обошёл 5.6 sol на задаче, которой нет ни в одном лидерборде.

Главные практические выводы

01

Собрать недельный отчёт о прогрессе из логов сессий Codex

источник: LLM под капотом 9 авг

Автор просит Codex писать новости про прогресс своих проектов. Агенту это ничего не стоит: в ~/.codex/sessions уже лежат логи всех проектов — остаётся попросить их прочитать и пересказать.

Почему важно: когда репозиториев несколько, а неделя рваная, к пятнице никто не помнит, где что осталось недоделанным. Логи сессий — это уже готовый журнал работы, который не надо вести руками; из него собирается и статус для команды, и собственный список хвостов.

⚡ Как применить
  • Посмотреть, что каталог не пустой: ls ~/.codex/sessions | tail.
  • Дать Codex одну задачу: прочитать сессии за последние семь дней и собрать по каждому проекту три пункта — сделано, застряло, следующий шаг.
  • Положить результат в docs/weekly-progress.md и повторять по пятницам той же командой.
  • Проверка: сверить отчёт с git log --since="7 days ago" по тем же репозиториям. У каждого пункта должен найтись коммит, и ни один рабочий день не должен пропасть — тогда формат рабочий.

Риск в сессии попадают куски кода, внутренние пути и имена сервисов. Отчёт, собранный из них, нельзя отправлять наружу без вычитки.

Источник: LLM под капотом, 9 авг 2026, 2026-08-03_2026-08-10_llm_under_hood.json, id=920
02

Дать двум тредам Codex договориться о приоритетах вместо ручного развода по файлам

источник: Глеб Кудрявцев про AI 8 авг

У тредов Codex появилась возможность общаться друг с другом. Если два соседних треда случайно или намеренно правят один кусок кода, в одном из них можно написать: «вот в соседнем треде [id] агент делает сходную задачу, договорись с ним о приоритетах, чтобы друг другу не мешать» — и они распараллелят работу сами.

Почему важно: обычная авария при нескольких агентах — двое переписывают один файл и затирают чужие правки. Раньше это разводили руками: отдельный worktree на тред, ручное деление по пакетам. Теперь есть более дешёвый вариант для случая, когда задачи соседние, а не параллельные.

Тред A рефакторит handler Тред B чинит тесты того же пакета «договорись о приоритетах с тредом [id]» общий пакет в репозитории точка, где правки затирают друг друга
переговоры между тредами не заменяют worktree, но снимают самый частый конфликт
⚡ Как применить
  • Запустить два треда на соседних задачах в одном репозитории и записать id второго треда.
  • В первом треде дать фразу из поста: сослаться на соседний id и попросить договориться о приоритетах.
  • Страховку оставить прежней: по git worktree на тред, чтобы конфликт ловил git, а не договорённость агентов.
  • Проверка: прогнать так две задачи и посчитать, сколько раз пришлось разбирать правки в одном файле — против прошлого раза без переговоров.

Риск автор сам пишет, что не знает, насколько давно фича работает. Договорённость тредов — это не блокировка файла: под нагрузкой или при длинных задачах она ничего не гарантирует.

Источник: Глеб Кудрявцев про AI, 8 авг 2026, 2026-08-03_2026-08-10_gleb_pro_ai.json, id=709
03

Написать агенту онбординг, а не промпт получше

Подкаст про внедрение агентов в компании, разложенный по таймкодам. Три тезиса бьют в одну точку: люди не могут рассказать, как именно делают свою работу, а агенту, как и сотруднику, нужен онбординг (00:16:56); полностью автоматические системы регулярно проваливаются (00:24:39); доступ в терминал делает агента гибким, но усложняет контроль, и ценность смещается от производства результата к ответственности за него (00:36:43).

Почему важно: это меняет, что именно писать. Не очередную формулировку задачи, а документ про то, как здесь принято работать: как выкатывается сервис, что считается готовым, где границы. И отдельно — кто отвечает за результат, когда его произвёл агент.

⚡ Как применить
  • Выписать в AGENTS.md то, что обычно передаётся устно: порядок выката, каталоги, которые нельзя трогать, критерий «готово».
  • Для одной задачи с доступом в терминал зафиксировать список разрешённых команд и точку, где человек смотрит diff до push.
  • В описании задачи назвать владельца результата — человека, который жмёт merge и отвечает за последствия.
  • Проверка: дать агенту задачу по этому описанию и посчитать уточняющие вопросы и возвраты на доработку — против такой же задачи неделю назад.

Риск онбординг-док устаревает быстрее кода. Пока его не обновляют вместе с процессом, агент уверенно работает по вчерашним правилам, и это заметно только по испорченному результату.

Источник: Остриков пилит агентов, 8 авг 2026, 2026-08-03_2026-08-10_aostrikov_ai_agents.json, id=176; дубль — AI и грабли, id=545
04

Выкатывать одноразовый внутренний UI прямо из Codex, без репозитория и VPS

источник: AI и грабли 7 авг

На марафоне по агентам самым ходовым кейсом оказались рабочие веб-приложения с бэкендом на Google-таблицах и деплоем в одну строку — без GitHub, Docker и VPS. Теперь для этого не нужны внешние сервисы: OpenAI встроила такую штуку в Codex поверх Cloudflare Workers и их же R2. В Claude Code этого нет: их Artifacts — статическая страница на их домене.

Почему важно: у бэкендера регулярно копятся скрипты без интерфейса — ручной ретрай, просмотр очереди, разовый отчёт. Обычно им не дают UI, потому что ради этого надо заводить репозиторий, пайплайн и хост. Теперь порог — одна просьба агенту.

⚡ Как применить
  • Взять один свой скрипт без интерфейса и попросить Codex собрать вокруг него страницу и выкатить.
  • До выката решить, что туда попадает: R2 — внешнее хранилище, поэтому рабочие данные заменить на синтетические.
  • Ссылку и срок жизни страницы записать рядом со скриптом, чтобы «времянка» не осталась висеть без владельца.
  • Проверка: замерить время от «нужна страница» до рабочей ссылки. Если укладываешься в час, приём занимает нишу одноразового внутреннего UI.

Риск это чужой хостинг и чужое хранилище. Для внутренних данных компании путь закрыт, пока не согласован с безопасностью, а привязка к Workers и R2 усложнит переезд, если страница неожиданно приживётся.

Источник: AI и грабли, 7 авг 2026, 2026-08-03_2026-08-10_ai_i_grabli.json, id=544
05

Развести конфиги: дешёвый тариф Meta — только там, где не жалко данных

источник: эйай ньюз 6 авг

Meta выпустила своего агента Muse Code и вместе с ним модель Muse Spark 1.2. Заявляют, что с официальным харнессом она лучше Grok 4.5, но не дотягивает до Opus 5. Главное в релизе — цена: если разрешить Meta тренировать модели на ваших данных, миллион токенов стоит $0,1/$0,2 против обычных $1,25/$4,25.

Почему важно: разница больше чем в десять раз, и соблазн переставить дефолтную модель в агентском пайплайне велик. Автор канала прямо советует не вестись, если делаете что-то стоящее или строите стартап; для пет-проектов и опенсорса условие терпимое.

⚡ Как применить
  • Держать два профиля харнесса: рабочий и личный. Дешёвый тариф прописывать только в личном.
  • Записать в AGENTS.md рабочего репозитория список допустимых моделей, чтобы «попробовать на неделю» не осталось навсегда.
  • Перед переключением посчитать, сколько токенов в месяц реально уходит на агентские задачи.
  • Проверка: если пересчитанная экономия меньше пары часов вашей работы, менять модель незачем — решение принимается по числу, а не по прайсу.

Риск условие про обучение распространяется на содержимое запросов, то есть на код. Для рабочего репозитория это юридический вопрос, а не строчка в конфиге. Сравнение с Grok 4.5 и Opus 5 — заявление вендора, независимых прогонов в посте нет.

Источник: эйай ньюз, 6 авг 2026, 2026-08-03_2026-08-10_ai_newz.json, id=4675
06

Завести личный бенч из своей задачи и выбирать модель по нему

источник: Глеб Кудрявцев про AI 6 авг

На личном бенче автора Kimi K3 не просто не уступает 5.6 sol, а оказывается лучше; обе модели в режиме max. Бенч всегда один и тот же: полностью разрушаемая воксельная планета диаметром 1000 клеток, 60 fps при любом удалении от поверхности, на голом Rust без готовых движков.

Почему важно: у такого бенча есть свойство, которого нет у публичных таблиц: он повторяет вашу настоящую задачу, и результат прямо говорит, какую модель ставить в пайплайн. Он же ловит развороты вроде «была хуже — стала лучше», которые в лидербордах не видны.

⚡ Как применить
  • Выбрать одну задачу из своей работы, где приёмку делает машина: например, сгенерировать слой репозитория по спецификации и прогнать go test ./....
  • Зафиксировать её как файл-задание с критерием приёмки: тесты зелёные, бенчмарк не хуже прежнего.
  • Прогнать на ней две уже оплаченные модели в одинаковом режиме и с одинаковым контекстом.
  • Проверка: записывать долю прогонов, где тесты зелёные с первого раза. Дефолтную модель менять только если разница держится на трёх прогонах подряд.

Риск один бенч меряет один класс задач. У автора это 3D на Rust, и переносить его вывод на Go-бэкенд нельзя — нужен свой, иначе получится тот же лидерборд, только маленький.

Источник: Глеб Кудрявцев про AI, 6 авг 2026, 2026-08-03_2026-08-10_gleb_pro_ai.json, id=707
07

Разогнать быстрый набор тестов до секунды и ставить задачи спеками

источник: LLM под капотом 6 авг

В поездке автор завёл codex-демонов на linux-сервере и доделал full-stack event-driven BDD-фреймворк: спеки привязаны к UI-компонентам, например через go templ, а написание и поддержку он свалил на Codex. Спеки гоняются на одном ядре со скоростью тысяча в секунду; параллелизм он добавит, когда их станет больше тысячи, потому что гонять базовые бизнес-тесты дольше секунды считает недопустимым. С таким набором задачи ставятся с телефона в два шага: «напиши спеки под такую фичу», затем «реализуй эти спеки».

Почему важно: связка ложится на Go напрямую — go templ плюс быстрый набор тестов дают агенту проверяемый контракт и мгновенную обратную связь. Пока прогон идёт минуты, агент работает вслепую и приносит правки пачками; когда прогон занимает секунду, он чинит себя сам в цикле, а вы читаете только спеки.

задача с телефона агент пишет спеки вы читаете только их агент реализует только по спекам прогон спеков 1000 в секунду, 1 ядро красный спек возвращается агенту, а не вам
цена секунды: агент успевает исправиться до того, как вы откроете ноутбук
⚡ Как применить
  • Замерить go test ./... на бизнес-слое и вынести всё, что дольше секунды, в отдельный набор по build-тегу.
  • Следующую фичу начать со спеков: попросить агента написать их первыми, отревьюить только спеки, потом дать команду реализовать.
  • Поднять агента фоном на dev-сервере, чтобы ставить задачи не только с ноутбука.
  • Проверка: сравнить с прошлой фичей число раундов «агент прислал — вернул на доработку».

Риск тысяча спеков в секунду получается на его event-driven схеме; на обычном сервисе с базой и HTTP так не выйдет без отдельной работы по изоляции. И спеки, написанные агентом, надо читать: он охотно закрепляет текущее поведение вместо нужного.

Источник: LLM под капотом, 6 авг 2026, 2026-08-03_2026-08-10_llm_under_hood.json, id=918
🛰

На радаре, но без действий

Здесь то, что стоит держать в голове, но пока рано внедрять: рецепта в источнике нет либо результат ещё не опубликован.

🛰 Полгода чата, дистиллированные агентом в книгу

Записи и переписки чата за полгода скормили Claude и получили книгу про модели, контекст, агентов, тулзы, скиллы, MCP и субагентов. Приём переносится на рабочий чат команды, но в посте нет ни промпта, ни схемы разбиения — поэтому смотрим, а не повторяем. Сейчас книга бесплатна, автор пишет, что на следующей неделе будет 15к.

Пост ↗

🛰 Соревнование по задержкам с публичным baseline от Claude-агента

На spectral.tech надо собрать простую систему с минимальной задержкой, причём не только средней, но и в худших случаях. Интересно не участие, а baseline: ту же задачу решает Claude-агент, и его решение лежит в публичном репозитории. Автор предупреждает, что без C++, сетей и системного программирования приза не видать; дедлайн — 30 августа, 23:59 GMT+3, призовой фонд $12к.

Пост ↗

🛰 Stateless MCP 2.0 для доступа агентов к общей Personal OS

Автор показывает Agentic OS — свой подход к разработке проектов, который заодно реализует протокол Stateless MCP 2.0 для доступа агентов к единой multi-tenant Personal OS. Обещает разбирать примеры в канале, а полный доступ к изменениям и исходникам открыть отдельно. Пока есть только скриншот, поэтому в план не идёт.

Пост ↗
🧹

Что отфильтровано

Из 18 сообщений окна в дайджест попало 9 постов: семь карточек и три пункта на радаре, причём один пост дал сразу и карточку, и радар. Оставшиеся 9 разошлись по категориям ниже.

Шутки, байки, реплики без вывода 4 Анонсы, стримы, репосты-похвалы 2 Повторы и обрывки соседних постов 2 Research без действия для backend 1 Нерелевантное 0
🎯

План на неделю

Из всех выводов выше — три, которые реально внедрю. Каждый проверяется результатом, а не ощущением.

Сделать: дать Codex собрать недельный отчёт из ~/.codex/sessions и сверить его с git log --since="7 days ago".
до пятницы
Сделать: следующую фичу начать со спеков: агент пишет спеки → ревью только спеков → реализация; записать число возвратов на доработку.
до конца недели
Сделать: прогнать одну свою задачу с машинной приёмкой на двух моделях в одинаковом режиме и записать долю зелёных прогонов.
до среды
#

Метаданные

сгенерировано 2026-08-10T06:04:15Z
окно 2026-08-03 — 2026-08-10 (7 дней), фолбэк окна не потребовался
прочитано / в дайджест 18 сообщений / 7 выводов и 3 пункта на радаре
источник локальный кеш tdl-экспортов /Users/sskorolev/obsidian_sskorolev/TELEGRAM/AI; перед сборкой прогнан --refresh (read-only tdl chat export) по всем 9 каналам
каналов с данными 5 из 9; все 18 ссылок точные (link_quality: exact)
каналы без данных в окне AI RANEZ, llm_x_news_in_actions, { между скобок } анонсы, Tuzov AI Lab
×
Открыть пост