Практичные приёмы, релизы и сдвиги из AI/agent-каналов Telegram для Go-backend инженера: что попробовать или поменять в работе на этой неделе.
🗓 окно 3 — 10 августа 2026⚡ выводов: 7👀 на радаре: 3📡 сообщений прочитано: 18
💡 Что важно на этой неделе
Неделя вышла про обвязку вокруг Codex, а не про модели. Соседние треды научились договариваться о приоритетах, деплой простой веб-страницы уехал внутрь агента поверх Cloudflare Workers, а логи в ~/.codex/sessions оказались готовым журналом работы, из которого агент сам собирает недельный отчёт. Вторая линия — спеки. Full-stack BDD-набор, который гоняет тысячу спеков в секунду, сводит постановку задачи к двум шагам: «напиши спеки» → «реализуй спеки»; в подкасте про внедрение та же мысль заходит с другой стороны — агенту нужен онбординг, как новому сотруднику, а не промпт получше. Третья — деньги: Meta отдаёт миллион токенов за $0,1 вместо $1,25, если разрешить учиться на ваших данных, и для рабочего репозитория это уже не настройка, а разговор с юристами. И напоминание из чужого личного бенча: Kimi K3 обошёл 5.6 sol на задаче, которой нет ни в одном лидерборде.
⚡
Главные практические выводы
01
Собрать недельный отчёт о прогрессе из логов сессий Codex
Автор просит Codex писать новости про прогресс своих проектов. Агенту это ничего не стоит: в ~/.codex/sessions уже лежат логи всех проектов — остаётся попросить их прочитать и пересказать.
Почему важно: когда репозиториев несколько, а неделя рваная, к пятнице никто не помнит, где что осталось недоделанным. Логи сессий — это уже готовый журнал работы, который не надо вести руками; из него собирается и статус для команды, и собственный список хвостов.
⚡ Как применить
Посмотреть, что каталог не пустой: ls ~/.codex/sessions | tail.
Дать Codex одну задачу: прочитать сессии за последние семь дней и собрать по каждому проекту три пункта — сделано, застряло, следующий шаг.
Положить результат в docs/weekly-progress.md и повторять по пятницам той же командой.
Проверка: сверить отчёт с git log --since="7 days ago" по тем же репозиториям. У каждого пункта должен найтись коммит, и ни один рабочий день не должен пропасть — тогда формат рабочий.
Риск в сессии попадают куски кода, внутренние пути и имена сервисов. Отчёт, собранный из них, нельзя отправлять наружу без вычитки.
У тредов Codex появилась возможность общаться друг с другом. Если два соседних треда случайно или намеренно правят один кусок кода, в одном из них можно написать: «вот в соседнем треде [id] агент делает сходную задачу, договорись с ним о приоритетах, чтобы друг другу не мешать» — и они распараллелят работу сами.
Почему важно: обычная авария при нескольких агентах — двое переписывают один файл и затирают чужие правки. Раньше это разводили руками: отдельный worktree на тред, ручное деление по пакетам. Теперь есть более дешёвый вариант для случая, когда задачи соседние, а не параллельные.
переговоры между тредами не заменяют worktree, но снимают самый частый конфликт
⚡ Как применить
Запустить два треда на соседних задачах в одном репозитории и записать id второго треда.
В первом треде дать фразу из поста: сослаться на соседний id и попросить договориться о приоритетах.
Страховку оставить прежней: по git worktree на тред, чтобы конфликт ловил git, а не договорённость агентов.
Проверка: прогнать так две задачи и посчитать, сколько раз пришлось разбирать правки в одном файле — против прошлого раза без переговоров.
Риск автор сам пишет, что не знает, насколько давно фича работает. Договорённость тредов — это не блокировка файла: под нагрузкой или при длинных задачах она ничего не гарантирует.
Подкаст про внедрение агентов в компании, разложенный по таймкодам. Три тезиса бьют в одну точку: люди не могут рассказать, как именно делают свою работу, а агенту, как и сотруднику, нужен онбординг (00:16:56); полностью автоматические системы регулярно проваливаются (00:24:39); доступ в терминал делает агента гибким, но усложняет контроль, и ценность смещается от производства результата к ответственности за него (00:36:43).
Почему важно: это меняет, что именно писать. Не очередную формулировку задачи, а документ про то, как здесь принято работать: как выкатывается сервис, что считается готовым, где границы. И отдельно — кто отвечает за результат, когда его произвёл агент.
⚡ Как применить
Выписать в AGENTS.md то, что обычно передаётся устно: порядок выката, каталоги, которые нельзя трогать, критерий «готово».
Для одной задачи с доступом в терминал зафиксировать список разрешённых команд и точку, где человек смотрит diff до push.
В описании задачи назвать владельца результата — человека, который жмёт merge и отвечает за последствия.
Проверка: дать агенту задачу по этому описанию и посчитать уточняющие вопросы и возвраты на доработку — против такой же задачи неделю назад.
Риск онбординг-док устаревает быстрее кода. Пока его не обновляют вместе с процессом, агент уверенно работает по вчерашним правилам, и это заметно только по испорченному результату.
На марафоне по агентам самым ходовым кейсом оказались рабочие веб-приложения с бэкендом на Google-таблицах и деплоем в одну строку — без GitHub, Docker и VPS. Теперь для этого не нужны внешние сервисы: OpenAI встроила такую штуку в Codex поверх Cloudflare Workers и их же R2. В Claude Code этого нет: их Artifacts — статическая страница на их домене.
Почему важно: у бэкендера регулярно копятся скрипты без интерфейса — ручной ретрай, просмотр очереди, разовый отчёт. Обычно им не дают UI, потому что ради этого надо заводить репозиторий, пайплайн и хост. Теперь порог — одна просьба агенту.
⚡ Как применить
Взять один свой скрипт без интерфейса и попросить Codex собрать вокруг него страницу и выкатить.
До выката решить, что туда попадает: R2 — внешнее хранилище, поэтому рабочие данные заменить на синтетические.
Ссылку и срок жизни страницы записать рядом со скриптом, чтобы «времянка» не осталась висеть без владельца.
Проверка: замерить время от «нужна страница» до рабочей ссылки. Если укладываешься в час, приём занимает нишу одноразового внутреннего UI.
Риск это чужой хостинг и чужое хранилище. Для внутренних данных компании путь закрыт, пока не согласован с безопасностью, а привязка к Workers и R2 усложнит переезд, если страница неожиданно приживётся.
Meta выпустила своего агента Muse Code и вместе с ним модель Muse Spark 1.2. Заявляют, что с официальным харнессом она лучше Grok 4.5, но не дотягивает до Opus 5. Главное в релизе — цена: если разрешить Meta тренировать модели на ваших данных, миллион токенов стоит $0,1/$0,2 против обычных $1,25/$4,25.
Почему важно: разница больше чем в десять раз, и соблазн переставить дефолтную модель в агентском пайплайне велик. Автор канала прямо советует не вестись, если делаете что-то стоящее или строите стартап; для пет-проектов и опенсорса условие терпимое.
⚡ Как применить
Держать два профиля харнесса: рабочий и личный. Дешёвый тариф прописывать только в личном.
Записать в AGENTS.md рабочего репозитория список допустимых моделей, чтобы «попробовать на неделю» не осталось навсегда.
Перед переключением посчитать, сколько токенов в месяц реально уходит на агентские задачи.
Проверка: если пересчитанная экономия меньше пары часов вашей работы, менять модель незачем — решение принимается по числу, а не по прайсу.
Риск условие про обучение распространяется на содержимое запросов, то есть на код. Для рабочего репозитория это юридический вопрос, а не строчка в конфиге. Сравнение с Grok 4.5 и Opus 5 — заявление вендора, независимых прогонов в посте нет.
На личном бенче автора Kimi K3 не просто не уступает 5.6 sol, а оказывается лучше; обе модели в режиме max. Бенч всегда один и тот же: полностью разрушаемая воксельная планета диаметром 1000 клеток, 60 fps при любом удалении от поверхности, на голом Rust без готовых движков.
Почему важно: у такого бенча есть свойство, которого нет у публичных таблиц: он повторяет вашу настоящую задачу, и результат прямо говорит, какую модель ставить в пайплайн. Он же ловит развороты вроде «была хуже — стала лучше», которые в лидербордах не видны.
⚡ Как применить
Выбрать одну задачу из своей работы, где приёмку делает машина: например, сгенерировать слой репозитория по спецификации и прогнать go test ./....
Зафиксировать её как файл-задание с критерием приёмки: тесты зелёные, бенчмарк не хуже прежнего.
Прогнать на ней две уже оплаченные модели в одинаковом режиме и с одинаковым контекстом.
Проверка: записывать долю прогонов, где тесты зелёные с первого раза. Дефолтную модель менять только если разница держится на трёх прогонах подряд.
Риск один бенч меряет один класс задач. У автора это 3D на Rust, и переносить его вывод на Go-бэкенд нельзя — нужен свой, иначе получится тот же лидерборд, только маленький.
В поездке автор завёл codex-демонов на linux-сервере и доделал full-stack event-driven BDD-фреймворк: спеки привязаны к UI-компонентам, например через go templ, а написание и поддержку он свалил на Codex. Спеки гоняются на одном ядре со скоростью тысяча в секунду; параллелизм он добавит, когда их станет больше тысячи, потому что гонять базовые бизнес-тесты дольше секунды считает недопустимым. С таким набором задачи ставятся с телефона в два шага: «напиши спеки под такую фичу», затем «реализуй эти спеки».
Почему важно: связка ложится на Go напрямую — go templ плюс быстрый набор тестов дают агенту проверяемый контракт и мгновенную обратную связь. Пока прогон идёт минуты, агент работает вслепую и приносит правки пачками; когда прогон занимает секунду, он чинит себя сам в цикле, а вы читаете только спеки.
цена секунды: агент успевает исправиться до того, как вы откроете ноутбук
⚡ Как применить
Замерить go test ./... на бизнес-слое и вынести всё, что дольше секунды, в отдельный набор по build-тегу.
Следующую фичу начать со спеков: попросить агента написать их первыми, отревьюить только спеки, потом дать команду реализовать.
Поднять агента фоном на dev-сервере, чтобы ставить задачи не только с ноутбука.
Проверка: сравнить с прошлой фичей число раундов «агент прислал — вернул на доработку».
Риск тысяча спеков в секунду получается на его event-driven схеме; на обычном сервисе с базой и HTTP так не выйдет без отдельной работы по изоляции. И спеки, написанные агентом, надо читать: он охотно закрепляет текущее поведение вместо нужного.
Записи и переписки чата за полгода скормили Claude и получили книгу про модели, контекст, агентов, тулзы, скиллы, MCP и субагентов. Приём переносится на рабочий чат команды, но в посте нет ни промпта, ни схемы разбиения — поэтому смотрим, а не повторяем. Сейчас книга бесплатна, автор пишет, что на следующей неделе будет 15к.
На spectral.tech надо собрать простую систему с минимальной задержкой, причём не только средней, но и в худших случаях. Интересно не участие, а baseline: ту же задачу решает Claude-агент, и его решение лежит в публичном репозитории. Автор предупреждает, что без C++, сетей и системного программирования приза не видать; дедлайн — 30 августа, 23:59 GMT+3, призовой фонд $12к.
Автор показывает Agentic OS — свой подход к разработке проектов, который заодно реализует протокол Stateless MCP 2.0 для доступа агентов к единой multi-tenant Personal OS. Обещает разбирать примеры в канале, а полный доступ к изменениям и исходникам открыть отдельно. Пока есть только скриншот, поэтому в план не идёт.
Из 18 сообщений окна в дайджест попало 9 постов: семь карточек и три пункта на радаре, причём один пост дал сразу и карточку, и радар. Оставшиеся 9 разошлись по категориям ниже.
Шутки, байки, реплики без вывода 4Анонсы, стримы, репосты-похвалы 2Повторы и обрывки соседних постов 2Research без действия для backend 1Нерелевантное 0
🎯
План на неделю
Из всех выводов выше — три, которые реально внедрю. Каждый проверяется результатом, а не ощущением.
Сделать: дать Codex собрать недельный отчёт из ~/.codex/sessions и сверить его с git log --since="7 days ago".
до пятницы
Сделать: следующую фичу начать со спеков: агент пишет спеки → ревью только спеков → реализация; записать число возвратов на доработку.
до конца недели
Сделать: прогнать одну свою задачу с машинной приёмкой на двух моделях в одинаковом режиме и записать долю зелёных прогонов.
до среды
#
Метаданные
сгенерировано 2026-08-10T06:04:15Z
окно 2026-08-03 — 2026-08-10 (7 дней), фолбэк окна не потребовался
прочитано / в дайджест 18 сообщений / 7 выводов и 3 пункта на радаре
источник локальный кеш tdl-экспортов /Users/sskorolev/obsidian_sskorolev/TELEGRAM/AI; перед сборкой прогнан --refresh (read-only tdl chat export) по всем 9 каналам
каналов с данными 5 из 9; все 18 ссылок точные (link_quality: exact)
каналы без данных в окне AI RANEZ, llm_x_news_in_actions, { между скобок } анонсы, Tuzov AI Lab