Проверь тесты, сохрани удачную сессию и убери лишние вопросы к агенту.
28 сентября — 5 октября 2026приёмов: 8на радаре: 3постов: 2202
О чём говорят
В выбранных постах много внимания к проверке результата и сохранению контекста. План тестирования читают до написания тестов, ошибки законченной сессии превращают в улучшения репозитория, а длинную историю пробуют хранить в редактируемом файле. Отдельная тема — интерфейс агента: повторяющийся вопрос можно вынести в мод, а сложное объяснение попросить в HTML. Для Go-сервиса, который вызывает модели через API, есть конкретная проверка миграции: схема инструментов и обработка ответа без вызова функции.
После сложной правки ошибки агента остаются в переписке; следующая сессия повторяет их.
→
Стало
Навык /retro читает сессию и предлагает улучшения навигации, проверок и инструкций репозитория.
Почему: Можно превратить один найденный промах в конкретную проверку или указатель на нужный файл. Список изменений сначала оценивает человек.
Попробовать за вечер
В Claude Code установи /plugin install mattpocock-skills; в Codex выбери навыки через npx skills@latest add mattpocock/skills. Не ставь оба варианта в один агент.
В репозитории выполни /setup-matt-pocock-skills, затем /retro для текущей или выбранной прошлой сессии. Выбери одно улучшение из отчёта.
Проверка: на следующей похожей задаче агент быстрее находит нужный файл или существующая проверка ловит прежнюю ошибку.
Учти: Установка пакета навыков сама по себе не чинит репозиторий; /retro предлагает изменения.
Поручаешь агенту добавить тесты и получаешь проверки, которые лишь повторяют реализацию.
→
Стало
Сначала читаешь план: какое поведение проверяется, почему нужен этот уровень теста и какие реальные компоненты участвуют.
Почему: У плана можно проверить смысл до того, как агент потратит время на код. Автор предлагает реальные сценарии использования и интеграционные проверки там, где они нужны.
Попробовать за вечер
Для своего опыта выбери один Go-обработчик. Попроси агента пока не писать код, а составить план тестирования: какое поведение проверить и как понять, что тест полезен.
Прочти план до написания тестов. Если нужен интеграционный сценарий, обсуди с агентом использование реальных компонентов, как предлагает автор.
Собственная проверка: намеренно нарушь выбранное поведение в локальной ветке и убедись, что написанный тест это замечает.
Учти: Это метод выбора проверок, а не требование запретить все моки или запускать E2E для каждой правки.
Снова просишь показать заполнение контекста, список правок или последствия команды.
→
Стало
По журналам последних сессий выбираешь один повторяющийся вопрос и добавляешь ответ в интерфейс агента.
Почему: Мод — расширение Claude Code, которое реагирует на события и может рисовать строку состояния или панель. Начать можно с описания того, что эта строка должна показывать.
Из источника
Token Weather из официального гайда: 81% контекста, 161.1k / 200k токенов и прирост последнего хода.
Попробовать за вечер
Проверь claude --version: руководство требует 2.1.287 или новее. Дай агенту ссылку на официальный гайд и попроси найти повторяющиеся вопросы в последних 20 локальных .jsonl-сессиях.
Попроси сначала идеи с точными цитатами и частотой. Выбери простую строку заполнения контекста; не создавай мод, если задачу уже решает настройка.
Проверка: проверь расширение через claude plugin validate <папка-мода> и сравни показание с реальным расходом контекста. Сохрани временную папку, если хочешь использовать мод в новой сессии.
Учти: Временный мод живёт в текущей сессии; для повторного использования его надо сохранить и установить как плагин. Это исполняемый код.
Одна модель и пишет код, и проверяет собственный план после повторяющейся ошибки.
→
Стало
В Claude Code включаешь вторую модель через /advisor: она читает всю сессию и даёт совет основной модели.
Почему: Второй взгляд можно запросить перед планом, после повторного сбоя и перед завершением длинной задачи. Время обращения выбирает модель, а не жёсткое правило.
Из источника
Схема автора: основная сессия и подагенты слева, советник с полной историей справа. Числа относятся к его примеру.
Попробовать за вечер
Запусти /advisor и выбери доступную совместимую модель. Если основная модель — Sonnet, официальный пример подключения Opus — /advisor opus.
На одной задаче попроси: «Обратись к советнику перед планом, при повторе ошибки и перед завершением». Смотри строки Advising и Reviewed.
Проверка: сравни замечания и расход через /usage с похожей сессией без советника. Выключение — /advisor off.
Учти: Экспериментальная функция через Anthropic API, в том числе для подписочных аккаунтов; Bedrock и другие платформы не поддерживаются. Каждый вызов читает всю сессию заново и расходует токены. Fable может требовать доступа и отдельного согласия на оплату.
Обёртка API отправляет tool_choice: any или tool и рассчитывает, что модель обязательно вызовет нужную функцию.
→
Стало
Для Sonnet 5.5 официальный гайд требует tool_choice: auto, строгую схему инструмента и указание в промпте, когда его использовать.
Почему: Прежние значения возвращают HTTP 400. Строгая схема проверяет форму аргументов, но решение о вызове остаётся за моделью.
Попробовать за вечер
В тестовой ветке Go-сервиса найди сериализацию tool_choice. Для Sonnet 5.5 замени type на auto; в описание инструмента добавь strict: true и additionalProperties: false для каждого объекта.
В запросе явно назови нужный инструмент. Выполни сценарий с валидными аргументами и обработай ответ без tool_use.
Проверка: убедись, что запрос не возвращает 400, аргументы соответствуют схеме, а отсутствие вызова обрабатывается явно.
Учти: Правило относится к Sonnet 5.5. strict задаёт форму входа, а auto не гарантирует выбор конкретного инструмента.
Длинные результаты инструментов накапливаются в истории, а общий пересказ может потерять точный текст ошибки.
→
Стало
Экспериментальная обёртка хранит рабочую историю в редактируемом файле и перечитывает её после каждой команды.
Почему: Агент может убрать отработанные фрагменты и оставить точную ошибку. Системные инструкции и исходная задача при этом хранятся отдельно, вне его правок.
Из источника
Панель эксперимента: слева размер контекста, в центре файл истории, справа сведения об исполнении.
Попробовать за вечер
На учебной задаче разбора логов оставь system и исходную задачу отдельно. Запиши остальную историю с заголовками сообщений в файл.
После команды перечитывай файл и собирай следующий запрос из защищённого префикса и обновлённой истории. Добавь ограничение размера, проверку ролей и откат невалидной правки.
Проверка: сравни сохранность точной ошибки, число обработанных токенов и результат с обычным пересказом истории.
Учти: Один SKILL.md не меняет контекст работающего агента. Нужна поддержка в его обёртке; частые правки начала истории сбрасывают кэш и могут увеличить расходы.
В посте есть команда npx tokenjam onboard. Указанный при проверке GitHub-путь не дал README; до установки нужно найти канонический репозиторий и проверить сбор телеметрии.
Промпт требует тест, который падает до исправления, и запрещает менять старые тесты. Команды /schedule и облачную доступность в этом проходе не подтвердили по официальной документации.
До среды: Проверить план тестирования одного Go-обработчика и убедиться, что тест замечает нарушение поведения.
7 октября
До пятницы: Разобрать одну сессию через /retro и внедрить одно подтверждённое улучшение.
9 октября
#
Метаданные
Собрано: 2026-10-05T15:28+03:00
Окно: 28 сентября — 5 октября 2026 года; текущий день включён по момент сбора.
Воронка: 2202 поста, 73 просмотрено, 22 прочитано полностью; 8 основных карточек, 3 на радаре. Остальные решения и непрочитанный резерв сохранены в журнале.
Метрики: 2202 поста с реакциями. Ранжирование учитывает репосты, лайки, ответы и пересечение тем.
Сбор: тематические и авторские RSS-ленты nitter.perennialte.ch через Firecrawl; метрики fxtwitter через Firecrawl. Три локально сохранённых изображения X были получены прямой загрузкой при предыдущем сборе; изображение связанного первоисточника получено через Firecrawl screenshot.
Пробелы: "token cost" OR "cost per token" min_faves:20; vllm OR sglang min_faves:20; "llama.cpp" OR ollama min_faves:30; "subagent" OR "sub-agent" min_faves:20; from:HamelHusain. Эти цели не покрыли пять дней даже после повторного запроса и проверки nitter.tiekoetter.com; часть недели по ним отсутствует в корпусе.
Изображения: 4 карточки с локально просмотренными исходниками. Обложки и изображения другой части поста исключены.