QA-инженер на примере формы обратной связи описал, как проверяет Claude Code в паре с ручным тестированием и превращает его промахи в отдельные правила и скиллы. После случая, когда агент не заметил, что в payload на сервер уходит неверное значение, он начал требовать от него доказательств и собрал из этих правил открытый пакет скиллов.

QA-инженер, который тестирует web-приложения на десктопе и в мобильном адаптиве, совмещает ручное тестирование с автоматизацией на Playwright и уже полгода перекладывает рутинную часть проверки на Claude Code. Он использует схему «доверяй, но проверяй»: агент прогоняет тесты, а он параллельно смотрит руками. После случая с формой обратной связи, когда Claude отчитался об успехе, но в payload на сервер ушла строка [object Object], автор начал превращать такие пропуски в отдельные правила — через скиллы и замечания, как при дообучении стажёра. Из этих правил вырос пакет скиллов, который он выложил в открытый доступ. В статье он обещает показать, что в пакете внутри, привести демо на реальном баге и отдельно перечислить ограничения такого подхода.

Источники 2
  • QA-инженер рассказал, как ограничил Claude в тестировании без доказательств Habr AI
    Я запретил Claude говорить «всё работает» без пруфов. Это изменило всё
    
    Пару месяцев назад я попросил агента проверить форму обратной связи после рефакторинга. Через несколько минут получил отчёт: все проверки пройдены, форма работает корректно. Зелёные галочки, уверенный тон.
    
    Я тогда только начинал отдавать тестирование агенту, поэтому работал по схеме «доверяй, но проверяй»: следом прошёл форму руками, с открытой вкладкой Network. Снаружи всё честно: валидация зелёная, кнопка активная, тост «Спасибо!» показывается, сервер отвечает 200. А в payload вместо темы обращения уходит строка [object Object]. Агент проверил всё, кроме того, что реально уходит на сервер.
    
    Я QA‑инженер, тестирую web (десктоп + мобильный адаптив), совмещаю ручное тестирование и автоматизацию на Playwright. Моя цель — максимум автоматизации и минимум ручной работы, поэтому полгода я перекладываю рутинную часть тестирования на Claude Code. Схема всё та же: агент прогоняет, я параллельно проверяю руками, и каждый его пропуск превращаю в правило — через скиллы и замечания, как дообучают стажёра. Из этих правил вырос пак скиллов, который я выложил в открытый доступ: ссылка в конце статьи. Расскажу, что внутри, и покажу демо на настоящем баге. В конце — честный список того, где это всё не работает. Читать далее
    
    #qa #playwright #claude_code #llm #автоматизация_тестирования #тест_дизайн | @habr_ai
  • В GPT-5.6 увеличили окно контекста и изменили цены Нейроканал
    В суматохе со всеми этими сбросами лимитов не сразу сообразил, что новые GPT-5.6 имеют больше окно контекста, а цена за превышение 272к токенов в два раза выше. Гляньте табличку с ценами.
    
    Если вы как и я пользуетесь /goal и оставляете Codex работать подолгу для решения задач под ключ, то можно попробовать в ~/.codex/config.toml добавить вот такие две строчки:
    
    model_context_window = 272000
    model_auto_compact_token_limit = 240000
    
    Контекста станет меньше, но мне кажется лучше раньше компактитить, чем позже, при работе над кодом. А основную работу вести через субагентов, основной агент как супервайзер.
    
    По идее это должно вернуть траты лимитов до примерно тех же уровней, что были ранее на 5.5, но на новом Sol. Если не жестить с max\ultra, конечно.