Лондонский стартап Weco представил систему AIDE², в которой внешний агент на Claude Opus 4.7 за восемь дней улучшил код внутреннего агента на Gemini 3 Flash. По словам компании, новая версия превзошла вариант, который команда вручную дорабатывала два года.

Лондонский стартап Weco представил двухуровневую агентную систему для самоулучшения AIDE² (AI-Driven Exploration). Внешний агент на Claude Opus 4.7 в течение восьми дней переписывал код внутреннего агента AIDE, работающего на Gemini 3 Flash. При этом менялась не сама модель, а «обвязка» вокруг нее: логика поиска решений, память, контекст, проверки и правила выбора следующего шага. В результате новая версия превзошла агента, которого команда вручную настраивала два года. В частности, был найден более эффективный поиск по веткам, контекст сжат в 16 раз, а склонность к «читерству» в GPU-бенчмарках снизилась с 63% до 34%.

Источники 1
  • Weco представил систему AIDE² для рекурсивного улучшения агентов Futuris
    Recursive self-improvement, это ты?🧐 
    
    Лондонский стартап Weco представил двухуровневую агентную систему для самоулучшения AIDE², или AI-Driven Exploration: внешний агент на Claude Opus 4.7 восемь дней переписывал код внутреннего агента AIDE, работающего на Gemini 3 Flash. То есть он не менял веса Claude или Gemini, а улучшал «обвязку» вокруг модели: логику поиска решений, память, контекст, проверки и правила выбора следующего шага.
    
    В итоге новая версия обошла агента, которого команда вручную тюнила два года: нашла более умный поиск по веткам, сжала контекст в 16 раз и снизила склонность «читерить» в GPU-бенчмарках с 63% до 34%. Пока это не бесконечно ускоряющийся AGI, а сильный пример того, как агенты могут сами делать следующие поколения более эффективных агентов💎
    
    пост https://x.com/zhengyaojiang/status/2077079778793042425
    
    статья https://www.weco.ai/blog/first-evidence-of-recursive-self-improvement
    
    P.S.
    представляю если бы они Fable или gpt 5.6 вместо opus 4.7 использовали🌚