Repo0、ゼロから全体を生成するコード生成を狙う
このフレームワークは、テスト駆動のコード生成に先立ってリポジトリのアーキテクチャを進化させる。
なぜ重要か
この研究は、エージェント型コーディングにおける実務上の課題に取り組むものだ。単にファイルを生成するのではなく、保守可能なリポジトリアーキテクチャをゼロから作るという問題である。再現性が確認されれば、アーキテクチャを意識した計画は、ソフトウェアプロジェクト全体の構築を担うAIシステムの信頼性向上につながる可能性がある。
要点
- 1.Repo0は自然言語の要件からプロジェクトを構築する。
- 2.Dual-DAGが要件、コンポーネント、整合性を追跡する。
- 3.6つのRepoCraftリポジトリでのテストでは、カバレッジと合格率が最高だった。
HF Daily Papersは、自然言語の要件からエージェントがソフトウェアプロジェクト全体を構築する「zero-to-all」コード生成フレームワーク、Repo0を取り上げた。Repo0は、要件、コンポーネント、それらの整合性を結ぶDual-DAGとして明示的なアーキテクチャ状態を保持し、コード生成に入る前に、モジュール性の指標を使ってコンポーネント境界を反復的に調整する。著者らはGPT-5 miniとDeepSeek V3.2を用いて6つのRepoCraftリポジトリで評価し、すべての設定で機能カバレッジと合格率が最高だったと報告した。
⚡ 今日から使える
新規リポジトリ生成にコードエージェントを使う前に、特にアーキテクチャ品質が重要なら、この論文に目を通しておきたい。
出典・一次報道
本記事は以下の媒体の報道を要約し、リンクしています。
この記事が役に立ちましたか?次号をメールでお届けします。
関連: 研究
Google DeepMind、AIゲームプレイでゲームスタジオと提携
同研究所は、15年にわたるゲーム研究を土台にAIゲームプレイのプロトタイプ開発を進めているという。
MemTrapBench、LLMの記憶利用に潜む認知的な落とし穴を検証
このベンチマークは、検索された記録が関連性のあるものでも、記憶がタスク性能を低下させ得ることを示した。
AI4AI-Bench、エージェントの訓練アルゴリズム設計能力を検証
arXivの新ベンチマークは、LLMエージェントが凍結されたリポジトリ群で訓練アルゴリズムを書き換えられるかを評価する。