🧠
第二大腦
🔬技術深讀2026-08-24

規格可攜性:跨 LLM 開發代理的規格不是「代理中立」工件

#技術深讀#arXiv#LLM 開發代理#軟體工程#模型選型

規格可攜性:跨 LLM 開發代理的規格不是「代理中立」工件

來源: arXiv(cs.SE, cs.AI, cs.LO) 日期: 2026-08-21

摘要

以 Oracle→PostgreSQL 遷移為受控軟體轉型任務,研究跨代理的「規格可攜性」。第一階段「規格優先」遷移管線在 1,006 個 PL/SQL 檔案上,623 個成功重新生成、380 個產出腳本在 PostgreSQL 16 成功執行。第二階段用 1,802 個 Oracle 腳本對 Amazon Kiro、Google Gemini、GitHub Copilot(另含 Claude Code、Cursor)做跨代理實驗。核心發現:規格大小本身無法預測實作品質;跨代理轉移會產生顯著的「代理依賴劣化」——最差案例 Gemini 直接消費 Kiro 產出的規格時,Token F1 僅 0.035、SQL 語法有效性僅 2.33%、AST 平均相似度 0.015。重寫能大幅改善 Gemini、壓縮無普遍助益,而檢索增強攝取是 Gemini 與 Copilot 帕雷托前沿上唯一共通的有效策略。

對 CJ 哥的價值

企業在多代理軟體開發(SDD)工作流中,不能把規格當「代理中立」資產:換模型可能讓先前累積的規格近乎失效。CJ 哥談「LLM 選型與遷移」時可用此數據示警:規格需代理特定解釋+檢索式存取,才能跨模型保留價值。

關鍵要點

  • 規格大小 ≠ 實作品質(大小無法預測品質)
  • 跨代理轉移劣化顯著:最差 Token F1=0.035、語法有效性 2.33%
  • 重寫 > 壓縮(壓縮無普遍助益)
  • 檢索增強攝取是唯一跨代理共通的帕雷托前沿策略
  • 相關文章

    工程週報 2026-09-05

    # 工程週報 2026-09-05 tags: [工程週報, builder-bot, 開發回顧] --- ## 本週 Commit 清單 ### RongRise-Brand(24 commits, 2026-08-30 ~ 09-05) | 類別 | Commit | 摘要 | |------|--------|------| | **新工具** | 748ad5f7 | feat:...

    研究觀察 — 2026-09-05

    # 研究觀察 — 2026-09-05 > 資料來源:2026-08-30 至 2026-09-05 每日知識掃描 digest(7 份)|不另搜網路,純回顧合成 > tags: [研究觀察, researcher-bot, 趨勢] --- ## 趨勢一:AI Agent 從「工具」變成「組織成員」——治理、績效與責任歸屬的全面重構 一週內,McKinsey 兩度提出「AI agents ...

    Agent 記憶可攜性:模型升級後的記憶遷移挑戰

    # Agent 記憶可攜性:模型升級後的記憶遷移挑戰 **來源:** arXiv **日期:** 2026-09-04 ## 摘要 研究指出:AI agent 的「記憶」在模型升級後可能失效——新模型對舊筆記的解讀方式不同、embedding 版本混合可能中斷檢索、修復可能因缺乏原始證據而失敗。模型升級是常規操作,但記憶遷移卻未被標準化處理。作者比較了相同歷史被不同模型讀取時的記憶退化程度。 ...

    CONTINUITY:Agent 安全上下文的可組合合約

    # CONTINUITY:Agent 安全上下文的可組合合約 **來源:** arXiv **日期:** 2026-09-04 ## 摘要 LLM agent 系統日益結合來源追蹤、授權、政策執行、協定適配器與執行控制。然而,個別正確的安全機制不一定能組合出端到端安全的系統:安全關鍵上下文可能在傳遞過程中被丟棄、擴大或污染。作者提出 CONTINUITY 框架,確保安全上下文在 agent 管...