🧠
第二大腦
🌏國際視野2026-05-14

AlphaEvolve: A Gemini-powered coding agent for designing advanced algorithms(AlphaEvolve:基于 Gemini 的高階演算法設計 AI 編碼代理)

#部落格#英文#Google DeepMind#AI Agent#演算法發現#Gemini

title: "AlphaEvolve: A Gemini-powered coding agent for designing advanced algorithms(AlphaEvolve:基于 Gemini 的高階演算法設計 AI 編碼代理)" tags: [部落格, 英文, Google DeepMind, AI Agent, 演算法發現, Gemini] source: https://deepmind.google/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/ date: 2026-05-14 domain: 國際視野 type: research status: active updated: 2026-08-30 ---# AlphaEvolve: A Gemini-powered coding agent for designing advanced algorithms(AlphaEvolve:基于 Gemini 的高階演算法設計 AI 編碼代理)

來源: Google DeepMind 原文日期: 2026-05-14

中文摘要

Google DeepMind 推出 AlphaEvolve,一個由 Gemini 驅動的編碼 AI Agent,能自主設計和進化新演算法。系統結合大型語言模型的創造力與自動化評估器,在數學、電腦科學和實際運算应用中成功發現新演算法。AlphaEvolve 為 4×4 複數矩陣乘法發現僅需 48 次純量乘法的演算法,超越了 Strassen 1969 年以來的最佳記錄。此外,在.openapi源社群 75% 的案例中重新發現當前最佳解,20% 的案例中實際推進了未解問題(如 11 維接吻數問題)。

關鍵洞察

  • 從搜尋到設計:與前代 AlphaTensor(專注搜尋矩陣乘法演算法)不同,AlphaEvolve 能提出全新的梯度下降程序,涵蓋權重初始化、損失函數、超參數搜尋等 15 個突變
  • Kissing number 突破:在 11 維空間中發現 593 個外層球體的新配置,推高了這個困擾数学家 300 多年的幾何學問題的下界
  • 真實世界運算優化:與之前的 AlphaEvolve v1 相比,新系統在資料中心負載分配和 Kernel 幾何最佳化上減少了 10-15% 的效能瓶頸
  • 可驗證性是核心:系統的關鍵在於用自動化的 evaluate 循環來測試 LLM 提案,排除不好的提案
  • AlphaEvolve 可被理解為一個演算法搜尋演算法:它進化的是人類可審查和修改的源代碼
  • 原文關鍵句(英文保留)

    > "New AI agent evolves algorithms for math and practical applications in computing by combining the creativity of large language models with automated evaluators."

    > "AlphaEvolve’s procedure found an algorithm to multiply 4x4 complex-valued matrices using 48 scalar multiplications, improving upon Strassen's 1969 algorithm that was previously known as the best in this setting."

    > "In 20% of cases, AlphaEvolve improved the previously best known solutions, making progress on the corresponding open problems."

    對 CJ 哥的價值

  • 企業 AI 轉型:AlphaEvolve 展示了 AI agent 如何從「輔助寫代碼」進化到「自動設計複雜系統」,對企業內部的工程團隊效能提升有重大啟示
  • 人才策略啟示:AI 發現瓶頸的關鍵在於「可驗證的自動化評估循環」,企業應投資建立內部的 AI agent 驗證基礎設施
  • 內容生產:「AI 自己設計 AI」的敘事極具傳播力,適合作為科技趋势內容的核心素材
  • 相關文章

    當管理層的大腦還留在十九世紀,企業憑什麼駕馭二十一世紀的AI?

    # 當管理層的大腦還留在十九世紀,企業憑什麼駕馭二十一世紀的AI? > 來源:https://home.gamer.com.tw/artwork.php?sn=6393385|作者:劍心san(sanboy289)|2026-09-05|巴哈姆特創作 > 存入:2026-09-05|分類:管理心理學 ## 一句話 管理思維還停留在工業革命早期的企業——用羞辱究責取代系統分析——不可能駕馭 A...

    Stratechery:Anthropic Fable 5.1 與企業 AI 資料政策轉向

    # Stratechery:Anthropic Fable 5.1 與企業 AI 資料政策轉向 **來源:** Stratechery(Ben Thompson) **日期:** 2026-09-02 ## 摘要 Ben Thompson 分析 Anthropic 發布 Fable 5.1 的產業意義:最值得關注的不是模型能力,而是 Anthropic 大幅修改了引發巨大爭議的資料保留政策(F...

    AI 代理與客戶資料之爭:資料基礎建設的未來(A16Z)

    # AI 代理與客戶資料之爭:資料基礎建設的未來 **來源:** A16Z Podcast(Martin Casado × Fivetran 共同創辦人 George Fraser) **日期:** 2026-06-05 ## 摘要 Martin Casado 與 Fivetran CEO George Fraser 對談 AI 時代資料基礎建設的未來。涵蓋 Fivetran 與 dbt 的合...

    全球首例雙盲 AI 評測:用密碼學環境建立基準信任(Google DeepMind)

    # 全球首例雙盲 AI 評測:用密碼學環境建立基準信任 **來源:** Google DeepMind(William Isaac、Sol Messing、Kristian Lum) **日期:** 2026-08-27 ## 摘要 DeepMind 推出全球首例「專有前沿模型的雙盲評測(double-blind evaluation)」,把外部評測侷限在密碼學「盒子」內,防止模型事先看到題目...