メインコンテンツへスキップ

オープンウェイト・日本

AI実装の主戦場が実行層へ――Fusion API、Agent権限管理、科学コード評価、AI基盤の再編

今日のご案内 ☕✨ # 今回の中心は、AIの価値が「良い答えを返すモデル」から「専門ツールを、決められた権限と検証手順の中で実行できる仕組み」へ移っていることだ。Autodesk Fusionでは、Drawing APIに加えてMetal Powder Bed Fusionのprocess simulationをAPIから実行・結果表示できる範囲が広がった。Coderはクラウド側のcoding agentと企業内の実行環境を分離し、CrowdStrikeやIBMはagent identity、短寿命権限、runtime control、trace、custom evaluationを製品レイヤーとして扱い始めている。 モデル性能そのものも動いている。OpenAIはGPT-6 Astraの提供を開始し、同社のPreparedness FrameworkでCritical cybersecurity-capability thresholdに達したモデルをChatGPTやAPI、Azure、AWS Bedrockへ展開する。モデルが強くなるほど「導入するか」だけではなく、どの環境で実行させ、何を許可し、いつ停止できるかがmodel upgrade governanceの一部になる。 Scientific AIでは、汎用coding benchmarkだけで実務適性を判断しにくいことも明確になっている。SWE-bench Scienceは科学ソフトウェアのrepository-level taskを20分野に広げ、最良の評価agentでもpass@1が50%未満と報告した。科学計算では、codeが動くことと、数値・物理上の前提やintegrationを壊さないことが別問題であり、engineering agentにはdomain-specificな検証系が必要になる。 基盤側では、NVIDIAがHugging Face買収で合意し、EuroHPCは3億8,780万ユーロ規模のLUMI-AIを2027年投入へ進める。モデル、配布hub、accelerator、hosted inference、public/sovereign computeの境界が再編されるなか、AI戦略はmodel selectionだけでなく、artifact portability、execution perimeter、compute procurementまで含む設計問題になっている。