新着研究 / LLM
分子式から合成計画へ一足飛びに進めない理由――中間表現で調べる逆合成
RetroPlan-Bench Representation Alignment
概要
- 逆合成を分子対応、反応対応、PDDL生成、計画実行に分けて失敗箇所を調べる。
- 著者らの評価では、SMILESからPDDLを直接作る条件で全モデルの計画解決率が0だった。
- 構造化した中間表現を用いる条件では、一部のモデルで解決率1.0が報告された。
補足:編集した模式図で仕組みを確認する
VISUAL EXPLAINER
図でつかむ、RetroPlan-Bench Representation Alignmentの仕組み
- 01分子の識別子
- 02分子構造の対応
- 03反応の対応付け
- 04PDDL計画記述
原論文の説明をもとにした模式図です。処理の細部は省略しています。
研究の背景
逆合成は、作りたい分子から必要な原料と反応をさかのぼって考える作業である。分子構造の文字表現であるSMILESから、計画問題を記すPDDLへ直接変換するには、化学的な対応と計画用の形式を一度に整えなければならない。
PDDLは反応を操作、原料を開始状態、目標分子を到達目標として表せる。形式が正しければ外部の計画器で経路を調べられるため、途中の対応違いがどこで生じるかを知る意味がある。
手法
研究は、分子の識別子とSMILESの対応、各反応の反応物と生成物の組、PDDLの領域・問題定義を順に扱う。領域定義には反応を操作として書き、問題定義には開始状態と目標を書く。例えば目標分子を得る反応について、必要な原料を前提条件、生成物を結果として表す。
その後、Fast Downwardという外部の計画器で経路を探し、記述が実行可能かを確かめる。評価では途中の正解を与えて各段階の能力を測る条件、モデルの出力を次段に渡す条件、SMILESからPDDLを直接作る条件を比較する。各段階の正確さと最終的な経路の成立を分けて見る設計である。
新規性
この研究は、逆合成で生じる失敗を一つの最終結果だけで測らず、分子の対応付け、反応物と生成物の対応付け、PDDLの生成、計画の実行へ分けて調べる。異なる表現の間で情報が正しく受け渡されるかを評価の中心に据えた。
途中の正解を与える条件と、モデル自身の出力を次段へ渡す条件も用意した。直接変換との違いを通じ、個別の作業ができても、それらを連結すると失敗し得ることを示している。
従来手法との違い
比較の基準は、分子構造を表すSMILESから計画記述のPDDLを直接作る方式である。著者らが評価した全モデルで、この直接方式の計画解決率と経路精度は0だった。
段階方式では、分子と反応を中間の構造化表現にしてからPDDLを作る。途中の正解を与える条件で強いモデルの解決率は1.0に回復した。ただし段階ごとの成功と、最初から最後まで自動で安定して動くことは同じではない。
実験結果
著者らはREADRetroの368件の複数段階の経路を基にRetroPlan-Benchを構築し、反応数100、200、300、400の設定などで評価した。分子対応、反応対応、PDDLの妥当性、計画解決率、正解経路との一致を測っている。
直接SMILESからPDDLを作る条件では、評価した全モデルの解決率と経路精度が0だった。途中の構造化表現を与える条件ではGPT-5.2、DeepSeek V3.2、Gemini 3.1の解決率が1.0となった。モデル出力を連結した追加条件でも、前二者は解決率1.0、経路精度0.986を維持したと著者らは報告する。
応用の可能性
編集上の応用案 · 論文が実証した用途とは区別しています。
編集上の応用案:研究者が確認済みの分子と反応の対応表を入力し、反応物・生成物の組を点検したうえでPDDLの計画記述を作る。外部の計画器が示した反応順序を、研究者が元の対応表と照らして確認する。
出力は実験指示ではなく、候補となる経路と各段階の照合結果とする。分子の対応、反応の向き、計画記述の意味が食い違った箇所を表示できれば、修正すべき段階を絞りやすい。
導入時の検証
導入時の検証案 · 対象データでの再評価が必要です。
導入時の検証案:確認済みの少数の合成経路を用い、SMILES、分子識別子、反応物・生成物の組、計画記述を対応付ける。比較の基準には、SMILESからPDDLを直接作る手順を置く。
分子対応と反応対応の正確さ、PDDLの構文と反応内容の一致、計画器による解決率を別々に測る。中間表現を人が修正した場合とモデル出力を連結した場合も比べ、どの段階の確認が最終結果に効くかを調べる。
限界と課題
著者らは対象が逆合成計画に限られ、他の計画問題でも同じ現象が起こるかは未確認だと述べる。主要な段階別分析には途中の正解を与える条件が含まれ、モデル出力を連結する追加評価も同じベンチマーク内である。
編集上の確認課題は、対象の反応集合が実務上の候補を十分に含むか、段階間で誤りが連鎖しないか、生成した経路を化学的にどう確認するかである。計画器が経路を見つけたことだけで、実験での成立を保証するものではない。
出典
元のタイトル・要旨を確認する(英語)
Representation Alignment as a Bottleneck in LLM-Based Retrosynthesis Planning
While LLMs show promise in general reasoning, symbolic planning in chemistry remains a bottleneck. Direct ''SMILES-to-PDDL'' attempts fail because they force models to juggle chemical analysis and planning-language structuring simultaneously. We hypothesize that this failure stems from a lack of intermediate abstractions rather than insufficient model capacity. By decomposing retrosynthesis into molecule mapping, reaction mapping, and PDDL generation, we achieve high success rates where end-to-end approaches fail. This provides evidence that a primary bottleneck lies in representation alignment rather than raw model capacity. Our structural analysis demonstrates that intermediate representations are essential in retrosynthesis planning, highlighting the importance of representation-centric design in future systems.
論文本体の取得範囲に基づく解説。AIが作成した未校閲の記事です。性能の数値は著者の評価条件に依存します。応用例と検証計画は編集上の提案です。収集:2026-09-30