
論文を探す
研究分野・応用テーマも指定する


AI Agent
短い行動履歴から次の商品を予測する――畳み込みを組み直したNextConvRec
NextConvRec — 商品遷移とセッション間の関係を前処理し、畳み込みで次の商品候補を順位付けする。
応用テーマ

RAG / VLM
文書画像を再処理せず、検索質問だけを小さなモデルへ蒸留する
ColNanoVDR — 教師のページ索引を維持し、質問を処理する部分だけ1億4,900万パラメータの学生に置き換える。
応用テーマ

LLM
クリックされなかった商品は、見られていたのか
Examination-Decomposed Doubly Robust Evaluation — クリックを閲覧と関連性に分け、見られていない項目を無反応と混同する偏りを扱う。
応用テーマ




Robotics / VLM
ロボットの動作モデルに、物体と手先の三次元的な位置関係を渡す
Spatial Grafting — 画像特徴に実寸の三次元位置と手先からの相対位置を結び付け、動作生成部へ渡す。
応用テーマ

Computer Vision / Robotics
故障していないセンサーの乱れを、検出器への入力直前で補正する
Boundary Feature Repair — 固定した検出器の統合境界で、カメラ特徴とLiDAR特徴に残差補正を加える。
応用テーマ

Robotics / AI Agent
多数の移動体の経路調整で、学習モデルの提案をPIBTが実行前に選別
GuardPIBT — 学習モデルはPIBTの候補順を提案し、最終的な移動先の決定はPIBTが担う。
応用テーマ
LLM
文章を生成せず評判を数値化――Jevの選択・判定を組み合わせた感情分析
Jev Typed Decisions for Dimensional ABSA — Jevの点数、選択確率、二択判定を組み合わせ、文章生成なしで三つの観点別感情分析課題を解く。
応用テーマ

RAG / VLM
文書検索で画像・表・本文を全部渡すべきかを測るGraphRAG研究
Modality-Aware Multimodal GraphRAG — 知識グラフの各事実に、本文・表・画像・配置のどれが根拠かを記録する。
応用テーマ

LLM
会話履歴の偽情報をLLMはいつ信じるか――出所の見せ方を変えた多ターン評価
Epistemic Policy Divergence — 同じ誤情報でも、会話履歴での出所の見せ方により、モデルの採用率が大きく変わった。
応用テーマ


Robotics / AI Agent / VLM
一本の人の作業動画から、ロボットの訓練動作を作るDexAgent
DexAgent — 人の一人称動画一本と作業文から、物体の再構成、ロボット軌道、訓練用データまでを段階的に生成する。
応用テーマ
Audio
音から「何をしているか」を推定できるか――音声言語モデルの活動理解を検証
Sounding Actions Benchmark — 個々の音を認識できても、時間をまたぐ音から人の活動を推定できるとは限らない。
応用テーマ

AI Agent
意識状態の推定に深層学習を使う研究をどう読むか
Deep Learning Methods in Neuroscience — 脳信号による状態分類、麻酔下の脳の結合変化、意識水準と相関する指標を扱うレビューである。
応用テーマ

Robotics / Computer Vision
人の道具使用動画を道具の姿勢に変え、ロボットの動作へつなぐ
P2P-T — 人の道具使用動画から、道具の位置と向きの軌道を取り出して学習する。
応用テーマ

LLM
AIは高校生による学習用フィードバックの評価を再現できるか
LLM Simulation of Learner Feedback Evaluations — 日本の高校生321人による4,478件の評価を使い、6モデルの予測を実際の学習者評価と比べた。
応用テーマ

LLM
多言語LLMでは全注意層を最初に置くと学習が速まるか
Multilinguality in Hybrid Attention LLMs — 英語と13言語の対訳表現を分析し、ハイブリッドLLMでは最初の全注意層付近に大きな変化を観察した。
応用テーマ


LLM
言語モデルの「自分を知る力」を四つの観点から測るAwarenessBench
AwarenessBench — 14,381問を四観点・15機能に分け、言語モデルの認知に関わる振る舞いを測る。