Reflector: Arrangement-Aware Harmonic Retrieval for Sample-Based Composition
Sample retrieval tools can help composers find harmonically compatible material, but querying from a fixed ref
- 用途
- 技術検証・論文読解補助
- 難易度
- Hard
- コスト
- High
「retrieval」の検索結果
55 件Sample retrieval tools can help composers find harmonically compatible material, but querying from a fixed ref
Multi-branch architectures and CNN-Transformer fusion have long been regarded as effective ways to improve veh
Full self-attention in large language models scales as O(N^2), which limits long-context document analysis to
Generative social robots (GSRs) powered by large language models offer new possibilities for personalized tuto
Large language models (LLMs) and AI agents have demonstrated strong potential for data integration in zero-sho
The integration of large language models (LLMs) into the nuclear power industry requires outputs grounded in d
Most endangered languages lack the parallel data required for machine translation, despite the existence of de
歴史資料の修復を支援するための新しい方法を提案し、歴史資料の修復を支援するためのモデルを作成した。
Single-pixel sensing encodes a scene as a short sequence of coded measurements, and image-free methods infer t
人間の推論とマシン・リーザーの推論を一致させることがAIセキュリティーやセーフティーにおける課題です。人間の推論とマシンの推論を対称化することで、AIシステムを安全かつ予測可能なものとすることができます。
Sparse attention reduces the cost of long contexts by allowing each query to read only selected parts of the i
Bridge infrastructure deteriorates gradually, yet its root causes---salt intrusion, freezing, fatigue cracking
この研究では、クローズドブックQAのアドプターを用いて、質問に対する正確な回答を生成することを目的とします。
Join discovery is a core task in dataset search, enabling users to find columns that can be joined with a give
Agentic Context Managementは、エージェントのメモリとコストを管理できるようにした。方法は、エージェントが自己管理できるように、トレーナーが制御できるようにした。
Democratization of AI Agent Creationは、オーガナイゼーションがオープンなAIエージェントを作成できるようにした。方法は、エージェントの信頼性を
この研究では、LLMsが長期記憶を持つ能力を評価するために開発された「RUMBA」という新しい基準を提示します。この基準は、記憶の長期間持つ能力を評価するための詳細な記憶関連質問の分類体系と、それを統合的に考慮するための
Retrieval-Augmented Generation (RAG) systems increasingly employ multiple LLM agents. Yet, most prior work opt
この研究では、大規模言語モデルを活用して、Greekに基づく書籍検索システムの評価を行いました。大規模言語モデルを活用することで、検索精度が高まりました。
Recent Large Language Models (LLMs) can produce and optimize complex code. We investigate the use of LLMs to g
知識重視の質問応答システム (KI-VQA) を分析するために、新しい評価基準を提案します。これらの基準では、VLMの各タスクを個別に評価することができます。
代理記憶の学習は、LGMが効果的に情報を保持・更新・処理できることを意味します。この研究では、アトリビューテッド グラフィックフィードバックを使用して、代理記憶を最適化する方法を提案します。
この論文では、対称的な位置エンコードにモビアスの対称性を適用しました。これにより、ローテーションの平面での各位置間のホロノミーが -1 となり、シーケンスの両端が決定的に結合されます。この手法により、精度が高額になること
この研究では、リスクベンチャークラウドワークにおける可信性の向上を目的として、Capital Markets LLM Reliability Score(CM-LRS)を提案し、LLMsが生成したドキュメントの価値を確立
この研究では、テキスト生成における個別化を目的として、PrefRewardを提案
Chinese language の長形法律研究報告における出典の信頼性を評価し、信頼性が低い出典を検出および評価する目的で LegalCiteTrust を提案している。
長形推論のための言語モデルが、提供されたコンテキストから乖離した論理を生成する可能性があることを指摘し、コンテキストと推論論理をより適切に融合するため、 REFACT (REstating Facts in Adapti
画像修復エージェントは、実世界シナリオでさまざまな不正確なデフォームを処理するための柔軟な枠組みとして急速に開発されています。既存のエージェントは、エージェントは欠陥、ツール、修復オペレーションのための候補を検索し、修復
文章ベースの人物検索には、実世界シナリオではQuery Granularityの不確実性が大きな課題です。この paper では、New Paradigm、Text-based Person Retrieval with
Improving video captioning quality typically demands retraining large vision-language models, an expensive and
本論文では、テキストと動画を対応させるDistribution-Alignment Bridge(DAB)を提案します。DABは、テキストと動画のエンティティを確率分布として表現し、両者の間の分布の差異を解決します。この
大規模言語モデルがヒューリスティックを形成し、それを使用して未知のタスクに適用できるようにすることを目標に掲げました。これにより、大規模言語モデルの実用性を向上させることができると予想されます。
リトリーウードされた大規模な言語モデルは、有益な情報と誤った情報の混在するコンテキストに対処するのに苦労しています。拒否することで有益な情報を捨てることになるし、無条件に採用すると不正確または危険な回答が得られます。正確
FinMMEval 2026 タスク 2 は、英語で提出された短答式の金融問題を解決することを目的としています。英語以外の言語による証拠も使用されます。
FinMMEval 2026 タスク 1 は、英語、中国語、アラビア語、ヒンディー語で行われる多言語的な金融質問に答えるものを評価します。
グラフやハイパーグラフを用いたリテラル・アンダラインは、複雑なn-アライアブル原子事実をエンティティ間の単一の関係を頼らない、エンティティ間の関係を明示することで、従来のグラフベースのアプローチを上回る精度を実現している
3D オキュピエンシー予測には、物体の配置と密度を解釈するための視覚的手法が必要です。従来の方法では、計算コストが高くなりすぎていたが、新しく提案されたGaussianSeedアルゴリズムは、層を階層化することで、計算コ
複数ターンのファッション画像検索は、実世界のファッション検索では重要なタスクです。Diverse-Intent Multi-Turn Fashion Image Retrievalアルゴリズムは、異なる検索用途を扱うこと
人間の個体を表現するための高精度の生成モデルを提案し、複数の人間の個体を表現するための精度と柔軟性を向上させることを目指しています。
可視光と非可視光のデータを連携するためのアプローチを提案し、可視光と非可視光のデータを連携するための精度と効率を向上させることを目指しています。
Global visual localization of unmanned aerial vehicles (UAVs) using remote-sensing reference maps has attracte
Large language models that generate step-by-step reasoning traces have achieved strong performance on complex
Low-rank adaptation introduces a static learned update applied identically to every input. The update provides
この研究では、臨床評価が主にMCQAに頼っているものの、モデルがどのような観点で回答を裏付けるかを検出できない問題に対処するために、マイクロドタイルと関係的推論のBENCHMARKであるMIRA-Evが提案された。
この研究では、エージェントメモリーのワークロードは直接的事実検索、関係連鎖や現在の状態の推論、長時間の履歴上に関係がある合成を組み合わせて、Supra Cognitive Modes を開発しました。このアーキテクチャで
この研究では、ニュースの多視点的生成とバイアス検出と軽減を行うために、AutoJournシステムが構築され、視点の多様化とバイアス検出と軽減のための新しい方法が提案された。
This comprehensive study introduces an advanced Artificial Intelligence for Indian Legal Question Answering (A
Large language models (LLMs) have driven rapid progress in electronic design automation (EDA), yet their appli
World Action Models(WAMs)は、ロボットマニピュレーションをモデル化するパラダイム。WAMsは、視覚ステートトランジションとロボットアクションを同時にモデル化する。しかし、既存のWAMsは、一定の時
因果推論を用いた政策学習を提案し、政策選択を行う際に最も近い類似の証拠によって行動の有効性を評価することを目指している。
Incorporating prior maps significantly enhances the accuracy and robustness of pose estimation in visual-inert
In The Algebraic Mind, Marcus identified three cognitive components: operations over variables, recursively st
Federated foundation-model adaptation increasingly relies on heterogeneous private artifacts (retrieval corpor
LLMの不正行為に対する防御。この研究では、LLMの不正行為を防ぐための防御の枠組みを開発し、LLMの不正行為の危険性を分析する。
この研究では、Controlled Dynamics Attractor Transformer (CDAT)を提案しました。このTransformerは、Self-Attention MechanismとAssocia