535 articles

Category

自然言語処理

LLM、RAG、埋め込み、ファインチューニングなど、AIアプリ実装に必要な自然言語処理技術を整理します。

大規模言語モデルRAGファインチューニングプロンプトエンジニアリング埋め込み・検索トークナイザ

人気記事

新着記事

未読 535
githubGitHubあり2026-07-24

prompts.chat — f.k.a. Awesome ChatGPT Prompts. Share, discover, and collect prompts from the community. Free and open source — self-host for your organization with complete privacy.

prompts.chatは、コミュニティが共有したChatGPT用のプロンプットを発見・収集できる場所で、無料でオープンソースで提供されている。

自然言語処理大規模言語モデル
用途
チャットGPT用のプロンプトを共有
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

awesome-MLSecOps — A curated list of MLSecOps tools and resources for securing machine learning and AI systems - adversarial ML defense, LLM security, AI red teaming, model scanning, supply-chain protection, and MLOps pipeline security.

マルチモーダル理解技術のための新しいアプローチであるMIRRORを提案しました。MIRRORは、テキスト、図、テキストと図の組み合わせから等価な視点を提供することで、視覚的な推論や複雑な推論力を向上し、さまざまなモデルの

自然言語処理大規模言語モデル
用途
マルチモーダル理解技術の開発
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

Medical_Image_Analysis — Foundation models based medical image analysis

医学画像分析は、医療の診断や治療を支援するために画像に記載されたデータから情報を抽出する研究分野です。この研究では、foundation modelsを用い、医療画像分析のための新しいアプローチを提案しました。found

自然言語処理大規模言語モデル生成画像テキスト
用途
医学画像分析
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

unsloth — Unsloth is a local UI for training and running Gemma 4, Qwen3.6, DeepSeek, Kimi, GLM and other models.

Unsloth Studioは、オープンモデルのトレーニングと実行を支援するWebUIです。このライブラリは、Gemma4、Qwen3.5などのオープンモデルのテストとトレーニングを支援するために使われます。

自然言語処理大規模言語モデルテキスト音声
用途
オープンモデルのトレーニングと実行
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

ai-agent-book — 《深入理解 AI Agent:设计原理与工程实践》(李博杰 著)开源主仓库:全书正文、编译版 PDF 与按章配套代码

この論文では、現在のVision-Language-Benchmark(VLB)を超える、MLLMがアクティブな観察を実演できるようにするためのバenchmark、ActiveVisionを提案する。このActiveVi

自然言語処理大規模言語モデルテキストマルチモーダル
用途
弁論の実際的な対象を形成するためにAIが活用される
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

wandb — The AI developer platform. Use Weights & Biases to train and fine-tune models, and manage models from experimentation to production.

Weights & Biasesは、AI開発を支援するプラットフォームです。このプラットフォームは、モデル開発から生産準備までを支援し、コストをコントロールし、モデルとデータへのアクセスを管理します。

自然言語処理ファインチューニング
用途
AI開発プラットフォーム
難易度
Easy
コスト
Medium
githubGitHubあり2026-07-24

ART — Agent Reinforcement Trainer: train multi-step agents for real-world tasks using GRPO. Give your agents on-the-job training. Reinforcement learning for Qwen3.6, GPT-OSS, Llama, and more!

ARTは、多段強化学習トレーナーです。このトレーナーは、GRPOを使用して、現実世界のタスクに対して、多段強化学習を行うことができます。

自然言語処理大規模言語モデル強化学習
用途
多段強化学習トレーナー
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

Mooncake — Mooncake is the serving platform for Kimi, a leading LLM service provided by Moonshot AI.

この論文では、LLM を提供するために使用される Mooncake サービス プラットフォームについて説明しています。Mooncakeは、Kimi というリーディングのLLMサービスを提供するサービスです。Kimiは、M

自然言語処理大規模言語モデル
用途
LLM用サービングプラットフォーム
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

qdrant — Qdrant - High-performance, massive-scale Vector Database and Vector Search Engine for the next generation of AI. Also available in the cloud https://cloud.qdrant.io/

このリポジトリでは、データとAIアルゴリズムを製品化するためのプラットフォームであるTaipyを提供しています。

自然言語処理埋め込み・検索生成画像
用途
AIアプリケーションを製品化するためのプラットフォーム
難易度
Easy
コスト
Low
githubGitHubあり2026-07-24

mlflow — The open source AI engineering platform for agents, LLMs, and ML models. MLflow enables teams of all sizes to debug, evaluate, monitor, and optimize production-quality AI applications while controlling costs and managing access to models and data.

このリポジトリでは、AIワークロードを管理するためのシステムであるSkypilotを提供しています。

品質予測/異常検知自然言語処理大規模言語モデル
用途
AIワークロードを管理するためのシステム
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

skypilot — The AI Compute Platform for frontier teams. SkyPilot turns fragmented AI compute into one AI supercomputer, so frontier AI teams build custom intelligence faster.

このリポジトリでは、AIアプリケーションをローカルに実行できるツールキットであるRunAnywhere-sdksを提供しています。

自然言語処理大規模言語モデル
用途
AIアプリケーションをローカルに実行できるツールキット
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

lance — Open Lakehouse Format for Multimodal AI. Convert from Parquet in 2 lines of code for 100x faster random access, vector index, and data versioning. Compatible with Pandas, DuckDB, Polars, Pyarrow, and PyTorch with more integrations coming..

マルチモーダルAIに適したオープンレイクハウスフォーマットです。このフォーマットでは、パレットからデータを2行のコードで変換することができ、100倍速くなります。また、ベクトルインデックスやデータバージョニングが可能です

自然言語処理大規模言語モデルマルチモーダル
用途
オープンレイクハウスフォーマット
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

kserve — Standardized Distributed Generative and Predictive AI Inference Platform for Scalable, Multi-Framework Deployment on Kubernetes

flyteは、高度に動的で堅牢なAIオーケストレーションプラットフォームであり、データ、モデル、コンピューティングを統合してAIワークフローを作成することができます。

自然言語処理大規模言語モデル生成
用途
エクスペリメントトラッカーを簡単にする
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

RAG_Techniques — This repository showcases various advanced techniques for Retrieval-Augmented Generation (RAG) systems. Each technique has a detailed notebook tutorial.

医学画像に対する疾患検出モデルを開発し、臨床現場で早期検出と迅速な介入を容易にすることを目的としたフレームワークを提案します。

自然言語処理大規模言語モデル生成
用途
医学画像の疾患検出
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

rasa — 💬 Open source machine learning framework to automate text- and voice-based conversations: NLU, dialogue management, connect to Slack, Facebook, and more - Create chatbots and voice assistants

rasaは、テキストやボイスベースの会話を自動化するオープンソースの機械学習フレームワークです。自然言語理解(NLU)、会話管理、 slackやFacebook等への接続など、幅広い機能を提供しています。

自然言語処理テキスト
用途
チャットボット作成
難易度
Easy
コスト
Medium
arxivPaper only2026-07-23

MIRROR: Learning from the Other View for Multi-Modal Reasoning

多モーダル理解技術のための新しいアプローチであるMIRROR(Learning from the Other View)を提案しました。MIRRORは、テキスト、図、テキストと図の組み合わせから同等の視点を提供することで

品質予測/異常検知自然言語処理大規模言語モデル画像テキストマルチモーダル
用途
多モーダル理解技術の開発
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Token Budget Saturation and Mechanistic Early Detection of Reasoning Non-Convergence in Chain-of-Thought Models

チェーン・オブ・サウト reasoning モデルの収束不明確さを解決する研究。このモデルの不完全収束は、生成するトークンの数に依存し、モデルには収束しない限り問題を解決する能力がない。これを解決するための予測を終了する

自然言語処理プロンプトエンジニアリング検出生成
用途
チェーン・オブ・サウト reasoning モデルに適切に予測を終了する方法を検討する
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Cautious optimism for deep parameterized quantum circuits

可能な量子的計算機械学習モデルにおける一般化の理解を進めた。この研究では、パラメータ化された量子回路のパフォーマンスのスケーリングに影響を与える要因を調査し、パラメータ化された量子回路のパフォーマンスを理解するための新し

自然言語処理RAG
用途
可能な量子的計算機械学習モデルにおける一般化の理解
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Emergent Misalignment Recruits a Pre-existing Persona Subspace

アライメントした言語モデルの偏った表現の理解を進めた。この研究では、アライメントした言語モデルの表現を分析して、偏った表現を理解することができ、これを用いて、偏った表現を正すことができると主張した。

自然言語処理ファインチューニング生成テキスト
用途
アライメントした言語モデルの偏った表現の理解
難易度
Hard
コスト
High
arxivPaper only2026-07-23

The Weight of Silence: A Causal Case for Weights Over the Scratchpad in Latent Chess Reasoning

ラテン言語モデルを使用すると、言語モデルの内部の計算結果を分析できる。計算結果は、連続ベクトル空間として実行される中間計算であり、これを分析すると、モデルがどのように結果を得ているかを明らかにできる。

MI向き自然言語処理ファインチューニングテキスト強化学習
用途
ラテン言語モデルの中間計算を分析する
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Position Bias is Hidden Behind Ceiling Effects: A Permutation Diagnostic for LLM Benchmarks

LLM(言語モデル)の評価における位置バイアスを分析するための方法を提案した研究で、この方法により、位置バイアスが評価結果にどのような影響を与えるかが明らかにできる。

自然言語処理大規模言語モデル検出生成
用途
LLMの評価における位置バイアスを分析する
難易度
Hard
コスト
High
arxivPaper only2026-07-23

From Resource Flow to Executable Tests: Petri-Net-Guided LLM Test Generation for Concurrent Stateful Rust APIs

この研究は、リソースフローの動作を表すPetriネットと、APIを操作するためのテストを自動生成する方法を提案した。方法は、APIの機能をテストするためのシナリオを生成し、テストが正しく実行されるようにした。

自然言語処理大規模言語モデル生成テキスト
用途
共時進行のコンカURRENCYAPIのテスト
難易度
Hard
コスト
High
arxivPaper only2026-07-23

An LLM-Driven Workflow for Automated Process Control Strategy Generation and Tuning from Dynamic Process Models

このプロセスでは、大規模言語モデルを使用して、ダイナミックプロセスモデルに基づいて自動化された制御戦略を生成します。

少数データ向きCPUで試しやすい条件最適化自然言語処理大規模言語モデル生成
用途
オートメーションされた制御戦略の生成
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Safeguards for Speech2Speech LLM-Assistants: A Case Study in Automotive Applications

S2S (Speech-to-Speech) LLMアシスタントを利用して、人間のような話し方をすることができますが、安全対策の実装が困難です。この研究では、S2S LLMアシスタントの安全対策を2つのアプローチで実現し

自然言語処理大規模言語モデルテキスト音声
用途
S2S LLMアシスタントの安全対策
難易度
Hard
コスト
High
arxivPaper only2026-07-23

V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure

ビデオLMMの安全性を確認するために、新しい診断フレームワークを提案します。これらのフレームワークは、モデルの挙動、理解、セマンティクスを同時に考慮します。

自然言語処理大規模言語モデル画像テキスト動画
用途
ビデオ安全性デ-カリブレーションの診断
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Hardware-Software Co-Design for Float16 On-Device Training on RISC-V Single-Core

RISC-V単コア上の16ビット浮動小数演算 (FP16) を高速化するために、新しいフレームワークを提案します。これらのフレームワークは、メモリ フットプリントを約50%削減しながらモデルのパフォーマンスを維持します。

自然言語処理RAG
用途
RISC-V単コア上の16ビット浮動小数演算の高速化
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Surprisal Theory is Tautological (without Rational Grounding)

ある単位の人間の認知的難易度は、その単位のスルーパイズアル (Surprisal) と特定の言語モデルによれば線形関数に等しいという理論が存在します。しかし、この理論は実態を反映していないという批判があります。この論文で

自然言語処理テキスト
用途
認知的難易度と言語モデルとの関係
難易度
Hard
コスト
High
arxivPaper only2026-07-23

MedGame: Storytelling Gamification Empowered by Large Language Models for Medical Education

Large Language Models (LLMs) は医学教育に大きな可能性を持っていますが、現在のシステムでは、質問に答えるか一時的なフィードバックしか行なわれていません。一方、臨床病例を決定センターへの学習トレ

自然言語処理大規模言語モデル生成QAテキスト
用途
医学教育への Large Language ModeL の適用
難易度
Hard
コスト
High
arxivPaper only2026-07-23

When Trivia Is Not Trivial: Everyday Knowledge Failures in Multilingual LLMs

この論文では、大規模言語モデル (LLMs) が日常的な文化的知識を評価する能力に着目しています。ここで、TriviaRoomQA というクイズスタイルで問題を提示して、LLMs が日常的な文化的知識をどのように評価する

自然言語処理大規模言語モデルテキスト
用途
大規模言語モデルにおける日常生活の知識の評価
難易度
Hard
コスト
High
arxivPaper only2026-07-23

An Evaluation Framework for Structured Audio Captions Validated by Controlled Perturbations

この論文では、音声字幕の評価手法が提案され、音声字幕の評価において既存の手法の制約を克服することを目指しました。提案されたフレームワークは音声字幕の各側面を評価し、質問回答型の評価手法ではなく字幕の中立性を評価することが

センサ/時系列自然言語処理大規模言語モデル生成テキスト音声
用途
音声字幕の評価フレームワークの構築
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Anti-Periodic Positional Encoding: Möbius Boundary Conditions Make In-Context Retrieval Reliable

この論文では、対称的な位置エンコードにモビアスの対称性を適用しました。これにより、ローテーションの平面での各位置間のホロノミーが -1 となり、シーケンスの両端が決定的に結合されます。この手法により、精度が高額になること

自然言語処理プロンプトエンジニアリングテキスト
用途
モビアスの対称性に基づく対称的な位置エンコード
難易度
Hard
コスト
High
arxivPaper only2026-07-23

MemTools: A Unified Research Framework for Interoperable Agent Memory

この論文では、記憶システムをサポートするフレームワークMemToolsが構築され、記憶システムの開発を容易にすることを目指しました。これにより開発者は、記憶システムの各コンポーネントを開発およびテストしやすくなり、設計と

自然言語処理RAGマルチモーダル
用途
エージェントの記憶をサポートするフレームワークの構築
難易度
Hard
コスト
High
arxivGitHubあり2026-07-23

REFACT: Adaptive Fact Restatement for Compact and Faithful Chain-of-Thought Reasoning

長形推論のための言語モデルが、提供されたコンテキストから乖離した論理を生成する可能性があることを指摘し、コンテキストと推論論理をより適切に融合するため、 REFACT (REstating Facts in Adapti

自然言語処理大規模言語モデル生成テキスト
用途
Chain-Of-Thought (CoT) の改善
難易度
Hard
コスト
High
arxivPaper only2026-07-23

HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

大規模言語モデルはさまざまな画像をテキストに変換する上で優れた性能を示しているが、発生するホログラフィックな診断にはまだ解決策が必要です。この研究では、主流の粗い検出方法の欠点を補うため、細部の診断方法を提案しています。

説明可能自然言語処理大規模言語モデル分類検出生成
用途
ホログラフィックハロウィーンの診断
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Geo3R: Mitigating Spatial Reasoning Hallucination in Multimodal Large Language Models

大規模言語モデルのハロウィーン診断では、対象の 3D 空間関係を推論する際に、視覚化が欠如していることが問題となります。この研究では、これらのハロウィーンを軽減するためのアプローチを提案しています。

自然言語処理大規模言語モデル画像テキスト3D
用途
3D空間推論のハロウィーン診断
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text

空間理解は、物理世界と静的のセマンティック理解の間でつながるために不可欠です。多くの空間タスクは、場所、領域、パスの自然な表現は、ポインティングやマーキングなど、連続的な視覚的シーンで行われることが多いが、現行の空間推論

自然言語処理大規模言語モデル生成画像テキスト
用途
空間理解
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Do Pathology Vision-Language Models Truly See Pathology?

パスロジは、現在、パスロジ認識のための画像言語モデルを評価するために広く使用されていますが、この研究では、パスロジ認識において画像言語モデルの視覚知覚が機能していることを疑問に問っています。

自然言語処理大規模言語モデル画像テキストマルチモーダル
用途
パスロジの認識
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Unsupervised Metal Artifact Reduction in Dental CBCT using Fine-tuned Cycle-Consistent Adversarial Networks

この研究では、歯科CBCT画像中のメタルアーティファクトを除去するための循環互換的アドバーサリアルネットワーク(CycleGAN)を提案します。CycleGANを使用すると、メタルアーティファクトを除去した後、CBCT画

品質予測/異常検知自然言語処理RAG生成画像教師なし
用途
メタルアーティファクトの除去
難易度
Hard
コスト
Low
arxivPaper only2026-07-23

FORGE-plus: Force-Budgeted Recovery for Contact-Rich Assembly with a Frozen LLM Supervisor

強制制約に基づく強化学習を利用し、低コストで高精度の組み立てが可能になると同時に、組み立てに失敗してもロボットが安全に回避できるように、ロボットの制御のための強化学習を提案します。

自然言語処理大規模言語モデルテキスト強化学習
用途
非対称ロボット組み立て
難易度
Hard
コスト
High
arxivPaper only2026-07-23

ZONDA: Zero-shot Object Navigation with Dynamic Avoidance in Multi-floor Environments

オブジェクト目標のナビゲーションにおける、動的な避け方とマルチフロア環境を考慮した、ゼロショットオブジェクトナビゲーションのフレームワークを提案します。このフレームワークでは、動的な人々とマルチフロア環境を考慮しながら、

自然言語処理ファインチューニングテキスト3Dマルチモーダル
用途
マルチフロアにおけるオブジェクト目標のナビゲーション
難易度
Hard
コスト
High
arxivPaper only2026-07-23

TableVerse: A Large-scale Tabletop Dataset with Real-world Grounded Layouts for Generalizable Manipulation

オートメーションされたマニピュレーションを目的とした、大規模なテーブルトップのデータセットであるTableVerse を提案します。このデータセットには、物理的に可能な実世界のレイアウトを生成する実用的な方法が含まれてお

品質予測/異常検知自然言語処理RAG生成画像テキスト
用途
オートメーションされたマニピュレーションのためのテーブル環境の生成
難易度
Hard
コスト
Low
arxivPaper only2026-07-23

Distributed Model-Based Diffusion For Scalable Multi-Robot Trajectory Optimization

多ロボットのトラッジオプティマイズを目的とした、分散型のモデリングベースの浸透を提案します。このフレームワークは、非凸の非線形の非可微分な環境を考慮しながら、効率的なトラッジ作成を支援します。

自然言語処理RAG生成
用途
多ロボットのトラッジオプティマイズ
難易度
Hard
コスト
High
githubGitHubあり2026-07-23

unstructured — Convert documents to structured data effortlessly. Unstructured is open-source ETL solution for transforming complex documents into clean, structured formats for language models. Visit our website to learn more about our enterprise grade Platform product for production grade workflows, partitioning, enrichments, chunking and embedding.

ドキュメントを構造化するために使えるオープンソースのETLソリューション。

表形式向き自然言語処理大規模言語モデル画像テキスト表形式
用途
ドキュメントの構造化
難易度
Easy
コスト
High
arxivPaper only2026-07-22

Evaluating and Mitigating Gender Bias in Pre-trained Embeddings for ML-based Recruitment

この研究では、AIベースの採用システムを使用して、過去の履歴データに基づいて機械学習モデルをトレーニングすることで、社会的偏見を永続させたり強化したりするリスクを評価および緩和することを目的とした。

自然言語処理埋め込み・検索テキスト
用途
人才採用における偏差解消
難易度
Hard
コスト
Low
arxivGitHubあり2026-07-22

Antigen-specific Antibody Multi-modal Foundation Model for Functional Antibody Design

この研究では、抗原特異性抗体を設計するために、抗原および抗体の間でエピトープレベルでのペアリングが必要であることを考慮した、抗原特異性の抗体多モーダルファンデーションモデル(AAMFM)を提案しました。

自然言語処理RAG分類生成テキスト
用途
抗原特異性抗体設計
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Hypothesis-and-Refinement Learning of Organic Structures from Multimodal Spectroscopic Data

分子構造を決定するために、スペクトルデータから自動的な構造解析を実施するための方法を提案している。この方法は、スペクトルデータに基づいてヒントと改良を繰り返すことで、分子構造を決定するもので、分子の可能性の広範な構造スペ

MI向き自然言語処理ファインチューニング生成テキストマルチモーダル
用途
分子構造の解析
難易度
Hard
コスト
High
arxivPaper only2026-07-22

SLPO: Scaling Latent Reasoning via a Surrogate Policy

この研究では、ラベラーの品質が悪い場合の対策として、ラベラーの評価を自動化します。特に、ラベラーの評価はオブジェクト検出のタスクでは困難です。したがって、ラベラーの評価を自動化するために、画像認識のデータを分析してラベラ

説明可能自然言語処理プロンプトエンジニアリング強化学習
用途
ラベル付けの品質を確保し、品質管理が必要な画像認識
難易度
Hard
コスト
Medium
arxivPaper only2026-07-22

PoTRE: Test-Time Reasoning inspired by Cognitive Heterogeneity

モデルの脆弱性を解決するために、四つのエージェントに分割される多様なフレームワークPoTREを導入した。モデルの推論能力を強化し、単一のストリーミングアプローチよりも複雑な理論的制約とアブストラクションに抵抗できるように

表形式向き自然言語処理大規模言語モデル生成テキスト
用途
複雑な推論力のあるタスクの解決
難易度
Hard
コスト
High
arxivPaper only2026-07-22

The Ethics of Autonomous AI Agents for Offensive Security

侵攻テストツールが異なっている点、決定主義的な性質、狭く特定されたスコープ、専門技術の操作を用いたものと異なり、LLM駆動の自治的セキュリティツールは3つの次元で不確実性を示した。政策決定への説明が困難、影響の開放性、行

自然言語処理大規模言語モデルテキスト
用途
自律的セキュリティツールの倫理的考慮
難易度
Hard
コスト
High
arxivPaper only2026-07-22

On the Systematic Challenges of Culturally Loaded Machine Translation: Dream of the Red Chamber as the Cultural Lens

文化的意味の表現が表現された翻訳には、翻訳システムが表現する意味を理解するために、表現の文化的背景を考慮する必要があることを指摘した。文化的背景が表現されている表現された翻訳には、いくつかの課題があり、LLMベースの翻訳

品質予測/異常検知自然言語処理大規模言語モデル翻訳テキスト
用途
文化的意味の表現
難易度
Hard
コスト
High
arxivPaper only2026-07-22

DQAOA-GPT: AI-Accelerated Distributed Quantum Optimization for Combinatorial Problems

組み合わせ方程式の最適化を解くための新しいフレームワークを提示した。分布される量子アルゴリズムの局所的な制限に直面する際、最適化の解を導けるために、分布される量子近似最適化アプローチと深層学習アルゴリズムを組み合わせた。

品質予測/異常検知自然言語処理大規模言語モデル生成
用途
方程式組み合わせの最適化
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Small, Free, and Effective: Orchestrating Open-Weight Small Language Models to Outperform Single LLM for Malware Analysis

分析報告の迅速な解釈が求められるときに行われるマルウェア分析を実現するために、閉じた重みの大きい言語モデルを使用しないことが多い。オープン重みの言語モデルは、マルウェア分析のために適切な言語能力と、閉じた重みの大きい言語

自然言語処理大規模言語モデルテキスト
用途
マルウェア分析のための小規模な言語モデル
難易度
Hard
コスト
High
arxivPaper only2026-07-22

HalluTruthQA: A Fine-Grained Benchmark for Hallucination Detection, Localization, and Explanation in Arabic Question Answering

大きな言語モデルは真実の情報を提供できるように見えますが、実際は虚偽情報を提供することが多く、これを検知、検出、および検証するための基準を作成するため、HalluTruthQAが開発されました。

自然言語処理大規模言語モデル検出QAテキスト
用途
仮想の答えを検知、検出、および検証するための基準を作成する
難易度
Hard
コスト
High
arxivPaper only2026-07-22

TINY_SCHILLER: A Drop-In German Drama Corpus for Small Language Models

小さな言語モデルに対するドロップインコーパス、tiny_schillerを導入し、単一ファイルで利用できるようにし、言語モデルを簡単にprototyping、fine-tuning、教育、研究に利用できるようにする。

自然言語処理大規模言語モデルテキスト
用途
ナイーブな言語モデルに対するドロップインコーパスの提供
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking

3D オキュピエンシー予測には、物体の配置と密度を解釈するための視覚的手法が必要です。従来の方法では、計算コストが高くなりすぎていたが、新しく提案されたGaussianSeedアルゴリズムは、層を階層化することで、計算コ

品質予測/異常検知自然言語処理大規模言語モデル生成テキスト
用途
3次元空間における物体の配置と密度の予測
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Reference-Free Evaluation of Reasoning in Open-Ended Question Answering

この研究では、AI生成物の論理的評価に必要なものとして、生成物がどうやって結果を得るのかを明らかにすることの重要性を強調しています。この研究では生成物を分解し、その論理的な構造を理解するために自然言語推論を利用し、生成物

自然言語処理大規模言語モデルQAテキスト
用途
AI生成物の論理的評価
難易度
Hard
コスト
High
arxivPaper only2026-07-22

PercepCap: Video Captioner with Structured Spatio-Temporal Perception

ビデオキャプション生成には、空間と時刻の理解が重要です。PercepCapアルゴリズムは、ビデオ入力を空間時刻認識に分解することで、生成されたキャプションの理解度が向上するとともに、空間時刻の誤差をより正確に検出でき、キ

品質予測/異常検知自然言語処理大規模言語モデル生成動画強化学習
用途
ビデオキャプション生成のための構造化された空間時刻の理解
難易度
Hard
コスト
High
arxivPaper only2026-07-22

OffNadirLoc: Benchmark and Framework for Challenging UAV-to-Satellite Geo-Localization under Large Off-Nadir Views

OffNadirLocは交差視点地理位置を推定するための基準セットを提案します。これにより、ドローンと衛星画像の交差視点地理位置推定プロセスでは重要な構造的シーン理解と内部ドメイン間の関係制約に焦点を当てることができます

自然言語処理プロンプトエンジニアリング検出画像テキスト
用途
ユーザー間の地理的位置の推定改善
難易度
Hard
コスト
High
arxivPaper only2026-07-22

PRISM-DR: Per-lesion Retinal Inference with Specialist Models for Diabetic Retinopathy

この研究では、糖尿病性黄斑病変の検出を目的としたPRISM-DRシステムを開発しました。このシステムは、医師が見逃す可能性がある小さな低コントラストな病変を見つけるのに役立ちます。

少数データ向きCPUで試しやすい条件最適化自然言語処理ファインチューニング検出生成画像
用途
糖尿病性黄斑病変を検出する
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Memory-Augmented Multimodal Large Language Models for Small Object Understanding in Streaming Aerial Videos

この研究では、ドローンで小さな物体を認識することを目的としたメモリ拡張型大規模言語モデルを開発しました。このモデルは、複雑なドローンの場面で、ユーザーの指示に従って物体を識別できるようになります。

自然言語処理大規模言語モデルセグメンテーション画像テキスト
用途
ドローンで物体認識を実行する
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning

自動運転システムには、道路のトポロジー(ドライバブルレーンとその接続性)を理解する機能が必要です。最近の検出モデルは360度の前方視野からボリュームイメージを取得することで、道路上のレーンのトポロジーを推測することができ

自然言語処理RAG画像テキストマルチモーダル
用途
道路のトポロジー認識を改善
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Extending a Large View Synthesis Model for Multi-view Panoptic Segmentation

自律ロボットには、障害物や事故の回避能力が必要です。これは、障害物や事故の回避能力が強化されていれば、障害物や事故に対しての対策がより効果的になります。障害物や事故の回避能力が強まることで、ロボットが障害物や事故から安全

品質予測/異常検知自然言語処理ファインチューニング生成セグメンテーション画像
用途
自動ロボットが障害物や事故を回避できるようにする
難易度
Hard
コスト
High
arxivGitHubあり2026-07-22

ReferTrack: Referring Then Tracking for Embodied Visual Tracking

ReferTrack は、自然言語で対象の車両に付近する自動車を追従させるシステムである。このシステムでは、対象の車両に付近する自動車を認識する後、自動車の動きを予測する。

自然言語処理プロンプトエンジニアリング検出画像テキスト
用途
自動車が対象の車両に付きそわせるシステム
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Robots Acquire Manipulation Skills in Seconds from a Single Human Video

HOST は、ロボットが人間の動作からスキルをすぐに習得できるシステムである。このシステムでは、ロボットは単一の人間の動作ビデオからスキルを習得し、既に習得したスキルを維持する。

自然言語処理RAG動画
用途
ロボットが人間の動作からスキルをすぐに習得できるシステム
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Optimal Placement of Docking Stations and Resident AUVs for Subsea Pipeline Inspection

このシステムは、沼辺のパイプラインを調査するために使用される。システムはサブシー ドッキング プレート(SDP)の配置と潜在的に泄漏する場所への居住者の無人潜水車(AUV)の割り当て両方の混和線型プログラミングフレームワ

品質予測/異常検知自然言語処理RAG
用途
沢辺のパイプラインを調査するための調査システム
難易度
Hard
コスト
Low
arxivPaper only2026-07-22

V2F: Vision-Informed Grasp Force Prediction for Damage-Aware Robotic Handling of Date Fruits

V2F は、日用消費財をロボットで取扱するためのシステムである。このシステムでは、ロボットが消費財を取扱うときに必要な力を予測し、物体を傷つけたり、物を作れなかったりするのを防ぐ。

自然言語処理RAGセグメンテーション画像
用途
日用消費財をロボットで取扱するためのシステム
難易度
Hard
コスト
Low
arxivPaper only2026-07-21

Optimizing Regret

決定関数とコストの関数間の共変性により、損失関数を最適化することで、適切な行動決定を可能にすることができます。また、これに基づいて、共変性の傾向を最適化する方向性を考察し、正確に予測された結果を持つモデルを導出するのに役

自然言語処理大規模言語モデル
用途
適切な行動決定のための損失関数の最適化
難易度
Hard
コスト
High
arxivPaper only2026-07-21

Agents in the Wild: Where Research Meets Deployment

分散型言語モデル(LLM)やコンテキストを活用するエージェントは、製品開発やファイナンス分野で活用されている。エージェントを実用化するには、堅牢性、安全性、信頼性を確保することが大切となる。 このチュートリアルでは、エー

自然言語処理大規模言語モデルテキスト
用途
エージェントの実践
難易度
Hard
コスト
High
arxivPaper only2026-07-21

The Price of Reasoning: Cost-Quality Tradeoffs in Reinforcement Learning for Neural Machine Translation

この研究では、学生チームのテーブル演習(TTX)における評価方法を提案し、複雑でオープンエンドな状況にあるチームの行動とコミュニケーションを記録できるTTX学習プラットフォームを使用します。

品質予測/異常検知自然言語処理大規模言語モデル翻訳テキスト強化学習
用途
計算機教育のチーム問題解決能力評価
難易度
Hard
コスト
High
arxivGitHubあり2026-07-21

Reasoning Before Translation: Enhancing Legal Machine Translation with Structured Reasoning

この研究では、平衡方程式を満たすPINNs(物理基準付きニューラルネットワーク)を使用して、平均脱出時間の計算を目的とした椭球型境界条件付きPINNsを提案し、PINNsを使用した計算と実験室データを比較します。

品質予測/異常検知自然言語処理ファインチューニング翻訳テキスト強化学習
用途
平均脱出時間計算を目的とした椭円型境界条件付きPINNs
難易度
Hard
コスト
High
arxivPaper only2026-07-21

Automated Extraction of Techno-Economic Data from 76,000 Energy System Studies

エネルギー系モデリングの信頼性は数量的仮定に依存するが、この仮定の情報源が乏しい。データベースの更新が遅いなどの問題は、研究者の重複した努力につながる。ここではエネルギー系研究の76,000件以上のデータを対象に行った自

自然言語処理
用途
エネルギー系研究データの自動抽出
難易度
Hard
コスト
Medium
arxivPaper only2026-07-21

Supra Cognitive Modes: A Routed Architecture for Agent Memory

この研究では、エージェントメモリーのワークロードは直接的事実検索、関係連鎖や現在の状態の推論、長時間の履歴上に関係がある合成を組み合わせて、Supra Cognitive Modes を開発しました。このアーキテクチャで

品質予測/異常検知自然言語処理埋め込み・検索分類生成
用途
メモリアーキテクチャの設計
難易度
Hard
コスト
Low
arxivPaper only2026-07-21

Benchmarking Human and Automatic Speech Recognition of Diverse Speech: Initial Results

人間の耳は最高の聴覚能力をもつものであると考えられており、音声認識では人間の聴覚機能を上回るようなシステムが作りだされるのを待っている。しかし、このようなシステムは実現しておらず、人間は音声認識システムの基準作成の参考と

センサ/時系列自然言語処理分類音声
用途
多様な発音の音声認識の基準作成
難易度
Hard
コスト
Low
arxivPaper only2026-07-21

Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM

人間は、大きな言語モデルを使って長い論理的推論を行うが、このような推論の結果は正しくない可能性がある。ここでは、これらの発言を検証する手法を提唱する。

自然言語処理大規模言語モデルテキスト
用途
大型言語モデルの中での論理的推論を検証する
難易度
Hard
コスト
High
arxivGitHubあり2026-07-21

OmniReasoner: Thinking with Long Audio-Video via Native Tool Use

オリジナルのデータとZoom-Inのツールを組み合わせた方法、OmniReasonerを提案する。これにより、オリンモードルLLMsの長いオーディオビデオの論理的推論を改善できる。

MI向き品質予測/異常検知自然言語処理大規模言語モデル画像音声動画
用途
長いオーディオビデオの論理的推論を改善する
難易度
Hard
コスト
High
arxivPaper only2026-07-21

Anatomy-Aware 3D Mesh Refinement of Pericardium Segmentations on Computed Tomography

心臓の囲みの区別は、食道肥厚の測定に重要であるが、しかし、これを正確に区別することは難しい。これを解決するために、周囲の解剖学的構造を利用して囲みの区別を改善する方法を提案する。

自然言語処理RAGセグメンテーション画像テキスト
用途
心臓CT画像から心臓の囲みを正確に区別する
難易度
Hard
コスト
High
arxivPaper only2026-07-21

WorldScape Policy 2.0: Empowering Steerable World Action Modeling with Reasoning-Augmented Memory

World Action Models(WAMs)は、ロボットマニピュレーションをモデル化するパラダイム。WAMsは、視覚ステートトランジションとロボットアクションを同時にモデル化する。しかし、既存のWAMsは、一定の時

自然言語処理プロンプトエンジニアリング画像テキスト動画
用途
多目的マニピュレーション問題を解決する
難易度
Hard
コスト
High
arxivPaper only2026-07-21

Correct-by-Construction Behavior Tree Synthesis from Signal Temporal Logic Specifications with Application to Robotic Missions

行動木はロボットの複雑なタスクの実行に広く採用されており、モジュラーで反応的な制御を提供します。しかし、既存の合法的な生成方法は、線形時間論理(LTL)のみに制限されるため、量的タイミング制約を表現できません。この論文で

自然言語処理RAG生成
用途
行動木の合法的な生成を解決する
難易度
Hard
コスト
Low
arxivPaper only2026-07-21

RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation

既存のロボットデータセットは高コスト、高度個別性、不足しているフィンガープリント構造を持ったものが多い。これらの問題を解決するために、RoboInter1.0に基づいて、RoboInter1.5を提案します。RoboIn

説明可能自然言語処理RAGセグメンテーション
用途
体系の世界モデリングを解決する
難易度
Hard
コスト
Low
arxivPaper only2026-07-21

How defensive driving enhances driving safety: A driving simulator study on drivers' defensive driving behaviors

「防御運転」とは、安全な運転スキルの一種です。しかし、防御運転が安全運転にどのような影響を及ぼし、どのようなメカニズムによって影響が与えられるかの研究は不足している。この研究では、防御運転の行動特徴と安全運転

自然言語処理RAG
用途
乗組み安全性を優先する運転を行う
難易度
Hard
コスト
High
arxivPaper only2026-07-21

LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior

LLMが広く使用されるようになり、LLMを識別するツールが開発されている。 しかし、識別システムは、使用者の行動に影響を与えている。つまり、識別システムが機能しないと、ユーザが別のシステムを使用することに関連し、最終的な

品質予測/異常検知自然言語処理大規模言語モデル検出
用途
LLMを識別
難易度
Hard
コスト
High
githubGitHubあり2026-07-21

agent-starter-pack — Ship AI Agents to Google Cloud in minutes, not months. Production-ready templates with built-in CI/CD, evaluation, and observability.

AIエージェントをGoogle Cloudに展開することが可能で、CI/CD、評価、観察など、プロダクションリードテンプレートが事前に用意されています。

自然言語処理大規模言語モデル生成
用途
AIエージェントをGoogle Cloudに展開
難易度
Easy
コスト
High
githubGitHubあり2026-07-21

BettaFish — 微舆:人人可用的多Agent舆情分析助手,打破信息茧房,还原舆情原貌,预测未来走向,辅助决策!从0实现,不依赖任何框架。

微舆は人人可用的多Agent舆情分析助手であり、情報茧房を打破して舆情の原貌を還元し、未来の走向を予測し、決策を助けることができます。

自然言語処理大規模言語モデル
用途
舆情分析助手の問題を解決する
難易度
Easy
コスト
High
arxivPaper only2026-07-20

Calibrated Alzheimer's Conversion Risk in Mild Cognitive Impairment: Persistent Homology of Clinical Trajectories with Conformal Guarantees

この論文では、アルツハイマー病の予測を行うためにPersistent HomologyとConformal Guaranteeという手法を提案する。この手法は、アルツハイマー病の予測を行うために、時間的な軌道を分析するこ

説明可能自然言語処理RAG3D
用途
アルツハイマー病の予測を行う
難易度
Hard
コスト
High
arxivPaper only2026-07-20

O-VAD: Industrial Video Anomaly Detection through Object-Centric Tracking and Reasoning

工場の中の異常が検出されるように設計された機械学習モデルを提案しています。通常の方法では、モデルはビデオ内のすべての内容を考慮し、複雑な問題を解決することは困難です。提案されたモデルのアプローチは、オブジェクトを検出して

説明可能品質予測/異常検知自然言語処理ファインチューニング検出異常検知テキスト
用途
産業ビデオの異常発生検出
難易度
Hard
コスト
High
arxivPaper only2026-07-20

How Does Alignment Tuning Shape Representations of Sycophancy and Related Cue-Induced Biases in LLMs?

研究では、LLMの不正回答を起こす根本原因を探りました。モデルを5つの家族と7つのBCTバイアスのタイプで検討すると、モデル内の特定のパターンが見つかりました。このパターンが不正回答の根本原因となります。

少数データ向き自然言語処理大規模言語モデル
用途
LLMの不正回答の根本原因の特定
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Leveraging Two Robotic Arms for Tight Assembly Performance Gains

この研究では、2 つのロボット腕を同時に使用することで、緊張組立て操作のパフォーマンスを向上させる end-to-end フレームワークを提供します。ロボット腕は、 CAD モデルの数字、そして望ましい組み立て状態に置か

品質予測/異常検知自然言語処理RAG動画
用途
2本のロボットアームによる組み立て
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Lifelong Localization in Dynamic Indoor Environments Combining Odometry with Sparse Distance Sampling

自律ロボットの位置決めは、ロボットナビゲーションの主要なタスクです。ロボットが予測できない、非静的な障害物、またはロボットが未知の環境に入ることが多い。この研究では、ロボットのオドメトリと距離サンプリングを組み合わせて、

センサ/時系列自然言語処理RAG検出3D
用途
自律ロボットの位置推定
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Receiver-Centered Robot-to-Human Handover with Grasp-Aware Object Orientation

共役ロボットは、人間オペレータと同梱するワークスペースを共有し、機械手のハンドオーバーなどの安全性の高いマイクロイベント頻繁に発生します。但し、従来の静的なハンドオーバーは、非対称の産業工具を取り扱う際、不自然な抓を持つ

自然言語処理大規模言語モデル分類3D
用途
道具のハンドオーバー
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Reasoning as a Double-Edged Sword: Architecture and Cross-Stage Robustness in Vision-Language-Action Models

この研究では、混乱のないターゲットに可視化言語アクションモデルを適応させることを目的として、3つのモデルを使用して研究を行った。3つのモデルは、観察から直接行動へのマッピング、テキストチャインオブスロット、潜在的な反復ル

自然言語処理RAGテキストマルチモーダル
用途
可視化言語アクションモデルを混乱のないターゲットに適応させる
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning

複数タスク間の説明性を提供するための逆強化学習は、複数タスク間の説明性を提供することによって、複雑なタスクを解決することに関与していますが、この研究では、複数タスク間の説明性を提供するための逆強化学習の新たなアプローチを

少数データ向き自然言語処理RAG強化学習
用途
複数タスク間の説明性のための逆強化学習のための新たなアプローチ
難易度
Hard
コスト
Low
arxivPaper only2026-07-20

The Shared Discovery Paradox: How a One-Answer Rule Turns Better Information into Worse Search

組織の中で、情報は共有され、同僚がその情報に基づいて行動することが多い。研究者たちは、このような情報の共有によって、共有する前よりも探索の精度が向上することがあることに注目しました。しかし、このような共有によって、探索の

自然言語処理RAG
用途
探索問題
難易度
Hard
コスト
Low
githubGitHubあり2026-07-20

ludwig — Low-code framework for building custom LLMs, neural networks, and other AI models

Ludwigは、LLM (Large Language Model) のカスタム化と構築のための低コストフレームワークです。このフレームワークは、ユーザーがカスタム LLM を構築し、トレーニングするのを容易にします。

自然言語処理大規模言語モデル
用途
LLMのカスタム化と構築のための低コストフレームワーク
難易度
Easy
コスト
High
githubGitHubあり2026-07-20

compromise — modest natural-language processing

この研究では、自然言語処理の負担を減らすモジュラリティを目指しています。モジュラリティとは、システムを小さくて独立した部分に分割して、それぞれを簡素化することです。この研究では、文脈に応じてモジュラリティを変更できるメカ

自然言語処理分類音声
用途
自然言語処理の簡素化
難易度
Easy
コスト
Low
arxivPaper only2026-07-17

Cluster-Aware Matching via Laplacian Optimal Transport

この論文では、インフラリーダーの観点から安全交通のアセスメントを行うためのフレームワーク、PRISAを提案する。このフレームワークは、道路状況の観測と交通安全の評価を提供し、交通渋滞や事故を予測することで安全交通の実現を

説明可能品質予測/異常検知自然言語処理RAG3D
用途
交通渋滞や事故を予測するためのインフラリーダーによる監視技術の開発
難易度
Hard
コスト
High
arxivPaper only2026-07-17

Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps

この研究では、動的なシナリオを分析するために可視化した地図上にMotion Attributeを付与し、Language QueryによるMotion Attributeフィルタを使用して分析することができます。

自然言語処理大規模言語モデル3Dマルチモーダル
用途
可視化した地図上での動的なシナリオの分析
難易度
Hard
コスト
High
githubGitHubあり2026-07-17

clearml — ClearML - Auto-Magical CI/CD to streamline your AI workload. Experiment Management, Data Management, Pipeline, Orchestration, Scheduling & Serving in one MLOps/LLMOps solution

このリポジトリでは、高スループットと低メモリ消費のLLMインフェレンザエンジンであるVLLMを提供しています。

自然言語処理大規模言語モデル
用途
高スループットと低メモリ消費のLLMインフェレンザ
難易度
Easy
コスト
High
arxivPaper only2026-07-15

Price of Fairness in Bandits: A Tight Minimax Characterization

最小限マージン定理を仮想環境における公平性と利益のトレードオフの分析に導入します。この定理により、公平性と利益のトレードオフを最小限の公平性確保することで解決することができます。

自然言語処理ファインチューニングテキスト
用途
仮想環境における公平性と利益のトレードオフを分析するための最小限マージン定理の導入
難易度
Hard
コスト
Medium
githubGitHubあり2026-07-14

memvid — Memory layer for AI Agents. Replace complex RAG pipelines with a serverless, single-file memory layer. Give your agents instant retrieval and long-term memory.

MemVidは、サーバーレスで単一ファイルの記憶層を提案し、AIエージェントが即時検索と長期的な記憶を持つようにする記憶層です。

自然言語処理大規模言語モデル生成テキスト動画
用途
AIエージェントの記憶を管理する
難易度
Easy
コスト
High
arxivPaper only2026-07-13

Markov Chain Monte Carlo with Diffusion Paths

この研究では、マルコフ連鎖モンテカルロ法を改良し、多モーダル分布からサンプリングする能力を高めるための新しいアプローチを提案した。このアプローチでは、微分のノイズパスを使用することで、モデルの収束を高速化し、多モーダル分

自然言語処理ファインチューニングマルチモーダル
用途
マルコフ連鎖モンテカルロ
難易度
Hard
コスト
High
arxivPaper only2026-07-10

Evolutionary Intelligence for Scientific Discovery: From Evolutionary Computation to Cumulative Discovery Systems

人工知能は、タスク固有のワークフローから、人工知能を組成して、実験とヒューマンフィードバックを組み込み、無尽蔵な候補空間内で自動的に調査を行うようにした。進化的計算は、実験的および人間のフィードバックに基づいて探索を導き

自然言語処理ファインチューニング
用途
感覚的探索に基づく科学研究
難易度
Hard
コスト
Medium
githubGitHubあり2026-07-10

multimind-sdk — Your SDK solves all of this. One interface. Unified logic. Local + hosted models. Fine-tuning. Agent tools. Enterprise-ready. Hybrid RAG.Star 🌟 if you like it!

GUI操作自動化に伴う停止判定、復讐、再検索に関する問題を解決し、 GUI操作自動化を実現するためのフレームワークを開発します。

自然言語処理大規模言語モデルマルチモーダル
用途
GUI操作自動化ツール
難易度
Easy
コスト
High
githubGitHubあり2026-07-09

Awesome-Item-ID-Gen-RecSys — Updating curated list of research advancements on item identification and item tokenization in generative recommender systems. The survey is titled "A Survey of Item Identifiers in Generative Recommendation: Construction, Alignment, and Generation"

本研究では、生成推奨システムにおけるアイテムIDの構築、調整、生成の手法について、アイテムIDの構築方法を分析しています。

自然言語処理大規模言語モデル生成
用途
生成推奨システムのアイテムIDの問題解決
難易度
Easy
コスト
High
arxivPaper only2026-07-08

Intrinsic-Noise Consolidation: A Doob-Barrier-Conditioned Diffusion Turns Analog Device Noise into a Continual-Learning Resource

計算機による学習記憶を安定化させることができる、新しい方程式を開発した。新しい方程式により、計算機による学習記憶を正確にコンソリデーションさせることができる。

自然言語処理RAG生成
用途
計算機による学習記憶のコンソリデーション
難易度
Hard
コスト
High
arxivPaper only2026-07-07

Strategic Bargaining in Multi-Buyer Markets: Reinforcement Learning from Verifiable Rewards for LLM Negotiations

複数の買い手を持つ市場における交渉システムを構築します。マーケットの規模を知り切れていない場合、セラーの損失が生じます。セラーは市場の規模を測る必要がありますが、これは複数の買い手を持つ場合に困難です。

自然言語処理大規模言語モデルテキスト強化学習
用途
複数の買い手を持つ市場における交渉
難易度
Hard
コスト
High
githubGitHubあり2026-07-07

enchanted — Enchanted is iOS and macOS app for chatting with private self hosted language models such as Llama2, Mistral or Vicuna using Ollama.

iOS、macOS用のアプリ「Enchanted」は、個人でホストした言語モデル(LLama2、Mistral、Vicunaなど)とのチャットを可能にする。

自然言語処理大規模言語モデルテキスト
用途
私家版の言語モデルとチャットするためのiOS、マックアプリ
難易度
Easy
コスト
High
githubGitHubあり2026-07-07

Awesome-large-language-model-for-Prognostics-and-health-management — 用于预测性维护与健康管理的大型语言模型(故障诊断;寿命预测)

この論文では、予測性維护と健康管理のための大型言語モデルが使用されます。この modelは、故障診断や寿命予測などの問題を解決するように設計されています。

自然言語処理
用途
故障診断と寿命予測の問題を解決
難易度
Easy
コスト
Medium
githubGitHubあり2026-07-05

llm-app — Ready-to-run cloud templates for RAG, AI pipelines, and enterprise search with live data. 🐳Docker-friendly.⚡Always in sync with Sharepoint, Google Drive, S3, Kafka, PostgreSQL, real-time data APIs, and more.

この論文では、RAG、AIパイプライン、企業検索を含むクラウド テンプレートを提供するアプリケーション「llm-app」を紹介します。 llm-app は Docker で動作し、Sharepoint、Google Dr

自然言語処理大規模言語モデル生成
用途
AIパイプラインを構築する
難易度
Easy
コスト
High
arxivPaper only2026-07-02

Hybridizing a Grouping Metaheuristic with Reinforcement Learning for the One-Dimensional Bin Packing Problem

1D バイナリング パッキング問題(1D-BPP)とは、さまざまな用途に多く応用される、分配不可能なNP困難な組合せ最適化問題である。この研究では、Falkenauerのハイブリッドグループゲンエイリアスアリファメント(

表形式向き品質予測/異常検知自然言語処理RAG生成表形式強化学習
用途
1D バイナリング パッキング
難易度
Hard
コスト
Low
arxivPaper only2026-07-01

From Consistency to Collaborative Discovery: MFEA-CoD for Multitask Novelty Search

この研究では、多タスクの奇抜さを促進するために、エボリューション性の多タスク (EMT) を導入しました。EMT は、目標指向の最適化に焦点を当ててきましたが、共通性の構造を利用して、同時に複数の最適化問題を解決する能力

自然言語処理RAG生成
用途
多タスクの奇抜さ検索
難易度
Hard
コスト
Low
arxivPaper only2026-06-30

Distributed Hierarchical Temporal Memory with Shared Associative Memory for Cross-Entity Preemptive Warning

分散型時間関数記憶体を用いた異常検知システムを開発しました。このシステムは、関連のあるエンティティの予兆行動を共有メモリ空間に保存し、異常検知に役立ちます。このシステムは、異常検知に役立つ新しい方法を提供します。

センサ/時系列品質予測/異常検知自然言語処理RAG検出生成異常検知
用途
分散型時間関数記憶体を用いた異常検知
難易度
Hard
コスト
Low
arxivPaper only2026-06-30

Guesswork Under Linear Constraints: Exact Exponent for Coset Decoding

データ解析のアルゴリズムを確立するための数値論理の研究で、データのguesswork(乱数解析)における線形制約の下での指数関数の成長率を研究している。この研究は、データ解析のアルゴリズムを開発するための基礎を提供し、デ

自然言語処理RAG
用途
データ解析のアルゴリズムを確立するための数値論理の研究
難易度
Hard
コスト
Low
githubGitHubあり2026-06-30

mxcp — Model eXecution + Context Protocol: Enterprise-Grade Data-to-AI Infrastructure

データをAIに変換する基盤を構築することで、ビジネス上の問題を解決できます。この研究では、Model eXecution + Context ProtocolであるMXCPを提案し、データの変換を簡素化した上で、AIアプ

自然言語処理大規模言語モデルテキスト
用途
データをAIに変換する基盤を構築することによって、ビジネスを改善する
難易度
Easy
コスト
High
githubGitHubあり2026-06-30

CV — ✅(已完结)超级全面的 深度学习 笔记【土堆 Pytorch】【李沐 动手学深度学习】【吴恩达 深度学习】【大飞 大模型Agent】

深層学習のノート書。このノートには、土山さんのPytorchノート、おしうの「深層学習」を実践するノート、Wu's「深層学習」をテキスト化したノート、およびダフィンの「大モデルエージェント」のノートが含まれている。

自然言語処理大規模言語モデル
用途
深層学習ノート
難易度
Easy
コスト
High
arxivPaper only2026-06-23

Age of LLM: A Strategic 1v1 Benchmark for Reasoning, Diplomacy and Reliability of Large Language Models under Fog of War

大規模言語モデルの戦略1対1ベンチマークであるAge of LLMを紹介。マインスイーパーゲームを想定し、フォーゲットオブラーサー、マインスイーパー対戦、JSONスキーマへの従属性という三つのストレスアウトを設定。

自然言語処理大規模言語モデルテキスト
用途
マインスイーパーゲーム用ベンチマーク
難易度
Hard
コスト
High
arxivPaper only2026-06-13

Large Language Model-Driven Cooperative Operator Ensemble Evolution for Permutation Flow Shop Scheduling

この研究では、PFSPのIterated Greedy (IG) アルゴリズムのパフォーマンスを改善するために、Large Language Model-Driven Cooperative Operator Ensem

少数データ向きCPUで試しやすい品質予測/異常検知自然言語処理大規模言語モデルテキスト
用途
PFSPのIterated Greedy (IG) アルゴリズムのパフォーマンスを改善すること。
難易度
Hard
コスト
High
arxivPaper only2026-06-12

MeEvo: Metacognitive Evolution Combined with Natural Evolution for Automatic Heuristic Design

この研究では、自動補助関数設計(AHD)についての研究を行った。AHDは、マシン学習が可能になる以前から研究されていたトピックであり、マシン学習によって、AHDがさらに活用可能になった。この研究では、AHDにおけるメタ認

品質予測/異常検知自然言語処理大規模言語モデル生成テキスト
用途
自動補助関数設計
難易度
Hard
コスト
High