detection」の検索結果

172
githubGitHubあり2026-07-24

cvat — Computer Vision Annotation Tool (CVAT) is a leading platform for building high-quality visual datasets for vision AI. It offers open-source, cloud, and enterprise products, as well as labeling services, for image, video, and 3D annotation with AI-assisted labeling, quality assurance, team collaboration, analytics, and developer APIs.

CVATは、機械学習用の業界標準のデータエンジンです。さまざまなスケールのチームが使用し、さまざまなスケールのデータに対応しています。

品質予測/異常検知コンピュータビジョンセグメンテーション分類検出画像
用途
データのラベル付けと管理
難易度
Easy
コスト
High
githubGitHubあり2026-07-24

presidio — An open-source framework for detecting, redacting, masking, and anonymizing sensitive data (PII) across text, images, and structured data. Supports NLP, pattern matching, and customizable pipelines.

presidioは、テキスト、画像、構造化データを含む敏感データを検出、削除、マスク、アノニマイズするオープンソースフレームワークです。自然言語処理、パターンマッチング、カスタマイズ可能なパイプラインをサポートします。

表形式向き深層学習Transformer分類検出画像
用途
データのプライバシーを保護する
難易度
Easy
コスト
Low
arxivPaper only2026-07-23

Synthetic data generation framework for quality control automation in gravure printing

印刷品質管理技術のための新しいアプローチであるシンセティック データ生成フレームワークを提案しました。このフレームワークは、ロトグラビューグラビング技術における品質管理のためのシンセティック データを生成することで、印刷

品質予測/異常検知画像検査深層学習Transformer検出生成画像
用途
印刷品質管理技術の開発
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Token Budget Saturation and Mechanistic Early Detection of Reasoning Non-Convergence in Chain-of-Thought Models

チェーン・オブ・サウト reasoning モデルの収束不明確さを解決する研究。このモデルの不完全収束は、生成するトークンの数に依存し、モデルには収束しない限り問題を解決する能力がない。これを解決するための予測を終了する

自然言語処理プロンプトエンジニアリング検出生成
用途
チェーン・オブ・サウト reasoning モデルに適切に予測を終了する方法を検討する
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Position Bias is Hidden Behind Ceiling Effects: A Permutation Diagnostic for LLM Benchmarks

LLM(言語モデル)の評価における位置バイアスを分析するための方法を提案した研究で、この方法により、位置バイアスが評価結果にどのような影響を与えるかが明らかにできる。

自然言語処理大規模言語モデル検出生成
用途
LLMの評価における位置バイアスを分析する
難易度
Hard
コスト
High
arxivPaper only2026-07-23

HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

大規模言語モデルはさまざまな画像をテキストに変換する上で優れた性能を示しているが、発生するホログラフィックな診断にはまだ解決策が必要です。この研究では、主流の粗い検出方法の欠点を補うため、細部の診断方法を提案しています。

説明可能自然言語処理大規模言語モデル分類検出生成
用途
ホログラフィックハロウィーンの診断
難易度
Hard
コスト
High
arxivPaper only2026-07-23

Human-Inspired Framework for Robotic Craniotomy: Integrating Multimodal Fusion and Adaptive Trajectory Adjustment

人間の知能を模倣するクロアニオトミー手術のフレームワークを提案します。このフレームワークは、前方計画と後方実行を組み合わせて、手術中に手術台の位置を自動的に調整することで、人間と同様の安全で効率的な手順を実現します。

センサ/時系列深層学習Transformer検出画像音声
用途
クロアニオトミー手術の自動化
難易度
Hard
コスト
High
arxivPaper only2026-07-23

GuidedAttention: Interpretable and Correctable Visual Attention for OOD-Robust Robot Manipulation via Imitation Learning

視覚モータリティポリシーを学習する際、人間が視覚アタッチメントを理解し、修正できるようにするため、視覚アタッチメントを明示的にしたフレームワークを提案します。

説明可能生成AI拡散モデル異常検知画像
用途
ロボットマニュピュレーションの視覺アタッチメント
難易度
Hard
コスト
High
githubGitHubあり2026-07-23

pycaret — Open-source, low-code AutoML platform for Python. PyCaret 4.0: sklearn-native engine + React control plane.

pycaretは、Pythonによるオープンソースの低コストオートMLプラットフォームで、Reactコントロールプレーンを備えたsklearnネイティブエンジンを搭載しています。

CPUで試しやすい機械学習教師あり学習分類検出回帰
用途
オートMLプラットフォーム
難易度
Easy
コスト
Low
arxivPaper only2026-07-22

TriAgent: Divergence-Aware Multi-Agent Committees for Cost-Efficient Financial Sentiment Analysis

生産的言語モデルの利用による金銭的感情分析に対処するための方法を提案している。複数のエージェントを活用したコミティー方式を使用し、さまざまな粒度のテキストデータに対応できるように、単語レベルのルールベースアプローチ、句節

深層学習Transformer検出テキスト
用途
金融分野の感情分析
難易度
Hard
コスト
High
arxivPaper only2026-07-22

HalluTruthQA: A Fine-Grained Benchmark for Hallucination Detection, Localization, and Explanation in Arabic Question Answering

大きな言語モデルは真実の情報を提供できるように見えますが、実際は虚偽情報を提供することが多く、これを検知、検出、および検証するための基準を作成するため、HalluTruthQAが開発されました。

自然言語処理大規模言語モデル検出QAテキスト
用途
仮想の答えを検知、検出、および検証するための基準を作成する
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Toward Seasonal Guidelines for Robust Deep-Learning Sentinel-2 Building Detection in Different Area Types

OffNadirLocは地学化におけるオフナジアムの視点を考慮するための基準セットを提案します。これにより、ドローンと衛星画像の交差視点地学化プロセスでは重要な構造的シーン理解と内部ドメイン間の関係的制約に重点を置くこと

深層学習CNN分類検出セグメンテーション
用途
ドローンから衛星画像への地学化の改善
難易度
Hard
コスト
High
arxivPaper only2026-07-22

OffNadirLoc: Benchmark and Framework for Challenging UAV-to-Satellite Geo-Localization under Large Off-Nadir Views

OffNadirLocは交差視点地理位置を推定するための基準セットを提案します。これにより、ドローンと衛星画像の交差視点地理位置推定プロセスでは重要な構造的シーン理解と内部ドメイン間の関係制約に焦点を当てることができます

自然言語処理プロンプトエンジニアリング検出画像テキスト
用途
ユーザー間の地理的位置の推定改善
難易度
Hard
コスト
High
arxivPaper only2026-07-22

PRISM-DR: Per-lesion Retinal Inference with Specialist Models for Diabetic Retinopathy

この研究では、糖尿病性黄斑病変の検出を目的としたPRISM-DRシステムを開発しました。このシステムは、医師が見逃す可能性がある小さな低コントラストな病変を見つけるのに役立ちます。

少数データ向きCPUで試しやすい条件最適化自然言語処理ファインチューニング検出生成画像
用途
糖尿病性黄斑病変を検出する
難易度
Hard
コスト
High
arxivPaper only2026-07-22

WASABI: Whole-graph Assignment-based Stabilizer for lAne topology By Inter-frame tracking

マグネティック リゾナンス イメージング (MRI) のデータ収集には、多くのエネルギーと時間が必要です。アクティブ サンプリングは MRI の速度を増加させる技術ですが、現在のアプローチでは、低周波数部分(解像度)と高

深層学習Transformer検出
用途
MRIデータを効率よく収集する
難易度
Hard
コスト
Medium
arxivPaper only2026-07-22

DRGBT-1K: A Large-scale High-quality Benchmark for Dynamic RGBT Tracking

地上を表す重力式マップの高解像度版が、多くの用途で役立ちます。たとえば、市区町村の変化を監視したり、エネルギー対策を向上させたり、温室効果ガスの排出量を追跡したりすることができます。4つの主要な全世界建物Rasterデー

センサ/時系列品質予測/異常検知コンピュータビジョン物体検出検出マルチモーダル
用途
宇宙に分布する建物の面積を正確に推定する
難易度
Hard
コスト
High
arxivGitHubあり2026-07-22

ReferTrack: Referring Then Tracking for Embodied Visual Tracking

ReferTrack は、自然言語で対象の車両に付近する自動車を追従させるシステムである。このシステムでは、対象の車両に付近する自動車を認識する後、自動車の動きを予測する。

自然言語処理プロンプトエンジニアリング検出画像テキスト
用途
自動車が対象の車両に付きそわせるシステム
難易度
Hard
コスト
High
arxivPaper only2026-07-22

Clinical Pathways as Safety Specifications for Physical AI in Hospital Wards

Clinical Pathways は、ロボットが実際の環境で安全に動作するためのシステムである。これは、ロボットが病室で安全に作業し、医療スタッフや患者を守る。

品質予測/異常検知コンピュータビジョン動画認識検出異常検知マルチモーダル
用途
医療機関で使うロボットの安全性を確保するためのシステム
難易度
Hard
コスト
High
arxivPaper only2026-07-21

Transcription Policy as a Latent Variable: Activating Controllable Verbatim ASR with Word-Level Timing

記号化の種類 (verbatim vs. intended) は、現在の音声認識モデルの評価に影響を与えるが、このような制約はモデルのトレーニングに影響しないことが多い。しかし、ここでは、制約はモデルのトレーニングに影響

品質予測/異常検知深層学習Attention機構検出音声
用途
記号化の制約付き復元
難易度
Hard
コスト
High
arxivPaper only2026-07-21

From Distances to Trajectories: Real-Time Signed Distance Function Mapping and Distance-Accelerated Motion Planning for UAVs

難しい環境で運用するためには、自動空飛ブイロード(UAV)が実際に障害物に存在する距離を判断し、安全な軌跡を計画することが求められる。 これを行うために、複数のステージ(マッピングと計画)を連続化した、サイン・ディスタン

コンピュータビジョンセグメンテーション検出3D
用途
UAVの安全な運用
難易度
Hard
コスト
High
arxivGitHubあり2026-07-21

NGPS: GPS-Denied Aerial Geo-Localization and 2.5D Reconstruction via Deep Satellite Image Matching and Multi-Rate Sensor Fusion

この研究では、高空飛行の無信号位置指示のNGPS (Next-Generation Positioning System)というフレームワークを提案しました。NGPSは、GPSの信号を利用せずに位置推定を可能にします。N

センサ/時系列コンピュータビジョン動画認識検出生成画像
用途
高空飛行の無信号位置指示
難易度
Hard
コスト
High
arxivPaper only2026-07-21

LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior

LLMが広く使用されるようになり、LLMを識別するツールが開発されている。 しかし、識別システムは、使用者の行動に影響を与えている。つまり、識別システムが機能しないと、ユーザが別のシステムを使用することに関連し、最終的な

品質予測/異常検知自然言語処理大規模言語モデル検出
用途
LLMを識別
難易度
Hard
コスト
High
arxivPaper only2026-07-20

O-VAD: Industrial Video Anomaly Detection through Object-Centric Tracking and Reasoning

工場の中の異常が検出されるように設計された機械学習モデルを提案しています。通常の方法では、モデルはビデオ内のすべての内容を考慮し、複雑な問題を解決することは困難です。提案されたモデルのアプローチは、オブジェクトを検出して

説明可能品質予測/異常検知自然言語処理ファインチューニング検出異常検知テキスト
用途
産業ビデオの異常発生検出
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Recti-Q: Feature-Space Rectification for Out-of-Distribution-Robust Quantized Perception in Edge Robotics

エッジロボチクスでの画像認識精度を安定させ、その安定性を確保するために、量化後のパフォーマンスを向上させ、分散型データ量化を実現し、分布シフトの影響を緩和する、新しい機械学習アプローチを提案します。

センサ/時系列深層学習Transformer分類異常検知画像
用途
エッジロボチクスでの画像認識の安定性
難易度
Hard
コスト
High
arxivPaper only2026-07-20

UMCP: A Unified Multi-Task Collaborative Perception Network for Luggage Trolley Pose Estimation

ロボット車の視覚システムは、高精度でリアルタイム性能を持つロジスティクス車両の位置検出を実現する必要があります。従来の手法では、複数のモデルが連続してインフェレンズされ、インフェレンスラティシーが増加し、高規模デプロイメ

コンピュータビジョン物体検出検出画像
用途
luggage trolleyの位置推定
難易度
Hard
コスト
Medium
arxivPaper only2026-07-20

Lifelong Localization in Dynamic Indoor Environments Combining Odometry with Sparse Distance Sampling

自律ロボットの位置決めは、ロボットナビゲーションの主要なタスクです。ロボットが予測できない、非静的な障害物、またはロボットが未知の環境に入ることが多い。この研究では、ロボットのオドメトリと距離サンプリングを組み合わせて、

センサ/時系列自然言語処理RAG検出3D
用途
自律ロボットの位置推定
難易度
Hard
コスト
High
arxivPaper only2026-07-20

Seg2Grasp: A Robust Modular Suction Grasping in Bin Picking

採掘ロボットの性能向上を目指したSeg2Graspを構築し、セグメンテーション、グレイシング、クラスフィルタリングの3つのモジュールで構成されます。セグメンテーションモジュールではTransformerを利用したオブジェ

深層学習Transformer分類検出セグメンテーション
用途
採掘ロボットがオブジェクトを取り上げる能力の向上
難易度
Hard
コスト
Low
arxivPaper only2026-07-17

An Efficient Likelihood Ratio Test for Online Changepoint Detection in the Presence of Autocorrelation

オフラインのデータ流れの中で、時間序列のデータに基づいてデータ変化を検知することができる方法が必要。この問題を解決するために、オンラインのデータ流れで検知した変更点をオフラインのデータ流れに適用する方法を提案。

深層学習軽量化・量子化検出
用途
オフラインの変更点検知
難易度
Hard
コスト
Low
arxivPaper only2026-07-16

Delocalization of bias in unadjusted Hamiltonian Monte Carlo and underdamped Langevin

この研究では、調整されていない HMC と Langevin Sampler の偏りの解消について議論しました。調整されていないサンプラーは、通常、偏りのあるものであることが知られています。この研究

コンピュータビジョンセグメンテーション検出
用途
HMC と Langevin Sampler の偏りの解消
難易度
Hard
コスト
Medium
arxivPaper only2026-07-16

Post Hoc Inference for Component Attribution in Multivariate Change-Point Detection

時系列データを観察し、その中に分割が起こっているかどうかを検知する方法はある。時間系列変化点を検知することができ、変化点の位置がどこにあるかを推定することができる。

センサ/時系列コンピュータビジョンセグメンテーション検出時系列
用途
時系列データの分割探知
難易度
Hard
コスト
Low
arxivPaper only2026-07-16

Toward Energy-Efficient and Low-Power Arrhythmia Detection for Wearable Devices

この研究では、ウェアラブルデバイスで電気生理学記録(ECG)を分析するために使用される深層学習アルゴリズムを開発することを目的としています。このアルゴリズムは、エネルギー効率が高く、小型化が可能であるため、心臓の病気の検

MI向き品質予測/異常検知深層学習Transformer分類検出
用途
心臓の病気の検出
難易度
Hard
コスト
Low
arxivPaper only2026-07-14

MixCIT: A Kernel Based Local-Polynomial Debiased Test for Conditional Independence on Mixed-Type Data

多種多様なデータに対して条件的独立性の検定を行う方法です。混合タイプデータに対して統一的な、効率的な、あるいは統計的に有効な解決策は存在しませんでしたが、グラフ上のノード間の距離を比较する方法を提案しています。

深層学習軽量化・量子化検出
用途
複合データの条件的独立性検定
難易度
Hard
コスト
Medium
arxivPaper only2026-07-14

Stability Buys Time: A Re-Keying Game for Encrypted Multi-Agent Control

暗号化された制御システムでは、クラウドがホモモルフィック暗号化された状態を操作し、動物達の動作をプライバシーで管理することができる。安全を確保するために、サイドチャネル攻撃のリスクを考慮しながら、制御機器が信頼できると仮

深層学習軽量化・量子化検出
用途
暗号化された制御
難易度
Hard
コスト
Low
githubGitHubあり2026-07-10

pytorch-grad-cam — Advanced AI Explainability for computer vision. Support for CNNs, Vision Transformers, Classification, Object detection, Segmentation, Image similarity and more.

このライブラリは、コンピューター ビジョンのための高度なAI解釈と可視化ソリューションです。このライブラリは、CNN、ビジョン トランスフォーム、分類、物体検出、分割、画像類似度など、さまざまなコンピューター ビジョンの

深層学習Transformer分類検出セグメンテーション
用途
AIの解釈と可視化ソリューション
難易度
Easy
コスト
Low
arxivPaper only2026-07-07

6G Sensing Security: Distributed Game-Theoretic RL for Urban Beamforming and Attacker Detection

Next-generation wireless networksにおける分散型ゲーム理論を用いた6Gのセキュリティを研究します。分散型ゲーム理論は、6Gの通信システムが環境の認識とデータの伝送両方を実現するために必要な

センサ/時系列深層学習軽量化・量子化検出生成強化学習
用途
6Gにおける分散型ゲーム理論
難易度
Hard
コスト
Medium
arxivPaper only2026-07-06

An event-driven framework for fly-inspired visual motion detection

イベントベースセンシングの活用と生物学的インスピレーションを利用した障害物検出を実現するために、飛行経路を用いた新しいアプローチが提案される。このアプローチは、イベントベースセンシングの活用と生物学的インスピレーションを

説明可能センサ/時系列深層学習Transformer検出画像
用途
イベントベースセンシングと飛行経路を用いた動的環境での障害物検出
難易度
Hard
コスト
High
arxivPaper only2026-07-02

Predicting Early Stages Of Alzheimer's Disease And Identifying Key Biomarkers Using Deep Artificial Neural Network And Ensemble Of Machine Learning Methodologies

この研究では、アルツハイマー病の前期診断と生物学的マーカーの検出にAI技術を適用します。AIモデルをトレーニングするために、電気エイセフィログラム(EEG)データを使用し、精度を高めます。また、AIモデルが得た情報を分析

表形式向きCPUで試しやすい深層学習Transformer分類検出回帰
用途
アルツハイマー病の前期診断と生物学的マーカーの検出
難易度
Hard
コスト
High
arxivPaper only2026-06-30

Distributed Hierarchical Temporal Memory with Shared Associative Memory for Cross-Entity Preemptive Warning

分散型時間関数記憶体を用いた異常検知システムを開発しました。このシステムは、関連のあるエンティティの予兆行動を共有メモリ空間に保存し、異常検知に役立ちます。このシステムは、異常検知に役立つ新しい方法を提供します。

センサ/時系列品質予測/異常検知自然言語処理RAG検出生成異常検知
用途
分散型時間関数記憶体を用いた異常検知
難易度
Hard
コスト
Low