embedding」の検索結果

8
githubGitHubあり2026-07-27

qdrant — Qdrant - High-performance, massive-scale Vector Database and Vector Search Engine for the next generation of AI. Also available in the cloud https://cloud.qdrant.io/

このリポジトリでは、データとAIアルゴリズムを製品化するためのプラットフォームであるTaipyを提供しています。

自然言語処理埋め込み・検索生成画像
用途
AIアプリケーションを製品化するためのプラットフォーム
難易度
Easy
コスト
Low
githubGitHubあり2026-07-26

unstructured — Convert documents to structured data effortlessly. Unstructured is open-source ETL solution for transforming complex documents into clean, structured formats for language models. Visit our website to learn more about our enterprise grade Platform product for production grade workflows, partitioning, enrichments, chunking and embedding.

ドキュメントを構造化するために使えるオープンソースのETLソリューション。

表形式向き自然言語処理大規模言語モデル画像テキスト表形式
用途
ドキュメントの構造化
難易度
Easy
コスト
High
arxivGitHubあり2026-07-23

DINOde: Continuous Vision-Text Alignment for Open-Vocabulary Semantic Segmentation

オープン語彙セマンティックセグメンテーションは、前もって定義されたカテゴリ以外のオブジェクトを分類する手法の一種である。本研究では、大規모言語モデルでこの手法を実現するために、連続的な視覚テキストのアライメントを実現する

自然言語処理RAGセグメンテーション画像テキスト
用途
オープン語彙セマンティックセグメンテーションのための視覚テキストの連続的なアライメントを実現する。
難易度
Hard
コスト
High
arxivGitHubあり2026-07-22

LKValues: Aligning Large Language Models with Sri Lankan Societal Values

スリランカの文化的価値観が反映された言語モデルの開発により、同国で言語モデルを使用する際の精度を向上させることができると予想され、このような言語モデルを開発するためのリソースを提供します。

自然言語処理大規模言語モデルテキスト
用途
スリランカの文化的価値を対象とする言語モデルの精度向上
難易度
Hard
コスト
High
arxivGitHubあり2026-07-22

emb-diversity: A Tool for Embedding-Based Measurement of Data Diversity

データ多様性はフェアかつ頑健なNLPモデルを構築する上で重要な要素である。しかし、データ多様性を測定する現存のアプローチは不合理で一貫性が欠けている。そのため、エンドポイントベースの多様性測定ツールを提案した。

自然言語処理RAGテキスト
用途
データの多様性の測定
難易度
Easy
コスト
Low
arxivGitHubあり2026-07-22

Not All Patches are Equal: Sampling Matters for Visible-Infrared Pre-Training

可視光と非可視光のデータを連携するためのアプローチを提案し、可視光と非可視光のデータを連携するための精度と効率を向上させることを目指しています。

センサ/時系列深層学習軽量化・量子化検出セグメンテーション埋め込み
用途
可視光と非可視光のデータを連携するためのアプローチ
難易度
Hard
コスト
High