wandb — The AI developer platform. Use Weights & Biases to train and fine-tune models, and manage models from experimentation to production.
Weights & Biasesは、AI開発を支援するプラットフォームです。このプラットフォームは、モデル開発から生産準備までを支援し、コストをコントロールし、モデルとデータへのアクセスを管理します。
Topic
LoRA、RLHF、SFT、軽量ファインチューニングなど、LLMを用途に合わせる技術を扱います。
Weights & Biasesは、AI開発を支援するプラットフォームです。このプラットフォームは、モデル開発から生産準備までを支援し、コストをコントロールし、モデルとデータへのアクセスを管理します。
データの期待値を把握するためのフレームワークです。
パラメータ効率の向上のための最先端のフィネチュニングフレームワークです。
prompts.chatは、コミュニティが共有したChatGPT用のプロンプットを発見・収集できる場所で、無料でオープンソースで提供されている。
rayは、core分布ランタイムとAIライブラリで構成されたAI計算エンジンで、スケーラブルなAI計算をサポートする。
Rustを使ってモジュラーLLMアプリケーションを構築することができるライブラリです。
ユーザーの行動を認識し、オートエージェントを構築するためのツール。
Unsloth Studioは、オープンモデルのトレーニングと実行を支援するWebUIです。このライブラリは、Gemma4、Qwen3.5などのオープンモデルのテストとトレーニングを支援するために使われます。
LLMの推論 Transparency を高めるために、DiffusionGemmaの計算を分離しVariable Transparency とAlgorithmic Transparencyを評価します。
この論文では、現在のVision-Language-Benchmark(VLB)を超える、MLLMがアクティブな観察を実演できるようにするためのバenchmark、ActiveVisionを提案する。このActiveVi
このリポジトリでは、LLMベースのエージェントアプリケーションのための強化学習の橋渡しを提供しています。
ARTは、多段強化学習トレーナーです。このトレーナーは、GRPOを使用して、現実世界のタスクに対して、多段強化学習を行うことができます。