Fine-tuning」の検索結果

82
arxivPaper only2026-08-04

Omega-S: A Functional Resilience Index for LLM Fine-Tuning

LLMが外部アクションを取り続けている場合、エージェントのメモリーが古くなったり誤った情報を持ったりする可能性があります。この問題を解決するために、この研究ではSafeCommitという技術を提案しています。SafeCo

深層学習正規化・最適化手法テキスト
用途
LLMによるメモリー・グランド・エージェントの安全なアクション
難易度
Hard
コスト
High
arxivPaper only2026-08-03

Divisive Normalization Shapes Low-Rank Slow Manifolds for Continuous Working Memory

この研究では、記憶を維持し更新する能力を強化するため、繰り返し神経ネットワークを用いて記憶の特性を分析しました。記憶を維持するための神経計算の一種として、ダイショビュールノーマリゼーション(Divisive Normal

深層学習Transformer
用途
瞬時記憶の能力を強化する
難易度
Hard
コスト
High