AIエージェントのメモリとは?短期記憶と長期記憶の違い
AIエージェントの「メモリ」とは何か。コンテキストウィンドウとの違い、スレッド内で完結する短期記憶とスレッドをまたぐ長期記憶の線引き、意味記憶・エピソード記憶・手続き記憶の使い分けを整理しました。
AIAIエージェントの「メモリ」とは何か。コンテキストウィンドウとの違い、スレッド内で完結する短期記憶とスレッドをまたぐ長期記憶の線引き、意味記憶・エピソード記憶・手続き記憶の使い分けを整理しました。
AIシステムプロンプトは、毎回の質問より先に効く「変わらない前提」を置く枠です。userメッセージとの優先順位の違い、書くべき内容、キャッシュや漏えいの落とし穴まで整理しました。
AIAIエージェントが外部ツールを使う土台となるファンクションコーリングを整理しました。モデルが返すのは実行結果ではなく呼び出しの申告であり、実際に動かすのは自分のコードだという分担を、一次情報をもとに解説します。
AIハイブリッド検索は、キーワード検索とベクトル検索を並列に走らせて結果を統合する手法です。定番の統合手法RRFがスコアではなく順位を足す理由と、効く場面・効かない場面を整理しました。
AIベクトル検索で拾った候補をクロスエンコーダで採点し直すリランキングの仕組みを、一次検索との役割分担・100件だけ並べ替える理由・Cohere Rerankの使い方から整理しました。
AIRAGの説明に必ず出てくるベクトルデータベースを、pgvectorの実例で整理しました。厳密検索と近似索引の違い、専用サービスとPostgreSQL拡張の使い分け、入れる前に決まる落とし穴まで。
AIプロンプトキャッシュの仕組みと料金の考え方を整理しました。先頭一致で効く性質、読み出し0.1倍と書き込み割増の損益分岐、最低トークン数の落とし穴までまとめています。
AIRAGの答えがずれる原因は、モデルより先に「文書の切り方」にあります。チャンクの大きさが検索の解像度を決める理由、オーバーラップが効く場面、固定長・区切り文字・構造という3つの分け方の違いを整理しました。
AIAIが最近の出来事を知らない理由、知識カットオフを整理しました。公式ドキュメントが併記する「信頼できるカットオフ」と「学習データのカットオフ」の違いから、足りない知識を外から渡す考え方まで。
AIゼロショット・ワンショット・フューショットの違いを、同じ分類タスクの指示文で並べて整理しました。言葉の出どころであるGPT-3の論文と、例を足しても効かない場面までまとめています。