今週のAIまとめ 8/24〜8/30:上限延長と実質17%減
8月24日〜30日の生成AIの動き。Claude Code の週次上限50%増が9月14日まで延びて、その後は実質17%減になる件、OpenAI が Cursor を切った件、オープンウェイト3本まで出典つきでまとめます。
AI8月24日〜30日の生成AIの動き。Claude Code の週次上限50%増が9月14日まで延びて、その後は実質17%減になる件、OpenAI が Cursor を切った件、オープンウェイト3本まで出典つきでまとめます。
AIRAGの答えがずれる原因は、モデルより先に「文書の切り方」にあります。チャンクの大きさが検索の解像度を決める理由、オーバーラップが効く場面、固定長・区切り文字・構造という3つの分け方の違いを整理しました。
AI8月17日〜23日の生成AIの動き。GPT-5.6 Sol の API 値下げ、Claude Code の週次上限50%増が8月31日まで延長された件、Bedrock で請求が黙って2倍になっていたバグまで出典つきでまとめます。
AIAIが最近の出来事を知らない理由、知識カットオフを整理しました。公式ドキュメントが併記する「信頼できるカットオフ」と「学習データのカットオフ」の違いから、足りない知識を外から渡す考え方まで。
AIゼロショット・ワンショット・フューショットの違いを、同じ分類タスクの指示文で並べて整理しました。言葉の出どころであるGPT-3の論文と、例を足しても効かない場面までまとめています。
AILoRAは事前学習済みの重みを凍結したまま、小さな行列のペアだけを学習する手法です。学習パラメータを1万分の1に減らしても精度が保てる理由と、実際に触る設定を整理しました。
AIMoE(Mixture of Experts)が何を節約しているのかを、Mixtral 8x7Bの総47B・活性13Bという数字を手がかりに整理しました。速くなるのは計算で、メモリは減りません。
AIRLHFは人間の評価を報酬に変えてAIの答え方を寄せる学習方法です。3段階の流れ、なぜ模範解答ではなく順位を集めるのか、DPOのような後継手法までを一次論文つきで整理しました。
AI会話が長くなるとAIの応答が重くなるのはなぜか。KVキャッシュが何を保存しているのか、文脈が伸びるとメモリがどれだけ増えるのか、削るための3つの方向までを順番に整理します。
AI8月10日〜16日の生成AIの動き。Sonnet 5 の9月値上げ撤回、auto mode の既定化発効、Z.ai が GLM-5.3 の重み公開を先送りした件、国内のフルAI映像CMまでを出典つきでまとめます。