CATEGORIES · 03 / 05

AI

モデル、プロンプト、alignment の周辺。数値と哲学の境界線で書く記事。(68 本)

embedding コストを 1/10 にする工夫
AI

embedding コストを 1/10 にする工夫

OpenAI embedding を毎回叩いていては破産する。再計算スキップ・dim 圧縮・バッチング、3 つの基本だけで激減する。

2025年9月17日 13:30
プロンプトとログをまとめて版管理する
AI

プロンプトとログをまとめて版管理する

プロンプトだけ git で管理しても、変更後の挙動を追えない。input / output / プロンプトを 1 つのコミットに含める運用。

2025年8月27日 22:00
ハルシネーション対策としての出典強制
AI

ハルシネーション対策としての出典強制

「正確に書いて」よりも「出典の URL がない情報は書くな」の方が効く。プロンプト 1 行で 80% の幻覚は消える。

2025年8月6日 14:00
Claude のツール使用パターン 4 種
AI

Claude のツール使用パターン 4 種

tool_use を「LLM がツールを呼ぶ」と素朴に考えると、4 つの設計パターンが見えてくる。委譲・ループ・並列・批評。

2025年7月23日 19:30
RAG の chunk size を 256 に固定する理由
AI

RAG の chunk size を 256 に固定する理由

512 や 1024 でも動く。でも 256 が多くのケースで「ちょうどいい」のはなぜか。検索精度と再構成可能性のバランスから。

2025年7月9日 11:00
評価 (evaluation) を test として書く
AI

評価 (evaluation) を test として書く

プロンプトを改善する作業を「気分」で続けると 1 週間で迷う。RSpec のように、判定可能な eval suite を最初に書く。

2025年6月25日 21:00
context window 1M を扱う前提のメモ術
AI

context window 1M を扱う前提のメモ術

コンテキストが 1M トークンあると、メモの取り方が変わる。「全部入れる」ではなく「正しく入れる」ための分類。

2025年6月11日 18:00
プロンプトの「役」を分けて指示する
AI

プロンプトの「役」を分けて指示する

「お前は熟練の◯◯だ」より、「タスクの分解者」「実行者」「批評者」を分けて配役するほうが、出力の質が安定する。

2025年5月28日 20:30