POSTS
記事一覧
技術、設計、AI、過程、随筆。書き散らしたものをゆっくり並べ直しています。211 本。

ローカルLLMが「使える」に変わった2026年 — 75% パリティを運用者目線で読む
M2 Mac (64GB) + LM Studio で Gemma 4 / Qwen 3 / GPT-OSS がフロンティアの約 75% に届いた、という HN 首位記事を運用者目線で読みます。75% の但し書き、どのタスクをローカルに寄せ、残り 25% をどこで払うか。コスト・プライバシー・精度の損益分岐を、自分が運用者になる覚悟込みで整理します。

launchd で自動化を 24/7 回すと踏む罠 — 個人運用の再点検
macOS の launchd で記事・動画の自動投稿を半年回してきた実体験から、cron が動かない / PATH と timeout で転ぶ / 依存サービスの起動順 / stuck プロセスの累積 という運用上の罠と対処を、個人運用 (solo-dev) の視点で再点検します。監視をどこまでやらないかの線引きも書きます。

日本語 RAG をローカル SLM に任せていいか — 4 モデル 15 問ベンチを運用者目線で読む
Gemini 2.5-flash と qwen 系のローカル SLM を同じ 15 問の日本語 RAG で比べた実測記事を起点に、品質・コスト・運用負荷の三軸でどこまでローカルに寄せられるかを運用者目線で整理します。サイズが大きいほど良いとは限らない、という結果の読み方も書きます。

AI の UI を「それっぽい」で止めない — DESIGN.md に値ではなく役割を書く
AI コーディングエージェントが吐く UI が「いかにも生成」に見えるのは、色や余白の値だけを渡して役割と理由を渡していないからです。DESIGN.md に値・役割・避けるべきパターンを先に固定してエージェントに参照させ、設計の一貫性を保つ運用を、AetherEchoes のトークン実例とともにまとめます。

「動いた」は安全の証明ではない — AI 生成コードを静的スキャンで検証する運用
AI が書いたコードは「動いた」時点が一番危ない。鍵の直書きやコマンドインジェクションが、動くという事実に隠れるからです。自作スキャナの知見をきっかけに、AI 起稿コードを人間レビューと静的解析の二重ゲートに通す運用を、運用者目線でまとめます。

「独自開発」の LLM が実は merge だった — Rio のモデル出自を運用者目線で読む
自治体が独自開発を掲げた 397B のモデルが、実態は既存モデルの merge だと GitHub issue で指摘されました。モデルの出自・由来表示・第三者検証という、API とモデルを使う運用者が踏むべき確認の話としてまとめます。

Postgres の大量 DELETE は「作業の先送り」だった — DROP TABLE 運用に切り替えた話
数千万行の DELETE は消す作業ではなく、vacuum と bloat という後始末を増やす行為でした。日付パーティションと DROP TABLE で「削除をメタ操作に変える」運用に切り替えた経緯を、運用者目線でまとめます。

モデルを消したのは出資元で競合だった — Anthropic 規制報道を運用者目線で読む
WSJ 報道で、Fable 5 / Mythos 5 停止の引き金が、出資元かつインフラ供給元かつ競合でもある Amazon の CEO の懸念表明だったと分かりました。可用性リスクの「統治層」を運用者目線で読みます。

日が暮れない — 夏至前の、一番長い夕方
夏至が近づく六月のいま、夕方がいつまでも明るい。けれど昼が一番長い夏至と、日の入りが一番遅い日は数日ずれている。一年で一番長い夕方の、引き伸ばされた時間の感触を、ベランダの椅子から書いた随筆。

Claude Fable 5 / Mythos 5 が突然止まった日 — 単一プロバイダ依存を運用者目線で点検する
2026 年 6 月 12 日、米政府の輸出管理指令で Anthropic が Claude Fable 5 と Mythos 5 のアクセスを全顧客向けに突然停止しました。モデルは「落ちる」だけでなく「消える」前提で組むべきという視点から、フェイルオーバー・モデル抽象化・縮退運転の三つの守りを運用者目線で整理します。