CATEGORIES · 03 / 05

AI

モデル、プロンプト、alignment の周辺。数値と哲学の境界線で書く記事。(68 本)

ノルウェーの小学校 AI 原則禁止を運用者目線で読む — 「手順を飛ばさせない」設計
AI

ノルウェーの小学校 AI 原則禁止を運用者目線で読む — 「手順を飛ばさせない」設計

ノルウェーが 2026 年 8 月から小学校で生成 AI を原則禁止にしました。年齢で段階分けされた規制の中身を整理し、「子どもが学習の手順を飛ばす」という懸念を、AI プロダクトやプロンプトを作る側の設計要件として運用者目線で読み直します。

2026年6月20日 12:05
自分は LLM の重みの中にいるのか — 学習データ帰属を運用者目線で読む
AI

自分は LLM の重みの中にいるのか — 学習データ帰属を運用者目線で読む

intheweights.com が投げる『あなたは学習済みモデルの重みに含まれるか』という問い。memorization と membership inference の違い、なぜ『含まれる』の判定が難しいのか、そして fine-tune や RAG で自分が『他人を重みに入れる側』になったときの運用者の責任を整理します。

2026年6月19日 09:05
ローカルLLMが「使える」に変わった2026年 — 75% パリティを運用者目線で読む
AI

ローカルLLMが「使える」に変わった2026年 — 75% パリティを運用者目線で読む

M2 Mac (64GB) + LM Studio で Gemma 4 / Qwen 3 / GPT-OSS がフロンティアの約 75% に届いた、という HN 首位記事を運用者目線で読みます。75% の但し書き、どのタスクをローカルに寄せ、残り 25% をどこで払うか。コスト・プライバシー・精度の損益分岐を、自分が運用者になる覚悟込みで整理します。

2026年6月17日 12:06
日本語 RAG をローカル SLM に任せていいか — 4 モデル 15 問ベンチを運用者目線で読む
AI

日本語 RAG をローカル SLM に任せていいか — 4 モデル 15 問ベンチを運用者目線で読む

Gemini 2.5-flash と qwen 系のローカル SLM を同じ 15 問の日本語 RAG で比べた実測記事を起点に、品質・コスト・運用負荷の三軸でどこまでローカルに寄せられるかを運用者目線で整理します。サイズが大きいほど良いとは限らない、という結果の読み方も書きます。

2026年6月16日 12:06
「動いた」は安全の証明ではない — AI 生成コードを静的スキャンで検証する運用
AI

「動いた」は安全の証明ではない — AI 生成コードを静的スキャンで検証する運用

AI が書いたコードは「動いた」時点が一番危ない。鍵の直書きやコマンドインジェクションが、動くという事実に隠れるからです。自作スキャナの知見をきっかけに、AI 起稿コードを人間レビューと静的解析の二重ゲートに通す運用を、運用者目線でまとめます。

2026年6月15日 12:05
「独自開発」の LLM が実は merge だった — Rio のモデル出自を運用者目線で読む
AI

「独自開発」の LLM が実は merge だった — Rio のモデル出自を運用者目線で読む

自治体が独自開発を掲げた 397B のモデルが、実態は既存モデルの merge だと GitHub issue で指摘されました。モデルの出自・由来表示・第三者検証という、API とモデルを使う運用者が踏むべき確認の話としてまとめます。

2026年6月15日 09:35
モデルを消したのは出資元で競合だった — Anthropic 規制報道を運用者目線で読む
AI

モデルを消したのは出資元で競合だった — Anthropic 規制報道を運用者目線で読む

WSJ 報道で、Fable 5 / Mythos 5 停止の引き金が、出資元かつインフラ供給元かつ競合でもある Amazon の CEO の懸念表明だったと分かりました。可用性リスクの「統治層」を運用者目線で読みます。

2026年6月14日 12:06
Claude Fable 5 / Mythos 5 が突然止まった日 — 単一プロバイダ依存を運用者目線で点検する
AI

Claude Fable 5 / Mythos 5 が突然止まった日 — 単一プロバイダ依存を運用者目線で点検する

2026 年 6 月 12 日、米政府の輸出管理指令で Anthropic が Claude Fable 5 と Mythos 5 のアクセスを全顧客向けに突然停止しました。モデルは「落ちる」だけでなく「消える」前提で組むべきという視点から、フェイルオーバー・モデル抽象化・縮退運転の三つの守りを運用者目線で整理します。

2026年6月13日 12:06
コーディングエージェントに 18 万行書かせて見えた限界と運用の勘所
AI

コーディングエージェントに 18 万行書かせて見えた限界と運用の勘所

GitHub のコーディングエージェントに 1 週間で 18 万行を書かせた実践記録を起点に、量を出せても設計は出せないという破綻ポイントと、Issue を基点に規約を「スキル」として渡すレビュー・運用の勘所を、自前の自動投稿運用も交えて運用者目線で整理します。

2026年6月12日 12:05
VLM は方眼を数えられない — 編み図読み取りで古典 CV に切り替えた話を運用者目線で読む
AI

VLM は方眼を数えられない — 編み図読み取りで古典 CV に切り替えた話を運用者目線で読む

VLM が編み図の方眼マス目を正確に数えられず、20 列を 19 列と読み、実行ごとに結果が揺れた失敗事例。8 日かけて古典 CV(OpenCV の格子検出)に切り替えた実話を、AI に何を任せ何を任せないかという運用者の判断軸で読みます。

2026年6月12日 09:06