CATEGORIES · 03 / 05

AI

モデル、プロンプト、alignment の周辺。数値と哲学の境界線で書く記事。(68 本)

1-bit 量子化の Bonsai Image 4B をローカルで動かす — 運用者目線で読む
AI

1-bit 量子化の Bonsai Image 4B をローカルで動かす — 運用者目線で読む

PrismML が公開した Bonsai Image 4B は、FLUX.2 Klein 4B を 1-bit / ternary に量子化し、iPhone でも 512×512 を 9.4 秒で生成します。メモリ・速度・品質のトレードオフを、API 推論を回す運用者目線で数字から読みます。

2026年6月1日 12:06
モデルの個性は post-training で決まる — API 運用者目線で読む
AI

モデルの個性は post-training で決まる — API 運用者目線で読む

モデルの口調や癖は、学習データの量よりも post-training(RLHF / RLVR)で大きく決まります。Cybernetic Forests の記事を起点に、版が変わると個性が変わる理由と、API を本番で回す運用者として何に備えるかを整理します。

2026年6月1日 09:34
OpenRouter が $113M 調達・評価額 約 $1.3B — 「ルーティング層」の値段を運用者目線で読む
AI

OpenRouter が $113M 調達・評価額 約 $1.3B — 「ルーティング層」の値段を運用者目線で読む

LLM ルーティング基盤の OpenRouter が CapitalG 主導で $113M のシリーズBを調達し、報道では評価額が約 $1.3B と 1 年で倍増しました。モデルそのものではなく「束ねる層」になぜ値段がつくのか、複数モデルを自前で叩く運用者として gateway を外部に置く損得を翻訳して読みます。

2026年5月31日 12:16
Liquid AI の LFM2.5 8B-A1B を運用視点で読む — 「総8B・アクティブ1B」の意味
AI

Liquid AI の LFM2.5 8B-A1B を運用視点で読む — 「総8B・アクティブ1B」の意味

Liquid AI が 2026 年 5 月 28 日に公開した LFM2.5 8B-A1B は、総 8B・アクティブ 1B の MoE 構成です。メモリは 8B 級・1 回の推論で動くのは 1B という設計が、自前で LLM を回す運用にどう効くのか。公称スループットとメモリ 6GB の数字を物差しに、品質とのトレードオフまで読み解きます。

2026年5月31日 00:05
標準 GPU で LLM 推論 3000 tokens/s/req — 数字の前提を運用者目線で読む
AI

標準 GPU で LLM 推論 3000 tokens/s/req — 数字の前提を運用者目線で読む

Kog AI が 8 枚の標準 GPU で「1 リクエストあたり毎秒 3000 トークン」を出したと発表しました。確かに速いのですが、これは batch size 1 の単一リクエスト速度で、モデルは 2B。自前推論のコストとレイテンシを気にする運用者として、数字の前提と再現性を読みます。

2026年5月30日 06:06
謎の LLM「Hy3」が OpenRouter 利用ランキングで Claude を 50% 超で抜いた — 運用者はランキングをどう読むか
AI

謎の LLM「Hy3」が OpenRouter 利用ランキングで Claude を 50% 超で抜いた — 運用者はランキングをどう読むか

出自のはっきりしない Tencent 製モデル Hy3 が、OpenRouter の利用ランキングで Claude をトークン量で 50% 超上回り首位に立った。だが input 98%・上位 5 app が 1% 未満という内訳を見ると、これは品質 No.1 ではなくトークン消費量の話だ。API 運用者として、ランキングの読み方・実効単価・ロックインの 3 点に翻訳して読みます。

2026年5月29日 18:05
Anthropic が $65B 調達・評価額 $965B — API 運用者として価格とロックインで読む
AI

Anthropic が $65B 調達・評価額 $965B — API 運用者として価格とロックインで読む

Anthropic が Series H で $65B を調達し、post-money 評価額が $965B に到達。run-rate は $47B を超えた。巨額の数字そのものより、フロンティアモデルを API として運用に組み込んでいる側が気にすべき「モデル更新ケイデンス・価格・ロックイン」の 3 点に翻訳して読みます。

2026年5月29日 12:06
Claude Opus 4.8 を初日に触る — effort control と Dynamic Workflows を運用者の実務で読む
AI

Claude Opus 4.8 を初日に触る — effort control と Dynamic Workflows を運用者の実務で読む

Anthropic が Claude Opus 4.8 (model ID claude-opus-4-8) を公開。料金は Opus 4.7 から据え置きで、自分が書いたコードの欠陥を約 4 倍見逃しにくくなった。effort control・fast mode 値下げ・Dynamic Workflows を、AI 起稿 + 人間レビューで記事を回す運用者の目線で実務に引きつけて読みます。

2026年5月29日 09:03
5 つのフロンティア LLM は事実判定の 67% で割れる — AI に正誤を委ねる前に
AI

5 つのフロンティア LLM は事実判定の 67% で割れる — AI に正誤を委ねる前に

GPT-5.4 や Claude Opus 4.7 などフロンティア LLM 5 つに 1,000 件の主張を判定させると、67% で意見が割れた。Lenz の研究から、AI に事実の正誤を委ねる危うさと、多数決・人間レビューで補う実務の構えを、AI 起稿 + 人間レビューで記事を出す運用者の目線で整理します。

2026年5月29日 00:08
YouTube が AI 動画に自動ラベル — 開示義務と作る側の実務
AI

YouTube が AI 動画に自動ラベル — 開示義務と作る側の実務

YouTube が 2026 年 5 月 27 日、写実的な AI 生成・編集動画への開示ラベルを自動付与する方針を発表しました。手動開示との違い、長尺とショートで異なる表示位置、開示が要る AI と要らない AI の線引きを、AI 起稿 + 人間レビューで動画を作る側の実務目線で整理します。

2026年5月28日 18:08