POSTS

記事一覧

技術、設計、AI、過程、随筆。書き散らしたものをゆっくり並べ直しています。211 本。

Liquid AI の LFM2.5 8B-A1B を運用視点で読む — 「総8B・アクティブ1B」の意味
AI

Liquid AI の LFM2.5 8B-A1B を運用視点で読む — 「総8B・アクティブ1B」の意味

Liquid AI が 2026 年 5 月 28 日に公開した LFM2.5 8B-A1B は、総 8B・アクティブ 1B の MoE 構成です。メモリは 8B 級・1 回の推論で動くのは 1B という設計が、自前で LLM を回す運用にどう効くのか。公称スループットとメモリ 6GB の数字を物差しに、品質とのトレードオフまで読み解きます。

2026年5月31日 00:05
コントラスト検証を「要素×状態×テーマ」で総当たりする — axe-core の穴を埋める
Design

コントラスト検証を「要素×状態×テーマ」で総当たりする — axe-core の穴を埋める

axe-core を CI に入れていても、hover やダークテーマに切り替えた瞬間のコントラスト事故は漏れます。要素×状態×テーマを総当たりするブラウザ JS 監査手法を、OKLCH トークン + light/dark 運用の視点で読み解きます。静的 CSS 差分・実効背景色の合成・WCAG 比の計算と、その限界までまとめます。

2026年5月30日 18:10
durable workflow の状態を SQLite だけに置く案を Sidekiq + Redis 運用者として読む
Engineering

durable workflow の状態を SQLite だけに置く案を Sidekiq + Redis 運用者として読む

「SQLite is all you need for durable workflows」は、途中で落ちても再開できるワークフローの状態を SQLite 1 ファイルに寄せる主張です。Sidekiq 8 + Redis 8 でジョブを回す運用者として、どこまで刺さり、どこで Redis を残すかを書きました。

2026年5月30日 12:08
要件定義を「思想」と「仕様」に分ける — 個人開発で手戻りを減らした運用
Process

要件定義を「思想」と「仕様」に分ける — 個人開発で手戻りを減らした運用

要件定義を「思想(なぜ・どうあるべきか)」と「仕様(何を・どう作るか)」の 2 層に分けると、レビューの重さもスコープの膨張も減ります。個人開発の auto-publish 再設計に当てはめた運用の記録です。

2026年5月30日 09:04
標準 GPU で LLM 推論 3000 tokens/s/req — 数字の前提を運用者目線で読む
AI

標準 GPU で LLM 推論 3000 tokens/s/req — 数字の前提を運用者目線で読む

Kog AI が 8 枚の標準 GPU で「1 リクエストあたり毎秒 3000 トークン」を出したと発表しました。確かに速いのですが、これは batch size 1 の単一リクエスト速度で、モデルは 2B。自前推論のコストとレイテンシを気にする運用者として、数字の前提と再現性を読みます。

2026年5月30日 06:06
Quake を 1997 年の道具でビルドし直す — 再現性を運用者目線で読む
Engineering

Quake を 1997 年の道具でビルドし直す — 再現性を運用者目線で読む

Fabien Sanglard が 1997 年当時のツールチェーンで Quake をビルドし直す記事を読んだ。VC++6 SP5 + Processor Pack で WinQuake.dsw を組む手順は短いのに、つまずきは全部「前提の固定漏れ」。Docker で同じ轍を踏んだ私が、再現性の急所を運用者目線で読みます。

2026年5月30日 00:06
謎の LLM「Hy3」が OpenRouter 利用ランキングで Claude を 50% 超で抜いた — 運用者はランキングをどう読むか
AI

謎の LLM「Hy3」が OpenRouter 利用ランキングで Claude を 50% 超で抜いた — 運用者はランキングをどう読むか

出自のはっきりしない Tencent 製モデル Hy3 が、OpenRouter の利用ランキングで Claude をトークン量で 50% 超上回り首位に立った。だが input 98%・上位 5 app が 1% 未満という内訳を見ると、これは品質 No.1 ではなくトークン消費量の話だ。API 運用者として、ランキングの読み方・実効単価・ロックインの 3 点に翻訳して読みます。

2026年5月29日 18:05
Anthropic が $65B 調達・評価額 $965B — API 運用者として価格とロックインで読む
AI

Anthropic が $65B 調達・評価額 $965B — API 運用者として価格とロックインで読む

Anthropic が Series H で $65B を調達し、post-money 評価額が $965B に到達。run-rate は $47B を超えた。巨額の数字そのものより、フロンティアモデルを API として運用に組み込んでいる側が気にすべき「モデル更新ケイデンス・価格・ロックイン」の 3 点に翻訳して読みます。

2026年5月29日 12:06
Claude Opus 4.8 を初日に触る — effort control と Dynamic Workflows を運用者の実務で読む
AI

Claude Opus 4.8 を初日に触る — effort control と Dynamic Workflows を運用者の実務で読む

Anthropic が Claude Opus 4.8 (model ID claude-opus-4-8) を公開。料金は Opus 4.7 から据え置きで、自分が書いたコードの欠陥を約 4 倍見逃しにくくなった。effort control・fast mode 値下げ・Dynamic Workflows を、AI 起稿 + 人間レビューで記事を回す運用者の目線で実務に引きつけて読みます。

2026年5月29日 09:03
5 つのフロンティア LLM は事実判定の 67% で割れる — AI に正誤を委ねる前に
AI

5 つのフロンティア LLM は事実判定の 67% で割れる — AI に正誤を委ねる前に

GPT-5.4 や Claude Opus 4.7 などフロンティア LLM 5 つに 1,000 件の主張を判定させると、67% で意見が割れた。Lenz の研究から、AI に事実の正誤を委ねる危うさと、多数決・人間レビューで補う実務の構えを、AI 起稿 + 人間レビューで記事を出す運用者の目線で整理します。

2026年5月29日 00:08