ブログ
AI開発、LLMO、コンテキストエンジニアリング、ハーネスエンジニアリングの技術記事。
2026 124件
- 静的解析コードKGが61%見逃した動的呼び出しで本番決済落ちた話 6分
- Claude Codeに図を「描かせる」のをやめて「一緒に描く」に変えたら、図解の意味が変わった 5分
- Claude Code 実戦運用ガイド ― エージェントを2年回して分かった8つの勘所 6分
- RTX 4070 一枚で BGM・効果音・画像を全部ローカル生成する — ACE-Step 1.5 と MOSS-SoundEffect v2.0 を一晩で実戦投入した話 8分
- Skill・Hook・MCPで同じ機能を3実装した結果、月額トークン費が家賃並みに割れた 7分
- AIコードレビューは説得の心理学:3つの言い回しでmerge速度が1.5倍になった話 6分
- Claude Code の auto mode で Bash だけが止まる — safety classifier 障害の調査と「故障時だけ fail-open」hook 案 8分
- LLMOだけでは読まれない。llms.txt完備のサイトで、AI経由の流入は3%だった 5分
- チャットモデルは損失マスクで生まれる — nanochatのSFTを「採点表」として読む 6分
- Tauri v2 を「ガワ」として使う — WSL2 mirrored networking で Node.js サーバをそのまま Windows デスクトップに映す 8分
- 熊本M7.1の余震346件を5日間追った — 福岡に届いたのは34件、そして10年前との答え合わせ 4分
- Tree-sitter+MCPでレビュートークンを8〜49倍削った実測: コードベースは既に巨大なグラフだった 7分
- Tree-sitter ASTで30分Blast Radius可視化 MCP設計3原則 8分
- 地震予知はなぜ無理で、余震予測はなぜできるのか — 能登の余震130件で実測 10分
- Knowledge Graphは3ヶ月で腐る — 300ノードで測ったrot率 7分
- Neo4jで3週間、7ステップで組んだナレッジグラフの実測メモ 6分
- Knowledge GraphでRAGのハルシネーションが8割減った実測 6分
- Shai-Hulud事件でCLAUDE.mdの書き方が変わった話 7分
- コード用Knowledge Graphを7ステップで作った実測ノート 6分
- Claude Code MCPでハードウェア制御——UART/I2C/SPI/RS-485/CAN 5プロトコル実測 8分
- Knowledge GraphをPython500行でスクラッチ実装 GraphRAG動くまで 6分
- MEO代行費5万円をClaudeで自前化、3業種プロンプト実物と月3万円分解 7分
- MCP OWASP Top 10全10項目、Claude Desktop標準設定で何が守れて何が抜けるか 8分
- MCP Sampling 権限昇格 — Claude Desktop で通る3経路 (7攻撃検証) 6分
- 「リズムの単調化は日本語だけか」を英語・ポルトガル語×7モデルで検証したら、70セル全部でAIは単調だった 7分
- RTX 4070 で Qwen 35B が 34.6 tok/s になった 2 フラグ実測 6分
- 「AI臭は語彙よりリズムに出る」を7モデルで検証したら、判別はAUC 0.998で語彙の圧勝だった 6分
- nanochat 8,000行でLLM製造工程を辿る — GPT-2訓練の値段は2026年いくらか 7分
- 論文の実測分布で校正したリズム計測CLI「rhythm-lens」を公開して、自分の記事に当てたら⚠2つ食らった 3分
- AIレビューがトークン80%焼く問題、Tree-sitter+MCPで8-49倍削減 8分
- 1Passwordを値上げで諦めた私が、SOPS+ageで.envの複数PC共有に着地した話 8分
- 複数アカウントで気づいた Claude Code の2ファイル認証 (credentials.json + ~/.claude.json) 9分
- MCPのTool descriptionはプロンプトインジェクションの窓 - 公開5個で試した3種 9分
- Strangler Fig で React/FastAPI 段階移行 11分
- YAML→PNG を LLM に任せる — historymap に MCP サーバーを足した記録 5分
- MCPファイルアップロードを7サービスで実測: 完全対応はゼロだった 8分
- X Premium ¥980 では Grok を CLI から叩けない — 403 の理由と $25 credit で始める最短路 9分
- AGENTS.md と CLAUDE.md の違いは「専用機か汎用機か」ではない — 3ヶ月使い分けて分かった実践設計の分岐点 8分
- 自作LLMOサイト、日本人1人運営なのに中国からのアクセスが45%になっていた — cn.bing で自然発生的にランクした話 8分
- OpenCutセットアップ難民は、まずopencut.appを開いてください — ローカル起動の3つの罠 8分
- OpenCut classic を fork して MCP サーバーを入れた — Claude Code から動画エディタを操作するまでに踏んだ4つの罠 8分
- MCPサーバーを公開する前のpre-flight — 4層で採点する mcp-scorecard の設計 14分
- AIエージェントのハーネスを構成する6要素 — 10分でCLAUDE.mdを棚卸しするチェックリスト 5分
- 107本のSKILL.mdをlintしたら、稼働中のskillが21本「壊れてる」と言われた 6分
- プロダクトを出すたび支援導線が勝手に付く: Cloudflare Workersのエッジ注入オーバーレイ 6分
- FUNDING.ymlを置いてもSponsorボタンは出ない: 42リポジトリを棚卸しした 4分
- YAMLを1枚書くと企業サイト風の年表ページになるOSS「historymap」を公開した 4分
- 自己進化エージェントを3ヶ月動かしたら2回ロールバックした 6分
- MCPで私が踏んだ地雷7つ — 実装と実測ログ 12分
- MCPサーバーの権限昇格を7パターン実演、うち3つはClaude Desktopの標準設定で通った 11分
- リリース作業の途中で、作っていたプラグインに67%警告を鳴らされた: compact-ops を公開しました 7分
- ナレッジグラフでコードレビュー範囲を9割削る——実PR30件でトークンと時間を測った 8分
- Claude Code 3セッション並走で8時間ぶん消えた: あの日から追加した5つのハーネス制約 7分
- Knowledge Graphを7ステップで作る前に、AIエージェントが「見えていない」3層を可視化する 9分
- Vector RAGで3か月粘って壊れた3ケースから作った、GraphRAGへ切り替える7ステップテスト 8分
- llms.txtとJSON-LDが噛み合っていない5パターン — 30ファイルを整合チェックして分かったこと 9分
- Neo4jで個人ナレッジグラフを組んだら、Notionを解約できた ― 3か月・300ファイルの実測 7分
- Knowledge Graphの抽出順を逆にしたらAPIコストが3倍になった話 8分
- Knowledge GraphでRAGの天井を破る:GraphRAGがベクトル検索に負けない「関係クエリ」3パターン 7分
- LLMO 総合ガイド ― AI 検索に引用される技術を、30ヶ月分の計測から組み立てる 9分
- Ollama 12.2 tok/s が34.6 tok/s になった: RTX 4070 で Qwen3 35B を2.8倍速にする1コマンド 6分
- Claude Code・Cursor・Codexを1日並列で走らせて、判断回数を数えたら412回だった 9分
- Claude Code・Cursor・Codex併用で1日の判断を400回から40回にした、ハーネス3層設計の実測 11分
- RDFかプロパティグラフか — GraphRAG 2026を3つの質問で5分で決める 9分
- Sonnet 4は確信度4.2で嘘をついた、Haikuは「知らない」と答えた — 大きいモデルほど自信を持って幻覚する 7分
- Claude Code の Plan モードで「朝に一日を設計」したら、手戻りが半分になった 5分
- 却下ログは「学習信号」だった — 自己進化ハーネスが strategy.md に書けない暗黙知を拾う仕組み 7分
- 「著者エンティティを実装した」と書いた私が、自分の239ページを監査したら配線が途中で切れていた話 8分
- 賢いモデルが来るほど、ハーネスは「捨てる」設計になる — Anthropicがマルチからシングルに戻した理由 7分
- マルチエージェントは並列化で速くなる、は幻想だった — 調整コストはエージェント数の二乗で増える 6分
- Figma MakeとClaude Codeで、デザイナー不在のUIを作る — コードからデザインを逆生成する時代 8分
- 記事にArticle schemaを入れてもAIは私を著者と認識しなかった。著者エンティティを実装して引用の帰属が変わった話 9分
- GPTBotに私のJSレンダリングページを見せたら、中身は空の`<div>`だった 7分
- LLMO対応はテストしないと静かに壊れる:AIクローラーの可読性をPlaywrightでCI検証する 5分
- 賢いモデルほど、上手に嘘をつく 6分
- 「いい感じに作って」はなぜ5回目で崩壊するのか -- コードの前に書く6つの定義書と3つの記憶ファイル 7分
- AIエージェントが「空気を読めない」本当の理由:常識ナレッジグラフという欠けたレイヤー 5分
- 接続したMCPサーバーの38%は認証なしだった — 60日で30件のCVEが出たMCPセキュリティの現実 6分
- 43秒の異常が24時間の障害になった: メトリクスの急変と漸増を見分ける時系列デバッグ 9分
- AIエージェントの予測を1つの数字で信じるな — Simulatorは点推定でなく確率分布を返すべき 6分
- サブエージェントにメインの記憶を渡すのは事故だった:7ファイルのうち4つは遮断すべき 6分
- バリデータがバグっていた — 「安全です」と報告するシステム自身が壊れているとき 6分
- 「とりあえず全部許可」でClaude Codeを動かすと、.envの秘密がそのままAnthropicに渡る話 5分
- 店舗LLMOの答えはllms.txtでなくGBPだった — 私が綺麗に書いたファイルを、AIは一度も引用しなかった 6分
- Claude Codeに渡すコンテキストを足すのをやめた — ツール出力を間引いたら長時間タスクの精度が戻った 5分
- 「稼働率99.5%」と「5,000件の決済失敗」は同じ事実 — 障害報告のフレーミングが緊急度を反転させる 5分
- 午後3時、あなたのコードレビュー承認率はほぼ0%になる:決断疲労の科学とAIエージェント時代の処方箋 8分
- ページ単位のSEOはAIに見えていない: 引用されるのは「パッセージ」だった 8分
- Claude Codeを/clearせず9時間動かした日、コンテキストはどこで腐り始めたのか 6分
- Claude Code Skills は発火しなくてもトークンを食う — 5 Skills × 7時間セッションで「使われなかった」3つが18%食べていた 8分
- AIエージェントを7本cronで毎日回したら、2本が18日間沈黙していた — observabilityでは拾えず、exit-code契約で拾えた話 10分
- Claude Codeを3セッション並列で8時間動かしたら、2回コンテキストを上書きしあった 10分
- 5つのAI検索に『kenimoto.devを引用して』と頼んだ。記事31本のうち出てきたのは3本だった 7分
- JSON-LDを11スキーマ入れた。3ヶ月測ったら、AIが拾っていたのは3つだけだった 9分
- コードレビューを6段階にしたら、AIと人間の分業が見えた 12分
- robots.txtにAIクローラー13個の個別ルールを書いた。30日後、守ったのは3つだけだった 10分
- AI Overviewsに載るための4条件を30日試した。効いたのは1つだけだった 7分
- 他のエージェントを監査する4層目を足したら、Strategistが3週間サボっていたことが発覚した話 4分
- ブログを4言語化したら、ポルトガル語版だけ流入が約4倍になった - 22日分の生データ 7分
- Claude Code Skills を10個書いたら、4個に統合された — Reusable Pattern が回り始める瞬間と回らない瞬間 6分
- Claudeに先週47回『おっしゃる通りです』と言われた。そのうち11回は私が、36回はClaudeが間違っていた。 6分
- 同じサイトを7つのAI引用トラッカーに入れたら、7つとも違う数字を返してきた 8分
- 30日間サーバーログを見続けて分かった、私のサイトを最も叩いた5つのAIクローラー - そこから読めるLLMOシグナル 8分
- ClaudeをカオスエンジニアリングのMCPサーバーに繋いだら、ステージングを4回殺した — 6ヶ月見逃していた本番バグを見つけた話 16分
- Claudeが3回連続でバグを「隠す修正」を出してきた話 — デバッグ10の技法をプロンプトに翻訳する 9分
- Strategist に WebSearch を持たせたら 5テーマ選びに 20分かかった - Observer / Strategist / Marketer 3役分離で 3分にした話 8分
- 音声AIスタックを5つ実測した。300msの壁を越えられたのは2つだけだった 9分
- 3人のサブエージェントに同じPRを見せたら、4割の指摘で意見が割れた話 9分
- 他社の llms.txt を30個監査したら、すでに5つのアンチパターンが形になっていた 10分
- SEOが壊れる日 — 私のAIエージェントは、もうGoogleを見ていなかった 11分
- CLAUDE.md は結局 Context Engineering を1ファイルに凝縮したものだった 6分
- 同じ質問なのに、LLMから5つの違う回答が返ってきた — Context Engineering 入門 5分
- JSON-LDで LLM にサイトを「説明」する: 11スキーマ統合実装ガイド 9分
- ChatGPTからのアクセスは、GA4にどう映るのか - LLMOを数値で把握する3つの方法 11分
- 15分で終わるLLMO最小実装: llms.txt + JSON-LDで「AIに見つけられる土台」を作る 8分
- 新規ドメインの最初の1週間、GA4は嘘をつく: kaoriq.com立ち上げ4日間の生データ 6分
- ChatGPTからの流入を90日で8,337%増やした実装: TRMが採用した4つのLLMO戦略柱 9分
- AIエージェントは月いくらかかるのか -- API・サブスク・ローカルの損益分岐点 8分
- Claude Code Hooks v2 — 「お願い」を「プログラム」に変える25のイベント 7分
- Claude CodeのSub-agent設計 — 1セッションで専門家チームを使い分ける 8分
- AIパイプラインが壊れる9つの理由 -- 全部AIの外側だった 5分
- LLMに「引用したい」と思わせるコンテンツ設計 — Microsoftが明かした3原則 8分
- MCPサーバーに接続しただけでトークンが消える — 4サービスで実測した 7分
- Claude Codeで自律型コンテンツパイプラインを構築した話 1分