井本 賢

井本 賢

AIエージェント運用エンジニア

LLMO · Context Engineering · Harness Engineering

LLMOフレームワーク作者。Claude Codeで開発・運用・マーケティングを自律化するハーネスを設計しています。

400K+

累計PV(Qiita+Zenn)

40+

冊(Kindle+Zenn)

6

論文(Zenodo)

Now

  • LLMOフレームワーク・LLMOチェッカー・Open LLMO Research Initiative の開発
  • AI-Native MEO を LLMO の実店舗向け実装としてまとめる
  • ハーネスエンジニアリングをプロダクトに適用 — 開発・運用・マーケティングまでAIエージェントで実践
  • 実践での知見を本や記事として公開

2026年10月更新

課題から探す

本や記事の一覧ではなく、困っていることの側から引ける地図を用意しています。49個の課題に、無料記事90本と書籍を紐づけました。無料の記事だけで解決するなら、そこで終わって構いません。

課題から探す (記事と本の地図)

出版物

AI開発シリーズ

音声AIの300ms

音声AIの300ms

人はなぜAIとの会話に違和感を覚えるのか

Kindle Zenn
AIコードレビューを仕組み化する技術

AIコードレビューを仕組み化する技術

レビュー時間60%削減の3層モデル

Kindle Zenn
ハーネス・エンジニアリング

ハーネス・エンジニアリング

AIを"使う"から"操る"へ

Kindle
実践Claude Code

実践Claude Code

コンテキストエンジニアリングで開発を変える

Kindle Zenn EN PT-BR
LLMを「嘘つき」から「専門家」に変える技術

LLMを「嘘つき」から「専門家」に変える技術

LLMを「嘘つき」から「専門家」に変える技術

Zenn (¥1,500) Kindle
Claude Code QuickStart

Claude Code QuickStart

すぐに始める

Zenn (無料)

ローカルLLM 実測シリーズ

8000行でわかる大規模言語モデル

8000行でわかる大規模言語モデル

Karpathyの8,000行を1冊で読み切る

Kindle Zenn (無料)
RTX 4070でQwen 35Bを2.8倍速くする

RTX 4070でQwen 35Bを2.8倍速くする

家庭用GPU1枚で測ったローカルLLM実測ノート

Kindle Zenn
NEW ローカルLLMで足りる仕事、Claude Codeに任せる仕事

ローカルLLMで足りる仕事、Claude Codeに任せる仕事

Claude Code の作業を1ステップずつ振り分ける

Kindle

LLMO / AI検索最適化シリーズ

AIに選ばれる店をつくる

AIに選ばれる店をつくる

店舗オーナーのための AI Native MEO 実践

Kindle JP (¥1,250)
LLMO実践ガイド

LLMO実践ガイド

LLMO実践ガイド

Kindle Zenn
LLMOクイックスタート

LLMOクイックスタート

エンジニアのためのAI検索最適化入門

Kindle JP (¥300)
LLMOに最適化されたホームページをゼロから作る

LLMOに最適化されたホームページをゼロから作る

LLMOに最適化されたホームページをゼロから作る

Zenn (¥500)

セキュリティ / 品質シリーズ

NEW AIくさい文章から脱出する技術

AIくさい文章から脱出する技術

6モデル180サンプルで測った「バレる文章」

Kindle (Unlimited対象)
MCP実践セキュリティ

MCP実践セキュリティ

本番導入で躓かないための完全ガイド

商業出版の準備中
なぜAI生成UIは全部青いのか

なぜAI生成UIは全部青いのか

4モデル×40色の実験データで解明

Kindle Zenn (¥500)

ナレッジ & データシリーズ

ナレッジグラフ活用大全

ナレッジグラフ活用大全

構造化すれば、AIは賢くなる

Kindle

エンジニアリング文化シリーズ

エンジニアリング100の言葉

エンジニアリング100の言葉

なぜその一文は記憶に残るのか

Kindle
エンジニアの心理トリック大全

エンジニアの心理トリック大全

コードは正しいのに、なぜ提案が通らないのか

Kindle Zenn (無料) PT-BR

→ Amazonで全書籍を見る

最新記事

論文

LLMテキストのリズム単調化は言語横断: 3言語×7モデルの証拠

二層指紋研究の続編。リズム単調化 (burstiness低下・文長CV低下) は日本語固有の癖か、それとも言語横断的な性質か。7 LLMを英語・ポルトガル語の人間baseline (Dev.to 853本 + TabNews 403本) と比較したところ、5中核指標×7モデル×2言語=70/70セルすべてでAIが単調側に着地し、長さの残差化後も効果は維持された。カンマ密度だけは言語で符号が割れ (EN +0.45 / PT −0.83)、signature/accent/dialectの三層指紋frameworkを提示。現行Claude世代の単調化はGPT-3.5の約1/3で、「AIの訛り」は薄まりつつある。

論文 (DOI) コード & データ 2026年7月 · Zenodo

語彙指紋 vs リズム指紋: 日本語AI生成テキストの二層構造分析

7モデル×350文書 vs 人間700記事で、語彙とリズムの2特徴系を同一設計で比較。リズムの単調化は全7モデル共通で実在する (burstiness d = −0.96) が、人間/AI判別は語彙が圧勝 (AUC 0.998 vs 0.897) で実務ツールの主張とは逆。語彙プロファイルは生成モデル自体を92%で特定 (リズムは51%)。document単位の再分析により、既刊研究の651語のうち35%がtoken集計のアーティファクトだったことも自己修正した。

論文 (DOI) コード & データ 2026年7月 · Zenodo
→ 残り4本の論文を表示→ 折りたたむ

Free-Executor Paradox: 反復LLMコード修復ループで「タダのエグゼキュータ」が一番高くつく

4構成のLLM (Opus solo / Haiku solo / Opus+Qwen / Opus+Haiku) を3つのPythonコード修復タスクで決定的判定器 (mypy + ruff + pytest) のもとで比較。「強いオーケストレータ + 安い (or ローカル無料) エグゼキュータ」という定石構造が全タスクで最も高くつく現象を発見 — オーケストレータがエグゼキュータの返したサマリを prompt cache 経由で読み直すコストが、実行委譲の節約を食い潰す。最大タスクではHaiku soloがドル建てで5.5倍安い (失敗率25%引き換え)。

論文 (DOI) コード & データ 2026年6月 · Zenodo

Excess Vocabulary: 日本語AI生成テキストの過剰語彙クロスモデル定量分析

7モデル×350サンプル vs 人間977記事で651の統計的に有意なexcess wordsを特定。Claude世代間で語彙偏りが増加(TTR: 0.52→0.29)。ドメイン内分類器AUC=0.946、ドメイン間では完全に崩壊。日本語excess vocabulary研究として世界初、共進化の証拠も確認。

論文 (DOI) コード & データ 2026年3月 · Zenodo

AI Text Slop: 日本語技術記事における6つのLLMの文体収束の定量分析

6モデル×10トピック×3試行=180サンプルで16指標を測定。RLHF商用モデルがOSSより有意に高スコア(Cohen's d=1.01)。語彙と構造の乖離(gpt-ossパラドックス)を発見。2026年8月に2点訂正: 当該20Bモデルは Swallow ではなく gpt-oss:20b、「人間のほうが構造スコアが高い」は記事の長さによる交絡で撤回。

論文 (DOI) コード & データ 2026年3月 · Zenodo

AI Blue: Vision-Language Modelの色認識バイアス

VLM 4モデル×40色×480観測で色認識精度をCIEDE2000で定量評価。商用モデルは中間色で精度低下、AI生成UIの95.4%が青紫に集中。AI Slopの原因メカニズムを初めて定量的に実証。

論文 (DOI) コード & データ 2026年3月 · Zenodo

研究

LLMO Framework

AI検索エンジンにおけるコンテンツ最適化

Voice AI 300ms

音声AIの300msレイテンシの壁への挑戦

コンテキストエンジニアリング

CLAUDE.md、マルチエージェント設計

Generative Agent Simulation

LLMマルチエージェントで社会をシミュレート

香り × AI

AI×パーソナリティで調香を科学する

Side Projects

Propel-Lab — 会社

LLM開発環境とハーネスエンジニアリングに特化した、企業向けAIシステムコンサルティング。

LLMO Framework — オープンな方法論

LLM最適化(AEO + GEO)の実践フレームワーク。セルフホストのドキュメントサイトが正典。

legacydram — ウィスキー × エンジニアの視点

瓶の中身を「他人のレガシーコード」として読み解くキュレーションメディア。 People · Craft · Tasting。

ainativemeo — AI 時代の実店舗最適化

「人ではなく AI に勧めてもらう時代」の実店舗最適化を扱う。Google Business Profile の構造化解釈と、各 AI エンジンの引用挙動の実測を公開する。日英バイリンガル。

Open Source

LLMO / AI SEARCH

open-llmo — GitHub organization · MIT

Open LLMO Research Initiative。「ある URL が AI からどれだけ引きやすいか」を測るための仕様・バリデータ・ツール群を、従来の SEO シグナルを超えた切り口で整備する。

llmo-checker — TypeScript CLI · MIT

URL の「AI からの引きやすさ」を Lighthouse 風に採点する CLI。 llms.txt / JSON-LD / robots policy / 意味構造を静的にチェックし、0〜100 の LLMO Score を JSON で返す。v0.1 draft。

RAG & RETRIEVAL

rag-db-advisor — Python · MCP + CLI · MIT

RAG スタック選定の質問に、rag-retriever-bench の実測値だけを根拠に答えるアドバイザー。どのベクトル DB が自分のワークロードに合うか、どの運用罠を踏みかけているかを MCP / CLI で質問できる。意見ではなく測定データで答える。

rag-retriever-bench — Python · MIT

RAG 検索バックエンドのベンチマークハーネス。同一コーパス・同一クエリ・同一メトリクスで DB だけ差し替える。7 バックエンド (pgvector / ClickHouse / Qdrant / Weaviate / Milvus / Chroma / LanceDB) を recall・レイテンシ・投入速度で決定論的に計測 (LLM judge 不使用)。ANN インデックスが実際に使われたかを検証する self-check 付き。

VOICE & SPEECH

voice-clone — Python · MIT

Qwen3-TTS を使った音声クローンツール。3 秒程度のサンプル音声から、任意のテキストを指定した声で合成。WSLg 録音対応・多言語。

speech-habit-lens — Python CLI · MIT

AmiVoice ESAS (感情 20 パラメータ) × LLM の三層解析で 1 分スピーチの癖を可視化。音響層 / テキスト層 / 身体と言語をつなぐクロス層を Markdown レポートに。

DEV UTILITIES

compact-ops — Claude Code plugin · MIT

Claude Code の context compaction を挟んでもセッションが壊れないようにする透過型プラグイン。圧縮前に構造化 state を保存し、圧縮直後と --resume 時に復旧ガイダンスを注入。使用率警告も plugin 単体で完結。u-ichi 氏の compact-plus 派生。

domain-pre-flight — Python CLI · MIT

サイト・アプリ用ドメインを取る前の最後のチェック。構造 / 過去履歴 / typosquat / 多言語意味 / LLMO / 商標 deeplink を 1 コマンドで判定。

PERSONA & IDENTITY

persona-hub — TypeScript + Python · Apache-2.0

2 つの部品で構成されるペルソナハブ。クイズの採点をローカルで完結させる軽量 TypeScript SDK と、結果を保存してサービス横断で引き継げる任意の FastAPI サービスから成ります。LaunchDarkly + Segment Engage 由来のアーキを「ペルソナ集約」に適用。Pre-alpha。

SNS・コンタクト