Claude Code のコンテキストに何が乗っているか——投入物を全部棚卸しした
Claude Code が1つのターンで LLM に渡しているコンテキストの中身——システムプロンプト、CLAUDE.md、ツール定義、環境情報、MCPサーバー、過去の会話や差し込みリマインダーまでを網羅的に整理した記事。何が暗黙に積まれ、何がトークンを食っているかを可視化しており、ハーネスの挙動を理解して制御したい人向けの実用的な地図になっている。コンテキスト管理の勘所を押さえる基礎資料として価値が高い。
DAILY TECH SURVEY — 2026-09-01 · RUN 48
Claude Code が1つのターンで LLM に渡しているコンテキストの中身——システムプロンプト、CLAUDE.md、ツール定義、環境情報、MCPサーバー、過去の会話や差し込みリマインダーまでを網羅的に整理した記事。何が暗黙に積まれ、何がトークンを食っているかを可視化しており、ハーネスの挙動を理解して制御したい人向けの実用的な地図になっている。コンテキスト管理の勘所を押さえる基礎資料として価値が高い。
エージェントに複数の Skill を持たせたとき、どれを使うかを description のマッチで自動選択させるための設計指針をまとめた記事。説明文の粒度・具体性・トリガー語の書き方が選択精度を左右するという実践知を、失敗パターンとともに整理している。Claude Code の Skill 機構をチームや自分の業務に組み込む際の、命名と記述のガイドラインとして直接使える内容。
MCP サーバーをエージェントに接続する前に確認すべきセキュリティ観点を11項目に落とし込んだチェックリスト。ツールの権限範囲、外部への副作用、認証情報の扱い、暴走・過剰実行の抑止など、実運用で事故につながりやすいポイントを列挙している。MCP を業務に入れる前のレビュー基準として、そのまま流用できる実務的な内容。
筆者が実際に使っている Claude Code の設定・カスタマイズを2026年8月時点でまとめた記事で、はてブでも270超のユーザーを集めている。CLAUDE.md の書き方、フック、権限設定、日々のワークフローまで具体的な設定値つきで公開しており、他人の実運用を覗いて自分の環境に取り込むのに向く。設定の「正解」を探している人にとって参照価値の高いスナップショット。
個人開発で Claude Code を回すなかで、CLAUDE.md に何を書くと効き、何を書くと逆に邪魔になるかを経験ベースで切り分けた記事。プロジェクト固有の不変条件や規約は書き、コードから読めばわかることや一時的な事情は書かない、という取捨選択の基準を示している。CLAUDE.md が肥大化して効かなくなる前に読んでおきたい実践知。
Anthropic が Claude Code の週次利用上限を約17%引き下げたとの告知が HN で議論を呼び、同時期に投稿された個人向け coding agent サブスクのコスパ比較や、Bedrock 経由での二重課金の顛末といった記事とあわせて、コーディングエージェントの「コスト」が主要な関心事になっていることが浮き彫りになった。定額サブスクの条件が数週ごとに変わる不安定さと、計算資源の逼迫が背景として語られている。LLMアプリの課金・計測を追ううえで見逃せない一連の動き。
HNでは「安く入り込んで後から値上げする戦略に疲れた」「$200サブスクが2週ごとに条件変更される」「実感は17%ではなく30%減」といった不満が並ぶ一方、「OpenAIのCodexは頻繁に上限をリセットしてくる」との比較や、各社が軒並み計算資源に逼迫しているという観測も出ている。
定額サブスクの安心感 vs 従量課金の透明性というトレードオフに加え、『Conciseは節約設定ではない』『Bedrock経由だと二重課金が起こりうる』といった、設定・経路の誤解がそのまま請求額に効くという落とし穴が共有されている。
主要な AI API の価格を3年にわたって記録し続けた結果、値上げ(や条件変更)が累計1,104回あったという実測データをまとめた記事。モデル単価が下がる一方で、レート・条件・課金経路が頻繁に変わり、実効コストは単純な単価比較では読めないことを数字で示している。LLMアプリの原価を見積もる際、公表単価をそのまま信じてはいけないという教訓が得られる。
Claude Code がコミットに自らを Co-authored-by として追記する挙動をやめさせた、という個人ブログが HN で42コメントの議論を呼んだ。筆者は責任の所在を曖昧にするとして反対するが、コメント欄では賛否が割れている。エージェントによる自動コミットをどう扱うかという、運用ポリシー上の身近な論点。
「そもそもこの慣習が定着したこと自体が問題で、ハーネスにgit書き込みを許した証拠だ」という強い反対がある一方、「映画のスタッフロールのように使ったツールをクレジットするのは自然」「昔Google/StackOverflowを共著者にしなかったのとは事情が違う」との擁護も。共通するのは『AIを運転しているのは自分であり、責任は自分が取る』という点で、そこから共著者表記の要否が分かれている。
Simon Willison が OpenAI の「ChatGPT Work」が内部で使うツールと Skill のリファレンスを引き出して公開し、HN で156ポイントを集めた。とくに Playwright を Node 経由で起動してブラウザを操作する control-browser スキルが、Codex 系ハーネスの実装として興味深いと指摘されている。競合エージェントのツール設計を覗ける資料で、Claude Code の Skill 機構と比較する材料になる。
simonw 自身が「最も面白いのは control-browser スキル(PlaywrightをNode経由で起動する)」と指摘。コメント欄では『AI生成サイトはどれも同じ見た目になる(Bootstrap時代の既視感)』という観察や、『結局Codexと何が違うのか』という疑問、OpenAIの安全機能の縮小への懸念が交わされた。
1つのモデルに複数のシニアエンジニアの人格を演じさせて相互レビューさせるという手法で、あるコードを67倍高速化しつつ、最終的に「この最適化は現実には不要」と自ら結論づけたという実験記。多視点レビューがパフォーマンス改善とオーバーエンジニアリングの抑制を同時にもたらしうることを示す。エージェントに批判的検証をさせるプロンプト設計の一例として参考になる。
Claude Code の作業ディレクトリ ~/.claude が6.57GBまで膨れ、その2.78GBが停止したまま放置されたジョブが握るログの丸ごとコピーだったという調査記事。長期運用でハーネスが静かにディスクを食う実例で、どのディレクトリが原因かと掃除の勘所を具体的に示している。CI や常駐運用で Claude Code を回している人が定期的にチェックすべき運用トピック。
LLM がもっともらしいが実質のない「コンサル的」助言を返してしまう問題を、具体例を挙げて批判的に論じたブログで、はてブ274ユーザーを集めた。表面的な整合性と実際の有用性が乖離する仕組みと、それを鵜呑みにしないための読み手側の姿勢を整理している。LLMアプリを設計・評価する側にとって、出力品質の落とし穴を言語化した良質な議論。
OpenAI が Mac mini と Mac Studio を数万台規模で買い占めていると報じられ、Apple 側も想定外の需要に驚いているという。汎用サーバーGPUではなく Apple Silicon を大量調達する動きは、推論・オンデバイス実験の計算資源確保が新たな争点になっていることを示唆する。エージェント各社が上限を絞る背景(計算資源の逼迫)と地続きの話題として面白い。
開発者が税理士事務所に1ヶ月住み込み、業務を間近で観察しながら会計AIを作り上げた過程を綴った記事で、はてブ372ユーザーを集めた。ドメインの現場に飛び込んで課題を吸い上げるという泥臭い手法が、AIプロダクトの精度と実用性をどう押し上げたかが具体的に語られている。技術より先に「誰のどの業務を解くか」を徹底する個人開発の好例。
RELEASE WATCH
一部Macでの Bash コマンド失敗、settings.local.json 未作成時の「常に許可」保存不具合、Remote Control のストール、巨大な失敗出力によるAPIリクエストサイズ超過などの不具合修正。
PreModelSwitch/PostModelSwitch フックを追加、フォアグラウンドのサブエージェントのツール呼び出しを Remote Control へライブ配信、/usage に Spend limit バーを追加。
バグ修正と信頼性向上。
--restricted(コマンド実行系ツールとWebFetchを外し、作業ディレクトリ内のファイル操作のみ許可)と、エージェント単位のプロンプトキャッシュTTL experimental.cacheTtl を追加。
不具合時にフィードバック下書きを作る SendFeedback ツール、spinnerTipsOverride の拡張(独自Tipsのローテーション)を追加。
オプションMCPサーバーのツール検出に設定可能な猶予期間を追加、拡張がMCPツール結果をモデル到達前に検査・置換可能に、プラグインカタログの改善とバグ修正。
OSS RANKING
FETCH STATUS