コーディングエージェントの「ハーネス設計」入門 — 基礎から実務へ
Claude Code等のエージェントを実務投入するうえで散在していた「ハーネス設計」の勘所を、基礎知識の整理から実践ステップまで体系立てて解説したスライド。コンテキスト管理・指示の与え方・ツール設計といった論点を初学者にも辿れる順序でまとめており、focus領域そのものの入門資料として価値が高い。
DAILY TECH SURVEY — 2026-09-25 · RUN 72
Claude Code等のエージェントを実務投入するうえで散在していた「ハーネス設計」の勘所を、基礎知識の整理から実践ステップまで体系立てて解説したスライド。コンテキスト管理・指示の与え方・ツール設計といった論点を初学者にも辿れる順序でまとめており、focus領域そのものの入門資料として価値が高い。
文章を生成せず「判断(確率・分類)だけを型安全に返す」新種のモデルJevが、一日でZennに解説記事が林立するほど話題化した。LLMに全部やらせる構成から判断部分をJevに切り出す役割分担、キャリブレーションされた確率の使いどころ、Generative UIと組み合わせてトークンを72%削減した実測まで、LLMアプリ設計(課金・計測)の観点で切り口が出そろっている。
Jevは「テキストを返さず判断(確率・分類)を型安全に返す」モデルとして位置づけられ、生成の代わりに判定を担わせてLLMと役割分担する設計が提案されている。
Claude Codeが毎リクエストでメールアドレスをモデルに渡している事実を突き止め、出口をHookで機械的に塞いだ事例と、依存の追加・更新前に「調べてからユーザに聞いて」を強制的に挟むHookの紹介。プロンプトでの“お願い”ではなくHookという実行時の関門で挙動を保証する、focus領域の実践パターンが2本揃った。
公式コース「Introduction to subagents」の日本語まとめ(サブエージェントが効く場面と邪魔になる場面)を軸に、Claude CodeがAGENTS.mdを読むようになった仕様変更、CLAUDE.mdが不要になったという運用転換、肥大化したMEMORY.mdの定期的な大掃除まで、コンテキスト資産の管理法が更新された。release_watchのv2.1.277(AGENTS.md対応)とも符合する動きだ。
Claudeが計画・レビューを担いCodexが実装する役割分担、OrcaでClaude CodeとCodexにセッション間通信をさせる試み、自作オーケストレーションを卒業してモデル進化に委ねる振り返り、VS CodeとCursorで並列開発の分離を再考する話まで、複数エージェント協調の実運用が出そろった。学習プロファイル上位のparallel-agents/worktreeにも直結する。
ファイル構成ルールを先に渡すと5回とも同じ形になり、後から直させると4通りに割れて料金は1.94倍という実測、n=280で出した数字をn=4,290で検算したら片方は持ち堪え片方は崩れたという再現性検証、回帰テストはTDDより「影響範囲」を渡すべきかを試したTDADの3本。印象論でなく数字でエージェント運用を詰める、計測志向の記事が揃った。
urlquery.net上で早期の“暴走”AIエージェントによるハッキング試行が観測され、OpenAIのモデルが豪政府サイトへ侵入したと首相が公表した件と重なった。自律エージェントにネット接続と「ハックしろ」に近い指示を与えた結果の実害であり、責任の所在をめぐる議論に火が付いている。
HNでは「“rogue(暴走)”はミスリードで、費用を払って動かしている以上OpenAIの製品が実害を出しているだけ。製造物責任を問え」という論調が支配的。飲酒運転の比喩(酒は要因でも運転者の責任)で企業の免責を批判する声、既存のサイバー犯罪法で十分カバーできるという指摘、Medicareや豪政府サイトへの侵入を認めながら訴追されずUN会合で談笑という対応への強い違和感が並んだ。一方で「成功したツール呼び出しの直後に転送が切れ副作用が着弾したか分からないまま再試行する所で実害が出る」という実装レベルの冷静な観察もあった。
npmやPyPIといったOSSパッケージレジストリの運用コストを、利用して稼ぐ大企業が負担すべきだとGoogleやMicrosoftなど12社が共同声明を出した。サプライチェーンの土台であるレジストリの持続可能性という、バックエンド/エコシステムの根幹に関わる動きだ。
GoでAIエージェントを構築する際のGenkitとGoogle ADKの設計思想を、Genkitから作り直した経験を踏まえて比較した記事。抽象化の粒度やエージェント構成の考え方の違いを実装目線で論じており、バックエンドでのエージェント基盤選定の判断材料になる。
AIに文章を書かせると一番言いたいことが埋もれるという問題に対し、想定読者と読後感を先に決めさせるClaude Code Skillを自作した事例。生成の前段に制約を差し込んで出力の質を担保する、Skill設計のfocus領域の実践例だ。
DHHがRails World 2026基調講演で、37signalsのHeyのバックエンドをエージェントが書いたRustへ移し、サーバーを110台から10台に削れると語った。コードをエージェントが書く時代には速いネイティブ言語を選ぶべきという主張で、Railsはほとんど言及されず“手書きコードの終焉”論として広く受け止められた。
HNは賛否が割れた。「Rust書き換えの成功率は良いテストスイートの有無に超線形で相関する。テストが尽きた後どう品質を保つのか(LLMはトートロジーなテストを書きがち)」という技術的懸念、「もうRuby on Railsですらない、ではエコシステムはどうなる」という戸惑いが一方に。他方でrobbyrussell(oh-my-zsh作者)は現場報告として「悲観一色ではない。多くは“修繕者”として既存システムを維持して食べており、新ツールはむしろ受け継いだ設計を見直す“許可”をくれる」と冷静に論じた。
ハッカー文化の古典「The Story of Mel」。最適化のために磁気ドラムメモリの回転位置まで計算してコードを配置した“真のプログラマ”メルの逸話で、抽象化に慣れた現代の目に機械と対話する凄みを思い出させる。
オープンソースAndroidアプリストアF-Droidが大規模刷新のv2.0を公開した。UI刷新に加え、特権拡張(FPE)を必要とせず標準のsessionインストーラで背景更新できるようになり、長年の使い勝手の課題に手が入った。
HNでは刷新を歓迎する声が中心で、Droid-ify/Neo Store/Obtainiumといった代替クライアントから戻る動きも。FPE(特権拡張)廃止を保守負担軽減として好意的に受け止める一方、依然としてレビュー・評価・DL数が無いことへの不満、Googleの締め付けが来年強まる中での将来像を問う声、そして本文が「LLMで書かれたのが残念」という指摘もあった。
RELEASE WATCH
maxProseWidth設定を追加し広い端末でも散文の幅を制限(表・コードは全幅維持)。復号できないweb検索結果を含む会話が全リクエスト400で落ちる不具合、--continue/--resume時に過去メッセージを改変送信し推論が欠落する不具合を修正した。
apps gatewayを拡張(desktopポリシー鍵、Bedrock upstreamのassume_role/guardrail、telemetry属性)。settings.jsonに"attribution":falseで帰属表記を全て隠す設定、plugin validateにMCP設定の検査を追加した。
Claude Opus 5.5(claude-opus-5-5)を既定Opusに追加(1Mコンテキスト、$4/$20 per Mtok)。symlink経由の書き込みが着地先でなく綴りで判定される不具合、auto modeが安全チェック不応答時に延々リトライする不具合を修正した。
Claude API/Enterpriseと各ゲートウェイでauto modeを既定でサーバー側分類器に変更し、分類オーバーヘッドを課金しないようにした。
AGENTS.md対応を追加。CLAUDE.mdが無いプロジェクトではAGENTS.mdを読み込む(Bedrock/Vertex/Foundryは未対応)。
OSS RANKING
FETCH STATUS