AI エージェント

ホーム/タグ一覧/AI エージェント

11件の記事

Anthropic Engineering Blog の歩き方 — 2024-2026 年の必読記事 15 選

Anthropic Engineering Blog の歩き方 — 2024-2026 年の必読記事 15 選

2026年10月1日

Anthropic Engineering Blog (anthropic.com/engineering) は AI エージェント開発の一次情報として現時点で最良のソース。Building effective agents、Context engineering、Multi-agent research system、Claude Code best practices など、2024-2026 年に公開された必読記事 15 本を分野別に整理し、どれから読むべきか・どう実務に落とすかを案内する。

tech-blogAnthropicClaude
AI エージェント並列化で開発速度 10 倍 — 1 人で 5 体の Claude Code を動かすワークフロー

AI エージェント並列化で開発速度 10 倍 — 1 人で 5 体の Claude Code を動かすワークフロー

2026年8月25日

AI エージェントを 1 体ずつ順番に使う時代は 2024 年で終わった。2026 年の実践は、Claude Code や Codex を 3-5 体並列で動かし、その間に自分は別の設計に集中する。1 人開発者の生産性を実質 10 倍にする並列ワークフローの組み方、ハマりポイント、必要なインフラ (git worktree / tmux / 通知経路 / コックピット) を解説する。

tech-blogAI エージェント並列開発
Claude Code の auto mode 完全ガイド — 権限確認を抑えて安全に自動実行する

Claude Code の auto mode 完全ガイド — 権限確認を抑えて安全に自動実行する

2026年4月5日

Claude Code の auto mode は、ツール実行のたびに人間に確認を取る挙動を抑え、作業スループットを数倍に上げる。Anthropic が 2026 年 3 月に導入した仕組みで、安全性を担保するために blast radius の分類と deny リストの設計が前提になる。本稿では auto mode を使う判断基準、deny リストの書き方、落とし穴と対策、MulmoTerminal の 9 セル並列運用での実用例を整理する。

tech-blogClaude Codeauto mode
AI エージェントの evaluation (evals) 入門 — 「それっぽく動く」を数値で担保する方法

AI エージェントの evaluation (evals) 入門 — 「それっぽく動く」を数値で担保する方法

2026年2月10日

AI エージェントの evaluation (evals) は、「それっぽく動く」を数値で担保する唯一の方法。本記事では、unit test では捉えられない AI 特有の非決定性、LLM-as-a-judge の使いどころと落とし穴、統計的妥当性のためのサンプル数、本番モニタリングとの関係を、実装パターンとともに整理する。Anthropic Engineering Blog の evals シリーズも参照。

tech-blogevaluationevals
Claude Code の hooks 完全ガイド — PreToolUse / PostToolUse でエージェントを規律化する

Claude Code の hooks 完全ガイド — PreToolUse / PostToolUse でエージェントを規律化する

2025年11月15日

Claude Code の hooks は、エージェントのツール実行の前後やセッション停止時に任意のシェルコマンドを割り込ませる仕組み。PreToolUse / PostToolUse / Stop / UserPromptSubmit の 4 種類を使うと、危険なコマンドのブロック、自動ログ、プロジェクト固有の品質ゲート、CI 連携まで組める。本稿では設定ファイルの書き方、代表的なユースケース、落とし穴を実例で整理する。

tech-blogClaude Codehooks
Agent Skills とは — 自作スキルで Claude に専門性を注入する実践ガイド

Agent Skills とは — 自作スキルで Claude に専門性を注入する実践ガイド

2025年10月28日

Agent Skills は、エージェントに「特定の仕事のやり方」を packaged なプロンプト + ツール + サンプルとして渡す仕組み。Anthropic が 2025 年 10 月に導入し、Claude Desktop / Claude Code / Claude.ai で動く。モデルの重みを変えずに専門性を注入でき、社内ノウハウを再利用可能な資産に変える。本稿では SKILL.md の書き方、スキル分割の原則、MulmoTerminal / MulmoClaude での実運用例まで整理する。

tech-blogAgent SkillsClaude
Context Engineering 入門 — プロンプトエンジニアリングの次に来るもの

Context Engineering 入門 — プロンプトエンジニアリングの次に来るもの

2025年10月10日

Anthropic が 2025 年 9 月に提唱した「Context Engineering」は、プロンプトエンジニアリングの次に来る概念。1 ターンの指示文を最適化する従来のアプローチから、長時間動くエージェント全体の文脈 (system prompt / tools / external data / message history) を設計する時代へ。Context rot、Compaction、Structured note-taking、Sub-agent architectures、Just-in-time retrieval の 5 技法を実例とともに解説する。

tech-blogContext EngineeringPrompt Engineering
マルチエージェント研究システムの作り方 — Anthropic Deep Research の設計から学ぶ

マルチエージェント研究システムの作り方 — Anthropic Deep Research の設計から学ぶ

2025年7月1日

ChatGPT の Deep Research や Claude の Research 機能は、裏で複数の AI エージェントが並列動作して結果を統合するマルチエージェント構成。Anthropic が 2025 年 6 月に公開した「How we built our multi-agent research system」から、オーケストレーター + サブエージェント設計、並列検索、結果マージ、評価ループ、コスト 10-15 倍の正当化を解説。自前実装のパターンまで。

tech-blogマルチエージェントDeep Research
Software 3.0 とは — AI 時代のプログラミング・パラダイムとエンジニアの新しい役割

Software 3.0 とは — AI 時代のプログラミング・パラダイムとエンジニアの新しい役割

2025年6月25日

Andrej Karpathy が 2017 年に提唱した「Software 2.0」の続編として 2025 年に広まった Software 3.0 は、「自然言語でソフトウェアを書く」パラダイム。1.0 は人間が書くコード、2.0 はデータから学ばせる重み、3.0 はプロンプトで動く LLM 自身がプログラム。Claude Code や Codex の普及で理論から実装へ移行した 2026 年現在の実態と、エンジニアに求められる新しい役割を整理する。

tech-blogSoftware 3.0AI プログラミング
MCP (Model Context Protocol) 入門 — AI エージェントに外の世界を触らせる標準

MCP (Model Context Protocol) 入門 — AI エージェントに外の世界を触らせる標準

2025年2月10日

MCP (Model Context Protocol) は、Anthropic が 2024 年末に発表した「AI エージェントが外部ツールやデータにアクセスするための標準プロトコル」。Claude Code、Cursor、Windsurf、各種エディタで対応が広がっている。ランタイム・JSON-RPC・STDIO / SSE / HTTP 伝送・tools / resources / prompts の 3 概念、既存の有名 MCP サーバー 10 選、自作の最小例、Claude Code や MulmoTerminal から呼ぶ方法を 1 ページで整理する。

tech-blogMCPModel Context Protocol
「Building Effective Agents」を実務に落とす — Anthropic 公式ガイドの 5 パターンと設計原則

「Building Effective Agents」を実務に落とす — Anthropic 公式ガイドの 5 パターンと設計原則

2025年1月10日

Anthropic が 2024 年末に公開した「Building effective agents」は、AI エージェント開発の全体像を整理した定本。本稿は原文の 5 つの基本パターン (Prompt chaining / Routing / Parallelization / Orchestrator-workers / Evaluator-optimizer)、ワークフローとエージェントの違い、フレームワーク非依存の思想を日本語で解説し、どう実務に落とすかを MulmoTerminal の実例を交えて示す。

tech-blogAI エージェントAnthropic