BlogPage 3 / 25
ツールが増えたら見直す設計——Tool Search入門
AIエージェントのツール選択精度は30〜50個を境に低下する。Tool Search Toolのdefer_loadingで中小企業がどう導入基準を設計すべきかを解説する。
MCP進捗通知とキャンセルの非対称設計——2026仕様
MCPの進捗通知とキャンセレーションは2026-07-28確定仕様でクライアント起点に非対称化された。トランスポート別のキャンセル信号とタイムアウト設計を整理する。
AIエージェントの緊急停止設計とキルスイッチ実装
AIエージェントの緊急停止は、LLMの推論経路の外側にトリガー・3段階エスカレーション・監査ログを実装します。EU AI Act第14条は高リスクAIシステムに停止手段を義務付けています。
Citations APIで実装する検証可能なRAG引用設計
Claude Citations APIは引用元テキストをcited_textとして返し出力トークンに加算しない。char_location等3種の引用形式とRAG実装への組み込み方を解説する。
AG-UIプロトコル入門——エージェントとUIをつなぐ設計
AG-UIはエージェントとフロントエンドをイベントストリームで結ぶオープンプロトコルで、2026年3月にAWS Bedrock AgentCoreも対応した約16種のイベント型が中核です。
Claude APIで作る最小構成ガードレール実装手順
Claude APIのコンテンツモデレーション機能を使えば、中小企業でも専門のML基盤なしにガードレールを最小構成で実装できる。Haiku 4.5なら1万件処理で約37ドルだ。
AIエージェントの暴走コスト対策——ステップ上限とスペンド制御
AIエージェントは悪意ある入力で無限ループに陥り月次コストが跳ね上がることがある。OWASP LLM10:2025のUnbounded Consumptionと、ステップ上限・Workspaceスペンド制御による防御設計を解説する。
Inspect AIでエージェント評価基盤を設計する
Inspect AIはUK AISI製のOSS評価フレームワークで、Task・Solver・Scorerの3層構成とサンドボックス実行でエージェント評価を再現可能にします。MITライセンスで200超の公開評価を利用できます。
AI生成コンテンツの来歴表示——中小企業のC2PA対応点
中小企業はC2PA暗号署名の独自実装までは不要で、生成AIツールのメタデータ記録機能を使う範囲で大半に対応できる。EU AI Act第50条は2026年8月2日に施行済みだ。
エージェント評価のラベリング体制設計とIAA指標選定
AIエージェント評価のラベリング体制は、2〜3名の重複アノテーションとタスク特性に応じたIAA指標選定でルーブリックの曖昧さを検出して設計します。Anthropicのevalガイドと指標選定研究に基づき解説します。