Verified on 2026-08-31
Claude Sonnet 5はAmazon Bedrockで利用できます。AWS公式モデルカードでは、1Mトークンのコンテキスト、最大128Kトークン出力、adaptive thinking、画像・テキスト入力、Converse/Invoke APIなどが案内されています。
Claude Sonnet 5のBedrock提供で何が変わったか
AWSは2026年6月30日、Claude Sonnet 5をAmazon BedrockとClaude Platform on AWSで提供すると発表しました。AWS公式発表では、コーディング、AIエージェント、日常的な専門業務を主な用途として挙げ、Sonnet 4.6からの更新として説明しています。
コードベース全体の作業
複数ファイルの変更、長いデバッグ、リファクタリングなど、計画を保ちながら進める開発作業が主な対象です。
複数段階のツール利用
依存関係を持つ処理や複数ツールの呼び出しを含む、顧客向け・社内向けエージェントの基盤として案内されています。
長い資料の構造化
複雑で非構造な資料から、レポート、分析、ブリーフなどの構造化された成果物を作る用途です。
ただし、公式の用途説明は自社データでの品質保証ではありません。精度、遅延、費用、再現性、安全性は、実際の入力と評価基準を使って比較する必要があります。
Bedrockの主要仕様
| 項目 | AWS公式モデルカードの内容 | 導入時の確認 |
|---|---|---|
| コンテキスト | 1M tokens | 長い入力を毎回送ると費用と遅延も増えるため、検索・要約・キャッシュとの分担を決める |
| 最大出力 | 128K tokens | 必要な上限だけを設定し、無制限な長文生成を避ける |
| 推論 | adaptive thinkingが既定で有効。effort調整と無効化に対応 | 品質だけでなく、応答時間とtoken消費を比較する |
| 入力/出力 | 画像・テキスト入力、テキスト出力 | 画像の権利、個人情報、保存範囲を先に確認する |
| 知識cutoff | 2026年1月 | 最新情報は検索・社内データ・人の確認で補う |
| prompt caching | 最小1,024 tokens、最大4 checkpoints、TTL 5分/1時間 | system、messages、toolsの再利用部分を分ける |
bedrock-runtimeとbedrock-mantleの選び方
AWS公式モデルカードは2つのendpointを掲載し、新規アプリケーションでは可能な限りbedrock-runtimeを推奨しています。既存のBedrock機能を使うか、Anthropicのnative platform experienceへ寄せるかで選びます。
| 比較 | bedrock-runtime | bedrock-mantle |
|---|---|---|
| 主な位置づけ | AWS nativeなBedrock endpoint | Anthropic native API互換のendpoint |
| 主なAPI | Converse、Invoke、Messages、Responses、Chat Completions | Messages、Responses、Chat Completions |
| Bedrock機能 | Guardrails、Knowledge Bases、評価、Prompt management、Flows、Agentsなどを利用可能 | 利用できるBedrock機能は限定される |
| 選ぶ目安 | AWSの認可・監視・Bedrock機能を一体で使う | Anthropic APIの操作感やClaude Platform on AWSとの整合を優先する |
モデルIDとデータ所在地
モデル名だけで呼び出し先を決めず、データ所在地と可用性の要件からinference IDを選びます。提供状況は変わるため、実装時にはAWSモデルカードのRegional Availabilityを再確認してください。
| 用途 | model/inference ID | データ所在地の考え方 |
|---|---|---|
| base model ID | anthropic.claude-sonnet-5 | endpointと提供方式に応じた識別子 |
| US Geo | us.anthropic.claude-sonnet-5 | 米国・カナダ内 |
| EU Geo | eu.anthropic.claude-sonnet-5 | EU内 |
| AU Geo | au.anthropic.claude-sonnet-5 | オーストラリア内 |
| Global | global.anthropic.claude-sonnet-5 | 世界各地へroutingされ、地域制約を設けない |
東京リージョンの注意:2026年8月31日に確認したAWSモデルカードでは、ap-northeast-1のbedrock-runtimeはGlobalのみsupportedで、In-RegionとGeoはnot supportedです。「東京から呼ぶ」ことと「東京内だけで処理する」ことを同一視しないでください。
Amazon Bedrockで使い始める6ステップ
- 対象業務を限定する:コードレビュー、資料整理、agent workflowなど、入力・出力・最終確認者を1つの業務で定義します。
- データ所在地を決める:Global、US、EU、AUのどれが契約・社内規程・顧客条件に合うかを確認します。
- endpointとAPIを選ぶ:新規構築ならbedrock-runtimeとConverse APIを第一候補にし、必要なBedrock機能を照合します。
- accessとIAMを確認する:モデル利用条件を確認し、実行主体へ必要最小限のinvoke権限だけを付与します。
- 小さな評価セットで試す:代表入力、期待出力、失敗例、禁止事項を用意し、品質・遅延・token・費用を比較します。
- 監視と承認を設計する:tool実行、外部送信、更新・削除など副作用がある処理は、人の承認と監査logを分けて設計します。
Converse APIの最小例
次は東京リージョンからGlobal inference IDを指定する最小構成です。実行前に、現在の提供状況、利用条件、IAM、quota、料金を必ず確認してください。
import boto3
client = boto3.client(
"bedrock-runtime",
region_name="ap-northeast-1",
)
response = client.converse(
modelId="global.anthropic.claude-sonnet-5",
messages=[{
"role": "user",
"content": [{"text": "この設計案のリスクを3点に整理してください。"}],
}],
inferenceConfig={"maxTokens": 1024},
)
print(response["output"]["message"]["content"][0]["text"])
料金とservice tierの確認
Claude Sonnet 5はAWS Marketplace経由のthird-party modelとして請求され、費用はAWS請求書とCost Explorerでmodel provider側に表示されます。モデルカードではStandard、Priority、Flex、Reservedのservice tierが案内されています。
通常の従量利用
commitmentなしのpay-per-token。まず評価を始める場合の基準です。
速度または費用を調整
応答速度を優先するPriorityと、時間に余裕のある処理を低コスト化するFlexを用途で分けます。
予測可能な専用throughput
期間commitmentを伴うため、実測trafficと継続要件を確認してからAWS担当者へ相談します。
本番導入前の確認事項
- 品質:長いcontextやthinkingを使えば必ず正確になるわけではない。誤答、欠落、形式崩れを評価する
- 費用:入力・出力・thinking・cache・再試行を含め、1業務あたりの費用を測る
- 安全:prompt injection、tool権限、外部送信、秘密情報、生成codeの実行を別々に制御する
- 可用性:service quota、throttling、timeout、fallback、再実行時の二重処理を設計する
- 監査:入力全文を無条件保存せず、目的に必要なID、判定、承認、結果を最小限記録する
- 鮮度:モデルカード、regional availability、API、料金は変わるため、公開時点の確認日を残す
長いcontextは設計の代替ではありません。必要な情報を検索して絞り込み、再利用部分をcacheし、最終判断に必要な根拠を出力させる構成の方が、費用・遅延・確認しやすさを管理できます。
よくある質問
Claude Sonnet 5はAmazon Bedrockで利用できますか?
はい。AWSは2026年6月30日に提供開始を発表し、2026年8月31日時点のモデルカードではlifecycleがActiveです。
モデルIDは何ですか?
base model IDはanthropic.claude-sonnet-5です。bedrock-runtimeのcross-region inferenceではUS、EU、AU、Globalのinference IDが案内されています。
東京リージョン内だけで処理できますか?
2026年8月31日時点のモデルカードでは、東京のbedrock-runtimeはGlobalのみsupportedです。東京から呼び出せても、東京内だけの処理を意味しません。
Converse APIとInvoke APIのどちらを選びますか?
複数モデルで共通形式を使う新規実装ではConverse APIが扱いやすい選択です。既存実装、対応機能、request形式によりInvokeを選ぶ場合もあります。
1Mトークンすべてを毎回使うべきですか?
いいえ。長い入力は費用と遅延を増やします。検索、要約、prompt cachingを使い、判断に必要な範囲へ絞ります。
料金はいくらですか?
価格は変更されるため、固定額をこの記事へ転記していません。Amazon Bedrockの料金表とAWS Marketplaceの利用条件を実装時に確認してください。
公式情報
- AWS公式発表:Introducing Claude Sonnet 5 on AWS
- AWS公式モデルカード:Claude Sonnet 5
- AWS公式:Converse API
- AWS公式:Amazon Bedrock料金
関連する実装判断
Bedrockモデルの比較軸
料金、リージョン、quota、context、更新日の比較から評価候補を絞ります。
Programmatic Tool Calling
複数toolの実行をcode側へ移す場合の採用判断と安全境界を整理します。
BedrockとMCPのビジョンAI
画像入力、Rekognition、MCP、workflowの役割分担を確認します。
From update to implementation
モデル選定だけでなく、評価データ、権限、費用、安全策、既存業務への組み込みまで整理する場合は、小さな検証から支援できます。