Claude Sonnet 5をAmazon Bedrockで使う方法

Verified on 2026-08-31

Claude Sonnet 5はAmazon Bedrockで利用できます。AWS公式モデルカードでは、1Mトークンのコンテキスト、最大128Kトークン出力、adaptive thinking、画像・テキスト入力、Converse/Invoke APIなどが案内されています。

Amazon BedrockClaude Sonnet 5Converse APIGlobal inference
1Mcontext window
128K最大出力tokens
Text + Image入力modalities
Activemodel lifecycle

Claude Sonnet 5のBedrock提供で何が変わったか

AWSは2026年6月30日、Claude Sonnet 5をAmazon BedrockとClaude Platform on AWSで提供すると発表しました。AWS公式発表では、コーディング、AIエージェント、日常的な専門業務を主な用途として挙げ、Sonnet 4.6からの更新として説明しています。

CODING

コードベース全体の作業

複数ファイルの変更、長いデバッグ、リファクタリングなど、計画を保ちながら進める開発作業が主な対象です。

AGENTS

複数段階のツール利用

依存関係を持つ処理や複数ツールの呼び出しを含む、顧客向け・社内向けエージェントの基盤として案内されています。

PROFESSIONAL WORK

長い資料の構造化

複雑で非構造な資料から、レポート、分析、ブリーフなどの構造化された成果物を作る用途です。

ただし、公式の用途説明は自社データでの品質保証ではありません。精度、遅延、費用、再現性、安全性は、実際の入力と評価基準を使って比較する必要があります。

Bedrockの主要仕様

項目AWS公式モデルカードの内容導入時の確認
コンテキスト1M tokens長い入力を毎回送ると費用と遅延も増えるため、検索・要約・キャッシュとの分担を決める
最大出力128K tokens必要な上限だけを設定し、無制限な長文生成を避ける
推論adaptive thinkingが既定で有効。effort調整と無効化に対応品質だけでなく、応答時間とtoken消費を比較する
入力/出力画像・テキスト入力、テキスト出力画像の権利、個人情報、保存範囲を先に確認する
知識cutoff2026年1月最新情報は検索・社内データ・人の確認で補う
prompt caching最小1,024 tokens、最大4 checkpoints、TTL 5分/1時間system、messages、toolsの再利用部分を分ける

bedrock-runtimeとbedrock-mantleの選び方

AWS公式モデルカードは2つのendpointを掲載し、新規アプリケーションでは可能な限りbedrock-runtimeを推奨しています。既存のBedrock機能を使うか、Anthropicのnative platform experienceへ寄せるかで選びます。

比較bedrock-runtimebedrock-mantle
主な位置づけAWS nativeなBedrock endpointAnthropic native API互換のendpoint
主なAPIConverse、Invoke、Messages、Responses、Chat CompletionsMessages、Responses、Chat Completions
Bedrock機能Guardrails、Knowledge Bases、評価、Prompt management、Flows、Agentsなどを利用可能利用できるBedrock機能は限定される
選ぶ目安AWSの認可・監視・Bedrock機能を一体で使うAnthropic APIの操作感やClaude Platform on AWSとの整合を優先する

モデルIDとデータ所在地

モデル名だけで呼び出し先を決めず、データ所在地と可用性の要件からinference IDを選びます。提供状況は変わるため、実装時にはAWSモデルカードのRegional Availabilityを再確認してください。

用途model/inference IDデータ所在地の考え方
base model IDanthropic.claude-sonnet-5endpointと提供方式に応じた識別子
US Geous.anthropic.claude-sonnet-5米国・カナダ内
EU Geoeu.anthropic.claude-sonnet-5EU内
AU Geoau.anthropic.claude-sonnet-5オーストラリア内
Globalglobal.anthropic.claude-sonnet-5世界各地へroutingされ、地域制約を設けない

東京リージョンの注意:2026年8月31日に確認したAWSモデルカードでは、ap-northeast-1のbedrock-runtimeはGlobalのみsupportedで、In-RegionとGeoはnot supportedです。「東京から呼ぶ」ことと「東京内だけで処理する」ことを同一視しないでください。

Amazon Bedrockで使い始める6ステップ

  1. 対象業務を限定する:コードレビュー、資料整理、agent workflowなど、入力・出力・最終確認者を1つの業務で定義します。
  2. データ所在地を決める:Global、US、EU、AUのどれが契約・社内規程・顧客条件に合うかを確認します。
  3. endpointとAPIを選ぶ:新規構築ならbedrock-runtimeとConverse APIを第一候補にし、必要なBedrock機能を照合します。
  4. accessとIAMを確認する:モデル利用条件を確認し、実行主体へ必要最小限のinvoke権限だけを付与します。
  5. 小さな評価セットで試す:代表入力、期待出力、失敗例、禁止事項を用意し、品質・遅延・token・費用を比較します。
  6. 監視と承認を設計する:tool実行、外部送信、更新・削除など副作用がある処理は、人の承認と監査logを分けて設計します。

Converse APIの最小例

次は東京リージョンからGlobal inference IDを指定する最小構成です。実行前に、現在の提供状況、利用条件、IAM、quota、料金を必ず確認してください。

import boto3

client = boto3.client(
    "bedrock-runtime",
    region_name="ap-northeast-1",
)

response = client.converse(
    modelId="global.anthropic.claude-sonnet-5",
    messages=[{
        "role": "user",
        "content": [{"text": "この設計案のリスクを3点に整理してください。"}],
    }],
    inferenceConfig={"maxTokens": 1024},
)

print(response["output"]["message"]["content"][0]["text"])

料金とservice tierの確認

Claude Sonnet 5はAWS Marketplace経由のthird-party modelとして請求され、費用はAWS請求書とCost Explorerでmodel provider側に表示されます。モデルカードではStandard、Priority、Flex、Reservedのservice tierが案内されています。

STANDARD

通常の従量利用

commitmentなしのpay-per-token。まず評価を始める場合の基準です。

PRIORITY / FLEX

速度または費用を調整

応答速度を優先するPriorityと、時間に余裕のある処理を低コスト化するFlexを用途で分けます。

RESERVED

予測可能な専用throughput

期間commitmentを伴うため、実測trafficと継続要件を確認してからAWS担当者へ相談します。

本番導入前の確認事項

  • 品質:長いcontextやthinkingを使えば必ず正確になるわけではない。誤答、欠落、形式崩れを評価する
  • 費用:入力・出力・thinking・cache・再試行を含め、1業務あたりの費用を測る
  • 安全:prompt injection、tool権限、外部送信、秘密情報、生成codeの実行を別々に制御する
  • 可用性:service quota、throttling、timeout、fallback、再実行時の二重処理を設計する
  • 監査:入力全文を無条件保存せず、目的に必要なID、判定、承認、結果を最小限記録する
  • 鮮度:モデルカード、regional availability、API、料金は変わるため、公開時点の確認日を残す

長いcontextは設計の代替ではありません。必要な情報を検索して絞り込み、再利用部分をcacheし、最終判断に必要な根拠を出力させる構成の方が、費用・遅延・確認しやすさを管理できます。

よくある質問

Claude Sonnet 5はAmazon Bedrockで利用できますか?

はい。AWSは2026年6月30日に提供開始を発表し、2026年8月31日時点のモデルカードではlifecycleがActiveです。

モデルIDは何ですか?

base model IDはanthropic.claude-sonnet-5です。bedrock-runtimeのcross-region inferenceではUS、EU、AU、Globalのinference IDが案内されています。

東京リージョン内だけで処理できますか?

2026年8月31日時点のモデルカードでは、東京のbedrock-runtimeはGlobalのみsupportedです。東京から呼び出せても、東京内だけの処理を意味しません。

Converse APIとInvoke APIのどちらを選びますか?

複数モデルで共通形式を使う新規実装ではConverse APIが扱いやすい選択です。既存実装、対応機能、request形式によりInvokeを選ぶ場合もあります。

1Mトークンすべてを毎回使うべきですか?

いいえ。長い入力は費用と遅延を増やします。検索、要約、prompt cachingを使い、判断に必要な範囲へ絞ります。

料金はいくらですか?

価格は変更されるため、固定額をこの記事へ転記していません。Amazon Bedrockの料金表とAWS Marketplaceの利用条件を実装時に確認してください。

公式情報

関連する実装判断

MODEL SELECTION

Bedrockモデルの比較軸

料金、リージョン、quota、context、更新日の比較から評価候補を絞ります。

TOOL USE

Programmatic Tool Calling

複数toolの実行をcode側へ移す場合の採用判断と安全境界を整理します。

From update to implementation

モデル選定だけでなく、評価データ、権限、費用、安全策、既存業務への組み込みまで整理する場合は、小さな検証から支援できます。

AIアップデートを、自社の業務改善へつなげる
新機能をすぐ導入する前に、目的・対象業務・確認責任・情報管理・費用対効果を6項目で整理します。
生成AI業務導入ガイドを読む