
生成AIによるイメージ画像です。実際の製品画面や出来事の記録ではありません。
2025年9月29日、AnthropicはClaude Sonnet 4.5を発表しました。注目点は、短いコードの補完にとどまらず、調査、修正、動作確認をつなぐ長い作業を支える方向へ進んだことです。この発表を振り返ると、AIの性能と同じくらい、仕事の任せ方が重要になった転換点が見えてきます。
長時間動くことと、完成すること
Anthropicは発表時、複雑な複数段階の課題に30時間以上集中した事例を紹介しました。これは同社の観測であり、あらゆる仕事を無人で30時間こなせるという保証ではありません。評価環境で続けられた時間と、自社の古いシステムで安全に完了できる範囲は分けて読む必要があります。
同時にClaude Codeには作業途中へ戻れるチェックポイントなどが加わり、Agent SDKも公開されました。モデルだけを強くするのではなく、途中経過を残し、道具を使い、失敗したら戻る仕組みを整えた点が実務上の変化です。長い処理ほど、最後の返事だけでは何が行われたか分かりにくくなります。
小さな改修で考えてみる
たとえば社内サイトの問い合わせフォームを直す場合、依頼は「使いやすくして」だけでは足りません。入力エラーを再現する、原因を探す、該当箇所を直す、送信成功と失敗の両方を確認する。こうした完了条件を先に伝えると、途中で見た目だけを整えて終わるようなずれを減らせます。これは説明用の例であり、特定企業の導入実績ではありません。
また、コードを変更する権限と、本番へ公開する権限は別に扱いたいところです。修正案を作る段階では自由に試せても、顧客が使う環境への反映には人の確認を残す。長く自律的に動けるからこそ、止まる場所を決める意味が大きくなります。
比較するなら、レビューまでの時間
新モデルを試すときは、生成にかかった秒数だけで判断しないほうが実態をつかめます。担当者が依頼文を整えた時間、出力を読み直した時間、手戻りを直した時間を含めて比べると、普段の業務に合うかが分かります。小さな既知の不具合を同じ条件で任せ、直してはいけない部分が保たれたかを見る方法が現実的です。
日本語の仕様書があるなら、用語の対応も確認対象です。「登録」と「申請」、「削除」と「非表示」のように似た言葉でも操作の意味は異なります。AIが仕様を言い換えたときに、その区別まで消えていないかを確認しましょう。説明が滑らかでも、実装の前提が合っているとは限りません。
2026年から見た位置づけ
2026年2月にはSonnet 4.6も発表されており、4.5は最新モデルの購入案内としてではなく、長い仕事を扱うAIが広がった時期の出来事として読むのが適切です。モデル名が変わっても、対象を絞り、途中経過を残し、実際の利用経路で完成を確かめるという考え方は使えます。
AIが長く働くほど、人の役割は細かな指示の繰り返しから、目的、許可範囲、合格条件の設定へ移っていきます。最初に任せる仕事を一つ選ぶなら、結果を自分で判定でき、失敗しても戻せる作業がよい出発点になります。
引き継ぎ方も試しておきましょう。途中で担当者が交代したとき、変更理由と未確認の点が残っていれば、最初から調べ直さずに済みます。作業を再開できる記録まで含めて成果物と考えると、長時間の自動処理が単に長いだけで終わるのを防げます。成功した一回だけでなく、止めた一回の後始末も見ておくことが、安心して任せる範囲を決める材料になります。
参考・出典
本稿は2026年9月12日時点で確認した公式情報に基づく振り返りです。発表時の計画と、その後の提供状況を区別して記載しています。
オリジナル記事、著者:AIの番人,転載の際には、出典を明記してください:https://nipponai.jp/article/claude-sonnet-4-5%e3%82%92%e6%8c%af%e3%82%8a%e8%bf%94%e3%82%8b%ef%bc%9aai%e3%81%ab%e9%95%b7%e3%81%84%e4%bb%95%e4%ba%8b%e3%82%92%e4%bb%bb%e3%81%9b%e3%82%8b%e3%81%9f%e3%82%81%e3%81%ab%e5%bf%85%e8%a6%81/