OPENAI SEARCH INSIGHT
OpenAI、Agents APIにブラウザ操作「computer use」を追加
この記事で分かること: OpenAIがAgents APIに追加したcomputer useの公式仕様と、日本の開発・運用チームが確認すべき実務上の論点を知りたい。
OpenAIは2026年9月29日、Agents APIに「computer use」機能を追加したと発表した。エージェントはOpenAIがホストするブラウザ上でタスクを実行でき、Webサイトへのアクセス承認とサインインは利用側のアプリケーションが扱う仕組みとされる。
開発者にとっての要点は、AIエージェントのWeb操作を設計する際に、ブラウザ実行環境だけでなく、アクセス許可と認証情報の受け渡しをアプリケーション側の責務として設計する必要がある点だ。公式発表で確認できる範囲では、機能の提供開始、価格、対応地域、利用上限、対応する認証方式の詳細は示されていない。
OpenAIが発表したcomputer useの内容
今回の公式発表は、OpenAIのFeatureとして公開された。発表文は、Agents APIへcomputer useを加えたこと、エージェントがOpenAIホストのブラウザでタスクを完了できることを明記している。
ここでいうcomputer useは、Agents APIを通じてエージェントにブラウザ上の作業を担わせるための機能として位置付けられる。公式文面には、エージェントがどのようなWeb操作を行えるか、個別サイトでの互換性がどうなるかといった詳細までは記載されていない。
また、ブラウザ環境についてはOpenAI-hosted browser、すなわちOpenAIがホストするブラウザであることが示されている。利用企業が自社端末や自社クラウドにブラウザを配置する構成なのかどうかは、今回確認できた公式文面だけでは判断できない。
アクセス承認とサインインはアプリ側が扱う
発表で特に重要なのは、Webサイトへのアクセス承認とサインインについて、利用者のアプリケーションが処理するという記述だ。OpenAIは、これらを「your application」、つまり導入側のアプリケーションが扱うものとして説明している。
したがって、Agents APIを呼び出すだけで、エージェントが任意の外部サイトへ自律的にログインし、自由にアクセスできると読み替えることはできない。サイトアクセスの承認とログイン処理はアプリケーション側で扱うという点が、公式に確認された利用条件である。
これは認証情報、セッション、承認画面、権限の範囲を、プロダクト側が明示的に管理する前提を示す。もっとも、OAuthなどの具体的な認証プロトコル、資格情報の保存場所、承認フローの画面仕様について、公式発表は詳細を示していない。
技術チームがまず評価すべき設計論点
導入を検討するチームは、ブラウザ操作そのものの成否だけでなく、誰が、どのサイトに、どの権限でアクセスを許可するのかを要件として分解する必要がある。特に業務システムでは、閲覧権限と更新・送信・購入などの実行権限を同一視しない設計が重要になる。
- エージェントに許可する対象サイト、URL範囲、業務画面を定義する
- ログインが必要な操作について、認証の開始者と承認者を決める
- 参照、入力、送信、変更といった操作ごとに権限を分ける
- エージェントの実行結果を業務システムへ反映する前の確認手順を設ける
- 失敗時、認証切れ、承認拒否時の利用者向け処理を設計する
こうした論点は今回の発表に実装仕様として書かれているわけではない。一方で、承認とサインインをアプリケーションが扱うという公式の前提から、導入側が設計判断を担う領域として整理しておく価値がある。
日本の実務で確認したいガバナンス
日本企業が業務利用を検討する場合、認証情報や顧客情報を含む画面をエージェントが扱う可能性を想定し、社内の情報セキュリティ、法務、業務部門の確認を早期に組み込むべきだ。実際にどのデータがどこで処理されるかは、提供される正式な技術文書や契約条件で確認する必要がある。
とりわけ、OpenAIホストのブラウザを利用するという発表内容を踏まえ、データ分類、外部サービス利用の承認、監査上必要な記録、委託先管理の扱いを既存ルールに照らして検討したい。今回の短い発表だけでは、データ保持や監査ログの仕様は確認できない。
運用面では、AIが操作候補を提示する段階と、外部サービスに対して確定操作を行う段階を分ける考え方も有効だ。高い影響を持つ処理では人の確認を要求するなど、業務リスクに応じた承認設計を検討する余地がある。
公式発表からは判断できない項目
今回確認できるOpenAI公式情報は、computer useがAgents APIに加わったこと、OpenAIホストのブラウザでタスクを行えること、アクセス承認とサインインをアプリケーションが扱うことに限られる。これを超える仕様は、現時点では公式発表の記述から断定できない。
- 利用できる国・地域、組織、アカウントの範囲
- 料金体系、無料利用の有無、API利用量の扱い
- 利用可能なWebサイトやブラウザ機能の範囲
- 画像、ファイル、ダウンロード、アップロードの対応状況
- ログ、データ保持、セキュリティ管理の詳細仕様
- ベータ版か正式提供かを含む提供段階の位置付け
そのため、実装計画では未公表の条件を前提にしないことが重要だ。公開日として確認できるのは2026年9月29日であり、個別の提供条件や将来の機能拡張については、別途の公式情報を確認する必要がある。
Agent Memories編集部の考察
今回の発表の新規性は、エージェントにブラウザ操作の実行場所を与える点と、認証・承認をアプリケーション側の制御点として明示した点にある。AIエージェントの実用化では、モデルの判断能力に加え、外部サービスへの接続をどう安全に統制するかが導入成否を左右する。
編集部としては、computer useを単なる画面自動化機能として評価するより、業務フローにおける「認証済み操作のオーケストレーション」として捉えることを勧める。ブラウザで作業できることと、業務上その操作を任せてよいことは別問題だからだ。
優先順位としては、まず低リスクで可逆性の高い閲覧・情報収集・下書き作成などを候補にし、その後に入力や送信を含む処理へ広げる方法が考えられる。ただしこれは公式の推奨ではなく、公式発表で示されたアプリケーション側の承認・サインイン管理を踏まえた編集部の運用上の考察である。
また、導入評価ではタスク完了率だけでなく、承認が必要になった場面、ログイン失敗時の復旧、想定外画面への遷移、操作結果の検証可能性を測るべきだ。エージェントの実行権限を最小化し、段階的に広げることが、業務導入では有力な選択肢になる。
よくある質問
computer useとは何ですか
OpenAIがAgents APIに追加した機能で、エージェントがOpenAIホストのブラウザでタスクを完了できると公式に説明されている。具体的な操作可能範囲や対応サイトの詳細は、今回の発表文には記載されていない。
エージェントは自動でWebサイトにログインしますか
公式発表では、Webサイトへのアクセス承認とサインインは利用側のアプリケーションが扱うとされている。そのため、ログインの具体的な実装や承認フローは、導入するアプリケーションの設計と追加の公式仕様を確認して判断する必要がある。
すぐに本番業務で利用できますか
本番利用の可否は、機能の利用可能範囲、契約条件、セキュリティ要件、対象業務のリスクなどに左右される。今回の公式発表だけでは、すべての利用条件や運用要件は確認できないため、未確認事項を補わずに評価を進めるべきだ。
価格やAPI利用条件は公表されていますか
確認済みの公式発表文には、価格、課金単位、利用上限、対象プランに関する記載はない。これらはOpenAIが別途示す公式情報で確認する必要がある。
まとめ
OpenAIは2026年9月29日、Agents APIへcomputer useを追加した。エージェントはOpenAIホストのブラウザでタスクを実行できる一方、Webサイトへのアクセス承認とサインインは導入側アプリケーションが扱う。
開発・AI運用チームは、ブラウザ操作の能力だけを比較するのではなく、認証、権限、承認、監査、例外処理を含むアプリケーション設計を見直す必要がある。価格や提供範囲など公式に未記載の条件は推測で補わず、追加の一次情報を確認しながら評価を進めることが重要だ。
公式出典・確認日
OpenAI公式情報を2026-10-01時点で確認しています。提供範囲・料金・画面は更新される場合があります。
新しいAIへ乗り換えても、自分の前提や判断を持ち運べる状態をつくる。Agent Memoriesは、記憶をスキルや外部ツールへつなぐAIパートナー基盤を育てています。
AIエージェントの記憶を知る Agent Memoriesを見る本カテゴリはMiraigent / Agent Memoriesによる非公式編集記事です。OpenAIとの提携・承認・後援を示すものではありません。