Agent Memories
← OpenAI最新情報

OPENAI SEARCH INSIGHT

2026.10.05 / OpenAI最新情報

GPT-6 Astra、Basisの税務作業簿を半分の時間で完了

Agent Memories編集部による非公式記事「GPT-6 Astra、Basisの税務作業簿を半分の時間で完了」。OpenAIとの提携・承認はありません

この記事で分かること: GPT-6 Astraが税務向けAIエージェントの長時間作業で示した性能と、一般利用者が実務で注意すべき点を知りたい。

OpenAIは2026年9月28日、会計業務向けAIエージェントを開発するBasisの事例として、GPT-6 Astraが50タブの複雑な税務作業簿をGPT-5.6 Solの半分の時間で完了したと発表しました。比較対象はBasisが実施した評価であり、正確かつ信頼性を持って作業簿を完成させることが課題でした。

一般のChatGPT利用者にとって重要なのは、単に回答速度が上がったという話ではありません。OpenAIの発表では、GPT-6 Astraは利用者の目的をよりよく理解し、質問すべき場面、前提を明示すべき場面、指示に従う場面を見分けることで、長く複雑な業務を進めやすくしたとされています。

OpenAIが発表したBasisでの検証結果

Basisは、会計士が日々行う手作業の多くを自動化するAIエージェントを開発する企業です。AIエージェントとは、質問への一回限りの返答だけでなく、複数の手順をまたぐ仕事を進めるよう設計されたAIシステムを指します。Basisは特に、長い作業を確実に完了できるエージェントの研究を進めています。

今回の公式発表では、Basisが50タブから成る複雑な税務作業簿でGPT-6 AstraとGPT-5.6 Solを比較しました。Basis共同創業者のMitch Troyanovsky氏は、GPT-6 Astraについて、利用者の意図と解決すべき問題をよりよく理解すると説明しています。

検証で求められたのは、単純に表の一部を埋めることではなく、作業簿を正確かつ信頼できる形で完成させることでした。OpenAIは、GPT-6 Astraがこの作業をGPT-5.6 Solより著しく速く実行し、Basisの説明では所要時間は約半分だったと伝えています。

50タブの税務作業簿で何が変わったのか

税務作業簿のようにタブ数が多い文書では、前の処理結果を踏まえて次の作業を選び、複数の条件や書式を保ちながら進める必要があります。一部だけ正しくても、参照関係や前提が崩れれば、全体の成果物としては使いにくくなります。

Basisによると、GPT-6 Astraは作業の初期段階でより良い判断を行う傾向がありました。その結果、Basisのエージェントは遠回りを減らし、誤りを修正するために費やす時間を抑えながら、より直接的な手順で仕事を進められたとしています。

これは「速く入力する」性能だけを意味しません。長い仕事では、最初に何を確認し、どの前提を置き、どこで確認を求めるかという判断が、後工程のやり直し量を左右します。公式発表は、GPT-6 Astraがこうした意図の把握でBasisにより大きな確信を与えたという事例です。

難しい工程に推論を配分する仕組み

BasisはGPT-6 Astraに対し、作業の進行に応じて使う推論量を調整させています。推論量とは、回答や判断に向けてAIが処理に充てる計算の度合いです。難しい手順では計算を増やし、比較的容易な手順では抑える運用を行っていると説明されています。

OpenAIの発表によれば、この調整はキャッシュを維持したまま行えます。キャッシュは、作業の途中で得た文脈や処理結果を再利用するための情報です。Basisはこの仕組みにより、長時間にわたる処理のコストと応答時間を下げ、顧客にとっても経済性を高められると見ています。

ただし、公式発表はBasisでの運用事例を示したものであり、すべての文書作成、表計算、税務判断で同じ時間短縮率やコスト削減が得られるとは述べていません。「半分の時間」はBasisの比較結果として受け取る必要があります。

内部評価は約20%改善、評価対象は最終回答だけではない

BasisはGPT-6 Astraの導入後、内部評価のスコアが約20%改善したとしています。改善の主な要因は、利用者の意図をよりよく理解できたことです。具体的には、質問を返すべき時点、仮定を明示する必要がある場面、指示を守るべき条件を捉える力が挙げられています。

Basisの評価は最終的な答えだけを見ているわけではありません。エージェントがテンプレートに従っているか、税務に関する問いで一次情報を参照しているか、自らの作業を確認しているかも評価対象に含まれます。一次情報とは、制度を定める公的機関などが直接公表した原典資料です。

OpenAIの説明では、GPT-6 Astraは広い文脈からこれらの期待を推測でき、個別の状況ごとに細かな指示を明示しなくても対応しやすいとされています。これによりBasisはケース別のルール作成を減らし、内部テストで扱っていない状況への対応にも、より確信を持てるようになったといいます。

一般の利用者に関係する実務上のポイント

この事例は会計士向けのAIエージェントが中心ですが、複数ページの資料整理、長い議事録からの確認事項抽出、表計算の点検、手順書に沿った下書き作成などにも通じる論点があります。AIに仕事を任せる際は、最終回答の文章だけでなく、途中の前提や確認手順を見える形にすることが重要です。

今日から取り入れるなら、依頼文に「目的」「完成形」「確認してほしい条件」「不明なら質問してほしい点」を分けて書く方法が実用的です。例えば、表の集計を頼む場合は、集計対象、除外条件、出力形式、数字が不明な場合の扱いを最初に示します。これにより、意図の食い違いを減らしやすくなります。

また、複雑な依頼では、一度に最終成果物だけを求めず、「前提の一覧」「作業手順」「確認が必要な項目」を先に出させる方法があります。AIが前提を勝手に補っていないかを人が確認しやすくなり、後半での大きな修正を避ける助けになります。

利用時の注意点:税務判断をそのまま任せない

税務は法令、地域、年度、個別の取引条件によって結論が変わり得る領域です。今回の発表は、Basisのエージェントが税務の質問で一次情報を参照することも評価していると述べていますが、AIの出力自体が税務上の正しさを保証するものではありません。

特に申告、控除、税額計算、契約条件の判断に関わる内容では、根拠となる公的資料や専門家による確認が必要です。AIには資料の整理、論点の洗い出し、確認すべき質問の作成を任せ、人が根拠を検証して最終判断するという役割分担が安全です。

さらに、OpenAIの公式発表には、GPT-6 Astraの価格、一般利用者への提供条件、利用可能な地域や製品、利用開始日についての記載はありません。発表にない提供条件や利用可否を推測しないことが大切です。

Agent Memories編集部の考察

今回の焦点は、モデルが難しいタスクを「解けるか」だけでなく、長い手順のどこに計算を使い、どこで利用者に確認し、どの前提を表に出すかにあります。実務では、もっともらしい最終回答よりも、誤った前提のまま作業を進めない能力が、信頼性を左右します。

Basisの約20%という内部評価の改善は、特定の評価設計と業務環境で得られた結果です。そのため、一般の利用者が同じ数値を期待する根拠にはなりません。一方で、指示の理解、確認質問、仮定の明示、自己点検を重視する運用が、AI活用の品質を高めるという方向性は参考になります。

利用者側も、AIに「答え」だけを求めるのではなく、「何を前提にしたか」「どの資料を根拠にしたか」「確認が必要な点は何か」を求めるべきです。こうした依頼の設計は、モデルの種類を問わず、仕事の再現性とレビューのしやすさを高める基本になります。

よくある質問

GPT-6 Astraは誰でもすぐに使えますか?

今回確認できるOpenAI公式発表はBasisでの事例であり、一般利用者向けの提供範囲、価格、利用開始日には触れていません。そのため、この発表だけから利用できる製品や対象者を判断することはできません。

50タブの作業簿を必ず半分の時間で処理できますか?

いいえ。半分の時間という数値は、BasisがGPT-5.6 Solとの比較で示した結果です。文書の構造、データの品質、求める検証水準、連携する仕組みによって、実際の処理時間や成果は変わります。

AIに税務作業を任せても問題ありませんか?

資料整理や確認項目の抽出には役立つ可能性がありますが、税務上の最終判断を無検証で任せるべきではありません。根拠資料を確認し、必要に応じて税務の専門家に相談してください。

長い依頼でAIのミスを減らすにはどうすればよいですか?

目的、出力形式、守る条件、不明時の対応を明示し、途中で前提と確認事項を出力させる方法が有効です。重要な数値や制度に関する記述は、元資料と照合する工程を必ず設けましょう。

まとめ

OpenAIの公式発表によると、BasisはGPT-6 Astraを用いた比較で、50タブの税務作業簿をGPT-5.6 Solの2倍の速さに相当する時間で完了したとしています。あわせて、利用者の意図理解、初期判断、推論量の調整、内部評価の改善が報告されました。

利用者が学べるのは、AIに複雑な仕事を依頼する際、目的と条件を明確にし、仮定・根拠・確認事項を見える化する重要性です。重要な判断は人が検証するという原則を保ちながら、反復作業や情報整理にAIを活用することが現実的な使い方です。

公式出典・確認日

OpenAI公式情報を2026-10-05時点で確認しています。提供範囲・料金・画面は更新される場合があります。

新しいAIへ乗り換えても、自分の前提や判断を持ち運べる状態をつくる。Agent Memoriesは、記憶をスキルや外部ツールへつなぐAIパートナー基盤を育てています。

AIエージェントの記憶を知る Agent Memoriesを見る

本カテゴリはMiraigent / Agent Memoriesによる非公式編集記事です。OpenAIとの提携・承認・後援を示すものではありません。