AI × 開発効率化OpenAI / 2026年6月

OpenAI 2026年6月発表まとめ|GPT-5.6 Sol/Terra/Luna 限定プレビュー


2026 年 6 月に OpenAI が発表した内容を、新しい順にまとめます。最大の動きは 6 月 26 日に始まった GPT-5.6 の限定プレビューです。GPT-5.5(4 月 23 日)から約 2 か月で、世代を表す数字と能力ティア(Sol / Terra / Luna)を分ける新しい命名体系とともに登場しました。あわせて Codex の 6 月アップデート(Bedrock・Sites・Remote GA)、利用枠リセットの banking 化、Terminal-Bench 2.1 で表面化した「同じモデルでもハーネスでスコアが変わる」ベンチマークの読み方も整理します。

公開2026.06.27
最終更新2026.06.27
読了 15 分 / 約6,200字
この記事をシェアポスト
AI × 開発効率化OpenAI / 2026 年 6 月

OpenAI 2026年6月
発表まとめ

C
本記事の結論
2026 年 6 月は「GPT-5.6 の限定プレビューと、利用枠まわりの立て直し」の月

6 月最大の動きは 6 月 26 日で、GPT-5.6 が Sol / Terra / Luna の 3 ティアで限定プレビューとして公開されました。GPT-5.5(4 月 23 日)から約 2 か月での更新で、 世代を表す数字(5.6)と、知能・速度・コストの方向を表す能力ティア(Sol=Sun・Terra=Earth・Luna=Moon)を 分ける新しい命名体系をともないます。提供はまず「一部の信頼できるパートナー・組織」に絞られ、 一般提供(GA)は「数週間以内」と案内されています。

開発者向けでは、Codex が Amazon Bedrock 対応(6/1)・Sites プラグイン(6/2)・ Codex Remote の一般提供(6/25)を重ねました。一方で、利用量計測の異常をきっかけに 利用枠リセットを蓄積して使える banking(バンク)方式が導入され(6/11)、 6 月 18 日には全ユーザーへの「ダブルリセット」も行われています。 新モデルの大型 GA というより、限定プレビューと運用面の立て直しが中心の 1 か月でした。

01.結論:2026年6月の OpenAI 動向ハイライト

2026 年 6 月の OpenAI は、新フラッグシップ世代 GPT-5.6 を限定プレビューで出しつつ、 Codex の提供チャネルを広げ、利用枠まわりの不具合対応に追われた月でした。 GPT モデル全体の流れはChatGPT・GPT モデル進化の年表に、Codex の流れはOpenAI Codex 進化の年表に、それぞれ別記事として年表でまとめています。本記事は 6 月単月の発表を一覧で押さえる位置づけです。

まず 6 月の主要トピックを発表日順(新しい順)に並べると次のとおりです。

時期出来事ハイライト
2026 年 6 月 26 日GPT-5.6 が限定プレビュー開始Sol / Terra / Luna の 3 ティア。世代=数字、能力=ティア名の新命名。Sol に max / ultra 推論。GA は「数週間以内」
2026 年 6 月 25 日Codex Remote が一般提供スマホから、接続済みの Mac / Windows 上の作業を開始・継続し、進捗確認や承認まで行える
2026 年 6 月 18 日Codex 利用枠の「ダブルリセット」全ユーザーの上限を即時リセットし、もう 1 回分をバンクへ付与(OpenAI の Thibault Sottiaux 氏の告知)
2026 年 6 月 11 日利用枠リセットの banking 化Plus / Pro 向けにリセットを蓄積して任意のタイミングで使える方式を導入(Codex アプリ v26.611)
2026 年 6 月 2 日Codex Sites プラグイン(プレビュー)Codex アプリからサイト・ダッシュボード・社内ツール・Web アプリを作成・デプロイ
2026 年 6 月 1 日Codex が Amazon Bedrock 対応モデルプロバイダに Bedrock を指定可能(Commercial / GovCloud)。AWS 側で認証・課金を管理
関連記事

Anthropic 2026年6月発表まとめ|Fable 5・Mythos 5と未発効の課金案

同じ 2026 年 6 月の Anthropic 側の発表(Claude Fable 5 の一般公開・Mythos 5 との違い・6 月 15 日施行の課金変更)を、新しい順にまとめています。あわせてご覧ください。

続きを読む
関連記事

OpenAI 2026年5月発表まとめ|GPT-5.5 Instant・ChatGPT for Excel/Google Sheets・Codex Goal Mode

前月(2026 年 5 月)の OpenAI の発表(GPT-5.5 Instant の既定化・ChatGPT for Excel / Google Sheets の GA・Codex Goal Mode 既定化)を、新しい順にまとめています。

続きを読む

02.GPT-5.6:Sol / Terra / Luna の限定プレビュー開始(6/26)

2026 年 6 月 26 日、OpenAI は次世代モデル GPT-5.6 の限定プレビューを開始しました。 9to5Mac は ChatGPT と Codex を GPT-5.6 で更新する限定リリース として報じています。最大の変化はモデルそのものより、数字(世代)と能力ティアを分ける新しい命名体系の導入です。「5.6」は世代を表し、Sol(Sun)・Terra(Earth)・Luna(Moon)という 天体由来のティア名が、知能・速度・コストの方向を表します。ティアは各自のペースで進化できる 恒久的な区分として設計され、利用者が「知能・速度・コスト」を選びやすくする狙いです。

同記事が伝えた各ティアの位置づけと API 標準料金(2026 年 6 月時点・プレビュー段階の概数。GA 時に変わる可能性があります)は次のとおりです。

ティア位置づけAPI 標準料金(100 万トークンあたり)
GPT-5.6 Solフラッグシップ(最も高い知能)入力 $5・出力 $30
GPT-5.6 Terraバランス型(知能と速度の中間)入力 $2.50・出力 $15
GPT-5.6 Luna高速・低コスト型入力 $1・出力 $6

ロールアウトは段階的です。まず「一部の信頼できるパートナー・組織」に絞った限定プレビューとして提供され、 Sol / Terra / Luna の一般提供(GA)は「数週間以内」と案内されています。 OpenAI はこの段階的提供を米国政府との連携によるものと説明しており、 高能力モデルを限定提供から始める運用は、Anthropic が Claude Mythos / Fable で採った 二段構えとも重なります。OpenAI 側のモデル更新履歴は OpenAI のリリースノート で随時更新されます。

!
読み方の注意
GPT-5.6 は限定プレビュー。Codex の公式チェンジログにはまだ載っていない

6 月 26 日時点の GPT-5.6 は限定プレビューで、対象は一部のパートナー・組織に限られます。 実際、OpenAI Developers の Codex 変更履歴には 6 月末時点で GPT-5.6 を Codex で選べる旨の記載がなく、Codex の推奨モデルは引き続き GPT-5.5 系です。 「GPT-5.6 が出た=今日から自分の Codex / ChatGPT で使える」ではない点に注意し、 自社環境での利用可否は、各プランのモデル一覧と GA の案内が出てから確認するのが安全です。

03.新しい推論設定:max と ultra(サブエージェント活用)

GPT-5.6 Sol には、推論にかける時間(reasoning effort)の新しい段階としてmax が加わりました。 従来の low〜high より深く考えさせる設定で、難所に時間を割く用途を想定しています。 さらに、単一エージェントの枠を超えるultra モードが導入され、複数のサブエージェントを使って複雑な作業を並列で進める仕組みが入りました。 OpenAI は GPT-5.6 の進歩としてコーディング・生物学・サイバーセキュリティを挙げています。

設定内容想定用途
max(reasoning effort)Sol に最も長い思考時間を割り当てる新しい上位段階難所の設計判断・込み入ったデバッグなど、時間をかけるほど精度が上がるタスク
ultra モードサブエージェントを束ねて複雑な作業を並列分担する実行モード1 エージェントでは捌ききれない、調査と実装が絡む大きめのタスク

ultra モードのように、マネージャー役のエージェントが下位のサブエージェントへ作業を割り振る構成は、 2026 年に入って各社のコーディングエージェントで広がっている方向です。 役割分担の考え方やコスト最適化(安価なモデルに下請けを任せる)の基本は、AIエージェントとは何かを整理した記事でも扱っています。ただし ultra のような並列実行は、便利な分だけトークン消費も増えやすいため、 次章の利用枠の話と合わせて、上限アラートを設定してから試すのがおすすめです。

04.Codex の6月アップデート:Bedrock・Sites・Remote GA

Codex は 6 月も小刻みに更新が続きました。モデルの大型更新(GPT-5.6 の Codex 投入)は 6 月末時点でまだですが、提供チャネルと作業面を広げる変更が並びます。 いずれも OpenAI Developers の Codex 変更履歴 で確認できます。

時期アップデート主な変更
2026 年 6 月 25 日Codex Remote 一般提供スマホから、接続済みの Mac / Windows 上の作業を開始・継続。進捗の確認やアクションの承認も手元の端末から行える
2026 年 6 月 11 日Codex アプリ v26.611利用枠リセットの banking(Plus / Pro)、Chrome でのブラウザ開発者モード、Computer Use の対象拡大(一部地域の Enterprise)など
2026 年 6 月 2 日Sites プラグイン(プレビュー)Codex アプリからサイト・ダッシュボード・社内ツール・Web アプリ・ゲームを作成・保存・デプロイ・点検
2026 年 6 月 1 日Amazon Bedrock 対応モデルプロバイダに Bedrock を指定可能(Commercial / GovCloud)。認証・課金を AWS 側で管理

方向性としては、5 月の Goal Mode 既定化(目標を渡して自走させる)に続き、 「どこからでも・どの基盤でも Codex を動かす」面を広げた 1 か月です。 とくに Codex Remote の GA は、手元のスマホから常駐エージェントの進捗を確認・承認できるようにする更新で、 長時間の自走(Goal Mode)と組み合わせると、席を外している間も要所だけ承認して前に進められます。 Bedrock 対応で AWS の認証・課金の中に Codex を載せやすくなり、 Codex の提供形態の全体像(CLI / Cloud / IDE 拡張など)は別記事の年表に整理しています。

図:Codex Remote でスマホから作業を進めるときの流れ
  1. 1
    Mac / Windows ホストを接続しておく

    作業マシンを Codex Remote に接続しておくと、外出先のスマホからそのホスト上のセッションに届きます。

  2. 2
    スマホから作業を開始・継続

    新しいタスクの開始や、進行中タスクの継続をスマホから指示できます。

  3. 3
    進捗を確認しアクションを承認

    エージェントが提案した変更やコマンド実行を、手元の端末で確認してから承認します。

承認を挟む設計のため、勝手に大きな変更が進む心配を抑えつつ、待ち時間を有効に使えます。

05.利用枠リセットの banking 化と利用量計測の異常(6/4・6/11・6/18)

6 月の運用面で目立ったのが、Codex の利用枠(rate limit)まわりの一連の対応です。 発端は利用量計測の異常で、6 月 4 日の一斉リセットの際に一部の Plus アカウントでリセットが反映されない事象や、消費量の計測が実態と合わない(例:週に 3,500 万トークンの利用で残り 36%、 以前は 1.2 億トークンで残り 10% など、消費とのつり合いが取れない)報告が相次ぎました。

OpenAI はまず、無料/Go の利用枠リセット周期を 7 日ごとから 30 日ごとへ変更しました。 Plus / Pro / Business / Edu / Enterprise は従来どおりの週次リセットが維持される一方、 無料/Go は同じ枠でも月あたりに使える回数が実質的に減る変更です。 そのうえで、6 月 11 日には利用枠リセットを蓄積して任意のタイミングで使える banking(バンク)方式を Plus / Pro 向けに導入しました(Crypto Briefing)。リセットを自動で消費せず、プロフィールメニューから保有数を確認して、必要なときに使えます。 導入時には 1 回分が無料付与され、友だち紹介(2 週間・最大 3 人)で双方にリセットが追加される仕組みも案内されました。

時期対応内容
2026 年 6 月 4 日一斉リセットと計測異常の発覚全有料サブスクの利用枠を一斉リセット。ただし一部 Plus でリセット未反映、消費量の計測に不整合が報告された
計測異常への対応無料 / Go のリセット周期を変更リセット周期を 7 日ごと → 30 日ごとへ。Plus 以上の有料プランは週次のまま維持
2026 年 6 月 11 日リセットの banking 化Plus / Pro 向けに、リセットを蓄積して任意のタイミングで使える方式を導入。導入時 1 回分を無料付与
2026 年 6 月 18 日全ユーザーへのダブルリセット全ユーザーの上限を即時リセットし、さらに 1 回分をバンクへ付与(OpenAI の Thibault Sottiaux 氏の告知)

6 月 18 日には、OpenAI の Thibault Sottiaux 氏が全ユーザーに対する「ダブルリセット」を告知しました。 全員の上限を即時にリセットしたうえで、もう 1 回分をバンクへ入れる対応で、 計測異常で割を食った利用者への埋め合わせの意味合いがあります。 ベンダーが不具合を公式に認め、影響範囲の広い利用者へ即時の緩和(mitigation)を打った事例として、 AI コーディングエージェントを業務に組み込む際のリスク管理の参考になります。

!
運用上の注意
無料/Go はリセット周期が月次に。利用量の前提を組み直す

無料/Go プランで Codex を試している場合、リセット周期が 7 日ごとから 30 日ごとへ変わったため、 月あたりに使える回数の感覚が以前と変わります。検証用途で無料枠を回しているチームは、 「週次でリセットされる前提」のスケジュールを月次に組み直しておくと、 想定外のタイミングで枠切れに当たる事態を避けやすくなります。 banking で蓄えたリセットの保有数は、プロフィールメニューから確認できます。 業務の自動化に組み込むなら、計測異常のような事象が起きうる前提で、 消費量のモニタリングと上限アラートをセットで用意しておくのが安全です。

06.Terminal-Bench 2.1 の読み方:モデルよりハーネスが効く

GPT-5.6 の発表前後で、コーディングエージェントのベンチマーク比較が改めて話題になりました。 とくに、コマンドライン操作を測る Terminal-Bench 2.1 の 6 月時点のスコアは、「同じモデルでも、それを動かすハーネス(実行環境)が違えばスコアが変わる」ことを示す例として引かれています。コミュニティの分析「Terminal-Bench 2.1 and the June 2026 Benchmark Landscape」によると、同じ GPT-5.5 でも、Codex CLI で動かすと 83.4%(6 月 9 日時点で CLI 系エージェントの首位)、 別のハーネス Terminus 2 で動かすと 78.2% と、5.2 ポイントの差がついています。

図:Terminal-Bench 2.1(コマンドライン操作)の比較

数値はコミュニティ分析の集計値(2026 年 6 月時点)。同じ GPT-5.5 でもハーネスでスコアが変わる

  • GPT-5.5|Codex CLI
    83.4%
  • Claude Code|Opus 4.8
    78.9%
  • GPT-5.5|Terminus 2
    78.2%
出典:Terminal-Bench 2.1 のコミュニティ分析(OpenAI / Anthropic の公式発表値ではなく、第三者集計)。同じ GPT-5.5 でも、Codex CLI(83.4%)と Terminus 2(78.2%)でスコアが異なります。

この差が示すのは、ツールの実力=モデルの実力ではない、という当たり前で見落としやすい点です。 エージェントのツール呼び出しのループ、サンドボックス構成、ファイル操作の方法、リトライや検証の作り込みは、 モデルと同じくらいスコアを左右します。分析は「ハーネスはモデル単体よりも結果を形づくる」 「設定(configuration)こそが新しい競争優位」と表現しています。 つまり Terminal-Bench のような CLI / エージェント型のベンチマークは、 モデルの地力ではなく「モデル+ハーネス」の総合点を測っている、と読むのが適切です。

モデル単体の到達点を見たいときは、別のベンチマークが手がかりになります。 同月公開の Claude Fable 5 は、リポジトリ全体のバグ修正を測る SWE-bench Verified で 95.0% を公表しており、 Terminal-Bench 2.1 でも 88.0% という値が報じられています(ただしセーフガードによるフォールバックの扱いで 注記が付く値です)。一方で、Codex CLI を含む CLI 系エージェントの土俵では GPT-5.5+Codex CLI が首位という結果も出ています。 測っている対象(端末操作か、リポジトリ規模のバグ修正か)も、動かすハーネスも違うため、 単一のスコアだけでツールの優劣を決めるのは危うい、というのが 6 月のベンチマーク事情の教訓です。 実際、実コーディングでの使い勝手についての開発者の評価は分かれており、 ベンチマーク上位も測る土俵やハーネス次第で入れ替わります。数字を鵜呑みにせず、 自社の典型タスクで小さく試してから判断するのが堅実です。

関連記事

Claude Code と Codex の併用ワークフロー|codex-plugin-cc で始めるコードレビュー連携

どちらか一方を選ぶのではなく、Claude Code で実装し Codex でレビュー・追加調査を回す併用ワークフローを、codex-plugin-cc を中心に整理しています。あわせてご覧ください。

続きを読む

07.これからの要チェックポイント

2026 年 6 月末時点で観測している項目を、本記事の更新時に拾うべきトピックとして残します。

  • GPT-5.6 の GA 時期と提供範囲: 限定プレビューから「数週間以内」とされた Sol / Terra / Luna の一般提供が、いつ・どのプランで・ どの地域から始まるか。Codex / ChatGPT の各プランでいつ選べるようになるか
  • GPT-5.6-Codex 系列の有無: 汎用 GPT-5.6 を Codex でそのまま使う構成が続くのか、Codex 専用チューニング版(5.6-Codex 系)が出るのか。 ティア(Sol / Terra / Luna)と Codex のモデル選択がどう対応づくか
  • 公式ベンチマークの公開: 現状の Terminal-Bench スコアは第三者集計が中心。OpenAI が GPT-5.6 の SWE-bench / Terminal-Bench を 公式に公表し、ハーネス条件込みで比較できるようになるか
  • 利用枠運用の安定化: banking 方式と無料/Go の月次リセットが定着するか、計測異常の再発防止がどう案内されるか。 ダブルリセットのような臨時対応が今後も必要になるか
  • ultra(サブエージェント)の使い勝手とコスト: 並列実行でトークン消費がどの程度増えるか、実務でどのタスクに効くか

ツール選びは「最新・最高スコア」を追うより、自社の典型タスクで小さく検証して決めるのが結局は早道です。 弊社では、AI をフル活用したコンテンツ制作・運用設計の支援を提供しており、 ベンチマークの読み解きやツール選定を含めた相談も承っています。

サービス資料・無料相談

TANTOU ─ AI検索時代のコンテンツ戦略を低コスト高品質で

Google検索はもちろん、ChatGPTやPerplexityにも引用される記事を毎月納品。貴社専用ガイドラインに基づくAI×人間のハイブリッド制作で、SEOとLLMOの両方に効くコンテンツを月額9.8万円(税別)から。

TANTOUの詳細を見る

08.よくある質問(FAQ)

2026 年 6 月の OpenAI の最大の発表は何ですか?

6 月 26 日に GPT-5.6 が Sol / Terra / Luna の 3 ティアで限定プレビューとして公開されたことです。 GPT-5.5(4 月 23 日)から約 2 か月での更新で、世代を表す数字と能力ティア (Sol=Sun・Terra=Earth・Luna=Moon)を分ける新しい命名体系をともないます。 提供はまず一部の信頼できるパートナー・組織に絞られ、一般提供(GA)は「数週間以内」と案内されています。

GPT-5.6 の Sol / Terra / Luna はどう違いますか?

数字(5.6)が世代を、Sol / Terra / Luna が能力ティアを表します。 Sol はフラッグシップ(最も高い知能)、Terra はバランス型、Luna は高速・低コスト型です。 API 標準料金は 100 万トークンあたり Sol が入力 $5・出力 $30、Terra が入力 $2.50・出力 $15、 Luna が入力 $1・出力 $6 とされています。ティアは知能・速度・コストを選びやすくするための 恒久的な区分で、各自のペースで進化できる設計です。

GPT-5.6 はもう自分の ChatGPT や Codex で使えますか?

6 月 26 日時点では限定プレビューで、対象は一部の信頼できるパートナー・組織に限られます。OpenAI Developers の Codex 変更履歴にも、6 月末時点で GPT-5.6 を Codex で選べる旨の記載はなく、Codex の推奨モデルは引き続き GPT-5.5 系です。 一般提供は「数週間以内」と案内されているため、自社環境での利用可否は、 各プランのモデル一覧と GA の案内が出てから確認するのが安全です。

GPT-5.6 の max 推論と ultra モードとは何ですか?

max は、推論にかける時間(reasoning effort)の新しい上位段階で、 GPT-5.6 Sol に最も長く考えさせる設定です。ultra モードは、単一エージェントの枠を超えて 複数のサブエージェントを束ね、複雑な作業を並列で進める実行モードです。 難所に時間を割きたいタスクには max、調査と実装が絡む大きめのタスクには ultra が想定されています。 並列実行はトークン消費が増えやすいため、上限アラートを設定してから試すのがおすすめです。

Codex の利用枠リセットの banking(バンク)とは何ですか?

利用枠のリセットを自動で消費せず、蓄積して任意のタイミングで使える方式です。 2026 年 6 月 11 日に Plus / Pro 向けに導入され(Codex アプリ v26.611)、 保有数はプロフィールメニューから確認できます。導入時には 1 回分が無料付与されました。 背景には 6 月初旬の利用量計測の異常があり、6 月 18 日には OpenAI が全ユーザーへ 即時リセット+もう 1 回分のバンク付与(ダブルリセット)も行っています。 あわせて無料/Go はリセット周期が 7 日ごとから 30 日ごとに変更されました。

Terminal-Bench のスコアで Codex と Claude Code の優劣は決まりますか?

単一のスコアだけでは決まりません。Terminal-Bench 2.1 の 6 月時点の集計では、 同じ GPT-5.5 でも Codex CLI で 83.4%、別のハーネス Terminus 2 で 78.2% と、 実行環境(ハーネス)の違いで 5.2 ポイント差がつきました。Claude Code + Opus 4.8 は 78.9% です(Terminal-Bench 2.1 のコミュニティ分析)。ベンチマークは「モデル+ハーネス」の総合点を測っており、測る対象 (端末操作かリポジトリ規模のバグ修正か)でも順位は変わります。 数字を鵜呑みにせず、自社の典型タスクで小さく試してから判断するのが堅実です。

09.まとめ

2026 年 6 月の OpenAI は、GPT-5.5 から約 2 か月で次世代の GPT-5.6 を限定プレビューとして公開した月でした。 世代を表す数字と、知能・速度・コストの方向を表す能力ティア(Sol / Terra / Luna)を分ける新命名を導入し、 Sol には max 推論とサブエージェントを使う ultra モードが加わりました。 ただし提供は一部のパートナー・組織に絞られ、一般提供は「数週間以内」と案内された段階です。

開発者向けでは、Codex が Bedrock 対応・Sites プラグイン・Remote の GA を重ねる一方、 利用量計測の異常をきっかけに、利用枠リセットの banking 化(6/11)や全ユーザーへのダブルリセット(6/18)といった 運用面の立て直しが続きました。無料/Go はリセット周期が月次に変わったため、利用の前提を組み直しておくのが安全です。

ベンチマークは、Terminal-Bench 2.1 のように「同じモデルでもハーネスでスコアが変わる」ことが 改めて可視化されました。単一のスコアでツールの優劣を決めず、測っている対象と実行環境を確かめ、 自社の典型タスクで小さく試してから選ぶのが堅実です。 対象は 6 月に発表された内容までです。7 月以降の発表は月ごとに別の記事へまとめています。

AI・AIエージェント活用 基礎知識集

一覧に戻る →
この記事をシェア
澤田 翔太(Shota Sawada)
この記事を書いた人

澤田 翔太

株式会社クリプタル 代表取締役

1988年生まれ、慶應義塾大学卒。創業メンバーとして関わった株式会社セールスサポートを株式会社ネオマーケティング(東証STD 4196)に売却。株式会社クリプタルでも複数の事業立ち上げと売却を経験し、2022年9月には婚活・恋愛メディア「シッテク」「婚活会議」を株式会社ベビーカレンダー(東証GRT 7363)へ売却。現在はAI業務支援事業、TANTOU事業、グロースハック支援事業、メディア事業、SEOコンサルティング事業を手がける。