タグアーカイブ 料金改定

GPT-5.6 API料金改定、Lunaは80%値下げでTerraも20%減。Fastモード登場

GPT-5.6 API料金改定、Lunaは80%値下げでTerraも20%減。Fastモード登場

OpenAIは2026年7月30日、大規模言語モデル「GPT-5.6」シリーズのAPI料金を大幅に引き下げた。最速かつ最安価なモデル「Luna」は80%値下げされ、バランス型の「Terra」も20%安くなる。あわせて最上位「Sol」向けにFastモードも導入され、標準処理の最大2.5倍の速度を提供する。

これらの改定は、OpenAIが掲げる「高度な知能をより豊富で手頃なものにする」という目標の実践だ。企業はコストと処理速度をワークフローごとに最適化できるため、AI利用の幅が大きく広がる。

GPT-5.6 LunaとTerraの大幅値下げ

GPT-5.6 LunaとTerraの大幅値下げ

今回の値下げの中心は、高速処理向けのLunaだ。LunaはAPI料金が80%引き下げられ、100万入力トークンあたり0.20ドル、同出力トークンあたり1.20ドルという破格の水準になった。一方、日常的な業務全般に使えるTerraは20%値下げされ、入力トークン100万あたり2ドル、出力は12ドルとなっている。

従来のLuna料金(Before)
■■■■■■■■■■ 高い処理コスト
大量のトークン処理ではコストが膨らみ、大規模導入の壁になっていた。
↓
新料金のLuna(After)
■■ 約80%コスト削減
高頻度の処理でも経済的になり、大量データ分析や自動応答に現実的な選択肢となった。

この値下げによって、Lunaは1タスクあたりのコストが非常に低くなり、大量処理に適したモデルへと進化した。OpenAIのブログによれば、専門的な作業指標で測った場合、同社の旧モデルFable 5と比べてLunaの推定タスク単価は99%近く低いという。小規模事業者が高度なAIを日常的に使うハードルが格段に下がったと言える。

FastモードでSolが最大2.5倍高速化

FastモードでSolが最大2.5倍高速化

最上位モデルのGPT-5.6 Solには、新たにFastモードが追加された。これは従来の優先処理(Priority Processing)を置き換えるもので、APIでFastモードを有効にすると、標準処理の最大2.5倍の速度で応答が得られる。価格は標準の2倍だが、知能の質はまったく変わらない。既存の優先処理指定リクエストは自動的にFastモードに移行するため、コードの修正は不要だ。

標準処理(Sol)
■■■■ ベースラインの速度
↓
Fastモード(Sol)
■■■■■■■■■■ 最大2.5倍の高速化

応答速度が重要な場面、たとえばユーザー向けのリアルタイムチャットボットや緊急度の高い意思決定支援などで効果を発揮する。一方で、コストが2倍になるため、処理の内容に応じて標準モードとの使い分けが鍵になる。OpenAIはこの仕組みによって、企業が「結果に対して適正な価格を払う」バランスを取りやすくしたとしている。

効率化を支えるモデル自身の最適化ループ

効率化を支えるモデル自身の最適化ループ

今回の値下げを支えているのは、GPT-5.6シリーズの稼働効率の劇的な向上だ。OpenAIはモデルそのもの、推論システム、そしてツールやコンテキストを扱うエージェント機構のあらゆる層で改良を重ねた。より直接的な処理経路の選択、ハードウェア生産性を維持するルーティング、トークン生成の最適化、重複作業を避ける賢いコンテキスト管理などが組み合わさり、同じ計算資源でより多くの有用な成果を出せるようになっている。

とりわけ注目されるのが、Sol自身が効率改善のプロセスに貢献した点だ。人間の管理のもと、Solは本番カーネルを自律的に書き換えて最適化し、トークン生成効率を高める数百の実験を設計・実行した。この取り組みによって、モデル提供にかかるエンドツーエンドのコストが20%削減され、トークン生成効率は15%以上向上した。AIがAIの運用コストを下げるフィードバックループが動き始めている。

STEP 1 人間主導でSolに改善指示
↓
STEP 2 Solがカーネルを自動書換、実験を数百回実行
↓
STEP 3 推論コスト20%減、トークン生成効率15%向上
↓
STEP 4 節約分を料金値下げと高速化に還元

こうした自己最適化のループは、OpenAIが目指す「インテリジェンスの価格性能比を継続的に向上させる」戦略の中核をなす。モデルが賢くなるほど、次の効率化のサイクルが加速するというわけだ。

企業がAI活用を進める際の新たな選択肢

企業がAI活用を進める際の新たな選択肢

LunaとTerraの値下げ、そしてSolのFastモードの登場によって、企業がワークフローごとに最適なモデルを選べる幅が大きく広がった。コストと速度、知能のバランスをタスク単位で調整できるようになったことで、AIの適用範囲を無理なく拡大できる。

たとえば、コード生成のワークフローを考えてみる。要件が曖昧で高度な判断が必要な設計段階ではSolを使い、確定した仕様に沿ったコード実装やテストの実行は低コストのLunaに任せる、といった割り振りが現実的になる。ドキュメントの大量分析や顧客対応の振り分けといった高頻度の業務も、Lunaを活用すれば予算内に収めやすい。

ワークロード別モデル選択の指針
高難度 複雑な推論や設計 → Sol
日常業務 一般的な文書作成や要約 → Terra
大量処理 データ分類や定型実装 → Luna
応答速度が求められるSol利用時はFastモードを併用

このように、単一のモデルですべてをこなすのではなく、処理の性質と求める品質に応じて使い分ける設計が、これからのAI戦略の基本になるだろう。SolのFastモードは、応答速度が収益に直結する顧客向けサービスなどで即効性が期待できる。

OpenAIのブログによれば、今回の改定によって、1年前に最先端とされたモデル並みのパフォーマンスをLunaで1タスク約6%のコストで実現できるという。AI活用が一部の専門領域から、あらゆる業務の日常ツールへと移行する大きな一歩だ。

この記事のポイント

  • GPT-5.6 LunaのAPI料金が80%値下げされ、100万入力トークンあたり0.20ドルに。Terraも20%引き
  • Sol向けFastモードが追加され、標準の最大2.5倍の速度を2倍の価格で提供
  • 値下げの背景には、Sol自身がカーネル最適化などで推論コストを20%削減した成果がある
  • 企業はタスクの難易度や処理量に応じてLuna、Terra、Solを柔軟に組み合わせ、コストと品質を両立できる
  • ChatGPT WorkやCodexのサブスクリプション価格は据え置きのまま、LunaとTerraの消費クレジットが減少
Neon、有料プランのデータ転送量を5倍に増量。500GBで実質エグレスフリー

Neon、有料プランのデータ転送量を5倍に増量。500GBで実質エグレスフリー

サーバーレスPostgreSQLサービスのNeonは2026年6月1日、全有料プランに含まれる月間データ転送量を従来の100GBから500GBへと5倍に引き上げた。この変更は自動的に適用され、利用者側での設定変更は不要だ。

500GBという上限は、ほとんどの一般的なワークロードにおける全データ転送(エグレス)コストを実質的にゼロにする水準だ。Neonのブログによれば、チャットボットのバックフィル処理や設定ミスによる超過リスクも、この増量によって大幅に緩和される。

本記事では、増量の具体的な内容と背景、利用者が知っておくべきポイントを整理する。

月間500GBへの増量。その具体的な内容

月間500GBへの増量。その具体的な内容

今回の変更の核心はシンプルだ。Neonの全有料プラン(Launch、Scale、Enterprise)において、月間のパブリックデータ転送(エグレス)の無料枠が100GBから500GBに拡大された。

従来の転送量(Before)
100 GB / 月
中規模ワークロードでは超過のリスクあり
⚠ 分析ジョブやチャットボットで予期せぬ課金
↓
増量後の転送量(After)
500 GB / 月
大半のワークロードでデータ転送料金ゼロ
✅ 予期せぬ課金リスクが大幅に減少

500GBを超過した場合の追加課金体系に変更はない。超過分はこれまでと同一の従量課金レートで計算される。Neonの記事では「データ転送の計測方法や料金体系に変更は一切ない」と明言されている。

変更は自動適用。請求書にも即時反映

この増量は2026年6月1日からユーザー側の操作なしで自動適用される。Neonのコンソール(管理画面)で利用状況を確認可能で、6月分の請求書には新たな500GBの枠が反映される。

なぜNeonは5倍への増量を決断したのか

なぜNeonは5倍への増量を決断したのか

Neonのブログ記事は、意思決定の背景を率直に説明している。最大の動機は「予期せぬエグレス課金の排除」だ。

エグレス課金のストレスを根本から減らす

クラウドデータベースにおけるデータ転送料金は、しばしば利用者にとっての「見えないコスト」となる。チャットボットが想定以上にデータを取得したケース、分析ジョブが大量の履歴データを読み込んだケース、設定ミスでループ接続が発生したケースなど、原因は多岐にわたる。

これらの超過は後になってから請求書で気づくことが多く、事後対応が難しい。Neonの著者Carlo Daniele氏は「請求書に届いてからでは遅すぎる」と指摘している。500GBへの増量は、この「事後ショック」をほとんどのユーザーから無くす狙いがある。

競合との差別化とサーバーレスの信頼性向上

サーバーレスデータベース市場では、Vercel PostgresやSupabaseなどもデータ転送枠を設けている。500GBという閾値は、これらのサービスと比較しても実質的な「エグレスフリー」を実現する水準だ。

Neonにとって、この変更はプラットフォームの信頼性向上と、サーバーレスアーキテクチャへの移行障壁を下げる施策といえる。特にスタートアップや個人開発者にとって、突発的なコスト増はサービス継続のリスクになりうる。その不安を軽減する効果は大きい。

利用者に求められる対応と確認方法

利用者に求められる対応と確認方法

必要な対応は一切なし

繰り返しになるが、利用者が実施すべき設定変更や申し込みは存在しない。Neonの全有料プラン契約者に対し、2026年6月1日以降の月間データ転送量が自動的に500GBへと引き上げられている。

利用状況の確認方法

自身のデータ転送量を把握したい場合は、Neon Consoleにログインし、請求および利用状況のダッシュボードでエグレス使用量を追跡できる。不明点はNeon公式Discordコミュニティで質問することも可能だ。

今後のデータ転送戦略とユーザーへの影響

今後のデータ転送戦略とユーザーへの影響

今回の増量は、Neonが「データ転送をコスト障壁にしない」という姿勢を明確に打ち出したものと捉えられる。サーバーレスデータベースの利点である「従量課金の柔軟性」は、往々にして「予測不能なコスト」と紙一重だ。

500GBの無料枠は、その両面を切り離す試みだ。実際の利用データにもとづきNeonが「ほとんどのワークロードでエグレス課金が発生しなくなる」と明言している点は、単なるマーケティングではなくユーザー利用統計に裏付けられた判断といえる。

将来的にNeonがさらなるデータ転送枠の拡大や、完全なエグレスフリー化に踏み切る可能性もあるが、現時点ではこの変更が最大のハードルを解消したと評価できる。

この記事のポイント

  • Neonは2026年6月1日より、全有料プランの月間データ転送量を100GBから500GBに増量
  • 変更は完全自動適用。利用者による操作や設定変更は不要
  • 500GB超過分の従量課金体系に変更はなく、データ転送の計測方法も据え置き
  • 大半の一般的なワークロードがエグレス課金の対象外に。実質的なコスト障壁が大幅に低下
  • 予期せぬエグレス課金への不安を解消し、サーバーレスデータベースの信頼性を強化