要約:
自社がリリースする製品が「量を質と交換できる」と固く信じている AI メーカーはほとんどありません。OpenAI はその 1 つです。前回の 12 日間にわたる記者会見と同様に、昨日、OpenAI Codex の責任者 Thibault Sottiaux (Tibo としても知られる) は 28 日間の約束を発表しました。
その後毎日、チームは大多数の Codex または ChatGPT Work ユーザーにとって明らかに価値のあるアップデートをリリースするか、完全なクォータのリセットを実行します。

イベントは 1 日目を迎え、OpenAI が提示した答えは高速化でした
。サブスクリプションで GPT-6 Astra および GPT-6.1 Sol を使用すると、ユーザーが設定を調整しなくても、デフォルトの速度が約 50% 向上します。同じ日に、OpenAI はまったく異なる方向の 2 つの変更も発表しました。
ChatGPT と Codex のテキスト出力の一部には、目に見えない透かしが追加され始めます。また、ChatGPT の広告ビジネスは、より直感的な画像表示形式を導入する準備をしています。
これらのアップデートを総合すると、OpenAI の現在の状況について多くのことがわかります。有料ユーザーにサブスクリプションの価値がより高いと感じてもらう必要があり、AI コンテンツがどこから来たのかを規制当局に説明する必要もあります。同時に、増え続けるユーザーを広告主が喜んでお金を払うビジネスにする必要がある。
モデル以外にも、AI プラットフォームが直面する日常業務は、私たちが慣れ親しんでいるインターネットにますます近づいています。
毎日更新されるため、ユーザーは利用可能な改善点のリストを楽しみにしています
ティボの約束には注目に値する限界があります。毎日リリースされる改良点は、Codex または Work ユーザーの大多数に関連するものである必要があり、その効果が十分に明らかである必要があります。
言い換えれば、片隅に隠れた小さな機能では、この約束に対するユーザーの期待に応えることはほとんどできません。毎日仕事でAIを利用している人にとって、待ち時間や操作の利便性、利用限度額が十分であるかどうかは、支払いを継続するかどうかに直接影響します。
Day 1 の高速化はまさにこの需要に応えたものです。
Tibo の説明によると、GPT-6 Astra および GPT-6.1 Sol のデフォルトの速度最適化は、OpenAI のサブスクリプション製品だけでなく、OpenCode、Pi、Amp、Devin など、ChatGPT でのサインインをサポートするパートナーも対象としています。

ユーザーが ChatGPT アカウントを通じてこれらのツールでサブスクリプションを使用できることも、この調整の範囲内です。同氏は、変更は発表から2時間以内にユーザーに徐々に感じられるだろうと述べた。
その後、Tibo はより具体的な数値を示し、生成速度を 1 秒あたり 30 トークンから 50 トークンに増加させました。

モデルとの継続的な対話が必要な作業の場合、高速化は依然として実用上重要です。コードを記述するには、ファイルの読み取り、変更、テスト、エラーの修正を繰り返し行う必要があります。データの整理には複数の検索と生成が必要になる場合もあります。 1回の待ち時間が短縮されると、蓄積された経験値の差がより顕著になります。
ただし、速度を上げることと比較すると、おそらく制限をリセットする方が現実的です。
、私たちもこの28日間で何度か見るのを楽しみにしています。テキストにウォーターマークを残す場合は、ウォーターマークの制限についても認識する必要があります。
スピードアップにより、ユーザーは AI を使いやすくなり、テキストの透かしが別の質問に答えます。生成されたコンテンツが電子メール、記事、レポート、公開ディスカッションに入ったとき、部外者はそのコンテンツと AI の関係を認識できるでしょうか?
また本日、OpenAI は EU のテキスト ソース ルールに対処する計画を発表しました。その発表によると、EU の AI 法は、生成 AI プロバイダーに対し、生成されたテキストを機械可読な方法で識別可能にすることを義務付けています。

グローバル API の顧客は、その日から一部のモデルに対してテキスト ウォーターマークを積極的にオンにできますが、デフォルト状態はオフのままです。
今後数週間で、OpenAI は EU 内の対象となる ChatGPT および Codex テキスト出力に目に見えない透かしを追加し、さまざまなパッケージをカバーしますが、初期起動段階ではグローバルなデフォルト機能として設定されません。
OpenAI はこのテクノロジーを textGrain と呼んでいます。モデルが単語を選択するときに目に見えない統計信号が追加され、検出ツールはこれらの信号を探して、テキストの一部に OpenAI ウォーターマークが含まれているかどうかを判断します。 OpenAIはまた、この技術をオープンソースにする計画もある。

難点は、テキストの変更が簡単すぎることと、モデルで利用できる表現オプションがコンテンツによって異なることです。
心理学やその他のコンテンツの誤検出率を 1% に設定したテスト条件下では、検出ツールは 200 トークンの透かしテキストの約 80% を認識できます。長さが 400 トークンに増加すると、認識率は約 95% になります。数学的内容の表現空間は小さくなり、検出性能は大幅に低下します。

編集によって信号が弱くなる場合もあります。別の 400 トークンのテキスト テスト セットでは、単語の 10% を同義語に置き換えると、検出率が約 92% から 66% に低下しました。 25% を交換した後の検出率はわずか 17% でした。

いくつかの数値セットは、テキストの透かしが手がかりとなることを示していますが、記事の作成プロセスを確実に判断できるようになるまでには、まだ長い道のりがあります。 OpenAIはまた、Astraを評価するために使用したベンチマークテストでは、ウォーターマークを追加する前後で有意なパフォーマンスの違いは観察されなかったが、これらのテストは依然として現実世界の書き込みシナリオをすべてカバーしているわけではないと述べた。
より重要な境界は、透かしでは人間の貢献を測定できないことです。
人間が自分で記事を完成させた後、AI に表現を調整させたり、AI に全文を生成させたりすることができます。これには、モデルによるテキストの処理が含まれる場合があります。透かしの検出は、作成者がどれだけの判断、編集、創造性を費やしたかを示すことはできず、著作権、責任、またはコンテンツの信頼性を判断するために使用することもできません。
ウォーターマークは、特定のユーザー、アカウント、プロンプト ワード、または会話に関連付けられることもありません。さらに、透かしは検出されず、テキストが人間によって独立して書かれたものであることを証明する方法はありません。テキストが短すぎる、編集または翻訳されている、ウォーターマークをサポートしていないモデルからのものであるため、信号が認識できない可能性があります。
偽陽性や偽陰性が依然として存在するため、OpenAI は当面、検出ツールの申請を承認された研究者や専門機関にのみ公開し、オンライン化しても完全には一般公開しません。

ChatGPT が毎週 12 億人にリーチすると、広告が見慣れたものになり始める
ビジュアル広告はウォーターマークに比べて、一般ユーザーが商品の変化を感じやすくなります。
OpenAI は同日の発表で、ChatGPT は毎週 12 億人に利用されていると述べました。この規模のプラットフォームでは、サブスクリプションを超えた商業収益が製品開発の一部となっています。
今回発表された新しい広告フォーマットでは、製品のインスピレーション、使用法、または関連する体験を写真で紹介します。最初のベータ版は今月後半に米国で開始される予定で、
最初の広告主グループと協力して、ChatGPT によって生成された画像を紹介します。

OpenAI の指示に従って、広告は明確にラベル付けされ、生成される画像とは切り離されており、ChatGPT が提供する回答には影響しません。
テスト シナリオとしてイメージ生成を選択します。これにはビジネス ロジックが含まれます。
ユーザーが部屋のレイアウトや行動計画、ライフスタイルを想像するときに、写真があると製品の使用シナリオがより直感的になり、ブランドがユーザーの検討範囲に入りやすくなります。もちろん、十分なエクスペリエンスを提供できるかどうかはテストによって判断されます。
OpenAI はまた、広告パフォーマンス測定ツールを拡張し、Hightouch、Tealium、LiveRamp などのプラットフォームと連携して、広告主がコンバージョン データを既存のシステムから ChatGPT Ads に転送し、より多くのアトリビューションおよびパフォーマンス評価パートナーを紹介できるようにしました。
広告主にとって、答えなければならない本当の疑問は、ユーザーが広告を見た後に購入したかどうか、そしてそもそもそのような購入が何件発生するかということです。
OpenAI は、いくつかのパートナー グループからの初期の結果を発表しました。
DV Rockerbox は、ChatGPT 広告における WeightWatchers の推定顧客獲得コストは、統合された有料検索ベンチマークより 15.3% 低いと主張しています。 WorkMagic は、ウェルネス ブランド Dose の追加購入の 67% は新規顧客によるものであると主張しています。 Triple Whale は、ChatGPT Ads からの Portland Leather の訪問者の 93% が新規訪問者であると主張しています。
さらに、広告が表示される場所についても新しいルールが必要です。 OpenAIは、会話が広告表示に適しているかどうかを評価し、感情的に傷つきやすい、デリケートな、または不適切な文脈での配信を回避し、DoubleVerifyとIntegral Ad Scienceを使ってブランド適合性の評価を検討すると述べた。

発表によると、これらのパートナーは、管理されたテスト環境で関連する保護メカニズムを評価し、実際のユーザーのプライベートな会話にはアクセスしません。
従来の Web サイトでは通常、ページ コンテンツの周囲に広告が配置されますが、ChatGPT 広告は常に変化する会話の横に表示されます。プラットフォームがユーザーが現在何をしたいのかをよりよく理解できればできるほど、ビジネスチャンスはより具体的になります。同様に、ユーザーは、受け取った提案がどのような影響を受けるかについてより懸念するようになります。
OpenAI は、広告が回答に影響を与えないことを約束しており、将来的には様子を見るつもりです。
28 日間のアップデートの取り組みは始まったばかりですが、毎日何が配信されるかは依然として注目に値します。しかし、初日にいくつかの変更が加えられ、競技の範囲がより明確になりました。 OpenAI は、料金を支払うユーザーの効率性、生成されたコンテンツの透明性、広告主の商業的利益を同時に運用する必要があります。
AI プラットフォームが成熟するにつれて、よくある質問に答える必要性が高まっています。それが意思決定を支援するアシスタントであり、企業があなたの注意を引くために競争する場所でもあるのに、なぜユーザーはそれを信頼し続ける必要があるのでしょうか?
コメント