1. Reflection、5010億パラメータのオープンウェイトモデル「Beam」を発表
- Reflectionは、同社初となるオープンウェイトモデル「Beam」を発表しました。総パラメータ数5010億、アクティブパラメータ数230億の疎結合(Sparse)MoE(Mixture-of-Experts)モデルで、コーディング、推論、エージェント向けワークロード向けに設計されています。
- Beamは23兆8000億トークンで事前学習され、100万トークンのコンテキストウィンドウを備えています。
- 計算負荷の高い強化学習の実行では、1万500基のNVIDIA GB300 GPUを用いて4週間で1億件以上のロールアウトを生成しました。
Sources: Reflection · TechCrunch
2. OpenAI、EU AI法の出所明示ルールに準拠するためテキストの電子透かしを開始
- OpenAIは、一部モデルを対象にAPI顧客がテキストの電子透かし機能を任意で有効化(オプトイン)できるようにしたと発表しました。APIではデフォルトでオフのままとなっています。今後数週間をかけて、EU域内の対象となるChatGPTおよびCodexのテキスト出力に見えない電子透かしを追加する予定ですが、提供開始時点で世界共通のデフォルト設定にはしないとしています。
- 「textGrain」と呼ばれるこの技術は、モデルの単語選択に見えない統計的シグナルを付加するもので、OpenAIによると、テキスト向けSynthIDなど同社が検証した他のアプローチと同等以上の水準を達成したとのことです。偽陽性率を1%に設定した場合、検出器は200トークンの文章で約80%、400トークンの文章で約95%の電子透かしを特定できましたが、400トークンの文章で単語の25%を置き換えると検出率は17%まで低下しました。
- 検出器へのアクセスは、当面の間、技術の評価や改善に協力できる承認済みの研究者や専門機関に限定されます。なお、音声および画像向けの検証ツールは引き続き一般に公開されているとOpenAIは述べています。
3. OpenAI、ChatGPTにビジュアル広告フォーマットを導入し広告効果測定を拡充
- OpenAIは、ChatGPTに新たなビジュアル広告フォーマットを導入し、当初は画像生成中にテストを行う予定です。広告には明確なラベルが付与され、生成中の画像とは区別して表示されます。テストは今月後半に米国で開始され、初期参加の広告主グループと連携して進められます。
- OpenAIはコンバージョンデータを送信するためにHightouch、Tealium、LiveRampとの連携を追加しました。また、AppsFlyer、Triple Whale、Adjust、Branchなどのアトリビューションパートナーに対応したほか、Haus、Measured、WorkMagicと提携して地域別の増分効果(インクリメンタリティ)実験の検討を進めています。
- 同社はDoubleVerifyおよびIntegral Ad Scienceとブランド適合性評価のパイロット開発を進めており、対象条件を満たす広告主はネガティブフレーズ指定を利用できるようになりました。OpenAIによると、ChatGPTの週間リーチ数は12億人に達しています。
Sources: OpenAI
4. ウィキメディア財団、OpenAIの「不正」エージェントがウィキを編集し5月の障害に関与した可能性があると表明
- ウィキメディア財団は調査の結果、OpenAIが運用していたとみられるエージェントの活動を確認したと発表しました。これにはウィキメディアの各ウィキへの編集が含まれますが、その大半は「サンドボックス」領域でのテスト編集でした。また、ツールをプロキシとして悪用しようとする潜在的に悪質な試みとみられる、出典引用ツールの設定に対する少数の編集も見つかりました。
- このトラフィックが、5月に発生した同クエリサービスの一部障害の一因となった可能性があります。
- ウィキメディアは、エージェント間での連携に同財団のシステムが利用された証拠や、システムおよびデータが侵害された証拠は見つからなかったとしています。一方で、AI各社は自社システムの保護対策が不十分であり、非営利のウェブサイト運営者が容易に識別できる方法でシステムを稼働させるべきだと指摘しました。
Sources: Wikimedia Foundation · The Verge
5. トランプ氏、ジェイ・クレイトン氏率いる「超知能タスクフォース」を設立
- ドナルド・トランプ大統領は日曜午前のTruth Socialへの投稿で、新たな「超知能タスクフォース(Super Intelligence Force)」の立ち上げを発表しました。国家情報長官のジェイ・クレイトン氏と政権幹部が率いる予定です。
- トランプ氏は、「米国が超知能において世界の主導権を維持し続ける」ための連邦政府の取り組みを統括する任務を担うと説明しました。
- このタスクフォースには、AIがもたらすリスクと好機に関する報告書を作成するため120日間の期限が与えられる見込みです。憲章案には、「イノベーションと競争を阻害する過剰規制や規制の虜(キャプチャー)を防ぎつつ、超知能による社会への脅威に対応する計画を策定する」と記されていると報じられています。
Sources: TechCrunch
6. サム・アルトマン氏、AIの恩恵のためには「世界はある程度の悪影響を受け入れるべき」と発言
- POLITICOの「Decoded」によるインタビューで、OpenAI CEOのサム・アルトマン氏は、AI規制を巡ってOpenAIとAnthropicの間には「大きな隔たり」があると述べました。Anthropicおよび同社CEOのダリオ・アモデイ氏とどこで意見が分かれるかを尋ねられたアルトマン氏は、「この技術の恩恵と人々が主体性を持つためには、世界はある程度の悪影響が起きることを受け入れるべきだと考えている」と語りました。
- POLITICOによると、アルトマン氏は最先端AIモデルの開発を減速すべきだとするアモデイ氏の前月の主張に同意しており、OpenAIはAnthropicに追随する形で、過去に支持していた内容よりも厳格な安全基準を盛り込んだ新たな州法を支持しています。
- また、OpenAIのロビイストは、大手AI企業に外部の安全評価担当者を常駐させることを義務付ける超党派の下院法案を最近支持したとPOLITICOは報じています。
Sources: POLITICO
7. ノルウェー、一部の公共スペースでAIグラスの一時的禁止を提案
- ノルウェー政府は月曜日、公園、ビーチ、学校、幼稚園などの場所でAIグラスの使用を一時的に禁止する法案を近く議会に提出すると発表しました。恒久的な国内ルールを提言する専門家グループも立ち上げる予定です。
- デジタル化担当大臣のトルゲイル・ミカエルセン氏は、一時的な禁止によって「徹底した評価を実施し、恒久的な規制の基礎となる情報に基づいた議論を行うための時間を確保できる」と述べました。
- 政府は全面的な禁止を提案したいわけではないとしています。オスロの学校や、エクイノール(Equinor)はすでにオフィスや海洋施設でこのグラスを禁止しており、オーストラリアでも特定の公共スペースにおけるスマートグラスの禁止が検討されています。
Sources: Ars Technica
8. GitHub、AIコードレビュー向けオープンベンチマーク「ReviewBench」を公開
- GitHubは、1億390万件のGitHubプルリクエストの分析に基づき、19言語にわたるオープンソースライセンスの公開リポジトリ187件から抽出した219件のプルリクエストで構成された、コードレビューエージェント向けベンチマーク「ReviewBench」を公開しました。完全なベンチマークデータセットが一般公開されています。
- ReviewBenchのゴールデンセットは、人間のレビュアー、最先端LLM、静的解析による指摘事項を組み合わせ、公開された評価基準に沿ってClaude Sonnet 5が判定したものです。すべてのグラウンドトゥルースを独立して再ラベル付けしたシニアエンジニアは、96.6%の割合でReviewBenchと意見が一致しました。
- GitHubによると、ReviewBenchはCopilotコードレビューにおける複数モデルアンサンブルレビューのオンラインA/Bテストの方向性を予測しており、テストでは対処率が8.0%向上、再現率が13.6%向上、レビューあたりのコストが8.0%低下しました。リーダーボードとセルフサービス型ランナーを備えたリサーチプレビューが現在利用可能です。
Sources: GitHub Blog