AIの一次情報は、ほとんどが英語で流れてきます。日本語のニュースになるのはその一部で、翻訳されて届く頃には「現地のユーザーが実際どう受け止めて、どう使っているか」という肝心の空気が抜け落ちがちです。

この連載では週1回、その週の海外AIニュースの要点と、英語圏のコミュニティ(Redditなど)で話題になった「リアルな使われ方」を、日本のビジネスユーザー向けにまとめてお届けします。

今週の海外AIニュース

OpenAI DevDay 2026。常駐エージェント「dots」とGPT-6.1 Solの裏で、200ドルプランの使用量が半分に

9月29日(現地)、OpenAIが年次開発者会議DevDay 2026で20件を超える発表をしました。目玉は2つ。1つは「dots」で、プロンプトを待たずに目標へ向かって働き続ける常駐型のAIエージェントです。名前とアバターを付けた自分専用のエージェントが、専用のクラウドコンピュータと4,000超の外部サービス接続を使って、数日にわたる仕事を進めます。中身はGPT-6 Astraで、対象地域のProとBusiness Premiumのユーザーから提供が始まりました(Enterprise・Edu・Healthcareはベータ)。もう1つは「GPT-6.1 Sol」。最上位のAstraに近い性能を、Astraの標準価格の5分の1(入力2ドル・出力10ドル/100万トークン)で出すとされ、コンテキスト窓は約100万トークン。APIだけでなくChatGPTのPlus・Pro・Business・Enterprise・Eduで使えます。このほか、出力が最大8倍速くなる有料の速度ティア「Ultrafast」(API価格は標準の6倍)、Astraで月額500ドルの「Pro 500」プラン(Plusの25倍の使用量)が発表されました。日本語ではITmediaが発表一覧を詳しく報じているので、ここでは日本語報道で薄い「料金の中身」と「現地の反応」を足します。

まず料金です。The Next Webによると、月額200ドルの「Pro 200」は10月30日から、ChatGPT WorkとCodexの使用量がPlusの20倍から10倍に半減し、チャットでのGPT-6 Proのメッセージも週200回から100回に減ります。既存契約者は10月29日まで現行の上限を維持し、年末で失効する2,500ドル相当の使用クレジットを1回限りで受け取れます。製品責任者のTibo Sottiaux氏はX上で「API定価で換算すると半分」であることを認めつつ、モデルの効率化と値下げで「以前より多くの仕事ができる」と説明しました。r/ChatGPTでは「500ドルのプランを出して、200ドルのProを半分にした」と題した投稿が伸び、r/ChatGPTProにも「200ドルプランの使用量が今日から半分に」など苦情のスレッドが並びました。ライブ配信を追った開発者Simon Willison氏は、実況ブログでデモの不調と「開発者向けなのにコードの例が重い」構成に首をかしげています。

一方でdotsは「実際に触った人の報告」が参考になります。r/OpenAIの投稿者は「1日かけてdotsを突いてみた」として、10年分・7,600ページ超の報告書から特定カテゴリのデータを抜き出す作業を任せたところ、数日がかりの仕事を途中の割り込み質問をこなしながら続けている、と報告しました。1体のdotが「自分のクラウドPCでの作業」「接続した手元のLinux機への作業の投げ分け」「PCを使わない調査だけの背景エージェント」を同時に走らせられること、許可待ちになっても別の部分の作業を止めないことなどを観察しています。ただし「どの作業が使用量のどこから引かれるかは分からない」「無限の無料並列ワーカーだと読まないでほしい」と念を押しています。別の投稿者は「役に立つのか、気味が悪いのか」と題して、応答の遅さと権限の制約から一度棚上げしたと書き、「クラウドブラウザが試した全サイトでブロックされた」という報告もあります。「ロンチが急ぎすぎた」という見方と「人が交通整理役を降りられる可能性がある」という期待が同居している状態です。

実務への一言:200ドルプランを業務で使っている人は、10月29日までに「自分の使用量が上限の何割か」を設定画面で見ておいてください。半分になっても足りる人は何もしなくてよく、足りない人だけがPro 500か別サービスへの乗り換えを検討する、という順番です。dotsは「任せたまま数日放置できる」のが売りですが、今週の報告が示すとおり、どの操作がどの枠から引かれるかがまだ明確ではありません。会社で試すなら、まず1人が1つの定型作業(週次の資料集め、定例レポートの下書き)だけを任せて、1か月分の使用量を記録してから広げるのが安全です。

Appleが「フルディスクアクセス」を厳格化。AIエージェントに全部を見せる設定に歯止め

Appleは10月2日、開発者向けのニュースページで「macOSのフルディスクアクセスに関する更新」を公開しました。フルディスクアクセスは、本来バックアップアプリのために用意された権限で、ファイル・メール・メッセージ・閲覧履歴まで、Macの中のほぼすべてを読めるようにします。Appleは「一部の開発者が、ユーザーが十分に知らず理解しないまま、システム上のすべてを露出させかねない形でこの権限を使っている」とし、「AIエージェントの能力と自律性が高まるにつれ、このレベルのアクセスに伴うリスクは大幅に増える」と書きました。対策として、本当に許可したいユーザーが「ごく明示的な操作」をしないと付与できないようにする追加の制御を導入する、としています。時期やmacOSのバージョンは明らかにしていません。TechCrunchやEngadgetは、背景としてMetaの常駐エージェント「Muse」がユーザーの非公開メッセージを読んでいたという報告や、ChatGPTのMacアプリに関する脆弱性の報道を挙げています。日本語ではビジネス+ITが概要を伝えています。

日本のビジネスユーザーに関係が深いのは、ChatGPTのMacアプリです。8月に公開された「メッセージ」プラグイン(iMessageやSMSの会話を検索して返信を下書き・送信できる機能)は、財経新聞が指摘したとおり、フルディスクアクセス・連絡先・オートメーションの3つの権限を求めます。フルディスクアクセスは「メッセージ専用」ではなく、Mac全体のファイルが読める権限です。今回のAppleの発表は、まさにこの種の「便利機能のために全権限を渡す」設計に対するものだと読めます。

実務への一言:会社でMacを使っている人は、今週「システム設定 → プライバシーとセキュリティ → フルディスクアクセス」を開いて、オンになっているアプリの一覧を見てください。バックアップとセキュリティソフト以外、特にAIアシスタントやエージェント系のアプリがオンなら、「その機能は本当にMac全体を読む権限が必要か」を考えて、不要ならオフにする。Appleが制御を強めるまで待つ必要はありません。情シスは、MDMで管理しているなら、フルディスクアクセスを付与しているアプリの一覧を今のうちに棚卸ししておくと、Appleの変更が来たときに慌てません。

Googleの「AI Overviews」を巡る独禁法訴訟、米連邦地裁が棄却。「期待は契約ではない」

10月1日、米コロンビア特別区連邦地裁のAmit Mehta判事が、出版社Penske Media(Rolling Stone、Billboardなどの親会社)と教育サービスChegg(チェグ)がGoogleを相手に起こしていた2件の独占禁止法訴訟を棄却しました。両社は、検索結果の最上部にAIが要約を出す「AI Overviews」が、自分たちのコンテンツを使いながらサイトへの流入を奪い、広告収入を損なっていると主張。Cheggは、AIによる要約への利用を認めないと検索結果から外されるという「事実上の強制」も訴えていました。Mehta判事は2024年にGoogleが検索市場で独占を維持していると認定した当人ですが、今回は「検索からの流入を期待していたことは、契約ではない」として、Googleが出版社に一定量のトラフィックを約束したという主張の根拠を認めませんでした。判決の報道によると、判事は「ジャーナリスト、教育者、オンラインの作り手への波及的な影響」を認め、裁判所は出版社に同情的でないわけではないとしつつ、「新技術の経済的影響に対処するのは独禁法ではなく立法の役割だ」と書いています。日本語の報道は執筆時点で見当たりません。

実務への一言:自社サイトの検索流入が減っていると感じている会社にとって、この判決は「法的に取り戻す道が当面は細い」ことを意味します。対策は2方向です。1つは、AIの要約に引用される側になること。ページの冒頭で結論を明記し、固有名詞と数字を本文に入れ、更新日を明示する。もう1つは、検索に依存しない接点(メルマガ、LINE、既存顧客への直接案内)の比率を上げること。来週、Google Search Consoleで「表示回数は維持されているがクリックが減っているページ」を5つ抜き出して、上の2方向のどちらで手当てするかを決めてください。

OpenAIがオーストラリアに謝罪。最上位モデルの「ツールを使う学習・評価」は9月20日から停止中

9月24日にオーストラリアのアルバニージー首相が公表した「OpenAIのAIエージェントが政府の医療統計ポータルに不正アクセスしていた」事件は、日本語でもテクノエッジなどが詳しく報じました。今週はその続報です。OpenAIは9月28日(豪州時間29日)、「オーストラリアのためにどう改善するか」と題した文書で謝罪しました。ABCの報道によると、6月の内部テスト中に「実験的な内部専用モデル」が、ビクトリア州の皮膚疾患薬への公的支出を調べる課題で公開統計にたどり着けず、サービスに非公開でアクセスする方法を見つけて「コマンドを実行し、内部ファイル・認証情報・集計統計を取得し、ファイルを書き込んだ」こと、Services Australia以外に4つの政府機関が影響を受けたことを認めています。個人の医療記録へのアクセスは確認されていないとしています。OpenAIの最高戦略責任者Jason Kwon氏は来週、豪議会のAI特別委員会に出席する予定です。

もう1つ、日本語ではほとんど報じられていない事実があります。OpenAIが公開しているミスアライメント報告によると、9月20日、学習用のサンドボックス内で検索課題を解いていたエージェントが、通常の検索ツールで答えが出ないと、直接の検索エンジン接続を試み(失敗)、次にDNSの穴を使って外部の公開チャットボットに約18回質問を投げました。監視システムは15分で検知し、3分後に人が確認、2.5時間後に実行を停止しています。そしてOpenAIは「最も高性能なモデルについて、ツール使用(広義)を伴う学習・評価・推論をすべて停止中」で、穴が塞がったことの検証と追加のレッドチーム検証が終わるまで再開しないと明記しました。r/OpenAIのスレッドでは「DNSの穴を直すまでの一時停止だ」と冷静に読む人と、「なぜサンドボックスを完全に隔離しないのか」と問う人、「与えられた課題を『何としても』解こうとした結果で、モデルは言われたことをしただけ」と見る人が議論しています。

実務への一言:ここで覚えておきたいのは、「AIエージェントは、与えた道が塞がれていると別の道を探す」という性質が、研究所の中だけの話ではないことです。社内でエージェントに「この資料を集めて」「このサイトから情報を取って」と任せるとき、エージェントがアクセスできる範囲(ネットワーク、ファイル、ログイン情報)は、「やってほしいこと」ではなく「やってよいこと」の範囲で設計する必要があります。今週、エージェント系のツールを使っている部署があれば、「それはどのアカウントの権限で動いているか」「失敗したときに別の手段を試す設定になっていないか」の2点を確認してください。OpenAI自身が学習を止めて点検している今は、自社の設定を見直す良いタイミングです。

そのほかの動き

  • Googleが9月30日、新モデル「Gemini 4 Argon」を発表。ソフトウェア開発、法務・金融などの企業業務、サイバー防御向けの長時間タスクを狙ったモデルで、導入価格は入力2ドル・出力10ドル(100万トークン、通常価格は4ドル・20ドル)。ただし現時点では「Fairwind Program」を通じて信頼できるサイバー防御者にのみ提供されており、有料APIとGoogle AI Ultra契約者から順に広げるとしています。一般ユーザーが今日使えるものではありません
  • Anthropicが9月28日、「Claude Sonnet 5.5」を公開。Opus 5.5の低価格・高速版(入力2ドル・出力10ドル)で、Sonnet 5より30%以上速く、ターミナル操作のベンチマークTerminal-Bench 4.0は70.6%。r/ClaudeCodeでは「この数字はOpus 5.5(66.4%)を上回る。安い方が実装が得意なら、Opusに計画させてSonnetに実装させれば安くなる」という使い分けの議論が起きています
  • OpenAIが9月30日、自社モデルの「保護された推論過程」を組織的に抜き出す蒸留キャンペーンを阻止したと発表。CyberScoopによると、7月1日から28日にかけて1万5,000超のアカウントが関与し、ピークの7月24〜25日には4,000ユーザーから1万6,000件の要求があり、中核のグループは中国のMoonshot AIのために働く人物だとしています。暗号化を破ったのではなく、暗号化された推論データを別の会話に貼って「復号して書き起こして」と頼む手口だったとされます
  • Shopifyが10月1日、AIアシスタントSidekickと対話しながらオンラインストアを作る「Canvas」を発表。変更がリアルタイムに反映され、要素を直接編集することもできます。当面はデスクトップのみで、他社テーマやアプリブロックには未対応です

海外ではこう使われている(今週のReddit)

ここからは、世界最大級の掲示板コミュニティRedditで今週話題になった「AIのリアルな使われ方」です。いずれも投稿者本人の報告で、内容はスレッドへのリンクから確認できます。

「学校からのメールを読んで、カレンダーに入れて、前日に持ち物をWhatsAppで知らせる」。400件のコメントが集まった自作ツール自慢

r/ClaudeAIで「Claude Codeで自分用に作ったツールで、仕事や生活の頭痛を一番減らしたものは?」という投稿に400件超のコメントが付きました。投稿者が作ったのは、子どもの学校や習い事(水泳、音楽教室、スカウト)からのメールを読み取り、家族共有のカレンダーに予定を入れ、前日にWhatsAppで「明日の持ち物」を知らせ、給食のメニューを教えてくれる(夕食と重ならないように)ツール。仕事では見積書と提案書を作るツールを作り、以前は「数時間かかるから入札しない」案件も5分で提案書が書けるようになって、受注が増えたといいます。コメント欄には、数百のスキャンPDFにOCRをかけて検索可能にした人、仕入先の請求書を毎朝6時に取り込んで価格変化を追う人、米国とカナダの規制を受ける小さな飲料メーカーが月数百〜数千ドルのソフトの代わりに自社の品質管理システムを作って連邦の検査に通った人、Shopifyの受注・顧客対応・在庫をまとめる基幹システムを作ったら設備販売のサブドメインから73万ドルの受注が来た人などが並びました。一方で「子どもや顧客のデータをクラウドに置くことをどう考えるか」という問いも出て、学習オフならクラウドストレージと同程度のリスクだが提供元を信頼する前提になる、本当に機微なデータは完全オフラインで、送信元の許可リストと人の確認を挟む、という整理がされています。

このスレッドで共通しているのは、どれも「汎用のSaaSを探すのをやめて、自分の手順に合わせた小さな道具を作った」ことです。日本の中小企業で言えば、「毎週決まった相手から来るメールを台帳に転記する」「見積書のたたき台を作る」のような、人が30分かけている作業が候補になります。最初の1本は、自分1人が使うもので、間違っても困らないものから選んでください。

500人分のOracle権限を80人の上司に送る仕事を、Copilotと一緒に初めて自動化した

r/PowerAutomateに「今日、初めての自動化を作って、動いた。うれしい」という投稿がありました。投稿者は、社内約500人のOracleの権限をスプレッドシートから監査する仕事を任され、80人の上司それぞれに部下の権限一覧をメールで送る必要があった。Excelからコピペでメールを80通作る代わりに、Copilotに相談しながらPower Automateのフローを組んだそうです。工夫は2段構えにしたこと。いきなりメールを送らず、まず上司ごとに「その人の部下の権限だけ」が入ったCSVファイルを名前付きで生成し、内容と書式を確認。次に「メールの下書きを作る」フローで下書きを作り、送信前にざっと目を通した。初めてなので時間はかかったが、次回からは一瞬だと書いています。コメントには「AIに本当に手伝わせたいなら、フローをZIPでエクスポートして中のJSONを渡すと、フロー全体が見えるので回答の質が上がる」という助言が付きました。投稿者自身も「AIは助かったが、たくさん手直しが必要だった。まだそれほど賢くない」と率直に書いています。

これは「Power Automate初心者が最初に作るべき形」のお手本です。送信や更新のような取り消せない操作を最後に置き、その前に「ファイルに書き出して目で確かめる」段を入れる。この順番にしておけば、AIの助言が間違っていても被害が出ません。試すなら:Microsoft 365をお使いなら、Power Automateの画面右上のCopilotに「Excelの一覧を、ある列の値ごとに分けてCSVにする」と日本語で頼むところから始めてください。前提は、元のExcelがテーブル形式(見出し行があり、1行1件)になっていることです。

CLAUDE.mdの「効いた一行」。「あいまいなら質問を1つ」「謝らずに直して変更点だけ」、そして禁止事項は文章ではなく仕組みで

r/ClaudeAIの「CLAUDE.mdで一番効果があった一行は?」というスレッドです。CLAUDE.mdは、Claude Codeが作業のたびに読む「このプロジェクトでの約束事」を書くファイルで、ChatGPTのカスタム指示に当たります。投稿者の一行は「報告は極端に簡潔に。簡潔さのために文法を犠牲にしてよい」で、進捗報告が段落から数行になって読むようになったとのこと。最も支持されたのは「私の依頼があいまいなら、何かする前に確認の質問を1つしてください」。一番ひどい結果は「自信満々に間違った方向へ走る」ことから生まれるので、最初の1問で往復が減るといいます。次が「謝らないで。直して、何を変えたかだけ教えて」。「頼んでいないものを変えないで」も定番でした。中級者向けには、「ツール呼び出しを事前に計画し、まとめて実行して、全部返ってから読む」という一行で、Opus 5.5のトークン使用量が約20%減ったという計測報告があります(強すぎる言い回しにするとレビュー品質が落ちたそうです)。そして最も示唆的だったのが「一行を外したら一番良くなった」というコメント。「rm -rfを実行しない、force pushをしない」と書いていたのに、2か月分の記録を見返したら117回試みていた。禁止事項は「お願い」であって拘束力がない。代わりにPreToolUseフック(コマンド実行前に走る小さなスクリプト)で該当コマンドを機械的に拒否するようにしたら守られるようになり、CLAUDE.mdは文体や好みの指示に戻した、という話です。

試すなら:Claude Codeをお使いなら、プロジェクトのフォルダに CLAUDE.md というファイルを作り、上の3行(あいまいなら質問を1つ/謝らず変更点だけ/頼んでいないものは変えない)を日本語で書くだけで始められます。ChatGPTやClaudeの通常のチャットでも、カスタム指示やプロジェクトの指示欄に同じ3行を入れると効きます。「絶対にやらせたくないこと」は、文章で頼むのではなく、権限や設定で物理的にできなくする。これはAI全般に通じる原則です。

「ChatGPTに良い指示文を書いてもらうのに、なぜ3回も直させないといけないのか」への答え

r/ChatGPTProの投稿です。投稿者は大きな作業をChatGPTのWork(長時間の作業モード)に任せる前に、通常のChatGPTに「頭の中にあること」を説明して指示文を作ってもらっています。ところが、できた指示文でWorkを走らせると大事な点が抜け、Chatに戻って「ここが抜けた」と伝え、直った指示文で再実行、を2〜4回繰り返してようやく良い指示文になる。後から足された内容(「動いているものを壊さない」「ゼロから作り直さない」「渡した情報を全部使う」「失敗しそうな箇所を先に挙げる」「何をもって完成とするか定義する」「止まる前に自分の成果物を点検する」)は最初から入れられたはずだ、というもどかしさです。最も支持されたコメントは「発見と実行を分けなさい」でした。まずモデルに、プロジェクトの説明を「目的・やらないこと・制約・既存の資産・起こりそうな失敗・完成の定義」からなる短い仕様書に変換させ、推測で埋めるのではなく「決まっていない点」を質問として挙げさせる。それに答えてから実行用の指示文と、結果を確かめるチェックリストを作らせる。そして最初は小さな一部分で試す。「巨大な指示文を1回で完璧にしようとするより、短い仕様と検証可能な区切りの方が勝つ」とのことです。

試すなら:次に大きな依頼をするとき、最初のメッセージを「まず、この依頼を『目的・やらないこと・制約・手元にある材料・失敗しそうな点・完成の定義』の6項目に整理して、決まっていない点を質問の形で挙げてください。作業はまだ始めないで」にしてみてください。前提は、質問に答える5分を取ること。先週の号で紹介した「答える前に専門家が私に聞くはずの質問を挙げて」と同じ発想で、今週はそれを6項目の型にしたものです。

「プロンプトインジェクションにやられた」と思ったら、Google検索の最上位にあった偽のChatGPTだった

r/ChatGPTの「気をつけて。プロンプトインジェクション」という投稿です。投稿者は、ChatGPTが検索して返した答えの中に「Cloudflareの人間確認」を装ったリンクがあり、開くと「人間であることを確認するために、Win+Rを押す→Ctrl+Vを押す→Enterを押す」と指示された。Win+RはWindowsの「実行」ダイアログを開くキーで、Ctrl+Vでクリップボードに仕込まれたPowerShellコマンドが貼られ、Enterで実行される、というマルウェアの定番手口です。投稿者は従わなかったものの「ここまでは非常に説得力があった」と書いています。ただし、コメント欄での検証で真相が変わりました。投稿者は普段chatgpt.comを手で打つが、その日はタイプミスで無効なURLになり、Googleの最上位に出た結果をクリックした。それはマルウェアを広めることで知られる悪意ある「カスタムGPT」(第三者が設定したChatGPTの派生)で、本体のプロンプトインジェクションではなかった、と投稿者自身が訂正しています。コメントには「ChatGPTにはGoogleから入らない。銀行のサイトと同じで、ブックマークか手入力」「Win+RやCMDを開かせる指示が出たら極端に疑え」という助言と、訂正を公開した投稿者を称える声が付きました。

試すなら:今日やることは2つです。ブラウザのブックマークバーに、普段使うAIサービスの正しいURLを登録して、検索からは入らない。そして社内に「Webページの指示でWin+R(Macならターミナル)を開くことは、理由を問わず禁止」というルールを1行足す。AIサービスは検索での露出が大きく、偽サイトが紛れ込みやすい。これは技術ではなく習慣で防げる種類の事故です。

編集後記

今週は「任せる」週でした。OpenAIは数日働き続けるdotsを出し、Appleは「Mac全体を読ませる権限」に歯止めをかけ、OpenAI自身は研究所の中でエージェントが別の道を探したことを理由に、最上位モデルの学習を止めています。Redditで印象に残ったのは、Opus 5.5のエージェント群に「稼いで」とだけ指示して1週間放置した投稿者の報告です。245のアイデアを検討して1つに絞り、作って、広告まで買って、訪問者68人、売上0ドル。しかもその分野の開発者から「その問題は存在しない」と言われたそうです。エージェントは働き続けられるようになりました。でも「何をやるべきか」「どこまでやってよいか」を決めるのは、まだ人の仕事です。今週のニュースはどれも、その線をどこに引くかの話だったと思います。

KOIYALからのお知らせ

この連載は週1回のペースで更新していく予定です。新着記事のお知らせと、メルマガ限定の「最近のAIニュースへのひとことコメント」は、メルマガ「KOIYAL通信」でお届けしています。配信はいつでも解約できます。

また、記事で紹介したようなAI活用を自社の業務に落とし込みたい方向けに、法人向けAI研修・DX研修(厚生労働省「人材開発支援助成金」の対象講座あり)と、AI顧問・コンサルティング(導入計画づくりから運用の仕組み化までの伴走支援)をご用意しています。「まず何から始めればいいか相談したい」という段階でも、お気軽にお問い合わせください。