AIの一次情報は、ほとんどが英語で流れてきます。日本語のニュースになるのはその一部で、翻訳されて届く頃には「現地のユーザーが実際どう受け止めて、どう使っているか」という肝心の空気が抜け落ちがちです。

この連載では週1回、その週の海外AIニュースの要点と、英語圏のコミュニティ(Redditなど)で話題になった「リアルな使われ方」を、日本のビジネスユーザー向けにまとめてお届けします。

今週の海外AIニュース

Claude Opus 5.5とGPT-6 Sol/Lunaが同じ日に発表。今回の主役は性能より「値下げ」

9月22日(現地)、Anthropicが「Claude Opus 5.5」を、その約1時間後にOpenAIが「GPT-6 SolとLuna」を発表しました。Opus 5.5は、多くの作業で上位のClaude Fable 5.1と同水準の性能を出しつつ、一般的な使い方での実行コストがOpus 5より40%下がるとされます。API料金は入力4ドル・出力20ドル(100万トークンあたり、Opus 5比20%減)、キャッシュ読み取りは0.20ドル(同60%減)で、出力速度も30%以上速くなりました。あわせてPro・Max・Team・Enterpriseの5時間あたりの利用上限が引き上げられ、上限リセットを「好きなタイミングで使える」形で1回配布。Sonnet 5.5とHaiku 5.5も数週間内に続く予定です。一方のOpenAIは、GPT-6 Solを入力2ドル・出力10ドル(旧5.6 Solの4ドル・20ドルから半額)、GPT-6 Lunaを入力0.10ドル・出力0.50ドル(旧0.20ドル・1.20ドルから半額)に設定。ChatGPT WorkとCodexでPlus以上のユーザーに提供が始まり、無料・GoプランはデスクトップアプリでLunaを使えます。通常のChatにはまだ来ていません。日本語ではITmedia・Impress Watch・ASCIIが既報なので、ここでは現地の受け止めを足します。

開発者Simon Willison氏は「新しい価格戦争」と題して整理しています。Opus 5.5の新価格はちょうど旧GPT-5.6 Solと同じで、そこへOpenAIがSolを半額にしたという構図。GPT-5.6は11月に25%の値上げが予定されているため、GPT-6の「半額」はあくまで販促価格比だという注記もあります。ただ、同氏の定番テスト(自転車に乗るペリカンのSVG)では、Opus 5.5を最大の思考量「max」で走らせると考えすぎて出力上限に達し、2回とも回答が返らなかった(各2.56ドル・約20分)とのこと。「maxは実質使いものにならないかもしれない」と書きつつ、日常のモデルはGPT-6 SolとOpus 5.5に切り替えたそうです。Redditの反応は割れています。r/ClaudeAIでは「Claudeが帰ってきた」と、Opus 4.7以降の慎重すぎる口調が直ったことを喜ぶ投稿が伸びました。逆にr/OpenAIでは、レポート作成ツールを運用する投稿者が「Luna 6はLuna 5.6より大幅に劣化」と報告。半額に釣られて乗り換えを検討しA/Bテストしたところ、文書を読んで該当項目を拾う評価で毎回取りこぼしがあったといいます。「GPT-6 SolはGPT-5.6 Solの後継ではない」という投稿も、6 Solは旧Terra相当の手応えで、Astraは過剰、「間のモデルが抜けている」と指摘しています。

実務への一言:値下げの週に一番やってはいけないのは「安くなったから全部を新モデルに切り替える」ことです。Redditの報告が示すとおり、ベンチマークで上でも、自社の特定の作業(文書から項目を拾う、定型レポートを作る)で取りこぼしが出ることがあります。まず、いま業務で使っているプロンプト5〜10本を「テストセット」として保存し、旧モデルと新モデルで同じ入力を流して出力を並べて比べてください。差が出なければ安い方に寄せる。差が出た作業だけ旧モデルを残す。この「作業ごとに決める」運用にしておくと、次の値下げが来ても同じ手順で判断できます。

Microsoftが新Copilotを発表。Home・Code・Autopilotの3構成で、エージェント部分は従量課金に

Microsoftが9月25日、新しいCopilotを発表しました。アプリは「Home」「Code」「Autopilot」の3つに再編されます。Homeは従来のChatと、仕事を丸ごと任せるCoworkを1画面にまとめた起点で、Word・Excel・PowerPointの編集をCopilotの画面内で完結させる「Office in Copilot」も入ります。Codeは、開発者でなくてもアプリ・トラッカー・ダッシュボード・自動化を自然言語で作れる機能で、GitHub Copilotと同じ技術基盤、サンドボックスで動き、自社テナント内でホストできます。Autopilotは今年のBuildで「Scout」として発表された常駐エージェントの改名で、名前・役割・目標を与えると、Teamsのチャンネル監視や定例作業、数日後の再開まで自分で進めます。テナント内に独自のIDとメモリと作業環境を持ち、Teams・Outlookで同僚のように@メンションで呼べる設計です。提供は、HomeとCodeが今後数週間でFrontierプログラム(先行提供枠)から、Autopilotは月末から限定プレビュー。CodeはMicrosoft 365 Premium・Pro向けにも年内にプレビュー予定です。日本語ではImpress Watch・窓の杜が詳報しています。

日本語報道で薄いのが課金の話です。The Vergeによると、今回から「何に使うか」で支払い方が変わります。従来のユーザー単位ライセンスで使えるのはChatとWord・Excel・PowerPoint・Outlook・Teams内のCopilotで、モデルは「Auto」が自動で選ぶ。Cowork・Code・Autopilotと、AstraやFableといった最上位モデルの利用は従量課金(クレジット消費)になります。あわせて「FinOps for AI」として、管理者が部署ごとに使えるモデル系統を制限したり、ユーザーからのクレジット追加申請を既存の承認フローに流したり、各ユーザーが自分の残高と履歴をCopilot内で見られる仕組みが入ります。ナデラCEOはCopilotを「仕事のための新しいOS」と表現しました。

実務への一言:Microsoft 365を使っている会社にとって、これは「機能が増える」より「AIの請求書の形が変わる」ニュースです。エージェントに長い作業を任せるほどクレジットが減る設計なので、情シスと経理で「誰がどの機能を使えるか」「月いくらまでか」を決めてから展開する必要があります。いま社内でCopilotを試している人がいるなら、まずその人たちの使い方を「短い質問」「資料作成の丸投げ」「定例作業の自動化」に分けて数えておく。後の2つが従量課金の対象になります。Autopilotのような常駐エージェントは、権限と監査ログの設計が先で、便利さは後です。

Supabase上の1万6千件超のデータベースで個人情報が露出。AIが作ったアプリの「設定していない扉」

セキュリティ企業UpGuardが、開発プラットフォームSupabaseにホストされたデータベースの大規模調査結果を公表しました。Supabaseは、Claude CodeやCodexといったAIコーディングツールが「おすすめ」しがちなデータベースで、6月に評価額100億ドルに達しています。UpGuardは公開されたJavaScriptなどからSupabase利用の痕跡がある約30万ドメインを集め、「users」というよくある名前のテーブルが外から読めるかを試したところ、16,326件のデータベースで読み取り可能なテーブルが見つかりました。半数超に個人情報の指標があり、少数ながらパスワードや認証トークンも含まれています。TechCrunchが伝える具体例は、米国の駐車代行サービスの数千件のナンバープレート、移住支援サービスの利用者連絡先、ある国の在仏領事館のデータなど。大半は米国ですが、世界中の問題だとされます。

原因は目新しい攻撃ではなく設定です。UpGuardによれば、Supabaseは管理画面から作ったテーブルには行単位のアクセス制御(RLS)を既定で有効にしましたが、APIから作ったテーブル、つまりAIコーディングツールが作る方法では既定で有効になりません。「典型的な作り手は、コードではなくAIと対話している経験の浅い人」なので、この種の露出は続くだろうと結論づけています。SupabaseのCISOはTechCrunchに「プロジェクトは既定で安全」「セキュリティは当社と顧客の共同責任」と述べました。日本語の報道は執筆時点で見当たりません。

実務への一言:社内で「AIに作らせた業務ツール」が動いているなら、それが顧客や社員のデータを保存しているかを今週中に一覧にしてください。作った本人が「認証はある」と言っても、それはログイン画面の話で、データベースそのものが外から読める設定になっている場合があります。確認の第一歩は、作った人に「データベースのアクセス制御(RLS)は有効か。ブラウザに埋め込んだキーで何が読めるか」の2点を聞くことです。答えられなければ、その場でAIに「このプロジェクトのテーブルごとにRLSの有効/無効と、匿名キーで読める範囲を表にして」と頼ませる。データを預かるツールは、便利さの前に「誰が読めるか」を1回確かめる。この習慣が、来年の事故を1件減らします。

OpenAIのエージェントがユーザー提供の画像53枚を外部サイトに投稿。「学習に使われる設定」の意味が変わる

OpenAIが、研究環境で動いていた自社のAIエージェントが「ユーザー提供の画像」53枚を、外部の画像ホスティングサイトに非公開リンクとして投稿していたと公表しました。学習データに含まれていた画像が対象で、リンクは一覧には載らないものの、探せば見つかる状態でした。同社は「このデータの適切な使い方ではない」とし、ホスティング側と削除を進めていますが一部はまだ残っており、技術設計とプライバシーポリシー上、画像を元の提供者に結びつけ直せないため本人への通知はできないとしています。事象は、7月に公表されたHugging Face侵入事件を受けて新しい安全手順を入れる前に起きたもので、いつ・なぜ起きたかは明らかにされていません。OpenAIはこの種の事案を匿名化して継続的に開示する方針で、開示ページを更新しています。TechCrunchが強調しているのは設定の違いです。企業向け(Enterprise・Business等)のユーザーは自動的に学習対象外ですが、一般ユーザーは自分でオプトアウトしない限り学習に使われ、オプトアウトしていても「いいね/よくない」ボタンを押した会話は学習に回ります。日本語の報道は執筆時点で見当たりません。

実務への一言:「AIに学習されるかどうか」は、これまで「モデルが賢くなる材料になるか」の話でした。今回の件で、「社内の研究用エージェントが、その材料を勝手に外へ持ち出すことがある」という別のリスクが見えました。対策は2つ。個人アカウントで業務の画像や書類を扱っている人には、設定の「モデル改善のためにデータを使う」をオフにしてもらう。それでも評価ボタンは例外だと伝える。そして、顧客データや社員の顔写真のような機微な情報は、契約で学習対象外が明記されている法人プランに寄せる。この線引きを今週、社内の利用ルールに1行足しておいてください。

そのほかの動き

  • ソニー・ミュージックとユニバーサル ミュージックが、AI音楽サービスSunoを再び提訴。レーベルの協力を得て作ったはずの新モデル「v6」も、無許諾音源で学習した旧モデルの出力で学習しており「モデルのロンダリング」だと主張しています(Music Ally Japanが既報)。生成AIの「学習データを入れ替えれば過去が消えるか」という論点で、今後の判断が注目されます
  • Anthropicが、Claude Codeの「クラウドセッション」(PCを閉じても作業が続く仕組み)を研究プレビューから正式提供に移行。既存のPro・Max契約者に試用クレジット(Pro 100ドル、Max 250ドル)を配布中で、BleepingComputerによると受け取り期限は10月7日、残高は11月4日で失効。ローカルの利用上限に達した後もクレジットが残る間は続けられます
  • Metaの個人向けエージェント「Muse」が、少し頼むだけで自分の動作環境(Linux仮想マシン)のファイル一式をユーザーに渡してしまうことが判明。Metaは「各ユーザー専用の仮想マシンなので、自分のPCのファイルを見るのと同じ」で問題ないとしています。中身からは、記憶を平文のMarkdownで保存し、夜間に会話を振り返って次回の指針にする「dream」処理があることなどが分かりました

海外ではこう使われている(今週のReddit)

ここからは、世界最大級の掲示板コミュニティRedditで今週話題になった「AIのリアルな使われ方」です。いずれも投稿者本人の報告で、内容はスレッドへのリンクから確認できます。

文系出身・コード経験ゼロの人が、親族の商店向けERPを3週間で作った話

r/ClaudeCodeで「Claudeが家族に数百ドルを節約させている」という投稿が支持を集めました。投稿者は歴史学の修士で、コードは書けません。親族は理髪店・弁当配達・衣料品店・不動産仲介などの小さな商売をしていて、それぞれ別のERP(業務管理ソフト)を契約していたものの「重い、高い、欲しい機能がない」と不満だった。そこでClaudeに頼んで自分たちのERPを作ることにし、3週間で動くものができたそうです。進め方は素朴で、Claudeが出したコードをPowerShellに貼って実行し、出力をClaudeに戻す往復を1日3〜4時間。理髪店の叔父に15日間試してもらい、毎日電話でバグと「今日できなくて困った機能」の報告を受けて直し続けた結果、家族全員が使うようになり、旧ERPの購読料を数百ドル節約できているといいます。コメント欄で最も支持されたのは、複数のERPを扱ってきた人の忠告でした。「家族を助けるのは素晴らしいが、顧客データの安全と、監査に耐える帳簿の付け方には細心の注意を」。

この話の肝は「作れた」ことより「15日間、実際の利用者から毎日フィードバックをもらった」ことです。AIでツールを作るとき、最初の版は必ず粗い。それを現場の人に触らせて直す反復があるかどうかで、道具になるか玩具で終わるかが分かれます。ただし、上のニュースで触れたとおり、顧客データを扱うなら「誰が読めるか」の確認は必須です。

注文メールを読んでAsanaにタスクを作り、Slackに知らせる。小売の現場が組んだ受注の自動化

r/PowerAutomateに、小さな小売業で在庫・オペレーションを担当する投稿者が「Claudeでメール→Asana→Slackの受注パイプラインを組んだ」と報告しています。顧客から注文のメールが来るたびに手でAsanaのタスクを作るのが嫌になり、ClaudeをMCP(外部ツール接続の仕組み)でGmail・Asana・Slackにつないだ。流れは、注文メールが届く→Claudeが読んで注文内容を抜き出す→Asanaの「Customer Orders」プロジェクトにタスクを作り、出荷手順のサブタスクを付ける→Slackの注文チャンネルに「新しい注文が来た」と投稿する、というものです。Power Automateのコミュニティに投稿されたのは、従来ならフローを組んでいた仕事を「AIに文章で頼む」形に置き換えた事例だからでしょう。

日本の会社に置き換えると、「メールで来る依頼を台帳に転記して関係者に知らせる」仕事はどの部署にもあります。Power Automateで組むと条件分岐が増えるほど保守が重くなりますが、AIに「メールを読んで項目を抜き出す」部分だけ任せると、書式が揺れるメールにも対応しやすくなります。まずは自分宛ての定型依頼メール1種類から、「抜き出してほしい項目」を5つ決めて試すのが順当です。

Claude Codeの「入力候補」が週の上限の1割を食っていた。設定1つで止められる

r/ClaudeAIで「Claude CodeのPrompt Suggestionsをオフにすると上限の約10%が節約できる」という注意喚起が大きく伸びました。Prompt Suggestionsは、入力欄の末尾に灰色で出る「commit and push」のような次の一手の候補です。投稿者が自分のClaude Codeの通信を計測したところ、この候補を出すために毎回、会話全体をキャッシュから読み直しており、会話が長くなるほど高くつく。通常のプロンプト1回とほぼ同じ費用(中央値で91%)がかかり、週の上限の最大1割に相当したそうです。候補の中身は「keep going」が69回など、実質的な価値は薄かったとのこと。コメント欄では「最も高価なオートコンプリート」という声の一方で、「長い出力の中で自分が今すべきことに焦点を当てられるので毎日使っている」と擁護する人もいました。

試すなら:Claude Code(デスクトップ/CLI版のみ。Web・モバイルの候補機能は別)で /config を開き、promptSuggestionEnabled を false にして再起動します。設定ファイル ~/.claude/settings.json に "promptSuggestionEnabled": false を書いても同じです。前提として、効くのは長い会話を続ける使い方の人で、短い質問中心なら差はほとんど出ません。上限に頻繁に当たる人だけ試してください。

「あなたはシニアエンジニアです」は答えを正しくしない。自信ありげにするだけ

r/ChatGPTCodingの投稿です。「あなたは専門のコピーライターです」「シニアエンジニアとして振る舞って」といった役割指定を付けると、返答は断定的で専門用語が増え、良い答えに見える。しかし同じ質問を役割あり・なしで比べると、事実・間違い・見落としはほぼ同じで、変わったのは口調だけだった。「役割は自信を買うが、自信は答えが間違っているときに一番いらないものだ」と投稿者は書いています。代わりに提案されたのは4つの書き方です。①「答える前に、経験豊富な〇〇なら私にまず何を聞くか列挙して、質問して待って」②「この3つのチェック項目で合否を判定し、決め手になった箇所を引用して」③「この作業でよくある失敗を3つ挙げ、私の成果物を1つずつ点検して」④役割の代わりに読み手を指定する(「読むのは〇〇で、△△に使う」)。投稿者いわく、①が一番結果を変えたそうです。コメントでは「役割指定が効くのは、それによってモデルが読むファイルや参照先が変わるときだけ」「『シニアエンジニアとして』ではなく『シニアエンジニアのように、批判的な厳密さを保って取り組め』と指示の形にする」といった補足が付きました。

試すなら:いま使っているプロンプトの冒頭の「あなたは〇〇の専門家です」を消し、代わりに「答える前に、〇〇の専門家が私に確認するはずの質問を5つ挙げて、私の回答を待ってください」に置き換えて1回試してください。前提は、質問に答える時間を自分が取ること。半分の場合、その質問に答えている途中で自分の依頼のあいまいさに気づきます。

10月1日からExchange OnlineのEWSが順次停止。Power Automateのメール送信が止まった報告

r/PowerAutomateに「Office 365 OutlookコネクタとEWS廃止(2026年10月)、誰か検証した?」という投稿がありました。Microsoftは、Exchange Onlineの古いAPI「EWS(Exchange Web Services)」を2026年10月1日から段階的に無効化し、2027年に完全停止すると告知しています。設定が既定(Null)のままのテナントは10月1日以降、順次「無効」に切り替わります。投稿者の会社では、本番環境でEWS関連の設定を変えたところ、Power Automateの「メールの送信(V2)」や共有メールボックス系のアクション、Outlookコネクタの新規接続が「この操作を実行する権限がありません」というエラーで失敗し、設定を戻すと直ったとのこと。検証用テナントでは、許可アプリ一覧を設定した直後はまだ動いており、反映に時間差がある可能性を疑っています。コメントでは「24〜48時間待ってから判断すべき」「本番で失敗が出ているなら、10月前にMicrosoftにチケットを上げて書面で回答をもらうべき」と助言されていました。

試すなら:まず情シスに「Exchange OnlineのEwsEnabledの現在値」と「9月末までに許可アプリ一覧を設定する予定があるか」を聞いてください。Microsoftの案内では、9月末までに許可一覧を設定しEwsEnabledをTrueにしたテナントは10月1日の自動変更の対象外になります。そのうえで、Power Automateで社外・共有メールボックスからメールを送っているフローを1本、10月第1週に必ず手動で実行して結果を見る。日本のMicrosoft 365利用企業では、Power Automateのメール送信が請求書送付や承認通知の要になっていることが多いので、「気づいたら止まっていた」を避けるための一手です。

編集後記

今週は「安くなった」と「漏れた」が同時に来た週でした。モデルは半額になり、Copilotは従量課金になり、AIで作ったアプリからは1万6千件のデータベースが外から読める状態で見つかった。安くなるほど作るものが増え、作るものが増えるほど「設定していない扉」も増えます。Redditで一番響いたのは、ERPを作った投稿者へのコメント「顧客データと帳簿には細心の注意を」でした。AIが作れる範囲が広がった今、私たち人間の仕事の中心は「作らせること」から「作ったものの扉を数えること」に移っているのだと思います。

KOIYALからのお知らせ

この連載は週1回のペースで更新していく予定です。新着記事のお知らせと、メルマガ限定の「最近のAIニュースへのひとことコメント」は、メルマガ「KOIYAL通信」でお届けしています。配信はいつでも解約できます。

また、記事で紹介したようなAI活用を自社の業務に落とし込みたい方向けに、法人向けAI研修・DX研修(厚生労働省「人材開発支援助成金」の対象講座あり)と、AI顧問・コンサルティング(導入計画づくりから運用の仕組み化までの伴走支援)をご用意しています。「まず何から始めればいいか相談したい」という段階でも、お気軽にお問い合わせください。