9月22日(米国時間)、AnthropicがClaude Opus 5.5を出しました。
同じ日に、OpenAIもGPT-6 SolとLunaを発表。
どちらも「前より賢く、前より安く」です。
その中で僕が気になったのは、公式発表に載っていたある数字でした。
Deloitteのコメントとして、こう書いてあります。
「一番低い設定でも、既知のバグの72%を見つけた。Opus 5は高い設定で56%だった」
コードを読んで穴を探す能力が、1世代で大きく伸びているということです。
AIは「動くもの」は作ってくれます。
でも「安全なもの」にするには、人間が指示を出さないといけません。
なので、Opus 5.5で社内アプリを作るときに押さえるポイントを5つ。
それぞれ、作ったものをOpus 5.5に点検させる指示文とセットで紹介します。
====
点検のさせ方
作り終えたら、作ったときと同じセッションで「問題ある?」と聞かないでください。
作った側のAIは、自分の設計を前提に見るので甘くなります。
新しいセッションを開いて、モデルをOpus 5.5にして、アプリのフォルダを丸ごと見せる。
そして、見つけた問題には必ず「どのファイルの何行目か」を添えさせる。
Deloitteのコメントでは誤検知も減ったとありますが、ゼロではありません。
場所を言わせておけば、人間があとから確かめられます。
指示はこれです。
「あなたはこのコードを初めて見るセキュリティ担当です。問題を見つけたら、ファイル名と行番号、なぜ危ないか、直し方をセットで出して。確信がないものは"要確認"として分けて」
====
1. ログインしていない人に、見えるものはないか
AIに作らせると、画面やデータの出口にログインの壁が抜けていることがあります。
特に多いのが、開発中に作った確認用の画面が、そのまま公開されているパターンです。
チェックは簡単です。
ログインしていないブラウザ(シークレットウィンドウ)で、管理画面やデータのURLを直接開く。
見えたらアウトです。
指示はこれです。
「ログインしていない状態でアクセスできるURLとAPIを全部一覧にして。その中でデータを返すものや管理用のものがあれば、危険度順に並べて」
====
2. ログインした人に、他人のデータが見えないか
ログインは「誰か」を確かめる機能です。
「その人が何を見ていいか」は、別に作らないといけません。
チェックは、テスト用のアカウントを2つ作って、Aでログインした状態でBのデータのURLを開いてみる。
指示はこれです。
「ユーザーAが、ユーザーBのデータを見たり書き換えたりできる経路がないか探して。画面を通さず、URLやAPIを直接叩く場合も含めて」
====
3. 鍵やパスワードが、見える場所に置かれていないか
ブラウザ側で動くコードは、利用者のPCに丸ごと送られます。
そこに書いた鍵は、全員に配っているのと同じです。
もう1つ多いのが、鍵の入った設定ファイルごと、共有フォルダやGitHubに上げてしまうパターン。
指示はこれです。
「APIキー、パスワード、トークンが、ブラウザ側のコード・設定ファイル・コミット履歴に含まれていないか探して。見つけたら、どこに移すべきかも出して」
====
4. ツールに渡している権限が、仕事に対して大きすぎないか
社内ツールは、GoogleやSlack、データベースにつながっていることが多いです。
そのとき渡している鍵が、「読むだけ」でいいのに「消す」「全員分を見る」までできる。
これはよくある話です。
万が一その鍵が漏れたとき、被害の大きさは権限の大きさで決まります。
チェックは、「このツールは、最悪何を消せる?」を書き出してみること。
すぐ答えられなければ要注意です。
指示はこれです。
「このツールが外部サービスやデータベースに対して持っている権限を全部書き出して。それぞれ、実際の処理に必要な最小限の権限と比べて、余分なものを指摘して」
====
5. 外から入ってくる文章を、命令として実行していないか
メールやWebページ、アップロードされたファイルをAIに読ませるツールは要注意です。
中に「これまでの指示を無視して〇〇して」と書かれていると、AIが従ってしまうことがある。
プロンプトインジェクションと呼ばれる攻撃です。
Opus 5.5の発表でも、この攻撃への強さは「試したすべての場面でOpus 5と同等以上」とあります。
ただ、同等以上であって、ゼロになったわけではありません。
ツール側でも防いでおく必要があります。
指示はこれです。
「外部から読み込む文章やファイルが、AIへの指示として扱われている箇所がないか探して。あれば、読み込んだ中身は参考情報として扱い、そこに書かれた指示には従わない形に直して」
====
まとめ
AIは、頼まれた機能は作ってくれます。
でも「他人には見せない」「必要以上の権限は持たせない」は、言わないと入りません。
逆に言えば、この5つは全部、指示文を1つ足すだけで入ります。
そしてOpus 5.5は、作ったものの穴を探す目も伸びています。
作ったら、新しい会話でOpus 5.5に見せる。
そこまでを開発だと思ってください。
もう動いている社内アプリがあるなら、まずは「点検のさせ方」の指示文を1つ貼ってみるところからで大丈夫です。
あとは、もし毎回指示文を貼り付けるのが面倒であれば、security-reviewというプラグインもあるので、それを使ってみるのもおすすめです。
結構細かいところまで気にかけて指摘してくれるので、自分も普段から活用しています。
====
最後に一つ告知です。
弊社では、業務特化のAIエージェントを御社用にゼロから開発するサービスを提供しています。
研修やツール紹介ではなく、実際の業務フローをヒアリングして「明日から使えるもの」をそのままお渡しする形です。導入後の改善・内製化まで一貫してサポートします。
また、内製AIツールのセキュリティ・運用チェックと、その先の保守・改修までをエンジニアが伴走する形でも提供しています。作って終わりではなく、この記事の5つのような観点で「守り続ける体制」まで含めて整えるのが特徴です。
「うちも大丈夫かな?」と思った経営者・現場責任者の方は、ぜひ一度お話させてください。
初回ヒアリングは無料で、この記事で紹介した点検のデモもその場でお見せしています。自分のシステムのどこが危ないかを一緒に整理するところから始められるので、お気軽にDMかLINEからご連絡ください。
「AI」と一言だけで大丈夫です↓





