# 【AIニュース解説】 Anthropicがサイバー能力を段階開放＿＿安全策が本人確認型へ

> https://bookfactory.kr/board/ai-tech/20322
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-10-07T10:15:55.624Z

---

## 危険だから全員に止めるをやめる

2026年10月6日、Anthropicは高度なサイバーセキュリティ能力を持つClaudeを、確認済みの専門家へ段階的に開放する「Cyber Verification Program」を拡大した。一般利用者には危険な操作を止める安全制限を残しながら、正当な防御目的の専門家には、その制限を用途に応じて弱める。

なぜそんな複雑な仕組みが必要なのか。強いAIは、ソフトウェアの弱点を見つけて直す防御側にも、その弱点を悪用する攻撃側にも使えるからだ。全員に強い能力を開放すれば危険が増える。一方で全員を同じように止めれば、本当にシステムを守っている専門家まで強いAIを使えなくなる。

## 3段階で使えるAIの力を変える

新制度では利用者を3段階に分ける。最初の「Defense Access」は、ウイルスの分析、事故対応、自社システムの弱点確認など、防御目的の仕事向けだ。企業や大学、病院や自治体のインフラ担当、実績のある個人研究者などが申請できる。

次の「Red Team Access」は、許可を受けたシステムへ実際に攻撃を仕掛け、どこまで侵入できるかを試す専門チーム向けだ。さらに最上位の「Specialized Access」は、電力網、航空システム、通信網、銀行間送金など、人命や市場に影響し得る重要設備を正式な権限の下で検査する少数組織に限る。最上位は米政府とも協力して組織を詳しく確認する。

つまり「この質問は危険そうだから止める」という内容だけの判定から、「誰が、どんな資格と目的で使っているのか」まで含めて能力を開け閉めする方向へ進んだ。車に例えれば、誰でも同じ速度しか出せないようにするのではなく、免許や仕事に応じて使える機能を変える考え方に近い。

## 13万件の弱点が制度を押し広げた

Anthropicが開放を広げる背景には、先行制度で得られた結果がある。提携先は2026年4月から7月までに少なくとも12万9000件の確認済みソフトウェア脆弱性を見つけ、Anthropic自身の調査でも10月までにさらに5500件を発見した。合計のうち3万3000件超は「重大」または「高い危険度」と評価されている。

ただし、この数字はAnthropicが提携先から集めた報告を基にしており、独立した第三者が全件を同じ基準で監査した数字ではない。Anthropicはむしろ実際の成果はさらに多いと推計しているが、それも現時点では同社側の見積もりとして見る必要がある。

安全制限の差が本当に働くかも社内で試している。Anthropicの評価では、一般向け設定は50回の攻撃シナリオを最初の指示ですべて止め、防御向け設定も46回を途中で止めた。一方、Red Team向けではブロックが発生せず、50回中34回を完了した。つまり同じAIでも、利用者の確認レベルによって実際に能力をかなり変えられることを示している。

## AIの安全策が「身分証」に近づく

この仕組みが興味深いのは、AI安全の考え方そのものを変える可能性がある点だ。これまでは危険な能力が見つかると、「モデル全体を弱くする」「危険な質問を拒否させる」という対策が中心だった。しかしAIが強くなるほど、その能力は医療、研究、インフラ、防御など正当な仕事にも必要になる。

そこで「能力を消す」のではなく、「使える人を確認する」という方法が出てくる。もちろんAnthropicの制度は政府が発行する免許ではなく、企業が審査するアクセス制度にすぎない。それでも、強いAIを全員へ同じ条件で配る時代から、本人確認や組織の責任、利用目的によって権限を変える時代へ進む例としては分かりやすい。

今後、同じ考え方が他の危険性の高いAI用途へ広がる可能性もある。ただし、誰を信用するのか、審査を企業だけに任せてよいのか、許可された組織から能力が悪用されないかという新しい問題も生まれる。AIが強くなるほど、安全策は「何を言わせないか」だけでなく、「誰にどこまで使わせるか」の設計になっていく。

![画像](https://assets.st-note.com/img/1791328588-F4rf1x3acp8doJnXi5zhwYLl.png?width=1200)

今日の話が、あなたの思考を広げるきっかけになったのなら嬉しいです。もし「次の話も聞いてみたい」と思われたら、フォローやいいねをしていただけると幸いです。

https://www.reuters.com/legal/litigation/anthropic-opens-its-most-powerful-ai-models-more-security-teams-2026-10-06/?utm_source=chatgpt.com

**출처:** [note 원문](https://note.com/100syousetuka/n/n45892265f0af)

*번역: Gemma 3(.44) 초벌 + 교정 검수*

[원문 보기](https://note.com/100syousetuka/n/n45892265f0af) | 출처: note.com