2026年10月6日に、Anthropicは、審査を通過したセキュリティ組織や研究者等に、高度なサイバー能力を持つAIモデルへのアクセスを許可するプログラムを拡充したと発表した。また、10月7日に、OpenAIは、「GPT-6 Sol」と「GPT-6 Luna」の安全性評価結果を公表した。
AI情報通:10月8日15時の情報
高度なサイバー能力を持つモデルへのアクセスの拡大
-
Anthropic “Expanding the Cyber Verification Program”
Anthropicは、「Claude Mythos 5.1」等の高性能モデルへのアクセスを、セキュリティ組織や研究者等へ広げるためのプログラムとして、「Cyber Verification Program」の拡充版を発表した。同社は、本プログラムにより、より多くのセキュリティ組織が高度なサイバー能力を活用し、自らのシステムを守れるようにすることを目的としている。
本プログラムでは、実施するサイバーセキュリティ業務の範囲に応じてアクセスを3段階に区分し、段階ごとにサイバー関連の利用制限の程度を変えているとしている。そして、段階ごとに異なる審査要件と安全管理策が設けられており、それらを満たした対象組織等に、各段階で認められる範囲でのモデル利用を許可するとしている。[リンク]
Anthropic. “Expanding the Cyber Verification Program”, October 6, 2026
https://www.anthropic.com/news/cyber-verification-program
OpenAIが新たなAIモデルに対する安全性評価結果を公表
-
OpenAI “GPT-6 Sol and GPT-6 Luna: October 2026 update”
OpenAIは、「GPT-5.6 Sol」及び「GPT-5.6 Luna」の後継として、「GPT-6 Sol」及び「GPT-6 Luna」を公開し、それらの安全性評価結果を公表した。
同公表では、両モデルのサイバー及び生物・化学分野における能力は「High」であり、最上位の「Critical」には達していないとの評価結果が示されている。同社は、この評価を踏まえ、「GPT-5.6 Sol」及び「GPT-5.6 Luna」と同じ安全対策を適用したとしている。
また、安全性評価では、従来モデルと比べて、安全機能を回避しようとする攻撃への耐性が向上するなどの改善が見られた一方で、18歳未満の利用を想定した評価では、年齢制限のある内容や性的内容に関する評価の結果が従来モデルを下回ったと述べられている。この結果を受けてOpenAIは、自傷、性的内容及び残虐な内容を含む可能性のある回答を遮断する機能を追加で導入したと説明している。[リンク]
OpenAI. “GPT-6 Sol and GPT-6 Luna: October 2026 update”, October 7, 2026
https://deploymentsafety.openai.com/gpt-6-october
その他のAI関連情報
-
UK AI Security Institute:”Transect: Making large-scale agentic evaluations easier to understand”(2026年10月7日)
英国AISIは、AIエージェントの評価中に生成される実行記録を分析・可視化するオープンソースツール「Transect」を公開した。同ツールは、エージェントが課題に取り組んだ過程や、複数のエージェント間の連携状況を時系列で整理するツールで、評価結果に至る過程や不審な行動を専門家が効率的に検証することを支援するとしている。
https://www.aisi.gov.uk/blog/transect-making-large-scale-agentic-evaluations-easier-to-understand -
英国政府:”Government backs recommendations of NHS doctors-led AI Commission”(2026年10月6日)
英国政府は、AIが組み込まれた医療機器を安全に導入・使用するための規制を見直す方針を公表した。本公表では、導入前の一度の審査に過度に依存せず、導入後も性能や安全性を継続的に監視し、AIの更新に伴う変化を管理する仕組みを整備する方針が示されている。
https://www.gov.uk/government/news/government-backs-recommendations-of-nhs-doctors-led-ai-commission -
OpenAI:”Our approach to EU text provenance rules”(2026年10月5日)
OpenAIは、EU AI Actの透明性義務への対応として、今後数週間のうちにEU域内でChatGPT及びCodexが生成するテキストへ電子透かしを付与すると発表した。同発表では、電子透かしの付与により、文章の生成・加工への同社AIの関与を示す手がかりが得られると述べられている。ただし、編集や翻訳等によって検出できない場合もあるため、今後は、検出精度の改善や、編集・翻訳後の検出可能性に関する研究を続けるとしている。
https://openai.com/index/eu-text-provenance/
免責事項
本ページは、AIセーフティに関する情報提供を目的として作成しています。
掲載内容については、作成時点において正確性、完全性および最新性の確保に努めていますが、これらを保証するものではありません。なお、本ページから参照する外部ウェブサイトやリンク先の内容については、作成時点から変更されている場合があります。また、外部ウェブサイトやリンク先の内容は、各ウェブサイトの運営主体により管理されており、当機構がその正確性、完全性、最新性又は安全性を保証するものではありません。
本ページに記載された内容は、政府としての公式見解を示すものではありません。
本ページに記載されている情報により生じる損失又は損害に対して、いかなる場合においても責任を負いかねます。
