その他 – とれまがニュース

経済や政治がわかる新聞社や通信社の時事ニュースなど配信

とれまが – 個人ブログがポータルサイトに!みんなでつくるポータルサイト。経済や政治がわかる新聞社や通信社の時事ニュースなど配信
RSS
製品 サービス 企業動向 業績報告 調査・報告 技術・開発 告知・募集 人事 その他
とれまが >  ニュース  > リリースニュース  > その他

Konoe Intelligence、機械論的解釈可能性を用いたLLMのガードレール実装について特許を取得

Konoe Intelligence株式会社

Konoe Intelligence、機械論的解釈可能性を用いたLLM

NVIDIA製ガードレールを検出精度で上回り、検査速度は約330倍を実現


[画像1: https://prcdn.freetls.fastly.net/release_image/160129/19/160129-19-915850a38087f7d2e7193c61668f1b36-1672x941.png?width=536&quality=85%2C75&format=jpeg&auto=webp&fit=bounds&bg-color=fff ]


AI安全性を専門とする研究開発企業のKonoe Intelligence株式会社(本社:京都府京都市、代表取締役:勘佐圭吾)は、機械論的解釈可能性の知見を用いたLLM(大規模言語モデル)向けガードレールの実装方法に関する特許を取得したことをお知らせします。同技術は、NVIDIAが開発したガードレールモデルを上回る有害コンテンツ検出率を、約330分の1の検査速度で達成しています。
背景
現在、LLMアプリケーションの安全性を担保する手法としては、生成された出力をさらに別のLLMに判定させる「LLM-as-a-Judge」型のガードレールや、専用の分類器モデルによる入出力の事後チェックが広く使われています。しかしこれらは、モデルが実際に生成し終えたテキストを外側から観察する手法であるため、以下のような課題があります。
- 判定のたびに追加のLLM推論が発生し、遅延・コストが大きい- モデル内部で何が起きて危険な出力に至ったのかは分からないまま運用される
当社はこの課題に対し、モデルの重みを一切変更せず、生成の各ステップでモデル内部の表現(隠れ状態)を直接検査することで危険な出力を検出・制御する、機械論的解釈可能性に基づくガードレール技術の研究開発を進めてきました。
NVIDIA製ガードレールを上回る精度と速度
本特許技術の性能は、NVIDIAが開発した安全性判定モデル「Llama-3.1-Nemotron-Safety-Guard-8B(NemoGuard)」との比較評価によって裏付けられています。
- 有害コンテンツのブロック率 84.1%(NemoGuard:83.0%)で、比較対象の中で最高精度を達成- 検査レイテンシは0.18ミリ秒(NemoGuard:59.5ミリ秒)と、約330分の1- NemoGuardが生成済みのテキスト全体を都度読み直して判定するのに対し、本手法はモデル内部の隠れ状態を検査するのみのため、圧倒的な高速化を実現
なお、良性コンテンツの許可率はNemoGuard出力レール比でやや低く、より安全側に踏み込んで判定する特性があります。医療・金融・行政など高リスク領域での利用には、この特性が有利に働くと考えています。
特許の技術概要
今回特許を取得したのは、学習済みモデルの隠れ状態空間に安全性の境界を幾何学的な制約として学習し、生成中の内部表現を検査することでガードレールを実装する方法です。
- モデルの重みを変更しない事後的(post-hoc)手法であり、既存のモデルに追加で組み込める- スパースオートエンコーダ(SAE)による特徴抽出を用いることで、カテゴリごとに必要な制約数を自動的に絞り込み、従来手法で必要だった網羅的なパラメータ探索をほぼ排除
この技術の理論的な裏付けとなる研究成果は、論文「LLM安全分類のための幾何学誘導型制約学習」(arXiv:2607.19366)として公開しています。
LLM安全分類のための幾何学誘導型制約学習
特許取得の概要
- 特許番号:特許第7909349号- 発明の名称:学習モデル用ガードレール実装方法、学習モデル用プログラムおよび人工知能システム- 発明者:上原 史皓、今井 冴生- 特許権者:Konoe Intelligence株式会社(出願時社名:Aladdin Security株式会社)
今後の展望
当社は今後も、機械論的解釈可能性を用いたAIの内部検証技術の研究開発を継続し、本特許技術を含むガードレール基盤の社会実装を進めるとともに、政府機関・企業と連携しながら日本発のAI安全性評価能力の構築に取り組んでまいります。
会社概要
Konoe Intelligence株式会社は、AI安全性を専門とする研究開発企業です。機械論的解釈可能性を用いたAIリスク評価技術の研究開発を中核とし、政府機関・企業との連携を通じて、日本のAI主権確立に貢献することを目指しています。
本件に関するお問い合わせ先
Konoe Intelligence株式会社
所在地: 京都府京都市上京区甲斐守町97西陣産業創造會館
メール: info@konoe-intelligence
HP:https://www.konoe-intelligence.net/contact
[画像2: https://prcdn.freetls.fastly.net/release_image/160129/19/160129-19-d70f07ecf8f5578e85c4f2b2acf2a872-3508x2481.png?width=536&quality=85%2C75&format=jpeg&auto=webp&fit=bounds&bg-color=fff ]Konoe Intelligence株式会社
We are an AI Safety & Security R&D company.
AIを解釈可能で、信頼できるものにし、無限の可能性を追求する。
(メール)️ info@aladdin-security.net

プレスリリース提供:PR TIMES

Konoe Intelligence、機械論的解釈可能性を用いたLLMKonoe Intelligence、機械論的解釈可能性を用いたLLM

記事提供:PRTimes

記事引用:アメーバ?  ブックマーク: Google Bookmarks  Yahoo!ブックマークに登録  livedoor clip  Hatena ブックマーク  Buzzurl ブックマーク

ニュース画像

一覧

関連ニュース

とれまがマネー

とれまがマネー

IR動画

一覧

とれまがニュースは、時事通信社、カブ知恵、Digital PR Platform、BUSINESS WIRE、エコノミックニュース、News2u、@Press、ABNNewswire、済龍、DreamNews、NEWS ON、PR TIMES、LEAFHIDEから情報提供を受けています。当サイトに掲載されている情報は必ずしも完全なものではなく、正確性・安全性を保証するものではありません。当社は、当サイトにて配信される情報を用いて行う判断の一切について責任を負うものではありません。

とれまがニュースは以下の配信元にご支援頂いております。

時事通信社 IR Times カブ知恵 Digital PR Platform Business Wire エコノミックニュース News2u

@Press ABN Newswire 済龍 DreamNews NEWS ON PR TIMES LEAF HIDE

Copyright (C) 2006-2026 sitescope co.,ltd. All Rights Reserved.