
カリフォルニア州ロスアルトス, 2026年8月5日 - (JCN Newswire) - 生成AIの普及が進む中、大規模言語モデル(LLM)が依然として「幻覚」を起こし、出典をでっち上げ、自信を持って誤りを生み出していることが研究により確認されています。これは、自律型自動化、研究、コンテンツ作成、意思決定のためにAIを導入する企業にとって、前例のないリスクをもたらしています。
この問題を解決するため、 TrustScaleは本日、特許出願中のAI保証プラットフォーム「Argus」のリリースを発表した。「AIがAIをチェックする」というアプローチとは異なり、Argusは実証的証拠と決定論的検証を用いてAI生成コンテンツを精査し、根拠のない主張にフラグを立て、AIの誤りが公開・共有・信頼される前に、証拠に基づいた修正を提案する。
研究によると、AIの「幻覚」発生率はタスクによって大きく異なり、複雑さが増すにつれて高まることが示されています。最先端モデルによる単純なクエリへの応答でさえ、平均して最大20%の「幻覚」が発生し、業界特化型のAIクエリ応答では、88%もの確率で「幻覚」が生じることがあります(スタンフォード大学RegLab)。この「幻覚」により、組織は年間700億ドル近くの損失を被っています。 Argusを利用すれば、ユーザ ーは手作業による調査に比べて最大135倍の速さでAI生成の主張を検証でき、幻覚を削減し、AI出力の精度を最大98.5%向上させることができます。
「AI業界は長年にわたりAIの知能向上に取り組んできましたが、今や解決すべきより大きな課題は『信頼できるAI』の実現です」と、TrustScaleのCEOであるローレンス・スナップ氏は述べています。「AIは設計上確率的なものですが、AIの誤りによるコストやリスクの責任を負うのは企業です。Argusは、ユーザーが生成AIの出力に基づいて行動を起こす前に、独立した証拠を提供することで、この問題を軽減します。」
医療、法律、学術界は、AIユーザーが知らず知らずのうちにAIの「幻覚」リスクにさらされている、リスクの高い業界の例です。さらに問題を深刻にしているのは、 Anthropicの調査によると、AIユーザーの91.3%が事実や主張を確認しておらず、その結果、「サイレント・フェイル」が人々に直接的な危害をもたらす可能性のある環境が生み出されていることです。 Argusはリアルタイムで、幻覚を検出し、色分けされた TrustScore のハイライトを重ね合わせ、AIの主張を裏付ける、あるいは反証する決定論的な証拠を提供することで、意図しない結果を未然に防ぎます。さらに、インラインの提案機能により、ユーザーがワンクリックでAIの誤りを修正できるように支援します。
20年以上にわたるAIデータに関する経験に基づき、Argusは「TrustScale Engine」という独自プラットフォーム上に構築されています。このプラットフォームは、AIの信頼性を保証するための継続的な信頼制御プレーンを構築し、ワークフローを妨げることなく 、ユーザーが十分な情報に基づいた意思決定を行えるよう支援します。
「AI開発者は、自社製品がより安全である、自律的である、あるいは真実を追求していると主張しています。しかし、AIに関しては、矛盾する証拠、多様な視点、微妙なニュアンスを含む言語、そして独立した保証が重要になります」と、Global Data Innovation のCEOであるドミニク・シェルトン・ライプツィヒ氏は述べています。「TrustScaleの Argusは、人間に証拠を提供し、信頼できるAIを実現する、初のリアルタイムかつ継続的な保証プラットフォームです。AIがもたらすリスクは極めて大きいため、少数の大規模モデルに真実を決定させてはなりません。」
TrustScaleの「Argus」は本日より、企業向けには12言語で提供されており、個人向けにはTrustArgus.aiにて研究用プレビュー版として利用可能です。また、Chrome拡張機能を通じてどこからでも利用できます。企業向けソリューションは、ChatGPT、Claude 、Gemini、Copilot、Grokを含むあらゆるAIモデルと併せて、プライベートおよびパブリックのデータ環境に導入可能です。デモのお申し込みは www.TrustScale.aiまで。
TrustScaleについて
TrustScaleは、AIのトレーニング、評価、保証を行う企業であり、組織がより高い信頼性と制御力をもって人工知能を構築、形成、活用できるよう支援しています。200以上 の言語にわたる20年以上のAIデータに関する経験に基づき、TrustScaleは、AIの誤りを検出し、実証的証拠に基づいて主張を評価し、重要な意思決定において人間を中心に据え続ける、独立した決定論的技術を開発しています。 同社の「Argus」プラットフォームは、パブリックおよびプライベートなデータ環境において、リアルタイムの「幻覚」 検出、TrustScore評価、および証拠に基づいた修正提案を提供します。詳細については 、TrustScale.aiをご覧ください。
メディアお問い合わせ先:
TrustScale担当:Songue PR
trustscale@songuepr.com
出典:TrustScale
Copyright 2026 JCN Newswire. All rights reserved. www.jcnnewswire.com