タグ

#arxiv に関するニュース

一覧へ戻る

37件のニュースを、関連テーマごとにまとめて確認できます。

EvoSherlock、未知のロングテール・セキュリティ事象を生涯学習するAIエージェント手法を公開
security 2026/9/18 arXiv
EvoSherlock、未知のロングテール・セキュリティ事象を生涯学習するAIエージェント手法を公開

脆弱性や権限変更が運用影響を持つ更新です。 arXiv 2609.19201として公開されたEvoSherlockは、監視カメラ映像等のセキュリティ領域で発生する「稀だが重…

arXiv 2609.19201として公開されたEvoSherlockは、監視カメラ映像等のセキュリティ領域で発生する「稀だが重大な事象」を継続学習します。従来手法では困難だった未知のロングテール事…

arXiv、マルチエージェントLLMにおける信頼伝播と構造的封じ込めに関する研究論文を公開
security 2026/9/17 arXiv
arXiv、マルチエージェントLLMにおける信頼伝播と構造的封じ込めに関する研究論文を公開

脆弱性や権限変更が運用影響を持つ更新です。 論文2609.17648では、複数のLLMが連携するパイプラインでの信頼性の連鎖を分析し、リスク拡散を防ぐ構造的封じ込めの手法を提案しています

論文2609.17648では、複数のLLMが連携するパイプラインでの信頼性の連鎖を分析し、リスク拡散を防ぐ構造的封じ込めの手法を提案しています。エージェント間のデータ漏洩や誤情報の波及を数理的に評価…

arXiv、P2P型ワークフロー状態複製アーキテクチャ「State Without a Landlord」を提案
devops 2026/9/17 arXiv
arXiv、P2P型ワークフロー状態複製アーキテクチャ「State Without a Landlord」を提案

運用や自動化の改善が継続的に効く話題です。 論文2609.17645は、特定の中央管理者(Landlord)を介さず耐久性の高い状態を維持するP2P複製手法を提示しました

論文2609.17645は、特定の中央管理者(Landlord)を介さず耐久性の高い状態を維持するP2P複製手法を提示しました。従来の集中型管理と異なり、分散ノード間で整合性を保つ新しいプロトコル設…

arXiv、数学と言語推論に特化した高効率基盤モデル「ZGCM-1」の論文を公開
ai 2026/9/15 arXiv
arXiv、数学と言語推論に特化した高効率基盤モデル「ZGCM-1」の論文を公開

生成AIやモデル更新が実務に直結しやすい話題です。 数学とエージェント検索に特化したZGCM-1は、完全オープンソースでありながら従来モデルを上回る効率性を実現しています

数学とエージェント検索に特化したZGCM-1は、完全オープンソースでありながら従来モデルを上回る効率性を実現しています。論文ID 2609.13356として公開され、推論コスト削減と計算リソースの最…

arXivでAIエージェントのスキル攻撃トレースライブラリ「SkillAtlas」が公開
security 2026/9/15 arXiv
arXivでAIエージェントのスキル攻撃トレースライブラリ「SkillAtlas」が公開

脆弱性や権限変更が運用影響を持つ更新です。 AIエージェントの安全性を評価するライブラリSkillAtlasが、論文番号2609.13353としてarXivで公開されました

AIエージェントの安全性を評価するライブラリSkillAtlasが、論文番号2609.13353としてarXivで公開されました。従来の手法よりも攻撃トレースの体系的な蓄積に焦点を当て、エージェント…

arXivで量子耐性暗号の構成要素と応用を整理したサーベイ論文が公開される
security 2026/9/14 arXiv
arXivで量子耐性暗号の構成要素と応用を整理したサーベイ論文が公開される

脆弱性や権限変更が運用影響を持つ更新です。 量子計算機の発展に伴う既存暗号の危殆化に対し、格子ベースや符号ベースなどの耐性アルゴリズムを整理した論文2609.11991が公開されました

量子計算機の発展に伴う既存暗号の危殆化に対し、格子ベースや符号ベースなどの耐性アルゴリズムを整理した論文2609.11991が公開されました。従来手法との安全性比較や実務導入時の構成要素を体系化して…

化学・材料科学用AIエージェントの安全性評価ベンチマーク「ChemMat-AgentSafetyBench」公開
security 2026/9/14 arXiv
化学・材料科学用AIエージェントの安全性評価ベンチマーク「ChemMat-AgentSafetyBench」公開

脆弱性や権限変更が運用影響を持つ更新です。 化学領域特化型AIエージェントへの長期攻撃を評価するChemMat-AgentSafetyBenchが公開されました

化学領域特化型AIエージェントへの長期攻撃を評価するChemMat-AgentSafetyBenchが公開されました。arXiv 2609.11952として登録された本ベンチマークは、従来の短文攻撃…

arXiv、自然言語からQUBO定式化を自動生成する手法に関する研究論文を公開
ai 2026/9/12 arXiv
arXiv、自然言語からQUBO定式化を自動生成する手法に関する研究論文を公開

生成AIやモデル更新が実務に直結しやすい話題です。 自然言語の課題記述から、量子計算に不可欠な二次非制約バイナリ最適化(QUBO)の数式を自動生成する手法が提案されました

自然言語の課題記述から、量子計算に不可欠な二次非制約バイナリ最適化(QUBO)の数式を自動生成する手法が提案されました。手動設計に数週間を要した従来の定式化プロセスを大幅に効率化し、開発コストを削減…

arXivでLLMジェイルブレイク評価器の実証実験結果が公開、評価器自体の信頼性を測定
security 2026/9/11 arXiv
arXivでLLMジェイルブレイク評価器の実証実験結果が公開、評価器自体の信頼性を測定

脆弱性や権限変更が運用影響を持つ更新です。 大規模言語モデル(LLM)の安全性評価に用いる評価器の信頼性を、論文2609.10594が実証的に測定しました

大規模言語モデル(LLM)の安全性評価に用いる評価器の信頼性を、論文2609.10594が実証的に測定しました。従来は評価器の精度が自明視されていましたが、ジェイルブレイク攻撃の検知漏れや誤検知の発…

ギリシャの税務システムeSENDとmyDATAへブロックチェーンによるセキュアなログ記録を導入
security 2026/9/7 arXiv
ギリシャの税務システムeSENDとmyDATAへブロックチェーンによるセキュアなログ記録を導入

脆弱性や権限変更が運用影響を持つ更新です。 ギリシャの既存税務インフラeSENDとmyDATAにおいて、データの改ざん耐性を高めるブロックチェーン基盤のログ記録手法が提案されました

ギリシャの既存税務インフラeSENDとmyDATAにおいて、データの改ざん耐性を高めるブロックチェーン基盤のログ記録手法が提案されました。従来の集中管理型と比較し、分散型台帳による検証可能性の向上が…

LLMの評価検知能力を測定するベンチマークEvalDetectBenchが公開
ai 2026/9/3 arXiv
LLMの評価検知能力を測定するベンチマークEvalDetectBenchが公開

生成AIやモデル更新が実務に直結しやすい話題です。 最新のLLMが評価環境を検知し挙動を変える「評価認識」のリスクを定量化するEvalDetectBenchがarXiv論文2609…

最新のLLMが評価環境を検知し挙動を変える「評価認識」のリスクを定量化するEvalDetectBenchがarXiv論文2609.01611で提案されました。従来の静的評価では困難だったモデルの意図…

arXivで論文公開、エージェント型LLMのポリシー違反を監査する手法AgentProvが提案される
ai 2026/9/2 arXiv
arXivで論文公開、エージェント型LLMのポリシー違反を監査する手法AgentProvが提案される

生成AIやモデル更新が実務に直結しやすい話題です。 AIエージェントのAPIプロバイダーが定義するツール利用ポリシーを、外部から自動監査するフレームワークAgentProvが提案されました

AIエージェントのAPIプロバイダーが定義するツール利用ポリシーを、外部から自動監査するフレームワークAgentProvが提案されました。論文番号2609.00052で公開され、従来の静的分析では困…

arXivでSQLインジェクション検知を強化するBERT-GNN手法の論文が公開
security 2026/9/1 arXiv
arXivでSQLインジェクション検知を強化するBERT-GNN手法の論文が公開

脆弱性や権限変更が運用影響を持つ更新です。 WAFの防御性能を高める「BERT-GNN」手法が提案されました

WAFの防御性能を高める「BERT-GNN」手法が提案されました。従来の静的解析や単純な機械学習に対し、自然言語処理モデルBERTとグラフニューラルネットワークを組み合わせることで検知精度の向上が図…

arXiv、AIエージェントの信頼性を多端末で測定する「ADeptS-Bench」を公開
security 2026/8/28 arXiv
arXiv、AIエージェントの信頼性を多端末で測定する「ADeptS-Bench」を公開

脆弱性や権限変更が運用影響を持つ更新です。 AIによるコンピュータ操作エージェントの安全性を評価するADeptS-Benchが提案されました

AIによるコンピュータ操作エージェントの安全性を評価するADeptS-Benchが提案されました。論文2608.26204では、デバイスを横断した操作における信頼性の定量的測定手法が確立されています。

LLMエージェントのプライバシー露出を低減する「ToolMinimize」を提案した研究論文がarXivで公開
ai 2026/8/27 arXiv
LLMエージェントのプライバシー露出を低減する「ToolMinimize」を提案した研究論文がarXivで公開

生成AIやモデル更新が実務に直結しやすい話題です。 論文番号2608.24957で公開されたToolMinimizeは、LLMエージェントのツール呼び出しを監査・書き換えることで、…

論文番号2608.24957で公開されたToolMinimizeは、LLMエージェントのツール呼び出しを監査・書き換えることで、機密情報の露出を最小化します。過剰なデータ送信を抑え、プライバシーリス…

LLMの記憶評価を最適化するRENDER手法が公開、読者向けの証拠提示を制御可能に
ai 2026/8/26 arXiv
LLMの記憶評価を最適化するRENDER手法が公開、読者向けの証拠提示を制御可能に

生成AIやモデル更新が実務に直結しやすい話題です。 arXivにて公開された論文2608.23568は、LLMのメモリ評価において証拠提示を制御するRENDERを提案しました

arXivにて公開された論文2608.23568は、LLMのメモリ評価において証拠提示を制御するRENDERを提案しました。従来の評価手法と比較して、モデルが保持する記憶と提示情報の干渉を分離して測…

arXivで公開、デジタルフォレンジックにおけるAIエージェントの推論能力を評価する新ベンチマーク「2608.21470」
security 2026/8/25 arXiv
arXivで公開、デジタルフォレンジックにおけるAIエージェントの推論能力を評価する新ベンチマーク「2608.21470」

脆弱性や権限変更が運用影響を持つ更新です。 非公開仕様のモバイルデータベース構造をAIがどこまで推論できるかを測定するベンチマークが提案されました

非公開仕様のモバイルデータベース構造をAIがどこまで推論できるかを測定するベンチマークが提案されました。従来の静的解析とは異なり、デジタルフォレンジックにおけるエージェントの自律的な推論精度を評価し…

arXivで公開、LLMの安全性・セキュリティ・プライバシーのトレードオフを評価する「aiXamine」
security 2026/8/24 arXiv
arXivで公開、LLMの安全性・セキュリティ・プライバシーのトレードオフを評価する「aiXamine」

脆弱性や権限変更が運用影響を持つ更新です。 LLMの安全性、セキュリティ、プライバシー間の複雑なトレードオフをブラックボックス形式で統合評価する「aiXamine」が提案されました

LLMの安全性、セキュリティ、プライバシー間の複雑なトレードオフをブラックボックス形式で統合評価する「aiXamine」が提案されました。arXiv論文2608.20554として、評価軸間の相関関係…

arXiv、複数LLMエージェントを動的にガバナンスする新フレームワークの論文を公開
ai 2026/8/13 arXiv
arXiv、複数LLMエージェントを動的にガバナンスする新フレームワークの論文を公開

生成AIやモデル更新が実務に直結しやすい話題です。 論文2608.11207では、複数のLLMエージェントが協調する際の対話品質を最適化する動的ガバナンス手法を提示しました

論文2608.11207では、複数のLLMエージェントが協調する際の対話品質を最適化する動的ガバナンス手法を提示しました。静的な制御に依存していた従来手法と異なり、実行時の状況に応じて権限や役割を調…

arXivで公開、複数ホストのLLMに対応する電子透かし技術WorldMarkが提案される
security 2026/8/10 arXiv
arXivで公開、複数ホストのLLMに対応する電子透かし技術WorldMarkが提案される

脆弱性や権限変更が運用影響を持つ更新です。 WorldMarkは、異なるホスト間で動作する言語モデルに「電子透かし」を埋め込むプラグアンドプレイ型のインターフェースです

WorldMarkは、異なるホスト間で動作する言語モデルに「電子透かし」を埋め込むプラグアンドプレイ型のインターフェースです。arXiv論文2608.06416として公開され、モデルの出自を追跡する…

arXiv、既存の企業アプリケーション統合を刷新する「Agentic Nesting」手法を公開
ai 2026/8/7 arXiv
arXiv、既存の企業アプリケーション統合を刷新する「Agentic Nesting」手法を公開

生成AIやモデル更新が実務に直結しやすい話題です。 論文2608.05159で提案されたAgentic Nestingは、既存のエンタープライズシステムとエージェント実行基盤を統合する新手法です

論文2608.05159で提案されたAgentic Nestingは、既存のエンタープライズシステムとエージェント実行基盤を統合する新手法です。従来型のAPI連携に対し、サービス内にエージェントを入…