
脆弱性や権限変更が運用影響を持つ更新です。 arXiv に PAPC: Platform Mediation for Privacy-Propagation Externa…
arXiv に PAPC: Platform Mediation for Privacy-Propagation Externalities in AI-Me… が掲載され、arXiv:2609.1…
タグ
37件のニュースを、関連テーマごとにまとめて確認できます。

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に PAPC: Platform Mediation for Privacy-Propagation Externa…
arXiv に PAPC: Platform Mediation for Privacy-Propagation Externalities in AI-Me… が掲載され、arXiv:2609.1…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv 2609.19201として公開されたEvoSherlockは、監視カメラ映像等のセキュリティ領域で発生する「稀だが重…
arXiv 2609.19201として公開されたEvoSherlockは、監視カメラ映像等のセキュリティ領域で発生する「稀だが重大な事象」を継続学習します。従来手法では困難だった未知のロングテール事…

脆弱性や権限変更が運用影響を持つ更新です。 論文2609.17648では、複数のLLMが連携するパイプラインでの信頼性の連鎖を分析し、リスク拡散を防ぐ構造的封じ込めの手法を提案しています
論文2609.17648では、複数のLLMが連携するパイプラインでの信頼性の連鎖を分析し、リスク拡散を防ぐ構造的封じ込めの手法を提案しています。エージェント間のデータ漏洩や誤情報の波及を数理的に評価…

運用や自動化の改善が継続的に効く話題です。 論文2609.17645は、特定の中央管理者(Landlord)を介さず耐久性の高い状態を維持するP2P複製手法を提示しました
論文2609.17645は、特定の中央管理者(Landlord)を介さず耐久性の高い状態を維持するP2P複製手法を提示しました。従来の集中型管理と異なり、分散ノード間で整合性を保つ新しいプロトコル設…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に Permutation-Based Stegomalware in Large Language Models:…
arXiv に Permutation-Based Stegomalware in Large Language Models: Threats and Co… が掲載され、arXiv:2609.1…

生成AIやモデル更新が実務に直結しやすい話題です。 数学とエージェント検索に特化したZGCM-1は、完全オープンソースでありながら従来モデルを上回る効率性を実現しています
数学とエージェント検索に特化したZGCM-1は、完全オープンソースでありながら従来モデルを上回る効率性を実現しています。論文ID 2609.13356として公開され、推論コスト削減と計算リソースの最…

脆弱性や権限変更が運用影響を持つ更新です。 AIエージェントの安全性を評価するライブラリSkillAtlasが、論文番号2609.13353としてarXivで公開されました
AIエージェントの安全性を評価するライブラリSkillAtlasが、論文番号2609.13353としてarXivで公開されました。従来の手法よりも攻撃トレースの体系的な蓄積に焦点を当て、エージェント…

脆弱性や権限変更が運用影響を持つ更新です。 量子計算機の発展に伴う既存暗号の危殆化に対し、格子ベースや符号ベースなどの耐性アルゴリズムを整理した論文2609.11991が公開されました
量子計算機の発展に伴う既存暗号の危殆化に対し、格子ベースや符号ベースなどの耐性アルゴリズムを整理した論文2609.11991が公開されました。従来手法との安全性比較や実務導入時の構成要素を体系化して…

脆弱性や権限変更が運用影響を持つ更新です。 化学領域特化型AIエージェントへの長期攻撃を評価するChemMat-AgentSafetyBenchが公開されました
化学領域特化型AIエージェントへの長期攻撃を評価するChemMat-AgentSafetyBenchが公開されました。arXiv 2609.11952として登録された本ベンチマークは、従来の短文攻撃…

UIや依存関係の変化が実装に影響しやすいです。 arXiv に Fundamental Dynamical Units for Physics-Informed Structu…
arXiv に Fundamental Dynamical Units for Physics-Informed Structural Inference f… が掲載され、arXiv:2609.1…

生成AIやモデル更新が実務に直結しやすい話題です。 自然言語の課題記述から、量子計算に不可欠な二次非制約バイナリ最適化(QUBO)の数式を自動生成する手法が提案されました
自然言語の課題記述から、量子計算に不可欠な二次非制約バイナリ最適化(QUBO)の数式を自動生成する手法が提案されました。手動設計に数週間を要した従来の定式化プロセスを大幅に効率化し、開発コストを削減…

生成AIやモデル更新が実務に直結しやすい話題です。 arXiv に OpenDiscoveryTrace: Process Traces for Evaluating AI Sci…
arXiv に OpenDiscoveryTrace: Process Traces for Evaluating AI Scientist Workflows が掲載され、arXiv:2609.0…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に Threshold Choice, Not Sample Size, Bounds Trustless Veri…
arXiv に Threshold Choice, Not Sample Size, Bounds Trustless Verification of Non… が掲載され、arXiv:2609.1…

脆弱性や権限変更が運用影響を持つ更新です。 大規模言語モデル(LLM)の安全性評価に用いる評価器の信頼性を、論文2609.10594が実証的に測定しました
大規模言語モデル(LLM)の安全性評価に用いる評価器の信頼性を、論文2609.10594が実証的に測定しました。従来は評価器の精度が自明視されていましたが、ジェイルブレイク攻撃の検知漏れや誤検知の発…

脆弱性や権限変更が運用影響を持つ更新です。 ギリシャの既存税務インフラeSENDとmyDATAにおいて、データの改ざん耐性を高めるブロックチェーン基盤のログ記録手法が提案されました
ギリシャの既存税務インフラeSENDとmyDATAにおいて、データの改ざん耐性を高めるブロックチェーン基盤のログ記録手法が提案されました。従来の集中管理型と比較し、分散型台帳による検証可能性の向上が…

生成AIやモデル更新が実務に直結しやすい話題です。 最新のLLMが評価環境を検知し挙動を変える「評価認識」のリスクを定量化するEvalDetectBenchがarXiv論文2609…
最新のLLMが評価環境を検知し挙動を変える「評価認識」のリスクを定量化するEvalDetectBenchがarXiv論文2609.01611で提案されました。従来の静的評価では困難だったモデルの意図…

生成AIやモデル更新が実務に直結しやすい話題です。 AIエージェントのAPIプロバイダーが定義するツール利用ポリシーを、外部から自動監査するフレームワークAgentProvが提案されました
AIエージェントのAPIプロバイダーが定義するツール利用ポリシーを、外部から自動監査するフレームワークAgentProvが提案されました。論文番号2609.00052で公開され、従来の静的分析では困…

脆弱性や権限変更が運用影響を持つ更新です。 WAFの防御性能を高める「BERT-GNN」手法が提案されました
WAFの防御性能を高める「BERT-GNN」手法が提案されました。従来の静的解析や単純な機械学習に対し、自然言語処理モデルBERTとグラフニューラルネットワークを組み合わせることで検知精度の向上が図…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に Can Tainted Pixels Expose Deepfake Videos? が掲載され、arXiv:2…
arXiv に Can Tainted Pixels Expose Deepfake Videos? が掲載され、arXiv:2608.27492v1 Announce Type: new Abst…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に EduRiskX: A Neuro-Symbolic Framework with F-Logic Reason…
arXiv に EduRiskX: A Neuro-Symbolic Framework with F-Logic Reasoning for Early A… が掲載され、arXiv:2608.2…

脆弱性や権限変更が運用影響を持つ更新です。 AIによるコンピュータ操作エージェントの安全性を評価するADeptS-Benchが提案されました
AIによるコンピュータ操作エージェントの安全性を評価するADeptS-Benchが提案されました。論文2608.26204では、デバイスを横断した操作における信頼性の定量的測定手法が確立されています。

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に Retrieved But Not Reliable: A Survey on Attacks, and Def…
arXiv に Retrieved But Not Reliable: A Survey on Attacks, and Defenses in Retrie… が掲載され、arXiv:2608.2…

生成AIやモデル更新が実務に直結しやすい話題です。 論文番号2608.24957で公開されたToolMinimizeは、LLMエージェントのツール呼び出しを監査・書き換えることで、…
論文番号2608.24957で公開されたToolMinimizeは、LLMエージェントのツール呼び出しを監査・書き換えることで、機密情報の露出を最小化します。過剰なデータ送信を抑え、プライバシーリス…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に TrustShiftProbe: Characterizing, Benchmarking, and Defen…
arXiv に TrustShiftProbe: Characterizing, Benchmarking, and Defending Staged Tru… が掲載され、arXiv:2608.2…

生成AIやモデル更新が実務に直結しやすい話題です。 arXivにて公開された論文2608.23568は、LLMのメモリ評価において証拠提示を制御するRENDERを提案しました
arXivにて公開された論文2608.23568は、LLMのメモリ評価において証拠提示を制御するRENDERを提案しました。従来の評価手法と比較して、モデルが保持する記憶と提示情報の干渉を分離して測…

UIや依存関係の変化が実装に影響しやすいです。 arXiv に KVBoost: Chunk-Level Key-Value Cache Reuse with Deviatio…
arXiv に KVBoost: Chunk-Level Key-Value Cache Reuse with Deviation-Guided Recomp… が掲載され、arXiv:2608.2…

脆弱性や権限変更が運用影響を持つ更新です。 非公開仕様のモバイルデータベース構造をAIがどこまで推論できるかを測定するベンチマークが提案されました
非公開仕様のモバイルデータベース構造をAIがどこまで推論できるかを測定するベンチマークが提案されました。従来の静的解析とは異なり、デジタルフォレンジックにおけるエージェントの自律的な推論精度を評価し…

脆弱性や権限変更が運用影響を持つ更新です。 LLMの安全性、セキュリティ、プライバシー間の複雑なトレードオフをブラックボックス形式で統合評価する「aiXamine」が提案されました
LLMの安全性、セキュリティ、プライバシー間の複雑なトレードオフをブラックボックス形式で統合評価する「aiXamine」が提案されました。arXiv論文2608.20554として、評価軸間の相関関係…

UIや依存関係の変化が実装に影響しやすいです。 arXiv に Position: Reasoning is a Learnable Rule-Based Process が掲…
arXiv に Position: Reasoning is a Learnable Rule-Based Process が掲載され、arXiv:2608.12325v1 Announce Typ…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に The energetic cost of mitigating AI attacks in cellular…
arXiv に The energetic cost of mitigating AI attacks in cellular networks が掲載され、arXiv:2608.12431v1 A…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に Agent Safety Should Be a Runtime Contract が掲載され、arXiv:26…
arXiv に Agent Safety Should Be a Runtime Contract が掲載され、arXiv:2608.11274v1 Announce Type: new Abstr…

生成AIやモデル更新が実務に直結しやすい話題です。 論文2608.11207では、複数のLLMエージェントが協調する際の対話品質を最適化する動的ガバナンス手法を提示しました
論文2608.11207では、複数のLLMエージェントが協調する際の対話品質を最適化する動的ガバナンス手法を提示しました。静的な制御に依存していた従来手法と異なり、実行時の状況に応じて権限や役割を調…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に MarkNull: Model-Agnostic Watermark Removal in AI-Generat…
arXiv に MarkNull: Model-Agnostic Watermark Removal in AI-Generated Images via O… が掲載され、arXiv:2608.1…

脆弱性や権限変更が運用影響を持つ更新です。 WorldMarkは、異なるホスト間で動作する言語モデルに「電子透かし」を埋め込むプラグアンドプレイ型のインターフェースです
WorldMarkは、異なるホスト間で動作する言語モデルに「電子透かし」を埋め込むプラグアンドプレイ型のインターフェースです。arXiv論文2608.06416として公開され、モデルの出自を追跡する…

生成AIやモデル更新が実務に直結しやすい話題です。 論文2608.05159で提案されたAgentic Nestingは、既存のエンタープライズシステムとエージェント実行基盤を統合する新手法です
論文2608.05159で提案されたAgentic Nestingは、既存のエンタープライズシステムとエージェント実行基盤を統合する新手法です。従来型のAPI連携に対し、サービス内にエージェントを入…

脆弱性や権限変更が運用影響を持つ更新です。 arXiv に Securing Contrastive mmWave-based Human Activity Recogni…
arXiv に Securing Contrastive mmWave-based Human Activity Recognition against Ad… が掲載され、arXiv:2608.0…

UIや依存関係の変化が実装に影響しやすいです。 arXiv に A Long-Run Persistence Theory for AI Systems under the R…
arXiv に A Long-Run Persistence Theory for AI Systems under the Redundancy-Adjus… が掲載され、arXiv:2608.0…