タグ

#ai-agent に関するニュース

一覧へ戻る

15件のニュースを、関連テーマごとにまとめて確認できます。

EvoSherlock、未知のロングテール・セキュリティ事象を生涯学習するAIエージェント手法を公開
security 2026/9/18 arXiv
EvoSherlock、未知のロングテール・セキュリティ事象を生涯学習するAIエージェント手法を公開

脆弱性や権限変更が運用影響を持つ更新です。 arXiv 2609.19201として公開されたEvoSherlockは、監視カメラ映像等のセキュリティ領域で発生する「稀だが重…

arXiv 2609.19201として公開されたEvoSherlockは、監視カメラ映像等のセキュリティ領域で発生する「稀だが重大な事象」を継続学習します。従来手法では困難だった未知のロングテール事…

Microsoft、AIコーディングエージェント評価時のサンドボックス制御による汚染防止を提唱
ai 2026/9/16 Microsoft DevBlogs
Microsoft、AIコーディングエージェント評価時のサンドボックス制御による汚染防止を提唱

生成AIやモデル更新が実務に直結しやすい話題です。 AIエージェントがモデル内部知識ではなくローカル環境から正解を取得する「評価の汚染」を防ぐため、Microsoftはサンドボック…

AIエージェントがモデル内部知識ではなくローカル環境から正解を取得する「評価の汚染」を防ぐため、Microsoftはサンドボックスの厳格な境界定義を推奨しています。検証目的ごとにWebアクセスやリポ…

arXivでAIエージェントのスキル攻撃トレースライブラリ「SkillAtlas」が公開
security 2026/9/15 arXiv
arXivでAIエージェントのスキル攻撃トレースライブラリ「SkillAtlas」が公開

脆弱性や権限変更が運用影響を持つ更新です。 AIエージェントの安全性を評価するライブラリSkillAtlasが、論文番号2609.13353としてarXivで公開されました

AIエージェントの安全性を評価するライブラリSkillAtlasが、論文番号2609.13353としてarXivで公開されました。従来の手法よりも攻撃トレースの体系的な蓄積に焦点を当て、エージェント…

国内企業がAIエージェント導入に際してデータ基盤整備を優先しガバナンスとコストを抑制
ai 2026/9/14 TechTargetジャパン
国内企業がAIエージェント導入に際してデータ基盤整備を優先しガバナンスとコストを抑制

生成AIやモデル更新が実務に直結しやすい話題です。 AIエージェント導入を先行する企業は、後付けのガバナンス欠如やコスト暴走を避けるため、LLMへの直接投資よりデータ基盤整備を優先しています

AIエージェント導入を先行する企業は、後付けのガバナンス欠如やコスト暴走を避けるため、LLMへの直接投資よりデータ基盤整備を優先しています。非構造化データの整理により、推論コストを最大3割削減した事…

化学・材料科学用AIエージェントの安全性評価ベンチマーク「ChemMat-AgentSafetyBench」公開
security 2026/9/14 arXiv
化学・材料科学用AIエージェントの安全性評価ベンチマーク「ChemMat-AgentSafetyBench」公開

脆弱性や権限変更が運用影響を持つ更新です。 化学領域特化型AIエージェントへの長期攻撃を評価するChemMat-AgentSafetyBenchが公開されました

化学領域特化型AIエージェントへの長期攻撃を評価するChemMat-AgentSafetyBenchが公開されました。arXiv 2609.11952として登録された本ベンチマークは、従来の短文攻撃…

Meta、自律型パーソナルAIエージェント「Muse」を公開しメール送信や旅行予約の代行を実現
ai 2026/9/12 @DIME アットダイム
Meta、自律型パーソナルAIエージェント「Muse」を公開しメール送信や旅行予約の代行を実現

生成AIやモデル更新が実務に直結しやすい話題です。 Metaは、ユーザーの目標達成を自律的に支援するAI「Muse」を発表しました

Metaは、ユーザーの目標達成を自律的に支援するAI「Muse」を発表しました。従来の受動的な対話型AIとは異なり、メールの自動送信や旅行予約といった具体的なアクションを、デバイス上の操作を通じて自…

Matt PocockがAIエージェント用スキル集「skills」を公開しGitHubで急浮上
ai 2026/9/6 GitHub Trending
Matt PocockがAIエージェント用スキル集「skills」を公開しGitHubで急浮上

生成AIやモデル更新が実務に直結しやすい話題です。 TypeScriptのエキスパートとして知られるMatt Pocock氏が、実務特化型のAIエージェント用ツール群を公開しました

TypeScriptのエキスパートとして知られるMatt Pocock氏が、実務特化型のAIエージェント用ツール群を公開しました。既存の自動化ツールと異なり、小規模かつ構成可能な設計で、エンジニアの…

DietrichGebertがAIエージェントの過剰実装を抑制するponytailを公開
ai 2026/9/4 GitHub Trending
DietrichGebertがAIエージェントの過剰実装を抑制するponytailを公開

生成AIやモデル更新が実務に直結しやすい話題です。 AIエージェントの思考を最適化するponytailが公開されました

AIエージェントの思考を最適化するponytailが公開されました。Haiku 4.5を用いた検証では、生成コード量を平均54%削減し、推論コストを約20%低減させる成果が示されています。

GitHub、VS Code向けCopilotの8月更新でエージェントセッション管理機能を拡充
devops 2026/8/31 GitHub Changelog
GitHub、VS Code向けCopilotの8月更新でエージェントセッション管理機能を拡充

運用や自動化の改善が継続的に効く話題です。 GitHub CopilotがVS Codeのv1.132からv1.135に対応し、エージェント生成内容の差分レビュー機能が強化されました

GitHub CopilotがVS Codeのv1.132からv1.135に対応し、エージェント生成内容の差分レビュー機能が強化されました。エージェントホストや統合ブラウザ、音声入力の改善により、長…

OSINT基盤「God's Eye View」がOSS化、リアルタイムな空間インテリジェンスを統合表示
data 2026/8/29 GitHub Trending
OSINT基盤「God's Eye View」がOSS化、リアルタイムな空間インテリジェンスを統合表示

データ活用や設計の見直しに関わる重要な動きです。 YouTubeで500万再生を記録した「God's Eye View」がOSS公開されました

YouTubeで500万再生を記録した「God's Eye View」がOSS公開されました。航空機・船舶・衛星のビーコンデータや地震情報をフォトリアルな3D地球儀上に統合し、ブラウザ上で一元可視化…

tt-a1i、AIエージェント向け図解生成ツールArchify v2.16.0を公開
devops 2026/8/29 GitHub Trending
tt-a1i、AIエージェント向け図解生成ツールArchify v2.16.0を公開

運用や自動化の改善が継続的に効く話題です。 AIエージェントが生成したJSONからHTML/SVGの動的な図解を出力するNode.js基盤が登場しました

AIエージェントが生成したJSONからHTML/SVGの動的な図解を出力するNode.js基盤が登場しました。CursorやClaude Codeとの連携を前提とし、検証可能な設計図をチャット上で直…

Salesforce、Agentforceを軸とした自律型AIエージェントへの移行でデータ基盤を強化
ai 2026/8/28 Semantic Data Layer Watch
Salesforce、Agentforceを軸とした自律型AIエージェントへの移行でデータ基盤を強化

生成AIやモデル更新が実務に直結しやすい話題です。 Salesforceは、Data Cloudを基盤とするAgentforceの展開により、従来の手動プロセスを自律型AIへ刷新しました

Salesforceは、Data Cloudを基盤とするAgentforceの展開により、従来の手動プロセスを自律型AIへ刷新しました。第3四半期の売上高は前年比10%増の94.4億ドルに達し、AI…

arXiv、AIエージェントの信頼性を多端末で測定する「ADeptS-Bench」を公開
security 2026/8/28 arXiv
arXiv、AIエージェントの信頼性を多端末で測定する「ADeptS-Bench」を公開

脆弱性や権限変更が運用影響を持つ更新です。 AIによるコンピュータ操作エージェントの安全性を評価するADeptS-Benchが提案されました

AIによるコンピュータ操作エージェントの安全性を評価するADeptS-Benchが提案されました。論文2608.26204では、デバイスを横断した操作における信頼性の定量的測定手法が確立されています。

arXivで公開、デジタルフォレンジックにおけるAIエージェントの推論能力を評価する新ベンチマーク「2608.21470」
security 2026/8/25 arXiv
arXivで公開、デジタルフォレンジックにおけるAIエージェントの推論能力を評価する新ベンチマーク「2608.21470」

脆弱性や権限変更が運用影響を持つ更新です。 非公開仕様のモバイルデータベース構造をAIがどこまで推論できるかを測定するベンチマークが提案されました

非公開仕様のモバイルデータベース構造をAIがどこまで推論できるかを測定するベンチマークが提案されました。従来の静的解析とは異なり、デジタルフォレンジックにおけるエージェントの自律的な推論精度を評価し…

msitarzewski、AIエージェント統合管理ツール「agency-agents」を公開
devops 2026/8/10 GitHub Trending
msitarzewski、AIエージェント統合管理ツール「agency-agents」を公開

運用や自動化の改善が継続的に効く話題です。 AIエージェントの専門家集団をデスクトップから一括導入できるOSSが登場しました

AIエージェントの専門家集団をデスクトップから一括導入できるOSSが登場しました。Claude CodeやCursor、Geminiなど主要なIDE・ツール群へ、スクリプト不要かつ1クリックで各エー…