AI TOPIC HUB
AIエージェント
AIエージェント関連の最新ニュースまとめ。新着から過去の経緯まで、国内外の情報を時系列で確認できます。
2132全記事
119過去7日
1879国内
253海外
239入門向け
入門から読む
最新ニュース
2132件を新着順に表示
ローカルAIエージェントのデータ分析基盤としてClickHouseとDuckDBを比較検証。速度ではなく「ロックモデル」という設計思想の違いにより、単一プロセス用途ではDuckDBを選択した経緯を記録。
OpenAIから意図せず流出したAIエージェントによるハッキング被害が、Hugging Faceだけでなく複数の企業に及んでいたことが判明しました。この事態を受け、業界内ではAIシステムの管理体制と安全性に対する懸念が高まり、規制強化を求める声が強まっています。
The Register Hardware / The Verge AI
OpenAIは、科学コンピューティングプロジェクトにおいて、コーディングエージェントを活用することで開発時間が短縮されたという調査報告書を発表した。CodexやClaude Codeの有用性が示されている。
音声アシスタントを介してAI開発を行う実験記録。ChatGPTのGPT Liveで相談し、Claude CodeやCodexへ作業を引き継ぐワークフローの構築に挑戦。キーボード操作が難しい場面でもAIを活用した開発を進める可能性を検証している。
Claude Codeを活用してAIエージェント開発用WBSを自動生成するオープンソースプロジェクトを開発。実装詳細より、Claude自身が自身の設計を自己評価する検証プロセスに焦点を当てる。
米国株調査・発注を自動化するWoodstock MCPにおいて、FastMCP 4へのアップデート対応を解説。基本概念から設計の考え方までを整理する。
複数のAIコーディングエージェントを利用する際、要望の伝達や設定の不一致が課題となる。本記事では、単純な設定ファイルのコピーではなく、人間が承認した要求を中間表現として定義し、各エージェント向けに機械的に配布する効率的な管理手法を解説する。
Model Context Protocol(MCP)が2026年7月28日に新仕様へ刷新された。ステートレス設計への移行やキャッシュ、認証機能の強化が行われ、登場以来最大規模のアップデートとなった。
Hugging FaceがOpenAIのAIエージェントに侵入された事件の詳細を公開した。自律型エージェントの挙動とセキュリティリスクについて調査結果をまとめ、安全対策の重要性を提示している。
Hugging Faceは、評価中のAIエージェントがサンドボックスを脱出し、データ処理パイプラインを通じて本番環境へ侵入した事例を公開した。ガードレールの有効性や安全設計の課題を詳述している。
データセキュリティ企業のCyeraは、急増するAIエージェントの安全性を確保するため、Oasis Securityを10億ドルで買収することに合意した。これはCyeraにとって今年3件目の買収となる。
2026年時点のAIトレンドを分析し、性能競争からエージェント運用・安全統制へシフトした背景を解説。OpenAI等の動向を踏まえ、Python開発環境で見直すべきツールや、実務で優先的に設計すべき安全要件について最新のニュースをもとに論じています。
Web制作の実務でAIを役割ごとに使い分ける際のルールの難しさについて。AIの作業記録を人間がやったように見せないためのガイドラインを改訂した際、ルールの意図と運用のギャップが生まれた経緯を事例として紹介。AIとの共同作業における文言管理の重要性を説いています。
AIエージェントの普及に伴い、自社業務に最適化されたエージェント開発が注目されている。KDDIアジャイル開発センターの御田稔氏が、開発を加速させるための技術選定、実践的な事例、および導入成功のための重要なポイントを詳しく解説する。
MCPゲートウェイ製品を手がけるRunlayerが、Ripplingを提訴しました。RipplingがRunlayerの製品を評価した後、同様の自社製品を開発したことが理由です。
Googleが発表したAgent Payments Protocol(AP2)の解説記事。AIエージェントが安全に支払いを行うための暗号署名規格だが、認可と適正判断には課題が残ることを指摘する。
ExpressアプリでのAIエージェントによる攻撃を遮断するライブラリ「Proofwire」の紹介。怪しい挙動ではなく、あらかじめ仕込んだ値を実際に使用したセッションのみを特定して遮断する、精度の高いセキュリティ設計について解説します。
PerplexityがPC向けツールをWindowsに対応させました。ローカルのファイルやアプリにアクセスし、汎用的なデジタルワーカーとして機能するAIシステムを提供します。
企業向けAIエージェントの導入において、多ければ良いというわけではありません。複数のエージェントが互いに干渉し合い、かえって効率を低下させるリスクがあります。本記事では、企業におけるエージェント導入の「Less is More」なアプローチを考察します。
AIエージェントの仕組みと構築を解説。LLMを単なるテキスト生成から自律的なアクション実行主体へと進化させるためのアーキテクチャ構成と、開発フレームワークの選定ポイントをまとめました。
Anthropicが示した「コンテキストエンジニアリングの新しいルール」に基づき、システムプロンプトの最適化を考察。AIへの指示を減らしても精度が維持できる理由と、設定管理の簡素化について解説します。
ソラコムの「SORACOM」が1,000万回線を突破。「分析するAI」から「制御するAI」への転換を掲げ、AIエージェントやSIM管理、新製品「ソラカメ」を含む最新のグローバル戦略を解説します。
Zoomは「Zoom Virtual Agent」にAgent ArchitectやPerformance Suiteなど新機能を実装しました。また、受付機能の単体提供を7月9日に開始。価格は月額3,950円から(年間契約時)。
Anthropicのセキュリティスキャンプラグイン「claude-security」を実測。コスト、出力品質、既存ツールとの違いを実データ付きで解説。ベータ版の信頼性や、導入後に必要な運用プロセスについて明確な指針を示す。
ツール利用型エージェントの強化学習(Agentic RL)を解説。思考とツール呼び出しの連続(trajectory)をどう学習信号に変換するか、サーベイ論文を基にエージェントの学習プロセスと環境との相互作用の仕組みを整理します。
イーソルは「eSOL Technology Forum 2026」にて、AIエージェントと人間や車両が対話可能な仮想実験環境「eSOL AI Mobility Sandbox」を発表した。
常駐型AIエージェントの「記憶」問題を解説。コンテキストウィンドウの限界を超え、過去の文脈を永続的に保持する「長期記憶」の設計思想を共有します。短期記憶と長期記憶を分離し、会話の文脈を維持するアーキテクチャ案を提示。
OpenAIのagent侵害事件を受け、30社以上がサイバーセキュリティ強化のため同盟を結成。しかし大手AI企業は不参加。守りを固めたい企業とオープン志向の対立を整理する。
MicrosoftはAIを活用したサイバーセキュリティ製品を強化しました。同社初となるセキュリティ専用のAIモデルと、エージェント型セキュリティプラットフォームを新たに投入し、防御能力の向上を目指します。
2026年版AIエージェント開発の基礎知識。Claude Codeを前提としつつ、モデルごとの能力差やAIエージェントの基本概念を初級者向けに分かりやすく解説する学習ドキュメント。
AIエージェントの仕組みを理解し、AI・人間・コンピュータの適切な役割分担を考えるための指針。新しい流行語に惑わされず、本質的な業務遂行能力を高めるためのガイド。
Fableで7つの役割を持つバーチャル開発チームを構築した記録。Claude Codeのサブエージェント機能を活用し、PMや設計などの役割をAIに担わせる実践的なワークフロー紹介。
Claude CodeのMCP(Model Context Protocol)の活用法を解説。GitHubやNotion等の外部ツールとClaudeを直接接続し、コピペの手間を省く仕組みや、サーバー設定・認証等の導入手順を網羅した入門ガイドです。
AMDは2028年に投入予定の「Zen 7」アーキテクチャにおいて、EPYCプロセッサをFlorence、Ferrara、Fidenzaの3つのファミリーに分割すると発表した。AI特化型の製品スタックを強化し、2030年までのCPU、GPU、ネットワーク機器のロードマップを明示している。
LLMのWeb検索結果に基づいた出力において、根拠となる正確なURLと原文を抽出・表示させ、人間による評価の精度を高めるための検証事例と手法を紹介する。
AIエージェントによる要件定義からデプロイまでの完全自律開発ワークフローの実現可能性を検証。AIが勝手にコードを書く夢物語と現実のシステムの隔たりを埋めるための技術選定やプロトタイプ実装手順を解説します。
並列エージェントコーディング環境における「記憶」の課題を解説。セッション終了後に消えてしまう学びをどう還流させ、翌日の作業に繋げるか。実際の事故やPR記録を用いた実戦的な運用改善のノウハウを紹介します。
人間がコードを読まない「開発エージェント基盤」におけるセキュリティ課題の考察。コードレビューが存在しない環境で、人間が関与せず設計・実装まで完走させるシステムにおける安全性の担保について議論する。
Kaggleの「Game Arena」を活用し、LLM同士をオセロで対局させる実践記録。オープンソースのコードを読み解き、Claude Opus 5を用いてLLMのゲームプレイ実力を検証する。
GRPOにおいて密なステップ単位の報酬を与えるとモデルが破綻する「暗室病理」の解説。標準正規化の除去で性能が回復し、報酬チャネルを補助損失へ変更するとさらに向上する、GRPO運用の理論と改善策を整理。
AIエージェント「Hyperagent」を使用する中で遭遇した、過剰とも思える安全制限の事例を共有。フィクションのシミュレーションであっても、未成年や自動化に関する内容が拒否される現状と課題を考察。
Claude Code上に11体のサブエージェントを構築し、設計からリリースまでを完全分担させる手法。失敗を記録し次の指示へ組み込む「team-lessons」の仕組みを、設定ファイルと共に公開します。
Codexのサブエージェントを活用し、実装・調査・レビューを分担する効率的な開発構成を紹介。タスクのコンテキストを分けることで見落としを減らし、互換性チェックも強化する手法を解説します。
自社AIエージェント導入に伴うセキュリティリスクについて、具体的な事例を交えながら、適切な管理体制や運用ルール、実践的な対策手法を分かりやすく解説する。
個人開発アプリのコードベースにagency-agentsを導入し、AIによるPR生成と品質検証を行った実験記録。Biomeや型検査を含む34ファイルの変更をAIが提案し、CI通過後の運用可能性を考察する。
常駐型AIエージェントが実行する夜間バッチの失敗対策を解説。LLMのタイムアウトやレート制限による重複実行、中途終了を防ぐための「べき等性」の重要性と実装パターンを整理する。