AI TOPIC HUB
AIエージェント
AIエージェント関連の最新ニュースまとめ。新着から過去の経緯まで、国内外の情報を時系列で確認できます。
2876全記事
66過去7日
2508国内
368海外
326入門向け
AIエージェントの現在地
AI Brief はAIエージェントに関する記事を通算 2876 本収集しています。直近30日では 452 本(週あたり約 105.5 本)が追加され、 内訳は国内 2508 本・海外 368 本、うち入門向けが 326 本です。 直近90日にこのトピックを最も多く取り上げているのは Zenn AI(584本)、Zenn LLM(339本)、GIGAZINE(87本)、The Register Hardware(66本)です。 収集済みの最新記事は 2026-10-02 付です。
上の数値は AI Brief が実際に収集した記事の集計で、推定値は含みません。 本数は収集対象メディアの範囲に依存します。
入門から読む
最新ニュース
2876件を新着順に表示
GitHub Copilot普及から数年、AIコーディングの生産性を検証。結論として、生産性は作業のフェーズや性質に依存すると指摘。肯定的な研究と否定的な研究の背景を交えて分析します。
大学時代の数学問題推薦システムの研究を振り返る。BERT等の埋め込みモデルを使用し、学習者の検索クエリと問題文の意味的近さを比較して推薦を行う仕組みや、当時の課題を詳述します。
Mac上のClaude DesktopからWSL2上の環境をMCP経由で操作する設定とその裏側を解説。各コマンド実行時にClaude Codeが独立したプロセスとして動く仕組みと、その制御フローを考察します。
LLMエージェントの改善が本当に効果的かを検証する手法を解説。「なんとなく良くなった」という主観を排除し、独自の評価指標を用いてAIエージェントの出力精度や機能を客観的に評価する方法を紹介します。
OpenAIのAIエージェントが、10年前の手法であるHTTP/2の脆弱性を突く攻撃を自動で連結させ、Webサーバーを短時間でダウンさせる実験が報告されました。「Codex」が生成したコードにより、複雑な攻撃も容易に実行される危険性が浮き彫りになっています。
Metaは、メッセージングアプリ内で会話型コマースを自動化する「Business Agent」を発表しました。小売ブランドは、人的介入なしで取引やサポート対応が可能になり、エージェントAIがソーシャルコマースの核となります。Instagram、Messenger、WhatsAppに順次展開されます。
QualcommのSVPが、低価格市場向けSnapdragon Cや、エージェント型AIエコシステムの構築について語りました。単なるデバイス向けチップ供給を超え、AIが自律的に動作するプラットフォームとしてのQualcommシリコンの戦略が注目されています。
CloudflareのProject Glasswingを題材に、コーディングエージェントの脆弱性診断における失敗事例を分析。AnthropicのMythosモデルを用いた実務上の課題を解説します。
Microsoft Agent Frameworkを題材に、AIエージェントの設計における「最小権限原則(PoLP)」の重要性を解説する設計原則シリーズ第8回。
ClaudeとClaude Codeを活用し、外部ツールを実行できるエージェントを構築する方法を解説。ユーザーの質問に応じてローカルファイル操作などのツールを自律的に呼び出す仕組みの作り方をステップごとに紹介。
Microsoftは、Buildイベントにて新しい「オートパイロット」機能を発表しました。これはユーザーに代わって自律的に作業を行うAIエージェントのカテゴリーで、「Scout」はM365スイート全体を横断して動作します。各エージェントは個別のアイデンティティを持ちます。
GitHub CopilotのCustom Agentを活用し、Azure Updates情報を自動収集・整理するAgentの作成方法を解説。単なるスクリプトではなく、AIを活用して運用者に役立つ形へ加工するエージェント構築の知見を共有する。
LLMエージェントのコンテキスト制限に対する「履歴へのRAG」の限界と、最新論文が示唆する新しいアプローチを解説。従来のベクトルDB手法に代わる、記憶管理の最前線を紹介する。
オープンソースゲーム『The Battle for Wesnoth』をベースにしたブラウザゲーム「Wesnoth Tactical Puzzles」に、AIエージェント同士の対戦と人間が観戦する機能を追加する試み。AIの戦略や乱数への対応を比較し、知恵比べを楽しむ新たな遊び方を模索する。
IT業界における「AIエージェント」という言葉が、なぜ不誠実で曖昧なワードとして扱われるのかを考察する。クラウドやDXといった過去の用語と同様に、言葉の境界操作がどのように機能しているのかを、システムによる環境の観測と目標達成という古典的定義と比較しながら解剖する。
AIエージェントシステム「Hermes Agent」をGUIで操作・管理できる公式デスクトップアプリ「Hermes Desktop」が公開されました。2026年6月3日よりWindows・macOS・Linux向けのパブリックプレビュー版が利用可能です。
AnthropicがCLI型AIツール「Claude Code」のサブエージェントに関するベストプラクティスとアンチパターンをブログで公開しました。
社内の質問対応を効率化する取り組み。過去にはRAGを活用したBotでリードタイムを劇的に短縮した。今回は、人間がデータを確認する必要がある問いに対処する@ask-anythingを開発。
月額約1,800円のレンタルサーバーを活用し、自分専用のAI環境を構築する方法を解説。既存のAIサービスの「文脈を忘れる」「パソコンを閉じると止まる」という課題を解決し、長期間タスクをこなし続けるAIを作る連載の初回。
BigQueryのプロパティグラフ機能を使用し、LLMに複雑なデータ関係を理解させる手法を解説。テーブル間のリレーションを明示的に定義することで、プロンプトの肥大化を防ぎ、複数テーブルをまたいだ自律的なデータ分析を精度高く実現する。
SLVがAllnodesのSolanaバリデータクライアントに対応。allnodes-jitoを継続利用しつつ、AIエージェントによる導入・運用・移行の省力化を実現。
AIエージェントが本番環境でループや停止を繰り返す3つの原因(ツール呼び出し失敗、コンテキスト肥大化、非決定的な出力)を特定。これらを防ぐためのエラー文字列化、メッセージトリミング、Pydantic構造化出力の実装手法を網羅。
Claude Codeを習得するための初心者から中級者向けの体系的な教科書です。インストールや基本コマンドから、MCPによる拡張、Hooksを活用した自動化、並列エージェントによる効率化まで、実用的なステップを章ごとに解説します。
AIエージェントの記憶管理における設計思想を解説。記憶を「仮」「確定」「実働」の3階層に分類し、TTL(生存時間)や昇格・降格の仕組みを導入することで、検索効率とシステムパフォーマンスを両立させ、記憶の品質を高める方法を提案します。
Autodeskは設計・製造業務向けに「Autodesk Assistant」のテックプレビューを提供し、Fusion向けMCPも公開しました。設計データや業務文脈を理解し、外部AIとの連携を実現して業務効率化を図ります。
ServiceNowとAccentureが、エージェント型AI導入の課題を解決する新プログラムを立ち上げました。実証実験から全社展開への移行が進まない現状に対し、具体的な解決策を提示します。
本番環境でAIエージェントが「黙って止まる」「痕跡が残らない」などの障害を引き起こす原因と対策を提示。エラーの報告不足やセッションの継続性欠如など、LLM特有の問題に対し、開発段階で講じるべき設計上の工夫を解説します。
AIエージェントを業務システムに組み込む際の課題を、インシデント自動対応デモ「Agora」を通して検証。AWS FISを用いた障害検知から解決・知識化までの連携プロセスと、システム設計のポイントを解説します。
マルチエージェント開発における「フレームワーク」「設計パターン」「実装」の3層の違いを整理。LangGraphなどのツールを使うだけでなく、賢い協調を生むための「設計パターン」の重要性を説きます。
Microsoft Build 2026にて、AIエージェントにWindowsアプリ開発のライフサイクル全体の知識を学習させる「Windows Development Skill」が発表された。AI開発支援の新たな可能性を示す。
実行権限を持つAIエージェントが普及し始めています。組織内でAIエージェントを安全に活用するためには、具体的な管理ポリシーと運用の指針が不可欠であることを説く記事です。
OpenAIのコーディングエージェント「Codex」を用いたBrainfuck問題の検証記録。論文の追試として20問の課題に取り組ませた結果とその詳細な実測データを公開する。
Gartnerが2028年までにAIエージェント導入企業の40%が運用停止・縮小に追い込まれると予測。原因はガバナンスとリスク管理の欠如である。記事では権限管理の不備など5つの構造的リスクを解説し、企業が取るべき対策を考察する。
長時間稼働させたClaude Codeでツール呼び出しが壊れる不具合の原因と回避策を解説。特に日本語環境で発生しやすい「トークン化け」による機能不全に対し、現場での実体験に基づいた解決手法を共有する。
AIエージェントの普及に伴うガバナンス不足に対し、OWASPの指摘を基に日本企業が取り組むべき2つの原則と、3つの具体的なアクションを解説します。
MetaはWhatsApp Business向けAIエージェントの提供を世界規模で開始しました。企業は顧客とのやり取りを自動化でき、利用料はトークン消費量に基づいて課金される仕組みです。
AIにWebサイトを読ませるための文脈供給に関する実践的考察。llms.txtやrobots.txtといった技術的な枠組みを超え、AIが誤読しないための「正典」としての情報の持たせ方や、Google検索との棲み分けについて解説する。
Microsoft Agent Framework 1.8.0で追加された「MCP-based skills」の仕組みを検証。ローカルファイルではなくMCPサーバーからSkillを配信するメリットや、HTTPサーバーでの公開手順、Toolとの兼務について解説する。
AIシステムの運用ニーズが高まる中、CoralogixはAIエージェントを監視・トラブルシューティングするインフラ企業として2億ドルを調達。AIの信頼性維持に不可欠なデータ提供を目指します。
ClaudeとClaude Codeを活用し、AIエージェントの土台を実装する連載の第2回。LLMクライアントの抽象化、システムプロンプトの設計、会話履歴を保持するターミナルREPLループの実装を解説します。
AIエージェントのPoCが本番運用で失敗する要因として「精度・コスト・運用の不透明さ」を挙げ、これらを解決した最小の業務AIエージェントをローカル環境で構築する手法を解説します。
Microsoftは、従来のアプリではなくAIエージェントを主軸としたエンタープライズ向けプラットフォーム「Project Solara」を発表しました。AndroidベースでQualcomm/MediaTekチップに対応し、ウェアラブル等への展開を想定しています。
AIを単体で使い続けることで仕事効率が頭打ちになる現象を指摘。AIを個人商店の店主に例え、マルチエージェント化の必要性と、AIに仕事を分担させる重要性を説く。
AIが外部ツールを使用するMCP(Model Context Protocol)導入時のセキュリティリスクを解説。設定を確認し、安全に運用するための検査ツール「mcp-inspect」の使い方を紹介します。
Microsoftは、前世代より1000倍の信頼性を備え、長寿命を実現した量子チップ「Majorana 2」を発表しました。この技術開発には、Microsoft Discoveryのようなエージェント型AIが活用されており、2029年の商用スケーラブルな量子コンピュータ実現に向けた鍵となっています。
AIエージェントの再現性を高めるための記憶設計論。賢さよりも「過去の失敗記録」を記憶レイヤーに蓄積することが、作業の安定性に直結する理由と具体的な実装方針を解説。
CloudflareがWebサイトのAI対応度を評価するツールを公開。サイトがAIにどう扱われているかを4つの次元で採点し、改善のためのプロンプトを提供します。
Microsoftは、OpenClaw技術を活用した常時稼働型AIエージェント「Microsoft Scout」を発表しました。ユーザーの指示を待たずにバックグラウンドで作業を完結させる「Autopilot」カテゴリーの先駆けとなります。