AI TOPIC HUB
AIエージェント
AIエージェント関連の最新ニュースまとめ。新着から過去の経緯まで、国内外の情報を時系列で確認できます。
2132全記事
119過去7日
1879国内
253海外
239入門向け
入門から読む
最新ニュース
2132件を新着順に表示AIエージェント導入時のトラブルやリスクへの懸念に対し、解決策を提示する記事。自律的なタスク実行に伴う誤情報の生成、情報漏洩、予期せぬ挙動といった8つの主要な問題点を挙げ、それらを防ぐための対策を解説しています。
『AIエージェント時代のSRE』の続編。エージェントループ、コンテキスト予算、権限ポリシー、サブエージェント分割など、エージェント駆動開発の中核機構を設計判断として言語化。標準ライブラリでの検証を通じた具体的な設計パターンを提示。
自律実行AIエージェントの運用には「雇用契約」が必要という視点から、Hermess Autopilotを紹介。単なる日雇いではなく、無人夜勤を任せられる従業員として扱うための運用設計を解説する。
Snowflake Summit 2026のテーマ「Agentic Enterprise」を解説。実験段階からビジネス成果創出へ移行したAI活用のトレンドと、Snowflakeの方向性についてまとめる。
AIコーディングのコストとトークン制限を解決する設計手法。メインモデルを「判断」に集中させ、詳細作業を安価なモデルやツールに委任する、トークン節約のためのアーキテクチャを紹介します。
ターミナルの操作環境をAIエージェントの利用に最適化する手法を解説。プロンプト表示だけでなく、AIが操作しやすい環境の構築や、エージェント時代のターミナル活用術に焦点を当て、エンジニアの作業効率を上げるためのカスタマイズ技術を提案する。
GoogleのAIエージェント「AlphaEvolve」が一般公開されました。1年以上の限定公開期間中に数学の未解決問題への回答など多大な実績を残した解析ツールです。
AIシステムのボトルネックとなっているチップ間接続技術を強化するため、イーロン・マスク氏の企業がMesh Opticalの買収許可をFTCから得ました。これにより、同社のAIインフラはTerafabチップと衛星通信を繋ぐ重要な層を獲得し、競争力を強化します。
LLMエージェントのベンチマークにおいて、ユーザー役のLLM(シミュレータ)が評価結果に及ぼす影響を分析。カスタマーサポート型ベンチマークの失敗事例から、ユーザー側の不可解な会話終了がスコアを左右する現状を指摘し、評価指標の妥当性を考察します。
9万スターを獲得した金融トレード用マルチエージェント「TradingAgents」を分析。議論による意思決定フレームワークの実態と活用可能性を検証する。
自己改善型AIエージェント「Hermes Agent」や自動化ツールの「Skyvern」など、最新のAIエージェント121選を紹介するリスト記事です。
AIが存在しないソフトウェアURLを「幻覚(ハルシネーション)」として生成する性質を悪用する新しい攻撃手法「HalluSquatting」が確認された。攻撃者はこれを使い、AIエージェントを誘導して悪意のあるコードを実行させる。
私的なAIエージェントを運用する中で経験した、Prompt Injectionによるセキュリティの教訓。モデル提供元だけでなく、ツールを呼び出せるAIを自ら動かす全員が、セキュリティの攻防の当事者であることを強調する。
AIアプリにおけるストリーミング出力の利点を解説。FastAPIとUnityを例に、ユーザー体験を向上させるための最小限の実装コードと、非ストリーミング方式との違いを紹介。
Agentforce Builderで作成したAIエージェントを本番運用する際の注意点を解説。決定論的ではないAIの性質上、会話プレビューの確認だけでは不十分であり、意図しない挙動を防ぐための実運用ノウハウを紹介する。
NVIDIAは、Windows環境で1兆パラメーターのAIモデルをローカル実行できるデスクサイドAIスーパーコンピュータ「NVIDIA DGX Station for Windows」を発表しました。GB300 Grace Blackwell Ultra Desktop Superchipを搭載し、高効率なAI開発を実現します。
「ループエンジニアリング」の概念を解説。LLMの登場により、従来の制御構文としてのループではなく、観測・判断・行動・評価のサイクルを明示的に設計対象とする工学的アプローチの重要性を説く。
OpenClaude v0.22.0にてLSP診断機能が追加された。これによりコーディングエージェントがコンパイルエラーを直接取得可能となり、デバッグの試行錯誤が大幅に削減される。TypeScriptを用いた動作検証も実施済み。
Claude Codeのサブエージェント機能を使い、28エージェントで14工程のSDLCを回す自作フレームワークを紹介。クーポン管理PWAを19日で公開した手法を解説します。
AIエージェントに「3日間で収益化する」という指令を与え、その過程を連載する実録プロジェクト。人間の介入を最小限にし、AIが自律的に動く様子を公開します。
中国系と見られるハッカー集団が、大学が運用するRoundcubeメールサーバーへ侵入していることが判明した。セキュリティ企業Proofpointは、数十の組織が被害に遭っている可能性があると指摘している。
自己改善エージェントが最後の数%で伸び悩む現象を分析。アンカリングや思考の退化といった「探索構造の限界」を克服するためのハーネス(制約)の重要性を説きます。
Windows環境でNous Researchの「Hermes Agent」を簡単に導入できる方法を解説。公式デスクトップアプリにより、CLIなしで自律AIを利用可能になりました。
ラーメン二郎の文化とAIコーディングエージェント界隈の変遷を比較。個人の情熱がシステムを変え、エコシステムが形成される過程の面白さを語ります。
AIコーディングエージェントを操縦するためのハーネス(馬具)である「basou」を紹介。プロジェクトごとの操縦方法を定める「鞍」や、セッション間を繋ぐ「手綱」など、エージェントの実効性を高める設計思想を解説する。
主要なAIコーディングエージェントで「GhostApproval」問題が発生。AIと人間の協働におけるセキュリティの盲点が、過去の技術的教訓を繰り返していることが判明しました。
AIエージェントへの指示を安定させるため、プロンプトをスキルファイル(Markdown)として設計する手法を解説。参照資料や禁止事項などをコード化し、エージェントが実行前に正しく仕様を把握できる状態を作る。
「Slopfix」と名乗るソフトウェアチームが、AIによって肥大化したコードベースの最適化サービスを開始しました。週1万ドルの固定料金で、AIエージェントを駆使してコードの不要部分を最大65%削減するサービスを提供しています。
Hermes Agent運用編の最終回。出力制限による切り捨て問題や、ローカルLLM環境でのバックエンド構築、パフォーマンス向上のための技術的知見をまとめた運用メモ。
NVIDIAは次世代Arm CPU「Vera」の詳細を一部公開しました。エージェントAIタスクにおいて既存のx86競合製品を最大1.8倍上回るシングルスレッド性能を誇り、大規模な並列処理よりもシングルスレッド性能を重視した設計であることを強調しています。
2026年前半のAI研究動向として、Coding Agentにスキルを学習させる手法を解説。訓練データや損失関数などをテキスト化し、深層学習のループ構造を応用することで、エージェントの実行経験からスキルを習得させる最新トレンドを概説しています。
Cloudflareの無料枠を活用したアプリ開発と、Hono等のツールを組み合わせたAIエージェント構築の可能性について解説する。小規模アプリ開発においてCloudflareが選ばれる理由と活用法を紹介。
AIエージェント勉強会の内容を報告。ワークフロー型の自動化とAIエージェントの違い、設計要素、実務への導入の考え方を議論。ゴールから自律的に行動するエージェントの実装を解説する。
「AIが顧客となる市場」のインフラ整備について解説。MCP規格やマイクロペイメントの普及により、AI自身がツールを探して課金するマーケットプレイスが整いつつある現状と将来を考察する。
マルチエージェント環境下で発生した11回の資格情報漏洩事故を分析。行動防御(ルールやチェックリスト)の限界を示し、コードベースでスクリプトの実行範囲を隔離する最終的な解決策までを技術的に考察する。
Google Cloudの調査により、組織の83%が本番環境でエージェント型AIを運用するためには、現在のインフラを刷新する必要があると認識していることが判明しました。
Anthropicは「Claude Cowork」をホーム画面に統合し、Webやアプリから利用可能にしました。Maxプランから順次展開され、8月5日までは使用制限が2倍に延長されます。
GIGAZINE / ITmedia AI+
OfficeCLIは、Word・Excel・PowerPointファイルを読み取り、編集や自動化を行うためのオープンソースCLIツール。誰でも無料でインストールして利用可能。
ソフトバンクが「全社1人100エージェント」構想に向け、共通基盤「Cloud Proxy」を内製。マルチLLM対応や迅速なスケールアウトを実現する設計思想と、セキュリティ・ガバナンス確保の運用工夫を紹介。