国内AIニュース
Figmaのプラグイン開発を、AIを活用して未経験から挑戦した体験談。CursorやClaude Codeを活用し、コーディング知識が乏しくても効率的に自分用ツールを開発する過程を共有する。
Anthropicが、プライバシーを重視したAIサービス利用データの収集と分析レポートを公開。Claude CodeやAPIを利用するユーザーの具体的な利用実態を明らかにした。
Addy Osmani氏の論文を基に、AIエージェントの設計手法「Loop Engineering」を解説。システム設計におけるエージェントのプロンプト最適化と、効率的な設計フレームワークの要点を日本語で整理して紹介します。
自律的AIエージェントのコア・モジュールを5段階で設計する手法を解説。Anthropic API版とOllama(ローカルLLM)版の両方のソースコードを公開し、最小実行サンプルで理解を深める。
LLMエージェントの会話における「忘却」問題に対し、長期記憶をホット・索引・コールドの3層に分けて設計する手法を解説。実装よりも設計順序の重要性を説く。
VRAM 6GBのGPU環境で、9BクラスのローカルLLM「Qwythos-9B」を動かす検証。llama.cppを使用し、量子化版のQ4_K_Mが現実的な選択肢であることを示した。
Zhipu AIのオープンウェイトモデルが、IDOR検出ベンチマークでフロンティアモデルを上回った事例を紹介。Semgrepチームによる比較検証を通じ、オープンソースモデルの実力とセキュリティ分野での活用可能性を解説する。
Sakana AIの「Sakana Chat」と「Sakana Fugu」に見られるUIの有無という非対称性について考察。FuguがUIを持たない理由は、対話用ではなく既存ワークフローへの組み込みを前提としたツールであるためだと分析する。
DeepSeekが公開したDSparkアルゴリズムを解説。1トークンずつ生成する従来の自己回帰生成のボトルネックを解消し、モデルの性能を維持したまま推論速度を大幅に向上させる手法を紹介する。
AIに検索機能を与えると出力が冗長になり、後段処理が失敗する問題を分析。DoorDashの論文「Decoupling Search from Reasoning」を基に、検索と推論を分離する構造的な解決策を提示する。
ガートナージャパンの亦賀忠明氏が、業務におけるAIエージェントの投資優先順位の決め方と、今後の進化予測を解説。業種別・業務別の導入戦略について、Webセミナーの内容から深掘りする。
長いAIエージェントセッションで発生するコンテキストの劣化問題(context rot)を解説。Rust製のClaude Codeプラグイン「ctxrot」を用い、劣化の検出・救済・復元を行う手法を紹介する。
AI研究組織DeepReinforceが、新たなAIモデルファミリー「Ornith-1.0」をオープンモデルとして公開しました。最上位のOrnith-1.0-397Bは、ベンチマークテストにおいてClaude Opus 4.7を上回る性能を記録しており、注目を集めています。
VibeThinker-3Bの論文を通じ、推論能力と知識を分けて設計する重要性を解説。モデルに事実を記憶させるのではなく、推論エンジンと知識ストアを分離する設計指針を提案する。
Anthropicが公開したガイド「Building AI agents for the enterprise」を紹介。先進企業がAIエージェントをどのように活用し、業務変革を実現しているのか、その手法を解説する。
Hiraku agentの調査により、ゲーム開発においてAIとエンジニアがどのような役割分担をすべきかが判明。AIに代替される業務と、エンジニアに残る核心的スキルを明らかにした。
MicrosoftのVS Code Eval Teamが、コーディングエージェントの「トークン浪費」問題を調査。5万回以上の検証から「過剰思考」の実態を明らかにし、評価自動化の重要性を提言。
常石造船がシステムモダナイゼーションにAI駆動開発を導入。調査と再設計の検討期間を従来の長期的なプロセスからわずか2日間へと大幅に短縮した具体的な手法を紹介する。
GoogleがMetaに対して、Geminiへのアクセスに制限を課したことが報じられました。世界最大級のAI企業であってもインフラリソースには制約があることを象徴する出来事として、業界内で大きな波紋を広げています。