国内AIニュース
コード生成だけでなく、文書作成や事務作業など知的労働全般にClaude Codeを適用する実験の記録。コーディングエージェントの設計をそのまま流用せず、業務フローに最適化するための課題と工夫を詳述する。
C3(Claude Code Conductor)の最新アップデート情報を共有する。マルチエージェントフレームワークとしての機能を強化したv2.53.0からv2.54.0までの開発ログを公開し、実装の背景と継続的な機能向上について解説する。
LLMエージェントのモデル差し替え時に発生する挙動の不一致(ツール呼び出しの欠落等)を検知するためのチェック手法。20分で実施可能な再現確認方法を提案し、品質を維持するノウハウをまとめている。
LLMエージェントの強化学習において、sandbox環境の特性を活かして効率を高めるBranching Policy Optimization(BPO)の解説。兄弟ノードを用いた効率的な分岐木構築により、分散を削減する手法を詳述する。
Claude Opus 4.8から5への移行に伴うトークナイザーの変化と、プロンプト最適化への影響を実測ベースで検証。count_tokens APIを用いた比較結果、プロンプト規約の互換性が保たれていることを実証する。
中国が米国製AIチップへの依存脱却を進める中、丁薛祥副首相が国産AIチップの採用を拒む国内企業を「裏切り者」と批判していたことが報じられました。政府主導の国産化強化の姿勢が浮き彫りになっています。
グルメAIレコメンドアプリ「Bitee」が、渋谷エリアの店舗と連携した食体験イベント「GOCHISOSAMA AWARD」を7月25日から開催します。AIを活用した新しいグルメ体験が特徴です。
画面キャプチャをVLMに送る際、全フレームを送るとコストや遅延が増大します。重要な変化のみを抽出する判定が必要ですが、画素差分ではマウス操作等で誤検知が発生します。本記事では効率的なフレーム選択の課題と実装のポイントを考察します。
Apple Silicon Macで動作するGemma 4 12Bモデルの実装記録。6.7GBの単一バンドルに32K/128K用関数を同梱し、Core ML上でKVキャッシュや投機的デコードを最適化。M4 Maxで毎秒11トークンの推論を実現した技術詳細。
Anthropicの新しいトークナイザーは、従来モデルと比較して最大35%多くのトークンを消費する可能性があります。記事ではトークン消費量が増える背景について、公式の曖昧な説明を引用しつつ、その影響について分析しています。
@ITに掲載された記事の中から、読者の関心を特に集めた上位10本をランキング形式で紹介します。技術トレンドや業界の注目度が反映された、多くの読者に読まれた人気記事のラインアップです。
Fable 5の利用条件が2026年7月20日に確定。Max/Team/Enterpriseは週次上限の50%まで無料が恒久化される一方、Pro/Team Standardはクレジット制へ移行。延長の末に決定した新料金プランの詳細を解説します。
Anthropicが新モデル「Claude Opus 5」を発表。上位モデル「Claude Fable 5」に迫る性能を半額で提供し、推論深度の調整機能や安全性分類器と連動した自動フォールバック機能を搭載しています。
NVIDIAのジェンスン・ファンCEOが、オープンウェイトAIモデルへの規制に対して慎重な対応を求める共同書簡をX(旧Twitter)上で公開しました。
評価軸を全タスク固定することの弊害を検証。タスクごとに評価軸が直交するため、最適化すべきモデルがタスクによって異なることを実証し、評価手法の重要性を解説する。
2026年7月25日にAnthropicが「Claude Opus 5」をリリース。第三者テストで「Claude Fable 5」を上回る性能が確認されており、コストパフォーマンスの高さが注目されています。
Model Context Protocol(MCP)を用いた実務でのSaaS連携について解説。API呼び出しだけでなく、曖昧な入力やエラーハンドリングなど、業務上の事故を防ぐ実装の重要性を説いています。
コーディングエージェントの進化と「ループエンジニアリング」の概念を調査。AIを単なるツールとして使う段階から、自律的に業務を見つけ・配り・検証する仕組みへの移行についてまとめました。
scikit-learnで作成したモデルをGemini Enterprise Agent Platformへ登録し、デプロイしてオンライン推論を実行する手順を解説した技術ブログ。