国内AIニュース
Claude Codeにおける「都度参照」設定が意図通り機能していなかった事例とその改善記録。設定ミスを実測から見抜き、適切なコンテキスト制御を行うための知見を共有する。
AI生成テキストに紛れ込む間違い文字の検出手法について。文字コードの問題ではなくパターン認識の領域として、「公式名簿」を用いた判定や機械的な抽出スクリプトの作成を通じ、AIによる誤字脱字を検出し修正する方法を解説する。
開発のボトルネックがコード記述速度からエージェントの承認待ち時間へ移行している実態を指摘。開発者が律儀にエージェントの確認を待つ時間を減らし、自律性を高めることで生産性を向上させる必要性を説く。
Claude CodeとCodexを連携させ、エージェント同士にタスクを処理させるマルチエージェント開発の手法。人間は意思決定に集中し、実作業はエージェント間の対話で行うという効率的な開発フローを構築する方法を説明する。
AIエージェントによるMCPツール購入における「信頼」の重要性と、manifestファイルの役割を解説。売り手の正当性やデータの整合性を担保するために、環境設定ファイルがどのように機能すべきか、自身の環境での実験を通じて考察する。
Kimi.comの公式サブスクリプションにおけるユーザーデータの学習オプトアウトについて解説。規約に記載されたメール窓口へ連絡しても自動応答のみで解決に至らない現状と、前回の記事で提示した実態を共有する。
Andrej Karpathyが提唱した「LLM Wiki」パターンをMulmoClaudeへ実装した経験を共有。RAGとは異なるアプローチでLLMに知識を蓄積させ、資料と向き合うための設計上の勘所を解説する。
庭のリフォームにおける完成イメージの視覚化という課題を、画像生成AIを活用して解決する方法を解説。Stable DiffusionやMidjourneyを実務で活用する際のモデル選定や設計のポイントを論じる。
AIの現在時刻認識がプロンプトキャッシュに与える影響とコスト・精度への懸念を解説。datetime.now()の実装によるキャッシュ破壊を防ぎ、ClaudeやGeminiで適切に時刻を管理する手法を考察する。
化学製品のSDS(安全データシート)をMHLW標準JSON形式で管理するためのツールキット「sdsforge」を紹介。PythonとRustを活用したSDS作成・変換の自動化手法について解説する。
AIエージェントの長期記憶から検索した情報が常に正しいとは限らない問題に対し、信頼性を評価する「recall gate」の設計手法を解説。TypeScriptによる実装と検索後の検証フローを提示する。
AIエージェントが新ツールを導入しても既存ツールへ戻ってしまう「行動慣性」の解消法を解説。文脈の入口で反実仮想を取り入れることや、ツール一覧を常時表示しない実装の工夫について論じる。
Queue株式会社が、AI検索最適化サービス「umoren.ai」を「DX総合EXPO 2026 夏 東京」に出展することを発表しました。
RAGにおいて質問と無関係に見える「橋渡し文書」の重要性を論じる。検索エージェントが正解へ至るために不可欠な文書を見落とす現状と、論文「Bridge Evidence」に基づく対策を解説する。
Optyino.aiは、生成AIによる回答9,715件を分析し、調査レポートの引用率が21.8%であることを明らかにしました。導入検討時の判断基準としての実態を検証しています。
高性能モデル「Claude Fable 5」が、高い能力を持ちながらも現場導入で混乱を引き起こした事例を紹介。AIが生成するコードや成果物が期待と異なり、組織に与える影響と人間側の指示の重要性を語る。
大阪産業局主催のセミナー「AI×自動運転の社会実装最前線」に、VML代表の山下氏が講師として登壇することが決定しました。
Netflixが、ベン・アフレック氏らが共同設立したAI映画制作スタートアップ「InterPositive」を、総額5億8700万ドル(約950億円)で買収しました。
大規模推論モデルの冗長なCoTを圧縮する技術「BIRD」の解説。二段階のパイプラインを用いることで、推論精度を維持しつつCoTを64%削減し、推論の効率化と軽量化を実現する手法です。
ローカル環境で「Gemma 4 26B(MTP版)」と「Claude Code」を連携させ、テトリス作成を検証。llama.cpp環境下で、わずか54秒でバグのないテトリスを完成させた実証レポート。