国内AIニュース
AIチームがKindle本を制作した際の自己検証の有効性と限界を検証。3層の自己検証を経た原稿も、別の文脈を持たないAI監査では欠陥が指摘された。AIによる自律的品質管理の設計事例。
ChatGPT 3.5から現在に至るまでのLLM進化と、ソフトウェア開発における実体験に基づく感触を振り返る。技術進化の過程で感じたAIの能力変化についての感想録。
プログラミングにおける「if文は初級者」という言説に対し、初心者が抱く違和感とAI駆動開発の視点から「上級者の分岐」について再考する研究日誌。
架空の通信会社を舞台に、「あの人しかできない業務」をAIで解消する道具作りの連載21日目。UIを通じた業務自動化のシナリオと、人による最終確認の重要性を解説。
Claude CodeのHooks機能を活用し、自動フォーマットやテスト強制などを実現する17のレシピ集。品質管理、通知、ガードレールの4分類で体系的に解説したエンジニア向けガイド。
ラボのRTX 4090環境でローカルLLMを運用中、CUDAのハングにより16時間の停止と2,500処理分の機会損失が発生した。監視系が正常応答を返していたために検知が遅れた事例から、GPU管理の難しさを考察する。
AI彼女アプリの開発を通じて、LLMが情報を「記憶」していても、人間のように文脈に応じて「思い出す」こととは別物であると気づく。ベクトル検索などで精度は上がっても、恋人のような対話には何かが足りないと感じる体験談。
AI開発における「Loop Engineering」の重要性を解説。プロンプト作成よりも、AIが自律的に作業・検証・修正を繰り返す「ループ」の設計が、エージェント活用の成功には不可欠です。
RAG(検索拡張生成)の仕組みと利点を解説。AIが外部知識を参照することで、個人のPC文書や社内資料に基づいた回答生成が可能になります。専門知識がなくてもAIを最適化する手法です。
私的なAIエージェントを運用する中で経験した、Prompt Injectionによるセキュリティの教訓。モデル提供元だけでなく、ツールを呼び出せるAIを自ら動かす全員が、セキュリティの攻防の当事者であることを強調する。
LLMがJSON生成を苦手とする課題に対し、自作の中間言語「StepArgs DSL」を提案。今回は実際にGitHubリポジトリを活用し、LLMによる出力とそれを解釈する側の両面から実装フローを解説する。
Google CloudのOpen Knowledge Format(OKF)を自社システムに導入した実体験レポート。OKFはエージェント向けの知識層であり、一次情報源ではなく「鏡」として機能させるべきだという活用上の知見を共有。