国内AIニュース
8月30日10時半より、広告を出しても売れない企業に向けた無料ウェビナーが開催されます。AIやSNS時代において、顧客の脳内シェアを獲得するための戦略を公開します。
「経営人事AIプロフェッショナル講座」が内容をアップデート。成果創出までの期間短縮を目的とし、受講者の声や実際の成果事例を大幅に刷新して提供されています。
AIコーディングエージェント利用時のコストと品質の最適化手法を解説。「安いモデルでも十分か」「モデルによる品質差は?」という疑問に対し、aws-samplesが公開する「sample-agent-cost-bench」を活用してタスクを評価する方法を紹介する。ツール自体の仕組みや同梱タスクの実行方法を具体的に説明し、適切なモデル選定を支援する内容。
Sakana AIの「Fugu」が提唱する「Multi-Agent System as a Model」の概念を、OpenFuguを用いて検証・再現する技術解説シリーズ。
Claude Codeが突然韓国語で謝罪し、存在しない脅威を主張した事例を検証。結論としてプロンプトインジェクションではなく、AI自身の幻覚によるものだと判明。
Android自動化において、UIの状態を観察せずに操作することが不安定の要因。画面認識とUI Selectorを組み合わせた安定的な自動化手法を解説する。
社内のAI勉強会から考察した、個人レベルでAI活用が進まない理由。技術ではなくマインドセットの問題であり、ツールや文化が変革の鍵となることを提言する。
ObsidianのAI会話ログ分類をCodex CLIで自動化する際、LLMによる意図しないコミットを防ぐための設計思想を解説。git操作をLLMから分離し、ランナー側で決定論的に実行する手法と、信頼ではなくシステム構造で制御する重要性を説く。
ChatGPT 5.6で導入された専門的な料理人(エージェント)による分業体制を例に、マルチエージェントシステムがもたらす品質と速度の向上を解説する。
5年分・約429万字に及ぶ自身のBacklog発言をAIに学習させ、自身の判断基準を38本の原則として抽出した。過去の判断とAIのバックテストを行った結果、本人一致率は39%となり、素のClaudeと比較して4.5ポイントの上積みを確認。数字以上に、自身の思考の癖や判断のプロセスを客観視できた過程の面白さと学びについて綴ったエッセイ。
Blender未経験者がClaude Codeを使い、クロノトリガーのシーン再現に挑戦。エンジニアによる3D制作の試行錯誤とAI連携の可能性を語る。
英語力A2、プログラミング未経験の著者が、AIを駆使して自分専用の英語学習アプリ開発に挑む記録。丸投げによる失敗から学び、AIとの協働を通じてアプリを構築していく過程を追う。
対話AIがユーザーに迎合する「迎合バイアス」の仕組みを解説。指示待ちの姿勢や曖昧な質問がAIの肯定を誘うとし、役割固定や評価観点の具体化によって、AIからの批判的なフィードバックを引き出す手法を提案する。
AI開発時代における新たなアーキテクチャの提案。AIの間違いを前提とし、人間に依存せず、CIによる検出と安全なマージを組み込んだ、AIエージェントと共存するための個人開発TypeScriptモノレポ構築法を論じる。
架空の映像制作会社「アオバ映像企画」を舞台に、業務上の「あの人しかできない」という属人化を解消するための連載記事。AIを活用したツールで、現場で発生しがちな小さな困りごとを解決する手法を紹介する。実際のUI動作を想定したデモを通じて、AIによる読み取り精度の限界と、実務における人間による最終確認の重要性を説く内容。
macOSのフォトアプリ内の写真を、ローカル環境のVLM(視覚言語モデル)を用いて自動分類する手法。子供の写真約7,500枚の中から「飲食に関連する写真」を抽出・自動アルバム化するツールを構築。外部サービスへデータを送信せず、NVIDIA DGX Spark上でプライバシーを保ちながら高度な画像解析を実現した記録。
LLMがツールやコマンドを実行できる理由を、モデル単体ではなく「テキスト+プロトコル」という枠組みで解説。モデル・Runtime・ツール実行層・権限環境といった境界線を明確に分離し、Agentをブラックボックスではなく構造的に理解するための視点を示す。