国内AIニュース
自己改善エージェントが最後の数%で伸び悩む現象を分析。アンカリングや思考の退化といった「探索構造の限界」を克服するためのハーネス(制約)の重要性を説きます。
AI開発効率化の現場での導入課題を解説。単にコード生成をAIに任せるだけでなく、役割分担と確認プロセスを明確化しないと効率化が困難であることを指摘します。
Windows環境でNous Researchの「Hermes Agent」を簡単に導入できる方法を解説。公式デスクトップアプリにより、CLIなしで自律AIを利用可能になりました。
未成年者のSNS利用を法律で禁止しているオーストラリアにて、政府調査により年齢確認システムがまったく機能していない実態が判明した。アカウント作成を防止するための技術的な対策が奏功しておらず、法の運用に大きな課題が露呈している。
個人の情報管理法を3人チームに適用した実験記録。AIへの指示出しを効率化するための「薄いマスタデータ」管理と、チーム間でのナレッジ共有について検証した結果を紹介。
Claude CodeのOpus 4.8で発生する、ツール呼び出しのマークアップが本文に漏れ出す「court-loop」バグについて解説。GitHubでも報告されている既知の不具合の現状と、セッションへの影響を整理します。
AIコーディングエージェントを操縦するためのハーネス(馬具)である「basou」を紹介。プロジェクトごとの操縦方法を定める「鞍」や、セッション間を繋ぐ「手綱」など、エージェントの実効性を高める設計思想を解説する。
動画編集ソフトを一切使わず、Claude Code(モデル:Claude Fable 5)のみで広告動画を制作した事例を紹介。17.5秒の動画で、6つのアプリを操作しながら音声を活用した入力画面を完成させた技術と工夫を語る。
Claude Codeを活用したエージェントチーム運用の全6冊のZenn Bookシリーズを紹介。非エンジニア向けの入門書からエンジニア向けの独立した実践ガイドまで、読者のタイプ別に最適な読み方と学習ガイドを整理した。
Claude Fable 5の提供終了に伴い、Claude本人に依頼して自分の開発スタイルをCodex CLI(GPT-5.5)へ移行・引き継ぐ手順を解説。AIを使い、AIツールの入れ替えを自動化する実践記録。
AI要約に頼りすぎて本の内容を記憶できない問題を解決するため、学習の質を高める読み方を解説。AIには要約させず、自分の頭で解釈した上で「採点・反証」の役割を担わせる、効果的な読書プロンプトを紹介する。
頻繁に変わるAIツールに翻弄されないための「原理マップ」の作り方を解説。目的や判断基準といった「不変の要素」と、UIやモデル名などの「可変の要素」を分離し、YAMLで管理して月次レビューする運用法を紹介。
自動化を進める際、フロー全体ではなく作業ログの分析から始める手法を解説。JSON Linesを用いて作業ログをスコアリングし、AIに適した部分と人間が行う判断を切り分けるための最小実装の手順を紹介。
プロンプトを再利用可能なテンプレート化する手法を解説。固定文と必須変数を分離し、検証工程を挟むことで、AIへの指示を安定させる実装寄りの運用フローを紹介する。
AIエージェントへの指示を安定させるため、プロンプトをスキルファイル(Markdown)として設計する手法を解説。参照資料や禁止事項などをコード化し、エージェントが実行前に正しく仕様を把握できる状態を作る。
AIの外部操作で発生するエラーを「PASS / HOLD / STOP」の3つの状態に分類する手法を解説。処理停止の原因を明確化し、次の対応を分かりやすくするための実装デモと判断基準を記録する。
Claude Code向けの公式OpenAIプラグイン「codex-plugin-cc」がリリースされたという話題を検証。2社の関係性とリポジトリの中身を調査した体験記。
メンバー各自の思考やコンテキストをgitリポジトリとして運用し、認識合わせを「git pull」で行うというユニークな業務運用の試み。攻殻機動隊のタチコマを彷彿とさせるナレッジ共有の物語。
Tencentが公開した最新MoEモデル「Tencent HY3」について紹介。APIコストと性能のトレードオフを打破する、無料で利用可能な強力なコーディング・推論能力を持つモデルの解説。