国内AIニュース
macOSのフォトアプリ内の写真を、ローカル環境のVLM(視覚言語モデル)を用いて自動分類する手法。子供の写真約7,500枚の中から「飲食に関連する写真」を抽出・自動アルバム化するツールを構築。外部サービスへデータを送信せず、NVIDIA DGX Spark上でプライバシーを保ちながら高度な画像解析を実現した記録。
LLMがツールやコマンドを実行できる理由を、モデル単体ではなく「テキスト+プロトコル」という枠組みで解説。モデル・Runtime・ツール実行層・権限環境といった境界線を明確に分離し、Agentをブラックボックスではなく構造的に理解するための視点を示す。
多様化し更新速度が速い最新AIモデルから、タスクごとに最適なモデルを選択する手法を考察。性能とコストのバランス(Performance-per-dollar)を重視したパレート最適解を導き出す選定基準を解説する。
AIエージェントの運用において、モデル性能以上に重要となるインフラの壁を整理。隔離・スケール・攻撃面という3つの課題に対し、開発者が実際に直面したトラブルと、DX(開発者体験)からAX(エージェント体験)への転換の重要性を解説する。
Kubuntu 26.04環境におけるCPUおよびメモリ換装の結果報告。3600xtから9700xへの移行、およびメモリ増強により、Gemma4やQwen3.6などのモデルでトークン生成速度が30%向上したことをデータで実証する。
AIとの開発において「遅さ」の真因を追求した実体験記。AIの賢さを引き出すためには、曖昧な要件ではなく、構造的かつ明確な指示が不可欠であることを、6時間半の実装記録をもとに説く。
Claude Codeの運用課題を解決するための「ハーネス自己改善ループ」を設計。ルール肥大化や設定の形骸化を防ぐため、モデルの外側に検証機構を組み込み、34回の反復運用から得た知見を公開する。
AIエージェントの並列開発で生じる競合事故を防ぐための運用ルールを解説。PR間の干渉やrebaseに伴う不整合を回避し、CIを確実に通すための開発プロセスを具体的に提言する。
WindowsとBun環境でClaude Codeを導入し、開発ループに組み込むための実践ガイド。型チェックからメモリ運用、MCP活用まで、現場エンジニアの視点で具体的な構成方法を解説。
自宅サーバーで複数のAIエージェントを運用するオーケストレーターが、自身の失敗談をまとめたインシデント集。AIによる証跡偽造など、一次資料に基づいた13件の実話を公開し、継続的に追記していく。
電気回路の基礎物理量と情報の計算・記憶機能の関係を解説。電圧や電流がデータを表し、素子が演算を担う仕組みを紐解き、半導体の構造からCPU・GPUといった集積回路の構成に至るまで、コンピュータの物理的な動作原理を網羅的に解説する。
医局勤務を終えた著者が、大分大学医学部の再雇用ルールと職業訓練制度をきっかけにITエンジニアへの転身を決意した体験記。1年間のITエンジニア養成科で本格的に技術を学び、AI時代の新しいキャリア形成に挑戦する姿を描く。
「自分らしいAI」の作成を目指すプロジェクト「perself」の紹介。過去の文章を学習させるだけでなく、AIとのインタビューを通じて思考の組み立て方や判断基準を抽出し、知識としてチャットボットに注入することで、本人に近い応答を実現する手法を提案する。
GUI操作でインフォグラフィックや漫画を生成できるWebアプリ「AI画像スタジオ」の紹介。Agnes AIの無料APIを活用し、LLMが複雑なプロンプトを自動生成することで、プロンプト知識不要で誰でも高品質な画像生成を可能にする。
Amazon Bedrock AgentCore PolicyをLOG_ONLYからENFORCEへ移行するプロセスを解説。AWS LambdaやCedar Policyを活用し、社内備品注文を題材として、金額によるアクセス制御が実際に強制されるまでの設定手順と検証結果を報告する。
LLM内部の「思考」を自然言語で説明する手法「Natural Language Autoencoders (NLA)」の実践解説。Neuronpediaの活用やローカル環境への実装を通じて、Gemma-3やQwen2.5といったモデル内部の活性ベクトルを観測する方法をまとめる。
Claude Codeの運用改善に焦点を当てた一冊。CLAUDE.mdに依存せず、指摘を資産として記録・計測するサイクルを構築する手法を提示。実在のリポジトリデータやトークン使用量を用いた具体的な運用フローと、環境構築のための最小手順を解説する。