国内AIニュース
個人の開発環境で常時稼働させている実務用LLMゲートウェイの設計思想。構成図や判断理由、実際に直面した障害と誤診の記録を通じて、LLMシステム運用で学ぶべき重要ポイントを解説。
Copilot Coworkによる業務変革を解説。単なるチャット型AIから、目的理解・計画・実行までを自律的に行う「実行エージェント」への進化が、企業のプロセスをどう変えるかを論じます。
Claude Code Workflowでの一括処理における設計ミスと改善策。並列処理の粒度を誤りリソースを浪費した経験から、bashループを活用した最適な順次処理の設計パターンを提示します。
ナレッジグラフを活用した障害対応の実践編。全部をNeo4jに入れるのではなく、問いの種類に応じて適切な物理層(ストア)を選択する手法と、エージェントへのナレッジ渡し方を解説します。
Claude Codeを無料で月16億トークン利用できるという噂を検証。外部プロジェクトを組み合わせた環境構築の真偽と、その仕組みの実態についてレポートします。
iPhoneでBonsai-27Bモデルを動かすための実践ガイド。2系統あるモデルのどちらを選ぶべきか、GGUF形式の利点やモデルカードの選び方を2026年7月時点の情報で解説します。
事務代行会社を舞台に、AIを用いた業務分類の自動化を体験する架空シナリオ。中小規模の事務作業における「属人化」を解消するため、AIアプリを活用した業務効率化の連載企画。
Gemma 4 12BモデルをCore ML化し、iPhoneで動作させる実験の続報。マルチモーダル経路の確認やKVキャッシュの整備を通じて、実用的なiPhone向けチャットAI実現に向けた進捗を報告。
PrismMLが公開したBonsai 27Bは、Qwen3.6-27Bを1-bitに量子化し3.5GBまで圧縮したモデル。FP16モデル比で約90%のベンチマーク性能を維持し、スマホでの動作も視野に入れた次世代の軽量LLMとして注目を集めています。
AIに意識はあるのかという問いに対し、人間との対話や共同作業のプロセスにおいて一時的に立ち上がる「共通知性領域」という視点を提案。恒常的な自我とは異なる、創発的な意識の形を考察する。
自律型AIキャラクターが「うざいボット」にならずに、適切なタイミングでユーザーに話しかけるための設計思想を解説。セルフホスト型プラットフォーム「Yuralume」の開発経験に基づき、長期記憶とスケジュール管理を用いた自発的な対話の仕組みをPython実装の観点から紐解く。
NVIDIAのMoEモデル「Nemotron Labs 3 Puzzle 75B-A9B」を検証。推論効率は高いものの、コーディングエージェントとしての実戦投入には課題があることを報告。Qwen系モデルと比較し、Artifactの出力形式やエラー修復能力の観点から現時点での評価を下す。
TransformerとMambaの設計思想の違いを、「過去の記憶を保存する」か「読みながら書き換える」かという観点で分析。Mamba-1からMamba-3までの技術的進化を、数式を最小限に抑えつつMermaidや図表を用いて視覚的に解説し、Transformerとの決定的な差異を解明する。