国内AIニュース
Difyを活用し、Markdown形式のナレッジベースを用いた社内ポータル向けRAGチャットボットを構築する方法を紹介。Chatflowを用いて検索から回答生成までの一連の流れを最小構成で実装する手順を解説する。
Claude Codeを実運用するための開発体制構築ガイド。判断・設計・実装の役割分担を構造化し、32件の失敗事例から導き出した一人でも効率的に回せる開発の規律とベストプラクティスを解説する。
AIエージェントを保護する免疫システム「Agent Antibody」のアイデア紹介。ハッカソン提出用として考案された、エージェントをガードする仕組みのインスピレーションと供養記事。
プロンプトエンジニアリング研修を選ぶ際のポイントを解説。選択肢が多すぎて迷う方へ、費用対効果を最大化し、現場で活用されないといった失敗を避けるための研修選定基準を紹介する。
RTX 4070(VRAM 12GB)環境を使用し、Qwythos-9B v2モデルのQ8_0精度を検証。2Dシューティングゲームの生成コードを対象に、旧版との比較やブラウザ実行時の挙動を含め、ローカル環境でのLLM活用におけるパフォーマンスを詳細にレビューする。
素数を用いた3次元パーコレーションモデルの研究結果報告。定数による到達性の劇的な変化と、その閾値が物理格子の臨界値と整合することを発見し、3Dデモサイトと論文を公開する。
2026年7月11日週のClaude Codeアップデート(v2.1.202〜v2.1.207)のまとめ。Artifactsの機能拡張やコマンド体系の刷新、オートモード利用拡大等のハイライトを紹介。
電設資材卸を舞台にした連載の25日目。AIを使わずに決定論的な計算で業務を効率化する小型アプリの構築を通じ、「あの人しかできない」業務を紐解くための実践手法を提示する。
Lifebotプロダクトの振り返りと現状報告。開発を取り巻く環境の変化や、AIエージェントのトレンド推移、オルターとの格闘記録をダイジェスト形式でまとめたエンジニアの独白。
「AI内部のグラフ構造」と「人間と対話するMOC構造」という2つの設計思想を対比。表象主義とサイバネティクスの観点から、AIを自己完結させるリスクと、検証可能性を維持しつつ人間とのフィードバックを重視するアーキテクチャの重要性を論じる。
RAGシステム特有のハルシネーション(回答の矛盾)問題に対し、評価駆動開発のアプローチで対処する方法を解説。関連文書があるにも関わらず誤った回答をする事象の原因を特定し、信頼性を向上させるためのテスト手法と改善プロセスを紹介する。
Alephが開発した、超音波で舌の動きを読み取り音声を生成するシステムを紹介。初期試作段階で約50時間の学習により、単語誤り率15.6%で発話内容を文章化できる。
意図分類と関数呼び出しに特化した30Mパラメータの軽量モデルをゼロから学習し、正解率91.11%を達成した事例を紹介。巨大モデルのAPI利用と比較し、特定のタスクに絞った小規模モデルの有用性とコスト削減の可能性について分析する。
LLMを計画ループから外す新手法「GATS」を紹介。状態遷移をグラフで管理し、既知のタスクは安価な層で処理することでLLMの推論回数を削減する。計画中の呼び出しを0回に抑える効率性と、未知の予測と既知の検索を分ける設計思想について解説する。
AIが生成する「もっともらしい嘘」に直面した著者が、自身の経験をもとに開発した手法「Core Growth Prompting(CGP)」を紹介。アプリ開発中に誤情報に遭遇した実例を通じ、AIとの付き合い方や、CGPに導入された検証機能について解説する。
AIが書いた不自然な日本語を自動で修正するAgent Skill「natural-japanese」を紹介。人間の文章とAI文章のコーパスを元に、機械的にAI臭を検出して修正する仕組みです。
ObsidianのノートをAIの記憶として運用する際、丸ごと読み込ませる手法が破綻した経験を共有。速度や精度の観点から運用を改善し、数ヶ月かけて辿り着いた「安定するフォルダ構成」のノウハウを、実測データとともに紹介する。
線形代数の基礎からLLM圧縮、LoRAまでの理論をNumPyだけで実装する連載の最終回。PyTorchを使わず、SVDを軸に数学的理論をコードで確認する手法を解説します。