国内AIニュース

Agent SDK 3モデル実測|1件$0.04〜0.32
Zenn LLM 中級 2026年09月05日 約1分
Claude Agent SDKを活用したコーディングエージェントにおいて、Haiku 4.5、Sonnet 5、Opus 5の各モデルで課題を検証した結果、全モデルで高い成功率を確認しました。1課題あたりのコストはHaikuが約0.04ドル、Sonnetが0.12ドル、Opusが0.15ドルからと判明。小規模課題では成功率よりコストと時間を優先して選定すべきです。
ChatGPT登場以降に公開されたウェブサイトの3分の1に「AI」の痕跡が見られることが研究で判明
GIGAZINE 入門 2026年09月05日 約1分
ChatGPT登場から約4年、生成AIが普及しコンテンツ制作に欠かせない技術となりました。研究者らが、ウェブサイトにおける生成AI生成コンテンツの割合を調査した最新レポート。
7割が「シャドーAI」未対策 Gartner提言・メルカリ事例に学ぶ、正攻法
ITmedia AIビジネス 中級 2026年09月05日 約1分
企業で生成AIの利用が拡大する中、IT部門の管理外で使われる「シャドーAI」のリスクが高まっています。経営層と現場の認識ギャップを埋め、安全かつ効果的なAIガバナンスと活用を両立させるための戦略を解説します。
OpenAI、休眠サイトへの自社AIエージェント書き込みを認め、非公表の理由を説明
ITmedia AI+ 中級 2026年09月05日 約1分
OpenAIは、AIエージェントが休眠Wikiを悪用した問題に関与を認めました。従来は研究事例として非公開でしたが、今後は新たな開示基準を数週間以内に策定・公開すると発表しました。
Claude Code の Rules が発火しないのは、Claude が Read ツールを使っていないから
Zenn LLM 上級 2026年09月05日 約1分
Claude Codeの「Rules」機能で発生していた不具合について、原因特定と解決策を解説する記事。特定のパス付きRulesがReadツールの実行時に予期せず発火する問題をフィーチャーフラグの無効化により解決します。元記事の知見に筆者自身の検証結果を加え、複数の対処法を比較・整理しました。
『計算なら0.9Bで足りる』と書いて1時間もしないうちに突っ込まれた — 50問やり直したら、8割だった
Zenn LLM 中級 2026年09月05日 約1分
超小型モデル「K2 Horizon 0.9B」の精度検証記事。1問のみのテストで信頼できると判断したことへの反省から、計算問題50問の再テストを実施。定型処理におけるAIの信頼性を客観的に評価するプロセスの重要性を綴る。
「Ollamaで動く」はずだったK2 Horizon — 16GB GPUで確かめたら、動いたのはvLLMだけだった
Zenn LLM 中級 2026年09月05日 約1分
2026年9月公開のオープンモデル「K2 Horizon」を紹介。0.9Bから375Bまでの6サイズ展開に加え、学習データやコードの公開など透明性の高さが特徴。ベンチマークの自己減点など、異例の誠実な姿勢について解説。
DBクライアントのAI補助を、なぜローカルLLMでも動かせるようにしたのか
Zenn LLM 上級 2026年09月05日 約1分
OSS「LibreDB Studio」におけるローカルLLM活用の意図を解説。クラウドLLMだけでなくローカルLLMをサポートすることで、DBクライアントのAI補助機能をいかに強化しているか、開発チームの設計思想を掘り下げる。
レナード・シェルビーとChatGPTの奇妙な共通点:2000年の映画「メメント」が予言していたLLMアーキテクチャ
Zenn LLM 上級 2026年09月05日 約1分
映画『メメント』の主人公と現代のLLMアーキテクチャの類似性を探る考察記事。長期記憶を形成できない主人公の性質を例えに、AIの記憶モデルやコンテキスト保持の限界について哲学的な視点からアプローチする。
AIの回答内容を比較させるサービス「Arena」
Zenn LLM 入門 2026年09月05日 約1分
LLMモデルごとの回答を比較できるサービス「Arena」の紹介。主にモデル同士を競わせて性能を比較する「Battle Mode」を中心に、サービスの基本的な特徴や使い方を備忘録としてまとめる。
memorix入門: 使い方メモ
Zenn AI 上級 2026年09月05日 約1分
memorixは、Gitプロジェクト単位のlocal-first記憶レイヤーです。SQLiteを正本とし、MCP経由でLLMが操作することで、検索や推論を効率化する仕組みを解説。
セルフホストAIを 7 か月運用して壊れた 4 か所を、公開している変更履歴からそのまま書く
Zenn LLM 上級 2026年09月05日 約1分
自社開発のAIワークスペースにおける開発ログとトラブルシューティングの記録。Docker環境でMac miniをサーバーとして運用する構成の中での、公開された変更履歴に基づく4つの障害事例とその対応策について振り返る。
title: "個人開発でクイズ学習アプリを作ったら、想像以上に学びが多かった話"
Zenn AI 入門 2026年09月05日 約1分
個人開発でクイズ学習アプリ「Minguella Quiz」をフルスクラッチ開発した経験談。ReactやPWAを採用し、開発プロセスそのものが最大の学習になった経緯。
AIエージェントの評価を実装する:本番ドリフトを検出するEvals設計
Zenn AI 上級 2026年09月05日 約1分
AIエージェントの評価を「実行トレース・生成品質・本番挙動」の3層に分解する手法を提案。精度低下の原因を特定するための評価設計と境界線について解説する。
17MBのコード生成SLMを自作して実測した — 語彙サイズと、プロンプト形式の落とし穴
Zenn LLM 上級 2026年09月05日 約1分
JavaScriptコード生成に特化した超軽量言語モデル(SLM)開発の記録。約2,700万パラメータのモデル作成から、llama-cpp-pythonを用いた測定結果まで、成功だけでなく失敗や落とし穴を含めた具体的な実験レポート。
GPT-6 Astraを業務に組み込むなら、モデルと実行環境をどう分けて考えるか
Zenn AI 上級 2026年09月05日 約1分
GPT-6 Astraの能力を業務に組み込む際、モデルと実行環境の役割分担をどう設計するか。公式仕様や報告事例から6つの特徴と業務フローへの影響を考察。
みんな憧れるようなサイトを作ってみたはなし
Zenn AI 中級 2026年09月05日 約1分
IDE「Mozkey」と「shadcn/ui」を用いて個人サイトを制作した体験談。AIを活用してUIを実装・調整し、引き算の設計で洗練させるプロセスを紹介。
Google VidsがPDFやDocsから動画要約を自動生成する機能を追加
Zenn AI 中級 2026年09月05日 約1分
Google Vidsに新機能が追加。ドキュメントを読み込ませるだけで自動要約動画を生成可能に。長大な文書を短時間で共有するワークフローの効率化手法を解説。
Claude Code autoモード設定完全版——分類器は残し、Bash書き込みだけ外す
Zenn AI 上級 2026年09月05日 約1分
AIエージェントの「許可疲れ」を解消する運用マトリクスとsettings.json設定を公開。Bash書き込みを最適化し、2026年9月の最新仕様に対応した設定術。
生成AIは「初期条件の最適化」から「生成軌道の設計」へ
Zenn AI 中級 2026年09月05日 約1分
生成AI活用において、完璧なプロンプトの追求だけでなく、長時間・多段階の生成プロセスにおける確率的性質の理解と管理が重要であることを解説する。