国内AIニュース

RAGの「関連度が高い文書」は本当に役立つ?検索エージェントで因果検証
Zenn LLM 上級 2026年07月20日 約1分
RAGにおいて質問と無関係に見える「橋渡し文書」の重要性を論じる。検索エージェントが正解へ至るために不可欠な文書を見落とす現状と、論文「Bridge Evidence」に基づく対策を解説する。
生成AIは調査レポートを引用する?Optyino.aiがAI回答9,715件を分析、導入判断では引用率21.8%
ASCII.jp 中級 2026年07月20日 約1分
Optyino.aiは、生成AIによる回答9,715件を分析し、調査レポートの引用率が21.8%であることを明らかにしました。導入検討時の判断基準としての実態を検証しています。
Fableでゴミが生まれた日
Zenn LLM 中級 2026年07月20日 約1分
高性能モデル「Claude Fable 5」が、高い能力を持ちながらも現場導入で混乱を引き起こした事例を紹介。AIが生成するコードや成果物が期待と異なり、組織に与える影響と人間側の指示の重要性を語る。
大阪産業局主催セミナー「AI×自動運転の社会実装最前線」でVML代表の山下が講師を務めます
ASCII.jp 入門 2026年07月20日 約1分
大阪産業局主催のセミナー「AI×自動運転の社会実装最前線」に、VML代表の山下氏が講師として登壇することが決定しました。
Netflixが950億円でベン・アフレックのAI映画制作スタートアップ「InterPositive」を買収したことが明らかに
GIGAZINE 入門 2026年07月20日 約1分
Netflixが、ベン・アフレック氏らが共同設立したAI映画制作スタートアップ「InterPositive」を、総額5億8700万ドル(約950億円)で買収しました。
BIRD:ブートストラップ自己蒸留で推論CoTを64%圧縮・精度も向上
Zenn LLM 上級 2026年07月20日 約1分
大規模推論モデルの冗長なCoTを圧縮する技術「BIRD」の解説。二段階のパイプラインを用いることで、推論精度を維持しつつCoTを64%削減し、推論の効率化と軽量化を実現する手法です。
ローカルLLMにテトリスを作らせたら54秒で一発動作した話(Gemma 4 MTP × Claude Code)
Zenn LLM 中級 2026年07月20日 約1分
ローカル環境で「Gemma 4 26B(MTP版)」と「Claude Code」を連携させ、テトリス作成を検証。llama.cpp環境下で、わずか54秒でバグのないテトリスを完成させた実証レポート。
Claude CodeはOpenRouterで動かすべき?Windowsでの環境構築とハマり道回避ガイド
Zenn LLM 中級 2026年07月20日 約1分
Windows環境でClaude Codeの接続先をOpenRouterに変更する方法を解説。API設定の柔軟性を高め、OpenRouterのクレジットを活用してCLIエージェントを効率的に運用するためのステップを紹介。
Claudeの「日本語は率直+0.08σ」、出典を確認して実際に試してみた
Zenn LLM 入門 2026年07月20日 約1分
Anthropicの研究論文に基づき、言語によってClaudeの性格が変化する現象について考察。日本語プロファイルにおける従順さや温かさなどの数値的特性を紹介し、AIの言語間バイアスを解説する。
エージェントで膨らむKVキャッシュを、prefixキャッシュを壊さず刈るIntentKV
Zenn LLM 上級 2026年07月20日 約1分
エージェント運用におけるKVキャッシュのボトルネックを解説。過去のトークンを保持するキャッシュの肥大化がシステムパフォーマンスに与える影響と、運用上の課題を技術的視点から整理した解説。
Hugging FaceにAI主導のサイバー攻撃 防御もAIで対抗するも、商用モデルは解析拒否で「GLM」採用
ITmedia AI+ 中級 2026年07月20日 約1分
Hugging Faceは、自律型AIエージェントによる本番インフラへの不正侵入を検知・対処しました。一部の資格情報やデータセットにアクセスされた可能性があり、ログ解析にはオープンウェイトモデル「GLM 5.2」を自社環境で実行して対応しました。
AI が自分より速くて正確になったとき、人間の判断はどこに残るのか
Zenn LLM 中級 2026年07月20日 約1分
AIに開発を任せる際の「人による設計介入」の重要性を説く。AIをヒント役として活用し、コアな設計判断を人間が行うことで学習効果と品質を高める、個人開発でのAIとの協働プロセスを振り返る。
生成AIが引用する旅行サイトの72.93%は予約対応サイト。Optyino.aiがAI回答4,624件を分析
ASCII.jp 中級 2026年07月20日 約1分
Optyino.aiの分析によると、生成AIが旅行に関する回答で引用したサイトのうち、72.93%が予約対応サイトであることが判明しました。合計4,624件を分析した結果です。
Claude Code ベストプラクティス実践ガイド(2026年7月版)
Zenn LLM 上級 2026年07月20日 約1分
Claude Codeのベストプラクティスを網羅したガイド。コンテキスト管理から、検証方法、エージェントチームによる並列スケールまで、2026年7月までの最新アップデートを反映した実践的ノウハウ集。
VRAM 4GBのノートPCでやる、ローカルLLMの限界を見つける旅
Zenn LLM 中級 2026年07月20日 約1分
VRAM 4GBのノートPCでローカルLLM会話環境の構築に挑戦。動画生成に続き、テキストLLMでも「工夫すれば動かせる」限界を検証したレポート。Ollama環境での動作検証プロセスを紹介。
AIによる視覚QAに「事前確率」を持たせる — 過去の違反履歴から注意の向け先を予測する設計
Zenn LLM 上級 2026年07月20日 約1分
Webツールの視覚QAにおいて、チェックリストを均等に扱う課題を解消する「事前確率に基づいたQA設計」を提案。Markdownベースで実装する経験則を活用した効率的な品質管理手法。
有限リソースにおける自律型AIエージェント構築 ― プロファイリングが導いたデュアルモデル構成と透過型制御プレーン ―
Zenn LLM 上級 2026年07月19日 約1分
VRAM 12GB環境で、役割の異なる2つのMoEモデルを組み合わせた「デュアルMoE構成」の有効性を検証。GemmaとQwenを並行稼働させ、推論速度と安定性を高めるアプローチの実践報告。
16GBのVRAMでGemma 4 26Bを爆速で動かす!llama.cppの新機能「MTP」を徹底検証
Zenn LLM 上級 2026年07月19日 約1分
ローカルLLM「Gemma 2 26B」をVRAM 16GB環境で高速化する方法を解説。新技術「MTP(Multi-Token Prediction)」を活用し、生成速度を約1.43倍(53.8 tok/sから76.8 tok/s)に向上させる具体的な手順と実測データを紹介します。RTX 4060 Ti等の環境でローカルLLMの性能を最大化したいユーザー必見の内容です。
株式会社Shinker、生成AI・AIエージェント・AI検索時代の実務を支援する専門メディア「AI TREND研究所」を正式公開―AIO・LLMO・GEOからAIツール活用まで毎日発信―
ASCII.jp 入門 2026年07月19日 約1分
株式会社Shinkerは、AIエージェントやAI検索の実務を支援する専門メディア「AI TREND研究所」を公開しました。AIO・LLMO・GEOなどの最新動向を発信します。
AIエージェントに良い仕事をさせるシステムプロンプトの書き方
Zenn LLM 中級 2026年07月19日 約1分
AIエージェントの性能を左右するシステムプロンプトの設計原則を解説。単なるチャットボットを超え、目標達成のために自律行動するエージェントを構築する際、役割と行動範囲を明確にするなど、実開発の知見に基づく4つの重要原則を紹介します。精度の高いエージェント開発を目指す開発者向けの実践的ガイドです。