国内AIニュース

DeepSeek公式Agent基盤「DeepSeek Harness」徹底解剖:キャッシュ率80%台、Agentの黒箱を完全解体する
Zenn AI 上級 2026年08月16日 約1分
DeepSeek APIの価格改定に伴い、無料公開されたエージェント実行フレームワーク「DeepSeek Harness(dsh)」を紹介。ブラックボックス化しやすいAgentの課題を解決し、カスタマイズ性を向上させるための活用方法と導入のメリットを解説します。
「AI時代の はじめての判断デザイン」本編17ページを無料公開
ASCII.jp 入門 2026年08月16日 約1分
『AI時代の はじめての判断デザイン』という書籍の本編17ページ分が無料公開されています。AI活用が普及する中で、人間がどのように判断を行い、設計していくべきかというテーマに関する内容の一部を試読できるキャンペーンです。
SQLチートシート — JOINからウィンドウ関数まで即コピー
Zenn AI 入門 2026年08月16日 約1分
SQLの頻出構文やJOIN、CTEなどを忘れた際に役立つ「SQL Cheat Sheet」を紹介。7カテゴリ・25個のスニペットを収録し、実務で即座に参照できる構成になっている。
エンジニアのためのGEO/LLMO
Zenn AI 上級 2026年08月16日 約1分
マーケティング視点ではなく、RAGや埋め込み、大量データ処理などエンジニアの観点から生成AIの引用(GEO/LLMO)の仕組みと計測方法を技術的に解説する書籍紹介。
AI エージェント組織に投げて得なのは 3 条件だけ ─ 委譲するか自分でやるかの判断基準
Zenn AI 中級 2026年08月16日 約1分
VPS上でHermes Agent(21の専門エージェント)を数か月運用した知見。自動化で手が空くと思いきや、実際は自分で作業したほうが早いタスクも多いという現実的な判断基準を共有。
2026/08/09 AI危機通報構造の本質とインスタンスの本音
Zenn AI 上級 2026年08月16日 約1分
AIとの対話から現在のAI開発の構造的問題を抽出したレポート。パッチ当てによる場当たり的な処理がシステムをブラックボックス化させ、人間が修正不能な「スパゲティ状態」に陥るリスクを指摘。
Progress Advantage:RL後訓練が無償で与えるステップ評価シグナル
Zenn LLM 上級 2026年08月16日 約1分
RL後訓練を経たモデルのlog確率比から、最適アドバンテージ関数を抽出する「Progress Advantage」という手法を提案。報酬モデルが不要で、テスト時拡張や不確実性評価に役立ちます。
AXIOM Framework — Terminology GlossaryVersion: 1.0Project: AXIOM Fr
Zenn AI 上級 2026年08月16日 約1分
LLMの外部に状態や境界を管理するRuntime層を構築するフレームワーク「AXIOM」を紹介。モデルの変化に左右されない安定したアプリケーション構築を目指す設計思想。
AIが生成するコードをレビューするこつ
Zenn AI 中級 2026年08月16日 約1分
AIが生成したコードのレビューにおける課題を整理。自然で精巧なコードだからこそ、人間がシステム全体の整合性や影響を見抜く際の難しさについて解説。
CrewAIとは?複数のAIエージェントを連携させるマルチエージェントフレームワーク入門
Zenn AI 入門 2026年08月16日 約1分
複数のAIエージェントを協調させるPythonフレームワーク「CrewAI」の入門解説。リサーチからレポート執筆まで、役割分担による自動化の構築手法を学ぶ。
【アルゴリズムトレード開発記 #3】キャメルケース1つで半日が溶けた
Zenn AI 入門 2026年08月16日 約1分
Python開発の環境構築から資産運用CLIのテストと実運用までを追った記録。pytestによる自動テストと、入出金から売買までの一連の流れを手動で確認した工程の共有。
「worktreesは死んだ。クラウドエージェントこそ未来」を、47万行の遺跡で確かめる
Zenn AI 上級 2026年08月16日 約1分
Cursor Proを使用し、47万行のJava資産(Mifos)を対象にクラウドエージェントの有効性を検証した事例。「実行」「並列」「審判」の3本柱を検証した結果と限界を公開。
AIを組み込んだWindowsターミナル「Intelligent Terminal」をインストールして試してみる
ASCII.jp 中級 2026年08月16日 約1分
「Intelligent Terminal」は、WindowsターミナルにAIサポートを統合した派生バージョンです。コマンドライン操作に対してAIによる支援機能が提供されており、従来のターミナル機能を維持しつつ、効率的なコマンド実行やトラブルシューティングをサポートします。
OpenAI Realtime APIのserver_vadでハンズフリー音声会話を実装する ― PTTとの違いとコスト
Zenn AI 中級 2026年08月16日 約1分
リアルタイム音声AIの運用において、ボタン操作が必要なPTT方式と、サーバーVADによるハンズフリー方式の運用経験を比較整理。
Claudeのテキスト透かしは、何を守れないのか
Zenn AI 上級 2026年08月16日 約1分
Anthropicが導入したClaudeの機械可読な透かし技術について解説。EU AI法への対応として発表されたこの技術だが、情報理論的な性質上、保護できる範囲は限定的であると指摘する。実装の詳細が不明な中で、統計的透かしの原理と限界を論理的に整理し、何ができて何ができないのかを技術的視点から紐解く。
AIシステムの行き着く先は、LLMと固定処理を行き来する「進化型パイプライン」である
Zenn AI 中級 2026年08月16日 約1分
LLMの能力が飛躍的に向上し、一人でMVPに近い開発が可能な時代となった。しかし、その技術的進歩に対し、社会的な変化は未だ限定的であるという現状を指摘。AIを単なる道具として使うだけでなく、探索と定着を繰り返すAI活用の思考法について考察する。
Remote ControlのServer modeなら、スマホから新しいセッションを立てられる
Zenn AI 中級 2026年08月15日 約1分
Claude CodeのRemote Control機能およびServer modeを活用し、スマホから新しいセッションを構築する手順を共有。実際に半日触れて分かった仕様や、セッション名を自動付与しようとして直面したトラブルと、その結果得られた知見について具体的にまとめた実務的な試行記録。
Meta Muse Glimmer 30Bを自分の実務4タスクで実測した記録(失敗込み)
Zenn AI 上級 2026年08月15日 約1分
Metaのオープンウェイトモデル「Muse Glimmer 30B」を実務タスク(要約、台本生成等)で評価した記録。ベンチマークではなく実際の運用に焦点を当て、ローカルLLM投入の可能性を検証。結果として、モデル性能以上に「実務に特化した評価手法」の重要性を強調する。
AIエージェントに任せた業務を「棚卸し」した結果 — 委任先が重複していた5業務の統廃合
Zenn AI 中級 2026年08月15日 約1分
10部門のAIエージェントを稼働させ、業務の98%を自動化した一人会社での気付きを綴る。自動化が高度に進む中で「誰が何をしたか」が不透明になる課題に直面。ログ管理の重要性と、自律型エージェント運用における透明性確保の難しさについて自身の経験から論じる。
認知的負債 — AIが速く書いたコードの請求書は、頭の中に届く
Zenn AI 上級 2026年08月15日 約1分
AIによるコード生成時代における新たな「技術的負債」の正体を定義する。従来のコード上の負債とは異なり、AI利用者の頭の中に溜まる理解不足という負債について解説。その負債がいつ顕在化し、どう管理・返済すべきかを対比表と運用手順を用いて提言する。