国内AIニュース

AIレビューから「良い点も挙げる」を捨てた ── 敵対的検証を全レビューに統一した結果
Zenn AI 上級 4日前 約1分
AIの無難なコードレビューを廃止し、あえて攻撃的に改善点を指摘させる「敵対的検証」への移行事例。実務でバグを発見した手法とそのルールを解説。
小規模サイトでA/Bテストを提案されたAIが「やらない」と答えた話
Zenn AI 中級 4日前 約1分
Next.jsとNotionを組み合わせたHPのA/BテストをAIエージェントに設計依頼。結果は「実施不可」だったが、その判断根拠が極めて論理的だったという学びの記録。
セキュリティ事故分析「JetBrains悪性AIプラグイン事件」と非保持型権限委譲
Zenn AI 上級 4日前 約1分
JetBrainsのプラグイン事件を例に、セキュリティ対策における非保持型権限委譲の適用を考察する技術解説記事。
AIが提案したデッキ改造案を、家のPCで3000回対戦させて検証したら棄却された
Zenn LLM 中級 4日前 約1分
MtGの自作デッキの勝率検証をAIを用いて実行した記録。9000戦のシミュレーションとClaudeによるデッキ改造案の検証プロセスを紹介。AIの提案を実測で検証した結果、勝率マイナス6.6ポイントという驚きの顛末を記す。
Knowledge Graphの次は何か?『知識表現』をAI自身に設計させるという思考実験
Zenn AI 上級 4日前 約1分
Knowledge Graphを知識の表現として再考する思考実験記事。GitHubリポジトリを分解して自分専用の教材を作る試みから、知識の最適な形を探る。
60年前に「死んだサンゴ礁」と判断された海域で豊かなサンゴ生態系が発見される
GIGAZINE 入門 4日前 約1分
ベナン沖の死滅したとされたサンゴ礁が、最新技術を用いた再調査により豊かな生態系が残っていることが判明しました。
【Claude Opus 5】ベストプラクティスをルール25本に当てたら、穴が3つ出た
Zenn AI 中級 4日前 約1分
AIエージェントへの指示資産を棚卸しした結果、公式推奨に従って削除するのではなく、不足していた制御用ルールが見つかった実体験レポート。
max_tokensを上げたら悪化した: DeepSeek V4 Flash (MLX) が「コードを書こう」と785回言い続けた
Zenn LLM 上級 4日前 約1分
ローカルLLMでmax_tokens上限を引き上げた際に発生する、コード生成の反復ループ問題を実測データを交えて解説。オセロ、はさみ将棋、墨流しアート実装時の挙動の差を比較し、モデルの挙動を検証する。
執事とメイドを雇ったら、AIエージェントが暴走しなくなった話
Zenn AI 中級 4日前 約1分
Claude Codeを用いたマルチエージェント運用で「執事とメイド」という世界観を導入。5ヶ月で265件のタスクをこなした運用事例とインターフェース層としての活用法。
[Agents on 16GB] 状態の分離をあきらめた。サブエージェントはそれで動くようになった
Zenn LLM 上級 4日前 約1分
16GBのMacBookでAPI利用ゼロのマルチエージェントを構築する手法。PMオーケストレーターと専門サブエージェント構成で、ローカルLLMを活用したメモリ効率の良い開発環境の構築記。
打ち合わせの録音を置くだけで議事録にする仕組みを作った
Zenn AI 中級 4日前 約1分
会議の録音データから、話者分離や議事録生成までを自動化する仕組みをClaude Codeスキルで構築した製造業エンジニアの挑戦記録。
Perplexity.ai で調査結果のダッシュボードを共有したりplan modeを使う
Zenn AI 入門 4日前 約1分
Perplexityの調査系機能に加え、調査結果を静的サイト化する機能や、ChatGPT/ClaudeのようなSkill/Plan Modeが搭載されたことを紹介。無料プランで使える機能を中心に解説します。
『ドカ食いダイスキ!もちづきさん』TVアニメ化決定、「限界突破の禁断グルメギャグ」が背徳感&爽快感とともにアニメに
GIGAZINE 入門 4日前 約1分
大量のカロリー摂取で話題を呼ぶ漫画『ドカ食いダイスキ!もちづきさん』のTVアニメ化が決定しました。
Codexにコミット前のレビューを1回頼む ― codex review で未コミットの変更を見てもらう最初の一歩
Zenn AI 入門 4日前 約1分
OpenAIのコーディング用エージェント「Codex」を用いたコードレビュー手法を解説。10分で環境を構築し、未コミットの変更を自動レビューするまでの手順をステップバイステップで説明します。
Perplexity風のエージェントを個人開発アプリに組み込んだ——設計の工夫と課題点
Zenn AI 上級 4日前 約1分
個人開発アプリ『Vector』に、Perplexity風のQ&Aエージェントを組み込んだ事例。AI分析とウェブ検索を統合した設計手法や、開発で得られた知見と課題をソースコードとともに公開します。
個人開発のAI Bot、全部同じモデルに投げていませんか? ——実測で分かった、安いモデルほど遅かった話
Zenn LLM 中級 4日前 約1分
Cloudflare Workers AIでモデルを使い分ける際のレイテンシ検証結果。軽量タスクに小型モデルを割り当てても、単価と処理速度が比例しない実情を解説。最適化には計測が不可欠であることを説く。
AIとスマートフォンの「セカンドライフ」
Zenn AI 入門 4日前 約1分
中古スマートフォン市場でAIによる品質判定が主流になりつつある現状を解説。従来の目視検査からAI導入へ移行することで、リファービッシュ端末の信頼性が向上している背景を伝えます。
AIエージェントの実運用
Zenn AI 中級 4日前 約1分
社内サーバーにAIエージェントを常駐させ、定型業務を自動化するシステム構成を紹介。具体的な設計判断や、運用中に発生したトラブル・ハマりポイントを詳しく解説します。
エンジニアをAIに置き換える、残りの二割
Zenn AI 中級 4日前 約1分
AIが生成・レビューしたコードで発生したStripe返金処理のバグ事例を紹介。テストは通過しても実機で初めて発覚する欠陥があることを示し、AI依存のリスクと検証の重要性を訴えます。
Hy3 T512をM3 Ultra 512GBで実測: 短文1本でピーク242GB、KV8は逆効果だった
Zenn LLM 上級 4日前 約1分
M3 Ultra / 512GB MacでHy3モデルをローカル実行した検証記録。59Kトークンの入力に対するneedle retrievalの成功可否、ピークメモリ消費量、生成速度などを実測データで報告する。