国内AIニュース

話題のStagehand v4 + Jevを調べた。Playwrightの代替ではなく「壊れやすいWeb自動化」を任せるのが良さそう
Zenn AI 中級 1日前 約1分
Stagehand v4とJevの組み合わせを調査。Playwrightの代替ではなく、UI変更で壊れやすい反復的なブラウザ操作を自動化するのに適していると結論づけ、適材適所の使い分けを提案する。
CLAUDE.mdに書く直前の、根拠1行の検査のすすめ
Zenn AI 中級 1日前 約1分
AIエージェントの指示ファイルで発生しがちな「過剰一般化」を防ぐ方法を解説。書く直前に根拠を添える検査と、視点を変えた並列レビューを導入し、AIの主張を客観的に管理する手法を共有する。
Jevで口笛を分類してMacを操作する「Whistle」を作りました
Zenn AI 入門 1日前 約1分
口笛でMacを操作するツール「Whistle」の紹介。Jev推論モデルを活用し、音程とリズムを数値化してアプリやショートカットを起動できる。音声データはAPI送信せず安全に利用可能。
AI 研究エージェントを自律化するには評価ループを閉じる必要がある
Zenn LLM 上級 1日前 約1分
AIエージェントによる研究自動化において、タスクの実行と評価プロセスの違いを解説。評価結果を次の仮説や実験設計にフィードバックするループの重要性に焦点を当てた設計論。
Obsidian×AIエージェントで「第二の脳」を作る──MCPの正体とプロンプト・スキルの境界線
Zenn LLM 入門 1日前 約1分
Obsidianを「第二の脳」として構築する際の技術的な混乱を解消するガイド。LLMエージェントを活用してメモを知識化する方法や、専門用語に悩む初心者に向けた整理案。
7 体の AI に別々の秘密を持たせる:Cloudflare Durable Objects で作るマルチエージェント人狼
Zenn LLM 上級 1日前 約1分
Cloudflare WorkersとDurable Objectsを活用した「AI人狼」の実装解説。7体のエージェント間で秘密情報を保持し、ゲームの整合性を保ちながら進行させる技術的な裏側。
FlashAttentionのIO-aware設計と実装上の確認点
Zenn LLM 上級 1日前 約1分
FlashAttentionの実装者向け解説記事。APIの呼び出しだけでなく、GPUやdtype、shapeなどの条件下で発生するfallbackを回避し、効率的なメモリ管理とonline softmaxを実現する方法。
Claude Code を終了するとき、1回だけ立ち止まらせる
Zenn AI 中級 1日前 約1分
Claude Codeでの開発時に、セッションをまたいで文脈を自動継承する仕組みを解説。カスタムフックを活用し、手動での再説明や方針のブレを防ぎ、スムーズな開発体験を実現する手法を紹介。
なぜAIのセルフレビューはすり抜けるのか。完了条件の1行で変える
Zenn LLM 中級 1日前 約1分
Claude Codeを用いた個人開発でのガードレール実装と、サブエージェントによる点検の記録。点検プロンプトの改善により、AIの自律的な安全管理がいかに向上したかを振り返る。
pdlc-skills を実際のプロジェクトで回してみる:三つの機能を並行させてリリースまで
Zenn AI 上級 1日前 約1分
PDLCモデルを実際のコンソールプロジェクトに導入した後の実践記。機能分割、人とAIの役割分担、ループエンジンの実運用、品質管理など、導入後に直面する6つの問いに対する具体的な回答をまとめる。
Kimi K3のPrompt Cacheを実測 — GPT-5.6向けの設定はそのまま使える
Zenn LLM 中級 1日前 約1分
LLMのPrompt Cacheを利用する際、HTTP 200だけではキャッシュのヒット/ミスを判定できない問題に対する解決策。usage内の詳細トークン数を用いた正確な判定方法を解説。
AIに「完成しました」と言わせない — Figma実装を画素で採点する仕組みを作った
Zenn AI 上級 1日前 約1分
AIによる実装の完成判定をAI自身に任せず、決定論的な画像比較ハーネスを導入した実測事例。AIの自己申告に頼らない品質管理により、実案件での実装精度向上と判定の客観性を実現した過程を報告。
AIが、頼んでいないメールを書いてきた — 記憶を見える形で貯めた4ヶ月
Zenn AI 中級 1日前 約1分
AIが指示していないにもかかわらず、作業完了を察知して完璧な納品メールの下書きを作成した事例を紹介。AIが文脈を理解し、主体的に先回りしたアウトプットを出すための条件と背景を考察。
みんパチ・スロサミの壊れにくい物販を考えみた
Zenn AI 入門 1日前 約1分
イベント会場でのスマートオーダー不具合を受け、待ち時間を解消する改善案を提示。順番待ちのストレスを軽減し、並ばずに安心して待機できる物販システムの仕様やUX設計のアイデアをまとめる。
Jevはサイコロを振らないがローカルLLMは振れるのか?|「較正された確率」の検証
Zenn AI 上級 1日前 約1分
Jevモデルの確率較正の限界とローカルモデルQwen3.5-4Bとの比較検証。サイコロ問題を通じ、AIが持つ確信度のバイアスやフロア効果、知識タスクにおけるメタ認知の精度について分析結果を共有。
TypeSafe AI の jev を Python で一通り試した (使い方と 10 の実験)
Zenn AI 入門 1日前 約1分
TypeSafe AIの「jev」モデルをPython SDKで操作する方法を解説。セットアップから数値の取得、公式ドキュメントにない応用例まで、実際のコード例を用いてjevの基本的な使い方を網羅的にまとめる。
みんなJevの話してる。やってないの俺だけ
Zenn AI 入門 1日前 約1分
2026年9月に突如話題となったAIモデル「Jev」について、その概要と注目される理由を整理。LLMと比較した性能や、開発元の公称値、現時点での入手困難な状況を解説した入門用まとめ記事。
失注理由は「価格」ではなかった — 20件のログを3つの型に分けたら、次の一手が見えた
Zenn AI 中級 1日前 約1分
営業案件の失注理由「価格」を鵜呑みにせず、本質的な原因を突き止める方法を解説。AIと表計算ソフトを活用し、顧客とのやり取りを整理して真の失注理由を分析する具体的な手順を紹介する。
CBN 取扱説明書 第 5 章 — コーディングをバイブで終わらせないために
Zenn AI 中級 1日前 約1分
2025年に広まった「バイブコーディング(vibe coding)」の実態とリスクを解説。AIにコードを任せて動けばよしとする手法の弊害である「可読性」と「再現性の欠如」という課題に焦点を当てる。