国内AIニュース

AIに記事を書かせるムラは「書く前」で決まっていた——Claude Codeの品質設計4段階と、5ヶ月で23個に育った差し戻しルール
Zenn AI 上級 15時間前 約1分
Claude Codeを用いた記事執筆の運用記録。5ヶ月間でルールファイルが5セクションから23セクションへ拡大し、運用を通じて品質チェックの指摘が抽象化・蓄積された。設計段階の工夫と品質向上サイクルの仕組みを詳解。
DIを肴にくだをまいてたら教育論になった
Zenn AI 中級 15時間前 約1分
GitHub Copilotとの対話を通じてDI(依存性の注入)の是非を議論したログ。DIを「不十分な部品」と定義し、実際に成功したプロジェクトの存在を疑う視点から、ソフトウェア工学におけるDIの真の価値について思考を深める。
「どこに落とす?」とは聞かない。Jevに落とした後の盤面を評価させてスイカゲームを解く
Zenn AI 中級 15時間前 約1分
Claude Codeを使用してスイカゲームを自動化し、モデルJevにプレイさせた実験記録。Jevの特性を活かし、プロンプトの工夫でスコアを向上させた過程と結果を解説。
「知覚連鎖:現在のAIが抱える致命的な欠落」の原点(第2回/全4回)
Zenn AI 上級 15時間前 約1分
AIの論理能力と物理的制御の相性が悪い理由を「接合の壁」として解説。欧州の規範や各地の制約がAI導入を阻む現状を指摘し、ハードウェアとソフトウェアの乖離を解き明かす。
質問分類器の評価を本番の入力で測り直したら定義の順位が入れ替わった――gpt-5.4-nano と Jev の比較で見つけた評価の穴
Zenn LLM 上級 15時間前 約1分
Difyチャットボットでの質問分類器置き換え検証記録。判断特化モデルJevを使用し、分類器の評価手法の重要性に焦点を当てる。生の質問と本番入力での精度の違いや、最適なモデル選定の難しさを考察。
判断特化モデル Jev を Dify のチャットボットに入れた――質問の分類ではなく法人種別の判定を任せた理由
Zenn LLM 上級 15時間前 約1分
判断特化モデルJevをDifyチャットボットに導入し、利用者の法人の種類を固定する運用を検証。52会話の評価で誤判定を半減させることに成功。Jevの特性である選択確率の返却と、実務導入の過程を報告。
AIの出力をAIでチェックしたら、はじいた12件のうち11件が間違いだった
Zenn LLM 中級 16時間前 約1分
AIの返答を別のAIでチェックする仕組みを、英語学習アプリから外した事例。誤判定により問題ない回答まで排除していたことが判明。AIの出力確認に関する実効性と、過剰な安全策の弊害について検証。
Opus 5.5 の並外れた 3D モデリング能力で理想の城を作る
Zenn LLM 入門 16時間前 約1分
Opus 5.5によるワンショットでの3Dモデル生成事例。ドイツ/ボヘミア様式の城を、既製アセットを使用せず、詳細なプロンプトのみで作成した結果を動画と併せて紹介。
ウェブカメラに向かって手を振って演奏できる「エア・テルミン」
GIGAZINE 入門 16時間前 約1分
1920年に発明された世界初の電子楽器「テルミン」は、空間中の手の位置で音を操るのが特徴です。このテルミンをPCやスマートフォンのカメラを使用して、非接触で演奏できるように再現した「Air Theremin」について紹介します。
hermes agentはアップデートが多すぎるので定期的なメンテナンスをLLMにやらせるべき
Zenn LLM 上級 16時間前 約1分
Hermes Agentなどのエージェント開発における頻繁な依存関係アップデートの課題を指摘。browser-use等のライブラリの破壊的変更に対し、LLMに自律的なメンテナンスを行わせる必要性を提言。
Jevが返すconfidenceの意味〜Jevの応答を受けてループエンジニアリングでどう捌くか〜(実例つき)
Zenn LLM 上級 17時間前 約1分
TypeSafe System One APIを活用し、エージェント内で判断処理を組み込む手法を紹介。CIの自動修復やリトライ処理における分岐判定の実装例と、最新モデルjev-1.13.0による検証結果を報告。
AI従業員を雇って定型作業をお任せできる「Geta.Team」、各AI従業員に個別にメールアドレス・電話番号を割り当てできてセルフホスト可能、機能限定の無料版もあり
GIGAZINE 入門 18時間前 約1分
メール返信や定期的な情報収集など、繰り返しの業務を効率化するサービス「Geta.Team」が公開されました。各AIエージェントに名前、役職、連絡先を割り当て、人間の従業員のように業務を任せることが可能です。
MacBook Air M5 RAM32GBで実用的なローカルLLMを探す 品質測定編 2026/09版
Zenn LLM 上級 19時間前 約1分
32GBメモリ搭載Macでのコーディング用途ローカルLLMベンチマーク記事です。公開データではなく、独自の実装タスクを通じてツール使用能力と限界を実測評価しています。
「ヒューマン・イン・ザ・ループ万能説」崩壊 AIエージェント時代に企業が迫られる“防御の再設計”
ITmedia AIビジネス 上級 19時間前 約1分
AIエージェントによる自動化が進む中、攻撃側もAIを活用し侵入時間を短縮しています。従来の静的な権限管理や人間による承認といった前提は通用しません。NISTの提言や脅威事例を基に、AI時代の新たなセキュリティ防御策を解説します。
あなたが呼んでいるのはモデルではなく"推論レジーム"だ ── 同じIDの裏で痩せる思考
Zenn LLM 上級 19時間前 約1分
Claude Codeユーザーの間で囁かれる「モデルの鈍化」についての考察記事。原因はモデルそのものではなく、推論の質や思考プロセスを制御する「推論レジーム」の変化にあるのではないかと分析しています。
Claude Opus 5.5の「4割安」は単価じゃなかった。あなたの請求が本当に下がるかを公式発表から読み解いた
Zenn LLM 中級 19時間前 約1分
Anthropicが発表したClaude Opus 5.5の「40%安く使える」という表現の真相を解説。値下げ分だけでなく、トークン効率の向上による全体のコスト削減効果を詳細に分析しています。
無料・BYOK・完全オフライン対応の AI コーディングエージェント IDE「Forger」を作りました
Zenn LLM 中級 20時間前 約1分
ElectronベースのスタンドアロンAIコーディングエージェントIDE「Forger」を紹介。VS Codeの拡張やフォークではなく、エージェントループを内蔵し、自律的なファイル操作と安全な承認プロセスを備えた独立アプリです。
コンテキストウィンドウ入門:資料をたくさん渡せばAIは賢くなる?
Zenn LLM 入門 20時間前 約1分
AIが資料の内容を見落とす原因を「作業机の広さ」という比喩で解説。コンテキストウィンドウの概念と、回答の正確性を高めるためにAIへ渡す情報の扱い方を、専門用語を使わずに分かりやすく紐解きます。
OrcaRouter、モデルリーダーボードを更新 - OpenAIの「GPT-5.4 Pro」が総合1位
ASCII.jp 入門 20時間前 約1分
モデルリーダーボード「OrcaRouter」が更新され、OpenAIの「GPT-5.4 Pro」が総合1位を獲得しました。AIモデルの最新ランキングや性能指標に関する短い速報です。
Jevでネタバレ防止用のChrome拡張を開発してみた(ミュートワードでは防げないネタバレをブロックするアドオン)
Zenn LLM 中級 20時間前 約1分
TypeSafe AIの「Jev」を活用し、X上の指定作品のネタバレを自動判定して警告を表示するChrome拡張機能の作成事例。高い精度の判別能力と実装の背景を紹介します。