国内AIニュース
Claude Codeを用いた記事執筆の運用記録。5ヶ月間でルールファイルが5セクションから23セクションへ拡大し、運用を通じて品質チェックの指摘が抽象化・蓄積された。設計段階の工夫と品質向上サイクルの仕組みを詳解。
GitHub Copilotとの対話を通じてDI(依存性の注入)の是非を議論したログ。DIを「不十分な部品」と定義し、実際に成功したプロジェクトの存在を疑う視点から、ソフトウェア工学におけるDIの真の価値について思考を深める。
Claude Codeを使用してスイカゲームを自動化し、モデルJevにプレイさせた実験記録。Jevの特性を活かし、プロンプトの工夫でスコアを向上させた過程と結果を解説。
AIの論理能力と物理的制御の相性が悪い理由を「接合の壁」として解説。欧州の規範や各地の制約がAI導入を阻む現状を指摘し、ハードウェアとソフトウェアの乖離を解き明かす。
Difyチャットボットでの質問分類器置き換え検証記録。判断特化モデルJevを使用し、分類器の評価手法の重要性に焦点を当てる。生の質問と本番入力での精度の違いや、最適なモデル選定の難しさを考察。
判断特化モデルJevをDifyチャットボットに導入し、利用者の法人の種類を固定する運用を検証。52会話の評価で誤判定を半減させることに成功。Jevの特性である選択確率の返却と、実務導入の過程を報告。
AIの返答を別のAIでチェックする仕組みを、英語学習アプリから外した事例。誤判定により問題ない回答まで排除していたことが判明。AIの出力確認に関する実効性と、過剰な安全策の弊害について検証。
Opus 5.5によるワンショットでの3Dモデル生成事例。ドイツ/ボヘミア様式の城を、既製アセットを使用せず、詳細なプロンプトのみで作成した結果を動画と併せて紹介。
1920年に発明された世界初の電子楽器「テルミン」は、空間中の手の位置で音を操るのが特徴です。このテルミンをPCやスマートフォンのカメラを使用して、非接触で演奏できるように再現した「Air Theremin」について紹介します。
Hermes Agentなどのエージェント開発における頻繁な依存関係アップデートの課題を指摘。browser-use等のライブラリの破壊的変更に対し、LLMに自律的なメンテナンスを行わせる必要性を提言。
TypeSafe System One APIを活用し、エージェント内で判断処理を組み込む手法を紹介。CIの自動修復やリトライ処理における分岐判定の実装例と、最新モデルjev-1.13.0による検証結果を報告。
メール返信や定期的な情報収集など、繰り返しの業務を効率化するサービス「Geta.Team」が公開されました。各AIエージェントに名前、役職、連絡先を割り当て、人間の従業員のように業務を任せることが可能です。
32GBメモリ搭載Macでのコーディング用途ローカルLLMベンチマーク記事です。公開データではなく、独自の実装タスクを通じてツール使用能力と限界を実測評価しています。
AIエージェントによる自動化が進む中、攻撃側もAIを活用し侵入時間を短縮しています。従来の静的な権限管理や人間による承認といった前提は通用しません。NISTの提言や脅威事例を基に、AI時代の新たなセキュリティ防御策を解説します。
Claude Codeユーザーの間で囁かれる「モデルの鈍化」についての考察記事。原因はモデルそのものではなく、推論の質や思考プロセスを制御する「推論レジーム」の変化にあるのではないかと分析しています。
Anthropicが発表したClaude Opus 5.5の「40%安く使える」という表現の真相を解説。値下げ分だけでなく、トークン効率の向上による全体のコスト削減効果を詳細に分析しています。
ElectronベースのスタンドアロンAIコーディングエージェントIDE「Forger」を紹介。VS Codeの拡張やフォークではなく、エージェントループを内蔵し、自律的なファイル操作と安全な承認プロセスを備えた独立アプリです。
AIが資料の内容を見落とす原因を「作業机の広さ」という比喩で解説。コンテキストウィンドウの概念と、回答の正確性を高めるためにAIへ渡す情報の扱い方を、専門用語を使わずに分かりやすく紐解きます。
モデルリーダーボード「OrcaRouter」が更新され、OpenAIの「GPT-5.4 Pro」が総合1位を獲得しました。AIモデルの最新ランキングや性能指標に関する短い速報です。
TypeSafe AIの「Jev」を活用し、X上の指定作品のネタバレを自動判定して警告を表示するChrome拡張機能の作成事例。高い精度の判別能力と実装の背景を紹介します。