国内AIニュース
英語の技術情報を効率的に追うために開発されたサイト「Hacker's Digest」を紹介。HackerNewsの注目記事を概要、考察、コメント要約とともに日本語で提供する仕組みと活用法を解説。
Claude Codeなどのスキル導入効果を「なんとなく」で終わらせないための、自動A/B計測ハーネスの実装方法を解説。隔離環境での機械計測とLLM judgeによる判定ロジックの構築手順。
30日間続いた連載の最終回。架空のシナリオを舞台に、自分自身の困りごとを解決するための小さなアプリを構築する過程を通じて、「誰かにしかできないこと」をほどく術を説く。
AIの普及により誰でも開発ができるようになった一方、社会への影響を判断する責任の重要性を論じる。Winny事件を教訓に、AI時代の技術者倫理と私たちが持つべき視点について考察する。
LLMによるコード生成に最適化されたUIライブラリ「axiom-ui」を紹介。人間向けの複雑なライブラリが抱える「ノイズ」を排除し、AIが正確にコードを生成できる環境を目指す。
Codex利用時に発生しやすい「言葉の定義の曖昧さ」に起因する設計・実装ミスについて解説。要件定義の不整合を防ぎ、AIに正確な意図を伝えるための具体的な対策を提案する。
LiteLLMを活用したマルチプロバイダー運用のベストプラクティスを解説。OpenAIやAnthropic等を統一インターフェースで扱い、フォールバック機能で信頼性を高める方法を紹介。
AI開発プロセスにおける「プロンプト設計の失敗」という落とし穴を整理。Vibe CodingからHarness Engineeringまで、生産性を最大化するためのモデル選定と指示出しのコツを紹介。
遊休資産のGPUを活用し、自分専用の技術ニュース収集botを構築するシリーズ第1回。モチベーションやローカルLLM活用のきっかけ、開発の動機を詳しく紹介する。
レガシーコード移行プロジェクトにおいて、LLMが生成したコードの品質を保証するための評価システム(ハーネス)の設計過程を解説。試行錯誤や失敗から得た知見を共有する。
Mac miniで9ヶ月運用した経験から、AIエージェントの実用性を決めるのはモデルの賢さではなく「記憶設計」にあると断言。Markdownファイルを用いた独自の記憶システムを解説。
障害調査でログをAI解析する際の課題を分析。既知のルールだけでなく、残り15%の「未知の事象」をどう拾い上げるか、という設計思想に焦点を当てる。
Optyino.aiがAI回答1,360件を分析した結果、Google検索で1位を獲得しているサイトの65.6%が、複数の生成AIによって回答のソースとして引用されていることが判明しました。
画面非搭載のスマートバンド「Google Fitbit Air」をレビュー。ハードウェアに画面がない分、重要な役割を果たすiOS/Android対応アプリ「Google Health」の操作性を深掘りします。
スタートアップが避けて通れない反社チェック(コンプライアンスチェック)について解説。資金調達や大手との取引に不可欠なチェックの必要性と、創業期の効率的な進め方を整理する。
おうちラボ構築10年の経験に基づき、初心者におすすめのサービスや構築・管理のポイントを概説。詳細設定ではなく「全体構成」に焦点を当てて情報を共有する。
TypeScriptプロジェクトでLLMにコード修正を依頼する際、型情報を正しく認識できず、推測で誤った修正コードを生成するリスクについて解説。LLMが文脈を誤認するケースを紹介し、TypeScriptの型安全性を維持したままAIを活用するための課題と注意点を提示する。
「プロンプトで読み解くAIエージェント」連載の第9回目。本稿から第2部が開始され、これまでの実行型エージェントとは異なる視点から、実在する3つのAIエージェントOSSを深く読み解く。独自のフレームワークを用いて自作AIエージェントの開発を目指す読者向けの内容。
ブランド可視化ツール「Optyino.ai」が、AIエージェントからダッシュボードデータを直接参照できる「MCP接続」機能を一般公開しました。AI検索時代の可視化を強化します。
OpenRouterで上位に位置していた謎のモデル「Owl Alpha」の正体が、中国Meituanの「LongCat-2.0」であることが判明。1.6兆パラメータの巨大モデルでありながら、Nvidiaのチップを一切使用せずに訓練されたという技術的特異点に注目する。