国内AIニュース
Anthropicの「Jacobian Lens」論文の手法を用い、日本語モデルの中間層から特定の概念を読み出す実験を紹介。モデルの内部解釈可能性を高め、ステアリングや概念抽出の可能性を探る研究プレビューです。
サイトの構造化データやllms.txtを整備しても、PerplexityやChatGPTに引用されない理由を分析。構造的なボトルネックを実測データに基づき考察した記録。
請求書や領収書をOCRし、インボイス登録番号を照合するAPIの開発事例。個人開発者が市場調査から本番稼働まで1日で行ったスピード感ある開発プロセスを紹介する。
AIモデルが急速に進化する中で、エンジニアが蓄積してきた工夫や知見が「陳腐化する不安」について考察。モデル依存の技術に依存しすぎない本質的な開発環境のあり方を問う。
Anthropic社が提供する「Claude Fable 5」が、AnthropicのMaxプランおよびTeam Premiumプランの一部として利用可能になったことが発表されました。
ChatGPTが文章を理解する仕組みを、開発者視点で解説。LLMは人間のように日本語を読んでいるわけではなく、文章をToken化し、Embedding(ベクトル変換)を経て、Transformerが次のTokenを予測することで生成を行っています。
AIに開発を任せる際、古いプロジェクト記録やメモを現在の事実と誤認する「古い記録を現在として踏む」事故が発生しがちです。本記事では、この矛盾問題の解決策と、複数のエージェント管理における工夫を紹介します。
プロンプトインジェクションはゼロにできません。ユーザー入力や外部文書をそのまま連結するリスクを警告し、入力内容がsystemプロンプトを上書きする危険性を指摘。防御を前提としたLLMアプリ設計の重要性を説きます。
中国AIの進化が日本の保険業界システム開発に与える影響は限定的です。セキュリティ規制や情報管理の厳格さから、日本の金融機関が中国製AIを業務に組み込む可能性は極めて低いためです。
LLMの「reasoning_effort」設定(思考の段階的な深さ)が矛盾検出に与える影響を検証。high設定で逆に検出性能が下がるモデルもあり、単純な強化ではないことを示唆。小規模テスト結果から実務への応用を論じます。
サブスクリプションによる音楽消費の変化を分析。聴き飛ばしが容易になった現代では、楽曲の冒頭数秒で価値を伝える必要があり、サビ始まりの曲が増加した。しかし、サビ始まりと曲の完成度は別物であると指摘する。
AiderとOllamaを用いてLLMのコーディング性能を比較検証。前回優秀だったモデルに加え、速度と精度のバランスが重要とされる「qwen3:14b」を含め、複雑なタスクにおける実用性を検証する。
AIが知識の習得を代替する時代において、知識の価値が低下するどころか、むしろ高まっていると主張。AIを使いこなすために必要な深い知識と、自己研鑽の重要性について論じる。
「ループエンジニアリング」と「ソフトウェアファクトリー」という概念を対比させ、AIエージェントの自走能力だけでなく、人間が設計者・監督者として関わる仕組みの重要性を論じる。
PrismMLが発表した1-bit LLM「Bonsai」を紹介。8Bモデルで1.15GBという超軽量化を実現し、GPUなしのPCでも実用的な速度で動作する点など、その特徴を解説する。
AIコーディングエージェントの普及と生産性向上の裏側にある開発者の疲弊に注目。Stack Overflowの2025年開発者調査を引用し、データから過渡期の現状と生き抜き方を考察する。
Cloudflare AI Gatewayの活用術を紹介。Base URLを変更するだけで、無料でロギング、キャッシュ、認証情報の集約ができる便利さを解説する。
Claude Codeでの開発における「セッション間の文脈継承」問題を解決する自作ツールを紹介。MCPサーバーとVSCode拡張で、設計方針や進捗を維持する工夫を解説する。
Claude Codeのcompact機能について、手動と自動の仕組みを解説。さらにセッションのcontext使用率を効率的に抑えるプラグインの自作について触れる。