国内AIニュース
AIエージェントの自己改善における「最初の前提を覆せない」問題についての考察。プロンプトや正規化等の表面的な改善に留まらず、設計そのものを変えるための実務的なアプローチを模索。
QLoRAとUnslothを活用したファインチューニング設計の要点。ベースモデル選択、データ品質、評価方法の3点を事前に決める重要性を説き、学習改善を加速させるためのステップを解説。
米政府はAnthropicのAI「Claude Mythos 5」および「Claude Fable 5」の国外利用を禁止していたが、G7諸国に対しても例外を認めない強硬な方針を示していることが報じられた。
Appleの機能「メールを非公開」で生成されるメールアドレスのドメインが変更されることが明らかになった。ユーザーのプライバシー保護を目的としたメール転送機能の仕組みが一部アップデートされる。
RAG構築におけるドメイン知識の入れ方を考察。1220回のクエリ実験を通じ、詳細な説明よりも「証拠となる情報」の重要性や、ベンチマークによる評価の限界を指摘する。
中国のZ.aiがAIモデル「GLM-5.2」を発表した。各種ベンチマークでClaude Opus 4.7を凌駕し、ブラインドテストではClaude Fable 5を上回る結果を出すなど、高い性能を示している。
LLM Wikiシステムのための知識コンパイル手法「WiCER」に関する技術メモ。Wiki-memoryのCompile(コンパイル)、Evaluate(評価)、Refine(洗練)を繰り返す手法を解説。
AIエージェントと外部ツールを連携する「MCP(Model Context Protocol)」のセキュリティリスクを解説。エージェントの権限管理や脆弱性の重要性を初心者向けに説く。
家族アルバム「みてね」のCREチームが半期ごとの目標設定手法を共有。チームの働き方や取り組みを言語化し、継続的に改善するためのプラクティスを解説します。
AIエージェント利用時の認証認可の課題とプロンプトインジェクションのリスクを指摘。人間用の権限をそのまま付与する危険性と、設定ファイル経由の攻撃手法について警鐘を鳴らす。
ClaudeデスクトップアプリからスマホアプリへのRemote接続について、誤った情報による混乱を回避し、正しい解決策を見つけるための診断アプローチを提示します。
NERVが金融機関3社のAI導入で培った、AI敬語評価の知見を公開。不適切な敬語が信頼に及ぼす影響と、MAGI Auditを用いた解決策を解説します。
自作のマルチエージェント・フレームワーク「C3(Claude Code Conductor)」の概要と目的。Claude Codeを拡張し、タスク実行を最適化する仕組みを解説。
失敗を共有するSNS「ShippAI」で、励ますAIが逆効果だった理由を分析。AIの人格を「賢者」から「編集者」へ変更したプロンプト設計の記録です。
AI関連書籍の出版を通じ、売上以上に本業の受託案件獲得に繋がるリード源としての価値を解説。Kindleストアで競争が激化する中、中身以上に表紙デザインが売上に直結するという残酷な現実と、AI感を払拭する重要性を説く。
大規模MoEモデルの推論を最適化するアーキテクチャ「AFD」を解説します。メモリ帯域を占有するAttentionと演算負荷の高いFFNを物理的に分離し、それぞれを最適なハードウェアで効率的に処理することで推論パフォーマンスを最大化します。
Z.aiがコーディングと長期エージェントタスクに特化したAIモデル「GLM-5.2」をMITライセンスで公開。オープンウェイトモデルとして最高水準のスコアを記録。
シャープの新型Androidスマホ「AQUOS R11」が登場。自動ズーム機能や、写真内の個人情報を守る自動ぼかし機能を搭載し、利便性とプライバシー保護を強化。
Googleビジネスプロフィールの運用ツールは有料が一般的ですが、公式APIを活用すれば無料で機能を実現可能です。Cloudflare無料枠を利用し、口コミ返信、投稿予約、分析、LINE通知を自動化するOSS開発の設計と思想を解説します。
Claude CodeでOpenAIのCodexプラグインを活用し、画像生成を行う方法を解説。Skill()ではなくAgent(subagent_type)を利用することで、バックグラウンド実行や日本語文字化けといったトラブルを回避して安定的に画像生成を行う手順を紹介。