国内AIニュース
LLM単体からエージェント実装・標準化・安全性へ焦点が移る2026年7月末の技術トレンド。MCPの仕様対応やセキュリティ課題など、AI開発基盤側の動向を俯瞰する。
LLMの品質評価手法「LLM-as-judge」の自作実装記録。初期モデルの不正確さをドメイン知識に基づく5回の修正で実用レベルまで引き上げた試行錯誤の過程と結論を共有。
Cloudflareが公開した「cloudflare/computer」の解説。Durable Object内に構築された仮想ファイルシステムの内容をテーブル定義から動かし方まで詳しく調査。
DevinのProプラン契約時に表示される「Extra usage balance: $50.00」の正体を解説。公式ドキュメントに基づき、これはGitHub接続時の付与クレジットであり請求ではないことを証明。
Rustでの個人開発において、データと振る舞いを分離する「データ指向プログラミング」を用いた設計パターンを整理。AIコードのレビューやリファクタリングを効率化する手法。
AIが生成するコードの「仕様どおり」を保証する手法を提案。設計、仕様、型契約、実装を一方向の参照チェーンで結び、CIゲートで機械的に検証する仕組みの全体像を解説。
AIの使いこなし術が毎週更新され、消費される現状を批判する記事。単なる「道具の使い方」の習得ではなく、技術の原理を理解することの重要性を説き、使いこなされる側にならないための視点を提示している。
ChatGPT、Gemini、Claudeの「御三家」を比較。2026年現在、性能差が縮まる中で各モデルの性格が明確になっているとし、目的に応じた最適なAIの使い分け方を提案する。
OpenAIが発表した大学研究者支援プログラム「ChatGPT for Academic Researchers」を解説。世界10万人に上位モデルを無償提供し、研究の各プロセスを支援する施策の内容を紹介。
AIエージェントの配布・利用障壁を解決する手段として「メール」を再考する。既存のインフラであり、全員が利用しているメールを分散型アプリケーション基盤として活用する利点を論じる。
FIFAワールドカップ2026での違法ストリーミング対策「オペレーション・オフサイド」について。米国司法省の取り組みと、さらなる対策として米映画協会が提唱するISP遮断の必要性を報告する。
AIを活用し、1人で年間1000万ドル以上の売上を上げる「1人事業者」が急増している。Stripeの分析に基づき、2年間で約3倍に増えたソロプレナーの動向と事業環境を分析。
AIによる「コラッツ予想の反証」がLeanに受理されたが、実際にはシステムの不具合を突いたものであったことが判明。数学的証明におけるAI利用の限界とリスクを指摘する。
AIに引用されるための戦略についての考察。情報量の多さだけでなく、AIのアルゴリズムに最適化された情報の構造が引用の可否を決定づけているという逆説的な事実を解説する。
AI時代における「仕様駆動開発」の再定義。官僚的な文書作成ではなく、AIに人間の意図を正確に伝え、コード生成を効率化するための実践的なコミュニケーション手法としての仕様書を論じる。
生成AIを用いて女性のわいせつ画像を加工し、SNSに投稿したとして会社員が逮捕、依頼した高校生が書類送検された。名誉毀損や児童ポルノ禁止法違反に問われた今回の事件を報じる。
AWSを活用したAI株価予測システム開発の第2回。予測モデルに何を学習させるかというデータ選定の重要性に焦点を当て、株価以外の外部データ活用とモデルの段階的構築について解説する。
Zennの「記事英語版生成機能」が自身の記事に適用された際の変化を解説。URLの変化やlocaleの影響など、自動翻訳機能がアカウントや記事にもたらす具体的な影響を実ログで示す。
MCP(Model Context Protocol)を活用してAIと外部ツールを連携させる重要性を説く。コピペ作業を排除し、AIが直接タスク管理ツール等にアクセスする仕組みの利点と実装の考え方を解説。
USENIX Security 2025掲載の論文「StruQ」を紹介。データと命令を分離する構造化クエリを用いることで、利便性を損なわずにプロンプトインジェクションを防ぐ仕組みを論じる。