国内AIニュース
ChatGPT、Gemini、Claudeのメモリ(記憶)機能の違いを解説。自動で文脈に混ざる「自動注入型」と、明示的な指示で呼び出す「明示的呼び出し型」の設計思想の違いを比較し、プライバシー管理とメモリ機能のオフ設定について検証する。
ローカルLLMを活用した自作かな漢字変換IME「Roman」の開発記。開発動機に加え、システム構成や変換キーを排除した新しい変換体験の構築について詳述する。あわせて、AIエンジニアの定義やローカルLLM活用の可能性についても考察する。
サーバーやAPIキーを一切使用せず、静的サイトにAIチャットへの営業導線を設置する方法を解説。llms.txtを公開し、クエリ付きのURLリンクを配置するだけで、ユーザーが各AIサービスへ直接質問を送れる仕組みを3ステップで実装する手法。
Dex Horthy氏が語る「context engineering」の概念と、AIエンジニアの実務におけるトークン制御の重要性を解説。抽象論を排し、LLM開発の実践的な視点を抽出して紹介する記事。
LLMエージェントによるタスク分解の正当性保証に関する考察。LLMが分解しLLMが検証する現状の課題に対し、決定論的な統合と生成的な実装の分離という原則を提唱。LLM同士の検証では誤りが相関するリスクを指摘し、より信頼性の高いワークフローの構築を目指す。
モデル崩壊(Model Collapse)を回避するための、合成データ学習の戦略的アプローチ。データが人間製かAI製かという二分法を超え、どのデータを次世代に残し、どう評価・修正信号を入れるかという「更新経路」の重要性を論じる。
Claude Codeのヘッドレス実行モードを利用した自動化手法のハンズオン。対話UIを介さずシェルスクリプトやCIからモデルを呼び出し、結果をJSONでパースして活用する15分間の実践手順。
マルチターンAgentを強化学習で訓練する際の課題である「信用割当て(Credit Assignment)」の困難さと、既存手法のジレンマを解説。新手法「CrEST」がどのように効率的な訓練を実現するのか、技術的な背景と解決策を提示する。
DeepSeek-V4-Pro正式版のリリースに伴うDay1デプロイ検証レポート。NVIDIA B300×8環境にて、ベンチマーク測定とデプロイ検証を行った結果を詳報する。
自由記述テキストを分類する際の、選択式と自然言語処理を用いた実装の比較論。性格診断などを例に、固定ラベルの限界とLLMによる柔軟な分類手法について技術的考察を述べる。
MoEモデルをAppleオンデバイス環境で高速化するためのカスタムMetalカーネルの試み。標準的なMoEデコードの非効率さを解消し、gather_qmmを用いた最適化事例を紹介。
マルチモーダルAI「Qwen3.8-27B」のオープンウェイト公開について。コーディングからエージェントタスクまでをカバーし、画像・動画理解能力を備えた最新モデルの概要を紹介。
Z.aiが発表した新型AI「GLM-5.3」の性能と特徴の紹介。事後学習を強化し、コーディングやセキュリティ性能を大幅向上させたモデルの概要と公開スケジュールについて。
GoogleがGeminiとFlowで導入した電子透かし設定の柔軟化について。可視の透かしを選択式にしつつ、SynthID等の不可視の来歴情報は維持し、透明性と創作の自由を両立させる仕組み。