国内AIニュース
株式会社バイティがAIを活用したグルメレコメンドアプリ「Bitee」の開発を発表。従来の星評価やランキング形式とは一線を画し、ユーザー個人の嗜好に深く適応する新しいマッチング体験の提供を目指す。
GMO Flatt Securityは、プラットフォーム「Takumi byGMO」にて新機能「Takumi Images」の提供を開始。脆弱性パッチ適用とサプライチェーン攻撃対策を同時に実現する機能で、開発の安全性を強化する。
大規模言語モデル(LLM)は発信元を文章スタイルで判別しているにすぎず、この仕様を悪用することで有害な情報を引き出せることがICML論文で指摘された。訓練でも解消困難な根本的欠陥と警鐘を鳴らしている。
大規模言語モデル(LLM)は発信元を文章スタイルで判別しているにすぎず、この仕様を悪用することで有害な情報を引き出せることがICML論文で指摘された。訓練でも解消困難な根本的欠陥と警鐘を鳴らしている。
LLMの品質とコストを750試行のデータから分析した報告。最大効率の「max」設定でも品質低下はなく、特定パターンの利用で大幅なコスト削減が可能であることを実測値で証明する。
OpenAIが次期主力モデル「Astra」の成果を発表。数学や理論計算機科学の未解決問題10件で成果を上げ、計算コストも抑えています。Leanを用いた形式証明の公開も含め、科学研究への応用可能性を探ります。
提案書作成において、入力情報の量によるAIモデル(ChatGPT, Claude, Gemini)の性能差を比較検証。短いメモでは同等だが、長い資料を与えた場合にClaudeが独走する結果を示し、コンテキスト処理の重要性を解説する。
チャット常駐型AIエージェントの意思決定プロセスを可視化する観測性設計を提案。入出力結果のみのログでは不十分なケースに対し、複数のツール実行やLLM呼び出しを追跡し、AIの行動理由を解明するためのログ実装手法を整理します。
アトラシアンが提供するDiaブラウザについて、現在Mac版のみのリリースですが、多くのユーザーが期待していたWindows版が今秋リリースされることが正式に発表されました。
AIエージェントの外部操作における安全性と確実性を確保する「Responsibility Pathway Runtime(RPR)」を解説する前後編の前編。AIによる自動操作で失敗や不整合を防ぐ重要性を説く。
AIとの対話を一人で完結させず、他者と共有して思考を深めるプラットフォーム「Sapio Tree」を紹介。ChatGPTやClaudeなどを用いた面白い問答を可視化し、対話から新しい気づきを得ることを目的としている。
複雑な論文を専門外の視点から要約・解釈する手法を提案。厳密な理解に固執せず、あえて「ふわっと」理解することでアウトプットを加速させる意義を説き、読み手に対して注意喚起を行いながら知見を共有する論文読解のアプローチ。
書籍『Empire of AI』を通じ、OpenAIの経営層だけでなく、AI開発を取り巻く世界的なデータ、電力、計算資源の構造的依存関係を解説。AI企業を告発の対象としてではなく、技術経路が強いる構造的課題として読み解きます。
3D CAD利用者の悩みを解決する「自作3Dマウス」の誕生秘話。既存製品に依存せず、わずか1500円で快適な操作環境を構築するプロセスと、その開発背景にある3Dマウス難民の悲哀をコラム形式で紹介。
Cloudflare Agentsの「Think」と「Session API」を活用し、エージェントに簡易的な記憶機能(メモリ)を実装する方法を解説。初期化時にContextを追加することで、AIに文脈を持たせる手順を紹介する。
AIエージェント設計における主要な概念(プロンプト、コンテキスト、ハーネス、ループ)を整理。各機能の責任範囲を明確に切り分け、生成AIエンジニアが実務で活用できる基礎理論と設計指針を提示する。
Claude Codeのplanモード出力を木構造の設計書へ変換し、実装後コードとの整合性を検証してPR本文に埋め込むCLIツール「cc-plan-tree」を紹介。
AIの成果物を信頼しすぎることの危険性を説く。自信満々に誤った情報を出すAIの特性を理解し、単なる「疑う心構え」ではなく、具体的な確認手順の重要性を実例と共に提示する。
夜間にAIエージェントを自律稼働させる際の「運用の設計」について解説。プロンプトよりも重要な、境界線の設定や停止条件、失敗時の対応といった事故を防ぐための仕組み作りを紹介。
Qwen3.5-9BのGPT-4超えという噂をM1 Max環境で検証。定量評価の困難さを認めつつ、量子化モデルを実機で動かした際の実測値を公開し、モデル検証における評価指標の妥当性とローカル実行環境の実態を解説します。