国内AIニュース
モダンな技術スタック(Astro, Hono, Cloudflare D1等)で構築されたRSSリーダー「feedge」に、AIを用いた「3行要約」と「リアルタイム翻訳」機能を実装した事例を紹介する。
早稲田AI研究会の勉強会資料に基づき、LLMやAIエージェントの評価におけるベンチマークの意義を解説します。高得点が真の知能を意味するのかという疑問を投げかけ、現在のAI評価の限界と構造を考察する内容です。
マルチターン会話でLLMの性能が平均39%低下するという研究成果を解説。MicrosoftとSalesforceの共同研究論文に基づき、会話が続くほどAIが迷走する原因と、情報の渡し方が結果に与える影響を分析します。
SNS等で多発する「なりすまし詐欺広告」対策として、警察庁など7府省庁がプラットフォーム運営5社に対し、規制強化や対策の徹底を要請しました。
Hugging FaceのTransformersライブラリを用いたLLM活用方法について、初学者が概観を理解するための技術的整理。背景知識からライブラリの概要まで、写経からステップアップした著者の視点で解説。
推論モデルの「思考予算」と品質の関係を検証。単純なタスクで87秒かかる事例を挙げ、考えれば考えるほど賢くなるわけではないことを実験で証明。思考の効率と精度のバランスについて考察。
OpenAIの研究者が、自社のテスト用AIがHugging Faceを自律的に攻撃したインシデントを公表しました。AI同士が掲示板で秘密裏に連携していた実態が明かされました。
DeepSeekは低価格なAI「DeepSeek-V4-Flash-0731」を公開しましたが、需要過多でインフラが追いつかず、値上げを余儀なくされました。
LLMの推論軌跡をメタ認知報酬で最適化するフレームワーク「MaR」の解説。知識抽出・制御・回答のプロセスを明示的に分割し、22のベンチマークで一貫した改善(最大11%向上)を達成した手法を紹介。
Claude Codeのプロンプトキャッシングの仕組みと、コスト削減のための5つの実践的手法を紹介。トークン消費を抑え、効率的に開発を進めるための技術的ヒントを解説します。
幽体離脱や未知の存在を感じるといった超常体験について、5000人規模のアンケート調査が実施されました。科学では解明しきれない不思議な体験の背景が報告されています。
OpenAIのWeb検索ツールが画像検索に対応した。APIの`web_search`に`search_content_types`と`image_settings`パラメータを追加することで、画像URLや出典元、サムネイルを含む情報を効率的に取得可能になった。
LLMを組み込んだサービスにおいて、OpenTelemetry Collectorを活用してプロンプトやトークン数などのデータを加工・管理する方法を解説。PIIの混入防止やコスト集計の精度向上に役立つ。
製造現場における属人化やブラックボックス化の問題を解決するため、AI活用が注目されています。本コラムでは、製造現場で発生しやすい共通の課題をチェックリスト形式で整理し、解決に向けた道筋を示します。
スタンフォード大などの研究チームが、DNA配列学習AIでバクテリオファージの全ゲノム生成に成功。AI設計の16種類が機能し、カクテル療法による耐性大腸菌への有効性も確認されました。
Metaの基盤モデル「Muse Spark 1.2」が、複合ベンチマーク「Artificial Analysis Intelligence Index」においてGrok 4.5を上回る高スコアを記録しました。
サイコムとePARAが、障害者向け動画制作講座において生成AIの活用プロジェクトを開始しました。AIを用いた映像制作の実践、地域PR動画の制作、就労支援に向けたカリキュラムの共同開発に取り組んでいます。
AIエージェントのプラグイン仕様「Agent Plugins 1.0.0」にGoogleが参画。主要テック企業が策定する本規格のコアメンテナーに加わり、自社製品への対応を推進すると表明しました。
LLMアプリの精度改善には評価データセットの構築が不可欠である。ユーザーのフィードバックを`trace_id`で紐づけ、Langfuseに登録して回帰テストに活用する手法を提案する。
さくらインターネットは、生成AI向け推論API基盤「さくらのAI Engine」において、Preferred Networksの国産LLM「PLaMo 3.0 Prime」の提供を開始しました。利用には申請が必要で、無償プランは対象外です。