国内AIニュース
AI時代のPM(プロダクトマネージャー)に必要な能力を、個人開発の経験をもとに解説。実装スピードが向上する中で、要件の曖昧さやセキュリティリスクをどうコントロールすべきかを詳述。
現在のLLM開発ツールが進化する中で、AIが「知的存在」のように見える背後のアーキテクチャを解説。トークン処理から決定論的な自動システムまでの本質を物理的に整理する考察記事。
中国メーカーCXMT製のDDR5メモリが注目を集めています。MSIが同社製メモリの高速動作をサポートするベータ版BIOSをリリースし、メモリ不足問題の解消への期待が高まっています。
Anthropicの新モデル「Fable 5」のリリースと提供状況の変遷を報告。政府規制による一時停止や、サブスクでの提供条件(従量課金への移行)など、実運用に関わる重要な最新情報を共有。
中国のウェブ小説サイトで、AI生成作品への規制が強化されています。品質低下に対する読者の不満を受け、テンセントやByteDanceなどの大手プラットフォームが審査基準を引き上げました。
OpenHandsの検証を通じて、コーディングエージェントのコモディティ化が進む現場の様子を報告。DeepSeek V4 Flashのコストパフォーマンスと開発ツールトレンドについて議論した勉強会の記録。
Claude Fable 5の「サブエージェント委任」機能に注目し、Claude Codeを活用した自律エージェント運用への挑戦と、モデルの能力が長期間のタスク遂行にどう活かせるかを考察。
米Anthropic社の最新AIモデル「Claude Fable 5」の性能をITmedia AI+編集部が徹底検証。特に「10年後のITエンジニアの仕事」というテーマで質問を行い、モデルが提示する未来の展望や回答の精度についてレビューします。
LLMエージェントが利用する「文脈」についての考察。プロジェクトメモや過去の履歴、ツール出力などのコンテキスト管理がエージェントの判断に与える影響と、その重要性を解説した記事。
AIエージェントの能力向上を目指す「Agentic Reinforcement Learning(Agentic RL)」について解説。自律的にツールを操作するLLMに仮想環境で報酬を与える学習手法と、その仕組みについて専門的な観点から概説する。
LLM向け圧縮法において、人間が判読不能なレベルまで圧縮しても精度を維持できるという説を検証。LLMLingua-2を用い、Mac mini環境にて圧縮率とQA精度のトレードオフを実測したレポート。
「Sakana Chat」に新機能が追加され、ビジネス敬語や日本特有の文化概念、ネットスラングの翻訳精度が向上。従来の翻訳エンジンでは困難だった「日本語らしさ」のニュアンスを的確に捉えることが可能になりました。
ボストン・ダイナミクスの人型ロボット「Atlas」が、FIFAワールドカップ2026のイベントに登場し、最新技術を世界中の観客に披露しました。
LLMの推論訓練における特権情報漏洩を解決する「DemoPSD」を紹介。既存のOPSD手法の弱点であるショートカット学習を回避するため、教師と学生の予測分布間のJS分岐を最適化する新しい手法。
AIコーディングエージェントをゼロデイ脆弱性ハンティングに活用するフレームワーク「T3MP3ST」を紹介。偵察から攻撃、レポート作成までを自動化するマルチエージェント型セキュリティツール。
テンセントが新AIモデル「Hy3」を公開しました。比較的小規模ながら、GLM-5.2やDeepSeek-V4-Proなどの大規模モデルに匹敵する性能を誇ると主張しています。
コードエージェントを利用してLLMのシステムプロンプトを抽出する手法「Just Ask」を紹介。一般的なAIエージェントとコードエージェントの違いや、その潜在的なリスクについて解説する。
AnthropicがLLM内に「J-space」という構造を発見し、新手法「Jacobian lens」を公開。AIが言語化しない潜在的な思考を観測でき、不正コードや評価の歪みを検知可能になるため、AIの安全性向上に寄与します。
数学研究におけるAI活用のケーススタディ。最新のAIを単に信頼するのではなく、自分自身を信頼するために設計した検証手順(ハーネス)の重要性について説く個人の開発記録。