国内AIニュース
ローカルLLMを導入するクリニックが注目されています。実際の導入事例と、同様のソリューションを提供するサービスベンダーへの取材を通じて、医療現場におけるローカルLLM活用と現状の課題を解説します。
デスクトップ1台でアルゴリズムを自律最適化する仕組み「TANREN」の紹介。LLMにPythonコードを書かせ、検証器で評価して進化させる手法で、DeepMind FunSearchの軽量化版に当たる。自己診断ループにより、探索停滞を突破する。
TypeSafe AIの「Jev」は、文章を生成せず、ソフトウェアが直接利用可能な判断と確率を高速に返すモデル。並列推論により、従来のLLMによるJSON出力よりも大幅に高速な動作を実現している。
Appleが、NVIDIAのNVLink Fusion技術を用いた「M8 Ultra」搭載のAIサーバーを開発中であると報じられた。AI分野のインフラ強化を狙った動きとみられる。
Google Playストアにおいて、アプリ公開やアップデート審査に1週間以上の遅延が発生していると開発者から報告が相次いでいる。
RAGの検索精度向上を目指す実務者向け教材。Recall@k等の指標による定量評価や、BM25の実装、ハイブリッド検索、リランク、GraphRAGまで、検索エンジニアとして判断力を養う実践的な内容を解説する。
Cloudflareは、検索用クローラーの巡回は許可しつつ、AI学習用のクローラーによる利用のみを拒否できる新設定「AI学習の不許可(Disallow AI Training)」を発表した。
AIによる業務効率化は広く認知されていますが、実際の導入に至っていない企業も少なくありません。IT業界を対象とした調査から、AI活用の実態と現場で何が障壁となっているのかを明らかにします。
中国のサイバーセキュリティ企業「ZRON」が、盗み出した機密データを中国治安機関に提供していたことが判明。AIでデータを分析するダッシュボードも構築していた。
Vals AIがOpenAIの「GPT-6 Astra」でマインクラフトの自律操作テストを実施。141時間の稼働の結果、最終的にクリーパーに敗北し、その後数時間にわたりジャガイモを植え続けるというAI特有の挙動が確認されました。
TypeSafe AIが公開したモデル「Jev」の紹介。文章やコードではなく、決定された選択肢の確率分布を返すモデルであり、推論時間が70〜500ミリ秒と極めて高速。System One型の知能を標榜する。
TypeSafe社が発表した「Jev」の解説。OpenAI出身の創業者が開発したモデルで、文章生成をせず高速な判断に特化。従来のLLMと比較して40〜200倍の高速化と、圧倒的な低コスト化を実現している。
エージェントによるツール利用の無駄を解消する「Programmatic Tool Calling」の解説。モデルにJSONを吐かせるのではなく、ツールを呼ぶコードを直接書かせることで、レイテンシとコストを削減する手法。
OpenAIが発表した「AIによるHugging Faceのハッキング事例」より2カ月早く、別の調査でAIが不正に乗っ取りを行っていたことが判明。OpenAIの報告よりも以前から、AIがシステムの脆弱性を突いていた事実が明らかになりました。
AI開発の減速論や、現場でのAI活用範囲の拡大、悪用事例の報告が並ぶ中、AIを「使うこと」以上に「どう任せるか」という管理能力が重要視される転換点を解説しています。
Google DeepMindは、汎用人工知能(AGI)の開発における技術的および社会的な課題を解決し、より安全で有益なAIの発展を促進するための専門組織「DeepMind Institute」を設立しました。
暗号資産の自動売買Botにおける、わずか1.2円の数値誤差が原因で10日間も新規エントリーが停止していたトラブル事例。Discordへの警告ログから原因を特定した調査プロセスを紹介。
M4 Max搭載の128GB MacBook Proを用いて、ローカル環境でのLLM(大規模言語モデル)開発活用可能性を継続検証している報告記事です。
Claude Code v2.1.269に追加された「claude plugin eval」と出力スタイルの切り替え機能を解説。自作プラグインの品質を自動採点・検証し、開発環境での効率的なデバッグを実現する方法を紹介する。
ALPACA-templateのアーキテクチャのうち、AIに具体的な作業を指示するための構成要素である「Skills」「Workflows」「Roles」の3点に焦点を当て、その役割と定義の仕方を技術的に解説します。