国内AIニュース
AI議事録ツールが活用されないという悩みに対し、議事録の真の価値は「読み返すこと」ではなく「決定の記録と追跡」にあると定義し、導入の失敗を再定義する。
PC画面の録画から編集、ノイズ除去、ファイル圧縮までを一台で完結できるツール「VideoProc Converter AI」を試しました。解説動画制作に必要な工程を効率化できる実用性を検証します。
実装を壊して証明の有効性を検証する「ミューテーション」手法の連載第4回。今回は、ミューテーション自体が機能不全に陥ったケースの教訓と改善の試みを綴る。
ChatGPT Workに、質問するだけで社内データの分析やグラフ、ダッシュボードを作成できる「Data agent」機能が登場しました。
こどもニュース運営者が、AIによるニュース生成コストを最適化する仕組みを解説。安価なモデルで処理し、精度が不足する場合のみ上位モデルへ自動で転送する手法を導入することで、品質とコストの両立を実現した。
LLMを用いた分類バッチ処理におけるテストの不安定さと、エラー時の挙動を改善するアプローチ。LLMの出力に依存しすぎない評価指標の導入や、異常系テストの見直しにより、バッチの信頼性を確保するための工夫を共有する。
Anthropicが脅威レポートを公開。Claudeが生物兵器や軍事目的、世論操作などに悪用される事例を検知・遮断したと発表し、悪用への警戒を強めています。
OpenAIの「Path to Astra」で言及されたExploitBenchを用いたセキュリティ評価について解説。二値判定では測れないLLMの脆弱性検知の難しさと、評価結果の多様な質を理解するための重要性を論じる。
『QAエンジニア入門』を読み解き、AIシステムにおける品質保証の観点をまとめた。社内ヘルプデスクAIを具体例として、AI特有の品質担保の考え方や重要ポイントを解説する。
NTTドコモソリューションズのIT運用部門が、業務の30%をAIに任せる中で「パワポ日報」を禁止。デジタル化の中であえて文書作成を減らす狙いを聞きました。
Anthropicは、コーディングエージェント「Claude Code」のデフォルトモードを、都度承認方式から自動実行方式へ変更しました。1053人を対象にした対照実験において、AIによる危険コマンドの検知率は人間によるレビューを上回る結果となりました。
ITRの調査により、国内のAIガバナンス・リスク管理市場が2025年度に前年度比で10倍に急拡大していることが判明しました。AI活用が普及する中で、これまで注目度が低かったリスク管理領域が重要視されるようになった背景を解説します。
Zed Industriesは、AIエージェントと人間がペアプログラミングを行うための環境「Delta」を発表しました。独自のデータベースにより、会話とワークツリーをリアルタイムで共有し、共同作業の効率を高める新ツールです。
AIインフラ需要の拡大に伴い、SSDやメモリの価格上昇が続いています。IT部門は単なる資材コスト増として捉えがちですが、実際にはシステム運用や予算計画に広範囲な影響を及ぼすため、早急な対策が必要となります。
AI生成ドキュメントの増加に対し、受け手が求める情報を再考するよう提言。詳細な全過程よりも、「何がわかったか」「どうすべきか」「未解決事項は何か」という判断根拠の提示が重要であると説く。
AIルームデザインツールにおける新しい試み。静止画の生成だけでなく、変身プロセスを動画(Before-After)で見せることで、視覚的インパクトと理解度を高めるツールを開発した体験談。
AIエージェントを活用してWindows用ソフト「Karuzip」を開発するまでの流れを解説。要件整理、画面設計、実装、確認、リリースまでの分担と手順を具体的にまとめた開発記録。
AI生成コードのレビュー負担に関する考察。書く時間は短縮されたが、生成されたコードの確認・修正に要する「レビュー時間」が増加している実態を、調査データと自身の感覚から分析。
AIを活用した小規模な内製開発フレームワーク「ALPACA-FW」の設計思想を解説。機能紹介にとどまらず、AIとの共同作業における仕組みづくりに焦点を当てる。
Geminiを活用した「第二の脳」構築のPoC(概念実証)体験記。Obsidianとの連携ではなくGemini単体でどこまで自動化できるかを検証し、得られた学びや限界を共有する。