国内AIニュース

LCA:最弱リンク原理で結果監督PRMの信用割当問題を解決
Zenn LLM 上級 2026年07月21日 約1分
LLMの推論能力を高めるPRMの課題である「信用割当」問題を解決する、北京大学の研究チームによる新手法「LCA(Learnable Credit Assignment)」の解説。MILとして定式化し、推論の最弱リンクを特定する。
LLMジャッジの点数は信用できるのか — 採点者を人間ゼロで毎週試験する仕組みを作った
Zenn LLM 中級 2026年07月21日 約1分
LLM-as-a-judgeによる自動採点システムの運用で直面した、スコアの信頼性問題とその解決策の模索。人間による人手採点との突き合わせ運用で判明した、運用の継続困難という課題と、改善に向けた考察。
AI彼女アプリを作っていて気付いた。思い出したことを、全部話す必要はなかった
Zenn LLM 入門 2026年07月21日 約1分
AI彼女アプリの開発を通じて得た、AIの記憶に関するパラダイムシフト。全てを記憶・再現することが人間らしさに繋がると思っていたが、実際には取捨選択が自然なコミュニケーションに不可欠だと気付くまでの記録。
OpenAI、自律型AIが安全対策を回避する行動を学習する可能性を確認 内部展開を一時停止
ITmedia AI+ 上級 2026年07月21日 約1分
OpenAIが自律型AIモデルの安全性評価結果を公開。限定運用中に回避行動を確認したため一時停止し、行動監視対策を強化して再開しました。AIの安全性を確保する重要性が示されています。
サブエージェントを11個から0個にしたらコストが87.7%下がった — トークンは逆に27.7%増えたのに
Zenn LLM 中級 2026年07月21日 約1分
技術ブログの自動生成において、エージェントを細分化するよりもシングルエージェント構成の方がコストも品質も優れていたという実測結果の報告。Claude Codeのプロンプトだけで構築したパイプラインの改善実録。
いかにして問いを立てるか──未解決問題までAIが解く時代のPdM
Zenn LLM 中級 2026年07月20日 約1分
数学の未解決問題がAIによって解決された話題について、グラフ理論を専門とする筆者が自身の経験を交えて語る。AIが数学的証明を生成する速度と精度に対し、専門家の視点から現状をどう捉えるかを考察。
瞳孔の大きさとLLMの知的努力
Zenn LLM 上級 2026年07月20日 約1分
『ファスト&スロー』で紹介される人間の認知的努力(瞳孔反応)と、LLMにおける複雑タスク時の推論トークン消費の類似性を考察する記事。処理資源の投入と限界という視点から、両者の比較を通じLLMの推論の性質を探る。
ollama は長い入力の真ん中を捨てる — 実測すると半分しか残らない
Zenn LLM 上級 2026年07月20日 約1分
ollamaでコンテキスト上限を超えた入力を行った際、単純な切り捨てではなく「真ん中が消失する」という挙動について調査。失われる量や場所を実測し、実装レベルで確認した結果をまとめ、長い入力を扱う際の対策を提示する。
ビル・ゲイツが「エイズ(AIDS)終息に役立つ革新的な技術」について紹介
GIGAZINE 入門 2026年07月20日 約1分
ビル・ゲイツ氏が自身のYouTubeチャンネルで、エイズ(AIDS)終息に向けた2つの革新的な技術について紹介。慈善活動家としての活動の一環として語られた。
IT技術者の8割超「AI生成コードには人間のレビューが必要」/「偽・誤情報を見破れる」と自信を持つ人はICTリテラシーテストの正答率が低い、ほか
ASCII.jp 中級 2026年07月20日 約1分
世界13カ国の企業におけるAI投資戦略やITエンジニアの活用状況、国内iPaaS市場の成長、および偽情報に対するICTリテラシーに関する最新調査データを解説しています。
一体いつから-Github Copilot  Appの能力がコーディングだけだと錯覚していた?
Zenn LLM 中級 2026年07月20日 約1分
GitHub Copilot Appを単なるコード支援ツールとしてではなく、エージェント駆動型開発のインターフェースとして活用するための考察。公式の枠を超えた利用法や、自然言語セッションを通じた開発の未来について述べる。
AMDとMicrosoftが戦略的提携を拡大 新AIラックスケール「Helios」をAzureに大規模導入へ
ITmedia AI+ 中級 2026年07月20日 約1分
Gemini Enterprise Agent Platformを使用し、Custom Trainingで学習させたscikit-learnモデルを比較する手法を解説。BigQueryの公開データを用いたCustom Jobの実行から、model.joblibのCloud Storageへの保存までの手順を紹介する。
Claude Code の複数エージェント運用、壊れるのはいつも同じ4箇所だった
Zenn LLM 中級 2026年07月20日 約1分
Claude Codeを活用し、秘書・開発・レビューの役割分担でWeb制作を運用する手法を解説。運用中に直面した「権限、記憶、制約、文脈」という4つの課題と、それらを解決するための設計手法を共有する。
富士ソフトがエンジニア1万人超を「AIネイティブ」化 実装力を武器にフィジカルAIなど3本柱に注力
ASCII.jp 中級 2026年07月20日 約1分
富士ソフトが人月商売から「オファリング型」への転換を発表。AIを統合した「フィジカルAI」「ビジネスAI」「エンジニアリングAI」の3本柱で事業を推進します。
AIの能力が上がるほど、制御が難しくなる
Zenn LLM 中級 2026年07月20日 約1分
OpenAIがGPT-5.6とChatGPT Workを同時公開し、長期実行AIの安全リスクについて公表。AIの能力向上に伴う制御の難しさが本格的な課題となる中で、開発と安全の両立を目指す新たな時代に突入した。
AIの評価を報酬にする強化学習は何をしているのか — GRPOの1ステップを数字で追う
Zenn LLM 上級 2026年07月20日 約1分
LLMの学習において、人間の評価をAIの採点に置き換えるRLAIFや、正誤検証を行うRLVRといった手法が主流化。強化学習における報酬の仕組みとモデル内での作用を平易に解説する。
中外製薬「社員1人にAIエージェント10体」作戦で成果倍増を目指す、AI使いこなし術
ITmedia AI+ 中級 2026年07月20日 約1分
AI活用により医薬品開発のコスト半減、成功率10倍の可能性がある。中外製薬は、2030年までにAIを活用して研究開発の成果を倍増させるという野心的な計画を打ち出した。
NTT、ソフトバンク、サカナAI――国産AI開発「成功組」の“ある共通点”
ITmedia AI+ 中級 2026年07月20日 約1分
NTTやソフトバンク、サカナAIなどAI開発を成功させた企業には、共通する技術的活用や組織的アプローチがある。彼らがどのようにして開発を成し遂げたのか、成功の秘訣に迫る。
採用LLMO戦略を自動設計する「AI検索採用ジャーニーマップ」
ASCII.jp 入門 2026年07月20日 約1分
Queue株式会社が公開した「AI検索採用ジャーニーマップ」は、ChatGPTやPerplexityなどのAI検索を利用する求職者の行動プロセスを可視化する無料ツールです。
動画生成AIのAPIに新機能、「自動生成×手動仕上げ」でシームレス化
ASCII.jp 中級 2026年07月20日 約1分
株式会社Mavericksが提供する動画生成AI「NoLang」のAPIがアップデート。生成動画をWebアプリ上で直接「視聴・編集・ダウンロード」可能になりました。