国内AIニュース
Anthropicが新モデル「Claude Opus 5.5」を発表しました。Fable 5.1に匹敵する高い実務性能を実現しつつ、Opus 5と比較してコストを40%削減。安全性評価でも過去最高スコアを記録するなど、高いコストパフォーマンスと安全性を両立させた次世代の高性能モデルです。
手元の機材だけで大規模モデル(235B MoE)を動かすための「Mesh LLM」技術を紹介。複数のマシンを連携させてメモリ不足を解決する仕組みと、プロジェクトの概要を解説する。
アナログAIの基本セル「Analog Cognitive Cell (ACC)」の設計論。記憶・選択・発振の機能を同一セルで実現する試みについて、Pythonを用いたシミュレーション環境を紹介する。
Codex CLIで「--approve-for-me」フラグを非対話的に使用する際の注意点。自動レビューが安全か、または権限昇格のリスクがあるかを検証し、正しく使うための判断材料を提示する。
TypeSafe社のJevモデルを OSS「Laya」で日本語メール業務に適用した実測レポート。多クラス選択性能や位置バイアスの影響を検証し、精度向上のための試行錯誤を記録する。
ローカルLLMをPCで楽しむためのガイド。LM Studioなどの無料ツールを使い、検閲なしモデルを含めて自由にAIを動かす環境構築と、近年の軽量化トレンドについて解説する。
AI.GENERATE_TABLEを活用し、非構造化データを効率的に列形式へ変換する手法。ECサイトのレビューや問い合わせ分析の前処理を自動化し、分析を高速化する具体的な実装を紹介する。
Jevによる観測とQuintによる仕様記述を組み合わせた、新しいAIアーキテクチャの構想メモ。AIの曖昧さをシステム仕様で補強する、信頼性の高いシステム設計を提案する。
AIエージェントの導入において、社員ごとの実行環境やAPIキー、アクセス権限を一元管理できるオープンソースツール「OneCLI」が公開されました。チーム単位で認証情報やルールを適用できるため、管理負荷を軽減します。
AIエージェント用モデルの選定に関する設計メモ。ベンチマーク順位だけでなく、パラメータ数や実運用時の成功率・GPU時間を基準に評価すべきと提唱しています。Xiaomi MiMo-V2.6を例に解説。
プロンプトエンジニアリングの「呪文化」による生産性低下を指摘し、プロンプトに頼りすぎない機械学習的なアプローチの重要性を説く記事。モデル変更時の再調整コスト削減を目指すエンジニアの知見です。
南開大学の研究チームが、腸内に生息するカビ「Mucor racemus」が放射線による腸管損傷を保護する可能性をマウス実験で突き止めました。この成果は「PNAS」誌に掲載されています。
業務のコストを可視化するツール「コスト思考(Cost Thinking)」の紹介。AI HACK 2026参加記録として、OrcaRouterを用いたLLM選定時の実測データや、チームの意思決定を支える仕組みについて解説。
AI HACK 2026に参加し、教材だけを参照して答えを直接教えない授業アシスタント「SYNBE」を開発。OrcaRouterを活用し、AIエージェントに特定の役割を遂行させるための手法を記録。
一人で気軽に遊べる「AIキャラ3人と喋りながら打てる麻雀」の開発記録。ブラウザで動作し、途中退出も可能な設計の工夫や、技術的な落とし穴、構成について解説しています。
AI HACK 2026で開発された「マルナゲ」の紹介。日程調整や催促など、誰がやるか曖昧な面倒な仕事を自律的にこなす幹事エージェント。人の気遣いを不要にするための仕組みを解説。
AIに独自のデザインをさせず、レイアウト配置と機能実装のみを行わせる手法を提案。AIによる画一的なデザイン(AI Slop)を回避し、人間がデザインしたスタイルを守りながら開発効率を高めるスキルです。
AIエージェント開発を効率化するための「Plan」「Work」「Review」「Compound」等の実戦的テンプレート集。毎日の作業にすぐに取り入れられるよう、そのまま貼り付けて使える形式で提供します。