2026年9月25日

Anthropic、新モデル「Claude Opus 5.5」を発表 ― コスト40%削減と長時間コーディング向けの性能向上

Claude Opus 5.5

anthropic.com ·

Anthropicの新フラッグシップモデル「Claude Opus 5.5」の発表記事で、エージェント型コーディングやコンピュータ操作でのベンチマーク結果、安全対策の強化が説明されている。トークン単価の引き下げ(キャッシュリードは60%安)と出力速度30%以上の向上が明記されており、API利用コストを見直したいエンジニアにとって直接的に有用な情報だ。

拡散ベースLLM「Mercury 2.5」が毎秒770トークンの生成速度に到達

Mercury 2.5 LLM hits 770 tokens per second

artificialanalysis.ai ·

Artificial Analysisによる拡散型LLM「Mercury 2.5」の独立分析で、毎秒770トークンという生成速度と価格・コンテキストウィンドウ・レイテンシが比較されている。対話型アプリでレイテンシが課題のチームにとって、新しいアーキテクチャのモデルが実用速度に達したかを判断する重要な指標になる。

F5 BIG-IP APMにCVSS 9.3のゼロデイRCE脆弱性、実攻撃を確認 ― 緊急パッチ適用を

Someone's attacking a critical 0-day RCE in F5 BIG-IP APM

theregister.com ·

F5 BIG-IP Access Policy ManagerのOAuth構成に影響するヒープバッファオーバーフロー(CVE-2026-94127)が実攻撃を受けており、CISAが既知悪用カタログに追加した。BIG-IPを運用している組織は、影響する仮想サーバ構成かどうかを即座に確認しパッチ適用を急ぐべき、極めて実務的な緊急情報だ。

Android・Linux・macOS・Windowsに共通するファイル通知まわりの長年老朽脆弱性が発見される

Decades-old file security flaws found in Android, Linux, macOS, and Windows

theregister.com ·

主要OSのファイル監視(inotify/FSEvents/FileObserverなど)が権限のないファイルの変更イベントを観測できてしまう問題の研究記事。キーストロークタイミング攻撃や他ユーザーの閲覧サイト追跡が実際に成立することが示されており、権限モデルの盲点を認識しておくべきセキュリティ上重要な内容だ。

手元のハードウェアでフロンティア級の自律研究エージェントを動かす ― オープンソース化の取り組み

Frontier AI on Your Own Hardware

timdettmers.com ·

Tim Dettmersが、少数GPUやMacBookで自律研究エージェントを長時間稼働させる自社ハーネスの設計思想を紹介し、オープンソースウィークの公開予定を予告している。長時間セッションを支える「CliffCompaction」という自動圧縮技術や、実際の研究室での運用知見が語られており、エージェントの実運用に興味があるエンジニアに示唆が多い。

Unreal Agent:キャッシュを壊さない非同期ツール実行で、ターン数とコストを削減したエージェントハーネス

Unreal Agent

unreallabs.ai ·

unreallabsが自社のエージェントハーネス設計を詳解した技術記事で、非同期ツール呼び出し・イベントログによる実装、SDK依存を減らす判断、サンドボックスによる承認ゲートなどを具体的に説明している。Terminal-Benchでの比較結果も含まれており、エージェントハーネスを自作・評価しているチームに即役立つ実装上の洞察が得られる。

AIコーディングでCIがボトルネックに ― LinearがCIをどう組み直したか

AI coding has made CI a bottleneck, so we reworked ours to keep up

linear.app ·

Linearが、AIコーディングによる大量のPRでCIが遅延した問題に対し、依存の絞り込み・tscチェックのスクリプトコンパイラ化・ASTベースのlint書き換え・チェックジョブの統合などで改善した実践記録。具体的な数値と施策が豊富で、自社CIの高速化にそのまま応用できる内容だ。

ModalがKubernetesを超えて ― 秒単位で100万並列サンドボックスをスケールする方法

Beyond Kubernetes at Modal: How to Scale 1 Million Concurrent Sandboxes in Seconds

infoq.com ·

Modalのスタッフエンジニアが、毎秒数万のサンドボックス生成と数百万規模の同時実行を支えるためKubernetesを使わずにインフラを再構築した事例を解説する。AIエージェント実行環境のような大規模サンドボックス基盤を設計する者にとって、Kubernetesの限界とその代替アーキテクチャを学べる貴重な事例だ。

AMDの256コア「Venice」Epycを解剖 ― Zen 6世代のキャッシュ・I/O・メモリ構成のすべて

An Epyc trip to Venice: Everything we do and don't know about AMD's 256-core monster chip

theregister.com ·

AMDのZen 6ベース次世代Epyc「Venice」のダイ構成、PCIe 6.0/CXL 3.1対応、DDR5 8000/MRDIMMによる1.6TB/sのメモリ帯域、3D V-Cache搭載のVenice-Xまでを詳述したハードウェア解説記事。データセンター調達やHPC基盤の計画に関わるエンジニアにとって、次期CPUプラットフォームの性能と選択肢を見極める材料になる。

Pragmatic Engineer「The Pulse」:CPU不足の兆し、Opus 5.5、コードレビューの未来

The Pulse: a new trend of CPU shortages

blog.pragmaticengineer.com ·

GPU・メモリに続くCPU不足という新たな供給制約を軸に、DHHの「手書きコード終了」宣言やAWS Distiguished Engineerによる人間の手によるコードレビュー消滅予測など、業界の転換点をまとめた週刊ダイジェスト。AIワークロードがCPU需要を押し上げる点は、インフラ計画に関わるエンジニアにとって押さえておきたい潮流だ。

次回配信予定: 2026年9月28日