xAIが新モデル「Grok 4.7」を発表、Cursorや各種APIですぐ利用可能
Grok 4.7 (x.ai)
x.ai ·
xAIがフロンティアモデルGrok 4.7をリリースし、Cursor・Grok Build・API経由で同日から利用可能になりました。コーディングや法的・医療分野のベンチマークだけでなく、jailbreak耐性やサイバー防御能力といった安全性評価も公開している点が注目です。価格は入力トークン100万あたり2ドルから。
Grok 4.7 (x.ai)
x.ai ·
xAIがフロンティアモデルGrok 4.7をリリースし、Cursor・Grok Build・API経由で同日から利用可能になりました。コーディングや法的・医療分野のベンチマークだけでなく、jailbreak耐性やサイバー防御能力といった安全性評価も公開している点が注目です。価格は入力トークン100万あたり2ドルから。
Show HN: Mini-AGI - Dynamic continual learning model trained on 8GB VRAM (github.com)
github.com ·
消費者向けGPU 1枚で事前学習から継続学習まで完結させ、忘却せず学び続ける実験的な言語モデルmini-AGIの設計が公開されました。重みをディスクに置きワーキングセットのみ常駐させる構成や、トークナイザなしのバイト列入力など、制約から逆算したアーキテクチャの工夫が詳細に語られています。個人所有のモデルが「凍結された他人のモデル」であるという問題意識に共感するエンジニアは多いはずです。
AX - Google's Open Agentic Orchestrator (agentexecutor.io)
agentexecutor.io ·
Google発のオープンソースプロジェクトAXは、エージェントワークロード向けに特化した宣言型の実行基盤で、タスク・ワークスペース・ネットワークポリシー・モデルをプリミティブとして抽象化します。ステートフルで実行が長く断続的なエージェントを、従来のマイクロサービス向けオーケストレーターが扱いにくい点を問題意識として掲げており、大規模エージェント基盤を設計する者にとって設計思想が参考になります。
Cloudflare/Security-Audit-Skill (github.com)
github.com ·
Cloudflareが、コーディングエージェントにセキュリティ監査・ペネトレーションテストを実行させるOSSスキルを公開しました。偵察から検証・レポーティングまでをフェーズ化し、「発見したエージェントと検証するエージェントを分ける」などの設計原則や、サンドボックス要件まで具体的に文書化されています。AIによる脆弱性診断を導入したいチームはすぐ試せる実用的な素材です。
Cisco drops another exploited zero-day, this time a perfect 10
theregister.com ·
Cisco ISEにCVE-2026-76460として登録されたCVSS満点のゼロデイ脆弱性が、実際に悪用されている状態で公開されました。同一アドバイザリでCVSS 10.0が他2件、RCE脆弱性が9.9まで多数報告されており、Cisco機器を運用する管理者は今月のパッチ計画を早急に見直す必要があります。
Tin: full-text search for Postgres (planetscale.com)
planetscale.com ·
PlanetScaleがPostgres用の全文検索インデックス「Tin」を発表しました。85GBのコーパスでParadeDBやGINなど競合インデックスと丁寧にベンチマークしており、同時書き込み性能やインデックス構築時間まで検証しています。Postgres内でElasticsearchなしの検索を検討しているチームにとって選択肢のひとつになります。
How Uber Protects Against Retry Storms (www.uber.com)
uber.com ·
Uberが分散システムでのリトライストームへの対策を解説しています。リトライバジェットによる要求量のクランプに加え、エラーが「症状」か「原因」かを判定して所有権を割り当てるという考え方を、数値シミュレーション付きで説明しています。可用性設計やフォールトトレランスの実務にそのまま適用できる知見です。
I built non-autoregressive decision models with RL a year ago (laya.convaiinnovations.com)
laya.convaiinnovations.com ·
チケットルーティングやプロンプトインジェクション判定のような定型判断を、生成LLMではなくミリ秒級の双方向エンコーダで実行するオープンソースモデルLayaの設計を詳述しています。ハルシネーションが構造的に不可能な確率出力や、51言語での評価で見つかった「英語モデルの信頼度が非ラテン文字で全く信用できない」という発見が示唆的です。アーキ上の限界も率直に書かれています。
Towards Self-Driving Codebases (blog.detail.dev)
blog.detail.dev ·
開発エージェントの限界はモデルではなく「エージェントが扱いやすい開発環境」にあると論じ、バグ検出・本番デバッグ・デザインシステム強制など任せられる領域と、必要な新しいプリミティブ(グローバルメモリ、エージェントが読めるテスト環境など)を整理しています。何をエージェントに任せ、何を人間がやるべきかの優先付けに役立つ視点です。
The CSS Zen Garden dream, finally shipped (josprague.com)
josprague.com ·
MozillaのFirefox.comをネイティブCSSのみ(1箇所の@importインライン化以外はビルド不要)で本番構築した事例を紹介します。CSSをシステムとして捉え、デザイナーの判断が本番まで変換されずに届く設計の価値を説いており、Tailwindなどフレームワーク依存を見直したいフロントエンドチームの議論の糧になります。