- AI Database Newsletter
- Posts
- 【2026/9/14〜9/21】週刊AIニュース
【2026/9/14〜9/21】週刊AIニュース
TypeSafe AI「Jev」、Claude Codeのプロジェクト、Gemini 4、「減速で一致」した業界に、5,170億ドルと反トラスト訴訟が出てきた1週間
みなさん、こんにちは。
チャエンです。(自己紹介はこちら)
📣 お知らせ
【GPT-6対応】Codex完全解説講座を10/3(土)にやります
今週、私のXでいちばん伸びた投稿は「バイブコーディングで最初に作るべきは、画面でもコードでもなく『ER図』です」でした。96万インプレッション、ブックマーク5,358件。 正直、ここまで伸びるとは思っていませんでした。
なぜ伸びたのかは、はっきりしています。皆さん「AIに作らせたのに、途中で崩れる」で困っているからです。 そしてその原因のほとんどは、モデルの性能ではなく指示の出し方と設計の順番にあります。
というわけで、10月3日(土)12:00〜14:00に「【GPT-6対応】Codex完全解説講座」をやります。 8月のClaude Codeハーネス入門講座の続編で、今回はCodex側です。今週バズったER図の話も、講座の中で扱う予定です。
■ 当日やること
Codexの主要機能と設定を一通り解説(ハーネス設計込み)
資料とLPを作るところを実演
社内アプリを作る実演+その場で手を動かすワーク
Claude Codeの指示やSkillsを引き継ぐときの確認ポイント
完成物の確認と、次回のための指示の残し方
事前学習動画3本(約27分)と、指示ファイル・Skillのひな型を含む基本特典9点、さらに「初めてのCodex 完全教科書【PDF版】」をお渡しします。PDFは最新情報を反映して、講座当日中に送ります。
プログラミング未経験でも参加できます(ChatGPT Plus以上が対象)。オンライン開催・アーカイブあり、本編90分+質疑30分。早割7,480円は先着50名、通常9,800円、定員150名。 前回はいったん満席になったので、気になる方は早めにどうぞ!
今週は「文章を作らない小さなAIが、1週間でエージェントの作り方を書き換えた週」 でした。そして週末、先週の話に続きがありました。 先週のニュースで「主要ラボのトップ4人が『速度を落とす』で一致した」と書きました。その1週間後に出てきたのが、5,170億ドルのコンピュート契約と、反トラスト訴訟です。
契約は主に今後10年にまたがるもので、訴訟はまだ提起されただけ。ただ「言っていることと、押さえている計算資源の量が噛み合っていない」という指摘が、今週から現実のリスクとして株主と司法の側から出てきたという事実は動きません。
⚡️ 先週の注目AIニュース
① TypeSafe AI:判定専用モデル「Jev」公開 — 文章を作らないAIが、1週間でエージェントの作り方を変えた
9月15日、TypeSafe AIが「Jev」を公開しました。今週のAI業界は、ほぼこれ一色でした。
まず、これが何なのかを正確に。JevはLLMではありません。 通常の言語モデルはトークンを1つずつ生成して文章を作りますが、Jevは文章を一切作りません。 コンテキストと、あらかじめ定義した質問を渡すと、選択肢ごとの確率・スコア・真偽が型付きで返ってきます。同社はこれを「System One モデル」つまり人間でいう直感的な即断を担う層と呼んでいます。
作っているのは、ChatGPTにつながるRLHF研究の中心にいた人たちです。 元OpenAIの研究者ディオゴ・アルメイダ氏が率いるチームが、約2年のステルス期間を経て出しました。RLHFは、人間の評価を使って「人にとって自然で役立つ回答」をするようLLMを調整する手法で、ChatGPTが今の会話型AIになった重要技術の1つです。その中心にいた人たちが、次に作ったのが「会話しないAI」だったというのが面白いところです。
なぜこれが刺さったのか。「そのままシステムに組み込める」からです。 従来は「この取引は不正か?」とLLMに聞き、返ってきた文章をパースして、形式を検証して、たまに壊れてリトライする、という遠回りをしていました。Jevなら fraud: 0.93 が返ってくるので、「0.90を超えたら人間に回す」とif文に書けます。
特に普及の速さが異常でした。Vercel AI Gatewayに載った初日、有料チームの約13%が使いました。これはGPT-5.6ファミリーの2倍、Fable 5.1の6倍以上で、同Gateway史上いちばん速く採用されたモデルです。
そして今週後半は、実装ラッシュでした。
(1)ブラウザ操作。 Browser Useがjev-ultrafastを公開。
従来のブラウザエージェントは「1手ごとにスクリーンショットを撮って視覚モデルに見せる」ループでしたが、これはページを構造化DOMスナップショットに変え、要素に索引を振って、操作と対象要素を1回のリクエストで決めます。Google Flightsの片道検索が9.5秒→7.1秒(7,073ミリ秒)、ブラウザへの通信回数は中央値1,092回→101回(91%減)、1回の実行コストは約$0.0039です。
(2)文脈圧縮
Claude Codeの/compactは通常、古い履歴をLLMに要約させます。要約は不可逆なので、ファイルパスや正確なエラー文言が消えます。OSS実装 fast-jev-compaction は、全履歴を1回のリクエストで採点し、閾値以下だけ機械的に削る方式。残したものは原文のままです。実測で156,000→62,000トークン(使用率78%→31%)、16件中10件は原文Keep・6件だけ削除という結果が出ています。
(3)モデル振り分け
Claude Code向けMod jev-model-router は、サブエージェントを起動するたびに7つの固定Yes/No質問をJevに投げ、重み付き合計でOpus / Sonnet / Haikuのどれに回すかを決めます。 計算がコード側にあるので挙動が読めて再現するのがよくできている点です。
実務に活用したい場合は「LLMに判定だけさせている箇所」を探してください。 問い合わせの振り分け、優先度づけ、品質チェック、ガードレール、A/Bのどちらを採るか。今週はJevを応用して、100倍安くて100倍速い選択肢が出てきました。 9月25日まではVercel AI Gateway上で無料なので、置き換えて実測するなら今週です。


Reply