• Mavericks AI ニュース
  • Posts
  • ChatGPT研究者が2年間極秘開発していたAIモデル「Jev」が突如公開!文章を生成できない代わりに超高速かつハルシネーションなし!?

ChatGPT研究者が2年間極秘開発していたAIモデル「Jev」が突如公開!文章を生成できない代わりに超高速かつハルシネーションなし!?

はじめての家でも片付けやタオル畳みができる!Figureがロボット向けAI「Helix 2.5」発表

NoLang運営チームよりお届けしている、Mavericks AIニュースをご覧いただきありがとうございます!

【お知らせ】 ポッドキャストをはじめました!

本ニュースレターを執筆している岩切をはじめとして、NoLang運営メンバーが最新AIトピックを紹介する📻ビデオポッドキャストを配信開始しました!

実際にAIを試すデモを交えながら、楽しく、気軽にAIトピックをキャッチアップできるよう配信していきますので、是非ご笑覧ください!

YouTubeでの視聴がおすすめです。Spotify、Apple Podcasts、Amazon Music、LISTENでも配信しています!

1. 直近のビッグニュースTop 3

① ChatGPT研究者が、文章を生成できない代わりに超高速なAIモデル「Jev」を発表!

  • 元OpenAIの研究者、Diogo Almeida氏創業のTypeSafe AIが、2年間のステルス期間を経て、新しいAIモデル「Jev」を提供開始

  • 用意された選択肢の中から最も適切なものを選ぶ「分類器」であり、テキストは生成できない代わりに、高速かつ安価に「判断」ができる

  • 同社の計測によれば、GPT-5.6, Claude 5などの既存LLMと比較して、20-200倍高速で、40-400倍入力トークンが安価

🐬 注目ポイント

国内外問わずSNSを席巻したリリースでしたが、ポッドキャストでも述べた通り、かなり過大評価されていたと感じています。

小型モデルGPT-5.6 Lunaと比較すると、価格はせいぜい約4分の1。平均応答時間は0.4秒と高速ですが、その差が決定的な意味を持つのは、0.1秒の遅延も許されないリアルタイム処理など、限られた用途でしょう。画像入力にも対応しておらず、現時点で主に恩恵を受けるのは、一部のエンジニアや研究者だと思います。

一方、音声対話AIやロボットなど、現実世界とインタラクションするAIにおいては、小さな速度改善が劇的な体験の変化をもたらします。実際、今年7月に発表されたGPT Liveの性能には衝撃を受けました。こうしたマルチモーダルなリアルタイムAIがさらに実用的になれば、AIとの関わり方が大きく変わる転換点になるかもしれません。

② はじめての家でも片付けやタオル畳みができる!Figureがロボット向けAI「Helix 2.5」発表

  • 米国時間9月17日、米Figure社がロボット向けAIモデル「Helix 2.5」を発表

  • 初めて訪問した30軒の家にて、おもちゃの片付け、タオル畳み、ベッドメイキングといった家事を56%の精度でこなすことに成功

  • 世界108か国、週間4万4000人超がデータ収集に参加する「Index」に収められた人間の作業動画を事前学習に使用

🐬 注目ポイント

家が変われば、家具の配置や物の置き場所も変わります。私たち人間はこうした違いに柔軟に対応できますが、ロボットにとっては難題です。学習した環境ではうまく動けても、場所が変わると性能が大きく落ちてしまうことが課題でした。

今回、Helix 2.5を搭載したヒューマノイドは、初めて入る30軒の家で家事に挑戦し、「4枚のタオルをすべて畳んでかごに入れる」「枕と掛け布団を整える」「おもちゃを片付ける」という3種類の作業で、56%の成功率を記録しました。まだ安心して任せられる水準には程遠いですが、訪問先で教え直すことなく、半数以上の試行で完了できた点には進歩を感じます。

家庭に先行して、工場では導入が進んでいます。すでに同社のFigure 02がBMWの生産を支え、今年6月にはFigure 03を物流業務に導入すると発表されました。家庭への普及はこれからですが、CEOのAdcock氏は昨年3月の対談で、将来の大量生産を前提に、ヒューマノイドを2万〜3万ドルで販売できるとの見通しを示しています。

Fable, GPT-6に代表されるように、今年に入ってもAIの性能向上は止まることを知りません。「知能」の観点からはいよいよ実用的なヒューマノイド実現に向けたピースが揃いつつあるとも指摘されています。

③ ドラマ「VIVANT」にVeo 3が使われていた!制作作業が2週間から3日に

  • TBSが「VIVANT」シーズン2の爆破映像にGoogleの動画生成AI「Veo 3」を活用したことを明らかに。TBSドラマでの生成AI導入は初めて

  • 初回に登場する病院の爆破映像が対象。従来2週間かかる作業が3日で完了し、制作時間を約8割短縮

  • 生成した映像から使える部分を選び、VFX(映像の合成・加工)で組み合わせて品質を高めた

🐬 注目ポイント

爆破シーンは、実際に爆発を起こすにも、VFXで炎を一つ一つ作り込むにも、費用と手間がかかります。生成AIによる効率化が、特に生きる場面であったわけです。

今回使われたVeo 3は、昨年5月に公開されたモデルです。その後も動画生成AIは進化を続け、Seedance 2.5などの最先端モデルでは、映像の精細さや動きの自然さが格段に向上しています。

Netflixも今年7月、制作に生成AIを活用した自社作品が約300本にのぼると明らかにしました。私たちが気づかないところで、AIが作った映像は着実に身近な作品へ入り始めています。

2. これだけは知っておこう!AIエージェントを使いこなすコツ

今週もClaude Code、Cowork、CodexといったAIエージェントを使っている方に向けて、AIの能力を最大限に引き出すためのコツをご紹介します!

① 入力トークン単価を最大1/40にできる「キャッシュ」をフル活用しよう!

以前、セッションを適切に切り替えることで、トークン使用量を大きく減らせることをお伝えしました。これに加えて、最近ますます重要になっているのが「キャッシュ」の活用です。

実はAIエージェントでは、同じセッションで会話を重ねるたびに、それまでの質問や回答もまとめて再入力されます。短い指示を一つ送っただけでも、裏側では長い会話履歴を読み込んでいるわけです。

そこで役立つのがキャッシュです。前回と同じ部分については、再利用によって次回以降は安い単価で読み込めます。Claude CodeやCodexでは、この仕組みが自動的に使われています。

しかも、その割引率はかなり大きいものです。通常入力と比べたAPI単価では、CodexのGPT-6 Astraは1/10、Claude CodeのOpus 5.5は1/20。そしてFable 5.1に至っては、なんと1/40になります! 同じ履歴を読み込む場合でも、キャッシュが効くかどうかで費用が大きく変わるのです。

ただし、キャッシュはいつまでも残るわけではありません。Claude Codeでは1時間、Codexでは少なくとも30分とされており、キャッシュが使われるたびに延長されますが、使わないまま時間が経つと、再開時に履歴を処理し直す必要があるのです。

そのため、セッションで進めている作業は、長時間放置せず、区切りのよいところまでまとめて進めるのがおすすめです。またやむを得ず長く席を外す場合は、引き継ぎ書を作成して別のセッションで作業を再開することで、入力トークン量をおさえると良いでしょう。

さいごに

最後までお読みいただきありがとうございました。
サービス改善のため、アンケートにご協力いただけると幸いです。「ワンクリック」で完了します。

一番ためになったのは?

Login or Subscribe to participate in polls.

運営元の紹介

株式会社Mavericksは2023年、世界に先駆けてリアルタイム動画生成AIサービス「🐬NoLang」をリリースし、現在15万超のユーザーを抱えるまでに成長してきました。法人向けの展開も行い、法人プランのユーザー数は100社を突破しています。また、大手企業との協業や独自開発案件にも着手しており、唯一性の高い価値創出が加速しています。

今後、NoLangを中核に据えながら事業をさらに成長させるべく、エンジニア・デザイナー、営業・マーケティング担当、そして全方位で学生インターンの募集を開始しています。法人営業の担当や、SNS運用などに興味のある方も、ぜひこちらのフォームより一度ご応募ください。

採用ページでは、弊社の実績、求める人物像に加え、メンバーの声をインタビュー形式で掲載しております。興味を持った方はぜひご覧ください。お問い合わせは、[email protected]にて受け付けています。https://

また、私たちはニュースレターだけでなくXやInstagramにおいても、開発プロダクトに関する最新情報について積極的に発信しています。こちらも是非チェックしてみてください!