Inference Brew

TypeSafe AIがJev APIの価格と機能を詳細に発表

00:00 / --:--

← ホームへ戻る

TypeSafe AIがJev APIの価格と機能を詳細に発表

1. TypeSafe AIがJev APIの価格と機能を詳細に発表

TypeSafe AIは、ホスト型APIのウェイティングリストで利用可能になったJev「System One」モデルの詳細を発表しました。サービス価格は入力トークン10億個あたり42ドルで、出力トークンは無料です。このAPIにより、開発者はテキストではなく、型付けされた決定と信頼度スコア(0〜1)を受け取ることができ、単一の状態に対してChoice、Score、Noulといった質問タイプの並列実行をサポートします。

  • • Jev APIの価格は入力トークン10億個あたり42ドルで、出力トークンは無料です。
  • • APIは信頼度スコア(0〜1)を伴う型付けされた決定をサポートします。
  • • 開発者は単一の状態に対してChoice、Score、Noulの質問タイプを並列実行できます。
  • • ホスト型APIへのアクセスは引き続きウェイティングリスト制です。

開発者は、Jevの構造化された意思決定機能をソフトウェアワークフローに組み込むためのコストと技術的な統合要件を評価できるようになりました。

SOURCES

2. Linkup Researchがオープンソースのスパース埋め込みモデル「SPARSEUP」をリリース

SPARSEUPは、ModernBERTバックボーン上に構築された1億4900万パラメータのスパース埋め込みモデルです。Apache 2.0ライセンスでリリースされており、出力次元を削減するためにロジットシフトや位置ごとのtop-k展開といった技術的最適化を活用しています。TransformersおよびSentence Transformersライブラリと完全に互換性があり、容易に統合可能です。

  • • SPARSEUPは1億4900万パラメータのオープンソース・スパース埋め込みモデルで、Apache 2.0ライセンスでリリースされています。
  • • ModernBERTバックボーン上に構築されており、TransformersおよびSentence Transformersライブラリと互換性があります。
  • • BEIR-13ベンチマークで平均nDCG@10スコア56.4を達成しました。
  • • MS MARCO上でSeismic転置インデックスを使用した場合、クエリあたり約380マイクロ秒で97%以上のリコールを達成します。
  • • 技術的な最適化として、ロジットシフト15、位置ごとのtop-k展開12、および出力次元を削減するためのケースフォールディングが含まれています。

高速で高リコールなハイブリッド検索システムを構築するための、非常に効率的でApache 2.0ライセンスのスパース埋め込みモデルを開発者に提供します。

SOURCES

3. JevのオープンソースかつCPUフレンドリーな代替品「Von」がリリース

Vonは、TypeSafeのJevモデルのオープンソース代替品としてリリースされました。標準的なCPU上で最小限のメモリ要件で効率的に動作するように設計されており、専用のGPUハードウェアを必要とせずに迅速な応答時間を提供します。このプロジェクトは完全にオープンソースであり、GitHubおよびHugging Faceでホストされており、ローカルでの構造化された意思決定機能を求める開発者をターゲットにしています。

  • • VonはGitHubおよびHugging Faceでホストされている3億9500万パラメータのオープンソースモデルです。
  • • TypeSafeのJevのドロップイン代替品として機能し、1〜2GBのメモリを搭載したCPU上で完全に動作します。
  • • 応答時間は25〜300ミリ秒の範囲であり、GPUアクセラレーションはオプションですが必須ではありません。
  • • 開発者は、VonがすべてのベンチマークでJevを上回っていると主張しています。

最小限のメモリオーバーヘッドでCPU上でローカルに動作する、構造化された意思決定のための軽量なオープンソースの代替手段を開発者に提供します。

SOURCES

4. 超高速なコンピュータ操作決定モデル「CUA-S1-FORMS」がリリース

CUA-S1-FORMSは、コンピュータ操作タスク専用に設計された非常に専門的な70万6000パラメータの決定モデルです。30分未満で合成データを用いてトレーニングされており、スクリーンショットの処理やテキスト生成を行わずに、構造化された入力に基づいてフォーム操作を予測します。このプロジェクトはMITライセンスで完全にオープンソース化されており、合成データ生成、トレーニング、評価、およびドライバー統合コードが提供されています。

  • • CUA-S1-FORMSは、70万6000パラメータを持ち、チェックポイントサイズが2.8MBのMITライセンスのオープンソースモデルです。
  • • テキスト生成やスクリーンショット処理を行わず、構造化された入力に基づいてフォーム要素をCHECK、CLICK、またはSKIPするかを予測します。
  • • ローカルでのスコアリングは7〜9ミリ秒で完了し、ホスト型のJev呼び出しの260〜280ミリ秒と比較して高速です。
  • • 内部評価では、ホスト型Jevの83.6%に対し、全決定セットで99.7%の精度を達成しました。
  • • リリースには、合成データ生成、トレーニング、評価、およびドライバー統合コードが含まれています。

エージェント開発者は、重いLLMやスクリーンショット処理に頼ることなく、10ミリ秒未満でローカルに、非常に正確なフォーム入力の意思決定を高速実行できるようになります。

SOURCES

5. Postgres用全文検索拡張機能「TIN」がリリース

TIN (Text INdex) は、PostgresおよびNekiデータベース向けのGA版全文検索拡張機能です。Postgresのネイティブなctid値をドキュメント識別子として使用することで、セグメントマージ中のドキュメント番号の付け直しを回避し、書き込み増幅とCPUコストを削減します。この拡張機能は2レベルのビットマップエンコーディングを利用し、最新のCPUでの効率的なベクトル化を可能にします。

  • • TINはPostgresおよびNekiデータベース向けの一般提供(GA)全文検索拡張機能です。
  • • Postgresのネイティブなctid値をドキュメント識別子として使用し、個別のマッピング構造を不要にします。
  • • 2レベルのビットマップエンコーディングを利用してCPUのベクトル化を可能にします。
  • • ベンチマークでは、GIN、ParadeDB、pg_textsearchなどの代替手段よりも少なくとも8倍高速であることが示されています。
  • • ブール式、フレーズクエリ、スパンクエリ、ファジー/正規表現マッチング、および大文字小文字/アクセントの折りたたみをサポートしています。

外部検索インデックスの書き込み増幅や複雑なマッピング構造を必要とせず、Postgres内部で直接超高速な全文検索を実装できるようになります。

SOURCES

6. Apple Silicon上でローカルモデルを加速する推論エンジン「Inco Splash」

Inco Splashは、Apple Silicon向けに最適化されたオープンソースの推論エンジンであり、デコード速度においてOllamaやoMLXを大幅に上回ります。このエンジンは、サブエージェントに分岐するマルチエージェントワークフローを処理する際に特に効率的です。一般的なエージェントと直接統合でき、LM Studio Bionicアプリのランタイム設定内で構成可能です。

  • • Inco SplashはApple Silicon専用に構築されたオープンソースの推論エンジンです。
  • • Ollamaの最大3倍、oMLXの2倍のデコード速度を提供します。
  • • エージェントがサブエージェントに分岐する場合、パフォーマンスは最大4倍近くまで向上します。
  • • システム要件はM3チップ以降、macOS 26.4以降、および36GBのメモリです。
  • • Homebrew経由でインストール可能で、Claude Code、OpenCode、Codex、Hermesなどのエージェントと互換性があります。

Macハードウェア上でのローカルモデルテストとエージェント実行を大幅に加速し、マルチエージェントワークフロー実行時のレイテンシを低減します。

SOURCES

7. OpenClaw 2026.9.5がプラットフォーム2.0にアトミック更新とホットリロードを追加

2.0アーキテクチャを基盤とするOpenClaw 2026.9.5では、更新中もゲートウェイを稼働させ、失敗時に自動ロールバックを行う「アトミック更新」が導入されました。また、プラグインのホットリロード、読み取り専用の会話共有、および拡張されたGPT Live機能が追加されました。このバージョンでのデータベース移行には、アップグレード前のバックアップが必要であることに注意してください。

  • • OpenClaw 2026.9.5は、Node 24.16+または26.1+を必要とするMITライセンスのオープンソース個人AIエージェントです。
  • • 新しいアトミック更新機能により、更新中もゲートウェイが稼働し続け、更新失敗時には自動的にロールバックされます。
  • • プラグインのホットリロード、読み取り専用の会話共有(Session Share)、およびガイド付きのスペシャリストエージェント設定が導入されました。
  • • この更新ではデータベース移行が変更されており、アトミック更新では移行を元に戻せないため、アップグレード前に検証済みのバックアップが必要です。
  • • システムNodeとnpmを使用した新しいFreeBSD CLIインストールルートが追加されました。

より安全な本番環境の更新と、ホットリロードによる迅速なイテレーションを可能にすることで、2.0プラットフォームの安定性と開発者体験を向上させます。

SOURCES

Inference Brewを受信箱へ

1日5分。無料、いつでも解除できます。

Inference Brewを受信箱へ

1日5分。無料、いつでも解除できます。