Inference Brew

TypeSafe AI, Jev API 가격 및 기능 상세 공개

00:00 / --:--

← 메인으로

TypeSafe AI, Jev API 가격 및 기능 상세 공개

1. TypeSafe AI, Jev API 가격 및 기능 상세 공개

TypeSafe AI는 호스팅된 API 대기자 명단을 통해 이용 가능한 Jev 'System One' 모델에 대한 추가 세부 정보를 제공했습니다. 서비스 가격은 입력 토큰 10억 개당 42달러이며, 출력 토큰은 무료로 제공됩니다. 이 API를 통해 개발자는 텍스트 대신 유형화된 결정과 신뢰도 점수(0~1)를 받을 수 있으며, 단일 상태에 대해 Choice, Score, Noul 질문 유형의 병렬 실행을 지원합니다.

  • • Jev API 가격은 입력 토큰 10억 개당 42달러이며, 출력 토큰은 무료입니다.
  • • API는 신뢰도 점수(0~1)가 포함된 유형화된 결정을 지원합니다.
  • • 개발자는 단일 상태에 대해 Choice, Score, Noul 질문 유형을 병렬로 실행할 수 있습니다.
  • • 호스팅된 API에 대한 액세스는 여전히 대기자 명단으로 제한됩니다.

개발자들은 이제 Jev의 구조화된 의사결정 기능을 소프트웨어 워크플로우에 통합하기 위한 비용과 기술적 요구 사항을 평가할 수 있게 되었습니다.

SOURCES

2. Linkup Research, 오픈소스 희소 임베딩 모델 SPARSEUP 출시

SPARSEUP은 ModernBERT 백본을 기반으로 구축된 1억 4,900만 파라미터의 희소 임베딩 모델입니다. Apache 2.0 라이선스로 출시된 이 모델은 로짓 시프팅(logit shifting) 및 위치별 top-k 확장과 같은 기술적 최적화를 활용하여 출력 차원을 줄입니다. Transformers 및 Sentence Transformers 라이브러리와 완벽하게 호환되어 쉽게 통합할 수 있습니다.

  • • SPARSEUP은 1억 4,900만 파라미터를 가진 오픈소스 희소 임베딩 모델로, Apache 2.0 라이선스로 출시되었습니다.
  • • 이 모델은 ModernBERT 백본을 기반으로 하며 Transformers 및 Sentence Transformers 라이브러리와 호환됩니다.
  • • BEIR-13 벤치마크에서 평균 nDCG@10 점수 56.4를 기록했습니다.
  • • MS MARCO에서 Seismic 역색인을 사용하여 쿼리당 약 380마이크로초 내에 97% 이상의 재현율을 달성합니다.
  • • 기술적 최적화에는 15의 로짓 시프트, 12의 위치별 top-k 확장, 출력 차원을 줄이기 위한 대소문자 통합(case folding)이 포함됩니다.

개발자들에게 빠르고 높은 재현율을 가진 하이브리드 검색 시스템을 구축할 수 있는 매우 효율적인 Apache 2.0 라이선스 희소 임베딩 모델을 제공합니다.

SOURCES

3. Jev의 오픈소스 및 CPU 친화적 대안인 Von 출시

Von은 TypeSafe의 Jev 모델에 대한 오픈소스 대안으로 출시되었습니다. 표준 CPU에서 최소한의 메모리 요구 사항으로 효율적으로 실행되도록 설계된 Von은 전용 GPU 하드웨어 없이도 빠른 응답 시간을 제공합니다. 이 프로젝트는 완전히 오픈소스로 GitHub와 Hugging Face에 호스팅되어 있으며, 로컬에서 구조화된 의사결정 기능을 찾는 개발자를 대상으로 합니다.

  • • Von은 GitHub와 Hugging Face에 호스팅된 3억 9,500만 파라미터 규모의 오픈소스 모델입니다.
  • • 이 모델은 TypeSafe의 Jev를 대체할 수 있으며, 1~2GB 메모리의 CPU에서 완전히 실행됩니다.
  • • 응답 시간은 25~300밀리초 사이이며, GPU 가속은 선택 사항이지만 필수는 아닙니다.
  • • 개발자는 Von이 모든 벤치마크에서 Jev를 능가한다고 주장합니다.

최소한의 메모리 오버헤드로 CPU에서 로컬로 실행되는 구조화된 의사결정을 위한 경량 오픈소스 대안을 개발자에게 제공합니다.

SOURCES

4. 초고속 컴퓨터 사용 의사결정을 위한 CUA-S1-FORMS 출시

CUA-S1-FORMS는 컴퓨터 사용 작업을 위해 특별히 설계된 고도로 전문화된 70만 6천 파라미터 규모의 의사결정 모델입니다. 30분 이내에 합성 데이터로 학습된 이 모델은 스크린샷을 처리하거나 텍스트를 생성하지 않고 구조화된 입력을 기반으로 양식 작업을 예측합니다. 이 프로젝트는 MIT 라이선스로 완전히 오픈소스화되었으며, 합성 데이터 생성, 학습, 평가 및 드라이버 통합 코드를 제공합니다.

  • • CUA-S1-FORMS는 70만 6천 개의 파라미터를 가진 MIT 라이선스 오픈소스 모델로, 체크포인트 크기는 2.8MB입니다.
  • • 이 모델은 텍스트 생성이나 스크린샷 처리 없이 구조화된 입력을 기반으로 양식 요소를 CHECK, CLICK 또는 SKIP할지 여부를 예측합니다.
  • • 로컬 점수 산정은 7~9밀리초가 소요되며, 이는 호스팅된 Jev 호출의 260~280밀리초와 비교됩니다.
  • • 내부 평가에서 이 모델은 전체 결정 세트에 대해 99.7%의 정확도를 달성했으며, 호스팅된 Jev는 83.6%를 기록했습니다.
  • • 릴리스에는 합성 데이터 생성, 학습, 평가 및 드라이버 통합 코드가 포함되어 있습니다.

에이전트 개발자가 무거운 LLM이나 스크린샷 처리 없이 10밀리초 이내에 로컬에서 매우 정확한 양식 작성 결정을 내릴 수 있게 합니다.

SOURCES

5. Postgres용 TIN 전문 검색 확장 기능 출시

TIN(Text INdex)은 Postgres 및 Neki 데이터베이스를 위한 정식 출시(GA) 전문 검색 확장 기능입니다. TIN은 기본 Postgres ctid 값을 문서 식별자로 사용하여 세그먼트 병합 중 문서 번호 재지정을 방지함으로써 쓰기 증폭과 CPU 비용을 줄입니다. 이 확장 기능은 2단계 비트맵 인코딩을 활용하여 최신 CPU에서 효율적인 벡터화를 가능하게 합니다.

  • • TIN은 Postgres 및 Neki 데이터베이스를 위한 정식 출시(GA) 전문 검색 확장 기능입니다.
  • • 이 확장 기능은 Postgres의 기본 ctid 값을 문서 식별자로 사용하여 별도의 매핑 구조가 필요하지 않습니다.
  • • 2단계 비트맵 인코딩을 활용하여 효율적인 CPU 벡터화를 가능하게 합니다.
  • • 벤치마크에 따르면 TIN은 GIN, ParadeDB, pg_textsearch와 같은 대안보다 최소 8배 빠릅니다.
  • • 불리언 표현식, 구문 쿼리, 범위 쿼리, 퍼지/정규식 매칭, 대소문자/악센트 통합을 지원합니다.

개발자가 외부 검색 인덱스의 쓰기 증폭이나 복잡한 매핑 구조 없이 Postgres 내부에서 초고속 전문 검색을 구현할 수 있게 합니다.

SOURCES

6. Apple Silicon에서 로컬 모델을 가속화하는 Inco Splash 추론 엔진

Inco Splash는 Apple Silicon에 최적화된 오픈소스 추론 엔진으로, 디코딩 속도 면에서 Ollama 및 oMLX를 크게 능가합니다. 이 엔진은 하위 에이전트로 분기되는 멀티 에이전트 워크플로우를 처리할 때 특히 효율적입니다. 인기 있는 에이전트와 직접 통합되며 LM Studio Bionic 앱 런타임 설정 내에서 구성할 수 있습니다.

  • • Inco Splash는 Apple Silicon 전용으로 구축된 오픈소스 추론 엔진입니다.
  • • 이 엔진은 Ollama보다 최대 3배, oMLX보다 2배 빠른 디코딩 속도를 제공합니다.
  • • 에이전트가 하위 에이전트로 분기될 때 성능이 거의 4배까지 빨라집니다.
  • • 시스템 요구 사항은 M3 칩 이상, macOS 26.4 이상, 36GB 메모리입니다.
  • • Homebrew를 통해 설치할 수 있으며 Claude Code, OpenCode, Codex, Hermes와 같은 에이전트와 호환됩니다.

Mac 하드웨어에서 로컬 모델 테스트 및 에이전트 실행을 크게 가속화하여 멀티 에이전트 워크플로우 실행 시 지연 시간을 줄여줍니다.

SOURCES

7. OpenClaw 2026.9.5, 2.0 플랫폼에 원자적 업데이트 및 핫 리로딩 추가

2.0 아키텍처를 기반으로 하는 OpenClaw 2026.9.5는 업데이트 중에도 게이트웨이를 운영 상태로 유지하고 실패 시 자동 롤백을 제공하는 원자적 업데이트 기능을 도입했습니다. 또한 이번 릴리스에는 플러그인 핫 리로딩, 읽기 전용 대화 공유, 확장된 GPT Live 기능이 추가되었습니다. 사용자는 이 버전의 데이터베이스 마이그레이션 시 업그레이드 전 백업이 필요하다는 점에 유의해야 합니다.

  • • OpenClaw 2026.9.5는 Node 24.16+ 또는 26.1+가 필요한 MIT 라이선스 오픈소스 개인 AI 에이전트입니다.
  • • 새로운 원자적 업데이트 기능은 업데이트 중에도 게이트웨이를 운영 상태로 유지하며 실패 시 자동으로 롤백합니다.
  • • 이번 릴리스에는 플러그인 핫 리로딩, 읽기 전용 대화 공유(Session Share), 가이드형 전문가 에이전트 설정이 도입되었습니다.
  • • 이 업데이트에서는 데이터베이스 마이그레이션이 변경되었으므로, 원자적 업데이트가 마이그레이션을 되돌리지 않기 때문에 업그레이드 전 검증된 백업이 필요합니다.
  • • 시스템 Node와 npm을 사용하는 새로운 FreeBSD CLI 설치 경로가 추가되었습니다.

더 안전한 프로덕션 업데이트와 핫 리로딩을 통한 빠른 반복을 가능하게 하여 2.0 플랫폼의 안정성과 개발자 경험을 향상시킵니다.

SOURCES

Inference Brew를 인박스로

하루 5분. 무료, 언제든 해지할 수 있습니다.

Inference Brew를 인박스로

하루 5분. 무료, 언제든 해지할 수 있습니다.