신규 계정에 5달러 크레딧…랭체인, 같은 날 판정 실험 공개
타입세이프 AI가 20일(현지시간) 의사결정 모델 Jev를 대기열 없이 전원에게 개방했다.
닷새 전 조기 접근으로 열린 뒤 게이트웨이와 평가 도구가 연달아 붙었다. 개방 당일 랭체인은 Jev를 에이전트 판정기로 쓴 비교 실험을 공개했고, 라이트LLM도 같은 날 연동을 올렸다. 회사는 콘솔 로그인으로 바로 키를 발급받게 했고, 모든 신규 이용자에게 약 1억2000만 토큰에 해당하는 5달러 크레딧을 지급한다.
대기열 닷새 만에 전원 개방
타입세이프는 15일 스텔스에서 나와 Jev를 조기 접근으로 공개하면서 대기열을 걸었다. 창업자 디오고 알메이다는 전 오픈AI 연구자다. 공개글은 Jev를 시스템 원 모델의 첫 공개작으로 적었고, 이름 시스템 원은 빠른 직관적 판단을, 학습 방식은 보정된 결정에 맞춘 강화학습을 가리킨다. Jev는 비정형 상태가 들어가고 타입이 정해진 확률적 결정이 나오는 프론티어급 함수 호출로도 묘사됐다.
우리는 병 속에 번개를 넣었는데, 그래도 쓸모가 없다.
— 디오고 알메이다, 테크크런치 9월 18일 · “We have lightning in a bottle, and yet it is not useful”
테크크런치에 따르면 출시 직후 수요가 폭증해 잠시 API를 제공하지 못하는 상태까지 갔다. 버셀 엔지니어 프라닛 샤르마는 명령 안전 분류기를 GPT-5.6 루나에서 Jev로 바꿨더니 결과가 5–18배 빨라졌다. 브리오 AI CTO 니킬 무드홀카르는 업무 메일 분류에서 제미나이가 정확도는 조금 더 높았지만 Jev가 10–20배 싸다고 했다.
실제 확률을 돌려주는 유일한 모델이라 워크플로 자동화에 이상적이다.
— 니킬 무드홀카르, 테크크런치 9월 18일 · “it is the only one that hands back a real probability which makes it ideal for automating workflows!!”
버셀은 18일 AI 게이트웨이에서 Jev가 24시간 만에 유료 팀의 약 13%에 쓰였다고 집계했다. GPT-5.6 계열의 두 배, 페이블 5.1의 여섯 배 이상이었다. 유료 팀의 10%에 도달하는 데 18시간이 걸렸고, 게이트웨이에서는 25일까지 무료 프로모션이 걸려 있었다.
Jev, 문장 없이 결정만 반환
공식 문서에 따르면 Jev는 상태를 받아 선택·점수·예아니오 확률을 한 번에 병렬로 돌려준다. 엔드포인트는 POST /v1/systemone이고, 현재 안정 버전은 jev-1.13.0이다. 문장을 생성하지 않아 미리 정한 스키마 밖 답을 내지 않는다. 입력은 텍스트만 받으며 이미지·음성은 받지 않는다. 선택지는 최대 255개까지 둘 수 있다.
입력은 백만 토큰당 0.042달러, 출력은 무료다. 종단 지연은 70–500밀리초, 요청당 컨텍스트는 6만4000토큰이다. 초당 25만 토큰·분당 1200요청이 공개 한도다. 수요가 커 한도가 예고 없이 바뀔 수 있다. 공개글의 자사 워크플로 평가에서는 프론티어 언어모델 대비 최대 193.6배 빠르고 444.6배 싸다고 나왔다. 다만 그 수치는 회사 팀이 만든 워크플로 기준이며 실제 이득의 상단에 가깝다고 적혀 있다.
랭체인, 판정 일관성·비용 측정
랭체인은 20일 날씨 에이전트 실행 다섯 건을 100번씩 재현해 Jev와 GPT-5.6 루나·테라, 클로드 소넷 4.6을 비교했다. 이진 합불 판정에서 Jev는 사람 라벨과 500건 모두 일치했다. 테라는 99.8%, 루나는 96.4%, 클로드는 80.0%였다.
호출당 평균 0.44초·0.00035달러였고, 같은 실험에서 클로드는 호출당 0.02811달러·총 28.17달러가 들었다. Jev 쪽 총비용은 0.34달러였다. 연속 품질 점수 분산은 비교군보다 92–913배 낮았다. 같은 날 라이트LLM도 Jev 패스스루를 릴리스 후보에 넣었다. 버셀이 적은 용도는 다음 도구 선택, 워크플로 계속·중단 판단, 출력 검증과 가드레일이다.
다른 에이전트 검증은 미정
실험 글은 결과가 다른 에이전트·프로덕션으로 이어지는지는 더 봐야 한다고 적었다. 타입세이프와 랭체인은 22일 공동 라이브스트림을 예고했다.
