TypeSafe · Erken Erişim

Jev ile metinleri geniş ölçekte değerlendirin.

Jev, TypeSafe tarafından geliştirilen yapısal bir değerlendirme modelidir. Kesin mantıksal (boolean) değerler, seçimler ve puanlar üretir. Her istekte 32 bağımsız soruyu paralel olarak işleyebilirsiniz.

Illustration of Jev turning a block of text into three structured judgment cards: a probability bar, a multiple-choice selector, and an ordered score bar

Jev'i doğrudan çalışma alanınızdan çağırın.

Yapısal değerlendirmeler istediğinizde Kollab Asistanı Jev'i otomatik olarak çağırır. Betikler (script) ve veri hatları (pipeline) için CLI üzerinden manuel olarak da çalıştırabilirsiniz.

Kur ve çağır
npm install -g @kollab/cli
kollab login

echo '{
  "state": "Help! My payouts have been failing for 3 days.",
  "questions": {
    "is_urgent": { "type": "noul", "instructions": "Does this convey urgency?" },
    "department": { "type": "choice", "instructions": "Which team should handle this?",
      "criteria": { "billing": "Payments, invoicing, refunds", "technical": "Bugs, outages, integrations", "sales": "Pricing, upgrades, new accounts" } }
  }
}' | kollab tool run jev --json

Kollab model cephaneliğinin bir parçası.

Metin, görüntü, video ve ses görevleri için eksiksiz bir model paketinin yanında Jev'e erişin.

Görüntüler
GPT Image 2
Video
Seedance 2 · Veo 3
Ses
Grok TTS · Grok STT
Görme
Visual Q&A
Arama ve veri
Web search · Deep search · Social data fetch
Sohbet modelleri
Claude · GPT · Gemini · Grok · Kimi · DeepSeek · GLM

Yapısal değerlendirme kullanım durumları.

Jev ile özel değerlendirme görevleri çalıştırın.

Performans karşılaştırmaları.

Toplu sınıflandırma görevleri için hızlı yürütme ve yüksek tutarlılık.

Resmi Karşılaştırmalar
Paralele Karşı Sıralı
10 kat daha hızlı · 12,2 kat daha ucuz

Tek çağrıda 13 soru: 0,27 sn, buna karşılık 13 ayrı çağrı için 2,71 sn

TypeSafe cookbook
Resmi Karşılaştırmalar
Aday Yeniden Sıralama İlk 10 Doğruluğu
%38 → %62

CLERC yasal veri kümesi, 40 sorgu, BM25 ilk 30 kısa listesi

TypeSafe cookbook
Bağımsız Değerlendirmeler
Claude Fable 5.1 ile Uyuşma
%91,5

6.003 derecelendirme kontrol edildi · milyon değerlendirme başına $160'a karşılık $33.000

Good Start Labs
Bağımsız Değerlendirmeler
Yazım Hatası Tespit Hızı
25 kat daha hızlı

Medyanda 0,35 sn'ye karşılık 8,83 sn · eklenen 7 hatadan 6'sı tespit edildi

Every.to
Bağımsız Değerlendirmeler
Spam Zero-Shot Sınıflandırma Doğruluğu
%98,64

5.733 e-postalık test seti, ayarlanmış bir TF-IDF temel modelinin %98,87'lik değerine oldukça yakın

bitnovus (bağımsız)

Sıkça sorulan sorular.

Jev nedir ve standart sohbet modellerinden farkı nedir?+

Jev, yapısal bir değerlendirme modelidir. Kesin mantıksal (boolean) değerler, seçimler ve puanlar üretir. Karşılıklı konuşma metinlerini tamamen atlar ve saf veri döndürür.

Kollab'da Jev'i nasıl kullanabilirim?+

Kollab Asistanı, yapısal değerlendirme gerektiren bir görev tanımladığınızda Jev'i otomatik olarak çağırır. Ayrıca terminalinizden `kollab tool run jev` komutunu kullanarak onu doğrudan da çalıştırabilirsiniz.

Fiyatlandırma nasıl hesaplanıyor?+

Girdi (input) token'larının maliyeti milyon başına $0,042'dır. Çıktı (output) token'ları ise tamamen ücretsizdir.

Jev Çince, Japonca ve Korece dillerini destekliyor mu?+

Evet. Ancak Çince, Japonca ve Korece (CJK) dillerindeki doğruluk oranı şu anda İngilizce'ye kıyasla daha düşüktür.

Güven olasılıkları kesinlikle doğru mu?+

Bağımsız denetimler, Jev'in çıktı olasılıklarının kesin bir şekilde kalibre edilmediğini göstermektedir. Bunları göreceli, monoton puanlar olarak değerlendirin. Yüksek riskli görevlerde rastgele kontroller (spot-check) yapmanızı öneririz.

Jev görüntü veya ses işleyebilir mi?+

Jev yalnızca 80.000 karaktere kadar düz metinleri işler. Öncelikle sesi yazıya dökmeli veya görüntülerden metin çıkarmalısınız. Kollab, doğrudan medya işleme için GPT Image 2 ve Grok STT gibi başka modeller sunmaktadır.

Jev ile metinleri değerlendirmeye başlayın.

Doğrudan çalışma alanınızda yüksek hacimli sınıflandırma ve puanlama görevleri çalıştırın.