CASE / sengpttr2026-09-18
MEDIA / 1video
Ssengpt@sengpt
코드·개발자 도구JEV
arkadaşlar
arkadaşlar
jev'e early access aldım ve test etmeye başladım ve gerçekten çok impressed olduğumu söylemem lazım
sadece şu kaydettiğim demoyu bi izleyin lütfen.
kesinlikle hızlandırılmış bir video değil. 4 tane jev karşılıklı 101 oynuyor ve oyunun hızına bir bakın.
beni takip edenler bilir.
yıllardır her yeni model çıktığında bizim meşhur 101 okey oyununu oynatırım.
benim kişisel benchmarklarımdan biridir ai modellere 101 oynatmak.
kimi cahiller ehi ehi ehi adam modele 101 oynatıyor dese de asıl benchmark budur. bizim eve bundan başka benchmark girmez.
çünkü 101 göründüğünden çok daha zor bi testtir
modelin önce oyunun kendine özgü kurallarını anlaması, sonra oyun boyunca bunlara eksiksiz uyması gerekiyor. ama bu da yetmiyor. elindeki taşları, masa'nın durumunu yani son state'ini ve rakiplerin hamlelerini değerlendirip doğru kararı zamanında vermesi gerekiyor. yani masanın anlık state'ini de her modelin bilmesi ve hızlı karar alması gerekiyor
özellikle bu son kısım bugüne kadar modellerin en çok zorlandığı yerdi
openai, anthropic vs. modelleri iyi karar verebilse bile bazen 30 saniye veya daha fazla düşünüyor. gerçek zamanlı oyunda iyi karar vermenin tek başına hiç bir anlamı yok çünkü doğru kararı verdin ama sıranı kaçırdın ise pek bi işe yaramıyor. dolayısıyla hız + doğru karar en önemli metrik burada.
jev duyurulur duyurulmaz early access'e başvurmamın sebebi de buydu. direkt aklıma 101 benchmarkım geldi
jev aslında konsept olarak çok da yabancı bi şey değil.
kabaca generalized zero-shot classifier diyebiliriz. uzun uzun metin üretmek yerine kendisine verilen state üzerinde tanımlı seçenekler arasında karar veriyor
ama güzel olan bunu ne kadar hızlı yaptığı
benim 3-4 yıldır farklı modellerle denediğim ama bir türlü tam verim alamadığım ai'ın 101 oynaması problemini jev çözmüş gibi görünüyor
kararları milisaniyeler içinde veriyor ve oyun boyunca oldukça isabetli oynuyor
bence asıl önemli tarafı da 101 değil zaten
101 bunun küçük bir demosu
computer use, browser use, hız gerektiren oyunlar vs gibi alanlarda yani modelin sürekli ne yapmam lazım diye düşündüğü her senaryoda jev hızır gibi yetişiyor. milyonlarca küçük karar için çok çok ideal gözüküyor
milyonlarca mini karar için 30 saniye düşünen dev bir generative model gerçekten işlevsiz. onun yerine 100 milisaniyede yeterince iyi karar veren bir model daha mantıklı
jev'in yaptığı da bu
bence müthiş bir ihtiyacı karşılıyor ve karşılayacak.
hatırlayın 4g gibi hızlı internet altyapıları yokken tiktok vs gibi realtime streamingler mümkün değildi. tiktok'un ortaya çıkabilmesi için 4g ya da hızlı internet gerekliydi. şimdi jev = 4g. hız konusunu çözüyor. dolayısıyla jev'in tiktoku yani jev sayesinde ne gibi yenilikler ortaya çıkacak acaba görürüz önümüzdeki dönem.
eğer anlık olarak milyonlarca mini karar alınması gereken bir konseptiniz varsa çok ideal bir şey jev.
openai ve anthropic gibi şirketlerin de benzer şekilde generation ile decision'ı zamanla birbirinden daha fazla ayıracağını düşünüyorum
54,709조회
169좋아요
178저장
8리포스트
인용 게시물
DDiogo Almeida@CompleteSkeptic
After co-inventing ChatGPT, I kept asking myself: why have superhuman chat models not led to AGI? I’ve spent the last 2 years in stealth building a new way to train models (RLCD), and a new type of frontier AI model that we are releasing today: Jev • 20-200x faster • 40-400x https://t.co/JSybNG2BKJ
원문 보기