Gemini 1.5'teki XNUMX milyon token bağlam penceresi neden oyunun kurallarını değiştiriyor?

Doğal dil işleme (NLP) alanı, son yıllarda insan dilini anlama ve işlemede olağanüstü yetenekler sunan büyük dil modellerinin (LLM'ler) ortaya çıkmasıyla muazzam bir devrime tanık oldu. Gemini 1.5, bu modellerin en yenilerinden biridir ve muazzam bağlamsal olanaklar sunar. Google Gemini 1.5 modeli artık XNUMX milyon benzersiz simgeden oluşan devasa bir bağlam penceresiyle birlikte geliyor ve ChatGPT, Claude ve diğer yapay zeka destekli sohbet robotları gibi doğrudan rakiplerini gölgede bırakıyor.

Gemini 1.5'teki bir milyon jetonlu bağlamsal pencere, modelin dili daha derin ve daha doğru bir şekilde anlamasına olanak tanıyan bir oyun değiştiricidir. Daha büyük bağlamsal kapasiteyle model, belirli bir kelimeyi veya cümleyi çevreleyen daha fazla kelimeyi ve ifadeyi analiz edebilir ve bu da anlamın daha iyi çıkarımına yardımcı olur. Doğrulamak Google'ın Gemini yapay zekası geliyor: Yapay zeka dünyasında ChatGPT'den daha mı öne çıkıyor?

Bağlam penceresi nedir?

Bir kavramın açıklanması veya bir metnin özetlenmesi gibi sorularınıza yanıt verirken yapay zeka modellerinin yanıt oluşturmak için dikkate alabilecekleri veri miktarı sınırlıdır. Dikkate alınabilecek maksimum metin boyutuna bağlam penceresi adı verilir.

İşte bu kavrama bakmanın başka bir yolu. Diyelim ki alışveriş listeniz olmadan sebze ve ev malzemeleri satın almak için bir markete gittiniz. Alışveriş yaparken hatırladığınız maksimum yiyecek sayısı içerik penceresidir. Ne kadar çok alışverişi hatırlarsanız, belirlediğiniz alışveriş planlarınızı mahvetmeme şansınız o kadar artar. Benzer şekilde, bir yapay zeka modelinin bağlam penceresi ne kadar büyük olursa, modelin size en iyi sonuçları sağlamak için ihtiyaç duyduğu her şeyi hatırlama olasılığı da o kadar artar.

Bu yazının yazıldığı sırada Anthropic'in 2.1 tokenlik Claude 200 bağlam penceresi, halka açık herhangi bir yapay zeka modelinin en büyük bağlam penceresiydi. Bunu 4 tokenlik bağlam penceresiyle GPT-128 Turbo takip ediyor. Google Gemini 1.5, piyasadaki diğer tüm pencerelerden dört kat daha büyük olan bir milyon bağlamsal pencere sunar. Bu bizi şu büyük soruya götürüyor: Milyonlarca farklı simgeden oluşan bağlam penceresinde özel olan nedir? Doğrulamak ChatGPT token limiti nedir ve onu aşabilir misiniz?

Gemini 1.5'teki bağlam penceresi neden bu kadar önemli?

Daha ayrıntılı olarak açıklamak gerekirse, Claude AI'nin 200 içerik penceresi, yaklaşık 150 kelimeden oluşan bir kitabı alıp ona cevaplar sunabileceği anlamına geliyor. Bu gerçekten çok büyük. Ancak Google Gemini 1.5 tek seferde 700000 kelimeyi barındırabilecek!

ChatGPT veya Gemini gibi bir AI sohbet robotuna büyük bir metin bloğu gönderdiğinizde, mümkün olduğu kadar çok metin almaya çalışır, ancak ne kadar metin alabileceği içerik penceresine bağlıdır. Yani, yalnızca 100 kelimeyi işleyebilen bir modelde 28 kelimelik bir konuşma yapıyorsanız ve ardından ona 100 kelimelik konuşmanın tamamı hakkında tam bilgi sahibi olmasını gerektiren sorular sormaya başlarsanız, onu başarısızlığa hazırlıyorsunuz demektir. .

Bir saatlik bir filmin yalnızca 20 dakikasını izlediğinizi ve filmin tamamını açıklamanızın istendiğini hayal edin. Sonuçlarınız ne kadar iyi olacak? Ya cevap vermeyi reddedin ya da sadece bir şeyler uydurun, ki bu tam olarak bir yapay zeka sohbet robotunun yapacağı şeydir, sonuç olarak... Yapay zeka halüsinasyonu.

Şimdi, bir chatbot'a hiçbir zaman 100 kelime girmek zorunda kalmadığınızı düşünüyorsanız, önemli olan tek şey bu değil. Bağlam penceresi, tek bir istemde yapay zeka modeline beslenen metnin ötesine geçer. Yapay zeka modelleri, yanıtlarının mümkün olduğunca alakalı olmasını sağlamak için bir sohbet oturumu sırasında yaptığınız konuşmanın tamamını dikkate alır.

Yani, modeli 100 kelimelik bir kitapla beslemeseniz bile, ileri geri konuşmalarınız ve verdiği yanıtların tümü bağlam penceresi hesaplamasına eklenir. Google'ın ChatGPT'si veya Gemini'nin konuşmanın başında söylediğiniz şeyleri neden sürekli unuttuğunu merak ediyor musunuz? Bağlam penceresi alanı tükenmiş ve bir şeyleri unutmaya başlamış olabilir.

Daha geniş bağlam penceresi, uzun makaleleri özetlemek, karmaşık soruları yanıtlamak veya oluşturulan metinde tutarlı bir anlatım sürdürmek gibi bağlamın derinlemesine anlaşılmasını gerektiren görevler için özellikle önemlidir. Baştan sona tutarlı bir anlatıma sahip 50 kelimelik bir roman yazmak ister misiniz? Bir saatlik videoyu "izleyebilen" ve soruları yanıtlayabilen bir model mi istiyorsunuz? Daha büyük bir bağlam penceresine ihtiyacınız var!

Kısacası, Gemini 1.5'in daha geniş bağlam penceresi, yapay zeka modelinin performansını önemli ölçüde artırabilir, halüsinasyonları azaltabilir ve doğruluğu ve talimatları daha iyi takip etme yeteneğini önemli ölçüde artırabilir.

Gemini 1.5 beklentileri karşılayacak mı?

Her şey planlandığı gibi giderse Gemini 1.5 muhtemelen piyasadaki en iyi yapay zeka modellerinden daha iyi performans gösterecek. Ancak Google'ın istikrarlı bir yapay zeka modeli oluşturma konusundaki sayısız başarısızlığı göz önüne alındığında, dikkatli olmak önemlidir. Formun içerik penceresini tek başına yükseltmek, formu otomatik olarak iyileştirmez.

2.1k Claude 200 bağlam penceresini piyasaya sürülmesinden bu yana birkaç aydır kullanıyorum ve benim için açık olan bir şey vardı: daha büyük bir bağlam penceresi bağlam duyarlılığını gerçekten artırabilir, ancak temel modelin performansıyla ilgili sorunlar daha büyük bir bağlam oluşturabilir onun için sorunlu.

Google Gemini 1.5 oyunun kurallarını değiştirecek mi? Sosyal medya şu anda Gemini 1.5 için erken erişim kullanıcılarının olumlu yorumlarıyla dolu. Ancak beş yıldızlı incelemelerin çoğu aceleye getirilmiş veya basit kullanım örneklerinden kaynaklanmaktadır. Gemini 1.5'in vahşi doğada nasıl performans gösterdiğini kontrol etmek için iyi bir yer teknik raporun içidir. Google İkizler 1.5 [PDF]. Rapor, "kontrollü test" sırasında bile modelin, bağlam penceresi boyutu dahilindeki belgelerin tüm ince ayrıntılarını alamadığını gösteriyor.

Bir milyon belirteçten oluşan bir bağlam penceresi zaten etkileyici bir teknik başarıdır, ancak belge ayrıntılarına güvenilir bir şekilde ulaşma yeteneği olmadan, daha büyük bir bağlam penceresinin pratik değeri çok azdır ve doğruluğun azalmasına ve ek halüsinasyonlara neden olabilir. Artık görüntüleyebilirsiniz ChatGPT'nin Ötesinde: Sohbet robotlarının ve üretken yapay zekanın geleceği için bir vizyon mu?

Üst düğmeye git