Google TPU 8t ve 8i Tanıtıldı
Google TPU 8t ve 8i Tanıtıldı

Google TPU 8t ve 8i Tanıtıldı: Eğitim ve Çıkarım İçin Ayrı Yapay Zeka Çipleri Dönemi Başladı

Teknoloji Haberleri - Google, Las Vegas’ta düzenlenen Cloud Next 2026 konferansında yapay zeka altyapısında yeni bir sayfa açtı. Şirket, sekizinci nesil Tensör İşlem Birimleri’ni Google TPU 8t ve 8i adıyla iki ayrı ürün olarak tanıtırken, eğitim ve çıkarım süreçlerini tek bir çipin sınırlarından kurtarmayı hedefliyor. Bu hamle, bulut bilişim tarafında yıllardır süregelen “her işe uyan tek çip” anlayışını rafa kaldırmış görünüyor.

Bir Modeli Eğitmek Başka, Çalıştırmak Başka

Yapay zeka dünyasında iş yükleri giderek kutuplaşıyor. Bir modeli sıfırdan eğitmek devasa hesaplama gücü ve çipler arası kesintisiz veri akışı isterken, aynı modeli son kullanıcıya hizmet verir hale getirmek düşük gecikme süresi ve yüksek bellek kapasitesi talep ediyor. HFS Research analisti Phil Fersht, müşterilerin artık model yaşam döngüsünün her aşaması için ayrı bir fiyat‑performans eğrisi talep ettiğini söylüyor. Yani kimse sadece çıkarım yapmak için eğitim seviyesinde pahalı donanımlara para ödemek istemiyor. Google da tam olarak bu noktaya parmak basıyor.

TPU 8t ile Ham Güç Masaya Konuyor

Eğitim için geliştirilen TPU 8t, selefi Ironwood ile kıyaslandığında pod başına yaklaşık üç kat daha fazla işlem performansı sunuyor. 9.600 çipi bir araya getiren tek bir süper pod, 121 exaflopluk FP4 işlem gücüne ulaşıyor ve 2 petabaytlık paylaşımlı bellekle besleniyor. Çipler arası çift yönlü bant genişliği saniyede 19.2 Tbps seviyesine çıkarılırken, raflar arası ağ bant genişliği dört kat artırılarak 400 Gbps’ye taşınıyor. Mühendisler ayrıca SparseCore adında yeni bir hızlandırıcı birimi devreye aldı. Bu birim, büyük dil modellerindeki dağınık bellek erişim desenlerini düzenleyerek çipin boş yere beklemesini engelliyor ve teorik verimlilik oranını yüzde 97’nin üzerine çıkarıyor.

TPU 8i Bellek ve Hız Odaklı Tasarlanıyor

Çıkarım odaklı TPU 8i ise tamamen farklı bir tasarım önceliğiyle geliyor. Çip üzerindeki SRAM miktarı 384 MB’a yükseltilirken, 288 GB yüksek bant genişlikli bellek ile aktif model verilerinin işlemciye olabildiğince yakın kalması sağlanıyor. Bu tercih, özellikle Mixture of Experts (MoE) ve uzun bağlamlı modeller gibi günümüzün popüler yaklaşımlarında gecikme süresini ciddi oranda kısaltıyor. Yeni Boardfly ağ topolojisi ve iki katına çıkarılan çipler arası bağlantı hızı sayesinde, Ironwood’a kıyasla dolar başına yüzde 80 daha fazla performans elde ediliyor. Başka bir deyişle aynı paraya neredeyse iki kat fazla kullanıcıya hizmet vermek mümkün hale geliyor.

Rakipler de Benzer Yolda İlerliyor

Google’ın bu iki kollu stratejisi, sektördeki diğer oyuncuların attığı adımlarla da örtüşüyor. AWS, Trainium ve Inferentia ailesiyle eğitim ve çıkarım iş yüklerini uzun süredir birbirinden ayırıyor. HyperFRAME Research analisti Stephen Sopko, bu ayrışmanın artık bir tercih değil zorunluluk haline geldiğini belirtiyor. Büyük model sağlayıcıları OpenAI ve Anthropic gibi şirketler de eğitim ve servis altyapılarını ayrı ayrı yöneterek kaynak kullanımını daha verimli kılabiliyor. TrendForce analisti Fion Chiu ise özellikle maliyet avantajı sayesinde işletmelerin büyük modelleri daha düşük bütçelerle devreye alabileceğine dikkat çekiyor.

Enerji Verimliliği ve Yayın Takvimi

Yeni nesil TPU ailesi yalnızca ham performansı değil, enerji tarafındaki dengeyi de iyileştiriyor. Açıklanan rakamlara göre watt başına performans iki kat artırılmış durumda. Çipler aynı zamanda Google’ın kendi tasarımı olan Axion ARM tabanlı CPU’larla daha sıkı entegre çalışıyor. Bu entegrasyon, veri merkezlerinde daha dengeli bir sistem mimarisi yaratırken toplam sahip olma maliyetini aşağı çekiyor. Google, TPU 8t ve 8i modellerini bu yılın ilerleyen aylarında AI Hypercomputer platformunun bir parçası olarak genel kullanıma sunacağını duyurdu. Teknoloji Haberleri - Teknoloji Medya

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir


Güncel Haberler
ChatGPT Health ABD’de Geniş Kapsamlı Kullanıma Açıldı: Sağlık Verileri Artık Yapay Zekâ İle Doğrudan Paylaşılabilecek - 24.07.2026Microsoft MAI-Image-2.5-Pro Ve MAI-Voice-2-Flash Modellerini Duyurdu - 24.07.2026Google Gemini Spark AI Pro Abonelerine Sunuldu: Kişisel Yapay Zeka Ajanı Daha Fazla Kullanıcıyla Buluşuyor - 24.07.2026Xiaomi Temmuz 2026 Güvenlik Güncellemesi 58 Cihaz İçin Yayınlandı: İşte Güncelleme Alan Modeller - 24.07.2026Cisco Antares Yapay Zekâ Modelleri Yazılım Güvenliğinde Maliyet Dengesini Değiştiriyor - 22.07.2026Apple iPhone 18 Pro Üretim Hacmini Artırıyor: Foxconn Fabrikalarında Yoğun Mesai Başladı - 22.07.2026Cilde Boya Gibi Uygulanan Yeni Elektrot Teknolojisi Biyometrik Takibi Değiştirebilir - 21.07.2026Hooma Magpulse Slim Manyetik Powerbank Serisi Türkiye’de Satışa Sunuldu - 21.07.2026Apple Live Notes İle Genius Bar Görüşmelerini Yapay Zekâ Destekli Notlara Dönüştürüyor - 21.07.2026Windows 11 İle Linux Karşılaştırması Şaşırttı: Aynı Donanımda Kazanan İş Yüküne Göre Değişti - 21.07.2026Google Chrome Find And Fill With Gemini Özelliği Form Doldurma Deneyimini Değiştiriyor - 21.07.2026Hayat Kimya Yapay Zekâ Destekli Enerji Yönetim Sistemini Kocaeli Kampüsünde Devreye Aldı - 21.07.2026Samsung Tandem OLED Ekran Teknolojisi 1600 Nit Parlaklık Ve Daha Uzun Kullanım Ömrü Sunuyor - 21.07.2026iOS 27 Beta 4 Yayınlandı: Apple TV, ProRes Log 2 Ve Yeni iPhone Donanımına İşaret Eden Değişiklikler Geldi - 21.07.2026Google Pixel 11a Tensor G6 İle Performansını Güçlendirmeye Hazırlanıyor - 20.07.2026Apple Fiyatlarını Neden Artırıyor? Zamların Arkasındaki Küresel Strateji Netleşiyor - 20.07.2026iPhone Sadakat Oranı Yüzde 87’ye Ulaştı: Android’den Geçişler Yavaşlıyor - 20.07.2026Samsung Galaxy A Serisi Temmuz 2026 Güvenlik Güncellemesi Dağıtıma Başladı - 20.07.2026Yapay Zeka Veri Merkezi Elektrikçileri 280 Bin Doları Aşan Maaşlarla Öne Çıkıyor - 20.07.2026Samsung Galaxy Z Fold 8 İçin Üretim Planı Büyüdü: Şirket Talep Beklentisini Yükseltti - 20.07.2026

Teknoloji Gündemi

Microsoft MAI-Image-2.5-Pro Ve MAI-Voice-2-Flash Modellerini Duyurdu

Microsoft MAI-Image-2.5-Pro ile görsel üretim ve düzenleme alanında yeni nesil yapay zekâ yeteneklerini kullanıma açtı. Şirket ayrıca daha düşük maliyet ve yüksek hız sunan MAI-Voice-2-Flash modelinin teknik ayrıntılarını da paylaştı. Microsoft MAI-Image-2.5-Pro, şirketin bugüne kadar...

Takip Et