Apple, son dönemde tanıttığı Apple Intelligence özelliklerinin arkasındaki teknolojiyi detaylandırarak, NVIDIA’nın donanım hızlandırıcıları yerine Google’ın TPU’larını tercih ettiğini duyurdu. Şirketin resmi araştırma belgesine göre, Apple Intelligence Foundation Dil Modelleri’nin (AFM) eğitiminde Google TPU (Tensor Processing Unit) kullanılmakta.
Google TPU’ları ve Apple’ın AFM Modelleri
Apple, Google TPUv4 ve TPUv5 çiplerinin paketlendiği sistemlerin, AFM-server ve AFM-on-device modellerinin geliştirilmesinde önemli bir rol oynadığını belirtti. Haziran ayında WWDC 2024’te tanıtılan çevrimiçi ve çevrimdışı Apple Intelligence özellikleri, bu modellerin teknolojisiyle destekleniyor.
AFM-Server: Apple’ın en büyük Büyük Dil Modeli (LLM) olup sadece çevrimiçi olarak çalışmakta. Eğitim sürecinde, Applebot web tarayıcısından toplanan veriler ve çeşitli lisanslı “yüksek kaliteli” veri kümeleri kullanılmıştır. Ayrıca, seçilmiş kod, matematik ve açık veri kümeleri de eğitim verileri arasında yer aldı.
AFM-on-Device: Çevrimdışı çalışan bu model ise daha küçük bir yapıya sahip, ancak Apple’ın bilgi damıtma teknikleri sayesinde performansı ve verimliliği optimize edilmiştir. Bu modelin eğitimi, Google TPUv5 kümeleri kullanılarak yapılmış ve modelin eğitiminde 2.048 TPUv5p çipten oluşan bir dilim kullanılmıştır.
Apple’ın Şeffaflığı ve Teknik Üstünlüğü
Apple’ın, Apple Intelligence’a güç veren teknikleri bu kadar ayrıntılı bir şekilde paylaşması alışılmadık bir durumdur; genellikle teknoloji devleri bu tür bilgileri gizli tutmayı tercih eder. Şirket içi testlerde, AFM-server ve AFM-on-device modellerinin Talimat Takibi, Araç Kullanımı, Yazma ve diğer alanlarda üstünlük sağladığı belirtiliyor.

















