"Bildiğimiz" Dünya simüle edilerek 8.3 milyar sanal insan oluşturuldu...
Harvard ve MIT Araştırmacıları, dünyadaki tüm insanları (8,3 Milyar kişi) simüle ettikleri sanal bir gezegen oluşturdular.
Bilim kurgudan fırlamış gibi görünen bir gelişmeyle, Harvard Üniversitesi ve Massachusetts Teknoloji Enstitüsü'nden araştırmacıların liderliğindeki büyük bir iş birliği ekibi, neredeyse Dünya üzerindeki her insanın davranışını modellemek için tasarlanmış, nüfus ölçeğinde bir yapay zeka simülasyon altyapısı olan MatrAIx'i tanıttı.
Harvard ve MIT'den araştırmacılar tarafından organize edilen ve OpenAI, Anthropic, Google DeepMind ve xAI'den 200'den fazla bilim insanından oluşan bir araştırma ekibi, yapay zeka ajanlarını kullanarak insan davranışını simüle etme üzerine yeni bir araştırma yayınladı. Yapay zeka sistemlerini ve dijital ürünleri çeşitli simüle edilmiş kullanıcı popülasyonlarıyla test eden bir değerlendirme altyapısı olan MatrAIx'i geliştirdiler. Bugüne kadar MatrAIx, 1.290 kişilik boyutu ve 1.010 uygulama görevini kapsayan 8,3 milyar kişilik profili içeriyor. Testlerde kişilik tutarlılığı %91.5. Artık ,herhangi bir problemi sanal dünyadaki bu bireylere yani matrixteki izdüşümlerimize yaşatıp istediğimiz sonucu alırlarsa gerçek dünyada hayata geçireceğiz. Makalede, kişilikleri destekleyen temel modeller olarak GPT-5.5, Claude Opus 4.8 ve Claude Haiku 4.5'in kullanıldığı 18.189 simüle edilmiş kullanıcı denemesi rapor ediliyor. MatrAIx, bilimsel araştırma örneklemlerinden pazarlama stratejilerine kadar çok çeşitli alanlarda çalışmaya uygun görünüyor.
ArXiv makalesi: https://arxiv.org/pdf/2608.04205
Bu araştırma, giderek önem kazanan bir soruyu ele alıyor: Yapay zeka ajanları insan davranışlarının ve tercihlerinin çeşitliliğini taklit edebilir mi?
Çalışma öncelikle ajanların değerlendirme ortamlarında insan tercihlerini simüle edip edemeyeceğini inceliyor. Yüksek kaliteli bir kullanıcı çalışması, katılımcı bulmayı, taramayı, test etmeyi ve istatistiksel analiz yapmayı gerektirir. Birkaç düzine katılımcıya ulaşmak zordur ve binlerce kullanıcıyı aynı anda karşılaştırmak daha da zordur. Gerçek kullanıcılarla büyük ölçekli testler yürütmek, pratik olamayacak kadar zaman alıcı ve maliyetlidir.
MatrAIx'in temel fikri, LLM ajanlarına kişilikler vererek, çeşitli kullanıcı gruplarını taklit etmelerini ve büyük ölçekli insan değerlendirmelerini simüle etmelerini sağlamaktır. MatrAIx'teki 8,3 milyar kişilik odaklı sanal kullanıcı, çok çeşitli test görevlerini hızlı ve doğru bir şekilde tamamlayabilir. Bu, ürün testinde uzun süredir devam eden çeşitli sorunları ele almaktadır: yüksek maliyet, uzun işlem süresi ve sınırlı kapsam.
MatrAIx platformunun üç temel bileşeni vardır: 1. Persona-8B persona veritabanı, 2. dört tür simülasyon ortamı ve 3. 25 alanda değerlendirme görevleri.
MatrAIx Uygulamaları: Çeşitli Alanlarda Değerlendirme Görevleri
MatrAIx şu anda 1.010 görev içermektedir: 621 anket görevi, 371 yapay zeka sohbet robotu görevi, 12 web sitesi görevi ve 6 uygulama görevi. Bunlar, iş, yazılım, finans ve sağlık hizmetleri de dahil olmak üzere 25'ten fazla alanı kapsamaktadır. Her görev, değerlendirilecek yapay zeka modelini veya dijital ürünü, kendi değerlendirme ölçütleri ve puanlama kriterleriyle birlikte içerir. Ekip, 8 temsili görevi yürüttü ve toplamda 18.189 kullanıcı etkileşimi gerçekleştirdi.
MatrAIx'in sitesi: https://matraix.ai/



Yorumlar (0)
Bu gönderi için henüz bir yorum yapılmamış.
Yorum Bırakın