
Dünyada milyonlarca aktif kullanıcıya sahip sosyal medya devi Reddit, yapay zekâ şirketi Perplexity AI ve üç veri sağlayıcısına (SerpApi, Oxylabs ve AWMProxy) dava açtı. Davanın gerekçeleri ise telif hakkı ihlali ve yasadışı veri toplama.
Reddit, açmış olduğu dava dilekçesinde sanıklar hakkında Reddit platformundaki koruma önlemlerini aşarak büyük ölçekli veri kazıma (data scraping) suçlamalarında bulundu. Reddit, bu firmaları “kasadaki parayı alamayınca zırhlı aracı soyan banka soyucularına” benzetti.
Perplexity’nin “Yanıt Motoru” Tartışması
Reddit’e göre Perplexity şirketi, geliştirdiği “yanıt motoru”nu geliştirmek için Reddit’ten topladığı verileri kullanıyor. Ancak iddiaya göre bu kullanım için Perplexity’nin Reddit ile bir lisans anlaşması yok. Şirket, Perplexity’nin bu verileri veri sağlayıcılar üzerinden dolaylı yoldan temin ettiğini ileri sürerek yasa dışı yollardan model eğitimi yapıldığını söylüyor.
Uyarılara Rağmen Veri Toplama Devam Etti
Reddit’in Mayıs 2024 tarihinde Perplexity’e yaptığı ihtarnamede resmi olarak veri toplama faaliyetinin sonlandırılması talebi vardı. Ancak Perplexity şirketi Reddit verilerini kullanmadıklarını ve yapay zekâ modellerini geliştirmek için robots.txt yönergelerine uyulduğunu söyledi. Reddit ise Mayıs 2024 tarihinden sonra platformlarında Perplexity alıntılarının arttığını tespit etti. Bu tespitin ardından Reddit, yalnızca Google’ın arama robotlarının erişebileceği özel bir içerik oluşturdu. Bu içeriklerin kısa süre sonra Perplexity sisteminde yeniden üretildiği fark edildi. Reddit, bu durumun Perplexity’nin “arama sonuçlarını doğrudan tarayıp kendi motoruna aktardığının kanıtı” olduğunu savundu.
Peki Reddit Verileri Neden Bu Kadar Önemli?
Reddit, yapay zekâ modelleri için altın değerinde bir platform. Bunun sebebi ise platformda milyonlarca kullanıcının doğal dil ve içerikleri kullanarak organik bir tartışma ortamı oluşturabilmesi.
Bu olaylar sonrası Reddit, 2023 yılında veri erişim politikasında değişikliklere gitti. Buna göre şirket, içeriklerinin ticari kullanımına karşı ücretli erişim modeli getirdi. Şirket daha sonra OpenAI ve Google ile resmi veri lisanslama anlaşmaları gerçekleştirdi.
💬 Sizce yapay zekâ şirketlerinin internetteki içerikleri kullanması nerede sınırlandırılmalı? Görüşlerinizi SiberHavadis yorumlarında bizlerle paylaşın.





