?>

Dünyanın ilk yapay zeka yazılım mühendisi başarısız oldu

Cognition AI tarafından geliştirilen ve Devin olarak adlandırılan dünyanın ilk yapay zeka yazılım mühendisi, kendisine verilen görevlerin yüzde 85’inde başarısız olarak sınıfta kaldı.

Teknoloji - 1 gün önce

Cognition AI tarafından geliştirilen ve Devin olarak adlandırılan dünyanın ilk “yapay zeka yazılım mühendisi” görünüşe göre işini yapmakta oldukça kötü. Yapılan son değerlendirmeler, bu yeni nesil aracın vaat edilen potansiyelden çok uzak olduğunu ortaya koyuyor. Testlerde Devin’in, kendisine verilen görevlerin yalnızca yüzde 15’ini başarıyla tamamladığı görüldü.

BEKLENTİLER BÜYÜKTÜ

Donanımhaber'de yer alan ayrıntılarda aktardığına göre 2024 yılının başlarında Cognition AI tarafından tanıtılan Devin, yazılım mühendislerine yardımcı olmayı amaçlayan bir otomasyon aracı olarak geliştirildi. Aralık 2024'te aylık 500 dolarlık abonelik ücretiyle genel kullanıma sunulan Devin'in, uygulama geliştirme ve hata giderme gibi görevleri baştan sona otonom bir şekilde gerçekleştirebildiği iddia edildi. Araç, Slack üzerinden komut alıyor ve Docker tabanlı bir çalışma ortamında terminal, tarayıcı, kod düzenleyici ve planlayıcı gibi araçlarla çalışıyor.

Cognition AI'nin açıklamasına göre Devin; API entegrasyonu, kod incelemeleri, altyapı yönetimi gibi görevleri yerine getirebiliyor. Hatta DoorDash üzerinden yemek siparişi verebilecek kadar "kişisel asistan" işlevi gördüğü de belirtiliyor. Bunlar, başlı başına çok büyük bir olay ve iddia.

Bu arada Devin, bir “bileşik yapay zeka sistemi”, yani OpenAI'nı GPT-4o'sunu içeren ve zaman içinde gelişmesi beklenebilecek bir dizi temel yapay zeka modeline dayanıyor. Teorik olarak onların yapabildikleri her şeyi yapması bekleniyor.

SONUÇLAR HAYAL KIRIKLIĞI OLDU

Saygın bir AI araştırma ve geliştirme laboratuvarı olan Answer.AI'dan üç veri bilimcisi Hamel Husain, Isaac Flath ve Johno Whitaker, bu iddiaları test etmek için bir dizi denemeler gerçekleştirdi. Devin ile test edilen 20 görevden sadece üçü başarıyla tamamlanabildi. Devin’in tamamladığı görevler arasında Notion veritabanından Google Sheets’e veri aktarma ve gezegen hareketlerini takip edebilen bir uygulama geliştirme bulunuyor. Ancak daha karmaşık görevlerde Devin, teknik çıkmazlara saplandı veya hatalı çözümler üretti.

Araştırmacılar, Devin'in temel engelleri fark edemediğini ve uygulanabilir olmayan çözümleri zorlamaya devam ettiğini belirtti. Örneğin, Devin’den birden fazla uygulamayı Railway platformuna dağıtması istendiğinde, bu platformun böyle bir özelliği desteklemediğini anlamadı. Günlerce çözüm arayarak zaman kaybetti ve hayali özellikler "uydurdu." Araştırmacılar, Devin’in arayüzünün kullanıcı dostu olduğunu ve bazı görevlerde umut verici sonuçlar verdiğini kabul etseler de, aracın güvenilir olmaktan uzak olduğunu vurguladı: “Daha da endişe verici olan, hangi görevlerin başarılı olacağını tahmin edemememizdi. İlk başarılarımıza benzer görevler bile karmaşık, zaman alıcı yollarla başarısız oluyordu.”

Haftanın Öne Çıkanları

Kartalkaya Kayak Merkezindeki otel sahibi kim? Mazhar Murtezaoğlu kimdir?

2025-01-21 15:09 - Gündem

AKP’li Şamil Tayyar’dan ‘denetim’ çıkışı: ‘Turizm belgeli işletmelerin denetimi bakanlığa aittir’

2025-01-23 01:39 - Siyaset

Mardin'de silahlı kavga: 17 yaşındaki genç hayatını kaybetti

2025-01-17 01:39 - Asayiş

Zafer Partisi lideri Ümit Özdağ'a destek için 'Vatan Emniyet' önünde toplanıldı

2025-01-21 00:38 - Siyaset

Tanju Özcan 'kirli bilgiler geliyor' dedi: Savcı ve bilirkişilere 'baskı' iddiası

2025-01-24 00:08 - Siyaset

Fenerbahçe'den Zalgiris karşısında muhteşem geri dönüş!

2025-01-18 00:00 - Spor

Son Dakika... AFAD duyurdu: Çanakkale açıklarında 5.2 büyüklüğünde deprem!

2025-01-22 00:08 - Gündem

Yanan otelin yetkilisi 3 gün önce konuşmuş: 'Oteller hazır, misafirlerini bekliyor'

2025-01-21 15:08 - Gündem

4 yıl önce ikizini kaybetmiş ardından kansere yakalanmıştı: 17 yaşındaki Sude’den acı haber geldi

2025-01-19 07:39 - Gündem

Adı Süper Lig devleriyle anılıyordu: Eyüpspor'dan Ahmed Kutucu için transfer açıklaması

2025-01-20 00:09 - Spor

İlgili Haberler

1 yılda yapay zekaya ne kadar harcağımız açıklandı

00:00 - Teknoloji

Samsung, ince yapıdaki Galaxy S25 Edge modelini duyurdu

00:00 - Teknoloji

Yapay zeka doğru yönetilmezse Pandora'nın kutusuna dönüşebilir

02:38 - Teknoloji

Microsoft Edge Game Assist sistemini kullanıma sundu

02:08 - Teknoloji

Dünyanın ilk sohbet botu hayata döndürüldü

00:08 - Teknoloji

Günün Manşetleri

Yunanistan'da müthiş zafer! Fenerbahçe Olympiakos'u deplasmanda dize getirdi!

01:39 - Gündem

Tanju Özcan'dan Bakan Ersoy'a yanıt: 'Suç duyurusunda bulunacağım'

01:08 - Gündem

ESP ile SGDF'ye MLKP operasyonu: 34 şüpheli tutuklandı

00:08 - Asayiş

Yıllar önce yine Konya'da bir bina çökmüştü: Konya'da çöken binada enkaz altında kalanlar

23:38 - Gündem

Kalpaksız Kuvvacı Uğur Mumcu ölüm yıldönümünde törenlerle anıldı

22:38 - Gündem