OpenAI, Perşembe günü, biyoloji alanında yaygın çalışma yöntemlerine özel olarak eğitilmiş büyük bir dil modeli olan GPT-Rosalind’i geliştirdiğini duyurdu.
Model, Rosalind Franklin’in adını taşımaktadır. GPT-Rosalind, büyük teknoloji şirketlerinin sunduğu genel amaçlı bilim odaklı modellerden farklılık gösteriyor. OpenAI, bu yeni modelin, biyoloji araştırmacılarının karşılaştığı iki büyük engeli aşmak için tasarlandığını belirtti.
OpenAI’nin Hayat Bilimleri Ürün Müdürü Yunyun Wang, bu engellerden birinin, on yıllar süren genom dizileme ve protein biyokimyası çalışmaları sonucu oluşan devasa veri setleri olduğunu ifade etti. Bu tür verilerin bireysel araştırmacılar için aşırı derecede zorlu olabileceği belirtildi.
Diğer engel ise biyolojinin birçok yüksek seviyede uzmanlaşmış alt alanlarının varlığıdır. Her birinin kendine özgü teknikleri ve jargonları bulunmaktadır. Örneğin, beyin hücrelerinde aktif bir gen üzerinde çalışan bir genetikçinin nörobiyolojik literatürü anlamakta zorluk çekebileceği ifade edildi.
Wang, GPT-Rosalind’in 50 yaygın biyolojik iş akışı üzerinde eğitildiğini ve biyolojik bilgiye erişimi sağlayan önemli kamu veri tabanlarını nasıl kullanacağını öğrendiğini bildirdi. Ekstra eğitim, modelin olası biyolojik yolları önerme ve potansiyel ilaç hedeflerini önceliklendirme yeteneği kazandığını gösterdi.
Wang, “Genotipi fenotip ile bağlantılı hale getiriyoruz, bilinen yollar ve düzenleyici mekanizmalar aracılığıyla, proteinlerin muhtemel yapısal veya işlevsel özelliklerini çıkarıyoruz ve bu mekanistik anlayışı gerçekten kullanıyoruz” dedi.
Bu model, biyoloji araştırmacılarının karmaşık verilerle başa çıkmasına ve uzmanlık alanlarına dair daha iyi anlamalarına olanak tanıyacak.




