TLDR
Steerling-8B adalah kemajuan penting dalam model AI yang dapat diinterpretasikan. Interpretabilitas dalam model pembelajaran mendalam dapat membantu dalam pengendalian hasil dan mematuhi regulasi. Guide Labs berfokus pada mengubah cara kita membangun model AI untuk membuatnya lebih transparan dan dapat dipahami. Memahami tindakan model deep learning dengan miliaran parameter seringkali sangat sulit. Guide Labs, sebuah startup dari San Francisco, memperkenalkan Steerling-8B, sebuah model bahasa dengan kemampuan untuk menelusuri setiap token yang dihasilkannya ke sumber data pelatihan asli. Hal ini membuat model lebih mudah dimengerti dan dikontrol.Steerling-8B menggunakan arsitektur baru yang memasukkan 'lapisan konsep' untuk mengelompokkan data ke dalam kategori yang mudah dilacak. Meskipun ini membutuhkan anotasi data yang lebih banyak di awal, tim Guide Labs menggunakan bantuan AI lain agar proses pelatihan lebih efisien dan efektif.Model ini dapat mencapai sekitar 90% kemampuan dari model-model besar lainnya yang memiliki parameter jauh lebih banyak. Kelebihan lain adalah penggunaan data pelatihan yang lebih sedikit berkat arsitektur uniknya, sehingga lebih hemat sumber daya dan waktu.Teknologi ini sangat penting untuk keperluan yang membutuhkan regulasi ketat seperti di bidang keuangan dan ilmiah. Misalnya, model bisa dikontrol agar tidak mempertimbangkan data sensitif seperti ras dalam evaluasi pinjaman, dan juga dapat memberikan penjelasan yang dibutuhkan dalam penelitian protein atau bidang ilmiah lain.Guide Labs berencana mengembangkan model yang lebih besar dan menyediakan akses melalui API untuk khalayak luas. Pendiri Julius Adebayo menyatakan interpretabilitas yang dimiliki model ini adalah jawaban atas permasalahan AI masa depan agar keputusan yang dibuat model tidak lagi misterius bagi manusia.