مدل زبانی بزرگ o1 شرکت OpenAI در تشخیص بیماریهای پیچیده و تهدیدکنندهی زندگی، بهویژه در مراحل اولیهی پذیرش در بخش اورژانس، عملکردی بهتر از پزشکان انسانی از خود نشان داد.
این مدل هوش مصنوعی در شرایطی که اطلاعات محدود بود، در حدود ۶۷ درصد از مواقع، تشخیص درست یا بسیار نزدیک به درست ارائه کرد؛ در حالی که نرخ موفقیت پزشکان بین ۵۰ تا ۵۵ درصد بود.
پژوهشگران برای ارزیابی این مدل، پنج آزمون مختلف شامل تحلیل پروفایلهای پزشکی و پیشبینی تغییرات سلامتی را طراحی کردند. نتایج نشان داد که o1 در تمامی این مراحل، مشابه پزشکان یا برتر از آنها عمل کرده است. /زومیت