هوش مصنوعی در حوزه پزشکی با سرعتی چشمگیر به سمت تخصصیتر شدن و افزایش ایمنی حرکت میکند. طبق اعلام آزمایشگاه هوش مصنوعی شانگهای، بنچمارک ارزیابی مدلهای زبانی بزرگ پزشکی در چین، موسوم به MedBench، بهتازگی نسخه ۵.۰ خود را با ارتقاهای جامع منتشر کرده است.
این بهروزرسانی حاصل همکاری برترین تیمهای تحقیقاتی هوش مصنوعی پزشکی در چین است. تیم تحقیقاتی آزمایشگاه هوش مصنوعی شانگهای با همکاری آزمایشگاه گوانگژو، تیم آکادمیسین «ژونگ نانشان» از بیمارستان وابسته به دانشگاه پزشکی گوانگژو و تیم آکادمیسین «گه جونبو» از بیمارستان ژونگشان دانشگاه فودان، در توسعه این نسخه مشارکت داشتهاند. نسخه جدید بر ایجاد یک سیستم ارزیابی تخصصی متمرکز است و پارادایم نوآورانه «ارزیابی مهارتهای اتمی پزشکی» را معرفی کرده که میتواند به اصلاح جامع توهمات (Hallucinations) در مدلهای هوش مصنوعی کمک کرده و سپر امنیتی این فناوری را در حوزه سلامت تقویت کند.
بهعنوان نخستین سیستم ارزیابی بومی پزشکی در چین، MedBench توسط کمیته فضای مجازی شهرداری شانگهای و کمیسیون بهداشت این شهر بهعنوان مرجع پیشارزیابی فناوریهای کاربردی هوش مصنوعی در پزشکی تعیین شده است. این بنچمارک نقشی حیاتی در استانداردسازی و توسعه باکیفیت مدلهای زبانی بزرگ پزشکی ایفا میکند.
