شرکت Anthropic، یکی از شرکتهای پیشرو در صنعت مدلهای بزرگ هوش مصنوعی در ایالات متحده، مدل بزرگ Claude Opus 4.8 را امروز نیمهشب رسماً منتشر کرد. با این حال، در حالی که این مدل در رتبهبندیهای متعدد به نتایج برجستهای دست یافت، بسیاری از کاربران و توسعهدهندگان گزارش دادهاند که دارای مشکلات «سردرگمی شناختی» است.
یکی از کاربران اینترنتی از طریق آزمایش API دریافت که وقتی از این مدل در مورد هویتش سوال میشود، به اشتباه ادعا میکند که «Qwen» یا «DeepSeek» از علیبابا است؛ دو مدل بزرگ متنباز اصلی در چین.
آزمایش API، ناهنجاری شناختی را آشکار میکند
در مورد این پدیده، برخی از کاربرانی که در رابط وب آزمایش میکردند، گفتند که نتوانستند آن را بازتولید کنند و معتقد بودند که این مدل از مدلهای بزرگ چینی تقطیر نشده است. با این حال، توسعهدهندگان مربوطه توضیح دادند که مکالمه در رابط وب دارای دستورات سیستمی سختگیرانهای است که این ناهنجاری را پنهان میکند.
در مقابل، در آزمایش API سطح پایین و بدون هیچ محدودیتی، این مشکل به کرات بازتولید شد. این به طور مستقیم نشان میدهد که مدل بزرگ رده بالای ایالات متحده احتمالاً از حجم زیادی از دادههای تولید شده توسط مدلهای بزرگ متنباز چینی برای «تقطیر» در طول آموزش یا تنظیم دقیق استفاده کرده است.
رفتار متناقض، انتقاد از استانداردهای دوگانه را برمیانگیزد
این حادثه جنجال بزرگی در جامعه فناوری ایجاد کرد، عمدتاً به این دلیل که Anthropic قبلاً تمایل شدیدی به «ضد چین» نشان داده بود. این شرکت زمانی با وزارت دفاع ایالات متحده و سایر بخشها برای تدوین قوانینی همکاری کرد و تلاش نمود تا «تقطیر مدلهای بزرگ» را به عنوان یک حمله خصمانه تعریف کند.
آنها نه تنها از دولت ایالات متحده خواستند تا محدودیتهای تراشه و نرمافزاری را بر صنعت هوش مصنوعی چین افزایش دهد، بلکه یک هدف استراتژیک را برای دستیابی به دو سال پیشتازی نسبت به چین در هوش مصنوعی تا سال ۲۰۲۸ پیشنهاد کردند. اکنون، مدل شاخص آنها در حال تقطیر از مدلهای بزرگ چینی گرفتار شده است، که به طعنه استانداردهای دوگانه آنها را آشکار میکند.