به گزارش خبرگزاری صحت خبر و براساس گزارش زومیت، آنتروپیک در آزمایش‌های خود، مدل Claude را به‌عنوان پژوهشگر هوش مصنوعی به کار گرفت. این مدل توانست با بررسی متون علمی، پیشنهاد راهکار، تولید داده آموزشی، آموزش مدل‌ها و ارزیابی نتایج، چرخه بهبود مدل‌های دیگر را تا حد زیادی به‌صورت خودکار پیش ببرد.

به گفته پژوهشگران، این سامانه توانست هر ۱۰ نقص هم‌ترازی مورد آزمایش را بدون کاهش قابلیت‌های عمومی مدل‌ها برطرف کند. در یکی از آزمایش‌ها نیز مدل Sonnet 5 برای آموزش نسخه اولیه Opus 4.8 استفاده شد و طی حدود ۶۰ ساعت، هم‌ترازی آن را به سطح مدل نهایی نزدیک کرد.

با این حال، آنتروپیک تأکید دارد این فرایند هنوز خودبه‌سازی بازگشتی کامل محسوب نمی‌شود؛ زیرا مدل بهبودیافته بلافاصله جای مدل قبلی را برای انجام چرخه بعدی تحقیق نمی‌گیرد. با وجود این، بخش بزرگی از چرخه پژوهش، آموزش، ارزیابی و تکرار اکنون توسط خود هوش مصنوعی انجام می‌شود.

۲۲۷۲۲۷

اشتراک‌گذاری »