آنتروپیک از Claude Fable 5 پرده برداشت؛ پیشرفت چشمگیر در برنامهنویسی AI

به گزارش ایتنا و به نقل از Venturebeat، مدل Claude Fable 5 بهعنوان نسخهای عمومیتر، از هماکنون در دسترس اکثریت کاربران و توسعهدهندگان قرار گرفته و در مقایسه با نسخههای قبلی Claude، در زمینههایی نظیر مهندسی نرمافزار، تجزیه و تحلیل دانش، بینایی ماشین، پژوهشهای علمی و انجام وظایف پیچیده و طولانیمدت، عملکردی بهتر از خود نشان میدهد. آنتروپیک در این خصوص اذعان دارد که این مدل در بسیاری از بنچمارکهای کلیدی هوش مصنوعی حتی از رقبای خود پیشی گرفته است. بهطور ویژه، در ارزیابی SWE-bench Pro برای حل معضلات پیچیده برنامهنویسی، این مدل موفق به کسب امتیاز ۸۰.۳ درصد شده که از امتیاز ۵۸.۶ درصدی GPT-5.5 بالاتر است. همچنین در معیار FrontierCode Diamond نیز عملکردی بسیار فراتر از مدلهای قبلی خود و رقبا ارائه کرده است.
یکی از ویژگیهای بارز Fable 5، قابلیت انجام وظایف مهندسی نرمافزار بهطور مستقل و به مدت طولانی است. آنتروپیک بیان میکند که این مدل میتواند بدون نیاز به نظارت مداوم انسان، پروژههای پیچیده را مدیریت کند و حتی در مواردی همچون مهاجرت کد در پایگاههای بسیار بزرگ، عملکردی تحسینبرانگیز از خود نشان داده است. بهعنوان نمونه، شرکت Stripe اعلام کرده این مدل توانسته است یک پروژه مهاجرت کد در پایگاه دادهای با ۵۰ میلیون خط کد را در مدت یک روز به پایان برساند؛ کاری که به شکل دستی به چندین ماه زمان نیاز داشت. همچنین شرکتهای Cursor، Replit و Figma نیز از کارایی این مدل در زمینه کدنویسی و توسعه نرمافزار ابراز خرسندی کردهاند.
از لحاظ ایمنی، Fable 5 شامل لایههای حفاظتی جدیدی است که قادر به شناسایی درخواستهای حساس در حیطههایی نظیر امنیت سایبری، شیمی و زیستشناسی میباشد و بهطور خودکار به مدل قدیمیتر Claude Opus 4.8 منتقل میشود. به گزارش آنتروپیک، بیش از ۹۵ درصد از جلسات کاری این مدل بدون نیاز به دخالت دیگر مدلها انجام میشود و در آزمایشهای جامع، هیچ راهی برای دور زدن محدودیتهای امنیتی آن شناسایی نشده است.
در مقابل، Claude Mythos 5 بهعنوان نسخهای پیشرفتهتر ولی با دسترسی بسیار محدودتر، طراحی شده است. این مدل بیشتر برای کاربران تاییدشده، پژوهشگران و همکاران امنیتی در پروژههایی مانند Project Glasswing توسعه یافته است. Mythos 5 بسیاری از محدودیتهای ایمنی Fable را ندارد و به همین دلیل، در زمینههای حساستر نظیر امنیت سایبری پیشرفته و علوم زیستی عملکرد بهتری نشان میدهد. با این حال، فعلاً دسترسی عمومی به آن وجود ندارد.
در عرصه امنیت سایبری، Mythos 5 در معیارهایی مانند ExploitBench و CyberGym نتایج بسیار بهتری نسبت به مدلهای قبلی از خود به نمایش گذاشته است. همچنین در دنیای علوم زیستی، آنتروپیک عنوان نموده که این مدل قادر به تسریع فرایند طراحی دارو و تحلیل پروتئین بهطور محسوس است. گزارشها نشان میدهد که در تعدادی از آزمایشها، به کارگیری این مدل موجب تسریع روند طراحی دارو تا حدود ۱۰ برابر شده و در برخی موارد، نتایج آن به نامزدهای شایسته دارویی منجر گردیده است.
یکی از نکات کلیدی در استراتژی آنتروپیک این است که بهجای جداسازی سنتی مدلها به «ضعیف» و «قوی»، تفاوت اصلی بین Fable و Mythos را در نحوه مدیریت ریسک و سطح آزادی در انجام وظایف حساس تعریف میکند. Fable 5 با محدودیتهای ایمنی بیشتر برای استفاده عمومی طراحی شده، در حالی که Mythos 5 برای کاربریهای تخصصی و پرریسکتر به گروههای خاص اختصاص یافته است.
در بخش قیمتگذاری، هر دو مدل با هزینه ۱۰ دلار برای هر یک میلیون توکن ورودی و ۵۰ دلار برای هر یک میلیون توکن خروجی ارائه شدهاند که نسبت به نسخههای پیشنمایش قبلی کاهشی معنادار محسوب میشود، اما همچنان آنها را در زمره مدلهای گرانقیمت بازار قرار میدهد.
بهطورکلی، ظهور Fable 5 و Mythos 5 نشاندهنده یک رویکرد نوین آنتروپیک در توسعه هوش مصنوعی است؛ رویکردی که به دنبال ایجاد تعادل میان توانایی، استقلال عملیاتی و کنترل ایمنی میباشد. Fable 5 برای استفاده گسترده در سازمانها و توسعه نرمافزار طراحی شده و Mythos 5 بیشتر به کاربریهای تخصصی در حوزههای حساس علمی و امنیتی معطوف میباشد، بدون آنکه تفاوت اصلی آنها بر اساس قدرت خام مدل تعیین شود، بلکه در میزان دسترسی و سطح محدودیتهای آنها تعریف میگردد.



