سایت خبری
famaserver
  • خانه
  • عمومی
  • ورزش
  • اقتصاد
  • مسکن
  • بین الملل
  • جامعه
  • فناوری اطلاعات
سایت خبری
برترین عناوین خبری
  • خرید بیمه: سنتی یا آنلاین؟ کدامیک تجربه بهتری برای مشتریان ایجاد می‌کند؟

سرتیتر خبرها

گزارش رسانه‌های صهیونیستی از ناکامی تلاش‌ها برای تشکیل نیروی بین‌المللی در غزه

گزارش رسانه‌های صهیونیستی از ناکامی تلاش‌ها برای تشکیل نیروی بین‌المللی در غزه

8 ماه پیش
واکنش نتانیاهو به حمله استرالیا

واکنش نتانیاهو به حمله استرالیا

8 ماه پیش
حماس ترور فرمانده ارشد القسام را تایید کرد

حماس ترور فرمانده ارشد القسام را تایید کرد

8 ماه پیش
عراقچی: صلح و ثبات افغانستان تنها از مسیر همگرایی منطقه‌ای محقق می‌شود

عراقچی: صلح و ثبات افغانستان تنها از مسیر همگرایی منطقه‌ای محقق می‌شود

8 ماه پیش
غریب آبادی: مردم ایران هرگز تسلیم تهدیدات و تجاوزات نخواهند شد و متحد و منسجم در مقابل متجاوز خواهند ایستاد

غریب آبادی: مردم ایران هرگز تسلیم تهدیدات و تجاوزات نخواهند شد و متحد و منسجم در مقابل متجاوز خواهند ایستاد

8 ماه پیش
واکنش ایران به حمله خشونت آمیز در سیدنی استرالیا

واکنش ایران به حمله خشونت آمیز در سیدنی استرالیا

8 ماه پیش
مصر: همه گزینه‌ها از جمله راه‌حل نظامی را درمورد سد النهضه بررسی می‌کنیم

مصر: همه گزینه‌ها از جمله راه‌حل نظامی را درمورد سد النهضه بررسی می‌کنیم

8 ماه پیش
واکنش آمریکا به تیراندازی مرگبار در سیدنی

واکنش آمریکا به تیراندازی مرگبار در سیدنی

8 ماه پیش
رضا نصری: علی‌اکبر صالحی شایسته‌ترین گزینه نه برای مدیریت یک سفارتخانه، بلکه برای عهده‌دار شدن سمت پیشنهادی «نماینده ویژه ایران در جهان عرب» است

رضا نصری: علی‌اکبر صالحی شایسته‌ترین گزینه نه برای مدیریت یک سفارتخانه، بلکه برای عهده‌دار شدن سمت پیشنهادی «نماینده ویژه ایران در جهان عرب» است

8 ماه پیش
ادعای اوکراین درباره حملات نظامی دقیق به عمق خاک روسیه

ادعای اوکراین درباره حملات نظامی دقیق به عمق خاک روسیه

8 ماه پیش

Home » GPT-5.5 و Claude Fable 5 در آزمون سخت AI؛ برتری با مدل OpenAI

GPT-5.5 و Claude Fable 5 در آزمون سخت AI؛ برتری با مدل OpenAI

زمان انتشار: 14 ژوئن 2026 ساعت 12:06

دسته بندی: فناوری اطلاعات

شناسه خبر: 2964718

زمان مطالعه: 6 دقیقه

GPT-5.5 و Claude Fable 5 در آزمون سخت AI؛ برتری با مدل OpenAI

GPT-5.5 و Claude Fable 5 در آزمون سخت AI؛ برتری با مدل OpenAI

رقابت در دنیای هوش مصنوعی با انتشار نتایج یک معیار ارزیابی جدید وارد فاز تازه‌ای شده است. در آزمون سخت‌گیرانه Agents’ Last Exam (ALE)، مدل GPT-5.5 شرکت OpenAI موفق شد عملکردی بهتر از Claude Fable 5 شرکت Anthropic ثبت کند و در صدر جدول قرار گیرد.
با این حال، نتایج نشان می‌دهد حتی پیشرفته‌ترین مدل‌های هوش مصنوعی جهان نیز هنوز فاصله زیادی تا انجام قابل اعتماد بسیاری از وظایف حرفه‌ای دارند.

به گزارش سیلاد این آزمون توسط پژوهشگران دانشگاه برکلی و با همکاری بیش از ۳۰۰ متخصص از حوزه‌های مختلف طراحی شده است، و هدف آن، سنجش توانایی عامل‌های هوش مصنوعی در انجام فرایندهای کاری واقعی و چندمرحله‌ای است؛ وظایفی که شباهت بیشتری به فعالیت‌های اقتصادی و حرفه‌ای دنیای واقعی دارند تا آزمون‌های سنتی هوش مصنوعی.
 

رقابت در دنیای هوش مصنوعی؛ GPT-5.5 در صدر قرار گرفت

بر اساس نتایج منتشرشده، GPT-5.5 با نرخ موفقیت ۲۴ درصدی رتبه نخست را کسب کرد. Claude Fable 5 نیز با ۲۲ درصد موفقیت در جایگاه سوم قرار گرفت. هرچند اختلاف میان دو مدل چندان زیاد نیست، اما این نتیجه برای OpenAI یک پیروزی مهم در یکی از دشوارترین ارزیابی‌های عامل‌های هوش مصنوعی محسوب می‌شود.
نکته قابل توجه این است که حتی بهترین مدل حاضر در این آزمون نیز در ۷۶ درصد از وظایف موفق به کسب امتیاز کامل نشده است؛ موضوعی که نشان می‌دهد مسیر دستیابی به عامل‌های هوشمند کاملاً خودمختار همچنان طولانی است.
 

چرا آزمون ALE اهمیت دارد؟

برخلاف بسیاری از بنچمارک‌های رایج که بر پرسش و پاسخ یا مسائل محدود برنامه‌نویسی تمرکز دارند، ALE توانایی مدل‌ها را در انجام کارهای واقعی می‌سنجد. این آزمون شامل بیش از ۱۴۰۰ وظیفه در ۵۵ حوزه مختلف صنعتی است و از مدل‌ها می‌خواهد در محیط‌های نرم‌افزاری واقعی فعالیت کنند.
پژوهشگران همچنین تلاش کرده‌اند نقاط ضعف معیارهای قدیمی، از جمله امکان «تقلب» یا حفظ کردن پاسخ‌ها، را کاهش دهند و تصویری واقع‌بینانه‌تر از توانایی عامل‌های هوش مصنوعی ارائه کنند.
 

آینده رقابت در دنیای هوش مصنوعی

بنا به نوشته سایت VentureBeat نتایج این ارزیابی نشان می‌دهد رقابت در دنیای هوش مصنوعی دیگر تنها به کیفیت تولید متن یا پاسخ‌گویی محدود نمی‌شود. اکنون شرکت‌هایی مانند OpenAI و Anthropic در تلاش‌اند مدل‌هایی توسعه دهند که بتوانند وظایف پیچیده و چندمرحله‌ای را در محیط‌های واقعی انجام دهند.
اگرچه GPT-5.5 در این آزمون از Claude Fable 5 پیشی گرفته است، اما بررسی سایر بنچمارک‌ها نشان می‌دهد رقابت میان این دو شرکت همچنان بسیار نزدیک است و هر مدل در برخی حوزه‌ها برتری‌های خاص خود را دارد. این موضوع نشان می‌دهد بازار هوش مصنوعی همچنان در حال تحول است و برنده نهایی این رقابت هنوز مشخص نیست.
 

جمع‌بندی

نتایج آزمون Agents’ Last Exam نشان می‌دهد رقابت در دنیای هوش مصنوعی وارد مرحله‌ای جدید شده است. هرچند GPT-5.5 توانسته Claude Fable 5 را در این ارزیابی پشت سر بگذارد، اما عملکرد نه‌چندان درخشان همه مدل‌ها نشان می‌دهد صنعت هوش مصنوعی هنوز تا دستیابی به عامل‌های کاملاً حرفه‌ای و قابل اتکا فاصله دارد.

برچسب ها
GPT-5.5
اشتراک گذاری

اخبار مرتبط

  • همکاری راهبردی شرکت‌های آمریکایی و کره‌ای برای توسعه نسل بعدی تبدیل توان
    همکاری راهبردی شرکت‌های آمریکایی و کره‌ای برای توسعه نسل بعدی تبدیل توان 8 ساعت پیش
  • اپل دامنه اتهام علیه OpenAI را گسترش داد؛ پای کارکنان سابق بیشتری به پرونده باز شد
    اپل دامنه اتهام علیه OpenAI را گسترش داد؛ پای کارکنان سابق بیشتری به پرونده باز شد 8 ساعت پیش
  • بیش از ۱۳۰ میلیون دلار بیت‌کوین از کیف‌پول‌های سخت‌افزاری به سرقت رفت
    بیش از ۱۳۰ میلیون دلار بیت‌کوین از کیف‌پول‌های سخت‌افزاری به سرقت رفت 8 ساعت پیش
  • چین با موج مدل‌های هوش مصنوعی باز، رقابت با آمریکا را وارد مرحله جدیدی کرد
    چین با موج مدل‌های هوش مصنوعی باز، رقابت با آمریکا را وارد مرحله جدیدی کرد 8 ساعت پیش

دیدگاه ها

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دسته بندی موضوعات

  • استانها 18797
  • اقتصاد 13280
  • بازار مالی 2633
  • بین الملل 14490
  • تبلیغات 32
  • جامعه 10132
  • دانش 7584
  • عمومی 1926
  • فناوری اطلاعات 8464
  • فیلم 3546
  • کاریکاتور 519
  • مسکن 2212
  • ورزش 23778

جدیدترین مقالات

  • رئیس سازمان اسناد و مدارک دفاع مقدس:تنگه هرمز برگ برنده برای ایران است
    رئیس سازمان اسناد و مدارک دفاع مقدس:تنگه هرمز برگ برنده برای ایران است 11 ساعت پیش
  • پیگیری های منطقه آزاد کیش از حمایت‌های بیمه‌ای و مالیاتی تا تسهیل خروج کالا
    پیگیری های منطقه آزاد کیش از حمایت‌های بیمه‌ای و مالیاتی تا تسهیل خروج کالا 11 ساعت پیش
  • تعارض قوانین؛ مانع پنهان سنددار شدن بخش بزرگی از املاک
    تعارض قوانین؛ مانع پنهان سنددار شدن بخش بزرگی از املاک 11 ساعت پیش
  • شهردار محمدیه روند اجرای پروژه‌های عمرانی را بررسی کرد
    شهردار محمدیه روند اجرای پروژه‌های عمرانی را بررسی کرد 11 ساعت پیش
  • فارس در مسیر امنیت غذایی؛تأمین‌ پروتئین استان‌های همجوار
    فارس در مسیر امنیت غذایی؛تأمین‌ پروتئین استان‌های همجوار 11 ساعت پیش

لینکهای پیشنهادی

فاماسرور |  دانلود رایگان نرم افزار |  کلاس آنلاین

میزبانی در هاست ویندوز فاماسرور