OpenAI می‌گوید یک مدل مخفی هوش مصنوعی صدها مسئله ریاضی را در یک درخواست حل کرده است - ریاضیدانان خواستار مدارک هستند

By: decrypt.co|07/10/2026 21:46:03
0
اشتراک‌گذاری
copy
امتیازدهی ما در گوگلامتیازدهی ما در گوگل

OpenAI روز سه‌شنبه ۷۲۲ مقاله ریاضی را در GitHub منتشر کرد که همگی توسط یک مدل داخلی تولید شده‌اند که این شرکت آن را منتشر نکرده است. یک سخنگوی OpenAI گفت تقریباً همه چیز از یک درخواست واحد به یک عامل هوش مصنوعی واحد ناشی شده است، اگرچه برخی ممکن است چندین تلاش را شامل شده باشند.

این یک ادعای جسورانه و یک پیشرفت بالقوه مهم در زمینه ریاضیات است. اما همه از این موضوع خوشحال نیستند و به این هیاهو اعتقادی ندارند. Myriad: Nvidia چقدر بالا خواهد رفت؟ برای پیش‌بینی خود کلیک کنید.

"تا زمانی که آنها مدل را منتشر نکنند و مردم نتوانند نتایج آنها را تکرار کنند، فکر می‌کنم باید هر ادعایی درباره حل مسائل با یک عامل واحد را به عنوان تأیید نشده در نظر بگیرید،" اندرو ساترلند، ریاضیدان MIT، به Scientific American گفت. "ما باید مدارک را درخواست کنیم،" او گفت.

مقالات به ۳۷۲ "خانواده" از نتایج مرتبط گروه‌بندی شده‌اند و یک خانواده می‌تواند یک نظریه اصلی را با استدلال‌های همراه، پیامدها یا اثبات‌های جایگزین ترکیب کند. بنابراین ۷۲۲ شمارش مقالات است، نه مسائل حل شده. OpenAI می‌گوید تقریباً ۴۰۰۰ مسئله را به مدل ارائه داده و خروجی‌هایی را که به اندازه کافی مهم تشخیص داده است برای انتشار نگه داشته است.

نتیجه متوسط معادل تقریباً سه ساعت محاسبات تفکر ChatGPT Pro را استفاده کرده است، به گفته OpenAI. ادعای Navier-Stokes در ماه گذشته به طور قابل توجهی متفاوت به نظر می‌رسید، با ۱۰,۰۰۰ عامل هماهنگ که به مدت ۸۸ ساعت کار می‌کردند.

OpenAI خلاصه‌های مختصری از استدلال برای ۱۰ مورد از نتایج منتشر کرد. با این حال، تنها ۱۶۲ از ۷۲۲ مقاله دارای یک نتیجه اصلی بررسی شده توسط کامپیوتر هستند، طبق یک فهرست‌سازی در مخزن. این حدود ۲۲٪ از مجموعه است که به Lean، نرم‌افزاری که هر مرحله منطقی را به‌طور مکانیکی بررسی می‌کند، ترجمه شده است.

OpenAI خود می‌گوید که همه مقالات دارای فرمالیزاسیون Lean نیستند و "برخی از نتایج غیررسمی ممکن است مشکلاتی داشته باشند." به عبارت دیگر، بسیاری از آنچه که آنها منتشر کرده‌اند ممکن است نادرست باشد.

یک بررسی Lean گذرا تنها تأیید می‌کند که اثبات از بیانیه‌ای که به‌طور نوشته شده در Lean است، ناشی می‌شود. این نشان نمی‌دهد که بیانیه با مسئله اصلی مطابقت دارد یا اینکه نتیجه جدید یا مهم است، که بخشی است که اکنون ریاضیدانان باید قضاوت کنند.

و اینجاست که محققان ابروهای خود را بالا می‌برند.

من سعی می‌کردم اثبات OpenAI را بخوانم که عدد رنگی یک صفحه >= 6 است. اما این ریاضیات کاملاً غیرقابل باور است؟

به طریقی مدل پیدا کرد که هر K-coloring <= "قابل اندازه‌گیری ضعیف" K-coloring است، که به نظر می‌رسد از هیچ‌جا آمده است

1/2 pic.twitter.com/W13ScT3nel

--- دیمیتری ریبین (@DmitryRybin1) ۷ اکتبر ۲۰۲۶

مخزن openai/math Issues را خاموش کرده و هرگز یک درخواست کشش را قبول نکرده است. این ناامیدکننده است. اگر ۷۲۲ مقاله منتشر می‌کنید و از فرمالیزاسیون‌های Lean درخواست می‌کنید، به جایی نیاز دارید که مردم بتوانند آنها را ارسال کنند.

من در حال فرمالیزه کردن اثبات حدس Saxl OpenAI در Lean 4 هستم در برابر...

--- کیت آدلر (@keithadler) ۷ اکتبر ۲۰۲۶

"اکنون اینگونه است که هوش مصنوعی می‌تواند استدلال‌های ریاضی را در شرایطی تولید کند که انسان که آن را تحریک کرده است، قادر به درک استدلال‌ها، تأیید آنها یا مسئولیت‌پذیری برای آنها نیست،" مؤسسه مطالعات پیشرفته در پرینستون، نیوجرسی، در بیانیه‌ای گفت. "ما معتقدیم که درک انسانی از ریاضیات همچنان از اهمیت بالایی برخوردار است. چگونه، در این دوره جدید، می‌توانیم به سمت یک پارادایم جدید حرکت کنیم که شامل درک انسانی از ریاضیات به عنوان بخشی از خروجی علمی مسئولانه باشد؟"

با این حال، دیگران، مانند پروفسور آبهیشک ساه، بسیار هیجان‌زده هستند. "این یک روز بسیار بزرگ برای ریاضیات است،" او نوشت، اما اشاره کرد که بیشتر مسائل در دسته‌های "پیشرفت‌های استثنایی در یک برنامه موجود" از "پیشرفت‌های شگفت‌انگیز" قرار می‌گیرند.

این بدان معناست که بیشتر مسائل در مجموعه جالب هستند، اما غیرممکن یا تغییر دهنده بازی مانند مسائل هزاره نیستند. آن نقطه دقیقاً برای یک مسئله از ۷۲۲ محفوظ است: حدس کوآزی-ریمان.

برخی افکار بیشتر در مورد ۳۷۲ نتیجه‌ای که امروز OpenAI منتشر کرد، در ۷۲۲ مقاله.

اگر بخواهم نظریه‌هایی را که ریاضیدانان اثبات می‌کنند و منتشر می‌کنند بر اساس ماهیت پیشگامانه آنها طبقه‌بندی کنم، (بسیار به‌طور تقریبی) آنها را به چهار دسته تقسیم می‌کنم:

A) غیر پیشگام...

--- آبهیشک ساه (@ObhishekSaha) ۷ اکتبر ۲۰۲۶

انتشار همچنین از آنچه که یک گروه مشاوره در مؤسسه مطالعات پیشرفته در ۲۹ سپتامبر توصیه کرده است، کوتاه است: نام مدل، درخواست‌ها، زنجیره‌ای خلاصه از تفکر، زمان صرف شده و هزینه محاسباتی برای هر نتیجه. OpenAI ارقام محاسبات متوسط و ۱۰ خلاصه استدلال منتشر کرده است اما هیچ درخواست‌هایی منتشر نکرده و می‌گوید هنوز در حال کار بر روی انتشار مسئولانه مدل است.

دانیل لیت، ریاضیدان دانشگاه تورنتو، نظر مخالفی دارد و استدلال می‌کند که دلیلی برای درخواست از این شرکت برای نگه‌داشتن پاسخ‌ها به این سوالات ریاضی به صورت محرمانه وجود ندارد.

Anthropic با اثبات حدس آخر فرما در ماه گذشته، مسیر متفاوتی را در پیش گرفت و تمام ۱۳ میلیون خط را به‌طور عمومی در GitHub منتشر کرد. آن اثبات یک نظریه را که اندرو وایلز در سال ۱۹۹۵ منتشر کرد، فرمالیزه کرد، نه اینکه ادعای نتایج جدید کند.

OpenAI می‌گوید که به محض به دست آوردن آنها، فرمالیزاسیون‌های Lean را اضافه خواهد کرد؛ در حال حاضر، ۱۶۲ از ۷۲۲ مقاله دارای یکی هستند.

قیمت --

--
--
--

این محتوا صرفاً برای اطلاع‌رسانی عمومی ارائه شده است و به‌منزله مشاوره مالی، سرمایه‌گذاری، حقوقی یا مالیاتی تلقی نمی‌شود. هرگونه رویداد، جایزه، کمپین آنلاین یا اطلاعات مرتبط که در اینجا ذکر شده است، نباید به‌عنوان توصیه، ترغیب یا دعوت به خرید، فروش، معامله یا هرگونه دادوستد دیگر دارایی‌های رمزارزی تلقی شود. دارایی‌های رمزارزی از نوسان بالایی برخوردار هستند و ممکن است منجر به زیان شوند. دسترسی به خدمات، محصولات و رویدادهای مرتبط با WEEX ممکن است بسته به منطقه جغرافیایی متفاوت باشد. اطمینان از اینکه استفاده شما از این خدمات با قوانین و مقررات محلی مطابقت دارد، بر عهده خود شماست.

ممکن است شما نیز علاقه‌مند باشید

سیدرها: نرخ‌های رکوردی، شوق به هوش مصنوعی و برزیل نقشه سهام را دوباره سازماندهی می‌کنند، اکنون چه می‌تواند اتفاق بیفتد؟

افزایش بازده‌ها در ایالات متحده، شتاب فناوری و رالی برزیلی ماه گذشته را در میان سیدرها مشخص کرد. تحلیلگران توضیح می‌دهند که چه چیزی می‌تواند این روندها را حفظ کند و کجا فرصت‌های سرمایه‌گذاری را می‌بینند.

تفسیر مورگان استنلی: کمبود حافظه AI دشوار است، چرا انویدیا به جای آن «کاهش مشخصات» می‌دهد؟

سرمایه‌گذار مشهور، کوین اولیری: فرصت‌های بعدی AI در انرژی، کریپتو در جستجوی ارزش جدید است

بنیان‌گذار هایپرکال می‌گوید گزینه‌ها باید تجارت را ساده‌تر کنند تا با پرپت‌ها رقابت کنند

چرا بازارها در حال افزایش و تحت فشار هستند

سهام ایالات متحده دوباره به رکوردهای جدیدی رسیدند، که به لطف سود شرکت‌های انرژی و فناوری است. در عین حال، افزایش قیمت‌های انرژی، بازدهی اوراق قرضه و هزینه‌های زیرساخت هوش مصنوعی فشارهای جدیدی بر اقتصاد وارد می‌کند.

Mistral Large 4، معروف به «Le Chonk»: غول فرانسوی در برابر GPT-6 Astra و Claude

Mistral Large 4، معروف به «Le Chonk» را معرفی می‌کند: ۱۰۰۰ میلیارد پارامتر، قیمت‌های شکسته و حاکمیت اروپایی. نمرات آن در برابر GPT-6 Astra و Claude.
...
iconiconiconiconiconiconiconicon
پشتیبانی مشتری:@weikecs
همکاری تجاری:@weikecs
معاملات کمّی و بازارسازی:[email protected]
برنامه VIP:[email protected]