هوش مصنوعی و علم داده به فارسی
🤖 معماری جدید Astra و چالشهای استدلال پنهان اخبار منتشر شده از معماری مدل جدید OpenAI موسوم به Astra نشان میدهد این مدل از تکنیکی به نام «عمق بازگشتی» یا «ترانسفورمر حلقوی» استفاده میکند. در این روش، مدل بهجای عبور متوالی از لایهها، متن را چندین بار…
ورود به عصر AGI با معرفی GPT-6 Astra
شرکت OpenAI بهتازگی از مدل قدرتمند GPT-6 Astra رونمایی کرد. این مدل که اولین خروجی آموزشی مبتنی بر بیش از ۱۰۰ هزار GPU است، در بنچمارکهای متعددی نظیر TBv4، SRE-Bench و FrontierMath عملکرد خیرهکنندهای را ثبت کرده و فاصله قابلتوجهی با رقبا ایجاد کرده است. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
گریگ براکمن، رئیس OpenAI، این نقطه عطف را سرآغاز عصر هوش مصنوعی عمومی (AGI) دانسته است. در ادامه به برخی از مهمترین نتایج عملکرد این مدل اشاره میکنیم:
* قابلیتهای کدنویسی: کسب امتیاز ۵۷.۷٪ در Terminal-Bench 4.0 که فراتر از رقباست.
* امنیت سایبری: ثبت دقت ۱۰۰٪ در ExploitBench و پیشتازی در SRE-Bench.
* عملکرد آکادمیک: دستیابی به نرخ خیرهکننده ۹۷.۶٪ در آزمون FrontierMath Tier 4.
* کار با کامپیوتر: برتری در بنچمارکهای OSWorld 2.0 و ScreenSpot-Pro با دقت ۹۲.۷٪.
* بهینهسازی هزینه: نرخ حل مسئله بالاتر در کنار هزینه API کمتر در مقایسه با سایر رقبا.
شرکت OpenAI بهتازگی از مدل قدرتمند GPT-6 Astra رونمایی کرد. این مدل که اولین خروجی آموزشی مبتنی بر بیش از ۱۰۰ هزار GPU است، در بنچمارکهای متعددی نظیر TBv4، SRE-Bench و FrontierMath عملکرد خیرهکنندهای را ثبت کرده و فاصله قابلتوجهی با رقبا ایجاد کرده است. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
گریگ براکمن، رئیس OpenAI، این نقطه عطف را سرآغاز عصر هوش مصنوعی عمومی (AGI) دانسته است. در ادامه به برخی از مهمترین نتایج عملکرد این مدل اشاره میکنیم:
* قابلیتهای کدنویسی: کسب امتیاز ۵۷.۷٪ در Terminal-Bench 4.0 که فراتر از رقباست.
* امنیت سایبری: ثبت دقت ۱۰۰٪ در ExploitBench و پیشتازی در SRE-Bench.
* عملکرد آکادمیک: دستیابی به نرخ خیرهکننده ۹۷.۶٪ در آزمون FrontierMath Tier 4.
* کار با کامپیوتر: برتری در بنچمارکهای OSWorld 2.0 و ScreenSpot-Pro با دقت ۹۲.۷٪.
* بهینهسازی هزینه: نرخ حل مسئله بالاتر در کنار هزینه API کمتر در مقایسه با سایر رقبا.
هوش مصنوعی و علم داده به فارسی
ورود به عصر AGI با معرفی GPT-6 Astra شرکت OpenAI بهتازگی از مدل قدرتمند GPT-6 Astra رونمایی کرد. این مدل که اولین خروجی آموزشی مبتنی بر بیش از ۱۰۰ هزار GPU است، در بنچمارکهای متعددی نظیر TBv4، SRE-Bench و FrontierMath عملکرد خیرهکنندهای را ثبت کرده…
📊 تحلیل عملکرد مدل Astra در مقابله با توهمات
محققان برای ارزیابی دقت فاکتوریال مدلهای زبانی، از دادههای چالشبرانگیزی استفاده کردهاند که پیشتر کاربران در آنها گزارش «توهم» (Hallucination) ثبت کرده بودند. این ارزیابی بر دو شاخص استوار است: بروز هرگونه خطای جدید در پاسخ و تکرار همان خطای قبلی گزارششده توسط کاربر. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
نتایج بنچمارک نشان میدهد مدل GPT-6 Astra با اختلاف عملکردی معنادار، نرخ خطای بسیار کمتری نسبت به مدلهای سری GPT-5.6 و GPT-5.5 دارد. مهمترین نکات این ارزیابی عبارتند از:
* در شاخص وقوع کلی توهم، مدل
* با افزایش زمان تأخیر (Latency)، دقت مدلها بهبود مییابد؛ اما
* در بازتولید خطاهای گزارششده، مدل
محققان برای ارزیابی دقت فاکتوریال مدلهای زبانی، از دادههای چالشبرانگیزی استفاده کردهاند که پیشتر کاربران در آنها گزارش «توهم» (Hallucination) ثبت کرده بودند. این ارزیابی بر دو شاخص استوار است: بروز هرگونه خطای جدید در پاسخ و تکرار همان خطای قبلی گزارششده توسط کاربر. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
نتایج بنچمارک نشان میدهد مدل GPT-6 Astra با اختلاف عملکردی معنادار، نرخ خطای بسیار کمتری نسبت به مدلهای سری GPT-5.6 و GPT-5.5 دارد. مهمترین نکات این ارزیابی عبارتند از:
* در شاخص وقوع کلی توهم، مدل
Astra نرخ خطایی بین ۴ تا ۸ درصد دارد، در حالی که مدل GPT-5.6 Sol با نرخ بالای ۳۰ درصد شروع میکند.* با افزایش زمان تأخیر (Latency)، دقت مدلها بهبود مییابد؛ اما
Astra حتی در تأخیرهای پایین نیز پایداری خیرهکنندهای در صحت پاسخها نشان میدهد.* در بازتولید خطاهای گزارششده، مدل
Astra با نرخ خطای حدود ۳ درصد، بسیار قابلاعتمادتر از رقبا ظاهر شده است.This media is not supported in your browser
VIEW IN TELEGRAM
🌍 تبدیل تصاویر دوبعدی به دنیای سهبعدی با WorldGen
مدل جدید WorldGen که توسط Hyper3D معرفی شده، مرزهای تبدیل تصویر به صحنههای سهبعدی را جابهجا کرده است. این ابزار قادر است تنها از یک تصویر دوبعدی، یک محیط سهبعدی کامل با ویژگیهای فیزیکی واقعی بسازد.
یکی از قابلیتهای کلیدی این مدل، استقلال اشیاء در صحنه است. شما میتوانید میز، صندلی و سایر اجزا را بهصورت جداگانه جابهجا، جایگزین یا اصلاح کنید. علاوه بر این، WorldGen بهطور خودکار ویژگیهای فیزیکی مانند برخورد، جرم و اصطکاک را به اشیاء اختصاص میدهد.
مهمترین ویژگیهای این مدل:
• خروجیهای بهینهشده برای استفاده در Blender، Unity و Unreal Engine
• امکان استفاده در پروژههای بازیسازی، فیلم، XR و شبیهسازی رباتیک
• قابلیت ترکیب با مدلهای ویدئویی مثل Seedance 2.5 برای اصلاح نورپردازی، متریال و تبدیل صحنهها به کلیپهای سینمایی
این فناوری گامی بزرگ برای تسریع در تولید محتوای سهبعدی و مدلسازی خودکار است.
#WorldGen #Seedance_2_5
مدل جدید WorldGen که توسط Hyper3D معرفی شده، مرزهای تبدیل تصویر به صحنههای سهبعدی را جابهجا کرده است. این ابزار قادر است تنها از یک تصویر دوبعدی، یک محیط سهبعدی کامل با ویژگیهای فیزیکی واقعی بسازد.
یکی از قابلیتهای کلیدی این مدل، استقلال اشیاء در صحنه است. شما میتوانید میز، صندلی و سایر اجزا را بهصورت جداگانه جابهجا، جایگزین یا اصلاح کنید. علاوه بر این، WorldGen بهطور خودکار ویژگیهای فیزیکی مانند برخورد، جرم و اصطکاک را به اشیاء اختصاص میدهد.
مهمترین ویژگیهای این مدل:
• خروجیهای بهینهشده برای استفاده در Blender، Unity و Unreal Engine
• امکان استفاده در پروژههای بازیسازی، فیلم، XR و شبیهسازی رباتیک
• قابلیت ترکیب با مدلهای ویدئویی مثل Seedance 2.5 برای اصلاح نورپردازی، متریال و تبدیل صحنهها به کلیپهای سینمایی
این فناوری گامی بزرگ برای تسریع در تولید محتوای سهبعدی و مدلسازی خودکار است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#WorldGen #Seedance_2_5
🚀 ظهور مدل قدرتمند Gemini 3.8 Flash
گوگل با معرفی Gemini 3.8 Flash بار دیگر استانداردهای مدلهای زبانی را جابهجا کرد. این مدل در بنچمارکهای متعددی موفق شده است عملکردی فراتر از مدلهای پیشرویی مانند Claude Opus 5 و GPT-5.6 Sol ارائه دهد. بررسی کامل مطلب نکات اصلی و زمینههای تکمیلی را منظمتر و دقیقتر مرور میکند.
مهمترین نکات درباره این نسخه:
- در وظایف پیچیده کدنویسی (DeepSWE-1.1)، به امتیاز ۷۳.۷ درصد دست یافته و با مدلهای برتر رقابت میکند.
- در شاخصهای ارزیابی هوش مصنوعی (Artificial Analysis Intelligence Index)، امتیاز ۵۹ را کسب کرده و در رده مدلهای سطح بالا قرار گرفته است.
- در وظایف مهندسی طولانی و فرآیندهای ایجنتیک، تعادل خیرهکنندهای میان هوشمندی و قیمت برقرار کرده است.
اگر به دنبال سرعت بالا و کارایی مناسب برای پروژههای توسعهمحور با هزینه منطقی هستید، این مدل یکی از بهترین گزینههای فعلی بازار است. البته Claude Opus 5 همچنان در برخی آزمونهای استدلال منطقی بسیار دشوار، پیشتاز است.
شما میتوانید برای بررسی و استفاده به Gemini.google.com مراجعه کنید.
گوگل با معرفی Gemini 3.8 Flash بار دیگر استانداردهای مدلهای زبانی را جابهجا کرد. این مدل در بنچمارکهای متعددی موفق شده است عملکردی فراتر از مدلهای پیشرویی مانند Claude Opus 5 و GPT-5.6 Sol ارائه دهد. بررسی کامل مطلب نکات اصلی و زمینههای تکمیلی را منظمتر و دقیقتر مرور میکند.
مهمترین نکات درباره این نسخه:
- در وظایف پیچیده کدنویسی (DeepSWE-1.1)، به امتیاز ۷۳.۷ درصد دست یافته و با مدلهای برتر رقابت میکند.
- در شاخصهای ارزیابی هوش مصنوعی (Artificial Analysis Intelligence Index)، امتیاز ۵۹ را کسب کرده و در رده مدلهای سطح بالا قرار گرفته است.
- در وظایف مهندسی طولانی و فرآیندهای ایجنتیک، تعادل خیرهکنندهای میان هوشمندی و قیمت برقرار کرده است.
اگر به دنبال سرعت بالا و کارایی مناسب برای پروژههای توسعهمحور با هزینه منطقی هستید، این مدل یکی از بهترین گزینههای فعلی بازار است. البته Claude Opus 5 همچنان در برخی آزمونهای استدلال منطقی بسیار دشوار، پیشتاز است.
شما میتوانید برای بررسی و استفاده به Gemini.google.com مراجعه کنید.
🌐 تحول پیشبینی وضع هوا با هوش مصنوعی
هوش مصنوعی مرزهای جدیدی را در علم هواشناسی ترسیم کرده است. مدل جدید WeatherNext 3 که توسط تیم Google DeepMind توسعه یافته، توانایی فوقالعادهای در تحلیل دادههای جوی پیدا کرده است. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
این مدل با پردازش دادههای زنده ماهوارهای، پیشبینیهای دقیقتری ارائه میدهد:
- بهروزرسانی ساعتی با رزولوشن ۵ کیلومتری
- وضوح ۵ برابر بیشتر نسبت به نسلهای گذشته
- افزایش ۵۰ درصدی دقت در پیشبینی بارش برف و باران
- تحلیل دقیق وضعیت باد و تابش خورشید برای بهینهسازی پروژههای انرژی پاک
به زودی شاهد ادغام این مدل قدرتمند در تمامی سرویسهای گوگل خواهیم بود که میتواند تصمیمگیری در حوزههای کشاورزی، مدیریت بحران و انرژیهای تجدیدپذیر را بهطور چشمگیری بهبود ببخشد.
#WeatherNext3 #GoogleDeepMind
هوش مصنوعی مرزهای جدیدی را در علم هواشناسی ترسیم کرده است. مدل جدید WeatherNext 3 که توسط تیم Google DeepMind توسعه یافته، توانایی فوقالعادهای در تحلیل دادههای جوی پیدا کرده است. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
این مدل با پردازش دادههای زنده ماهوارهای، پیشبینیهای دقیقتری ارائه میدهد:
- بهروزرسانی ساعتی با رزولوشن ۵ کیلومتری
- وضوح ۵ برابر بیشتر نسبت به نسلهای گذشته
- افزایش ۵۰ درصدی دقت در پیشبینی بارش برف و باران
- تحلیل دقیق وضعیت باد و تابش خورشید برای بهینهسازی پروژههای انرژی پاک
به زودی شاهد ادغام این مدل قدرتمند در تمامی سرویسهای گوگل خواهیم بود که میتواند تصمیمگیری در حوزههای کشاورزی، مدیریت بحران و انرژیهای تجدیدپذیر را بهطور چشمگیری بهبود ببخشد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#WeatherNext3 #GoogleDeepMind
Media is too big
VIEW IN TELEGRAM
🚀 ظهور GPT-6 Astra: انقلابی در دنیای هوش مصنوعی
شرکت OpenAI نسل جدید مدلهای خود یعنی GPT-6 Astra را معرفی کرد. این مدل بهعنوان نخستین هوش مصنوعی موفق به دستیابی به سطح Critical در امنیت سایبری شده است. دسترسی به این مدل در حال حاضر محدود به شرکای امنیتی بوده و طی روزهای آتی برای کاربران Plus و Pro فعال میشود.
برخی از توانمندیهای خیرهکننده این مدل در تستهای اولیه عبارتند از:
• ساخت بازیهای سهبعدی با صدا و گرافیک تنها با یک پرامپت
• تبدیل مستقیم تصاویر و ویدیوها به صحنههای قابل ویرایش در Blender یا Unreal Engine
• مدیریت سیستمعامل و نرمافزارها مانند یک کاربر انسانی (کار با CRM، تست وبسایت و تنظیم سختافزار)
• طراحی رابط کاربری از روی اسکچهای دستی
• آهنگسازی حرفهای با اتصال مستقیم به نرمافزار Ableton
• اجرای موازی صدها عامل هوشمند برای توسعه و دیباگ خودکار کدهای پیچیده
رقابت اصلی اکنون میان Astra و Claude Fable 5.1 است و باید منتظر بنچمارکهای مستقل برای تعیین رهبر واقعی بازار ماند. هزینه استفاده از این مدل نسبت به نسل قبل افزایش یافته است.
📊 Data➕Science
شرکت OpenAI نسل جدید مدلهای خود یعنی GPT-6 Astra را معرفی کرد. این مدل بهعنوان نخستین هوش مصنوعی موفق به دستیابی به سطح Critical در امنیت سایبری شده است. دسترسی به این مدل در حال حاضر محدود به شرکای امنیتی بوده و طی روزهای آتی برای کاربران Plus و Pro فعال میشود.
برخی از توانمندیهای خیرهکننده این مدل در تستهای اولیه عبارتند از:
• ساخت بازیهای سهبعدی با صدا و گرافیک تنها با یک پرامپت
• تبدیل مستقیم تصاویر و ویدیوها به صحنههای قابل ویرایش در Blender یا Unreal Engine
• مدیریت سیستمعامل و نرمافزارها مانند یک کاربر انسانی (کار با CRM، تست وبسایت و تنظیم سختافزار)
• طراحی رابط کاربری از روی اسکچهای دستی
• آهنگسازی حرفهای با اتصال مستقیم به نرمافزار Ableton
• اجرای موازی صدها عامل هوشمند برای توسعه و دیباگ خودکار کدهای پیچیده
رقابت اصلی اکنون میان Astra و Claude Fable 5.1 است و باید منتظر بنچمارکهای مستقل برای تعیین رهبر واقعی بازار ماند. هزینه استفاده از این مدل نسبت به نسل قبل افزایش یافته است.
📊 Data➕Science
❤1
هوش مصنوعی و رمزگشایی معمای ۳۷۳ ساله
دانشمندان حوزه هوش مصنوعی بهتازگی موفق شدند با استفاده از مدل Claude Fable 5.1، یکی از چالشهای تاریخی در دنیای رمزنگاری را حل کنند. این معما که شامل دو سطر از ۳۲ عدد در رسالهای متعلق به سال ۱۶۵۳ بود، بیش از سه قرن ذهن پژوهشگران را به خود مشغول کرده بود. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.
بر اساس تحلیل Vals AI، این مدل توانست در کمتر از ۴۵ دقیقه الگوی این رمز را کشف کند. هر عدد در واقع آدرسی برای اشاره به کلمات موجود در متن اصلی بود که با استخراج حروف ابتدایی آنها، پیامی برای آرزوی سلامتی پادشاه کارل دوم به دست آمد.
نکاتی درباره این دستاورد:
* این رمز در فهرست «۵۰ پیام رمزگذاریشده حلنشده برتر» قرار داشت.
* راه حل به دست آمده از نظر سادگی، بسیاری از متخصصان را غافلگیر کرد.
* برخی رمزنگاران همچنان در حال بررسی دقت این پاسخ در تطابق با متون تاریخی هستند.
این موفقیت نشان میدهد که مدلهای زبانی چگونه در تحلیل الگوهای پیچیده و بازسازی متون کهن، فراتر از توان تحلیل انسانی عمل میکنند.
📊 Data➕Science
دانشمندان حوزه هوش مصنوعی بهتازگی موفق شدند با استفاده از مدل Claude Fable 5.1، یکی از چالشهای تاریخی در دنیای رمزنگاری را حل کنند. این معما که شامل دو سطر از ۳۲ عدد در رسالهای متعلق به سال ۱۶۵۳ بود، بیش از سه قرن ذهن پژوهشگران را به خود مشغول کرده بود. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.
بر اساس تحلیل Vals AI، این مدل توانست در کمتر از ۴۵ دقیقه الگوی این رمز را کشف کند. هر عدد در واقع آدرسی برای اشاره به کلمات موجود در متن اصلی بود که با استخراج حروف ابتدایی آنها، پیامی برای آرزوی سلامتی پادشاه کارل دوم به دست آمد.
نکاتی درباره این دستاورد:
* این رمز در فهرست «۵۰ پیام رمزگذاریشده حلنشده برتر» قرار داشت.
* راه حل به دست آمده از نظر سادگی، بسیاری از متخصصان را غافلگیر کرد.
* برخی رمزنگاران همچنان در حال بررسی دقت این پاسخ در تطابق با متون تاریخی هستند.
این موفقیت نشان میدهد که مدلهای زبانی چگونه در تحلیل الگوهای پیچیده و بازسازی متون کهن، فراتر از توان تحلیل انسانی عمل میکنند.
📊 Data➕Science
This media is not supported in your browser
VIEW IN TELEGRAM
💻 سنجش آسان توان سختافزاری برای اجرای محلی مدلها
آیا میخواهید بدانید سیستم شما توانایی اجرای چه مدلهای زبانی محلی را دارد؟
ابزار متنباز Magnitude سختافزار شما را ارزیابی کرده و مدلهای مناسب را بر اساس معیارهای زیر رتبهبندی میکند:
• سرعت (Speed)
• دقت (Accuracy)
• هوشمندی (Intelligence)
• حافظه مورد نیاز (Memory)
برای تحلیل سیستم خود کافی است دستورات زیر را در خط فرمان اجرا کنید:
پس از تحلیل، میتوانید فریمورک و ابزار دلخواه خود مانند Claude Code یا OpenCode را برای اجرای مدلها انتخاب کنید.
#Magnitude #Claude_Code
آیا میخواهید بدانید سیستم شما توانایی اجرای چه مدلهای زبانی محلی را دارد؟
ابزار متنباز Magnitude سختافزار شما را ارزیابی کرده و مدلهای مناسب را بر اساس معیارهای زیر رتبهبندی میکند:
• سرعت (Speed)
• دقت (Accuracy)
• هوشمندی (Intelligence)
• حافظه مورد نیاز (Memory)
برای تحلیل سیستم خود کافی است دستورات زیر را در خط فرمان اجرا کنید:
npm i -g @magnitudedev/cli
magnitude setupپس از تحلیل، میتوانید فریمورک و ابزار دلخواه خود مانند Claude Code یا OpenCode را برای اجرای مدلها انتخاب کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Magnitude #Claude_Code