@DataPlusScience_linkedin_7501157818226409473_01.pdf
153.4 KB
مهندسی گراف برای سیستمهای هوش مصنوعی چندعامله
سیستمهای هوش مصنوعی چندعامله (Multi-agent Systems) دیگر نیازی به پرامپتهای پیچیدهتر یا حلقههای تکرار (Loop) بیانتها ندارند. آنچه این سیستمها برای رسیدن به مقیاسپذیری و قابلیت اطمینان در محیطهای عملیاتی نیاز دارند، مهندسی گراف (Graph Engineering) است. برای اجرای دقیقتر، راهنمای گامبهگام مراحل و نکات کاربردی را یکجا ارائه میکند.
در حالی که در «Agent Loop» تمرکز بر حلقههای فکری مدل است، «Agent Graph» با ساختارمند کردن مسیرهای اجرا، انتقال وظایف (Handoffs) و مدیریت وضعیت (State)، امکان طراحی سیستمهای مهندسیشده را فراهم میکند.
مهمترین اصول در طراحی گرافهای عاملی:
• تعریف صریح گرهها و لبهها: هر گره باید وظیفهای مشخص (مانند برنامهریز، منتقد یا مجری ابزار) داشته باشد و لبهها باید شروط دقیق انتقال را تعیین کنند.
• مدیریت وضعیت و تاریخچه: استفاده از دادههای بادوام (Durable State) برای بازیابی دقیق پس از خطا و بازرسی عملیات.
سیستمهای هوش مصنوعی چندعامله (Multi-agent Systems) دیگر نیازی به پرامپتهای پیچیدهتر یا حلقههای تکرار (Loop) بیانتها ندارند. آنچه این سیستمها برای رسیدن به مقیاسپذیری و قابلیت اطمینان در محیطهای عملیاتی نیاز دارند، مهندسی گراف (Graph Engineering) است. برای اجرای دقیقتر، راهنمای گامبهگام مراحل و نکات کاربردی را یکجا ارائه میکند.
در حالی که در «Agent Loop» تمرکز بر حلقههای فکری مدل است، «Agent Graph» با ساختارمند کردن مسیرهای اجرا، انتقال وظایف (Handoffs) و مدیریت وضعیت (State)، امکان طراحی سیستمهای مهندسیشده را فراهم میکند.
مهمترین اصول در طراحی گرافهای عاملی:
• تعریف صریح گرهها و لبهها: هر گره باید وظیفهای مشخص (مانند برنامهریز، منتقد یا مجری ابزار) داشته باشد و لبهها باید شروط دقیق انتقال را تعیین کنند.
• مدیریت وضعیت و تاریخچه: استفاده از دادههای بادوام (Durable State) برای بازیابی دقیق پس از خطا و بازرسی عملیات.
هوش مصنوعی و علم داده به فارسی
🚀 تحول در تولید ویدیو با Wan 3.0 تیم علیبابا از مدل جدید ویدیویی خود به نام Wan 3.0 رونمایی کرد که امکان ساخت ویدیوهای ۳۰ ثانیهای را در یک مرحله فراهم میکند. این مدل با حذف نیاز به چسباندن کلیپهای کوتاه، جهشی بزرگ در کیفیت خروجیها ایجاد کرده است. …
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 ظهور مدل قدرتمند Wan 3.0 در دنیای تولید ویدیو
شرکت علیبابا با معرفی مدل Wan 3.0، استانداردهای جدیدی را در تولید و ویرایش هوشمند ویدیو تعریف کرده است. این مدل چندوجهی میتواند با دریافت متن، تصویر، صدا و حتی صفحات وب، ویدیوهایی با کیفیت 1080p و مدت زمان ۳۰ ثانیه همراه با صدای اختصاصی تولید کند. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
بر اساس تحلیلهای Artificial Analysis، این مدل جهشی بزرگ نسبت به نسخه قبلی خود داشته و در میان رقبا جایگاههای برتر را به دست آورده است:
* رتبه اول در ویرایش ویدیویی همراه با صدا
* رتبه دوم در تبدیل متن به ویدیو همراه با صدا
* رتبه پنجم در تبدیل تصویر به ویدیو همراه با صدا
قابلیتهای ویرایشی این سیستم شامل تغییرات مستقیم در جلوههای بصری، پیرنگ داستان، دیالوگ و صدا است که آن را به ابزاری همهکاره برای تولید محتوا تبدیل میکند. این مدل هماکنون در پلتفرم Alibaba Cloud Model Studio در دسترس عموم قرار گرفته است.
#Wan_3_0 #Alibaba_Cloud
شرکت علیبابا با معرفی مدل Wan 3.0، استانداردهای جدیدی را در تولید و ویرایش هوشمند ویدیو تعریف کرده است. این مدل چندوجهی میتواند با دریافت متن، تصویر، صدا و حتی صفحات وب، ویدیوهایی با کیفیت 1080p و مدت زمان ۳۰ ثانیه همراه با صدای اختصاصی تولید کند. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
بر اساس تحلیلهای Artificial Analysis، این مدل جهشی بزرگ نسبت به نسخه قبلی خود داشته و در میان رقبا جایگاههای برتر را به دست آورده است:
* رتبه اول در ویرایش ویدیویی همراه با صدا
* رتبه دوم در تبدیل متن به ویدیو همراه با صدا
* رتبه پنجم در تبدیل تصویر به ویدیو همراه با صدا
قابلیتهای ویرایشی این سیستم شامل تغییرات مستقیم در جلوههای بصری، پیرنگ داستان، دیالوگ و صدا است که آن را به ابزاری همهکاره برای تولید محتوا تبدیل میکند. این مدل هماکنون در پلتفرم Alibaba Cloud Model Studio در دسترس عموم قرار گرفته است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Wan_3_0 #Alibaba_Cloud
🚀 معرفی مدلهای جدید Gemini 3.8 Flash
گوگل از نسل جدید مدلهای خود با نام Gemini 3.8 Flash رونمایی کرد. این مدل برای تحلیل همزمان متن و تصویر با کارایی بالا بهینهسازی شده و تمرکز اصلی آن بر توسعه نرمافزار، کدنویسی و تستهای پیچیده برنامههاست. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
در بنچمارک DeepSWE 1.1، این مدل به امتیاز خیرهکننده ۷۳.۷٪ دست یافته که بسیار به مدل قدرتمند Claude Opus 5 نزدیک است، با این تفاوت که از نظر اقتصادی بسیار مقرونبهصرفهتر عمل میکند.
مهمترین ویژگیهای این بهروزرسانی:
* پشتیبانی عالی از تحلیل دادههای حجیم و ترکیب اطلاعات متنی و تصویری.
* عملکرد بسیار نزدیک به بهترین مدلهای حال حاضر بازار در تستهای کدنویسی.
* ارائه مدل تخصصی Gemini 3.8 Flash Cyber جهت شناسایی خودکار حفرههای امنیتی که در تستهای کروم، ۲.۶ برابر پچهای دقیقتری نسبت به رقبا تولید کرده است.
* قیمتگذاری رقابتی در API که تا پایان سال ۲۰۲۶ با نرخ ۰.۷۵ دلار برای ورودی و ۳.۷۵ دلار برای خروجی ارائه میشود.
📊 Data➕Science
گوگل از نسل جدید مدلهای خود با نام Gemini 3.8 Flash رونمایی کرد. این مدل برای تحلیل همزمان متن و تصویر با کارایی بالا بهینهسازی شده و تمرکز اصلی آن بر توسعه نرمافزار، کدنویسی و تستهای پیچیده برنامههاست. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
در بنچمارک DeepSWE 1.1، این مدل به امتیاز خیرهکننده ۷۳.۷٪ دست یافته که بسیار به مدل قدرتمند Claude Opus 5 نزدیک است، با این تفاوت که از نظر اقتصادی بسیار مقرونبهصرفهتر عمل میکند.
مهمترین ویژگیهای این بهروزرسانی:
* پشتیبانی عالی از تحلیل دادههای حجیم و ترکیب اطلاعات متنی و تصویری.
* عملکرد بسیار نزدیک به بهترین مدلهای حال حاضر بازار در تستهای کدنویسی.
* ارائه مدل تخصصی Gemini 3.8 Flash Cyber جهت شناسایی خودکار حفرههای امنیتی که در تستهای کروم، ۲.۶ برابر پچهای دقیقتری نسبت به رقبا تولید کرده است.
* قیمتگذاری رقابتی در API که تا پایان سال ۲۰۲۶ با نرخ ۰.۷۵ دلار برای ورودی و ۳.۷۵ دلار برای خروجی ارائه میشود.
📊 Data➕Science
🚀 معرفی مدل GLM-5.3 با قابلیتهای ویژه برای ردتیمینگ
تیم AbliterationAI نسخه جدیدی از مدل GLM-5.3 را با نام
این مدل در بنچمارکهای امنیتی عملکرد قابل توجهی داشته است:
• در CyberGym برای کشف آسیبپذیریهای OSS-Fuzz موفقیت ۸۴.۵ درصدی ثبت کرده که با مدلهای پیشرویی مانند GPT-5.5 و DeepSeek V4 رقابت میکند.
• در بنچمارک Terminal-Bench 4.0 نیز امتیاز ۴۱.۸ درصد را کسب کرده است.
از ویژگیهای کلیدی این سرویس میتوان به موارد زیر اشاره کرد:
• حذف محدودیتهای محتوایی (به جز موارد غیراخلاقی خاص)
• ارائه API سازگار با استانداردهای OpenAI و Anthropic
• تضمین عدم ذخیرهسازی پرامپتها و دادههای کاربر
• دسترسی از طریق وبسایت رسمی (Playground) برای تست اولیه
📊 Data➕Science
تیم AbliterationAI نسخه جدیدی از مدل GLM-5.3 را با نام
abliterated-model-large-v2 عرضه کرده است. در این مدل، وزنهای شبکه به گونهای اصلاح شدهاند که مکانیسمهای سختگیرانه رد درخواستها در آن کاهش یابد تا برای تحلیلهای امنیتی، تست نفوذ و استفاده توسط ایجنتها بهینهتر شود. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.این مدل در بنچمارکهای امنیتی عملکرد قابل توجهی داشته است:
• در CyberGym برای کشف آسیبپذیریهای OSS-Fuzz موفقیت ۸۴.۵ درصدی ثبت کرده که با مدلهای پیشرویی مانند GPT-5.5 و DeepSeek V4 رقابت میکند.
• در بنچمارک Terminal-Bench 4.0 نیز امتیاز ۴۱.۸ درصد را کسب کرده است.
از ویژگیهای کلیدی این سرویس میتوان به موارد زیر اشاره کرد:
• حذف محدودیتهای محتوایی (به جز موارد غیراخلاقی خاص)
• ارائه API سازگار با استانداردهای OpenAI و Anthropic
• تضمین عدم ذخیرهسازی پرامپتها و دادههای کاربر
• دسترسی از طریق وبسایت رسمی (Playground) برای تست اولیه
📊 Data➕Science
❤1
هوش مصنوعی و علم داده به فارسی
🚀 رونمایی از مدل هوشمند Fable 5.1 نسخه جدید Fable 5.1 با پیشرفتهای چشمگیر در بنچمارکهای هوش مصنوعی منتشر شد. این مدل در مقایسه با نسخه قبلی، در تمامی سطوح عملکردی، امتیازات بالاتری کسب کرده و بهینهسازیهای قابلتوجهی در هزینههای پردازشی ارائه میدهد.…
🤖 تست رایگان Claude Fable 5.1 در Arena
فرصت محدودی برای تست مستقیم یکی از مدلهای جدید هوش مصنوعی فراهم شده است. شما میتوانید مدل Claude Fable 5.1 را به طور مستقیم در پلتفرم Arena ارزیابی کنید.
برای استفاده از این امکان، کافی است در بخش Direct Mode این پلتفرم، مدل مذکور را از منوی کشویی انتخاب کنید. این دسترسی مستقیم تا ۵ سپتامبر (ساعت ۱۸:۳۰ به وقت تهران) برقرار است. پس از این تاریخ، مدل Fable 5.1 همچنان در بخشهای رقابتی Battle Mode و Agent Mode در دسترس کاربران خواهد بود.
#Claude_Fable_5_1 #Direct_Mode
فرصت محدودی برای تست مستقیم یکی از مدلهای جدید هوش مصنوعی فراهم شده است. شما میتوانید مدل Claude Fable 5.1 را به طور مستقیم در پلتفرم Arena ارزیابی کنید.
برای استفاده از این امکان، کافی است در بخش Direct Mode این پلتفرم، مدل مذکور را از منوی کشویی انتخاب کنید. این دسترسی مستقیم تا ۵ سپتامبر (ساعت ۱۸:۳۰ به وقت تهران) برقرار است. پس از این تاریخ، مدل Fable 5.1 همچنان در بخشهای رقابتی Battle Mode و Agent Mode در دسترس کاربران خواهد بود.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Claude_Fable_5_1 #Direct_Mode
هوش مصنوعی و علم داده به فارسی
🤖 معماری جدید Astra و چالشهای استدلال پنهان اخبار منتشر شده از معماری مدل جدید OpenAI موسوم به Astra نشان میدهد این مدل از تکنیکی به نام «عمق بازگشتی» یا «ترانسفورمر حلقوی» استفاده میکند. در این روش، مدل بهجای عبور متوالی از لایهها، متن را چندین بار…
ورود به عصر AGI با معرفی GPT-6 Astra
شرکت OpenAI بهتازگی از مدل قدرتمند GPT-6 Astra رونمایی کرد. این مدل که اولین خروجی آموزشی مبتنی بر بیش از ۱۰۰ هزار GPU است، در بنچمارکهای متعددی نظیر TBv4، SRE-Bench و FrontierMath عملکرد خیرهکنندهای را ثبت کرده و فاصله قابلتوجهی با رقبا ایجاد کرده است. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
گریگ براکمن، رئیس OpenAI، این نقطه عطف را سرآغاز عصر هوش مصنوعی عمومی (AGI) دانسته است. در ادامه به برخی از مهمترین نتایج عملکرد این مدل اشاره میکنیم:
* قابلیتهای کدنویسی: کسب امتیاز ۵۷.۷٪ در Terminal-Bench 4.0 که فراتر از رقباست.
* امنیت سایبری: ثبت دقت ۱۰۰٪ در ExploitBench و پیشتازی در SRE-Bench.
* عملکرد آکادمیک: دستیابی به نرخ خیرهکننده ۹۷.۶٪ در آزمون FrontierMath Tier 4.
* کار با کامپیوتر: برتری در بنچمارکهای OSWorld 2.0 و ScreenSpot-Pro با دقت ۹۲.۷٪.
* بهینهسازی هزینه: نرخ حل مسئله بالاتر در کنار هزینه API کمتر در مقایسه با سایر رقبا.
شرکت OpenAI بهتازگی از مدل قدرتمند GPT-6 Astra رونمایی کرد. این مدل که اولین خروجی آموزشی مبتنی بر بیش از ۱۰۰ هزار GPU است، در بنچمارکهای متعددی نظیر TBv4، SRE-Bench و FrontierMath عملکرد خیرهکنندهای را ثبت کرده و فاصله قابلتوجهی با رقبا ایجاد کرده است. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
گریگ براکمن، رئیس OpenAI، این نقطه عطف را سرآغاز عصر هوش مصنوعی عمومی (AGI) دانسته است. در ادامه به برخی از مهمترین نتایج عملکرد این مدل اشاره میکنیم:
* قابلیتهای کدنویسی: کسب امتیاز ۵۷.۷٪ در Terminal-Bench 4.0 که فراتر از رقباست.
* امنیت سایبری: ثبت دقت ۱۰۰٪ در ExploitBench و پیشتازی در SRE-Bench.
* عملکرد آکادمیک: دستیابی به نرخ خیرهکننده ۹۷.۶٪ در آزمون FrontierMath Tier 4.
* کار با کامپیوتر: برتری در بنچمارکهای OSWorld 2.0 و ScreenSpot-Pro با دقت ۹۲.۷٪.
* بهینهسازی هزینه: نرخ حل مسئله بالاتر در کنار هزینه API کمتر در مقایسه با سایر رقبا.
هوش مصنوعی و علم داده به فارسی
ورود به عصر AGI با معرفی GPT-6 Astra شرکت OpenAI بهتازگی از مدل قدرتمند GPT-6 Astra رونمایی کرد. این مدل که اولین خروجی آموزشی مبتنی بر بیش از ۱۰۰ هزار GPU است، در بنچمارکهای متعددی نظیر TBv4، SRE-Bench و FrontierMath عملکرد خیرهکنندهای را ثبت کرده…
📊 تحلیل عملکرد مدل Astra در مقابله با توهمات
محققان برای ارزیابی دقت فاکتوریال مدلهای زبانی، از دادههای چالشبرانگیزی استفاده کردهاند که پیشتر کاربران در آنها گزارش «توهم» (Hallucination) ثبت کرده بودند. این ارزیابی بر دو شاخص استوار است: بروز هرگونه خطای جدید در پاسخ و تکرار همان خطای قبلی گزارششده توسط کاربر. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
نتایج بنچمارک نشان میدهد مدل GPT-6 Astra با اختلاف عملکردی معنادار، نرخ خطای بسیار کمتری نسبت به مدلهای سری GPT-5.6 و GPT-5.5 دارد. مهمترین نکات این ارزیابی عبارتند از:
* در شاخص وقوع کلی توهم، مدل
* با افزایش زمان تأخیر (Latency)، دقت مدلها بهبود مییابد؛ اما
* در بازتولید خطاهای گزارششده، مدل
محققان برای ارزیابی دقت فاکتوریال مدلهای زبانی، از دادههای چالشبرانگیزی استفاده کردهاند که پیشتر کاربران در آنها گزارش «توهم» (Hallucination) ثبت کرده بودند. این ارزیابی بر دو شاخص استوار است: بروز هرگونه خطای جدید در پاسخ و تکرار همان خطای قبلی گزارششده توسط کاربر. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
نتایج بنچمارک نشان میدهد مدل GPT-6 Astra با اختلاف عملکردی معنادار، نرخ خطای بسیار کمتری نسبت به مدلهای سری GPT-5.6 و GPT-5.5 دارد. مهمترین نکات این ارزیابی عبارتند از:
* در شاخص وقوع کلی توهم، مدل
Astra نرخ خطایی بین ۴ تا ۸ درصد دارد، در حالی که مدل GPT-5.6 Sol با نرخ بالای ۳۰ درصد شروع میکند.* با افزایش زمان تأخیر (Latency)، دقت مدلها بهبود مییابد؛ اما
Astra حتی در تأخیرهای پایین نیز پایداری خیرهکنندهای در صحت پاسخها نشان میدهد.* در بازتولید خطاهای گزارششده، مدل
Astra با نرخ خطای حدود ۳ درصد، بسیار قابلاعتمادتر از رقبا ظاهر شده است.This media is not supported in your browser
VIEW IN TELEGRAM
🌍 تبدیل تصاویر دوبعدی به دنیای سهبعدی با WorldGen
مدل جدید WorldGen که توسط Hyper3D معرفی شده، مرزهای تبدیل تصویر به صحنههای سهبعدی را جابهجا کرده است. این ابزار قادر است تنها از یک تصویر دوبعدی، یک محیط سهبعدی کامل با ویژگیهای فیزیکی واقعی بسازد.
یکی از قابلیتهای کلیدی این مدل، استقلال اشیاء در صحنه است. شما میتوانید میز، صندلی و سایر اجزا را بهصورت جداگانه جابهجا، جایگزین یا اصلاح کنید. علاوه بر این، WorldGen بهطور خودکار ویژگیهای فیزیکی مانند برخورد، جرم و اصطکاک را به اشیاء اختصاص میدهد.
مهمترین ویژگیهای این مدل:
• خروجیهای بهینهشده برای استفاده در Blender، Unity و Unreal Engine
• امکان استفاده در پروژههای بازیسازی، فیلم، XR و شبیهسازی رباتیک
• قابلیت ترکیب با مدلهای ویدئویی مثل Seedance 2.5 برای اصلاح نورپردازی، متریال و تبدیل صحنهها به کلیپهای سینمایی
این فناوری گامی بزرگ برای تسریع در تولید محتوای سهبعدی و مدلسازی خودکار است.
#WorldGen #Seedance_2_5
مدل جدید WorldGen که توسط Hyper3D معرفی شده، مرزهای تبدیل تصویر به صحنههای سهبعدی را جابهجا کرده است. این ابزار قادر است تنها از یک تصویر دوبعدی، یک محیط سهبعدی کامل با ویژگیهای فیزیکی واقعی بسازد.
یکی از قابلیتهای کلیدی این مدل، استقلال اشیاء در صحنه است. شما میتوانید میز، صندلی و سایر اجزا را بهصورت جداگانه جابهجا، جایگزین یا اصلاح کنید. علاوه بر این، WorldGen بهطور خودکار ویژگیهای فیزیکی مانند برخورد، جرم و اصطکاک را به اشیاء اختصاص میدهد.
مهمترین ویژگیهای این مدل:
• خروجیهای بهینهشده برای استفاده در Blender، Unity و Unreal Engine
• امکان استفاده در پروژههای بازیسازی، فیلم، XR و شبیهسازی رباتیک
• قابلیت ترکیب با مدلهای ویدئویی مثل Seedance 2.5 برای اصلاح نورپردازی، متریال و تبدیل صحنهها به کلیپهای سینمایی
این فناوری گامی بزرگ برای تسریع در تولید محتوای سهبعدی و مدلسازی خودکار است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#WorldGen #Seedance_2_5
🚀 ظهور مدل قدرتمند Gemini 3.8 Flash
گوگل با معرفی Gemini 3.8 Flash بار دیگر استانداردهای مدلهای زبانی را جابهجا کرد. این مدل در بنچمارکهای متعددی موفق شده است عملکردی فراتر از مدلهای پیشرویی مانند Claude Opus 5 و GPT-5.6 Sol ارائه دهد. بررسی کامل مطلب نکات اصلی و زمینههای تکمیلی را منظمتر و دقیقتر مرور میکند.
مهمترین نکات درباره این نسخه:
- در وظایف پیچیده کدنویسی (DeepSWE-1.1)، به امتیاز ۷۳.۷ درصد دست یافته و با مدلهای برتر رقابت میکند.
- در شاخصهای ارزیابی هوش مصنوعی (Artificial Analysis Intelligence Index)، امتیاز ۵۹ را کسب کرده و در رده مدلهای سطح بالا قرار گرفته است.
- در وظایف مهندسی طولانی و فرآیندهای ایجنتیک، تعادل خیرهکنندهای میان هوشمندی و قیمت برقرار کرده است.
اگر به دنبال سرعت بالا و کارایی مناسب برای پروژههای توسعهمحور با هزینه منطقی هستید، این مدل یکی از بهترین گزینههای فعلی بازار است. البته Claude Opus 5 همچنان در برخی آزمونهای استدلال منطقی بسیار دشوار، پیشتاز است.
شما میتوانید برای بررسی و استفاده به Gemini.google.com مراجعه کنید.
گوگل با معرفی Gemini 3.8 Flash بار دیگر استانداردهای مدلهای زبانی را جابهجا کرد. این مدل در بنچمارکهای متعددی موفق شده است عملکردی فراتر از مدلهای پیشرویی مانند Claude Opus 5 و GPT-5.6 Sol ارائه دهد. بررسی کامل مطلب نکات اصلی و زمینههای تکمیلی را منظمتر و دقیقتر مرور میکند.
مهمترین نکات درباره این نسخه:
- در وظایف پیچیده کدنویسی (DeepSWE-1.1)، به امتیاز ۷۳.۷ درصد دست یافته و با مدلهای برتر رقابت میکند.
- در شاخصهای ارزیابی هوش مصنوعی (Artificial Analysis Intelligence Index)، امتیاز ۵۹ را کسب کرده و در رده مدلهای سطح بالا قرار گرفته است.
- در وظایف مهندسی طولانی و فرآیندهای ایجنتیک، تعادل خیرهکنندهای میان هوشمندی و قیمت برقرار کرده است.
اگر به دنبال سرعت بالا و کارایی مناسب برای پروژههای توسعهمحور با هزینه منطقی هستید، این مدل یکی از بهترین گزینههای فعلی بازار است. البته Claude Opus 5 همچنان در برخی آزمونهای استدلال منطقی بسیار دشوار، پیشتاز است.
شما میتوانید برای بررسی و استفاده به Gemini.google.com مراجعه کنید.
🌐 تحول پیشبینی وضع هوا با هوش مصنوعی
هوش مصنوعی مرزهای جدیدی را در علم هواشناسی ترسیم کرده است. مدل جدید WeatherNext 3 که توسط تیم Google DeepMind توسعه یافته، توانایی فوقالعادهای در تحلیل دادههای جوی پیدا کرده است. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
این مدل با پردازش دادههای زنده ماهوارهای، پیشبینیهای دقیقتری ارائه میدهد:
- بهروزرسانی ساعتی با رزولوشن ۵ کیلومتری
- وضوح ۵ برابر بیشتر نسبت به نسلهای گذشته
- افزایش ۵۰ درصدی دقت در پیشبینی بارش برف و باران
- تحلیل دقیق وضعیت باد و تابش خورشید برای بهینهسازی پروژههای انرژی پاک
به زودی شاهد ادغام این مدل قدرتمند در تمامی سرویسهای گوگل خواهیم بود که میتواند تصمیمگیری در حوزههای کشاورزی، مدیریت بحران و انرژیهای تجدیدپذیر را بهطور چشمگیری بهبود ببخشد.
#WeatherNext3 #GoogleDeepMind
هوش مصنوعی مرزهای جدیدی را در علم هواشناسی ترسیم کرده است. مدل جدید WeatherNext 3 که توسط تیم Google DeepMind توسعه یافته، توانایی فوقالعادهای در تحلیل دادههای جوی پیدا کرده است. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
این مدل با پردازش دادههای زنده ماهوارهای، پیشبینیهای دقیقتری ارائه میدهد:
- بهروزرسانی ساعتی با رزولوشن ۵ کیلومتری
- وضوح ۵ برابر بیشتر نسبت به نسلهای گذشته
- افزایش ۵۰ درصدی دقت در پیشبینی بارش برف و باران
- تحلیل دقیق وضعیت باد و تابش خورشید برای بهینهسازی پروژههای انرژی پاک
به زودی شاهد ادغام این مدل قدرتمند در تمامی سرویسهای گوگل خواهیم بود که میتواند تصمیمگیری در حوزههای کشاورزی، مدیریت بحران و انرژیهای تجدیدپذیر را بهطور چشمگیری بهبود ببخشد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#WeatherNext3 #GoogleDeepMind
Media is too big
VIEW IN TELEGRAM
🚀 ظهور GPT-6 Astra: انقلابی در دنیای هوش مصنوعی
شرکت OpenAI نسل جدید مدلهای خود یعنی GPT-6 Astra را معرفی کرد. این مدل بهعنوان نخستین هوش مصنوعی موفق به دستیابی به سطح Critical در امنیت سایبری شده است. دسترسی به این مدل در حال حاضر محدود به شرکای امنیتی بوده و طی روزهای آتی برای کاربران Plus و Pro فعال میشود.
برخی از توانمندیهای خیرهکننده این مدل در تستهای اولیه عبارتند از:
• ساخت بازیهای سهبعدی با صدا و گرافیک تنها با یک پرامپت
• تبدیل مستقیم تصاویر و ویدیوها به صحنههای قابل ویرایش در Blender یا Unreal Engine
• مدیریت سیستمعامل و نرمافزارها مانند یک کاربر انسانی (کار با CRM، تست وبسایت و تنظیم سختافزار)
• طراحی رابط کاربری از روی اسکچهای دستی
• آهنگسازی حرفهای با اتصال مستقیم به نرمافزار Ableton
• اجرای موازی صدها عامل هوشمند برای توسعه و دیباگ خودکار کدهای پیچیده
رقابت اصلی اکنون میان Astra و Claude Fable 5.1 است و باید منتظر بنچمارکهای مستقل برای تعیین رهبر واقعی بازار ماند. هزینه استفاده از این مدل نسبت به نسل قبل افزایش یافته است.
📊 Data➕Science
شرکت OpenAI نسل جدید مدلهای خود یعنی GPT-6 Astra را معرفی کرد. این مدل بهعنوان نخستین هوش مصنوعی موفق به دستیابی به سطح Critical در امنیت سایبری شده است. دسترسی به این مدل در حال حاضر محدود به شرکای امنیتی بوده و طی روزهای آتی برای کاربران Plus و Pro فعال میشود.
برخی از توانمندیهای خیرهکننده این مدل در تستهای اولیه عبارتند از:
• ساخت بازیهای سهبعدی با صدا و گرافیک تنها با یک پرامپت
• تبدیل مستقیم تصاویر و ویدیوها به صحنههای قابل ویرایش در Blender یا Unreal Engine
• مدیریت سیستمعامل و نرمافزارها مانند یک کاربر انسانی (کار با CRM، تست وبسایت و تنظیم سختافزار)
• طراحی رابط کاربری از روی اسکچهای دستی
• آهنگسازی حرفهای با اتصال مستقیم به نرمافزار Ableton
• اجرای موازی صدها عامل هوشمند برای توسعه و دیباگ خودکار کدهای پیچیده
رقابت اصلی اکنون میان Astra و Claude Fable 5.1 است و باید منتظر بنچمارکهای مستقل برای تعیین رهبر واقعی بازار ماند. هزینه استفاده از این مدل نسبت به نسل قبل افزایش یافته است.
📊 Data➕Science
❤1
هوش مصنوعی و رمزگشایی معمای ۳۷۳ ساله
دانشمندان حوزه هوش مصنوعی بهتازگی موفق شدند با استفاده از مدل Claude Fable 5.1، یکی از چالشهای تاریخی در دنیای رمزنگاری را حل کنند. این معما که شامل دو سطر از ۳۲ عدد در رسالهای متعلق به سال ۱۶۵۳ بود، بیش از سه قرن ذهن پژوهشگران را به خود مشغول کرده بود. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.
بر اساس تحلیل Vals AI، این مدل توانست در کمتر از ۴۵ دقیقه الگوی این رمز را کشف کند. هر عدد در واقع آدرسی برای اشاره به کلمات موجود در متن اصلی بود که با استخراج حروف ابتدایی آنها، پیامی برای آرزوی سلامتی پادشاه کارل دوم به دست آمد.
نکاتی درباره این دستاورد:
* این رمز در فهرست «۵۰ پیام رمزگذاریشده حلنشده برتر» قرار داشت.
* راه حل به دست آمده از نظر سادگی، بسیاری از متخصصان را غافلگیر کرد.
* برخی رمزنگاران همچنان در حال بررسی دقت این پاسخ در تطابق با متون تاریخی هستند.
این موفقیت نشان میدهد که مدلهای زبانی چگونه در تحلیل الگوهای پیچیده و بازسازی متون کهن، فراتر از توان تحلیل انسانی عمل میکنند.
📊 Data➕Science
دانشمندان حوزه هوش مصنوعی بهتازگی موفق شدند با استفاده از مدل Claude Fable 5.1، یکی از چالشهای تاریخی در دنیای رمزنگاری را حل کنند. این معما که شامل دو سطر از ۳۲ عدد در رسالهای متعلق به سال ۱۶۵۳ بود، بیش از سه قرن ذهن پژوهشگران را به خود مشغول کرده بود. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.
بر اساس تحلیل Vals AI، این مدل توانست در کمتر از ۴۵ دقیقه الگوی این رمز را کشف کند. هر عدد در واقع آدرسی برای اشاره به کلمات موجود در متن اصلی بود که با استخراج حروف ابتدایی آنها، پیامی برای آرزوی سلامتی پادشاه کارل دوم به دست آمد.
نکاتی درباره این دستاورد:
* این رمز در فهرست «۵۰ پیام رمزگذاریشده حلنشده برتر» قرار داشت.
* راه حل به دست آمده از نظر سادگی، بسیاری از متخصصان را غافلگیر کرد.
* برخی رمزنگاران همچنان در حال بررسی دقت این پاسخ در تطابق با متون تاریخی هستند.
این موفقیت نشان میدهد که مدلهای زبانی چگونه در تحلیل الگوهای پیچیده و بازسازی متون کهن، فراتر از توان تحلیل انسانی عمل میکنند.
📊 Data➕Science