This media is not supported in your browser
VIEW IN TELEGRAM
📊 یادگیری تعاملی مفاهیم علم داده
اگر به دنبال درک عمیقتر مفاهیم پیچیده در Machine Learning هستید، این مخزن (Repository) یکی از کاربردیترین منابع آموزشی است. این پروژه با تبدیل ایدههای انتزاعی به آزمایشهای بصری، فرآیند یادگیری را برای متخصصان سطح متوسط تا پیشرفته بسیار ملموس کرده است.
⚡ با استفاده از این ابزار میتوانید مدلهای مختلف را بررسی کرده و با تغییر پارامترها، بلافاصله نتایج حاصل از محاسبات را مشاهده کنید. این رویکرد عملی به شما کمک میکند تا رفتار مدلها در شرایط گوناگون و تاثیر متغیرها بر خروجی نهایی را به درستی درک کنید.
🚀 این منبع که بر پایه Python توسعه یافته است، برای تقویت شهود ریاضی و فنی در پروژههای تحلیل داده یک انتخاب عالی محسوب میشود. شما میتوانید از طریق لینک زیر به کدهای منبع دسترسی داشته باشید.
GitHub
#GeostatsGuy #InteractivePython
اگر به دنبال درک عمیقتر مفاهیم پیچیده در Machine Learning هستید، این مخزن (Repository) یکی از کاربردیترین منابع آموزشی است. این پروژه با تبدیل ایدههای انتزاعی به آزمایشهای بصری، فرآیند یادگیری را برای متخصصان سطح متوسط تا پیشرفته بسیار ملموس کرده است.
⚡ با استفاده از این ابزار میتوانید مدلهای مختلف را بررسی کرده و با تغییر پارامترها، بلافاصله نتایج حاصل از محاسبات را مشاهده کنید. این رویکرد عملی به شما کمک میکند تا رفتار مدلها در شرایط گوناگون و تاثیر متغیرها بر خروجی نهایی را به درستی درک کنید.
🚀 این منبع که بر پایه Python توسعه یافته است، برای تقویت شهود ریاضی و فنی در پروژههای تحلیل داده یک انتخاب عالی محسوب میشود. شما میتوانید از طریق لینک زیر به کدهای منبع دسترسی داشته باشید.
GitHub
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#GeostatsGuy #InteractivePython
🎬 رونمایی از مدل ویدئوساز جدید MiniMax H3
شرکت MiniMax در حال آمادهسازی برای عرضه مدل ویدئوساز جدید خود با نام H3 است که برای پلتفرم Hailuo AI طراحی شده است. این مدل هماکنون در اختیار گروهی از تستکنندهها قرار گرفته و نمونههای خروجی آن به سرعت در حال انتشار است.
⚡ اگرچه هنوز اطلاعیه رسمی از سوی تیم توسعهدهنده منتشر نشده است، اما کاربران اولیه با استفاده از هشتگهای مرتبط، قابلیتهای نسل جدید این ابزار تولید ویدئو را به نمایش گذاشتهاند. با توجه به عملکرد قدرتمند نسخههای قبلی، انتظار میرود H3 استانداردهای جدیدی در زمینه کیفیت بصری و ثبات حرکات در ویدئوهای مبتنی بر AI تعیین کند.
🔬 پیشرفتهای اخیر در مدلهای Video Generation نشاندهنده رقابت تنگاتنگ شرکتها برای رسیدن به واقعگرایی بیشتر است. باید منتظر ماند و دید آیا این مدل جدید میتواند در بنچمارکهای کیفی، عملکرد بهتری نسبت به رقبای مطرح خود داشته باشد یا خیر.
#MiniMax_H3 #Hailuo_AI
شرکت MiniMax در حال آمادهسازی برای عرضه مدل ویدئوساز جدید خود با نام H3 است که برای پلتفرم Hailuo AI طراحی شده است. این مدل هماکنون در اختیار گروهی از تستکنندهها قرار گرفته و نمونههای خروجی آن به سرعت در حال انتشار است.
⚡ اگرچه هنوز اطلاعیه رسمی از سوی تیم توسعهدهنده منتشر نشده است، اما کاربران اولیه با استفاده از هشتگهای مرتبط، قابلیتهای نسل جدید این ابزار تولید ویدئو را به نمایش گذاشتهاند. با توجه به عملکرد قدرتمند نسخههای قبلی، انتظار میرود H3 استانداردهای جدیدی در زمینه کیفیت بصری و ثبات حرکات در ویدئوهای مبتنی بر AI تعیین کند.
🔬 پیشرفتهای اخیر در مدلهای Video Generation نشاندهنده رقابت تنگاتنگ شرکتها برای رسیدن به واقعگرایی بیشتر است. باید منتظر ماند و دید آیا این مدل جدید میتواند در بنچمارکهای کیفی، عملکرد بهتری نسبت به رقبای مطرح خود داشته باشد یا خیر.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#MiniMax_H3 #Hailuo_AI
❤1
🤖 دستیار پزشکی هوشمند با معماری RAG
🔬 در این پروژه، یک دستیار تخصصی پزشکی با استفاده از تکنیک RAG (بازیابی اطلاعات برای افزایش دقت مدل) پیادهسازی شده است. این سیستم با بهرهگیری از دادههای معتبر پایگاه MedQAD متعلق به NIH، دقت بالایی در ارائه پاسخهای پزشکی دارد.
⚡ برای تحلیل متون زیستپزشکی از مدل PubMedBERT استفاده شده که پرسشهای کاربر را به بردارهای معنایی دقیق تبدیل میکند. سپس این بردارها در دیتابیس FAISS ذخیره میشوند تا جستجوی شباهت با سرعت و کارایی بسیار بالایی انجام شود.
🧠 در مرحله بازیابی، سیستم متون مرتبط با پرسش کاربر را شناسایی کرده و با ترکیب آنها، یک Augmented Prompt میسازد. در نهایت، مدل GPT-2 بر اساس این کانتکست غنیشده، پاسخ نهایی را بهصورت تخصصی و آگاه از بافت تولید میکند.
🧩 پشته تکنولوژی این دستیار شامل Python و PyTorch است.
#PubMedBERT #MedQAD
🔬 در این پروژه، یک دستیار تخصصی پزشکی با استفاده از تکنیک RAG (بازیابی اطلاعات برای افزایش دقت مدل) پیادهسازی شده است. این سیستم با بهرهگیری از دادههای معتبر پایگاه MedQAD متعلق به NIH، دقت بالایی در ارائه پاسخهای پزشکی دارد.
⚡ برای تحلیل متون زیستپزشکی از مدل PubMedBERT استفاده شده که پرسشهای کاربر را به بردارهای معنایی دقیق تبدیل میکند. سپس این بردارها در دیتابیس FAISS ذخیره میشوند تا جستجوی شباهت با سرعت و کارایی بسیار بالایی انجام شود.
🧠 در مرحله بازیابی، سیستم متون مرتبط با پرسش کاربر را شناسایی کرده و با ترکیب آنها، یک Augmented Prompt میسازد. در نهایت، مدل GPT-2 بر اساس این کانتکست غنیشده، پاسخ نهایی را بهصورت تخصصی و آگاه از بافت تولید میکند.
🧩 پشته تکنولوژی این دستیار شامل Python و PyTorch است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#PubMedBERT #MedQAD
MedQuAD_RAG_PubMedBERT_GPT2.ipynb
1.5 MB
🚀 دستیار هوش مصنوعی پزشکی با معماری End-to-End
🧠 این پروژه یک دستیار هوشمند پزشکی جامع را پیادهسازی کرده است که با ترکیب فناوریهای پیشرفته، دقت پاسخدهی در حوزه سلامت را ارتقا میدهد.
⚡ سیستم از معماری RAG (بازیابی اطلاعات برای افزایش دقت مدل) بهره میبرد تا پاسخهای دقیقتری بر اساس متون تخصصی ارائه دهد. در این ساختار از مدل PubMedBERT (مدل زبانی پیشآموزشدیده روی مقالات پزشکی) برای درک بهتر مفاهیم تخصصی استفاده شده است.
📊 همچنین برای مدیریت و جستجوی سریع دادههای حجیم از کتابخانه FAISS استفاده شده و پردازش نهایی متن توسط GPT-2 انجام میشود. این ترکیب ابزارها، یک جریان کاری موثر برای تحلیل دادههای پزشکی فراهم میکند.
#PubMedBERT #FAISS
🧠 این پروژه یک دستیار هوشمند پزشکی جامع را پیادهسازی کرده است که با ترکیب فناوریهای پیشرفته، دقت پاسخدهی در حوزه سلامت را ارتقا میدهد.
⚡ سیستم از معماری RAG (بازیابی اطلاعات برای افزایش دقت مدل) بهره میبرد تا پاسخهای دقیقتری بر اساس متون تخصصی ارائه دهد. در این ساختار از مدل PubMedBERT (مدل زبانی پیشآموزشدیده روی مقالات پزشکی) برای درک بهتر مفاهیم تخصصی استفاده شده است.
📊 همچنین برای مدیریت و جستجوی سریع دادههای حجیم از کتابخانه FAISS استفاده شده و پردازش نهایی متن توسط GPT-2 انجام میشود. این ترکیب ابزارها، یک جریان کاری موثر برای تحلیل دادههای پزشکی فراهم میکند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#PubMedBERT #FAISS
medquad.csv
21.8 MB
📊 مجموعه داده MedQuad
دادههای MedQuad
دادههای MedQuad
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
This media is not supported in your browser
VIEW IN TELEGRAM
🔥 معرفی مدل چندوجهی MODUS
🚀 مدل جدید MODUS با رویکردی نوآورانه، فرآیند تولید محتوای چندوجهی (Any-to-Any) را یکپارچه میکند. این مدل با معماری Decoder-only طراحی شده و برخلاف مدلهای سنتی، از هیچگونه Task Head اختصاصی برای وظایف مختلف استفاده نمیکند.
🧠 ساختار این مدل بر پایه یک Decoder واحد و دو Expert (متخصص در پردازش داده) بنا شده است. این طراحی هوشمندانه باعث میشود تا MODUS بتواند انواع مختلفی از دادهها را با بهرهوری بالا و بدون نیاز به معماریهای پیچیده جانبی تولید کند.
💎 این دستاورد فنی که تحت لایسنس Apache منتشر شده، گامی مهم در جهت سادهسازی مدلهای چندوجهی است. برای مطالعه جزئیات معماری و بررسی نتایج عملکرد این مدل، میتوانید از لینکهای زیر استفاده کنید.
https://arxiv.org/abs/2405.16663
https://modus-gen.github.io
https://github.com/PKU-YuanGroup/MODUS
#MODUS #Decoder_only
🚀 مدل جدید MODUS با رویکردی نوآورانه، فرآیند تولید محتوای چندوجهی (Any-to-Any) را یکپارچه میکند. این مدل با معماری Decoder-only طراحی شده و برخلاف مدلهای سنتی، از هیچگونه Task Head اختصاصی برای وظایف مختلف استفاده نمیکند.
🧠 ساختار این مدل بر پایه یک Decoder واحد و دو Expert (متخصص در پردازش داده) بنا شده است. این طراحی هوشمندانه باعث میشود تا MODUS بتواند انواع مختلفی از دادهها را با بهرهوری بالا و بدون نیاز به معماریهای پیچیده جانبی تولید کند.
💎 این دستاورد فنی که تحت لایسنس Apache منتشر شده، گامی مهم در جهت سادهسازی مدلهای چندوجهی است. برای مطالعه جزئیات معماری و بررسی نتایج عملکرد این مدل، میتوانید از لینکهای زیر استفاده کنید.
https://arxiv.org/abs/2405.16663
https://modus-gen.github.io
https://github.com/PKU-YuanGroup/MODUS
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#MODUS #Decoder_only
This media is not supported in your browser
VIEW IN TELEGRAM
⚡ مدل ویدیویی قدرتمند MiniMax H3
🤖 مدل جدید MiniMax H3 که نسل بعدی خانواده Hailuo محسوب میشود، هماکنون در صدر بنچمارکهای برتر ویدیو قرار دارد. این مدل با معماری مالتیمودال، ورودیهای متن، تصویر، ویدیو و صدا را پردازش کرده و کلیپهای ۵ تا ۱۵ ثانیهای با نرخ ۲۴ فریم بر ثانیه و صدای بومی (Native) تولید میکند.
🔬 این مدل رتبه نخست را در ویرایش ویدیویی مبتنی بر دستور کسب کرده است. همچنین در بخشهای Text-to-Video و Image-to-Video به ترتیب جایگاههای دوم و سوم را دارد که آن را به رقیبی جدی برای رقبا تبدیل میکند.
🚀 دسترسی به این مدل از طریق اپلیکیشن Hailuo و API رسمی ممکن است. قیمتگذاری برای رزولوشن 2K حدود ۷.۸۰ دلار در هر دقیقه است که در مقایسه با سرویسهایی نظیر Kling 3.0 بسیار مقرونبهصرفهتر ارزیابی میشود.
🧩 یکی از نقاط عطف مهم، برنامه MiniMax برای انتشار عمومی وزنها تحت لایسنس Community License است.
#MiniMax_H3 #Hailuo_AI
🤖 مدل جدید MiniMax H3 که نسل بعدی خانواده Hailuo محسوب میشود، هماکنون در صدر بنچمارکهای برتر ویدیو قرار دارد. این مدل با معماری مالتیمودال، ورودیهای متن، تصویر، ویدیو و صدا را پردازش کرده و کلیپهای ۵ تا ۱۵ ثانیهای با نرخ ۲۴ فریم بر ثانیه و صدای بومی (Native) تولید میکند.
🔬 این مدل رتبه نخست را در ویرایش ویدیویی مبتنی بر دستور کسب کرده است. همچنین در بخشهای Text-to-Video و Image-to-Video به ترتیب جایگاههای دوم و سوم را دارد که آن را به رقیبی جدی برای رقبا تبدیل میکند.
🚀 دسترسی به این مدل از طریق اپلیکیشن Hailuo و API رسمی ممکن است. قیمتگذاری برای رزولوشن 2K حدود ۷.۸۰ دلار در هر دقیقه است که در مقایسه با سرویسهایی نظیر Kling 3.0 بسیار مقرونبهصرفهتر ارزیابی میشود.
🧩 یکی از نقاط عطف مهم، برنامه MiniMax برای انتشار عمومی وزنها تحت لایسنس Community License است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#MiniMax_H3 #Hailuo_AI
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #72 | 📌 7 آیتم گزارش | 🧾 از 46 پست بررسیشده
🕐 پنجشنبه 1405/05/08 ساعت 14:00 تا جمعه 1405/05/09 ساعت 14:00
🤖 مدلهای زبانی بزرگ و هوش مصنوعی مولد
🔬 پژوهش و علم
📊 ابزارهای داده و دیتاستها
🗂 گزارش #72 | 📌 7 آیتم گزارش | 🧾 از 46 پست بررسیشده
🕐 پنجشنبه 1405/05/08 ساعت 14:00 تا جمعه 1405/05/09 ساعت 14:00
🤖 مدلهای زبانی بزرگ و هوش مصنوعی مولد
ایلان ماسک از عرضه مدل Grok 4.6 با 1.5 تریلیون پارامتر خبر داد و وعده داد مدل بعدی با ظرفیت 2.1 تریلیون پارامتر بهزودی منتشر شود.
🔗 مشاهده پست
مایکروسافت مدل MAI-Image-2.5-Pro برای تولید تصویر و مدل MAI-Voice-2-Flash را برای سنتز سریع گفتار در 15 زبان عرضه کردند.
🔗 مشاهده پست
مدل ویدئوساز جدید MiniMax H3 با قابلیت تولید ویدیوهای 5 تا 15 ثانیهای و نرخ 24 فریم بر ثانیه، به رقیبی جدی در حوزه مالتیمودال تبدیل شده است.
🔗 مشاهده پست
مدل جدید MODUS با معماری Decoder-only و بدون نیاز به Task Head، فرآیند تولید محتوای Any-to-Any را به شکلی نوآورانه یکپارچه کرده است.
🔗 مشاهده پست
🔬 پژوهش و علم
گوگل دیپمایند در راستای تمرکز بر Scientific AI و مدلهای Gemini، تیم توسعهدهنده AlphaFold را منحل کرد.
🔗 مشاهده پست
شرکت Anthropic مجوز قانونی استفاده از کتب فیزیکی برای آموزش مدلها را تحت عنوان استفاده منصفانه دریافت کرد که منجر به جنجالهای اخلاقی پیرامون نابودی کتابها شده است.
🔗 مشاهده پست
پروژههای پزشکی با استفاده از RAG و مدلهای PubMedBERT و FAISS، دقت تشخیص و پاسخدهی دستیاران هوشمند را به شدت افزایش دادهاند.
🔗 مشاهده پست
📊 ابزارهای داده و دیتاستها
مجموعه دادههای متنوعی از جمله حقوق مشاغل سال 2026، S&P 500، و قیمت مسکن در وین با بیش از 99 هزار رکورد برای تحلیلهای رگرسیونی منتشر شدهاند.
🔗 مشاهده پست
دیتاستهای تخصصی مانند LiveBench برای ارزیابی LLMها و دادههای UFC با بیش از 10 هزار رکورد، امکان تحلیلهای مقایسهای دقیق را فراهم میکنند.
🔗 مشاهده پست
مخزن آموزشی جدید مبتنی بر Python با تبدیل مفاهیم انتزاعی به آزمایشهای بصری، یادگیری Machine Learning را برای متخصصان سطح متوسط ملموستر کرده است.
🔗 مشاهده پست
دیتاستهای ترند نظیر Apple App Store (2026) با 11500 رکورد و Global Unicorn Companies با 1500 رکورد، برای تحلیل الگوهای کسبوکار در دسترس قرار گرفتهاند.
🔗 مشاهده پست
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🤖 مسیر یادگیری جامع هوش مصنوعی از طریق یوتیوب
⚡ یادگیری اصولی هوش مصنوعی و علم داده نیازمند منابعی است که مفاهیم را از پایه تا پروژههای مدرن پوشش دهند. در اینجا برترین کانالهای یوتیوب در حوزههای کلیدی دستهبندی شدهاند تا نقشه راه حرفهای خود را ترسیم کنید.
🧠 برای تسلط بر Agentic AI و اتوماسیون، کانالهای Krish Naik و FreeCodeCamp بهترین انتخاب برای اجرای پروژههای عملی با LLMها هستند. اگر به دنبال درک شهودی الگوریتمها هستید، محتوای آموزشی StatQuest، Yannic Kilcher و DeepLearningAI مرجع اصلی متخصصان محسوب میشود.
📊 برای تقویت مهارتهای پایتون، Corey Schafer و Ken Jee دانش کاربردی از تحلیل تا استقرار مدل را ارائه میدهند. 🔬 برای درک عمیق ریاضیات پشت مدلها، کانالهای 3Blue1Brown و Khan Academy بینظیر هستند.
🚀 در حوزه مهندسی داده، محتوای Alex The Analyst و Edureka برای مقیاسپذیری پایپلاینهای AI توصیه میشود.
#Agentic_AI #StatQuest
⚡ یادگیری اصولی هوش مصنوعی و علم داده نیازمند منابعی است که مفاهیم را از پایه تا پروژههای مدرن پوشش دهند. در اینجا برترین کانالهای یوتیوب در حوزههای کلیدی دستهبندی شدهاند تا نقشه راه حرفهای خود را ترسیم کنید.
🧠 برای تسلط بر Agentic AI و اتوماسیون، کانالهای Krish Naik و FreeCodeCamp بهترین انتخاب برای اجرای پروژههای عملی با LLMها هستند. اگر به دنبال درک شهودی الگوریتمها هستید، محتوای آموزشی StatQuest، Yannic Kilcher و DeepLearningAI مرجع اصلی متخصصان محسوب میشود.
📊 برای تقویت مهارتهای پایتون، Corey Schafer و Ken Jee دانش کاربردی از تحلیل تا استقرار مدل را ارائه میدهند. 🔬 برای درک عمیق ریاضیات پشت مدلها، کانالهای 3Blue1Brown و Khan Academy بینظیر هستند.
🚀 در حوزه مهندسی داده، محتوای Alex The Analyst و Edureka برای مقیاسپذیری پایپلاینهای AI توصیه میشود.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Agentic_AI #StatQuest
❤1
🚀 معرفی فریمورک AngelSpec برای شتابدهی به استنتاج LLM
شرکت Tencent به تازگی از AngelSpec رونمایی کرده است، یک فریمورک جامع (End-to-End) که با هدف بهینهسازی فرآیند Speculative Decoding (روش افزایش سرعت تولید متن با استفاده از مدلهای کوچکتر) توسعه یافته است. این ابزار کل چرخه حیات، شامل آموزش مدلهای پیشگو یا Drafter، بهینهسازی و استقرار نهایی برای افزایش سرعت استنتاج (Inference) را پوشش میدهد.
🔬 ارزیابیهای انجام شده روی مدل Hy3-A21B با معماری اختصاصی DFly نتایج چشمگیری را نشان داده است. این معماری موفق شده سرعت تولید متن را بین ۱.۹۸ تا ۲.۴۰ برابر نسبت به روشهای خودرگرسیو استاندارد افزایش دهد.
📊 در تستهای انجام شده، کارایی این مدل در محیطهای با ترافیک بالا (از ۴ تا ۶۴ درخواست همزمان) کاملاً پایدار بوده است. همچنین، توان عملیاتی یا Throughput این سیستم نسبت به روش مشابه DFlash حدود ۱۰.۵ تا ۱۱.۸ درصد بهبود یافته است.
🧩 تنسنت علاوه بر انتشار مقالات پژوهشی، زیرساختهای لازم برای استفاده از این تکنولوژی را نیز فراهم کرده است. تمامی کدهای آموزشی، مستندات فنی و وزنهای از پیش آموزشدیده مدلهای MTP/DFly برای مدل Hy3-A21B اکنون به صورت عمومی در دسترس قرار گرفتهاند.
GitHub
arXiv
Documentation
HuggingFace Models
📚 مستندات
🔗 modelscope.cn
#AngelSpec #DFly
شرکت Tencent به تازگی از AngelSpec رونمایی کرده است، یک فریمورک جامع (End-to-End) که با هدف بهینهسازی فرآیند Speculative Decoding (روش افزایش سرعت تولید متن با استفاده از مدلهای کوچکتر) توسعه یافته است. این ابزار کل چرخه حیات، شامل آموزش مدلهای پیشگو یا Drafter، بهینهسازی و استقرار نهایی برای افزایش سرعت استنتاج (Inference) را پوشش میدهد.
🔬 ارزیابیهای انجام شده روی مدل Hy3-A21B با معماری اختصاصی DFly نتایج چشمگیری را نشان داده است. این معماری موفق شده سرعت تولید متن را بین ۱.۹۸ تا ۲.۴۰ برابر نسبت به روشهای خودرگرسیو استاندارد افزایش دهد.
📊 در تستهای انجام شده، کارایی این مدل در محیطهای با ترافیک بالا (از ۴ تا ۶۴ درخواست همزمان) کاملاً پایدار بوده است. همچنین، توان عملیاتی یا Throughput این سیستم نسبت به روش مشابه DFlash حدود ۱۰.۵ تا ۱۱.۸ درصد بهبود یافته است.
🧩 تنسنت علاوه بر انتشار مقالات پژوهشی، زیرساختهای لازم برای استفاده از این تکنولوژی را نیز فراهم کرده است. تمامی کدهای آموزشی، مستندات فنی و وزنهای از پیش آموزشدیده مدلهای MTP/DFly برای مدل Hy3-A21B اکنون به صورت عمومی در دسترس قرار گرفتهاند.
GitHub
arXiv
Documentation
HuggingFace Models
📚 مستندات
🔗 modelscope.cn
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#AngelSpec #DFly
🤖 جهش عملکرد مدل GPT-5.6 Sol در بنچمارک ARC-AGI-3
مطالعات جدید OpenAI نشان میدهد که با اعمال دو تغییر ساختاری در نحوه تعامل با API، امتیاز مدل GPT-5.6 Sol در بنچمارک ARC-AGI-3 از ۱۳.۳٪ به ۳۸.۳٪ افزایش یافته است. این جهش خیرهکننده، مدل را به سطح عملکرد انسانی که میانگین آن ۴۸٪ برآورد میشود، نزدیکتر میکند. نکته جالبتوجه این است که با این بهینهسازی، مصرف توکنهای خروجی نیز حدود ۶ برابر کاهش یافته است.
🧠 اولین تغییر، حفظ زنجیره استدلال بین کنشهای مدل است. در متدولوژی پیشین، ایجنت (Agent) پس از هر گام، الگوهای کشفشده را فراموش میکرد و عملاً بازی را از نو تحلیل میکرد، اما اکنون استدلالها در حافظه باقی میمانند.
⚡ تغییر دوم جایگزینی حذف تاریخچه با تکنیک Compaction است. در این روش، به جای پاک کردن پیامهای قدیمی، بخشهای طولانی متن به یک خلاصه هوشمند تبدیل میشوند تا ضمن حفظ استراتژی و مشاهدات کلیدی، فضای حافظه بهخوبی مدیریت شود.
#GPT_5_6_Sol #ARC_AGI_3
مطالعات جدید OpenAI نشان میدهد که با اعمال دو تغییر ساختاری در نحوه تعامل با API، امتیاز مدل GPT-5.6 Sol در بنچمارک ARC-AGI-3 از ۱۳.۳٪ به ۳۸.۳٪ افزایش یافته است. این جهش خیرهکننده، مدل را به سطح عملکرد انسانی که میانگین آن ۴۸٪ برآورد میشود، نزدیکتر میکند. نکته جالبتوجه این است که با این بهینهسازی، مصرف توکنهای خروجی نیز حدود ۶ برابر کاهش یافته است.
🧠 اولین تغییر، حفظ زنجیره استدلال بین کنشهای مدل است. در متدولوژی پیشین، ایجنت (Agent) پس از هر گام، الگوهای کشفشده را فراموش میکرد و عملاً بازی را از نو تحلیل میکرد، اما اکنون استدلالها در حافظه باقی میمانند.
⚡ تغییر دوم جایگزینی حذف تاریخچه با تکنیک Compaction است. در این روش، به جای پاک کردن پیامهای قدیمی، بخشهای طولانی متن به یک خلاصه هوشمند تبدیل میشوند تا ضمن حفظ استراتژی و مشاهدات کلیدی، فضای حافظه بهخوبی مدیریت شود.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#GPT_5_6_Sol #ARC_AGI_3
🚀 انتشار رسمی API مدل DeepSeek V4-Flash
کمپانی DeepSeek بهتازگی از عرضه رسمی API مدل V4-Flash با تمرکز ویژه بر بهبود عملکرد در سناریوهای عاملمحور (Agentic) خبر داد. طبق بنچمارکهای داخلی، این نسخه در وظایف مرتبط با کدنویسی و اجرای دستورات توسط Autonomous Agents، عملکردی بهمراتب دقیقتر و سریعتر از نسخه V4-Pro-Preview ارائه میدهد.
⚡ تغییرات کلیدی در این بهروزرسانی شامل تقویت توانایی مدل در پردازش وظایف طولانی و پشتیبانی بومی از Responses API است. همچنین قابلیت Parallel Tool Calls برای فراخوانی همزمان ابزارها اضافه شده و سطوح استدلال low، high و max برای کنترل دقیقتر خروجی در دسترس کاربران قرار گرفته است.
🧠 ظرفیت حافظه یا Context Window مدل به ۱ میلیون توکن افزایش یافته و بهینهسازیهای لازم برای هماهنگی کامل با Codex انجام شده است. کاربران میتوانند این مدل را از طریق یک پیکربندی واحد به Codex CLI، افزونه VS Code و سایر ابزارهای سازگار متصل کنند.
#DeepSeek_V4_Flash #Autonomous_Agents
کمپانی DeepSeek بهتازگی از عرضه رسمی API مدل V4-Flash با تمرکز ویژه بر بهبود عملکرد در سناریوهای عاملمحور (Agentic) خبر داد. طبق بنچمارکهای داخلی، این نسخه در وظایف مرتبط با کدنویسی و اجرای دستورات توسط Autonomous Agents، عملکردی بهمراتب دقیقتر و سریعتر از نسخه V4-Pro-Preview ارائه میدهد.
⚡ تغییرات کلیدی در این بهروزرسانی شامل تقویت توانایی مدل در پردازش وظایف طولانی و پشتیبانی بومی از Responses API است. همچنین قابلیت Parallel Tool Calls برای فراخوانی همزمان ابزارها اضافه شده و سطوح استدلال low، high و max برای کنترل دقیقتر خروجی در دسترس کاربران قرار گرفته است.
🧠 ظرفیت حافظه یا Context Window مدل به ۱ میلیون توکن افزایش یافته و بهینهسازیهای لازم برای هماهنگی کامل با Codex انجام شده است. کاربران میتوانند این مدل را از طریق یک پیکربندی واحد به Codex CLI، افزونه VS Code و سایر ابزارهای سازگار متصل کنند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#DeepSeek_V4_Flash #Autonomous_Agents
🤖 بررسی مدل جدید DeepSeek V4 Flash 0731
🔬 مدل جدید DeepSeek V4 Flash 0731 با کسب امتیاز 50 در شاخص هوش Artificial Analysis، جهشی 10 امتیازی نسبت به نسخه پیشین خود داشته است. این مدل با حفظ معماری و 284 میلیارد پارامتر (13 میلیارد فعال)، اکنون 6 امتیاز از نسخه Pro پیشی گرفته و در مرز پارتو (تعادل بهینه هزینه و هوش) قرار دارد.
⚡ عملکرد این مدل در Agentic Tasks (وظایف خودمختار) بهبود چشمگیری یافته و امتیاز Elo آن در بنچمارک GDPval-AA v2 به 1559 رسیده است. همچنین در Terminal-Bench 2.1 رشد 17 واحدی ثبت کرده و در تمامی بخشهای شاخص هوش، از جمله GPQA Diamond با امتیاز 91٪، عملکردی قویتر از نسل قبل ارائه میدهد.
🧠 نکته کلیدی در نسخه 0731، کاهش نرخ Hallucination (توهم مدل) است که باعث بهبود 7 واحدی شاخص AA-Omniscience شده، بدون اینکه دقت کلی تغییری کند. علاوه بر این، مدل با کاهش 12 درصدی در مصرف توکن، نسبت به predecessor خود بسیار بهینهتر عمل میکند.
#DeepSeek_V4_Flash #GDPval_AA
🔬 مدل جدید DeepSeek V4 Flash 0731 با کسب امتیاز 50 در شاخص هوش Artificial Analysis، جهشی 10 امتیازی نسبت به نسخه پیشین خود داشته است. این مدل با حفظ معماری و 284 میلیارد پارامتر (13 میلیارد فعال)، اکنون 6 امتیاز از نسخه Pro پیشی گرفته و در مرز پارتو (تعادل بهینه هزینه و هوش) قرار دارد.
⚡ عملکرد این مدل در Agentic Tasks (وظایف خودمختار) بهبود چشمگیری یافته و امتیاز Elo آن در بنچمارک GDPval-AA v2 به 1559 رسیده است. همچنین در Terminal-Bench 2.1 رشد 17 واحدی ثبت کرده و در تمامی بخشهای شاخص هوش، از جمله GPQA Diamond با امتیاز 91٪، عملکردی قویتر از نسل قبل ارائه میدهد.
🧠 نکته کلیدی در نسخه 0731، کاهش نرخ Hallucination (توهم مدل) است که باعث بهبود 7 واحدی شاخص AA-Omniscience شده، بدون اینکه دقت کلی تغییری کند. علاوه بر این، مدل با کاهش 12 درصدی در مصرف توکن، نسبت به predecessor خود بسیار بهینهتر عمل میکند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#DeepSeek_V4_Flash #GDPval_AA
🤖 چهار مرحله حیاتی در آموزش LLMها
🧠 فرآیند تکامل یک مدل زبانی (LLM) از وزنهای تصادفی تا مدلهای استدلالی، مسیری چهار مرحلهای است. در مرحله نخست یعنی Pre-training، مدل با پردازش حجم عظیمی از داده، گرامر، حقایق و تواناییهای پایه را میآموزد. در این مرحله مدل تنها یاد میگیرد که متن را ادامه دهد و هنوز مفهوم پرسش و پاسخ را درک نمیکند.
⚡ در مرحله دوم یا Instruction Fine-tuning، مدل با جفتهای دستور و پاسخ آموزش میبیند تا یاد بگیرد چگونه به درخواستهای کاربر پاسخ دهد. این مرحله در واقع تعیینکننده فرمت پاسخدهی است و دانش مدل را از پیشدادههای مرحله قبل استخراج میکند.
📊 مرحله سوم Preference Fine-tuning است که برای مدیریت پاسخهای چندگانه طراحی شده است. در اینجا از بازخورد انسانی برای انتخاب پاسخ برتر استفاده میشود تا مدل یاد بگیرد بر اساس ترجیحات کاربران عمل کند.
🧩 مرحله نهایی Reasoning Fine-tuning است که برای حوزههایی مثل ریاضی و کدنویسی به کار میرود.
#DeepSeek_R1 #GRPO
🧠 فرآیند تکامل یک مدل زبانی (LLM) از وزنهای تصادفی تا مدلهای استدلالی، مسیری چهار مرحلهای است. در مرحله نخست یعنی Pre-training، مدل با پردازش حجم عظیمی از داده، گرامر، حقایق و تواناییهای پایه را میآموزد. در این مرحله مدل تنها یاد میگیرد که متن را ادامه دهد و هنوز مفهوم پرسش و پاسخ را درک نمیکند.
⚡ در مرحله دوم یا Instruction Fine-tuning، مدل با جفتهای دستور و پاسخ آموزش میبیند تا یاد بگیرد چگونه به درخواستهای کاربر پاسخ دهد. این مرحله در واقع تعیینکننده فرمت پاسخدهی است و دانش مدل را از پیشدادههای مرحله قبل استخراج میکند.
📊 مرحله سوم Preference Fine-tuning است که برای مدیریت پاسخهای چندگانه طراحی شده است. در اینجا از بازخورد انسانی برای انتخاب پاسخ برتر استفاده میشود تا مدل یاد بگیرد بر اساس ترجیحات کاربران عمل کند.
🧩 مرحله نهایی Reasoning Fine-tuning است که برای حوزههایی مثل ریاضی و کدنویسی به کار میرود.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#DeepSeek_R1 #GRPO
❤2
🤖 معرفی مدل Inkling-Small: جهش در بهرهوری مدلهای MoE
آزمایشگاه Thinking Machines مدل جدید Inkling-Small را به عنوان یک مدل باز (Open-weights) از نوع MoE با ۲۷۶ میلیارد پارامتر کل معرفی کرده است که تنها ۱۲ میلیارد پارامتر فعال در هر توکن دارد. این مدل با بهرهگیری از تکنیک on-policy distillation و دو هفته آموزش RL (یادگیری تقویتی) در حوزه برنامهنویسی عاملی، بهینهسازی شده است.
⚡ ️ این نسخه در بنچمارکهای حیاتی از مدل قبلی با ۴۱ میلیارد پارامتر فعال پیشی گرفته و به امتیاز ۶۴.۷٪ در Terminal-Bench 2.1، امتیاز ۳۱.۶٪ در HLE و ۸۰.۲٪ در SWE-Bench Verified دست یافته است. 🧠 این مدل با پشتیبانی از ورودی تصویر و صوت، طول بافتار تا ۱ میلیون توکن و عمق استدلال قابلتنظیم، بستری قدرتمند برای توسعهدهندگان عوامل هوشمند است.
#Inkling_Small #on_policy_distillation
آزمایشگاه Thinking Machines مدل جدید Inkling-Small را به عنوان یک مدل باز (Open-weights) از نوع MoE با ۲۷۶ میلیارد پارامتر کل معرفی کرده است که تنها ۱۲ میلیارد پارامتر فعال در هر توکن دارد. این مدل با بهرهگیری از تکنیک on-policy distillation و دو هفته آموزش RL (یادگیری تقویتی) در حوزه برنامهنویسی عاملی، بهینهسازی شده است.
⚡ ️ این نسخه در بنچمارکهای حیاتی از مدل قبلی با ۴۱ میلیارد پارامتر فعال پیشی گرفته و به امتیاز ۶۴.۷٪ در Terminal-Bench 2.1، امتیاز ۳۱.۶٪ در HLE و ۸۰.۲٪ در SWE-Bench Verified دست یافته است. 🧠 این مدل با پشتیبانی از ورودی تصویر و صوت، طول بافتار تا ۱ میلیون توکن و عمق استدلال قابلتنظیم، بستری قدرتمند برای توسعهدهندگان عوامل هوشمند است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Inkling_Small #on_policy_distillation