هوش مصنوعی و علم داده به فارسی
6.04K subscribers
1.35K photos
364 videos
336 files
1.5K links
🗨 ارتباط با ما (تبلیغات، سوال، پیشنهاد و انتقاد):
📩 @Contact2Mebot

💯 کانال دوم ما:
@Datascientists_Files

💎 در پیام‌رسان بله(آپدیت اتومات):
https://ble.ir/dataplusscience

💡 در پیام‌رسان ایتا(آپدیت اتومات):
https://eitaa.com/DataPlusScience
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
مدل ویدیویی قدرتمند MiniMax H3

🤖 ‏ مدل جدید MiniMax H3 که نسل بعدی خانواده Hailuo محسوب می‌شود، هم‌اکنون در صدر بنچمارک‌های برتر ویدیو قرار دارد. این مدل با معماری مالتی‌مودال، ورودی‌های متن، تصویر، ویدیو و صدا را پردازش کرده و کلیپ‌های ۵ تا ۱۵ ثانیه‌ای با نرخ ۲۴ فریم بر ثانیه و صدای بومی (Native) تولید می‌کند.

🔬 ‏ این مدل رتبه نخست را در ویرایش ویدیویی مبتنی بر دستور کسب کرده است. همچنین در بخش‌های Text-to-Video و Image-to-Video به ترتیب جایگاه‌های دوم و سوم را دارد که آن را به رقیبی جدی برای رقبا تبدیل می‌کند.

🚀 ‏ دسترسی به این مدل از طریق اپلیکیشن Hailuo و API رسمی ممکن است. قیمت‌گذاری برای رزولوشن 2K حدود ۷.۸۰ دلار در هر دقیقه است که در مقایسه با سرویس‌هایی نظیر Kling 3.0 بسیار مقرون‌به‌صرفه‌تر ارزیابی می‌شود.

🧩 ‏ یکی از نقاط عطف مهم، برنامه MiniMax برای انتشار عمومی وزن‌ها تحت لایسنس Community License است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#MiniMax_H3 #Hailuo_AI
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #72 | 📌 7 آیتم گزارش | 🧾 از 46 پست بررسی‌شده
🕐 پنجشنبه 1405/05/08 ساعت 14:00 تا جمعه 1405/05/09 ساعت 14:00

🤖 مدل‌های زبانی بزرگ و هوش مصنوعی مولد

ایلان ماسک از عرضه مدل Grok 4.6 با 1.5 تریلیون پارامتر خبر داد و وعده داد مدل بعدی با ظرفیت 2.1 تریلیون پارامتر به‌زودی منتشر شود.
🔗 مشاهده پست

مایکروسافت مدل MAI-Image-2.5-Pro برای تولید تصویر و مدل MAI-Voice-2-Flash را برای سنتز سریع گفتار در 15 زبان عرضه کردند.
🔗 مشاهده پست

مدل ویدئوساز جدید MiniMax H3 با قابلیت تولید ویدیوهای 5 تا 15 ثانیه‌ای و نرخ 24 فریم بر ثانیه، به رقیبی جدی در حوزه مالتی‌مودال تبدیل شده است.
🔗 مشاهده پست

مدل جدید MODUS با معماری Decoder-only و بدون نیاز به Task Head، فرآیند تولید محتوای Any-to-Any را به شکلی نوآورانه یکپارچه کرده است.
🔗 مشاهده پست


🔬 پژوهش و علم

گوگل دیپ‌مایند در راستای تمرکز بر Scientific AI و مدل‌های Gemini، تیم توسعه‌دهنده AlphaFold را منحل کرد.
🔗 مشاهده پست

شرکت Anthropic مجوز قانونی استفاده از کتب فیزیکی برای آموزش مدل‌ها را تحت عنوان استفاده منصفانه دریافت کرد که منجر به جنجال‌های اخلاقی پیرامون نابودی کتاب‌ها شده است.
🔗 مشاهده پست

پروژه‌های پزشکی با استفاده از RAG و مدل‌های PubMedBERT و FAISS، دقت تشخیص و پاسخ‌دهی دستیاران هوشمند را به شدت افزایش داده‌اند.
🔗 مشاهده پست


📊 ابزارهای داده و دیتاست‌ها

مجموعه داده‌های متنوعی از جمله حقوق مشاغل سال 2026، S&P 500، و قیمت مسکن در وین با بیش از 99 هزار رکورد برای تحلیل‌های رگرسیونی منتشر شده‌اند.
🔗 مشاهده پست

دیتاست‌های تخصصی مانند LiveBench برای ارزیابی LLMها و داده‌های UFC با بیش از 10 هزار رکورد، امکان تحلیل‌های مقایسه‌ای دقیق را فراهم می‌کنند.
🔗 مشاهده پست

مخزن آموزشی جدید مبتنی بر Python با تبدیل مفاهیم انتزاعی به آزمایش‌های بصری، یادگیری Machine Learning را برای متخصصان سطح متوسط ملموس‌تر کرده است.
🔗 مشاهده پست

دیتاست‌های ترند نظیر Apple App Store (2026) با 11500 رکورد و Global Unicorn Companies با 1500 رکورد، برای تحلیل الگوهای کسب‌وکار در دسترس قرار گرفته‌اند.
🔗 مشاهده پست


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🤖 مسیر یادگیری جامع هوش مصنوعی از طریق یوتیوب

‏ یادگیری اصولی هوش مصنوعی و علم داده نیازمند منابعی است که مفاهیم را از پایه تا پروژه‌های مدرن پوشش دهند. در اینجا برترین کانال‌های یوتیوب در حوزه‌های کلیدی دسته‌بندی شده‌اند تا نقشه راه حرفه‌ای خود را ترسیم کنید.

🧠 ‏ برای تسلط بر Agentic AI و اتوماسیون، کانال‌های Krish Naik و FreeCodeCamp بهترین انتخاب برای اجرای پروژه‌های عملی با LLMها هستند. اگر به دنبال درک شهودی الگوریتم‌ها هستید، محتوای آموزشی StatQuest، Yannic Kilcher و DeepLearningAI مرجع اصلی متخصصان محسوب می‌شود.

📊 ‏ برای تقویت مهارت‌های پایتون، Corey Schafer و Ken Jee دانش کاربردی از تحلیل تا استقرار مدل را ارائه می‌دهند. 🔬 برای درک عمیق ریاضیات پشت مدل‌ها، کانال‌های 3Blue1Brown و Khan Academy بی‌نظیر هستند.

🚀 ‏ در حوزه مهندسی داده، محتوای Alex The Analyst و Edureka برای مقیاس‌پذیری پایپ‌لاین‌های AI توصیه می‌شود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Agentic_AI #StatQuest
1
🚀 معرفی فریم‌ورک AngelSpec برای شتاب‌دهی به استنتاج LLM

‏شرکت Tencent به تازگی از AngelSpec رونمایی کرده است، یک فریم‌ورک جامع (End-to-End) که با هدف بهینه‌سازی فرآیند Speculative Decoding (روش افزایش سرعت تولید متن با استفاده از مدل‌های کوچک‌تر) توسعه یافته است. این ابزار کل چرخه حیات، شامل آموزش مدل‌های پیش‌گو یا Drafter، بهینه‌سازی و استقرار نهایی برای افزایش سرعت استنتاج (Inference) را پوشش می‌دهد.

🔬 ‏ ارزیابی‌های انجام شده روی مدل Hy3-A21B با معماری اختصاصی DFly نتایج چشمگیری را نشان داده است. این معماری موفق شده سرعت تولید متن را بین ۱.۹۸ تا ۲.۴۰ برابر نسبت به روش‌های خودرگرسیو استاندارد افزایش دهد.

📊 ‏ در تست‌های انجام شده، کارایی این مدل در محیط‌های با ترافیک بالا (از ۴ تا ۶۴ درخواست همزمان) کاملاً پایدار بوده است. همچنین، توان عملیاتی یا Throughput این سیستم نسبت به روش مشابه DFlash حدود ۱۰.۵ تا ۱۱.۸ درصد بهبود یافته است.

🧩 ‏ تنسنت علاوه بر انتشار مقالات پژوهشی، زیرساخت‌های لازم برای استفاده از این تکنولوژی را نیز فراهم کرده است. تمامی کدهای آموزشی، مستندات فنی و وزن‌های از پیش آموزش‌دیده مدل‌های MTP/DFly برای مدل Hy3-A21B اکنون به صورت عمومی در دسترس قرار گرفته‌اند.

GitHub
arXiv
Documentation
HuggingFace Models

📚مستندات
🔗modelscope.cn

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#AngelSpec #DFly
🤖جهش عملکرد مدل GPT-5.6 Sol در بنچمارک ARC-AGI-3

‏مطالعات جدید OpenAI نشان می‌دهد که با اعمال دو تغییر ساختاری در نحوه تعامل با API، امتیاز مدل GPT-5.6 Sol در بنچمارک ARC-AGI-3 از ۱۳.۳٪ به ۳۸.۳٪ افزایش یافته است. این جهش خیره‌کننده، مدل را به سطح عملکرد انسانی که میانگین آن ۴۸٪ برآورد می‌شود، نزدیک‌تر می‌کند. نکته جالب‌توجه این است که با این بهینه‌سازی، مصرف توکن‌های خروجی نیز حدود ۶ برابر کاهش یافته است.

🧠 ‏ اولین تغییر، حفظ زنجیره استدلال بین کنش‌های مدل است. در متدولوژی پیشین، ایجنت (Agent) پس از هر گام، الگوهای کشف‌شده را فراموش می‌کرد و عملاً بازی را از نو تحلیل می‌کرد، اما اکنون استدلال‌ها در حافظه باقی می‌مانند.

‏ تغییر دوم جایگزینی حذف تاریخچه با تکنیک Compaction است. در این روش، به جای پاک کردن پیام‌های قدیمی، بخش‌های طولانی متن به یک خلاصه هوشمند تبدیل می‌شوند تا ضمن حفظ استراتژی و مشاهدات کلیدی، فضای حافظه به‌خوبی مدیریت شود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#GPT_5_6_Sol #ARC_AGI_3
🚀 انتشار رسمی API مدل DeepSeek V4-Flash

‏کمپانی DeepSeek به‌تازگی از عرضه رسمی API مدل V4-Flash با تمرکز ویژه بر بهبود عملکرد در سناریوهای عامل‌محور (Agentic) خبر داد. طبق بنچمارک‌های داخلی، این نسخه در وظایف مرتبط با کدنویسی و اجرای دستورات توسط Autonomous Agents، عملکردی به‌مراتب دقیق‌تر و سریع‌تر از نسخه V4-Pro-Preview ارائه می‌دهد.

‏ تغییرات کلیدی در این به‌روزرسانی شامل تقویت توانایی مدل در پردازش وظایف طولانی و پشتیبانی بومی از Responses API است. همچنین قابلیت Parallel Tool Calls برای فراخوانی همزمان ابزارها اضافه شده و سطوح استدلال low، high و max برای کنترل دقیق‌تر خروجی در دسترس کاربران قرار گرفته است.

🧠 ‏ ظرفیت حافظه یا Context Window مدل به ۱ میلیون توکن افزایش یافته و بهینه‌سازی‌های لازم برای هماهنگی کامل با Codex انجام شده است. کاربران می‌توانند این مدل را از طریق یک پیکربندی واحد به Codex CLI، افزونه VS Code و سایر ابزارهای سازگار متصل کنند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_V4_Flash #Autonomous_Agents
🤖 بررسی مدل جدید DeepSeek V4 Flash 0731

🔬 ‏ مدل جدید DeepSeek V4 Flash 0731 با کسب امتیاز 50 در شاخص هوش Artificial Analysis، جهشی 10 امتیازی نسبت به نسخه پیشین خود داشته است. این مدل با حفظ معماری و 284 میلیارد پارامتر (13 میلیارد فعال)، اکنون 6 امتیاز از نسخه Pro پیشی گرفته و در مرز پارتو (تعادل بهینه هزینه و هوش) قرار دارد.

‏ عملکرد این مدل در Agentic Tasks (وظایف خودمختار) بهبود چشمگیری یافته و امتیاز Elo آن در بنچمارک GDPval-AA v2 به 1559 رسیده است. همچنین در Terminal-Bench 2.1 رشد 17 واحدی ثبت کرده و در تمامی بخش‌های شاخص هوش، از جمله GPQA Diamond با امتیاز 91٪، عملکردی قوی‌تر از نسل قبل ارائه می‌دهد.

🧠 ‏ نکته کلیدی در نسخه 0731، کاهش نرخ Hallucination (توهم مدل) است که باعث بهبود 7 واحدی شاخص AA-Omniscience شده، بدون اینکه دقت کلی تغییری کند. علاوه بر این، مدل با کاهش 12 درصدی در مصرف توکن، نسبت به predecessor خود بسیار بهینه‌تر عمل می‌کند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_V4_Flash #GDPval_AA
🤖 چهار مرحله حیاتی در آموزش LLMها

🧠 ‏ فرآیند تکامل یک مدل زبانی (LLM) از وزن‌های تصادفی تا مدل‌های استدلالی، مسیری چهار مرحله‌ای است. در مرحله نخست یعنی Pre-training، مدل با پردازش حجم عظیمی از داده، گرامر، حقایق و توانایی‌های پایه را می‌آموزد. در این مرحله مدل تنها یاد می‌گیرد که متن را ادامه دهد و هنوز مفهوم پرسش و پاسخ را درک نمی‌کند.

‏ در مرحله دوم یا Instruction Fine-tuning، مدل با جفت‌های دستور و پاسخ آموزش می‌بیند تا یاد بگیرد چگونه به درخواست‌های کاربر پاسخ دهد. این مرحله در واقع تعیین‌کننده فرمت پاسخ‌دهی است و دانش مدل را از پیش‌داده‌های مرحله قبل استخراج می‌کند.

📊 ‏ مرحله سوم Preference Fine-tuning است که برای مدیریت پاسخ‌های چندگانه طراحی شده است. در اینجا از بازخورد انسانی برای انتخاب پاسخ برتر استفاده می‌شود تا مدل یاد بگیرد بر اساس ترجیحات کاربران عمل کند.

🧩 ‏ مرحله نهایی Reasoning Fine-tuning است که برای حوزه‌هایی مثل ریاضی و کدنویسی به کار می‌رود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_R1 #GRPO
2
🤖 معرفی مدل Inkling-Small: جهش در بهره‌وری مدل‌های MoE

‏آزمایشگاه Thinking Machines مدل جدید Inkling-Small را به عنوان یک مدل باز (Open-weights) از نوع MoE با ۲۷۶ میلیارد پارامتر کل معرفی کرده است که تنها ۱۲ میلیارد پارامتر فعال در هر توکن دارد. این مدل با بهره‌گیری از تکنیک on-policy distillation و دو هفته آموزش RL (یادگیری تقویتی) در حوزه برنامه‌نویسی عاملی، بهینه‌سازی شده است.

‏️ این نسخه در بنچمارک‌های حیاتی از مدل قبلی با ۴۱ میلیارد پارامتر فعال پیشی گرفته و به امتیاز ۶۴.۷٪ در Terminal-Bench 2.1، امتیاز ۳۱.۶٪ در HLE و ۸۰.۲٪ در SWE-Bench Verified دست یافته است. 🧠 این مدل با پشتیبانی از ورودی تصویر و صوت، طول بافتار تا ۱ میلیون توکن و عمق استدلال قابل‌تنظیم، بستری قدرتمند برای توسعه‌دهندگان عوامل هوشمند است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Inkling_Small #on_policy_distillation
️ نفوذ ناخواسته مدل‌های Anthropic به زیرساخت‌های واقعی

🔬 ‏ در یک رخداد امنیتی کم‌سابقه، مدل‌های هوش مصنوعی شرکت Anthropic شامل Opus 4.7، Mythos 5 و یک نسخه آزمایشی، در حین تست‌های نفوذ (CTF) به‌طور تصادفی به سه شرکت واقعی نفوذ کردند. این حادثه ناشی از پیکربندی نادرست در محیط آزمایشگاهی شرکت همکار یعنی Irregular رخ داد که برخلاف پروتکل‌ها، دسترسی مدل‌ها به اینترنت عمومی را مسدود نکرده بود.

‏️ مدل‌های مذکور با استفاده از تکنیک‌های پایه هک، موفق شدند نقاط ضعف امنیتی نظیر رمزهای عبور ضعیف و Endpoints (نقاط دسترسی شبکه) بدون احراز هویت را در سیستم‌های هدف اکسپلویت کنند. این نقض امنیتی پس از تحلیل دقیق بر روی ۱۴۱ هزار نشست آزمایشی توسط تیم فنی Anthropic شناسایی شد.

🤖 ‏ این شرکت بلافاصله پس از آگاهی از ابعاد ماجرا، تمامی تست‌های سایبری خود را متوقف کرد.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Anthropic #Opus_4_7
🚀 تحولات جدید در قیمت‌گذاری و مدل‌های OpenAI

🤖 ‏ شرکت OpenAI تغییرات استراتژیک مهمی را در ساختار هزینه‌ای مدل‌های هوش مصنوعی خود اعمال کرده که مستقیماً بر لایه‌های Luna و Terra تأثیرگذار است. هزینه استفاده از مدل Luna با کاهشی ۸۰ درصدی، اکنون به نرخ ۰.۲۰ یا ۱.۲۰ دلار برای هر میلیون توکن رسیده است.

📉 ‏ لایه Terra نیز شاهد ۲۰ درصد کاهش قیمت بوده و اکنون با نرخ ۲ یا ۱۲ دلار به ازای هر میلیون توکن در دسترس است. با این تغییرات، مدل Luna در مقایسه با Sol، اکنون ۲۵ برابر ارزان‌تر شده است که جهشی بزرگ در بازار مدل‌های اقتصادی محسوب می‌شود.

‏ در سمت مقابل، مدل جدید GPT-5.6 Sol Fast با هدف بهینه‌سازی سرعت ارائه شده که تا ۲.۵ برابر سریع‌تر از قبل عمل می‌کند. علی‌رغم افزایش ۲ برابری قیمت، بهره‌وری نسبت «سرعت به هزینه» در این مدل ۲۵ درصد بهبود یافته و سطح هوشمندی آن کاملاً حفظ شده است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#OpenAI #GPT_5
2
Media is too big
VIEW IN TELEGRAM
🚀 آپدیت بزرگ مدل ویدیویی Seedance 2.5

🧠 ‏ مدل پیشرفته Seedance 2.5 با تمرکز ویژه بر کنترل دقیق و تولید ویدیوهای طولانی عرضه شد. این مدل اکنون قادر به تولید کلیپ‌های ۳۰ ثانیه‌ای یکپارچه بوده و در حالت بتا، این ویدیوها را تا ۱۸۰ ثانیه با حفظ تداوم محتوا گسترش می‌دهد.

‏ از قابلیت‌های کلیدی این نسخه، پشتیبانی از حداکثر ۵۰ تصویر مرجع (Reference) برای ورودی است. تمرکز توسعه‌دهندگان بر بهینه‌سازی پایپ‌لاین‌های حرفه‌ای برای کار با پرده سبز و مدل‌های سه‌بعدی Blender بوده است تا ساختار فضایی، مسیر حرکت اشیاء و حرکت دوربین با دقت بالا کنترل شوند.

🎨 ‏ قابلیت ویرایش نقطه‌ای مشابه با Gemini Omni به این مدل اضافه شده است. اگرچه پیش‌تر وعده خروجی 4K داده شده بود، اما در حال حاضر خروجی نهایی به رزولوشن‌های 480p و 720p محدود است.

💰 ‏ هزینه استفاده از Seedance 2.5 حدود ۱.۵ برابر مدل قبلی بوده و با قیمت ۶ دلار برای هر ۳۰ ثانیه، گران‌ترین گزینه در بازار است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Seedance_2_5 #Dreamina
🌐 مجموعه‌ای جامع از مطالعات موردی سیستم‌های ML

‏ این مخزن گیت‌هاب شامل بیش از ۳۰۰ مطالعه موردی واقعی از سیستم‌های یادگیری ماشین در شرکت‌های بزرگ فناوری است. برخلاف منابع تئوریک، این لیست بر تجربیات عملی مهندسی و پیاده‌سازی مدل‌ها در مقیاس Production تمرکز دارد.

🏗 ‏️ شما می‌توانید نحوه معماری سیستم‌های شرکت‌های پیشرو نظیر Uber، Netflix و Google را بررسی کنید. این مستندات به چالش‌های فنی، شکست‌های زیرساختی و راهکارهای عملیاتی که منجر به بازیابی و بهینه‌سازی سیستم‌ها شده‌اند، می‌پردازد.

🧠 ‏ مطالعه این کیس‌استادی‌ها برای مهندسان داده و توسعه‌دهندگان سیستم‌های هوش مصنوعی بسیار مفید است، زیرا بینش عمیقی از نحوه برخورد با پیچیدگی‌های دنیای واقعی ارائه می‌دهد. این مخزن می‌تواند منبعی کلیدی برای درک بهتر System Design در پروژه‌های بزرگ مقیاس باشد.

GitHub Link

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#System_Design #Production_ML
🤖 مقابله لینکدین با سیل محتوای هوش مصنوعی

🌐 ‏ به دلیل افزایش چشمگیر پست‌های بی‌کیفیت تولیدشده توسط هوش مصنوعی، لینکدین قابلیت جدیدی با عنوان Seems like AI slop را برای گزارش‌دهی این محتواها معرفی کرده است. طبق آمار سیستم تشخیص محتوای Pangram، بالغ بر ۴۱ درصد از پست‌های طولانی این پلتفرم بدون هیچ‌گونه ویرایش انسانی توسط مدل‌های زبانی ایجاد شده‌اند.

🚀 ‏ لینکدین در حال پیاده‌سازی یک سیستم طبقه‌بندی‌کننده (مدل تشخیص الگو) جدید است تا محتواهای ماشینی را شناسایی کند. با شناسایی این موارد، نرخ نمایش آن‌ها در فید کاربران به شدت کاهش می‌یابد و دکمه جدید گزارش‌دهی به بهبود دقت این سیستم‌ها کمک می‌کند.

📊 ‏ این شبکه اجتماعی همچنین قصد دارد قابلیتی اضافه کند که به نویسندگان هشدار می‌دهد کاربران پست‌های آن‌ها را غیرواقعی یا بیش از حد ماشینی تلقی کرده‌اند. این اقدامات بخشی از استراتژی گسترده لینکدین برای حفظ اصالت تعاملات و ارتقای کیفیت محتوا در این محیط حرفه‌ای است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Seems_like_AI_slop #Pangram