هوش مصنوعی و علم داده به فارسی
6.06K subscribers
1.66K photos
436 videos
348 files
1.82K links
🗨 ارتباط با ما (تبلیغات، سوال، پیشنهاد و انتقاد):
📩 @Contact2Mebot

💯 کانال دوم ما:
@Datascientists_Files

💎 در پیام‌رسان بله(آپدیت اتومات):
https://ble.ir/dataplusscience

💡 در پیام‌رسان ایتا(آپدیت اتومات):
https://eitaa.com/DataPlusScience
Download Telegram
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #91 | 📌 6 آیتم گزارش | 🧾 از 11 پست بررسی‌شده
🕐 چهارشنبه 1405/05/28 ساعت 14:00 تا پنجشنبه 1405/05/29 ساعت 14:00

🛠️ ابزارها و توسعه نرم‌افزار

شرکت Modular زبان برنامه‌نویسی Mojo را به صورت متن‌باز تحت مجوز Apache 2.0 منتشر کرد که دسترسی توسعه‌دهندگان به زیرساخت‌های این زبان متمرکز بر هوش مصنوعی را متحول می‌کند.
🔗 مشاهده پست

ابزار متن‌باز TrueForge معرفی شد؛ یک Agent Harness برای مدیریت هزینه‌ها، حفظ وضعیت و بهبود کارایی اِیجنت‌های هوش مصنوعی در پروژه‌های طولانی‌مدت.
🔗 مشاهده پست


🧪 دستاوردهای علمی و پژوهشی

شرکت Anthropic با استفاده از مدل هوش مصنوعی Claude Opus موفق شد برای ۱۴ مورد از ۱۵ هدف تعیین‌شده، پروتئین‌های اختصاصی با نرخ موفقیت بی‌سابقه ۲۲ تا ۳۵ درصد طراحی کند.
🔗 مشاهده پست

پژوهشگران استنفورد و MIT سیستم Meta-Harness را معرفی کردند که با بهینه‌سازی کد محیط اجرا (بدون نیاز به تغییر وزن‌های مدل)، عملکرد مدل‌های زبانی بزرگ را تا ۶ برابر بهبود می‌دهد.
🔗 مشاهده پست


🤖 کاربردها و مفاهیم هوش مصنوعی

شرکت OpenAI نسخه اختصاصی ChatGPT را برای نوجوانان ۱۳ تا ۱۷ سال با تمرکز بر یادگیری عمیق، حل مسئله (از طریق حالت Study Mode) و امنیت پیشرفته طراحی و عرضه کرده است.
🔗 مشاهده پست

بررسی تفاوت‌های ساختاری کلیدی مانند تفاوت LLM با AI Agent (عامل هوشمند مجهز به حافظه و ابزار) و تفاوت تکنیک RAG (بازیابی اطلاعات) با Grounding (اتصال به منابع معتبر).
🔗 مشاهده پست


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
هوش مصنوعی مایکروسافت در میدان رقابت تصویر

‏مایکروسافت با عرضه مدل‌های جدید سری MAI-Image توانسته است خود را به جمع برترین‌های حوزه تبدیل تصویر به عکس (t2i) برساند. عملکرد خیره‌کننده این تیم که متشکل از متخصصان سابق Meta GenAI است، در بنچمارک‌های اخیر توجه زیادی را به خود جلب کرده است.

‏بر اساس تحلیل‌های Artificial Analysis، مدل‌های جدید در پیاده‌سازی جزئیات دقیق، رندر متن و طراحی رابط کاربری (UI/UX) نتایج رقابتی و نزدیکی با مدل‌هایی نظیر GPT Image 2 ارائه می‌دهند.

‏مهم‌ترین نکات درباره این تحولات:
‏* مدل MAI-Image-2.6-Preview یکی از مدعیان جدید در صدر جدول رده‌بندی است.
‏* نسخه MAI-Image-2.5-Pro با استفاده از فشرده‌سازی پیشرفته، تعادل خوبی میان کیفیت و هزینه ایجاد کرده است.
‏* عملکرد مدل‌ها در آزمون‌های پیچیده مانند نمایش احساسات در انیمه یا ترسیم دیاگرام‌های ایزومتریک، نشان‌دهنده دقت بالای موتورهای تولید تصویر این مجموعه است.

‏برای بررسی و تست مستقیم توانایی‌های این مدل‌ها می‌توانید از Playground مایکروسافت استفاده کنید.

📚 مطالعه با جزئیات بیشتر

📊 DataScience
⚡️ رقابت داغ در دنیای AI: چین به مرزهای آمریکا رسید

‏گزارش‌های تازه بلومبرگ و تحلیل‌های مستقل نشان می‌دهد که شکاف میان توانمندی‌های هوش مصنوعی چین و آمریکا با سرعتی غیرمنتظره در حال بسته شدن است. مدل جدید Kimi K3 از شرکت Moonshot اکنون در کنار بزرگانی نظیر مدل‌های پیشرو Anthropic و OpenAI قرار گرفته و در بسیاری از بنچمارک‌ها پابه‌پای آن‌ها پیش می‌رود.

‏نکته قابل‌توجه این است که علاوه بر بهبود عملکرد فنی، مدل‌های چینی مانند Kimi، GLM و Qwen به‌طور قابل‌توجهی در هزینه‌های عملیاتی بهینه‌تر هستند.

‏مهم‌ترین یافته‌های تحلیل‌های اخیر:

‏* شاخص Artificial Analysis: مدل Kimi K3 در ارزیابی ترکیبی از کدنویسی و استدلال، خود را به رده‌های بالای جهان رسانده است.
‏* شاخص توانمندی Epoch: این مدل با کسب امتیازهای بالا در بیش از ۵۰ بنچمارک، رسماً در جمع پیشروترین هوش‌های مصنوعی جهان قرار دارد.
‏* شاخص Vals: بررسی عملکرد تخصصی در حوزه‌های حقوقی، مالی و برنامه‌نویسی نشان می‌دهد که Kimi K3 در وضعیت عملکردی بسیار رقابتی قرار گرفته است.

📚 مطالعه با جزئیات بیشتر

📊 DataScience
📊 تحلیل عملکرد مدل‌های کوانتایز شده Qwen

‏آیا کوانتایز کردن مدل‌ها به قیمت از دست رفتن هوش آن‌ها تمام می‌شود؟ پاسخ به این پرسش در یک بنچمارک ۶۷ ساعته روی خانواده Qwen 2.5-32B بررسی شده است.

‏نتایج نشان می‌دهد که برخلاف تصور رایج، استفاده از کوانتایزیشن ۴ بیت نه تنها فاجعه‌بار نیست، بلکه در برخی متدها عملکردی خیره‌کننده دارد:

‏• متد AWQ INT4 توانسته با ثبت دقت ۹۰٪، حتی از نسخه‌های FP8 با دقت ۸۸.۷٪ نیز پیشی بگیرد.
‏• سایر روش‌های ۴ بیتی نیز در محدوده عملکردی بسیار نزدیک به نسخه‌های سنگین‌تر (۸۸ تا ۸۹ درصد) قرار دارند.
‏• مدل‌های xhigh در عمل تنها باعث مصرف بیشتر توکن و منابع می‌شوند و تفاوت کیفیت آن‌ها با مدل‌های بهینه‌تر بسیار ناچیز است.

‏برای کاربردهای عملی و واقعی، استفاده از مدل‌های سبک‌تر با کوانتایزیشن مناسب، انتخاب هوشمندانه‌ای است. نسخه‌های سنگین عمدتاً برای بهبود رتبه‌بندی در لیدربوردها کاربرد دارند و ارزش افزوده عملیاتی چندانی ایجاد نمی‌کنند. این تحلیل دید دقیق‌تری برای انتخاب مدل بر اساس منابع سخت‌افزاری و نیاز واقعی پروژه به ما می‌دهد.

📚 مطالعه با جزئیات بیشتر

📊 DataScience
1
🧬 موفقیت بزرگ هوش مصنوعی در ساخت واکسن سرطان

‏در یک پیشرفت انقلابی، واکسن سرطان شخصی‌سازی‌شده که با کمک هوش مصنوعی توسط شرکت‌های مدرنا و مرک توسعه یافته، فاز سوم کارآزمایی بالینی خود را با موفقیت پشت سر گذاشت.

‏این فرآیند درمانی با توالی‌یابی ژنوم تومور بیمار و مقایسه آن با DNA سالم آغاز می‌شود. سپس هوش مصنوعی جهش‌های خاصی را شناسایی می‌کند که بیشترین پتانسیل را برای تحریک سیستم ایمنی بدن دارند. بر اساس این داده‌ها، یک درمان اختصاصی مبتنی بر mRNA برای هدف قرار دادن حداکثر ۳۴ آنتی‌ژن ساخته می‌شود.

‏نتایج اولیه و فاز سوم این مطالعه نشان‌دهنمهم‌ترین دستاوردهاهای مهمی است:

‏* کاهش ۴۹ درصدی خطر بازگشت بیماری یا مرگ در بیماران.
‏* کاهش ۵۹ درصدی احتمال متاستاز یا مرگ.
‏* ماندگاری نرخ بقای بدون سرطان در بیش از ۶۸ درصد بیماران پس از ۵ سال.

‏جزئیات بیشتر این دستاورد پزشکی را می‌توانید در وب‌سایت رسمی مرک مشاهده کنید. این موفقیت، گامی کلیدی در استفاده از یادگیری ماشین برای درمان‌های شخصی‌سازی‌شده پزشکی است.

📚 مطالعه با جزئیات بیشتر

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🚀 افزایش چشمگیر سرعت دیکودینگ با مدل‌های جدید Liquid AI

‏شرکت Liquid AI به تازگی مدل‌های LFM2.5-DSpark را معرفی کرده است که می‌توانند سرعت تولید توکن (Decoding) را تا ۳.۱۸ برابر افزایش دهند، بدون اینکه کوچک‌ترین تغییری در خروجی نهایی مدل ایجاد کنند.

‏مهم‌ترین نکات این نسخه:
‏• عملکرد بدون تغییر در کیفیت: این معماری به گونه‌ای طراحی شده که خروجی مدل کاملاً مشابه مدل پایه باقی می‌ماند. اگر توکن پیش‌بینی شده توسط مدلِ درفتر با توزیع هدف مطابقت نداشته باشد، مدل اصلی جایگزین آن می‌شود.

‏• ارتباط مستقیم با نرخ پذیرش: افزایش سرعت وابستگی مستقیمی به «نرخ پذیرش توکن‌ها» دارد. به عبارت دیگر، هرچه مدل پیش‌بینی‌های دقیق‌تری داشته باشد، جهش سرعت بیشتر خواهد بود.

‏• مدل‌های منتشر شده:
‏- LFM2.5-1.2B-Instruct
‏- LFM2.5-2.6B
‏- LFM2.5-8B-A1B

‏این مدل‌های درفتر با حدود ۳۰۰ میلیون پارامتر، بهینه‌سازی بسیار کارآمدی برای تسریع در اجرا روی سخت‌افزارهایی مانند H100 یا پردازنده‌های سری M اپل محسوب می‌شوند. برای مطالعه تحلیل کامل فنی، می‌توانید به این گزارش مراجعه کنید.

📚 مطالعه با جزئیات بیشتر

📊 DataScience
هوش مصنوعی و علم داده به فارسی
🚀 دوره‌های رایگان هوش مصنوعی Anthropic ‏شرکت Anthropic به‌تازگی ۱۳ دوره آموزشی تخصصی و رایگان را در آکادمی خود منتشر کرده است. این دوره‌ها طیف گسترده‌ای از مباحث، از مفاهیم پایه تا پیاده‌سازی‌های حرفه‌ای را پوشش می‌دهند و برای کاربران عمومی، توسعه‌دهندگان…
This media is not supported in your browser
VIEW IN TELEGRAM
🎓 راه‌اندازی آکادمی آموزشی Claude توسط Anthropic

‏شرکت Anthropic پلتفرم آموزشی جامع خود را تحت عنوان Claude Academy به صورت کاملاً رایگان در دسترس همگان قرار داده است.

‏این آکادمی شامل دوره‌های متنوعی از سطح مبتدی و آشنایی با مبانی هوش مصنوعی تا سطوح پیشرفته برای بهره‌گیری حرفه‌ای از Claude در فعالیت‌های روزمره و تخصصی است.

‏نکته جالب این است که برخی از دوره‌های این پلتفرم مدرک معتبر (Certificate) نیز ارائه می‌دهند که برای اشتراک‌گذاری در لینکدین و ارتقای رزومه بسیار مناسب است. تمامی محتواها و راهنماهای این آکادمی بدون هیچ محدودیتی قابل استفاده هستند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Anthropic #ClaudeAcademy
هوش مصنوعی و آینده ریاضیات از نگاه ترنس تائو

‏ترنس تائو در مقاله‌ای تازه، به بررسی نقش ریاضیدانان در عصر تسلط هوش مصنوعی پرداخته است. او استدلال می‌کند که با خودکار شدنِ «حل مسئله» توسط AI، ماهیت پژوهش‌های ریاضی دگرگون خواهد شد.

‏تائو معتقد است فرآیند علمی فراتر از رسیدن به پاسخ است و شامل مراحل زیر می‌شود که بخش بزرگی از آن برای ماشین غیرقابل دسترس است:

‏* درک و تبیین: تبدیل راه‌حل‌های خام به دانش قابل فهم برای جامعه علمی.
‏* ارتباط‌دهی: پیوند دادن یافته‌های جدید با نظریه‌های موجود.
‏* جامعه‌پذیری: بحث‌های انتقادی و داوری همتایان.
‏* کانونیزه کردن: تبدیل نتایج به بخشی از بدنه آموزش و متون مرجع.

‏برخلاف تصور، هوش مصنوعی تنها در تولید و تایید اثبات‌ها (Proofs) پیشرو است. وظیفه اصلی ریاضیدانان در آینده، نه صرفاً حل معماها، بلکه مدیریت «کولکتیو دانش» و انتقال مفاهیم به نسل‌های آینده است. تائو معتقد است ما در حال ورود به دوره‌ای از بازنگری در ارزش‌های ضمنی ریاضیات هستیم.

📚 مطالعه با جزئیات بیشتر

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Terence_Tao #Proof_Assistants
1
Media is too big
VIEW IN TELEGRAM
🧬 شبیه‌سازی سلول زنده انسان با مدل جهانی هوش مصنوعی

‏استارت‌آپ GenBio AI از سیستم جدیدی به نام AIDO Cell رونمایی کرده است؛ یک مدل جهانی (World Model) که می‌تواند یک سلول زنده را در تمامی سطوح از جمله DNA، RNA، پروتئین‌ها و رفتارهای کل سلول شبیه‌سازی کند.

‏برخلاف مدل‌های گذشته که هر بخش را جداگانه پیش‌بینی می‌کردند، این ابزار کل زنجیره زیستی را به هم متصل می‌کند. برای مثال، تغییر در یک ژن می‌تواند اثرات خود را در سراسر سلول نشان دهد. همچنین، این مدل وضعیت سلول را به خاطر می‌سپارد؛ بنابراین هر مداخله جدید، روی سلول تغییریافته قبلی اعمال می‌شود نه روی یک نسخه خام.

‏این فناوری هنوز در مراحل اولیه است، اما پتانسیل آن را دارد که به پژوهشگران اجازه دهد آزمایش‌های پیچیده بیولوژیکی را پیش از محیط واقعی، درون یک سلول مجازی اجرا کنند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#AIDOCell #WorldModel
🚀 راهنمای جامع و عملی مدل‌های Transformer

‏یادگیری معماری ترنسفورمرها از مبانی تا سطوح پیشرفته و عملیاتی، نیازمند دسترسی به کدهای تست‌شده و پروژه‌محور است. مخزن Transformers - The definitive Guide یک منبع کامل شامل ۱۲ فصل آموزشی است که به شما اجازه می‌دهد تمامی مفاهیم را به‌صورت عملی در Google Colab پیاده‌سازی کنید.

‏مهم‌ترین سرفصل‌های این مجموعه عبارتند از:
‏• آشنایی با اصول اولیه و معماری ترنسفورمرهای SOTA
‏• کاربرد ترنسفورمرها در سری‌های زمانی و وظایف بینایی
‏• مدل‌های تولیدکننده تصویر، ویدیو و صوت
‏• یادگیری تقویتی، برنامه‌ریزی، استدلال و کدنویسی
‏• طراحی عوامل (Agents) هوش مصنوعی و بهینه‌سازی مدل
‏• استقرار و Deploy کردن نهایی مدل‌ها در محیط عملیاتی

‏ساختار این مخزن به گونه‌ای طراحی شده که نوت‌بوک‌های هر فصل با نام‌گذاری استاندارد در پوشه‌های مجزا قرار دارند و یادگیری مرحله‌به‌مرحله را برای شما تسهیل می‌کنند. این منبع برای تمامی متخصصان حوزه پردازش متن و تصویر که به دنبال تسلط بر اکوسیستم ترنسفورمرها هستند، توصیه می‌شود.

📚 مطالعه با جزئیات بیشتر

📊 DataScience
1
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #92 | 📌 6 آیتم گزارش | 🧾 از 9 پست بررسی‌شده
🕐 پنجشنبه 1405/05/29 ساعت 14:00 تا جمعه 1405/05/30 ساعت 14:00

🧬 هوش مصنوعی در پزشکی و زیست‌شناسی

واکسن شخصی‌سازی‌شده سرطان مبتنی بر mRNA شرکت‌های مدرنا و مرک با کمک هوش مصنوعی برای شناسایی جهش‌های تومور، فاز سوم کارآزمایی بالینی را با موفقیت پشت سر گذاشت.
🔗 مشاهده پست

استارت‌آپ GenBio AI از مدل جهانی AIDO Cell رونمایی کرد که قادر است یک سلول زنده انسان را در تمامی سطوح شامل DNA، RNA و پروتئین‌ها به‌طور یکپارچه شبیه‌سازی کند.
🔗 مشاهده پست


🤖 مدل‌های نوین و بنچمارک‌های هوش مصنوعی

مایکروسافت با معرفی مدل‌های جدید MAI-Image که توسط متخصصان سابق متا توسعه یافته‌اند، در بنچمارک‌های تولید تصویر به رقابت نزدیکی با مدل‌های برتر بازار رسیده است.
🔗 مشاهده پست

گزارش‌ها نشان می‌دهد شکاف هوش مصنوعی چین و آمریکا با سرعت در حال کاهش است؛ مدل Kimi K3 چین اکنون در بنچمارک‌ها در کنار مدل‌های پیشرو قرار دارد.
🔗 مشاهده پست

شرکت Liquid AI مدل‌های LFM2.5-DSpark را معرفی کرد که بدون تغییر در کیفیت خروجی، سرعت تولید توکن و دیکودینگ را تا ۳.۱۸ برابر افزایش می‌دهند.
🔗 مشاهده پست

بررسی بنچمارک خانواده Qwen 2.5-32B نشان می‌دهد کوانتایزیشن ۴ بیت با متد AWQ توانسته با دقت ۹۰٪ حتی از نسخه‌های با دقت بالاتر FP8 نیز پیشی بگیرد.
🔗 مشاهده پست


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
1
🚀 مدل‌های جدید ترجمه Tencent و عرضه Ox Alpha در OpenRouter

‏پلتفرم OpenRouter به‌تازگی میزبان مدل‌های جدید و جذابی شده است که قابلیت‌های کاربردی برای مهندسان داده و توسعه‌دهندگان ارائه می‌دهند.

‏مهم‌ترین موارد اضافه شده:

‏• مدل‌های ترجمه Hy-MT2: شرکت Tencent مدل‌های Hy-MT2-1.8B و Hy-MT2-30B-A3B را عرضه کرده است. این مدل‌ها از ۳۳ زبان پشتیبانی می‌کنند و علاوه بر متن عادی، در پردازش ساختار، بافتار (Context) و رعایت سبک‌های خاص در ترجمه عملکرد بسیار خوبی دارند.

‏• مدل استدلالی Ox Alpha: این مدل که با رویکردی متمرکز بر استدلال (Reasoning) طراحی شده، برای انجام کارهای عامل‌محور (Agentic)، کدنویسی پیچیده و بارهای کاری سنگین در محیط‌های Production بسیار ایده‌آل است. این مدل با پنجره متنی بیش از ۱ میلیون توکن ارائه شده است.

📚 مطالعه با جزئیات بیشتر

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Hy_MT2 #Ox_Alpha
🤖 آینده هوش مصنوعی: فراتر از تکنولوژی

‏تیم Strategic Futures در OpenAI با راه‌اندازی بلاگ جدیدی، به بررسی ابعاد عمیق‌تری از تاثیر هوش مصنوعی بر قدرت و ساختارهای اجتماعی پرداخته است. این پروژه تاکید می‌کند که هوش مصنوعی نه تنها یک ابزار فنی، بلکه عاملی دگرگون‌کننده برای نحوه حکمرانی و آزادی‌های فردی است.

‏مهم‌ترین نکات و خطرات مطرح‌شده:
‏* دولت‌ها ممکن است با سیستم‌های خودمختار، بدون نیاز به نیروی انسانی و با تکیه بر خروجی مراکز داده (data centers) قدرت خود را اعمال کنند.
‏* خودکارسازی بوروکراسی و تغییر در قراردادهای اجتماعی می‌تواند نقش انسان را در تصمیم‌گیری‌های کلان کمرنگ کند.
‏* حفظ استقلال فردی و عاملیت انسان باید بر رشد اقتصادی و امنیت اولویت داشته باشد.
‏* سیستم‌های هوش مصنوعی باید در فعالیت‌های پرخطر به یک مسئول انسانی قابل ردیابی باشند.
‏* حکمرانی هوش مصنوعی باید بر توزیع عادلانه قدرت تمرکز کند تا از تمرکز بیش از حد اختیارات جلوگیری شود.
‏* آزادی استفاده از AI باید همراه با حفظ حریم خصوصی و امکان ناشناس ماندن برای صیانت از آزادی بیان باشد.

📚 مطالعه با جزئیات بیشتر

📊 DataScience