هوش مصنوعی و علم داده به فارسی
6.06K subscribers
1.67K photos
436 videos
350 files
1.83K links
🗨 ارتباط با ما (تبلیغات، سوال، پیشنهاد و انتقاد):
📩 @Contact2Mebot

💯 کانال دوم ما:
@Datascientists_Files

💎 در پیام‌رسان بله(آپدیت اتومات):
https://ble.ir/dataplusscience

💡 در پیام‌رسان ایتا(آپدیت اتومات):
https://eitaa.com/DataPlusScience
Download Telegram
🎵 معرفی مدل قدرتمند MiniMax Music 3 برای تولید موسیقی

‏مدل جدید MiniMax Music 3 یک ابزار متن‌باز و پیشرفته برای تولید قطعات موسیقی کامل (تا ۵ دقیقه) با پشتیبانی از وکال است. این مدل با درک ساختار دقیق موسیقی، خروجی‌های استریو با کیفیت ۳۲ کیلوهرتز تولید می‌کند.

ویژگی‌های فنی و معماری:
‏این مدل از یک معماری سلسله‌مراتبی استفاده می‌کند: یک Global LLM (مبتنی بر Qwen3-8B) وظیفه مدیریت ساختار کلی قطعه را بر عهده دارد و یک Local LLM کوچک‌تر، جزئیات آکوستیک و بافت صوتی را پردازش می‌کند. در نهایت، با استفاده از تکنیک Flow Matching، کیفیت نهایی صدا به مراتب بالاتر از مدل‌های مبتنی بر توکن‌سازهای گسسته است.

مهم‌ترین نکات برای استفاده:
‏• پشتیبانی از اجرای بهینه در SGLang، HuggingFace Diffusers و ComfyUI.
‏• امکان اجرا روی کارت‌های گرافیک با حافظه ۸ گیگابایت (با تکنیک streaming) تا ۲۴ گیگابایت.
‏• قابلیت کنترل دقیق بر سبک، ضرب‌آهنگ (BPM) و ساختار متن ترانه با استفاده از تگ‌های خاص.
‏• دسترسی به ابزار بازنویسی پرامپت برای تولید بهتر متادیتای موسیقی.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
هوش مصنوعی و علم داده به فارسی
🔍 نشان‌گذاری محتوای هوش مصنوعی توسط Anthropic ‏شرکت Anthropic به‌تازگی اعلام کرده است که در راستای پایبندی به قوانین اتحادیه اروپا (AI Act)، سیستم جدیدی را برای واترمارک کردن متون تولیدشده توسط مدل‌های Claude پیاده‌سازی می‌کند. این قابلیت که در مستندات رسمی…
🚀 ابزاری قدرتمند برای حذف واترمارک‌های هوش مصنوعی

‏اخیراً ابزار جدیدی در گیت‌هاب منتشر شده که با استقبال بی‌نظیر کاربران مواجه شده است. پروژه Watermarks Remover در مدت کوتاهی بیش از ۱۲ هزار ستاره دریافت کرده و به یکی از ترندهای اصلی دنیای حریم خصوصی تبدیل شده است.

‏این ابزار با هدف مقابله با واترمارک‌های نامرئی و نشان‌گذاری‌های شرکت‌های هوش مصنوعی مانند Anthropic طراحی شده است. عملکرد آن شامل موارد زیر است:

‏- حذف کاراکترهای یونی‌کد نامرئی
‏- تلاش برای شکستن واترمارک‌های آماری از طریق بازنویسی متن
‏- پاک‌سازی متادیتای فایل‌ها شامل C2PA، EXIF و XMP

‏این ابزار از فرمت‌های متنوعی نظیر PNG، JPEG، WebP، PDF، DOCX و Markdown پشتیبانی می‌کند و علاوه بر قابلیت استفاده توسط ایجنت‌های هوش مصنوعی، به صورت یک سرویس محلی (Local) نیز قابل اجراست تا نیازی به ارسال اطلاعات به APIهای ابری نباشد. اگر به دنبال حفظ حریم خصوصی خروجی‌های هوش مصنوعی هستید، بررسی این پروژه می‌تواند برایتان بسیار مفید باشد.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Watermarks_Remover #C2PA
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 بهینه‌سازی ورود داده به مدل‌های هوش مصنوعی

‏قبل از ارجاع فایل‌های PDF به مدل‌های هوش مصنوعی، تبدیل صحیح داده‌ها تأثیر مستقیمی بر کیفیت خروجی و کاهش هزینه‌های پردازشی دارد. ابزار OpenDataLoader یک راهکار متن‌باز برای تبدیل اسناد PDF به فرمت Markdown است که به‌طور تخصصی برای تسهیل کار با LLMها طراحی شده است.

‏استفاده از این ابزار مزایای زیر را به همراه دارد:

‏• استخراج دقیق متن، تیترها و ساختار جداول.
‏• تبدیل فرمول‌های پیچیده به ساختاری قابل فهم برای هوش مصنوعی.
‏• حذف المان‌های زائد صفحات (مانند هدر و فوتر) جهت کاهش مصرف توکن.

‏با پاک‌سازی داده‌ها پیش از ارسال به مدل، دقت تحلیل‌ و استدلال‌های مدل به‌مراتب افزایش می‌یابد. اگر در پروژه‌های پردازش اسناد با مشکل توهم مدل یا عدم درک ساختار جداول مواجه هستید، استفاده از این پیش‌پردازشگر توصیه می‌شود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#OpenDataLoader #Markdown
🚀 معرفی مدل ویدئویی پیشرفته MAGI-2

‏تیم Sand.ai مدل جدید MAGI-2 Preview را با معماری MoE منتشر کرده است. این مدل با استفاده از ساختار single-stream، ویدئوهای ۱۰ ثانیه‌ای را به همراه صوت هماهنگ تولید می‌کند.

‏نکات کلیدی این مدل:
‏* کارایی محاسباتی: با وجود ۱۱۴ میلیارد پارامتر، در هر توکن تنها ۶ میلیارد پارامتر فعال می‌شوند که باعث کاهش ۱۰ برابری هزینه اینفرنس نسبت به مدل‌های dense شده است.
‏* پایپ‌لاین دو مرحله‌ای: ابتدا ویدئو با رزولوشن پایین تولید و سپس توسط refiner تا کیفیت 1080p ارتقا می‌یابد.
‏* جایگاه فنی: مدل مذکور در حال حاضر رتبه ششم benchmark موسسه Artificial Analysis را کسب کرده است.

‏علاوه بر مدل، مستندات فنی و کدهای پیاده‌سازی برای بررسی در دسترس هستند:
‏* گزارش فنی (Technical Report)
‏* کد منبع در GitHub
‏* وزن‌های مدل در HuggingFace

‏همچنین در تحلیل معماری‌های توزیع‌شده، روش Hierarchical Head Parallel با هدف بهینه‌سازی تبادل داده‌ها در سطوح InfiniBand و NVLink مورد توجه قرار گرفته است که بر مدیریت محلی توکن‌ها و کاهش گلوگاه‌های ارتباطی نودها تمرکز دارد.

📊 DataScience
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 تحول جدید در دنیای برنامه‌نویسی با Cursor Origin

‏تیم Cursor با معرفی سرویس جدید خود به نام Origin، گام بزرگی در جهت تبدیل شدن به یک پلتفرم توسعه‌ یکپارچه برداشته است. این قابلیت که هم‌اکنون در مرحله بتای اولیه برای کاربران پلن‌های حرفه‌ای در دسترس است، امکان مدیریت کامل مخازن کد را مستقیماً درون ویرایشگر فراهم می‌کند.

‏برخی از مهم‌ترین ویژگی‌های این سرویس:
‏• مدیریت کامل مخازن، Pull Requestها و مشاهده کد بدون خروج از محیط Cursor.
‏• همگام‌سازی بلادرنگ با GitHub به عنوان منبع اصلی تغییرات.
‏• پشتیبانی از هوش مصنوعی برای اعمال تغییرات در کد، به‌روزرسانی PRها و مدیریت شاخه‌ها.
‏• ادغام مستقیم با ابزارهای CI/CD مانند Vercel، Depot و Buildkite.

‏استراتژی Cursor کاملاً مشخص است: آن‌ها قصد دارند فراتر از یک ویرایشگر ساده حرکت کرده و یک اکوسیستم کامل متشکل از کدهای شما و ایجنت‌های هوشمند بسازند. این ادغام، چرخه توسعه نرم‌افزار را به شدت سریع‌تر و کارآمدتر می‌کند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Cursor_Origin #AI_Agents
📈 جهش خیره‌کننده درآمد Anthropic در آستانه IPO

‏شرکت Anthropic با ثبت رکوردی بی‌سابقه، نرخ درآمد سالانه خود را به بیش از ۶۵ میلیارد دلار رسانده است. این رقم نشان‌دهنده رشدی ۷ برابری نسبت به پایان سال گذشته است و جایگاه این شرکت را به عنوان یکی از رقبای اصلی در صنعت هوش مصنوعی مستحکم‌تر می‌کند.

‏مهم‌ترین نکات درباره وضعیت فعلی این شرکت:

‏• دستیابی به سود عملیاتی تعدیل‌شده در سه‌ماهه اخیر که نشان از مدل تجاری پایدار دارد.
‏• رشد سریع نرخ درآمد از ۴۷ میلیارد دلار در ماه مه به ۶۵ میلیارد دلار در پایان ژوئیه.
‏• برنامه‌ریزی جدی برای عرضه عمومی سهام (IPO) که طبق پیش‌بینی‌ها ممکن است زودتر از OpenAI و در پاییز امسال رخ دهد.

‏این ارقام که در به‌روزرسانی‌های اختصاصی برای سرمایه‌گذاران منتشر شده، نشان می‌دهد که فضای رقابتی بین غول‌های AI به شدت داغ شده است و سرمایه‌گذاران وال‌استریت به زودی شاهد ورود یکی از بزرگ‌ترین بازیگران این حوزه به بازار بورس خواهند بود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Anthropic #IPO
🚀 تحولی در کارایی DeepSeek-V4-Pro

‏مدل DeepSeek-V4-Pro با استفاده از ابزار J-Space Cognition Suite توانسته است در بنچمارک‌های مختلف، از مدل Fable 5 پیشی بگیرد. نکته جالب توجه این است که این جهش عملکرد بدون هیچ‌گونه تغییر در وزن‌های مدل رخ داده است.

‏در واقع مشکل اصلی نه در معماری مدل، بلکه در نحوه اجرای آن بود. با اصلاح پروتکل زمان اجرا و رفع خطاهای پردازش تفکر (Thinking Process)، این مدل اکنون به سطح بالاتری از کیفیت استدلال دست یافته است. در گذشته، نشت توان مدل به دلیل کنترل ضعیف در زمان استنتاج رخ می‌داد که با این رویکرد جدید برطرف شد.

‏برخی از مهم‌ترین بنچمارک‌هایی که این مدل در آن‌ها عملکرد خیره‌کننده‌ای ثبت کرده است:

‏- Toolathlon
‏- DeepSWE
‏- NL2Repo
‏- HLE

‏این اتفاق نشان می‌دهد که گاهی اوقات با بهینه‌سازی دقیق فرآیند اجرا و کنترل هوشمندانه مدل، می‌توان بدون آموزش مجدد و صرف هزینه‌های سنگین، خروجی‌های بسیار قدرتمندتری از مدل‌های موجود دریافت کرد.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_V4_Pro #J_Space_Cognition_Suite
🚀 جهش خیره‌کننده مدل Qwen 3.8 27B در دنیای هوش مصنوعی

‏مدل Qwen 3.8 27B با کسب امتیاز ۵۲ در بنچمارک Artificial Analysis، معادلات رقابت در حوزه مدل‌های هوش مصنوعی را تغییر داده است. این دستاورد نشان می‌دهد که مدل‌های Open-Weight اکنون عملکردی در سطح پرچمداران تجاری ارائه می‌دهند.

‏مهم‌ترین نکات این موفقیت:

‏• قابلیت اجرا به صورت Local بر روی سخت‌افزارهای شخصی و لپ‌تاپ‌های معمولی.
‏• نزدیکی عملکرد به مدل‌های قدرتمندی نظیر GPT-5.6 Luna و GLM-5.2.
‏• کاهش وابستگی به APIهای ابری و سرورهای سنگین برای انجام پردازش‌های تخصصی.

‏ما وارد دوره‌ای شده‌ایم که قدرت پردازشی پیشرفته نه در سرورهای ابری، بلکه بر روی سخت‌افزار شخصی کاربران رقم می‌خورد. این مدل نمونه‌ای بارز از بلوغ مدل‌های متن‌باز برای استفاده در تسک‌های روزمره و حرفه‌ای است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Qwen_3_8_27B #Artificial_Analysis
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 یکپارچگی هوشمند Claude و ElevenLabs

‏اکنون می‌توانید ابزارهای صوتی ElevenLabs را مستقیماً از طریق رابط کاربری Claude مدیریت کنید. این قابلیت جدید که از طریق پروتکل MCP ارائه شده، جریان کاری توسعه‌دهندگان را متحول می‌کند.

‏با استفاده از این کانکتور، امکانات زیر بدون خروج از محیط Claude فراهم شده است:

‏* بررسی آمار عملکرد ایجنت‌های صوتی و متنی
‏* ساخت ایجنت‌های جدید و مدیریت تنظیمات آن‌ها
‏* تخمین دقیق هزینه‌های مربوط به درخواست‌های LLM پیش از استقرار نهایی در محیط عملیاتی (Production)

‏این یکپارچگی باعث می‌شود تا بدون نیاز به جابه‌جایی میان پلتفرم‌های مختلف، بهره‌وری در پروژه‌های هوش مصنوعی به‌طور چشمگیری افزایش یابد. این ابزار برای کسانی که به‌طور مداوم با مدل‌های زبانی و تولید محتوای صوتی سروکار دارند، یک گام رو به جلو محسوب می‌شود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#MCP #ElevenLabs
This media is not supported in your browser
VIEW IN TELEGRAM
📊 آمار جالب از میزان استفاده روزانه از ChatGPT

‏سارا فرایر، مدیر مالی ارشد (CFO) شرکت OpenAI، در مصاحبه جدید خود جزییات جالبی از میانگین تعداد پرسش‌های روزانه کاربران مطرح کرده است. الگوی استفاده در سطوح مختلف به شرح زیر است:

کاربران رایگان: حدود ۷ پرسش در روز
‏• اولین سطح اشتراک پولی: حدود ۱۵ پرسش در روز (۲ برابر)
‏• اشتراک Plus (۲۰ دلاری): حدود ۳ برابر کاربران رایگان
‏• اشتراک Pro: حدود ۱۱ برابر کاربران رایگان


‏مدیر مالی OpenAI در نهایت اشاره کرد که مأموریت اصلی این شرکت، توسعه هوش مصنوعی عمومی (AGI) برای منفعت همگانی بشریت است، نه فقط برای کسانی که توانایی پرداخت هزینه آن را دارند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🚀 جهش هوش مصنوعی با استراتژی خود-ارزیابی

‏مدل‌های متن‌باز اکنون به سطحی از توانایی رسیده‌اند که می‌توانند تعداد زیادی راهکار باکیفیت تولید کرده و خروجی‌های خود را با هزینه‌ای بسیار ناچیز ارزیابی کنند.

‏در یک بنچمارک اخیر بر روی Terminal-Bench 2.1، مدل DeepSeek V4 Flash موفق شد با استفاده از تکنیک خود-ارزیابی، عملکردی بهتر از Claude Fable 5 داشته باشد. نکته قابل توجه این است که این روش نه تنها دقت را به شکل چشمگیری افزایش می‌دهد، بلکه هزینه‌های اجرا را تا ۱۱ برابر کاهش می‌دهد.

‏مهم‌ترین نکات این روش:
‏• افزایش دقت مدل از ۷۹٪ به ۸۸٪ تنها با نمونه‌برداری از ۵ راهکار.
‏• استفاده از خود مدل به عنوان داور (LLM-as-a-Verifier) برای رتبه‌بندی خروجی‌ها.
‏• صرفه اقتصادی بالا در مقایسه با مدل‌های بسته و تجاری.

‏این رویکرد نشان می‌دهد که چگونه ترکیب هوشمندانه استراتژی‌های ارزیابی می‌تواند کارایی مدل‌های فعلی را بدون نیاز به آموزش مجدد سنگین، ارتقا دهد.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_V4_Flash #Terminal_Bench
هوش مصنوعی و علم داده به فارسی
🚀 تحولی در کارایی DeepSeek-V4-Pro ‏مدل DeepSeek-V4-Pro با استفاده از ابزار J-Space Cognition Suite توانسته است در بنچمارک‌های مختلف، از مدل Fable 5 پیشی بگیرد. نکته جالب توجه این است که این جهش عملکرد بدون هیچ‌گونه تغییر در وزن‌های مدل رخ داده است. ‏در…
🚀 تحول در عملکرد مدل‌ها با سیستم J-Space

‏دنیای هوش مصنوعی دوباره غافلگیر شد! گزارش‌های اخیر نشان می‌دهد که استفاده از ابزار J-Space توانسته است عملکرد مدل DeepSeek V4-Pro را در وظایف پیچیده به شکل چشمگیری بهبود ببخشد، به طوری که در بسیاری از تست‌ها از مدل Fable 5 پیشی گرفته است.

‏نکته جالب اینجاست که در این فرآیند، پارامترهای مدل تغییر نکرده‌اند. سیستم J-Space در واقع یک گردش‌کار هوشمند برای مدیریت پرامپت‌هاست که به مدل کمک می‌کند در انجام وظایف طولانی و چندمرحله‌ای دچار سردرگمی نشود. این سیستم با ایجاد یک «دفترچه یادداشت» برای مدل، او را مجبور می‌کند مراحل را تایید کرده و در صورت بروز خطا، به عقب بازگردد.

‏مهم‌ترین دستاوردهای این متدولوژی:
‏* افزایش امتیاز در Terminal Bench از ۸۷.۹ به ۹۰.۱
‏* جهش عملکرد در DeepSWE از ۶۲.۷ به ۷۲.۰
‏* رشد چشمگیر در NL2Repo از ۶۱.۵ به ۷۳.۴

‏این تجربه ثابت کرد که شاید مدل‌ها همواره توانمند بوده‌اند، اما توانایی آن‌ها به درستی آزاد نمی‌شد. به جای رقابت صرف بر سر مدل‌های جدید، اکنون اهمیتِ طراحی «روش کار» یا همان Harness برای مدل‌ها، بیش از پیش آشکار شده است.

📊 DataScience
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #89 | 📌 7 آیتم گزارش | 🧾 از 16 پست بررسی‌شده
🕐 دوشنبه 1405/05/26 ساعت 14:00 تا سه‌شنبه 1405/05/27 ساعت 14:00

🤖 مدل‌ها و ابزارهای هوش مصنوعی

معرفی مدل North Micro Vision توسط Cohere Labs با ۲.۴ میلیارد پارامتر. این مدل برای تحلیل دقیق اسناد، جداول و نمودارها بهینه شده و به دلیل حجم کم، روی دستگاه‌های موبایل و لپ‌تاپ قابل اجراست.
🔗 مشاهده پست

مدل MiniMax Music 3 با معماری سلسله‌مراتبی، امکان تولید قطعات موسیقی ۵ دقیقه‌ای با کیفیت استریو و پشتیبانی از وکال را به صورت متن‌باز فراهم کرده است.
🔗 مشاهده پست

مدل ویدئویی MAGI-2 با معماری MoE، ویدئوهای ۱۰ ثانیه‌ای با صوت هماهنگ تولید می‌کند. این مدل با استفاده از ساختار single-stream، هزینه اینفرنس را نسبت به مدل‌های مشابه ده برابر کاهش داده است.
🔗 مشاهده پست


📈 تحولات بازار و شرکت‌ها

شرکت Stripe در یک اقدام استراتژیک برای تقویت جایگاه خود در هوش مصنوعی، OpenRouter را به مبلغ ۷ میلیارد دلار خریداری کرد.
🔗 مشاهده پست

درآمد سالانه شرکت Anthropic با رشدی ۷ برابری نسبت به سال گذشته به ۶۵ میلیارد دلار رسید. این شرکت اکنون به سود عملیاتی تعدیل‌شده دست یافته و در آستانه عرضه اولیه عمومی قرار دارد.
🔗 مشاهده پست


بهینه‌سازی و عملکرد مدل‌ها

مدل متن‌باز Qwen 3.8 27B با کسب امتیاز ۵۲ در بنچمارک‌ها، عملکردی در سطح پرچمداران تجاری ارائه داده و قابلیت اجرا روی سخت‌افزارهای شخصی را دارد.
🔗 مشاهده پست

استفاده از استراتژی خود-ارزیابی در مدل‌های متن‌باز مانند DeepSeek V4 Flash، ضمن ارتقای دقت در بنچمارک‌ها، هزینه‌های پردازشی را تا ۱۱ برابر کاهش داده است.
🔗 مشاهده پست


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🚀 ظهور مدل پیشرو Sonic-3.6 در دنیای TTS

‏شرکت Cartesia با انتشار مدل جدید Sonic-3.6، استانداردهای تولید متن به گفتار (TTS) را جابجا کرده است. این مدل در حال حاضر رتبه اول را در هر دو بنچمارک اصلی Artificial Analysis کسب کرده و رقبای قدرتمندی را پشت سر گذاشته است.

‏مهم‌ترین نکات درباره این مدل:
‏* صدرنشینی در بنچمارک‌ها: کسب بالاترین امتیاز Elo در بخش‌های Provider Voice و Controlled Voice.
‏* برتری در ارزیابی فنی: در بخش Controlled Voice که تفاوت‌های ناشی از کیفیت صدا حذف شده و تنها موتور سنتز ارزیابی می‌شود، این مدل با کنار زدن ElevenLabs Eleven v3 به جایگاه نخست رسیده است.
‏* معماری متفاوت: برخلاف مدل‌های ترنسفورمری رایج، Sonic بر پایه State Space Models توسعه یافته است.
‏* تاخیر بسیار کم: ادعای زمان تولید کمتر از 90 میلی‌ثانیه تا شنیده شدن اولین بخش از صدا (Time-to-first-audio).

‏جزئیات بیشتر را می‌توانید در بررسی تخصصی این مدل مطالعه کنید.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Sonic_3_6 #State_Space_Models
📚 کتاب جامع یادگیری زبان طبیعی و مدل‌های زبانی بزرگ

‏انتشارات Springer به تازگی کتابی جامع و دسترسی‌-آزاد با عنوان «Natural Language Processing and Large Language Models» منتشر کرده است. این کتاب حدود ۴۰۰ صفحه‌ای، منبعی عالی برای ورود به دنیای مدرن پردازش زبان طبیعی و مدل‌های زبانی بزرگ (LLM) است.

‏مطالب این کتاب به شکلی طبقه‌بندی شده‌اند که یادگیری مفاهیم پیچیده را برای مخاطب ساده می‌کند. مهم‌ترین سرفصل‌های این کتاب عبارتند از:

‏- شبکه‌های عصبی و نمایش‌های توزیع‌شده
‏- معماری‌های Transformer، BERT و GPT
‏- مکانیزم‌های توکنایزیشن و تحلیل احساسات
‏- خلاصه‌سازی متن و درک زبان طبیعی
‏- ترجمه ماشینی و سیستم‌های پرسش و پاسخ
‏- یادگیری تقویتی با بازخورد انسانی (RLHF)

‏اگر به دنبال مرجعی معتبر برای یادگیری این مباحث هستید، می‌توانید نسخه کامل آن را از طریق لینک زیر دریافت کنید:

دریافت و مطالعه کتاب از Springer

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Transformer #RLHF
هوش مصنوعی و علم داده به فارسی
📚 کتاب جامع یادگیری زبان طبیعی و مدل‌های زبانی بزرگ ‏انتشارات Springer به تازگی کتابی جامع و دسترسی‌-آزاد با عنوان «Natural Language Processing and Large Language Models» منتشر کرده است. این کتاب حدود ۴۰۰ صفحه‌ای، منبعی عالی برای ورود به دنیای مدرن پردازش…
DataPlusScience___978-981-92-0682-7.pdf
9.9 MB
Natural Language Processing and Large Language Models
Theory, Hand-on Codes, and Case Studies


📚 کتاب جامع یادگیری زبان طبیعی و مدل‌های زبانی بزرگ

‏انتشارات Springer به تازگی کتابی جامع و دسترسی‌-آزاد با عنوان «Natural Language Processing and Large Language Models» منتشر کرده است. این کتاب حدود ۴۰۰ صفحه‌ای، منبعی عالی برای ورود به دنیای مدرن پردازش زبان طبیعی و مدل‌های زبانی بزرگ (LLM) است.

‏مطالب این کتاب به شکلی طبقه‌بندی شده‌اند که یادگیری مفاهیم پیچیده را برای مخاطب ساده می‌کند. مهم‌ترین سرفصل‌های این کتاب عبارتند از:

‏- شبکه‌های عصبی و نمایش‌های توزیع‌شده
‏- معماری‌های Transformer، BERT و GPT
‏- مکانیزم‌های توکنایزیشن و تحلیل احساسات
‏- خلاصه‌سازی متن و درک زبان طبیعی
‏- ترجمه ماشینی و سیستم‌های پرسش و پاسخ
‏- یادگیری تقویتی با بازخورد انسانی (RLHF)


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Transformer #RLHF
📊 ۱۲ تکنیک کلیدی برای مدیریت داده‌های پرت (Outliers)

داده‌های پرت می‌توانند نتایج مدل‌های یادگیری ماشین را به شدت تحت تأثیر قرار دهند. برای حفظ دقت و کاهش سوگیری، باید بدانیم چه زمانی و چگونه با این نقاط برخورد کنیم. در ادامه، مهم‌ترین راهکارها برای شناسایی و مدیریت این داده‌ها را بررسی می‌کنیم:

‏* روش IQR: حذف مقادیر خارج از محدوده چارک‌ها؛ ایده‌آل برای داده‌های غیرنرمال.
‏* Z-Score: استفاده از انحراف از میانگین برای داده‌های با توزیع نرمال.
‏* Winsorization: جایگزینی مقادیر پرت با مقادیر مرزی به جای حذف داده‌ها.
‏* Isolation Forest: الگوریتم یادگیری ماشین برای شناسایی ناهنجاری‌ها از طریق ایزوله کردن مشاهدات.
‏* DBSCAN: شناسایی نقاطی که در خوشه‌های متراکم جای نمی‌گیرند؛ بسیار کاربردی برای داده‌های مکانی.

چند نکته طلایی:
‏همیشه پیش از حذف هر داده‌ای، آن را بصری‌سازی کنید و به یاد داشته باشید که تمام داده‌های پرت لزوماً «بد» نیستند؛ گاهی آن‌ها حاوی ارزشمندترین اطلاعات سیستم شما هستند. درک عمیق از ماهیت داده‌ها و قوانین دامنه (Domain Knowledge) همیشه بر کورکورانه حذف کردن ارجحیت دارد.

📊 DataScience
1