هوش مصنوعی و علم داده به فارسی
6.06K subscribers
2.09K photos
515 videos
366 files
2.27K links
DataPlusScience | هوش مصنوعی و علم داده به فارسی
اخبار، تحلیل، آموزش و ابزارهای کاربردی

🌐 DataPlusScience.ir

📩 ارتباط با ما: @Contact2Mebot

📂 کانال فایل‌ها: @Datascientists_Files

💎 بله: ble.ir/dataplusscience

💡 ایتا: eitaa.com/DataPlusScience
Download Telegram
‏💰 اهداف مالی آنتروپیک برای عرضه عمومی سهام

‏اسناد فاش‌شده از برنامه‌های Anthropic برای ورود به بازار بورس نشان می‌دهد که این شرکت در حال هدف‌گذاری برای رسیدن به ارزش‌گذاری بیش از ۲ تریلیون دلار است.

‏این گزارش جزئیات مالی زیر را درباره عملکرد شرکت در سال ۲۰۲۵ برملا می‌کند:

‏• درآمد سالانه ۴.۶ میلیارد دلار که نسبت به دوره‌های قبل رشد ۱۲ برابری داشته است.
‏• زیان عملیاتی ۸.۰۶ میلیارد دلار و زیان خالص ۴۲ میلیارد دلاری که بخش بزرگی از آن ناشی از هزینه‌های غیرنقدی حسابداری است.
‏• وابستگی قابل‌توجه به مشتریان بزرگ، به‌طوری که نزدیک به ۲۵ درصد درآمد تنها از دو مشتری تأمین می‌شود.
‏• تعهدات سنگین ۵۱۸ میلیارد دلاری برای زیرساخت‌ها، پردازش ابری و محاسباتی که بیش از ۱۰۰ برابر درآمد سال ۲۰۲۵ این شرکت است.

‏بسیاری از مشتریان اصلی آنتروپیک در حال حاضر قراردادهای بلندمدتی ندارند و این موضوع احتمال کاهش یا توقف هزینه‌کرد آن‌ها را در آینده افزایش می‌دهد.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Anthropic #IPO
Media is too big
VIEW IN TELEGRAM
‏🤖 معرفی Dots توسط OpenAI

‏شرکت OpenAI از «Dots» رونمایی کرد؛ ایجنت‌های هوش مصنوعی دائمی که روی فضای ابری اختصاصی اجرا می‌شوند و حتی پس از بستن پنجره ChatGPT به فعالیت خود ادامه می‌دهند.

‏هر Dot از مدل GPT-6 Astra قدرت می‌گیرد و به مرورگر و بیش از ۴ هزار اپلیکیشن دسترسی دارد. این ایجنت‌ها می‌توانند در زمان آفلاین بودن کاربر، در اپلیکیشن‌های متصل جست‌وجو انجام دهند و پس از تأیید نهایی توسط کاربر، عملیات مورد نظر را اجرا کنند.

‏نکات فنی این ابزار:
‏* استفاده از لاگین‌های ذخیره‌شده بدون نمایش رمز عبور به مدل.
‏* ضرورت دخالت انسان برای تغییر رمز عبور.

‏OpenAI اعلام کرده که احتمال بروز خطا در عملکرد این ایجنت‌ها همچنان وجود دارد. متا نیز با معرفی مدل Muse در حال توسعه دستیارهایی با قابلیت‌های مشابه، از جمله حافظه مستقل و دسترسی به برنامه‌ها است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#OpenAI_Dots #GPT_6_Astra
‏📊 کاهش فاصله زمانی انتشار مدل‌های Anthropic و OpenAI

‏فاصله زمانی بین انتشار مدل‌های جدید از سوی دو شرکت Anthropic و OpenAI به شکل قابل‌توجهی کاهش یافته است.

‏داده‌های بررسی‌شده نشان می‌دهد در حالی که اوایل سال ۲۰۲۴ به طور متوسط هر ۷۰ روز شاهد معرفی یک مدل جدید بودیم، این بازه زمانی اکنون به حدود ۱۱ روز رسیده است.

‏این روند نشان‌دهنده سرعت‌گیری جدی در چرخه تولید و عرضه مدل‌های هوش مصنوعی توسط این دو توسعه‌دهنده اصلی است که در نمودار فعلی با کاهش بازه زمانی انتشار میان مدل‌های نارنجی (Anthropic) و سبز (OpenAI) مشخص شده است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Anthropic #OpenAI
‏جزوات معماری GPU و برنامه‌نویسی CUDA

‏دانشگاه استنفورد جزوات کامل درس معماری GPU و برنامه‌نویسی CUDA را منتشر کرده است. این دوره مفاهیم پایه پردازش موازی و نحوه مدیریت منابع سخت‌افزاری را بررسی می‌کند.

‏مهم‌ترین نکات مطرح‌شده در این دوره شامل موارد زیر است:

‏* سیر تکامل: بررسی گذار از کاربردهای گرافیکی اولیه به محاسبات علمی (GPGPU) و ظهور معماری Tesla و CUDA در سال ۲۰۰۷.
‏* مدل برنامه‌نویسی: تفکیک دقیق وظایف بین Host (CPU) و Device (GPU) با استفاده از مدل Kernel و Thread Block.
‏* سلسله‌مراتب حافظه: تفاوت عملکرد بین Registers، Shared memory و Global memory و تاثیر آن‌ها بر کارایی برنامه.
‏* معماری سخت‌افزار: تحلیل اجزای Streaming Multiprocessors (SM) در نمونه سخت‌افزارهایی مانند NVIDIA V100.
‏* مدیریت اجرا: نحوه زمان‌بندی رشته‌ها، همگام‌سازی (Synchronization) در بلوک‌های پردازشی و پیاده‌سازی الگوریتم‌هایی نظیر کانولوشن یک‌بعدی.

‏این مطالب به بررسی نحوه انتقال داده بین CPU و GPU و اجرای موازی در مقیاس وسیع می‌پردازد.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
‏📚 کتاب الگوهای طراحی یادگیری ماشین

‏کتاب «Machine Learning Design Patterns» که توسط انتشارات O'REILLY منتشر شده، به بررسی راهکارهای عملی برای چالش‌های رایج در پروژه‌های هوش مصنوعی می‌پردازد.

‏نویسندگان این کتاب، Valliappa Lakshmanan، Sara Robinson و Michael Munn، تجربیات خود را در سه حوزه اصلی متمرکز کرده‌اند:

‏* آماده‌سازی داده‌ها
‏* ساخت مدل
‏* مدیریت MLOps

‏این کتاب برای توسعه‌دهندگان و مهندسان داده‌ای مناسب است که به دنبال پیاده‌سازی اصولی و مقیاس‌پذیر در چرخه‌ حیات پروژه‌های یادگیری ماشین هستند. مطالب این منبع به جای تئوری‌های انتزاعی، بر ارائه الگوهای تکرارپذیر برای رفع مشکلات فنی در محیط‌های عملیاتی تمرکز دارد.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#MLOps #MachineLearningDesignPatterns
هوش مصنوعی و علم داده به فارسی
‏📚 کتاب الگوهای طراحی یادگیری ماشین ‏کتاب «Machine Learning Design Patterns» که توسط انتشارات O'REILLY منتشر شده، به بررسی راهکارهای عملی برای چالش‌های رایج در پروژه‌های هوش مصنوعی می‌پردازد. ‏نویسندگان این کتاب، Valliappa Lakshmanan، Sara Robinson و Michael…
Machine Learning Design Patterns.pdf
16.1 MB
‏📊 الگوهای طراحی در یادگیری ماشین

‏کتاب Machine Learning Design Patterns مجموعه‌ای از راه‌حل‌های تکرارپذیر برای چالش‌های رایج در پروژه‌های یادگیری ماشین ارائه می‌دهد. این الگوها به مهندسان کمک می‌کنند تا با انتخاب ساختارهای بهینه، فرآیند توسعه و استقرار مدل‌ها را استانداردسازی کنند.

‏مهم‌ترین الگوهای مطرح‌شده در این منبع:

‏* الگوهای تحلیل داده: شامل راهکارهایی برای برخورد با داده‌های نابرابر (Imbalanced Datasets) و مدیریت داده‌های نویزدار.
‏* الگوهای مهندسی ویژگی: روش‌های استاندارد برای تبدیل ویژگی‌ها (Feature Transformation) و ایجاد ویژگی‌های ترکیبی.
‏* الگوهای مدل‌سازی: شامل راهکارهایی برای افزایش دقت پیش‌بینی، ترکیب مدل‌ها (Ensemble) و مدیریت نرخ یادگیری.
‏* الگوهای استقرار و خدمت‌رسانی: متدهایی برای بهینه‌سازی سرعت پاسخ‌دهی (Latency) در مدل‌های مستقر شده.
‏* الگوهای تکرارپذیری: روش‌هایی برای حفظ ثبات و اطمینان از عملکرد مدل در طول زمان و به‌روزرسانی‌های متناوب.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#MLDesignPatterns #FeatureTransformation
‏🧠 گوگل دیپ‌مایند مدل جدید Gemini 4 Argon را معرفی کرد

‏شرکت گوگل دیپ‌مایند از مدل پیشرو جدید خود با نام Gemini 4 Argon رونمایی کرد. این مدل برای مدیریت گردش‌های کاری پیچیده در حوزه‌های برنامه‌نویسی، فعالیت‌های دانشی سازمانی و دفاع امنیت سایبری توسعه یافته است.

‏دسترسی به این مدل از امروز برای گروهی از ارزیابان معتمد در قالب برنامه‌ای به نام Fairwind آغاز می‌شود.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Gemini4Argon #FairwindProgram
This media is not supported in your browser
VIEW IN TELEGRAM
‏🦴 انتشار مدل‌های بنیادی سه‌بعدی برای رادیولوژی

‏مدل‌های nnFoundation به عنوان مدل‌های بنیادی برای داده‌های سه‌بعدی رادیولوژی معرفی شدند. این مدل‌ها با هدف یادگیری بازنمایی‌های قابل انتقال در وظایف و مجموعه‌داده‌های مختلف طراحی شده‌اند.

‏دسترسی به مستندات و منابع این مدل‌ها از طریق لینک‌های زیر امکان‌پذیر است:

‏- مقاله علمی
‏- مجموعه مدل‌ها در Hugging Face
‏- بررسی فنی

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#nnFoundation #RepresentationLearning
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 معرفی مدل مالتی‌مودال Jev-Omni

‏مدل Jev-Omni به عنوان یک سیستم جامع چندوجهی منتشر شد که برخلاف نسخه‌های متن‌باز فعلی، همزمان از ورودی‌های متن، تصویر، صدا و ویدیو پشتیبانی می‌کند.

‏این مدل در بنچمارک‌های تایپ‌شده با مدل Jev برابری می‌کند و برای آموزش آن از ۳۰ هزار نمونه داده روی سخت‌افزار 8xH200 استفاده شده است. طبق اعلام توسعه‌دهنده، زمان پاسخگویی این مدل روی یک پردازنده H100 کمتر از ۱۰۰ میلی‌ثانیه است.

‏اطلاعات فنی و فایل‌های این مدل را می‌توانید در صفحه Hugging Face پروژه مشاهده کنید.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Jev_Omni #H100
This media is not supported in your browser
VIEW IN TELEGRAM
‏🚀 معرفی موتور جستجوی Photon توسط Perplexity

‏جستجو به گلوگاه اصلی برای ایجنت‌های هوش مصنوعی تبدیل شده است و شرکت Perplexity برای رفع این مشکل، موتور بازیابی و رتبه‌بندی خود را با نام Photon از پایه بازنویسی کرده است. این موتور که با زبان Rust توسعه یافته، جایگزین نسخه متن‌بازی شده که سال‌ها از آن استفاده می‌شد.

‏موتور قبلی با افزایش حجم ایندکس دچار مشکل کمبود RAM می‌شد و زمان پاسخگویی p99 آن به حدود ۸۰۰ تا ۱۲۰۰ میلی‌ثانیه می‌رسید. Photon با تغییرات زیر این مشکل را حل کرده است:

‏• استفاده از لیست‌های فشرده (Inline، آرایه‌های پراکنده یا Bitmap) برای ذخیره‌سازی
‏• پیاده‌سازی الگوریتم پیمایش WAND برای حذف کاندیداهای نامناسب پیش از محاسبه دقیق امتیازها
‏• دسته‌بندی خواندن از دیسک با استفاده از io_uring برای جلوگیری از انباشت تأخیرها
‏• انتقال فرایند ساخت ایندکس به خارج از نودهای سرویس‌دهنده

‏در محیط عملیاتی، این تغییرات باعث شد p99 به حدود ۶۵ میلی‌ثانیه کاهش یابد؛ در حالی که مصرف منابع سخت‌افزاری ۲۰ درصد کمتر شده و ظرفیت ذخیره‌سازی داده‌ها ۲.۵ برابر افزایش یافته است.

🇮🇷 سایت | تلگرام
Media is too big
VIEW IN TELEGRAM
‏🤖 عرضه نسخه ۲.۰ پلتفرم Manus با معماری Cascade

‏نسخه جدید Manus از یک ایجنت هوش مصنوعی به یک محیط کاری کامل تبدیل شده است. قلب تپنده این نسخه، معماری جدید Cascade است که ابزارها را تنها در زمان نیاز فعال می‌کند. طبق داده‌های فنی، این تغییر باعث کاهش ۲۳.۲ درصدی مصرف توکن، افزایش ۲۸.۲ درصدی سرعت اجرای تسک‌ها و کاهش ۳۲ درصدی هزینه‌ها شده است.

‏مهم‌ترین ویژگی‌های نسخه جدید عبارتند از:

‏* Manus Studio: فضایی یکپارچه برای مدیریت همزمان اسناد، صفحات گسترده، ارائه، وب‌سایت، کد، ویدیو و بازی.
‏* ویرایشگر ویدیو: امکان تغییر دستی فریم‌ها، موسیقی، متن و انیمیشن‌ها بدون نیاز به تولید مجدد کامل ویدیو.
‏* Game Dev: ابزاری برای ساخت و انتشار بازی با قابلیت اجرای سرور اختصاصی در Cloud Computer.
‏* اتوماسیون رویدادمحور: اجرای خودکار تسک‌ها بر اساس پیام‌های Slack، ایمیل یا تغییرات تقویم.
‏* Computer Use: قابلیت کنترل مستقیم برنامه‌ها و فایل‌های سیستم از طریق گوشی.

‏علاوه بر این، اپلیکیشن Cue نیز معرفی شده است که امکان ساخت ایجنت‌های شخصی با ایمیل، شماره تلفن و کیف پول اختصاصی و تشکیل تیم‌های چندعاملی را فراهم می‌کند.
❤2
‏🛡 مخزن منابع امنیت ایجنت‌های هوش مصنوعی

‏مخزن Awesome Agent Skills Security در گیت‌هاب مجموعه‌ای از تحقیقات، استانداردها و ابزارهای لازم برای ایمن‌سازی ایجنت‌هایی که از ابزارها، افزونه‌ها و مهارت‌های خارجی استفاده می‌کنند را گردآوری کرده است.

‏این فهرست برای افرادی که در حال توسعه زیرساخت‌های MCP یا سیستم‌های ایجنتی هستند، کاربردی است و موارد زیر را پوشش می‌دهد:

‏- حملات تزریق پرامپت (Prompt Injection) از طریق ابزارها
‏- حملات مسموم‌سازی داده و زنجیره تأمین
‏- نشت اطلاعات و دسترسی‌های فراتر از نیاز
‏- محیط‌های ایزوله (Sandboxing) و نظارت در زمان اجرا
‏- تیم‌های قرمز (Red Teaming) و بنچمارک‌ها
‏- استانداردهای OWASP، MITRE ATLAS، NIST و IETF

‏این منابع نشان می‌دهند که با دسترسی مدل‌ها به فایل‌ها، APIها و انجام عملیات واقعی، سطح حمله برای سیستم‌های ایجنتی به میزان قابل توجهی گسترش یافته است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Agent_Security #MCP
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #130 | 📌 8 آیتم گزارش | 🧾 از 15 پست بررسی‌شده
🕐 چهارشنبه 1405/07/08 ساعت 14:00 تا پنجشنبه 1405/07/09 ساعت 14:00

🔎 تحلیل کوتاه
تمرکز توسعه‌دهندگان بر ابزارهای خودکار، از معرفی ایجنت‌های دائمی تا زیرساخت‌های تخصصی، بهینه‌سازی عملکرد و مدیریت منابع را به چالش اصلی تبدیل کرده است. در این میان، کاهش فاصله زمانی انتشار مدل‌ها و توسعه معماری‌های جدید برای افزایش سرعت اجرای تسک‌ها، نشان‌دهنده شتاب‌گیری در استقرار ایجنت‌های هوش مصنوعی در محیط‌های عملیاتی است.


🤖 توسعه ابزارها و زیرساخت ایجنت‌ها

معرفی ایجنت‌های دائمی Dots توسط OpenAI
ایجنت‌های ابری که حتی در زمان آفلاین بودن کاربر، در اپلیکیشن‌ها جست‌وجو می‌کنند.
🔗 مشاهده پست

آناتومی فنی زیرساخت Agent Harness
بررسی اجزای زیرساختی که مدل‌های زبانی را به عامل‌های خودکار تبدیل می‌کنند.
🔗 ادامه مطلب در سایت

نسخه جدید پلتفرم Manus با معماری Cascade
ارتقای سرعت و کاهش هزینه اجرای تسک‌ها با فعال‌سازی ابزارها فقط در زمان نیاز.
🔗 مشاهده پست

مخزن منابع امنیت ایجنت‌های هوش مصنوعی
مجموعه‌ای از استانداردها و ابزارها برای ایمن‌سازی مهارت‌های خارجی ایجنت‌ها.
🔗 مشاهده پست

ابزار Jev برای غنی‌سازی داده‌ها
جایگزین متن‌باز و کم‌هزینه برای استفاده در عامل‌های هوشمند.
🔗 جزئیات کامل در سایت


🧠 مدل‌های جدید و تحقیقات فنی

معرفی مدل Gemini 4 Argon گوگل دیپ‌مایند
مدل جدید برای مدیریت گردش‌های کاری پیچیده در برنامه‌نویسی و امنیت سایبری.
🔗 مشاهده پست

انتشار مدل مالتی‌مودال Jev-Omni
سیستم چندوجهی با زمان پاسخگویی زیر ۱۰۰ میلی‌ثانیه روی سخت‌افزار H100.
🔗 مشاهده پست

بنچمارک ExplorationBench برای هوش مصنوعی
ارزیابی توانایی مدل‌ها در کشف قواعد ناشناخته در محیط‌های مجازی.
🔗 ادامه مطلب در سایت


🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
‏🧪 بنچمارک جدید برای سنجش توانایی اکتشاف هوش مصنوعی

‏محققان Tencent، دانشگاه فودان و چینهوا بنچمارک ExplorationBench را برای بررسی قدرت «کشف قوانین جدید» توسط مدل‌های هوش مصنوعی ارائه کرده‌اند. در این محیط، منطق معمول کار نمی‌کند و مدل باید با آزمایش و خطا، قواعد حاکم بر «جهان‌های بیگانه» را بیاموزد.

‏این بنچمارک از دو محیط اصلی تشکیل شده است:
‏* AlienCode: شامل ۳۱ قانون و ۷۰ تسک برای ارزیابی منطق عددی.
‏* AlienLogic: شامل ۲۴ قانون و ۷۰ تسک برای بررسی قواعد منطقی.

‏نتایج ارزیابی ۱۰ سیستم هوش مصنوعی نشان می‌دهد که توانایی استدلال بر اساس قوانین از پیش‌تعیین‌شده با توانایی کشف قوانین جدید متفاوت است. مهم‌ترین نکات این آزمایش:
‏* مدل‌ها در شروع بدون بازخورد، عملکردی حداکثر ۱۵.۷ درصدی دارند که پس از چهار مرحله تعامل با محیط، در AlienCode تا ۸۹ درصد بهبود می‌یابد.
‏* در مهم‌ترین موارد از ۱۰ سیستم، طراحی آزمایش‌های خودکار توسط مدل برای کشف محیط، موثرتر از تکیه بر اطلاعات پیش‌فرض بود.
‏* تفاوت فاحش عملکردی (از ۵.۷ تا ۷۹ درصد) در مدل‌های مختلف با بودجه یکسان مشاهده شده است.

🇮🇷 سایت | تلگرام
هوش مصنوعی و علم داده به فارسی
‏🧠 گوگل دیپ‌مایند مدل جدید Gemini 4 Argon را معرفی کرد ‏شرکت گوگل دیپ‌مایند از مدل پیشرو جدید خود با نام Gemini 4 Argon رونمایی کرد. این مدل برای مدیریت گردش‌های کاری پیچیده در حوزه‌های برنامه‌نویسی، فعالیت‌های دانشی سازمانی و دفاع امنیت سایبری توسعه یافته…
‏🤖 معرفی مدل هوش مصنوعی Gemini 4 Argon

‏گوگل مدل جدید Gemini 4 Argon را برای انجام وظایف پیچیده چندمرحله‌ای مانند برنامه‌نویسی، تحلیل‌های حقوقی و مالی، و مدیریت جریان‌های کاری سازمانی معرفی کرد. ویژگی اصلی این مدل افزایش ظرفیت تولید خروجی تا ۱ میلیون توکن است که امکان استدلال در پروژه‌های بسیار طولانی را فراهم می‌کند.

‏برخی از نتایج بنچمارک این مدل عبارتند از:
‏- کسب امتیاز ۷۷.۹٪ در DeepSWE v1.1 برای مسائل پیچیده مهندسی نرم‌افزار
‏- رتبه اول در AutomationBench با امتیاز ۵۱.۳٪
‏- کسب امتیاز ۹۱.۷٪ در LVBench برای تحلیل ویدیوهای طولانی
‏- امتیاز ۶۸٪ در CWE-bench v1 برای شناسایی و اصلاح آسیب‌پذیری‌ها

‏در پروژه‌های داخلی گوگل، مدل Argon برای بازنویسی کدهای حجیم C/C++ به Rust استفاده شده است. همچنین با تحلیل زیرساخت‌های این شرکت، مدل موفق به شناسایی بهینه‌سازی‌هایی در مدیریت حافظه شد که آزادسازی بیش از ۳۰۰ ترابایت رم را به همراه داشت.

‏در حال حاضر دسترسی به این مدل محدود است و ابتدا برای کاربران برنامه Fairwind فراهم شده.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 ابزار تعاملی برای درک بصری معماری Transformer

‏آزمایشگاه Polo Club دانشگاه جورجیا تک یک ابزار تعاملی به نام Transformer Explainer توسعه داده است که کارکرد درونی این معماری را به صورت زنده در مرورگر نمایش می‌دهد.

‏این شبیه‌ساز جریان داده‌ها را در یک مدل پیش‌فرض (در مقیاس GPT-2) بررسی می‌کند. شما می‌توانید متن دلخواه خود را وارد کنید و فرآیند تبدیل متن به توکن، کارکرد مکانیزم Attention، اعمال توابع فعال‌ساز و نحوه محاسبه احتمالات برای تولید کلمه بعدی را به صورت گام‌به‌گام مشاهده کنید. این ابزار به درک مفاهیم ریاضی پشت مدل‌های زبانی بدون نیاز به درگیری با کدها کمک می‌کند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Transformer_Explainer #GPT2
‏📊 عملکرد متفاوت دستیار هوش مصنوعی در آموزش فیزیک هاروارد

‏دانشگاه هاروارد در آزمایشی روی ۱۹۴ دانشجوی فیزیک، عملکرد یک دستیار هوش مصنوعی اختصاصی را با کلاس‌های درس سنتی مقایسه کرد. این سیستم به جای ارائه پاسخ‌های آماده، دانشجو را با پرسش، توضیحات گام‌به‌گام و بررسی استدلال‌ها هدایت می‌کند.

‏نتایج نشان می‌دهد دانشجویانی که از این ابزار استفاده کردند:
‏* نمره میانه ۴.۵ را در آزمون نهایی کسب کردند (در مقابل نمره ۳.۵ گروه کلاس حضوری).
‏* یادگیری بیشتری را تجربه کردند در حالی که زمان مطالعه آن‌ها به ۴۹ دقیقه کاهش یافت (در مقابل ۶۰ دقیقه زمان کلاس حضوری).

‏این مدل به‌طور اختصاصی برای اصول یادگیری علوم طراحی شده است و برخلاف چت‌بات‌های عمومی، مانند یک معلم خصوصی برای هر دانشجو شخصی‌سازی می‌شود. این مطالعه تنها بر دو مبحث فیزیک متمرکز بوده و به معنای جایگزینی کلی اساتید یا دانشگاه‌ها نیست.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Harvard_Physics #AI_Tutor
This media is not supported in your browser
VIEW IN TELEGRAM
‏🎙 انتشار مدل جدید تبدیل گفتار به متن مایکروسافت

‏مایکروسافت مدل جدید MAI-Transcribe-2-Streaming را برای تبدیل لحظه‌ای گفتار به متن منتشر کرد. این مدل اکنون با نرخ خطای ۲.۵ درصد در جایگاه نخست بنچمارک AA-WER قرار گرفته است.

‏برخی از ویژگی‌های عملکردی این مدل عبارتند از:

‏* دقت و سرعت: دستیابی به نرخ خطای ۲.۵ درصد در زمان ۰.۱۳ ثانیه پس از پایان صحبت که نسبت به مدل‌هایی مانند Grok Voice Transcribe 2.0 با نرخ ۲.۷ درصد و تأخیر ۰.۴۹ ثانیه، بهبود یافته است.
‏* هزینه: قیمت سرویس استریمینگ این مدل ۰.۵۴ دلار به ازای هر ساعت صدا (معادل ۹ دلار برای هر ۱۰۰۰ دقیقه) تعیین شده است.
‏* نسخه آفلاین: هزینه تبدیل گفتار به متن در حالت غیر‌استریمینگ (non-streaming) معادل ۰.۱۰ دلار برای هر ساعت است.

‏این مدل در بخش First Partial Transcript نیز دقت مشابه ۲.۵ درصد را در زمان ۰.۱۲ ثانیه ثبت کرده است. جزئیات بیشتر و مقایسه با سایر مدل‌ها در وب‌سایت Artificial Analysis در دسترس است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#MAI_Transcribe_2_Streaming #WER