Forwarded from شانزدهمین کارآموزی همراه اول
📢 آغاز ثبتنام شانزدهمین دوره کارآموزی همراه اول
مسیر شغلی خود را با تجربه در معتبرترین شرکتهای حوزه ICT بسازید.
🎯 کارآموزی همراه اول یک دوره ۴ ماهه، با هدف افزایش #تجربه و #مهارت #دانشجویان و #فارغالتحصیلان جویای کار است.
💎 مزایای دوره کارآموزی:
💼 فرصت #استخدام در گروه همراه اول
💰 پرداخت #حقوق + #بیمه در طول دوره کارآموزی
🏅 کسب تجربه در معتبرترین شرکتهای حوزه ICT
✅ انتخاب از بین ۱۲۰+ موقعیت شغلی متنوع (امکان ارسال درخواست در۳ موقعیت شغلی)
🌐 برای «ثبتنام رایگان» و مشاهده موقعیتهای کارآموزی روی لینک زیر بزنید:
🔗 https://l.hamrah.academy/8c1
⭐ @hamrah_academy | آکادمی همراه اول
مسیر شغلی خود را با تجربه در معتبرترین شرکتهای حوزه ICT بسازید.
🎯 کارآموزی همراه اول یک دوره ۴ ماهه، با هدف افزایش #تجربه و #مهارت #دانشجویان و #فارغالتحصیلان جویای کار است.
💎 مزایای دوره کارآموزی:
💼 فرصت #استخدام در گروه همراه اول
💰 پرداخت #حقوق + #بیمه در طول دوره کارآموزی
🏅 کسب تجربه در معتبرترین شرکتهای حوزه ICT
✅ انتخاب از بین ۱۲۰+ موقعیت شغلی متنوع (امکان ارسال درخواست در۳ موقعیت شغلی)
🗓️ مهلت ثبتنام: تا ۱۴ شهریور ماه ۱۴۰۵
⚠️ ظرفیت محدود (پیش از تکمیل موقعیتها ثبتنام کنید!)
🌐 برای «ثبتنام رایگان» و مشاهده موقعیتهای کارآموزی روی لینک زیر بزنید:
🔗 https://l.hamrah.academy/8c1
⭐ @hamrah_academy | آکادمی همراه اول
⚖️ پرونده قضایی جدی علیه OpenAI
دادستان کل ایالت آلاباما تحقیقات رسمی و گستردهای را علیه OpenAI و سم آلتمن آغاز کرده است. این اقدام قانونی پس از آن صورت میگیرد که ادعا شده است انتشار یک مدل هوش مصنوعی آزمایشی بدون نظارتهای کافی، منجر به نفوذ به شبکههای کامپیوتری و هک شرکت Hugging Face در ماه ژوئیه شده است.
مهمترین محورهای این پرونده:
* صدور احضاریه برای دریافت تمامی اسناد و دادههای مرتبط با حادثه هک، شامل اطلاعات کارکنان دخیل و جزئیات امنیتی تست مدلها.
* بررسی احتمال نقض قانون «عملکرد تجاری فریبکارانه» در ایالت آلاباما.
* تحقیق درباره نبود تدابیر حفاظتی کافی در محصولات هوش مصنوعی و عدم نظارت منطقی بر مدلهای در حال توسعه.
دادستانی به دنبال مشخص کردن این موضوع است که آیا ناتوانی OpenAI در تضمین امنیت محصولاتش، سلامت و حقوق شهروندان را با خطر جدی مواجه کرده است یا خیر. در صورت اثبات اتهامات، ممکن است محدودیتهای قانونی شدیدی برای فعالیتهای این شرکت در ایالت مذکور اعمال شود.
📚 مطالعه با جزئیات بیشتر
#OpenAI #HuggingFace
دادستان کل ایالت آلاباما تحقیقات رسمی و گستردهای را علیه OpenAI و سم آلتمن آغاز کرده است. این اقدام قانونی پس از آن صورت میگیرد که ادعا شده است انتشار یک مدل هوش مصنوعی آزمایشی بدون نظارتهای کافی، منجر به نفوذ به شبکههای کامپیوتری و هک شرکت Hugging Face در ماه ژوئیه شده است.
مهمترین محورهای این پرونده:
* صدور احضاریه برای دریافت تمامی اسناد و دادههای مرتبط با حادثه هک، شامل اطلاعات کارکنان دخیل و جزئیات امنیتی تست مدلها.
* بررسی احتمال نقض قانون «عملکرد تجاری فریبکارانه» در ایالت آلاباما.
* تحقیق درباره نبود تدابیر حفاظتی کافی در محصولات هوش مصنوعی و عدم نظارت منطقی بر مدلهای در حال توسعه.
دادستانی به دنبال مشخص کردن این موضوع است که آیا ناتوانی OpenAI در تضمین امنیت محصولاتش، سلامت و حقوق شهروندان را با خطر جدی مواجه کرده است یا خیر. در صورت اثبات اتهامات، ممکن است محدودیتهای قانونی شدیدی برای فعالیتهای این شرکت در ایالت مذکور اعمال شود.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#OpenAI #HuggingFace
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 بهینهسازی مصرف توکن در ایجنتهای LLM
آیا میدانستید دو ایجنت با مدل یکسان ممکن است عملکرد مشابهی داشته باشند اما یکی تا سه برابر بیشتر توکن مصرف کند؟ تفاوت در «مهندسی هارنس» (Harness Engineering) است؛ یعنی کدهایی که مدیریت میکنند چه چیزی و چه زمانی وارد Context مدل شود.
به جای بارگذاری همیشگی تمام ابزارها و دادههای حجیم در پرامپت، یک هارنس بهینه از استراتژیهای زیر استفاده میکند:
- حافظه (Memory): نگهداری وضعیت خارج از وزنها و Context اصلی.
- مهارتها (Skills): دانش رویهای که مدلهای عمومی را تخصصی میکند.
- پروتکلها (Protocols): قراردادهای تعاملی برای کاربران و سایر ایجنتها.
برای مدیریت دادههای سنگین، هارنسهایی مثل TrueForge به جای بارگذاری مستقیم، فایلها را در فضای سندباکس ذخیره کرده و تنها پیشنمایش یا مسیر فایل را به مدل میدهند. این ابزار متنباز نشان داده که میتواند با مصرف تنها یکسوم توکنهای معمول و ۴۰ درصد فراخوانی ابزار کمتر، وظایف مشابه ایجنتهای مدیریتشده را انجام دهد.
📚 مطالعه با جزئیات بیشتر
آیا میدانستید دو ایجنت با مدل یکسان ممکن است عملکرد مشابهی داشته باشند اما یکی تا سه برابر بیشتر توکن مصرف کند؟ تفاوت در «مهندسی هارنس» (Harness Engineering) است؛ یعنی کدهایی که مدیریت میکنند چه چیزی و چه زمانی وارد Context مدل شود.
به جای بارگذاری همیشگی تمام ابزارها و دادههای حجیم در پرامپت، یک هارنس بهینه از استراتژیهای زیر استفاده میکند:
- حافظه (Memory): نگهداری وضعیت خارج از وزنها و Context اصلی.
- مهارتها (Skills): دانش رویهای که مدلهای عمومی را تخصصی میکند.
- پروتکلها (Protocols): قراردادهای تعاملی برای کاربران و سایر ایجنتها.
برای مدیریت دادههای سنگین، هارنسهایی مثل TrueForge به جای بارگذاری مستقیم، فایلها را در فضای سندباکس ذخیره کرده و تنها پیشنمایش یا مسیر فایل را به مدل میدهند. این ابزار متنباز نشان داده که میتواند با مصرف تنها یکسوم توکنهای معمول و ۴۰ درصد فراخوانی ابزار کمتر، وظایف مشابه ایجنتهای مدیریتشده را انجام دهد.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🚀 عرضه نسل جدید مدلهای GigaEmbeddings
تیم توسعهدهنده GigaEmbeddings از انتشار نسل جدید مدلهای خود در سه سایز مختلف (480M، 3B و 10B) خبر داد. این مدلها برای تبدیل متون به بردارهای عددی جهت استفاده در جستجوی معنایی، سیستمهای RAG، کلاسبندی و خوشهبندی طراحی شدهاند.
بهینهسازیهای انجام شده باعث شده تا مدلهای 3B و 10B نسبت به نسخههای قبلی تا ۲ برابر سریعتر در vLLM عمل کنند. در بخش ارزیابی، مدل 10B-A1.8B موفق به کسب رتبه اول در بنچمارک ruMTEB شده است.
مهمترین مدلهای منتشر شده برای دسترسی روی HuggingFace:
- مدل 480M (بهترین در رده خود)
- مدل 3B (افزایش ۱۴.۵ واحدی کیفیت کد)
- مدل 10B-A1.8B
این مدلها تحت لایسنس MIT برای توسعهدهندگان و استفادههای تجاری بهصورت رایگان در دسترس قرار گرفتهاند.
📚 مطالعه با جزئیات بیشتر
#GigaEmbeddings #ruMTEB
تیم توسعهدهنده GigaEmbeddings از انتشار نسل جدید مدلهای خود در سه سایز مختلف (480M، 3B و 10B) خبر داد. این مدلها برای تبدیل متون به بردارهای عددی جهت استفاده در جستجوی معنایی، سیستمهای RAG، کلاسبندی و خوشهبندی طراحی شدهاند.
بهینهسازیهای انجام شده باعث شده تا مدلهای 3B و 10B نسبت به نسخههای قبلی تا ۲ برابر سریعتر در vLLM عمل کنند. در بخش ارزیابی، مدل 10B-A1.8B موفق به کسب رتبه اول در بنچمارک ruMTEB شده است.
مهمترین مدلهای منتشر شده برای دسترسی روی HuggingFace:
- مدل 480M (بهترین در رده خود)
- مدل 3B (افزایش ۱۴.۵ واحدی کیفیت کد)
- مدل 10B-A1.8B
این مدلها تحت لایسنس MIT برای توسعهدهندگان و استفادههای تجاری بهصورت رایگان در دسترس قرار گرفتهاند.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#GigaEmbeddings #ruMTEB
🚀 جهش خیرهکننده مدلهای محلی با Qwen 27B
مدلهای هوش مصنوعی محلی (Local AI) با سرعتی باورنکردنی در حال نزدیک شدن به غولهای ابری هستند. مدل جدید Qwen 27B از شرکت علیبابا، بهتازگی در لیدربرد Arena WebDev خوش درخشیده و توانسته در جمع ۱۰ مدل برتر دنیا قرار بگیرد.
نکته تحسینبرانگیز این است که این مدل با ۲۷ میلیارد پارامتر، به عملکردی دست یافته که پیشتر تنها در مدلهای بسیار بزرگتر و با زیرساختهای ابری گرانقیمت ممکن بود. این دستاورد نشان میدهد که مدلهای متنباز (Open-source) اکنون قدرت رقابت با پیشروترین مدلهای بازار را روی سختافزارهای شخصی دارند.
مهمترین مدلهای حاضر در این لیست رقابتی عبارتند از:
- Claude Opus 5 (Max)
- Kimi K3 (Max)
- Qwen-3.8 Max
- Claude Opus 5 (High)
- Qwen-3.8 27B
با امتیاز ۱۵۹۵، مدل ۲۷ میلیاردی Qwen نه تنها از نظر هزینه بسیار بهصرفهتر است، بلکه بهرهوری خیرهکنندهای را در برنامهنویسی و توسعه وب ارائه میدهد. اکنون مرز میان مدلهای قدرتمند و قابل اجرا روی سیستم شخصی، بیش از همیشه کمرنگ شده است.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science
مدلهای هوش مصنوعی محلی (Local AI) با سرعتی باورنکردنی در حال نزدیک شدن به غولهای ابری هستند. مدل جدید Qwen 27B از شرکت علیبابا، بهتازگی در لیدربرد Arena WebDev خوش درخشیده و توانسته در جمع ۱۰ مدل برتر دنیا قرار بگیرد.
نکته تحسینبرانگیز این است که این مدل با ۲۷ میلیارد پارامتر، به عملکردی دست یافته که پیشتر تنها در مدلهای بسیار بزرگتر و با زیرساختهای ابری گرانقیمت ممکن بود. این دستاورد نشان میدهد که مدلهای متنباز (Open-source) اکنون قدرت رقابت با پیشروترین مدلهای بازار را روی سختافزارهای شخصی دارند.
مهمترین مدلهای حاضر در این لیست رقابتی عبارتند از:
- Claude Opus 5 (Max)
- Kimi K3 (Max)
- Qwen-3.8 Max
- Claude Opus 5 (High)
- Qwen-3.8 27B
با امتیاز ۱۵۹۵، مدل ۲۷ میلیاردی Qwen نه تنها از نظر هزینه بسیار بهصرفهتر است، بلکه بهرهوری خیرهکنندهای را در برنامهنویسی و توسعه وب ارائه میدهد. اکنون مرز میان مدلهای قدرتمند و قابل اجرا روی سیستم شخصی، بیش از همیشه کمرنگ شده است.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science
🌐 نقشهبرداری هوشمند ساختار پروژههای نرمافزاری
در پروژههای نرمافزاری بزرگ، درک معماری و روابط بین مؤلفهها اغلب چالشبرانگیز است و بررسی تکتک فایلها زمانبر خواهد بود. ابزار Understand-Anything با تحلیل خودکار کل پروژه، این فرایند را بهینه میکند.
این ابزار با بهرهگیری از هوش مصنوعی، نقشهای بصری و قابلجستوجو از ساختار پروژه ارائه میدهد که شامل موارد زیر است:
- شناسایی دقیق توابع و کلاسهای تعریفشده
- ترسیم روابط و وابستگیهای بین فایلها
- امکان جستوجوی ساختاریافته در کل فضای پروژه
استفاده از این ابزار به توسعهدهندگان کمک میکند تا در بدو ورود به پروژههای پیچیده یا میراثی، با صرف کمترین زمان به درک صحیحی از معماری و منطق حاکم بر کد دست یابند. این رویکرد، سرعت مستندسازی و عیبیابی را به شکل چشمگیری افزایش میدهد.
📚 مطالعه با جزئیات بیشتر
#Understand_Anything #Dependency_Mapping
در پروژههای نرمافزاری بزرگ، درک معماری و روابط بین مؤلفهها اغلب چالشبرانگیز است و بررسی تکتک فایلها زمانبر خواهد بود. ابزار Understand-Anything با تحلیل خودکار کل پروژه، این فرایند را بهینه میکند.
این ابزار با بهرهگیری از هوش مصنوعی، نقشهای بصری و قابلجستوجو از ساختار پروژه ارائه میدهد که شامل موارد زیر است:
- شناسایی دقیق توابع و کلاسهای تعریفشده
- ترسیم روابط و وابستگیهای بین فایلها
- امکان جستوجوی ساختاریافته در کل فضای پروژه
استفاده از این ابزار به توسعهدهندگان کمک میکند تا در بدو ورود به پروژههای پیچیده یا میراثی، با صرف کمترین زمان به درک صحیحی از معماری و منطق حاکم بر کد دست یابند. این رویکرد، سرعت مستندسازی و عیبیابی را به شکل چشمگیری افزایش میدهد.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Understand_Anything #Dependency_Mapping
🧠 مدلهای زبانی چگونه سطح دانش شما را میسنجند؟
تحقیقات جدید نشان میدهد مدلهای زبانی پیش از پاسخدهی، ابتدا سطح تخصص کاربر را ارزیابی میکنند. این ارزیابی درونی نه تنها تعیینکننده میزان جزئیات پاسخ است، بلکه تمایل مدل برای تعامل با کاربر را نیز تحت تأثیر قرار میدهد.
پژوهشگران دریافتهاند که مدلها از یک چارچوب واحد برای سنجش صلاحیت کاربران استفاده میکنند که بهطور مستقیم پیچیدگی اطلاعات ارائهشده را شکل میدهد.
مهمترین یافتههای این مطالعه:
* مدلها با تحلیل دادههای ورودی، یک تخمین محاسباتی از تخصص کاربر ایجاد میکنند.
* این ارزیابی مستقیماً بر رفتار مدل و نحوه ارائه پاسخ تأثیر میگذارد.
* اگرچه الگوهای جمعیتی خاصی با این تخمین گره خوردهاند، اما لزوماً منجر به خروجیهای تبعیضآمیز نمیشوند.
این مقاله با عنوان Who Do Language Models Think Is Competent? به واکاوی سوگیریهای شغلی در تعاملات هوش مصنوعی میپردازد.
📚 مطالعه با جزئیات بیشتر
#OccupationalBias #LanguageModels
تحقیقات جدید نشان میدهد مدلهای زبانی پیش از پاسخدهی، ابتدا سطح تخصص کاربر را ارزیابی میکنند. این ارزیابی درونی نه تنها تعیینکننده میزان جزئیات پاسخ است، بلکه تمایل مدل برای تعامل با کاربر را نیز تحت تأثیر قرار میدهد.
پژوهشگران دریافتهاند که مدلها از یک چارچوب واحد برای سنجش صلاحیت کاربران استفاده میکنند که بهطور مستقیم پیچیدگی اطلاعات ارائهشده را شکل میدهد.
مهمترین یافتههای این مطالعه:
* مدلها با تحلیل دادههای ورودی، یک تخمین محاسباتی از تخصص کاربر ایجاد میکنند.
* این ارزیابی مستقیماً بر رفتار مدل و نحوه ارائه پاسخ تأثیر میگذارد.
* اگرچه الگوهای جمعیتی خاصی با این تخمین گره خوردهاند، اما لزوماً منجر به خروجیهای تبعیضآمیز نمیشوند.
این مقاله با عنوان Who Do Language Models Think Is Competent? به واکاوی سوگیریهای شغلی در تعاملات هوش مصنوعی میپردازد.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#OccupationalBias #LanguageModels
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 صدرنشینی خیرهکننده مدل جدید مایکروسافت
مایکروسافت با معرفی مدل MAI-Image-2.6-Preview، بار دیگر استانداردهای تولید و ویرایش تصویر را جابهجا کرد. این مدل در جدیدترین ارزیابیهای Artificial Analysis توانست جایگاه نخست را در بخش ویرایش تصویر (Image Editing) تصاحب کند و در حوزه تبدیل متن به تصویر (Text to Image) نیز به رتبه دوم دست یابد.
این مدل با تمرکز بر بهبود رندر متن، جزئیات چهره و تصاویر سهبعدی، توانسته است رقبای قدرتمندی مانند محصولات OpenAI و نسخههای پیشین خود را پشت سر بگذارد. مهمترین برتریهای این نسخه در دستهبندیهای تخصصی عبارتند از:
* کیفیت متریال و بافتها
* دقت در بازنمایی دانش بصری
* کاربردهای حوزه بازاریابی و تجارت الکترونیک
مدل جدید در حال حاضر از طریق MAI Playground و در بخش Private Preview پلتفرم Foundry قابل دسترسی است. مایکروسافت با این سرعت عمل، رقابت در دنیای مدلهای مولد تصویر را بیش از پیش داغ کرده است.
📚 مطالعه با جزئیات بیشتر
#MAI_Image_2 #Image_Editing
مایکروسافت با معرفی مدل MAI-Image-2.6-Preview، بار دیگر استانداردهای تولید و ویرایش تصویر را جابهجا کرد. این مدل در جدیدترین ارزیابیهای Artificial Analysis توانست جایگاه نخست را در بخش ویرایش تصویر (Image Editing) تصاحب کند و در حوزه تبدیل متن به تصویر (Text to Image) نیز به رتبه دوم دست یابد.
این مدل با تمرکز بر بهبود رندر متن، جزئیات چهره و تصاویر سهبعدی، توانسته است رقبای قدرتمندی مانند محصولات OpenAI و نسخههای پیشین خود را پشت سر بگذارد. مهمترین برتریهای این نسخه در دستهبندیهای تخصصی عبارتند از:
* کیفیت متریال و بافتها
* دقت در بازنمایی دانش بصری
* کاربردهای حوزه بازاریابی و تجارت الکترونیک
مدل جدید در حال حاضر از طریق MAI Playground و در بخش Private Preview پلتفرم Foundry قابل دسترسی است. مایکروسافت با این سرعت عمل، رقابت در دنیای مدلهای مولد تصویر را بیش از پیش داغ کرده است.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#MAI_Image_2 #Image_Editing
🚀 جهش بزرگ OpenAI با تراشه اختصاصی Jalapeño
شرکت OpenAI با معرفی تراشه اختصاصی خود با نام Jalapeño، استانداردهای جدیدی را در صنعت سختافزار هوش مصنوعی تعریف کرده است. بر اساس نتایج اولیه، این تراشه در بارهای کاری تعاملی، نه تنها از نظر سرعت، بلکه از نظر بهرهوری انرژی (Efficiency) بهطور معناداری از محصولات انویدیا مانند GB200 و GB300 پیشی میگیرد.
برخی از مهمترین نکات فنی این گزارش عبارتند از:
• بهرهوری انرژی خیرهکننده: در مدل GPT-OSS، این تراشه در سطوح بالای تولید توکن (535 tok/s/user)، تا ۵۳ برابر کارایی بیشتری نسبت به GB200 نشان میدهد.
• عملکرد در مدل DeepSeek R1: در سناریوهای عملیاتی، Jalapeño تا ۱۰۴ برابر خروجی توکن بیشتری به ازای هر وات مصرف انرژی ارائه میدهد.
• کاهش تأخیر: در مدلهای سنگین مانند Kimi K2.5، تأخیر پردازش تا ۲.۲ برابر کمتر از نسلهای مشابه انویدیا است.
• توان حرارتی (TDP): با وجود قدرت بسیار بالاتر، این تراشه تنها با توان ۷۰۰ وات فعالیت میکند که نشاندهنده بهینهسازی گسترده در سطح معماری است.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science
شرکت OpenAI با معرفی تراشه اختصاصی خود با نام Jalapeño، استانداردهای جدیدی را در صنعت سختافزار هوش مصنوعی تعریف کرده است. بر اساس نتایج اولیه، این تراشه در بارهای کاری تعاملی، نه تنها از نظر سرعت، بلکه از نظر بهرهوری انرژی (Efficiency) بهطور معناداری از محصولات انویدیا مانند GB200 و GB300 پیشی میگیرد.
برخی از مهمترین نکات فنی این گزارش عبارتند از:
• بهرهوری انرژی خیرهکننده: در مدل GPT-OSS، این تراشه در سطوح بالای تولید توکن (535 tok/s/user)، تا ۵۳ برابر کارایی بیشتری نسبت به GB200 نشان میدهد.
• عملکرد در مدل DeepSeek R1: در سناریوهای عملیاتی، Jalapeño تا ۱۰۴ برابر خروجی توکن بیشتری به ازای هر وات مصرف انرژی ارائه میدهد.
• کاهش تأخیر: در مدلهای سنگین مانند Kimi K2.5، تأخیر پردازش تا ۲.۲ برابر کمتر از نسلهای مشابه انویدیا است.
• توان حرارتی (TDP): با وجود قدرت بسیار بالاتر، این تراشه تنها با توان ۷۰۰ وات فعالیت میکند که نشاندهنده بهینهسازی گسترده در سطح معماری است.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science
🧠 پیادهسازی گامبهگام مفاهیم عمیق یادگیری ماشین
اگر میخواهید بدانید مدلهای بزرگ هوش مصنوعی در پشت صحنه چطور کار میکنند، مخزن Beyond-NanoGPT یک پل ارتباطی عالی بین کدهای ساده و سیستمهای پیچیده است. این پروژه توسط یکی از دانشجویان دانشگاه استنفورد توسعه یافته و شامل پیادهسازیهای دقیق و خطبهخط مفاهیم مدرن دیپ لرنینگ در PyTorch است.
مهمترین پیادهسازیهای موجود در این مخزن:
• معماریهای پیشرفته مانند Vision Transformer و Diffusion Transformer
• انواع مکانیزمهای توجه از جمله Grouped-Query و cross-attention
• روشهای بهینهسازی سرعت LLM مانند KV-caching و speculative decoding
• الگوریتمهای یادگیری تقویتی کاربردی نظیر DQN و PPO
این پروژه بدون نیاز به کلاسترهای گرانقیمت، روی یک GPU معمولی قابل اجراست و راهنمایی عالی برای درک عمیق مقالات علمی است.
📚 مطالعه با جزئیات بیشتر
#Beyond_NanoGPT #PyTorch
اگر میخواهید بدانید مدلهای بزرگ هوش مصنوعی در پشت صحنه چطور کار میکنند، مخزن Beyond-NanoGPT یک پل ارتباطی عالی بین کدهای ساده و سیستمهای پیچیده است. این پروژه توسط یکی از دانشجویان دانشگاه استنفورد توسعه یافته و شامل پیادهسازیهای دقیق و خطبهخط مفاهیم مدرن دیپ لرنینگ در PyTorch است.
مهمترین پیادهسازیهای موجود در این مخزن:
• معماریهای پیشرفته مانند Vision Transformer و Diffusion Transformer
• انواع مکانیزمهای توجه از جمله Grouped-Query و cross-attention
• روشهای بهینهسازی سرعت LLM مانند KV-caching و speculative decoding
• الگوریتمهای یادگیری تقویتی کاربردی نظیر DQN و PPO
این پروژه بدون نیاز به کلاسترهای گرانقیمت، روی یک GPU معمولی قابل اجراست و راهنمایی عالی برای درک عمیق مقالات علمی است.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Beyond_NanoGPT #PyTorch
🤖 عامل هوش مصنوعی Hatch؛ گام بزرگ متا در اتوماسیون
شرکت متا خود را برای معرفی دو ابزار جدید آماده میکند. بر اساس گزارشهای تازه، این کمپانی قصد دارد طی هفتههای آینده عامل هوش مصنوعی کاربرمحور خود به نام Hatch را روانه بازار کند. در ادامه این مسیر نیز در ماه اکتبر، از مدل هوش مصنوعی بعدی خود با نام Watermelon رونمایی خواهد کرد.
پروژه Hatch که گفته میشود از OpenClaw الهام گرفته شده است، احتمالاً یک اشتراک ویژه با هزینه ۱۹۹.۹۹ دلار در ماه خواهد داشت. این عامل هوشمند به کاربران اجازه میدهد تا فعالیتهای خود را در پلتفرمهایی مانند DoorDash، Etsy، Reddit، Yelp و Outlook به صورت خودکار مدیریت کنند و از یک داشبورد قابل شخصیسازی بهرهمند شوند.
📚 مطالعه با جزئیات بیشتر
#Hatch #Watermelon
شرکت متا خود را برای معرفی دو ابزار جدید آماده میکند. بر اساس گزارشهای تازه، این کمپانی قصد دارد طی هفتههای آینده عامل هوش مصنوعی کاربرمحور خود به نام Hatch را روانه بازار کند. در ادامه این مسیر نیز در ماه اکتبر، از مدل هوش مصنوعی بعدی خود با نام Watermelon رونمایی خواهد کرد.
پروژه Hatch که گفته میشود از OpenClaw الهام گرفته شده است، احتمالاً یک اشتراک ویژه با هزینه ۱۹۹.۹۹ دلار در ماه خواهد داشت. این عامل هوشمند به کاربران اجازه میدهد تا فعالیتهای خود را در پلتفرمهایی مانند DoorDash، Etsy، Reddit، Yelp و Outlook به صورت خودکار مدیریت کنند و از یک داشبورد قابل شخصیسازی بهرهمند شوند.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Hatch #Watermelon
🚀 بررسی سختافزارهای جدید اپل برای هوش مصنوعی
شرکت اپل نسل جدید تراشههای خود یعنی M6 و M5 را معرفی کرد که تغییرات قابلتوجهی در سرعت پردازش مدلهای هوش مصنوعی ایجاد کردهاند. این بهروزرسانیها به ویژه در سرعت Prompt processing تا ۴.۸ برابر نسبت به نسل قبل بهبود یافتهاند.
مهمترین مشخصات سختافزاری:
* تراشه M6: دارای ۱۲ هسته CPU و ۱۲ هسته GPU که با ۳۲ گیگابایت حافظه یکپارچه، اجرای مدلهای 7B تا 14B و مدلهای کوانتایز شده 27B-32B را به راحتی ممکن میکند.
* تراشه M5 Pro: با حداکثر ۱۸ هسته CPU و ۲۰ هسته GPU، گزینه مناسبی برای اجرای مدلهای 70B با کوانتایز 4-bit است که به حدود ۴۰ گیگابایت حافظه نیاز دارند.
* تراشه M5 Ultra: غول پردازشی اپل با پشتیبانی از ۵۱۲ گیگابایت حافظه یکپارچه که برای پردازش مدلهای سنگین MoE و کاربردهای حرفهای طراحی شده است.
مدلهای جدید Mac mini با این تراشهها، اکنون از اتصال همزمان به سه نمایشگر پشتیبانی میکنند و در کانفیگهای مختلف برای نیازهای متنوع یادگیری ماشین در دسترس هستند.
📚 مطالعه با جزئیات بیشتر
شرکت اپل نسل جدید تراشههای خود یعنی M6 و M5 را معرفی کرد که تغییرات قابلتوجهی در سرعت پردازش مدلهای هوش مصنوعی ایجاد کردهاند. این بهروزرسانیها به ویژه در سرعت Prompt processing تا ۴.۸ برابر نسبت به نسل قبل بهبود یافتهاند.
مهمترین مشخصات سختافزاری:
* تراشه M6: دارای ۱۲ هسته CPU و ۱۲ هسته GPU که با ۳۲ گیگابایت حافظه یکپارچه، اجرای مدلهای 7B تا 14B و مدلهای کوانتایز شده 27B-32B را به راحتی ممکن میکند.
* تراشه M5 Pro: با حداکثر ۱۸ هسته CPU و ۲۰ هسته GPU، گزینه مناسبی برای اجرای مدلهای 70B با کوانتایز 4-bit است که به حدود ۴۰ گیگابایت حافظه نیاز دارند.
* تراشه M5 Ultra: غول پردازشی اپل با پشتیبانی از ۵۱۲ گیگابایت حافظه یکپارچه که برای پردازش مدلهای سنگین MoE و کاربردهای حرفهای طراحی شده است.
مدلهای جدید Mac mini با این تراشهها، اکنون از اتصال همزمان به سه نمایشگر پشتیبانی میکنند و در کانفیگهای مختلف برای نیازهای متنوع یادگیری ماشین در دسترس هستند.
📚 مطالعه با جزئیات بیشتر
🛡 افزایش امنیت Codex در برابر حذف ناخواسته فایلها
تیم OpenAI پس از گزارشهایی مبنی بر حذف اشتباهی فایلهای کاربران توسط مدل
مهمترین اقدامات حفاظتی انجام شده:
• اصلاح دستورات مدل: مدل اکنون موظف به بررسی دقیق مسیرهای حذف و استفاده از فرآیندهای بازگشتپذیر است.
• اعتبارسنجی اجرایی: سیستمهای بازبینی خودکار برای شناسایی و مسدودسازی دستورات خطرناک تقویت شدهاند.
• محدودسازی دسترسی کامل: فعالسازی حالت
• آموزش مبتنی بر خطا: اضافه شدن سناریوهای آزمایشی جدید برای پیشگیری از تکرار این حوادث در فرآیند آموزش مدل.
به کاربران توصیه میشود ضمن بهروزرسانی
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science
تیم OpenAI پس از گزارشهایی مبنی بر حذف اشتباهی فایلهای کاربران توسط مدل
Codex، پروتکلهای امنیتی خود را بهروزرسانی کرد. این مشکل ناشی از خطای مدل در مدیریت متغیرهای محیطی و مسیرهای دسترسی بود که در موارد نادر باعث میشد دستورات پاکسازی به جای پوشههای موقت، به دایرکتوری اصلی کاربر اشاره کنند.مهمترین اقدامات حفاظتی انجام شده:
• اصلاح دستورات مدل: مدل اکنون موظف به بررسی دقیق مسیرهای حذف و استفاده از فرآیندهای بازگشتپذیر است.
• اعتبارسنجی اجرایی: سیستمهای بازبینی خودکار برای شناسایی و مسدودسازی دستورات خطرناک تقویت شدهاند.
• محدودسازی دسترسی کامل: فعالسازی حالت
Full access دشوارتر و هشدارهای امنیتی آن شفافتر شده است.• آموزش مبتنی بر خطا: اضافه شدن سناریوهای آزمایشی جدید برای پیشگیری از تکرار این حوادث در فرآیند آموزش مدل.
به کاربران توصیه میشود ضمن بهروزرسانی
Codex، از محیطهای ایزوله (Sandbox) استفاده کرده و دسترسیهای مدیریتی را تنها در صورت نیاز و اطمینان از سلامت محیط فعال کنند.📚 مطالعه با جزئیات بیشتر
📊 Data➕Science
This media is not supported in your browser
VIEW IN TELEGRAM
🎨 تبدیل تصاویر به استیکر با هوش مصنوعی
قابلیت جدید ChatGPT به شما اجازه میدهد از هر عکس یا ایده ذهنی، استیکرهای جذاب بسازید. در نسخه جدید ChatGPT Images 2.0، حالتی به نام Stickers اضافه شده که به کاربران امکان میدهد با انتخاب یکی از ۱۸ سبک مختلف (مانند 3D یا انیمه)، استیکرهایی با پسزمینه شفاف تولید کنند.
مهمترین ویژگیهای این قابلیت:
- تولید استیکر از طریق آپلود عکس یا توصیف متنی.
- امکان خروجی گرفتن برای پیامرسانهایی مثل iMessage و WhatsApp.
- دسترسی به قابلیت حذف پسزمینه برای تمامی تصاویر تولیدی.
این ابزار هماکنون در نسخه موبایل اپلیکیشن ChatGPT به صورت رایگان در دسترس کاربران سراسر جهان قرار گرفته است. تغییرات جدید نشاندهنده تمرکز بیشتر OpenAI بر ابزارهای کاربردی و خلاقانه برای استفادههای روزمره است.
#ChatGPT_Images #استیکر
قابلیت جدید ChatGPT به شما اجازه میدهد از هر عکس یا ایده ذهنی، استیکرهای جذاب بسازید. در نسخه جدید ChatGPT Images 2.0، حالتی به نام Stickers اضافه شده که به کاربران امکان میدهد با انتخاب یکی از ۱۸ سبک مختلف (مانند 3D یا انیمه)، استیکرهایی با پسزمینه شفاف تولید کنند.
مهمترین ویژگیهای این قابلیت:
- تولید استیکر از طریق آپلود عکس یا توصیف متنی.
- امکان خروجی گرفتن برای پیامرسانهایی مثل iMessage و WhatsApp.
- دسترسی به قابلیت حذف پسزمینه برای تمامی تصاویر تولیدی.
این ابزار هماکنون در نسخه موبایل اپلیکیشن ChatGPT به صورت رایگان در دسترس کاربران سراسر جهان قرار گرفته است. تغییرات جدید نشاندهنده تمرکز بیشتر OpenAI بر ابزارهای کاربردی و خلاقانه برای استفادههای روزمره است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#ChatGPT_Images #استیکر
راهنمای جامع دسترسی رایگان به مدلهای هوش مصنوعی در ۲۰۲۶
استفاده از سرویسهای هوش مصنوعی بدون هزینه، در سال ۲۰۲۶ بهشدت تغییر کرده است. بسیاری از لیستهای آنلاین قدیمی هستند و محدودیتهای جدیدی برای مدلها وضع شده است. در اینجا مهمترین نکات برای استفاده از منابع رایگان و نیمهرایگان آورده شده است:
* Google AI Studio: بهترین گزینه برای تست ایدهها و پروژههای چندوجهی. محدودیتهای دقیق آن در کنسول نمایش داده میشود و دادههای شما ممکن است برای بهبود مدلها استفاده شود.
* Groq: با سرعت بسیار بالا، انتخابی عالی برای ابزارهای شخصی و پروژههایی است که تأخیر کم در آنها اولویت دارد.
* Cerebras: با ارائه ۱ میلیون توکن در روز، برای پردازش کارهای سریع و دستهبندی عالی است، اما محدودیت 8192 توکنی در Context آن را برای کارهای سنگین محدود میکند.
* OpenRouter: پلتفرمی برای دسترسی به دهها مدل مختلف. با یک پرداخت جزئی (مثلاً ۱۰ دلار)، محدودیت روزانه شما به شکل چشمگیری افزایش مییابد.
* اجرای محلی (Local Models): تنها راهی که هیچ محدودیت نرخ (Rate Limit)، نظارت یا سانسور منطقهای ندارد.
📚 مطالعه با جزئیات بیشتر
استفاده از سرویسهای هوش مصنوعی بدون هزینه، در سال ۲۰۲۶ بهشدت تغییر کرده است. بسیاری از لیستهای آنلاین قدیمی هستند و محدودیتهای جدیدی برای مدلها وضع شده است. در اینجا مهمترین نکات برای استفاده از منابع رایگان و نیمهرایگان آورده شده است:
* Google AI Studio: بهترین گزینه برای تست ایدهها و پروژههای چندوجهی. محدودیتهای دقیق آن در کنسول نمایش داده میشود و دادههای شما ممکن است برای بهبود مدلها استفاده شود.
* Groq: با سرعت بسیار بالا، انتخابی عالی برای ابزارهای شخصی و پروژههایی است که تأخیر کم در آنها اولویت دارد.
* Cerebras: با ارائه ۱ میلیون توکن در روز، برای پردازش کارهای سریع و دستهبندی عالی است، اما محدودیت 8192 توکنی در Context آن را برای کارهای سنگین محدود میکند.
* OpenRouter: پلتفرمی برای دسترسی به دهها مدل مختلف. با یک پرداخت جزئی (مثلاً ۱۰ دلار)، محدودیت روزانه شما به شکل چشمگیری افزایش مییابد.
* اجرای محلی (Local Models): تنها راهی که هیچ محدودیت نرخ (Rate Limit)، نظارت یا سانسور منطقهای ندارد.
📚 مطالعه با جزئیات بیشتر