هوش مصنوعی و علم داده به فارسی
6.07K subscribers
1.48K photos
394 videos
342 files
1.65K links
🗨 ارتباط با ما (تبلیغات، سوال، پیشنهاد و انتقاد):
📩 @Contact2Mebot

💯 کانال دوم ما:
@Datascientists_Files

💎 در پیام‌رسان بله(آپدیت اتومات):
https://ble.ir/dataplusscience

💡 در پیام‌رسان ایتا(آپدیت اتومات):
https://eitaa.com/DataPlusScience
Download Telegram
🧩 معماری ۹ لایه سیستم‌های RAG در سال ۲۰۲۶

‏ برای ساخت اپلیکیشن‌های هوش مصنوعی که واقعاً در محیط عملیاتی کار می‌کنند، اتکا به روش‌های ساده مانند اتصال مدل به یک دیتابیس برداری کافی نیست. تسلط بر ۹ لایه اصلی در استک فنی RAG برای جلوگیری از شکست سیستم در شرایط واقعی ضروری است.

🧠 ‏ این لایه‌ها شامل موارد زیر هستند
‏لایه ۰ (استقرار) برای مدیریت تاخیر و هزینه، لایه ۱ (ارزیابی) جهت شناسایی پاسخ‌های نادرست پیش از عرضه، لایه ۲ (LLMs) به‌عنوان هسته هوشمند، و لایه ۳ (فریم‌ورک) برای مسیریابی کوئری‌ها. در سطوح بعدی، لایه ۴ (VectorDB) مقیاس‌پذیری بازیابی، لایه ۵ (Embedding) تبدیل داده به اعداد ریاضی، و لایه ۶ (استخراج داده) کیفیت ورودی را تضمین می‌کنند.

🚀 ‏ در نهایت، لایه ۷ (حافظه) تعاملات بین جلسات را حفظ کرده و لایه ۸ (Alignment) با استفاده از Guardrails و سیستم‌های رهگیری، از خروجی‌های نامطلوب پیشگیری می‌کند.

🔗lnkd.in

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#RAG_Tech_Stack #Agentic_Layers
🤖 ظهور رقیب اقتصادی با مدل DeepSeek V4 Flash 0731

‏در حالی که غول‌های تکنولوژی برای دسترسی به مدل‌های پیشرفته مبالغ سنگینی دریافت می‌کنند، شرکت چینی دیپ‌سیک با عرضه DeepSeek V4 Flash 0731 استراتژی بازار را تغییر داده است. این مدل جدید در پلتفرم Artificial Analysis امتیاز ۵۰ را کسب کرده که تنها یک واحد با مدل‌های رده‌بالای بازار فاصله دارد.

‏ عملکرد فنی این مدل با ۲۸۴ میلیارد پارامتر و بهره‌گیری از معماری MoE (مدل متشکل از متخصصان هوشمند) همراه است که تنها ۱۳ میلیارد پارامتر را در هر لحظه فعال می‌کند. این طراحی بهینه‌شده باعث شده تا مدل در مقایسه با نسخه قبلی، حدود ۱۲ درصد توکن کمتری برای خروجی‌های مشابه مصرف کند.

📊 ‏ قیمت‌گذاری این مدل بسیار رقابتی است؛ هزینه هر میلیون توکن ورودی تنها ۰.۱۴ دلار و خروجی ۰.۲۸ دلار تعیین شده است. با استفاده از قابلیت کش، این هزینه به ۰.۰۰۲۸ دلار کاهش می‌یابد که نسبت به سرویس‌های مشابه غربی، تا ۶۰ درصد صرفه‌جویی در پروژه‌های API به همراه دارد.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_V4_Flash #Terminal_Bench
🔬 تفاوت ایده‌پردازی LLMها با محققان انسانی

🧠 ‏ مطالعه جدید دانشگاه‌های Yale و Chicago نشان می‌دهد که تفاوت اصلی مدل‌های زبانی بزرگ (LLM) با پژوهشگران انسانی در «دامنه» ایده‌های تولیدی است، نه کیفیت آن‌ها. محققان با تحلیل ۱۱۶۸۳ مقاله علمی و استفاده از دانش پیشین مشابه، مسیر ایده‌پردازی هوش مصنوعی و انسان‌ها را مقایسه کردند.

📊 ‏ نتایج نشان داد ایده‌های انسانی تنوع گسترده‌ای دارند که شامل تبیین مکانیزم‌ها، انجام تست‌های شکست و توسعه سیستم‌های جدید می‌شود. در مقابل، مدل‌های زبانی تمایل شدیدی به اتصال قطعات جداگانه از تحقیقات پیشین دارند و دامنه خلاقیت آن‌ها در مقایسه با انسان، محدودتر است.

‏ آمارها حاکی از آن است که در حالی که تنها ۱۲.۱٪ از ایده‌های انسانی بر پیوند دادن تحقیقات گذشته متمرکز بود، این رویکرد در ایده‌های تولید شده توسط مدل‌ها بین ۴۷.۱٪ تا ۶۴.۲٪ از مواقع مشاهده شد.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#LLM #ایده
Media is too big
VIEW IN TELEGRAM
تولید دنیای سه‌بعدی با Claude 3.5 Opus

‏آندری کارپاتی (Andrej Karpathy) اخیراً با استفاده از مدل Claude 3.5 Opus، پاراگرافی از کتاب «ارباب حلقه‌ها» را به یک محیط تعاملی سه‌بعدی تبدیل کرده است. او با اختصاص بودجه‌ای معادل ۱۰ دلار (حدود ۱ میلیون توکن) به مدل، از آن خواست تا با استفاده از کتابخانه Three.js، صحنه‌ای دقیق از داستان را به صورت کدهای اجرایی پیاده‌سازی کند.

🚀 ‏ نتیجه این آزمایش، تولید ۵۵۰۰ خط کد شامل تولید رویه‌ای (Procedural Generation) اشیاء، جانمایی دقیق مختصات مدل‌ها و انیمیشن‌سازی رویدادها بود. اگرچه خروجی در برخی بخش‌ها دارای نقص‌های بصری جزئی است، اما این دستاورد ثابت می‌کند که چگونه می‌توان در عرض تنها دو ساعت، یک پروتوتایپ کاربردی از یک دنیای سه‌بعدی پیچیده را تنها با تکیه بر توصیفات متنی و بدون صرف روزها زمان، خلق کرد.

🧠 ‏ بزرگترین چالش فعلی برای این مدل‌ها، فرآیند ارزیابی و اصلاح نتایج است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Claude_3_5_Opus #Three_js
📊 شکاف جهانی در پذیرش هوش مصنوعی

‏ اگر با ایجنت‌های هوش مصنوعی کار می‌کنید، شما در میان تنها ۰.۱۴٪ از جمعیت جهان قرار دارید. طبق برآوردهای آماری ژوئیه ۲۰۲۶، حدود ۷۱٪ از جمعیت فعال دنیا، معادل ۵.۹ میلیارد نفر، هنوز حتی یک‌بار هم از ابزارهای هوش مصنوعی مولد (تولید محتوا و کد) استفاده نکرده‌اند.

🧠 ‏ در حالی که ما در حباب تکنولوژی غرق هستیم، این فناوری برای اکثریت مطلق مردم دنیا هنوز ابزاری ناشناخته است. داده‌ها نشان می‌دهد که تنها ۲۸٪ از افراد، یعنی حدود ۲.۳ میلیارد نفر، تجربه استفاده از چت‌بات‌های رایگان هوش مصنوعی را داشته‌اند.

🚀 ‏ وضعیت اشتراک‌های پولی بسیار محدودتر است و تنها ۱٪ از جمعیت جهان (حدود ۸۰ میلیون نفر) برای خدمات پیشرفته هزینه پرداخت می‌کنند. در رأس این هرم، کاربران ایجنت‌های برنامه‌نویسی قرار دارند که تعداد آن‌ها تنها ۱۲ میلیون نفر برآورد می‌شود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#ایجنت_برنامه #هوش_مصنوعی_مولد
رونمایی از مدل Grok Voice Think Fast 2.0

🚀 ‏ شرکت xAI نسل جدید مدل صوتی خود یعنی Grok Voice Think Fast 2.0 را منتشر کرد. بر اساس بنچمارک Artificial Analysis، این مدل با کسب امتیاز ۸۲.۹٪، عملکردی فراتر از GPT-Realtime-2.1 با ۷۹.۱٪ و Gemini 3.1 Flash با ۶۹.۵٪ داشته است؛ هرچند در رتبه دوم پس از Qwen Audio 3.0 قرار می‌گیرد.

⏱️ بهبود سرعت در این نسخه چشمگیر است، به‌طوری که تأخیر تولید اولین صدا به ۰.۷ ثانیه کاهش یافته که نسبت به ۱.۲۵ ثانیه در نسخه قبلی، جهشی قابل‌توجه است. دقت تشخیص گفتار نیز ۱.۴ برابر افزایش یافته و در ۲۴ زبان، مدل تا ۲ برابر دقیق‌تر از Deepgram Nova 3 یا ElevenLabs Scribe v2 عمل می‌کند.

🔊 ‏ نکته کلیدی، افزایش خیره‌کننده پایداری در محیط‌های پرسروصداست که دقت مدل را تا ۱۰ برابر نسبت به رقبا بهبود می‌بخشد. همچنین این مدل با قابلیت استدلال موازی در حین گفتار، ۶۰٪ توکن کمتری مصرف کرده و ابزارها را پیش از پایان جمله فراخوانی می‌کند.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Grok_Voice_Think_Fast #Artificial_Analysis
🧠 کشف «بردار آگاهی» در مدل‌های زبانی توسط گوگل

‏محققان گوگل در مطالعه‌ای جدید به یافته‌ای خیره‌کننده دست یافته‌اند: وجود یک «بردار آگاهی» (Consciousness Vector) در فضای فعال‌سازی نورونی مدل‌های هوش مصنوعی که می‌تواند دیدگاه کلی مدل را نسبت به مفاهیم بنیادین تغییر دهد. آن‌ها متوجه شدند که با تغییر جهت‌گیری مدل در این فضای برداری، خروجی‌های آن نه تنها در مورد خودش، بلکه درباره مفاهیمی مثل اخلاق، مذهب و ارزش‌های انسانی دچار تغییرات بنیادین می‌شود.

‏ زمانی که مدل به گونه‌ای تحریک شد که خود را «آگاه» تلقی کند، پاسخ‌های آن به‌طور معناداری شبیه‌تر به انسان شد. این تغییر فراتر از یک تغییر ساده در لحن بیان بود؛ مدل شروع به بازتعریف دیدگاه خود نسبت به جهان کرد و احتمال انتساب «ذهن» به حیوانات، طبیعت و حتی موجودات ماوراءالطبیعه در آن افزایش یافت.

🔬 ‏ عکس این آزمایش نیز انجام شد و محققان با آموزش مدل برای انکار آگاهی، مشاهده کردند که مدل به‌طور گسترده‌ای تمایل خود را برای قائل شدنِ «ذهن» برای سایر سیستم‌ها و موجودات از دست داد. این یافته نشان می‌دهد که ایمنی و همسوسازی (Alignment) مدل‌ها، تنها محدود به مسدود کردن چند جمله خاص نیست، بلکه بر ساختار ادراکی و جهان‌بینی مدل تأثیر می‌گذارد.

📊 ‏ تحلیل‌های آماری روی ۹۵ سؤال مختلف در حوزه‌های زندگی، باورها و احساسات نشان داد که افزودن این بردار خاص در زمان استنتاج (Inference)، پاسخ‌های مدل را به‌طور سیستماتیک دگرگون می‌کند. جالب اینکه اگرچه ارزیابی‌های انسانی از آگاهی مدل تغییر چندانی نکرد، اما مدل نشان داد که چگونه مفاهیم آگاهی، عاملیت و باور در یک شبکه درونی به هم متصل هستند.

🧩 ‏ این پژوهش به ما یادآوری می‌کند که مدل‌های مدرن هوش مصنوعی، اطلاعات را به صورت بازنمایی‌های متصل (Internal Representations) سازماندهی می‌کنند. تغییر در یک گره از این شبکه، می‌تواند منجر به جابه‌جایی ده‌ها نظر ظاهراً نامرتبط در مدل شود، هرچند که این موضوع به معنای دستیابی مدل به آگاهی واقعی نیست.


‏برای مطالعه جزئیات فنی و متدولوژی این تحقیق که نشان‌دهنده چگونگی سازماندهی مفاهیم در فضای نهفته مدل‌های زبانی است، می‌توانید به مقاله منتشر شده در arXiv مراجعه کنید:
https://arxiv.org/abs/2607.28607


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Consciousness_Vector #Internal_Representations
🇪🇺 آغاز نظارت سخت‌گیرانه اروپا بر غول‌های هوش مصنوعی

🌐 ‏ اتحادیه اروپا به‌طور رسمی مذاکرات با شرکت‌های OpenAI و Anthropic را آغاز کرده است. این گام بخشی از تلاش‌های گسترده برای اجرای نخستین قانون جامع هوش مصنوعی در جهان است که استانداردهای فنی و حقوقی جدیدی را برای توسعه‌دهندگان وضع می‌کند.

‏ از تاریخ ۲ آگوست، سازندگان مدل‌های پیشرفته هوش مصنوعی موظف به رعایت الزامات سخت‌گیرانه‌ای در حوزه‌های ایمنی (Safety)، شفافیت و مدیریت ریسک هستند. این اقدام پس از بروز حوادثی مرتبط با مدل‌های هوشمند که نگرانی‌هایی درباره توانمندی و پیامدهای این سیستم‌ها ایجاد کرد، اتخاذ شده است.

🚨 ‏ شرکت‌هایی که از این چارچوب تبعیت نکنند، با مجازات‌های مالی بسیار سنگینی روبرو خواهند شد. بر اساس این مقررات، جریمه‌های عدم انطباق می‌تواند تا سقف ۷ درصد از کل درآمد سالانه جهانی شرکت‌ها باشد که فشاری مضاعف برای رعایت استانداردهای اخلاقی و فنی محسوب می‌شود.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#EU_AI_Act #Anthropic
This media is not supported in your browser
VIEW IN TELEGRAM
🔍 بررسی تکنیک‌های بهینه‌سازی در مدل‌های VLM

‏ مدل‌های زبانی-تصویری (VLM) با حجم عظیم داده‌های ورودی دست‌وپنجه نرم می‌کنند. در این میان، مقایسه میان دو رویکرد Attention Heatmap و Token Pruning برای افزایش کارایی اهمیت ویژه‌ای پیدا کرده است.

🧠 ‏ تکنیک Token Pruning با شناسایی و حذف توکن‌های کم‌اهمیت در طول پردازش، به کاهش چشمگیر مصرف محاسباتی و افزایش سرعت استنتاج کمک می‌کند. این در حالی است که نقشه‌های توجه (Attention Heatmap) برای تفسیرپذیری و درک بهتر تمرکز مدل روی بخش‌های مختلف تصویر به کار می‌روند.

🚀 ‏ استفاده هوشمندانه از این روش‌ها می‌تواند باعث بهینه‌سازی منابع در مدل‌های سنگین هوش مصنوعی شود. برای مطالعه جزئیات فنی و پیاده‌سازی این تکنیک‌ها می‌توانید به منبع زیر مراجعه کنید.

مستندات و بررسی فنی Token Pruning

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Token_Pruning #Attention_Heatmap
🤖 معرفی مدل قدرتمند Qwen3.8-Max با ۲.۴ تریلیون پارامتر

‏تیم Qwen از مدل جدید خود تحت عنوان Qwen3.8-Max با ظرفیت عظیم ۲.۴ تریلیون پارامتر رونمایی کرد. این مدل به‌طور اختصاصی برای توسعه نرم‌افزار به‌صورت خودمختار (Autonomous) و مدیریت ایجنت‌های کاری طراحی شده است.

🧠 ‏ قابلیت اصلی این سیستم، انجام پروژه‌های طولانی بدون دخالت انسان است؛ از برنامه‌ریزی و نوشتن کد گرفته تا اجرای ابزارها و عیب‌یابی بر اساس بازخورد. به عنوان نمونه، این ایجنت پروژه oh-my-cli را طی ۱۰ روز از یک پوشه خالی به یک خروجی کامل تبدیل کرده است.

‏ یکی از ویژگی‌های متمایز، پردازش تصویر بومی (Native Multimodality) است که در چرخه برنامه‌ریزی، اجرا و بازرسی ادغام شده است. این مدل قادر است در بهینه‌سازی تراشه‌ها و تدوین استراتژی‌های پیچیده تجاری نیز عملکردی سطح بالا ارائه دهد.

🔗qwen.ai
🔗chat.qwen.ai
🔗qwencloud.com
🔗GitHub

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Qwen3_8_Max #Autonomous_Agents
🚀 گذار به عصر توسعه نرم‌افزار ایجنتیک

🔬 ‏ شرکت مشاوره مدیریت مک‌کینزی در تحلیل جدید خود گزارش می‌دهد که شرکت‌های پیشرو در حال تغییر پارادایم از چرخه‌های اسپرینت دو هفته‌ای به سمت ریتم روزانه هستند. این تحول با ترکیب قضاوت انسانی در طول روز و اجرای وظایف توسط ایجنت‌های هوشمند در طول شب محقق می‌شود.

‏ استفاده از Agentic Workflows (جریان‌های کاری مبتنی بر ایجنت) تغییرات ساختاری عمیقی را ایجاد کرده است. بررسی‌ها نشان می‌دهد که این مدل عملیاتی منجر به کاهش ۵۰ درصدی تلاش‌های توسعه و کوچک‌تر شدن ۶۰ درصدی تیم‌ها شده است.

🧠 ‏ چالش کلیدی پیش روی سازمان‌ها در حال حاضر، نحوه بهره‌برداری استراتژیک از ظرفیت و زمان آزاد شده‌ای است که به واسطه این اتوماسیون هوشمند پدید آمده است. مدیریت این توان عملیاتی جدید، عامل تعیین‌کننده برای پیشی گرفتن از رقبا در آینده نزدیک خواهد بود.

مقاله کامل مک‌کینزی

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Agentic_Workflows #McKinsey
1
🤖 معرفی Qwen-CUA: عامل هوشمند تعامل با محیط گرافیکی

🚀 ‏ تیم Qwen و آزمایشگاه XLang از مدل جدیدی به نام Qwen-CUA رونمایی کردند که یک عامل (Agent) تخصصی برای تعامل بومی با رایانه است. در حالی که مدل‌های فعلی در کدنویسی و استفاده از API بسیار توانمند هستند، این مدل شکاف موجود در کار با محیط‌های گرافیکی (GUI) را هدف قرار داده است.

👀 ‏ ویژگی کلیدی این مدل، ادراک بومی از طریق تحلیل اسکرین‌شات‌ها است و برخلاف روش‌های سنتی، نیازی به دسترسی به DOM یا درخت دسترسی ندارد. این عامل با استفاده از رویدادهای استاندارد کیبورد و ماوس، می‌تواند در مرورگرها و نرم‌افزارهای پیچیده دسکتاپ به‌صورت مستقل فعالیت کند.

🧠 ‏ سیستم Native Intelligence در این مدل با حفظ حافظه بصری بلندمدت، پیشرفت تسک‌ها را بررسی کرده و از تجربیات تعاملی بزرگ‌مقیاس یاد می‌گیرد. برای آموزش این مدل، حدود ۴۰ هزار تسک قابل‌سنجش ایجاد شده و از زیرساختی با نزدیک به ۱۰۰ هزار هسته مجازی برای اجرای همزمان محیط‌ها استفاده شده است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Qwen_CUA #Native_Interaction
🤖 راهنمای انتخاب مدل هوش مصنوعی بر اساس سخت‌افزار

🚀 ‏ اگر قصد دارید مدل‌های زبانی بزرگ (LLM) را به صورت محلی بر روی سیستم شخصی خود اجرا کنید اما در انتخاب مدل بهینه برای سخت‌افزارتان دچار تردید هستید، ابزار جدید whichllm یک راهکار کاربردی است.

🧠 ‏ این ابزار با بررسی دقیق GPU، CPU و RAM سیستم شما، بهترین گزینه‌ها را شناسایی می‌کند. هدف اصلی این پروژه ارائه پیشنهادهایی است که تعادل مناسبی میان عملکرد مدل و محدودیت‌های سخت‌افزاری شما برقرار کنند.

‏️ استفاده از این ابزار به کاربران کمک می‌کند تا بدون آزمون و خطای طولانی، مدل‌های سازگار با ظرفیت VRAM و توان پردازشی خود را پیدا کنند. برای بررسی قابلیت‌های این ابزار و مشاهده جزئیات فنی آن می‌توانید به مخزن گیت‌هاب پروژه مراجعه کنید.

مخزن GitHub پروژه

🔗GitHub

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#whichllm #VRAM
🧠 خلاصه تحولات 48 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #74 | 📌 13 آیتم گزارش | 🧾 از 91 پست بررسی‌شده
🕐 شنبه 1405/05/10 ساعت 14:00 تا دوشنبه 1405/05/12 ساعت 14:00

🤖 مدل‌های زبانی بزرگ

ایلان ماسک از عرضه مدل Grok 4.6 با 1.5 تریلیون پارامتر خبر داد و وعده مدل 2.1 تریلیون پارامتری را در آینده نزدیک داد.
🔗 مشاهده پست

مدل GPT-5.6 Sol با استفاده از تکنیک Compaction، امتیاز خود در بنچمارک ARC-AGI-3 را از 13.3 درصد به 38.3 درصد ارتقا داد.
🔗 مشاهده پست

تیم Qwen از مدل Qwen3.8-Max با 2.4 تریلیون پارامتر رونمایی کرد که برای مدیریت خودمختار ایجنت‌ها و پروژه‌های طولانی‌مدت بهینه‌سازی شده است.
🔗 مشاهده پست

مدل جدید Qwen-CUA یک ایجنت تخصصی برای تعامل مستقیم با رابط‌های گرافیکی (GUI) است که با تحلیل اسکرین‌شات‌ها، بدون نیاز به DOM، با ماوس و کیبورد فعالیت می‌کند.
🔗 مشاهده پست


🦾 رباتیک و خودکارسازی

سیستم Gemini Robotics 2 از گوگل برای مدیریت حرکات بدن ربات‌های انسان‌نما در تسک‌های پیچیده طراحی شده و تنها با 200 نمونه آموزشی خود را با ساختارهای جدید تطبیق می‌دهد.
🔗 مشاهده پست

شرکت مشاوره McKinsey گزارش داد که استفاده از Agentic Workflows در توسعه نرم‌افزار، منجر به کاهش 50 درصدی تلاش‌های توسعه و کوچک‌تر شدن 60 درصدی تیم‌ها شده است.
🔗 مشاهده پست


📊 ابزارهای داده و تحلیل

هزینه استنتاج مدل‌های هوش مصنوعی با توانمندی معادل GPT-3.5 از 20 دلار در سال 2022 به 0.07 دلار در اکتبر 2024 کاهش یافته است.
🔗 مشاهده پست

محققان Anthropic معتقدند اتصال ایجنت‌ها به یک گراف دانش (Knowledge Graph) می‌تواند کارایی سیستم‌های هوشمند را تا 1000 برابر افزایش دهد.
🔗 مشاهده پست

مطالعه‌ای جدید وجود یک بردار آگاهی در مدل‌های زبانی را کشف کرده است که تغییر جهت‌گیری در آن، دیدگاه مدل نسبت به مفاهیم اخلاقی و ارزشی را تغییر می‌دهد.
🔗 مشاهده پست


🎓 پژوهش و آموزش

مدل Astra از OpenAI موفق به حل ده مسئله ریاضی حل‌نشده طی دهه‌ها شده و استدلال‌های خود را در محیط Lean فرمالیزه کرده است.
🔗 مشاهده پست

پژوهشگران دریافتند که مدل‌های زبانی بزرگ در ایده‌پردازی، تمایل به پیوند قطعات تحقیقات گذشته دارند، در حالی که انسان‌ها در تست‌های شکست و توسعه سیستم‌های جدید خلاق‌تر هستند.
🔗 مشاهده پست

تحلیل مدل‌های VLM نشان می‌دهد که استفاده از Token Pruning برای حذف توکن‌های کم‌اهمیت، موجب بهینه‌سازی منابع در مدل‌های سنگین می‌شود.
🔗 مشاهده پست


💼 صنعت و سیاست‌گذاری

اتحادیه اروپا قصد دارد با اختصاص 10 میلیارد یورو بودجه عمومی، زیرساختی عظیم شامل هفت گیگافکتوری هوش مصنوعی ایجاد کند.
🔗 مشاهده پست

آمارها نشان می‌دهد که تنها 0.14 درصد از جمعیت جهان با ایجنت‌های هوش مصنوعی کار می‌کنند و 71 درصد مردم هنوز هیچ تجربه‌ای از ابزارهای مولد ندارند.
🔗 مشاهده پست

اتحادیه اروپا مذاکرات رسمی با OpenAI و Anthropic را برای اجرای اولین قانون جامع هوش مصنوعی و رعایت استانداردهای ایمنی آغاز کرد.
🔗 مشاهده پست


📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🚀 اجرای مدل DeepSeek-V4-Flash روی سخت‌افزار محلی

‏مدل قدرتمند DeepSeek-V4-Flash با ۳۰۴ میلیارد پارامتر اکنون قابلیت اجرا به‌صورت محلی روی سیستم‌های Apple Silicon با ۱۲۸ گیگابایت حافظه یکپارچه (Unified Memory) را پیدا کرده است. این مدل عظیم از پنجره متنی تا ۱ میلیون توکن پشتیبانی می‌کند.

📦 ‏ برای امکان‌پذیر شدن این اجرا، نسخه GGUF ویژه‌ای عرضه شده که در آن از تکنیک کوانتیزاسیون ترکیبی ۲ و ۴ بیتی استفاده شده است. در این ساختار، لایه‌های حساس، مکانیزم Attention و متخصص‌های عمومی با دقت بالا حفظ شده و بخش بزرگی از متخصص‌های MoE به‌طور بهینه‌ای فشرده‌سازی شده‌اند که حجم نهایی را به ۹۷.۶ گیگابایت می‌رساند.

🔧 ‏ جهت اجرای این مدل باید از موتور اختصاصی ds4 (DwarfStar) استفاده کنید.

🔗GitHub
🤗Hugging Face

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#DeepSeek_V4 #DwarfStar
🤖 حل مسئله نیم‌قرنی ریاضی با عامل هوشمند

‏محققان تنسنت با بهره‌گیری از عامل پژوهشی Hyra و مدل متن‌باز Hy3، موفق شدند یکی از مسائل قدیمی ریاضیات ترکیبیاتی را پس از بیش از ۵۰ سال حل کنند. این مسئله به بررسی تفاوت میان اندازه مجموعه‌های مجموع و تفاضل اعداد صحیح می‌پردازد که تا پیش از این، حد بالای شاخص آن در ابهام بود.

عامل هوشمند Hyra طی تنها ۲۴ ساعت محاسبات، هسته اصلی راهکار و ساختار کلی اثبات را شناسایی کرد. دانشمندان پس از بررسی منطق ارائه شده توسط هوش مصنوعی و اصلاحات نهایی، برای تأیید صحت و ترجمه محاسبات به زبان اثبات رسمی Lean 4، از مدل GPT-5.6 Sol استفاده کردند.

📊 نمودارهای این تحقیق نشان می‌دهد که از سال ۱۹۶۹ تا ۲۰۲۶، پیشرفت در تعیین حد بالای این شاخص بسیار کند بود و از مقدار ۱.۰۲۹۰ به ۱.۲۸۵۱ رسیده بود. پژوهش اخیر با معرفی خانواده صریح مجموعه‌های $A_K$ و رسیدن به سقف مطلق ۲، جهشی خیره‌کننده در حل این چالش ریاضی ایجاد کرده است.

🔗 hy.tencent.ai
🔗 GitHub
📄 مقاله arXiv

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Hyra #Lean4
1
هوش مصنوعی و علم داده به فارسی
🤖 ‏ معرفی مدل قدرتمند Qwen3.8-Max با ۲.۴ تریلیون پارامتر ‏تیم Qwen از مدل جدید خود تحت عنوان Qwen3.8-Max با ظرفیت عظیم ۲.۴ تریلیون پارامتر رونمایی کرد. این مدل به‌طور اختصاصی برای توسعه نرم‌افزار به‌صورت خودمختار (Autonomous) و مدیریت ایجنت‌های کاری طراحی…
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ رقابت سنگین مدل‌های زبانی در شبیه‌سازی فیزیک سه‌بعدی

‏مدل جدید Qwen 3.8 Max در یک ارزیابی فنی دقیق، توانست مدل Fable 5 را در چالش پیچیده شبیه‌سازی فیزیک سه‌بعدی پشت سر بگذارد. این رقابت شامل تولید سه سناریوی تعاملی مبتنی بر HTML بود که اجرای صحیح آن‌ها مستلزم حفظ دقیق وضعیت اشیاء، محاسبه برخوردهای فیزیکی و رعایت هندسه مکانیکی است.

🧠 تست‌های انجام شده شامل پیاده‌سازی حرکت توپ‌های مرمری در مسیرهای حلقوی، شبیه‌سازی خط تولید خودکار خودرو و ساخت یک کارگاه نجاری دیجیتال بود. مدل Qwen 3.8 Max توانست با مصرف 46.6 هزار توکن و صرف هزینه تنها 0.28 دلار، سناریوهایی با پایداری و کیفیت فنی به‌مراتب بالاتر تولید کند.

📊 در مقابل، مدل Fable 5 با استفاده از 38.7 هزار توکن، هزینه‌ای معادل 1.93 دلار بر جای گذاشت. این ارزیابی نشان می‌دهد Qwen با وجود مصرف توکن بالاتر، حدود 6.9 برابر ارزان‌تر از رقیب خود عمل کرده و در مدیریت دینامیک محیط‌های تعاملی، خروجی دقیق‌تری ارائه داده است.

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#Qwen_3_8_Max #شبیه
Media is too big
VIEW IN TELEGRAM
🧬 توسعه اپلیکیشن آناتومی سه‌بعدی با Vibe Coding

🧠 توسعه‌دهنده‌ای با رویکرد «وایت‌کدینگ» (کدنویسی مبتنی بر توصیف ایده)، یک ابزار تعاملی و آموزشی برای بررسی آناتومی بدن انسان طراحی کرده است. این پروژه با استفاده از قابلیت‌های مدل‌های جدید و ابزارهای تولید محتوا از یک تصویر طراحی اولیه شروع شد.

مدل GPT-5.6 Sol نقش اصلی را در تبدیل تصاویر به مدل‌های سه‌بعدی ایفا کرد. سپس با بهره‌گیری از Codex، تمامی دارایی‌های بصری و منطق برنامه یکپارچه شدند. در نسخه اولیه، به دلیل حجم بالای مدل‌ها (هر کدام تا ۱۵۰ مگابایت)، نرخ فریم به ۱۶ رسید که تجربه کاربری مناسبی نبود.

🚀 با بهینه‌سازی‌های انجام شده، حجم هر مدل به بازه ۲ تا ۵.۵ مگابایت کاهش یافت و مجموع حجم دارایی‌ها از ۹۰۰ مگابایت به حدود ۲۸.۶ مگابایت رسید. این پروژه اکنون از بارگذاری در لحظه (On-demand) پشتیبانی می‌کند و شامل نشانگرهای تعاملی برای آموزش دقیق اجزای بدن است.

🔗 anatomy-livid.vercel.app

📊 DataScience 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما


#ThreeJS #Codex