🤖 رونمایی از مدلهای جدید مایکروسافت در خانواده MAI
🚀 شرکت مایکروسافت دو مدل پیشرفته را در خانواده MAI معرفی کرد. مدل MAI-Image-2.5-Pro با تمرکز بر تولید تصاویر با جزئیات دقیق و رندر عالی متن درون عکس عرضه شده است. در کنار آن، مدل MAI-Voice-2-Flash برای سنتز گفتار با سرعت بالا بهینهسازی شده و اکنون در Azure AI Foundry و محیط تست MAI Playground قابل دسترسی است.
⚡ مدل Image-2.5-Pro به عنوان باکیفیتترین مدل تصویری مایکروسافت شناخته میشود که هزینه آن ۵ دلار به ازای هر میلیون توکن متنی ورودی است. در سوی دیگر، مدل Voice-2-Flash نسبت به نسل قبل دو برابر سریعتر بوده و با کاهش ۳۲ درصدی در هزینهها، نرخ ۱۵ دلار برای هر میلیون کاراکتر را ارائه میدهد.
📊 مایکروسافت در حال جایگزینی مدلهای شخص ثالث با مدلهای اختصاصی خود در سرویسهای اصلی است.
#MAI_Image_2_5_Pro #MAI_Voice_2_Flash
🚀 شرکت مایکروسافت دو مدل پیشرفته را در خانواده MAI معرفی کرد. مدل MAI-Image-2.5-Pro با تمرکز بر تولید تصاویر با جزئیات دقیق و رندر عالی متن درون عکس عرضه شده است. در کنار آن، مدل MAI-Voice-2-Flash برای سنتز گفتار با سرعت بالا بهینهسازی شده و اکنون در Azure AI Foundry و محیط تست MAI Playground قابل دسترسی است.
⚡ مدل Image-2.5-Pro به عنوان باکیفیتترین مدل تصویری مایکروسافت شناخته میشود که هزینه آن ۵ دلار به ازای هر میلیون توکن متنی ورودی است. در سوی دیگر، مدل Voice-2-Flash نسبت به نسل قبل دو برابر سریعتر بوده و با کاهش ۳۲ درصدی در هزینهها، نرخ ۱۵ دلار برای هر میلیون کاراکتر را ارائه میدهد.
📊 مایکروسافت در حال جایگزینی مدلهای شخص ثالث با مدلهای اختصاصی خود در سرویسهای اصلی است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#MAI_Image_2_5_Pro #MAI_Voice_2_Flash
📉 پایان عصر توکنسوزی: ظهور ترند Thrift-Maxxing
🚀 گزارش جدید والاستریت ژورنال نشان میدهد فضای کسبوکار آمریکا در حال گذار از «توکنسوزی حداکثری» به سمت رویکردی به نام Thrift-Maxxing (اقتصاد هوش مصنوعی) است. برخلاف ماههای گذشته که رقابت اصلی بر سر استفاده حداکثری از مدلهای گرانقیمت بود، اکنون مدیریت بودجه و بهرهوری به اولویت اول شرکتها تبدیل شده است.
📊 دادههای پلتفرم OpenRouter تایید میکند که سهم مدلهای پیشرو آمریکایی شامل Google، OpenAI و Anthropic در بخش سازمانی ایالات متحده، از حدود ۷۰٪ در ژوئن ۲۰۲۵ به ۳۰٪ در ژوئن ۲۰۲۶ کاهش یافته است. در مقابل، مدلهای چینی مانند DeepSeek، Kimi و GLM به دلیل صرفه اقتصادی بالا، به سرعت در حال تصاحب بازار هستند.
🧠 استراتژی جدید شرکتها ترکیبی است: استفاده از مدلهای قدرتمند صرفاً برای وظایف پیچیده برنامهریزی و واگذاری سایر تسکها به مدلهای ارزانتر.
🔗 wsj.com
#Thrift_Maxxing #OpenRouter
🚀 گزارش جدید والاستریت ژورنال نشان میدهد فضای کسبوکار آمریکا در حال گذار از «توکنسوزی حداکثری» به سمت رویکردی به نام Thrift-Maxxing (اقتصاد هوش مصنوعی) است. برخلاف ماههای گذشته که رقابت اصلی بر سر استفاده حداکثری از مدلهای گرانقیمت بود، اکنون مدیریت بودجه و بهرهوری به اولویت اول شرکتها تبدیل شده است.
📊 دادههای پلتفرم OpenRouter تایید میکند که سهم مدلهای پیشرو آمریکایی شامل Google، OpenAI و Anthropic در بخش سازمانی ایالات متحده، از حدود ۷۰٪ در ژوئن ۲۰۲۵ به ۳۰٪ در ژوئن ۲۰۲۶ کاهش یافته است. در مقابل، مدلهای چینی مانند DeepSeek، Kimi و GLM به دلیل صرفه اقتصادی بالا، به سرعت در حال تصاحب بازار هستند.
🧠 استراتژی جدید شرکتها ترکیبی است: استفاده از مدلهای قدرتمند صرفاً برای وظایف پیچیده برنامهریزی و واگذاری سایر تسکها به مدلهای ارزانتر.
🔗 wsj.com
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Thrift_Maxxing #OpenRouter
❤1
🎓 دوره رایگان آموزش ساخت ایجنتهای هوشمند
🚀 مایکروسافت یک دوره آموزشی جامع و کاربردی برای یادگیری نحوه توسعه AI Agents (سیستمهای خودمختار که با محیط تعامل کرده و تصمیم میگیرند) منتشر کرده است. این منبع آموزشی برای افرادی که قصد دارند از سطح پایه با مفاهیم کلیدی ایجنتها آشنا شوند، بسیار مناسب است.
🧠 در این دوره، شما به صورت عمیق درک خواهید کرد که معماری ایجنتها چگونه کار میکند و مدلهای هوش مصنوعی چطور با تکیه بر ابزارهای مختلف، فرآیند تصمیمگیری خود را مدیریت میکنند. مطالب آموزشی شامل راهنماییهای عملی برای ساخت سیستمهای هوشمند اختصاصی شماست که میتواند مهارتهای توسعهدهندگان را در این حوزه داغ ارتقا دهد.
🔗 دسترسی به سرفصلها و مخزن گیتهاب دوره
#AIAgents #Microsoft
🚀 مایکروسافت یک دوره آموزشی جامع و کاربردی برای یادگیری نحوه توسعه AI Agents (سیستمهای خودمختار که با محیط تعامل کرده و تصمیم میگیرند) منتشر کرده است. این منبع آموزشی برای افرادی که قصد دارند از سطح پایه با مفاهیم کلیدی ایجنتها آشنا شوند، بسیار مناسب است.
🧠 در این دوره، شما به صورت عمیق درک خواهید کرد که معماری ایجنتها چگونه کار میکند و مدلهای هوش مصنوعی چطور با تکیه بر ابزارهای مختلف، فرآیند تصمیمگیری خود را مدیریت میکنند. مطالب آموزشی شامل راهنماییهای عملی برای ساخت سیستمهای هوشمند اختصاصی شماست که میتواند مهارتهای توسعهدهندگان را در این حوزه داغ ارتقا دهد.
🔗 دسترسی به سرفصلها و مخزن گیتهاب دوره
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#AIAgents #Microsoft
❤1
🚀 رویکرد استراتژیک مایکروسافت به مدلهای Open-weight
⚡ ساتیا نادلا با اعلام موضع رسمی مایکروسافت، از توسعه مدلهای هوش مصنوعی با وزنهای باز (Open-weight) بهعنوان ضرورتی برای حفظ رقابتپذیری آمریکا حمایت کرد. این شرکت معتقد است انحصار مدلهای قدرتمند در دست آزمایشگاههای بسته، خطرات ساختاری بزرگی برای آینده فناوری ایجاد میکند.
🧠 مایکروسافت هشدار میدهد که تمرکز قدرت در کنترل قیمتها و زیرساختها توسط چند شرکت خاص، ریسکهای جدی دارد. مدلهای Open-weight با تغییر این معادله، به توسعهدهندگان اجازه میدهند تا مدلها را دانلود، شخصیسازی و بر روی سختافزار شخصی اجرا کنند.
🧩 این رویکرد وابستگی مطلق به یک ارائهدهنده هوش مصنوعی را کاهش داده و نوآوری را توزیع میکند. با وجود پذیرش چالشهای امنیتی، مایکروسافت تأکید دارد که تمرکز آینده این صنعت در اختیار تنها چند شرکت، تهدید بزرگتری محسوب میشود.
#Open_weight #Satya_Nadella
⚡ ساتیا نادلا با اعلام موضع رسمی مایکروسافت، از توسعه مدلهای هوش مصنوعی با وزنهای باز (Open-weight) بهعنوان ضرورتی برای حفظ رقابتپذیری آمریکا حمایت کرد. این شرکت معتقد است انحصار مدلهای قدرتمند در دست آزمایشگاههای بسته، خطرات ساختاری بزرگی برای آینده فناوری ایجاد میکند.
🧠 مایکروسافت هشدار میدهد که تمرکز قدرت در کنترل قیمتها و زیرساختها توسط چند شرکت خاص، ریسکهای جدی دارد. مدلهای Open-weight با تغییر این معادله، به توسعهدهندگان اجازه میدهند تا مدلها را دانلود، شخصیسازی و بر روی سختافزار شخصی اجرا کنند.
🧩 این رویکرد وابستگی مطلق به یک ارائهدهنده هوش مصنوعی را کاهش داده و نوآوری را توزیع میکند. با وجود پذیرش چالشهای امنیتی، مایکروسافت تأکید دارد که تمرکز آینده این صنعت در اختیار تنها چند شرکت، تهدید بزرگتری محسوب میشود.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Open_weight #Satya_Nadella
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 عرضه مدل قدرتمند Kimi K3 با ۲.۸ تریلیون پارامتر
🚨 شرکت Moonshot AI مدل جدید Kimi K3 را با ۲.۸ تریلیون پارامتر در پلتفرم Hugging Face منتشر کرد. این نخستین مدل در کلاس ۳ تریلیون پارامتر است که به صورت Open-weights در دسترس عموم قرار میگیرد. به لطف معماری MoE (مدل ترکیبی متخصصان)، در هر توکن تنها ۱۰۴ میلیارد پارامتر فعال میشوند که شامل ۱۶ متخصص از مجموع ۸۹۶ متخصص موجود است.
🧠 این مدل از کانتکست یک میلیون توکنی پشتیبانی کرده و بهصورت بومی با متن و تصویر کار میکند. ساختار فنی آن شامل ۹۳ لایه است که از ۶۹ لایه Kimi Delta Attention (مکانیزم توجه بهینه) و ۲۴ لایه Gated MLA تشکیل شده است. استفاده از فرمتهای MXFP4 برای وزنها و MXFP8 برای اکتیویشنها، باعث شده تا بهرهوری مقیاسپذیری آن ۲.۵ برابر نسبت به نسخه K2 افزایش یابد.
⚡ مدل Kimi K3 بهطور خاص برای وظایف ایجنتیک طولانی توسعه یافته است.
#Kimi_K3 #Mixture_of_Experts
🚨 شرکت Moonshot AI مدل جدید Kimi K3 را با ۲.۸ تریلیون پارامتر در پلتفرم Hugging Face منتشر کرد. این نخستین مدل در کلاس ۳ تریلیون پارامتر است که به صورت Open-weights در دسترس عموم قرار میگیرد. به لطف معماری MoE (مدل ترکیبی متخصصان)، در هر توکن تنها ۱۰۴ میلیارد پارامتر فعال میشوند که شامل ۱۶ متخصص از مجموع ۸۹۶ متخصص موجود است.
🧠 این مدل از کانتکست یک میلیون توکنی پشتیبانی کرده و بهصورت بومی با متن و تصویر کار میکند. ساختار فنی آن شامل ۹۳ لایه است که از ۶۹ لایه Kimi Delta Attention (مکانیزم توجه بهینه) و ۲۴ لایه Gated MLA تشکیل شده است. استفاده از فرمتهای MXFP4 برای وزنها و MXFP8 برای اکتیویشنها، باعث شده تا بهرهوری مقیاسپذیری آن ۲.۵ برابر نسبت به نسخه K2 افزایش یابد.
⚡ مدل Kimi K3 بهطور خاص برای وظایف ایجنتیک طولانی توسعه یافته است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Kimi_K3 #Mixture_of_Experts
❤1
🔥 معرفی ابزار جدید بایتدنس برای بهینهسازی کدنوسی
🧠 تیم تحقیقاتی ByteDance به تازگی از SWE-Pruner Pro رونمایی کرده است؛ یک سیستم نوآورانه برای Context Pruning (هرس کردن دادههای اضافی در پنجره متنی) که مخصوص ایجنتهای برنامهنویس طراحی شده است. این ابزار برخلاف روشهای سنتی، از مدل مجزایی برای هرس کردن استفاده نمیکند.
⚡ در عوض، این سیستم با تحلیل Hidden States (حالتهای پنهان) خودِ ایجنت، تصمیم میگیرد که کدام بخش از خروجی ابزارها برای حل مسئله ضروری است و کدام بخش باید حذف شود. این رویکرد هوشمندانه باعث میشود ایجنت در تعاملات چندمرحلهای، بازدهی بسیار بالاتری داشته باشد.
📊 نتایج ارزیابیها روی ۴ Benchmark چندمرحلهای نشان میدهد که SWE-Pruner Pro قادر است تا ۳۹ درصد از کل توکنهای مصرفی در بخش Prompt و تکمیل متن را کاهش دهد. این کاهش چشمگیر حجم توکن، علاوه بر افزایش سرعت، هزینههای پردازشی ایجنتهای کدنوس را بهطور قابلتوجهی پایین میآورد.
#SWE_Pruner_Pro #Context_Pruning
🧠 تیم تحقیقاتی ByteDance به تازگی از SWE-Pruner Pro رونمایی کرده است؛ یک سیستم نوآورانه برای Context Pruning (هرس کردن دادههای اضافی در پنجره متنی) که مخصوص ایجنتهای برنامهنویس طراحی شده است. این ابزار برخلاف روشهای سنتی، از مدل مجزایی برای هرس کردن استفاده نمیکند.
⚡ در عوض، این سیستم با تحلیل Hidden States (حالتهای پنهان) خودِ ایجنت، تصمیم میگیرد که کدام بخش از خروجی ابزارها برای حل مسئله ضروری است و کدام بخش باید حذف شود. این رویکرد هوشمندانه باعث میشود ایجنت در تعاملات چندمرحلهای، بازدهی بسیار بالاتری داشته باشد.
📊 نتایج ارزیابیها روی ۴ Benchmark چندمرحلهای نشان میدهد که SWE-Pruner Pro قادر است تا ۳۹ درصد از کل توکنهای مصرفی در بخش Prompt و تکمیل متن را کاهش دهد. این کاهش چشمگیر حجم توکن، علاوه بر افزایش سرعت، هزینههای پردازشی ایجنتهای کدنوس را بهطور قابلتوجهی پایین میآورد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#SWE_Pruner_Pro #Context_Pruning
📊 تسلط مدلهای چینی بر حجم مصرفی API
⚡ گزارش جدید از پلتفرم OpenRouter نشان میدهد که مدلهای هوش مصنوعی چینی اکنون بازار توکنهای مصرفی را به قبضه خود درآوردهاند. در لیست ۱۰ مدل برتر از نظر حجم توکن (Token Volume)، تنها مدل Claude 3.5 Opus در جایگاه دهم حضور دارد و سایر جایگاهها در تسلط مدلهای چینی است.
🚀 پنج مدل برتر هفته گذشته به شرح زیر است
🔹 Xiaomi Mimo-v2.5: با ۱۰.۵ تریلیون توکن در صدر.
🔹 DeepSeek V4 Flash: با ۶.۳۷ تریلیون توکن.
🔹 Tencent Hunyuan-3: با رشد خیرهکننده ۹۹۹ درصدی و ۳.۹۴ تریلیون توکن.
🔹 Z-AI GLM 5.2: با ۳.۲۹ تریلیون توکن.
🔹 DeepSeek V4 Pro: با ۳.۱۷ تریلیون توکن.
🧠 قیمتگذاری بسیار رقابتی این مدلها که بین ۰.۰۹ تا ۰.۶۷ دلار برای هر میلیون توکن ورودی است، نقش کلیدی در این تغییر رویکرد کاربران ایفا میکند.
#OpenRouter #DeepSeek
⚡ گزارش جدید از پلتفرم OpenRouter نشان میدهد که مدلهای هوش مصنوعی چینی اکنون بازار توکنهای مصرفی را به قبضه خود درآوردهاند. در لیست ۱۰ مدل برتر از نظر حجم توکن (Token Volume)، تنها مدل Claude 3.5 Opus در جایگاه دهم حضور دارد و سایر جایگاهها در تسلط مدلهای چینی است.
🚀 پنج مدل برتر هفته گذشته به شرح زیر است
🔹 Xiaomi Mimo-v2.5: با ۱۰.۵ تریلیون توکن در صدر.
🔹 DeepSeek V4 Flash: با ۶.۳۷ تریلیون توکن.
🔹 Tencent Hunyuan-3: با رشد خیرهکننده ۹۹۹ درصدی و ۳.۹۴ تریلیون توکن.
🔹 Z-AI GLM 5.2: با ۳.۲۹ تریلیون توکن.
🔹 DeepSeek V4 Pro: با ۳.۱۷ تریلیون توکن.
🧠 قیمتگذاری بسیار رقابتی این مدلها که بین ۰.۰۹ تا ۰.۶۷ دلار برای هر میلیون توکن ورودی است، نقش کلیدی در این تغییر رویکرد کاربران ایفا میکند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#OpenRouter #DeepSeek
🌐 چالشهای زیرساختی مراکز داده در بریتانیا
⚡ مایکروسافت اخیراً اعلام کرده است که در بریتانیا، ساخت فیزیکی یک مرکز داده (Data Center) حدود ۱۸ ماه زمان میبرد، اما فرآیند دریافت مجوز اتصال به شبکه برق میتواند تا ۸ سال طول بکشد. این تأخیرهای طولانی در تأمین انرژی، توسعه زیرساختهای هوش مصنوعی را در این کشور با چالشی جدی مواجه کرده است.
📊 در حال حاضر، ظرفیت مراکز داده بریتانیا تنها ۲ گیگاوات است که در مقایسه با سرانه آمریکا، حدود یکسوم آن محسوب میشود. بریتانیا امیدوار است تا سال ۲۰۳۰ این ظرفیت را به ۶ گیگاوات برساند که همچنان فاصله بسیار زیادی با هدفگذاری ۹۰ گیگاواتی ایالات متحده دارد.
🧠 این شکاف گسترده در ظرفیت عملیاتی نشاندهنده اهمیت حیاتی زیرساختهای انرژی در رقابت جهانی برای گسترش مدلهای زبانی بزرگ است. اگر بریتانیا نتواند موانع موجود در شبکه انتقال برق را مرتفع کند، ممکن است در دستیابی به اهداف توسعه فناوریهای هوش مصنوعی نسبت به سایر قدرتهای اقتصادی عقب بماند.
#زیرساخت_انرژی #مایکروسافت
⚡ مایکروسافت اخیراً اعلام کرده است که در بریتانیا، ساخت فیزیکی یک مرکز داده (Data Center) حدود ۱۸ ماه زمان میبرد، اما فرآیند دریافت مجوز اتصال به شبکه برق میتواند تا ۸ سال طول بکشد. این تأخیرهای طولانی در تأمین انرژی، توسعه زیرساختهای هوش مصنوعی را در این کشور با چالشی جدی مواجه کرده است.
📊 در حال حاضر، ظرفیت مراکز داده بریتانیا تنها ۲ گیگاوات است که در مقایسه با سرانه آمریکا، حدود یکسوم آن محسوب میشود. بریتانیا امیدوار است تا سال ۲۰۳۰ این ظرفیت را به ۶ گیگاوات برساند که همچنان فاصله بسیار زیادی با هدفگذاری ۹۰ گیگاواتی ایالات متحده دارد.
🧠 این شکاف گسترده در ظرفیت عملیاتی نشاندهنده اهمیت حیاتی زیرساختهای انرژی در رقابت جهانی برای گسترش مدلهای زبانی بزرگ است. اگر بریتانیا نتواند موانع موجود در شبکه انتقال برق را مرتفع کند، ممکن است در دستیابی به اهداف توسعه فناوریهای هوش مصنوعی نسبت به سایر قدرتهای اقتصادی عقب بماند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#زیرساخت_انرژی #مایکروسافت
🚀 جهش خیرهکننده مدلهای متنباز چینی
🔬 دنیای مدلهای متنباز (Open Weights) شاهد یک تحول بزرگ است. مدلهای هوش مصنوعی چینی در کمتر از دو ماه پس از عرضه، عملکردی فراتر از رقبای قدرتمندی نظیر Opus 4.8 در بنچمارکها ثبت کردهاند.
🧠 مدل Kimi K3 اکنون با کسب امتیاز 57 در شاخص Artificial Analysis، در صدر جدول مدلهای متنباز قرار گرفته است. این مدل عظیم با 2.6 تریلیون پارامتر، وزنهای خود را بهصورت عمومی منتشر کرده و استانداردهای جدیدی را در صنعت هوش مصنوعی تعریف کرده است.
⚖ ️ استفاده از این مدل تحت لیسانس اختصاصی Kimi K3 مجاز است. کسبوکارهایی که درآمد سالانه بالای 20 میلیون دلار دارند یا خدماتی با بیش از 100 میلیون کاربر فعال ماهانه ارائه میدهند، برای بهرهبرداری تجاری باید توافقنامههای ویژهای با توسعهدهندگان منعقد کنند.
📊 سازندگان همچنین ملزم به درج نام Kimi K3 در رابط کاربری محصولات خود هستند.
#Kimi_K3 #Artificial_Analysis
🔬 دنیای مدلهای متنباز (Open Weights) شاهد یک تحول بزرگ است. مدلهای هوش مصنوعی چینی در کمتر از دو ماه پس از عرضه، عملکردی فراتر از رقبای قدرتمندی نظیر Opus 4.8 در بنچمارکها ثبت کردهاند.
🧠 مدل Kimi K3 اکنون با کسب امتیاز 57 در شاخص Artificial Analysis، در صدر جدول مدلهای متنباز قرار گرفته است. این مدل عظیم با 2.6 تریلیون پارامتر، وزنهای خود را بهصورت عمومی منتشر کرده و استانداردهای جدیدی را در صنعت هوش مصنوعی تعریف کرده است.
⚖ ️ استفاده از این مدل تحت لیسانس اختصاصی Kimi K3 مجاز است. کسبوکارهایی که درآمد سالانه بالای 20 میلیون دلار دارند یا خدماتی با بیش از 100 میلیون کاربر فعال ماهانه ارائه میدهند، برای بهرهبرداری تجاری باید توافقنامههای ویژهای با توسعهدهندگان منعقد کنند.
📊 سازندگان همچنین ملزم به درج نام Kimi K3 در رابط کاربری محصولات خود هستند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Kimi_K3 #Artificial_Analysis
🚀 آغاز تولید بومی دستگاههای لیتوگرافی DUV در چین
🇨🇳 چین برای نخستین بار خط تولید ماشینهای لیتوگرافی فرابنفش عمیق (DUV) را راهاندازی کرده است. این تجهیزات که برای ساخت نیمههادیهای پیشرفته حیاتی هستند، تا پیش از این تحت انحصار شرکت هلندی ASML قرار داشتند.
📊 بر اساس گزارشها، یک شرکت مستقر در شانگهای برنامه دارد امسال ۵ دستگاه تولید کند و این ظرفیت را در سال آینده به ۲۰ واحد افزایش دهد. اگرچه این فناوری فعلاً در مراحل اولیه توسعه قرار دارد، اما ورود یک بازیگر جدید به این بازار، توازن قدرت در زنجیره تأمین تراشههای پیشرفته جهان را بهطور جدی به چالش کشیده است.
📉 انتشار این خبر واکنش فوری و گسترده بازارهای مالی را در پی داشت. ارزش سهام ASML تا ۸.۳٪ سقوط کرد و به زیر میانگین متحرک ۵۰ روزه رسید که نشاندهنده شکستهشدن روند صعودی قیمت این سهم در نمودارهای تکنیکال است.
#لیتوگرافی_DUV #ASML
🇨🇳 چین برای نخستین بار خط تولید ماشینهای لیتوگرافی فرابنفش عمیق (DUV) را راهاندازی کرده است. این تجهیزات که برای ساخت نیمههادیهای پیشرفته حیاتی هستند، تا پیش از این تحت انحصار شرکت هلندی ASML قرار داشتند.
📊 بر اساس گزارشها، یک شرکت مستقر در شانگهای برنامه دارد امسال ۵ دستگاه تولید کند و این ظرفیت را در سال آینده به ۲۰ واحد افزایش دهد. اگرچه این فناوری فعلاً در مراحل اولیه توسعه قرار دارد، اما ورود یک بازیگر جدید به این بازار، توازن قدرت در زنجیره تأمین تراشههای پیشرفته جهان را بهطور جدی به چالش کشیده است.
📉 انتشار این خبر واکنش فوری و گسترده بازارهای مالی را در پی داشت. ارزش سهام ASML تا ۸.۳٪ سقوط کرد و به زیر میانگین متحرک ۵۰ روزه رسید که نشاندهنده شکستهشدن روند صعودی قیمت این سهم در نمودارهای تکنیکال است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#لیتوگرافی_DUV #ASML
❤1
🤖 تدوین چارچوبهای نظارتی آمریکا بر مدلهای پیشرو هوش مصنوعی
دولت آمریکا در حال تدوین مکانیزم جدیدی است که توسعهدهندگان مدلهای پیشرو (Frontier models) را ملزم میکند پیش از عرضه عمومی، دسترسی مدلهای خود را برای بررسیهای امنیتی به نهادهای فدرال ارائه دهند. این دوره بازرسی که احتمالاً تا ۳۰ روز به طول میانجامد، با هدف ارزیابی قابلیتهای خطرناک سایبری و تهدیدات احتمالی برای امنیت ملی صورت میگیرد.
🔬 شرکتهای پیشرو نظیر OpenAI، Anthropic و Google هماکنون در حال مذاکره برای نحوه اجرای این سیستم نظارتی هستند. مقامات آمریکایی در تلاشند تا تعریفی دقیق از مدلهای Frontier ارائه داده و تفکیک استانداردی میان مدلهای Closed و Open-weight برقرار کنند.
⚡ این رویکرد پیشتر عملیاتی شده است؛ دولت آمریکا اخیراً با اعمال فشار بر Anthropic در قبال مدل Mythos به دلیل قابلیتهای تهاجمی سایبری، از انتشار عمومی گسترده آن جلوگیری کرد.
#Frontier_models #Mythos
دولت آمریکا در حال تدوین مکانیزم جدیدی است که توسعهدهندگان مدلهای پیشرو (Frontier models) را ملزم میکند پیش از عرضه عمومی، دسترسی مدلهای خود را برای بررسیهای امنیتی به نهادهای فدرال ارائه دهند. این دوره بازرسی که احتمالاً تا ۳۰ روز به طول میانجامد، با هدف ارزیابی قابلیتهای خطرناک سایبری و تهدیدات احتمالی برای امنیت ملی صورت میگیرد.
🔬 شرکتهای پیشرو نظیر OpenAI، Anthropic و Google هماکنون در حال مذاکره برای نحوه اجرای این سیستم نظارتی هستند. مقامات آمریکایی در تلاشند تا تعریفی دقیق از مدلهای Frontier ارائه داده و تفکیک استانداردی میان مدلهای Closed و Open-weight برقرار کنند.
⚡ این رویکرد پیشتر عملیاتی شده است؛ دولت آمریکا اخیراً با اعمال فشار بر Anthropic در قبال مدل Mythos به دلیل قابلیتهای تهاجمی سایبری، از انتشار عمومی گسترده آن جلوگیری کرد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Frontier_models #Mythos
🤖 بررسی فنی مدل Kimi K3 از شرکت Moonshot AI
🔬 شرکت Moonshot AI با انتشار گزارش فنی مدل Kimi K3، تغییرات ساختاری بنیادینی را نسبت به نسل قبلی (K2) معرفی کرده است. این مدل با ۹۳ لایه پردازشی، از معماری ترکیبی نوآورانهای شامل ۳ لایه KDA و یک لایه MLA جهانی استفاده میکند. مکانیزم KDA با فشردهسازی متن در حالتی با اندازه ثابت، مانع از اشباع حافظه (Cache) در گفتگوهای بسیار طولانی میشود.
⚡ یکی از قابلیتهای کلیدی K3، پشتیبانی از پنجره متنی تا یک میلیون توکن بدون نیاز به تنظیمات مرسوم RoPE است. در بخش مدیریت اطلاعات، معماری Attention Residuals به هر لایه اجازه میدهد انتخاب کند از کدام بلوکهای قبلی داده دریافت کند، که این امر منجر به بهینهسازی جریان اطلاعات در ۸ بلوک ۱۲ لایهای شده است.
🧠 در معماری MoE (مدلهای آمیخته از متخصصان)، تعداد متخصصان به ۸۹۶ افزایش یافته و در هر توکن، ۱۶ متخصص فعال میشوند.
#Kimi_K3 #KDA_Architecture
🔬 شرکت Moonshot AI با انتشار گزارش فنی مدل Kimi K3، تغییرات ساختاری بنیادینی را نسبت به نسل قبلی (K2) معرفی کرده است. این مدل با ۹۳ لایه پردازشی، از معماری ترکیبی نوآورانهای شامل ۳ لایه KDA و یک لایه MLA جهانی استفاده میکند. مکانیزم KDA با فشردهسازی متن در حالتی با اندازه ثابت، مانع از اشباع حافظه (Cache) در گفتگوهای بسیار طولانی میشود.
⚡ یکی از قابلیتهای کلیدی K3، پشتیبانی از پنجره متنی تا یک میلیون توکن بدون نیاز به تنظیمات مرسوم RoPE است. در بخش مدیریت اطلاعات، معماری Attention Residuals به هر لایه اجازه میدهد انتخاب کند از کدام بلوکهای قبلی داده دریافت کند، که این امر منجر به بهینهسازی جریان اطلاعات در ۸ بلوک ۱۲ لایهای شده است.
🧠 در معماری MoE (مدلهای آمیخته از متخصصان)، تعداد متخصصان به ۸۹۶ افزایش یافته و در هر توکن، ۱۶ متخصص فعال میشوند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Kimi_K3 #KDA_Architecture
🤖 تغییر رفتار تخصصی کاربران با هوش مصنوعی
🔬 نتایج تحقیقات جدید OpenAI نشان میدهد که حدود ۴۳.۵ درصد از پیامهای تخصصی کاربران تجاری ChatGPT در ایالات متحده، مربوط به وظایفی است که خارج از حوزههای شغلی معمول آنها قرار دارد. این آمار نشان میدهد که کاربران به شکلی گسترده از مدلهای زبانی برای انجام فعالیتهای تخصصی خارج از حیطه اصلی کاری خود استفاده میکنند.
⚡ در تحلیل دادههای بهدستآمده، محاسبات مالی و عیبیابی سیستمهای کامپیوتری در میان سه وظیفه برترِ خارج از نقش شغلی در تمام گروهها مشاهده شدند. همچنین وظایف مرتبط با بازاریابی از جمله فعالیتهای پرتکراری بودند که کاربران در مشاغل مختلف برای انجام آنها از این ابزار بهره میبرند.
📊 محققان تأکید دارند که این ارقام صرفاً پیامهای رد و بدل شده در نسخه ChatGPT Business را بازتاب میدهد و معیار مستقیمی برای سنجش کیفیت خروجی، میزان بهرهوری یا تأثیر واقعی بر بازار کار نیست.
#ChatGPT_Business #محاسبات_مالی
🔬 نتایج تحقیقات جدید OpenAI نشان میدهد که حدود ۴۳.۵ درصد از پیامهای تخصصی کاربران تجاری ChatGPT در ایالات متحده، مربوط به وظایفی است که خارج از حوزههای شغلی معمول آنها قرار دارد. این آمار نشان میدهد که کاربران به شکلی گسترده از مدلهای زبانی برای انجام فعالیتهای تخصصی خارج از حیطه اصلی کاری خود استفاده میکنند.
⚡ در تحلیل دادههای بهدستآمده، محاسبات مالی و عیبیابی سیستمهای کامپیوتری در میان سه وظیفه برترِ خارج از نقش شغلی در تمام گروهها مشاهده شدند. همچنین وظایف مرتبط با بازاریابی از جمله فعالیتهای پرتکراری بودند که کاربران در مشاغل مختلف برای انجام آنها از این ابزار بهره میبرند.
📊 محققان تأکید دارند که این ارقام صرفاً پیامهای رد و بدل شده در نسخه ChatGPT Business را بازتاب میدهد و معیار مستقیمی برای سنجش کیفیت خروجی، میزان بهرهوری یا تأثیر واقعی بر بازار کار نیست.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#ChatGPT_Business #محاسبات_مالی
🧠 خلاصه تحولات 48 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #70 | 📌 10 آیتم گزارش | 🧾 از 93 پست بررسیشده
🕐 یکشنبه 1405/05/04 ساعت 14:00 تا سهشنبه 1405/05/06 ساعت 14:00
🤖 مدلهای زبانی بزرگ و هوش مصنوعی مولد
🦾 مهندسی ایجنتیک و سیستمهای هوشمند
📊 دیتاستها و تحلیل داده
💼 بازار کار، صنعت و سیاستگذاری
🎓 آموزش و منابع تخصصی
🗂 گزارش #70 | 📌 10 آیتم گزارش | 🧾 از 93 پست بررسیشده
🕐 یکشنبه 1405/05/04 ساعت 14:00 تا سهشنبه 1405/05/06 ساعت 14:00
🤖 مدلهای زبانی بزرگ و هوش مصنوعی مولد
مدل Kimi K3 با 2.8 تریلیون پارامتر و معماری MoE به عنوان نخستین مدل در کلاس 3 تریلیون پارامتر به صورت Open-weights منتشر شد. این مدل از پنجره متنی 1 میلیون توکنی پشتیبانی کرده و با استفاده از مکانیزمهای KDA و MLA، بهرهوری استنتاج را به شدت افزایش داده است.
🔗 مشاهده پست
مایکروسافت دو مدل جدید MAI-Image-2.5-Pro برای تولید تصویر و MAI-Voice-2-Flash برای سنتز سریع گفتار را در Azure AI Foundry عرضه کرد. مدل تصویری جدید مایکروسافت با هزینه 5 دلار به ازای هر میلیون توکن، در زمینه رندر متن در عکس عملکردی پیشرو دارد.
🔗 مشاهده پست
🦾 مهندسی ایجنتیک و سیستمهای هوشمند
سیستمهای Agentic AI فراتر از چتباتهای ساده عمل کرده و شامل لایههای برنامهنویسی پویا، مدیریت حافظه و حلقههای خودارزیابی برای نقد خروجیها هستند. توسعهدهندگان باید برای پیادهسازی سیستمهای تولیدی (Production-grade)، از معماریهای 9 لایه شامل استقرار، ارزیابی و دیتابیسهای برداری استفاده کنند.
🔗 مشاهده پست
ابزار SWE-Pruner Pro از بایتدنس با تحلیل Hidden States ایجنتها، امکان Context Pruning هوشمند را فراهم کرده است. این ابزار قادر است تا 39 درصد از توکنهای غیرضروری در پنجره متنی را حذف کرده و بازدهی ایجنتهای برنامهنویس را در تعاملات چندمرحلهای بهبود بخشد.
🔗 مشاهده پست
📊 دیتاستها و تحلیل داده
مجموعه داده جامع جام جهانی فوتبال (1930 - 2026) با هدف پیشبینی نتایج و بررسی عملکرد بازیکنان و تیمها منتشر شد. این دیتاست شامل فایلهای چندبخشی از مسابقات، آمار گلزنان و اطلاعات بازیکنان است که برای پروژههای مدلسازی مالی و تحلیلی بسیار کاربرد دارد.
🔗 مشاهده پست
دیتاست قیمت مسکن در وین با 99,185 رکورد و امتیاز کاربردپذیری 10 از 10 در پلتفرم Kaggle برای تحلیلهای آماری قیمت عرضه شده است. همچنین دادههای تاریخی شاخص S&P 500 با 24,756 ردیف شامل قیمتهای بازگشایی و حجم معاملات برای مطالعه نوسانات بازار در دسترس قرار گرفت.
🔗 مشاهده پست
💼 بازار کار، صنعت و سیاستگذاری
گزارشها نشان میدهد استراتژی Thrift-Maxxing جایگزین توکنسوزی در فضای کسبوکار آمریکا شده است. سهم مدلهای پیشرو آمریکایی در بازار سازمانی از 70 درصد در سال 2025 به 30 درصد در سال 2026 کاهش یافته و مدلهای چینی به دلیل صرفه اقتصادی بالا در حال گسترش هستند.
🔗 مشاهده پست
چین برای نخستین بار تولید دستگاههای لیتوگرافی DUV را بومیسازی کرده است که تهدیدی جدی برای انحصار شرکت ASML محسوب میشود. این حرکت باعث واکنش منفی در بازارهای مالی و سقوط 8.3 درصدی ارزش سهام این غول هلندی شد.
🔗 مشاهده پست
🎓 آموزش و منابع تخصصی
فهرست Awesome Free AI Books شامل بیش از 30 کتاب کلیدی در حوزههای Deep Learning و Reinforcement Learning گردآوری شده است. این منبع شامل آثار اساتیدی چون گودفلو و بیشاپ است که مستقیماً به صفحه رسمی مؤلفان ارجاع میدهد.
🔗 مشاهده پست
دوره جامع مایکروسافت برای آموزش AI Agents منتشر شد که به بررسی معماری ایجنتهای خودمختار و نحوه تعامل آنها با ابزارهای مختلف میپردازد. این دوره شامل مخزن GitHub برای تمرینهای عملی است و برای توسعهدهندگانی که قصد دارند از سطح پایه شروع کنند، بسیار مناسب است.
🔗 مشاهده پست
🚀 جهش بزرگ در اکوسیستم Grok
ایلان ماسک اعلام کرد که مدل Grok 4.6 با ۱.۵ تریلیون پارامتر در تاریخ ۷ آگوست منتشر میشود. این مدل تنها آغاز مسیر است و انتظار میرود مدل بعدی یعنی Grok 4.7 با ظرفیت عظیم ۲.۱ تریلیون پارامتر، تنها چند هفته پس از آن عرضه شود.
⚡ در کنار این تحولات، شایعاتی درباره انتشار مدل برنامهنویسی Composer 3 قوت گرفته است. گفته میشود این مدل از صفر بر روی کلاستر پردازشی عظیم Colossus 2 آموزش دیده است تا عملکردی در سطح Claude Opus 5 یا GPT-5.6 Sol ارائه دهد.
🧠 تحلیلگران معتقدند در صورت صحت این گزارشها، مدل جدید با هزینهای بهمراتب کمتر، استانداردهای فعلی کدنویسی هوشمند را جابهجا خواهد کرد. اگرچه جزئیات فنی دقیق این معماریها هنوز بهطور رسمی تأیید نشده، اما سرعت توسعه آنها نشاندهنده رقابتی فشرده در مقیاسهای بسیار بزرگ مدلهای زبانی است. 🧩 این پیشرفتها به لطف زیرساختهای سختافزاری جدید، تحولی در کارایی سیستمهای هوش مصنوعی ایجاد خواهد کرد.
#Grok_4_6 #Composer_3
ایلان ماسک اعلام کرد که مدل Grok 4.6 با ۱.۵ تریلیون پارامتر در تاریخ ۷ آگوست منتشر میشود. این مدل تنها آغاز مسیر است و انتظار میرود مدل بعدی یعنی Grok 4.7 با ظرفیت عظیم ۲.۱ تریلیون پارامتر، تنها چند هفته پس از آن عرضه شود.
⚡ در کنار این تحولات، شایعاتی درباره انتشار مدل برنامهنویسی Composer 3 قوت گرفته است. گفته میشود این مدل از صفر بر روی کلاستر پردازشی عظیم Colossus 2 آموزش دیده است تا عملکردی در سطح Claude Opus 5 یا GPT-5.6 Sol ارائه دهد.
🧠 تحلیلگران معتقدند در صورت صحت این گزارشها، مدل جدید با هزینهای بهمراتب کمتر، استانداردهای فعلی کدنویسی هوشمند را جابهجا خواهد کرد. اگرچه جزئیات فنی دقیق این معماریها هنوز بهطور رسمی تأیید نشده، اما سرعت توسعه آنها نشاندهنده رقابتی فشرده در مقیاسهای بسیار بزرگ مدلهای زبانی است. 🧩 این پیشرفتها به لطف زیرساختهای سختافزاری جدید، تحولی در کارایی سیستمهای هوش مصنوعی ایجاد خواهد کرد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Grok_4_6 #Composer_3