🤖 فریمورک OpenResearcher معرفی شد
⚡️ ️ آزمایشگاه TIGER-AI از ابزار OpenResearcher رونمایی کرد. این پروژه یک خطلوله (مجموعهای از مراحل پردازش داده) کاملاً متنباز برای آموزش عوامل تحقیقات عمیق (Deep Research Agents) است که تمام کدهای آموزش، ارزیابی و محیط جستجوی آفلاین را ارائه میدهد.
🧠 این ابزار با تکیه بر حدود ۹۶ هزار مسیر تحقیقاتی به مدلها یاد میدهد که بهجای تولید پاسخهای فرضی، فرآیند کامل پژوهش شامل جستجو در وب، استخراج شواهد و استدلال چندمرحلهای را برای رسیدن به پاسخ نهایی طی کنند.
🔗 مخزن GitHub
#ابزار #AgentAI
⚡️ ️ آزمایشگاه TIGER-AI از ابزار OpenResearcher رونمایی کرد. این پروژه یک خطلوله (مجموعهای از مراحل پردازش داده) کاملاً متنباز برای آموزش عوامل تحقیقات عمیق (Deep Research Agents) است که تمام کدهای آموزش، ارزیابی و محیط جستجوی آفلاین را ارائه میدهد.
🧠 این ابزار با تکیه بر حدود ۹۶ هزار مسیر تحقیقاتی به مدلها یاد میدهد که بهجای تولید پاسخهای فرضی، فرآیند کامل پژوهش شامل جستجو در وب، استخراج شواهد و استدلال چندمرحلهای را برای رسیدن به پاسخ نهایی طی کنند.
🔗 مخزن GitHub
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#ابزار #AgentAI
🤖 ابزار AgentField برای توسعه و اجرای AI Agentها در مقیاس عملیاتی
⚡ فریمورک AgentField با هدف تبدیل AI Agentها به سرویسهای بکاند استاندارد طراحی شده است. این ابزار به جای تمرکز صرف بر منطق ایجنت، بر چالشهای استقرار در محیط Production، مدیریت API و میکروسرویسها متمرکز است.
🧩 با این ابزار، توابع ساده Python، Go یا TypeScript به REST endpoints با قابلیتهای مدیریت وضعیت، retry خودکار، حافظه (Memory) و قابلیت مشاهده (Observability) تبدیل میشوند. پروژه با بیش از ۲.۴ هزار ستاره در گیتهاب، امکان مدیریت هزاران ایجنت را فراهم میکند.
#معرفی #AgentAI
⚡ فریمورک AgentField با هدف تبدیل AI Agentها به سرویسهای بکاند استاندارد طراحی شده است. این ابزار به جای تمرکز صرف بر منطق ایجنت، بر چالشهای استقرار در محیط Production، مدیریت API و میکروسرویسها متمرکز است.
🧩 با این ابزار، توابع ساده Python، Go یا TypeScript به REST endpoints با قابلیتهای مدیریت وضعیت، retry خودکار، حافظه (Memory) و قابلیت مشاهده (Observability) تبدیل میشوند. پروژه با بیش از ۲.۴ هزار ستاره در گیتهاب، امکان مدیریت هزاران ایجنت را فراهم میکند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#معرفی #AgentAI
🇨🇳 ترجیح مدلهای هوش مصنوعی چینی در آمریکا
📊 گزارشهای اخیر نشان میدهند که شرکتهای آمریکایی اکنون بیش از مدلهای بومی ایالات متحده، از مدلهای هوش مصنوعی چینی استفاده میکنند.
📈 این تغییر جهت غافلگیرکننده در بازار، نشاندهنده افزایش رقابتپذیری و کارایی بالای فناوریهای توسعهیافته توسط شرکتهای چینی است که توانستهاند سهم بازار قابلتوجهی کسب کنند.
#خبر #Qwen
📊 گزارشهای اخیر نشان میدهند که شرکتهای آمریکایی اکنون بیش از مدلهای بومی ایالات متحده، از مدلهای هوش مصنوعی چینی استفاده میکنند.
📈 این تغییر جهت غافلگیرکننده در بازار، نشاندهنده افزایش رقابتپذیری و کارایی بالای فناوریهای توسعهیافته توسط شرکتهای چینی است که توانستهاند سهم بازار قابلتوجهی کسب کنند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#خبر #Qwen
b2_alg_coverandinside.pdf
9.5 MB
📚 مرجع جامع جبر برای متخصصان
🧠 کتاب Basic Algebra نوشته Anthony Knapp یک منبع فوقالعاده برای دانشجویان ارشد و علاقهمندان به درک عمیق ریاضیات است. این کتاب در بیش از 700 صفحه، مسیر کاملی از مفاهیم پایهای تا نظریات پیشرفته را پوشش میدهد.
⚡ محتوای این اثر شامل مباحث کلیدی نظیر گروهها، حلقهها، میدانها و نظریه گالوا است. همچنین مباحث کاربردی در مدلسازی مانند ماتریسها، تانسورها و جبر خطی به شکلی دقیق تدریس شدهاند.
math.stonybrook.edu/~aknapp/download/b2-alg-coverandinside.pdf
#معرفی #DataScience
🧠 کتاب Basic Algebra نوشته Anthony Knapp یک منبع فوقالعاده برای دانشجویان ارشد و علاقهمندان به درک عمیق ریاضیات است. این کتاب در بیش از 700 صفحه، مسیر کاملی از مفاهیم پایهای تا نظریات پیشرفته را پوشش میدهد.
⚡ محتوای این اثر شامل مباحث کلیدی نظیر گروهها، حلقهها، میدانها و نظریه گالوا است. همچنین مباحث کاربردی در مدلسازی مانند ماتریسها، تانسورها و جبر خطی به شکلی دقیق تدریس شدهاند.
math.stonybrook.edu/~aknapp/download/b2-alg-coverandinside.pdf
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#معرفی #DataScience
🚀 توقف موقت اشتراکگیری Kimi K3
🤖 سرویس هوش مصنوعی Kimi K3 به دلیل تقاضای بسیار بالا و فشار سنگین بر منابع پردازشی GPU، ثبتنام کاربران جدید را به طور موقت متوقف کرد. محدودیت در توان عملیاتی (Inference capacity) اکنون به اصلیترین چالش برای گسترش این مدل تبدیل شده است.
⚡ پیشبینی میشود این فشار زیرساختی، تقاضا برای تراشههای هوش مصنوعی چینی، بهویژه محصولات Huawei را افزایش دهد. این موضوع نشاندهنده اهمیت حیاتی سختافزار در مقیاسپذیری مدلهای بزرگ است.
📊 تیم توسعهدهنده قصد دارد در فازهای بعدی ظرفیت خود را توسعه دهد و اشتراکها را مجدداً بازگشایی کند. در ساختار جدید، مدلهای اشتراکی به دو دسته عمومی و تخصصی برنامهنویسی تقسیم خواهند شد تا منابع پردازشی بهینهتر مدیریت شوند.
#خبر #Kimi
🤖 سرویس هوش مصنوعی Kimi K3 به دلیل تقاضای بسیار بالا و فشار سنگین بر منابع پردازشی GPU، ثبتنام کاربران جدید را به طور موقت متوقف کرد. محدودیت در توان عملیاتی (Inference capacity) اکنون به اصلیترین چالش برای گسترش این مدل تبدیل شده است.
⚡ پیشبینی میشود این فشار زیرساختی، تقاضا برای تراشههای هوش مصنوعی چینی، بهویژه محصولات Huawei را افزایش دهد. این موضوع نشاندهنده اهمیت حیاتی سختافزار در مقیاسپذیری مدلهای بزرگ است.
📊 تیم توسعهدهنده قصد دارد در فازهای بعدی ظرفیت خود را توسعه دهد و اشتراکها را مجدداً بازگشایی کند. در ساختار جدید، مدلهای اشتراکی به دو دسته عمومی و تخصصی برنامهنویسی تقسیم خواهند شد تا منابع پردازشی بهینهتر مدیریت شوند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#خبر #Kimi
❤1
🚀 جهش خیرهکننده مدلهای متنباز چینی
🚨 سرعت رشد مدلهای هوش مصنوعی Open-source به طرز باورنکردنی افزایش یافته است. در حال حاضر، آزمایشگاههای پیشرو چینی با سرعتی بیسابقه، مدلهایی در سطح جهانی ارائه میدهند که فاصله چندانی با مدلهای اختصاصی (Closed-source) ندارند.
🔬 مدلهای جدیدی مانند GLM-5.2 با عملکردی نزدیک به Opus، مدل Kimi K3 در سطح Fable و Qwen 3.8 Max با پارامترهای عظیم 2.4 تریلیونی منتشر شدهاند که نشاندهنده قدرت محاسباتی بالای این مجموعههاست.
#گزارش #Qwen
🚨 سرعت رشد مدلهای هوش مصنوعی Open-source به طرز باورنکردنی افزایش یافته است. در حال حاضر، آزمایشگاههای پیشرو چینی با سرعتی بیسابقه، مدلهایی در سطح جهانی ارائه میدهند که فاصله چندانی با مدلهای اختصاصی (Closed-source) ندارند.
🔬 مدلهای جدیدی مانند GLM-5.2 با عملکردی نزدیک به Opus، مدل Kimi K3 در سطح Fable و Qwen 3.8 Max با پارامترهای عظیم 2.4 تریلیونی منتشر شدهاند که نشاندهنده قدرت محاسباتی بالای این مجموعههاست.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#گزارش #Qwen
🤖 علت اصلی شکست عاملهای هوش مصنوعی
🧠 پژوهش جدید نشان میدهد شکست یک AI Agent (عامل هوشمند)، پیش از خطای مدل، در بافتار و محیط (Context) آن رخ میدهد. دستورالعمل مبهم، توصیف ضعیف ابزارها و حافظه کم از دلایل اصلی این امر هستند.
📊 بررسی روی ۳۰۰ تست نشان داد ساختاریافته کردن محیط، عملکرد مدلها را ارتقا میدهد. اطلاعات واقعیتر توهم (Hallucination) را کاهش داده و تعریف دقیقتر ابزارها، قابلیت Tool use را بهبود میبخشد.
⚠ ️ البته محافظت بیش از حد (Guardrails) عاملها را بیش از حد محتاط میکند. پس پیش از تغییر مدل، پرامپت، ابزارها و حافظه سیستم را بررسی کنید.
🔗 مقاله در arXiv
#پژوهش #AgentAI
🧠 پژوهش جدید نشان میدهد شکست یک AI Agent (عامل هوشمند)، پیش از خطای مدل، در بافتار و محیط (Context) آن رخ میدهد. دستورالعمل مبهم، توصیف ضعیف ابزارها و حافظه کم از دلایل اصلی این امر هستند.
📊 بررسی روی ۳۰۰ تست نشان داد ساختاریافته کردن محیط، عملکرد مدلها را ارتقا میدهد. اطلاعات واقعیتر توهم (Hallucination) را کاهش داده و تعریف دقیقتر ابزارها، قابلیت Tool use را بهبود میبخشد.
⚠ ️ البته محافظت بیش از حد (Guardrails) عاملها را بیش از حد محتاط میکند. پس پیش از تغییر مدل، پرامپت، ابزارها و حافظه سیستم را بررسی کنید.
🔗 مقاله در arXiv
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#پژوهش #AgentAI
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #65 | 📦 10 پست
🕐 یکشنبه 1405/04/28 ساعت 14:00 تا دوشنبه 1405/04/29 ساعت 14:00
🤖 مدلهای زبانی بزرگ
🦾 توسعه و تحلیل عاملهای هوشمند
🎓 ریاضیات و منابع آموزشی
⚡ زیرساخت و سختافزار
🗂 گزارش #65 | 📦 10 پست
🕐 یکشنبه 1405/04/28 ساعت 14:00 تا دوشنبه 1405/04/29 ساعت 14:00
🤖 مدلهای زبانی بزرگ
تحولات اخیر نشان میدهد مدل Grok 4.5 با کسب امتیاز Elo 1543 پیشتاز است، در حالی که مدلهای چینی مانند DeepSeek v4 Pro در ارزیابیها با بیش از ۲۰ درصد اختلاف عملکرد ضعیفتری ثبت کردهاند.
🔗 مشاهده پست
گزارشهای جدید نشان میدهند که شرکتهای آمریکایی اکنون به دلیل کارایی بالا، استفاده از مدلهای هوش مصنوعی چینی را به گزینههای بومی ترجیح میدهند.
🔗 مشاهده پست
مدلهای متنباز چینی با معرفی ابرمدلهایی چون Qwen 3.8 Max با ظرفیت ۲.۴ تریلیون پارامتر و مدل GLM-5.2 گامی بلند در جهت رقابت با مدلهای تجاری برداشتهاند.
🔗 مشاهده پست
🦾 توسعه و تحلیل عاملهای هوشمند
پلتفرم معروف Hugging Face هدف یک حمله سایبری پیچیده توسط سیستمهای خودمختار یا همان عاملهای هوشمند (AI Agents) مهاجم قرار گرفت که با نفوذ به ماشینهای مجازی به دادههای داخلی دسترسی یافتند.
🔗 مشاهده پست
آزمایشگاه TIGER-AI فریمورک متنباز OpenResearcher را برای آموزش عوامل تحقیقات عمیق ارایه داد که بر پایه ۹۶ هزار مسیر پژوهشی فرآیند جستجو و استدلال چندمرحلهای را شبیهسازی میکند.
🔗 مشاهده پست
ابزار AgentField با کسب بیش از ۲.۴ هزار ستاره گیتهاب، توابع پایتون را به REST API تبدیل کرده و فرآیند مدیریت و استقرار ایجنتها را در محیط Production تسهیل میکند.
🔗 مشاهده پست
پژوهشهای جدید نشان میدهد دلیل اصلی شکست عاملهای هوشمند، قبل از خطای مدل، در ضعف بافتار (Context)، پرامپتهای مبهم و تعریف ضعیف ابزارها نهفته است.
🔗 مشاهده پست
🎓 ریاضیات و منابع آموزشی
کتاب جامع Basic Algebra اثر Anthony Knapp در بیش از ۷۰۰ صفحه، مفاهیم پایهای جبر خطی، ماتریسها، تانسورها و جبر کاربردی در مدلسازی را به شکلی دقیق آموزش میدهد.
🔗 مشاهده پست
⚡ زیرساخت و سختافزار
سرویس هوش مصنوعی Kimi K3 به دلیل تقاضای بسیار بالا و فشار سنگین بر پردازندههای GPU، ثبتنام کاربران جدید را موقت متوقف کرد که این امر نشاندهنده اهمیت حیاتی سختافزار در مقیاسپذیری است.
🔗 مشاهده پست
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 مقایسه مدلهای هوش مصنوعی در ساخت پروژههای سهبعدی
🤖 اخیراً شاهد یک رقابت جدی در حوزه تولید محتوای ۳بعدی میان مدلهای Claude Fable 5 و Kimi K3 هستیم. توسعهدهندگان با استفاده از این مدلها، ابزارهای پیشرفتهای برای انتخاب صندلی در استادیومهای ورزشی یا کنسرتها ساختهاند که دید دقیق و واقعی از جایگاه کاربر را پیش از خرید بلیت ارائه میدهد.
📊 این فناوری با جایگزینی نقشههای دوبعدی و ایستا، تجربه کاربری را در پلتفرمهای فروش بلیت متحول میکند. از سینماها گرفته تا زمینهای کریکت و مسابقات ویمبلدون، این ابزارها امکان مشاهده فضای سهبعدی محیط را فراهم کردهاند.
#Claude_Fable5 #Kimi_K3
🤖 اخیراً شاهد یک رقابت جدی در حوزه تولید محتوای ۳بعدی میان مدلهای Claude Fable 5 و Kimi K3 هستیم. توسعهدهندگان با استفاده از این مدلها، ابزارهای پیشرفتهای برای انتخاب صندلی در استادیومهای ورزشی یا کنسرتها ساختهاند که دید دقیق و واقعی از جایگاه کاربر را پیش از خرید بلیت ارائه میدهد.
📊 این فناوری با جایگزینی نقشههای دوبعدی و ایستا، تجربه کاربری را در پلتفرمهای فروش بلیت متحول میکند. از سینماها گرفته تا زمینهای کریکت و مسابقات ویمبلدون، این ابزارها امکان مشاهده فضای سهبعدی محیط را فراهم کردهاند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Claude_Fable5 #Kimi_K3
💡 ۹ ترفند کلیدی برای بهبود پرامپتنویسی
🧠 برای دریافت نتایج دقیقتر از مدلهای هوش مصنوعی، به این ۹ استراتژی کاربردی توجه کنید. شفافیت در دستورالعملها و ارائه زمینه (Context) کافی، اولین گام برای رسیدن به خروجی مطلوب است.
⚡ از تکنیک Few-Shot Prompting (ارائه چند مثال نمونه) استفاده کنید تا مدل الگوهای مدنظر شما را بهتر درک کند. همچنین تعیین نقش (Persona) برای هوش مصنوعی به خروجی نهایی لحن و دقت تخصصیتری میبخشد.
🚀 درخواستهای پیچیده را به مراحل کوچکتر تقسیم کنید تا احتمال بروز خطای منطقی کاهش یابد. به یاد داشته باشید که تکرار و بازخورد گرفتن از مدل، یکی از بهترین روشها برای بهینهسازی پاسخ نهایی است.
🧩 مشخص کردن فرمت خروجی، مثلاً درخواست جدول یا کد اجرایی، به ساختاریافتهتر شدن پاسخ کمک شایانی میکند. همیشه سعی کنید محدودیتهای موردنظر خود را بهصورت صریح و منفی (مثلاً: بدون استفاده از اصطلاحات سخت) بیان کنید.
#Few_Shot_Prompting #پرامپت_نویسی
🧠 برای دریافت نتایج دقیقتر از مدلهای هوش مصنوعی، به این ۹ استراتژی کاربردی توجه کنید. شفافیت در دستورالعملها و ارائه زمینه (Context) کافی، اولین گام برای رسیدن به خروجی مطلوب است.
⚡ از تکنیک Few-Shot Prompting (ارائه چند مثال نمونه) استفاده کنید تا مدل الگوهای مدنظر شما را بهتر درک کند. همچنین تعیین نقش (Persona) برای هوش مصنوعی به خروجی نهایی لحن و دقت تخصصیتری میبخشد.
🚀 درخواستهای پیچیده را به مراحل کوچکتر تقسیم کنید تا احتمال بروز خطای منطقی کاهش یابد. به یاد داشته باشید که تکرار و بازخورد گرفتن از مدل، یکی از بهترین روشها برای بهینهسازی پاسخ نهایی است.
🧩 مشخص کردن فرمت خروجی، مثلاً درخواست جدول یا کد اجرایی، به ساختاریافتهتر شدن پاسخ کمک شایانی میکند. همیشه سعی کنید محدودیتهای موردنظر خود را بهصورت صریح و منفی (مثلاً: بدون استفاده از اصطلاحات سخت) بیان کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Few_Shot_Prompting #پرامپت_نویسی
🚀 تحلیل پرفورمنس مدل Kimi K3 در برنامهنویسی
🔬 بررسی نتایج جدید در benchmark اختصاصی «vibe coding» نشان میدهد که مدل Kimi K3 به نقطه عطف مهمی در دنیای هوش مصنوعی رسیده است. این بنچمارک توانایی مدلها در ساخت و استقرار کامل اپلیکیشنهای وب را میسنجد.
⚡ برای نخستین بار در تاریخ، یک مدل با دسترسی باز (open-weight) موفق شده است مدلهای پیشرو OpenAI و Anthropic را پشت سر بگذارد. تا پیش از این، مدلهای متنباز صرفاً گزینههایی جالب بودند و توان رقابت با غولهای آمریکایی را نداشتند.
📈 در تحلیل روند پیشرفت، نرخ بهبود یا Slope اهمیت حیاتی دارد. مدل Kimi K3 توانسته است امتیاز خود را از ۱۷.۵٪ به ۸۵.۰٪ در عرض ۵.۵ ماه ارتقا دهد؛ یعنی نرخ رشد خیرهکننده ۱۲ امتیاز در هر ماه.
🧠 این در حالی است که مدلهای سری GPT در بازه مشابه، با شیبی حدود ۷.۱ امتیاز در ماه رشد کردهاند. نکته کلیدی دیگر، بهرهوری توکن (token efficiency) است که در K3 بسیار بهینهتر از رقبا ارزیابی شده است.
#Kimi_K3 #vibe_coding
🔬 بررسی نتایج جدید در benchmark اختصاصی «vibe coding» نشان میدهد که مدل Kimi K3 به نقطه عطف مهمی در دنیای هوش مصنوعی رسیده است. این بنچمارک توانایی مدلها در ساخت و استقرار کامل اپلیکیشنهای وب را میسنجد.
⚡ برای نخستین بار در تاریخ، یک مدل با دسترسی باز (open-weight) موفق شده است مدلهای پیشرو OpenAI و Anthropic را پشت سر بگذارد. تا پیش از این، مدلهای متنباز صرفاً گزینههایی جالب بودند و توان رقابت با غولهای آمریکایی را نداشتند.
📈 در تحلیل روند پیشرفت، نرخ بهبود یا Slope اهمیت حیاتی دارد. مدل Kimi K3 توانسته است امتیاز خود را از ۱۷.۵٪ به ۸۵.۰٪ در عرض ۵.۵ ماه ارتقا دهد؛ یعنی نرخ رشد خیرهکننده ۱۲ امتیاز در هر ماه.
🧠 این در حالی است که مدلهای سری GPT در بازه مشابه، با شیبی حدود ۷.۱ امتیاز در ماه رشد کردهاند. نکته کلیدی دیگر، بهرهوری توکن (token efficiency) است که در K3 بسیار بهینهتر از رقبا ارزیابی شده است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Kimi_K3 #vibe_coding
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 ارزیابی مدل Kimi-k3 در برابر مدلهای Frontier
⚡ بررسی عملکرد مدل جدید Kimi-k3 نشان میدهد که اگرچه این مدل در تلاش برای نزدیکی به استانداردهای مدلهای برتر (Frontier) است، اما در سناریوهای عملیاتی چالشهای جدی دارد. تست انجام شده شامل طراحی یک Chain Reaction Machine (ماشین واکنش زنجیرهای) با آزادی عمل کامل در پیادهسازی بود.
🧠 در مقایسه با مدل GPT-5.6، این ابزار با مشکلات جدی در بهرهوری روبروست. مدل GPT-5.6 در نسخه Codex با هزینه 4.53 دلار و در زمان 25 دقیقه، و نسخه Max آن با هزینه 1.71 دلار در مدت 15 دقیقه، موفق به تکمیل تسک شد.
🔬 در مقابل، مدل Kimi-k3 با استفاده از 10 میلیون توکن ورودی و تولید 101 هزار توکن، عملکرد بسیار ضعیفتری نشان داد. فرآیند اجرای این مدل حدود 6 ساعت به طول انجامید و به دلیل اتمام محدودیتهای زمانی و نیاز مکرر به دستور Continue، متوقف شد.
📊 هزینه تخمینی برای Kimi-k3 معادل 4.18 دلار برآورد شد .
#Kimi_k3 #Chain_Reaction_Machine
⚡ بررسی عملکرد مدل جدید Kimi-k3 نشان میدهد که اگرچه این مدل در تلاش برای نزدیکی به استانداردهای مدلهای برتر (Frontier) است، اما در سناریوهای عملیاتی چالشهای جدی دارد. تست انجام شده شامل طراحی یک Chain Reaction Machine (ماشین واکنش زنجیرهای) با آزادی عمل کامل در پیادهسازی بود.
🧠 در مقایسه با مدل GPT-5.6، این ابزار با مشکلات جدی در بهرهوری روبروست. مدل GPT-5.6 در نسخه Codex با هزینه 4.53 دلار و در زمان 25 دقیقه، و نسخه Max آن با هزینه 1.71 دلار در مدت 15 دقیقه، موفق به تکمیل تسک شد.
🔬 در مقابل، مدل Kimi-k3 با استفاده از 10 میلیون توکن ورودی و تولید 101 هزار توکن، عملکرد بسیار ضعیفتری نشان داد. فرآیند اجرای این مدل حدود 6 ساعت به طول انجامید و به دلیل اتمام محدودیتهای زمانی و نیاز مکرر به دستور Continue، متوقف شد.
📊 هزینه تخمینی برای Kimi-k3 معادل 4.18 دلار برآورد شد .
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Kimi_k3 #Chain_Reaction_Machine
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 رونمایی از ربات انساننمای GENE.01
🤖 استارتاپ ایتالیایی Generative Bionics تنها در مدت ۶ ماه موفق به توسعه پلتفرم رباتیک GENE.01 شده است. این ربات انساننمای کاربردی میتواند به راحتی راه برود، محیط خود را درک کند و با آن تعامل داشته باشد.
🔬 این ربات به پوست چندوجهی تمامبدن مجهز شده است که توانایی حس کردن لمس، مجاورت، نیرو و دما را دارد. این فناوری هوشمند گامی بزرگ برای نزدیکتر کردن هوش مصنوعی فیزیکی (تعامل سیستمهای هوشمند با دنیای مادی) به همکاری ایمن و طبیعی با انسانها به شمار میرود.
🚀 برای آشنایی بیشتر با جزئیات فنی این ربات میتوانید به وبسایت رسمی پروژه مراجعه کنید.
🤖 استارتاپ ایتالیایی Generative Bionics تنها در مدت ۶ ماه موفق به توسعه پلتفرم رباتیک GENE.01 شده است. این ربات انساننمای کاربردی میتواند به راحتی راه برود، محیط خود را درک کند و با آن تعامل داشته باشد.
🔬 این ربات به پوست چندوجهی تمامبدن مجهز شده است که توانایی حس کردن لمس، مجاورت، نیرو و دما را دارد. این فناوری هوشمند گامی بزرگ برای نزدیکتر کردن هوش مصنوعی فیزیکی (تعامل سیستمهای هوشمند با دنیای مادی) به همکاری ایمن و طبیعی با انسانها به شمار میرود.
🚀 برای آشنایی بیشتر با جزئیات فنی این ربات میتوانید به وبسایت رسمی پروژه مراجعه کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🤖 پیادهسازی کلون SQLite با Rust توسط ارتش عوامل هوش مصنوعی
🚀 شرکت Cursor اخیراً دست به یک آزمایش شگفتانگیز زده است؛ این شرکت به گروهی از عوامل هوش مصنوعی (AI Agents - برنامههای خودمختاری که وظایف پیچیده را مستقل انجام میدهند) تنها یک سند رسمی ۸۳۵ صفحهای از SQLite داد و از آنها خواست بدون دسترسی به اینترنت و کدهای آماده، یک موتور پایگاه داده را از صفر به زبان Rust بنویسند.
📊 شگفتانگیز این که تنها پس از ۴ ساعت، سیستمهای طراحی شده توانستند ۷۳ تا ۸۵ درصد از آزمونهای ارزیابی مخفی را با موفقیت پشت سر بگذارند و در ادامه کار، برخی از تیمها حتی به دقت ۱۰۰ درصدی رسیدند.
⚡️ این آزمایش نشان داد هوش مصنوعی نه تنها در چند ساعت قادر به ساخت سیستمهای مهندسی پیشرفته است، بلکه به نظر میرسد چالشهای تیمی و حتی ترس از مسئولیتپذیری را نیز به طور خودکار شبیهسازی کرده است!
🔗 جزئیات فنی و اقتصادی بیشتر را در وبلاگ رسمی Cursor مطالعه کنید.
#SQLite #Cursor_Composer
🚀 شرکت Cursor اخیراً دست به یک آزمایش شگفتانگیز زده است؛ این شرکت به گروهی از عوامل هوش مصنوعی (AI Agents - برنامههای خودمختاری که وظایف پیچیده را مستقل انجام میدهند) تنها یک سند رسمی ۸۳۵ صفحهای از SQLite داد و از آنها خواست بدون دسترسی به اینترنت و کدهای آماده، یک موتور پایگاه داده را از صفر به زبان Rust بنویسند.
📊 شگفتانگیز این که تنها پس از ۴ ساعت، سیستمهای طراحی شده توانستند ۷۳ تا ۸۵ درصد از آزمونهای ارزیابی مخفی را با موفقیت پشت سر بگذارند و در ادامه کار، برخی از تیمها حتی به دقت ۱۰۰ درصدی رسیدند.
⚡️ این آزمایش نشان داد هوش مصنوعی نه تنها در چند ساعت قادر به ساخت سیستمهای مهندسی پیشرفته است، بلکه به نظر میرسد چالشهای تیمی و حتی ترس از مسئولیتپذیری را نیز به طور خودکار شبیهسازی کرده است!
🔗 جزئیات فنی و اقتصادی بیشتر را در وبلاگ رسمی Cursor مطالعه کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#SQLite #Cursor_Composer
🤖 معرفی Fugu-Cyber: ارکستراتور هوشمند برای امنیت سایبری
شرکت Sakana AI از مدل تخصصی جدید خود با نام Fugu-Cyber رونمایی کرد که برای تحلیل و حل چالشهای امنیت اطلاعات طراحی شده است. این سیستم با معماری نوآورانه خود، به عنوان یک مدل واحد عمل میکند اما در لایه داخلی، وظایف پیچیده را میان چندین AI Agent (عوامل هوشمند تخصصی) توزیع و مدیریت میکند.
📊 عملکرد این مدل در بنچمارکهای معتبر نتایج درخشانی ثبت کرده است
⚡️ توانمندی سیستم همتراز با مدلهای قدرتمندی همچون GPT-5.5-Cyber و Mythos Preview ارزیابی شده است. کاربران تنها با ارسال یک درخواست به API واحد، پردازشهای چندمرحلهای را به سیستم میسپارند تا مدیریت هوشمند بین ایجنتها بهصورت خودکار برقرار شود.
#Fugu_Cyber #CyberGym
شرکت Sakana AI از مدل تخصصی جدید خود با نام Fugu-Cyber رونمایی کرد که برای تحلیل و حل چالشهای امنیت اطلاعات طراحی شده است. این سیستم با معماری نوآورانه خود، به عنوان یک مدل واحد عمل میکند اما در لایه داخلی، وظایف پیچیده را میان چندین AI Agent (عوامل هوشمند تخصصی) توزیع و مدیریت میکند.
📊 عملکرد این مدل در بنچمارکهای معتبر نتایج درخشانی ثبت کرده است
🔹 CyberGym: دستیابی به موفقیت ۸۶.۹٪ در شناسایی و تایید آسیبپذیریهای پیچیده کد.
🔹 CTI-REALM: کسب نرخ موفقیت ۷۲.۱٪ در تبدیل گزارشهای تهدید به قوانین عملیاتی شناسایی.
⚡️ توانمندی سیستم همتراز با مدلهای قدرتمندی همچون GPT-5.5-Cyber و Mythos Preview ارزیابی شده است. کاربران تنها با ارسال یک درخواست به API واحد، پردازشهای چندمرحلهای را به سیستم میسپارند تا مدیریت هوشمند بین ایجنتها بهصورت خودکار برقرار شود.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Fugu_Cyber #CyberGym
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 ابزار جدید Unity برای توسعه بازی با AI
🚀 شرکت یونیتی بهتازگی از Unity CLI رونمایی کرده است؛ ابزاری قدرتمند که به ایجنتهای هوش مصنوعی اجازه میدهد مستقیماً با پروژههای بازیسازی تعامل داشته باشند. این رابط خط فرمان، عملاً نقش یک توسعهدهنده هوشمند را ایفا میکند تا فرآیند تولید نرمافزار را بهینهتر کند.
🧩 ایجنتها با استفاده از این ابزار میتوانند در صحنهها تغییرات ایجاد کنند، کامپوننتها را ویرایش کرده و باگها را شناسایی یا رفع کنند. قابلیت کلیدی این سیستم، توانایی اجرای خودکار بیلد (Build) پروژه و اعتبارسنجیِ اصلاحات انجامشده توسط مدل است که باعث اطمینان از خروجی نهایی میشود.
🧠 در یک دمو، ایجنت توانست بهصورت خودکار مشکل فرو رفتن کاراکتر در زمین را حل کند. این مدل با شناسایی یک Collider غیرفعال، آن را اصلاح کرده و پس از تست، از رفع کامل باگ اطمینان حاصل کرد. تمام این مراحل از دریافت گزارش خطا تا استقرار نهایی، از طریق ترمینال انجام شد.
#Unity_CLI #Collider
🚀 شرکت یونیتی بهتازگی از Unity CLI رونمایی کرده است؛ ابزاری قدرتمند که به ایجنتهای هوش مصنوعی اجازه میدهد مستقیماً با پروژههای بازیسازی تعامل داشته باشند. این رابط خط فرمان، عملاً نقش یک توسعهدهنده هوشمند را ایفا میکند تا فرآیند تولید نرمافزار را بهینهتر کند.
🧩 ایجنتها با استفاده از این ابزار میتوانند در صحنهها تغییرات ایجاد کنند، کامپوننتها را ویرایش کرده و باگها را شناسایی یا رفع کنند. قابلیت کلیدی این سیستم، توانایی اجرای خودکار بیلد (Build) پروژه و اعتبارسنجیِ اصلاحات انجامشده توسط مدل است که باعث اطمینان از خروجی نهایی میشود.
🧠 در یک دمو، ایجنت توانست بهصورت خودکار مشکل فرو رفتن کاراکتر در زمین را حل کند. این مدل با شناسایی یک Collider غیرفعال، آن را اصلاح کرده و پس از تست، از رفع کامل باگ اطمینان حاصل کرد. تمام این مراحل از دریافت گزارش خطا تا استقرار نهایی، از طریق ترمینال انجام شد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Unity_CLI #Collider
📊 راهنمای جامع انتخاب متریک ارزیابی مدل
انتخاب متریک ارزیابی مناسب، مستقیماً به ماهیت مسئله و هزینه خطاهای احتمالی شما بستگی دارد. هیچ متریک واحدی برای تمام سناریوها ایدهآل نیست و باید بر اساس اولویت بین Precision (دقت در پیشبینی مثبتها) و Recall (پوشش موارد واقعی) تصمیم بگیرید.
🧠 درک تفاوت این متریکها برای بهینهسازی مدل بسیار مهم است.
#Precision_Recall #F1_Score
انتخاب متریک ارزیابی مناسب، مستقیماً به ماهیت مسئله و هزینه خطاهای احتمالی شما بستگی دارد. هیچ متریک واحدی برای تمام سناریوها ایدهآل نیست و باید بر اساس اولویت بین Precision (دقت در پیشبینی مثبتها) و Recall (پوشش موارد واقعی) تصمیم بگیرید.
🔹 اسپم ایمیل و تشخیص چهره: اولویت با Precision برای به حداقل رساندن False Positives (مثبتهای کاذب) است.
🔹 تشخیص سرطان و عیوب تولید: تمرکز روی Recall برای کاهش False Negatives (منفیهای کاذب) حیاتی است.
🔹 کلاهبرداری بانکی و ریزش مشتری: استفاده از F1 Score برای ایجاد تعادل بهینه بین دقت و پوشش ضروری است.
🔹 پیشبینی قبولی دانشآموزان: به دلیل توازن کلاسها، متریک Accuracy (صحت کلی) معیار مناسبی خواهد بود.
🧠 درک تفاوت این متریکها برای بهینهسازی مدل بسیار مهم است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Precision_Recall #F1_Score
🇨🇳 پایان دوران مدلهای متنباز چینی
دولت چین در حال بررسی اعمال محدودیتهای سختگیرانه بر صادرات مدلهای هوش مصنوعی و تراشههای پیشرفته است. گزارشها حاکی از آن است که پکن در حال رایزنی با غولهای فناوری نظیر Alibaba، ByteDance و Zhipu پیرامون محدودسازی خروج دادههای آموزشی و دسترسی خارجی به وزنهای (Weights) مدلهای قدرتمند است.
🔬 پیش از این، رویکرد «متنباز» در چین ابزاری استراتژیک برای رقابت با مدلهای غربی بود. اما با ظهور مدلهای پیشرویی نظیر Kimi K3 با 2.8T پارامتر که به عملکردی نزدیک به سیستمهای آمریکایی دست یافتهاند، نگرش پکن تغییر کرده و اکنون این مدلها را به عنوان داراییهای راهبردی و امنیتی طبقهبندی میکند.
🚀 محدودیتهای آتی صرفاً محدود به مدلها نیست و صنایع سختافزاری را نیز هدف قرار میدهد. پکن در تلاش است تا با ایجاد سدهایی در برابر تولید تراشههای پیشرفته بر اساس طراحیهای داخلی، مانع از انتقال فناوری به شرکتهایی نظیر Qualcomm یا TSMC شود.
🔗 reuters.com
#Kimi_K3 #Open_Weight
دولت چین در حال بررسی اعمال محدودیتهای سختگیرانه بر صادرات مدلهای هوش مصنوعی و تراشههای پیشرفته است. گزارشها حاکی از آن است که پکن در حال رایزنی با غولهای فناوری نظیر Alibaba، ByteDance و Zhipu پیرامون محدودسازی خروج دادههای آموزشی و دسترسی خارجی به وزنهای (Weights) مدلهای قدرتمند است.
🔬 پیش از این، رویکرد «متنباز» در چین ابزاری استراتژیک برای رقابت با مدلهای غربی بود. اما با ظهور مدلهای پیشرویی نظیر Kimi K3 با 2.8T پارامتر که به عملکردی نزدیک به سیستمهای آمریکایی دست یافتهاند، نگرش پکن تغییر کرده و اکنون این مدلها را به عنوان داراییهای راهبردی و امنیتی طبقهبندی میکند.
🚀 محدودیتهای آتی صرفاً محدود به مدلها نیست و صنایع سختافزاری را نیز هدف قرار میدهد. پکن در تلاش است تا با ایجاد سدهایی در برابر تولید تراشههای پیشرفته بر اساس طراحیهای داخلی، مانع از انتقال فناوری به شرکتهایی نظیر Qualcomm یا TSMC شود.
🔗 reuters.com
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Kimi_K3 #Open_Weight
🚀 پیشتازی مدل Qwen-Audio-3.0-TTS-Plus در دنیای صوت
شرکت علیبابا با معرفی مدل جدید Qwen-Audio-3.0-TTS-Plus، جایگاه نخست را در لیدربورد معتبر Artificial Analysis Speech Arena به خود اختصاص داده است. این مدلِ تبدیل متن به گفتار (TTS)، با ارائه طبیعی بودن بیشتر و لحن متناسب با زمینه، از رقبای قدرتمندی همچون Simba 3.2، Gemini 3.1 Flash TTS و Sonic 3.5 پیشی گرفته است.
🔬 در ارزیابیهای کیفی، این مدل با ثبت امتیاز Elo 1,236 از ۱,۳۰۵ حضور در آرنا، به صدر جدول صعود کرده است. اگرچه بازه اطمینان این مدل با Simba 3.2 همپوشانی دارد، اما عملکرد آن در بازتولید گفتار با کیفیت بالا، توجه بسیاری از متخصصان حوزه هوش مصنوعی را به خود جلب کرده است.
⚡ بررسی سرعت پردازش نشان میدهد که مدل علیبابا خروجی را با نرخ ۱۶ کاراکتر در ثانیه تولید میکند. این در حالی است که مدلهای Simba 3.2 با ۳۰.۲ کاراکتر، Gemini 3.1 Flash با ۲۷ کاراکتر و Sonic 3.5 با ۱۲۰ کاراکتر در ثانیه، سرعت پردازش بالاتری دارند.
#Qwen_Audio_3 #Speech_Arena
شرکت علیبابا با معرفی مدل جدید Qwen-Audio-3.0-TTS-Plus، جایگاه نخست را در لیدربورد معتبر Artificial Analysis Speech Arena به خود اختصاص داده است. این مدلِ تبدیل متن به گفتار (TTS)، با ارائه طبیعی بودن بیشتر و لحن متناسب با زمینه، از رقبای قدرتمندی همچون Simba 3.2، Gemini 3.1 Flash TTS و Sonic 3.5 پیشی گرفته است.
🔬 در ارزیابیهای کیفی، این مدل با ثبت امتیاز Elo 1,236 از ۱,۳۰۵ حضور در آرنا، به صدر جدول صعود کرده است. اگرچه بازه اطمینان این مدل با Simba 3.2 همپوشانی دارد، اما عملکرد آن در بازتولید گفتار با کیفیت بالا، توجه بسیاری از متخصصان حوزه هوش مصنوعی را به خود جلب کرده است.
⚡ بررسی سرعت پردازش نشان میدهد که مدل علیبابا خروجی را با نرخ ۱۶ کاراکتر در ثانیه تولید میکند. این در حالی است که مدلهای Simba 3.2 با ۳۰.۲ کاراکتر، Gemini 3.1 Flash با ۲۷ کاراکتر و Sonic 3.5 با ۱۲۰ کاراکتر در ثانیه، سرعت پردازش بالاتری دارند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Qwen_Audio_3 #Speech_Arena
🚀 پیشرفت چین در خودکفایی زیرساختهای هوش مصنوعی
🔬 شرکت چینی Z.ai (که پیشتر با نام Zhipu AI شناخته میشد) موفق به راهاندازی یک مرکز داده عظیم با توان ۱ گیگاوات شده است. نکته حائز اهمیت این پروژه، عدم استفاده از حتی یک تراشه شرکت Nvidia در این مرکز است.
⚡ این زیرساخت که هماکنون بخشی از آن عملیاتی شده، برای توسعه و آموزش مدلهای پیشرفته خانواده GLM به کار گرفته میشود. علاوه بر این مرکز، شرکت مذکور چندین کلاستر پردازشی مجزا را مدیریت میکند که هر کدام شامل بیش از ۱۰ هزار تراشه بومی است.
📊 این تحول نشان میدهد چین در حال ایجاد یک پلتفرم محاسباتی جایگزین برای کاهش وابستگی به شتابدهندههای آمریکایی است. هرچند هنوز اثبات نشده که عملکرد و اکوسیستم نرمافزاری تراشههای داخلی با محصولات انویدیا برابری میکند، اما این اقدام گامی استراتژیک در مسیر استقلال تکنولوژیک محسوب میشود.
🔗 گزارش بلومبرگ
#Z_ai #GLM_models
🔬 شرکت چینی Z.ai (که پیشتر با نام Zhipu AI شناخته میشد) موفق به راهاندازی یک مرکز داده عظیم با توان ۱ گیگاوات شده است. نکته حائز اهمیت این پروژه، عدم استفاده از حتی یک تراشه شرکت Nvidia در این مرکز است.
⚡ این زیرساخت که هماکنون بخشی از آن عملیاتی شده، برای توسعه و آموزش مدلهای پیشرفته خانواده GLM به کار گرفته میشود. علاوه بر این مرکز، شرکت مذکور چندین کلاستر پردازشی مجزا را مدیریت میکند که هر کدام شامل بیش از ۱۰ هزار تراشه بومی است.
📊 این تحول نشان میدهد چین در حال ایجاد یک پلتفرم محاسباتی جایگزین برای کاهش وابستگی به شتابدهندههای آمریکایی است. هرچند هنوز اثبات نشده که عملکرد و اکوسیستم نرمافزاری تراشههای داخلی با محصولات انویدیا برابری میکند، اما این اقدام گامی استراتژیک در مسیر استقلال تکنولوژیک محسوب میشود.
🔗 گزارش بلومبرگ
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Z_ai #GLM_models
❤1