ابزارها و کاربردهای هوش مصنوعی
4.85K subscribers
1.08K photos
779 videos
1.02K files
1.62K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
🩺 OpenEvidence
دستیار هوش مصنوعی برای پزشکان و کادر درمان

یک ابزار تخصصی برای پزشکان و کادر درمان که می‌تونید سؤال بالینی‌تون رو مطرح کنید تا با جست‌وجو در منابع و مقالات پزشکی، یک پاسخ خلاصه، مستند و قابل‌بررسی ارائه بده.
💊 همچنین می‌تونه اطلاعات مربوط به داروها، عوارض جانبی و تداخلات دارویی رو بررسی کنه و پاسخ‌ها رو همراه با منابع ارائه بده.
🔗 https://openevidence.com

#معرفی_سایت
Media is too big
VIEW IN TELEGRAM
🤖 OpenAI،
حالا GPT-Live-1 را به API آورد!

حالا مدل می‌تواند وسط صحبت شما گوش بدهد، مکث کند، حرفش را قطع کند یا مسیر گفتگو را تغییر دهد؛ بدون اینکه منتظر بماند شما کاملاً صحبتتان را تمام کنید. 🎙️

مدل GPT-Live-1 یک مدل Full-Duplex است؛ یعنی شنیدن و صحبت‌کردن را هم‌زمان مدیریت می‌کند و برای کارهای پیچیده‌تر می‌تواند وظایف را به مدل‌های بک‌اند مثل GPT-6 Astra واگذار کند.

🔹 مدیریت بهتر قطع‌کردن و مکث‌ها
🔹 عملکرد بهتر در محیط‌های پرسر‌وصدا
🔹 پشتیبانی از تماس‌های تلفنی
🔹 حفظ بهتر جریان مکالمه در جلسات طولانی
🔹 امکان کنترل لحن، سرعت و سبک صحبت

📊 در ارزیابی‌های OpenAI، GPT-Live در Full Duplex Bench حدود ۳۰ واحد درصد بالاتر از GPT-Realtime-2.1 امتیاز گرفته است.

💰 قیمت API: فقط ۰.۰۵ دلار به‌ازای هر دقیقه برای لایه صوتی؛ هزینه مدل بک‌اند و ابزارها جداگانه محاسبه می‌شود.

به‌نظر می‌رسه نسل جدید دستیارهای صوتی دیگه قرار نیست فقط «نوبتی» با ما صحبت کنن. 👀
❤1
🤖 Google،
مدل Gemini را به ویندوز آورد! 💻

اپلیکیشن دسکتاپ Gemini حالا روی Windows 10 و 11 اجرا می‌شود و می‌توانید با میانبر Alt + Space آن را روی اسناد و سایر برنامه‌ها باز کنید.

🔹 اتصال به Gmail و Google Drive
🔹 پشتیبانی از Gemini Spark برای انجام کارهای چندمرحله‌ای
🔹 تولید تصویر و ویدیو
🔹 دسترسی سریع از روی محیط ویندوز

البته مثل همیشه، پاسخ‌های Gemini را باید قبل از استفاده برای کارهای مهم بررسی و راستی‌آزمایی کرد. 🔍

به‌نظرتون Gemini روی ویندوز می‌تونه تبدیل به یکی از ابزارهای اصلی کار روزمره بشه؟ 👀
Media is too big
VIEW IN TELEGRAM
🔍شرکت Google قابلیت استدلال در پس‌زمینه را به Gemini Live اضافه کرد! 🤖

حالا Gemini 3.8 Live می‌تواند هم‌زمان با ادامه‌ی مکالمه صوتی، در پس‌زمینه سراغ ابزارها برود و کارهای چندمرحله‌ای را از طریق API انجام دهد؛ بدون اینکه جریان گفتگو متوقف شود. 🎙️

🔹 پردازش تصاویر تقریباً به‌صورت لحظه‌ای
🔹 پشتیبانی از جابه‌جایی بین ۹۷ زبان در طول مکالمه
🔹 اجرای هم‌زمان ابزارها و وظایف چندمرحله‌ای
🔹 نسخه Extended Thinking برای درخواست‌های پیچیده‌تر صوتی

📊 در ارزیابی‌های اعلام‌شده، نسخه Extended Thinking امتیاز 82.6 را در Speech to Speech Quality Index و 97.7٪ را در Big Bench Audio کسب کرده است.

این مدل‌ها حالا در Gemini API و Google AI Studio در دسترس هستند و نسخه Extended Thinking به Gemini Live و برخی سرویس‌های Google نیز راه پیدا کرده است.

یعنی Gemini می‌تونه در حالی که هنوز با شما حرف می‌زنه، پشت‌صحنه کارهای پیچیده رو هم انجام بده. 👀
مدل GPT-6 Astra یک پیام رادیویی ۱۰۸ ساله را رمزگشایی کرد! 📻

گزارش‌ها می‌گویند GPT-6 Astra موفق شده یک پیام رادیویی رمزنگاری‌شده آلمانی از سال ۱۹۱۸ را رمزگشایی کند؛ پیامی که ظاهراً تا امروز راه‌حل شناخته‌شده‌ای برای آن وجود نداشته است.

متن به‌دست‌آمده تقریباً این معنا را دارد:

««یک رزم‌ناو انگلیسی در ۲۴ام وارد سواستوپول شد؛ یک اسکادران متفقین نیز در ۲۶ام در پی آن می‌آید.»»

🔍 جالب‌تر اینکه Astra نتیجه را با اطلاعات تاریخی مقایسه کرده و به HMS Canterbury رسیده؛ لاگ کشتی نشان می‌دهد این رزم‌ناو در ۲۴ نوامبر ۱۹۱۸ وارد سواستوپول شده و در ۲۶ نوامبر نیز ورود یک اسکادران متفقین ثبت شده است.

یعنی مدل فقط یک متن احتمالی تولید نکرده؛ نتیجه رمزگشایی را با یک سند تاریخی مستقل تطبیق داده است.

البته این موضوع هنوز به معنی اثبات قطعی «اولین رمزگشایی» نیست و جزئیات روش و ادعای مستقل‌بودن نتیجه همچنان جای بررسی دارد.

اگر این نتیجه تأیید شود، یکی از نمونه‌های جالب استفاده از AI برای رمزگشایی و پژوهش تاریخی خواهد بود. 🧠📜
🔥2
🤖 دو سرویس ابری برای کارهای AI

🔹 Superserve.ai
بیشتر شبیه یک کامپیوتر ابری مخصوص AI Agentهاست؛ محیط لینوکس ایزوله می‌دهد که Agent می‌تواند داخلش کد اجرا کند، فایل بسازد، پکیج نصب کند و ابزارهای مختلف را اجرا کند.

🔹 Deepnote.com
بیشتر شبیه Google Colab پیشرفته است؛ برای اجرای Python، پروژه‌های AI، تحلیل داده و استفاده از GPUهای ابری مثل T4 و L4.

📌 خلاصه:
Superserve → کامپیوتر ابری برای Agent
Deepnote → محیط ابری برای Python و AI

هر دو برای اجرای پروژه‌های AI کاربرد دارند، ولی VPS معمولی مثل Hetzner یا Contabo نیستند.


رایگان بدون نیاز به کردیت کارت
#معرفی_سایت
#هوش_مصنوعی
This media is not supported in your browser
VIEW IN TELEGRAM
🔍 با AI Studio فقط توضیح بده چی می‌خوای؛ اپلیکیشنش رو تحویل بگیر! 🤖💻

حالا می‌تونی با توصیف متنی ساده، یک اپلیکیشن بسازی و هم‌زمان پیش‌نمایش زنده‌اش رو ببینی؛ همراه با کدی که می‌تونی ویرایشش کنی.

✨ قابلیت‌های کلیدی:

🔹 تبدیل متن به اپلیکیشن: ایده‌ات رو توضیح بده تا کد پروژه تولید بشه. پروژه‌های وب به‌طور پیش‌فرض از React و یک بک‌اند استفاده می‌کنن.

🔹 ویرایش با Annotation Mode: روی یک بخش از رابط کاربری کلیک کن و دقیقاً بگو چه تغییری می‌خوای؛ AI همون قسمت رو اصلاح می‌کنه.

🔹 ویرایش با چت یا کدنویسی مستقیم: می‌تونی تغییرات رو از طریق گفتگو ادامه بدی یا خودت کد رو دستی ویرایش کنی.

🔹 استفاده از پروژه‌های آماده: پروژه‌های گالری رو شخصی‌سازی کن و بعد با GitHub همگام‌سازی کن یا فایل‌ها رو به‌صورت محلی خروجی بگیر.

🚀 از یک ایده متنی تا یک رابط کاربری قابل اجرا؛ بدون اینکه همه‌چیز رو از صفر کدنویسی کنی.
🚀 Grok 4.7 منتشر شد!

نسخه جدید مدل هوش مصنوعی xAI با وعده‌ی بهبود قابل‌توجه عملکرد، بدون افزایش قیمت یا سرعت پاسخ‌گویی کمتر از راه رسیده است.

🔹 افزایش محسوس عملکرد نسبت به نسخه قبلی
🔹 حفظ قیمت و سرعت
🔹 تغییر احتمالی در برنامه‌های آموزشی مدل

ایلان ماسک پیش‌تر گفته بود که Grok 4.7 قرار است بر پایه‌ی یک پیش‌آموزش جدید با ۲.۱ تریلیون پارامتر ساخته شود؛ اما به‌نظر می‌رسد برنامه‌ها تغییر کرده‌اند.

👀 در همین حال، گفته می‌شود آموزش Grok 4.8 با ۲.۵ تریلیون پارامتر قرار بوده هفته گذشته تمام شود و احتمالاً مدل اکنون وارد مرحله‌ی RL (یادگیری تقویتی) شده است.

اگر این زمان‌بندی درست باشد، شاید فاصله زیادی تا اطلاعات بیشتر درباره نسل بعدی Grok نداشته باشیم!
🟢 OpenAI
احتمالاً مدل سایبری جدیدی معرفی می‌کند! 🛡️🤖

گزارش‌ها از آماده‌شدن یک مدل جدید و تخصصی OpenAI برای امنیت سایبری خبر می‌دهند؛ مدلی که قرار است برای کارهایی مثل پیدا کردن آسیب‌پذیری‌ها، بررسی کد و کمک به تیم‌های امنیتی استفاده شود.

شرکت OpenAI در حال حاضر برنامه Daybreak را برای ارائه دسترسی کنترل‌شده به قابلیت‌های پیشرفته سایبری اجرا می‌کند و مدل GPT-5.6-Cyber نیز در همین چارچوب وجود دارد.

🔹 تمرکز روی کشف و بررسی آسیب‌پذیری‌ها
🔹 کمک به تیم‌های دفاع سایبری
🔹 تحلیل کد و بررسی امنیتی
🔹 دسترسی کنترل‌شده برای کاربران و سازمان‌های تأییدشده

📅 با توجه به سرعت توسعه این بخش، احتمال معرفی نسل جدیدی از مدل‌های سایبری OpenAI در آینده نزدیک مطرح شده؛ اما جزئیات مربوط به نام GPT-6 Cyber و زمان دقیق معرفی هنوز به‌طور رسمی تأیید نشده است.

به‌نظر می‌رسد رقابت AI حالا فقط بر سر مدل‌های عمومی نیست؛ امنیت سایبری هم به یکی از مهم‌ترین میدان‌های رقابت تبدیل شده. 🔐
🤖 Gemini
حالا می‌تونه به‌جای شما با کسب‌وکارها تماس بگیره! 📞

گوگل قابلیت آزمایشی Call for Me را روی Pixel 11 معرفی کرده؛ قابلیتی که به Gemini اجازه می‌دهد برای انجام کارهای روزمره با کسب‌وکارها تماس بگیرد. این ویژگی فعلاً به‌صورت محدود در آمریکا در حال انتشار است.

مثلاً می‌تونه:

🔹 موجودی یک محصول را بررسی کند
🔹 برای رستوران یا خدمات مختلف رزرو انجام دهد
🔹 زمان یک قرار را تغییر دهد
🔹 از منوهای تلفنی عبور کند و در صف انتظار بماند

👀 در طول تماس هم می‌توانید رونوشت زنده مکالمه را ببینید و هر زمان خواستید با گزینه Take over کنترل تماس را خودتان در دست بگیرید.

فعلاً این قابلیت برای کاربران ۱۸ سال به بالا در آمریکا، روی Pixel 11 با سیم‌کارت آمریکایی و اشتراک Google AI و نسخه بتای Phone by Google ارائه می‌شود.

به‌نظر می‌رسه دستیارهای AI کم‌کم از «جواب دادن» عبور می‌کنن و وارد دنیای انجام واقعی کارها می‌شن. 🤯
📱 Meta
ابزارهای AI برای ساخت بازی را معرفی کرد! 🎮🤖

متا در Meta Connect 2026 از دو ابزار جدید به نام‌های Horizon Create و Horizon Studio رونمایی کرده؛ ابزارهایی که به شما اجازه می‌دهند فقط با توضیح متنی، ایده‌ی بازی‌تان را به یک بازی دوبعدی یا سه‌بعدی قابل اجرا تبدیل کنید.

🔹 Horizon Create:
یک اپلیکیشن موبایلی برای ساخت و تغییر بازی از طریق گوشی
🔹 Horizon Studio:
نسخه تحت وب با کنترل‌های دقیق‌تر، ویرایش بصری و مدیریت کامل‌تر پروژه
🔹 امکان تغییر محیط، شخصیت‌ها، سبک هنری و سیستم پیشرفت با دستورهای متنی
🔹 انتقال پروژه بین نسخه موبایل و وب بدون شروع دوباره
🔹 امکان انتشار بازی‌ها روی Horizon، Instagram و Facebook

حتی نیازی به موتور بازی‌سازی یا دانش کدنویسی ندارید؛ کافی است ایده‌تان را توضیح دهید و بعد بازی را مرحله‌به‌مرحله اصلاح و شخصی‌سازی کنید. 🚀

این دو ابزار فعلاً در مرحله Early Access هستند و متا برای دسترسی گسترده‌تر، فهرست انتظار راه‌اندازی کرده است.

🎮 به‌نظر می‌رسد ساخت بازی هم کم‌کم از «کدنویسی» به «توضیح دادن چیزی که می‌خواهی» نزدیک می‌شود.
Media is too big
VIEW IN TELEGRAM
🤖 گوگل آواتار زنده را به Gemini آورد! 👤✨

گوگل از قابلیت جدید Live Avatar برای Gemini 3.8 Live رونمایی کرده؛ قابلیتی که امکان گفت‌وگوی تقریباً لحظه‌ای با یک شخصیت هوش مصنوعی متحرک را فراهم می‌کند.

این آواتار هنگام صحبت کردن، حرکت لب‌ها و حالات چهره‌اش را با مکالمه هماهنگ می‌کند و از ۹۷ زبان پشتیبانی دارد. 🌍

🔹 مشاهده اطلاعات و محتوای مرتبط روی صفحه حین مکالمه
🔹 هماهنگی حرکات و حالات چهره با گفت‌وگو
🔹 پشتیبانی از ۹۷ زبان
🔹 امکان ساخت آواتارهای اختصاصی برای سازمان‌ها

گوگل می‌گوید این فناوری می‌تواند در خدمات مشتریان، آموزش و راهنمایی‌های تعاملی و سایر تجربه‌های دیجیتال استفاده شود.

👀 به‌نظر می‌رسد دستیارهای AI دارند از یک «چت‌بات متنی» به سمت شخصیت‌های دیجیتال قابل تعامل حرکت می‌کنند.
👗📱 گوگل فوتوز به کمد لباس هوشمند مجهز شد!

گوگل قابلیت Wardrobe را برای کاربران iOS و اندروید منتشر کرده؛ قابلیتی که با کمک هوش مصنوعی، لباس‌ها و اکسسوری‌های موجود در عکس‌های شما را شناسایی می‌کند و به یک کمد لباس مجازی تبدیل می‌کند. 🧥✨

حالا می‌توانید آیتم‌های مختلف را دسته‌بندی کنید و با ترکیب آن‌ها، استایل‌های متفاوت بسازید.

اما آپدیت‌های گوگل فوتوز به همین‌جا ختم نمی‌شود:

🔹 Redact:
محوکردن اطلاعات حساس در تصاویر
🔹 Markup
ویرایش دقیق‌تر و راحت‌تر عکس‌ها
🔹 Gemini Spark:
ویرایش تصاویر با استفاده از پرامپت
🔹 Moods:
فیلترهای جدید برای تغییر حال‌وهوای عکس‌ها
🔹 Remix:
اضافه‌شدن ۱۵ قالب جدید برای
خلاقیت بیشتر

به‌نظر می‌رسد گوگل فوتوز کم‌کم از یک گالری ساده به یک دستیار هوشمند برای مدیریت و ویرایش تصاویر تبدیل می‌شود. 🤖📸
This media is not supported in your browser
VIEW IN TELEGRAM
🌐⚡ هوش مصنوعی می‌تواند حمله به شبکه برق را ساده‌تر کند

متوسط سن نیروگاه‌های هسته‌ای آمریکا حدود ۴۴ سال است؛ یعنی بخش قابل‌توجهی از زیرساخت‌های انرژی این کشور در دورانی ساخته شده‌اند که تهدیدات سایبری امروز وجود نداشتند.

🔸 بسیاری از تجهیزات صنعتی قدیمی هستند و به‌روزرسانی آن‌ها آسان نیست. حتی برخی سازندگان تجهیزات از بازار خارج شده‌اند و سیستم‌های کنترل صنعتی ممکن است فقط هر چند ماه یا حتی سالی یک‌بار به‌روزرسانی شوند.

اما نگرانی اصلی کارشناسان، لزوماً عامل‌های هوش مصنوعی خودمختار نیستند؛ بلکه استفاده مهاجمان از مدل‌های مولد است.

🤖 یک مدل هوش مصنوعی می‌تواند به فردی که دانش محدودی از سیستم‌های صنعتی دارد، در درک مستندات فنی و پروتکل‌های پیچیده کمک کند و بخشی از موانع ورود به حملات سایبری را کاهش دهد.

در نهایت، خطر به افرادی برمی‌گردد که می‌توانند از AI برای آموزش یا هدایت حملات هدفمند علیه زیرساخت‌های حیاتی استفاده کنند.

⚠️ با قدیمی‌تر شدن زیرساخت‌ها و قدرتمندتر شدن AI، امنیت شبکه‌های انرژی اهمیت بیشتری پیدا می‌کند.
🌐 سفری به اعماق اینترنت

پایگاهی برای ورود امن و آگاهانه به دنیای دیپ‌وب
اگر به دیپ‌وب، دارک‌وب، امنیت سایبری یا حریم خصوصی آنلاین علاقه‌مند هستید،


DeepWeb.net

یکی از منابعی است که مطالب و اطلاعات مرتبط با این حوزه را ارائه می‌کند.

🔎 چی پیدا می‌کنید توی این سایت؟

• معرفی مارکت‌ها و انجمن‌های دارک‌وب
• راهنمای اتصال امن به شبکه‌ی Tor
• مقالات و آموزش‌های تخصصی درباره امنیت و ناشناس‌ماندن
• اخبار و تحلیل‌های روز درباره فضای سایبری
• معرفی سرورهای رایگان XMPP
🌐 لینک سایت:

https://deepweb.net/


🔍 برای جستجو در دارک‌نت می‌تونید از این دو موتور جستجو استفاده کنید:
Ahmia
http://juhanurmihxlp77nkq76byazcldy2hlmovfu2epvl5ankdibsot4csyd.onion/
DarkSearch
http://darkzqtmbdeauwq5mzcmgeeuhet42fhfjj4p5wbak3ofx2yqgecoeqyd.onion/
⚠️ توجه: برای دسترسی به آدرس‌های .onion باید از مرورگر Tor Browser استفاده کنید.
این مطلب به درخواست دوستانی منتشر شد که درباره نحوه ورود و آشنایی با اینترنت تاریک سؤال کرده بودند.

#onion #معرفی_سایت
🎬🤯 Claude Opus 5.5
بدون مدل ویدیویی انیمیشن می‌سازد!

یکی از قابلیت‌های جالب Claude Opus 5.5 این است که برای ساخت بعضی انیمیشن‌ها و موشن‌گرافیک‌ها، اصلاً به مدل ویدیویی نیاز ندارد!

این مدل می‌تواند با استفاده از JavaScript و فناوری‌های وب، انیمیشن‌های تعاملی و جلوه‌های بصری مختلفی را از صفر ایجاد کند؛ حتی در نمونه‌ای، موسیقی هم توسط خود مدل ساخته شده. 🎵✨

یعنی به‌جای تولید مستقیم یک فایل ویدیویی، Claude می‌تواند کد، حرکت، صدا و عناصر بصری را کنار هم قرار دهد و یک تجربه متحرک کامل بسازد. 🔥

این اتفاق نشان می‌دهد مدل‌های زبانی چقدر در تولید محتوای چندرسانه‌ای از طریق کدنویسی قدرتمندتر شده‌اند.