چرا هوش مصنوعی در شمردن حروف Strawberry گیج میشود؟
اگر از پیشرفتهترین مدلهای زبانی بپرسید در کلمه strawberry چند حرف r وجود دارد، احتمالاً اشتباه پاسخ میدهد! دلیلش این است که مدلها حروف را مانند انسان نمیبینند؛ آنها متن را به تکههایی به نام توکن (Token) خرد میکنند.
اگر از پیشرفتهترین مدلهای زبانی بپرسید در کلمه strawberry چند حرف r وجود دارد، احتمالاً اشتباه پاسخ میدهد! دلیلش این است که مدلها حروف را مانند انسان نمیبینند؛ آنها متن را به تکههایی به نام توکن (Token) خرد میکنند.
۳ نکته کلیدی درباره دیدگاه توکنایزر:در قسمت بعدی بررسی میکنیم مدلها چطور کلمات را توکنبهتوکن تولید میکنند و چرا راهی برای بازگشت و پاککردن کلمات اشتباه قبلی خود ندارند.
توکنایزرها قطعی هستند: کلمه ghost برای مدل ۱ توکن است، اما غلط املایی gohst به ۳ توکن مجزا خرد میشود g-oh-st.
مدل نمیتواند مکث کند: مدل امکان توقف و بررسی تکتک کاراکترها را ندارد و با سطح زیرتوکن (Sub-token) چالش جدی دارد.
تغییر حروف بزرگ/کوچک: عبارت strange new worlds شامل ۴ توکن است، اما نسخه بزرگ آن STRANGE NEW WORLDS به ۶ توکن کاملاً متفاوت تبدیل میشود!
توصیه مهم به توسعهدهندگان: پردازشهای سطح کاراکتر (مثل معکوسکردن رشته، شمارش حروف یا تطبیق Regex) را به مدل واگذار نکنید. این کارها را در کدنویسی سنتی Pre/Post-processing انجام دهید تا توان پردازشی مدل صرف مسأله اصلی شود.
فصل دوم، بخش دوم
کتاب Prompt Engineering for LLMs
🔥3❤1🍓1
معرفی Gemini Omni 1.1 Flash
این مدل مجموعه جدیدی از کنترلهای خلاقانه و قابلیتهای تولید ویدیو را برای توسعهدهندگان به ارمغان میآورد
- گسترش صحنهها برای روایتگویی طولانیتر
- مشخص کردن فریمهای اول و آخر
- پیشنویس ویدیوها به طور کارآمدتر در 360p
- ارتقای کیفیت تا رزولوشن 4K
- افزودن مراجع ویدیویی در ورودی چندوجهی خود
اکنون از طریق API جمینی و در AI Studio در دسترس است.
این مدل مجموعه جدیدی از کنترلهای خلاقانه و قابلیتهای تولید ویدیو را برای توسعهدهندگان به ارمغان میآورد
- گسترش صحنهها برای روایتگویی طولانیتر
- مشخص کردن فریمهای اول و آخر
- پیشنویس ویدیوها به طور کارآمدتر در 360p
- ارتقای کیفیت تا رزولوشن 4K
- افزودن مراجع ویدیویی در ورودی چندوجهی خود
اکنون از طریق API جمینی و در AI Studio در دسترس است.
❤🔥2❤2🔥1🐳1
Media is too big
VIEW IN TELEGRAM
سام آلتمن (مدیرعامل OpenAI):
شما دیگر نیازی به نوشتن پرامپت ندارید.
او در فقط ۳۸ دقیقه توضیح میدهد که چگونه از ChatGPT در سطحی استفاده کنیم که اکثر مردم حتی نمیتوانند تصور کنند.
این سخنرانیای است که او برای دانشجویان استنفورد ایراد کرده است. یک دوست دیشب ضبط آن را برایم فرستاد.
بعد از تماشای آن، فهمیدم که من فقط از حدود ۱۵٪ قابلیتهای واقعی این ابزار استفاده میکردم.
آن را کامل تماشا کنید و سپس راهنمای زیر را بخوانید که در مورد چگونگی ایجاد سیستمی است که خودش پرامپت تولید کند.
شما دیگر نیازی به نوشتن پرامپت ندارید.
او در فقط ۳۸ دقیقه توضیح میدهد که چگونه از ChatGPT در سطحی استفاده کنیم که اکثر مردم حتی نمیتوانند تصور کنند.
این سخنرانیای است که او برای دانشجویان استنفورد ایراد کرده است. یک دوست دیشب ضبط آن را برایم فرستاد.
بعد از تماشای آن، فهمیدم که من فقط از حدود ۱۵٪ قابلیتهای واقعی این ابزار استفاده میکردم.
آن را کامل تماشا کنید و سپس راهنمای زیر را بخوانید که در مورد چگونگی ایجاد سیستمی است که خودش پرامپت تولید کند.
❤🔥6👍1👎1🔥1
مایکروسافت یکی از بزرگترین بهروزرسانیهای ویندوز ۱۱ را منتشر کرد؛ با نوار وظیفه قابل جابجایی، جستجوی ویندوز بدون نتایج بینگ و مایکروسافت استور، و امکان سفارشیسازی منوی استارت!
این یکی از بزرگترین بهروزرسانیهای ویندوز در سال است و نشان میدهد مایکروسافت به بازخوردها گوش میدهد. ادامه دهید!
۱. نوار وظیفه: حالا میتوانید نوار وظیفه را به سمت بالا، راست یا چپ منتقل کنید، مشابه ویندوز ۱۰.علاوه بر این، اگر از نحوه تنظیم پویای منوی استارت خوشتان نمیآید، میتوانید آن را کوچکتر کنید.
همچنین میتوانید نوار وظیفه کوچکتری را فعال کنید که کل نوار وظیفه را کوچک میکند، نه فقط آیکونها، همانطور که قبلاً در ویندوز ۱۱ انجام میشد.
۲. حالا میتوانید نتایج بینگ و مایکروسافت استور را کاملاً در جستجوی ویندوز غیرفعال کنید، که آن را سریعتر و قابل اعتمادتر میکند.
۳. حالا میتوانید منوی استارت را سفارشی کنید، از جمله امکان حذف کامل فید پیشنهادی (که حالا به نام «حادثههای اخیر» نامیده میشود) و داشتن فقط برنامههای سنجاقشده یا لیست همه برنامهها. حالا امکان انتخاب اینکه کدام بخش ظاهر شود و پنهان کردن همه چیزهای دیگر وجود دارد.
این یکی از بزرگترین بهروزرسانیهای ویندوز در سال است و نشان میدهد مایکروسافت به بازخوردها گوش میدهد. ادامه دهید!
👍4❤1🐳1🤓1
Media is too big
VIEW IN TELEGRAM
آموزش جامع تولید ویدیوهای هوش مصنوعی بهصورت نامحدود و رایگان در مدت ۱۸ دقیقه
این ویدیو روش ساخت ویدیو با استفاده از Google Flow و King AI را بدون نیاز به پرداخت هزینه اعتبار معرفی میکند.همچنین، راهکارهای خودکارسازی کانال یوتیوب نیز در این آموزش تشریح شده است.
این ویدیو روش ساخت ویدیو با استفاده از Google Flow و King AI را بدون نیاز به پرداخت هزینه اعتبار معرفی میکند.همچنین، راهکارهای خودکارسازی کانال یوتیوب نیز در این آموزش تشریح شده است.
❤🔥3🔥1💯1
چرا هوش مصنوعی نمیتواند حرفش را پس بگیرد؟ (تولید توکن به توکن)
تا به حال به تایپ کردن خودکار کیبورد گوشی دقت کردهاید که بعد از هر کلمه، دکمه وسط را چند بار پشت سر هم میزنید تا جمله کامل شود؟ هوش مصنوعی دقیقاً به همین شیوه کار میکند!
مدلهای زبانی، متن را یکجا تولید نمیکنند؛ آنها سیستمهای خودبازگشتی (Autoregressive) هستند. یعنی در هر مرحله فقط یک توکن حدس میزنند، آن را به انتهای متن میچسبانند و دوباره کل متن را میخوانند تا توکن بعدی را پیدا کنند.
۳ پیامد مهم این ساختار برای توسعهدهندگان:
در قسمت بعدی بررسی میکنیم چطور با پارامتر Temperature خلاقیت مدل را تنظیم کنیم و چه زمانی بالا بردن این عدد، رفتار مدل را مثل یک فرد مست غیرقابل پیشبینی میکند!
تا به حال به تایپ کردن خودکار کیبورد گوشی دقت کردهاید که بعد از هر کلمه، دکمه وسط را چند بار پشت سر هم میزنید تا جمله کامل شود؟ هوش مصنوعی دقیقاً به همین شیوه کار میکند!
مدلهای زبانی، متن را یکجا تولید نمیکنند؛ آنها سیستمهای خودبازگشتی (Autoregressive) هستند. یعنی در هر مرحله فقط یک توکن حدس میزنند، آن را به انتهای متن میچسبانند و دوباره کل متن را میخوانند تا توکن بعدی را پیدا کنند.
۳ پیامد مهم این ساختار برای توسعهدهندگان:
۱. راه بازگشت وجود ندارد: انسان موقع نوشتن مکث میکند، فکر میکند و اشتباهش را پاک میکند. اما مدل به محض تولید یک توکن، به آن متعهد میشود و هیچ مکانیزمی برای Backtrack یا پاککردن کلمه قبلی ندارد.وظیفه ما به عنوان مهندس پرامپت: تشخیص خطا، تصحیح مسیر و بازگرداندن مدل به ریل اصلی، وظیفهای است که باید توسط کد و منطق برنامه شما مدیریت شود.
۲. لجاجت در اشتباه: اگر مدل در یک توکن مسیر اشتباهی برود، در مراحل بعدی تلاش میکند مسیر غلط قبلی را توجیه کند و ادامه دهد؛ چون متنهای آموزشدیدهٔ مدل هم معمولاً شامل «حرف پس گرفتن» نبودهاند.
۳. تله تکرار بیپایان: مدلها ممکن است در الگوهای ساختاری خودشان گیر کنند و شروع به تکرار بینهایت یک ساختار یا کلمه نمایند.
در قسمت بعدی بررسی میکنیم چطور با پارامتر Temperature خلاقیت مدل را تنظیم کنیم و چه زمانی بالا بردن این عدد، رفتار مدل را مثل یک فرد مست غیرقابل پیشبینی میکند!
فصل دوم، بخش سوم
کتاب Prompt Engineering for LLMs
👍5❤2❤🔥1🆒1
This media is not supported in your browser
VIEW IN TELEGRAM
من یک وبسایت پیدا کردم که بیش از ۱۰٬۰۰۰ پرامپت برای تولید تصاویر با Nano Banana، GPT Image 2 و دیگر مدلها دارد.اینها بر اساس سبکها، عکاسی، برندینگ و موارد دیگر سازماندهی شدهاند.
بهترین بخشش این است که میتوانی به صورت رایگان از آنها استفاده کنی و به راحتی آنها را با پروژههای خودت تطبیق دهی.
meigen.ai
meigen.ai
بهترین بخشش این است که میتوانی به صورت رایگان از آنها استفاده کنی و به راحتی آنها را با پروژههای خودت تطبیق دهی.
meigen.ai
meigen.ai
❤🔥2❤1🐳1
This media is not supported in your browser
VIEW IN TELEGRAM
سام آلتمن همین حالا ساختن کودکس برای شکست دادن کلود کد را مأموریت کامیکازه دیوانهوار نامید.
اوپنایآی خیلی عقب بود. هر کتاب راهنمایی میگفت بیخیال شو.بعد تیمش کاری کرد که او اسمش را بسیار نادر در تاریخ تجارت بگذارد
اوپنایآی خیلی عقب بود. هر کتاب راهنمایی میگفت بیخیال شو.بعد تیمش کاری کرد که او اسمش را بسیار نادر در تاریخ تجارت بگذارد
❤5🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
به یک انیمیشن خفن تفکر هوش مصنوعی برای وبسایت یا اپلیکیشنتان نیاز دارید؟ این را ذخیره کنید؛ Liquid Orb Editor را بررسی کنید. یک کره شیشهای مایع بلادرنگ ساختهشده با WebGPU که میتوانید هر جور بخواهید سفارشیسازی کنید. متنباز و رایگان.
lersent001.github.io
lersent001.github.io
❤🔥4🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
prompt:
Simply replace [SUBJECT] or upload your reference image:✨
“Extreme macro shot of woven cotton shirt fabric, empty at first. Colored embroidery threads rise from the surface and weave themselves into place, laying down tight satin stitches row by row, tracing out a detailed [SUBJECT]. The stitched area grows steadily across the frame, thread pulling taut and raising into dimensional embroidered texture, colors and defining features building up stitch by stitch until the full subject is complete and clearly recognizable. Camera holds steady, slow satisfying timelapse pace. Soft natural side light, shallow depth of field, visible fabric fibers and realistic thread sheen. No hands, thread moves on its own. One shot no scene change. 5 second video.”❤🔥1👍1🔥1
Media is too big
VIEW IN TELEGRAM
اندری کارپاتی هشت سال در OpenAI و تسلا کار کرد. هفته گذشته، او همهی آنچه میداند را در یک سخنرانی رایگان دو ساعته فشرده کرد:
Agents → Loops → Graphs → Self-Improving Systems
این سخنرانی از اکثر دورههای مهندسی هوش مصنوعی پولی بهتر است. احتمالاً الان دو ساعت وقت ندارید.
آن را تماشا کنید، سپس راهنمای زیر را بخوانید.
https://x.com/0xwhrrari/status/2093685107534000560
Agents → Loops → Graphs → Self-Improving Systems
این سخنرانی از اکثر دورههای مهندسی هوش مصنوعی پولی بهتر است. احتمالاً الان دو ساعت وقت ندارید.
آن را تماشا کنید، سپس راهنمای زیر را بخوانید.
https://x.com/0xwhrrari/status/2093685107534000560
❤5❤🔥1👍1🔥1🆒1
کلود فیبل ۵.۱ از امروز در همهجا در دسترس است. کلود میتوس ۵.۱، مدل ما برای مدافعان سایبری و دانشمندان علوم زیستی، از طریق برنامههای دسترسی مورد اعتماد در دسترس است.
بیشتر بخوانید: https://www.anthropic.com/claude-fable-and-mythos-5-1
بیشتر بخوانید: https://www.anthropic.com/claude-fable-and-mythos-5-1
Anthropic
Introducing Claude Fable 5.1 and Claude Mythos 5.1
Our most advanced models for coding and knowledge work. Their research capabilities also offer an early glimpse of how AI models will contribute to scientific progress.
❤🔥6🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
معرفی Google Pics 🎨
ایجاد تصاویر هوش مصنوعی دقیق و قدرتمند اکنون برای مشتریان Google Workspace و مشترکین Google AI Pro و Ultra در حال عرضه است.
ءGoogle Pics به شما اجازه میدهد اشیاء فردی را ویرایش کنید، متن را تصحیح یا ترجمه کنید، و با تیم خود همکاری کنید.
pics.new
ایجاد تصاویر هوش مصنوعی دقیق و قدرتمند اکنون برای مشتریان Google Workspace و مشترکین Google AI Pro و Ultra در حال عرضه است.
ءGoogle Pics به شما اجازه میدهد اشیاء فردی را ویرایش کنید، متن را تصحیح یا ترجمه کنید، و با تیم خود همکاری کنید.
pics.new
❤🔥3👨💻1
⚡ جمینی 3.8 فلش: هوشمندترین مدل کارکشته ما تا به امروز.
این مدل ارتقاهایی را در زمینه کدنویسی، جریانهای کاری عاملمحور، و استدلال چندمرحلهای حیاتی ارائه میدهد، در حالی که سرعت و هزینه پایین 3.7 فلش را حفظ میکند.
🛡️ جمینی 3.8 فلش سایبر: توانمندترین مدل امنیت سایبری ما، که عملکردی در سطح پیشرو در تشخیص آسیبپذیری و وصلهزنی خودکار ارائه میدهد.
جمینی 3.8 فلش با همان قیمت مقدماتی 3.7 فلش در دسترس است: 0.75 دلار به ازای هر میلیون توکن ورودی و 3.75 دلار به ازای هر میلیون توکن خروجی.
این مدل ارتقاهایی را در زمینه کدنویسی، جریانهای کاری عاملمحور، و استدلال چندمرحلهای حیاتی ارائه میدهد، در حالی که سرعت و هزینه پایین 3.7 فلش را حفظ میکند.
🛡️ جمینی 3.8 فلش سایبر: توانمندترین مدل امنیت سایبری ما، که عملکردی در سطح پیشرو در تشخیص آسیبپذیری و وصلهزنی خودکار ارائه میدهد.
جمینی 3.8 فلش با همان قیمت مقدماتی 3.7 فلش در دسترس است: 0.75 دلار به ازای هر میلیون توکن ورودی و 3.75 دلار به ازای هر میلیون توکن خروجی.
❤🔥2🔥2❤1👎1