خبر و ترفند روز

خبر و ترفند های روز را اینجا بخوانید!

این فضای کار رایگان برای مدل‌های زبانی، بساط چت‌بات‌هایم را مضحک جلوه داد

فضای کاری رایگان LLM که چیدمان چت‌بات من را مضحک جلوه داد
سرانجام فهمیدم راه رهایی از جابه‌جایی مداوم میان زبانه‌ها، یک برنامه رایگان دسکتاپی است.

سه زبانه مرورگر، یک پرسش که در هر سه چسبانده شده و کلی جابه‌جایی با Alt+Tab برای قاطی نکردن پاسخ‌ها. این روشی عادی برای مقایسه مدل‌های هوش مصنوعی است و خیلی‌ها چند چت‌بات رایگان را کنار هم می‌گذارند تا هرگز بابت یکی از آن‌ها پولی نپردازند.

Msty Studio همین کار را در یک پنجره انجام می‌دهد. چند مدل را با یک درخواست واحد به کار می‌گیرد، پاسخ‌ها را کنار هم می‌چیند و طرح رایگانش نیز همه نیازهای مرا پوشش می‌دهد. این مقایسه بیش از آنکه پاسخ‌های دریافتی‌ام را تغییر دهد، میزان اعتمادم به آن‌ها را دگرگون کرد.

امستی استودیو همه مدل‌ها را در یک پنجره گرد می‌آورد

هر بخش زمینه مستقل خود را نگه می‌دارد؛ و این مهم است

Msty Studio فضای کاری دسکتاپی از CloudStack است که از راه یک رابط واحد به مدل‌های محلی و ارائه‌دهندگان ابری دسترسی پیدا می‌کند. این برنامه روی Windows، macOS و Linux اجرا می‌شود و برای آغاز کار نیازی به ساخت حساب ندارد.

هنگام راه‌اندازی از مدل محلی پیشنهادی‌اش صرف‌نظر کردم، چون مدل‌های کوچک روی لپ‌تاپی میان‌رده آن‌قدر کند هستند که آدم را کلافه می‌کنند. در عوض، کلید OpenRouter را وارد کردم که با یک اعتبارنامه، دسترسی به ده‌ها ارائه‌دهنده را فراهم می‌کند. ابزارهای رایگان دیگری هم هستند که بدون اشتراک، هوش مصنوعی را روی رایانه شخصی اجرا می‌کنند و شماری از آن‌ها یک مدل را به‌خوبی به کار می‌اندازند؛ اما Msty Studio در مقایسه مدل‌ها بهتر است.

سه مدل از سه آزمایشگاه متفاوت افزودم: Google Gemma ۴ 31B، NVIDIA Nemotron ۳ Ultra و Z.ai GLM ۵.۲. قابلیت Split Chats برای هر مدل بخش و تاریخچه گفت‌وگوی جداگانه‌ای در نظر می‌گیرد؛ بنابراین هرکدام مستقل پاسخ می‌دهد و از خروجی دو مدل دیگر خبر ندارد.

این استقلال نکته‌ای جزئی نیست. ابتدا آزمون‌هایم را در یک رشته گفت‌وگوی واحد پیش بردم و پنل استدلال یکی از مدل‌ها آشکارا نشان داد که صرفاً برای ایجاد تنوع، پاسخی متفاوت از دفعه پیش برگزیده است. مدل به‌جای مخالفت واقعی، از تکرار دوری می‌کرد و من ممکن بود آن را به‌اشتباه اختلاف‌نظری جدی قلمداد کنم.

مطلب مرتبط:   من استفاده از ویجت‌ها روی پیکسل ۱۰ پرو را متوقف کردم — و دلم برایشان تنگ نمی‌شود.

مدل‌ها کجا هم‌نظرند و کجا راهشان جدا می‌شود

آنچه ارزش توجه دارد، اختلاف‌نظرهاست

پس یک پرسش یکسان را پیش روی هر سه گذاشتم.

برای خرید لپ‌تاپی ۶۰۰ دلاری با هدف نویسندگی، وب‌گردی و ویرایش سبک عکس چگونه هزینه کنیم؟ هر مدل باید در سه جمله می‌گفت چه چیزهایی در اولویت‌اند و از چه امکاناتی باید چشم پوشید.

هر سه درباره آنچه باید کنار گذاشت، هم‌نظر بودند: کارت گرافیک مجزا، بدنه فلزی گران‌قیمت و نمایشگر با نرخ نوسازی بالا. سه مدل از سه آزمایشگاه به یک پاسخ رسیدند و چنین توافقی را می‌توان نشانه معقولی دانست که تکلیف پرسش روشن است.

اما بر سر حافظه اختلاف پیدا کردند. GLM و Gemma هر دو 16GB را پیشنهاد دادند. Nemotron گفت 8GB کافی است و از دو مدل دیگر هم دقیق‌تر شد: یک لپ‌تاپ فوق‌سبک ۱۳ تا ۱۴ اینچی با Core i5 یا Ryzen ۵، حافظه SSD با ظرفیت 256GB و نمایشگر IPS با وضوح 1080p که به برآوردش با بودجه ۶۰۰ دلاری جور درمی‌آید.

این اختلاف در چنین بودجه‌ای مهم است، زیرا لپ‌تاپی با مشخصاتی که Nemotron توصیف کرد واقعاً در بازار پیدا می‌شود.

نسخه رایگان ChatGPT از پس بیشتر پرسش‌ها به‌خوبی برمی‌آید و امکاناتی را هم به دست آورده که پیش‌تر تنها با پرداخت اشتراک در دسترس بودند. محدودیت آن نه به کیفیت، بلکه به ساختارش بازمی‌گردد: یک مدل در یک رشته گفت‌وگو نمی‌تواند به شما بگوید که مدلی دیگر پاسخی متفاوت می‌داد.

پنل‌های اندیشه، مسیر رسیدن به پاسخ را نشان می‌دهند

یک مدل پیش از پاسخ دادن نظرش را عوض کرد

پنل استدلال GLM در Msty Studio پس از بازنگری مقدار حافظه به 16GB

پنل‌های استدلال از خود پاسخ‌ها جالب‌تر از کار درآمدند. GLM ابتدا پاسخ خود را بر پایه 8GB رم تنظیم کرد، اما سپس دست نگه داشت. در پنلش نوشته بود که 8GB برای ویرایش عکس کمی اندک است؛ بنابراین پیش از نهایی کردن پاسخ، این مقدار را به 16GB افزایش داد.

مطلب مرتبط:   مزایای واقعی یک مانیتور فوق‌عرض فقط پس از این‌که یکی را امتحان کردم برایم آشکار شد.

در پاسخ نهایی هیچ نشانه‌ای از این فرایند دیده نمی‌شود. اما با خواندن پنل درمی‌یابید که پیشنهاد 16GB نه برداشت نخست، بلکه حاصل بازنگری بوده است؛ نکته‌ای که وقتی مدلی دیگر به نتیجه‌ای کاملاً متفاوت رسیده، ارزش دانستن دارد.

این پنل‌ها همچنین نشان می‌دهند که شیوه کار مدل‌ها تا چه اندازه با یکدیگر فرق دارد. GLM چهارده ثانیه صرف کرد تا محدودیت‌ها و اولویت‌ها را به‌صورت شماره‌گذاری‌شده بررسی کند. Nemotron اندکی تأمل کرد و سه جمله نوشت. Gemma نیز هیچ بخشی از استدلالش را نمایش نداد و با سرعت ۱۹.۹۰ توکن در ثانیه پاسخ داد؛ در حالی که سرعت GLM به ۵۶.۸۵ توکن در ثانیه رسید.

پشته‌های دانش و مرزهای واقعی طرح رایگان

بیشتر امکانات دلخواهتان اینجاست؛ اما برخی قطعاً نیستند

پنل ساخت پشته دانش تازه در Msty Studio با کادرهای نگارش باز

پشته‌های دانش کار بازیابی اطلاعات را بر عهده می‌گیرند. می‌توانید سندها، پوشه‌ها یا یادداشت‌ها را بیفزایید، یک مدل تعبیه‌سازی برگزینید و پاسخ مدل‌ها را به‌جای اتکای صرف به داده‌های آموزشی، بر پایه محتوای خودتان دریافت کنید. وقتی یک سند را هم‌زمان در اختیار سه مدل می‌گذارید، هرکدام جنبه‌های متفاوتی از منبعی را برجسته می‌کنند که مهارش در دست خودتان است؛ درست همین‌جاست که راه‌اندازی یک هوش مصنوعی خصوصی و در دسترس همگان، معنا و ارزش بیشتری پیدا می‌کند.

Prompt Studio بسیار مهم‌تر از آن چیزی است که در نگاه نخست به نظر می‌رسد. اگر یک‌بار پرسش مقایسه‌ای خود را ذخیره کنید، همه آزمایش‌های بعدی با عبارتی کاملاً یکسان اجرا می‌شوند؛ و تنها همین یکسانی بیان است که پاسخ‌ها را واقعاً سنجش‌پذیر نگه می‌دارد. هم پشته‌های دانش و هم Prompt Studio در طرح رایگان در دسترس‌اند؛ در کنار گفت‌وگو با مدل‌های محلی و برخط، Split Chats، Agent Mode و استودیوهای Persona، Skill و Media.

مطلب مرتبط:   OnlyOffice فرم های قابل پر کردن را اضافه می کند که با Microsoft Office و Adobe سازگار است

Aurum سالانه ۱۴۹ دلار یا با پرداخت یک‌باره ۳۴۹ دلار هزینه دارد و امکانات Msty Studio Web، Turnstiles، Forge Mode، Insights و Live Contexts را می‌افزاید. البته مدل‌های رایگان نیز محدودیت‌های خودشان را دارند. OpenRouter تا پیش از خرید اعتبار، استفاده را به ۲۰ درخواست در دقیقه و ۵۰ درخواست در روز محدود می‌کند؛ افزون بر این، ارائه‌دهندگان ممکن است ظرفیت رایگان را بی‌هیچ هشداری پس بگیرند.

Gemma سه بار ناکام ماند تا اینکه کسری از یک سنت پرداختم و از راهی دیگر به همان مدل دسترسی پیدا کردم. مدل‌ها همچنین ممکن است بی‌سروصدا و پشت صحنه تغییر کنند؛ دلیلی دیگر برای اینکه همواره بیش از یک مدل را زیر نظر داشته باشیم.

مجوز رایگان Msty Studio استفاده شخصی و غیرتجاری را پوشش می‌دهد. برای کار حرفه‌ای و درآمدزا باید مجوز Aurum تهیه کنید.

حالا پرسش‌هایم را جور دیگری مطرح می‌کنم

یک پرسش، سه پاسخ و دلیلی برای اعتماد به یکی از آن‌ها

گام بعدی که از این فضای کاری می‌خواهم، مجموعه‌ای ثابت از پرسش‌هاست که هرگاه تصمیمی هزینه واقعی در پی دارد، آن‌ها را اجرا کنم؛ آن هم با تکیه بر پشته دانشی از منابع مرجع خودم، نه اینترنت آزاد. آماده‌سازی چنین سامانه‌ای یک آخر هفته زمان می‌برد، اما پس از آن هر مقایسه‌ای دقیق‌تر و سنجیده‌تر خواهد بود.

هرجا که یک پاسخ نادرست می‌تواند وقت یا پولتان را هدر دهد، ارزش دارد چند دقیقه برای فرستادن یک پرسش به سه مدل و بررسی نقاط اختلافشان زمان بگذارید. اما برای یافتن دستوری که فقط بخشی از آن را به یاد دارید، هنوز هم پرسیدن از یک چت‌بات سریع‌ترین راه است.

منبع: این مطلب ترجمه و بومی‌سازی مقاله‌ای از MakeUseOf به قلم Yasir Mahmood است. مشاهده مقاله اصلی