کوئن ۳.۸ فلش؛ مدل ارزان علی‌بابا که با کلود و دیپ‌سیک رقابت می‌کند

اخبار · هوش مصنوعی

علی‌بابا با رونمایی از کوئن ۳.۸ فلش، مدلی کوچک‌تر و به‌مراتب ارزان‌تر از نسخه‌های پیشین این خانواده را وارد میدان رقابت مدل‌های زبانی کرده است؛ مدلی که به گفته‌ی این شرکت در آزمون‌های داخلی به عملکرد اوپوس ۴.۶ آنتروپیک و مدل V4-Flash دیپ‌سیک نزدیک شده است.

چکیده. علی‌بابا مدل تازه‌ی کوئن ۳.۸ فلش را با ۱۲۵ میلیارد پارامتر و بر پایه‌ی معماری نسل بعدی کوئن ۴ منتشر کرده است. این مدل با وجود اندازه‌ی کوچک‌تر نسبت به پرچمدارهای بازار، هزینه‌ی آموزش و اجرای پایین‌تری دارد و در آزمون‌های داخلی شرکت، عملکردی رقابتی در برابر اوپوس ۴.۶ آنتروپیک و دیپ‌سیک V4-Flash از خود نشان داده است. همزمان، نسخه‌ی بین‌المللی ابزار سازمانی کوئن‌ورک نیز عرضه شده تا شرکت‌های خارج از چین بتوانند از این فناوری بهره ببرند.

۱. رونمایی کوئن ۳.۸ فلش؛ گام تازه‌ی علی‌بابا در جنگ مدل‌های زبانی

علی‌بابا در روزهای اخیر از تازه‌ترین عضو خانواده‌ی مدل‌های زبانی کوئن رونمایی کرد؛ مدلی با نام کوئن ۳.۸ فلش که مسیر متفاوتی نسبت به نسخه‌های غول‌پیکر پیشین این خانواده در پیش گرفته است. برخلاف کوئن ۳.۸-مکس که با ۲.۴ تریلیون پارامتر ساخته شده بود تا مستقیماً با پرچمدارهای اوپن‌ای‌آی و آنتروپیک رقابت کند، کوئن ۳.۸ فلش روی دو محور دیگر تمرکز دارد: اندازه‌ی کوچک‌تر و هزینه‌ی اجرای به‌مراتب پایین‌تر.

این رویکرد نشان می‌دهد استراتژی علی‌بابا در حوزه‌ی هوش مصنوعی تنها به دنبال ساختن بزرگ‌ترین مدل ممکن نیست. شرکت به‌جای آن، سبدی از مدل‌ها در اندازه‌های مختلف عرضه می‌کند تا توسعه‌دهنده‌ها بتوانند بسته به نیاز پروژه، میان کیفیت و هزینه تعادل برقرار کنند. برای آشنایی بیشتر با این‌که چرا شرکت‌های بزرگ فناوری این‌قدر روی هوش مصنوعی سرمایه‌گذاری می‌کنند، می‌توانید اهمیت هوش مصنوعی در کسب‌وکار را بخوانید.

نکته‌ی قابل‌توجه دیگر زمان‌بندی این رونمایی است. علی‌بابا در طول تابستان امسال چند مدل مختلف از خانواده‌ی کوئن را پشت سر هم منتشر کرده؛ از کوئن ۳.۸-مکس با ۲.۴ تریلیون پارامتر گرفته تا نسخه‌های سبک‌تری که برای اجرا روی سخت‌افزار معمولی طراحی شده‌اند. کوئن ۳.۸ فلش آخرین حلقه‌ی این زنجیره است و نشان می‌دهد شرکت به‌جای انتشار یک مدل واحد، ترجیح می‌دهد چند نسخه با کاربردهای متفاوت را همزمان در دسترس بازار قرار دهد.

۲. مشخصات فنی کوئن ۳.۸ فلش چیست؟

کوئن ۳.۸ فلش با حدود ۱۲۵ میلیارد پارامتر ساخته شده و بر پایه‌ی معماری تازه‌ای موسوم به کوئن ۴ عمل می‌کند. علی‌بابا اعلام کرده این مدل در چهار حوزه‌ی اصلی بهبود قابل‌توجهی نسبت به نسل قبل داشته است: توانایی استدلال، برنامه‌نویسی، عاملیت یا همان قابلیت اجرای وظایف چندمرحله‌ای به‌صورت خودکار (ایجنت)، و درک چندوجهی شامل تصویر و متن.

نکته‌ی مهم این است که این ارقام نسبت به مدل‌های تریلیون‌پارامتری رقیب بسیار کوچک‌تر به نظر می‌رسند، اما همین کوچک‌تر بودن است که مدل را برای زیرساخت‌های سبک‌تر و اجرای محلی یا نیمه‌محلی مناسب‌تر می‌کند. اگر می‌خواهید بدانید مدل‌های زبانی امروزی از نظر فنی چه محدودیت‌ها و ظرفیت‌های واقعی دارند، این مطلب درباره‌ی ظرفیت‌ها و محدودیت‌های واقعی هوش مصنوعی نگاه خوبی به موضوع می‌دهد.

برای توسعه‌دهنده‌ها، اندازه‌ی کوچک‌تر مدل معمولاً به معنای زمان پاسخ‌دهی سریع‌تر، مصرف حافظه‌ی کمتر و امکان راه‌اندازی روی زیرساخت‌های ارزان‌تر است. این ویژگی‌ها به‌ویژه برای استارتاپ‌ها و تیم‌های کوچکی که بودجه‌ی محدودی برای زیرساخت هوش مصنوعی دارند، جذاب به نظر می‌رسد. با این حال، مدل‌های کوچک‌تر معمولاً در وظایف بسیار پیچیده و چندمرحله‌ای نسبت به مدل‌های بزرگ‌تر عملکرد ضعیف‌تری دارند؛ بنابراین انتخاب میان کوئن ۳.۸ فلش و نسخه‌ی مکس همچنان به نوع کاربرد بستگی دارد.

۳. مقایسه‌ی عملکرد با اوپوس آنتروپیک و دیپ‌سیک V4-Flash

به گفته‌ی علی‌بابا، کوئن ۳.۸ فلش در آزمون‌های داخلی این شرکت عملکردی نزدیک به مدل اوپوس ۴.۶ آنتروپیک و مدل V4-Flash دیپ‌سیک از خود نشان داده است. البته باید توجه داشت که این نتایج تاکنون از سوی نهادهای مستقل ارزیابی هوش مصنوعی به‌طور کامل تأیید نشده و بخشی از آن‌ها بر پایه‌ی آزمون‌های داخلی شرکت سازنده گزارش شده‌اند؛ نکته‌ای که همیشه در مقایسه‌ی مدل‌های رقیب باید در نظر گرفته شود.

با این حال، همین ادعا به‌تنهایی نشان‌دهنده‌ی سرعت پیشرفت مدل‌های چینی در ماه‌های اخیر است. رقابت میان دیپ‌سیک، علی‌بابا و دیگر آزمایشگاه‌های چینی باعث شده فاصله‌ی فنی با مدل‌های آمریکایی به‌سرعت کاهش یابد. برای دیدن نمونه‌ای دیگر از این رقابت مستقیم، مطلب مقایسه‌ی چت‌جی‌پی‌تی و دیپ‌سیک را می‌توانید بخوانید.

۴. چرا هزینه‌ی پایین‌تر این‌قدر اهمیت دارد؟

علی‌بابا اعلام کرده هزینه‌ی آموزش و اجرای کوئن ۳.۸ فلش به‌طور چشمگیری پایین‌تر از نسخه‌های پیشین کوئن است، هرچند رقم دقیقی برای این کاهش هزینه منتشر نشده است. در صنعتی که هزینه‌ی محاسباتی مدل‌های بزرگ یکی از مهم‌ترین موانع رشد است، هر کاهش قابل‌توجه در هزینه‌ی اجرا می‌تواند مسیر رقابت را به‌کلی تغییر دهد.

وقتی یک شرکت مدلی با عملکرد نزدیک به پرچمدارها اما با هزینه‌ی به‌مراتب کمتر عرضه می‌کند، رقبا ناچار می‌شوند یا قیمت خدمات خود را کاهش دهند یا روی مزیت‌های دیگری مثل دقت، ایمنی یا یکپارچگی با ابزارهای سازمانی تمرکز کنند. این همان الگویی است که در ماه‌های گذشته بارها میان آنتروپیک، اوپن‌ای‌آی، گوگل و اکنون علی‌بابا تکرار شده است.

۵. کوئن‌ورک؛ ابزار سازمانی بین‌المللی علی‌بابا

همزمان با انتشار کوئن ۳.۸ فلش، علی‌بابا نسخه‌ی بین‌المللی ابزار سازمانی خود موسوم به کوئن‌ورک را نیز عرضه کرد. این پلتفرم قرار است به شرکت‌های خارج از چین امکان دهد از قابلیت‌های هوش مصنوعی خانواده‌ی کوئن در فرایندهای کاری روزمره مانند مدیریت اسناد، ارتباطات تیمی و اتوماسیون وظایف استفاده کنند.

این حرکت نشان می‌دهد علی‌بابا فقط به رقابت فنی روی مدل‌های زبانی بسنده نمی‌کند و می‌خواهد اکوسیستم کوئن را به یک محصول کاربردی و قابل‌فروش برای بازارهای جهانی تبدیل کند. اگر برای کسب‌وکار خود به دنبال راهکارهای عملی هوش مصنوعی هستید، آموزش‌های استفاده از ابزارهای هوش مصنوعی در سایت مستر چت‌جی‌پی‌تی می‌تواند نقطه‌ی شروع خوبی باشد.

۶. جایگاه کوئن ۳.۸ فلش در استراتژی متن‌باز علی‌بابا

علی‌بابا از مدت‌ها پیش سیاست انتشار متن‌باز بخش قابل‌توجهی از مدل‌های کوئن را دنبال می‌کند؛ رویکردی که باعث شده مدل‌های این خانواده میلیون‌ها بار توسط توسعه‌دهندگان سراسر جهان دانلود شوند. انتظار می‌رود وزن‌های کوئن ۳.۸ فلش نیز طبق همین سنت به‌صورت متن‌باز در دسترس جامعه‌ی توسعه‌دهندگان قرار گیرد، هرچند جزئیات دقیق زمان‌بندی انتشار از سوی شرکت اعلام نشده است.

این سیاست متن‌باز در تضاد آشکار با رویکرد بسته‌تر شرکت‌هایی مانند اوپن‌ای‌آی قرار دارد. برای درک بهتر تفاوت رویکردهای شرکت‌های مختلف در این زمینه، مطلب اوپن‌ای‌آی چیست و چگونه کار می‌کند زمینه‌ی خوبی برای مقایسه فراهم می‌کند.

متن‌باز بودن مدل‌ها همچنین به معنای این است که پژوهشگران و شرکت‌های کوچک‌تر می‌توانند بدون پرداخت هزینه‌ی مجوز، وزن‌های مدل را دانلود کرده و آن را متناسب با نیاز خودشان تنظیم دقیق یا فاین‌تیون کنند. همین ویژگی باعث شده مدل‌های کوئن در میان توسعه‌دهندگان مستقل و دانشگاهیانی که بودجه‌ی محدودی برای دسترسی به مدل‌های بسته دارند، محبوبیت بالایی پیدا کنند. تحلیلگران بازار معتقدند این استراتژی در بلندمدت می‌تواند سهم علی‌بابا از اکوسیستم جهانی توسعه‌ی هوش مصنوعی را افزایش دهد، حتی اگر در کوتاه‌مدت درآمد مستقیمی از فروش مجوز مدل‌ها به همراه نداشته باشد.

۷. تأثیر این رقابت بر بازار جهانی هوش مصنوعی

رقابت میان علی‌بابا، دیپ‌سیک، آنتروپیک، اوپن‌ای‌آی و گوگل در ماه‌های اخیر عمدتاً حول محور کاهش هزینه و افزایش دسترسی‌پذیری مدل‌های زبانی شکل گرفته است. هر بار که یکی از این شرکت‌ها مدلی ارزان‌تر با عملکرد رقابتی معرفی می‌کند، فشار روی بقیه‌ی بازیگران برای پایین آوردن قیمت خدمات API افزایش می‌یابد. این چرخه در نهایت به سود توسعه‌دهندگان و کسب‌وکارهای کوچک‌تری تمام می‌شود که پیش‌تر توان مالی استفاده از مدل‌های گران‌قیمت را نداشتند.

از سوی دیگر، این رقابت شدید نگرانی‌هایی نیز درباره‌ی کیفیت واقعی مدل‌ها در برابر ادعاهای بازاریابی به همراه دارد. تفاوت میان توانایی واقعی یک مدل و تصویری که از آن در اخبار ساخته می‌شود، موضوعی است که در مطلب توهم هوش مصنوعی در برابر واقعیت به‌خوبی بررسی شده است.

برای بازار چین، موفقیت مدل‌هایی مانند کوئن و دیپ‌سیک اهمیت راهبردی هم دارد؛ چون نشان می‌دهد شرکت‌های این کشور با وجود محدودیت‌های دسترسی به برخی تراشه‌های پیشرفته، همچنان می‌توانند مدل‌هایی با عملکرد رقابتی در سطح جهانی تولید کنند. این موضوع در ماه‌های آینده احتمالاً بر تصمیم‌های سرمایه‌گذاری شرکت‌های فناوری و همچنین سیاست‌های تجاری میان چین و آمریکا در حوزه‌ی هوش مصنوعی اثر خواهد گذاشت.

۸. سوالات متداول درباره‌ی کوئن ۳.۸ فلش

کوئن ۳.۸ فلش دقیقاً چیست؟

کوئن ۳.۸ فلش تازه‌ترین مدل زبانی علی‌بابا با حدود ۱۲۵ میلیارد پارامتر است که روی معماری کوئن ۴ ساخته شده و هدف اصلی آن ارائه‌ی عملکرد نزدیک به مدل‌های بزرگ‌تر با هزینه‌ی اجرای پایین‌تر است.

آیا کوئن ۳.۸ فلش از کلود یا دیپ‌سیک بهتر است؟

طبق اعلام علی‌بابا، این مدل در برخی آزمون‌های داخلی به عملکرد اوپوس ۴.۶ آنتروپیک و دیپ‌سیک V4-Flash نزدیک شده، اما این نتایج هنوز به‌طور کامل توسط نهادهای مستقل ارزیابی تأیید نشده‌اند؛ بنابراین بهتر است این ادعا را با احتیاط در نظر بگیرید.

کوئن‌ورک چه کاربردی دارد؟

کوئن‌ورک ابزار سازمانی علی‌بابا برای استفاده‌ی شرکت‌ها از هوش مصنوعی در فرایندهای کاری است که اکنون نسخه‌ی بین‌المللی آن نیز عرضه شده تا کسب‌وکارهای خارج از چین بتوانند از آن استفاده کنند.

چطور می‌توان با مدل‌های کوئن کار کرد؟

برای شروع کار با مدل‌های زبانی مانند کوئن، آشنایی با اصول نوشتن دستور یا پرامپت مناسب اهمیت زیادی دارد. راهنمای نوشتن پرامپت برای مبتدیان نقطه‌ی شروع خوبی برای یادگیری این مهارت است.

جمع‌بندی. رونمایی کوئن ۳.۸ فلش نشان می‌دهد جنگ مدل‌های زبانی وارد فاز تازه‌ای شده که در آن هزینه‌ی اجرا به‌اندازه‌ی قدرت خام مدل اهمیت دارد. علی‌بابا با ترکیب یک مدل کوچک‌تر و ارزان‌تر با ابزار سازمانی کوئن‌ورک، تلاش می‌کند هم در رقابت فنی و هم در بازار عملی هوش مصنوعی جایگاه محکم‌تری پیدا کند. برای دنبال کردن آخرین تحولات این رقابت جهانی، صفحه‌ی اخبار هوش مصنوعی مستر چت‌جی‌پی‌تی را دنبال کنید و ما را در تلگرام @MrChatGPT_IR همراهی کنید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *