معرفی شش مدل هوش مصنوعی متن‌باز کی۲ هورایزن با پارامترهای ۰.۹ تا ۳۷۵ میلیارد

کی۲ هورایزن: بزرگ‌ترین انتشار متن‌باز تاریخ هوش مصنوعی با ۶ مدل رایگان

اخبار · هوش مصنوعی

موسسه‌ی مدل‌های بنیادین وابسته به دانشگاه محمد بن زاید برای هوش مصنوعی، خانواده‌ای شش‌تایی از مدل‌های زبانی به نام کی۲ هورایزن منتشر کرد؛ از مدلی برای ساعت هوشمند تا غولی ۳۷۵ میلیاردی برای سرورهای سازمانی، با وزن، کد و داده‌ی آموزشی کاملاً باز.

چکیده. موسسه‌ی IFM در ابوظبی روز پنجشنبه سوم سپتامبر ۲۰۲۶، شش مدل هوش مصنوعی با عنوان کی۲ هورایزن معرفی کرد که پارامترهای آن‌ها از ۰.۹ تا ۳۷۵ میلیارد متغیر است. بر خلاف بسیاری از مدل‌های «متن‌باز» رایج که تنها وزن‌ها را منتشر می‌کنند، این مجموعه کدهای آموزش، دستور کارهای کامل و مجموعه‌داده‌ی آموزشی را نیز زیر مجوز آپاچی ۲.۰ در دسترس همگان قرار داده و به گفته‌ی مسئولانش، یکی از بزرگ‌ترین انتشارهای کاملاً باز در تاریخ هوش مصنوعی به شمار می‌رود.
معرفی شش مدل هوش مصنوعی متن‌باز کی۲ هورایزن با پارامترهای ۰.۹ تا ۳۷۵ میلیارد

۱. کی۲ هورایزن چیست و چه کسی آن را ساخته است؟

کی۲ هورایزن محصول موسسه‌ی مدل‌های بنیادین (IFM) است؛ آزمایشگاه پژوهشی جهانی با شعبه‌هایی در ابوظبی، سیلیکون‌ولی و پاریس که در می ۲۰۲۵ توسط دانشگاه محمد بن زاید برای هوش مصنوعی (MBZUAI) در امارات راه‌اندازی شد. این دانشگاه که از سال ۲۰۲۰ به‌عنوان نخستین دانشگاه تخصصی جهان در حوزه‌ی هوش مصنوعی فعالیت می‌کند، طی سال‌های اخیر با انتشار مدل‌های زبانی متن‌باز مانند خانواده‌ی جیس و فانار، جایگاه خود را در جامعه‌ی هوش مصنوعی متن‌باز تثبیت کرده است. کی۲ هورایزن، جدی‌ترین و بزرگ‌ترین قدم این نهاد تاکنون به شمار می‌رود. برای آشنایی بیشتر با اینکه اصلاً هوش مصنوعی و شرکت‌هایی مثل OpenAI چه می‌کنند، می‌توانید مقاله‌ی مرتبط را در سایت ما بخوانید.

۲. شش مدل، شش کاربرد؛ از مچ‌بند تا مرکز داده

ویژگی متمایز این انتشار، طیف گسترده‌ی اندازه‌ی مدل‌هاست که برای شش سطح متفاوت از سخت‌افزار طراحی شده‌اند:

مدل ۰.۹ میلیاردی

کوچک‌ترین عضو خانواده، آن‌قدر سبک است که روی ساعت‌های هوشمند و عینک‌های هوشمند اجرا می‌شود؛ گزینه‌ای برای دستیارهای صوتی و پردازش آنی روی دستگاه‌های پوشیدنی.

مدل‌های ۳.۷ و ۷ میلیاردی

این دو مدل برای گوشی‌های هوشمند و پردازش لبه (Edge Computing) بهینه شده‌اند؛ جایی که تأخیر شبکه و حریم خصوصی داده اهمیت بالایی دارد.

مدل ۳۲ میلیاردی

مناسب میزبانی محلی روی سرورهای درون‌سازمانی، برای تیم‌هایی که می‌خواهند داده‌ی خود را روی زیرساخت خودشان نگه دارند.

مدل ۳۶ میلیاردی

با معماری Mixture of Value Attention ساخته شده تا توان استدلال را بدون بار محاسباتی اضافه ارتقا دهد؛ تنها حدود ۴ میلیارد پارامتر آن در هر گام فعال می‌شود.

مدل پرچمدار ۳۷۵ میلیاردی

غول این خانواده، با معماری آمیخته‌ی کارشناسان (Mixture-of-Experts) طراحی شده که در هر مرحله تنها حدود ۲۳ میلیارد پارامتر از مجموع ۳۷۵ میلیارد را فعال می‌کند؛ رویکردی که هزینه‌ی استنتاج را پایین نگه می‌دارد و در عین حال قدرت استدلال یک مدل بزرگ را حفظ می‌کند. این مدل برای استقرار سازمانی و کارهای عامل‌محور طراحی شده است.

مدل پرچمدار ۳۷۵ میلیارد پارامتری کی۲ هورایزن رقیب مدل‌های بسته هوش مصنوعی

۳. نوآوری‌های فنی: تقطیر انتشاری و توجه ارزش‌محور

تیم توسعه‌ی کی۲ هورایزن دو تکنیک کلیدی را در معماری این مدل‌ها به کار گرفته است. نخست، «تقطیر انتشاری» (Diffusion Distillation) است که برخلاف روش سنتی تولید متن کلمه‌به‌کلمه، بلوک‌هایی از توکن‌ها را به‌صورت موازی تولید می‌کند. این رویکرد سرعت پردازش را تا حدود سه برابر افزایش می‌دهد، بدون آنکه کیفیت خروجی افت محسوسی داشته باشد.

دومین نوآوری، معماری «آمیخته‌ی توجه ارزش‌محور» یا Mixture of Value Attention (MoVA) نام دارد که توانایی استدلال مدل را بهبود می‌بخشد بدون آنکه هزینه‌ی محاسباتی اضافه‌ای تحمیل کند. این معماری در مدل‌های میان‌رده‌ی خانواده مانند نسخه‌ی ۳۶ میلیاردی به کار رفته و به گفته‌ی موسسه، بخشی از دلیل جهش عملکردی این مدل‌ها نسبت به نسخه‌های قبلی است. اگر می‌خواهید بدانید معماری و توان مدل‌های زبانی در عمل چه تفاوتی در قابلیت‌ها و محدودیت‌های واقعی هوش مصنوعی ایجاد می‌کند، این مقاله را از دست ندهید.

۴. عملکرد و بنچمارک‌ها: مقایسه با مدل‌های رقیب

طبق ارزیابی‌های مستقل مؤسسه‌ی تحلیل هوش مصنوعی (Artificial Analysis)، مدل ۳۷۵ میلیاردی کی۲ هورایزن در شاخص هوش این مؤسسه نسبت به نسل قبلی خود جهشی نزدیک به سی امتیاز ثبت کرده و در وظایف عامل‌محور واقعی، عملکردی رقابتی در برابر مدل‌های وزن‌باز پیشرو نشان داده است. موسسه‌ی سازنده همچنین اعلام کرده مدل‌های ۰.۹، ۳.۷ و ۷ میلیاردی در رده‌ی اندازه‌ی خود، رکوردهای تازه‌ای در استدلال، ریاضیات، برنامه‌نویسی و وظایف عامل‌محور ثبت کرده‌اند. این ادعاها نشان می‌دهد که رقابت میان مدل‌های بسته‌ی غول‌های فناوری و جامعه‌ی متن‌باز، حالا در همه‌ی رده‌های اندازه در جریان است، نه فقط در قله‌ی بازار. البته سنجش عملکرد واقعی مدل‌های هوش مصنوعی همیشه ساده نیست؛ همان‌طور که در مقایسه‌ی عملکرد چت‌جی‌پی‌تی و دیپ‌سیک در بازی شطرنج دیدیم، بنچمارک‌های استاندارد همیشه بازتاب کامل توانایی مدل در کاربردهای واقعی نیستند و باید با احتیاط تفسیر شوند.

۵. «متن‌باز واقعی» یعنی چه؟ فراتر از انتشار وزن‌ها

بسیاری از مدل‌هایی که امروز برچسب «متن‌باز» یا «وزن‌باز» می‌گیرند، تنها فایل وزن‌های نهایی را منتشر می‌کنند و جزئیات داده‌ی آموزشی یا روش دقیق آموزش را پنهان نگه می‌دارند. کی۲ هورایزن این رویکرد را کنار گذاشته است. این انتشار شامل وزن‌های کامل هر شش مدل، کدهای آموزش و دستور کارها، مجموعه‌داده‌ی آموزشی کامل، و مستندات روش‌شناسی و ارزیابی است؛ همه زیر مجوز آپاچی ۲.۰ که اجازه‌ی استفاده‌ی تجاری آزاد را نیز می‌دهد.

اریک شینگ (Eric Xing)، رئیس موسسه‌ی IFM، در توضیح فلسفه‌ی این انتشار گفته است: «متن‌باز بودن چیزی فراتر از باز بودن وزن‌هاست؛ علم زمانی کار می‌کند که دیگران بتوانند داده را ببینند، روش را دنبال کنند، نتیجه را بازتولید کنند و آن را بهبود دهند.» او تأکید کرده که پیشرفت معنادار هوش مصنوعی به توانایی جامعه‌ی پژوهشی برای بررسی، ساخت روی فناوری موجود و بهبود آن وابسته است، نه صرفاً دسترسی به آن از پشت یک رابط برنامه‌نویسی بسته.

انتشار متن‌باز کامل وزن کد و داده‌ی آموزشی کی۲ هورایزن با مجوز آپاچی

۶. در دسترس همه: از هاگینگ‌فیس تا زیرساخت‌های استنتاج

مدل‌های کی۲ هورایزن هم‌اکنون از طریق پلتفرم‌هایی مانند هاگینگ‌فیس، اولاما، Unsloth و مخزن رسمی IFM قابل دانلود هستند و برای اجرا از چارچوب‌های استنتاج شناخته‌شده‌ای مانند vLLM و SGLang پشتیبانی می‌کنند. شرکای زیرساخت از جمله Cerebras و Nebius نیز میزبانی سریع این مدل‌ها را فراهم کرده‌اند تا توسعه‌دهندگان بتوانند بدون هزینه‌ی سنگین سخت‌افزاری، حتی مدل پرچمدار ۳۷۵ میلیاردی را آزمایش کنند. این دسترسی گسترده می‌تواند مسیر ورود کسب‌وکارهای کوچک و پژوهشگران مستقل به دنیای مدل‌های بزرگ زبانی را هموارتر کند؛ موضوعی که با رشد اهمیت هوش مصنوعی در کسب‌وکارها هم‌راستاست و در مقاله‌ی اهمیت هوش مصنوعی در کسب‌وکار به آن پرداخته‌ایم.

۷. چرا این انتشار برای صنعت هوش مصنوعی مهم است؟

انتشار کی۲ هورایزن در بحبوحه‌ی رقابتی داغ میان مدل‌های بسته‌ی شرکت‌های بزرگ فناوری و جامعه‌ی متن‌باز رخ می‌دهد. تا پیش از این، اغلب مدل‌های بزرگ و قدرتمند تنها از طریق رابط‌های برنامه‌نویسی بسته و پولی در دسترس بودند و کاربران کنترل محدودی بر نحوه‌ی اجرا، سفارشی‌سازی یا میزبانی آن‌ها داشتند. با انتشار کامل وزن، کد و داده، توسعه‌دهندگان می‌توانند مدل را روی زیرساخت خود اجرا کنند، آن را برای زبان‌ها و حوزه‌های تخصصی فاین‌تیون کنند، و حتی روش آموزش را برای ساخت مدل‌های اختصاصی خود الگو قرار دهند. این سطح از شفافیت، به‌ویژه برای کشورها و سازمان‌هایی که به دنبال حاکمیت داده و استقلال فناورانه در حوزه‌ی هوش مصنوعی هستند، ارزش راهبردی بالایی دارد.

۸. چالش‌ها و محدودیت‌های احتمالی

با وجود همه‌ی مزایا، اجرای مدل ۳۷۵ میلیاردی همچنان به زیرساخت محاسباتی قابل‌توجهی نیاز دارد و برای اغلب کاربران فردی در دسترس نیست، هرچند نسخه‌های کوچک‌تر این محدودیت را ندارند. همچنین، مانند هر مدل متن‌باز دیگری، مسئولیت رعایت ایمنی، فیلترکردن محتوای مضر و پایش کاربرد نهایی مدل بر عهده‌ی توسعه‌دهنده و سازمان استفاده‌کننده قرار می‌گیرد؛ موضوعی که در بحث‌های جاری درباره‌ی تفاوت توسعه‌دهنده‌ی مستقل و مهندس واقعی در پروژه‌های هوش مصنوعی نیز اهمیت دارد. با این حال، انتشار کامل داده و روش‌شناسی می‌تواند بررسی و رفع این نگرانی‌ها را برای جامعه‌ی پژوهشی آسان‌تر کند.

۹. اگر می‌خواهید خودتان این مدل‌ها را امتحان کنید

برای کاربران فارسی‌زبانی که می‌خواهند از این موج مدل‌های متن‌باز بهره ببرند، نیازی به دانش عمیق فنی نیست. بسیاری از این مدل‌ها را می‌توان از طریق ابزارهای ساده روی سیستم شخصی اجرا کرد یا حتی از طریق پلتفرم‌های آنلاین رایگان امتحان کرد. اگر با نحوه‌ی کار با ابزارهای هوش مصنوعی مانند چت‌جی‌پی‌تی آشنایی ندارید، مجموعه‌ی آموزش‌های چت‌جی‌پی‌تی در سایت ما نقطه‌ی شروع خوبی است. همچنین نوشتن پرامپت مناسب، تأثیر مستقیمی بر کیفیت خروجی هر مدل زبانی دارد؛ راهنمای نوشتن پرامپت برای مبتدیان می‌تواند به شما کمک کند از همین مدل‌های متن‌باز جدید هم نتیجه‌ی بهتری بگیرید. برای پیگیری مستمر اخبار این حوزه نیز سری به بخش اخبار هوش مصنوعی سایت بزنید که هر رویداد مهم این صنعت را پوشش می‌دهد.

۱۰. پرسش‌های متداول

کی۲ هورایزن چیست؟

خانواده‌ای از شش مدل هوش مصنوعی متن‌باز با پارامترهایی از ۰.۹ تا ۳۷۵ میلیارد است که توسط موسسه‌ی IFM وابسته به دانشگاه محمد بن زاید برای هوش مصنوعی منتشر شده است.

آیا استفاده از این مدل‌ها رایگان است؟

بله، همه‌ی مدل‌ها زیر مجوز آپاچی ۲.۰ منتشر شده‌اند که استفاده‌ی شخصی و تجاری رایگان را مجاز می‌کند.

چه چیزی کی۲ هورایزن را از سایر مدل‌های متن‌باز متمایز می‌کند؟

برخلاف بسیاری از مدل‌ها که تنها وزن‌ها را منتشر می‌کنند، این مجموعه کد آموزش، داده‌ی آموزشی کامل و مستندات روش‌شناسی را نیز باز کرده است.

از کجا می‌توان این مدل‌ها را دانلود کرد؟

از طریق هاگینگ‌فیس، اولاما، Unsloth و مخزن رسمی موسسه‌ی IFM.

جمع‌بندی. انتشار کی۲ هورایزن نشان می‌دهد رقابت هوش مصنوعی دیگر محدود به چند شرکت بزرگ فناوری نیست و نهادهای پژوهشی می‌توانند با شفافیت کامل، فناوری در سطح مدل‌های پیشرو را در اختیار همه قرار دهند. برای دنبال‌کردن جدیدترین اخبار و تحلیل‌های هوش مصنوعی، کانال تلگرام @MrChatGPT_IR را دنبال کنید.
(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *