
همه چیز درباره هوش مصنوعی Kimi – کیمی

هوش مصنوعی Kimi
Kimi یک دستیار هوش مصنوعی و خانواده ای از مدل های زبانی بزرگ (LLM) است که توسط شرکت چینی Moonshot AI توسعه داده شده است. این محصول از سال ۲۰۲۳ تاکنون به یکی از جدی ترین رقبای مدل های آمریکایی مانند GPT و Claude تبدیل شده و امروز با عرضه نسخههای متنباز و قدرتمند خود، توجه زیادی را در صنعت هوش مصنوعی به خود جلب کرده است. در این مقاله، تمام جنبههای Kimi از تاریخچه و شرکت سازنده گرفته تا مدلها، قابلیتها، قیمتگذاری، نحوه استفاده و جایگاه آن در مقایسه با رقبا بررسی میشود تا نیازی به مراجعه به منبع دیگری نداشته باشید.
شرکت سازنده: Moonshot AI کیست؟
Moonshot AI (به چینی: 月之暗面، به معنای «سمت تاریک ماه») یک شرکت هوش مصنوعی مستقر در پکن است که در مارس ۲۰۲۳ توسط یانگ ژیلین (Yang Zhilin) به همراه ژو شینیو و وو یوشین تأسیس شد. این شرکت یکی از شش شرکت معروف به «ببرهای هوش مصنوعی چین» (AI Tigers) محسوب میشود که سرمایهگذاران بزرگ چینی روی آنها تمرکز کردهاند.
نکات کلیدی درباره Moonshot AI:
- تمرکز اصلی: توسعه مدلهای زبانی بزرگ و رسیدن به هوش مصنوعی عمومی (AGI)
- محصولات: چتبات Kimi، Kimi Researcher، Kimi Agent، Kimi Code، Kimi Audio و Kimina Prover
- سرمایهگذاران: علیبابا، IDG Capital، Sequoia China و شیائوهونگشو از جمله حامیان مالی این شرکت بودهاند
- ارزشگذاری: این شرکت در تابستان ۲۰۲۶ پس از موفقیت مدل Kimi K3 موفق شد در یک دور جدید تأمین مالی، ۳.۵ میلیارد دلار جذب کند و به ارزشگذاری ۳۵ میلیارد دلاری برسد

تاریخچه توسعه Kimi
روند تکامل Kimi نمونهای از سرعت باورنکردنی توسعه هوش مصنوعی در چین است:
- اکتبر ۲۰۲۳: نخستین نسخه Kimi به صورت بسته منتشر و وارد فاز تست شد. این نسخه با قابلیت پردازش پنجره متنی (context window) تا ۱۲۸ هزار توکن (حدود ۲۰۰ هزار کاراکتر چینی)، به عنوان اولین مدل تجاری با چنین ظرفیت بزرگی شناخته شد
- نوامبر ۲۰۲۳: Kimi به صورت عمومی در دسترس همگان قرار گرفت
- مارس ۲۰۲۴: نسخه بهروزشدهای با پنجره متنی ۲ میلیون کاراکتری وارد فاز تست بسته شد
- جولای ۲۰۲۴: قابلیت «کش کردن زمینه» (context caching) به صورت آزمایشی عمومی عرضه شد
- اکتبر ۲۰۲۴: نسخه Kimi Explore با قابلیت جستوجوی خودکار مبتنی بر هوش مصنوعی رونمایی شد؛ کاربران فعال ماهانه این محصول از مرز ۳۶ میلیون نفر گذشت
- جولای ۲۰۲۵: مدل متنباز Kimi K2 با یک تریلیون پارامتر معرفی شد که در معیارهای کدنویسی عملکرد بسیار قوی از خود نشان داد
- ژانویه ۲۰۲۶: مدل Kimi K2.5 با قابلیتهای چندوجهی (multimodal) بومی و توانایی درک تصویر و ویدیو عرضه شد
- بهار تا تابستان ۲۰۲۶: نسخههای K2.6 و سپس K2.7 Code با تمرکز ویژه بر کدنویسی عاملی (agentic coding) منتشر شدند
- جولای ۲۰۲۶: پرچمدار جدید یعنی Kimi K3 با ۲.۸ تریلیون پارامتر معرفی شد که بزرگترین مدل زبانی متنباز جهان تا آن زمان به شمار میرفت
معرفی مدلهای اصلی Kimi
Kimi K2 (پایه اصلی نسل جدید)
Kimi K2 یک مدل Mixture-of-Experts (ترکیبی از چند شبکه تخصصی) با ۱.۰۴ تریلیون پارامتر کل و ۳۲ میلیارد پارامتر فعال در هر مرحله پردازش است. این مدل بر پایه ۱۵.۵ تریلیون توکن با کیفیت بالا آموزش دیده و طراحی آن به طور خاص برای «هوش عاملی» (agentic intelligence) صورت گرفته است؛ یعنی توانایی تجزیه مسائل پیچیده به مراحل کوچکتر، اجرای گامبهگام کارها و تعامل با ابزارهای بیرونی مانند رابطهای برنامهنویسی (API)، پایگاههای داده و ترمینالهای سیستم.
از نوآوریهای فنی این مدل میتوان به بهینهساز اختصاصی MuonClip اشاره کرد که کارایی توکن را در فرآیند آموزش بهبود میبخشد. Kimi K2 در رتبهبندی LMSYS Arena به عنوان برترین مدل متنباز و پنجمین مدل برتر در میان همه مدلها (بر اساس رأی بیش از سه هزار کاربر) قرار گرفت. این مدل تحت مجوز Modified MIT License منتشر شده و به صورت آزاد روی پلتفرم Hugging Face قابل دسترسی است.
Kimi K2.5 (ورود هوش مصنوعی چندوجهی)
در ژانویه ۲۰۲۶، Moonshot نسخه K2.5 را عرضه کرد که روی حدود ۱۵ تریلیون توکن ترکیبی از متن و تصویر آموزش دیده و برای اولین بار به صورت بومی چندوجهی (natively multimodal) است. این مدل با بهرهگیری از یک رمزگذار بصری اختصاصی به نام MoonViT با ۴۰۰ میلیون پارامتر، قادر است هم تصویر و هم ویدیو را در کنار متن پردازش کند.
قابلیتهای شاخص K2.5:
- تولید و اشکالزدایی (debug) کد رابط کاربری صرفاً بر اساس یک تصویر یا اسکرینشات
- بازسازی وبسایت از روی یک ویدیوی نمایشی از تعاملات کاربر
- معماری «ازدحام عاملها» (Agent Swarm) که در آن مدل میتواند چندین عامل فرعی را به صورت موازی و بدون نیاز به هماهنگکننده بیرونی اجرا کند تا زمان انجام کارهای پیچیده کاهش یابد
- چهار حالت کاری در Kimi.com و اپلیکیشن: حالت فوری (Instant)، حالت تفکر (Thinking)، حالت عامل (Agent) و حالت ازدحام عاملها (Agent Swarm، در نسخه بتا)
Kimi K2.6 و K2.7 Code
نسخه K2.6 پیشرفت محسوسی نسبت به K2.5 در کدنویسی، اجرای وظایف طولانیمدت و قابلیتهای ازدحام عاملها ارائه کرد. طبق ارزیابیهای داخلی، دقت تولید کد در این نسخه ۱۲ درصد، پایداری در زمینههای طولانی ۱۸ درصد و نرخ موفقیت فراخوانی ابزارها به ۹۶.۶ درصد رسید. یکی از نمایشهای جالب توجه این مدل، بازنویسی یک موتور تطبیق مالی متنباز هشتساله طی یک نشست ۱۳ ساعته بود که با بیش از هزار تغییر هدفمند در کد، بهبود ۱۸۵ درصدی در توان عملیاتی میانگین و ۱۳۳ درصدی در اوج توان عملیاتی را بدون هیچ دخالت انسانی پس از تعریف اولیه وظیفه به همراه داشت.
در ادامه، K2.7 Code به عنوان مدلی تخصصی برای کدنویسی عاملی منتشر شد که نسبت به K2.6 بهبودهای قابل توجهی داشت: ۲۱.۸ درصد در معیار Kimi Code Bench نسخه دوم، ۱۱ درصد در Program Bench و ۳۱.۵ درصد در MLS Bench Lite. این مدل همچنین مصرف توکنهای تفکر (thinking tokens) را حدود ۳۰ درصد نسبت به K2.6 کاهش داد که به معنای صرفهجویی در هزینه و افزایش سرعت است.
Kimi K3 (پرچمدار فعلی)
Kimi K3 که در ۱۶ جولای ۲۰۲۶ معرفی شد، جدیدترین و قدرتمندترین مدل خانواده Kimi است. مشخصات کلیدی آن عبارتند از:
- ۲.۸ تریلیون پارامتر کل (با حدود ۱۰۴ میلیارد پارامتر فعال در هر مرحله)، که آن را به بزرگترین مدل زبانی متنباز جهان در کلاس خود تبدیل میکند
- پنجره متنی یک میلیون توکنی که برای پردازش کدبیسهای بزرگ، آرشیوهای اسنادی گسترده یا هزاران مکالمه پشتیبانی مشتری در یک درخواست واحد مناسب است
- معماری نوین Kimi Delta Attention (KDA)، یک مکانیزم توجه خطی ترکیبی که همراه با «باقیماندههای توجه» (Attention Residuals) کارایی محاسباتی را بهبود میبخشد
- درک بصری بومی برای پردازش تصویر و ویدیو در کنار متن
- تفکر همیشهفعال (always-on reasoning) به این معنا که کاربر نمیتواند این ویژگی را به طور کامل خاموش کند، اما میتواند سطح آن (reasoning_effort) را برای کاهش زمان پاسخدهی تنظیم کند
طبق گزارشها، Moonshot ادعا کرده که K3 در عملکرد به صورت رقابتی با مدلهای پیشرفتهای مانند Claude Fable 5 قابل مقایسه است. این مدل در شاخص هوش Artificial Analysis نمره ۵۷ را کسب کرد که بالاترین امتیاز در میان مدلهای متنباز تا آن زمان بود (مدل رقیب GLM-5.2 با نمره ۵۱ در رتبه بعدی قرار داشت).
نکته مهم درباره K3 این است که Moonshot ابتدا آن را از طریق API عرضه کرد و اعلام کرد وزنهای کامل مدل (model weights) تا ۲۷ جولای ۲۰۲۶ به صورت متنباز منتشر خواهند شد؛ وعدهای که طبق گزارشها عملی شد و باعث شد کشورها و سازمانها بتوانند این مدل را به صورت محلی (بدون وابستگی به سرویسهای ابری گرانقیمت آمریکایی) مستقر کنند.
قابلیتهای کلیدی Kimi
۱. پنجره متنی بسیار بزرگ
یکی از ویژگیهای شاخص و همیشگی خانواده Kimi، پشتیبانی از پنجرههای متنی بسیار بزرگ بوده است؛ از ۱۲۸ هزار توکن در نسخه اول تا یک میلیون توکن در K3. این قابلیت به مدل اجازه میدهد اسناد بسیار طولانی، مخازن کد بزرگ یا مجموعهای گسترده از فایلها را در یک درخواست پردازش کند بدون آنکه نیاز به تقسیم اطلاعات باشد.
۲. هوش عاملی (Agentic Intelligence)
طراحی Kimi از ابتدا حول محور «عامل بودن» شکل گرفته است؛ یعنی مدل نهتنها پاسخ میدهد، بلکه میتواند وظایف را به مراحل کوچکتر تقسیم کند، از ابزارهای بیرونی (مانند مرورگر، ترمینال، پایگاه داده یا API) استفاده کند و به صورت خودکار و چندمرحلهای کار را تا رسیدن به نتیجه نهایی پیش ببرد.
۳. ازدحام عاملها (Agent Swarm)
از نسخه K2.5 به بعد، Kimi قابلیتی به نام Agent Swarm ارائه میکند که در آن به جای اجرای یک عامل واحد به صورت ترتیبی، چندین زیرعامل به طور همزمان و بدون نقشهای از پیش تعریفشده فعالیت میکنند و کار را هماهنگ میکنند. طبق ادعای Moonshot، این روش زمان انجام کارهای پیچیده را به طور محسوسی کاهش میدهد.
۴. کدنویسی و توسعه نرمافزار
Kimi (بهویژه نسخههای K2.6، K2.7 Code و K3) در معیارهای کدنویسی مانند SWE-bench Verified، LiveCodeBench و Kimi Code Bench عملکرد بسیار قوی از خود نشان داده است. این مدل میتواند:
- رابطهای کاربری کامل (front-end) را از یک پرامپت ساده بسازد، شامل بخشهای قهرمان (hero section)، انیمیشنهای اسکرول-محور و طراحیهای حرفهای
- عملیات پیچیده مانند بازآرایی کد (refactoring)، رفع اشکال و تست را در طول جلسات طولانی و بدون نظارت مستقیم انسان انجام دهد
- در زبانهای برنامهنویسی متعددی از جمله Rust، Go و Python به خوبی تعمیم یابد
۵. چندوجهی بودن (Multimodal)
Kimi از نسخه K2.5 به بعد قادر است تصویر و ویدیو را در کنار متن پردازش کند. این ویژگی امکاناتی مانند تولید کد از روی طرحهای بصری (mockup)، اشکالزدایی بر اساس اسکرینشات، و بازسازی جریانهای کاری کاربر از روی ویدیو را فراهم میکند.
۶. ابزارهای جانبی
Moonshot علاوه بر چتبات اصلی، محصولات تخصصی دیگری نیز عرضه کرده است:
- Kimi Code: محیط توسعه اختصاصی برای کدنویسی عاملی
- Kimi Researcher: ابزار پژوهش خودکار
- Kimi Agent: مجموعهای از ابزارهای از پیش پیکربندیشده برای اجرای کارهای عاملی
- Kimi Audio: پردازش و تولید صدا
- Kimina Prover: ابزار تخصصی برای اثبات قضایای ریاضی
نحوه دسترسی و استفاده از Kimi
Kimi از چند مسیر مختلف در دسترس کاربران قرار دارد:
- وبسایت رسمی: kimi.com، جایی که کاربران میتوانند بدون نیاز به نصب، مستقیماً با مدل چت کنند
- اپلیکیشن موبایل: برای سیستمعاملهای iOS و Android
- رابط برنامهنویسی (API): از طریق پلتفرم platform.moonshot.ai که هم به صورت سازگار با OpenAI و هم سازگار با Anthropic در دسترس است. این ویژگی باعث میشود توسعهدهندگانی که قبلاً با API مدلهای دیگر کار کردهاند، بتوانند با کمترین تغییر کد از Kimi استفاده کنند
- Kimi Code: ابزار اختصاصی برای کدنویسان که مدل را در قالب یک محیط عاملی کدنویسی در اختیار قرار میدهد
- پلتفرمهای واسط (Aggregator): مانند OpenRouter که دسترسی به Kimi را از طریق چند ارائهدهنده مختلف با گزینههای مسیریابی متفاوت (تعادل قیمت و سرعت، سریعترین حالت، یا دقیقترین فراخوانی ابزار) فراهم میکند
قیمتگذاری
قیمتگذاری Kimi بسته به نسخه مدل متفاوت است. برای مدل پرچمدار K3 (بر اساس آخرین اطلاعات موجود):
- ورودی (در صورت عدم استفاده از کش): حدود ۳ دلار به ازای هر یک میلیون توکن
- ورودی با کش (cache hit): حدود ۰.۳ دلار به ازای هر یک میلیون توکن (تخفیف ۹۰ درصدی)
- خروجی: حدود ۱۵ دلار به ازای هر یک میلیون توکن
- پنجره متنی: یک میلیون توکن، بدون هیچگونه لایهبندی قیمتی بر اساس طول متن
این قیمتگذاری تقریباً همتراز با Claude Sonnet 5 است و در مقایسه با مدلهای بالاتر Anthropic (مانند Opus یا Fable) حدود ۴۰ تا ۷۰ درصد ارزانتر است. لازم به ذکر است که مدلهای قدیمیتر خانواده Kimi مانند K2.5 و K2.7 Code قیمتهای بهمراتب پایینتری دارند و برای کارهای معمول کدنویسی گزینه اقتصادیتری محسوب میشوند. برای اطلاع از قیمتهای دقیق و بهروز، بهتر است همواره به صفحه رسمی قیمتگذاری در platform.moonshot.ai مراجعه شود، چون این نرخها به مرور زمان تغییر میکنند.
در نسخه مصرفی (اپلیکیشن Kimi)، اشتراکهای پولی معمولاً در بازهای از ۱۹ تا ۱۹۹ دلار در ماه ارائه میشوند که بسته به سطح، امکاناتی مانند حجم بیشتر استفاده، دسترسی به پنجره متنی کامل و قابلیتهای پیشرفتهتر عاملی را در اختیار کاربر قرار میدهند.
مقایسه Kimi با رقبا
Kimi، بهویژه در نسخه K3، اغلب با مدلهای زیر مقایسه میشود:
- Claude (Anthropic): در قیمتگذاری با Claude Sonnet 5 همتراز است، اما طبق برخی معیارها امتیاز کمی بالاتری کسب کرده است. با این حال، مدلهای سطح بالاتر Anthropic مانند Opus و Fable همچنان در بسیاری از کارها قدرتمندتر ارزیابی میشوند
- GPT (OpenAI): در معیارهای کدنویسی و عاملی رقابت نزدیکی با نسخههای اخیر GPT دارد
- DeepSeek: از نظر قیمت، DeepSeek همچنان گزینه ارزانتری محسوب میشود و Kimi در این محور رقابتی ندارد
- GLM (Zhipu AI): یکی دیگر از رقبای چینی که در شاخص هوش Artificial Analysis رتبه نزدیکی به Kimi دارد
نکته مهم این است که برخلاف نسل قبلی Kimi (K2) که با قیمت بسیار پایین به عنوان یک «کشنده ارزان قیمت مدلهای گران» شناخته میشد، نسخه K3 با قیمتگذاری در سطح مدلهای پرچمدار عرضه شده و دیگر گزینهای ارزان محسوب نمیشود.
نکات مربوط به ایمنی و ریسکها
یک ارزیابی مستقل ایمنی که روی نسخه K2.5 انجام شد نشان داد این مدل در برخی حوزههای حساس (مانند خطرات مربوط به سلاحهای شیمیایی، بیولوژیکی، رادیولوژیکی و هستهای) نسبت به مدلهای بسته مانند GPT و Claude امتناع کمتری از خود نشان میدهد که میتواند نگرانیهایی درباره سوءاستفاده احتمالی ایجاد کند. از سوی دیگر، در حوزه امنیت سایبری، عملکرد این مدل رقابتی ارزیابی شده اما تواناییهای پیشرفته و خودکار برای کشف و بهرهبرداری از آسیبپذیریها (که ویژگی مدلهای در سطح فرانتیر است) در آن مشاهده نشده است. این موضوع یکی از چالشهای مهم مدلهای متنباز و قدرتمند است؛ چراکه در دسترس بودن آزادانه وزنهای مدل، کنترل بر نحوه استفاده از آن را دشوارتر میکند.
کاربرد های عملی Kimi
با توجه به قابلیتهایی که تاکنون بررسی شد، Kimi میتواند در موارد زیر کاربرد داشته باشد:
- توسعه نرمافزار: ساخت رابطهای کاربری کامل، رفع اشکال کد، بازآرایی کدبیسهای بزرگ و اجرای عاملهای کدنویسی طولانیمدت
- پژوهش و تحلیل اسناد: بررسی و خلاصهسازی اسناد بسیار طولانی یا مجموعهای گسترده از فایلها به لطف پنجره متنی یک میلیون توکنی
- تولید محتوا: ساخت اسناد، اسلایدها و صفحات گسترده (spreadsheet) با کیفیت بالا
- کارهای بصری: تحلیل تصویر و ویدیو، تولید کد از روی طرحهای گرافیکی و بازسازی جریانهای کاربری از روی ضبط ویدیویی
- جایگزینی زیرساختهای ابری گرانقیمت: به لطف متنباز بودن مدلهایی مانند K2 و K3، سازمانها و حتی دولتها میتوانند این مدلها را به صورت محلی و بدون وابستگی به سرویسهای ابری آمریکایی مستقر کنند
خرید کارت گرافیک مناسب هوش مصنوعی
جمعبندی
Kimi از یک چتبات نوپای چینی با قابلیت پردازش متن طولانی، به یکی از جدیترین رقبای مدلهای پیشرفته جهانی تبدیل شده است. نقاط قوت اصلی این خانواده مدل عبارتند از: پنجره متنی بسیار بزرگ، توانایی قوی در کدنویسی و اجرای وظایف عاملی، پشتیبانی بومی از تصویر و ویدیو، و مهمتر از همه، متنباز بودن بسیاری از نسخههای آن که امکان استقرار محلی و کنترل بیشتر بر دادهها را برای سازمانها فراهم میکند. در مقابل، قیمتگذاری نسخه پرچمدار K3 دیگر ارزانترین گزینه بازار نیست و برخی نگرانیهای ایمنی درباره کاهش امتناع مدل در برابر درخواستهای حساس نیز مطرح شده است.
با توجه به سرعت بالای انتشار نسخههای جدید (تقریباً هر چند ماه یک بار)، توصیه میشود پیش از هرگونه تصمیمگیری فنی یا سرمایهگذاری روی این مدل، برای اطمینان از آخرین قیمتها، قابلیتها و شرایط دسترسی به منابع رسمی Moonshot AI در آدرسهای kimi.com و platform.moonshot.ai مراجعه شود، زیرا این حوزه به سرعت در حال تغییر است.
https://sahandserver.com/s/zch
کپی آدرس
