Prime Agent چیست؟ تحلیل کامل معماری RLM، بنچمارک ARC-AGI-3 و چرا باید همین الان با ChatGPT Codex یا Kimi از آن استفاده کنید

Prime Agent هارس اپنسورس و خود-بهبوددهنده شرکت Prime Intellect است که در اوت ۲۰۲۶ منتشر شد. با معماری Recursive Language Model (RLM) و کرنل پایدار IPython، مصرف توکن را به شدت کاهش میدهد، از ایجنتهای فرعی بازگشتی پشتیبانی میکند و با دستور /refine خودش را از اشتباهات یاد میگیرد. در بنچمارک ARC-AGI-3 به ۹۵.۵٪ Best-at-1 (بالاتر از خط پایه انسانی) و ۹۹.۹۷٪ Best-at-3 رسیده است. پشتیبانی کامل OAuth برای ChatGPT Plus/Pro (Codex) و Claude و امکان استفاده از Kimi باعث میشود با اشتراکهای موجود از پیکسول بتوانید بلافاصله آن را روی پروژههای بزرگ اجرا کنید. آنی · اصل · امن.
اگر هر روز با ایجنتهای کدنویسی کار میکنید، احتمالاً از دو درد کلاسیک خسته شدهاید: پر شدن سریع context و افت کیفیت استدلال بعد از چند ده پیام. هزینه توکن هم که برای پروژههای واقعی سنگین میشود. تیم Prime Intellect در ۵ آگوست ۲۰۲۶ با معرفی Prime Agent این بازی را عوض کرد.
این ابزار اپنسورس (مجوز MIT) فقط یک CLI ساده نیست. بر پایه معماری جدید Recursive Language Model (RLM) و مفهوم Continual Harness ساخته شده. در بنچمارک سختگیرانه ARC-AGI-3 با مدل Opus 5 به امتیاز ۹۵.۵٪ در حالت Best-at-1 رسیده و خط پایه متخصصان انسانی (۹۵.۴٪) را شکسته است. در حالت Best-at-3 حتی به ۹۹.۹۷٪ رسیده و تمام ۱۸۳ سطح را کامل کرده.
Prime Agent – هارس خود-بهبوددهنده مبتنی بر RLM
این مطلب طولانی و تخصصی، معماری فنی، ویژگیهای کلیدی، مقایسه با Claude Code و OpenAI Codex و Pi Agent و OpenCode را موشکافی میکند. در پایان نشان میدهیم چطور با اشتراکهای موجود مثل ChatGPT (برای Codex) و Kimi AI از پیکسول، بلافاصله قدرت کامل آن را در اختیار دارید.
فلسفه وجودی و مشکلات ایجنتهای نسل اول
در نسل اول ایجنتهای کدنویسی، الگو ساده بود: مدل خروجی متنی تولید میکند، ابزار را صدا میزند و خروجی خام ابزار (مثلاً کل محتوای یک فایل یا لاگ طولانی) مستقیم داخل context window ریخته میشود. دو مشکل بزرگ پیش میآمد:
انفجار توکن (Token Bloat): حافظه کوتاهمدت مدل با دادههای خام پر میشود. یک فایل ۱۰۰ هزار خطی یا خروجی تست طولانی کافی است تا به سقف برسید.
افت کیفیت استدلال (Context Degradation): هرچه تاریخچه شلوغتر شود، توانایی استدلال مدل کاهش پیدا میکند.
Prime Agent این پارادایم را تغییر داده. هدف ساخت یک ایجنت برنامهنویسی شبیه انسان است که روی کدبیسهای عظیم کار کند، منابع را بهینه مصرف کند و بعد از هر تعامل، خودش را بهبود ببخشد.
ساختار فنی و معماری Monorepo
مخزن پروژه (prime-agent) یک Monorepo چندزبانه (TypeScript + Python) است:
packages/agent: موتور اصلی و حلقه ایجنتpackages/ai: لایه تجرید مدلها، providers و پروتکل MCPpackages/coding-agent: CLI تعاملی، مدیریت جلسات، Daemon و ابزارهاpackages/tui: موتور رابط کاربری ترمینالprime-agent-runtime: هسته پایتونی برای اجرای RLM و کرنل IPython
لایه @prime/ai پشتیبانی بومی از Anthropic (Extended Thinking و Prompt Caching)، OpenAI/Azure/Codex، Google Gemini/Vertex، Bedrock، Cloudflare، Mistral و پروتکل MCP دارد. مکانیزم مدیریت کلید و OAuth هم وجود دارد: میتوانید مستقیم با حساب ChatGPT Plus/Pro، Claude Pro/Max یا GitHub Copilot لاگین کنید بدون نیاز به API Key اختصاصی.
معماری انقلابی RLM (Recursive Language Model)
بزرگترین نوآوری فنی همینجاست.

مقایسه معماری سنتی در برابر RLM: فیلتر خروجی در کرنل IPython به جای ریختن متن خام در context

در مدل سنتی، خروجی ابزار خام وارد context میشود. در Prime Agent مدل به یک REPL زنده پایتون (IPython Kernel پایدار) دسترسی دارد که در طول کل جلسه باز میماند.
مدل دادهها را به عنوان متغیرهای پایتون مدیریت میکند.
برای خواندن یک فایل بزرگ، اسکریپت کوتاهی مینویسد که فقط بخشهای مرتبط یا آمار استخراجشده را برمیگرداند. متن خام وارد context نمیشود.
ابزارها و ایجنتهای فرعی به شکل توابع پایتون صدا زده میشوند.
فراخوانی بازگشتی ایجنتهای فرعی: هر Sub-agent یک نمونه کامل از Prime Agent با تاریخچه و مدل مستقل است. ایجنت اصلی میتواند در محیط پایتون خود تابع را صدا بزند:
handle = await rlm("این بخش از کد را از نظر امنیتی بررسی کن", name="auth-reviewer")خروجی مثل نتیجه یک تابع عادی برمیگردد. کارها موازی انجام میشوند و context اصلی شلوغ نمیشود. این طراحی باعث میشود روی کدبیسهای خیلی بزرگ هم کارآمد بماند؛ جایی که ایجنتهای سنتی بعد از چند دقیقه به سقف توکن میخورند.
Continual Harness و قابلیت خود-بهبوددهی
اکثر ایجنتها پرامپت و ساختار ثابت دارند. اگر اشتباهی کنید و اصلاح کنید، جلسه بعدی دوباره همان اشتباه تکرار میشود. Prime Agent ساختار harness (پرامپتها، مهارتها و حافظه) را به عنوان دادههای قابل تغییر (Mutable State) مدیریت میکند.
دستور /refine: تاریخچه تعاملات اخیر را تحلیل میکند و اصلاحات شما را به عنوان «درسهای آموختهشده» به harness اضافه میکند.
پرامپت پایه سیستم تغییرناپذیر میماند تا ثبات حفظ شود.
تمام بهروزرسانیها Snapshot میشوند و در صورت نیاز قابل Rollback هستند.
مهارتها دیگر فقط فایل Markdown نیستند. پکیجهای استاندارد پایتون (با pyproject.toml) هستند که با uv/pip ایزوله نصب میشوند. دستور /skill-creator فرآیندهای تکراری را به مهارت کپسوله تبدیل میکند.
معماری Daemon، حالت خودمختار و پروتکلها
اجرای ایجنت در حالت Daemon حیاتی است برای پروژههای بزرگ:
فرآیندها در پسزمینه ادامه پیدا میکنند حتی اگر ترمینال بسته شود یا SSH قطع شود.
دستور
prime-agent agentsتمام جلسات فعال را نشان میدهد.prime-agent attachاتصال مجدد به هر جلسه.ایجنتها میتوانند مستقیم با هم ارتباط برقرار کنند.
دستورهای هدفمحور:
/goal: اهداف بلندمدت که در فشردهسازیهای متوالی پایدار میمانند./heartbeat: بیدار کردن دورهای برای بررسی وضعیت./autonomous: اجرای مستقل با بودجه توکن و زمان مشخص + Quality Gate.
پشتیبانی از ACP (اتصال به IDEهایی مثل VS Code و Cursor) و MCP (اتصال به پایگاه داده و ابزارهای سازمانی) هم وجود دارد.
مقایسه تفصیلی با رقبا
ویژگی / پارامتر Prime Agent Claude Code OpenAI Codex Pi Agent OpenCode معماری کانتکست RLM (IPython Kernel) خطی خطی / تکمیل متنی خطی پایهای خطی متداول مصرف توکن فوقالعاده بهینه بالا متوسط متوسط بالا خود-بهبودی دارد (/refine) ندارد ندارد ندارد ندارد معماری اجرا Daemon پسزمینه تکجلسهای تکجلسهای تکجلسهای تکجلسهای اسپاون بازگشتی دارد (تابع پایتون) محدود ندارد محدود ندارد مدلهای پشتیبانیشده همه فقط Anthropic فقط OpenAI محدود آزاد/محدود مدل مالی OAuth + API + Local Claude API Key API Key API/Local سیستم مهارتها پکیج پایتون ایزوله Markdown JSON Schema ساده Markdown حالت خودمختار کامل دارد خیر خیر محدود خیر مجوز MIT اپنسورس تجاری تجاری اپنسورس اپنسورس
در برابر Claude Code: Claude Code خروجیهای خام را مستقیم وارد context میکند و سریع به سقف میرسد. Prime Agent با RLM فقط نتایج فیلترشده را نگه میدارد. Claude Code قفل به مدلهای Anthropic است؛ Prime Agent هر مدلی را میپذیرد. خود-بهبودی هم ندارد.
در برابر OpenAI Codex: Codex بیشتر روی تکمیل کد متمرکز است. Prime Agent یک harness کامل پژوهشی و توسعه است. نکته طلایی اینجاست: چون پشتیبانی OAuth برای ChatGPT Plus/Pro (Codex) دارد، با خرید اشتراک از پیکسول میتوانید مستقیم Codex را داخل محیط RLM استفاده کنید.
در برابر Pi Agent و OpenCode: Prime Agent نسخه تکاملیافته Pi است. معماری RLM پیشرفته، Daemon و Continual Harness را ندارد. harnessهای ساده اپنسورس فاقد محیط IPython persistent و خود-بهبودی هستند.
تحلیل بنچمارک ARC-AGI-3

ARC-AGI-3 یکی از سختترین تستهای استدلال تعاملی و agentic است. محیطهای کاملاً جدید که عامل باید قوانین را کشف کند، مدل ذهنی بسازد و عمل کند. خط پایه متخصصان انسانی ۹۵.۴٪ گزارش شده.
نتایج بنچمارک ARC-AGI-3: ۹۵.۵٪ Best-at-1 و ۹۹.۹۷٪ Best-at-3
Prime Agent با Opus 5 به ۹۵.۵٪ Best-at-1 رسیده. سه run جداگانه ۹۵.۰، ۹۵.۲ و ۹۵.۵ ثبت شده و Best-at-3 حدود ۹۹.۹۷٪ با تکمیل تمام ۱۸۳ سطح. مهمتر از عدد خام این است که این نتیجه بدون آموزش خاص مدل روی harness به دست آمده و روی مدلهای دیگر هم بهبود نسبت به harnessهای proprietary دیده شده. از نظر token efficiency هم برتری دارد.
این یعنی معماری RLM واقعاً کار میکند: مدل میتواند context را برنامهنویسی کند به جای اینکه در آن غرق شود.
نصب سریع و استفاده عملی با مدلهای مختلف
نصب روی لینوکس یا macOS:
curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | shسپس در پوشه پروژه:
prime-agentبا /login میتوانید مستقیم وارد حساب ChatGPT Plus/Pro (Codex) یا Claude Pro/Max شوید. API Key هم پشتیبانی میشود. مدلهای محلی (Ollama، LM Studio، vLLM) و مدلهای اپنسورس قوی مثل GLM-5.2 و DeepSeek هم کار میکنند.
نقطه طلایی برای کاربران ایرانی و پیکسول
چون پشتیبانی کامل OAuth برای ChatGPT Plus/Pro وجود دارد، با خرید اشتراک از پیکسول میتوانید بدون API Key اضافه و هزینههای پنهان، مستقیم از قدرت Codex داخل محیط RLM و Daemon استفاده کنید. Codex برای کدنویسی agentic فوقالعاده است و با مدیریت کانتکست هوشمند Prime Agent حتی بهتر عمل میکند.
برای پروژههایی که به context بسیار بزرگ (تا ۱ میلیون توکن) و مدلهای کدنویسی قوی مثل Kimi K3 نیاز دارید، اشتراک Kimi AI انتخاب ایدهآلی است. فقط کلید را تنظیم کنید و شروع کنید.
اگر IDE میخواهید، با پروتکل ACP میتوانید آن را به Cursor متصل کنید و از قدرت مدلهای روز (از جمله Grok 4.5) بهرهمند شوید. برای کسانی که Claude را ترجیح میدهند هم اشتراک Claude Pro/Max از پیکسول مستقیم با /login کار میکند.
لینکهای مستقیم خرید با تحویل آنی:
اشتراک ChatGPT · OpenAI
خرید اشتراک ChatGPT Plus و Pro با تحویل آنی. دسترسی کامل به GPT-5.6، Codex (سازگار با Claude Code، Hermes، OpenCode و pi.dev)، GPT-Live و تولید تصویر پیشرفته. اصل · امن · پشتیبانی واقعی.اشتراک Claude AI
اشتراک رسمی Claude Pro، Max 5x و Max 20x با تحویل آنی روی ایمیل. دسترسی کامل به Claude Code، Cowork، Design و مدلهای پیشرفته Anthropic. آنی · اصل · امن · ضمانت بازگشت وجه در صورت بن.اشتراک Cursor
Cursor یکی از قویترین IDE مبتنی بر هوش مصنوعی برای کدنویسی agentic. با Grok 4.5، Composer 2.5 و دسترسی به بهترین مدلهای روز. پلن مناسب خودت را انتخاب کن و فوری فعال کن.اشتراک Kimi AI
اشتراک Kimi AI با تحویل آنی | Plus / Pro / Ultra - دسترسی به مدلهای Kimi (از جمله K3 و K2.7-code) با context تا ۱ میلیون توکن، Kimi AI Code و سانسور کمتر. فعالسازی مستقیم روی اکانت خودت. مناسب کدنویسی و کارهای بلندمدت.
این ترکیب (Prime Agent + مدل قوی از پیکسول) یعنی harness خود-بهبوددهنده و توکنبهینه + مدل frontier با قیمت منطقی و پشتیبانی واقعی فارسی. دیگر لازم نیست بین هزینه توکن، محدودیت مدل و پیچیدگی راهاندازی یکی را انتخاب کنید.
نتیجهگیری و توصیه نهایی
Prime Agent فقط یک ابزار جدید نیست؛ تغییر پارادایم در نحوه تعامل ایجنت با مدل زبانی و کانتکست است. RLM با کرنل IPython پایدار، Continual Harness با قابلیت /refine، معماری Daemon و پشتیبانی گسترده از مدلها (از جمله OAuth مستقیم برای ChatGPT Codex و Claude) آن را به یکی از قویترین و انعطافپذیرترین harnessهای کدنویسی ۲۰۲۶ تبدیل کرده.
اگر روی پروژههای بزرگ کار میکنید، بودجه توکن برایتان مهم است، یا میخواهید ایجنتی داشته باشید که از اشتباهات یاد بگیرد و در پسزمینه به کار ادامه دهد، همین امروز امتحانش کنید. نصب رایگان و اپنسورس است. فقط مدل را از پیکسول با تحویل آنی تهیه کنید و شروع کنید.
آنی · اصل · امن · پشتیبانی واقعی.
پیسکول DIGITAL — تخصص ما محصولات دیجیتال با تحویل آنی است.
لینکهای رسمی برای مطالعه بیشتر:
اگر سوالی در مورد نصب، تنظیم مدل یا ترکیب با اشتراکهای پیکسول دارید، در کامنتها یا از طریق پشتیبانی تلگرام بپرسید. موفق باشید.
این مطلب را بفرستید
لینک، تلگرام، یا منابع منتخب گوگل
مطالب مرتبط
همه مطالب
Qwen 3.8-Max از زبان کاربران: قدرت کدنویسی، نقاط ضعف و مقایسه با Kimi
Qwen 3.8-Max از زبان کاربران: قدرت کدنویسی، نقاط ضعف و مقایسه با Kimi

مدل Kimi K3 چیست؟ بررسی کامل معماری ۲.۸ تریلیونی، بنچمارکها و مقایسه با Claude و GPT
Kimi K3 اولین مدل open-weight کلاس ۲.۸ تریلیون پارامتر با ۱ میلیون توکن context است. بنچمارکها، معماری و مقایسه با Claude Fable 5 را ببین و اشتراکش را با تحویل آنی از پیکسول بگیر.
