Prime Agent چیست؟ تحلیل کامل معماری RLM، بنچمارک ARC-AGI-3 و چرا باید همین الان از ChatGPT Codex یا Kimi استفاده کنید

Prime Agent هارس اپنسورس و خود-بهبوددهنده شرکت Prime Intellect است که در اوت ۲۰۲۶ منتشر شد. با معماری Recursive Language Model (RLM) و کرنل پایدار IPython، مصرف توکن رو به شدت کاهش میده، از ایجنتهای فرعی بازگشتی پشتیبانی میکند و با دستور /refine خودش رو از اشتباهات دور میکنه.
اگه هر روز با ایجنتهای کدنویسی کار میکنید، احتمالاً از دوتا درد کلاسیک خسته شدید: پر شدن سریع context و افت کیفیت استدلال بعد از چند ده پیام. هزینهی توکن هم که برای پروژههای واقعی خیلی سنگین میشه. تیم Prime Intellect توی ۵ آگوست ۲۰۲۶، با معرفی Prime Agent، این بازی رو عوض کرد.
این ابزار اپنسورسه (با مجوز MIT) و فقط یه CLI ساده نیست. روی معماری جدید Recursive Language Model (RLM) و مفهوم Continual Harness ساخته شده. توی بنچمارک سختگیرانهی ARC-AGI-3 با مدل Opus 5 به امتیاز ۹۵.۵٪ توی حالت Best-at-1 رسیده و از خط پایهی متخصصان انسانی (۹۵.۴٪) هم جلو زده. توی حالت Best-at-3 حتی به ۹۹.۹۷٪ رسیده و تمام ۱۸۳ سطح رو کامل کرده.
Prime Agent، یه هارس خود-بهبوددهنده مبتنی بر RLM
این مطلب طولانی و تخصصیه؛ معماری فنی، ویژگیهای کلیدی، مقایسه با Claude Code، OpenAI Codex، Pi Agent و OpenCode رو موشکافی میکنیم. آخر سر هم نشون میدیم چطور با اشتراکهای موجود، مثل ChatGPT (برای Codex) و Kimi AI از پیکسول، بلافاصله میتونید از قدرت کاملش استفاده کنید.
فلسفهی وجودی و مشکلات ایجنتهای نسل اول
توی نسل اول ایجنتهای کدنویسی، الگو ساده بود: مدل یه خروجی متنی تولید میکرد، ابزار رو صدا میزد، و خروجی خام همون ابزار (مثلاً کل محتوای یه فایل یا یه لاگ طولانی) مستقیم میریخت داخل context window. دو مشکل بزرگ اینجوری پیش میاومد:
انفجار توکن (Token Bloat): حافظهی کوتاهمدت مدل پر میشد از دادههای خام. یه فایل ۱۰۰ هزار خطی یا خروجی تست طولانی کافی بود تا به سقف برسید.
افت کیفیت استدلال (Context Degradation): هرچی تاریخچه شلوغتر میشد، توانایی استدلال مدل هم کمتر میشد.
Prime Agent این پارادایم رو عوض کرده. هدفش ساخت یه ایجنت برنامهنویسی شبیه انسانه که روی کدبیسهای عظیم کار کنه، منابع رو بهینه مصرف کنه و بعد از هر تعامل، خودش رو بهبود بده.
ساختار فنی و معماری Monorepo
مخزن پروژه (prime-agent) یه Monorepo چندزبانهست (TypeScript + Python):
packages/agent: موتور اصلی و حلقهی ایجنتpackages/ai: لایهی تجرید مدلها، providers و پروتکل MCPpackages/coding-agent: CLI تعاملی، مدیریت جلسات، Daemon و ابزارهاpackages/tui: موتور رابط کاربری ترمینالprime-agent-runtime: هستهی پایتونی برای اجرای RLM و کرنل IPython
لایهی @prime/ai پشتیبانی بومی از Anthropic (شامل Extended Thinking و Prompt Caching)، OpenAI/Azure/Codex، Google Gemini/Vertex، Bedrock، Cloudflare، Mistral و پروتکل MCP داره. یه مکانیزم مدیریت کلید و OAuth هم داره: میتونید مستقیم با حساب ChatGPT Plus/Pro، Claude Pro/Max یا GitHub Copilot لاگین کنید، بدون نیاز به یه API Key اختصاصی.
معماری انقلابی RLM (Recursive Language Model)
بزرگترین نوآوری فنی دقیقاً همینجاست.
مقایسهی معماری سنتی در برابر RLM: فیلتر خروجی توی کرنل IPython، بهجای ریختن متن خام توی context
توی مدل سنتی، خروجی خام ابزار مستقیم وارد context میشه. توی Prime Agent، مدل به یه REPL زندهی پایتون (کرنل IPython پایدار) دسترسی داره که توی کل جلسه باز میمونه.
مدل دادهها رو به شکل متغیرهای پایتون مدیریت میکنه.
برای خوندن یه فایل بزرگ، یه اسکریپت کوتاه مینویسه که فقط بخشهای مرتبط یا آمار استخراجشده رو برمیگردونه؛ متن خام هیچوقت وارد context نمیشه.
ابزارها و ایجنتهای فرعی هم به شکل توابع پایتون صدا زده میشن.
فراخوانی بازگشتی ایجنتهای فرعی: هر Sub-agent یه نمونهی کامل از Prime Agent با تاریخچه و مدل مستقله. ایجنت اصلی میتونه توی محیط پایتون خودش تابعشو صدا بزنه:
handle = await rlm("این بخش از کد را از نظر امنیتی بررسی کن", name="auth-reviewer")
خروجی مثل نتیجهی یه تابع عادی برمیگرده. کارها موازی انجام میشن و context اصلی شلوغ نمیشه. این طراحی باعث میشه روی کدبیسهای خیلی بزرگ هم کارآمد بمونه؛ جایی که ایجنتهای سنتی معمولاً بعد از چند دقیقه به سقف توکن میخورن.
Continual Harness و قابلیت خود-بهبوددهی
اکثر ایجنتها یه پرامپت و ساختار ثابت دارن؛ اگه اشتباهی کنید و اصلاحش کنید، جلسهی بعدی دوباره همون اشتباه تکرار میشه. Prime Agent ساختار harness (پرامپتها، مهارتها و حافظه) رو بهعنوان دادهی قابل تغییر (Mutable State) مدیریت میکنه.
دستور /refine: تاریخچهی تعاملات اخیر رو تحلیل میکنه و اصلاحات شما رو بهعنوان «درسهای آموختهشده» به harness اضافه میکنه.
پرامپت پایهی سیستم تغییرناپذیر میمونه تا ثبات حفظ بشه.
همهی بهروزرسانیها Snapshot میشن و در صورت نیاز قابل Rollback هستن.
مهارتها دیگه فقط فایل Markdown نیستن؛ پکیجهای استاندارد پایتونن (با pyproject.toml) که با uv یا pip بهصورت ایزوله نصب میشن. دستور /skill-creator هم فرآیندهای تکراری رو به یه مهارت کپسوله تبدیل میکنه.
معماری Daemon، حالت خودمختار و پروتکلها
اجرای ایجنت توی حالت Daemon برای پروژههای بزرگ حیاتیه:
فرآیندها توی پسزمینه ادامه پیدا میکنن، حتی اگه ترمینال بسته بشه یا SSH قطع بشه.
دستور
prime-agent agentsهمهی جلسات فعال رو نشون میده.prime-agent attachبرای اتصال مجدد به هر جلسه.ایجنتها میتونن مستقیم با هم ارتباط برقرار کنن.
چندتا دستور هدفمحور هم داره:
/goal: اهداف بلندمدتی که توی فشردهسازیهای متوالی پایدار میمونن./heartbeat: بیدار کردن دورهای برای بررسی وضعیت./autonomous: اجرای مستقل با بودجهی توکن و زمان مشخص، بههمراه Quality Gate.
پشتیبانی از ACP (برای اتصال به IDEهایی مثل VS Code و Cursor) و MCP (برای اتصال به پایگاه داده و ابزارهای سازمانی) هم وجود داره.
مقایسهی تفصیلی با رقبا
| ویژگی / پارامتر | Prime Agent | Claude Code | OpenAI Codex | Pi Agent | OpenCode |
|---|---|---|---|---|---|
| معماری کانتکست | RLM (IPython Kernel) | خطی | خطی / تکمیل متنی | خطی پایهای | خطی متداول |
| مصرف توکن | فوقالعاده بهینه | بالا | متوسط | متوسط | بالا |
| خود-بهبودی | دارد (/refine) | ندارد | ندارد | ندارد | ندارد |
| معماری اجرا | Daemon پسزمینه | تکجلسهای | تکجلسهای | تکجلسهای | تکجلسهای |
| اسپاون بازگشتی | دارد (تابع پایتون) | محدود | ندارد | محدود | ندارد |
| مدلهای پشتیبانیشده | همه | فقط Anthropic | فقط OpenAI | محدود | آزاد/محدود |
| مدل مالی | OAuth + API + Local | Claude API Key | API Key | API/Local | |
| سیستم مهارتها | پکیج پایتون ایزوله | Markdown | JSON Schema | ساده | Markdown |
| حالت خودمختار کامل | دارد | خیر | خیر | محدود | خیر |
| مجوز | MIT اپنسورس | تجاری | تجاری | اپنسورس | اپنسورس |
در برابر Claude Code: Claude Code خروجیهای خام رو مستقیم وارد context میکنه و سریع به سقف میرسه. Prime Agent با RLM فقط نتایج فیلترشده رو نگه میداره. Claude Code هم قفل به مدلهای Anthropicه؛ Prime Agent هر مدلی رو میپذیره و خود-بهبودی هم داره که Claude Code نداره.
در برابر OpenAI Codex: Codex بیشتر تمرکزش روی تکمیل کده. Prime Agent یه harness کامل پژوهشی و توسعهست. نکتهی جالب اینجاست: چون پشتیبانی OAuth برای ChatGPT Plus/Pro (Codex) داره، با خرید اشتراک از پیکسول میتونید مستقیم Codex رو داخل محیط RLM استفاده کنید.
در برابر Pi Agent و OpenCode: Prime Agent عملاً نسخهی تکاملیافتهی Piه. اینا معماری RLM پیشرفته، Daemon و Continual Harness رو ندارن؛ harnessهای سادهی اپنسورس فاقد محیط IPython پایدار و خود-بهبودی هستن.
تحلیل بنچمارک ARC-AGI-3
ARC-AGI-3 یکی از سختترین تستهای استدلال تعاملی و agenticه. یه محیط کاملاً جدید که عامل باید قوانینش رو کشف کنه، مدل ذهنی بسازه و عمل کنه. خط پایهی متخصصان انسانی هم ۹۵.۴٪ گزارش شده.
نتایج بنچمارک ARC-AGI-3: ۹۵.۵٪ توی Best-at-1 و ۹۹.۹۷٪ توی Best-at-3
Prime Agent با Opus 5 به ۹۵.۵٪ Best-at-1 رسیده. سه ران جداگانه اعداد ۹۵.۰، ۹۵.۲ و ۹۵.۵ رو ثبت کردن و Best-at-3 حدود ۹۹.۹۷٪ شده، با تکمیل تمام ۱۸۳ سطح. مهمتر از عدد خام اینه که این نتیجه بدون آموزش خاص مدل روی harness به دست اومده، و روی مدلهای دیگه هم نسبت به harnessهای proprietary بهبود دیده شده. از نظر token efficiency هم برتری داره.
این یعنی معماری RLM واقعاً کار میکنه: مدل میتونه context رو برنامهنویسی کنه، بهجای اینکه توش غرق بشه.
نصب سریع و استفادهی عملی با مدلهای مختلف
نصب روی لینوکس یا macOS:
curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh
بعدش توی پوشهی پروژه:
prime-agent
با /login میتونید مستقیم وارد حساب ChatGPT Plus/Pro (Codex) یا Claude Pro/Max بشید. API Key هم پشتیبانی میشه. مدلهای محلی (Ollama، LM Studio، vLLM) و مدلهای اپنسورس قوی مثل GLM-5.2 و DeepSeek هم کار میکنن.
نکتهی طلایی برای کاربرای ایرانی و پیکسول
چون پشتیبانی کامل OAuth برای ChatGPT Plus/Pro وجود داره، با خرید اشتراک از پیکسول میتونید بدون نیاز به API Key اضافه و بدون هزینهی پنهان، مستقیم از قدرت Codex داخل محیط RLM و Daemon استفاده کنید. Codex برای کدنویسی agentic فوقالعادهست و با مدیریت هوشمند کانتکست Prime Agent حتی بهتر هم عمل میکنه.
برای پروژههایی که به context خیلی بزرگ (تا ۱ میلیون توکن) و مدلهای کدنویسی قوی مثل Kimi K3 نیاز دارید، اشتراک Kimi AI یه انتخاب ایدهآله. فقط کلید رو تنظیم کنید و شروع کنید.
اگه IDE میخواید، با پروتکل ACP میتونید به Cursor وصلش کنید و از قدرت مدلهای روز (از جمله Grok 4.5) استفاده کنید. برای کسایی که Claude رو ترجیح میدن هم، اشتراک Claude Pro/Max از پیکسول مستقیم با /login کار میکنه.
لینکهای مستقیم خرید با تحویل آنی:
اشتراک ChatGPT · OpenAI
خرید اشتراک ChatGPT Plus و Pro با تحویل آنی. دسترسی کامل به GPT-5.6، Codex (سازگار با Claude Code، Hermes، OpenCode و pi.dev)، GPT-Live و تولید تصویر پیشرفته. اصل · امن · پشتیبانی واقعی.اشتراک Claude AI
اشتراک رسمی Claude Pro، Max 5x و Max 20x با تحویل آنی روی ایمیل. دسترسی کامل به Claude Code، Cowork، Design و مدلهای پیشرفتهی Anthropic. آنی · اصل · امن · ضمانت بازگشت وجه در صورت بن.اشتراک Cursor
Cursor یکی از قویترین IDEهای مبتنی بر هوش مصنوعی برای کدنویسی agenticه. با Grok 4.5، Composer 2.5 و دسترسی به بهترین مدلهای روز. پلن مناسب خودت رو انتخاب کن و فوری فعالش کن.اشتراک Kimi AI
اشتراک Kimi AI با تحویل آنی؛ پلنهای Plus، Pro و Ultra. دسترسی به مدلهای Kimi (از جمله K3 و K2.7-code) با context تا ۱ میلیون توکن، Kimi AI Code و سانسور کمتر. فعالسازی مستقیم روی اکانت خودت؛ مناسب کدنویسی و کارهای بلندمدت.
این ترکیب (Prime Agent + یه مدل قوی از پیکسول) یعنی هارس خود-بهبوددهنده و توکنبهینه، در کنار یه مدل frontier با قیمت منطقی و پشتیبانی واقعی فارسی. دیگه لازم نیست بین هزینهی توکن، محدودیت مدل و پیچیدگی راهاندازی فقط یکی رو انتخاب کنید.
نتیجهگیری و توصیهی نهایی
Prime Agent فقط یه ابزار جدید نیست؛ یه تغییر پارادایمه توی نحوهی تعامل ایجنت با مدل زبانی و کانتکست. RLM با کرنل IPython پایدار، Continual Harness با قابلیت /refine، معماری Daemon و پشتیبانی گسترده از مدلها (از جمله OAuth مستقیم برای ChatGPT Codex و Claude)، این ابزار رو به یکی از قویترین و انعطافپذیرترین harnessهای کدنویسی سال ۲۰۲۶ تبدیل کرده.
اگه روی پروژههای بزرگ کار میکنید، بودجهی توکن براتون مهمه، یا میخواید ایجنتی داشته باشید که از اشتباهاتش یاد بگیره و توی پسزمینه به کارش ادامه بده، همین امروز امتحانش کنید. نصبش رایگان و اپنسورسه. فقط مدلتون رو از پیکسول با تحویل آنی تهیه کنید و شروع کنید.
آنی · اصل · امن · پشتیبانی واقعی.
پیکسول — تخصص ما محصولات دیجیتال با تحویل آنیه.
لینکهای رسمی برای مطالعهی بیشتر:
اگه سوالی دربارهی نصب، تنظیم مدل یا ترکیب با اشتراکهای پیکسول دارید، توی کامنتها یا از طریق پشتیبانی تلگرام بپرسید. موفق باشید.
این مطلب را بفرستید
لینک، تلگرام، یا منابع منتخب گوگل
مطالب مرتبط
همه مطالب
تفاوت ChatGPT Plus و Pro | کدام را بخریم؟ (راهنمای ۲۰۲۶)
تفاوت chatgpt plus و pro را کامل بدانید.برای کدنویسی و Codex ،Plus کافی است یا Pro؟

ریشههای PI agent و فلسفه مینیمالیسم
تحلیل جامع معماری و فلسفه Pi Agent و مقایسه با Claude Code، Codex، OpenCode و Prime Agent. ببین چطور با اشتراک ChatGPT یا Kimi از مدلهای قوی داخل Pi استفاده کنی.

Qwen 3.8-Max از زبان کاربران: قدرت کدنویسی، نقاط ضعف و مقایسه با Kimi
Qwen 3.8-Max از زبان کاربران: قدرت کدنویسی، نقاط ضعف و مقایسه با Kimi