SSD Nodes Learn Hosting plans →
راهنماها Matt Connorتوسط Matt Connor

خرید API Claude از ایران: چه چیزی واقعاً کار می‌کند

ایران در فهرست مناطق پشتیبانی‌شده Anthropic نیست. اینجا می‌گوییم حساب Console و کلید API از کجا قانونی است، ریسک کلید اشتراکی چیست و جایگزین واقعی کدام است.

پاسخ کوتاه: کدام راه برای شماست

خرید API Claude از ایران با حساب و کارت ایرانی ممکن نیست، چون ایران در فهرست مناطق پشتیبانی‌شدهٔ Anthropic نیست. این فهرست را خود Anthropic در صفحهٔ Supported Countries and Regions منتشر می‌کند و در ۳۰ سپتامبر ۲۰۲۶ که بررسی شد، نامی از ایران در آن نبود. همان فهرست هم برای API تجاری معتبر است و هم برای Claude.ai، پس «خرید api claude» و «خرید اکانت claude» دو صورت از یک پرسش‌اند و یک پاسخ دارند.

عملاً سه راه پیش روی یک توسعه‌دهنده در ایران است:

  1. حسابی در کشوری پشتیبانی‌شده، به نام کسی که واقعاً همان‌جا زندگی یا کار می‌کند، یا حساب سازمانی کارفرمای شما در آن کشور.
  2. کلید یا دسترسی به یک سازمان اشتراکی که از واسطه خریده می‌شود.
  3. یک مدل باز روی VPS خودتان.

راه دوم امروز رایج‌ترین است و کم‌دوام‌ترین. دلیلش فنی است: کلید مال organization است، آن organization مال شما نیست، و هر سقفی که به برنامهٔ شما اصابت می‌کند در جایی تنظیم شده که به آن دسترسی ندارید. دور زدن محدودیت جغرافیایی هم راه چهارم نیست. Usage Policy خود Anthropic در بخش سوءاستفاده از پلتفرم، «Access or facilitate account or API access to Claude to persons, entities, or users in violation of our Supported Regions Policy» را ممنوع کرده است. یعنی آن مسیر ریسک را حذف نمی‌کند، فقط آن را روی حساب شخص دیگری منتقل می‌کند.

فهرست مناطق پشتیبانی‌شده چه می‌گوید

فهرست Anthropic بلند است و بیشتر منطقه را پوشش می‌دهد. از همسایه‌ها و کشورهای نزدیک، عراق، ترکیه، امارات، عربستان، ارمنستان، آذربایجان، ترکمنستان، پاکستان و هند در فهرست ۳۰ سپتامبر ۲۰۲۶ حاضرند. ایران و افغانستان نیستند. اوکراین با استثنای کریمه و چند استان آمده، که نشان می‌دهد این فهرست حتی در سطح زیرمنطقه نگه‌داری می‌شود و تغییر می‌کند.

این نکته برای شما کاربرد مستقیم دارد: اگر کارفرما یا شرکت شما در یکی از آن کشورها ثبت است، مسیر قانونی از همان‌جا باز است و لازم نیست سراغ واسطه بروید. تفکیک کامل دسترسی برای Claude.ai و API در صفحهٔ کشورهایی که Claude در آن‌ها در دسترس است آمده. پیش از هر تصمیمی همان صفحهٔ رسمی Anthropic را در تاریخ روز خودتان باز کنید، چون فهرستی که یک سال پیش درست بوده امروز می‌تواند غلط باشد.

حساب Console چه چیزی را در دست دارد

کلید API به تنهایی معنا ندارد. هر کلید به یک organization در Claude Console وصل است، و هر چیزی که روی رفتار برنامهٔ شما اثر می‌گذارد در سطح همان organization تنظیم می‌شود. مستندات Anthropic این را صریح می‌گوید: «Limits are set at the organization level». صاحب organization کسی است که صورتحساب به نام او است، و او هم سقف خرج را تعیین می‌کند، هم workspace می‌سازد، هم کلید را باطل می‌کند.

صورتحساب API پیش‌پرداخت است. شما credit می‌خرید و مصرف از آن کم می‌شود. صفحهٔ پشتیبانی Anthropic سه چیز را روشن می‌گوید: این اعتبار API، playground و Claude Code را پوشش می‌دهد؛ یک سال پس از تاریخ خرید منقضی می‌شود و تاریخ انقضا قابل تمدید نیست؛ و «All credit purchases are non-refundable». یعنی پولی که روی یک organization می‌رود، مال همان organization است و برگشت ندارد.

نتیجهٔ عملی: وقتی کلید را از کسی می‌خرید، آنچه می‌خرید یک رشتهٔ متنی است. مالکیت سازمان، موجودی اعتبار، سقف خرج، تنظیم workspace و مسیر پشتیبانی هیچ‌کدام همراه آن رشته به شما منتقل نمی‌شود.

کلید خریداری‌شده: سقف خرج را شما تعیین نمی‌کنید

سقف ماهانهٔ خرج در سطح سازمان اعمال می‌شود. سازمانی روی Start tier سقف ۵۰۰ دلار در ماه دارد. وقتی آن سازمان به سقفش برسد، درخواست شما HTTP 429 می‌گیرد، حتی اگر خودتان یک دلار هم خرج نکرده باشید:

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "message": "You have reached your API usage limits: your organization has crossed its monthly API usage threshold, set based on your organization's API tier. You will regain access on 2026-09-01 at 00:00 UTC.",
    "details": { "error_code": "enforced_spend_limit_reached" }
  },
  "request_id": "req_018EeWyXxfu5pfWkrYcMdjWG"
}

این خطا با یک rate limit معمولی یک تفاوت مهم دارد: هدر retry-after ندارد. مستندات صریح است که تلاش مجدد، از جمله retry خودکار SDK، تا زمان بازگشت دسترسی شکست می‌خورد. پس برنامهٔ شما تا ساعت ۰۰:۰۰ UTC روز اول ماه بعد پاسخ نمی‌گیرد، مگر اینکه صاحب سازمان سقف را بالا ببرد. error.details.error_code با مقدار enforced_spend_limit_reached تنها راه تشخیص این حالت از یک rate limit واقعی است، پس اگر روی کلید واسطه کار می‌کنید همین فیلد را در log خودتان بنویسید.

اگر صاحب سازمان خودش سقفی پایین‌تر از سقف tier تعیین کرده باشد، خطا شکل دیگری دارد: HTTP 400 با type invalid_request_error و پیامی که با You have reached your specified API usage limits شروع می‌شود. دیدن ۴۰۰ به جای ۴۲۹ یعنی سقف دستی است، نه سقف tier.

rate limit هم مشترک است. RPM و ITPM و OTPM برای کل سازمان شمرده می‌شود، پس ترافیک هر مشتری دیگری که روی همان سازمان کلید دارد از سهم شما کم می‌کند. این نوع ۴۲۹ هدر retry-after دارد و گذرا است، ولی الگوی مصرفی که آن را می‌سازد در اختیار شما نیست.

چرا کلید وسط deploy از کار می‌افتد

سه خطای مستند وجود دارد که همه در عمل یک معنا دارند: سازمان صاحب کلید تصمیمی گرفته و به شما خبر نداده است.

  • HTTP 401 با type authentication_error. مستندات می‌گوید مشکل از کلید است، مثلاً malformed یا revoked یا expired. کلیدی که rotate شده دقیقاً همین را برمی‌گرداند.
  • HTTP 403 با type permission_error. کلید اجازهٔ آن resource را ندارد. حذف شدن کلید از یک workspace همین شکل را دارد.
  • HTTP 402 با type billing_error. مشکل صورتحساب یا پرداخت. ته کشیدن اعتبار پیش‌پرداخت سازمان اینجا ظاهر می‌شود.

هر پاسخ API یک هدر request-id دارد، با مقداری مثل req_018EeWyXxfu5pfWkrYcMdjWG، و مستندات می‌گوید هنگام تماس با پشتیبانی همین را بفرستید. برای دیدن هدرها بدون چاپ بدنهٔ پاسخ:

curl -sS -D - -o /dev/null https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Hello, Claude"}]
  }'

پاسخ سالم HTTP 200 است و هدرهای request-id و anthropic-organization-id و anthropic-ratelimit-requests-remaining را نشان می‌دهد. اگر ۴۰۱ گرفتید، کلید مرده است. مشکل اینجاست که آن request_id برای شما بی‌فایده است، چون تیکت پشتیبانی را صاحب حساب باز می‌کند و نه کسی که کلید را خریده. تفکیک این خطاها و معنای هدرهای احراز هویت در توضیح احراز هویت API Claude آمده است.

بند حقوقی هم همان‌قدر مشخص است. Consumer Terms می‌گوید «You may not share your Account login information, Anthropic API key, or Account credentials with anyone else. You also may not make your Account available to anyone else.» در همان سند آمده که اگر حساب به دلیل نقض شرایط بسته شود بازپرداختی در کار نیست، و Anthropic می‌تواند «at our option delete any Materials or other data associated with your Account». پس وقتی حساب واسطه بسته شود، نه کلید می‌ماند، نه اعتبار، و نه داده‌ای که روی آن حساب مانده بود.

اگر کلید دست شماست و آن را با کسی شریک شده‌اید

کلید API یک bearer credential است: هر کسی که رشتهٔ آن را دارد می‌تواند تا سقف خرج سازمان هزینه بسازد و به همهٔ مدل‌هایی که سازمان دسترسی دارد درخواست بزند. خود کلید سقف ندارد. سقف مال workspace و سازمان است.

اگر ناچارید دسترسی را با کسی شریک شوید، کار درست این است:

  • کلید را در یک workspace غیر از default بسازید. مستندات می‌گوید روی default workspace نمی‌توانید limit تعیین کنید.
  • برای آن workspace سقف خرج و rate limit جداگانه بگذارید. سقف سازمان همیشه اعمال می‌شود، حتی اگر مجموع سقف workspace‌ها بیشتر باشد.
  • هدر anthropic-workspace-id را در پاسخ‌ها بخوانید تا بدانید هر درخواست به حساب کدام workspace نوشته شده است.

این کار خرج ناخواسته را محدود می‌کند ولی افشای اعتبارنامه را جبران نمی‌کند. همان منطق برای اعتبارنامه‌های سمت کاربر هم برقرار است و آنچه یک session key لو می‌دهد نشان می‌دهد یک رشتهٔ ساده چه اندازه دسترسی حمل می‌کند.

راهی که دوام دارد: حسابی که واقعاً مال شماست

تنها شکل پایدار دسترسی، organization‌ای است که در کشوری پشتیبانی‌شده و به نام نهاد یا شخصی که واقعاً همان‌جا مستقر است ساخته شده باشد. Commercial Terms می‌گوید «Services under these Terms are not for consumer use» و اضافه می‌کند «You may not enter into these Terms on behalf of an organization, company, or other entity unless you have the legal authority to bind that entity». یعنی امضاکنندهٔ شرایط باید واقعاً اختیار آن شرکت را داشته باشد.

برای بیشتر خوانندگان این یعنی مسیر کارفرما. اگر برای شرکتی در ترکیه، امارات، آلمان یا هر کشور دیگری از آن فهرست کار می‌کنید، از آن‌ها بخواهید organization را بسازند، برای شما یک workspace با سقف خرج مشخص تعریف کنند، و کلید خودتان را در همان workspace صادر کنند. در این حالت سه چیز را به دست می‌آورید که کلید خریداری‌شده هرگز نمی‌دهد: سقفی که قابل پیش‌بینی است، کلیدی که فقط با اطلاع شما rotate می‌شود، و مسیر پشتیبانی که با request_id شما کار می‌کند.

اگر پرسش اصلی شما مقایسهٔ هزینه است، نه دسترسی، حساب آن جداست: مقایسهٔ هزینهٔ API با اشتراک مرز صرفه را حساب می‌کند، و انتخاب پلن مناسب سمت اشتراک را باز می‌کند.

مدل باز روی VPS، وقتی همین هفته inference لازم دارید

اگر کاری دارید که باید همین هفته جواب بدهد و حساب پشتیبانی‌شده ندارید، مدل باز روی سرور خودتان تنها گزینه‌ای است که کسی نمی‌تواند از زیر پای شما بکشد. کلیدی وجود ندارد که rotate شود و سقف خرجی وجود ندارد که مال دیگری باشد. در عوض RAM می‌خرید، نه توکن.

نصب Ollama روی یک VPS لینوکسی یک خط است، همان خطی که README رسمی پروژه می‌دهد:

curl -fsSL https://ollama.com/install.sh | sh

بعد مدل را pull و اجرا کنید:

ollama pull qwen3:8b
ollama run qwen3:8b
ollama list

ollama list باید مدل را با اندازه‌اش فهرست کند. اگر فهرست خالی بود، دانلود کامل نشده است و باید ollama pull را دوباره اجرا کنید. سرویس یک HTTP API محلی روی پورت 11434 باز می‌کند و برنامهٔ شما به همان می‌زند:

curl http://localhost:11434/api/chat -d '{
  "model": "qwen3:8b",
  "stream": false,
  "messages": [
    { "role": "user", "content": "یک تابع پایتون برای نرمال‌سازی نیم‌فاصله بنویس" }
  ]
}'

بدون "stream": false این endpoint جریانی پاسخ می‌دهد و مستندات می‌گوید چند پاسخ پشت هم می‌گیرید، که در تست دستی گیج‌کننده است.

انتخاب مدل در عمل یک محاسبهٔ RAM است. وزن‌های مدل باید در حافظه جا شوند، به اضافهٔ فضایی برای context و سیستم‌عامل. حجم دانلودهای زیر از کتابخانهٔ رسمی Ollama در ۳۰ سپتامبر ۲۰۲۶ خوانده شده است. ستون RAM یک حداقل عملی است، یعنی حجم دانلود به اضافهٔ حدود دو گیگابایت سرریز:

Chartحجم دانلود مدل و حداقل RAM عملی
The data behind this chart
[
  {
    "label": "qwen3:1.7b",
    "download_gb": 1.4,
    "ram_gb": 4
  },
  {
    "label": "qwen3:4b",
    "download_gb": 2.5,
    "ram_gb": 8
  },
  {
    "label": "qwen3:8b",
    "download_gb": 5.2,
    "ram_gb": 8
  },
  {
    "label": "qwen3:14b",
    "download_gb": 9.3,
    "ram_gb": 16
  },
  {
    "label": "qwen3:32b",
    "download_gb": 20,
    "ram_gb": 32
  }
]

نقطهٔ شروع منطقی برای بیشتر کارها qwen3:8b است: 5.2 گیگابایت دانلود روی یک VPS با 8 گیگابایت RAM. پرش به qwen3:32b یعنی 20 گیگابایت وزن و سروری با 32 گیگابایت RAM، که چند برابر گران‌تر است. از 5 اندازهٔ فهرست‌شده، پیش از خرید سرور بزرگ‌تر مدل کوچک‌تر را با prompt‌های واقعی خودتان بسنجید، چون هزینهٔ سرور قطعی است و بهبود کیفیت نیست.

تفاوت بنیادی با API در شکل صورتحساب است. اجارهٔ VPS به مصرف شما کاری ندارد: یک پلن با ۸ گیگابایت RAM هر ماه یک مبلغ ثابت است، چه ده درخواست بزنید و چه ده هزار. در مدل توکنی، ده هزار درخواست هزارتای ده درخواست هزینه دارد. اگر بار شما ثابت و مداوم است سرور برنده می‌شود، و اگر پراکنده و کم است پرداخت به‌ازای توکن ارزان‌تر است. برای عامل‌هایی که شبانه‌روز روشن می‌مانند، کنترل هزینهٔ عامل هوش مصنوعی روی VPS همین محاسبه را با اعداد باز می‌کند.

دو هشدار صادقانه. اول، بدون GPU تولید متن روی CPU انجام می‌شود و به‌مراتب کندتر است، پس برای کار تعاملی مدل کوچک‌تر بردارید و برای کار دسته‌ای کندی اهمیت کمتری دارد. دوم، کیفیت مدل‌های باز روی فارسی یکنواخت نیست و هیچ benchmark انگلیسی آن را به شما نمی‌گوید. با prompt‌های فارسی خودتان تست کنید، نه با نمونه‌های انگلیسی. انتخاب بین این مسیر و پلن رسمی در استفاده از یک مدل باز به‌جای پلن Claude کامل باز شده، و اگر سؤالتان این است که خود Claude را می‌توان روی سرور خودتان اجرا کرد، پاسخ و دلیل فنی‌اش جداگانه آمده است.

کدام راه مال شماست

اگر کارفرمای شما در کشوری پشتیبانی‌شده ثبت است، از او organization و یک workspace با کلید خودتان بخواهید. این تنها حالتی است که سقف قابل پیش‌بینی و مسیر پشتیبانی دارید.

اگر خودتان در کشوری از آن فهرست زندگی یا کار می‌کنید، حساب را به نام و صورتحساب واقعی همان‌جا بسازید و تمام.

اگر هیچ‌کدام برقرار نیست، مدل باز روی VPS جواب پایدار است. کلید خریداری‌شده برای یک نمونهٔ آزمایشی چندروزه قابل تحمل است ولی زیربنای محصول نمی‌شود، چون هم اعتبار و هم سقف خرج در اختیار حسابی است که خودش خارج از شرایط کار می‌کند و هر روز می‌تواند بسته شود.

FAQ

آیا می‌توانم با کارت بانکی ایرانی در Claude Console اعتبار بخرم؟

نه. ایران در فهرست مناطق پشتیبانی‌شدهٔ Anthropic که در ۳۰ سپتامبر ۲۰۲۶ بررسی شد نیست، و همان فهرست هم برای API تجاری معتبر است و هم برای Claude.ai. صورتحساب API پیش‌پرداخت است و به یک organization در کشوری پشتیبانی‌شده بسته می‌شود. اعتبار خریداری‌شده یک سال پس از تاریخ خرید منقضی می‌شود، تاریخ انقضا قابل تمدید نیست، و به گفتهٔ صفحهٔ پشتیبانی Anthropic تمام خریدهای اعتبار غیرقابل بازپرداخت‌اند. پس حتی موجودی روی حساب شخص دیگر هم دارایی شما نیست.

کلید خریداری‌شده وسط کار از کار افتاد. چه خطایی می‌بینم و چه می‌توانم بکنم؟

اگر کلید rotate یا revoke شده باشد HTTP 401 با type authentication_error می‌گیرید. اگر کلید از workspace حذف شده باشد HTTP 403 با permission_error. اگر اعتبار سازمان ته کشیده باشد HTTP 402 با billing_error. اگر سقف ماهانهٔ سازمان پر شده باشد HTTP 429 با rate_limit_error می‌گیرید که error.details.error_code آن enforced_spend_limit_reached است و هدر retry-after ندارد، یعنی retry تا اول ماه بعد بی‌فایده است. در هیچ‌یک از این حالت‌ها راه اقدامی برای شما وجود ندارد، چون تیکت پشتیبانی فقط از سمت صاحب سازمان باز می‌شود و request_id شما بدون آن حساب ارزشی ندارد.

آیا VPN یا آدرس دیگری مشکل را حل می‌کند؟

نه، و دلیلش حقوقی است نه فنی. Usage Policy خود Anthropic در بخش سوءاستفاده از پلتفرم، دسترسی دادن یا تسهیل دسترسی به حساب یا API برخلاف Supported Regions Policy را ممنوع کرده است. یعنی حسابی که این دسترسی را فراهم می‌کند خودش در وضعیت نقض قرار دارد و قابل بستن است. Consumer Terms هم به اشتراک گذاشتن کلید API و اعتبارنامه‌های حساب را صریحاً ممنوع کرده، می‌گوید در صورت بسته شدن حساب به دلیل نقض شرایط بازپرداختی نیست، و اجازه می‌دهد داده‌های مرتبط با حساب حذف شود. محصولی که روی چنین حسابی ساخته شود تاریخ انقضای نامعلوم دارد.

حداقل RAM برای اجرای یک مدل باز روی VPS چقدر است؟

وزن مدل باید در حافظه جا شود، به اضافهٔ فضایی برای context و سیستم‌عامل. برای کوچک‌ترین مدل فهرست بالا با 1.4 گیگابایت دانلود، 4 گیگابایت RAM کافی است. برای مدل ۸ میلیارد پارامتری 8 گیگابایت لازم دارید. بدون GPU تولید متن روی CPU انجام می‌شود و کندتر است، پس اگر پاسخ تعاملی می‌خواهید مدل کوچک‌تر بردارید و اندازهٔ context را محدود نگه دارید.