مستندات API هوش مصنوعی
یک آدرس، یک کلید، همه مدلها؛ با فرمت OpenAI، Anthropic یا Gemini.
API هوش مصنوعی گره یک درگاه واحد برای مدلهای Claude، GPT، Gemini، DeepSeek و دیگران است. همان API رسمی هر سازنده را روی آدرس گره صدا میزنید؛ گره درخواست را به مدل میرساند، پاسخ را در همان فرمتی که فرستادهاید برمیگرداند و هزینه را به تومان از کیف پول کم میکند.
شروع سریع
- در گره ثبتنام کنید و کیف پول را شارژ کنید.
- در پنل › API هوش مصنوعی یک کلید بسازید. کلید با
gk-شروع میشود و فقط یک بار نمایش داده میشود. - در برنامه یا ابزارتان آدرس پایه را به
https://api.gereh.devتغییر دهید و کلید را بهجای کلید OpenAI، Anthropic یا Gemini بگذارید.
نشانی پایه
https://api.gereh.devبرای SDKهای OpenAI آدرس https://api.gereh.dev/v1 و برای Anthropic و Gemini خود https://api.gereh.dev را بدهید.
احراز هویت
کلید را به یکی از این روشها بفرستید (هر SDK روش خودش را خودکار بهکار میبرد):
| روش | نمونه |
|---|---|
| هدر Authorization | Authorization: Bearer gk-… |
| هدر Anthropic | x-api-key: gk-… |
| هدر Gemini | x-goog-api-key: gk-… |
| پارامتر Gemini | ?key=gk-… |
مسیرها
| متد | مسیر | توضیح |
|---|---|---|
| POST | /v1/chat/completions | OpenAI Chat Completions (استریم، ابزار، تصویر، JSON mode) |
| POST | /v1/responses | OpenAI Responses — برای Codex؛ بدون حالت ذخیرهشده (store) |
| POST | /v1/messages | Anthropic Messages — برای Claude Code و SDK رسمی Anthropic |
| POST | /v1/messages/count_tokens | شمارش تقریبی توکن ورودی (Anthropic) |
| POST | /v1beta/models/{model}:generateContent | Google Gemini (و :streamGenerateContent?alt=sse) |
| GET | /v1/models | فهرست مدلها (با هدر anthropic-version به شکل Anthropic) |
| GET | /v1beta/models | فهرست مدلها به شکل Gemini |
Claude Code
Claude Code مستقیم با فرمت Anthropic به گره وصل میشود؛ ابزارها، استریم و فایلخوانی همه کار میکنند.
export ANTHROPIC_BASE_URL=https://api.gereh.dev
export ANTHROPIC_AUTH_TOKEN=gk-YOUR-KEY
export ANTHROPIC_MODEL=claude-opus-5.5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4.5
claudeCodex CLI
در ~/.codex/config.toml بگذارید و کلید را در متغیر GEREH_API_KEY قرار دهید (export GEREH_API_KEY=…).
model = "gpt-5.5"
model_provider = "gereh"
[model_providers.gereh]
name = "Gereh"
base_url = "https://api.gereh.dev/v1"
env_key = "GEREH_API_KEY"
wire_api = "responses"OpenAI SDK و ابزارهای سازگار
هر برنامه یا کتابخانه سازگار با OpenAI (LangChain، n8n، Cursor، Continue، LibreChat…) فقط با تغییر base URL کار میکند.
from openai import OpenAI
client = OpenAI(base_url="https://api.gereh.dev/v1", api_key="gk-YOUR-KEY")
r = client.chat.completions.create(
model="gpt-5.5",
messages=[{"role": "user", "content": "سلام!"}],
)
print(r.choices[0].message.content)در Cursor: Settings › Models › OpenAI API Key، کلید گره را وارد و «Override OpenAI Base URL» را روی https://api.gereh.dev/v1 بگذارید. در n8n، اعتبارنامه OpenAI را با Base URL همین آدرس بسازید.
Anthropic SDK
SDK رسمی Anthropic؛ ابزارها (tool use)، تصویر و استریم پشتیبانی میشوند.
import anthropic
client = anthropic.Anthropic(base_url="https://api.gereh.dev", api_key="gk-YOUR-KEY")
msg = client.messages.create(
model="claude-sonnet-5.5", max_tokens=1024,
messages=[{"role": "user", "content": "سلام!"}],
)
print(msg.content[0].text)Gemini SDK
SDK گوگل (google-genai) با آدرس گره؛ مدلهای دیگر هم با همین فرمت قابل فراخوانیاند.
from google import genai
client = genai.Client(api_key="gk-YOUR-KEY", http_options={"base_url": "https://api.gereh.dev"})
r = client.models.generate_content(model="gemini-3.8-flash", contents="سلام!")
print(r.text)cURL
سادهترین تست از ترمینال.
curl https://api.gereh.dev/v1/chat/completions \
-H "Authorization: Bearer gk-YOUR-KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-4o-mini","messages":[{"role":"user","content":"سلام!"}]}'استریم
در همه فرمتها استریم پشتیبانی میشود: "stream": true در OpenAI و Anthropic و مسیر :streamGenerateContent?alt=sse در Gemini. رویدادها دقیقاً با قالب رسمی هر سازنده ارسال میشوند، پس SDKها و ابزارها بدون تغییر کار میکنند. در OpenAI Chat برای دریافت مصرف توکن در انتهای استریم "stream_options": {"include_usage": true} بفرستید.
هزینه و صورتحساب
- هزینه هر درخواست = (توکن ورودی × قیمت ورودی + توکن خروجی × قیمت خروجی) ÷ ۱٬۰۰۰٬۰۰۰، به تومان و رو به بالا.
- پیش از ارسال، حداکثر هزینه ممکن (بر اساس
max_tokens) از کیف پول رزرو و بلافاصله پس از پاسخ، مازاد آن برگردانده میشود. اگرmax_tokensنفرستید ۸٬۱۹۲ در نظر گرفته میشود. - درخواست ناموفق (خطای سرویسدهنده) هیچ هزینهای ندارد.
- هر پاسخ موفق هدر
x-gereh-charged-toman(هزینه به تومان) وx-gereh-request-id(شناسه پیگیری) دارد. - مصرف هر ۱۰ دقیقه در یک تراکنش «مصرف» در صورتحساب جمع میشود.
محدودیتها
- برای هر کلید میتوانید سقف هزینه روزانه و ماهانه، فهرست مدلهای مجاز، تعداد درخواست در دقیقه (پیشفرض ۱۲۰، حداکثر ۶۰۰) و تاریخ انقضا تعیین کنید.
- حداکثر حجم هر درخواست ۱۶ مگابایت است.
- در Responses API حالت ذخیره سمت سرور (
previous_response_id،background،conversation) پشتیبانی نمیشود؛ تاریخچه را درinputبفرستید. Codex بهطور پیشفرض همین کار را میکند. - متن درخواستها و پاسخها ذخیره نمیشود؛ فقط مدل، توکن، هزینه و زمان پاسخ در گزارش میماند.
کدهای خطا
| HTTP | کد | معنی |
|---|---|---|
| 400 | invalid_request | بدنه یا پارامترها نادرست است |
| 401 | invalid_api_key / key_expired | کلید نامعتبر یا منقضی |
| 402 | insufficient_balance | موجودی کیف پول کافی نیست |
| 402 | key_budget_exceeded | سقف روزانه یا ماهانه کلید پر شده |
| 403 | key_disabled / model_not_allowed | کلید باطل شده یا مدل برای این کلید مجاز نیست |
| 404 | model_not_found | مدل وجود ندارد یا غیرفعال است |
| 429 | rate_limit_exceeded | سقف درخواست در دقیقه کلید |
| 429 | upstream_rate_limited | ظرفیت لحظهای مدل پر است؛ دوباره تلاش کنید |
| 502 | upstream_error / upstream_unavailable | خطای سرویسدهنده مدل؛ هزینهای کم نمیشود |
قالب بدنه خطا با فرمت درخواست یکی است (OpenAI، Anthropic یا Gemini) تا SDKها خطا را درست نمایش دهند.
مدلها و قیمت
قیمتها به تومان و به ازای یک میلیون توکن است.
| مدل | شناسه | ورودی | خروجی | کانتکست |
|---|---|---|---|---|
| Claude Opus 5.5 | claude-opus-5.5 | ۱٬۸۲۴٬۰۰۰ | ۹٬۱۲۰٬۰۰۰ | ۱٬۰۰۰K |
| Claude Sonnet 5.5 | claude-sonnet-5.5 | ۹۱۲٬۰۰۰ | ۴٬۵۶۰٬۰۰۰ | ۱٬۰۰۰K |
| Claude Sonnet 5 | claude-sonnet-5 | ۹۱۲٬۰۰۰ | ۴٬۵۶۰٬۰۰۰ | ۱٬۰۰۰K |
| Claude Opus 5 | claude-opus-5 | ۲٬۲۸۰٬۰۰۰ | ۱۱٬۴۰۰٬۰۰۰ | ۱٬۰۰۰K |
| Claude Sonnet 4.6 | claude-sonnet-4.6 | ۱٬۳۶۸٬۰۰۰ | ۶٬۸۴۰٬۰۰۰ | ۱٬۰۰۰K |
| Claude Haiku 4.5 | claude-haiku-4.5 | ۴۵۶٬۰۰۰ | ۲٬۲۸۰٬۰۰۰ | ۲۰۰K |
| GPT-6 Sol | gpt-6-sol | ۹۱۲٬۰۰۰ | ۴٬۵۶۰٬۰۰۰ | ۱٬۰۵۰K |
| GPT-6 Luna | gpt-6-luna | ۴۵٬۶۰۰ | ۲۲۸٬۰۰۰ | ۱٬۰۵۰K |
| GPT-5.5 | gpt-5.5 | ۲٬۲۸۰٬۰۰۰ | ۱۳٬۶۸۰٬۰۰۰ | ۱٬۰۵۰K |
| GPT-5.4 | gpt-5.4 | ۱٬۱۴۰٬۰۰۰ | ۶٬۸۴۰٬۰۰۰ | ۱٬۰۵۰K |
| GPT-5.4 Mini | gpt-5.4-mini | ۳۴۲٬۰۰۰ | ۲٬۰۵۲٬۰۰۰ | ۴۰۰K |
| GPT-5.4 Nano | gpt-5.4-nano | ۹۱٬۲۰۰ | ۵۷۰٬۰۰۰ | ۴۰۰K |
| GPT-4.1 | gpt-4.1 | ۹۱۲٬۰۰۰ | ۳٬۶۴۸٬۰۰۰ | ۱٬۰۴۸K |
| GPT-4.1 Mini | gpt-4.1-mini | ۱۸۲٬۴۰۰ | ۷۲۹٬۶۰۰ | ۱٬۰۴۸K |
| GPT-4o | gpt-4o | ۱٬۱۴۰٬۰۰۰ | ۴٬۵۶۰٬۰۰۰ | ۱۲۸K |
| GPT-4o mini | gpt-4o-mini | ۶۸٬۴۰۰ | ۲۷۳٬۶۰۰ | ۱۲۸K |
| o3 | o3 | ۹۱۲٬۰۰۰ | ۳٬۶۴۸٬۰۰۰ | ۲۰۰K |
| gpt-oss-120b | gpt-oss-120b | ۶۸٬۴۰۰ | ۲۷۳٬۶۰۰ | ۱۳۱K |
| Gemini 3.8 Flash | gemini-3.8-flash | ۳۴۲٬۰۰۰ | ۱٬۷۱۰٬۰۰۰ | ۱٬۰۴۹K |
| Gemini 3.1 Pro | gemini-3.1-pro | ۹۱۲٬۰۰۰ | ۵٬۴۷۲٬۰۰۰ | ۱٬۰۴۹K |
| Gemini 2.5 Pro | gemini-2.5-pro | ۵۷۰٬۰۰۰ | ۴٬۵۶۰٬۰۰۰ | ۱٬۰۴۹K |
| Gemini 2.5 Flash | gemini-2.5-flash | ۱۳۶٬۸۰۰ | ۱٬۱۴۰٬۰۰۰ | ۱٬۰۴۹K |
| DeepSeek V4 Pro | deepseek-v4-pro | ۱۸۲٬۴۰۰ | ۱٬۹۱۵٬۲۰۰ | ۱٬۰۴۹K |
| DeepSeek V4 Flash | deepseek-v4-flash | ۱۳۶٬۸۰۰ | ۵۴۷٬۲۰۰ | ۱٬۰۴۹K |
| DeepSeek V3.2 | deepseek-v3.2 | ۱۲۷٬۷۰۰ | ۱۹۱٬۵۰۰ | ۱۶۴K |
| DeepSeek R1 | deepseek-r1 | ۲۲۸٬۰۰۰ | ۹۸۰٬۴۰۰ | ۱۶۴K |
| Qwen 3.8 Max | qwen3.8-max | ۹۱۲٬۰۰۰ | ۲٬۷۳۶٬۰۰۰ | ۱٬۰۰۰K |
| Qwen3 Coder 480B | qwen3-coder | ۱۳۶٬۸۰۰ | ۴۵۶٬۰۰۰ | ۲۶۲K |
| GLM 5.3 Flash | glm-5.3-flash | ۶۸٬۴۰۰ | ۲۲۸٬۰۰۰ | ۱٬۳۱۱K |