যে tool-এ custom OpenAI-compatible বা Anthropic-compatible endpoint বসানো যায়, Tokens তাকেই চালাতে পারে। এই পাতায় দেখতে পাবেন কোন coding agent আর editor-এ এটা হয়, কোনটায় হয় না। আর যে tool-এর নিজস্ব guide নেই, তার জন্য একটা সাধারণ নিয়মও আছে।
Compatibility table#
প্রতিটা tool-এর official documentation দেখে লেখা, October 2026-এ যাচাই করা। "Partial" মানে কিছু feature Tokens ব্যবহার করে, কিছু করে না।
| Tool | Custom endpoint? | Tokens-এর সাথে যে protocol | Guide |
|---|---|---|---|
| Claude Code | হ্যাঁ | Anthropic Messages, base https://tokens.bd | Claude Code |
| Codex CLI | হ্যাঁ, একটা শর্তে | শুধু Responses API; model-এর upstream /v1/responses চালালে কাজ করে | Codex CLI |
| OpenCode | হ্যাঁ | Chat Completions | OpenCode |
| OpenClaw | হ্যাঁ | Chat Completions বা Anthropic Messages | OpenClaw |
| Hermes Agent | হ্যাঁ | Chat Completions | Hermes Agent |
| Crush | হ্যাঁ | Chat Completions (openai-compat) | Crush |
| Aider | হ্যাঁ | Chat Completions, model-এর আগে openai/ prefix | Aider |
| Goose | হ্যাঁ | Chat Completions, পুরো endpoint URL | Goose |
| Qwen Code | হ্যাঁ | Chat Completions | Qwen Code |
| Kimi Code CLI | হ্যাঁ | Chat Completions বা Anthropic Messages | Kimi Code |
| Factory Droid | হ্যাঁ | Chat Completions বা Anthropic Messages | Factory Droid |
| Cline | হ্যাঁ | Chat Completions | Cline |
| Kilo Code | হ্যাঁ | Chat Completions | Kilo Code |
| Roo Code | হ্যাঁ, তবে archived | Chat Completions; repo 2026-05-15-এ archive হয়েছে | Roo Code |
| Continue | হ্যাঁ | Chat Completions | Continue |
| Zed | হ্যাঁ | Chat Completions বা Anthropic Messages | Zed |
| GitHub Copilot (VS Code) | Partial | শুধু chat; inline suggestion আর embeddings GitHub-এই থাকে | GitHub Copilot |
| Cursor | Partial, documented নয় | base URL override Cursor-এর official docs-এ নেই; Tab এটা কখনো ব্যবহার করে না | Cursor |
| Warp | Partial | Chat Completions; Auto model আর Cloud Agents এটা ব্যবহার করে না | Warp |
| Amp | Partial | শুধু Amp-এর নিজের catalog-এর model route করা যায় | Amp |
| Gemini CLI | না | শুধু Gemini বা Vertex wire format নেয় | Qwen Code ব্যবহার করুন |
| Kimi CLI (Python) | না | Archived; এখনকার install কাজ করা বন্ধ করবে | Kimi Code CLI ব্যবহার করুন |
Gemini CLI কেন Tokens ব্যবহার করতে পারে না#
Gemini CLI-তে base URL বদলানোর একমাত্র উপায় GOOGLE_GEMINI_BASE_URL আর GOOGLE_VERTEX_BASE_URL। দুটোই Gemini বা Vertex-এর request format আশা করে। Tokens সেই format চালায় না, তাই কোনো setting দিয়েই এটা কাজ করানো যাবে না। Qwen Code প্রথমে Gemini CLI-র fork ছিল, আর সেটা OpenAI-compatible endpoint সাপোর্ট করে।
যেকোনো OpenAI-compatible tool যুক্ত করুন#
আপনার tool তালিকায় না থাকলে settings-এ "OpenAI compatible", "custom provider", "API base" বা "base URL" নামের কিছু খুঁজুন। তারপর চারটা জিনিস লাগবে।
1. Base URL#
| আপনার tool যা বলে | Base URL | তারপর tool যেখানে call করে |
|---|---|---|
| OpenAI Chat Completions | https://tokens.bd/v1 | /v1/chat/completions |
| Anthropic Messages | https://tokens.bd | /v1/messages |
কিছু tool পুরো endpoint চায়, যেমন Goose-এর custom provider file-এ https://tokens.bd/v1/chat/completions দিতে হয়। tool-এর নিজের উদাহরণ যদি /chat/completions দিয়ে শেষ হয়, তাহলে সেই আকারেই দিন। প্রথম request-এ 404 এলে প্রায় সবসময় /v1 বাদ পড়েছে, নয়তো দুবার বসেছে।
2. API key#
Tokens key পড়ে Authorization: Bearer <key> অথবা x-api-key: <key> header থেকে। তাই OpenAI-style আর Anthropic-style, দুই ধরনের tool-ই বাড়তি header ছাড়া চলে। tool যদি environment variable পড়ে, তাহলে export TOKENS_API_KEY=tok_live_your_key ব্যবহার করুন। commit হয়ে যেতে পারে, এমন config file-এ key রাখবেন না। প্রতিটা tool-এর জন্য আলাদা key নিলে usage পড়া সহজ হয়, আর দরকারে একটা key revoke করা ঝামেলা হয় না। দেখুন API keys।
3. Model ID#
Tokens-এর ID হুবহু দিন, provider prefix-সহ: deepseek/deepseek-v4.1-flash, শুধু deepseek-v4.1-flash নয়। ID পাবেন model catalog-এ, অথবা API থেকে। API শুধু সেই model-ই দেখায়, যা আপনার key ব্যবহার করতে পারে:
curl -s https://tokens.bd/v1/models -H "Authorization: Bearer $TOKENS_API_KEY"যেসব tool model লেখে <provider>/<model> আকারে, সেখানে দুটো slash হয়ে যায়, যেমন tokens/deepseek/deepseek-v4.1-flash। tool এটা কীভাবে ভাগ করে, তা সবাই documentation-এ লেখে না। তাই model খুঁজে না পেলে আগে এখানটা দেখুন। Aider-এর মতো LiteLLM-ভিত্তিক tool-এ openai/ prefix লাগে, পাঠানোর আগে সেটা তারা কেটে দেয়।
4. Context window আর output limit#
অনেক tool endpoint থেকে model-এর সীমা পড়তে পারে না, তাই আপনাকে জিজ্ঞেস করে, নয়তো একটা default ধরে নেয়। catalog থেকে সংখ্যাগুলো নিয়ে বসান। context window ভুল হলে automatic compaction এলোমেলো হয়ে যায়: বেশি দিলে লম্বা কথোপকথন upstream-এ reject হয়, কম দিলে history আগেভাগেই কেটে যায়।
আরও কয়েকটা জিনিস দেখে নিন:
- Tool calling। যে agent file edit করে, তার জন্য function calling আছে এমন model লাগবে।
- Streaming। OpenAI-style stream-এর শেষে usage chunk পেতে হলে client-কে
stream_options: {"include_usage": true}পাঠাতে হবে। - যে endpoint নেই। image generation, audio, files, batches, assistants, fine-tuning আর moderations-এ 404
unsupported_endpointআসে। Embeddings শুধু embedding model-এর জন্য চলে, তাই tool-এর embedding feature এখন যে provider-এ আছে, সেখানেই রাখুন। - শুধু browser-এ চলা tool। Tokens-এর response-এ কোনো CORS header থাকে না, তাই web page থেকে সরাসরি call করলে fail করবে। server, CLI বা editor extension থেকে call করুন।
Connection test করুন#
tool-এর settings নিয়ে ঘাঁটার আগে নিশ্চিত হয়ে নিন key আর model ঠিক আছে। নিচের tester আপনার key আর বেছে নেওয়া model দিয়ে একটা ছোট request পাঠায়। অথবা তার পরের curl-টা নিজের machine থেকে চালান।
Live connection test
Check latency and token generation before you start coding.
curl -s https://tokens.bd/v1/chat/completions \
-H "Authorization: Bearer $TOKENS_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek/deepseek-v4.1-flash", "max_tokens": 16, "messages": [{"role": "user", "content": "Reply with OK"}]}'এটা সফল হলে আর tool তবু না চললে সমস্যা tool-এর settings-এ। Connect Your Agent পাতাতেও live test চালানো যায়, আর সাধারণ agent-এর জন্য snippet আছে।
সমস্যা হলে#
| Status আর code | নতুন tool-এ সাধারণ কারণ |
|---|---|
| প্রথম request-এই 404 | Base URL-এ /v1 নেই, অথবা path দুবার বসেছে |
401 missing_api_key | tool যেখানে চলে, সেখানে env var set করা নেই |
404 model_not_found | Model ID-তে provider prefix নেই |
429 rate_limited | Agent প্রতি মিনিটের সীমা ছাড়িয়েছে; Retry-After পর্যন্ত থামুন |
প্রতিটা code-এর ব্যাখ্যা আছে Troubleshooting-এ। Request-এর format দেখুন Chat Completions আর Messages পাতায়। Tokens CLI আপনার হয়ে OpenCode, Claude Code, Codex CLI আর Crush-এর config লিখে দিতে পারে।
Sources: Gemini CLI configuration reference, MoonshotAI/kimi-cli archive notice, সাথে প্রতিটা tool-এর guide-এ দেওয়া official docs, October 2026-এ দেখা।