Warp একটা terminal, যার ভেতরেই AI agent আছে। এতে custom inference endpoint দেওয়া যায়। অর্থাৎ OpenAI-র POST /v1/chat/completions বোঝে, এমন যেকোনো server। Tokens ঠিক তা-ই। তাই https://tokens.bd/v1 endpoint হিসেবে যোগ করলেই Warp-এর model picker-এ Tokens-এর model বেছে নিতে পারবেন।
আগে যে সীমাবদ্ধতাগুলো জানা দরকার#
এগুলো Warp-এর নিজের documentation থেকে নেওয়া (October 2026-এ দেখা):
- Request যায় Warp-এর backend হয়ে। Warp তার নিজের server থেকে আপনার endpoint-এ call করে, তাই endpoint-এর URL public হতে হয়।
tokens.bdpublic, কাজেই চলবে। তবে মনে রাখবেন, আপনার prompt Tokens-এর পাশাপাশি Warp-এর ভেতর দিয়েও যায়। - "Auto" model আর custom router কখনো আপনার endpoint ব্যবহার করে না। শুধু যে model আপনি নিজে বেছে নেবেন, সেটাই Tokens-এ আসবে।
- Cloud Agents-এ এটা কাজ করে না। Warp-এর docs বলছে, custom endpoint Cloud Agents-এর জন্য নয়।
- কারা ব্যবহার করতে পারবেন। ব্যক্তি আর 10 জন বা তার কম কর্মীর প্রতিষ্ঠানের জন্য feature-টা ফ্রি। এর চেয়ে বড় প্রতিষ্ঠানের Business বা Enterprise plan লাগবে, আর সেগুলোতেও Warp platform credit খরচ হয়।
এই সীমাগুলো আপনার কাজে না লাগলে এমন terminal agent দেখুন, যা পুরোটাই আপনার key-তে চলে। যেমন Claude Code, OpenCode বা Aider।
Warp-এ Tokens-কে custom inference endpoint হিসেবে যোগ করুন#
1. key তৈরি করুন#
Dashboard থেকে একটা API key তৈরি করে নিন। spend cap আর model allow-list নিয়ে জানতে দেখুন API keys। Warp-এর জন্য আলাদা key রাখলে তার usage আলাদা করে চেনা সহজ হয়।
2. endpoint বসান#
- Warp-এর Settings খুলে
inference endpointলিখে search করুন। - endpoint URL দিন:
https://tokens.bd/v1। Warp-এর docs এই ঘরকে বলছে "the base URL that exposes/v1/chat/completions", আর তাদের উদাহরণের URL-ও/v1দিয়ে শেষ হয়। - আপনার API key দিন:
tok_live_your_key। - model ID দিন:
deepseek/deepseek-v4.1-flash। - Save করুন।
এক নজরে:
Endpoint URL: https://tokens.bd/v1
API key: tok_live_your_key
Model ID: deepseek/deepseek-v4.1-flashWarp key-টা নিজের settings-এ রাখে। আপনার environment থেকে TOKENS_API_KEY সে পড়ে না।
3. model বেছে নিন#
Warp-এর model picker খুলে Tokens-এর model-টা নিজে বেছে নিন। picker যদি Auto-তে থাকে, request Warp-এর নিজের model-এ যাবে, Tokens-এ নয়।
model বদলানো#
আরেকটা Tokens model চাইলে endpoint settings-এ তার ID যোগ করুন। প্রতিটা model-এর জন্য একটা করে ID লাগবে। তারপর model picker থেকে দরকারমতো বেছে নিন। ID হুবহু লিখবেন, provider prefix-সহ। ID পাবেন model catalog-এ, অথবা এই command-এ:
curl -s https://tokens.bd/v1/models -H "Authorization: Bearer $TOKENS_API_KEY"Warp-এর agent file edit করে আর command চালায়, তাই tool calling সাপোর্ট করে এমন model নিন। কোনটা কেন ভালো, তা বুঝতে দেখুন Choosing a model।
ঠিকমতো চলছে কিনা দেখুন#
আগে key-টা সরাসরি test করে নিন:
export TOKENS_API_KEY=tok_live_your_key
curl -s https://tokens.bd/v1/chat/completions \
-H "Authorization: Bearer $TOKENS_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek/deepseek-v4.1-flash", "max_tokens": 16, "messages": [{"role": "user", "content": "Reply with OK"}]}'এরপর Tokens-এর model বেছে Warp-এর agent-কে ছোট একটা প্রশ্ন করুন। তারপর Dashboard-এর usage analytics খুলুন। আপনার বাছা model-এর নামে request-টা সেখানে দেখা যাওয়ার কথা। Warp উত্তর দিল, অথচ usage-এ কিছু নেই? তার মানে Warp নিজের কোনো model ব্যবহার করেছে। picker-টা আবার দেখুন।
সমস্যা হলে#
Tokens-এ কিছুই পৌঁছাচ্ছে না। হয় picker Auto-তে আছে, নয়তো আপনি Cloud Agent ব্যবহার করছেন। Cloud Agents-এর বাইরে Tokens model নিজে বেছে নিন।
setting-টা পাচ্ছেন না। আপনার প্রতিষ্ঠানে হয়তো 10 জনের বেশি কর্মী আছে, অথচ Business বা Enterprise plan নেই।
401 invalid_api_key। key ভুল, revoke করা বা rotate করা। rotate করলে পুরোনো secret সাথে সাথে বন্ধ হয়ে যায়, তাই Warp-এ নতুন key বসিয়ে দিন।
404 model_not_found। model ID Tokens-এর ID-র সাথে হুবহু মিলতে হবে, যেমন deepseek/deepseek-v4.1-flash।
প্রতিটা request-এ 404। endpoint URL হবে https://tokens.bd/v1। এর পেছনে /chat/completions জুড়বেন না, Warp নিজেই জুড়ে নেয়।
403 model_not_allowed_on_key। key-র allow-list-এ এই model নেই। allow-list তৈরির পরে বদলানো যায় না, তাই নতুন key বানান।
429 rate_limited বা concurrency_limit। Retry-After যতক্ষণ বলে, ততক্ষণ অপেক্ষা করুন। বিস্তারিত Troubleshooting পাতায়।
Warp-এর request Chat Completions format-এ যায়।
Source: Warp docs, custom inference endpoint, October 2026-এ দেখা।