# Warp-কে Tokens-এর সাথে যুক্ত করুন

> Warp-এর agent-কে custom inference endpoint দিয়ে Tokens-এ পাঠান। endpoint-টা OpenAI Chat Completions বোঝে। সাথে জেনে নিন Warp-এর কোথায় এটা কাজ করে না।

Warp একটা terminal, যার ভেতরেই AI agent আছে। এতে **custom inference endpoint** দেওয়া যায়। অর্থাৎ OpenAI-র `POST /v1/chat/completions` বোঝে, এমন যেকোনো server। Tokens ঠিক তা-ই। তাই `https://tokens.bd/v1` endpoint হিসেবে যোগ করলেই Warp-এর model picker-এ Tokens-এর model বেছে নিতে পারবেন।

## আগে যে সীমাবদ্ধতাগুলো জানা দরকার

এগুলো Warp-এর নিজের documentation থেকে নেওয়া (October 2026-এ দেখা):

- **Request যায় Warp-এর backend হয়ে।** Warp তার নিজের server থেকে আপনার endpoint-এ call করে, তাই endpoint-এর URL public হতে হয়। `tokens.bd` public, কাজেই চলবে। তবে মনে রাখবেন, আপনার prompt Tokens-এর পাশাপাশি Warp-এর ভেতর দিয়েও যায়।
- **"Auto" model আর custom router কখনো আপনার endpoint ব্যবহার করে না।** শুধু যে model আপনি নিজে বেছে নেবেন, সেটাই Tokens-এ আসবে।
- **Cloud Agents-এ এটা কাজ করে না।** Warp-এর docs বলছে, custom endpoint Cloud Agents-এর জন্য নয়।
- **কারা ব্যবহার করতে পারবেন।** ব্যক্তি আর 10 জন বা তার কম কর্মীর প্রতিষ্ঠানের জন্য feature-টা ফ্রি। এর চেয়ে বড় প্রতিষ্ঠানের Business বা Enterprise plan লাগবে, আর সেগুলোতেও Warp platform credit খরচ হয়।

এই সীমাগুলো আপনার কাজে না লাগলে এমন terminal agent দেখুন, যা পুরোটাই আপনার key-তে চলে। যেমন [Claude Code](/docs/claude-code), [OpenCode](/docs/opencode) বা [Aider](/docs/aider)।

## Warp-এ Tokens-কে custom inference endpoint হিসেবে যোগ করুন

### 1. key তৈরি করুন

Dashboard থেকে একটা API key তৈরি করে নিন। spend cap আর model allow-list নিয়ে জানতে দেখুন [API keys](/docs/api-keys)। Warp-এর জন্য আলাদা key রাখলে তার usage আলাদা করে চেনা সহজ হয়।

### 2. endpoint বসান

1. Warp-এর **Settings** খুলে `inference endpoint` লিখে search করুন।
2. endpoint URL দিন: `https://tokens.bd/v1`। Warp-এর docs এই ঘরকে বলছে "the base URL that exposes `/v1/chat/completions`", আর তাদের উদাহরণের URL-ও `/v1` দিয়ে শেষ হয়।
3. আপনার API key দিন: `tok_live_your_key`।
4. model ID দিন: `deepseek/deepseek-v4.1-flash`।
5. Save করুন।

এক নজরে:

```text title="Warp Settings > inference endpoint"
Endpoint URL:  https://tokens.bd/v1
API key:       tok_live_your_key
Model ID:      deepseek/deepseek-v4.1-flash
```

Warp key-টা নিজের settings-এ রাখে। আপনার environment থেকে `TOKENS_API_KEY` সে পড়ে না।

### 3. model বেছে নিন

Warp-এর model picker খুলে Tokens-এর model-টা নিজে বেছে নিন। picker যদি Auto-তে থাকে, request Warp-এর নিজের model-এ যাবে, Tokens-এ নয়।

## model বদলানো

আরেকটা Tokens model চাইলে endpoint settings-এ তার ID যোগ করুন। প্রতিটা model-এর জন্য একটা করে ID লাগবে। তারপর model picker থেকে দরকারমতো বেছে নিন। ID হুবহু লিখবেন, provider prefix-সহ। ID পাবেন [model catalog](/models)-এ, অথবা এই command-এ:

```bash
curl -s https://tokens.bd/v1/models -H "Authorization: Bearer $TOKENS_API_KEY"
```

Warp-এর agent file edit করে আর command চালায়, তাই tool calling সাপোর্ট করে এমন model নিন। কোনটা কেন ভালো, তা বুঝতে দেখুন [Choosing a model](/docs/choosing-a-model)।

## ঠিকমতো চলছে কিনা দেখুন

আগে key-টা সরাসরি test করে নিন:

```bash
export TOKENS_API_KEY=tok_live_your_key
curl -s https://tokens.bd/v1/chat/completions \
  -H "Authorization: Bearer $TOKENS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek/deepseek-v4.1-flash", "max_tokens": 16, "messages": [{"role": "user", "content": "Reply with OK"}]}'
```

এরপর Tokens-এর model বেছে Warp-এর agent-কে ছোট একটা প্রশ্ন করুন। তারপর Dashboard-এর usage analytics খুলুন। আপনার বাছা model-এর নামে request-টা সেখানে দেখা যাওয়ার কথা। Warp উত্তর দিল, অথচ usage-এ কিছু নেই? তার মানে Warp নিজের কোনো model ব্যবহার করেছে। picker-টা আবার দেখুন।

## সমস্যা হলে

**Tokens-এ কিছুই পৌঁছাচ্ছে না।** হয় picker Auto-তে আছে, নয়তো আপনি Cloud Agent ব্যবহার করছেন। Cloud Agents-এর বাইরে Tokens model নিজে বেছে নিন।

**setting-টা পাচ্ছেন না।** আপনার প্রতিষ্ঠানে হয়তো 10 জনের বেশি কর্মী আছে, অথচ Business বা Enterprise plan নেই।

**401 `invalid_api_key`।** key ভুল, revoke করা বা rotate করা। rotate করলে পুরোনো secret সাথে সাথে বন্ধ হয়ে যায়, তাই Warp-এ নতুন key বসিয়ে দিন।

**404 `model_not_found`।** model ID Tokens-এর ID-র সাথে হুবহু মিলতে হবে, যেমন `deepseek/deepseek-v4.1-flash`।

**প্রতিটা request-এ 404।** endpoint URL হবে `https://tokens.bd/v1`। এর পেছনে `/chat/completions` জুড়বেন না, Warp নিজেই জুড়ে নেয়।

**403 `model_not_allowed_on_key`।** key-র allow-list-এ এই model নেই। allow-list তৈরির পরে বদলানো যায় না, তাই নতুন key বানান।

**429 `rate_limited` বা `concurrency_limit`।** `Retry-After` যতক্ষণ বলে, ততক্ষণ অপেক্ষা করুন। বিস্তারিত [Troubleshooting](/docs/troubleshooting) পাতায়।

Warp-এর request [Chat Completions](/docs/chat-completions) format-এ যায়।

Source: [Warp docs, custom inference endpoint](https://docs.warp.dev/agents/inference/custom-inference-endpoint), October 2026-এ দেখা।

---
Page: https://tokens.bd/bn/docs/warp
