# AI ভয়েস এজেন্ট


# AI ভয়েস এজেন্ট

একটি **এজেন্ট** হলো একটি একক AI ভয়েস ব্যক্তিত্ব যা আপনার প্রতিষ্ঠানের জন্য ফোন কল করে এবং উত্তর দেয়। এটির নিজস্ব ভাষা মডেল, ভয়েস, গ্রিটিং, আচরণ এবং টুল রয়েছে — যা কিছু নির্ধারণ করে একটি কল কেমন শোনায় এবং এজেন্ট কী করতে পারে। আপনি **/agent/setup**-এ এজেন্ট বিল্ডারে এজেন্ট তৈরি ও টিউন করেন, তারপর সেগুলি পরীক্ষা ও প্রকাশ করেন। এই পেজটি এজেন্ট ধারণা ব্যাখ্যা করে এবং প্রতিটি বিল্ডার ট্যাবকে এর ডকুমেন্টেশনে ম্যাপ করে।

## একটি এজেন্ট কী

প্রতিটি এজেন্ট একসাথে বান্ডেল করে:

- একটি **voice pipeline এবং ভাষা মডেল** যা কথোপকথন চালায়;
- একটি **ভয়েস** যা কথা বলে এবং একটি ট্রান্সক্রাইবার যা শোনে;
- একটি **system prompt, greeting এবং মূল বার্তা** যা এর ব্যক্তিত্ব এবং এটি কীভাবে একটি কল খোলে ও বন্ধ করে তা আকার দেয়;
- **engine আচরণ** যা পেসিং নিয়ন্ত্রণ করে — বাধা, নীরবতা এবং টার্ন-টেকিং;
- ইনবাউন্ড এবং আউটবাউন্ড ব্যবহারের জন্য **calling সেটিংস**;
- ঐচ্ছিক **জ্ঞান** এবং **টুল** যাতে এটি আপনার নথি থেকে উত্তর দিতে এবং প্রকৃত অ্যাকশন নিতে পারে; এবং
- কমপ্লায়েন্স এবং মেসেজিং অ্যাপে মানুষের কাছে পৌঁছানোর জন্য **guardrails এবং channels**।

এজেন্টরা প্রজেক্টের ভেতরে থাকে, [ওভারভিউ](../introduction#তিন-স্তরের-মডেল) থেকে **Organization → Projects → Agents** কাঠামো অনুসরণ করে। একটি এজেন্ট প্রকাশিত হলে আপনি এটির দিকে ক্যাম্পেইন এবং ইনবাউন্ড নম্বর নির্দেশ করতে পারেন।

## বিল্ডার ট্যাব মডেল

![Agent বিল্ডার ও এর ট্যাবসমূহ](/img/screenshots/portal/agent-tab.png)
*এজেন্ট বিল্ডার। উপরের দিকে থাকা ট্যাবগুলো (Agent, Model, Voice, Behavior, Calling, Tools, Calendar, Workflow, Function Logs, Guardrails, Channels) প্রতিটি এজেন্টের একটি করে অংশ কনফিগার করে।*

**/agent/setup**-এ বিল্ডার কনফিগারেশনকে এগারোটি ট্যাবে সংগঠিত করে। আপনি বাম থেকে ডানে এগুলির মধ্য দিয়ে এগোন, এগোনোর সাথে সাথে সংরক্ষণ করেন। মূল ট্যাবগুলির প্রতিটির নিজস্ব ডকুমেন্টেশন পেজ রয়েছে:

- **Agent** — নাম, বিবরণ, use case এবং শুরুর টেমপ্লেট, এবং **system prompt**, **greeting** এবং **end / fallback / busy / voicemail** বার্তা, এবং **Published** ও **Active** টগল। এখানেই প্রতিটি নতুন এজেন্ট শুরু হয়; দেখুন [আপনার প্রথম এজেন্ট তৈরি করুন](./create-agent)।
- **[LLM](./llm)** — voice pipeline mode, LLM প্রদানকারী ও মডেল, temperature, টোকেন সীমা, উন্নত প্যারামিটার, একটি ফলব্যাক মডেল, এবং **RAG / জ্ঞান-ভিত্তি** সংযোগ (দেখুন [জ্ঞান ও RAG](./knowledge-rag))।
- **[Audio (Voice & audio)](./voice-audio)** — মাল্টি-প্রদানকারী speech-to-text এবং text-to-speech (প্রদানকারী, মডেল, ভয়েস, এবং প্রদানকারী-নির্দিষ্ট টিউনিং)।
- **[Engine (Conversation behavior)](./engine-behavior)** — barge-in এবং বাধা হ্যান্ডলিং, voice-activity-detection প্যাডিং, প্রতিক্রিয়া বিলম্ব, নীরবতা হ্যান্ডলিং এবং ফিলার শব্দ।
- **[Calling](./calling-telephony)** — ইনবাউন্ড/আউটবাউন্ড, সর্বোচ্চ সময়কাল, অটো-হ্যাংআপ, বরাদ্দকৃত নম্বর এবং webhook।
- **[Tools](./tools-mcp)** — এজেন্টের ফাংশন বাইন্ড করুন, MCP সার্ভার সংযুক্ত করুন, এবং **Workflow Builder** খুলুন।
- **Calendar** — OAuth-এর মাধ্যমে Google বা Outlook সংযুক্ত করুন যাতে এজেন্ট প্রাপ্যতা নিয়ে কাজ করতে পারে।
- **[Workflow](./workflow-builder)** — একটি ভিজ্যুয়াল কল-ফ্লো বিল্ডার (নিচে আলোচনা করা), Tools ট্যাব থেকে চালু করা।
- **Function Logs** — প্রতি-ফাংশন মেট্রিক্স: এই এজেন্ট ব্যবহার করা ফাংশনগুলির জন্য কল সংখ্যা, লেটেন্সি এবং এরর।
- **[Guardrails](./guardrails)** — কমপ্লায়েন্স এবং ডেটা-সংগ্রহ নিয়ন্ত্রণ (নিচে আলোচনা করা)।
- **[Channels](../channels)** — মেসেজিং অ্যাপে মানুষের কাছে পৌঁছান: WhatsApp, Telegram, Facebook Messenger এবং একটি এমবেডযোগ্য ওয়েব উইজেট।

### Workflow Builder

**Workflow** ট্যাব একটি ভিজ্যুয়াল কল-ফ্লো বিল্ডার খোলে (Tools ট্যাবে **Open Workflow Builder** বোতাম দিয়ে চালু করা)। এটি আপনাকে নির্ধারক, নোড-ভিত্তিক কল প্রবাহ ডিজাইন করতে দেয় — প্রশ্ন, শর্ত, টুল কল, webhook এবং ট্রান্সফার — সেই এজেন্টদের জন্য যাদের উন্মুক্ত কথোপকথনের পরিবর্তে একটি স্ক্রিপ্টেড পথ প্রয়োজন।

### Function Logs

**Function Logs** ট্যাব দেখায় এজেন্টের বাইন্ড করা ফাংশনগুলি প্রকৃত কলের সময় কীভাবে পারফর্ম করছে: প্রতিটি ফাংশন কত ঘন ঘন কল করা হয়, এর লেটেন্সি, এবং যেকোনো এরর। কল গুণমান ক্ষতিগ্রস্ত করার আগে একটি ধীর বা ব্যর্থ টুল চিহ্নিত করতে এটি ব্যবহার করুন।

### Guardrails

**Guardrails** ট্যাব এজেন্টকে নিরাপদ এবং কমপ্লায়েন্ট রাখে। এটি নিয়ন্ত্রণ করে:

- **Content guardrails** — এজেন্ট যে **prohibited topics** এড়িয়ে চলে এবং দূরে পুনঃনির্দেশ করে তার একটি তালিকা।
- **PII handling** — ট্রান্সক্রিপ্টে ব্যক্তিগতভাবে শনাক্তযোগ্য তথ্য কীভাবে বিবেচনা করা হয় (**mask**, **redact** বা **allow**), এবং একটি প্রতি-ধরন **transcript PII redaction** নির্বাচক (SSN, ক্রেডিট কার্ড, ইমেইল, ফোন, ঠিকানা, জন্ম তারিখ, ব্যাংক অ্যাকাউন্ট)।
- **Compliance mode** — **Standard**, **Strict**, **HIPAA** বা **PCI-DSS**; কঠোর মোডগুলি অতিরিক্ত নিরাপত্তা ব্যবস্থা এবং লগিং সক্ষম করে।
- **Data collection** — এজেন্ট যে **collected fields** ক্যাপচার করার চেষ্টা করে এবং যে **required fields** এটিকে অবশ্যই পেতে হবে (অনুপস্থিত থাকলে কলারকে প্রম্পট করে)।
- **Post-call analysis** — অপ্ট-ইন **auto-summarize**, **sentiment analysis** এবং **intent detection**।

:::note[Channels হলো মেসেজিং অ্যাপ, ইমেইল নয়]

**Channels** ট্যাবটি মেসেজিং অ্যাপের জন্য — WhatsApp, Telegram, Facebook Messenger এবং একটি ওয়েব উইজেট। ইমেইল ফলো-আপ একটি channel নয়: এটি [Tools](./tools-mcp) ট্যাবে **send_email** ফাংশন।

:::

:::tip

শুরু করতে আপনাকে প্রতিটি ট্যাব পূরণ করতে হবে না। একটি নাম, একটি মডেল, একটি ভয়েস এবং একটি গ্রিটিং একটি প্রথম পরীক্ষার জন্য যথেষ্ট। মূল বিষয়গুলি ঠিক শোনালে জ্ঞান এবং টুল যোগ করুন।

:::

## প্রকাশের আগে পরীক্ষা করুন

বিল্ডার দুটি পরীক্ষার পৃষ্ঠের সাথে জোড়া দেয় যাতে আপনি একটি এজেন্ট প্রকৃত কল স্পর্শ করার আগে এটি চেষ্টা করতে পারেন:

- **/agent/interface**-এ **ভয়েস পরীক্ষা** — এজেন্টের সাথে কথা বলুন এবং এটিকে প্রতিক্রিয়া জানাতে শুনুন।
- **/agent/chat**-এ **চ্যাট পরীক্ষা** — দ্রুত লজিক এবং প্রম্পট পরীক্ষা করতে টেক্সট টার্ন বিনিময় করুন।

একটি ফাঁকা এজেন্ট থেকে একটি প্রকাশিত এজেন্ট পর্যন্ত সম্পূর্ণ পথ [আপনার প্রথম এজেন্ট তৈরি করুন](./create-agent)-এ রয়েছে।

## পরবর্তী ধাপ

- [আপনার প্রথম এজেন্ট তৈরি করুন](./create-agent)
- [ভাষা মডেল কনফিগার করুন](./llm)
- [ভয়েস এবং অডিও সেট আপ করুন](./voice-audio)
- [কথোপকথন আচরণ আকার দিন](./engine-behavior)
