همهی مدلهایی که سازمانتان استفاده میکند، پشت یک دروازه که خودتان کنترلش میکنید.
هاترا روی هر درخواست هوش مصنوعی سازمان شما یک بودجه، یک سیاست و یک نام میگذارد، پیش از آنکه از شبکهتان خارج شود و روی صورتحسابی که میتوانید به واحد مالی بدهید.
در حال اجرا در محیط عملیاتی
یک فهرست · یک سطح API
تأخیر افزودهشده در دروازه، اندازهگیریشده در p50
درخواست مدیریتشده در هر ماه در میان مشتریان ما
میانگین صرفهجویی وقتی ترافیک پایدار روی GPUهای خودتان میرود
مدل در یک فهرست واحد، پشت یک سطح API
یک base URL. هیچ چیز دیگری تغییر نمیکند.
هاترا به زبان API اوپنایآی حرف میزند. SDK فعلیتان را به دروازه اشاره دهید، کلید را عوض کنید و هر فراخوانی با یک بودجه، یک مجموعه گاردریل و یک مالک میرسد.
- با SDKهای OpenAI، Anthropic و LangChain که همین حالا دارید کار میکند.
- هر کلید بودجه و سیاست مدل خودش را دارد، سختتر کردن آن تغییر کد نیست.
- هر پاسخ با هزینهاش و اینکه به حساب چه کسی رفته برمیگردد.
from openai import OpenAI
client = OpenAI(
base_url="https://api.openai.com/v1",
api_key=OPENAI_API_KEY,
)
from openai import OpenAI
client = OpenAI(
base_url="https://gateway.hatra.io/v1",
api_key=HATRA_KEY, # budget + policy attached
)
{
"model": "glm-5.3",
"routed_to": "onprem-node-01",
"guardrails": ["pii-redact", "secret-block"],
"cost_usd": 0.0042,
"charged_to": { "team": "Engineering", "person": "priya@" }
}
یک کنترلپلین برای کل هوش مصنوعی سازمان
همان شش چیزی که تیم پلتفرم شش ماه بعد خودش برای خودش میسازد، از قبل ساخته شده و به همان لاگ حسابرسی وصل است. یکی را انتخاب کنید تا صفحهی واقعیاش را ببینید.
curl https://api.hatra.dev/v1/chat/completions \
-H "Authorization: Bearer $HATRA_API_KEY" \
-d '{"model":"gpt-4o","messages":[{"role":"user","content":"Hello"}]}'کلید فقط یکبار هنگام ساخت نمایش داده میشود؛ آن را در secret manager نگه دارید، نه در مخزن کد.
دو خط از کلاینتتان را عوض کنید و ابزارهایتان را نگه دارید.
https://api.hatra.dev/v1هر درخواست به یک کلید نسبت داده میشود، بودجهبندی شده و توسط محافظها بررسی میشود، از جمله ترافیک ایجنتها و CI.
درخواستها از کانفیگ مسیریابی متصل به کلید پیروی میکنند.
| عملیاتعملیات | ||
|---|---|---|
Production APIsk_live_••••4f2a | ۲۰۰٬۰۰۰٬۰۰۰ریال | |
CI pipelinesk_live_••••9c1b | ۷۵٬۰۰۰٬۰۰۰ریال | |
Research notebookssk_test_••••a83d | ۱۰۰٬۰۰۰٬۰۰۰ریال | |
Analytics exportssk_live_••••e5f7 | ۴۰٬۰۰۰٬۰۰۰ریال | |
Legacy integrationsk_live_••••7b0c | ۱۰۰٬۰۰۰٬۰۰۰ریال | |
Mobile appsk_test_••••d92e | ۶۰٬۰۰۰٬۰۰۰ریال | |
Deprecated widgetلغوشدهsk_live_••••0011 | ۲۵٬۰۰۰٬۰۰۰ریال |
۷ کلید
اسکرینشات نیست. خودِ صفحههاست.
همهی صفحههایی که تیمتان در آنها زندگی میکند، وصل به یک لاگ حسابرسی. تبها را عوض کنید، یک ردیف را باز کنید، یک درخواست را بکشید.
موارد نیازمند رسیدگی، سلامت سرویس، ظرفیت باقیمانده و هزینه: صفحهی صبحگاهی.
نمای کلی
سلامت، ظرفیت و هزینه کل فضای کاری.
از ۰۹:۱۲ درخواستها رد میشوند. ۴۱۸٬۰۰۰٬۰۰۰ تومان در برابر سقف ۴۰۰٬۰۰۰٬۰۰۰ خرج شده.
پاکسازی داده پرداخت در ۲۴ اوت توسط lena@ به حالت فقط هشدار تغییر کرد.
نسخه v4.1.8 در حال اجراست، نسخه فعلی v4.2.1 است. بدون توقف کاری.
پنجره انتقال ۲۴ ساعته است. فراخوانها بدون توقف مهاجرت میکنند.
p95 ۱٫۸۴ ثانیه · ۰٫۹ میلیثانیه سربار
۷۱٪ در استفاده · ۱ بهروزرسانی در انتظار
DeepSeek در ۰۴:۱۴ بازیابی شد
۱٬۲۰۸ درخواست امروز مسدود شد
سقف ساعتی جلوی کار سرکش را پیش از آنکه سقف ماهانه متوجه شود میگیرد.
بدون بودجه، بدون سیاست، بدون رد حسابرسی. انتقال آن به Hatra کمهزینهتر و شفافتر است.
یک درخواست را مسیریابی کنید
درخواست را روی یک مسیر بکشید، یا روی مسیر کلیک کنید
سه مرحله، یک بعدازظهر
بدون مهاجرت، بدون پروکسی برای نگهداشتن، بدون بازنویسی. دروازه همانجایی مینشیند که ترافیک شما از قبل میرود.
اتصال
کلیدهای ارائهدهندهتان را بیاورید یا از کلیدهای ما استفاده کنید. سرورهایی که دارید را وصل کنید. فهرست مدلها خودش پر میشود.
حاکمیت
افراد را دعوت کنید، کلیدها را با بودجه صادر کنید و گاردریلهایی را بچینید که هر پرامپت و هر پاسخ را بازرسی میکنند.
انتساب
هزینه را بر اساس تیم، فرد، کلید و مدل ببینید، و به واحد مالی عددی بدهید که بتواند تطبیق دهد.
“چهار تیم، سه حساب ارائهدهنده داشتیم و هیچ ایدهای نداشتیم چه کسی چقدر خرج میکند. یک هفته بعد از اینکه هاترا را جلوی آن گذاشتیم، میتوانستم جواب سؤال CFO را روی یک صفحه بدهم، و بودجهها جلوی خرج را میگیرند، نه اینکه فقط گزارشش کنند.”
ساختهشده برای بازبینیای که تیم امنیتتان انجام میدهد
سؤالهایی که راهاندازی هوش مصنوعی را متوقف میکنند، پیش از پرسیدهشدن پاسخ داده شدهاند: داده کجا میرود، چه کسی آن را میبیند و وقتی کسی اطلاعات مشتری را داخل پرامپت میچسباند چه اتفاقی میافتد.
داده در همان منطقه میماند
فرانکفورت یا آمستردام، یا سختافزار خودتان. پرامپتها هرگز برای آموزش استفاده نمیشوند.
هر اقدام حسابرسی میشود
چرخش کلید، ویرایش گاردریل، تغییر بودجه: امضاشده، قابل خروجیگرفتن و نگهداریشده.
همان هویتی که از قبل دارید
SSO و SCIM روی دایرکتوری خودتان، با نقشهایی که با تیمهایتان منطبقاند.
بدون قفل شدن به ما
یک API استاندارد، لاگهای قابل خروجیگرفتن و استقرار خودمیزبان اگر بازبینی آن را بخواهد.
بفهمید هوش مصنوعی سازمانتان واقعاً چقدر هزینه دارد
یک دموی ۳۰ دقیقهای روی اعداد خودتان. یک کلید ارائهدهنده وصل میکنیم و اولین گزارش را پیش از پایان تماس نشانتان میدهیم.
همیشه رایگان
متنبازبدون کارت اعتباری. در چند دقیقه خودتان میزبانی کنید.
- فهرست ۱۲ مدلی پشت یک API
- کلیدهای مجازی، بودجهها و تیمها
- توزیع بار و محدودیتهای RPM/TPM
- گاردریلهای دادهی شخصی و کلید مخفی
- خودمیزبانی در چند دقیقه
سازمانی
محبوبترینیا ۴٪ از هزینهی مدل
- همهچیز در پلن رایگان
- SSO، SCIM و لاگهای حسابرسی
- GPU خودی یا اجارهای، یک صورتحساب
- پشتیبانی سازمانی و SLA
- میزبانی داده در اروپا یا خودمیزبان
سؤالهایی که از ما میپرسند
روی هر درخواست هوش مصنوعی یک بودجه، یک سیاست و یک نام بگذارید.
از ۱۲ دلار بهازای هر نفر / ماه، یا ۴٪ از هزینهی مدل. یک کلید ارائهدهنده وصل کنید و اولین گزارش را پیش از پایان تماس ببینید.