پرش به محتوا

یک ایجنت متناسب با وظیفه خودتان بسازید.

یک ایجنت سفارشی هوش مصنوعی با رفتار و ارزیابی مشخص بسازید. آن را برای یک جریان کاری خاص خودتان استفاده کنید.

از توضیح تا نتیجه.

01

وظیفه را تعریف کنید

کاری که ایجنت باید انجام دهد، زمینه‌ای که به آن نیاز دارد و اینکه یک نتیجه مفید چه شکلی باید داشته باشد را توصیف کنید.

02

رفتار را ارزیابی کنید

قبل از اتکا به ایجنت در یک جریان کار، ایجنت تولیدشده و نتایج ارزیابی آن را بررسی کنید.

03

اصلاح و استفاده مجدد

دستورالعمل‌ها و پیاده‌سازی را از طریق گفتگوی ساخت تنظیم کنید و خروجی تولیدشده را نگه دارید.

ساخت‌های ایجنت سفارشی، متمایز از تیم‌های Workload داخلی هستند که کارهای مستمر سئو، بازاریابی، فروش و سایر امور را انجام می‌دهند.

دانش شما. ابزارهای شما. یک دستیار هوش مصنوعی که می‌توانید آزمایش کنید.

وظیفه را تعریف کنید، گفتگو را شکل دهید و رفتار دستیار را بررسی کنید.

پاسخ‌ها را مستند کنید

به دستیار خود چیزی قابل‌اتکا برای گفتن بدهید.

دستیار مکالمه‌ای خود را متناسب با وظیفه، مخاطب و منابع اطلاعاتی خودتان بسازید. هوش مصنوعی دستورالعمل‌های خودش را می‌سازد، اطلاعات ارائه‌شده را سازمان‌دهی می‌کند و یک رابط چت می‌سازد. لحن، پرسش‌هایی که باید پاسخ دهد و کاری که باید هنگام نبود اطلاعات انجام دهد را تعیین کنید.

  • از بریف و فایل‌های دانشی خود برای تعیین حقایقی که می‌تواند به آن‌ها تکیه کند استفاده کنید.
  • خوش‌آمدگویی، سبک پاسخ‌دهی و دامنه مکالمه را شکل دهید.
  • تجربه چت تولیدشده را روی دسکتاپ و موبایل بررسی کنید.
گفتگوی نمونه پشتیبانی که به یک سؤال بازگشت کالا پاسخ می‌دهد در کنار خط‌مشی منبع آن

اقدامات درست را متصل کنید

به آن ابزار و راهی برای انتقال گفتگو بدهید.

یک دستیار می‌تواند در دانش خود جستجو کند و از ابزارهای HTTP پشتیبانی‌شده‌ای که تعریف می‌کنید استفاده کند. تنظیم کنید که چه زمانی باید انتقال به یک انسان را پیشنهاد دهد، مثلاً برای درخواستی خارج از دامنه‌اش. پلتفرم مدل و فراخوانی ابزارها را اجرا می‌کند و رابط چت تولیدشده پاسخ‌ها و رویدادهای انتقال را نمایش می‌دهد.

  • ورودی‌های ابزار و نقاط پایانی (endpoint) موردنیاز وظیفه را مشخص کنید.
  • زمانی را انتخاب کنید که دستیار باید متوقف شود و انتقال به انسان را پیشنهاد دهد.
  • پیش از اتکا به اعلان انتقال، جریان کاری اطراف آن را آزمایش کنید.
دستیار نمونه‌ای که با حفظ زمینه گفتگو، ارجاع به یک انسان را پیشنهاد می‌دهد

رفتار را ارزیابی کنید

پرسش‌هایی را که کاربران شما خواهند پرسید آزمایش کنید.

این ساخت شامل نمونه‌مکالمه‌هایی با پاسخ‌ها و اقدامات موردانتظار است. ارزیابی آن نمونه‌ها را همراه با آزمون‌های پلتفرم برای پاسخ‌های بی‌پایه، تزریق دستور (prompt injection)، حریم خصوصی، دامنه و رفتار ابزار بررسی می‌کند. یافته‌ها را بررسی کنید، سپس دستورالعمل‌ها، دانش یا رابط را در گفتگوی ساخت اصلاح کنید.

  • پرسش‌های معمولی، پاسخ‌های نامشخص و موارد خاص (edge case) را بررسی کنید.
  • بررسی کنید که آیا فراخوانی ابزارها و رفتار انتقال با وظیفه موردنظر مطابقت دارد.
  • تعریف عامل، دانش و نمونه‌های ارزیابی را همراه با ساخت نگه دارید.
جدول نمونه بازبینی رفتار برای سؤالات خط‌مشی، جزئیات نامشخص و درخواست‌های ارجاع به انسان

جریان کار

کار را متصل نگه دارید.

  1. نتیجه را توصیف کنید

    مخاطب، خروجی مطلوب و محدودیت‌ها را توضیح دهید. قبل از ادامه، جهت کار را اصلاح کنید.

  2. کار را بررسی کنید

    فایل‌های تولیدشده، پیش‌نمایش موجود و بررسی‌های مرتبط با خروجی را بازبینی کنید.

  3. نسخه بعدی را بسازید

    درخواست تغییرات دهید، سپس از جریان کار خروجی یا تحویل پشتیبانی‌شده توسط آن پروژه استفاده کنید.

پرسش و پاسخ

کمی شفافیت قبل از شروع.

این چه تفاوتی با تیم‌های عامل هوش مصنوعی داخلی دارد؟+
سازنده عامل هوش مصنوعی یک دستاورد عامل سفارشی برای وظیفه خودتان می‌سازد. تیم‌های عامل، جریان‌های کاری موجود پلتفرم برای کارهایی مانند تحقیق، سئو، بازاریابی، فروش و پیام‌رسانی هستند.
به سازنده چه بگویم؟+
وظیفه عامل، زمینه‌ای که باید از آن استفاده کند، محدودیت‌های آن و نمونه‌هایی از پاسخ‌های خوب را توصیف کنید. ابزارها یا یکپارچه‌سازی‌های موردنیاز جریان کاری و زمانی که باید کار را به شما بازگرداند را نیز مشخص کنید.
آیا عامل می‌تواند از ابزارها استفاده کند؟+
عامل‌های سفارشی می‌توانند برای جریان کاری خود ابزارهایی تعریف کنند. پیاده‌سازی و اتصالات موردنیاز باید در دسترس باشند؛ ارزیابی شامل بررسی‌هایی است که ابزارهای تعریف‌شده فراخوانی‌های معتبر دریافت کنند.
عامل چگونه ارزیابی می‌شود؟+
بررسی‌ها شامل نمونه‌مکالمه‌ها، پایه‌بودن پاسخ‌ها (grounding)، لحن و زبان، فراخوانی ابزارهای تعریف‌شده، تأخیر و خطاها می‌شود. آزمون‌های دیگر رفتار در قبال دامنه، اطلاعات حساس و تلاش‌ها برای زیرپا گذاشتن دستورالعمل‌ها را بررسی می‌کنند.
آیا می‌توانم علت شکست یک ارزیابی را بررسی کنم؟+
رکورد ارزیابی شامل رونوشت‌ها، نمرات و یافته‌ها است. از این شواهد برای بررسی پاسخ یا رفتار ابزار و درخواست یک تغییر هدفمند استفاده کنید.
آیا می‌توانم پس از ساخت اول، عامل را بازبینی کنم؟+
بله. دستورالعمل‌ها، نمونه‌ها یا پیاده‌سازی را در گفتگوی ساخت اصلاح کنید و نسخه بعدی و ارزیابی آن را بررسی کنید. قبول‌شدن در بررسی‌ها نیازی به بررسی رفتار آن در جریان کاری موردنظر شما را برطرف نمی‌کند.

چه چیزی می‌سازید؟

یک ساخت ایجاد کنید، یا یک تیم متخصص را روی وظیفه بعدی خود به کار بگیرید.