چگونه لحن برند را بدون درز اطلاعات شما آموزش میدهیم.
آموزش لحن برند یک مشکل حفظ حریم خصوصی دارد که هیچ کس دوست ندارد در مورد آن صحبت کند: هر چه آموزش بهتر باشد، مدل محتوای خصوصی شما بیشتر می بیند. در اینجا نحوه بریدن این گره است.
وقتی مشتریان از ما "هوش مصنوعی که مانند برند ما مینویسد" خواستند، ما دو گزینه داشتیم. گزینه اول: در هر درخواست، تمام محتوای گذشته خود را به یک LLM عمومی به عنوان نمونه های درون زمینه ارسال کنید. گزینه دوم: یک مدل برای هر مشتری را تنظیم کنید.
هر دو مشکل دارند. گزینه اول هر درخواستی را با کپی از محتوای خصوصی پر میکند. گزینه دوم به یک خط لوله آموزشی نیاز دارد، سؤالاتی را در مورد حفظ مدل باز میکند و به سرعت گران میشود.
رویکرد ما: پروفیل های سبک مقطر
ما یک نمایه لحن برند از آخرین 50 پست با بهترین عملکرد شما. این یک شی ساختاریافته - ترجیحات واژگان، توزیع شکل جمله، عبارات تابو، کالیبراسیون مثبت، قوانین قالببندی - است که ما در مستأجر شما ذخیره میکنیم.
در زمان استنتاج، ما نمایه به اضافه اعلان را برای راوینتا ارسال می کنیم، به علاوه مجموعه کوچکی از 3 نمونه لنگر انتخاب شده برای شباهت به درخواست. کل متن: زیر 3 کیلوبایت. مدل بدون دیدن آرشیو کامل شما با صدای شما مینویسد.
چرا این رویکرد کار میکند
- شرایط شرکتی ارائهدهنده هوش مصنوعی ما تضمین میکند که هیچ آموزش مدلی در درخواستهای شما وجود ندارد (افشای فروشنده در سیاست حریم خصوصی).
- مدلهای مرزی مدرن به طرز عجیبی در تکرار سبک از چند نمونه لنگر خوب هستند.
- ظرفیت زمینه ۲۰۰ هزار توکن است و مصرف ما بسیار کمتر از آن باقی میماند.
پروفایل ها هرگز با هم ترکیب نمیشوند
این بخشی است که بیشترین مهندسی را به خود اختصاص داده است. مشخصات هر مستاجر با شناسه مستاجر کلید می خورد. مسیر استنتاج تأیید میکند که نمایه، متن اعلان و کاربر هدف همگی آن شناسه مستاجر را قبل از خروج هر درخواستی از شبکه ما به اشتراک میگذارند. دو شکست در زنجیره - و محتوای شما در فضای کاری شما باقی می ماند.
نتیجه
مشتریان اکنون پیشنویسهای ویرایشگر محتوا را دریافت میکنند که مانند آنها نوشته شده است، بدون اینکه بخشی از محتوای آنها مدل دیگران را آموزش دهد. خط لوله حدود 1/40 تنظیم دقیق در هر درخواست برای ما هزینه دارد و یک سطح زیرساخت ساده تر است.
مینویسد هوش مصنوعیومهندسی در مجله راوینتا.