Надвор од промптови: Дизајнирање софтвер што ВИ треба да го интернализира
Повеќето дискусии за ВИ започнуваат со промптови. Тоа е разбирливо: промптот е видлив, непосреден и лесно се подобрува. Но промптовите се само разговорниот раб на еден систем. Потешката работа е да се дизајнира софтвер што на ВИ ѝ дава доволно контекст, овластување, структура и повратни информации за да се однесува корисно кога никој не набљудува.
Една ВИ-функција станува доверлива помалку преку вешто формулирање, а повеќе преку околината што ја опкружува. Моделот треба да знае што смее да прави, на кои информации може да им верува, како да побара детали што недостигаат и кога да запре. Во пракса, градењето за ВИ значи претворање на имплицитниот човечки работен тек во експлицитни софтверски договори.
На ВИ ѝ е потребна разбирлива работна средина
Луѓето можат да работат и покрај нејаснотиите. Искусен агент за поддршка препознава невообичаена состојба на сметка, знае каде да бара и разбира кои исклучоци бараат ескалација. Моделот не го наследува тоа организациско знаење. Тој ги гледа само контекстот, алатките и ограничувањата што се обезбедени за тековната задача.
Тоа менува едно важно дизајнерско прашање. Наместо да прашувате: „Кој промпт треба да го испратиме?“, прашајте: „Што би му требало на способен нов колега за безбедно да ја заврши оваа задача?“ Одговорот обично вклучува повеќе од упатства:
- Јасна цел и дефиниција за успешен исход.
- Релевантни, тековни податоци со разбирливи имиња и односи.
- Алатки со тесни, предвидливи интерфејси.
- Правила за одобрувања, ескалација и неповратни дејства.
- Повратни информации што откриваат дали дејството навистина успеало.
Ова се познати теми во софтверското инженерство: дизајн на интерфејси, дозволи, набљудливост, валидација и справување со грешки. ВИ ги прави нивните слабости повидливи бидејќи не може тивко да ги пополни празнините со институционална меморија.
Дизајнирајте ги алатките како производи, а не како излези за пристап до базата на податоци
Давањето неограничен пристап на агент до внатрешни системи може да изгледа ефикасно за време на демо. Обично е слаб интерфејс за продукциска употреба. Суровиот пристап до базата на податоци изложува двосмислени шеми, непотребни чувствителни податоци и премногу начини да се произведе технички валиден, но оперативно погрешен резултат.
Подобар пристап е да се изложат способности ориентирани кон задачи. Разгледајте ВИ-асистент што му помага на тим за успех со клиенти да истражи проблем со наплата. Не треба да мора да го заклучува значењето на шест табели или да составува произволни пребарувања. Му требаат операции како get_customer_account, list_recent_invoices, explain_payment_status и можеби create_refund_request.
Секоја операција треба да има стабилен облик на влез, мал одговор, експлицитни состојби на грешка и јасно однесување за авторизација. Описот на алатката треба да го објаснува деловното значење, а не само типовите на полиња. „Враќа фактура“ е слаба документација. „Ги враќа најновите финализирани фактури; ги исклучува нацртите и поништените фактури“ му кажува на агентот како да расудува за резултатот.
Направете опасните дејства да бидат намерни
Операциите за читање и операциите за запишување заслужуваат различен третман. ВИ често може автономно да презема и сумира информации. Дејствата што менуваат записи, испраќаат пораки, трошат пари, објавуваат содржина или менуваат пристап треба да бидат дизајнирани околу контролни точки.
Доверлив образец е да се оддели подготовката од извршувањето. Дозволете ѝ на ВИ да подготви барање за поврат на средства, да го сумира образложението и да го прикаже точниот ефект. Потоа побарајте човечко одобрување или посебен чекор на потврда пред системот да го поднесе. Ова не е само безбедносна карактеристика. Создава ревизорска трага и им дава на луѓето можност да откријат исклучоци од политики што никогаш не биле претставени во контекстот на моделот.
{
"action": "create_refund_request",
"customer_id": "cust_123",
"invoice_id": "inv_456",
"amount": 49.00,
"currency": "USD",
"requires_approval": true
}
Системот треба да врати резултат што ја прави следната одлука очигледна: чека одобрување, одбиено поради политика или завршено со идентификатор. Нејасните пораки за успех не се доволни за автоматизирани работни текови.
Контекстот е проблем на производ за податоци
Моделите произведуваат подобри резултати кога вистинските факти се достапни во вистинскиот момент. Тоа не значи ставање на цела база на знаење во секое барање. Прекумерниот контекст може да биде застарен, противречен, скап или одвлекувачки. Целта е релевантен контекст со потекло.
За асистент за документација, ова може да значи преземање мал сет од одобрени страници, вклучувајќи наслови, датуми на ревизија и врски. За инженерски асистент, може да значи обезбедување на тековниот договор за услугата, средината за распоредување, неодамнешниот излез од грешки и конвенциите на складиштето. ВИ треба да може да разликува авторитативна политика од нишка за дискусија или застарен пример.
Структурата помага. Политика за поддршка претставена само како долг документ ги принудува и луѓето и моделите да бараат услови. Истата политика може да биде поупотреблива кога клучните правила се запишани и како полиња: подобен производ, временски прозорец, исклучувања, праг за одобрување и патека за ескалација. Насоките на природен јазик остануваат вредни за нијанси, но важните одлуки не треба да зависат единствено од тоа моделот правилно да ја толкува прозата секојпат.
Градете за неизвесност и закрепнување
Системите со ВИ ќе се сретнат со нецелосни барања, недостапни алатки, противречни записи и упатства надвор од нивните овластувања. Третирајте ги како вообичаени состојби, а не како непријатни гранични случаи. Систем што не може да каже „Немам доволно информации“ веројатно ќе компензира со уверлив, но небезбеден излез.
Дефинирајте што се случува кога алатка ќе откаже. Ако пребарувањето истече, дали агентот треба да се обиде повторно? Ако да, колку пати и дали операцијата е идемпотентна? Ако недостига запис, дали треба да побара од корисникот друг идентификатор или да го насочи случајот до лице? Ако надворешното дејство можеби успеало и покрај мрежен неуспех, системот мора да го провери статусот пред да го повтори.
Ова се истите прашања на кои тимовите одговараат за секој дистрибуиран работен тек. Разликата е што ВИ-агентот може да одлучи која гранка да ја избере, па гранките треба да имаат имиња и правила што може да ги користи. Добрите системи ги изложуваат неуспесите во машински читлив облик, притоа зачувувајќи доволно објаснување за човечки прегледувач.
Оценувајте го работниот тек, а не само одговорот
Исполиран одговор може да скрие слаб процес. ВИ може точно да сумира сметка, но да консултира застарен запис, да изостави задолжително одобрување или неправилно да повтори дејство за запишување. Затоа оценувањето треба да го вклучува преземениот пат, а не само конечниот текст.
Создадете реалистични сетови на задачи од репрезентативни работни текови. Вклучете рутински случаи, двосмислени барања, граници на политики, прекини на алатки и погрешни информации. За секој случај, дефинирајте очекувани повици на алатки, забранети дејства, прифатливо однесување при ескалација и суштинските факти што одговорот мора да ги зачува. Прегледувајте ги неуспесите по категорија: преземање, расудување, избор на алатка, авторизација, форматирање или предавање.
Следењето во продукција го следи истиот принцип. Забележете доволно информации за да реконструирате исход: барањето, избраниот контекст, повиците на алатки, резултатите, одобрувањата и конечниот одговор. Внимателно ракувајте со чувствителните податоци, но не правете го системот нетранспарентен во име на едноставноста. Без видливост, тимовите не можат да разликуваат грешка на моделот од лоша интеграција или расипана основна услуга.
Трајната предност е оперативната јасност
Подобрите промптови можат да подобрат една интеракција. Подобриот дизајн на системот ја подобрува секоја интеракција што следи. Тој ги принудува тимовите да ја разјаснат одговорноста, да ги документираат политиките, да ги намалат кревките предавања и да создадат употребливи интерфејси околу важната работа. Овие подобрувања остануваат вредни дури и кога моделот се менува.
Најефективниот ВИ-софтвер не се преправа дека моделот е магичен соработник. Тој му дава на моделот добро дизајниран работен простор: корисни алатки, доверлив контекст, јасни граници, набљудливи исходи и елегантни начини да побара помош. Кога софтверот станува разбирлив на тој начин, ВИ добива нешто многу повредно од промпт што треба да го усвои: систем во кој може одговорно да учествува.