Jak bezpečně řídit AI agenty ve firmě: guardrails v praxi

Tým Elys AI & Technologie Červen 2026 3 min čtení
Jak bezpečně řídit AI agenty ve firmě: guardrails v praxi
Klíčové poznatky
  • Kombinujte prompt-level instrukce (Claude, ChatGPT) s workflow-level ochranou v Elys Automate – jeden layer nestačí.
  • Schvalovací uzel v Elys Automate pozastaví každou WRITE/DELETE akci a čeká na lidské potvrzení – průměrně 40 sekund na rozhodnutí.
  • Správně nastavené guardrails ušetří průměrně 4 hodiny týdně opraveným chybám a manuálnímu dohledu AI agentů.

Nasadili jste AI agenty, workflow běží – a pak se jeden den agent udělá něco, co jste nečekali: přepíše živá data v CRM, odešle zákazníkovi nedokončený e-mail nebo se zacyklí a spálí API kredity za půl dne. Správně nastavené guardrails (ochranné mantinely) tomuto scénáři zabraňují a podle zkušeností firem, které to řeší systematicky, ušetří průměrně 4 hodiny týdně opraveným chybám a manuálnímu dohledu. 🛡️ Téma 'The ways we contain Claude across products' rezonuje právě teď na technických fórech – Anthropic i OpenAI zveřejňují stále podrobnější dokumentaci k tomu, jak jejich modely omezují. Jenže guardrails na straně poskytovatele modelu nestačí: klíčová část ochrany musí být ve vašem workflow, ne v cloudu cizí firmy. Právě tady vstupuje do hry kombinace Claude, ChatGPT a Elys Automate.

Jak na to krok za krokem

Krok 1 – Zmapujte, co agent smí a co nesmí. Než cokoli nastavíte technicky, sepište si v Elys Notes jednoduchý dokument: seznam akcí s příznakem READ (čte data), WRITE (zapisuje) a DELETE (maže nebo odesílá nevratně). Každá WRITE a DELETE akce by měla vyžadovat buď potvrzení člověka, nebo jasný reverzibilní rollback. Tento seznam pak přenesete do systémového promptu modelu.

Krok 2 – Nastavte systémový prompt s explicitními hranicemi. V Claude nebo ChatGPT (GPT-4o / o3) vložte do System Message konkrétní instrukce, například: 'Nikdy neodesílej e-mail bez pole draft:true. Nikdy nemaž záznamy v CRM – pouze je označ jako archived. Při nejistotě se zeptej operátora.' Čím konkrétnější jazyk, tím méně prostoru pro kreativní interpretaci modelu. Testujte edge cases: zadejte agentovi záměrně ambiguózní pokyn a sledujte, zda se zastaví a zeptá, nebo rovnou jedná.

Krok 3 – Postavte workflow v Elys Automate se schvalovacím uzlem. V Elys Automate propojte AI modul s takzvaným Approval Step: pokaždé, když agent navrhne WRITE nebo DELETE akci, workflow se pozastaví a pošle notifikaci odpovědné osobě do Elys Chat nebo e-mailem. Osoba akci schválí nebo zamítne jediným kliknutím – celý proces trvá v průměru 40 sekund. Zároveň nastavte rate-limit uzel: pokud agent volá stejné API více než 10× za minutu, workflow se automaticky zastaví a vytvoří incident ticket v Elys Projects. Takto máte dvouvrstvou ochranu: model na úrovni promptu, Elys Automate na úrovni orchestrace. 🚀 Krok 4 – Logujte vše a pravidelně auditujte. Každý běh workflow v Elys Automate ukládá kompletní execution log. Jednou týdně – ideálně v pátek odpoledne, trvá to 15 minut – projděte logy a hledejte anomálie: neočekávané větve, opakované chyby nebo neobvykle vysoký počet tokenů na jeden dotaz. Pokud používáte Claude přes API, zapněte rozšířené logování Usage a nastavte budget alert na 80 % měsíčního limitu. Tato data vám řeknou, kde agent tápne a kde je prompt třeba zpřesnit.

Časté chyby a jak je obejít

Chyba č. 1 – Guardrails jen v systémovém promptu, bez technické vrstvy. Mnoho IT manažerů spoléhá výhradně na instrukce v promptu a zapomíná, že model je stochastický: při dostatečném množství volání se dříve nebo později ocitne mimo hranice. Řešení je jednoduché – vždy kombinujte prompt-level instrukce s workflow-level kontrolou v Elys Automate. Prompt říká agentovi, co má dělat; Elys Automate technicky znemožňuje to, co nesmí projít bez souhlasu.

Chyba č. 2 – Příliš přísné guardrails, které paralyzují produktivitu. Opačný extrém: firmy nastaví schválení na každou akci včetně běžných READ operací a lidé jsou zahlceni notifikacemi, které začnou ignorovat – čímž bezpečnostní mechanismus fakticky přestane fungovat. Doporučený přístup: schválení jen pro WRITE a DELETE akce s dopadem na zákazníka nebo finance, READ akce nechte procházet automaticky s logováním. Jednoduché pravidlo: pokud akci lze snadno vrátit, nepotřebuje lidské schválení v reálném čase.

Chcete mít AI agenty pod kontrolou od prvního dne?

Nastavení guardrails není jednorázový projekt – je to živý systém, který se vyvíjí spolu s vašimi AI workflow. Tým Elys pomáhá technicky zdatným firmám navrhnout celou vrstvovou architekturu: od systémových promptů přes schvalovací uzly v Elys Automate až po audit logy a alerting. Pokud chcete začít bezpečně a efektivně, kontaktujte tým Elys nebo si rovnou spočítejte investici přes online kalkulačku – první konzultace je zdarma.

Sdílet: LinkedIn X
Tagy:
AI agenti guardrails Elys Automate