OpenAI 19. srpna 2026 představila náhled funkce Private Safety Processing, která má odhalovat rizikové vzorce rozprostřené napříč více konverzacemi a současně zachovat režim Zero Data Retention.
Research answer

Create a landscape editorial hero image for this Studio Global article: How does OpenAI’s newly previewed Private Safety Processing service, announced on August 19, 2026, seek to balance AI misuse detection with. Article summary: OpenAI’s preview is a privacy-preserving alternative to conventional abuse monitoring: it aims to identify multi-turn misuse patterns while keeping Zero Data Retention (ZDR) customers’ prompts and outputs unavailable to . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
OpenAI testuje způsob, jak sledovat zneužívání pokročilých modelů, aniž by u vybraných podnikových nasazení opustila svůj příslib Zero Data Retention (ZDR), tedy nulového uchovávání dat. Funkce nazvaná Private Safety Processing, představená 19. srpna 2026, má hledat rizikové vzorce napříč souvisejícími interakcemi namísto posuzování každého požadavku izolovaně. Zároveň má zajistit, aby pracovníci OpenAI neměli přístup k samotnému obsahu zákazníka. 31
Pro firmy jde o řešení nepříjemného kompromisu: bezpečnostní týmy potřebují dostatek informací k odhalení zneužití, které se vyvíjí postupně, zatímco podniky z regulovaných nebo bezpečnostně citlivých odvětví často nechtějí, aby poskytovatel AI uchovával jejich prompty a odpovědi.
Dosavadní bezpečnostní systémy kompatibilní se ZDR vyhodnocují jednotlivé interakce samostatně. Mohou tak přehlédnout distribuovaný útok, při němž není jedno zadání samo o sobě jednoznačně škodlivé, ale série souvisejících požadavků postupně směřuje k nebezpečnému cíli.
OpenAI uvádí, že Private Safety Processing rozšiřuje automatické ochrany napříč souvisejícími interakcemi. Systém má díky tomu rozpoznávat širší vzorce aktivity, včetně pokusů o hackerské útoky vedených lidmi nebo „nesladěnými“ AI agenty. 31
V praxi by několik zdánlivě neškodných požadavků mohlo při společném posouzení vytvořit rizikový obraz — například pracovní postup potenciálně související s vývojem malwaru nebo s průnikem do systémů. Dostupné zdroje však popisují zamýšlenou schopnost rozpoznávat vzorce napříč více interakcemi, nikoli důkaz, že náhledová verze spolehlivě odhalí každou podobnou kampaň.
Klíčovou hranicí ochrany soukromí je podle OpenAI automatizovaná analýza zákaznické aktivity bez zpřístupnění příslušných promptů a odpovědí jejím zaměstnancům. Pokud systém zachytí potenciální problém, má OpenAI zaslat pouze úzce definovaný bezpečnostní signál, nikoli surový obsah konverzace. 310
Zákaznická data mohou podle zpráv o této funkci zůstat na infrastruktuře kontrolované zákazníkem, případně být chráněna šifrovacími klíči, které drží sám zákazník. 157 Takové uspořádání má zachovat výhody ZDR, které podniky obvykle požadují, a současně OpenAI poskytnout dostatek informací k reakci na podezření na zneužití.
To ovšem neznamená, že detekce nemůže mít provozní důsledky. Bezpečnostní signál může vést k opatření na úrovni účtu nebo k žádosti, aby zákazník incident prověřil. Pokud firma napadené označení zpochybní nebo pomáhá s vyšetřováním, může dobrovolně dodat relevantní kontext. Náhledová verze však není popisována tak, že by OpenAI automaticky získala přístup k uchovávané konverzaci. 23
Private Safety Processing se zatím testuje s vybranými prvními zákazníky a OpenAI jej nepředstavuje jako plně zavedenou, široce dostupnou službu. 35 Z oznámení proto nelze spolehlivě vyčíst několik pro podniky zásadních parametrů:
Příslib této funkce je proto užší než tvrzení, že „bezpečnost chránící soukromí vyřeší zneužití AI“. OpenAI teprve ověřuje, zda omezený signál dokáže účinně pomáhat s odhalováním škodlivé aktivity bez širšího modelu uchovávání zákaznických dat a jejich lidské kontroly.
Anthropic u svých vybraných modelů zvolil přístup založený na uchovávání dat. Její politika vyžaduje, aby se prompty zaslané do tzv. pokrytých modelů a jejich výstupy uchovávaly 30 dní pro bezpečnostní účely. Týká se to modelů třídy Mythos i budoucích modelů s podobnými schopnostmi.
Anthropic uvádí, že tato data nepoužívá k trénování nových modelů Claude ani k jiným než bezpečnostním účelům. Mezi zveřejněné ochranné prvky patří omezený přístup, evidence lidského přístupu a smazání dat po 30 dnech téměř ve všech případech.
Výhodou tohoto modelu je možnost zpětně prozkoumat složité útoky a prověřit případné falešné poplachy. Zároveň ale vytváří větší povinnost v oblasti správy dat a dodržování interních i regulatorních pravidel.
Podle zpráv o plánované změně chce Anthropic 30denní uchovávání zachovat, ale podnikovým zákazníkům nabídnout možnost ukládat data v jejich vlastní cloudové infrastruktuře. To může zmírnit obavy z toho, kdo data fyzicky spravuje, samotnou povinnost uchovávat je po určitou dobu by to však neodstranilo.
Oba přístupy staví na odlišném kompromisu:
Přístup OpenAI může být zajímavější pro firmy, jejichž nákupní a compliance pravidla výrazně odmítají data držená poskytovatelem. Jeho slabinou může být menší množství důkazů při vyšetřování sporného nebo nejednoznačného incidentu. Řešení Anthropic nabízí lepší forenzní dohled, současně ale přináší povinnost uchovávání i zákazníkům, kteří by dali přednost striktnímu režimu bez retence.
Ani jedna varianta neodstraňuje základní bezpečnostní problém. Vícekrokové zneužití se může podobat legitimnímu výzkumu a ochrana soukromí může omezit množství podkladů dostupných lidským vyšetřovatelům. U náhledu OpenAI proto bude rozhodující, zda jsou automatické signály dostatečně přesné, aby podpořily vymáhání pravidel bez přístupu k obsahu, který pouze shrnují.
Rozdíl v přístupu k soukromí přichází v době, kdy OpenAI a Anthropic intenzivněji soupeří o podnikové zákazníky a uživatele nejvýkonnějších modelů. Roční přepočtené tržby Anthropic podle zpráv na konci července překročily 65 miliard dolarů. Jde však o projekci založenou na aktuálním tempu, nikoli o skutečné tržby za celý účetní rok.
Investoři údajně hovořili také o možném ocenění Anthropic na úrovni 2 bilionů dolarů nebo vyššího při případném vstupu na burzu. To je očekávání uváděné externími zdroji, nikoli garantované ocenění ani dokončené IPO.
Tyto finanční údaje poskytují konkurenční kontext, samy o sobě ale nedokazují, že Private Safety Processing vznikl výhradně jako reakce na Anthropic. Opatrnější závěr zní, že OpenAI reaguje na konkrétní požadavek firemních zákazníků: jak používat vysoce schopné modely s účinnějším dohledem proti zneužití a současně omezit poskytovatelův přístup k důvěrným obchodním datům.
Dostupné zdroje nepotvrzují konečný harmonogram ani podmínky případného IPO OpenAI. Tvrzení, že firma má bezprostřední nebo definitivně schválený plán vstupu na burzu, by vyžadovalo samostatné a aktuální potvrzení.
Private Safety Processing je pokus OpenAI rozšířit ZDR z filtrování jednotlivých interakcí na bezpečnostní dohled napříč souvisejícími konverzacemi, aniž by uchovávala prompty a odpovědi zákazníků jako obsah dostupný jejím pracovníkům. Systém má vracet pouze úzce definovaný bezpečnostní signál a další spolupráce zákazníka má být dobrovolná.
Ve srovnání s 30denním retenčním modelem Anthropic tak jde o slibnou alternativu pro firmy, které kladou ochranu dat na první místo. Zatím je však Private Safety Processing pouze v náhledu. Podniky by proto měly tvrzení OpenAI chápat jako návrh ve fázi testování, dokud nezávislé údaje neobjasní přesnost detekce, míru falešných poplachů, možnosti auditu a skutečný postup při vymáhání bezpečnostních opatření.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAI 19. srpna 2026 představila náhled funkce Private Safety Processing, která má odhalovat rizikové vzorce rozprostřené napříč více konverzacemi a současně zachovat režim Zero Data Retention.
OpenAI 19. srpna 2026 představila náhled funkce Private Safety Processing, která má odhalovat rizikové vzorce rozprostřené napříč více konverzacemi a současně zachovat režim Zero Data Retention. Pokud systém zaznamená potenciální problém, OpenAI podle svých slov obdrží pouze úzce definovaný bezpečnostní signál, nikoli obsah zákaznických promptů a odpovědí.
Přístup se liší od politiky Anthropic, která u vybraných modelů vyžaduje 30denní uchovávání promptů a výstupů pro bezpečnostní účely a omezený, evidovaný lidský dohled.