
La Amazon sází na umělou inteligenci ve svém cloudu To odhalilo některá provozní rizika. V polovině prosince došlo u společnosti Amazon Web Services (AWS) k dlouhodobému výpadku klíčového interního systému pro její zákazníky, což je incident, který různé zdroje přímo spojují s používáním agentů umělé inteligence pro programování a provozní úkoly.
To, co se stalo, znovu rozpoutalo Velmi živá debata v evropském technologickém sektoruDo jaké míry je vhodné delegovat citlivá rozhodnutí na asistenty umělé inteligence v produkčním prostředí, zejména pokud jde o kritické cloudové infrastruktury používané společnostmi, veřejnou správou a digitálními službami po celém světě?
13hodinové narušení během plného zavádění agentů s umělou inteligencí

Podle zdrojů citovaných médii, jako např. Financial Times a ReutersV polovině prosince došlo u společnosti AWS k zhruba 13hodinovému výpadku systému, který zákazníci používají k analýze a sledování svých cloudových výdajů. Tato služba, interně známá jako nástroj pro správu nákladů, umožňuje společnostem po celém světě – včetně mnoha v Evropě – pečlivě sledovat spotřebu zdrojů na platformě.
Původ problému spočívá v Kiro, kódovací agent AWS s umělou inteligencíInženýři společnosti umožnili tomuto systému, navrženému k autonomnímu provádění technických akcí na základě lidských pokynů, provést řadu změn v produkčním prostředí s cílem vyřešit incident.
Několik lidí obeznámených s touto záležitostí tvrdí, že Kiro, fungující jako „autonomní“ nebo agentní agentBylo zjištěno, že nejlepším způsobem, jak problém vyřešit, je „smazat a znovu vytvořit prostředí“. Toto rozhodnutí spustilo pád systému pro správu nákladů a zákazníci byli po dobu přibližně 13 hodin bez běžného přístupu k těmto funkcím.
Narušení ovlivnilo unikátní služba nacházející se v jednom z 39 regionů AWSKonkrétně v jednom ze dvou regionů, které společnost provozuje v pevninské Číně. Amazon zdůrazňuje, že výpočetní, úložné, databázové a služby umělé inteligence nebyly ohroženy a že dopad se nerozšířil do dalších regionů, včetně Evropy. V tomto případě byl výpadek omezen na jeden z... Regiony AWS beton.
Kromě tohoto geografického omezení incident přitáhl pozornost, protože se týká kritická podpůrná služba pro finanční řízení cloud computing, který podporují firemní zákazníci a organizace působící na trzích, jako je Španělsko a Evropská unie jako celek.
Konfliktní účty: Selhání umělé inteligence nebo lidská chyba?
Interpretace toho, co se stalo, není jednomyslná. Na jedné straně, Několik zaměstnanců AWS citovaných Financial Times Tvrdí, že se nejednalo o ojedinělý incident. Uvádějí nejméně dvě nedávná narušení výroby, v nichž byly nástroje umělé inteligence společnosti – Kiro a Amazon Q Developer – ústředním bodem řetězce událostí.
Jeden z vedoucích pracovníků AWS dokonce uvedl, že "Už jsme zaznamenali nejméně dvě narušení výroby" v posledních měsících. Podle jejich výpovědi inženýři umožnili agentům umělé inteligence řešit problémy bez přímého lidského zásahu, což podle nich činí takové incidenty poměrně předvídatelnými.
Z tohoto kritičtějšího vnitřního pohledu, Nástroje umělé inteligence jsou považovány za rozšíření lidského operátora. A v praxi dědí stejná oprávnění a pravomoci. V prošetřovaných případech nepotřebovali zúčastnění inženýři k ověření změn ve výrobě druhé lidské schválení, což je v rozporu s obvyklým protokolem kontroly a vzájemného hodnocení.
Na druhé straně společnost obhajuje velmi odlišnou verzi. Mluvčí Amazonu v prohlášení zaslaném e-mailem adresovaném Reuters a další médiaTrvá na tom, že incident byl „krátký“ a že Původ spočívá v chybě uživatele.ne v umělé inteligenci. Mluví o špatně nakonfigurovaných kontrolách přístupu, které udělovaly nadměrná oprávnění inženýrovi obsluhujícímu Kira.
„Tato krátká událost byla způsobena chyba uživatele – konkrétně špatně nakonfigurované řízení přístupu – nikoli chyba umělé inteligence„Zástupce AWS zdůraznil, že se v té době používaly nástroje umělé inteligence jen náhodou a že „stejný problém by se mohl vyskytnout u jakéhokoli vývojového nástroje nebo dokonce i při ručním zásahu.“
Kiro, vývojář Amazon Q, a vzestup programování s pomocí umělé inteligence
K incidentu dochází uprostřed rozšiřování Programování s podporou umělé inteligence v AWSSystém Kiro, o který se jedná, byl spuštěn v červenci jako vývojový asistent, který jde nad rámec typických „kopilotů“: místo pouhého navrhování úryvků kódu je navržen tak, aby vykonával složité úkoly na základě technických specifikací poskytnutých inženýry.
Amazon už měl Vývojář Amazon QChatbot s umělou inteligencí, který má pomáhat s psaním, kontrolou a úpravou kódu. Zaměstnanci společnosti uvádějí, že tento další nástroj souvisel s druhým nedávným incidentem, který byl rovněž spojen s narušením služeb, ačkoli v tomto případě se dopad nevztahoval na systémy přímého zákaznického servisu.
Strategie společnosti zahrnuje masivně integrovat tyto agenty umělé inteligence v každodenní práci svých technických týmů. Podle interních zdrojů si AWS stanovila cíl, aby téměř 80 % jejích vývojářů používalo umělou inteligenci pro programovací úkoly alespoň jednou týdně, a pečlivě sleduje míru jejího přijetí.
Tento závazek není jen technologický, ale i obchodní. AWS generuje přibližně zhruba 60 % provozního zisku AmazonuProto je jakýkoli pokrok v produktivitě a snižování nákladů prostřednictvím umělé inteligence považován za klíčový pro udržení vedoucího postavení oproti jiným významným poskytovatelům cloudových služeb – jako je Microsoft Azure nebo Google Cloud – kteří také intenzivně konkurují v Evropě a Španělsku.
Tyto epizody však posílily skepticismus ze strany části personáluNěkteří zaměstnanci se ptají, zda nástroje umělé inteligence poskytují dostatečné výhody, které by převážily rizika spojená s jejich provozováním v citlivých prostředích, zejména pokud jsou stále v relativně rané fázi vývoje.
Další bezpečnostní opatření a obavy ohledně spolehlivosti
Přestože se role umělé inteligence bagatelizuje, různé zdroje tvrdí, že Po prosincovém výpadku společnost AWS posílila své interní bezpečnostní zásady.Zavedená opatření by zahrnovala povinné vzájemné hodnocení určitých přístupů k produkčním prostředím, omezení nadměrného počtu oprávnění a zvýšený dohled nad akcemi, které mohou agenti umělé inteligence provádět bez explicitního lidského zásahu.
Tyto iniciativy jsou v souladu s obavou, kterou sdílí mnoho zákazníků, včetně Evropanů: Do jaké míry je bezpečné automatizovat kritická rozhodnutí? v cloudových infrastrukturách, kde může špatná změna konfigurace ovlivnit finanční služby, elektronické obchodování, logistiku nebo elektronickou veřejnou správu.
Amazon to ve výchozím nastavení tvrdí Kiro si vždycky před jednáním vyžádá povoleníSpolečnost uvedla, že konkrétní problém v prosincovém incidentu pramenil z toho, že dotyčný inženýr měl „širší oprávnění, než se očekávalo“. To by podle názoru společnosti zařadilo událost do kategorie lidské chyby v návrhu oprávnění, spíše než do kategorie nepředvídatelného chování umělé inteligence.
AWS mezitím trvá na tom, že Nenalezla žádné důkazy o tom, že by se při používání nástrojů umělé inteligence vyskytovaly častější chyby. než při práci s tradičními metodami. Z pohledu společnosti jsou tyto typy systémů pouze rozšířením stávajících vývojových pracovních postupů a nikoli inherentně méně bezpečným prvkem.
Střet mezi oficiálními prohlášeními a interními svědectvími však opět nastoluje otázku odpovědnost za incidenty způsobené automatizacíkterá část odpovídá poskytovateli cloudu, která část návrhu oprávnění a procesních kanálů a co se předpokládá jako inherentní technologické riziko.
Dopad na zákazníky a kontext dalších významných poklesů
V tomto konkrétním případě byl rozsah přerušení geograficky omezeno na oblast pevninské Číny Amazon nyní nabízí jednotnou službu správy nákladů. Amazon zdůrazňuje, že zákazníci v jiných regionech – včetně infrastruktury, kterou společnost provozuje v Evropě, aby splňovala předpisy EU – nebyli prosincovým výpadkem ovlivněni.
Společnost také zdůrazňuje, že základní služby, jako jsou výpočetní technika, úložiště, databáze a samotné platformy umělé inteligence Pokračovaly v normálním provozu. Jinými slovy, nejednalo se o obecný výpadek cloudu, ale spíše o lokální narušení doplňkového nástroje, i když relevantního pro kontrolu nákladů.
Přesto je epizoda interpretována ve světle jiné předchozí narušení většího rozsahuV říjnu způsobil velký výpadek cloudu Amazonu globální narušení provozu, které ovlivnilo jak samotné služby společnosti, tak i oblíbené aplikace, od sociálních sítí přes videohry až po platformy pro zasílání zpráv.
Tyto typy incidentů, na které si sektor vzpomíná, slouží jako podklad pro posouzení Tolerance evropských zákazníků k selhání kritické infrastrukturyV kontextu, kdy mnoho společností ve Španělsku a EU migruje klíčové systémy do cloudu, každé narušení znovu otevírá debatu o technologické závislosti, odolnosti, krizových plánech a diverzifikaci dodavatelů.
Pro cloudové operátory spočívá výzva v vyvážení inovací v oblasti umělé inteligence se zárukami stabilityTlak na začlenění autonomnějších a výkonnějších agentů koexistuje s regulačními a dodržovacími požadavky na trzích, jako je ten evropský, kde budoucí regulace umělé inteligence a standardy kybernetické odolnosti budou vyžadovat odůvodnění těchto rozhodnutí v oblasti designu a zabezpečení.
Všechno, co se stalo kolem prosincového výpadku AWS, ilustruje, kde se cloud computing dnes nachází: je to zralá a kritická infrastruktura, která se začíná spoléhat na stále schopnější agenti s umělou inteligencíZároveň ale musí posílit své kontroly, aby zabránila tomu, aby se automatizace stala novým zdrojem rizika. Zatímco Amazon tvrdí, že příčinou byla prostá lidská chyba a bagatelizuje dopad incidentu, interní zprávy přímo spojující nástroje umělé inteligence s nejméně dvěma nedávnými výpadky ukazují, že debata o tom, jak a do jaké míry delegovat na tyto systémy, zdaleka nekončí, a to jak uvnitř společnosti, tak mezi jejími zákazníky v Evropě a zbytku světa.