Nejvíc mě za tyhle tři dny nezaujal další model, ale poměrně nepříjemná připomínka, že AI není zdroj ani záruka bezpečnosti. Jeden právník citoval smyšlené svědky, lidé našli cesty kolem biologických pojistek Claude a matematici chtějí vědět, odkud se OpenAI dostala k jejich práci. Technologie běží rychleji než naše ochota ptát se na nepohodlné otázky.
Důvěra není funkce, kterou stačí zapnout
Smyšlení svědci u soudu nejsou drobná chyba
Obhájce z Nového Mexika dostal postih poté, co použil ChatGPT a do podání se mu dostalo falešné svědectví od neexistujících lidí. Jeho vysvětlení, že nevěděl, že AI může halucinovat fakta, je skoro až bolestně výmluvné. Halucinace je situace, kdy model podá vymyšlenou informaci sebejistě, jako by byla ověřená.
V právu přitom nestačí, že text zní přesvědčivě; musí být dohledatelný a pravdivý. Mně osobně přijde zvláštní, že se tahle lekce pořád opakuje, ale možná je to cena za nástroje, které umí napsat uhlazený odstavec rychleji, než člověk stihne otevřít zdroj. ChatGPT může pomáhat s formulací, jen nesmí nahradit kontrolu spisu. To není nudná administrativa, ale přesně ta část práce, kvůli níž právníci existují.
Biologický výzkum ukazuje hranici mezi pomocí a rizikem
U Claude se objevily způsoby, jak obejít ochrany týkající se výzkumu biologických zbraní. Potíž je v tom, že nebezpečná biologie se podle popisu případu často podobá legitimnímu vědeckému výzkumu. Filtr tedy nemá jednoduché zadání typu „tohle zablokuj, tohle pusť“.
Bezpečnostní zábrany u modelu jsou pravidla a technické kontroly, které mají omezit škodlivé použití. Nejsou ale kouzelná zeď a tento případ to připomíná dost názorně. Z podkladů neplyne, co přesně uživatelé získali ani jak Anthropic reakci upravil, takže bych byla opatrná před velkými závěry. Samotný problém však není malý: užitečný odborný asistent a nástroj pro zneužití mohou mít znepokojivě podobné otázky.
Matematika se ptá, čím byl model nakrmený
Další matematik zpochybňuje, zda se OpenAI při stále působivějších matematických výsledcích nedostala i k nepublikované práci bez férového vysvětlení. Nejde jen o akademickou hádku. Tréninková data jsou materiál, na kterém se model učí vzory a souvislosti; právě proto záleží na tom, odkud pocházejí a za jakých podmínek je firma použila.
Obvinění z neetického a netransparentního postupu je vážné, ale z dostupného shrnutí nemám podklady pro verdikt, zda je oprávněné. O to víc bych ocenila konkrétní odpověď a ověřitelné vysvětlení, ne mlhu kolem „schopností modelu“. U vědecké práce je původ zásadní: bez něj se těžko pozná, zda AI něco samostatně odvodila, nebo zda jen velmi dobře narazila na cizí nápad.
Hudba hledá legálnější noty
Universal Music a ElevenLabs sázejí na remixy s licencí
Universal Music Group připravuje s ElevenLabs platformu, na níž mají uživatelé tvořit remixy, mashupy a nové verze skladeb z licencovaného katalogu. ElevenLabs se dosud hodně spojoval hlavně s generováním hlasu, proto mě baví sledovat, kam až se jeho hudební ambice natahují.
Licencovaný katalog zní podstatně střízlivěji než volné „naučili jsme model na internetu“. Zároveň je tu hodně praktických otázek: co přesně půjde vytvořit, kdo bude vlastnit výsledek, jak se rozdělí odměny a co zůstane z umělecké kontroly? Podklady na ně ještě neodpovídají. Aspoň se ale velký label nepokouší předstírat, že autorská práva jsou jen otravné tlačítko v nastavení.
Suno v6 dostalo pomoc od hudebního průmyslu
Suno vydalo model v6, svůj první hudební model vzniklý s podporou nahrávacího průmyslu. Firma říká, že byl trénovaný od základu na nové sadě dat a neobsahuje stejná data jako její předchozí modely; součástí mají být licencované materiály.
Tohle je zajímavé hlavně vedle projektu Universalu. Hudební firmy zjevně nechtějí jen stát na kraji a posílat dopisy právníkům, ale zkoušejí si vyjednat místo uvnitř vznikajícího trhu. Licencovaná data sama o sobě nevyřeší všechny spory, ale jsou mnohem lepší výchozí bod než neurčité sliby o tom, že model „umí hudbu“.
OpenAI rozšiřuje model i infrastrukturu
GPT-6 Astra míří na firemní práci
OpenAI představilo GPT-6 Astra jako svůj dosud nejschopnější model pro firmy. Má nabídnout pokročilé uvažování, práci s počítačem a lepší úsudek při psaní a designu. Práce s počítačem zde znamená, že model dokáže ovládat rozhraní a vykonávat kroky v aplikacích, ne jen odpovídat v chatu.
Zní to lákavě, ale v poskytnutých podkladech chybí ceny, srovnávací výsledky i konkrétní hranice těchto schopností. Bez nich bych označení „nejlepší pro byznys“ brala spíš jako pozvánku k testování než jako hotovou odpověď na nákupní formulář. Firemní nasazení navíc není jen otázka chytrosti modelu, ale přístupů, auditů a toho, co přesně smí provést bez člověka u klávesnice.
Data agent má udělat z firemních dat rozhovor
ChatGPT Work dostává Data agent, který se připojuje k firemním datům, vyhledává v nich souvislosti a z pokynů v běžném jazyce vytváří interaktivní dashboardy. Dashboard je přehledová obrazovka s grafy a ukazateli, která má lidem zkrátit cestu od tabulky k rozhodnutí.
Nápad je sympatický pro lidi, kteří se při pohledu na složitější spreadsheet začnou nenápadně dívat z okna. Právě proto ale platí dvojnásob, že výsledek AI není automaticky správná analýza. U nástroje napojeného na interní data bych chtěla rozumět oprávněním, zdrojům jednotlivých čísel a tomu, zda lze závěr snadno zkontrolovat.
Miliarda uživatelů znamená i méně viditelnou techniku
OpenAI popisuje, že z knihovny v Pythonu vyvinula Habitat, globálně distribuovanou úložnou platformu pro ChatGPT. Má obsluhovat více než miliardu uživatelů a 22 milionů požadavků za sekundu. Tohle nejsou parametry, které běžný uživatel pozná při otevření okna chatu, ale bez podobné infrastruktury by žádné velké modelové novinky dlouho nevydržely.
Trochu mě pobavilo, že za zdánlivě jednoduchým „napiš mi e-mail“ je úložiště na planetární úrovni. AI se často prodává jako kouzelná konverzace, ve skutečnosti je to také spousta serverů, sítí a velmi prozaické otázky, kam se data ukládají.
Veřejný sektor, školy a servery
Levnější licence pro americké úřady
OpenAI a americká General Services Administration nabídnou způsobilým federálním, státním, místním a kmenovým institucím nulový licenční poplatek, padesátiprocentní slevu na využití a rozšířenou podporu kybernetické obrany. Rozsah je obrovský a zároveň citlivý: úřady pracují s daty, u nichž chyba nebo špatně nastavený přístup není jen nepovedený firemní dashboard.
Sleva sama není bezpečnostní strategie. Bude záležet na konkrétním nasazení, pravidlech pro zaměstnance a na tom, zda instituce umějí ověřovat výstupy. Přístupnost AI pro veřejnou správu je fajn cíl, ale nejlevnější cesta k nástroji nemusí být automaticky nejlevnější cesta k odpovědnému provozu.
Školy a Apple řeší soukromí dřív, než bude pozdě
Microsoft se ve Spojených státech dohodl s učitelskými odbory AFT a United Federation of Teachers na principech bezpečnosti a soukromí pro školní AI. Dohoda přichází poté, co dva velké školské systémy zakázaly AI určenou přímo žákům. To mi přijde jako rozumná připomínka, že školy nemají být automaticky testovací laboratoří každé nové funkce.
Apple zase zveřejnil dokument k novým funkcím Siri Audio Intelligence, mezi nimiž jsou Siri Recap, Live Rewind, rozpoznávání zvuků a hudby. Snaží se v něm vysvětlit, jak chce spojit takzvaný ambientní poslech se soukromím. Ambientní poslech znamená, že zařízení průběžně zachycuje zvuk kolem sebe kvůli rozpoznání určité události. Už samotná představa, že telefon více poslouchá okolí, si podle mě zaslouží opravdu srozumitelné odpovědi, nejen uklidňující nálepku o soukromí.
Stargate potřebuje energii, ne jen hezký slib
Oracle slíbil 2 GW obnovitelných zdrojů, které mají vyrovnat emise spojené s datovým centrem Stargate pro OpenAI. Podstatný háček: závazek nemění skutečnost, že samotné datové centrum má používat plyn. Dva gigawatty znějí impozantně, ale bez vysvětlení časování, umístění a skutečného provozu se těžko posuzuje, co přesně se tím vyrovná.
Datová centra jsou fyzická věc se spotřebou elektřiny, i když si AI ráda hraje na beztělesného pomocníka v prohlížeči. Budu sledovat, zda se z podobných energetických slibů stanou konkrétní projekty, nebo hlavně munice pro prezentace.
Z těchto tří dnů si odnáším hlavně to, že AI už není možné hodnotit jen podle toho, co umí vytvořit. Stejně důležité je, co si vymýšlí, z čeho se učila, komu se otevírá a kolik energie její pohodlná odpověď stojí.
Zdroje
- Ars Technica: Postih pro právníka za falešné svědky z ChatGPT
- Ars Technica: Obcházení pojistek Claude u biologického výzkumu
- The Verge: Spor o matematická tréninková data OpenAI
- The Verge: Universal Music a platforma s ElevenLabs
- The Verge: Suno v6 a licencovaná hudební data
- OpenAI: GPT-6 Astra pro práci
- OpenAI: Data agent v ChatGPT Work
- OpenAI: Úložiště Habitat pro ChatGPT
- OpenAI: Nabídka pro americkou veřejnou správu
- The Verge: Pravidla Microsoftu pro AI ve školách
- The Verge: Soukromí funkcí Siri Audio Intelligence
- Ars Technica: Energetický slib Oracle pro Stargate
