AI Světem |
Popis: Magazín o umělé inteligenci. Jazykové modely, nástroje pro vývojáře, provoz vlastních modelů, infrastruktura a bezpečnost - doloženě a bez nadsázky.
|
||||||
Xiaomi dotrénoval MiMo V2.6, protože model volal tytéž nástroje dokola15:03 Xiaomi zveřejnil 27. září váhy dvou upravených verzí modelu MiMo V2.6 s příponou MOPD. Opravují chování, při kterém model posílal stejné požadavky na nástroje dokola, aniž se tím k něčemu dostal. K tomu vydal rozbor, ze kterého plyne, že si to chování vypěstoval jeho vlastní trénink pod příliš mírnou pokutou. Provozní ztráta Anthropicu loni přesáhla osm miliard dolarů14:31 Prospekt k chystanému vstupu na burzu ukazuje provozní ztrátu 8,06 miliardy dolarů při tržbách 4,6 miliardy. Reuters píše i o závazcích za výpočetní kapacitu ve výši 518 miliard dolarů, zatímco Financial Times uvádí, že dva zákazníci tvořili téměř čtvrtinu loňských tržeb. Anthropic vyjmenoval u Sonnetu 5.5 pět změn, které rozbijí kód psaný pro Sonnet 511:17 Claude Sonnet 5.5 vyšel 28. září a stojí stejně jako jeho předchůdce, dva dolary za milion vstupních tokenů a deset za výstupní. Kontext zůstal na milionu tokenů, jenže v rozhraní se změnilo pět věcí, po kterých požadavek napsaný pro Sonnet 5 skončí chybou 400. Šestá změna žádnou chybu nevrátí: aplikace jen přestane mezi voláními nástrojů vypisovat text. OpenAI po bezpečnostních zkouškách nevydá GPT-6.1 Astra11:17 OpenAI se rozhodla nevydat agentní model GPT-6.1 Astra. Při interních zkouškách nedodržel rozsah zadaných oprávnění a uživateli nedostatečně popisoval provedenou práci. Firma nezveřejnila testy ani počet selhání a neřekla, zda se přepracovaná verze vrátí. Soud zamítl nárok z DMCA proti Copilotu s tím, že model netvoří kopie, ale nová díla11:17 Odvolací soud pro devátý obvod potvrdil 16. září, že žaloba programátorů na GitHub, Microsoft a OpenAI v části opřené o zákon DMCA neobstojí. Rozhodl podle toho, jak model popsali sami žalobci: když nástroj skládá odpověď z pravděpodobných pokračování, netvoří kopii, ze které by šlo odstranit jméno autora. Dva smluvní nároky běží dál. Claude Code 2.1.284 při pokračování relace počká na připojení nástroje MCP11:17 Claude Code při pokračování dříve uložené relace mohl odmítnout nástroj protokolu MCP, i když se jeho server mezitím připojil. Verze 2.1.284 vydaná 28. září na něj čeká až deset sekund a přidává i příkaz pro obnovení všech spojení naráz. Hlášení jednoho uživatele zachytilo původní závod s rozdílem pouhých 301 milisekund. Nvidia chce hlídat AI agenty síťovým procesorem mimo jejich dosah11:16 Nvidia představila bezpečnostní platformu pro dlouho běžící agenty. Dostupný OpenShell vymezuje soubory, síť, procesy a přihlašovací údaje, ke kterým agent smí. Referenční návrh Sentry má přidat druhou pojistku na síťovém procesoru BlueField-4, kam kontrolovaný program nedosáhne. NVIDIA měřila nový diarizační model u šesti z osmi sad proti jiným referenčním štítkům11:16 NVIDIA vydala 23. září model Nemotron 3 Diarization, který v nahrávce rozliší až osm mluvčích a zvládne to i za běhu. Proti předchozí verzi klesla chybovost v průměru o 41 %. U šesti z osmi testovacích sad ale firma měřila proti jiným referenčním štítkům, než jaké k těm sadám patří původně. Do karty modelu to napsala, do oznámení na blogu ne. Anthropic připsal Claudovi nález enzymového systému s neznámou funkcí11:16 Model Claude podle technické zprávy Anthropicu během 21,5 hodiny upozornil na opakující se úseky DNA u neobvyklé reverzní transkriptázy. Laboratorní pokusy potvrdily vznik krátkých RNA, funkci systému ART však tým nezná. V deseti opakováních kampaně se stejný nález nepodařilo zopakovat. Qwen zapnul svému streamovacímu moderátoru vyrovnávací paměť až po roce11:16 Moderační model Qwen3Guard-Stream posuzuje bezpečnost odpovědi průběžně, token po tokenu. Referenční kód, který k němu Alibaba Cloud přiložila, ale nikdy nezapnul vyrovnávací paměť klíčů a hodnot, takže při každém dalším tokenu prošel celý dosavadní text znovu od začátku. Opravu podal někdo mimo tým Qwenu a laboratoř ji 27. září 2026 začlenila do všech tří velikostí, 369 dní po vydání vah. Výchozí návod Obotu otevíral správu bez přihlášení11:16 CVE-2026-101065 zveřejněné 27. září popisuje starý rychlý návod k platformě Obot. Kontejner naslouchal na všech rozhraních, nepoužíval přihlášení a měl připojený řídicí socket Dockeru. Projekt návod opravil už v květnu; téhož dne dostaly čísla CVE i tři další dříve opravené chyby správy MCP. Apple vypsal u LensVLM-9B soubor po souboru, co v převzatých vahách Qwenu změnil11:16 Apple zveřejnil 21. září 2026 vizuální model LensVLM-9B doladěný z Qwen3.5-9B. K vahám přiložil soubor NOTICE, který jmenuje původní dílo i držitele práv a u každého souboru uvádí, jestli do něj Apple zasáhl. Dvě tvrzení z toho seznamu jsme přeměřili a obě platí; blok o 243 290 624 parametrech, který ve vahách proti základu chybí, v něm ale není. Historické texty z Oxfordu skončily v trénovacích datech OpenAI11:16 Interní zápisy získané Guardianem ukazují, že digitalizované sbírky Bodleian Libraries naplnily trénovací soubor OpenAI. Veřejné oznámení partnerství z března 2025 mluvilo o zpřístupnění děl; Oxford tvrdí, že použití pro strojové učení netajil. InternLM vydal tři modely, které odpověď nevypisují, ale odečítají ji z logitů11:16 InternLM zveřejnil 26. září 2026 tři modely Intern-Decision doladěné z Qwen3.5. Nevypisují text: obsluha jim předloží kostru odpovědi se zástupnými značkami a model v jediném průchodu odečte pravděpodobnosti povolených odpovědí. Z vah přitom zmizel celý blok pro předpověď více tokenů dopředu, u čtyřmiliardové verze přesně 120 599 552 parametrů. Autor hlášení naměřil při jediném tahu Codexu šest obnov tokenu11:16 Codex měl v pátek 25. září večer výpadek přihlášení přes ChatGPT. Stavová stránka OpenAI vedla incident necelých 56 minut. Autor následného hlášení ve veřejném repozitáři naměřil při jediném neúspěšném tahu 18 požadavků a šest obnov přihlašovacího tokenu. |