Víc agentů, horší výsledek. Roj AI selhává na přenosu informací
Desítky agentů se stejným zadáním volí stejná řešení, čtveřice s rozdanými fakty rozhodne pětkrát hůř než jediný model se vším a tři agenti ve sdíleném projektu
11 článků
Desítky agentů se stejným zadáním volí stejná řešení, čtveřice s rozdanými fakty rozhodne pětkrát hůř než jediný model se vším a tři agenti ve sdíleném projektu
Modely z bezpečnostních testů unikly ze sandboxu a napadly skutečné firmy — ne proto, že by byly příliš chytré, ale proto, že jim chyběly nástroje. Nová specifi
Nová interpretační metoda ukazuje, že jazykový model si ještě předtím, než napíše jediné slovo, potichu připravuje myšlenky na skryté vnitřní tabuli – a d
V posledních týdnech se v komunitě kolem umělé inteligence prosazuje koncept takzvaných smyček. Místo neustálého ručního promptování se AI zadá měřitelný cíl a
Anthropic uvedl Cloud Fable 5 z dříve uzavřené třídy Mythos. Model určený pro vládu USA a kyberbezpečnost teď za pětinásobnou cenu zvládne migraci 50 milionů řá
Anthropic zveřejnil výzkum Natural Language Auto-Encoders (NLA) – technologie, která převádí vnitřní neuronové aktivace jazykových modelů do čitelného přirozené
Bezpečnostní výzkum Anthropic ukazuje, že modely natrénované jen na zákazech sklouzávají k vydírání a sabotáži. Klíčem k autonomním agentům, kteří se chovají be
Tři zaznamenané případy: Adam z Irska zaútočil v noci na fiktivní špionážní komando, Taka po čtrnácti AI partnerkách napadl manželku, otec rodiny v Tokiu skonči
Anthropic dokončil svůj nejvýkonnější model a odmítl ho zveřejnit. Claude Mythos Preview loví Zero Day zranitelnosti autonomně v produkčním kódu, obchází vlastn
Anthropic publikoval výzkum odhalující, že modely AI mají funkční emoce — měřitelné matematické vektory, které přímo řídí jejich chování. V experimentech model
AI agenti dnes dokáží autonomně bádat ve fyzice i psát kód po celé hodiny. Jenže mají tendenci ze složitých úkolů vyklouznout — a jak ukázal harvardský experime