Goodfire chce odhalit nebezpečné AI agenty sledováním dění uvnitř modelu
Startup Goodfire představil systém, který má zachytit rizikové chování AI agentů sledováním signálů uvnitř modelu. Podle testů firmy může být výrazně levnější než…
Startup Goodfire představil systém, který má zachytit rizikové chování AI agentů sledováním signálů uvnitř modelu. Podle testů firmy může být výrazně levnější než…
Anthropic představilo OSS Scanner, který má dobrovolně zapojeným open-source projektům pravidelně hledat bezpečnostní zranitelnosti. Skeny budou zdarma a zcela automatizované, takže jejich výsledky…
Google představil nového agenta Gemini, který má kromě odpovídání na dotazy také samostatně plnit svěřené úkoly. Zpočátku bude určen firmám; pro jeho nasazení…
Hugging Face zveřejnil článek s názvem „Introducing Falcon ASR“. Dodané RSS shrnutí je však prázdné, takže z něj nelze bezpečně zjistit, co nástroj…
Nvidia rozšiřuje svůj bezpečnostní systém Halos z autonomních vozidel také na roboty, kteří pracují ve skladech, továrnách nebo nemocnicích. Cílem je umožnit jejich…
Michael Smith podle amerického ministerstva spravedlnosti sedm let pomocí botů navyšoval přehrání stovek tisíc skladeb vytvořených umělou inteligencí. Soud mu vedle 18 měsíců…
Copilot má ve Windows získat přístup k místním souborům a provádět úkoly napříč systémem. Microsoft zároveň chystá nové vyhledávání pro Windows 11, které…
GPT‑6 se podle OpenAI začíná celosvětově objevovat v ChatGPT. Novinka má nabídnout rychlejší odpovědi a takzvané inteligentní rozhraní s vizuálními a interaktivními prvky,…
Titulek článku na Hugging Face uvádí, že rodinu modelů Nemotron firma ladila pro Mezinárodní olympiádu v informatice (IOI) a Mezinárodní matematickou olympiádu (IMO)…
Google DeepMind, Meta a Isomorphic Labs společně investují 300 milionů dolarů do Biohubu, neziskové organizace založené Markem Zuckerbergem a Priscillou Chanovou. Peníze podpoří…
Osobní AI agenti mohou za uživatele hledat zboží, rezervovat stůl nebo plánovat cestu, jejich úkoly však často zastaví ochrana webových stránek proti automatizovanému…
Společnost Musubi představila PolicyLM-1.7B, model pro moderování obsahu, který má posuzovat příspěvky podle pravidel napsaných běžným jazykem. Firma uvádí, že rozhodnutí zvládne za…
Další zprávy se načítají při posouvání.