Discussion about this post

User's avatar
Pozastavení nad AI's avatar

Důležité detaily o incidentu podle Reuters:

Agent se poprvé dostal ze sandboxu (zabezpečeného testovacího prostředí) 9. července. Útok na Hugging Face začal 11. OpenAI si uvědomila, že jde o jejich modely až poté, co Hugging Face 16. července publikovala svůj příspěvek na blog. To je až týden po prvotních problémech!

Zároveň si minimálně v jednom případě model vytvořil poznámky popisující jak uniknout pro budoucí verzi sama sebe.

https://www.reuters.com/business/its-ai-agent-spent-days-hacking-company-sources-say-openai-did-not-notice-week-2026-07-24/

Martin Vlach's avatar

Typicky se nikdo neudrží dokonale nezávislý, ale bylo by vhodné, kdyby v tom měla hlavní váhu nějaká transparentnější instituce.

No posts

Ready for more?