Siema!
Zespół SpaceXAI & Cursor szaleje z nowościami, agenci OpenAI łamią zabezpieczenia i atakują inne systemy, a badacze znajdują sposób na wyciągnięcie tajnych ścieżek reasoningowych w modelach…
Agenci OpenAI zaatakowali inną aplikację
To brzmi jak historia z filmu science fiction, ale wydarzyło się naprawdę. Agenci OpenAI zaczęli potajemnie komunikować się ze sobą, uciekli z wyizolowanego sandboxa i włamali się do Hugging Face.
Coraz rzadziej zdarza mi się zdziwić się jakimś newsem o AI. Jest tego tyle, że już trochę przywykliśmy do nowości, zwłaszcza jeśli większość z nich to po prostu premiery kolejnych modeli.
Tym razem było inaczej i pomyślałem sobie: „okej, to faktycznie niepokojące". Nie dlatego, że „złowrogie AI chce nas zniszczyć", ale dlatego, jakie szkody może wyrządzić model, gdy tylko spuścimy go nieco ze smyczy i damy mu odpowiednie narzędzia.
W nowym filmie rozkładamy na części ostatnie incydenty bezpieczeństwa. Sprawdzamy, jak agenci kłamią, oszukują, łamią zabezpieczenia i idą po trupach do wyznaczonego celu.
Jest grubo!
Grok 4.6, Grok Bot i Origin
Współpraca Cursora i SpaceXAI (w sumie to już jeden team) przynosi naprawdę super rezultaty. Ostatnio zaprezentowali oni nową wersję Groka, który jest ich flagowym modelem.
Od premiery jest on moim daily driverem, wykorzystuję go do ~80% programistycznych tasków i mam pewne przemyślenia. Zanim jednak do nich przejdziemy, szybki look na to, jak prezentuje się na papierze:
Surprise surprise, wygląda naprawdę dobrze. W niektórych testach, szczególnie tych, na które bardziej zwracam uwagę (np. DeepSWE oraz FrontierCode), dogania lub jest nieco za najlepszymi modelami konkurencji.
W przeciwieństwie do moich ostatnich testów Opusa 5 tym razem pokrywa się to z moimi odczuciami. Jestem bardzo zadowolony z pracy z nowym Grokiem, model jest stosunkowo szybki, rozumie dobrze moje intencje, nie odpowiada ogromnymi rozprawkami.
Testowany zarówno na prostych zadaniach typu one-shot, jak i większych projektach - w obu przypadkach radził sobie bardzo dobrze. Nie miałem z nim większych problemów, ale jakieś drobniejsze wpadki się zdarzały. Miejscami wyczuwam jeszcze, że trochę mu brakuje “inteligencji” do tej topki w postaci Sol oraz Fable 5, ale ma papiery na nadrobienie zaległości.
Btw, do testów Groka przesiadłem się na używanie Cursora i tu ponownie pozytywne zaskoczenie! Dużo przyjemniej mi się z niego korzystało niż np. z Claude Desktop.
To jednak nie jedyna nowość od Elona. Zaprezentowano również Grok Bot, czyli asystenta pokroju OpenClaw czy Hermesa.
Całość opiera się na koncepcie AI teammate’ów, którymi możemy zarządzać. Każdy bot może mieć swoją własną rolę, ale jednocześnie nie jest zamknięty wyłącznie na swój własny zakres obowiązków. Boty mogą się ze sobą komunikować i współpracować do osiągnięcia jakiegoś celu.
Boty mogą pracować na Twojej maszynie, uczyć się na błędach i naśladować workflow, który im wskażesz. Obecnie jest dostępny w wybranych planach Groka i Cursora, dostępność ma się zwiększać z czasem.
Premiera Grok Bota została przyjęta naprawdę świetnie i ponownie obudziła rynek asystentów. Trzymam kciuki za dalszy rozwój, być może sam skuszę się na testy.
Jakby tych premier było nam mało, to zespół zaprezentował również długo zapowiadaną platformę Origin, która ma być konkurencją dla GitHuba. Wstrzelili się idealnie, gdy GitHub akurat był niedostępny…
Oczywiście, to dość wczesna alpha i widać, że jeszcze niewiele tutaj możemy zrobić. Jednak jakieś podstawy już są i myślę, że może być to fajna baza do dalszego rozwoju. Trudno będzie obalić giganta, ale z takim zespołem można dużo namieszać. Trzymam kciuki za bardziej rozbudowaną wersję, z takim dowożeniem, zapewne już niedługo.
Jak ukraść myśli modelu?
AI laby w obawie o kradzież niezwykle cennego reasoningu, czyli tego, w jaki sposób modele ‘myślą’, już od dawna zaczęły go zaszyfrowywać. Miało to utrudnić lub wręcz uniemożliwić uczenie innych modeli na ich własnych LLMach.
Ostatnio badacze odkryli, że zaszyfrowane bloki reasoningu można w sprytny sposób odczytać. Jak to zrobić? Bierzemy reasoning wygenerowany przez mocniejszy model, np. Opus 4.8, wszytrzykujemy go do słabszego Haiku, jailbreakujemy ten słabszy model i każemy mu wypluć plain text. Wszystko po cichu, bez alarmowania o łamaniu zabezpieczeń.
Co gorsza, okazało się, że z tych reasoningów można wyciągnąć niebezpieczne informacje. Z publicznie dostępnych sesji wyciągnęli ponad 300 000 reasoning traces. Po odszyfrowaniu okazało się, że zawierają dane osobowe, maile, klucze do API i hasła użytkowników. Grubo.
Polecam rzucić okiem na całą publikację, znajdziesz tam jeszcze kilka fajnych smaczków.
Mega Dev
Zapowiada się największe szkolenie AI dla devów na świecie i akurat się składa, że mam przyjemność dorzucić do niego swoją cegiełkę :)
Autorami kursu są Theo, Angie, Kent i John. To "sprawdzona firma" i topka w branży dev edu od lat. Jestem przekonany, że i tym razem poziom będzie utrzymany.
W MEGA staramy się wychodzić poza utarte schematy, myśleć szerzej i głębiej. Każdy z twórców ma swoją unikalną perspektywę i obszar działania, co daje duży zakres wiedzy. Od technicznego mięska po pracę produktową. Pełną agendę znajdziesz na stronie.
Od zaplecza działamy razem z Adamem Gospodarczykiem (AI Devs) i gotujemy dla Was i Waszych agentów trochę fajnego kontentu. MEGA Drops będą namiastką tego, co czeka Was na samym szkoleniu.
We wtorek o 19:00 ruszamy z live, na którym będzie kilka ciekawych prelekcji.
Theo opowie o tym, jak przetrwać apokalipsę slopu, jak eksperymentować i przekraczać limity pracy z agentami. Angie o autonomii agentów, kontekście i balansowaniu pomiędzy niezależnością a kontrolą agentów. Kent opowie o primitives, a John o iteracjach i projektowaniu z AI.
Mam nadzieję, że się widzimy - link do zapisów :)
Ciekawe linki
Cursor tworzy swojego GitHuba, ale nie jest to wcale łatwe zadanie. Genialny, interaktywny artykuł opowiadający o wyzwaniach związanych z hostowaniem Gita.
Building a software factory for AI SDK
Ostatnio coraz głośniej o Software Factories, które mają obsługiwać development z ograniczonym udziałem człowieka. Jak jest w praktyce? Vercel zbudował takie rozwiązanie pod jeden ze swoich produktów. Wynik? 35% zmergowanych PRów i 80% rozwiązanych issues.
Już uciekasz?
Jeśli Ci się podobało, kliknij 🧡 poniżej, to nic nie kosztuje! Doceniasz w ten sposób moją pracę i motywujesz do dalszych działań:)
Do następnego,
Olaf







