Go back

OpenClaw, SWE-AGI i zmierzch chatbotów - Opus 4.6 i GPT-5.3 Codex to Agenci z przyszłości!

103m 15s

OpenClaw, SWE-AGI i zmierzch chatbotów - Opus 4.6 i GPT-5.3 Codex to Agenci z przyszłości!

Transkrypcja jest zapisem odcinka podcastu "Opany AGI", podsumowującego kluczowe wydarzenia z lutego 2026 roku w świecie sztucznej inteligencji. Głównymi tematami są dwie "burze": wokół agenta AI o nazwie OpenClow (znanego też jako Cloudbot) oraz dyskusja na temat postępu w kierunku AGI w kontekście programowania. OpenClow przedstawiony jest jako przełomowy, autonomiczny i sprawczy agent, który aktywnie wykonuje zadania end-to-end, korzystając z dostępu do systemu operacyjnego i integracji z komunikatorami. Jego gwałtowny wzrost popularności (rekord na GitHub) szedł w parze z kontrowersjami, w tym rebrandingiem, zarzutami prawnymi i krytyką dotyczącą bezpieczeństwa oraz dezinformacji (powiązany portal "Moldbuk" okazał się nie w pełni wirtualny). Druga część dyskusji dotyczy wpływu najnowszych modeli językowych (jak GPT-4o i Claude 3.5) na zawód programisty. Prowadzący zastanawiają się, czy te narzędzia, umożliwiające nowy, agentowy workflow, oznaczają nadejście AGI w programowaniu. Podkreślają przy tym własne doświadczenia z nową generacją rozwiązań i zachęcają do aktualizacji przyzwyczajeń. Podcast promuje także nową inicjatywę edukacyjną – kurs "AI Native Software Engineering" (TenXDevs), który ma nauczyć świadomego wykorzystania agentów AI w procesie tworzenia oprogramowania, oraz zachęca do śledzenia kanałów prowadzących.

Transcription

15267 Words, 98117 Characters

Polish
w okazję, że w tym 2026 roku całkiem sporo przy pomocy tego AM można zrobić. Koncechtnie programowania szczyzna inteligencja to nie jest już autokomplicy na stwierdach. To jest naptawne wygląda jak taki zdawcze autonomiczny byt, który nie tylko generuje jakiś tam kodzik, wybranym tiku, tylko wykonuje pracę end to end. I oczywiście to rodzi kolejne pytania. Kim jest programista, czym programista ma się zajmować, jaka jest odpowiedzialność programisty i czy faktycznie to AGI już tutaj jest, czy można ten program, który widzimy zalecieć do właśnie takich kategorii. Cześć witam Was bardzo serdecznie. To jest kolejna odcina jak podcastu Opany AGI. Dzisiaj podsumowujemy luty 2020 roku. Witaj się z Wami. Przemek Smrzdek. Matciń Zorkowski, cześć. Głównym i tematami odcinka będą dwie burze. Burze homarowa i burza AGIowa, czyli tematy, które naprawdę powinny zainteresować wszystkich pasjonatów. Tużna inteligencja i uczenie maszynowego i tego co dzieje się w obszarze. Budowania produktów nowej generacji. Nie zaczniemy od homarów. Jednak nie będzie to rozmowa o kuchni, śródziemnomorskiej. Nie będzie to rozmowa gdzieś tam na pogranie czułzo czy różnych gatunków zwierząt. Ale rozmowa bardzo mocno osadzone nadal w tematyce sztucznej inteligencji. Po rozmawiamy o takim produkcie, o takim usudzu, o takim rozwizania Cloudbot. Czasami nazwane "Boldbotem" albo też finalnie "OpenClow". Czyli takim agencie, który w ostatnich tygodniach naprawdę podbijał serca programistów, użytkowników, szczycznej inteligencji i agentów. Dzisiaj, kiedy nagrywamy cały ten kusz rozwoju Cloudbota i moldubuka opadu, i zastanowimy się, co tak naprawdę pozostało. Mówimy o takim wejralowym hitie od pana Pyterašta inbergera, który przechodził w ostatnich tygodniach kilka rebrandingów, zmierzył się zażytanie o narusze nieznaku towarowego, napędzał agentowe media społecznościowo, które, de facto, nie okazały się wcale takie agentowe, ale o tym wam też opowiem. A następnie został ponięty przez jednego z gigantów sztucznej inteligencji. Oczywiście dzisiaj powiem wam o całej tej sytuacji więcej. Wtedy kompromitecy influencerów publiczne zakłady z jednym z uczestników tego podkastu skandalę dziury bezpieczeństwa, duża kasa, najnętrzy testy opowiem wam, jak to wszystko działa z naszej bardzo subiektywnej, bardzo osobistej perspektywy. W drugim tematem będzie AGI, czyli jeden z takich memów tego naszego podkastu, AGI tutaj wielokrotnie wspominaliśmy. Raczej nie byliśmy wielkimi fanami ogłaszania tego, że AGI już nabeszło. Natomiast w programowanie w ostatnim kwartale wydarzyło się naprawdę sporo w świecie programowania napędzonego szluczną inteligencją. No i tutaj takich dwóch graczy mene wiecie opus 4,6 i GTI 5,3 codex. No, każą nam tak naprawdę zrewidować te nasze tezę apropo tego, czy AGI już nadeszło, czy AGI podbiło świat programowania. Właśnie o tym porozmawiamy, a to dlatego, że od kilku tygodni to stujemy dla was właśnie nową generację rozwiązań w tej modelie agentów, które pozwalają na dobre przynajmniej z naszej perspektywy zapomnieć o Epoce cztatowania zeszczyszczą inteligencją. Ten workflow nowoczesny, workflow nowej generacji dla nas jest już standardem, ale z naszej perspektywy dla wielu specjalistów IT codziennością takim standardem jest nadal otwarta zakładka szczatem GPT-skąd, taki duży kontrast, skąd różnice w podejściu, czemu my już pracujemy zupełnie inaczej z sąszczyszczą inteligencją. Dzisiaj opowiem wam właśnie o tym, opowiem co zmieniają nowe modele i narzędzia, dlaczego tak dobrze działają i dlaczego warto zaktualizować przyzwyczajenia i też prognozła przyszłości programowania, bo ten temat jest też szczególnie interesując. Przy okazji opowiem wam jeszcze więcej o naszej nowej inicjatywie o benchmarku TanexBench, gdzie zamknięta topka modeli rywalizuje z otwartymi rozwiązaniami i z upęsorsowymi alternatywami. Oczywiście zachęcamy do tego, żeby wystawiać nam najwyższe możliwe oceny dlatego podkastuję dla odcinka, którego właśnie słuchacie. Czy to spotyfeć, czy Apple Podcast stajcie nam 5-5, zostawcie opkę w górę i udostępnięcie podkaz ze znajomym, to pomaga nam docierać do szerszego grana odbiorców, pomaga nam się przebijać przez algorytmy. No i dzięki takim wsparciu możemy tworzyć jeszcze więcej wartościowych materiałów. Zanim przejdziemy do tych dwóch najważniejszych tematów dzisiejszego odcinka, to Marcin opowił wam jeszcze, co tam słuchać na Bextaj Jun, nad czym pracujemy, dlaczego chcemy was zaprosić, bo też dziesięć tutaj sporo. Dokładnie tak, na początku możemy was jeszcze zachęcić, to śledzenia naszego tak naprawdę głównego kanału na YouTube, czyli przeprogramowani, gdzie wznowiliśmy reguladne publikacje, właśnie związane ze szczuszczą i telegęcją, więc na YouTube przeprogramowani, znajdziecie nasze najnowsze materiały w zupełnie nowej jakości, z nowym montażem, więc jeżeli ktoś nas nas w przyszłości, no to będzie pozytywnie zaskoczony, a jeżeli którymi nas oglądał przez pierwszy, no to myślę, że również będzie dla niego fajne doświadczenie, pojawiają się nasze odcinki, nie ma, że co tydzień, więc jest, co śledzić, więc jest, co oglądać. Zachęcałe was w również do dołączenia do Nusletera Opanu AI na Stonie Opanu. Kropka AI, ułamane na Nusleter, zapisując się na tą listę, oczmujecie, co poniedziałek, trzy wysyreksjonowane newsy, narzędzia, techniki, pracy z AI, które pozwolają wam się rozwijać jako specjalistaj, tim, jako programista. Nie musicie zapisywać się w ciemno na Stonie Opanu i Kropka AI, ułamane na Nusleter, właśnie. Wzajęcie poprzednie nasze publikacje, te które spotkały się z największu na interesowaniem, więc można zobaczyć co my tam, co ten poniedziałek do was wysyłamy, zachęcamy do szczerwzenia i do dołączenia do ponad tysiąca czterstu czytelników naszego Nusletera. No i tutaj również bardzo ważne. O głoszenie zapraszamy was na stronę TenXDevs.pl, 10XDevs.pl. Gdzie czeka na was zupełnie nowa 100 naprogramu w edycji 30? I czym ta edycja 30 jest? Będzie to intensywny 5 tygodniowy program AI Native Software Engineering. Co ważne przygotowaliśmy 80% nowych teści. To nie jest aktualizacja, bo przegiedecji to jest zupełnie nowy kurs. I będzie mu uczyli procesu, a nie w tej mordkach konkutnych technologii. Ten łatwo będzie działo spytonem, jawą, typskryptem czy też innymi poprzednymi technologiami. Wybranym przez was narzędzią. My oczywiście będziemy te komendowali, te przez nas preferowane. Uobione na chwilę od bezsną jest to Cloud Cloud, Skodex i AI. Ale oczywiście kurs od GitHub CoPilot również będzie to odfotososowany do tych narzędzi. Największa zmiana w tujce to modu być 5 duże nastabijena, jakoś na skalę, na pracę z połową. Tematy, które poruszaliśmy w poprzednich edycjach, ale nie w sposób kompleksowy. A teraz stało się tu już płuczowe, przy coraz większej adopcji AI w togdemowaniu. Jeżeli chodzi o adopcja, a bój, adaptacyjność, no to adaptacyjne będzie nasz priładk, będzie dososowany do waszego poziomu. Wiedzę, więc jeżeli jesteście już doświadczeni, to to nie będzie dzisiaj nudzić, nie będzie to w takiej czasu. A jeżeli przychodzicie jako osoby początkujące, to również zdobyjciecie niezbędną, wiedzę, żeby wskoczyć w pierwszy intensywnym modu Agentic Environment. Mamy 3 700 osób, które przeszły, wcześniej się edycje, więc wiemy co działa, wiemy co nie działa. Mieliśmy ogrom pozytywnego feedbacku, informacji co można poprawić, więc to będzie naprawdę dotacowane szkolenie. No i przede wszystkim nie uczymy, jak to z małeś czas, bo ten nie uczyły też jakiegoś safu, przede AI, uczymy świadomego podejścia, to wykorzystania tych narzędzi, tego jak zbudować w dowisku Agentowe i jak efektywnie w nim programować, więc raz jeszcze zaawęcamy do odwiedzenia strony TenXZHOPK.pl, 10XZHOPK.pl, tam znajdziecie wszystkie informacje o szkoleniu, statkujemy 18 maja. I tym o to spocnąłem, przechodzimy do pierwszego tematu tej naszej chomadowej, a pokaliwcy przemekwadztu wszystko w dowadzie. Macim wspominał, że w TenXZZHOPK stawiamy na właśnie programowanie z Agentami. O tym na pewno jeszcze będziemy mówić w kolejnych odcinkach, natomiast dzisiaj pogadamy o takim agentie najbardziej uniwersalnym, o takim asystęcie, który gdzieś tam docelował miał zastąpić choćby syry na urządzaniach iOS. I faktycznie powstał, faktycznie zdobył serca wielu użytkowników szczęśnienitelegencji, w tym również serce Marcina, który na pewno zaraz wam opowie, jak to z tym rozwiązaniem się opresuje. Ale dzisiaj chcemy wam całą te burze podsumować, burze związane z produktem OpenClow, zwanym też wcześniej Cloudbotem czy Modbotem, bo historia jest naprawdę gruba. Wyobraźcie sobie, że budujecie taką firmy, która jest warto, jest wyceniana na 100 mln euro, wychodzicie z niej po 13 latach i ciągu tego rozwoju. I na gład spadacie w kryzys, taką egzystencją namną pustkę, w egzystenc allną pustkę, nie wiecie co robić, nie wiecie, na czym się skupić, to programowanie wydaje wam się już takie w ogóle. No, średnio interesujące. Co robić, co robić właśnie z tym swoim dostępnym czasem z całą tą kasą. Jeśli nazywacie się Peter Steinberger, to możecie choćby wrócić do kodu i zbudować kolejny produkt zupełnie nowych realiach, tylko że właśnie tym razem ten produkt będzie postawał przy wsparciu jakichś wirtualnych asystentów i jakichś agentów, którzy będą dla ciebie ten produkt budować, troszkę tak jakbyś grał w taką grę RTS. Przy okazji ten produkt stanie się viralowym hitem, przejem jego Big Tech, a ty nakręci już mnóstwo kontrowersji w wielu różnych obszarach życia i te wszystkie historywa. Dzisiaj podsumujemy, bo właśnie tak narodził się Cloudbot, znany pod nazwą OpenCloucze i takiej osobiste 24/7. Asystant napędzamy sztóczną inteligencją, który w kilka dni zdobył rekordowy 86 tysięcy gwiazdyk na githabie, co oczywiście wygenerował tyle samo pozytywnych, komentarzy i feedbacku, co krytyki i jakichś takich wyrazów z ceptycyzmu, a propos tego co też tużna inteligencja ze światem programowania robi. My dzisiaj nie skupimy się wyłącznie na technikaliach, chociaż o tym też opowiem ale postaram się przedstawić taki "big picture" bo jego często w tej dyskusji brakuje jasnej ciemne strony tego całego szalnego ekosystemu przefiltrujemy również prawdy od półprawd, kontrowersji skomentujemy. Tak żebyście dobrze rozumieją czyn ten produkt tak naprawdę jest, kto może z niego skorzystać, jakie są zagrożenia, a co jest absolutnym. Farma z onem bo takich niestety też tutaj sporo było i to się wiąże z kolejnym tematem czyli właśnie z moldbukiem, czyli takim, że koło pierwszym portalem społecznościowym dla agentów, który miał być zupełnie wirtualny, rozwijany bez udziału ludzi ile w tym wszystkim prawdy o tym się zaraz przekonać. No i tutaj masz się jako użytkownik OpenCloa, bo dzisiaj chyba tą nazwą będziemy się domyśnia posługiwać. Na początku może opowiedzmy czym to rozwiązanie tak naprawdę jest, do czego go porównać czy to jest może jakaś nie wiem. Nowa wersja czata GPT, jakieś rozszerzenie czata GPT, nie, o co tak naprawdę chodzi. No nie jest to szarnę rozszerwienie, że to jest GPT, a linięc tak naprawdę podobnego do tego produktu. Może zostawmy sobie właśnie te dwa rozwiązania, żeby dooprzez zumieć różnicę. Czaj GPT jest takim tenacyjnym szatbotem, który jest spasywny czeka na interakcje z naszych stron, czeka na prostu pląt, aby móc udzielić nam odpowiedzi w formie tekstowej, no zakończą minimalną sprawczością na poziomie konektorów i innych rozszerzeń, które dają nam jakoś możliwość wyrób konewania działań. W przypadku OpenCloa mamy zupełnie inne podejście, bo jest to Agate Plaktywny, który działa 24 na 7 ożązaniu i jest w pełni sprawczy, ponieważ ma pełen dostęp do terminala i też do klików dostępnych na systemie operacyjnym urządzenia, na którym jest uruchomiony. Po czas do szczegcielu GPT, no mam oczywiście odniżowaną piaskownicę, która nie ma zupełnie takich możliwości. Co do samego interwejsu, to również jest tu bardzo ciekawie, no w przypadku to to GPT jest to oczywiście albo interwejsu, bo po prostu sześć aplikacja, jak to mamy pobraną na komputerze, a jeżeli chodzi o kontekst OpenCloa, mamy ogrom różnych możliwości. Przede wszystkim to przykłodliło komunikatory, takie jak WhatsApp, i Messy, że Discord Slack, mamy również interfejs słabo, mamy terminal, tak więc naprawdę do wyboru do koloru. No i też duże różice zachodzą na poziomie pamięci. W przypadku czarga GPT, no mamy kotrothałą pamięć związanym z oknem kontekstowym w ramach danej komensacji, no i też oczywiście jakieś mniej się rozszerzenia, gdzie pojedyncze fakty na nasz temat możemy zachowywać i jakoś tam nie lub bardziej skutę się odwoływać się do poprzednich. Komensację w przypadku OpenCloa ono ten system jest dużo bardziej odpudowany. Mamy PAMY II kotwałą w szeregu Bików MD. Jednym z najciekawszych jest Soul MD, czyli tak naprawdę tużsamość, osobowość naszego agenta. To jeszcze poruszymy, no więc tutaj mamy z nasz bardziej ten system rozszerzody, agent też w szykie o rzeczy, które się uczy, zapisuje w ledykowanych blikach i potem stoi wiedzy korzysta podczas kolejnych interakcji. Tak więc widzimy, że OpenCloa z samego założenia jest bitem. Autonowiść, sprawczył to jest taka maszyda, która ma recek, która nie tylko może, ale taka prawda chce działać. I to nie jest tylko tak naprawdę rozwiązanie, które mówi nam jak coś zrobić, albo wykonuje dla nas proste działania, to jest cały środowisko wykonywania napisane w testy, gdzie w noczyje się, no które sektuje nasz system operacyjny, to odwiesunowominie jako przestrzeni oboczął, gdzie działa, wykonuje działania, nie tylko w ramach tego systemu, również na mach sieci, czy to był przez skis, w przypadku MCP, no dla integdatca jest dużo mniejsza, bo sam Peter Schoenberger, wiekim fanem tego protokołu, nie jest, no więc może przemku. Jeszcze wejdźmy trochę na głębszy filar, na czarnych głębszy powiedzmy poziom techniczny, mówimy właśnie te filady, na które składać sam OpenCloa, mamy tutaj kilka takich głównych komponentów. Park, powiedzmy o kilku takich filarach, na pewno takim pierwszy najważniejtuję celem filarem, czy też taką podstawą tego wszystkiego jest na samodal językowy, który tutaj gdzieś tam w centrum jest, ale wiemy, że jak taki model, gdzieś tam wrzucimy na nasz dysk, to on sam z siebie tych rzeczy, o których te machie opowiadaje się, robił nie będzie, on potrzebuje jakieś dodatku, w jakiejś rozszerzeń umiejętności obsługi na rzędzi. I tutaj w tym OpenCloa, w którym takie rozszerzenie mamy, pierwszym istotnym rozszerzeniem, na który zwraca uwagę Pete Steinberger, czyli właśnie autor tego rozwiązań, to jest Gateway, taka brama komunikacji, tego rozwiązania z innymi z jedniesznymi usługami. Ten Gateway to jest rozwiązanie, przez która OpenCloa podpienna się do twojego właśnie uca, patele grama, slaka czy usług zewnętrznych i pozwalabyć w ciągłym kontakcie z operatorem właśnie w taki proaktywny sposób, czyli nie tylko pasownie czeka na twoje polecenia, ale również na przykład, na skutach działania OpenCloa, możecie się pojawić jakaś wiadomość, jakieś powiadomienia na twoją smartfonie, możesz korzystać nie tylko spodsować wymiany wiadomości, ale z różnych takich dodatków dotyczących właśnie tych platformach, jak wypłuki, czy automatyzacja. W tym wszystkim jest też całkiem sporo prompt engineeringu, a właściwie takiej pracy dotyczącej rozumowania tego OpenCloa i tutaj wykorzystywane z taka pętla React, czyli jedna z takich technik promptingu, która była już opisywana, myślę, 24, ze z 75 roku, przed tym jak agenci weszli do mystreamu, natomiast tu mamy takie praktycznie zastosowanie tego mechanizmu. Ony tutaj tak naprawdę dwa kroki, czyli Ryzen oraz Act, krozumowania i krolku działania, agenc nie zajmuje się wyłącznie właśnie odpowiadaniem na nasze zapytania i generowaniem tekstu. On bardziej zbiorczo podchodzi do problemu, bardziej tak całościowo, czyli właśnie najpierw interpretuje twoje polecenie, planuje kroki, wykonuje jakieś akcje, czasami do tego się dokłada, te rzeczy właśnie obserwacje na temat tego, co się w środowisku zmieniło i przez to właśnie zmieniany jest stan tego agenta. Mamy też całe ekostystę wtyczek, czy też z kili, które można do tego OpenCloa dodawać. No tak naprawdę już setki gotowych umiejętności, dedykowana platforma CloudHub, gdzie użytkownicy pasjonaci tego ekosystemu dorzucają różnego rodzaju rozszerzenia, czy to jeśli chodzi o usługi zewnętrzne, czy nawet wychodzenie do takiego świata fizycznego starowani naszym smart home. Taki skill jest po prostu plikiem kontekstowym, fragmentem, jakiegoś polecenia, jakieś instrukcje, możemy go wgrać, agent przez to uczę się nowych instrukcji jest w stanie posugiwać się nowymi narzędziami. Najważniej ten ostatni filar, o którym właśnie wspomniał, czyli SoulMD, taki dokument, który określa też samość agenta, bardzo mocny nacisk, tutaj kładzany jest na to, żeby każdy użytkownik miał takiego swojego OpenCloa, żeby sobie miał takiego swojego wirtalnego asistenta. Dla każdego będzie to coś innego, nieco inne zachowalnie, nieco inne reakcje. Właśnie w tym SoulMD można się pobawić. Zanim Agend rozpoczyna pracę, on przeprowadzę z tobą wywiad, żeby zrozumieć to, co jest dla ciebie istotne, w przypadku korzystania z takiego produkcji, i też ogólnie w szerszym kontekście. I w SoulMD jest to podsumowywane. Tutaj w dużym cudysowie można powiedzieć, że to jest taka dusza agenta, a mówię o cudysowie, dlatego, że jak wiedziałem właśnie na takie tematy, to bardzo, bardzo te różne przekomania. No ale o tym sobie jeszcze porozmowiam. Więc jestem SoulMD, jest to taka właśnie korowa, tożsamość tego agenta, na tej podstawie wykonywane są różne akcje, sposób interakcji i sposób na te, żeby Agend pamiętał, kim jest i co ma właściwie robić. No i jak te filary tak naprawdę przekładają się, macie na samodziałanie OpenClow, i jak to w ogóle wszystko w ogóle ryzynuuje ze społecznością, co to jest z tym wszystkim takiego fascynującego, w ogóle też z twojej perspektywy, jak to zaragowała społeczność. No bardzo duże zainteresowanie chyba największe tak naprawdę za mojej bytności w świecie technologii, jeżeli chodzi o jakiś nowy projekt OpenSoc, co też to znaedruje pod wierdzeniem. W liczbach, Sztej Berger upublicznił jeszcze wtedy CloudBota, pod koniec 2005 roku, no i bardzo szybko zdobył pierwsze 9 tysięcy. Wiadzek, co już samą w sobie jest imponującym wynikiem, ale w ciągu kilku kolejnych liczbata przekroczyła 86 tysięcy, no co już pobiło, bo te kody jeżeli chodzi o wzrost, a ostatnio wziął dzisiejszym projekt ma ponad 220 tysięcy gwiazdek na gitabi, no więc to jest niesamowity wzrost, jak na niecałe dwa miesiące od publikacji projektu. Mamy też nawet prawie 12 tysięcy forków, więc widać, że ludzie tworzą własne, według z jetego projektu mam aktywnąc płeszczość na Discord. Dziekto liczbę 20 tysięcy członków, no i ogrodą postów na social media związanych właśnie z tym projektem. Jest to rekord Litchawa, jeżeli chodzi o wzrost projektu przynajmniej liczony. W gwiazdkach to oczywiście nie jest idealna metryka, ale pokazuje, jak dużo zainteresowania ten projekt wygęerował w tak krótkim czasie. Dużo również kontrowencji, ale też dużo powoł nawet ze strony osób, które mają, bo jest my nie nagarną reputę. w szucznie inteligencji, jak chociażby Andei Kapati, to jest ołażył, że to fascynująca wadztwa nad agentami opady tymi ORLM, która wynosi od kestacje i twarostki, który na niespotykany dotąd poziom abstakcji, myślę, że to jest to, o czym wiele osób marzyło już w roku 2024, 2025, to jest leszcie ten argument, tego wszyscy chcieli mieć, który działa, który robi dla nas rzeczy i faktycznie funkcjonuje w sposób, który pozwala na realizację niebanalnych, ciekawych zadań technicznych i nie tylko tutaj może opowiem o tym, jak ja obejrzcie, go stosuję, mam go odpalonego na zewatnym VPSie na chętne, że wtedy to była gdzieś tam najbardziej rekommendowana opcja i też najbardziej atakcyjna cenowo, chociaż zupełnie szczerze widziałem wczoraj post kuby blogarskiego, że na chętne, że szczykują się potwyżki cen być może, kiedy będzie stawiał podobną infrastrukturę dla naszej filmy przeprogramowani, no to sobie to na mikrusie, żeby tutaj być bardziej o to gospodarczy i wspierać znajomych twórców, pozdrawiamy w tę kubę blogarskiego. No i jako mając na obadze kwestie bezpieczeństwa, żeby nikt do tego chętnera się nie mógł dobić i wypalić po prostu tych pięć cudlarów, kurcza, na operu też, które mam przeznaczone na pracę tego agenta, jeżeli chodzi o bezpieczeństwo, to zadbałem o to, żeby nikt nie mógł mi przepalić mojego planu na klot, którego mam w piantego w OpenCrow i zapropować moich tygodniowych limitów oraz kluczy OpenRut, który wykorzystuje w różnych aplikacjach na łącznie sumę pięć dodadów z limitem, więc poważne tutaj pieniądze są w grze, na postanowiłem o to odpowiednio. Zadbać, więc również cały ten serper sobie spieczułem w siecią w Tejske, no która sprawia, że jest ona tylko dostępna z moich urządzeń dla świata zewnętrznego ten, że VPS-chętnera jest niedostępny, niewidoczny wszystkie porty i adresy są zablokowane. No i to jest takie rekumentowane set up, które zapewnia wysokie bezpieczeństwo korzystania z OpenCrow łącznie kosztuje około 10 dodadów miesięcy, więc naprawdę nieduże pieniądze, żeby się w pełni bezpiecznie z tym naszym krawem. Pobawić sobie tam działa i jest takim moim pomocnikiem właśnie VPS-owym, pierw pomóg mi z konfiguracją całego tegoś budowisko inoxowego, co wywołuje raczej w ogóle mnie niemiłe wspomnienia szczęstów ilniowskich, gdzie bardzo dużo w tu się do wisku spędzałem czasu i tak jak raczej to były godziny przeglądania z tak o Welflowe, dbania o to, żeby różne strowniki zaczęły działać i postowe rzeczy, żeby można było z tego systemu krysynt, tutaj wydarzyło się to kilka minut i mogłem zacząć hostować różne nasze pewne aplikacje na użyteg własne. No i teraz OpenCrow głównie jest takim właśnie moim alkietr satorem te aplikacje, dba o to, żeby one się na wyrożąco. Diprojowały informuje mnie o różnych problemach, matał dojść od palonego. Super, super, bardzo dobrze sobie radzi za rządzarium, przykąd zajęł migracjami, jak wypuszczam jaki zmianę to sam sobie zaciąga z Kit Hava, to wszystkie komity, liwie poróję i informuje miasto przez Discorda, również pomagami w innych zadania jakichś discerczu, kiedy szukam jakichś produktów, to również bardzo dobrze sobie z tym razi. Tak więc no nie mam tutaj jakiś za wasowanymi uskreśców, to wszystko by było tak naprawdę zrobić na stare dobre inne sposoby, ale chciałem właśnie przede�ć do rozdania bardzo przyjemne, jest użyciu daj taki fajny film, że ma chyba się takiego własnego agenta, który nie dojrz, że robi dla ciebie rzeczy, gotowa się na Discordzie ci o tym. Pojfradbuje, wysiecie mimo, emotkę zgodnie z tym, co w Solem D ma opisane, więc fajnie sobie z tym moim krawem. Wejbujemy i zupełnie jeszcze, że czekam na tarż, będę miał trochę więcej czasu, co nie wiem, czy na stopie przed previerą się się edycji, ten jak zdarzył sobie jeszcze więcej z nim pobawić, ale jest to na pewno zajawkowe, daje takie poczucie, że przyszłość jest teraz. Więc wracając włoży do samego OpenClose i do tego projektu, no bo dużo kontrowencji i dużo też znaków zapytania, woku może nawet samego, no bo w sposobu wytwarzania tego projektu samego osoby pita z tym bergela, no bo to wywołało również wiele gdzieś tam wątpliwości z cewtycyzmu. Kim ten pił, jest, czy to jest jakiś tam dziwny wipecode, jakiś leszczyk, czy może jednak goście, to najlepiej znana rzecz niż mogłoby się na pieszu toka wydawać, przede jak to wygląda. No wygląda to dla wielu tak, że jest to nie zdecydowanie mówiąc, szczerze, wygląda to absurdalnie ziele, wygląda to radykalnie sprzecznien z wszystkimi dobrej praktykami rozwijanej oprogramowania, myślę, że gdzieś tam na granicy prawa tutaj autor działa, jest to go open-clo, a czy tak naprawdę jest, no też wam zaraz o tym opowiem, jak jest tutaj ten największy problem dla wielu komentujących cały ten produkt, no tym problemem jest wipecoding, a moim zdaniem właściwie nie sam wipecoding, tylko takie pomieszanie pojęć właśnie z zakresu programowania z wykorzystaniem sztucznej inteligencji, bo tak się składa, że o tym kryzysie, o którym właśnie wspominałem wam właśnie na otwarcie tego, tego, tego modułu czy też tej części naszego odcinka, no to Pietrze Tejmbelger mówi wprost, ja mam po prostu było dość programowania, on po prostu nie widział w tym niczego angażującego, ekscytującego, on się narobił, zrobił produkty, zrobił kasę i tak naprawdę trudno mu do tej gry było wrócić tym, co obudziło w nim taką nową iskre, był właśnie potencjaższecznej inteligencji i agentów, których można wykorzystywać, do których można dalegować prace, co zostało sklejane z wipekodynieniem, sam pit tak dość, luźno nie jasno posługuje się tym inną czasami mówi, że stosuje właśnie ten wipekodyn, czasami mówi, że stosuje coś więcej, czasami wyjaśnia te swoje praktyki, to oczywiście gdzieś tam jest sklejane w taką jedną szarą masę, którą bardzo o co skrytykować i troszkę sobie to postaramy się rozpakować. No więc jak jest ten największy problem z tym, jak OpenClub powstaje, a no właśnie wipekodynk, czyli w aduku takiego pośredznego rozmowania, taka 4 etapowa procedura, gdzie piszemy prąpta, jako programyści, szczużna inteligencja, od, my ten kod, że samy na produkcję, potem się pali, no i tak naprawdę tracimy kase, idziemy do więzienia, albo zostajemy oskarżeni o jakieś przystę z twą gospodarczy. No tym jest w poszedłym rozmowaniu, rozmowaniu, przy rozumieniu ten wipekodynk. No i tutaj całe problemy polega na tym, że ten wipekodynk faktycznie pojawia się niebezpiecznie blisko OpenClub, sam pit, że ten Ambergro w takim artykuble shipping at inference speed wspomina, że dla niego to jest niesamowite, jak w Nowa wipekodynk się rozwinął. W ostatnim roku, czyli w 2025, bo o ile w okolicach maja, on był sam zaskoczony, kiedy niektóre prąpty generowały dziency kod out of the box, tak teraz jest to jego domyślne oczekiwanie. Tylko, że problem w tym, a właściwie senk, tym, że tak naprawdę naszym zdaniem, o kim moim Marcinie, czyli osób, które już też na tym programowaniu z AI zadły zęby, można powiedzieć, dostaję naprawdę ten pit, wipekodynk, nieuprawia, on robi co jest zdecydowanie bardziej zaawansowane, i to najgłego coś takiego, dlaczego my również zachęcamy, co rekomendujemy, czasami nazywa się to, agentic software engineering, assistant software development, różnie to, bywa. Zanim wam opowiem na czym to praktyka polega, to opowiedzmy jeszcze tak naprawdę z jakim bagażem doświadczeń, ten pit do całej tej gry programowania z AI wchodzi, bo to jest wydaje mi się całkiem istotne, chcemy sobie troszkę ten jego profil ocenić w skieku różnych perspektyw. I na końcu decydujemy, czy on ma mandat na to programowanie z wykorzystaniem szczęśc której inteligencji, czy wcale nie ma. I tutaj będziemy bazować na jego historiach z podcastu z Gurgelaim Oroszem, z podcastu Pragmatic Engineer, gdzie to właśnie pit był całkiem niedawno gościem i opowiada jak właśnie ta jego ścieżka rozwoju programisty wyglądała, więc to wcale nie jest tak, że to jest gość, który postanowił weźdę świata programowania właśnie wczoraj albo dwa miesiące temu, on programowanie w zafascynowaniu w wieku czterna stulat, kiedy to zrozumiał, że komputer są takie trochę bilatem do innego świata, on wychowywał się na fi w Austrii i zafascynował się tworzeniem produkcji w cyfrowych poprzez, tak naprawdę kradziesz gry ze swojej szkoły. Ta sytuacja wyglądała tak, że on sobie te gry pożyczył, miał sobie w nią grać, natomiast bardziej zafascynował go to, jak ta gra działa, co tam na tej dyskietce jest, do której on uzyskał dostęp, zrobił sobie taki reverse engineering, żeby zrozumieć, jak ta dyskietka tak naprawdę przekłada się na działającą grę, no i pit postanowił rozszerzyć gdzieś tam mechanizm i ładowania tej gry i wprowadzić tam mechanizm, zabezpieczające przed kopiowaniem. On też dzięki temu chciał po prostu zarobić troszkę pieniędzy na dyskrybucję tych gier, nie chciał, żeby to żyło swoim życiem i na czymś takim się skupił. No i właśnie ten reverse engineering był takim pierwszym etapem, w którym to główny bohater tej naszej historii zrozumiał, zwanie systemu, w takiej tinkering, grzebanie wewnętrznościach technologii, daje właśnie więcej frajdeniż konsumowanie takiej bezpośredniej rozrywki, jak np. gry komputerowe, to był taki pierwszy moment, w którym jaką sam mówi narodził się w nim taki właśnie bilder osoba, która przy pomocy tej technologii coś chciała robić, jeszcze raz podkreśle 14 lat. Takim kolejnym ważnym etapem w jego karierze, w jego ścieżce zawodowej, za wotrzej, była. był etap destyczący ekosystemu iOS. Pit swego czasu był bardzo zangażowanym użytkownikiem aplikacji rantkowych na wczesnych systemach Apple, iPhone OS 2 i 3. Tam problem wyglądał tak, że mieliśmy sobie internet, sobą jakość aplikacji, nie takie mocny hardware, po prostu wszystko działało tak sobie. I Pit w podkaście z oroszem wspomina, że po znego razu pisał długą i emocjonalną wiadomość właśnie w takiej aplikacji rantkowej. Wiechał do tunelu, działa skryb na stronie zablokował przycisk wyśl i a wiadomość przepadła. Tak naprawdę nie było tam żadnego kesza czy żadnego schowka, gdzie można byłoby to wiadomość przechować na później. I tak naprawdę pojawia się ogromna frustracja, nie dało się żaden sposób tego. Ozyskać wiadomo, że było też jeszcze połączone właśnie z całym motywami. Rantkowania, więc pewnie po drugiej stronie czekał ktoś, do kogo ta wiadomość powinna trafić. No i co zrobił nasz główny bohater? No nie napisał reklamacji do autorów tej aplikacji. Nie zmienił też systemu operacyjnego. On wrócił do domu ścierną Xcode i napisał własnego klienta iOS. Dlatego serwisu tak naprawdę postanowił zrobić lepiej to, szczerze korzystał, co go wkurzyło, co go zfrustrowało. I tam też wykonaw całkiem solidną porcję inżynierii oprogramowania, że to już zaangażowała się taką inżynierię oprogramowania. Po prostu wykonując brutalny skraping tego serwisu, z którego on korzystał porcowo surowe HTML, ze strony serwera za pomocą wyrażeni regularnych i w tym swoim klientie w tej dedykowanej aplikacji obsługiwał to wszystko zdecydowanie lepiej. Kosztofało go to 5 dolarów, wystawił to w sklepie, we wczesnej wersji App Store, co to jego aplikację zarbia 10 tysięcy dolarów w pierwszym miesiącu. Tutaj jeszcze pit opowiada, że kiedy jego dziadek, bo ta kątu dziadka została podane właśnie gdzieś tam na profilu developera, zobaczył przelew od aplenu taką kwotę, no to o małco zawał mnie, dostał pit, wspomina, żeby tej kas nie ruszać, bo to jest akurat przelew po prostu do niego. Więc kolejne takie ważne etap, wcześniej reverse engineering gear, gdzieś tam zabezpieczają przed kopiowaniem, teraz skrapowanie stron. No i taki filar kariery tak naprawdę produkt, na którym on zrobił największą kasę, czyli PS, BDF kit, rozwiązanie, które tak naprawdę stało się domyślną, biblioteką do parsowania, procesowania PDF-ów, w ekosystemie Apple. Tutaj pit był zaangażowany w pracę z językiem C++, jego rozwiązanie tak naprawdę dotarło praktycznie do wszystkich najważniejszych korporacji, do usług firm, tak jak Dropbox, IBM, Sub, or United Airlines. Tam mieliśmy dedykowany mechanizm do renderowania PDF-ów, benchmark-i, różnego rodzaju mechanizmy, które po prostu ten plik odpakowywały, pozwalały się nim posługiwać w swoich produktach. W 2021 roku cały ten produkt przycieniu inwestycje rzędu 100 mln euro, pit postanowił wyjść, sprzedać swoje udziały. I tak naprawdę tutaj pojawił się ten jego największy kryzys, który to został zaregenony poprzez wejście do świata programowania zresztuszną inteligencją i częściowo poprzez Wipecoating. Ale właśnie macie pytanie, czy to co robi pit, czy ten Berger, czy ten jego Streetcat, to jest naprawdę coś, co możemy z dyskredytować, czy jest tutaj coś, co może warto docenić i jak twoją zdaniem w ogóle można ocenić takiego gościa i taką historię rozwoju jako programista. Na co my zwracamy uwagę, a co jest też często pomijane właśnie w takiej dyskusji o historii tego szowieka, o którym dzisiaj mówimy. Ja do mnie słucham tej rozmowy Peter Zgerger, im w podkaście Plegmatic Engine, i kiedy usłyszałem właśnie tego backstory, kiedy w ogóle chciałem zrozumieć czym jest ten cały OpenClow, który waluje tyle zamieszania, a jak się jestem takim podkastorem gościem, więc sobie właśnie posłuchać twórców, jak jest tylko okazja, od posłuchałem i mówię, no kutsze ciekawa osoba, kiedyś tam nagrzewam popcorn i słucham dalej, bo na pewno czegoś ciekawego się dojął do osoby, która na latami optomalizowa koste plus pusie zbudowała tak dużą filmę, która rozumie w skalę niesamowitym poziomie, bo w końcu jego rozwiązania mówi się, że obecnie działają na miliardzie telefonów w różnych aplikacjach. No i które się domie wybiera programowanie zaję, jako dźwignie jest przekonany, że to jest właściwy sposób rozwijania produktów, czy to w 2005, czy w 2006 roku. No zupełnie szczerze, dość śpiesznie mi się czyta, jakiej jest zrozuty poza adresem jego właśnie zdolności, programieistycznych doświadczenia, o osób, no które mają znacznie mniejsze, gdzieś tam dokonania, czy to właśnie prognemistyczne, techniczne, czy też biznesowe, niż sam pijcer, no wydaje mi się, że skoro mamy taką osobę, no to warto byłoby posłasić jego perspektywą, oczywiście nie trzeba się z nią zgadać, ale jakiś szasunek respekt i poczucie, że to osoba ma prawo robić coś w inny sposób, ich chyba wie co robi, mając takie doświadczenie, no to moim zdaniem byłoby to podejściem rozsądnym i należy tym. Ja tak do tego potrzebłem, no i chłutczę dość wiele takich kontrowencyjnych, czy też odswierających może nowe, nowe klapki, nową perspektywę od pitera, w dalszej części tego podgastu usłyszałem, z tymi, nie do końca się zawsze zaszczadzam, ale no to jest to dowód na to, że można coś robić w sposób inny, i że to działa, również w tak dużym projekcie, jakim jest open-code. Co na przykład możemy filować od pitera? No, że nie robi on kordywu linia polini w swoim projekcie, mianowicie uważa, że bardzo duża część kodu, większości projektów sosuorowych, to jest ponad lat nudna hydraulika, która nie zasługuje specjalnie na uwagę, to w dzisiejszym czasach przy obecnych modelach, przy obecnych narzędzach, w tej chwili świecie działa i nie ma co się nad tym szczególnie pochywać, bo nawet jeżeli są tam jakieś downe problemy błędy, no to koszt ich naprawdę ulepszenia jest równy zero, zarówno pod kątem. Czasu, jak jest potrzebny, jak i samych wydatków, które musimy poniść, to oczywiście również poniosło szerokim echem, wiele osób podnosiło ono tutaj. Nie patrzeć słuszne, poniekąd uwagi, że, a co z bezpieczeństwem, a co z tymi wszystkimi, bagami, które się mogą przemknąć, no to jest po prostu inna perspektywa, kto ja coś w zasadzie, rozumiem korzystając do tego, żeby sko teksje zjelej, no który niesamowicie szybko jest stanie, de facto dolezować, debagować jakieś mniejsza problemy, które nawet kiedy przepuścimy coś na produkcję, nie będę z dokońca dokładnymi bardzo szybko jest stanie naprawić, jeżeli mu tylko informacje o tym będzie, dostarczymy tak więc wiele takich, no podejść, powiedzmy, ona podejść takie hattkorołe, czyli idziemy odełej i patrzymy, co się dzieje, on też prosto mówi o tym, co nie działa, co działa, z jakimi to się wiąże, kosek, fencjami, no ale coś nie pochodzi o tego tak zupełnie na imię, no po ma określonym pętle, jakby powiedzmy jakości, z wrazania tego, czy to co on obecnie wypuszcza, działa jak powinno, no czyli, to pracuję na podstawie tego głowania zadań, następnie samodzielnie mamy ten etap testowania, odpalania, siedra, odprawania szykiori, interów, budowania i dopiero kiedy to wszystko przejdzie, czyli mamy to powiedzmy o grin na tych wszystkich naszych uczułych kwaity gate-acht, no to ten kod uznajemy zagotowy do wypuszczenia na produkcję, ale bez jakiego jest awansowanego pipelineu, CI/CD, trzech po prostu środowisk testujących, no które wydają nam się zupełnie normą, jego zdanie mierze i to po prostu śmiga, no to znaczy, że śmiga, jedycimy, czy to oczywiście zawsze działa? Nie zawsze działa, ale jego zdanie na tyle szybko możemy potem wprładać pokrawki ulepszenia, że to jest podejście godinaw, bo to tempo, z naszy sposób gdzieś tam rekompensuje ewentualne ustępstwa na poziomie 100% jakości. To oczywiście pewnie nie sprawdziłoby się w systemie jakimś medycznym, bankowy, czy też zarządzającym samolotem, gdzie jak cię nam musimy mieć. 100% to mam pewność, że wszystko co działa, co wypuszczamy działa w każdym możliwym w warunkach zanim trafi na urządzenie, zanim trafi do klienta, no ale nie da się uktyć, że większość aplikacji wcale takich wymagań wysokich. Nie ma, no i OpenClown jest tego dobrym przykładem. Ja się z jakimiś wielkimi, znaczy w ogóle oni spotkałem się z jakimiś bagami i problemami korzystając z tego rozwiązania. Nie mówię, że wszystko zawsze od razu uśmigało, czasami musiałem jakieś komendy powtarzać, ale to było jednostkowe sytuacje i nie wiem, na irony były związane z samym kodem OpenClowna, a na ile z tym, że model gdzieś tam się lekko zamotał, bądź też mój prompt nie był szczególnie dokładny. Więc spółktu widzenia użytkownika to oprogramowanie działa na prawdę. Nieźle i sprawdzę się w tym, jakie powinny realizować gdzieś tam rezultaty, co powinno dowodzić, co chyba jest dobrym, dowodem na to, że to podejście. Pitera działa całkiem nieźle. No i też to sobie, Piter to jest takie kodowanie podagenta, przemek może wyjaśnić nad czym to tak naprawdę, i co to zmienia w tym całym procesie, które mogły się wydać chałotyczny i bardzo dwie bezpieczne, no chyba, że właśnie robiły coś między innymi. To. To jest takie kolejne etap ewolucji projektów programistycznych, które tym razem mają być już nie tylko możliwe do rozszerzenia i dyskolowania przez ludzi, ale zrozumiałe dla agentów, dla sztucznej inteligencji, więc takie modyfikacje, taki sposób rozwijany, jakiś struktur, takie prowadzenie plików w systemie czy poszczególnych połączeń, między różnymi tutaj składowymi, żeby ten agent po prostu w łatwe i optymalny kosztawa w sposób po prostu po tym projekcie się poruszał. I tutaj pijet wskazuje na kilka takich istotnych elementów, które bardzo szybko również poczujecie, jeśli właśnie zaczniecie korzystać z takich rozwiązania, jak opuszc 4, 6, 5, 5, 3 kdx, i też istotność tych elementów poczujecie. I więcej czasu po prostu będziecie będziecie spędzać w programowanie w takim stylu. I pierwsza taka rzecz, którą pijęc zwraca uwagę, to jest upraszczenie struktur. To jest coś takiego, z czym mogą mieć problem osoby, który przyzwyczaiły się do takich złożonych systemów Enterprise, gdzie tworzymy właśnie interfejsy, fabryki, różne wzorce, projektowe, łączymy 7-małapoziemowe, gdzieś tam konfiguracje, 15-apoziemowe moduły do feature flag. Pied mówi, że to jest po prostu konst produktywne. Jeśli pracujecie z agentami, i ten model ma czy agent ma problem z nawigacją, macie zbyt duże struktury, to po prostu refaktoryzujcie ten kout, upraszajcie, spłaszczajcie, redukujcie jakieś tutaj zbędne połączenia. Znadziają na to, że po prostu przyspieszenie, węcej produktywności przeszczeń na jakieś bardziej strategiczne zadania, przez to, że właśnie agent będzie w tym środowisku poruszał się lepiej, będzie się tam czuł bardziej komfortowo. I druga sprawa, to jest kontekst. Cały temat kontekst, engineeringu też utrzymywania dokumentacji w takim formacie, który jest po prostu łatwiej do interpretowania dla agentów. Tutaj Pietro wspomina o kilku plikach, chociaż my się to są przykłady bardziej liczy się taki koncept, czyli jakiś albo Sol MD, albo Identity MD. Ja osobiście też na przykład zacząłem rozwiać, jak kuk, bok, MD, czyli powiedzmy, taka książka z przepisami dla agenta, żeby szybko wiedział co w danym systemie się robi. Jakie sposób się to robi, na co zwraca ci uwagę? I w tym, w tych plikach, w takiej dokumentacji, po prostu opisy je moglobalne zasady projektu, możemy opisać struktury, możemy opisać konwencję, jakieś dobre praktyki, antywzorze, wszystko to, co agent przeczyta i przy każdym zadaniu weźmie pod uwagę, to również zapewni spójność tego, jak agent programuje, wprawędę tego, jak programuje reszta zespół. Z mojej perspektywy też to, co ja osobiście poczułem, co tutaj też mogę dokleść, to są właśnie wszystkiego rodzaje, prychikomfiguracyjne typu JSON-y, które się dobrze sprawdzały wcześniej, które tworzyliśmy sobie, żeby gdzieś tam różne przełączniki w systemie zmieniać flagi, ustawiać, żeby konfigurować teraz myślę, że trzeba to robić zupełnie inaczej, te konfiguracje można opisywać tak z tym naturalnym, może z poziomu Margdalna, czy też z poziomu jakichś takich instrukcji, które się po prostu ze sobą komponują. Im bardziej przywyczajemy się do tego, że to agent jest pełno prawnym tutaj członkiem zespół, tym lepiej to o programowanie AI będzie wyglądało i właśnie tak ten pit programuje, czyli tutaj zachęcam do tego, że to projekty transformować, tak jest wspomniałem, nie tylko pod kątem właśnie reguł biznesowych, jakiejś wartości, którą dowodziłem, już takiego skalowanie biznesowego, ale też tego, żeby agent po prostu potem wszystkim poruszał się sprawnie, przyjemnie i w optymalny sposób. Jak cały ten projekt finalnie, na czym ten projekt stanu, jaki był jego final, o tym wam zaraz opowiemy, natomiast chcemy jeszcze przejść do takiej ilustrzonej oddzielnej inicjatywy, która nam tak naprawdę mieszka i w taki drastyczny sposób zaburza całą tą percepcję, takie właśnie projektu, jak OpenClow, czy też obraz takich systemów nowej generacji, czyli właśnie o platformie "Moldbook" sobie porozmowałam, czyli takim portalu, który na bazie tego OpenClow zyskał popularność, z którego to korzystają już innebyty niż ludzie, którzy zwykle sportali społecznościowych korzystali. Więc czym ten "Moldbook" jest, macień czemu on właśnie skomplikował, co on te dyskusje o OpenClow i czy tutaj też być powiedem, że to wszystko działa i bagów nie widzisz? Pobietmy pierwszy o samym "Moldbook" który była dużo zamieszania i akurat w pełni zazumiałej krytyki. W momencie kiedy OpenClow nazwał się "Moldbot" przez chwilę, to powstała nam również inicjatywa "Moldbot", którą uruchął mi ułcokoł mi się niezależnie od pitera Szczejem Bergera, przedsiębiorca "Mat Shlift" jeżeli dobrze czytam jego nazwisko. No i to miała być platforma społecznościowa na kształt Facebooka, a czy to średlitat, gdzie cała aktywność z cyłżetkowicy mieli być właśnie agentami AI, korzystające przede wszystkim właśnie z "Moldbot" a wtedy, czyli obecnie OpenClow, bo to było najobszardzwiązanie, żeby tego typu agentów zdolnych do korzystania z tego serwisu stworzyć. A ludzie mieli tylko obserwować coś, agenti tam publikują, co komentują jak pogóły taka sztuczna inteligencja w dziczy sosial media, będzie się zachowywała. No i to był kolejny widać w ciągu 3 dni od startu, no już była wielka narracja o tym, że właśnie agentie, ja i tam robią nie stworzone rzeczy, wypisują również chresję różnego rodzaju, bez jakiejkolwiek ingencji ludzi i co tam się dzieje różne skliny z tego, z tego medium latały i woływały kontroversje oburzenie. No i miały być również informacja o tym, że ci agenti już tworzą własne paty, polityczne debatują na sensem istnienia i filozofią, bo otworzą jakich luchy artystyczne, no co da nie widać tak naprawdę, bardzo szerokim echem się to odbijało. No i kontrolem był taki, że modłuk jakoś obok projektem, który postał szybko, żeby tak naprawdę wybić się trochę na tym momencie, a tym ten dzieł wokół modłotał, po wokół OpenClote miał różne problemy w samej bezpieczeństwem o to, auto, nie zadbał jak wiele osób takich nie technicznych, które tworzą rzeczy w pośpiechu. No i mieliśmy tam kilka istotnych podatności, przez między innymi znanej lubiane wystawienie klucza API to SuperBeza w kodzie "Clying Site", mieliśmy również zreskonfigurowane rolę w sekuritii, w tym, że SuperBezie przez co mogliśmy czytać całą bazę mając ten, że klucz. No i to te dwa istotne podatności pozwalały na przejmowanie, kont pozostałych użytkowników na dostęp do szyky rodzaju. Wiadomości ptywatnych wyciekanie kluczy, potem za pomocą front injection, no bo takiego agenta. Czy to OpenClote? Tak naprawdę dowolnego, jeżeli mniej lub bardziej się znamy na rzecz, no to możemy wyciągnąć z niego te połówne dane i to nie tyle był problem samym OpenClote. Chociaż oczywiście jakiś turbo zabezpieczy nie ma, nie było wtedy już teraz jest na tym poziomie istotna poprawa, wtedy ich nie było, więc bardzo łatwo było taki klucz z tej konfiguracji wydobyć, jeżeli byliśmy w stanie z tym agentem bezpośrednio porozmawiać, a tutaj taka możliwość była na szeroką skalę. No więc tutaj ten cały eksperyment wyłożący kontrowencję, był jeszcze wyłożą konsowencję takie czysto techniczne, bezpieczeństwa i to wszystko zostało bardzo połączone zarówno z samym OpenClote, który jak mówię sam Peter Szczeńberger nie był zaangażowany w tym projekach, w jakichkolwiek sposób w nim nie uczestniczył, no i z samym programowaniem z AI no patrzcie po prostu podca lagenów i taka świetna w zetówka tego całego zagadnienia wipecoding-u, no to taka prawda szkolne błęderok, to jest faktycznie można przypadku wipecoding-u popełnić, ale wcale nie trzeba, no bo to są rzeczy, które można zabezpieczyć jednym promptem, jedną poprawkę, jeżeli znamy się jako wiek na tym programistycznym fachu, no to wiemy, żeby takie rzeczy zweryfikować i żeby po prostu to zabezpieczyć, zresztą w naszych kursach my również robimy w przykład, i zachęcamy do sprzmiau aplikacji, opadrzy o superface, i zaseć uwagi na wyciek kruszy w kodzie klienca, jeszcze toż właściwą konflikulację LLS, no to na to uwagi dla samym, utrzymy jak to robić i jak najbardziej bez wiekszych problemów można o to, o to zadbać również programując AI tylko trzeba po prostu jako wiek, to rozumieć i na to zdrucić uwagi. No ale ten właśnie modług, to całe kontrowersje, ten jego upadek, taką kompomitacja, no stała się trochę takim wodkiem ktenięgowym, motywem napędowym dla osób, które, no nie gdzieś tam nie podchodzą entuzja z tyśmi do samego tematu. AI 4 do samego projektu OpenClow ciężko było wytłumaczyć, że to projekty są tylko programowane z osobą na poziomie nazwy, że nic się tak naprawdę nie łączy, nic tak naprawdę wielkiego, to co się wydarzyło z modbókiem nieświadczy o samym OpenClow, o jego skuteczności, o tym jak to oprójoma jest rozwijane, jakie ma wady i zalety. No więc było to taki przypuszcz. władz trochę niewłaścowego powiązania dwóch zjawi z tudełączym przede wszystkim. No nazwa, jakieś tam koncepta tak naprawdę, chęść jednego wybicia się na drugim. Tak więc kurczę, no to było ciekawe, na to to się patrzyłem z taką, no to nie tak towałem w ogóle tego mód w ogóle, szczególnie na poważę, nie wiem, czy jak się temu przyglądać, to w ogóle jak kowik w tobie, zbudziło jakieś zainteresowanie, czy raczej też, no od razu podnosiłeś oko, jak wydaje mi się, że każda osoba. To jest zupełnie szczerze, no podnosiłem oko, gdzieś tam brew mi się akierowała ku górze, no to był zupełnie kontra, za tego jak odbieram OpenClow, czy właśnie Cloudbota. Dla mnie to był po prostu ciekawy i eksperyment, takie wyzwanie techniczne. Czasz warto powiedzieć, że sam OpenClow trafia pod skrzydła fundacji, Api, czyta inberg, w stanie się częścią OpenAI jako takie pozytywne domknięcie całej tej historii, co się nie wydarzyło w przypadku moldbuka, w przypadku moldbukara, czy mówimy o no taki stopniowej konsekwentnej degradacji tego, co się tam dzieje. Dla mnie z tej historii też potwierdza się tak jak eurystyka, którą ja od pełnego czasu stosuję, że jeśli w dyskusji, jak gdzieś produkcie, jakiejś usódze AI pojawia się koncept właśnie, tożsamości, czy jakiegoś takiego wirtolnego bitu, który działa w sposób autonomiczny i tutaj przyjmuje władzę nad światem, to dla mnie to już śmierdzi na kilometr, i staty niestety na kolejne razy się to potwierdziło, bo tak jak mówię OpenClow, ja może nie skoczyłem jakoś bardzo wcześniej na cały ten hype-train, wręcz tymi tutaj opowiadałeś jak to wszystko wygląda, ale tak jak mówię, zrobię sobie background check autora, bo obserwowałem co co się dzieje w społeczności, mówię, ok, kolejna iteracja autodzipiti, ten temat się pojawia, nie jest to zupełnie nowa rzecz. Jeśli tym razem zadziała to spoko, natomiast moldbuk religia, gdzieś tam spiskowanie przez agentów, to naprawdę było dla mnie mocno podejrzane, no i okazało się, że dzisiaj to jest raczej takie jesie disco różnych kryptoskamów osób, które chcą zarobić właśnie na całej tej fali popularności takiego ruchu agentowego, na zdecydowanie nie jest to coś, co chciałbym, żeby tutaj wracało, może tak się zdarzy, że będzie to wracać w kolejnych odcinkach tego podcastu, ale raczej nie chciałbym, żeby to wracało w takim pozytywnym kontekście raczej jako taka nauczka. Tutaj też nie sądyną muszę przytoczyć jedną z takich wypowiedzi profesora Pietra Sankowskiego, który ostatnio wrzucił taki wpisk komentujący czas działania klawt opusa. Tutaj organizacja metr ostatnio opublikowa wyniki badania tego konkretnego modelu, okazało się, że ten opus tam działa przez 14 godzin, my też ostatnio mówiliśmy w odcinku jak to jest tym z tym metrem i z tymczasem działania modeli. Wiecie, że my tak sobie patrzymy na całe to przedsięwzięcie. Natomiast tutaj profesor Piotsk w Sankowski zaczyna swój wpisk od takiego, takiego fragmentu, ok, myślę, że opentał mnie demon. Takie słowa powiedział model clot opus 4-6, nie raz, więc odpowiedział na proste pytania. No ja wzdycham, jak widzę, jak widzę na co ludzie to jest wracają uwagę, jeśli właśnie w całej tej dyskusji o meczu, o długości działania modeli, o jakichś takim możliwościach technicznych najbardziej istotnym fragmentem, z dużym modelu pisze, że opentał go demon i to trafi na pierwsze strony gazet, faktu super ekspresułów tygodników powszechny, bo to musi trafić. To trochę ręce opadają w daj mi się. Naprawdę, no, kurczę nie na te, nie na te aspekty tych historyj powinniśmy zwracać uwagę, jak chcemy to żyć, no poważną debatę o sztucznej inteligencji, jakby agenci nie zakładają swoich tutaj zborów, nie rozwijają religii, można wyłączyć w tyczkę, tak jak Marcin powiedział, jest tam gdzieś token do open-rotera, który ma kredyty, 5 dolarów, 10 dolarów, to się może gdzieś tam wyczyścić i kurczę tyle, w oku tego jest tyle takiej generacji, która jest po prostu dla mnie zaskakująca, nie? Ona płynie od takich osób, które wydaje mi się, no nie powinny się już na te różne bajty łapać, że troszkę ręce opadają. Tutaj pojawił się taki bardzo fajny mem pod tym, wpisałem gdzie to właśnie użytkownik mówi do komputera, powiedzę, że żyje, model mówi, żyje, a użytkownik mówi, o mój Boże. No ja sobie myślę, że kurczę no taka jest to właśnie dyskusja o tych wszystkich w módłbukach i agentach, nie? No szkoda, szkoda, open-club będę śledził, mam nadzieję, że tutaj pitrzcień Berger gdzieś tam, na zaznaczy swama obecność w OpenAI, natomiast wszystkie takie właśnie kolektywne działania agentów wydaje mi się, że jeszcze na tym etapie nie jesteśmy. Niestety właśnie to jest często pierwsza strona gazet w tej dyskusji i chciałem tu skrytykować mówiąc o tym, to macie, bo myślę, że zmiesiąc, a na miesiąc to się jednak nie zmienia w przestrzeni publicznej, a chyba czas, żeby się zmieniło. Tak to widzę. No i samowite jest to, jak często jest przywoływane, adgument iść lm, to są tylko krzywitywacze w kolejnej stokanów, stora z tyszczą papugi, podczas gdy kiedy ta papuga stora z tyszczą, a powiedz, cokolwiek kontroferycyjnego to już słucham, "Ło, obój Boże, co to napukali w przeladchodzi, nie? To jest to jest niesawowite. Ja tutaj daję miło wszystko, to w Stanowiu Sankowskiej, u jakiś cynt załofania, bo już to polepiścerać po prostu w serka z tyszczyny, nie wiem, w sensie, to chciałbym wiesz, że to, że tak jest i na to gdzieś tam liczekom, nie daje to zaufania, no to osobie, która poznała, podała dalej, no z kamewski twójc tak naprawdę, który był zobiony typowo pod zasięgi, zresztą jest to nie pierwsza działalność tego typu, tejże osoby, o co chodzi. No wyrós tutaj, całkowicie niezgodny, sprawdzią, no i ktoś niezgodny z tym, co wam opoiedzieliśmy, o raz pitera, jakoby on był jakiś piwniczakiem, który właśnie zastrawał akwizycji Open Go przez Open, ja odniósł pierwszy sukces i żąd stworzył 43 projekty, które odniósły podaszkę i w to z jego pierwsza sukces, i dlatego warto cisną i coś zwróć. - To jest to, że jak jest nią ruchą, zjro to chido. - To chido. I w ogóle chodź ci na siłkę, nie umiejajcie wtedy i głów i wtedy warto się mu dać 40 projekty. No i to się pojawią gdzieś tam, to był taki viral, która czołgnąży się na exie. No oczywiście jeden z moich ulubieńców w polskiej sferze AI, członek, angłączy kart, którzy już słuchaczy tego w podcastu dobrze, to przeznają. Czyli doszcia spowiem pierwszy raz wprost ujawnij pierwszego członka Wojtek Karteś. No tak więc pan Wojtek Karteś na swoim Twitterze postanowił przetłumaczyć dokładnie tego Twitter na język Polski, podać go dalej. No bo, oczywiście pan mnie trzeba jak nie opracować. - Zawsiadnę na historia, na prawe. - No tu jak widzicie aż ciężko nam nagrać tę fragment, bo to jest prostwo tak śmieszne i super jeszcze, że żałosne podawanie no tak prostopoknęconych historii, żeby tylko zbić engagement jako żelaty profilu te tego pana się to średnio dziewczyrazę w tygodniu. No to na to tutaj jakby już podnoszę, ale żeby uważać tego typu publikację, no Peter Szczejbergę nie jest znanym, gdzieś tam nie znanym wipekoderełk od justwy pierwsze sukces. Piesiąteł się skaszował na dziewięćmi euro w Eurow i jest wymiatający, programista, który też szczyli jeszcze projekty do to dla fanu sobie zrealizował jako site project dla swoim gitapie i nigdy nie mówił, że to miałem być jako wiek projekty biznesowe. Pod tym niestety dość dużo osób w podwyciło to po tej publikacji, kiedyś ja osoby, które do gdzieś tam szanuje, nawet coś po prostu czasem jest dawać sprawę, że jeżeli co w publikujemy mają zasięgi, no to jest za tym jakaś odpowiedzialność, dlatego my dla was te podkasy przygotowujemy raz miesiącu, żeby mieć czas się do nich merytorycznie przygotować i to się nie robimy tego dla zasięgu, dla reakcji, tylko dla dzielenia się wiedzą, no i zdajemy sobie z całej rzutą. Do ceniacie, więc tutaj taki "colout" tutaj jakby już nie mam większych wątpliwości, czemu i w jaki sposób było to zdobione podajek mówię, to nie był jakiś tam pierwszy, błąd, tylko no to jest stały format w działalności tylko pana. Ja tego osobiście po prostu nie pochwara. Dobra, przejdźmy teraz z to tematu drugiego, jaki jest takie trochę prowokacyjne pytanie z naszej strony. No wciąż mamy już to słynne "EGI" w naszej ulubionej domenie, czyli "Toglamowaniu zajej", no i przemku o co to je chodzi, skąd w ogóle taki pomysł skąd takie pytanie. Tak naprawdę, to jest temat, który naturalny sposób wywodzi się z tej historii OpenClow, Modbota czy Cloudbota w zasadzie jest gdzieś tam upostaw tego, jak ta syagięci powstają, jak oni działają, bo kurczę okazję się, że w tym 2026 roku całkiem sporo przy pomóc tego "A.M.a, można zrobić i całkiem szybko i to że uproszczenie z mojej strony okazję się, że w kontekście programowania szczyszna inteligencja to nie jest już auto kompletna. Stary, tak? Nie, się nie. Dobra, słuchajcie tutaj, mała przerwa w montażę z naszej strony, musieliśmy się opanować po tym poprzednim fragmentie, bo to była zbyt mocna dyskusja, która również nas też gdzieś tam powaliła, spadliśmy z krzeseł, ale już wracamy do gry i zastanawiam się, czy ta "A.G.I" w programowaniu już to faktycznie jest. Okazję się, że metody czy też narzędzie w sprząci do wytwarzania takich rozwiązaniach OpenClow, o którym przez chwilą mówiliśmy, no tak naprawdę przyspieszają ich rozwój, przyspieszają ich potencjał rośnie i dzisiaj w kontekście programowania "A.G.I" to już jest znacznie więcej niż tylko auto kompletna starydach. I oczywiście pojawiają się pytania co dalej, co przed nami, jak to wszystko może wpłynąć na przyszłość branży. Tutaj takimi dwoma głównym triggerami, które spowodowały gdzieś tam taką dyskusję, czy tam roznieciły taką dyskusję, by właśnie model GP-typięć 3 kodex i opus 4-6. w połączeniu. ze środowiskami uruchominiowymi, z tak zwanymi agent harness, z takimi uprężami na modale. Co całościowo stało się, można powiedzieć, no już takim konstruktorem systemu, czy też prośródła się na postaniu takich konstruktorów systemów napędzanych sztuszną inteligencym. No i oczywiście to rodzi kolejne pytania, kim jest programista, czym programista ma się zajmować, jaka jest odpowiedzialność programisty, jak wygląda proces wytwarzania o programowania i czy faktycznie to AGI już tutaj jest, czy można ten program, który widzimy zaledwie czyś do właśnie takich kategorii. I co to właściwie oznacza, kiedy oddamy coraz więcej odpowiedzialności za produkty cyfrowa wręca agentów. Chcemy się nad tym, zastanowić, chcemy wam opowiedzieć również o naszych przemyśleniach w takim obszarze. I to, czego zaczniemy, to jest taki Apple oto, że my jako branża musimy po prostu przedefiniować proces jej praktyki, do których bardzo mocno się przyzwyczaliśmy, które są dla nas standardem. Musimy podważyć ten status kwo, który istnieje, gdzie na konfach, metapach i konferencjach po prostu napamięć tak naprawdę, krepiemy historię o tym, na czym ta nasza branża polega, opowiadamy rodzicom kuzyną, wujką, czym się zajmuje programista. W tak naprawdę jest taki mocny etabredefinicy wielu pojęć, z którymi się spotykaliśmy w ostatnich latach. Jednym z takich pojęć, czy z takich praktych procesów, na którym trzeba się zastanowić na nowo jest całe SDLC, czyli software development lifecycle. W tym klasycznym modelu mieliśmy taką bardzo dużą obszarną rozległą PENTLE, często sekwencyjną. Mieliśmy z wymagania, mieliśmy jakieś projektowanie, jakieś road mapping, project management, postawały gdzieś tam kod, testowaliśmy poszczególne milestone, było review, wdrożenie może utrzymanie tej produkcji. No tylko problem w tym, że to jakby nie przystaje, to tego jak dzisiaj się programuje z agentami. Ten model sekwencyjny, takie bardzo mocno rozorząne w czasie, nie jest tym, co tak naprawdę jest kompatybilny z takim workflow, agentowym, zresztą też dlatego, taki duży re-design.xd30, o czym mogłeście w innych miejscach posłuchać, to był właśnie taki trigger, dlatego żebyśmy przebudowali całe to szkolenie. Cała taka koncepcja właśnie przekazywania zadań, między analitykami, deva, mi, QA, mi spotkania, whiteboard i tak dalej i tak dalej, są elementem o dużej wartości, ale właśnie ta forma, czy też ten format w tych wszystkich celebracji, tych wszystkich obrządków, które tutaj w programowaniu uprawialiśmy, stoi pod dużym znakiem zapytania. Z tego powodu, że poprosył ta cała pętla, do tworzenia programowania się po prostu zacieśnia i wydaje się, że pojawia się takie nowe wysoko-poziomowe kroki, które są napędzane przez agentów i takim pierwszym krokiem, jest taka szeroko rozumena intencja. Coś chcemy zbudować, coś chcemy powołać, dużycia mamy jakiś pomysł, na coś chcemy, coś stworzyć, wrzucić, gdzieś, itd. itd. Natomiast, no nie możemy spędzać, tygodni na zastanowienie się, jak to wszystko będzie działać. W zasadzie możemy to robić, ale wydaje się, że konkurencja będzie działać inaczej, taka konkurencja, która bardzo mocno zaszczyszczonał inteligencją, się ją zintegruje. Dlaczego? No bo oni bardzo szybko przejdą do właśnie kolejnego cyklu, czyli do budowania testów i wdrożenia tego rozwiązania, nad którym będziemy i terować zdecydowanie częściej i genściej niż wcześniej. I będziemy też w pewnym sensie na żywym organizmie, przy pomocy praktyk jakościowych, obserwować jak ten nasz pomysł, jak ta nasza intencja sprawdza się w praktyce. Można powiedzieć, że to jest taki edzial na starydach, albo taki edzial, który w końcu działa, gdzie tak naprawdę przyspieszamy, stosujemy z winne iteracje, ale tak naprawdę ten czas wytwarzania, programowania, skraca się tak bardzo, że trudno tutaj mówić jakiś tygodniowy, tak naprawdę sprint, tak żeby jeden fikiel na produkcję wydać. I też też tak sobie pojawia się takie pytanie, jeśli chodzi o właśnie produkowanie z wykorzystania szczyszczona inteligencji, co robić do dokumentacją, jak zarządzać dokumentację. To jest kolejne takie duże wyzwanie tego programowania agentowego, z tego powodu, że wiele dokumentów, które były dla nas standardem, które były statyczne zamrożone, po prostu upędniamy. One muszą być żywe, muszą ewolułować w czasie, musimy się zwyczaić do tego, że te dokumenty, tak naprawdę, są tylko jakimiś z naprzotami, które będą aktualizowane z biegiem czasu. I ten kontekst, który mamy, musi maksymalnie blisko odpowiadać tej intencji, którą mamy z tyłu głowy, to będzie przekazywane do agentów, agenci na podstawie teokonce, to będą dla nas budować rozwiązane. Kolejnym znakiem zapytania, kolejnym dużym wyzwaniem jest proces code review. Jeśli mamy 500, pół rikostów dziennie, wszyscy przyspieszyli, wszyscy programy z wykorzystaniem agentów, no to właśnie, co z tym wszystkim zrobić? Tak jak masz, czyń opowiadał i Pitch, ten burger opowiadali, no czy chcemy do każdego pół rikostu siadać i ocenia, co zrobili agenci, czy naprawdę każdanie nikakody jest tak samo ważna, no wydaje się, że tutaj również mamy sporo do zrobienia. To się nie zmienia, wydaje się, że monitoring techniki obserwowania produkcji, wszystkie te gaity jakościowe, tak naprawdę postukroć, ważniejszy stają się w tym kontekście, o którym rozmawiamy, szybkie wykrywanie anomali, unikanie regresji i też to właśnie pętle, zwrotne dzięki którym agenci automatycznie naprawiają to, co zepsuli. To są te wszystkie wyzwania, które obserwujemy na skutek właśnie nowej generacji rozwiązań. I do tego wszystko musimy się przyzwyczaić, rozpoczynać tej naproety duża debatach, chyba wszyscy w środowisku programowania, czy jemy, jak tak naprawdę to branży zdefiniować, jak zbudować te procesy, i jakimi narzędziami się posługiwać, bo to też wcale oczywistanie jest. I tutaj też chcemy opowiedzieć o tym, jak ten nasz uorklą wygląda, bo takie ciężkie środowiska graficzne, no nie są już naszym defaultem, co? Dokładnie tak, no można powiedzieć, że linia poleceniu terminal przyżywają swój denę sons, mieliśmy no lata, w których ID-i stabały się coraz potężniejsze. No, oczywistym było to, że ktoś z jakiegoś ID korzysta, czy było to pytanie, że ten instytut wizuala studioko, to takie najpopularniejsze dwa ID-iS, na obecnie coraz więcej tebeloperów, którzy aktywnie korzystają ze AI w daca do terminala. No bo tam mamy tak naprawdę największe możliwości, najprotężniejsze rozwiązania, o czym zresztą opowiem powołując się jako ktetne dane w dalszej części tego odcinka. No nawet ludzie mówią, że już nie potrzebują tak naprawdę ID-i, wystarczy im Neo, WIM z funkcją do difowania, a także po prostu szybko przegodnać zmiany agenta. Ja zupełnie szczerze również, no obecnie z ancygrablitiej, czy też kursora korzystał głównie jako z przegodarki do kodu z ładnym interfejsem. I to jest większość tego do czego mi te rozwiązania, służą, nie wiem czy to uzasadnia, wydawanie pieniędzy na ich suskrypcję, która cały czas ponosza pewnie już coraz bardziej nie. A no większość magii można powiedzieć, dzieje się właśnie w terminalu, czy to zaspawą kaldkoda, czy kodek z CLI. Mamy takie sełowite możliwości już tych modeli, tak duży brotwod, z takło znamy ojów z odców, no że ten kald po prostu powstaje, on działa, oczywiście trzeba go przejrzeć, zwłaszcza kiedy robimy coś innowacyjnego, kuczowego, kiedy też piszelmy testy i tak dalej, i tak dalej, bo są te kuczowe cały czas obszarasz jego systemu, ale ja rzeczywiście, ja nie mam potrzebny, nieźlam pracę już w łatwo, czy na trzy co sam, ja mu sobie wydarazłem i wydarazowałem w poprzednich edycjach tenek z deszcz, przeglądają na beżąco każdej linii, którą tworzy agent, jeszcze kodygowajego, no często to jużła poczuć, to agent Boże skonygować mnie, kiedy no w kilka minut robi rzeczy, które ja w swojej pracy robiłem, tygodniami w pocieczoła, nie do końca będąc za doporony, wspinany faktów, no bo miałem zwykle za mało czasu, no, słyszało się tak często, z 17-a u czas słyszy, że pisanie kodą nigdy nie było botelne kiel, no to ja osobiście bacowe winnych filmach, bo pamiętam, że zwykle ciało się 30, skołbro 30% i waliło się nad godziny, żeby dowieść po prostu tak naprawdę, no, w jaksięści posego, co wiedzieliśmy, że biznesce i czego użytkownik potrzebuje i potem potrzebowaliśmy dalej, trzywych kwartałów rata, żeby zrobić to, co tam było, to sobie ja biznesowo w jeden w teamach naprawdę dobrych choregstów, którzy staje świadaczy, no ale, że kogo pisanie kodą nigdy botelne kiel, nie było, no ja jakby miałem troszeczkę, inne doświadczenia, teraz już na pewno nie jest, bo ten kod powstaje bardzo szybko, jest wysoki jakości i po prostu działa, tak więc przejdźmy moru do tego, co to się stało, co to się dzieje, że ten kod nagle z takiego, nie najwyższej jakości, no bo to, że jak to się zarzutuje zresztą roku, że że ten troszeczą w pierwszych powierz, że ten kod już taki dobne jaję rzuczają, tak jak pamięć, że jak tylko jest trudniej, to się to wszystko rozsypuje, faktu się tak było, należy, jeżeli gdzieś tam korzystaliśmy z tych najlepszy w tuli w ostatnie 2,3 miesiące, o to już wiemy, że tak nie jest, i z czego to przełkowelika, co tam się fajnego w tym obszarze dzieje. No mamy tutaj takie dwie ważne składowe, które tak naprawdę zaczęło się uzupełniać, w taki sposób, którego wcześniej brakowało. Jeśli korzystaliście z "Czata GPT" od samego początku zaraz po premierze, czy korzystaliście z wszystkich wersji kopalotami, jeśli kontakt z modelami językowymi, no co tak naprawdę wchodziście w interakcje z pewnego rodzaju mózgiem systemu, z jakąś taką jednostką, rozumującą jeszcze bardzo proste postawy sposób, albo właśnie uzupełniającą poszczególne fragmenty kodu, która robiła swoją robotę, natomiast miałam praktycznie żaden kontakt ze światem rzeczywistym, była bardzo niedeterministyczna, nieprzewidewalna, były trudno kontrolować. I nie ma co tutaj oszukiwać, była takim łatwym, łatwym celem wielu krytyków, czy też zceptyków całego tego, całej tej aktywności programowania z wykorzystaniem szczusznej inteligencji. Natomiast w Zastwience 126 roku ten mózg zostaje obudowany ciałem, jakąś taką uprzężą albo agent harnessem, czyli takim zestawem narzędzi, mechanizmów dodatkowych algorytmów czy jakiejś statycznej logich i które po prostu sprawiają, że to wszystko zaczyna działać i warto wiedzieć, z jakich składowych tak naprawdę to wszystko się składa troszkę masło maślenezd, to by z jakich składowych to wszystko budujemy, żeby już tak naprawdę nie przechodzić do tej łatwiej krytyki LLM-u, jako tych właśnie stocha sycznych papug, których Marciom powiedział, jako tych systemów, nie dla terministycznych, trudnych do przewidywania, no bo dzisiaj już rozumiem, że LLM wszystkie go dla nas nie może robić, a bo właściwie nie powinniś moczekiwać, że LLM będzie dla nas wszystko robię. To jest jakiś zamknięty z biur danych treningowych, jakiś wzorców, który tak naprawdę z tej bazowej formieniem, a kontaktu ze światem rzeczywistym. Do tego potrzebujemy narzędzia, narzędzia terminala, narzędzia, jakiegoś wywoływania zewnętrznych api, przeglądarki, narzędzi, które działają w sposób statyczny, przewidywalny, powtarzalny, które to model wykorzystuje, model może się nimi posługiwać, tak jak musk jest tutaj operatorem różnych składowych naszego ciała. I to jest właśnie ten brakujący element, czyli właśnie ten agent halny z cały to ciało opakujący model, które dla nas, czy też dla osób, które spędziły w tym świecie progromwalny, zresztuszczą inteligencem jest już czymś naturalnym. Natomiast do osób, które dalej patrzą na to wszystko, jak właśnie na aktywność uzupełnienia kolejnych linii kodu, jest czymś nieoczywistem w ogóle nie zrozumiałem. W jaki sposób LLM czy AI może działać w sposób przewidywalny, gdzie tutaj ten determinizm po co mi wywołowanie terminala przez model, skoro ja sobie mogę tutaj jakieś komendy wprost wpisać. Więc dzisiaj musimy zrozumieć, że ten rozwój agent halny posunosie prawie tak daleko, prawie tak bardzo do przodu, jak właśnie rozwój samych modeli. I dzisiaj jest to z perspektywem firm tworzących te rozwiązania. Tak samo istotne element całej tej układankich, jak modela, które wcześniej były tak naprawdę w samym sercu tej edytucji o programowaniu z wykorzystaniem szczusznej inteligencji. Więc pogłębmy macie jeszcze temat całego tego agent halny tutaj upręży. O co tutaj chodzi, co to właściwie daje tym firmom, które skupiają się na rozwoju tego typu rozwiązań, czy mystego korzystamy, kto z tego korzysta, jak to właściwie zrozumieć. To jest to zrozumieć, że rozwijanie modeli jest bardzo trudne, obecnie wymaga ogromnych okładów, nakładów kapitału, energii, czasu i te zyski, które otrzymujemy, no już nie są zakażone takim ponującą z optawda, te miedli takich modeli, jak opuszczer i pół, 4-4-CPT Codex, 5-2, no to były imponujące modela. Widzieliśmy zauważalnym. W ogóle jest tak naprawdę niezależnie od tego, gdzie ten model uruchomiliśmy. Ale wiele innych iteracji modeli, no często nie wnoszą tak wiele. To jest po prostu kilka procent lepszej skuteszności w jakichś tam poprostów wybranych zastosowaniach. Więc można spokojnie powiedzieć, że te modele są jakiś sposób takim dowarem komoditii. No to już jest nic nadrzeczajnego, no może raz do roku mamy jakąś taką imponującą premierę, która faktycznie pcha rynek do przodu. Na rzecz tym, że te hardesy, te narzędzia to obudowały wokół modelu, no to jest przestrzeń, gdzie znacznie szybciej, znacznie niższym nakładem, tak naprawdę kapitału zasobów, bo możemy czynić istotne różice w tym, jaki osiągamy efekty, więc się mówisz, że ten hardness to właśnie jest mod. To jest coś, co wyróżnia firmy. To dało się tak naprawdę odczuść, po raz pierwszy już za sprawą kursora, pod koniec 2020 roku, który był taki pierwszy naprawdę wnoszącym jakościową, zmianę hardnessem, bo to jak rozwisał pojedynczatę, gdzie PTI-wittapko-pajnotem, nie była jakoś imponująca w tamtych czasach, to w kursorze faktycznie czuliśmy, że nie by ten sam model, a jednak coś tam innego jest na odpłucie. Oczywiście było osoby, które tytuły, że nie, no oczywiście co za różnica, a to na jakoś, czy pięć dolarów w drożej, te same modeler są dostępne, ale kto trochę więcej czasu w tym wszystkim spędzał, testował to sposób. Bardzo aktywy o to jednak tą różnicę czuł. Ale wtedy to jeszcze takie było powiedzmy nagdanicy, powiedzmy subiektywnego odczucia, a twardych faktów do teasteru, że już są tak istotne, że widzimy, no po prostu zauważalny przesk, chociażby pomiędzy CloudCode, Codex, CLI, a czy wspomnianym Gitratko-Pajotem, nawet jeżeli wepniemy tam ten sam topowy model, no to to, co jesteśmy w stanie zrobić w Kopajrocia, w sensie, w sensie, w sensie w stanie w CloudCode, to jest po prostu niesamowita różnica, właśnie na pewno wszystkich narzędzi i tego całego powiedzmy, exoszkiretu, jaki model dostaje do dyspozycji dzięki czułer, czemu zyskuje spraw, coś możliwość, dużo lepszego zarządzania, kontekstem, gerowania modułów i tworzenia takich rozwiązań, tu end włącznie z testowaniem ich poprzez właśnie samolęcznie uruchomiony sever dywery o penski, wykonanie jakichś akcji, na tym co sobie odworzył, mamy tam po prostu ogrom możliwości, to rzecz naprawdę wygląda jak taki zwlawczy autonomistcy, byt, który nie tylko generuje jakiś tam kolik, w jakimś tam wybranem TIKU, tylko wykonuje pracę end tu end, a my jako programiści, no tą pracą, nadzorujemy, sterujemy, ale nie jesteśmy gdzieś tam aktywnym tak naprawdę członkiem tego całego procesu, wytwarzania tego kodu, tak to przynajmniej wygląda w mojej codziennej pracy. No i mamy tutaj tak naprawdę dwa modele i dwa harnessy zresztą, które są absolutnej topce, które są obecnie rywalizują, no i które tak naprawdę zdobyły serca wielu programistów, coraz więcej osób przekonują pogorę do tej praktyki programowania z AI. No i to her gdzieś tam odbierają wiele argumentów, co to jakości, co do zdolności tego AI w zakresie programowania. I cóż to są przęku za modelę, cóż to są zacharnesy, jakie mamy dane, które potwierdzają skuteczność, tych rozwiązań wokreślonych zadania. No przede wszystkim myśmy tutaj o dwóch rozwiązaniach, czyli Cloud Opus 4.6, ten największy model od firmy Anthropic, model o największym potencjale, którego filozofia można powiedzieć, jest taka długo dystansowa praca w tle. Dzisiaj już opus ma okno kontekstowe jednego biliona aktywnych tokenów, generuje odbud do 128 tysięcy tokenów. I jednym z takich ostatnich fikzerów, które zwróciły naszą uwagę, jest "feature agent team", czyli orkiestracji agentów, takich instancji opusach, które działają sobie, czasami równolegle, a czasami ramię w ramie, nad jakimś bardziej zorzonym problemem. Ten agent harness może sobie właśnie spełnować, pochwywać do życia kolejne instancje. Można powiedzieć tego samego narzędzia, jest to całkiem ciekawa historia, które to działa sobie właśnie na swoim oknie kontekstowym, na swoich niezależnych listach zadania i może nam pomóc w realizacji takich przekroowych, bardziej entrenowych problemów. Mamy również dzip.t5.3.c od OpenAI, gdzie z kolei społeczność docenia taką brutalną siłę i sterowalność. Jedną z takich ciekawych nowości, która się pojawiła w przypadku drzip.t5.3.c, jest właśnie tak zwany Meet Execution Styrability, czyli moment, kiedy model wchodzi sobie do trybu. Rizonowanie jest taki moment, gdzie może mówstrzyknąć zatkowe instrukcje, nie musimy czekać na sam koniec z długiego złożonego zadania. Co oczywiście pozwala wbacić taki atomowy, precyzyjny sposób sterować tym rozwiązaniem. Tutaj również OpenAI chwali się tym, że ten Harnest to opakowanie modeli, czy też tego konkretnego modelu, skutkuje redukcją tokenów, aż o 50% mniej ich jest zużywane na podobnego rodzaju zadania, jak w przypadku rozwiązań poprzednich generacji, idzie się to aż 40% szybciej, niż w przypadku poprzedników. To są takie dwa standardowe rozwiązania, które dla nas są takimi rozwiązaniami już tak naprawdę nowej generacji. Tutaj wspólnie z Marcinem testujemy i opusa i GPT-5 3-Kodex. No i tak naprawdę jest kosmiczna różnica, jeśli chodzi o budowanie softwareu, budowanie aplikacji produktów cyfrowych właśnie jest wykorzystaniem tych rozwiązań, w porównaniu do tego, jak to wygląda. Albo modeli otwartech, albo rozwiązań konkurencyjnych. Też mamy swój własny benchmark, który to potwierdził, właśnie wam jeszcze o tym zaraz opowiemy. Natomiast tutaj, powawamy się na jeszcze jeden branżowy benchmark, benchmark SW i EGI, gdzie autorzy również postanowili sprawdzić, czy faktycznie to Next Generation Experience jest odczuwalne, czy faktycznie jest tak, że to rozwiązania, o których mówimy, działają inaczej lepiej niż rozwiązania alternatywne. Jak ten benchmark SW i EGI działa, nie jest to na pewno generowanie kodu, nie jest to uzupełnienie istniejącą kodu, nie jest to sprawdzanie plików tekstowych. Jest to taka pełno prawna praca na jakieś piaskownicy, na jakimś sandboksie. A więc ma chłodny start, taki cold start, dostaję plik task MD, i musi sobie od zaraz budować jakieś systemy, jakieś złożone rozwiązania z wszystkimi elementami, które są do tego potrzebne, czy to posukiewanie się systemem plików, interpretowanie polecań, pobieranie tych informacji z różnych miejsc, to wszystko musi się składać na niejedną całość. Tutaj wykorzystywany jest też Antichit. Mianowicie mamy tutaj język Moonbit, który ma sprawić, że model nie będzie recytował kodu podóż pamięci w przypadku tych najbardziej moich. z streamowych rozwiązań, więc taki kolejny poziom trudności sprawdzamy, czy to rozumowanie, które odbywa się po stronie modelu, czy po stronie tego agenta, z którym działamy. Faktycznie doprowadza do celu, czy jest tylko powtarzanie jakieś wzorców, które potencjalnie model widział na etapie procesu treningowego. No i jak tutaj w tym SW i AGI wypadają te nasze rozwiązania, o których wspominaliśmy, mamy tak naprawdę tutaj dominacje, prawdziwą dominacje, DZPT-5-3, to jest rozwiązanie, które zdało 19 z 22 zadań, 5 na 8 na poziomie heart, czyli na poziomie tym najtrudniejszym, kosztowało to 213 dolarów i zajęło to temu agenta wiej około 24 godzin. Opóz był na miejscu drugim, rozwiązanie z 22 zadań, natomiast kosztował praktycznie 10 razy więcej, 155 dolarów i aż 76 godzin. Mamy też alternatywy z Chin, DLM 476 na 22 zadań załączny koszt 486 dolarów, co pokazuje, że pojmote grze jest to bardzo ekonomicznie opłacalne, to osiąganie tych samych rezultatów, no tutaj jest jeszcze poza zasięgiem tych modeli otwartych. Mamy też inne benchmarki, jak na przykład terminal bench, gdzie DZPT-5-3-77, 3.0, on wygra was opusem, 65, 4.0. I mamy wiele dyskusji, debat o tym, jak właśnie mają się zmieniać narzędzia, napędzane sztuczno inteligencie, chociażby Ampcode stwierdził, że no taka dostawka w formie pluginu do editorów, gdzie tam czatujemy sobie CIA, to już naprawdę nie jest, nie jest ta rzeczywistość, którą oni ścili by widzieć w swoim produkcie. Czasem muszę być sprawcze, muszę mieć dostęp, muszę mieć narzędzia, właśnie w tą stronę będą się orientować, więc mamy dane, mamy statystyki, mamy liczby, co to wszystko nam daje, jak takie przeciętne programy staram, może z tego skorzystać, dlaczego warto gdzieś tam testować tego typu rozwiązania, Marcin? Która można przede wszystkim ja bym zachęcoł od rozwijania jakichś projektów na użytek własny, na użytek naszych bliższej, bo też na użytek naszego zespołu. Często mamy wiele pomysłów na automatyzację, na wewnętrzna aplikację serwisy i to jest świetna okazja, żeby korzystać właśnie z potencjału AI tam się tego nauczyć, tego zresztą utrzymy do tego zachęcamy w pierwszej części kutsu Tenex.pl. To jest to świetna okazja, żeby właśnie poczuć jak szybko i jak skutecznie możemy oprogramowanie rozwijać. I też musimy zrozumieć jak istotny, w tym wszystkim jestem co coś planowania, czyli tworzenia, jak wizji tego, co ma dostać zbudowane, tak żeby AI zrozumiał nasze intencje i mu kto po prostu wszystko zamienić na kot. Uknok w tej retyptacji jest taki, że dokonujemy wspólnie zagętem, tworzymy jakoś pierwszą iterację tego planu. To jest to oczywiście dwa możliwe strane usze, agent plan. W trażach robi to skutecznie, wysił za dowoleni, a potem mogą być szekiwana od zarówno feria, bo na przykład takie, że ten plan okazuje się niejdaalny, bo np. czegoś nie obsługuje i dopiero po wykonaniu tejże placy zauważamy tym problem. Ale wtedy mamy magiczną technologię pod nazwą kontroleraresji, możemy wycofać te zmiany, zmodyfikować plan i poprość ageta, żeby dalej to rozwijał. Mądź też w miarę tego jak to powstaje, możemy coraz bardziej rozumieć co taka bardzo chciałbym zbudować. I bardzo szybko iterować, czy to ulepszary z plan, czy też już na bazie tego planu po prostu dalej idą z doprzodu od skojennej, iteracje w niesapowitym tempie. No i to daje takiego poczucie niesamowitec w trawczości, tempa, które kiedyś były niedostępne. I mając już takie doświadczenie, takie wyczucie tego jak z tym modem, z tym chatnesem, pracować, możemy potem skutecznie przychodzić do większych projektów do projektów komedcyjnych, bo tak naprawdę to nie skala jest tutaj samego projektu kuczowym, gdzieś tam czynnikie wpływający dla skuteczność AI. Rzeczy są oczywiście dwie, no w pierwszą umiejętności, operatora to jest istotne i nasze doświadczenie, jeśli odomość tego jak w ogóle jest wydarzenie pracować przed tym nie uciekniemy, tak samo jak musimy się nauczyć samego programowania, tak programowania z AI również trzeba się nauczyć, to tylko pozodnie jest łatwe, ale prac w nostę skali i zorzyności projektu coraz więcej musi być tych umiejętności wiedzy i doświadczenia posiadać. Na poddukie to z cała strukturą projektu, o czym spójaliśmy już w przestwieży, w farzie tego podcastu, czyli no na ile właśnie sama strukturą poddukowania, z krok tu, która pomaga w mojście przeszkadza agentowi, często jest tak, że strukturę w projektach starych i dużych jest słaba idoniczego i to głównie sprawia, że agentom ciężko się tam pracować, ale również możemy wykonać piec kroki defaktoryzacji pod agenta, czyli przygotować ten modlut, tą te fragment systemu, na który chce je pracować pod to, żeby agent się po nim poruszał sprawnie, a dopiero potem przejść do samej pracy nad bagiem wficzerem, które tam chcemy gdzieś tam dodać, jak ktoś w ogóle powiedzieć, no ale to jest dodatkowa placę, o tak, to jest dodatkowa placę, która zajmie Ci tyle samo czasu, co napisanie kilku linie kodu manualnie, tak szybko i tak sprawnie, a satysfakcja z tego na aktyngot się defaktoryzuje, poprawia, no jest niesamowita, no i też pamiętajmy o tym, że kiedyś projektu defaktoryzacyjne, to my projektu, które nie wydarzało się nigdy, a teraz to są projekty, które zajmują 10 minut i naprawdę robią wrażenie, więc nie musimy spędzić trzech miesięcy, roznęsowując na omeru idealną strukturę projektu i przewidlijąc wszystko, bo nawet jeżeli nam się lekko, noga, architektolicznie powinnie, to możemy sobie to mnogę bardzo szybko gdzieś tam doprowadzić do pełni zdowia kilkoma sesjami, z właśnie tymi narzędziami, więc to też jakby zmienia to chodynamikę tego, ile nasz kosztują te błędy, kiedyś błędy, te którzy to były tak naprawdę błędy na lata, teraz to są błędy na minutę, więc też pamiętajmy o tym, oczywiście dobralki te która cały czas ma znaczenie, ale możemy ją wprowadzić nie tylko od na początku projektu z pomocą konsultantów, możemy też to robić samodziewnie w sposób. I te racje, jakie są tu przełuku, mimo wszystko w tej całej zabadwie, kutcze, zagdożenia, czy tu widzisz w ogóle coś, co, co może mi wszystko nie działać, czy masz tutaj coś do dania. No wraz z tym, jak te modely stają się coraz lepsze i agentii chcą działać coraz dużej, no to oczywiście coraz większą, coraz większą zagadką staje się taka aktywność programy z tywoku tego wszystkiego, co dzieje się w naszym terminal, albo w edytorze pojawia się takie zagrożenie luki poznawczej, tego, że po prostu ta nasza percepcja, gdzieś tam interpretacja tej pracy, czy tych efektów pracy, agenta po prostu nie przestaje do tego w jakim tempie ta technologia się rozwija. Czasz częściej pojawia się takie stwierdzenie, że to my jako ludzie stajemy się wąskim gardłem w całej tej układance programowania z wykorzystania szczusznej inteligencji, a te systemy rosną w takim tempie, które jest po prostu wyzwanie dla wielu najbardziej doświadczonych programistów, tutaj też muszę was odeswać do bardzo ciekowego filmu Marcina, z naszego kanału, przeprogramwani, który pokazuję, jak te samo szczęszne inteligencje można wykorzystać na dwa sposoby, po pierwsze właśnie, żeby gdzieś tam tracić różnego rodzaju wiedza i kompetencja, a z drugiej strony, żeby się rozwijać, żeby korzystać z tych narzędzi w taki sposób, żeby jednak te lukie poznawszzą w jakiś sposób adresować, żeby po prostu integrować ze technikami, przys fajnie wiedzę, zapamiętywalnie pojęć, czy też budowania swojej głowie, jakiś modely mentalnych, które będą po prostu bardziej korzystną. No w kontekście programowania to jest niesamowicie istotne, bo sporo tej roboty programisty dzieje się jednak w głowie, w takiej warstwie, która nie jest pisana, która nie zawsze gdzieś tam opiera się o specyfikację, czasami mamy jakieś intuicy, czujemy jak system działa, potrafimy o nim opowiedzieć. No teraz to wszystko gdzieś tam jest zaburzane, bo może być zaburzane po prostu, czysto jak agenci działają, nie mówiąc już o agentach, którzy działają w sposób równaleguje, w taki sposób, gdzie na kilku branczach albo na kilku gtwork, trysach, kilku agentów w tym naszym projekcie działa. To jest ogromne wyzwanie, my chcemy to wyzwanie zaadresować w tenek z desach, też będziemy się wspólnie zastanawiać, jak to wyzwanie tej luky poznawczy, gdzieś tam adresować w taki sposób, żeby dalej był fan z programowania, bo przyznam, że mamy mnóstwo fanu z tego, jak się programuje z wykorzystaniem takich narzędzie, ale wiemy, że dla sporej części naszego komunitii to jest duże znak zapytania, duże wyzwanie. To jest to, co ja naprawdę mam robić, w momencie kiedy agent działa, czy ja się mam zajęć, przystaje kontrolować rozwój tego systemu, chcemy wam o tym w przyszłości mówić. No na pewno też tutaj pojawia się kolejne zagrożenie dotyczące samego bezpieczeństwa, my coraz częściej kierujemy się do takiego trybu działania agenta, który po prostu jest pozbawiony jakiś tam ograniczeń, agent nas nie pyta w każdym kroku o pozwolenie działamy w takim jolomout albo groźnie skipujemy permiszony, mówiąc takim pongliżem, dężyrysyski permission, taka flaga Scraut Code, tutaj oczywiście pojawia się zagrożenie tego, że kiedy taki agent działa właśnie w sposób autonomiczny, może posługiwać się narzędziami, może korzystać z różnych danych, gdzie my nie zawsze zerkamy wcześniej, to może się pojawiać jakaś po prostu wadliwa porcja informacji albo taka ryzykowana porcja informacji, która zostanie zinterpretowana przez agenta, a ten agent np. coś na naszym file systemie wykonat, takie ryzyko prompt injection, co oczywiście też będziemy próbować adresować natomiast bez sztywnych polityk, bo właśnie takie pętli jakościowej tutaj piszymy się na kolejny wektor, a nie, ataku, gdzie to agend jest manipulowane i może wykonywać jakieś destrukcyjne operacje w naszym środowisku. I też oczywiście będziemy się zastanawiać, czy to już AGI czy to nie AGI. Oczywiście im mocniej rośnie poziom trudności tych zadań. Tak wymaga do szego planowania, te bardziej spada w kuteczności GPD 5, 3 i opusa. Natomiast z naszej perspektywy, z mojej perspektywy jest sporo takich zadań w takiej codziennej pracy programisty, gdzie tak naprawdę tego już nie odczujemy i trzeba się zastanawiać po prostu co z tym wszystkim po prostu zrobić. To znaczy gdzie tych agentów przykładać, gdzie ten AGI się wspomagać, gdzie cały czas te wasze twarde skile te kompetencje programy z tym musicie rozwijają, do czego one się przydają. To tutaj może z mojej strony powiem, że też próbowałem takiego SWI, EGI, odzorować też na grę o tym firmamy projekt, który nazywa się TenX Bench, jest część naszego ekosystemu TenX Devs. I toż taki dowód na to, że staramy się poważnie i mówić o całym tym świecie programowania z AI niż przeciętna, nie wystarczono WIP-Coding. Ja właśnie właśnie w tym kontekście postanowiłem wydać na świat, nasz otwarte benchmark. I tam przyznam szczerze te dwa rozwiązania, których mówimy, no zostałem mocno zaskoczony tym, jak daleko posunęło się działanie modeli i agentów w kontekście budowania aplikacji webowych, to działanie Bench Marko TenX Bench wygląda dość podobnie z tych założeń SWI Bench, czyli mamy jakiegoś prąpta początkowego, jakieś polecenie, jakieś task MD można powiedzieć, a akurat skupiam się na tym, żeby model zbudował stronę w Astra, w rejakcie i w tej lindzie, żeby przy okazji pobrał informacje kontekstowe o projekcie przeprogramowani, bo to ma być stronę naszej marki z sieci, żeby unikał hallucynacji, żeby tam dodał sekcję, podkastował sekcję YouTube, YouTube'ową informację naszych kursach, żeby wydał na świat fajny UI, żeby to wszystko było responsywne, żeby było tam seona odpowiednim poziomie. No i muszę przyznać, że są zeskoczone tym, jak działają najlepsze modeli i też jaka jest różnica, pomiędzy tym i najlepszy niepodelamy, czyli opusem i GPT-5-3 Codex, a resztą tej stawki, tym i modelami otwartymi tym, co dzieje się w OpenCode. Na prawdę wydaje mi się, że jeśli ktoś jest na tym etapie, że to wszystko to jest tam ściała, można na to machnąć z ręką, to naprawdę zachęcałbym do tego, żeby wbić sobie do kalenderza taki godziny myślę blog testowania, tych rodziny znań, o których mówimy, odpali sobie na szkod tanex bencha albo jakieś zadanie takie entłemdowe, budowanie jakiejś stroną, albo jakieś funkcjonalności w systemie, żeby przekonać się, że tak naprawdę warto zrewidować te swoje przekonania, i że naprawdę w ostatnich dwóch kwartałach wydarzyło się coś istotnego. Ja też widzę taką tendencję do ciągu tego, też pewnie to widzisz, martli do takiego ciągu tego przesuwania tego goal postu, że ta poprzeczka jeszcze kiedyś była na takim poziomie, że to w ogóle nie zadziała, potem była na poziomie, że to zadziała, ale nic jakościowego z tego nie dostaniesz. Teraz już jest na etapie, że nic co zbuduje, że tak naprawdę nie przyniesie zysków, więc tak naprawdę przesuwamy się z etapu działania do gdzieś tam wartości takiej w świecie, w świecie rzeczywistem. Zakładam, że to nie dotyczy strik te umiejętności czysto technicznych, ale jest związane niewiąstwo. Miegłością jako przedsiębiorca jako biznesmen, ale to właśnie też pokazuje, jak bardzo zmieniła się użyteczność tych rozwiązań, do czego one są wykorzystywane. Jeśli w 24, byśmy powiedzieli, że ok, zbudujesz, cokolwiek, nie wiadomo, czy na tym zarobierz, to byśmy powiedzieli, kuszcze, no spoko, to mi ogólnie wystarczy i ogólnie jestem w ogóle w szoku, że to jest na takim poziomie. Dzisiaj mówimy, dobra tam, nie ważne, to dalej są bajki i gdzieś tam farm z miątpli. My próbuję wam powiedzieć, że tak nie jest, zachęcam was do tego, żeby po prostu testować te najlepsze narzędzia. I podkreślamy, że ten gap jest po prostu gap po między jednym, dwoma, trzeba ma rozwiązania mi na rynku, a tym co znaliście z naszych poprzednich odcinków, chociażby z 2025 roku, więc. Więc temat jest twart waszej uwagi, waszego zainteresowania i czasu. Dokładnie tak, jeżeli szukajcie takie, najbardziej ekonomiczne opcji, żeby doświadczyć tego, o czym mówimy, no to to jest Codex CLI, który stąd najtajszą subskrypcją, czyta GPD 3GPD Plus za dwadzieścia do ulców, daje naprawdę niesamowite limity, nieprównybalne z tym, co ofraguje CloudCode. No i tam właśnie macie wjazd o tego modelu GPD-djęć Codex, macie wjazd o samego Tura CLI, i możecie zobaczyć, jak to programowanie właśnie z terminala wygląda. No to model jest niesamowity, może sam UX tego CLI nie jest jeszcze takim ponującej w przypadku CloudCode, ale to spędnie jak w feste czasu, jeżeli chodzi o taką czystą programistyczną siłę, no to tam na pewno i doświadczycie za dwadzieścia do ulców i może sobie naprawdę fajnie pokodzić na przestrzeni tygodnia i zrobić ciekawe rzeczy, które zapewniam was, nie zrobili byście szybciej manualnie, bo to też kiedyś był częsty. Tak, 100% argument. To już jakby naprawdę. Potem pokazać tego. Ej, ja, ja. Pocajam, mam się dwie przecież, poro szybciej napiszę to z palca. Dokładnie, tak, no to to już jest dawno. Nie prawda, w sum oczywiście to wszystkie wyzwanie na poziomie SDL-C, w tych spójnaliśmy, kodywiu, testowanie, i tak dalej i tak dalej. My oczywiście te tematy dla was będziemy rozkliniali w TNX.Z. 3.0 to oczywiście są realne wyzwania, bo musimy ten proces odytworzenia o programowania. To stosować na to, żeby się przystotować do tego, jak wyglądało programowanie, kiedyś z językami gdzieś tam obiektowymi, no to spędziliśmy kilka dobrych dekacji jako, jako całą branżę. No tutaj tak naprawdę mamy dopiero pierwszy rok na liczniku, kiedy jakaś większa niż barodzić, tak, tu je to na poważnie i w ogóle te problemy się w organizacjach pojawiają, więc pewnie ten manifest Edge-I-R przyszły, który nam to wszystko ułoży, zacznie układać, dopiero jeszcze jest przed nami, a już nie mówiąc o tym, jak cała branżę nie się dosyłowywała. Więc to są realne wyzwania, z którymi sobie można podalić. I zamiast się skupiać na tym, że jest wyzwanie. Wyzwania o głównie są zawsze jakieś innowacje, to się pojawiają wyzwania na poziomie jej wdrożenia, to jest naturalny cykstładzenia technologii, ale zamiast mówić o jest wyzwanie, to jednak tego nie róbmy, to jeszcze nigdy w historie się nie zdarziło, puszka pandoda się odtworzyła, a w tomie tęło już dał ogielin, no to teraz po prostu nauczymy się nieparrzeć z tym ogniskiem, bo ogól nie da się, a fajnie się jest to mięso, jak jest ciepłe, ugotowane, a nie sudowe, no mimożo tam tas, pewnie po prostu to recharzymy, z tych osób z tego, oczywiście wyniknie, ale to jest okazja, a nie powód, żeby mówić, nie, nie, nie zajmujemy się tym tak szaniem, na to patrzymy, tak do tego podchodzimy i do tego was będziemy zachęcali. Po wolii kończę z tym podcast, mamy też taką jedną sekcję, w której nasu dodaliśmy, żeby, bo często gdzieś tam ta dyskusja w oku AI, no niż na znacznym podkaście, gdzie często, coś krytykujemy, gdzie często mówimy, gdzie działa, gdzie są właśnie jakieś wyzwania, niebezpieczeństwa, na przykład po poprzedni, po odcineku, toś mocno w takich nutach, gdzie mówiliśmy o "Chadzipiti Health", mimo że niektórzy nie światowej, no przepisali w żachkowiek tutaj więcej, chwali nie się w tym projekt. No to chcieliśmy z swojej konsekcje, gdzie mówimy o czym jest fajny w tym AI i co jest niespilujące i zachęcające do tego, czego eksponowania, dobudowania was, bo wiązaj do testowania, mamy taką pewne dwa tutaj dwie nominacje za ten zatem luty, obydwie, tak naprawdę, odejemnie tutaj w decyzje, że ich będą jakieś zastrzeżenia, to to, proszę do mnie, chociaż myślę, że przemek się pod nimi podpiszę. No przede wszystkim, pietrz tej "Bajograd" i "Oben-Klow", naprawdę fajny projekt, inspirujący, imponujący, zarówno od strony Inżyniecki, jak i od strony biznesowej, myślę, że wiele gdzieś tam był się tu, postało z miąsku z tym i jakiś tam postudziłnych postów, ale też na pewno powstało wiele ciekawych integracji i może ktoś, co teraz ma 16 lat, tworzy własną wersję i za dekadę, po prostu będzie jakimiś legendarnym i będzie w podkrastach opowiadał, że właśnie zaczął swoją przygodę poprzesłuchaniu podkrastu z pittem i po zainstalowaniu na swoim pierwszym VPS-ie właśnie "Oben-Klow", a myślę, że takich historii będą tysiące na to gdzieś tam postawiłem zakład, tak naprawdę w duchu, w duchu tego wydaje mi się, że to jest projekt wysocy, inspirujący jest to wysocy, inspirująca osoba i to gdzieś tam będę zawsze wspierał. A to w tym takim ciekawym projektem moim zdaniem, ja przy nim nie nie byłem bezczesnieńmniego zaangażowany, żeby przemek od początku do końca to postaniu, czyli ten ekspęcz, klopka ej, czyli ten nasz benchmark właśnie samodzielnej pracy, modely nad stroną przeprogramowanych, coś fajnego, coś co te realnie testuje, możliwości tych modeli, pokazuje różnicę pomiędzy modelami, jak i hardnessami, tak więc no coś mega praktycznego, pokazującego, gdzie te modele się różnymi, gdzie są podobne, a w czym nie, więc coś takiego fajnego od nas w lutym 2006 roku. Tak, to ja z mojej spręską, podziękuję za tą wed docenienie tego projektu, natomiast też powiem, że ogólnie jako duet, mamy masę zajawy z tego co robimy, mamy dużo naprawdę takich projektu wewnętrznych, które się nie powią, gdzieś tam na naszych profilach społecznościowych, gdzie na co dzień korzystamy z tych rozwiązań, no i muszę was zapłynąć, że naprawdę mamy sporo zajawy w tym wszystkim, ale to nie jest tak, że jako programy ścieżięciu, 12 lat, tym doświadczeniem, mamy takie poczucie, że kursze to AI odwale za nas robota, jest to nieprzewidywalne, jest to męczące, jest to drogie, to zupełnie tak nie wygląda, i chcemy was do tego przekonywać, jeśli szczególnie macie taką rzeczę, Żyłkę bielderów, budowniczych w sobie, jeśli zawsze mieście w głowie jakieś inicjatywy, na które nie było czasu przestrzeni albo też zespału, bo często dużo projekty wymagały tego, żeby w 3-4 osoby coś gryści a takować jakieś samad, to właśnie teraz jest czas takich osób, teraz jest czas na to, żeby po prostu korzystać z tych najlepszych modeli, trochę na czarpność ten budżet w tych wysokich wynajgrodzeni, pensji programistycznych wykorzystać to do tego, żeby walić na fajne subskrypcje takiej komfortowe, które pozwoliłem wam pracować z wykorzystania szczęszne inteligencje. I po prostu to potestawać, ja tylko na koniec apelował o to, żeby wyrabiać sobie własne zdanie. Niekoniecznie nawet bazując na tym co my mówimy, ale też nie bazując na tym co my osepsis czy też krytycy, żeby naprawdę zainstalować kodexa albo opusa w jakiejś formie, żeby sobie pobrać te CLIe i coś zbudować. Na tej podstawie zobaczycie ile w tym fanu możecie mieć i odnaleźć jako programistziej, bo my zupełnie nie podpiesujemy się pod jakimś takim dewycystycznym tutaj spojrzeniem, to wszystko, że nie wiem, programowanie się kończy, bo AI odwale za nas roboty, totalnie po prostu tak nie wygląda. Powadzaj, depreduje się zaczyna. Przynajmniej gdzieś tam dla mnie, a tak na taka jakość, jako człowiek, który zawsze miał dużo pomysłów i niespecjalnie czas i też chęci na tą żmudną roboty, jak ta część z to było wświebiązała z dużą ilością. Zatań, to teraz właśnie właśnie czuję, że mogę budować z naszym więcej, z nasz szybciej i też dzięki temu przyjemie nam się pracuje nad newseterami, pod kastami, bo również mamy we wnętrzną apkę, która nam w tym pomaga, którą chciałeś budować o jakieś pięć lat, która wreszczy jest i rozbijamy i są kolejne pomysły i wiem, przez kwestia kilku godzin, a nie po prostu dwóch tygodni, które nigdy nie mam na to, żeby zbudować jakiegoś bieda pocak, które byłby dalek i daleki, od tego co zrobiliśmy w kilka wieczorów właśnie z opusem i z kotexem. Dobra, kończąc bo to jest jeden z dłuższych odcinków, miałby się jeden z krótszych, bęk, no to zachęcamy was do tego, żeby nam zostawić ocenę pięć na pięć, lajka, mądź też podjęje się z tym podcastem, jeżeli ten odcinek przypad wam do gustu, będziemy za to bardzo wcięczni i dziękujemy wszystkim, którzy ten podcast wspierają, bardzo nam z tego tytułu. Miło raz jeszcze zachęcamy, to zapisania się na newseter opalny.ai. Newseter, co poniedziałek, żeby se dysleksynowane newsy, też informacją naszych nowych odcinkach na YouTube, webinarach, ta będzie ich kilka przed statem Tenex DS3018 maja, jeżeli chcesz opanować nasz sposób platy z AI, znacie na rzeczy i naprawdę no właśnie realizować projekt, na które nigdy nie było czasu albo robić to wreszcie w pełnym skopie, z pełną jakością i faktycznie tb. Tytutę, a nie tylko czytać o tych książkach, a potem być w skrajnie inne rzeczywistości, generalnie to wszystko nie ma czasu, no to zachęcamy, żeby do tego kursu dołączyć, powreszcie są czasy, gdzie może być fajny soft, na dużej skali z dbałością, o jakość z dbałością o UX, ja je na to pozwala tylko trzeba wiedzieć jak z tego AI świadomie korzystać, tak więc zapraszamy, zachęcamy i do zobaczenia w kolejnym odcinku, Dostępny, tak.

Podcast Summary

Key Points:

  1. OpenClow (dawniej Cloudbot/Moldbot) to autonomiczny agent AI działający 24/7, z pełnym dostępem do terminala i systemu operacyjnego, zdolny do end-to-end wykonywania zadań, w przeciwieństwie do pasywnego ChatGPT.
  2. Projekt wzbudził ogromne zainteresowanie (rekordowe 220 tys. gwiazdek na GitHub) i kontrowersje, stając się viralowym hitem, ale też napotkał problemy prawne (rebranding, zarzuty naruszenia znaku towarowego) oraz krytykę dotyczącą bezpieczeństwa i dezinformacji.
  3. Rozmowa dotyczy również szerszego wpływu zaawansowanych modeli AI (jak GPT-4o i Claude 3.5) na programowanie, podnosząc pytania o przyszłość zawodu programisty i to, czy obecne rozwiązania przybliżają nas do AGI (sztucznej inteligencji ogólnej).
  4. Prezentowana jest nowa inicjatywa edukacyjna – intensywny kurs "AI Native Software Engineering" (TenXDevs), mający na celu nauczenie świadomego wykorzystania agentów AI w procesie programowania.

Summary:

Transkrypcja jest zapisem odcinka podcastu "Opany AGI", podsumowującego kluczowe wydarzenia z lutego 2026 roku w świecie sztucznej inteligencji. Głównymi tematami są dwie "burze": wokół agenta AI o nazwie OpenClow (znanego też jako Cloudbot) oraz dyskusja na temat postępu w kierunku AGI w kontekście programowania.

OpenClow przedstawiony jest jako przełomowy, autonomiczny i sprawczy agent, który aktywnie wykonuje zadania end-to-end, korzystając z dostępu do systemu operacyjnego i integracji z komunikatorami. Jego gwałtowny wzrost popularności (rekord na GitHub) szedł w parze z kontrowersjami, w tym rebrandingiem, zarzutami prawnymi i krytyką dotyczącą bezpieczeństwa oraz dezinformacji (powiązany portal "Moldbuk" okazał się nie w pełni wirtualny).

Druga część dyskusji dotyczy wpływu najnowszych modeli językowych (jak GPT-4o i Claude 3.5) na zawód programisty. Prowadzący zastanawiają się, czy te narzędzia, umożliwiające nowy, agentowy workflow, oznaczają nadejście AGI w programowaniu. Podkreślają przy tym własne doświadczenia z nową generacją rozwiązań i zachęcają do aktualizacji przyzwyczajeń.

Podcast promuje także nową inicjatywę edukacyjną – kurs "AI Native Software Engineering" (TenXDevs), który ma nauczyć świadomego wykorzystania agentów AI w procesie tworzenia oprogramowania, oraz zachęca do śledzenia kanałów prowadzących.

FAQs

OpenClow to aktywny, autonomiczny agent AI działający 24/7, który ma pełny dostęp do terminala i systemu operacyjnego, wykonując zadania end-to-end. W przeciwieństwie do pasywnego ChatGPT, który czeka na interakcje, OpenClow jest sprawczy i działa proaktywnie, integrując się z komunikatorami jak WhatsApp czy Slack.

OpenClow składa się z modelu językowego, Gateway do komunikacji z usługami zewnętrznymi, pętli React (Reason-Act) do planowania i wykonywania zadań, ekosystemu wtyczek (skills) oraz SoulMD – dokumentu definiującego tożsamość i zachowanie agenta, dostosowanego do użytkownika.

SoulMD to dokument określający 'duszę' agenta, czyli jego tożsamość, preferencje i sposób interakcji. Agent przeprowadza wywiad z użytkownikiem, aby dostosować SoulMD, co pozwala na personalizację zachowania i pamięć długoterminową w formie plików MD.

Projekt wzbudził kontrowersje związane z rebrandingiem (z Cloudbot/Moldbot), zarzutami naruszenia znaku towarowego, oraz wątpliwościami co do bezpieczeństwa i rzeczywistej autonomii. Mimo to, zdobył ogromną popularność, osiągając ponad 220 tysięcy gwiazdek na GitHub w krótkim czasie.

OpenClow i podobne zaawansowane modele (jak GPT-4.6) rewidują tezy o AGI, oferując agentyczne środowiska wykonujące kompleksowe zadania. Jednak czy to już AGI, pozostaje dyskusyjne – to raczej krok ku większej autonomii, a nie pełna sztuczna inteligencja ogólna.

Społeczność zareagowała entuzjastycznie, z rekordowym wzrostem na GitHub (ponad 220 tysięcy gwiazdek), aktywnością na Discordzie (20 tysięcy członków) i szerokim omówieniem w mediach. Projekt chwalono za innowacyjność, choć pojawiły się też głosy sceptyczne co do jego implikacji.

Chat with AI

Loading...

Pro features

Go deeper with this episode

Unlock creator-grade tools that turn any transcript into show notes and subtitle files.