Hejto.pl
Dodaj post

Wpisz coś do wyszukania (minimum 2 znaki)

#programowanie

Gruba ryba

w Hydepark

25piorunów

Kluczowe wnioski z mojej agenturalnej pracy z AI, którymi chce się podzielić.

Na początek, ostatnio wszedł nowy Opus 4.7, co zaóważyłem -> potrafi ciągnąć długie wątki zadaniowe, nie rozprasza się. Jest bardzo dokładny i wielokrotnie waliduje i porpawia sam siebie. Co ciekawe to jest out of box -> po prostu go uruchamiam i bez żadnych reguł on po prostu tak działa. Oczywiście dodatkowe rules, zawsze spoko.

I teraz uwaga, każdy model różni się od poprzednich. Różnice są znaczące. Jedne modele będą podejmowały inne decyzje ale każdy z nich dostarczy zupełnie inny output. Co za tym idzie nigdy nie wiemy jak nowy model poradzi sobie z danym zadaniem i nigdy nie będziemy mieli 100% pewności czy wykona zadanie czy nie.

Ich zachowanie jest w pełni niedeterministyczne, przypomina brainstorming w działaniu. ALe narzucenie jażma determinizmu, zdecydowanie poprawia wyniki pracy. Po zamknięciu schematu w workflow, wymuszeniu semi-deterministycznego podejścia do zagandienia znacząco poprawia wyniki pracy. Po takim zabiegu zadania wykonywane przez system agenturalny są dużo bardziej powtarzalne, a wyniki bardziej spójne. To jest props.

Są problemy -> największym problemem we współpracy z agentami(akurat bardzo podobnie jak z prawdziwymi ludźmi) jest ustalenie zakresu wymagań i potrzeb. Często jest tak że te 3 czynniki -> to czego oczekuje operator systemu AI, to co agent wykona, i to co rzeczywiście jest potrzebne i wystarczające mocno się rozjeżdża. ALe takie jest rzycie(doceńcie błędy ortograficzne, dzisiaj to oznaka autentycności, róbcie błedy, lpieje się to czyta niż slopy AI xD)

I kolejny problem to problem walidacji. Przy pierwszym podejściu, modele agenturalne raczej domyślają się że coś działa niż faktycznie to walidują. Owszem, widzę, zmienia się to w mocniejszych modelach. Stopniowo są one coraz bardziej srkupulatne w walidacji i sprawdzaniu wyników swojej pracy, ale ten wątek jest w powijakach. Często dostaniemy w wyniku piękną i spójna architektórę, ale w naszej aplikacji zabraknie przycisku ACCEPT na końcu i okno się nie zamknie.

Rola architekta AI na dziś to:

* Ustalanie wymagań i potrzeb

* Ustalanie workflow pracy dla agenta

* Dobór skills oraz rules do pracy nad projektem

* Ewentualny wybór technologii

* Wysoka świadomość systemowa(Warto w początkowych wymaganiach umieć określić zestaw narzędzi, infrastruktuwy czy ogólnego podejścia, i tutaj jest moment w którym większość Juniorów czy nawet midów odpada, nie wiedzą co można zrobić i nawet nie mają pojęcia czy można to zrobić, a to wymaga lat doświadczenia, może dekad...)

* Korekcja błędnych kieruków pracy AI - warto patrzeć na logi co robi żeby go klepnąć w kark i kazać wrócić na dobre tory

* Najważniejsze - finalne testowanie i sprawdzenie wyników pracy, żaden AI tego nie zrobi

* Jeśli projekt jest złożony to warto wymusić techniki takie jak TDD, Solid, Struktura projektu, Architektura, Modularność - to załatwiamy właśnie rules i skilles ale trzeba wiedzieć jak to ustawić

* Dokumentacja techniczna! AI sam tego nie zrobi - trzeba mu kazać

I jeszcze pare innych rzeczy ale już nie chce mi się o tym pisać. Generalnie główny wniosek jest taki że jedna osoba dzisiaj może robić za zespół. Aplikacja dobrze prowadzona przez operatora systemu agenturalnego będzie działać dobrze, ale nie może to być vibe coding, to musi byc przłożenie inżynierskiej pracy na system AI -> one tego nie potrafią bo to nie jest coś co jest opisane w książece, nie ma o tym wiedzy ogólnie, to się zdobywa krwią i potem w projektach i to są dziesiątki tysięcy przepracowanych godzin i przebyte załamania nerowowe(miałem to wszystko).

Napisałem cały tekst z palaca i nawet nie poprawiam błędów -> dla autentyczności :grinning: doceńcie :D

Pokaż więcej komentarzy (22)

Gruba ryba

w Hydepark

16piorunów

Na swoim landingpage zrobiłem rozpiskę. Co takiego ma mój BTerminal, czego nie ma konkurencja. Przede wszystkim ja zrobiłem rozwiązanie które nie jest nastawione na zysk. Oni mają rozwiązania na którym chcą zarabiać. Ja zrobiłem coś "pod siebie" -> co ma dac maksimum kontroli, minimum obostrzeń. Ma być maksymalnie tanie a najlepiej darmowe. Oni tego nie mają bo chca zarobić, a ja chcę po prostu mieć dore narzędzie. I zrobiłem analizę porównawczą :)

https://bterminal.mandaladev.eu/

Jestem otwarty na dyskusję i konstruktywną krytykę. Jeśli ktoś zechce to krytykujcie, potrzebuję tego bo to najlepsza metoda na znalezienie błędów, problemów i dalszy rozwój.

Dajcie gwiazdkę na github - proszę :)

Pokaż więcej komentarzy (8)

Gruba ryba

w Programowanie

38piorunów

Ale mnie wkurwia niemożliwie ze trzeba będzie teraz pewnie ze dwa lata czekać żeby się wielkie projekty data center wyjebały i ceny RAMu wróciły do normy jak będą to wyprzedawać.

Tytan6piorunów
jak będą to wyprzedawać.

Nie będą. Serwerowych RAMów nie włożysz do konsumenckich PC, ani do laptopów. Nie mówiąc już o HBM, które zostały wlutowane do akceleratorów, a przez nie spadła produkcja DDR5.

Co najwyżej cena może spaść przez zwiększoną produkcje, gdy popyt od serwerów spadnie.
Wynajmowanie serwerów może też będzie tańsze.

Pokaż więcej komentarzy (19)

Autorytet

w Hydepark

7piorunów

„To nie sztuczna inteligencja zabrała nam pracę. To chciwość. Ta sama chciwość, która przeniosła fabryki do Bangladeszu i trzyma niewolników w kopalniach kobaltu w Kongo, noszących nowe maski.”

http://stvn.sh/writing/programming-still-sucks-fqffhyp

Pokaż więcej komentarzy (2)

Osobistość

w Hydepark

5piorunów

AI pogrąża polskie software house'y. Muszą się zmienić, bo wyceny lecą w dół

Główna teza:\ Rewolucja AI (automatyzacja kodowania, narzędzia jak Claude Code) zmiażdżyła tradycyjny model polskich software house'ów opartych na nearshoringu i sprzedaży godzin pracy programistów. Wyceny spadły ~30%, a w 2025 r. w Polsce nie doszło do ani jednej transakcji M&A

Fanatyk

w Internet

8piorunów


**https://killertools.net/**

GitHub: **https://github.com/SteveTheKiller**

Gruba ryba

w Hydepark

14piorunów

Zobaczcie Landing page dla mojego projektu :grinning: zbieram feedback zanim zacznę marketing. Zrobiłem już generalny refactoring projektu i dodałem obsługę wielu języków. Nie wstyd pokazać. Muszę jeszcze zrobić ręczne testy pod kontem regresji, ale wstępne i automatyczne testowanie nie pokazuje żadnych problemów. Chociaz nie testowałem instalatora dokładnie ale myśle że powinien działać. Także obejrzyjcie Landing page i czekam na konstruktywną krytykę żeby to dobrze dopracować zanim zacznę się tym szerzej chwalić.

https://bterminal.mandaladev.eu/

GURU3piorunów

Mnie się podoba. Czytelne i nieprzeładowane, z intuicyjnym rozkładem. Nawet tę animację bym chyba wywalił, bo trochę rozprasza.

Pokaż więcej komentarzy (10)

Gruba ryba

w Hydepark

19piorunów

Zobaczcie, zrobiła mi się z tego już duża aplikacja. Dzisiaj zrobiłem refaktor i dodałem więcej testów. Robi się naprawdę fajne środowisko.

Mam plan zrobić w najbliższym czasie jeszcze 2 rzeczy. Po pierwsze dodam obsługę większej liczby CLI — poza Claude Code wepnę jeszcze Aidera, Codeksa i Copilot CLI. Już czekają w kolejce. Ostatni refaktor przygotował środowisko pod kolejne rozszerzenia. Bardzo fajnie działa mi mechanika obsługi pluginów. Cały czas tego używam.

To środowisko skrojone na moje potrzeby, ale pomyślane tak, żeby każdy mógł skorzystać. Ot, przykład — mój lekarz psychiatra. Zapytał mnie, co robiłem na L4, pokazałem mu to. Potem dzwonił i mówił, że zarywa na tym noce :grinning: Jest tam kilka fajnych narzędzi, które dodałem od siebie. Dorzucę jeszcze obsługę kilku języków i tłumaczenia, i będę się tym chwalił.

A kiedy minie mi okres wypowiedzenia, zamierzam zająć się szkoleniami i wdrożeniami systemów AI — i klientom będę to pokazywał. Jest to pomyślane tak, że można dopisać dowolny plugin dla AI i postawić na tym jakiś fajny system, a nawet całe centrum dowodzenia. Na razie testowałem to na swoim projekcie od zdalnych wyświetlaczy i działa fajnie :)

@Harpersy przepraszam że kanał na discordzie leży ale mam tyle roboty że nie mam kiedy pospinać tego serwerka 😒 ale to jest w planie :)

Pokaż więcej komentarzy (6)

Sum

w Hydepark

48piorunów

Tomeczki pijcie ze mną kompot. Po ponad roku od tego wpisu, gdzie próbowałem napisać bota/algorytm do tradingu na krypto i po roku nauki matematyki, bibliotek pythona i algorytmów, udało mi się zrobić spory krok w kierunku mojej transformacji z Web Developmentu do Machine Learningu 😎

Na razie jest to mały krok, bo w ramach proof of concept zrobiłem system do rekomendacji do jednego z produktów, który posiada firma w której pracuje, ale i tak jestem zadowolony, że pojawiają się jakieś namacalne efekty.

Zaczęło się od ciekawości, gdy robiłem sobie wyżej wspomnianego bota i wymyślałem jakie dane analizować pod jakim kątem. Tym sposobem ChatGPT naprowadził mnie na Pythona i Machine Learning. Zacząłem wałkować temat i skille który by mi były potrzebne. I tak zacząłem od korepetycji z matematyki, nauki Pythona i jego bibliotek do ML, potem zrobiłem bardzo fajny kurs ML, aż zacząłem robić właśne eksperymenty z modelami i badać ich output.

Zajęło mi to ponad rok, ale jestem z siebie mega zadowolony, bo wykazałem się przy tym mega dyscypliną i za wyjątkiem jedno 2 miesięcznego okresu to od poniedziałku do piątku przynajmniej 30 min poświęcałem na naukę.

i taguje też  bo też mi bardzo pomógł zacząć a potem utrzymać w ryzach cały proces nauki

Pokaż więcej komentarzy (4)

Lider

w Podróże

6piorunów

.

Od 2018 śledzę wszystkie swoje podróże zagraniczne, mam dane dla każdego dnia w którym kraju byłem w prywatnym excelu i na nomads.com którego używam do generowania map podróży.

W lutym skleciłem excela który dla każdego dnia roku mówi w ilu krajach byłem. W sumie tabela działa spoko, ale była słaba wizualnie i nie da się za bardzo jakiegoś fancy wykresu z niej zrobić. (2 obrazek) Fancy wykres to w sumie by był udawany kalendarz który w każdym dniu mówi ile i gdzie.

I miesiąc robiłem vanity project na podstawie danych z tego portalu wcześniej (działa na API więc jego użytkownicy mogą tez sobie taki kalendarz wygenerować).

I w tym kalendarzu nakładam lata i mogę wyciągać jakieś random fakty:

22 marca* - odwiedziłem najwięcej krajów 6

za granicą byłem 281 / 366* dni kalendarzowych

* styczeń i listopada to miesiące w których każdy dzień byłem za granicą

* brakuje mi 17 czerwca żeby mieć cały czerwiec

* mogę podejrzeć wizualnie kiedy byłem w danym miejscu w ciągu roku

* od 2023 byłem co roku we Włoszech czego nie zarejestrowałem a widać w danych

Takie w sumie tylko osobę której tyczy taki kalendarz interesujące próżne dane, dla mnie też trochę ze wskazówka gdzie mogę sobie polować żeby łatać dziury.

https://deykun.github.io/travel-calendar/#u:deykun&h:pl

Pokaż więcej komentarzy (4)

Gruba ryba

w Gównowpis

26piorunów

Jak przy pracy w nocy się zamyślę to patrzę przez okno na okoliczne bloki. Szczególną uwagę zwracam na to gdzie pali się światło. Jeśli gdzieś światło często pali się do godzin porannych, to taki sąsiad w mojej glowie staje się moim twórczym kompanem. Wyobrażam sobie, ze to inny programista, architekt, poeta albo malarz artysta rzeźbiący swoje magnum opus przy świetle księżyca.

Zbijam z nim wtedy piątkę w głowie, życzę powodzenia i wracam robić swoje.

Pokaż więcej komentarzy (3)

GURU

w Heheszki

54piorunów

Gruba ryba11piorunów

@damw u mnie kiedys jakis smieszek jak sie bawilem w Windowsowe AD ustawil ktos na kontrolerach domeny haslo: cwaneiproste XD

GURU19piorunów

@damw Się śmiejesz, a ja zrobiłem podobne zabezpieczenie przed jednym z pierwszych ransomware, które szyfrowało rekursywnie plik po pliku xD

Miałem potworzone wszędzie katalogi z odnośnikami do siebie nawzajem ( ͡° ͜ʖ ͡°)

Pokaż więcej komentarzy (19)

GURU

w Hydepark

9piorunów

AI popsuło bazę danych i usunęło backupy https://x.com/lifeof_jer/status/2048103471019434248

Co za przypadek

Gruba ryba5piorunów

@30ohm

1. Byo

2. cały "artykuł" jest napisany przez AI xD

3. pomiędzy AI robiącym co zrobiło było też stworzenie endpointu, który usuwał wszystkie dane (ciekawe po co taki powstał bo AI na 99% samo z siebie takiego niestworzyło XD) oraz "ofiara" nieczytający co w ogóle AI robi, o pracy na danych produkcyjnych nie mówiąc

4. "autor" artykułu nie widzi w sobie dosłownie żadnej winy

Sprawa lekko mówiąc śmierdzi. O ile w ogóle jest prawdziwa.

Pokaż więcej komentarzy (4)

GURU

w Heheszki

52piorunów

Fanatyk12piorunów

Pozew na grube mln. A ustalić kto to zrobił nie jest jakoś mocno trudno

GURU0piorunów

@wielbuont a tego nie wiem, ale slyszalem o takich akcjach, ze sobie na pendrive nowe wersje kodu podaja w biurze. Nie mam pojecia jak w ogole mozna byc tak pozbawiony godnosci, aby w takiej firmie robic

Pokaż więcej komentarzy (16)

Gruba ryba

w AI

67piorunów

tl;dr

Koleś miał sobie business, całkiem fajny bo dostarczał technologię używaną przez wypożyczalnie samochodów w USA.

Kozystali z infrastruktury firmy Railway ale coś tam nie pykło i tokeny uwierzytelniające w API dostawcy usług miały bardzo szerokie uprawnienia, co oczywiście jest okropną praktyką.

No i pan od biznesu wypożyczalnianego wykupił sobie Cursoa i Claude, po czym zaczęło sie vibecodowanie. Ale pan był, jak mu się wydawało, przezorny i ustawił Cursorowi ograniczenia, że niby czegoś tam nie może robić sam.

A ten nie posłuchał i wyparował im wszystkie kopie baz danych, łącznie z backupami. Jednym-kurła-żądaniem-REST.
Nie wiem kto tu bardziej zawinił ale robi się ciekawie.
Polecam jednak przeczytać posta na Twatterze, bo tam autor dołącza szczerą samokrytykę którą wygłosił agent.
https://x.com/lifeof_jer/status/2048103471019434248?s=46

Fenomen11piorunów

Miałem o wiele mniejszą w skutkach akcję na prywatnym serwerze. Postawiłem sobie po raz pierwszy Immich w Dockerze ale coś mi tam się nie zgadzało z uprawnieniami więc zacząłem pytać Gemini o porady. Początkowo brzmiało dobrze - proponował komendy nadające odpowiednie uprawnienia użytkownikowi. Zaczął jednak brnąć (na moją prośbę) w naprawianie wolumenów i ustawień albumów . Od słowa do słowa i nagle odkrył, że jestem na starej wersji (byłem na najnowszej) i zaproponował "upgrade" do wersji niższej i to sporo. Zaświeciła mi się niestety tylko żółta lampka zamiast czerwonej i zapytałem czy ta wersja Immicha (1.6.2) jest na pewno nowsza od 2.6.5. Gemini odpowiedział, że tak bo to inna numeracja niż zazwyczaj XD no i tu ja zjebałem bo mu zaufałem i powiedziałem no dobra to lecimy XD

Skończyło się na tym, że robiłem przez dwie godziny downgrade wszystkich kontenerów przez konsole co poskutkowało prawie całkowitym rozjebaniem instancji Immicha i zmarnowaniem około 8 godzin pracy. Całe szczęście, że nie tknął zdjęć. Ale co się nauczyłem o zaufaniu do AI to moje.

Pokaż więcej komentarzy (34)