Wpis użytkownika fervi w Hydepark
ferviGwiazdor
13piorunówOgólnie dzięki zakupowi Gemini za 15zł / 18msc zacząłem częściej przenosić aplikacje na Termux lub Android. Niestety to już jest tak dobre AI, że piszesz co chcesz i z grubsza to dostajesz.
W każdym razie Frets on Fire X (takie Guitar Hero dla ubogich) nie działało ze sterownikiem Zink. Puściłem Antigravity, sprawdził, naprawił, potem napisał issue dla Gitlaba Mesy i zacząłem się zastanawiać po kij żyję jak ten chwast, skoro AI robi to samo lepiej
Komentarze (21)
@fervi Gemini za 15zł / 18msc
Jak to możliwe?
@madhouze Zależy co robisz. Ja wspieram open source (tym hajsem, że tak powiem), a to wszystko i tak publicznie dostępne, więc to nie problem 😛
Jakbym miał płacić to albo za Mistrala (bo Europa + Open Source) albo OpenCode Go (bo mają topowe modele za 10 dolarów)
@fervi opłacam chatgpt i Gemini, ale to prawie 200 zł na miesiąc, dlatego mnie to zaciekawiło, ale chyba jednak nie będę ryzykował
@madhouze Prawdopodobnie to wygląda tak:
* Chińczyk kupuje na organizację konto
* Ty kupujesz klucz na Allegro
* On daje Ci linka, który dołącza do organizacji
* Jest szansa na bana, więc uważaj
Coś słyszałem, że oni mogą wtedy uczyć swoje AI (poprzez dane treningowe). Może więc mają wgląd do korespondencji.
Jeśli chcesz legitny plan to zobacz OpenCode Go - 10 dolarów (gdy konkurencja ma 20) lub Mistral (ale Mistral ma słabe modele, ale projekt francuski, więc RODO itd)
Albo OpenCode Zen z darmowymi modelami, są limity dzienne, ale może przetrwasz :grinning:
@fervi ludzie z wiedzą domenową nie ogarniają jak mało wiedzą o programowaniu zwykli śmiertelnicy.
Coś tam dłubie sobie na Linuxie, czytałem Project Phoenix i słuchałem trochę podcastów. Ale poza wieloma skryptami w bashu nic nie programowałem.
Dałem radę zrobić appkę na Androida w języku, którego nie rozumiem. Ale wiedziałem, żeby kazać botowi zrobić dobry plan, checkpointy, CI/CD i testy. I przy każdym checkpoincie weryfikować czy działa jak trzeba.
Ale mógłbym dać mamie te same narzędzia i chociaż nie jest głupia, to nawet nie będzie znała słownictwa, żeby kazać botowi zrobić to porządnie.
Wiadomo, w bańce programistów wydaje się, że LLMy tyle potrafią, ale to dzięki dobremu nadzorowaniu. Nawet jeżeli bot będzie pisać kod, to nie zrobi wszystkich innych rzeczy, a na koniec nie weźmie odpowiedzialności.
A jak wygląda sytuacja jak ktoś bez głębszej wiedzy zvibecoduje jakąś produkcyjną appkę było widać z tym facetem, który został po krótkim czasie zhakowany.
Albo ludziach, którzy źle skonfigurowali harness i dostępy i bot przypadkiem usunął bazę danych na produkcji. Faktycznie, masz rację! Nie powinienem był tego robić.
@Legendary_Weaponsmith prywatnie nie zaryzykował bym brania odpowiedzialności za kod którego nie rozumiem. Wiedza domenowa, ok, ale wtedy pokryjesz tylko known unknowns, ale zostaje znacznie większy worek z unknown unknowns niż gdybyś znał dany język (umówmy się też, że nie tylko sam język, ale i język i narzędzia wokół niego).
To jest ok dla PoC, ale nie dla produkcji imo, nie na dzień dzisiejszy przynajmniej
@fervi Wszystko dlatego że nie sprawdziłeś kodu który napisał : >.
A tak serio to zgadzam się, że są dużo lepsze obecnie niż np rok temu, ale docieramy do granicy tego co potrafią IMO. Tzn same sieci neuronowe zrobiły się tylko trochę lepsze, po prostu są mądrzej używane. Progres ich rozwoju dotarł do etapu optymalizacji, więc nie będzie już przeskoków jakościowych jak przez poprzednie 4 lata.
Będą z nami już zawsze, ale przepięknie wyglądają ich dostarczenia kodu jeśli nie przyjrzysz się co robią dokładnie. To nie ma rozumu, to maszyna statystyczna.
@baklazan Ogólnie z jednej strony optymalizacje modeli to jest klucz, który powinno się wdrażać, ale z drugiej większość optymalizacji pogarsza działanie LLMa. Od nieznacznie do znacznie.
Dlatego LLMów "komercyjnych" się nie optymalizuje, a głównie te open source i to też niektóre.
Weźmy przykład: Qwen3.6 35B A3B vs Qwen3.6 27B. Wydaje się, że 35B jest lepszy, bo ma więcej parametrów, tak? Otóż nie 😛
Gdyż jest na architekturze MoE, która daje bardzo dużą wydajność (spora optymalizacja), ale zarazem realnie gorsze wyniki, bo to takie połączenie X modeli po 3B parametrów, z czego tylko np. 4 są aktywowane podczas odpowiedzi.
@fervi możesz rozszerzyć, bo nie jestem pewien co masz na myśli
@baklazan Największy problem z LLMami jest taki, że muszą być inteligentne, osiągać jak najwięcej punktów itd. Im słabiej tym gorzej.
Na przykład świetnie zoptymalizowanymi modelami są Qwen3.6 i Gemma 4. Chodzą na RTXach i społeczność wyciska ile się da z nich. DFlashe, Turboquanty itd.
@fervi uważam że jest bardzo duże pole do popisu jeśli chodzi o optymalizację LLMów, w zasadzie na wszystkich płaszczyznach, ale jest jeszcze bardzo daleka droga zanim to się stanie. A do tego czasu - będą drożeć.
@fervi - tańsze przez jakiś czas nie będą :thinking_face:
@baklazan Tylko nawet jeśli dochodzą do limitów to nie znaczy, że nie są użyteczne 😛
A jeszcze lepiej jak będą z roku na rok - tańsze, łatwiejsze do wdrożenia itd.
Niestety to już jest tak dobre AI, że piszesz co chcesz i z grubsza to dostajesz.
Gówno prawda. Mojego programu nie potrafiło skompilować.
@kim_jestesmy_dokad_zmierzamy Możliwe. No tutaj to Bash i budowanie aplikacji, dodawanie parametrów do budowania, czasem fix jakiś kodu.
@fervi potrzebowałem ladder przerobić na hex, i nie dał rady, chyba zbyt trudne zadanie mu dałem
@kim_jestesmy_dokad_zmierzamy Widocznie słaby kod 😛 Ogólnie w znacznej części rzeczy daje radę. Raz wysłałem PRa z naprawą budowania do Termux, Gemini znalazło ukrytą flagę deweloperską, która rozwiązywała problem xD
@fervi nie jak chwast tylko jako specjalista :smiley: AI jest super ale dla ludzi którzy mają jakąś wiedzę.
sprawdził, naprawił, napisał issue dla Gitlaba Mesy i zacząłem się zastanawiać po kij żyję jak ten chwast, skoro AI robi to samo lepiej
@fervi no z tym lepiej to ja tam nie wiem. Skoro to takie lepsze, to nie byłoby tyle narzekania na masę spamu.
I cyk, issue zamknięte, bo napisane przez AI.