

Ich habe ein Ryzen 7850HS (32GB) mit einer RTX 4060 (8GB) und lasse da z.B. gemma4 26B A4B drauf laufen. Es ist sicher nicht so performant wie cloud Modelle, aber ich finde man kann damit gut arbeiten. Habe gestern qwen3.6 als MoE probiert und das war eine Katastrophe. Denke kommt stark auf die Hardware, Model und letztendlich auf die Tasks an.
Habe heute ihn selbst Docker, Compose und Startskript über arbeiten lassen und am Ende eine saubere Readme.md schreiben lassen, ging erschreckend gut.
Hint: Ich hoste noch ein paar Dienste auf einem NUC8i7 und wollte es darauf probieren, ist ja im Grunde auch Mobile Hardware, Katastrophe.
Auch der techstack oder anders? Hatte am Anfang ollama, aber llamacpp macht mir einen performanteren Eindruck, wenn man ein Modell exklusiv nutzen mochte.
Zum Thema vibecoding sehe ich genauso, aber für Tasks die man nicht so gerne machen möchte geht es zumindest mit gemma4 echt gut. Will morgen mal gucken, ob ich Infrastrukturaufgaben abgeben kann. Haben ein paar Skripte mit denen alle unzufrieden sind, aber keiner Lust und Zeit hat diese zu überarbeiten. Danach will ich auch mal sehen, ob es reviews von pull requests machen kann und eine erste Einschätzung machen kann. Vll. auch refactorings vorschlagen kann.