Erstmal gutes Video finde ich.
Ich denke aber aktuell ist noch Investment für die meisten der größte Punkt und Cloud wird für die Meisten einfach noch der weg sein, auch weil es noch recht viel Arbeit brauch um alles zum Laufen zu bekommen.
Ich spiele auch seit ein paar Wochen mit lokalen llm. Am besten gefällt mir Qwen 3.8 27B das bei mir schnell genug läuft damit ich es einfach nebenher als Sprachassistenten benutzen kann. Für schwierige Tasks nehme ich Qwen 3.8 Flash Next das ist aber am Limit was bei mir laufen kann.
Jetzt neu gibt es ja auch das Deutsch/Englische Model Aleph-Alpha/Kolibri-1 · Hugging Face das könnte auch interessant werden, da selbst das denken auf deutsch passiert.
Hier für wenn es interessiert mein Benchmark:
