Offene, quantisierte Modelle laufen On-Device auf SoCs mit NPU; keine Daten verlassen das Gerät. Das senkt DSGVO- und CRA-Risiko und macht unabhängiger von US-Cloud-Anbietern. ▶ Diesen Artikel anhören25 KI-Unternehmen — darunter Nvidia, Microsoft, Meta und Palantir — warnen Washington vor voreiligen Beschränkungen offener KI-Modelle. Quantisierte offene Modelle (4- bis 8-Bit) laufen heute auf SoCs mit NPU; als Laufzeit haben sich llama.cpp/GGUF und ONNX Runtime etabliert. Verlassen keine Daten das Gerät, schrumpfen DSGVO-Fragen und CRA-Angriffsfläche gleichzeitig – ein handfester Vorteil vor der Meldepflicht ab 11.