IT-News KW33/2026: GPT-5.6 wird billiger, DeepSeek V4-Flash besser, Apple Screen Sharing offen
Die Woche vom 10. bis 16. August 2026 drehte sich um zwei Themen: Preise fallen, Lücken werden sofort ausgenutzt. OpenAI senkte GPT-5.6 Luna um 80 Prozent und machte Geschwindigkeit zum eigenen Produkt. DeepSeek V4-Flash legte im Terminal-Bench um 25 Punkte zu und liegt nun vor Claude Fable 5. Apple musste einen kritischen Authentifizierungs-Bypass in macOS Screen Sharing patchen, und Alibaba positionierte Qwen3.8-Max als offene Frontier-Alternative.
Deep Dive: OpenAI GPT-5.6: Preisverfall und Speed-as-a-Service
Luna minus 80 Prozent, Sol wird schneller gegen Aufpreis
OpenAI hat die Preise für die günstigeren GPT-5.6-Modelle gesenkt: Luna kostet neu $0,20 Input und $1,20 Output je Million Token (−80 %). Terra liegt bei $2 / $12 (−20 %), Sol bleibt bei $5 / $30. Dazu kam ein Fast Mode für Sol, der die Verarbeitung um bis zu das 2,5-Fache beschleunigt, zum doppelten Preis. the decoder
Die Botschaft: Geschwindigkeit wird vom Modell entkoppelt und zum separaten Produkt. Wer warten kann, zahlt weniger. Für KMU heißt das: Planungsannahmen veralten im Quartalstakt, und Langfristverträge auf Basis aktueller Preise werden schnell teuer.
Bewertung: Preisverfall ist gut, aber nur für den, der austauschbar bleibt. Wer sich an ein einziges Modell bindet, bekommt die günstigeren Alternativen nicht mit.
Deep Dive: DeepSeek V4-Flash: 99 Prozent günstiger als Claude Fable 5
Stilles Nachtraining, großer Benchmark-Sprung
DeepSeek hat V4-Flash ohne große Ankündigung nachtrainiert. Gleiche Architektur (284 Mrd. Parameter, rund 13 Mrd. aktiv, 1 Mio. Token Kontext), neues Post-Training. Im Terminal-Bench 2.1 sprang das Modell von 56,9 auf 82,7 Punkte: und liegt damit vor Claude Fable 5 (80,5). OfficeChai
Der Preis liegt bei $0,14 Input / $0,28 Output je Million Token. Claude Fable 5 ruft für dieselbe Menge $10 / $50 ab. Der Leistungsabstand zum Spitzenmodell GPT-5.6 Sol beträgt nur 3,1 Punkte, der Preisunterschied Faktor 100.
Bewertung: Für agentische Coding-Aufgaben ist V4-Flash jetzt die erste Wahl, wenn Datenschutz keine Rolle spielt. Wer sensible Codebasen hat, sollte auf offene Gewichte im Eigenbetrieb setzen.
Deep Dive: Apple macOS CVE-2026-65400: Screen Sharing ohne Passwort
Authentifizierungs-Bypass ermöglicht Root-Zugriff
Apple patchte CVE-2026-65400 am 6. August. Die Lücke sitzt in screensharingd und erlaubt einem Angreifer mit Netzwerkzugriff, sich am VNC-Service auf Port 5900 anzumelden, ohne gültige Credentials. Ergebnis: Root-Zugriff per Remote Desktop. Das NCSC-NL bestätigte aktive Ausnutzung; in jedem bekannten Fall wurde ein Monero-Miner installiert. Tanium
Apple hat die Schwere nachträglich von 7,1 auf CVSS 9,8 angehoben. CISA nahm die Lücke am 18. August in die KEV-Liste auf.
Bewertung: Screen Sharing ist in vielen Unternehmen für Support-Zwecke aktiv und wird selten auf Erreichbarkeit geprüft. Patch sofort, deaktiviere Screen Sharing dort, wo es nicht gebraucht wird, und blockiere Port 5900 nach außen.
Deep Dive: Qwen3.8-Max: 2,4 Billionen Parameter mit Open-Weight-Ankündigung
Alibaba kehrt zum Offenlegen der Spitze zurück
Alibaba veröffentlichte Qwen3.8-Max am 3. August: ein MoE-Modell mit 2,4 Billionen Parametern, davon rund 95 Milliarden aktiv, multimodal für Text, Bild, Video und Dokumente, mit 1 Mio. Token Kontext. Der Preis liegt bei $2 Input / $6 Output je Million Token. MarkTechPost
Im Arena-Leaderboard für Frontend-Code liegt Qwen3.8-Max auf Rang 4 mit 1.668 Punkten, 37 Punkte hinter Claude Opus 5. Wichtiger als die Platzierung ist die Ankündigung, die Gewichte offenzulegen: sowohl Qwen3.8-Max als auch ein kleineres Qwen3.8-27B. Träfe das ein, wäre ein 2,4-Billionen-Parameter-Modell im Eigenbetrieb erreichbar.
Bewertung: Die Ankündigung ist vager als die Gewichte selbst. Bis die Checkpoints verfügbar sind, bleibt Qwen3.8-Max eine API-Option. Unternehmen mit Datenschutzanforderungen sollten abwarten, bis Eigenbetrieb möglich ist.
Innovation & Open Source
- FreeToken: Neue Apache-2.0-Edge-MoE-Inferenz-Engine, die 290B+ Frontier-Modelle auf einer Gaming-GPU mit CPU/RAM laufen lässt. Konkurrenz für KTransformers.
- vLLM 0.27.1 Prefix-Token-Details:
--enable-prompt-tokens-detailsmacht den Cache-Anteil pro Prompt transparent.
Digest: Weitere wichtige Nachrichten
Sicherheit
- VMware vCenter CVE-2026-59310: Path-Traversal CVSS 9.8, gepatcht am 29. Juli, ausgenutzt ab 3. August. Wird im nächsten Newsletter detailliert.
- 14 trojanisierte npm-Pakete: Pakete wie streak-metrics-math liefern RedC2-Backdoor beim Import.
- Rust-Supply-Chain: arrayref, internment, append-only-vec: Kompromittierte Crates über typosquattete
proc-macro1-Abhängigkeit.
KI & Unternehmen
- Anthropic baut eigene Rechenzentren: Milliarden-Investition mit Macquarie und GIC.
- Intel verkauft erstmals seit 1971 neue Aktien: 15 Milliarden Dollar zur Sanierung der Foundry-Sparte.
Aus dem Blog
- GPT-5.6: Geschwindigkeit als eigenes Produkt: OpenAIs neue Preisstruktur und was der Fast Mode für KMU-Pläne bedeutet.
- DeepSeek V4-Flash: Frontier-Leistung für einen Prozent des Preises: Terminal-Bench-Sprung und die Rechnung hinter dem Preisverfall.
- Apple macOS CVE-2026-65400: warum ein Screen-Sharing-Auth-Bypass Root-Zugriff ermöglicht.
- Supply-Chain-Angriffe: npm und Rust: RedC2-Backdoor, kompromittierte Rust-Crates und GitLab.
- Qwen3.8-Max: 2,4 Billionen Parameter im Eigenbetrieb?: Was die Open-Weight-Ankündigung für den Mittelstand bedeutet.
Zusammengestellt am 16. August 2026. Quellen: the decoder, OpenRouter, OfficeChai, Tanium, MarkTechPost, Bloomberg, Cyber Recaps.
senn-tech