senn-techsenn-tech
← IT-News
Kalenderwoche 2026-W332026-08-16

IT-News KW33/2026: GPT-5.6 wird billiger, DeepSeek V4-Flash besser, Apple Screen Sharing offen

KIOpenAIDeepSeekQwenSicherheitApple

Die Woche vom 10. bis 16. August 2026 drehte sich um zwei Themen: Preise fallen, Lücken werden sofort ausgenutzt. OpenAI senkte GPT-5.6 Luna um 80 Prozent und machte Geschwindigkeit zum eigenen Produkt. DeepSeek V4-Flash legte im Terminal-Bench um 25 Punkte zu und liegt nun vor Claude Fable 5. Apple musste einen kritischen Authentifizierungs-Bypass in macOS Screen Sharing patchen, und Alibaba positionierte Qwen3.8-Max als offene Frontier-Alternative.

Deep Dive: OpenAI GPT-5.6: Preisverfall und Speed-as-a-Service

Luna minus 80 Prozent, Sol wird schneller gegen Aufpreis

OpenAI hat die Preise für die günstigeren GPT-5.6-Modelle gesenkt: Luna kostet neu $0,20 Input und $1,20 Output je Million Token (−80 %). Terra liegt bei $2 / $12 (−20 %), Sol bleibt bei $5 / $30. Dazu kam ein Fast Mode für Sol, der die Verarbeitung um bis zu das 2,5-Fache beschleunigt, zum doppelten Preis. the decoder

Die Botschaft: Geschwindigkeit wird vom Modell entkoppelt und zum separaten Produkt. Wer warten kann, zahlt weniger. Für KMU heißt das: Planungsannahmen veralten im Quartalstakt, und Langfristverträge auf Basis aktueller Preise werden schnell teuer.

Bewertung: Preisverfall ist gut, aber nur für den, der austauschbar bleibt. Wer sich an ein einziges Modell bindet, bekommt die günstigeren Alternativen nicht mit.


Deep Dive: DeepSeek V4-Flash: 99 Prozent günstiger als Claude Fable 5

Stilles Nachtraining, großer Benchmark-Sprung

DeepSeek hat V4-Flash ohne große Ankündigung nachtrainiert. Gleiche Architektur (284 Mrd. Parameter, rund 13 Mrd. aktiv, 1 Mio. Token Kontext), neues Post-Training. Im Terminal-Bench 2.1 sprang das Modell von 56,9 auf 82,7 Punkte: und liegt damit vor Claude Fable 5 (80,5). OfficeChai

Der Preis liegt bei $0,14 Input / $0,28 Output je Million Token. Claude Fable 5 ruft für dieselbe Menge $10 / $50 ab. Der Leistungsabstand zum Spitzenmodell GPT-5.6 Sol beträgt nur 3,1 Punkte, der Preisunterschied Faktor 100.

Terminal-Bench 2.1, Score und Listenpreis (Input / Output je 1 Mio. Token)GPT-5.6 Sol85.8$5 / $30DeepSeek V4-Flash82.7$0.14 / $0.28Claude Fable 580.5$10 / $50Claude Sonnet 574.5$3 / $156090
DeepSeek V4-Flash liegt 3,1 Punkte hinter GPT-5.6 Sol und vor Claude Fable 5, zu rund einem Prozent von dessen Preis. Quelle: Terminal-Bench 2.1, Anbieter-Preislisten (Juli 2026).

Bewertung: Für agentische Coding-Aufgaben ist V4-Flash jetzt die erste Wahl, wenn Datenschutz keine Rolle spielt. Wer sensible Codebasen hat, sollte auf offene Gewichte im Eigenbetrieb setzen.


Deep Dive: Apple macOS CVE-2026-65400: Screen Sharing ohne Passwort

Authentifizierungs-Bypass ermöglicht Root-Zugriff

Apple patchte CVE-2026-65400 am 6. August. Die Lücke sitzt in screensharingd und erlaubt einem Angreifer mit Netzwerkzugriff, sich am VNC-Service auf Port 5900 anzumelden, ohne gültige Credentials. Ergebnis: Root-Zugriff per Remote Desktop. Das NCSC-NL bestätigte aktive Ausnutzung; in jedem bekannten Fall wurde ein Monero-Miner installiert. Tanium

Apple hat die Schwere nachträglich von 7,1 auf CVSS 9,8 angehoben. CISA nahm die Lücke am 18. August in die KEV-Liste auf.

Bewertung: Screen Sharing ist in vielen Unternehmen für Support-Zwecke aktiv und wird selten auf Erreichbarkeit geprüft. Patch sofort, deaktiviere Screen Sharing dort, wo es nicht gebraucht wird, und blockiere Port 5900 nach außen.


Deep Dive: Qwen3.8-Max: 2,4 Billionen Parameter mit Open-Weight-Ankündigung

Alibaba kehrt zum Offenlegen der Spitze zurück

Alibaba veröffentlichte Qwen3.8-Max am 3. August: ein MoE-Modell mit 2,4 Billionen Parametern, davon rund 95 Milliarden aktiv, multimodal für Text, Bild, Video und Dokumente, mit 1 Mio. Token Kontext. Der Preis liegt bei $2 Input / $6 Output je Million Token. MarkTechPost

Im Arena-Leaderboard für Frontend-Code liegt Qwen3.8-Max auf Rang 4 mit 1.668 Punkten, 37 Punkte hinter Claude Opus 5. Wichtiger als die Platzierung ist die Ankündigung, die Gewichte offenzulegen: sowohl Qwen3.8-Max als auch ein kleineres Qwen3.8-27B. Träfe das ein, wäre ein 2,4-Billionen-Parameter-Modell im Eigenbetrieb erreichbar.

Bewertung: Die Ankündigung ist vager als die Gewichte selbst. Bis die Checkpoints verfügbar sind, bleibt Qwen3.8-Max eine API-Option. Unternehmen mit Datenschutzanforderungen sollten abwarten, bis Eigenbetrieb möglich ist.


Innovation & Open Source

  • FreeToken: Neue Apache-2.0-Edge-MoE-Inferenz-Engine, die 290B+ Frontier-Modelle auf einer Gaming-GPU mit CPU/RAM laufen lässt. Konkurrenz für KTransformers.
  • vLLM 0.27.1 Prefix-Token-Details: --enable-prompt-tokens-details macht den Cache-Anteil pro Prompt transparent.

Digest: Weitere wichtige Nachrichten

Sicherheit

KI & Unternehmen


Aus dem Blog


Zusammengestellt am 16. August 2026. Quellen: the decoder, OpenRouter, OfficeChai, Tanium, MarkTechPost, Bloomberg, Cyber Recaps.