Der Standard verrechnet sich gerade in der Rubrik Verrechnet

04. August 2026

Also - mit dem Fazit.

860 Pro­zent über Bud­get! Wie der KI-Hype gera­de Ama­zons Mil­lio­nen verbrennt

11EINS!!!EINS!!!ELF!

Und wer hats geschrie­ben? Klar - Alex­an­der Amon.

Genutzt wur­de dafür das KI-Modell Clau­de Son­net von Anthro­pic, ein Ergeb­nis brach­te das Pro­jekt nicht.

[…]

Das Ver­spre­chen, dass die KI alles kann und das bes­ser, bil­li­ger und schnel­ler, ging bis­her nicht wie ver­spro­chen auf. Man darf gespannt sein, wie viel Geld die “Magni­ficent Seven” noch in die­se Idee inves­tie­ren und mit wel­chem Erfolg. (Alex­an­der Amon, 3.8.2026)

Was haben sie ver­wen­det? Clau­de Son­net? Gut, Model­num­mer nicht dazu­ge­sagt, wie immer im guten deutsch­spra­chi­gen Qualitätsjournalismus…

Gehen wir davon aus dass es 4.6 mit adap­ti­ve Rea­so­ning war: 47 Arti­fi­cial Ana­ly­sis Intel­li­gence Index Punk­te. Bei 3 USD per mil input/15 USD per mil output

Gehen wir davon aus dass es 5 mit adap­ti­ve Rea­so­ning war (was es nicht gewe­sen ist): 53 Arti­fi­cial Ana­ly­sis Intel­li­gence Index Punk­te. Bei 2 USD per mil input/10 USD per mil output

Deep­seek v4 Flash 0731: 50 Arti­fi­cial Ana­ly­sis Intel­li­gence Index Punk­te. Bei 0.14 USD per mil input/ 0.28 USD per mil output

OH MEIN GOTT 9x over budget!

IT wech­selt zu einem aktu­el­len chi­ne­si­schen Modell

OH MEIN GOTT 2x unter budget!

Tja, das wird den Alex Amon, Mensch der nicht schrei­ben und nicht den­ken kann nicht retten. 🙂

Qwen 3.8 Resul­ta­te sehen wir die­se Woche noch, falls das Ama­zon Manage­ment mehr, aber doch kei­ne Mond­prei­se für die sel­be Leis­tung zah­len möchte… 🙂

Es ist der­ar­tig mit­leid­s­er­re­gend, Jour­na­lis­ten dabei zuzu­se­hen, wie sie die ein­fachs­te Logik von Tech­no­lo­gie­ent­wick­lung nicht begreifen…

1. Es wird nicht besser.
2. Fak­tor 10 bei der Preis­ent­wick­lung ist mit chi­ne­si­schen Model­len locker wett zu machen.
3. Du kannst die sel­ben Idio­ten ange­stellt las­sen, die hier das Pro­jekt in den Sand gesetzt haben, gib ihnen ein­fach das bil­li­ge­re Spielzeug
4. Das Manage­ment musst du tau­schen, denn dort sit­zen nur Idioten.
5. Genau­so wie im deutsch­spra­chi­gen Qua­li­täts­jour­na­lis­mus der schon wie­der die Öffent­lich­keit vor den Aus­wir­kun­gen der KI Zukunft geret­tet hat. 🙂

PS: Wel­cher Idi­ot ver­wen­det für den tat­säch­li­chen Task (Abgleich von 100.000 Autoren Bio snip­pets) hier Son­net, und kei­ne Armee von Micro­agents auf nem Flash Modell? Ah, Amazon.

Gut, aber die­se Flash­mo­del­le (284B/13A mit nati­ver Q8 Quant (150GB groß at Q4)), die kön­nen ja nichts. Wer wür­de die heut­zu­ta­ge schon nut­zen wollen…

*hust*

Wer?

Wir bewe­gen uns gera­de in Rich­tung in 10 Jah­ren ist der Spiele-PC dei­nes Soh­ne­manns schlau­er und schnel­ler als du - mit Tools… 

https://old.reddit.com/r/LocalLLaMA/comments/1veow4b/deepseek_v4flash_284b_moe_at_33_toks_single_68/

Mit den übli­chen LLM Pit­falls. Und das nicht wegen der Tech­no­lo­gie­ent­wick­lung, son­dern wegen dem was chi­ne­si­sche AI Buden aus der Model­ent­wick­lung rausholen.

Und deren Ite­ra­ti­ons­zy­klus ist effing sca­ry. Also im Sin­ne von, das war das Resul­tat eines top Models vor 8 Mona­ten. Und nächs­te Woche haben wir zwei chi­ne­si­sche Anbie­ter die das mit nem Flash Model kön­nen. Das Top End wächst mit den sel­ben Pro­ble­men lang­sa­mer. Aber die open source Model­le holen mit einer Geschwin­dig­keit zu den Gro­ßen auf, die ist effing scary.

edit: Sowas:









Hinterlasse eine Antwort