Also - mit dem Fazit.
860 Prozent über Budget! Wie der KI-Hype gerade Amazons Millionen verbrennt
11EINS!!!EINS!!!ELF!
Und wer hats geschrieben? Klar - Alexander Amon.
Genutzt wurde dafür das KI-Modell Claude Sonnet von Anthropic, ein Ergebnis brachte das Projekt nicht.
[…]
Das Versprechen, dass die KI alles kann und das besser, billiger und schneller, ging bisher nicht wie versprochen auf. Man darf gespannt sein, wie viel Geld die “Magnificent Seven” noch in diese Idee investieren und mit welchem Erfolg. (Alexander Amon, 3.8.2026)
Was haben sie verwendet? Claude Sonnet? Gut, Modelnummer nicht dazugesagt, wie immer im guten deutschsprachigen Qualitätsjournalismus…
Gehen wir davon aus dass es 4.6 mit adaptive Reasoning war: 47 Artificial Analysis Intelligence Index Punkte. Bei 3 USD per mil input/15 USD per mil output
Gehen wir davon aus dass es 5 mit adaptive Reasoning war (was es nicht gewesen ist): 53 Artificial Analysis Intelligence Index Punkte. Bei 2 USD per mil input/10 USD per mil output
Deepseek v4 Flash 0731: 50 Artificial Analysis Intelligence Index Punkte. Bei 0.14 USD per mil input/ 0.28 USD per mil output
OH MEIN GOTT 9x over budget!
IT wechselt zu einem aktuellen chinesischen Modell
OH MEIN GOTT 2x unter budget!
Tja, das wird den Alex Amon, Mensch der nicht schreiben und nicht denken kann nicht retten. 🙂
Qwen 3.8 Resultate sehen wir diese Woche noch, falls das Amazon Management mehr, aber doch keine Mondpreise für die selbe Leistung zahlen möchte… 🙂
Es ist derartig mitleidserregend, Journalisten dabei zuzusehen, wie sie die einfachste Logik von Technologieentwicklung nicht begreifen…
1. Es wird nicht besser.
2. Faktor 10 bei der Preisentwicklung ist mit chinesischen Modellen locker wett zu machen.
3. Du kannst die selben Idioten angestellt lassen, die hier das Projekt in den Sand gesetzt haben, gib ihnen einfach das billigere Spielzeug
4. Das Management musst du tauschen, denn dort sitzen nur Idioten.
5. Genauso wie im deutschsprachigen Qualitätsjournalismus der schon wieder die Öffentlichkeit vor den Auswirkungen der KI Zukunft gerettet hat. 🙂
PS: Welcher Idiot verwendet für den tatsächlichen Task (Abgleich von 100.000 Autoren Bio snippets) hier Sonnet, und keine Armee von Microagents auf nem Flash Modell? Ah, Amazon.
Gut, aber diese Flashmodelle (284B/13A mit nativer Q8 Quant (150GB groß at Q4)), die können ja nichts. Wer würde die heutzutage schon nutzen wollen…
Wer?
Wir bewegen uns gerade in Richtung in 10 Jahren ist der Spiele-PC deines Sohnemanns schlauer und schneller als du - mit Tools…
https://old.reddit.com/r/LocalLLaMA/comments/1veow4b/deepseek_v4flash_284b_moe_at_33_toks_single_68/
Mit den üblichen LLM Pitfalls. Und das nicht wegen der Technologieentwicklung, sondern wegen dem was chinesische AI Buden aus der Modelentwicklung rausholen.
Und deren Iterationszyklus ist effing scary. Also im Sinne von, das war das Resultat eines top Models vor 8 Monaten. Und nächste Woche haben wir zwei chinesische Anbieter die das mit nem Flash Model können. Das Top End wächst mit den selben Problemen langsamer. Aber die open source Modelle holen mit einer Geschwindigkeit zu den Großen auf, die ist effing scary.
edit: Sowas:
