Zusammenfassung
- Mistral Large 4 ist seit dem 6. Oktober als öffentliche API-Vorschau verfügbar. Das Unternehmen erwartet die Gewichte bis Monatsende; am 8. Oktober ist der Eigenbetrieb durch Kunden noch eine Zukunftsoption.
- Die Modellseite nennt befristete Aktionspreise von 0,68 US-Dollar je Million Eingabetoken und 2,09 US-Dollar je Million Ausgabetoken, gegenüber Standardpreisen von 1,36 und 4,18 US-Dollar. Ein günstiger Test misst die API-Rechnung, nicht die Kosten des Eigenbetriebs.
- Käufer können jetzt repräsentative Arbeitsabläufe testen und nach Veröffentlichung von Dateien, Lizenz und technischen Angaben die Kosten je akzeptiertem Ergebnis und den nötigen Kontrollumfang vergleichen.
Zwei Zeitlinien für einen Start
Mistrals Ankündigung vom 6. Oktober setzt zwei Uhren in Gang. Die erste läuft bereits: Large 4 lässt sich über die Vorschau-API von Mistral Studio nutzen. Die zweite ist angekündigt: Die Gewichte sollen bis Ende des Monats folgen. Das sind keine gleichwertigen Zugangsformen. Bei der ersten betreibt Mistral das Modell, der Kunde kauft Inferenz. Bei der zweiten könnte der Kunde es selbst betreiben, sofern die Dateien tatsächlich erscheinen und die Bedingungen passen.
Die Reihenfolge ist wirtschaftlich relevant. Ein Unternehmen kann prüfen, ob das Modell einen konkreten Arbeitsablauf verbessert, bevor es über eine private Cloud oder eigene Server entscheidet. Das senkt die Kosten des ersten Lernschritts. Heute ist der Vergleich aber ein nutzungsabhängiger Dienst gegen die bisherige Alternative des Käufers, nicht gegen eine eigene Umgebung, die es noch nicht gibt.
Der Aktionspreis macht den ersten Test kalkulierbar. Mistrals Modellseite zeigt 0,68 US-Dollar je Million nicht zwischengespeicherter Eingabetoken und 2,09 US-Dollar je Million Ausgabetoken; die durchgestrichenen Standardpreise lauten 1,36 und 4,18 US-Dollar. Zwischengespeicherte Eingaben kosten separat 0,07 im Angebot und 0,14 zum Standardpreis. Das Changelog nennt einen Rabatt von 50 Prozent für zwei Wochen.
Beispielrechnung: Zehn Millionen nicht zwischengespeicherte Eingabetoken plus eine Million Ausgabetoken kosten zum Aktionspreis 8,89 US-Dollar, vor Wiederholungen, Werkzeugaufrufen, Steuern und Orchestrierung; zum Standardpreis wären es 17,78 US-Dollar. Das ist eine Rechenhilfe, keine Prognose.
Für den Käufer zählt nicht der Preis je Million Token allein. Entscheidend sind die Kosten je akzeptiertem Ergebnis mit den eigenen Promptlängen, Cache-Wiederholungen, Ausgabelängen, Werkzeugaufrufen, Wiederholungen und menschlicher Prüfung. Ein Agent, der eine Stunde arbeitet, kann eine andere Tokenmischung erzeugen als eine kurze Klassifikation. Muss eine misslungene Antwort wiederholt werden, ist ein günstiger Versuch noch keine günstige erledigte Aufgabe.
Ein Rang ersetzt keine Kaufentscheidung
Die frühen Tests zeigen unterschiedliche Stärken. Vals AI führt Large 4 in seinem Profil vom 7. Oktober mit 48,05 Prozent auf Rang 33 von 45 im Vals Index; das beste aufgeführte Einzelergebnis ist Rang 6 von 76 im Harvey’s Legal Agent Benchmark. Der Index kombiniert Aufgaben aus Finanzen, Programmierung, Recht und Steuern, gewichtet nach ihrem ungefähren Anteil am US-BIP. Vals bezeichnet ihn als Näherungswert und weist darauf hin, dass einzelne Tests unterschiedliche Anbieter und Parameter verwenden können. Das ist eine bestimmte Perspektive, keine allgemeine Qualitätsrangliste.
Unternehmen sollten deshalb ihre eigenen Aufgaben prüfen, statt die Markteinführung oder einen aggregierten Rang als Kaufbeleg zu nehmen. Mistral sagt, die Vorschau werde weiter verbessert; mit den Gewichten sollen zusätzliche Architektur-, Benchmark- und Post-Training-Details erscheinen. Le Monde berichtete zum Start, dass die Leistungsbehauptungen noch auf unabhängige Bestätigung warteten. Kunden können jetzt eigene API-Ergebnisse sammeln, sollten sie aber der getesteten Vorschauversion und Servicekonfiguration zuordnen.
Die künftige Option hat noch keinen Betriebspreis
Die offizielle Modellkarte nennt 52 Milliarden aktive Parameter, insgesamt 1,05 Billionen, einen Vision-Encoder mit 1,6 Milliarden und ein Kontextfenster von einer Million Token. Daraus lässt sich nicht ableiten, wie viel Speicher ein Kunde für ein bestimmtes Latenz- und Parallelitätsziel benötigt. Aktive Parameter je Token sind nicht gleich dem Speicherbedarf aller Gewichte. Präzision, Quantisierung, Speicherbandbreite, Routing, Kontextlänge und Inferenz-Stack zählen ebenfalls.
Die späteren Gewichte können einen Wert haben, aber nur unter bestimmten Bedingungen. Sie könnten Inferenz in einer privaten Cloud oder auf eigenen Servern ermöglichen, bestimmte Moderationseinstellungen verändern oder eine Ausweichmöglichkeit schaffen, falls sich der gehostete Zugang ändert. Zugleich gingen Aktualisierungen, Sicherheit, Skalierung, Verfügbarkeit und Störungsbehebung stärker auf den Kunden über. Ein Download macht den Betrieb nicht kostenlos.
Eine belastbare Reihenfolge: jetzt eine repräsentative Aufgabenmenge über die API testen und Qualität, Latenz sowie Tokenverbrauch festhalten. Prompts, Modellversion, Abnahmekriterien, Cache-Annahmen und Wiederholungen sollten gespeichert werden. Nach Veröffentlichung der Gewichte werden dieselben Aufgaben erneut ausgeführt und die Kosten je akzeptiertem Ergebnis verglichen, einschließlich Infrastruktur und Personal. Lizenz, Hardware, Sicherheit und Verfügbarkeit brauchen eigene Prüfungen.
Der Start ist also auf einer Seite bepreist, auf der anderen noch nicht. Die API macht aus der Bewertung schon heute eine Rechnung. Die Gewichte könnten später den Kontrollpunkt verschieben; was diese Kontrolle kostet und ob sie betrieblich besser ist, weiß der Käufer noch nicht.
Quellen: Mistrals Ankündigung; Modellkarte und Preise; Changelog; Vals-Modellprofil; Methodik des Vals Index; Le Monde zur Einführung.
Mitgliederbriefing
Detaillierter Profilkontext
Melden Sie sich mit der richtigen Mitgliedschaftsstufe an, um das vollständige Briefing und die Quellennotizen freizuschalten.
Nur für Strategic Circle
Strategic Circle
Offen für alle Leser. Schalten Sie Profil-Briefings nach Beitritt und Anmeldung frei.
Strategic Circle beitretenNur für Leadership Alliance
Leadership Alliance
Für qualifizierte Inhaber von IP-Assets und Management; melden Sie sich an, um Leadership-Alliance-Briefings freizuschalten.
Leadership Alliance beitreten
