Skip to main content
Midjourney ist eine generative KI-Plattform, die nach GPU-Zeit statt nach Bildanzahl abrechnet. Ein komplexes Rendering in hoher Auflösung benötigt mehr GPU-Zeit und damit mehr vom Kontingent als ein schneller Entwurf mit niedriger Auflösung.

Wie Midjourney abrechnet

Jedes Midjourney-Abonnement umfasst ein monatliches Kontingent an “Fast GPU Time”, also der Rechenzeit, die für deine Generierungen aufgewendet wird. Die folgenden Zahlen stammen aus dem Midjourney-Vergleich der Pläne.
  1. Preisstufen: Midjourney bietet vier Abonnementstufen von $10 bis $120 pro Monat an. Jede umfasst eine festgelegte Menge an Fast GPU Time.
  2. Relax Mode: Die Standard- und höheren Pläne umfassen unbegrenzte Bildgenerierungen in einer Warteschlange mit niedriger Priorität, sobald die Fast Time aufgebraucht ist, sodass Nutzer nicht an eine harte Grenze stoßen.
  3. Zusätzliche GPU-Stunden: Nutzer können zusätzliche Fast GPU Time für $4 pro Stunde kaufen, wenn sie nach dem Aufbrauchen ihres monatlichen Kontingents schnelle Ergebnisse benötigen.
  4. Messung in GPU-Sekunden: Die Nutzung wird anhand der GPU-Zeit gemessen, die jede Generierung benötigt. Daher kosten komplexe Renderings mehr als einfache Entwürfe.
  5. Community-Kreislauf: Nutzer können durch das Bewerten von Bildern kostenlose GPU-Zeit verdienen, was außerdem beim Trainieren der Midjourney-Modelle hilft.

Was macht es einzigartig?

Das Midjourney-Modell verknüpft die Kosten für Nutzer mit den von ihnen verbrauchten Ressourcen:
  • Abrechnung nach GPU-Zeit: Komplexe Renderings werden höher bepreist als einfache Entwürfe, entsprechend ihren Rechenkosten.
  • Relax Mode ist eine unbegrenzte Ausweichoption, die die Abwanderung reduziert, da Nutzer auch nach dem Aufbrauchen des monatlichen Kontingents weiterhin Zugriff haben.
  • Die Aufteilung in Fast und Relax fördert Upgrades, indem sie Nutzern, die Wert auf Geschwindigkeit legen, eine priorisierte Verarbeitung anbietet.
  • Zusätzliche GPU-Stunden geben Power-Usern untermonatlich die Möglichkeit, ihre Kapazität mit hoher Priorität aufzustocken.

Mit Dodo Payments erstellen

Du kannst dieses Modell mit Dodo Payments umsetzen, indem du Abonnements, Nutzungsmetriken und Logik in deiner Anwendung kombinierst.
1

Create a Usage Meter

Erstelle eine Metrik, die die von jedem Kunden verwendeten GPU-Sekunden erfasst.
  • Event name: gpu.fast_seconds
  • Aggregation: Sum, mit gpu_seconds als Over Property
Sende Events nur für Generierungen im Fast-Modus. Generierungen im Relax Mode werden nicht für die Abrechnung erfasst.
2

Create Subscription Products with Usage Pricing

Erstelle deine Abonnementprodukte und füge die Nutzungsmetrik mit einem Free Threshold hinzu, der dem Fast-GPU-Kontingent des Plans entspricht.Setze den Preis pro Einheit in jedem Plan auf $0, damit die Nutzung oberhalb des Schwellenwerts nicht berechnet wird. Dodo Payments stoppt die Nutzung nicht am Schwellenwert. Deine Anwendung setzt die harte Obergrenze des Basic-Plans durch und leitet die anderen Pläne an Relax Mode weiter, sobald die Metrik den Schwellenwert überschreitet.
3

Implement Application-Level Relax Mode

Relax Mode ist keine Abrechnungsfunktion. Deine Anwendung sendet Anfragen an eine langsamere Warteschlange, wenn die Dodo Payments-Nutzungsmetrik anzeigt, dass der Kunde den Schwellenwert des Plans überschritten hat.
4

Send Usage Events (Fast Mode Only)

Sende nur dann ein Nutzungs-Event an Dodo Payments, wenn eine Generierung im Fast-Modus ausgeführt wird.
5

Sell Extra Fast Hours (One-Time Top-Up)

Erstelle ein einmaliges Zahlungsprodukt namens “Extra Fast GPU Hour” zum Preis von $4. Wenn ein Kunde es kauft, erhöhe den Schwellenwert in deiner Anwendung um 3.600 Sekunden pro gekaufter Stunde.
6

Create Checkout for Subscription

Erstelle eine Checkout-Session für den Abonnementplan.

Mit dem Time Range Ingestion Blueprint beschleunigen

Der Time Range Ingestion Blueprint stellt Hilfsfunktionen für die abrechnungsbasierte Erfassung von Zeitdauern bereit und verkürzt dadurch die Implementierung der GPU-Zeiterfassung.
Der Blueprint erstellt das Event und übermittelt die Dauer in seinen Metadaten. Du stellst die Kunden-ID und die verstrichene Zeit bereit. Dieses Beispiel sendet durationMs. Setze daher die Over Property der Metrik auf durationMs oder sende durationSeconds, um eine Metrik abzugleichen, die Sekunden verwendet.
Der Time Range Blueprint akzeptiert Zeitdauern in Millisekunden, Sekunden oder Minuten. In der vollständigen Blueprint-Dokumentation findest du alle Optionen für Zeitdauern und Best Practices.

Die Fast-vs.-Relax-Architektur

Die beiden Warteschlangen funktionieren, indem jede Anfrage anhand der aktuellen Nutzung des Kunden weitergeleitet wird.
  1. Alle Anfragen durchlaufen deine Anwendung.
  2. Die Anwendung vergleicht die Fast-GPU-Nutzung des Kunden mit dem kostenlosen Schwellenwert des Plans.
  3. Liegt die Nutzung unter dem Schwellenwert, wird die Anfrage an die Fast-Warteschlange weitergeleitet und erfasst.
  4. Liegt die Nutzung über dem Schwellenwert, wird die Anfrage an die Relax-Warteschlange weitergeleitet, die nicht erfasst wird und eine niedrigere Priorität hat.
  5. Der Basic-Plan verfügt über keine Relax-Ausweichoption. Daher blockiert die Anwendung Anfragen, sobald das Limit erreicht ist.
Relax Mode ist ein Muster auf Anwendungsebene und keine Abrechnungsfunktion von Dodo Payments. Dodo Payments erfasst die Fast-GPU-Nutzung deiner Kunden. Deine Anwendung entscheidet, ob der Nutzer blockiert oder an eine langsamere Warteschlange weitergeleitet wird.

Verwendete zentrale Dodo-Funktionen

Subscriptions

Verwalte wiederkehrende Abrechnung und Planstufen.

Usage-Based Billing

Erfasse und berechne die tatsächliche Ressourcennutzung.

Event Ingestion

Sende Nutzungs-Events mit hohem Volumen an die Dodo Payments API.

Meters

Lege fest, wie Nutzungs-Events aggregiert und abgerechnet werden.

One-Time Payments

Verkaufe zusätzliche Stunden oder Aufstockungen als einmalige Käufe.

Time Range Blueprint

Vereinfache die GPU-Zeiterfassung mit Hilfsfunktionen für Zeitdauern.
Zuletzt geändert am 26. September 2026