KI-Hosting

Nutzen Sie KI-Funktionen auf Ihrem Hosting, ohne eine GPU zu mieten

Serverlose Inferenz bei offenen Modellen, abgerechnet pro Tausend Token über ein Guthaben, das Sie einsehen und deckeln können. Verwenden Sie Ihren eigenen Anbieterschlüssel oder geben Sie Zinn® AI-Guthaben aus – in beiden Fällen gilt derselbe Zähler und Ihre Anwendung befindet sich auf demselben Konto.

Jetzt startenTarife ab 12,99 € im Monat

Inferenz, die Sie sich leisten können, im Betrieb zu lassen

Eine gemietete GPU wird unabhängig davon berechnet, ob sie genutzt wird oder nicht, weshalb die meisten KI-Funktionen nie über einen Prototyp hinauskommen. Serverless Inference wird nach den tatsächlichen Token berechnet, sodass eine Funktion, die zweimal am Tag genutzt wird, auch genau so viel kostet wie zwei Nutzungen. Die Modelle sind Open-Source-Modelle – Llama, Mistral und deren Nachfolger –, die über unser AI Gateway bereitgestellt werden. Dieses kümmert sich um Caching und Failover zwischen Anbietern, sodass ein schlechter Start in den Tag bei einem einzelnen Upstream-Anbieter nicht zu Ihrem Ausfall wird.

Ein Meter, egal welchen Schlüssel Sie verwenden

Sie können Ihren eigenen Anbieter-Schlüssel verwenden; in diesem Fall bezahlen Sie diesen Anbieter direkt, und wir haben mit der Rechnung nichts zu tun. Oder Sie nutzen bei uns gekaufte Zinn® AI-Guthabenpunkte. Was nicht passieren kann, ist, dass Sie doppelt bezahlen, da beide Wege an einem Ort mit einer einzigen Gesamtsumme und einem Limit erfasst werden – die von Ihnen festgelegte Zahl stoppt die Ausgaben, unabhängig davon, welcher Schlüssel die Anfrage bearbeitet hat.

In jedem KI-Tarif enthalten

  • Ein monatliches Kontingent an KI-Guthaben und ein selbst festgelegtes Ausgabenlimit
  • Verwenden Sie stattdessen Ihren eigenen Anbieter-Schlüssel ohne zusätzliche Kosten
  • SSH, Git und geplante Aufgaben, sodass die das Modell aufrufende Anwendung ebenfalls hier liegt
  • Kostenlose SSL-Zertifikate, tägliche Backups und On-Demand-Snapshots

Tarife und Preise

Drei Tarife auf unserer eigenen Infrastruktur. Jeder Tarif umfasst SSH, Git, geplante Aufgaben sowie ein monatliches Kontingent an KI-Guthaben.

Zinn® AI Start

12,99 €/Monat

oder 128,99 € im Jahr

NVMe-Speicher
25 GB
Bandbreite
1 TB

Jetzt starten

Zinn® AI Builder

24,99 €/Monat

oder 248,99 € im Jahr

NVMe-Speicher
100 GB
Bandbreite
5 TB

Jetzt starten

Zinn® AI Scale

85,99 €/Monat

oder 859,99 € im Jahr

NVMe-Speicher
500 GB
Bandbreite
25 TB

Jetzt starten

Betrieben zu 100 % mit erneuerbaren Energien

Jeder Server, den wir betreiben, für jedes Produkt, wird mit Strom aus erneuerbaren Quellen betrieben. Nicht nachträglich kompensiert – sondern direkt so bezogen.

  • 100 % Ökostrom für all unser Hosting
  • Rechenzentren mit einer PUE von 1,1 bis 1,2 arbeiten
  • Websites auf unserer Shared-Plattform bestehen die Prüfungen der Green Web Foundation – eine unabhängige Prüfstelle, die Sie selbst verifizieren können.

Erfahren Sie, wie wir die Plattform betreiben

Fragen vor dem Kauf

Brauche ich eine GPU, oder stellen Sie mir eine zur Verfügung?

Keines von beidem. Inference läuft auf serverbasierten Open-Model-Endpoints und wird pro 1.000 Token abgerechnet, sodass kein Computer reserviert werden muss und während der Leerlaufzeiten keine Kosten anfallen. Dedizierte GPU-Kapazität bieten wir derzeit nicht an – das sagen wir Ihnen lieber offen, als Ihnen eine zu vermieten, die Sie nicht benötigen.

Kann ich meinen eigenen OpenAI- oder Anthropic-Schlüssel verwenden?

Ja. Fügen Sie ihn unter den KI-Anmeldeinformationen hinzu, und Anfragen werden mit Ihrem Schlüssel gestellt und Ihnen von diesem Anbieter in Rechnung gestellt. Ihr Zinn®-Guthaben bleibt davon unberührt. Sie können jederzeit zwischen Ihrem Schlüssel und unseren Guthaben wechseln, ohne Ihren Code zu ändern.

Woher weiß ich, was es mich kostet, bevor die Rechnung eintrifft?

Die Nutzung wird pro 1.000 Token berechnet, und der aktuelle Stand wird in Echtzeit auf Ihrem Dashboard angezeigt, nicht erst am Monatsende. Sie legen ein Limit fest; wenn dieses erreicht ist, stoppen die Ausgaben, anstatt weiterzulaufen und Sie zu überraschen.

Werden meine Daten zum Training von Modellen verwendet?

Nein. Anfragen laufen über unser Gateway zum Modell-Anbieter und fließen nicht in das Training ein. Wenn Sie Ihren eigenen Schlüssel verwenden, gelten für diese Anfragen die Bedingungen, die Sie mit diesem Anbieter vereinbart haben.

Was ist noch nicht enthalten?

Künstliche-Intelligenz-Umgebungen mit einem Klick wie Jupyter, PyTorch und Ollama sowie das Hosting für langlebige Agenten sind nicht Teil dieser Tarife. Sie erfordern eine Maschine, auf der Sie Root-Zugriff haben, anstatt eines Shared-Hosting-Kontos; daher gehören sie zu Zinn® Private Cloud und wir lassen sie lieber von dieser Seite weg, als Ihnen etwas zu verkaufen, das dieser Tarif nicht ausführen kann.