KI-Inferenz

Ihrer Anwendung Superkräfte verleihen KI mit wenig Aufwand integrieren

Nutzen Sie Open-Source-Sprachmodelle über unsere OpenAI-kompatible API.

  • Geringere Kosten: nur Basis-URL und API-Schlüssel ändern
  • Eigene Infrastruktur in Europa

Was Sie damit machen können

Ihre Anwendung um KI erweitern

Chat und dialogfähige Assistenten

Chatbots und Support-Agenten, die mit dem Kontext Ihres Geschäfts antworten.

Textgenerierung

Texte verfassen, zusammenfassen, umschreiben, korrigieren und Vorschläge zur Autovervollständigung.

Klassifizierung und Stimmungsanalyse

Kategorisieren Sie Tickets, E-Mails oder Bewertungen und erkennen Sie den Ton automatisch.

Maschinelle Übersetzung

Übersetzen Sie Inhalte von einer Sprache in die andere und passen Sie sie an – Sinn und Ton bleiben erhalten.

Code

Autovervollständigung und Generierung, Erklärung, Review, Refactoring und Testgenerierung.

Datenextraktion

Machen Sie aus Rechnungen, E-Mails oder Dokumenten strukturierte Felder, fertig für Ihre Datenbank.

Fähigkeiten

Was unsere API kann

KI mit wenig Aufwand in Ihre Anwendung integrieren

Tragen Sie in einer beliebigen OpenAI-kompatiblen Bibliothek die Basis-URL von Nebux und Ihren API-Schlüssel ein – ohne Code umzuschreiben.

Code ansehen

Streaming in Echtzeit

Zeigen Sie die Antwort, während sie entsteht, Token für Token. Oder holen Sie sie sich am Stück, wenn Ihnen das lieber ist.

Code ansehen

Garantierte JSON-Ausgabe

Erzwingen Sie als Antwort gültiges JSON nach Ihrem Schema.

Code ansehen

Funktionsaufrufe

Das Modell ruft bei Bedarf Ihre Tools und Funktionen auf und antwortet mit den Daten, die sie zurückgeben.

Code ansehen

Was Sie erwarten können

Ohne Kleingedrucktes

Flexible Abrechnung, ohne Lock-in

Sie zahlen nur, was Sie nutzen, zu klaren Preisen pro Token: ohne monatliche Grundgebühren, versteckte Kosten oder reservierte Kapazität, die Sie nicht nutzen.

Verbrauch im Detail

Sie wissen jederzeit, wie viel Sie ausgeben und für welche Modelle – Monat für Monat und im Vergleich zum Vormonat.

Keine Datenspeicherung

Wir protokollieren keine Prompts und trainieren nicht mit Ihren Daten. Was Sie senden, wird nie aufbewahrt.

Auf eigener Infrastruktur

Die Modelle laufen auf eigener Hardware in unseren Räumen in Valencia (Spanien). Ihre Prompts gehen nie über Drittanbieter.

Playground

Ausprobieren und justieren, bevor Sie Code schreiben

Preise

Nur für die Tokens zahlen, die Sie nutzen

Qwen 3 14B

qwen3-14b

Ein Token entspricht etwa 4 Zeichen, eine Million Tokens rund 700.000 Wörtern: zweimal der ganze Don Quijote, für etwa 22 Cent.

Eingabe
0,12 €
pro 1 Mio. Tokens
Ausgabe
0,22 €
pro 1 Mio. Tokens

Transparente Preise pro Token: ohne monatliche Grundgebühren.

Die Preise gelten für .

Erste Schritte

In Minuten loslegen

  1. 1

    Konto erstellen

    Registrieren Sie sich in Sekunden.

  2. 2

    Zahlungsmethode hinzufügen

    Wir buchen nachträglich im Folgemonat ab; Sie zahlen nur, was Sie verbrauchen.

  3. 3

    Ihren API-Schlüssel holen

    Erzeugen Sie den Schlüssel im Dashboard. Er ist sofort einsatzbereit.

  4. 4

    Ihr SDK verbinden

    Wenn Sie schon ein OpenAI-kompatibles SDK nutzen, ändern Sie nur die Basis-URL und den API-Schlüssel.

Bereit, KI-Inferenz auszuprobieren?

Oder wir übernehmen das für Sie

Sie wollen sich lieber auf Ihr Produkt konzentrieren? Wir warten Ihre Systeme und entwickeln sie weiter – wie ein weiteres Team in Ihrem Unternehmen.

Mehr zur Managed Cloud