Zum Inhalt springen
THE GUILD
0%
SERVICES PRODUCTS CAREERS ABOUT BLOG FAQ CONTACT

Privater LLM-PoC · 30 Tage, Festpreis

Beweisen Sie, dass ein privates LLM auf Ihren Daten funktioniert, in 30 Tagen — bevor Sie sich auf Hardware festlegen.

Genauigkeit und Latenz werden anhand Ihrer eigenen Dokumente und Arbeitslast gemessen, nicht anhand eines generischen Benchmarks. Sie erhalten eine schriftliche Empfehlung zu Bereitstellungsform, Modellgröße und Kosten für den vollständigen Aufbau — bevor Sie in einen GPU-Server investieren.

Privaten LLM-PoC starten Zunächst kostenloses Erstgespräch · NDA, bevor Daten den Besitzer wechseln · Antwort innerhalb 1 Werktags

Häufige Situationen

„Wir wollen ein privates LLM. Wir wollen aber nicht in einen GPU-Server investieren, nur um herauszufinden, ob es tatsächlich funktioniert."

Ein privater LLM-PoC ist für den Moment vor der Verpflichtung zu Hardware oder einem Hosting-Vertrag gedacht — wenn die offene Frage noch lautet „erfüllt dies unsere Genauigkeitsanforderungen", und Sie eine Antwort anhand Ihrer eigenen Daten wollen, nicht anhand einer Anbieter-Demo.

Situation 01

Ein vollständiger 8-GPU-Aufbau erreicht sechsstellige Beträge, in USD. Das ist eine große Verpflichtung, bevor überhaupt jemand die Genauigkeit anhand Ihrer eigenen Dokumente gemessen hat.

Siehe die Marktrealität bei der Ausrüstung auf der Infrastruktur-Servicepage — dieser PoC existiert, damit Sie das nicht zuerst ausgeben müssen.
Situation 02

Die IT-Abteilung hat bereits versucht, ein offenes Modell selbst zu hosten. Es blieb entweder hinter der gewohnten Genauigkeit zurück oder benötigte mehr VRAM als erwartet.

Modellgröße und Quantisierung sind genau das, was der PoC anhand Ihrer echten Arbeitslast testet.
Situation 03

Selbst gehostet, verwaltet oder gemeinsam genutzt — drei Wege, dies zu betreiben, und niemand intern kann mit Sicherheit sagen, welcher für Ihr Nutzungsmuster am günstigsten ist.

Keine der drei Optionen gewinnt auf jeder Skala. Der PoC-Bericht sagt Ihnen, welche für Sie.

Vorher → Nachher

Was sich in 30 Tagen ändert.

Der Liefergegenstand ist eine Entscheidung, nach der Sie handeln können, keine Präsentation darüber, was ein privates LLM theoretisch leisten könnte.

Tag 0 · Vorher
  • Keine Hardware, und keine Genauigkeitszahlen, gemessen anhand Ihrer eigenen Dokumente.
  • Drei Bereitstellungsformen nur auf dem Papier — selbst gehostet, verwaltet, gemeinsam genutzt — ohne Grundlage für eine Wahl.
  • Ein GPU-Markt, der sich schnell genug bewegt, dass das Angebot vom letzten Quartal bereits veraltet sein könnte.
  • Keine Schätzung, was ein vollständiger Aufbau für Ihren spezifischen Anwendungsfall tatsächlich kosten würde.
Tag 30 · Nachher
  • Ein schriftlicher Bericht: machbar, bedingt machbar oder nicht machbar — speziell für Ihre Arbeitslast.
  • Genauigkeit und Latenz, gemessen anhand Ihrer eigenen Dokumente und Fragen.
  • Eine empfohlene Modellstufe und Bereitstellungsform, mit der jeweiligen Begründung.
  • Eine Kostenschätzung für den vollständigen Aufbau, und die PoC-Gebühr wird bei Fortsetzung darauf angerechnet.

Warum dieser PoC, vor einem Hardware-Angebot

Es geht um eine vertretbare Entscheidung, keine Demo.

Ein privater LLM-PoC ist darauf ausgelegt, eine Frage ehrlich zu beantworten: Erfüllt dies Ihre Genauigkeits- und Latenzanforderungen, anhand Ihres eigenen Materials, zu Kosten, die für Ihre Nutzung sinnvoll sind.

01 · Keine Hardware erforderlich

Getestet auf Infrastruktur, die wir bereits betreiben

Der PoC läuft auf der eigenen internen Umgebung von LLL. Sie müssen keinen GPU-Server bereitstellen, um herauszufinden, ob die Antwort ja lautet.

02 · Ihre Daten, kein Benchmark

Genauigkeit gemessen anhand Ihrer eigenen Dokumente

Das Evaluationsset wird aus Ihrem Material und Ihren Fragen erstellt — nicht aus einem generischen öffentlichen Benchmark, der Ihre Domäne oder Ihren Sprachgebrauch möglicherweise nicht widerspiegelt.

03 · Eine Empfehlung, kein Verkaufsgespräch

Bereitstellungsform und Modellgröße, mit Begründung

Der Bericht nennt eine konkrete Modellstufe und Bereitstellungsform und erklärt, warum — einschließlich der Aussage, falls ein privates LLM für das Getestete nicht die richtige Wahl ist.

So funktioniert es · 4 wöchentliche Phasen

Dreißig Tage vom Kickoff bis zur schriftlichen Empfehlung.

NDA und DPA werden unterzeichnet, bevor irgendeines Ihrer Dokumente oder Daten für die Evaluation verwendet wird.

Woche 1

Kickoff & Definition der Arbeitslast

Definition des Anwendungsfalls, der Dokumente und Fragen, anhand derer das Modell getestet wird, und was „machbar" für Ihre Genauigkeits- und Latenzanforderungen bedeutet — schriftlich, bevor die Tests beginnen.

PM + Ingenieur + Kunde · 60 Minuten

Woche 2

Vorauswahl von Modell & Bereitstellungsform

Basierend auf der definierten Arbeitslast wird eine Modellstufe vorausgewählt (ausgehend vom Standard der Klasse 70B) und in unserer eigenen Betriebsumgebung für Tests bereitgestellt.

In dieser Phase kein Hardwarekauf

Woche 3

Aufbau & Test

Verbindung des vorausgewählten Modells mit Ihrem Material (RAG, wo relevant) und Durchführung von Genauigkeitstests anhand Ihres eigenen Evaluationssets, sowie Latenz und Durchsatz unter einer repräsentativen Last.

Ergebnisse gemessen, nicht geschätzt

Woche 4

Bericht & Empfehlung

Schriftlicher Validierungsbericht: machbar, bedingt machbar oder nicht machbar. Empfohlene Modellstufe und Bereitstellungsform, plus eine Kostenschätzung für den vollständigen Aufbau.

Gebühr für vollständigen Aufbau wird bei Fortsetzung angerechnet

Was der PoC tatsächlich beseitigt

Die Verpflichtung, die Sie noch nicht eingehen.

Dies sind die drei Dinge, die ein privater LLM-PoC beseitigen soll, bevor Sie etwas Größeres unterschreiben.

0Für den PoC gekaufte Hardware

Die Tests laufen auf Infrastruktur, die LLL bereits betreibt. Sie verpflichten sich erst zu Hardware, nachdem der Bericht Ihnen mitgeteilt hat, welche Form und Größe tatsächlich passen.

FP8Quantisierungsuntergrenze, unverändert getestet

Dieselbe Untergrenze, die wir in jedem empfohlenen Aufbau verwenden — unsere Tests zeigen einen messbaren Genauigkeitsabfall bei japanischsprachigen Geschäftsaufgaben darunter, daher testen oder liefern wir standardmäßig nichts Niedrigeres.

3Verglichene Bereitstellungsformen

Selbst gehostet, verwaltet und gemeinsam genutzt — jede hat eine Skala, bei der sie am günstigsten ist. Der Bericht sagt Ihnen, welche für Ihre Arbeitslast, nicht standardmäßig.

Worauf Sie sich verlassen können

Fünf Regeln, die jeden privaten LLM-PoC bestimmen.

Betriebsregeln, keine ambitionierten Ziele — dieselben bei jedem Engagement.

  • NDA vor Daten

    NDA und DPA werden unterzeichnet, bevor irgendeines Ihrer Dokumente, Daten oder Fragen für die Evaluation verwendet wird — einschließlich während des kostenlosen Erstgesprächs.

  • Getestet an Ihrem eigenen Material

    Die Genauigkeit wird anhand Ihrer Dokumente und Fragen geprüft, nicht anhand eines generischen öffentlichen Benchmarks, der Ihre Domäne oder Ihren Sprachgebrauch möglicherweise nicht widerspiegelt.

  • FP8-Quantisierungsuntergrenze

    Wir testen oder empfehlen nichts unterhalb von FP8 für geschäftskritische Antworten. Falls ein Anwendungsfall es wirklich nicht benötigt, sagt der Bericht dies — es ist kein Upselling.

  • Volle Anrechnung auf den Aufbau

    Wenn Sie zu einem vollständigen Aufbau übergehen, wird die PoC-Gebühr von $6.000 (oder $3.000) vollständig von dieser Rechnung abgezogen. Kein Gutschein, kein Verfallsdatum.

  • Ehrliches No-Go

    Falls die Arbeitslast nicht zu einem privaten LLM passt — die Genauigkeit reicht nicht aus, die Wirtschaftlichkeit stimmt nicht, eine öffentliche API ist tatsächlich die bessere Wahl —, sagt der Bericht dies, statt trotzdem einen Aufbau zu empfehlen.

Häufig gestellte Fragen

Fünf Fragen, bevor Sie beginnen.

Ihr spezifischer Fall ist nicht dabei? Ergänzen Sie ihn im Nachrichtenfeld des Formulars unten. Wir antworten innerhalb eines Werktags.

Auf welcher Hardware läuft der PoC tatsächlich?
Der PoC läuft auf Infrastruktur, die LLL bereits intern aufbaut und betreibt. Sie müssen keinen Server kaufen, um herauszufinden, ob ein privates LLM zu Ihrem Anwendungsfall passt — der abschließende Bericht sagt Ihnen, was Sie kaufen, mieten oder von uns hosten lassen sollten, falls Sie sich für die Fortsetzung entscheiden.
Welche Modellgröße werden Sie testen?
Wir beginnen mit dem empfohlenen Standard, einem Dense-Modell der Klasse 70B (etwa 70GB in FP8), dimensioniert, um ein unternehmensweites ChatGPT-Äquivalent auf einer Maschine anzunähern. Falls Ihre Arbeitslast weniger (die 32B-Untergrenze) oder mehr (122B-A10B oder 400B-Klasse-MoE für hohe gleichzeitige Nutzung) benötigt, sagt der Bericht dies mit Begründung, nicht als Standard-Upselling.
Warum FP8 und keine kleinere Quantisierung?
Unsere Standardkonfigurationen halten FP8 als Untergrenze. Eine weitere Quantisierung (zum Beispiel auf 4-Bit) verschlechtert in unseren Tests die Genauigkeit bei japanischsprachigen Geschäftsaufgaben messbar, daher liefern wir dies nicht als Standardempfehlung, auch wenn es die Hardwarerechnung senken würde.
Wird die Gebühr wirklich vom vollständigen Aufbau abgezogen?
Ja. Die vollen $6.000 (oder $3.000 für Teams mit 50 oder weniger Mitarbeitenden) werden bei Fortsetzung von den Kosten des vollständigen Aufbaus abgezogen. Kein Gutschein, kein Verfallsdatum — es wird von der nächsten Rechnung abgezogen.
Bedeutet „privat", dass nichts unser Netzwerk verlässt?
Es bedeutet, dass die Inferenz — der Prompt und die generierte Antwort — auf Servern innerhalb Ihrer eigenen Infrastruktur verarbeitet wird, statt an einen öffentlichen KI-Dienst für allgemeine Zwecke gesendet zu werden. Es ist keine Aussage über Ihren Netzwerkperimeter, VPNs oder Zugriffskontrollen, die eine separate Designentscheidung bleiben, unabhängig davon, wo das Modell selbst läuft.

Privaten LLM-PoC starten

Erzählen Sie uns von Ihrer Arbeitslast. Erhalten Sie eine kostenlose Erstbewertung.

Wir antworten innerhalb eines Werktags mit einer kostenlosen ersten Einschätzung zur Machbarkeit, bevor Sie sich auf die $6.000 (oder $3.000) festlegen.

  • NDA unterzeichnet vor jeder technischen Diskussion — einschließlich der kostenlosen Bewertung.
  • Für die Durchführung des PoC selbst ist kein Hardwarekauf erforderlich.
  • Falls ein privates LLM nicht die richtige Wahl ist, sagen wir das im Bericht.
  • $6K ($3K ≤50 Mitarbeitende)
  • 30 Tage
  • 0 Hardware erforderlich
  • Anrechnung auf vollständigen Aufbau

Kostenlose Erstbewertung anfordern

Pflichtfelder sind mit * markiert

Mit dem Absenden stimmen Sie unserem Datenschutzhinweis zu.