PoC LLM Privé · 30 jours, prix fixe
Prouvez qu'un LLM privé fonctionne sur vos données, en 30 jours — avant de vous engager sur du matériel.
Précision et latence mesurées sur vos propres documents et charge de travail, pas sur un benchmark générique. Vous obtenez une recommandation écrite sur la forme de déploiement, la taille de modèle et le coût de la construction complète — avant de dépenser pour un serveur GPU.
Situations courantes
« Nous voulons un LLM privé. Nous ne voulons pas dépenser pour un serveur GPU pour savoir si cela fonctionne réellement. »
Un PoC LLM Privé est fait pour le moment précédant l'engagement sur du matériel ou un contrat d'hébergement — quand la question ouverte reste « cela atteint-il notre seuil de précision », et que vous voulez une réponse sur vos propres données, pas la démonstration d'un fournisseur.
Une construction complète à 8 GPU atteint six chiffres, en USD. C'est un engagement important avant que quiconque n'ait mesuré la précision sur vos propres documents.
Voir la réalité du marché des équipements sur la page de service infrastructure — ce PoC existe pour que vous n'ayez pas à dépenser cela d'abord.Le service informatique a déjà essayé d'auto-héberger un modèle ouvert. Soit il n'a pas atteint la précision à laquelle les équipes sont habituées, soit il a nécessité plus de VRAM que prévu.
La taille du modèle et la quantification sont exactement ce que le PoC teste sur votre charge de travail réelle.Auto-hébergé, géré, ou partagé — trois façons de faire fonctionner cela, et personne en interne ne peut dire avec confiance laquelle est la moins chère pour votre profil d'utilisation.
Aucune des trois ne l'emporte à toutes les échelles. Le rapport de PoC indique laquelle, pour vous.Avant → Après
Ce qui change en 30 jours.
Le livrable est une décision sur laquelle vous pouvez agir, pas une présentation sur ce qu'un LLM privé pourrait théoriquement faire.
- Aucun matériel, et aucun chiffre de précision mesuré sur vos propres documents.
- Trois formes de déploiement sur le papier — auto-hébergée, gérée, partagée — sans base pour en choisir une.
- Un marché du GPU évoluant assez vite pour que le devis du trimestre dernier soit peut-être déjà dépassé.
- Aucune estimation du coût réel d'une construction complète pour votre cas d'usage spécifique.
- Un rapport écrit : réalisable, réalisable sous conditions, ou non réalisable — spécifique à votre charge de travail.
- Précision et latence mesurées sur vos propres documents et questions.
- Un palier de modèle et une forme de déploiement recommandés, avec la justification de chacun.
- Une estimation de coût pour la construction complète, et les frais de PoC crédités sur celle-ci si vous poursuivez.
Pourquoi ce PoC, avant un devis matériel
L'objectif est une décision que vous pouvez défendre, pas une démo.
Un PoC LLM privé est conçu pour répondre honnêtement à une question : cela atteint-il votre seuil de précision et de latence, sur votre propre contenu, à un coût qui a du sens pour votre usage.
Testé sur une infrastructure que nous exploitons déjà
Le PoC s'exécute sur l'environnement interne propre à LLL. On ne vous demande pas de provisionner un serveur GPU pour savoir si la réponse est oui.
Précision mesurée sur vos propres documents
L'ensemble d'évaluation est constitué à partir de votre contenu et de vos questions — pas d'un benchmark public générique qui pourrait ne pas refléter votre domaine ou votre usage de la langue.
Forme de déploiement et taille de modèle, avec justification
Le rapport nomme un palier de modèle et une forme de déploiement précis et en explique la raison — y compris en indiquant si un LLM privé n'est pas le bon choix pour ce que vous avez testé.
Fonctionnement · 4 phases hebdomadaires
Trente jours du lancement à la recommandation écrite.
NDA et DPA sont signés avant que l'un de vos documents ou l'une de vos données ne soit utilisé dans l'évaluation.
Lancement & définition de la charge de travail
Définition du cas d'usage, des documents et questions sur lesquels le modèle sera testé, et de ce que « réalisable » signifie pour vos exigences de précision et de latence — par écrit, avant le début des tests.
PM + ingénieur + client · 60 minutes
Présélection du modèle & de la forme de déploiement
Sur la base de la charge de travail définie, présélection d'un palier de modèle (à partir du choix par défaut classe 70B) et provisionnement sur notre propre environnement d'exploitation pour les tests.
Aucun achat de matériel à ce stade
Construction & test
Connexion du modèle présélectionné à votre contenu (RAG le cas échéant) et exécution de tests de précision sur votre propre ensemble d'évaluation, ainsi que de la latence et du débit sous une charge représentative.
Résultats mesurés, pas estimés
Rapport & recommandation
Rapport de validation écrit : réalisable, réalisable sous conditions, ou non réalisable. Palier de modèle et forme de déploiement recommandés, plus une estimation de coût pour la construction complète.
Frais crédités sur la construction complète si vous poursuivez
Ce que le PoC élimine réellement
L'engagement que vous ne prenez pas encore.
Voici les trois éléments qu'un PoC LLM privé est conçu pour éliminer avant que vous ne signiez quelque chose de plus important.
Les tests s'exécutent sur une infrastructure déjà exploitée par LLL. Vous ne vous engagez sur du matériel qu'après que le rapport vous a indiqué quelle forme et quelle taille conviennent réellement.
Le même seuil que nous utilisons dans chaque construction recommandée — nos tests montrent une baisse mesurable de précision sur les tâches professionnelles en japonais en dessous, nous ne testons ni ne livrons donc plus bas par défaut.
Auto-hébergée, gérée et partagée — chacune a une échelle où elle est la moins chère. Le rapport indique laquelle pour votre charge de travail, pas par défaut.
Ce sur quoi vous pouvez compter
Cinq règles qui régissent chaque PoC LLM Privé.
Des règles opérationnelles, pas des objectifs ambitieux — les mêmes à chaque mission.
NDA avant les données
NDA et DPA sont signés avant que l'un de vos documents, données ou questions ne soit utilisé pour l'évaluation — y compris pendant l'appel initial gratuit.
Testé sur votre propre contenu
La précision est vérifiée sur vos documents et questions, pas sur un benchmark public générique qui pourrait ne pas refléter votre domaine ou votre usage de la langue.
Seuil minimal de quantification FP8
Nous ne testons ni ne recommandons en dessous de FP8 pour des réponses destinées à l'entreprise. Si un cas d'usage n'en a réellement pas besoin, le rapport le précise — ce n'est pas une vente incitative.
Crédit intégral sur la construction
Si vous poursuivez vers une construction complète, les frais de PoC de $6,000 (ou $3,000) sont intégralement déduits de cette facture. Aucun bon d'achat, aucune expiration.
Refus honnête
Si la charge de travail ne convient pas à un LLM privé — précision insuffisante, économie non viable, une API publique étant réellement plus adaptée — le rapport le précise au lieu de recommander une construction malgré tout.
FAQ
Cinq questions avant de commencer.
Votre cas particulier n'y figure pas ? Ajoutez-le dans le champ message du formulaire ci-dessous. Nous répondons sous un jour ouvré.
Sur quel matériel le PoC fonctionne-t-il réellement ?
Quelle taille de modèle allez-vous tester ?
Pourquoi FP8 et non une quantification plus petite ?
Les frais sont-ils vraiment déduits de la construction complète ?
« Privé » signifie-t-il que rien ne quitte notre réseau ?
Démarrer un PoC LLM Privé
Parlez-nous de votre charge de travail. Obtenez une évaluation initiale gratuite.
Nous répondons sous 1 jour ouvré avec une première lecture gratuite de la faisabilité, avant que vous ne vous engagiez sur les $6,000 (ou $3,000).
- NDA signé avant toute discussion technique — y compris l'évaluation gratuite.
- Aucun achat de matériel requis pour réaliser le PoC lui-même.
- Si un LLM privé n'est pas le bon choix, nous le dirons dans le rapport.
- $6K ($3K ≤50 personnes)
- 30 jours
- 0 matériel requis
- Crédit sur la construction complète
Demander une évaluation initiale gratuite
Champs obligatoires marqués d'un *