AI-SERVERS

Solutions et projets

Nous développons des outils d’administration, de diagnostic et d’analyse économique des infrastructures GPU. Nous prévoyons aussi d’utiliser les serveurs lorsqu’ils disposent de capacités libres.

Phase finale de développementAccès sur invitation

DCMetrik.com

Supervision des serveurs, administration et économie des projets. Des coûts détaillés aux prévisions de revenus et au retour sur investissement.

À propos du projet
En développementAccès privé

DCMedic — SERA

Server Emergency & Recovery Agent

Un outil de diagnostic et d’aide au rétablissement des serveurs d’IA. La gestion des incidents tient également compte de leur impact financier.

À propos du projet
Prévu

Flexible Compute

Une couche d’ordonnancement prévue pour répartir les tâches de calcul entre les serveurs GPU disposant de capacités libres.

À propos du projet

L’économie du projet dans son ensemble

Nous associons notre expertise matérielle à une longue expérience des marchés de capitaux et de la gestion des processus. Nous évaluons les performances techniques et financières des projets.

Acquisition et cycle de vie

Prix du matériel, financement, extension, remplacement et valeur résiduelle.

Coûts d’exploitation détaillés

Électricité, refroidissement, espace, connectivité, maintenance et administration, y compris la gestion des incidents et le coût des interruptions.

Revenus et résultats globaux

Utilisation des serveurs, revenus réels et prévisionnels, valeur des traitements internes et rendement des ressources investies.

Aperçu de DCMetrik

DCMetrik.com

Phase finale de développement · Accès sur invitation

Supervision des serveurs, administration et économie des projets. Des coûts détaillés aux prévisions de revenus et au retour sur investissement.

Supervision et comptabilité détaillée

DCMetrik relie l’état, l’utilisation et l’historique des serveurs aux coûts et revenus du projet. Il couvre les coûts du matériel, de l’énergie, du refroidissement, de la connectivité, de la maintenance et de l’administration.

Prévisions et rentabilité

Outre les résultats réels, le système fournit des estimations de revenus futurs et des calculs de ROA et de ROI. Il aide à évaluer le projet et les décisions de réparation, de renouvellement ou d’extension. L’accès se fait sur invitation.

Accès, clients et historique des serveurs

L’Advanced Account Admin supervise plusieurs comptes. Chaque Account Admin gère son compte et attribue les serveurs aux utilisateurs, qui ne voient que leurs machines. Il peut définir des commissions et des coûts différents et réaffecter des serveurs en conservant l’historique des revenus et des coûts.

Heartbeat et alertes

Les rapports réguliers permettent de suivre la disponibilité et l’état des serveurs connectés. Si les rapports cessent ou si un problème est détecté, les utilisateurs reçoivent des alertes selon les règles et les droits définis.

DCMedic — SERA

En développement · Accès privé

Un outil de diagnostic et d’aide au rétablissement des serveurs d’IA. La gestion des incidents tient également compte de leur impact financier.

Server Emergency & Recovery Agent

SERA signifie Server Emergency & Recovery Agent : un outil de gestion des incidents et d’aide au rétablissement des serveurs. Il fait partie du projet DCMedic.

Il aide les administrateurs à comprendre l’état du serveur, à analyser les données de diagnostic et à préparer les prochaines étapes. Il vise à faciliter la résolution de l’incident et la remise en service.

Cet outil interne est en cours de développement. Un accès partenaire est possible sur demande, après accord avec l’opérateur.

DCMedic — SERA sur DCMetrik

Les pannes ont un impact financier

Le développement prend en compte les interruptions, les capacités inutilisées, les coûts de réparation et l’impact sur les revenus. L’intégration avec DCMetrik doit replacer chaque intervention dans le contexte économique du projet.

Flexible Compute

Prévu

Une couche d’ordonnancement prévue pour répartir les tâches de calcul entre les serveurs GPU disposant de capacités libres.

Une couche de pilotage des capacités GPU libres

La couche de pilotage prévue doit identifier les ressources disponibles et répartir les tâches adaptées entre les serveurs. Les traitements principaux des clients restent prioritaires. Nous ciblons les tâches pouvant attendre ou être suspendues puis reprises.

Utiliser le matériel existant

Une meilleure utilisation des capacités libres peut limiter l’achat de serveurs supplémentaires. Nous évaluerons les calculs réalisés, la consommation d’énergie, les coûts et les revenus. La soumission publique de tâches n’est pas encore disponible.