Définir l’objectif
Précisez si la première tâche concerne l’inférence MLX, le déploiement IA sur Mac, une compilation iOS/macOS ou l’automatisation à distance. Notez la durée, le mode de concurrence et les livrables finaux.
Ce guide s’adresse aux développeurs et équipes d’ingénierie qui souhaitent louer un VMMini M4. Vous vérifierez votre charge de travail, comparerez les quatre nœuds disponibles, créerez votre commande, vous connecterez, puis lancerez un service d’inférence MLX ou un self-hosted runner.
VMMini M4 est un nœud physique dédié équipé d’un Mac Mini M4, de 16GB de RAM et d’un SSD de 256GB, et non une machine virtuelle. Les nœuds fonctionnent 365 jours par an ; les performances réseau, la disponibilité et les informations de livraison sont celles affichées en temps réel dans la console.
Le nœud, la durée et le stockage déterminent directement votre mode d’utilisation après livraison. Préparez une courte fiche de tâche pour éviter de découvrir après connexion que le dépôt est trop éloigné, que le disque est insuffisant ou que l’équipe ne dispose pas de clé publique utilisable.
Précisez si la première tâche concerne l’inférence MLX, le déploiement IA sur Mac, une compilation iOS/macOS ou l’automatisation à distance. Notez la durée, le mode de concurrence et les livrables finaux.
Listez les régions où se trouvent les principaux opérateurs. En cas de collaboration, ne tenez pas compte uniquement de l’administrateur : considérez aussi les personnes qui consulteront les journaux et récupéreront les livrables.
Notez le réseau où se trouvent le dépôt, les fichiers de modèles, le cache des dépendances et le stockage des artefacts. Le point d’entrée des données influence souvent davantage le choix du nœud que la localisation de l’équipe.
Une validation courte peut se faire à la journée, un sprint continu à la semaine, et une compilation ou un service stable au mois ou au trimestre. La durée doit couvrir le déploiement, la validation et l’export des données.
Additionnez les poids des modèles, le cache des dépendances, les répertoires de compilation, les artefacts archivés et les journaux. N’estimez pas le disque système à partir de la seule taille du dépôt.
Utilisez une clé distincte pour cette tâche et vérifiez que la clé privée est conservée par des personnes autorisées. Envoyez la clé publique uniquement ; ne transmettez jamais la clé privée par e-mail ou ticket.
Utilisez une adresse professionnelle capable de recevoir durablement les notifications de commande et de service, et assurez-vous que le responsable de la livraison peut y accéder. Mettez à jour le contact interne avant le transfert de la tâche.
VMMini M4 est actuellement disponible à Singapour, au Japon (Tokyo), en Corée du Sud (Séoul) et à Hong Kong. Les quatre options du catalogue peuvent être commandées ; la disponibilité réelle est celle affichée en temps réel dans la console.
Convient aux tâches dont la source de code, l’équipe ou les utilisateurs du service se trouvent en Asie du Sud-Est. Avant de récupérer de grands modèles ou dépendances depuis une autre région, testez le parcours de téléchargement réel plutôt que de vous limiter au ping.
Convient aux tâches de compilation dont les dépendances et les collaborateurs principaux se trouvent au Japon ou en Asie de l’Est. Si le pipeline télécharge souvent des dépendances, mesurez à la fois la latence du premier paquet et le débit soutenu.
Convient aux tâches dont l’équipe ou la chaîne de livraison se trouve en Corée du Sud et en Asie du Nord-Est. Si les artefacts de compilation sont envoyés en continu, ajoutez un test de transfert de fichiers réel.
Convient aux tâches dont les opérateurs principaux, la source de code ou le parcours métier se trouvent dans le sud de la Chine ou en Asie du Sud-Est. Les accès interrégionaux restent soumis aux variations des opérateurs et du routage locaux.
Tâches interactivesObservez en priorité la réactivité des entrées SSH, l’actualisation des journaux et le transfert de petits fichiers.
Tâches de compilationObservez en priorité le clonage du dépôt, le téléchargement des dépendances, la restauration du cache et l’envoi des artefacts.
Service d’inférenceObservez en priorité la préparation du modèle, le parcours réel des requêtes du client au serveur et la stabilité dans la durée.
Le tableau indique les temps aller-retour ICMP entre plusieurs villes de test et les quatre nœuds disponibles. Il aide à écarter les parcours manifestement inadaptés, mais ne remplace pas les tests réels du dépôt, de la source des modèles, du registre d’artefacts et du parcours utilisateur final.
| Ville du point de test | Nœud de Singapour | Nœud de Tokyo | Nœud de Séoul | Nœud de Hong Kong |
|---|---|---|---|---|
| Point de test de Shanghai | 79 ms | 48 ms | 52 ms | 36 ms |
| Point de test de Shenzhen | 47 ms | 66 ms | 61 ms | 24 ms |
| Point de test de Taipei | 58 ms | 39 ms | 45 ms | 31 ms |
| Point de test de Bangkok | 33 ms | 92 ms | 99 ms | 56 ms |
Depuis les réseaux habituellement utilisés par l’équipe, exécutez plusieurs séries de ping et répétez-les pendant les heures prévues. Clonez ensuite un dépôt de taille comparable, téléchargez des dépendances ou un modèle, puis envoyez un artefact représentatif.
Une faible médiane ne garantit pas une stabilité durable. Observez également les pertes de paquets, les variations, le débit de téléchargement et les changements aux heures de pointe. Ces résultats servent uniquement au premier choix du nœud et ne constituent pas une garantie de performances continues.
Une seule configuration VMMini M4 est actuellement proposée. La commande doit préciser le nœud physique, la durée de location et les options ; n’attendez pas la soumission pour estimer le stockage ou le nombre d’appareils interconnectés.
Mac Mini M4 · 16GB RAM · 256GB SSD
Choisissez uniquement Singapour, Tokyo, Séoul ou Hong Kong et notez la justification de votre choix.
Créez la commande à la journée, à la semaine, au mois ou au trimestre ; la durée doit inclure le déploiement et l’export des données.
Vérifiez les quantités selon les besoins en modèles, cache, artefacts et appareils interconnectés.
L’extension de stockage et l’interconnexion Thunderbolt 5 ne font pas partie de la configuration de base. Ajoutez-les uniquement si la tâche le nécessite et intégrez leur prix à la durée correspondante dans votre budget.
Les prix et le règlement sont indiqués en USD. Avant de payer, vérifiez la durée de base, le nœud, l’extension SSD et le nombre d’interconnexions Thunderbolt 5, puis assurez-vous que le total correspond à votre fiche de tâche.
Effectuez le transfert selon les informations de la commande et vérifiez le réseau, le montant et le statut de la commande.
Le paiement par carte est traité par Stripe ; la passerelle réellement disponible est celle affichée dans la console.
La première connexion ne sert pas à lancer immédiatement une tâche, mais à établir une base fiable. Vérifiez d’abord l’empreinte de l’hôte, les informations système, le disque, l’heure, le réseau et les autorisations du compte avant de modifier l’environnement.
Comparez caractère par caractère l’empreinte affichée à la connexion avec le relevé de livraison. En cas de divergence, interrompez la connexion et ouvrez un ticket depuis la console.
Privilégiez SSH pour les tâches en ligne de commande ; utilisez VNC pour observer l’interface graphique macOS. N’ouvrez que les accès indispensables à la tâche.
Notez la version de macOS, l’architecture du noyau, la capacité du disque système et l’espace disponible afin d’établir une base pour le dépannage.
Vérifiez le fuseau horaire, l’heure système, le DNS, l’accès aux dépendances externes et la connectivité avec la source de code afin d’éviter les problèmes de certificats ou d’horodatage des compilations.
Vérifiez que le compte actuel ne possède que les autorisations nécessaires à la tâche et séparez les identifiants du projet des identifiants de connexion des personnes.
sw_vers
uname -m
df -h /
date
scutil --get TimeZone
networkQuality
whoami
id
Ne lancez pas l’intégralité du processus de production lors de la première exécution. Validez d’abord l’environnement, les journaux, le code de sortie et le chemin des artefacts avec une requête utilisant un petit modèle ou une seule compilation, puis élargissez progressivement la tâche.
Vérifiez d’abord l’environnement Python et le répertoire du modèle, puis faites écouter le service uniquement sur l’adresse locale. Après validation du contrôle de santé, ouvrez les ports nécessaires selon les appelants réels et la stratégie d’accès.
export MODEL_PATH="/srv/models/current"
export SERVICE_PORT="8080"
python -m mlx_lm.server \
--model "$MODEL_PATH" \
--host 127.0.0.1 \
--port "$SERVICE_PORT"
curl --fail \
"http://127.0.0.1:${SERVICE_PORT}/v1/models"
Créez un runner restreint pour un seul projet et configurez-le avec un jeton d’enregistrement à durée limitée. Exécutez d’abord une compilation minimale sans signature ni publication, puis intégrez le pipeline officiel.
export REPOSITORY_URL="$CI_REPOSITORY_URL"
export RUNNER_TOKEN="$CI_RUNNER_TOKEN"
./config.sh \
--url "$REPOSITORY_URL" \
--token "$RUNNER_TOKEN" \
--name "vmmini-m4-runner"
./run.sh
La première tâche doit fournir un code de sortie clair et des journaux permettant d’identifier la cause.
Conservez les versions des dépendances, les commandes, la configuration et les chemins des artefacts.
Gérez séparément les accès des personnes et les identifiants d’automatisation du projet.
Après ces six vérifications, l’équipe dispose d’un environnement récupérable, dépannable et proprement clôturable. Pour chacune, notez un responsable, le résultat de la validation et la condition de la prochaine vérification.
Vérifiez que le service, le runner ou le script d’orchestration redémarre comme prévu et notez les étapes nécessitant une intervention manuelle.
Séparez les journaux d’exécution, les journaux d’erreur et les enregistrements d’audit, désensibilisez-les et définissez une stratégie de capacité et de conservation.
Téléchargez ou envoyez réellement un artefact représentatif, puis vérifiez sa somme de contrôle, ses autorisations, sa destination et la durée du transfert.
Couvrez au minimum la disponibilité du service, les échecs de tâche, l’espace disque restant et l’état des processus clés, puis vérifiez que les notifications parviennent au responsable.
Listez le code, les modèles, le cache, les journaux, les copies d’artefacts et les identifiants temporaires à supprimer à la fin de la tâche.
Conservez l’identifiant de commande, le nœud, l’heure du problème, les étapes de reproduction et les journaux désensibilisés comme informations minimales pour toute demande d’assistance.
Choisissez VMMini M4, un nœud à Singapour, Tokyo, Séoul ou Hong Kong, ainsi qu’une durée à la journée, à la semaine, au mois ou au trimestre. Toutes les commandes sont réglées en USD ; après livraison, établissez d’abord la base de connexion, puis lancez votre première charge de travail.