Einsatzzweck festlegen
Legen Sie fest, ob die erste Aufgabe MLX-Inferenz, Mac-KI-Bereitstellung, iOS-/macOS-Builds oder Remote-Automatisierung umfasst. Notieren Sie Laufzeit, Parallelisierung und Endprodukte.
Dieser Leitfaden richtet sich an Entwickler und Engineering-Teams, die einen VMMini M4 mieten möchten. Sie prüfen nacheinander die Arbeitslast, vergleichen vier verfügbare Knoten, erstellen eine Bestellung, verbinden sich erstmals und starten anschließend einen MLX-Inferenzdienst oder self-hosted Runner.
Der VMMini M4 ist ein dedizierter physischer Knoten mit Mac Mini M4, 16GB RAM und 256GB SSD – keine virtuelle Maschine. Der Knoten läuft 365 Tage im Jahr durchgehend; tatsächliche Netzwerkleistung, Bestellverfügbarkeit und Lieferdetails richten sich nach den Live-Angaben in der Konsole.
Knoten, Laufzeit und Speicher bestimmen den späteren Arbeitsablauf. Erstellen Sie zunächst eine kurze Aufgabenkarte. So vermeiden Sie, erst nach der Verbindung festzustellen, dass die Codequelle zu weit entfernt ist, der Speicher nicht reicht oder dem Team ein nutzbarer öffentlicher Schlüssel fehlt.
Legen Sie fest, ob die erste Aufgabe MLX-Inferenz, Mac-KI-Bereitstellung, iOS-/macOS-Builds oder Remote-Automatisierung umfasst. Notieren Sie Laufzeit, Parallelisierung und Endprodukte.
Listen Sie die Regionen der wichtigsten Nutzer auf. Bei mehreren Beteiligten zählt nicht nur der Standort der Administration, sondern auch der der Personen, die täglich Logs prüfen und Artefakte abrufen.
Dokumentieren Sie, in welchem Netzwerk sich Code-Repository, Modelldateien, Dependency-Cache und Artefaktspeicher befinden. Der Datenweg der Aufgabe beeinflusst die Knotenauswahl oft stärker als der Teamstandort.
Kurze Tests können tageweise, kontinuierliche Sprints wochenweise und stabile Builds oder Dienste monatlich oder quartalsweise abgerechnet werden. Die Laufzeit sollte Bereitstellung, Validierung und vollständigen Datenexport abdecken.
Berechnen Sie Modellgewichte, Dependency-Cache, Build-Verzeichnisse, archivierte Artefakte und Logs gemeinsam. Schätzen Sie den Bedarf nicht nur anhand der Repository-Größe.
Verwenden Sie für diese Aufgabe einen eigenen Schlüssel und stellen Sie sicher, dass der private Schlüssel von autorisierten Personen verwahrt wird. Übermitteln Sie nur den öffentlichen Schlüssel – niemals den privaten per E-Mail oder Supportanfrage.
Verwenden Sie eine geschäftliche E-Mail-Adresse, die Bestell- und Servicemitteilungen dauerhaft empfängt, und stellen Sie sicher, dass die zuständige Person Zugriff hat. Aktualisieren Sie interne Kontakte vor der Übergabe.
VMMini M4 ist derzeit in Singapur, Japan (Tokio), Südkorea (Seoul) und Hongkong verfügbar. Alle vier Konfigurationen im Katalog können bestellt werden; die tatsächliche Verfügbarkeit zeigt die Konsole live an.
Geeignet für Aufgaben mit Codequelle, Team oder Zielkundschaft in Südostasien. Testen Sie vor dem regionsübergreifenden Abruf großer Modelle oder Dependencies den tatsächlichen Downloadpfad, statt nur den Ping zu betrachten.
Geeignet für Build-Aufgaben, deren Dependencies und Mitarbeitende überwiegend in Japan oder Ostasien liegen. Lädt die Pipeline häufig Dependencies herunter, messen Sie sowohl die Latenz des ersten Pakets als auch den anhaltenden Durchsatz.
Geeignet für Aufgaben mit Team oder Bereitstellungskette in Südkorea und Nordostasien. Bei regelmäßigem Upload von Build-Artefakten sollten Sie einen realen Dateitransfer testen.
Geeignet für Aufgaben mit Bedienstandort, Codequelle oder Geschäftsweg in Südchina und Südostasien. Der grenzüberschreitende Zugriff hängt weiterhin von lokalen Anbietern und wechselnden Routen ab.
Interaktive AufgabenAchten Sie vor allem auf die Reaktion auf SSH-Eingaben, die Aktualisierung von Logs und die Übertragung kleiner Dateien.
Build-AufgabenAchten Sie vor allem auf Repository-Klon, Dependency-Download, Cache-Wiederherstellung und Artefakt-Upload.
InferenzdienstAchten Sie vor allem auf die Modellvorbereitung, den realen Anfrageweg vom Client zum Server und die dauerhafte Stabilität.
Die folgende Tabelle zeigt die ICMP-Roundtrip-Mediane von Teststandorten in wichtigen Städten zu den vier verfügbaren Knoten. Sie hilft beim Ausschluss offensichtlich ungeeigneter Wege, ersetzt aber keine realen Tests von Repository, Modellquelle, Artefaktspeicher und Endnutzerverbindung.
| Stadt des Teststandorts | Knoten Singapur | Knoten Tokio | Knoten Seoul | Knoten Hongkong |
|---|---|---|---|---|
| Teststandort Shanghai | 79 ms | 48 ms | 52 ms | 36 ms |
| Teststandort Shenzhen | 47 ms | 66 ms | 61 ms | 24 ms |
| Teststandort Taipeh | 58 ms | 39 ms | 45 ms | 31 ms |
| Teststandort Bangkok | 33 ms | 92 ms | 99 ms | 56 ms |
Führen Sie im üblichen Teamnetz mehrere Ping-Runden durch und wiederholen Sie sie zu den erwarteten Arbeitszeiten. Klonen Sie anschließend ein Repository mit realistischer Größe, laden Sie Dependencies oder Modelldateien herunter und laden Sie ein repräsentatives Artefakt hoch.
Ein niedriger Median bedeutet nicht automatisch dauerhafte Stabilität. Prüfen Sie auch Paketverlust, Schwankungen, Download-Durchsatz und Veränderungen zu Spitzenzeiten. Die Tabellenwerte dienen nur der Vorauswahl und sind keine Zusicherung der Dauerleistung.
Derzeit ist genau eine VMMini-M4-Konfiguration verfügbar. In der Bestellung müssen physischer Knoten, Mietlaufzeit und Zusatzoptionen festgelegt werden. Schätzen Sie Speicher- oder Geräteanzahl nicht erst nach dem Absenden.
Mac Mini M4 · 16GB RAM · 256GB SSD
Wählen Sie ausschließlich zwischen Singapur, Tokio, Seoul und Hongkong und dokumentieren Sie die Entscheidungsgrundlage.
Tage, Wochen, Monate oder Quartale buchen; die Laufzeit muss Bereitstellung und Datenexport abdecken.
Prüfen Sie den Bedarf anhand von Modellen, Cache, Artefakten und parallel betriebenen Geräten.
Speichererweiterungen und Thunderbolt-5-Verbindungen sind nicht Bestandteil der Basiskonfiguration. Fügen Sie sie nur bei tatsächlichem Bedarf hinzu und berücksichtigen Sie den Preis für die jeweilige Laufzeit im Budget.
Bestellpreise und Abrechnung erfolgen ausschließlich in USD. Prüfen Sie vor der Zahlung einzeln Basislaufzeit, Knoten, SSD-Erweiterung und Anzahl der Thunderbolt-5-Verbindungen und vergleichen Sie den Gesamtbetrag mit der Aufgabenkarte.
Führen Sie die Überweisung anhand der Bestellangaben aus und prüfen Sie Netzwerk, Betrag und Bestellstatus.
Kartenzahlungen werden über Stripe abgewickelt; das tatsächlich verfügbare Gateway wird in der Konsole angezeigt.
Das Ziel der ersten Verbindung ist nicht der sofortige Aufgabenstart, sondern eine verlässliche Ausgangsbasis. Prüfen Sie zunächst Hostschlüssel, Systeminformationen, Speicher, Uhrzeit, Netzwerk und Kontoberechtigungen, bevor Sie die Umgebung ändern.
Vergleichen Sie den beim Verbinden angezeigten Fingerabdruck Zeichen für Zeichen mit dem Lieferprotokoll. Bei Abweichungen beenden Sie die Verbindung und erstellen über die Konsole eine Supportanfrage.
Für Aufgaben in der Kommandozeile bevorzugt SSH verwenden; für die macOS-Oberfläche VNC einsetzen. Öffnen Sie nur die für die Aufgabe erforderlichen Zugänge.
Dokumentieren Sie macOS-Version, Kernelarchitektur, Systemlaufwerkskapazität und freien Speicher als Grundlage für die spätere Fehleranalyse.
Prüfen Sie Zeitzone, Systemzeit, DNS, Zugriff auf externe Dependencies und die Erreichbarkeit der Codequelle, um Probleme mit Zertifikaten oder Build-Zeitstempeln zu vermeiden.
Stellen Sie sicher, dass das aktuelle Konto nur die für die Aufgabe erforderlichen Rechte besitzt, und verwalten Sie Projekt- und persönliche Zugangsdaten getrennt.
sw_vers
uname -m
df -h /
date
scutil --get TimeZone
networkQuality
whoami
id
Führen Sie beim ersten Mal nicht den vollständigen Produktionsablauf aus. Prüfen Sie zunächst mit einer Minimalanfrage an ein Modell oder einem einzelnen Build Umgebung, Logs, Exit-Code und Artefaktpfad; erweitern Sie den Umfang anschließend schrittweise.
Prüfen Sie zunächst Python-Umgebung und Modellverzeichnis und lassen Sie den Dienst nur an der lokalen Adresse lauschen. Nach bestandenem Gesundheitscheck öffnen Sie anhand der realen Aufrufer und Zugriffsregeln die erforderlichen Ports.
export MODEL_PATH="/srv/models/current"
export SERVICE_PORT="8080"
python -m mlx_lm.server \
--model "$MODEL_PATH" \
--host 127.0.0.1 \
--port "$SERVICE_PORT"
curl --fail \
"http://127.0.0.1:${SERVICE_PORT}/v1/models"
Erstellen Sie für ein einzelnes Projekt einen eingeschränkten Runner und konfigurieren Sie ihn mit einem kurzlebigen Registrierungstoken. Führen Sie zunächst einen minimalen Build ohne Signierung und Veröffentlichung aus, bevor Sie die reguläre Pipeline anbinden.
export REPOSITORY_URL="$CI_REPOSITORY_URL"
export RUNNER_TOKEN="$CI_RUNNER_TOKEN"
./config.sh \
--url "$REPOSITORY_URL" \
--token "$RUNNER_TOKEN" \
--name "vmmini-m4-runner"
./run.sh
Die erste Aufgabe sollte einen eindeutigen Exit-Code und auffindbare Logs haben.
Speichern Sie Dependency-Versionen, Befehle, Konfiguration und Artefaktpfade.
Verwalten Sie persönliche Zugriffe und Projekt-Automatisierungszugangsdaten getrennt.
Erst nach Abschluss dieser sechs Prüfungen verfügt das Team über eine wiederherstellbare, analysierbare und sicher beendbare Umgebung. Für jeden Punkt sollten Verantwortliche, Ergebnis und Bedingung für die nächste Prüfung dokumentiert werden.
Bestätigen Sie, dass Dienst, Runner oder Planungsskript wie erwartet wiederhergestellt werden, und dokumentieren Sie erforderliche manuelle Schritte.
Trennen Sie Laufzeitlogs, Fehlerlogs und Auditaufzeichnungen, anonymisieren Sie sie und legen Sie Größen- und Aufbewahrungsregeln fest.
Laden Sie ein repräsentatives Artefakt tatsächlich herunter oder hoch und prüfen Sie Prüfsumme, Berechtigungen, Zielort und Übertragungsdauer.
Decken Sie mindestens Dienstprüfung, fehlgeschlagene Aufgaben, freien Speicher und den Status wichtiger Prozesse ab und prüfen Sie, ob Benachrichtigungen die verantwortliche Person erreichen.
Listen Sie Code, Modelle, Cache, Logs, Artefaktkopien und temporäre Zugangsdaten auf, die am Ende der Aufgabe gelöscht werden müssen.
Bestellkennung, Knoten, Zeitpunkt des Problems, Reproduktionsschritte und bereinigte Logs bilden die Mindestangaben für eine Supportanfrage.
Wählen Sie VMMini M4, den Knoten in Singapur, Tokio, Seoul oder Hongkong sowie eine Laufzeit pro Tag, Woche, Monat oder Quartal. Alle Bestellungen werden in USD abgerechnet. Führen Sie nach der Lieferung zuerst die Verbindungsprüfung durch und starten Sie anschließend die erste Arbeitslast.