Νέο σήμα για autoscaling στα AI workloads: CPU δεν αρκεί

Photo: Igor Omilaev / Unsplash

Startups

Νέο σήμα για autoscaling στα AI workloads: CPU δεν αρκεί

Το backlog και η GPU utilization μπαίνουν στο επίκεντρο της κλιμάκωσης σε inference pods

26 Ιουλίου 2026

Σε GPU inference pod, η χρήση CPU μπορεί να δείχνει χαμηλή ενώ ο accelerator είναι ήδη πιεσμένος και τα αιτήματα συσσωρεύονται. Η κλιμάκωση πρέπει να βασίζεται στο backlog και στη GPU utilization, με το KEDA να αξιοποιείται στο κρίσιμο μονοπάτι.

Σε GPU inference pod, η χρήση CPU μπορεί να είναι παραπλανητική, καθώς μπορεί να παραμένει στο 30% την ώρα που ο accelerator είναι ήδη πλήρως απασχολημένος και τα αιτήματα συσσωρεύονται.

Το κρίσιμο σήμα για την κλιμάκωση είναι αυτό που βρίσκεται πραγματικά στο μονοπάτι εκτέλεσης: το backlog και η GPU utilization. Για αυτό το σημείο αναφέρεται η χρήση του KEDA.

Ποιο σήμα μετρά περισσότερο στην κλιμάκωση;

Στο συγκεκριμένο σενάριο, το CPU δεν αποτυπώνει την πίεση του συστήματος. Αντίθετα, το backlog δείχνει ότι τα αιτήματα περιμένουν, ενώ η GPU utilization αποτυπώνει την κατάσταση του accelerator.

  • CPU ως decorrelated proxy
  • Backlog ως ένδειξη συσσώρευσης αιτημάτων
  • GPU utilization ως βασικό σήμα φόρτου
  • KEDA για το autoscaling

Γιατί το CPU μπορεί να οδηγήσει σε λάθος εικόνα;

Το άρθρο αναφέρει ότι σε ένα GPU inference pod το CPU μπορεί να βρίσκεται χαμηλά, ακόμη και στο 30%, την ίδια στιγμή που η GPU έχει φτάσει στο όριό της. Σε αυτή την περίπτωση, η κατάσταση του συστήματος δεν αποτυπώνεται σωστά από το CPU.

Γι’ αυτό το autoscaling δεν πρέπει να στηρίζεται σε ένα σήμα που δεν βρίσκεται στο κρίσιμο μονοπάτι.

Τι δείχνει το παράδειγμα ενός model-serving service;

Το υλικό κάνει αναφορά σε ένα model-serving service στο οποίο ο συντάκτης ήταν on-call, με τίτλο «The Autoscaler That Watched the Queue Burn». Από αυτό το παράδειγμα προκύπτει η ανάγκη να παρακολουθείται η ουρά και η GPU, όχι να βασίζεται κανείς μόνο σε δευτερεύοντα σήματα.

Η βασική κατεύθυνση είναι σαφής: κλιμάκωση με βάση το backlog και τη GPU utilization, όχι με βάση το CPU όταν αυτό δεν αντικατοπτρίζει το πραγματικό φορτίο.

Ποια είναι η πρακτική οδηγία που προκύπτει;

Η οδηγία που δίνεται είναι να γίνεται scaling στο σήμα που βρίσκεται πάνω στο κρίσιμο μονοπάτι. Στο συγκεκριμένο περιβάλλον αυτό σημαίνει backlog και GPU utilization, με το KEDA να χρησιμοποιείται ως εργαλείο autoscaling.

Το μήνυμα του άρθρου είναι να επιλέγονται metrics που αντικατοπτρίζουν την πραγματική πίεση του AI workload.

Πηγή:startupbeat.com

Πώς σου φάνηκε το άρθρο;

#AI workloads#autoscaling#GPU utilization
Κοινοποίησηf𝕏WV

? Συχνές Ερωτήσεις

Ποια metrics είναι καλύτερα για autoscaling σε AI workloads;

Στο συγκεκριμένο κείμενο αναφέρονται το backlog και η GPU utilization ως τα σήματα που βρίσκονται στο κρίσιμο μονοπάτι.

Γιατί το CPU δεν είναι αρκετό σε GPU inference pod;

Επειδή μπορεί να παραμένει χαμηλό, ακόμη και στο 30%, ενώ η GPU είναι ήδη πλήρως απασχολημένη και τα αιτήματα συσσωρεύονται.

Ποιο εργαλείο αναφέρεται για το autoscaling;

Το κείμενο αναφέρει το KEDA ως εργαλείο για την κλιμάκωση με βάση το backlog και τη GPU utilization.

Σχετικά Άρθρα

Η IQM, η πρώτη εισηγμένη ευρωπαϊκή εταιρεία κβαντικών υπολογιστών, παραδέχεται ότι το μέλλον της τεχνολογίας παραμένει αβέβαιο

Η IQM, η πρώτη εισηγμένη ευρωπαϊκή εταιρεία κβαντικών υπολογιστών, παραδέχεται ότι το μέλλον της τεχνολογίας παραμένει αβέβαιο

Το κενό ελέγχου στην enterprise AI: Το πραγματικό πρόβλημα είναι η ιδιοκτησία, όχι η τεχνολογία

Το κενό ελέγχου στην enterprise AI: Το πραγματικό πρόβλημα είναι η ιδιοκτησία, όχι η τεχνολογία

Η ευρωπαϊκή επέκταση της Uber συναντά νέα εμπόδια

Η ευρωπαϊκή επέκταση της Uber συναντά νέα εμπόδια

Η γαλλική startup ZML λανσάρει δωρεάν εργαλείο για ταχύτερο AI inference σε πολλαπλά chips

Η γαλλική startup ZML λανσάρει δωρεάν εργαλείο για ταχύτερο AI inference σε πολλαπλά chips

Ρεκόρ 510 δισ. δολαρίων στις χρηματοδοτήσεις startups μέσα σε έξι μήνες

Ρεκόρ 510 δισ. δολαρίων στις χρηματοδοτήσεις startups μέσα σε έξι μήνες

Οι 10 μεγαλύτεροι γύροι χρηματοδότησης της εβδομάδας: AI, ενέργεια και biotech στην πρώτη γραμμή

Οι 10 μεγαλύτεροι γύροι χρηματοδότησης της εβδομάδας: AI, ενέργεια και biotech στην πρώτη γραμμή

Η Anthropic επαναφέρει παγκοσμίως το Claude Fable 5 μετά την άρση των αμερικανικών περιορισμών εξαγωγών

Η Anthropic επαναφέρει παγκοσμίως το Claude Fable 5 μετά την άρση των αμερικανικών περιορισμών εξαγωγών

Startup βάζει αντιμέτωπες τις αντιπροσωπείες για την πώληση μεταχειρισμένου αυτοκινήτου

Startup βάζει αντιμέτωπες τις αντιπροσωπείες για την πώληση μεταχειρισμένου αυτοκινήτου

Η Tapestry VC έκλεισε τρίτο fund 80 εκατ. δολαρίων για επαναλαμβανόμενους Ευρωπαίους founders

Η Tapestry VC έκλεισε τρίτο fund 80 εκατ. δολαρίων για επαναλαμβανόμενους Ευρωπαίους founders

Νέο Ξεκίνημα στο Fundamentum με επένδυση 200 εκατομμυρίων

Νέο Ξεκίνημα στο Fundamentum με επένδυση 200 εκατομμυρίων

Τι είναι η Mistral AI: όλα όσα πρέπει να γνωρίζετε για την ευρωπαϊκή αντίπαλο της OpenAI

Τι είναι η Mistral AI: όλα όσα πρέπει να γνωρίζετε για την ευρωπαϊκή αντίπαλο της OpenAI

Τα κεφάλαια επιστρέφουν στην καθαρή τεχνολογία με ώθηση από την αυξημένη κατανάλωση ρεύματος

Τα κεφάλαια επιστρέφουν στην καθαρή τεχνολογία με ώθηση από την αυξημένη κατανάλωση ρεύματος

Νέα χρηματοδότηση για την EdVisorly με στόχο τις μετεγγραφές από community colleges

Νέα χρηματοδότηση για την EdVisorly με στόχο τις μετεγγραφές από community colleges

Η επιστροφή του hype στα αυτόνομα οχήματα φέρνει τη Humble Robotics στο προσκήνιο των εμπορευματικών μεταφορών

Η επιστροφή του hype στα αυτόνομα οχήματα φέρνει τη Humble Robotics στο προσκήνιο των εμπορευματικών μεταφορών

Η τεχνητή νοημοσύνη μηδένισε τον χρόνο αντίδρασης στις κυβερνοεπιθέσεις

Η τεχνητή νοημοσύνη μηδένισε τον χρόνο αντίδρασης στις κυβερνοεπιθέσεις