Microsoft: Το σλόγκαν του 1977 ξαναγράφεται με επίκεντρο το AI

Η Microsoft αλλάζει ριζικά στρατηγική για τα Windows 11 και την τεχνητή νοημοσύνη. Στην έκθεση IFA, ο τεχνολογικός κολοσσός παρουσίασε το όραμα του «unmetered intelligence». Στόχος είναι η εκτέλεση σύνθετων LLM τοπικά στο PC σου χωρίς χρεώσεις tokens στο cloud. Η υλοποίηση αυτή όμως απαιτεί δραστικές αλλαγές στο hardware που έχεις στο γραφείο σου.

✂️ Σύνοψη άρθρου

  • Τέλος στις χρεώσεις ανά token: Το τοπικό αναλαμβάνει καθημερινές εργασίες χωρίς συνδρομές API ή cloud καθυστερήσεις (latency).
  • Ακραίες απαιτήσεις συστήματος: Το Project Zenith και τα τσιπ RTX Spark θέτουν ως ελάχιστη βάση τα 64GB έως 128GB Unified Memory.
  • Διχασμός στα Windows 11: Ενώ οι AI agents απαιτούν workstation specs, η Microsoft εξακολουθεί να υπόσχεται βασική εμπειρία σε μηχανήματα των 8GB RAM.

Πώς λειτουργεί το unmetered intelligence

Η βασική ιδέα πίσω από την ανακοίνωση της Microsoft εστιάζει στα οικονομικά των tokens («token economics»). Σήμερα, κάθε ερώτημα που στέλνεις σε ένα εμπορικό LLM κοστίζει σε υπολογιστικούς πόρους στα . Αυτό δημιουργεί συνδρομητικά μοντέλα ή αυστηρά ημερήσια όρια χρήσης για εσένα.

Το unmetered intelligence μεταφέρει την εκτέλεση των μοντέλων 30B+ παραμέτρων απευθείας στο silicon της συσκευής σου. Όταν ένα σύστημα τρέχει τα νευρωνικά δίκτυα τοπικά, το latency πέφτει σχεδόν στο μηδέν. Ταυτόχρονα, τα ευαίσθητα αρχεία σου δεν φεύγουν ποτέ από τον τοπικό αποθηκευτικό χώρο.

Στην πράξη, αυτό διαχωρίζει τις εργασίες σε δύο επίπεδα. Τα μικρά και μεσαία μοντέλα επεξεργάζονται κείμενο, κώδικα και εικόνες offline, ενώ το cloud παραμένει ενεργό μόνο για τεράστια tasks κλίμακας frontier. Όπως έχουμε αναλύσει στον οδηγό μας για τις AI λειτουργίες των Windows 11, η μετάβαση στο edge computing είναι ο μόνος βιώσιμος δρόμος για μαζική υιοθέτηση βοηθών χωρίς μηνιαίο κόστος.

Project Zenith και RTX Spark: Προδιαγραφές

Για να λειτουργήσει αυτό το μοντέλο, τα συμβατικά PC χρειάζονται ριζική αναβάθμιση αρχιτεκτονικής. Εδώ μπαίνει η NVIDIA με το RTX Spark. Μιλάμε για μία πλατφόρμα με 20 πυρήνες CPU, έως 6.144 Blackwell πυρήνες γραφικών και υπολογιστική ισχύ AI που αγγίζει το 1 Petaflop.

Το κλειδί δεν είναι μόνο η ωμή επεξεργαστική ισχύς, αλλά η ενοποιημένη μνήμη (Unified Memory). Το πρότυπο Project Zenith ορίζει ελάχιστο όριο τα 64GB RAM με διαμεταγωγή τουλάχιστον 250GB/s. Χωρίς αυτό το bandwidth, τα βάρη (weights) ενός μοντέλου 30 δισεκατομμυρίων παραμέτρων προκαλούν άμεσο memory bottleneck στους παραδοσιακούς διαύλους PCIe.

Κατηγορία PC Ελάχιστη RAM Memory Bandwidth Τοπικά Μοντέλα (Παράμετροι)
Standard PC 8GB – 16GB DDR4/DDR5 ~50-80 GB/s 1B – 3B (Με έντονο quantizing)
Copilot+ PC (NPU) 16GB LPDDR5X ~135 GB/s 3B – 7B (SLMs τύπου Phi-Silica)
Project Zenith / RTX Spark 64GB – 128GB Unified 250+ GB/s 30B έως 100B+ (Πλήρης ακρίβεια)

Αυτά τα νούμερα δείχνουν ότι η αγορά ενός απλού laptop των 800€ δεν επαρκεί για τη νέα εποχή. Οι απαιτήσεις μνήμης ξεπερνούν ακόμη και σύγχρονα gaming rigs, τοποθετώντας το πραγματικό local AI σε επίπεδα κόστους άνω των 2.000€.

Αλλαγές στον πυρήνα των Windows 11

Το hardware από μόνο του δεν αρκεί αν το λειτουργικό σύστημα διαχειρίζεται τα νήματα με παλιές μεθόδους. Η Microsoft προχώρησε σε πλήρη ανασύνταξη του kernel scheduler στα Windows 11. Το νέο σύστημα ονομάζεται Workload Profile Scheduling και κατανέμει τα AI pipelines δυναμικά στους 20 πυρήνες της Arm CPU και στα Tensor cores της GPU.

Για την ασφάλεια, η πλατφόρμα εισάγει τα Microsoft Execution Containers σε συνεργασία με το πλαίσιο OpenShell της αρχιτεκτονικής Blackwell της NVIDIA. Αυτά τα κοντέινερ λειτουργούν ως απομονωμένα sandboxes. Κάθε αυτόνομος agent που διαβάζει τα αρχεία σου ή αυτοματοποιεί κλικ στην οθόνη περιορίζεται από αυστηρές πολιτικές δικαιωμάτων.

Επιπλέον, το Windows Foundry δίνει στους προγραμματιστές έτοιμα pre-installed μοντέλα (inbox models). Έτσι, οι εφαρμογές που χρησιμοποιείς καθημερινά δεν χρειάζεται να κατεβάζουν ξεχωριστά LLMs 15GB για κάθε λειτουργία.

Το χάσμα των 8GB και η πραγματικότητα

Την ίδια ώρα που οι μηχανικοί σχεδιάζουν συστήματα για 128GB unified RAM, η ηγεσία της Microsoft επιμένει δημόσια ότι βελτιστοποιεί τα Windows 11 για μηχανήματα με μόλις 8GB RAM. Αυτή η αντίφαση δημιουργεί ένα τεράστιο τεχνολογικό χάσμα στην αγορά.

Η εμπειρία μας με παρόμοιες υλοποιήσεις δείχνει ότι τα 8GB σήμερα εξαντλούνται μόνο με τον browser και τις βασικές διεργασίες παρασκηνίου. Η εκτέλεση ακόμη και ενός υποτυπώδους τοπικού μοντέλου 3B παραμέτρων οδηγεί άμεσα σε έντονο paging στον SSD, αυξάνοντας τη θερμοκρασία και μειώνοντας δραματικά τη διάρκεια ζωής του δίσκου.

Ο μέσος χρήστης βρίσκεται παγιδευμένος ανάμεσα σε δύο άκρα. Από τη μία πλευρά υπάρχει ένα λειτουργικό που υπόσχεται πρόσβαση σε αυτόνομους agents, και από την άλλη πλευρά υπάρχει ένα hardware paywall που απαιτεί επένδυση επιπέδου επαγγελματικού workstation.

Η άποψή μας στο TechNoid

Η ιδέα του unmetered local AI είναι αναμφίβολα η σωστή κατεύθυνση. Κανείς δεν θέλει να πληρώνει 25€ τον μήνα σε συνδρομές ούτε να εξαρτάται από τις ορέξεις και τα downtime των κεντρικών servers. Η ανεξαρτησία από το cloud και η προστασία της ιδιωτικότητας είναι τεράστια πλεονεκτήματα.

Όμως ας είμαστε απόλυτα ειλικρινείς: η Microsoft πουλάει σήμερα ένα μέλλον που αφορά το 1% των καταναλωτών. Τα Project Zenith και RTX Spark δεν απευθύνονται στο μέσο γραφείο ή στον φοιτητή. Το να ισχυρίζεται η εταιρεία ότι συντηρεί ταυτόχρονα το οικοσύστημα των 8GB αποτελεί επικοινωνιακό ελιγμό για να μην απαξιώσει εκατομμύρια ενεργά PC στην αγορά.

Αν σκοπεύεις να αγοράσεις νέο υπολογιστή σήμερα με ορίζοντα πενταετίας, μην κοιτάς τίποτα κάτω από 32GB RAM. Για σοβαρό τοπικό AI, τα 64GB γίνονται σταδιακά η νέα πραγματικότητα, είτε μας αρέσει το κόστος είτε όχι.

Συχνές Ερωτήσεις για το Unmetered AI

Τι σημαίνει πρακτικά ο όρος «unmetered intelligence»;

Σημαίνει απεριόριστη χρήση τεχνητής νοημοσύνης τοπικά στο PC σου χωρίς χρέωση ανά ερώτημα, χωρίς μηνιαίες συνδρομές και χωρίς ανάγκη σύνδεσης σε απομακρυσμένο server.

Μπορώ να τρέξω αυτά τα μοντέλα στο τωρινό laptop μου με 16GB RAM;

Όχι τα μεγάλα μοντέλα του Project Zenith. Με 16GB RAM μπορείς να εκτελέσεις μόνο μικρά μοντέλα (SLMs) 3B έως 7B παραμέτρων με σημαντικούς περιορισμούς στην ταχύτητα.

Ποια είναι η διαφορά των επεξεργαστών NPU από το σύστημα RTX Spark;

Οι NPUs των τυπικών επεξεργαστών αποδίδουν 40-50 TOPS για βασικές εργασίες, ενώ το RTX Spark αγγίζει το 1 Petaflop (1.000 TOPS) επιτρέποντας την εκτέλεση workstation-class μοντέλων.

Χρειάζομαι υποχρεωτικά σύνδεση στο διαδίκτυο για τα Windows Foundry;

Όχι για την εκτέλεση. Τα προεγκατεστημένα μοντέλα των Windows λειτουργούν πλήρως offline, προστατεύοντας τα προσωπικά σου δεδομένα τοπικά.

Γιατί η ενιαία μνήμη (Unified Memory) είναι τόσο κρίσιμη για το AI;

Επειδή επιτρέπει στην CPU και την GPU να έχουν άμεση πρόσβαση στον ίδιο χώρο μνήμης χωρίς καθυστερήσεις μεταφοράς δεδομένων μέσω του διαύλου PCIe.

Dimitris Marizas
Dimitris Marizashttps://technoid.gr
Γράφω για τεχνολογία από τη σκοπιά του ανθρώπου που τη χρησιμοποιεί καθημερινά — όχι από αίθουσες συνεδρίων. Ασχολούμαι με δίκτυα, δορυφορικό internet, smartphones και ψηφιακές υπηρεσίες, με έμφαση στο τι σημαίνουν αυτά πρακτικά για τον Έλληνα χρήστη. Πίσω από κάθε άρθρο κρύβεται ώρες ανάλυσης, δοκιμών και — όταν χρειάζεται — κριτικής σε ό,τι το marketing προσπαθεί να κρύψει.

ΑΦΗΣΤΕ ΜΙΑ ΑΠΑΝΤΗΣΗ

εισάγετε το σχόλιό σας!
παρακαλώ εισάγετε το όνομά σας εδώ