Κορυφαία αμερικανικά εργαστήρια AI, όπως η OpenAI και η Anthropic, κυκλοφορούν φθηνότερα μοντέλα καθώς δίνουν μάχη για να διατηρήσουν πελάτες που είναι ευαίσθητοι στο κόστος και στρέφονται σε οικονομικότερες εναλλακτικές από Κινέζους ανταγωνιστές.
Ο πόλεμος τιμών εκτυλίσσεται καθώς οι αυξανόμενες δαπάνες για AI ωθούν τις εταιρείες να περιορίσουν τη χρήση και να αναζητήσουν φθηνότερα μοντέλα, βοηθώντας Κινέζους developers, μεταξύ άλλων τις Moonshot και DeepSeek, να διεισδύσουν σε πελατολόγια από τη Silicon Valley έως την Ευρώπη.
Η OpenAI ανακοίνωσε πρόσφατα ότι μειώνει κατά 80% τις τιμές του GPT-5.6 Luna, του «ταχύτερου και πιο προσιτού μοντέλου» της. Η Anthropic λάνσαρε το Claude Opus 5, προβάλλοντας την «τεχνολογία αιχμής σε επίπεδο intelligence... στη μισή τιμή» του Fable 5, του πιο ικανού μοντέλου της εταιρείας.
Οι κινήσεις αυτές έχουν συμβάλει στη μείωση κατά σχεδόν ένα τέταρτο των τιμών που πληρώνουν οι πελάτες για μοντέλα από τα κορυφαία αμερικανικά εργαστήρια από τα μέσα Ιουλίου, σύμφωνα με τον δείκτη τιμών token της Silicon Data. Τα tokens είναι οι μονάδες δεδομένων που επεξεργάζονται τα γλωσσικά μοντέλα και χρησιμοποιούνται για τον υπολογισμό των χρεώσεων πολλών πελατών.
Οι περικοπές σηματοδοτούν μια αλλαγή για τους αμερικανικούς ομίλους AI που αναπτύσσουν ιδιόκτητα «κλειστά» μοντέλα και οι οποίοι μέχρι σήμερα ανταγωνίζονταν σε μεγάλο βαθμό με βάση τις επιδόσεις. Τα ολοένα πιο ικανά «ανοιχτά» κινεζικά μοντέλα — τα οποία μπορούν να κατεβαίνουν δωρεάν και να τροποποιούνται από developers — έχουν συμβάλει στην άσκηση πιέσεων στις τιμές.
Οι κινήσεις αυτές έρχονται επίσης καθώς η OpenAI και η Anthropic σχεδιάζουν αρχικές δημόσιες προσφορές με αποτιμήσεις τρισεκατομμυρίων δολαρίων, ενώ οι επενδυτές αναζητούν ενδείξεις ότι οι τεράστιες δαπάνες του κλάδου για AI μπορούν να αποφέρουν αποδόσεις.
Οι εταιρικοί χρήστες AI αντιμετωπίζουν πιέσεις στο κόστος καθώς η Anthropic και η OpenAI μετακινούν ορισμένους εταιρικούς πελάτες από σταθερές συνδρομές προς χρέωση βάσει χρήσης, στο πλαίσιο της οποίας οι εταιρείες πληρώνουν ανάλογα με τους υπολογιστικούς πόρους που καταναλώνουν.
Ορισμένες επιχειρήσεις έχουν αντιδράσει στην αύξηση των λογαριασμών επιβάλλοντας όρια στη χρήση AI ή δοκιμάζοντας φθηνότερες εναλλακτικές. Εταιρείες όπως η DoorDash και η Airbnb έχουν δηλώσει ότι άρχισαν να χρησιμοποιούν κινεζικής κατασκευής μοντέλα, σε μια προσπάθεια να περιορίσουν τις δαπάνες.
Η στροφή αυτή συνέπεσε με μια καταιγίδα νέων κυκλοφοριών από κινεζικά εργαστήρια, τα οποία έχουν περιορίσει το χάσμα επιδόσεων έναντι των κορυφαίων αμερικανικών μοντέλων, εντείνοντας τις ανησυχίες στον αμερικανικό τεχνολογικό κλάδο ότι οι Αμερικανοί developers θα μπορούσαν να χάσουν πελάτες, παρότι δαπανούν μεγάλα ποσά για να διατηρήσουν το τεχνολογικό τους προβάδισμα, σημειώνουν οι Financial Times.
Οι τελευταίες μειώσεις τιμών από τα αμερικανικά εργαστήρια αφορούν προϊόντα μεσαίας κατηγορίας και τα καθιστούν πιο ανταγωνιστικά έναντι των κινεζικών προσφορών. Η OpenAI, για παράδειγμα, μείωσε την τιμή του GPT-5.6 Luna από $1 σε $0,20 ανά 1 εκατ. tokens εισόδου και από $6 σε $1,20 ανά 1 εκατ. tokens εξόδου.
Η Anthropic λάνσαρε το Opus 5 στα $5 ανά 1 εκατ. tokens εισόδου και $25 ανά 1 εκατ. tokens εξόδου — στη μισή τιμή του μοντέλου Fable 5. Αυτή την εβδομάδα, η εταιρεία ακύρωσε προγραμματισμένη αύξηση των τιμών για το μοντέλο Sonnet 5, η οποία επρόκειτο να τεθεί σε ισχύ από τον Σεπτέμβριο.
Ωστόσο, οι ονομαστικές τιμές των tokens δεν παρέχουν μια ευθεία σύγκριση μεταξύ των μοντέλων AI. Τα πιο ικανά μοντέλα μπορούν ορισμένες φορές να ολοκληρώσουν μια εργασία χρησιμοποιώντας λιγότερα tokens ή λιγότερες προσπάθειες, πράγμα που σημαίνει ότι ένα μοντέλο που φαίνεται ακριβότερο με βάση την ονομαστική τιμή των tokens μπορεί τελικά να κοστίζει λιγότερο.
Επιπλέον, τα περισσότερα μπορούν να λειτουργούν με διαφορετικές ρυθμίσεις «effort», οι οποίες διαφοροποιούν την υπολογιστική ισχύ που χρησιμοποιείται για την απάντηση σε ένα ερώτημα και μπορούν να επηρεάσουν τόσο τις επιδόσεις, όσο και το τελικό κόστος ολοκλήρωσης μιας εργασίας.
Η Artificial Analysis, η οποία αξιολογεί μοντέλα σε τομείς όπως τα μαθηματικά, η επιστήμη, ο προγραμματισμός και η συλλογιστική, διαπίστωσε ότι το Opus 5 της Anthropic σε επίπεδο «medium» effort παρείχε παρόμοιες επιδόσεις και κόστος ανά εργασία με το Kimi K3 της Moonshot σε επίπεδο «max» effort. Το GPT-5.6 Luna της OpenAI σε επίπεδο «max» effort είχε παρόμοιες επιδόσεις με το V4 Flash της DeepSeek σε επίπεδο «max», αλλά κόστιζε λίγο λιγότερο από το διπλάσιο ανά εργασία.
Η Anthropic και η OpenAI αρνήθηκαν να σχολιάσουν.