Το νέο μοντέλο της Anthropic μειώνει το κόστος εκτέλεσης εντολών κατά 75%

0


Σύνοψη

  • Η Anthropic ανακοίνωσε επίσημα το Claude Haiku 5.5, το οποίο αποτελεί το ταχύτερο και πιο προσιτό οικονομικά μοντέλο τεχνητής νοημοσύνης στο τεχνολογικό χαρτοφυλάκιό της.
  • Το κόστος χρήσης για ερωτήματα μικρότερα των 100.000 tokens διαμορφώνεται στα 0,10 δολάρια ανά εκατομμύριο input tokens, σημειώνοντας τεράστια πτώση 90% σε σχέση με την προηγούμενη γενιά.
  • Οι προγραμματιστές αποκτούν για πρώτη φορά την ελευθερία να επιλέξουν μεταξύ πέντε διαφορετικών επιπέδων προσπάθειας (από Low έως Max) προκειμένου να εξισορροπήσουν το λειτουργικό κόστος με την απαιτούμενη πολυπλοκότητα των απαντήσεων.
  • Το αναβαθμισμένο μοντέλο καταγράφει υψηλότερες επιδόσεις από το ανταγωνιστικό GPT-6 Luna της OpenAI στα περισσότερα benchmarks.
  • Η διάθεσή του στους προγραμματιστές έχει ήδη ξεκινήσει μέσω των υποδομών Cloud της Amazon, της Microsoft και της Google, καθώς και από το επίσημο Claude Platform.

Η Anthropic προχώρησε στην επίσημη κυκλοφορία του Claude Haiku 5.5, ενός νέου γλωσσικού μοντέλου το οποίο εστιάζει στην ταχύτητα απόκρισης και την αποτελεσματική διαχείριση εργασιών μεγάλου όγκου με εξαιρετικά χαμηλό λειτουργικό κόστος. 

Η ανακοίνωση έρχεται λίγες ημέρες μετά την παρουσίαση του Sonnet 5.5 και μόλις ένα μήνα μετά το κορυφαίο Opus 5.5, ολοκληρώνοντας πλήρως την τελευταία γενιά εργαλείων τεχνητής νοημοσύνης της αμερικανικής εταιρείας. 

Το νέο AI εργαλείο απευθύνεται αποκλειστικά σε προγραμματιστές και σύγχρονες επιχειρήσεις που χρειάζονται άμεσες, αυτοματοποιημένες απαντήσεις για απαιτητικές εφαρμογές όπως η ζωντανή εξυπηρέτηση πελατών, η μαζική ταξινόμηση δεδομένων και οι γρήγορες περιλήψεις τεράστιων εγγράφων, διατηρώντας παράλληλα την απαιτούμενη μαθηματική ακρίβεια στις παραγόμενες εξόδους.

Το Claude Haiku 5.5 αποτελεί το νέο, μικρού μεγέθους γλωσσικό μοντέλο της Anthropic, κατασκευασμένο για ταχύτητα και αυτοματοποιημένες εργασίες μεγάλου όγκου. Κοστίζει 0,10 δολάρια ανά εκατομμύριο input tokens και 0,50 δολάρια ανά εκατομμύριο output tokens για ερωτήματα έως 100.000 tokens. Παρέχει ρυθμιζόμενα επίπεδα απόδοσης μέσω API και ξεπερνά το GPT-6 Luna στις δοκιμές αξιολόγησης.

Η νέα τιμολογιακή πολιτική που ακολουθεί η εταιρεία καθιστά το φρέσκο μοντέλο σχεδόν 75% φθηνότερο κατά μέσο όρο σε σχέση με τον άμεσο προκάτοχό του, το Haiku 4.5. Εάν οι προγραμματιστικές εντολές παραμείνουν κάτω από το βασικό όριο των 100.000 tokens, η συνολική μείωση του κόστους αγγίζει το 90%, δημιουργώντας τεράστια περιθώρια βιωσιμότητας για τις ψηφιακές πλατφόρμες που εκτελούν χιλιάδες μικρές αυτοματοποιημένες λειτουργίες σε καθημερινή βάση. Για μεγαλύτερα και πιο απαιτητικά ερωτήματα που ξεπερνούν το προαναφερθέν όριο, το λειτουργικό κόστος διαμορφώνεται στα 0,50 δολάρια ανά εκατομμύριο tokens εισόδου και 2,50 δολάρια για τα αντίστοιχα tokens εξόδου. 

Πρέπει βεβαίως να ληφθεί σοβαρά υπόψη η ταυτόχρονη ενσωμάτωση ενός νέου, τεχνολογικά εξελιγμένου tokenizer από την Anthropic, το οποίο οδηγεί αναπόφευκτα σε ελαφρώς αυξημένη κατανάλωση tokens ανά εργασία συγκριτικά με την προηγούμενη γενιά. Η τεχνική αυτή ιδιαιτερότητα ωστόσο δεν αναιρεί το τεράστιο οικονομικό πλεονέκτημα, καθώς η δραματική πτώση της αρχικής τιμής υπερκαλύπτει εύκολα την οποιαδήποτε μικρή αύξηση στην τελική καταμέτρηση των παραγόμενων tokens.

Ρυθμιζόμενα επίπεδα προσπάθειας και εντυπωσιακά τεχνικά χαρακτηριστικά

Από αυστηρά τεχνολογικής άποψης, το πιο ρηξικέλευθο στοιχείο της νέας κυκλοφορίας εντοπίζεται στην εισαγωγή των ρυθμιζόμενων επιπέδων προσπάθειας (effort settings) για την κατηγορία Haiku. Οι υπεύθυνοι ανάπτυξης λογισμικού μπορούν πλέον να επιλέγουν κατά βούληση μεταξύ πέντε διαφορετικών διαβαθμίσεων απόδοσης: Low, Medium, High, Xhigh και Max. Όσο υψηλότερο είναι το επιλεγμένο επίπεδο μέσω των παραμέτρων του API, τόσο πιο έξυπνη, αναλυτική και ακριβής γίνεται η παραγόμενη απόκριση, προκαλώντας φυσικά τον ανάλογο αντίκτυπο στο τελικό κόστος εκτέλεσης του κώδικα. Η νέα ευελιξία επιτρέπει στα εταιρικά τμήματα IT να βελτιστοποιούν δυναμικά τον οικονομικό προϋπολογισμό τους, χρησιμοποιώντας παραδείγματος χάριν τη χαμηλότερη ρύθμιση για απλές ταξινομήσεις βάσεων δεδομένων και τη μέγιστη δυνατή ρύθμιση για πολύπλοκες αναλύσεις κώδικα ή διαχείριση συστημάτων.

Οι αναλυτικές μετρήσεις απόδοσης που δημοσίευσε επισήμως η Anthropic καταδεικνύουν την ξεκάθαρη ανωτερότητα του νέου μοντέλου απέναντι σε άμεσα ανταγωνιστικές προτάσεις της σύγχρονης αγοράς. Στην απαιτητική δοκιμασία OSWorld 2.1, η οποία αξιολογεί αυστηρά την ικανότητα ενός αλγορίθμου να διαχειρίζεται γραφικά περιβάλλοντα λειτουργικών συστημάτων και να ολοκληρώνει σύνθετα βήματα, το Haiku 5.5 σημείωσε ποσοστό επιτυχίας 72,4% στην offline έκδοση, αφήνοντας πολύ πίσω του το πολυσυζητημένο GPT-6 Luna της OpenAI το οποίο σταμάτησε μόλις στο 48,9%. Παράλληλα, στη δοκιμασία Agentic coding Terminal-Bench 4.0, το μικρό μοντέλο της Anthropic έφτασε το 39,2%, προσφέροντας μια εξαιρετικά αξιόπιστη και ταχύτατη λύση ως δευτερεύων πράκτορας (subagent) που μπορεί κάλλιστα να συνεργαστεί αρμονικά με μεγαλύτερα και ακριβότερα μοντέλα, όπως το Opus 5.5, για την οριστική επίλυση προβλημάτων σε πηγαίο κώδικα.

Εκτεταμένες βελτιώσεις τιμολόγησης στο ευρύτερο οικοσύστημα της Anthropic

Πέρα από την εντυπωσιακή κυκλοφορία του βασικού μοντέλου, η εταιρεία ανακοίνωσε πρόσθετες στρατηγικές αλλαγές που επηρεάζουν θετικά τον συνολικό τρόπο λειτουργίας όλων των διαθέσιμων υπηρεσιών της. Το σταθερό κόστος για την ανάγνωση αποθηκευμένων δεδομένων (cache reads) στο δημοφιλές και ισχυρότερο μοντέλο Sonnet 5.5 μειώθηκε δραστικά κατά 50%, φτάνοντας πλέον στα 0,10 δολάρια ανά εκατομμύριο tokens. Ο αναθεωρημένος τιμοκατάλογος μεταφράζεται σε μια άμεση, μετρήσιμη εξοικονόμηση της τάξης του 20% για τους μεγάλους οργανισμούς που επιλέγουν να εκτελούν συνεχώς πολύπλοκες, πολυεπίπεδες λειτουργίες αυτόνομων αντιπροσώπων (agentic tasks). 

Ταυτόχρονα, τα επαγγελματικά προγράμματα συνδρομής Max και Team αποκτούν πλέον ενσωματωμένες πιστώσεις API κάθε ημερολογιακό μήνα, ξεκινώντας από 100 δολάρια για τους βασικούς χρήστες Max 5x και φτάνοντας έως τα 500 δολάρια για τους μεγάλους ομαδικούς λογαριασμούς, γεγονός που δίνει τεράστια ώθηση στον καθημερινό πειραματισμό και την απρόσκοπτη δημιουργία νέων, καινοτόμων εφαρμογών λογισμικού.

Εταιρείες κολοσσοί που συμμετείχαν ενεργά στις πρώιμες και κλειστές δοκιμές του συστήματος μοιράστηκαν ήδη εξαιρετικά ενθαρρυντικά, πραγματικά αποτελέσματα. Οι μηχανικοί λογισμικού της δημοφιλούς πλατφόρμας διαχείρισης έργων Asana ανέφεραν ραγδαία μείωση του χρόνου καθυστέρησης κατά 30% και μια εντυπωσιακή αύξηση της συνολικής ταχύτητας εξαγωγής συμπερασμάτων, φτάνοντας συχνά σε ταχύτητες δυόμισι φορές μεγαλύτερες ανά κύκλο αλληλεπίδρασης. Αντίστοιχα, κορυφαίες πλατφόρμες διαχείρισης πελατολογίου (CRM) όπως το HubSpot αξιοποίησαν τις προηγμένες δυνατότητες του μοντέλου για τον ταχύτατο εντοπισμό παλαιών και εξαιρετικά διφορούμενων εγγραφών, καταγράφοντας το υψηλότερο ποσοστό ευστοχίας που έχουν δει ποτέ, με ταυτόχρονη ελαχιστοποίηση των ψευδώς θετικών ενδείξεων.

Σε επίπεδο επιχειρησιακής ασφάλειας και αυστηρής συμμόρφωσης με τους κανονισμούς, οι εσωτερικές αρχιτεκτονικές δικλείδες προστασίας έχουν αυστηροποιηθεί αισθητά για να αποτρέψουν κακόβουλες χρήσεις. Το έξυπνο σύστημα διαθέτει πλέον περαιτέρω ενισχυμένα πρωτόκολλα κυβερνοασφάλειας που εμποδίζουν αυτόματα τεχνικές ελέγχου διείσδυσης και άλλες επιθετικές μεθόδους που θα μπορούσαν ενδεχομένως να αξιοποιηθούν από χάκερς, διατηρώντας ωστόσο τη σχετική ελευθερία στους διαχειριστές για την εκτέλεση νόμιμων αμυντικών εργασιών ελέγχου. 

Εξάλλου, η Anthropic προχώρησε στην επίσημη ενημέρωση των Software Development Kits (SDKs) για τις γλώσσες Python και TypeScript, ενσωματώνοντας σε αρχική δοκιμαστική μορφή (beta) την υποστήριξη για αυτοματοποιημένη χρήση υπολογιστή και περιήγηση στον ιστό, επιτρέποντας στους developers να χτίσουν συστήματα που δρουν εντελώς αυτόνομα μέσα στον browser του τελικού χρήστη.



Πηγή