Η νέα έκδοση Gemini 3.6 Flash της Google μειώνει το κόστος για επιχειρησιακούς πράκτορες
Η Google παρουσίασε τις νέες εκδόσεις Gemini 3.6 Flash και 3.5 Flash-Lite, σχεδιασμένες για να μειώσουν την καθυστέρηση και το κόστος των tokens για επιχειρησιακούς πράκτορες τεχνητής νοημοσύνης. Η λειτουργία αυτόνομων λογισμικών σε παραγωγικό περιβάλλον εξαρτάται από μια σταθερή εξίσωση που λίγοι προμηθευτές διαφημίζουν άμεσα. Ένα μοντέλο πρέπει να εκτελεί μια πολυβήματη εργασία με επάρκεια, αλλά κάθε επιπλέον token που παράγει προσθέτει κόστος και καθυστέρηση σε μια διαδικασία που μπορεί να εκτελείται χιλιάδες φορές την ώρα.
Οι ομάδες που αναπτύσσουν πράκτορες υποβάθρου αντί για διεπαφές συνομιλίας χρειάζονται πρώτα απόδοση και δεύτερον αριθμό παραμέτρων. Η απάντηση της Google, όπως ανακοινώθηκε αυτή την εβδομάδα, διαιρεί αυτή την ανταλλαγή μεταξύ τριών μοντέλων: το Gemini 3.6 Flash για κωδικοποίηση και πολυτροπική λογική, το Gemini 3.5 Flash-Lite για εργασία υψηλού όγκου και χαμηλής καθυστέρησης, και μια περιορισμένη έκδοση Gemini 3.5 Flash Cyber για διόρθωση ευπαθειών.
Τα μαθηματικά πίσω από το Gemini 3.6 Flash
Η τεκμηρίωση της Google για το 3.6 Flash επικεντρώνεται σε ένα στοιχείο: 17% λιγότερα tokens εξόδου σε σύγκριση με την προηγούμενη έκδοση 3.5 Flash, σύμφωνα με μετρήσεις από τον Δείκτη Τεχνητής Ανάλυσης. Σε συγκεκριμένες συνθετικές δοκιμές, όπως το benchmark Datacurve DeepSWE, η Google αναφέρει μειώσεις στη χρήση tokens έως και 65%. Η τιμολόγηση τοποθετείται στα $1.50/1M tokens εισόδου και $7.50/1M tokens εξόδου, καθιστώντας το μοντέλο κατάλληλο για συνεχείς λογικούς βρόχους αντί για κατά παραγγελία εκτέλεση.
Στο DeepSWE, η εταιρεία καταγράφει ποσοστό επιτυχίας 49% για το 3.6 Flash έναντι 37% για τον προκάτοχό του. Στο MLE Bench, η βαθμολογία μετακινείται από 49.7% σε 63.9%, και στη δοκιμή GDPval-AA v2 της Google – η οποία προσπαθεί να μετρήσει την πραγματική γνώση εργασίας αντί για παζλ κωδικοποίησης – το 3.6 Flash σημειώνει 1421 έναντι 1349 για το παλαιότερο μοντέλο.
Εφαρμογή του μοντέλου από τις Figma, Hebbia και Harvey
Η Figma έχει ενσωματώσει το 3.6 Flash στην υποδομή πρωτοτύπων της, και σύμφωνα με τον Matt Colyer, Διευθυντή Μηχανικής Προϊόντων της εταιρείας, το μοντέλο προσφέρει στους προγραμματιστές έναν γρηγορότερο δρόμο μέσα από τις επαναλήψεις σχεδίασης χωρίς πτώση στην ποιότητα εξόδου. Η νομική πλατφόρμα τεχνολογίας Harvey και το ερευνητικό εργαλείο Hebbia διοχετεύουν δεδομένα μέσω του μοντέλου για πολυτροπική εργασία εγγράφων: εισάγοντας ακατέργαστες οικονομικές καταθέσεις, αναλύοντας τη δομή των εγγράφων, διαβάζοντας ενσωματωμένα γραφήματα και παράγοντας προσχέδια αναφορών για ανασκόπηση.
Η Google επίσης ενσωμάτωσε ένα εργαλείο χρήσης υπολογιστή στην πλευρά του πελάτη απευθείας στις πλατφόρμες Gemini API και Gemini Enterprise, αφαιρώντας το προσαρμοσμένο ενδιάμεσο λογισμικό που προηγουμένως απαιτούσαν οι μηχανικοί για να επιτρέψουν στα μοντέλα να λειτουργούν πάνω από ένα λειτουργικό σύστημα.
Μια πιο οικονομική κατηγορία για πράκτορες υποβάθρου υψηλού όγκου
Το Gemini 3.5 Flash-Lite στοχεύει σε διαφορετική εργασία: επεξεργασία εγγράφων και αναζήτηση πρακτόρων που εκτελούνται σε όγκο αντί για βάθος λογικής. Ο Δείκτης Τεχνητής Ανάλυσης μέτρησε το μοντέλο στα 350 tokens εξόδου ανά δευτερόλεπτο, το ταχύτερο στη σειρά 3.5 σύμφωνα με την Google. Η τιμολόγηση είναι στα $0.3/1M tokens εισόδου και $2.5/1M tokens εξόδου, αρκετά οικονομική ώστε οι ομάδες μηχανικών να μπορούν να κατευθύνουν απλά, υψηλού όγκου αιτήματα υποπρακτόρων σε ένα ελάχιστο επίπεδο σκέψης και να κρατούν τα υψηλότερα επίπεδα σκέψης για πολυβήματη εργασία.
Στη δοκιμή GDM-MRCR v2 μακροχρόνιου περιεχομένου της Google, το Gemini 3.5 Flash-Lite κατέγραψε ποσοστό επιτυχίας 72.2% έναντι 60.1% για τον προκάτοχό του, και η βαθμολογία του GDPval-AA v2 σχεδόν διπλασιάστηκε, από 642 σε 1140. Το μοντέλο διαθέτει το ίδιο εγγενές εργαλείο χρήσης υπολογιστή όπως το 3.6 Flash.
Gemini 3.5 Flash Cyber: Ένα περιορισμένο μοντέλο για διόρθωση κώδικα
Οι αυτόματοι σαρωτές ευπαθειών πλέον εντοπίζουν ατέλειες ταχύτερα από ό,τι οι περισσότερες ομάδες ασφαλείας μπορούν να τις διορθώσουν, και αυτό το κενό είναι όπου η Google τοποθετεί το Gemini 3.5 Flash Cyber. Το μοντέλο είναι κατασκευασμένο για να επικυρώνει και να διορθώνει ευπάθειες κώδικα, και η Google αναφέρει απόδοση στο benchmark CyberGym ανταγωνιστική με τα πρωτοποριακά μοντέλα (αν και δεν έχει δημοσιεύσει αυτά τα στοιχεία με την ίδια λεπτομέρεια όπως στις εκδόσεις που απευθύνονται σε καταναλωτές).
Η διανομή παραμένει περιορισμένη σε κυβερνήσεις και επιλεγμένους συνεργάτες μέσω ενός πιλοτικού προγράμματος, ένας περιορισμός που η Google πλαισιώνει ως μέτρο ασφαλείας κατά της δημιουργίας εκμεταλλεύσιμου κώδικα για επιθετική χρήση.
Μέσα στον πράκτορα ασφαλείας CodeMender της Google, πολλαπλές περιπτώσεις του 3.5 Flash Cyber λειτουργούν παράλληλα, διασταυρώνοντας τα ευρήματα του ενός με το άλλο πριν παράγουν μια ενιαία αναφορά διόρθωσης που εγκρίνεται από έναν ανθρώπινο αναθεωρητή.
Οι ομάδες μηχανικών που επιθυμούν να ενσωματώσουν αυτά τα νέα μοντέλα μπορούν να τα αποκτήσουν μέσω του Gemini API μέσω του Google AI Studio, του Android Studio ή της Gemini Enterprise Agent Platform. Οι καταναλωτές μπορούν επίσης να αποκτήσουν πρόσβαση στα νέα μοντέλα στην εφαρμογή Gemini και το 3.5 Flash-Lite κυκλοφορεί επίσης στο Google Search.












