Αντίληψη · 2026-09-24 · 1:50

«Συγκρίσιμο», στο 94 τοις εκατό

Μια εργασία με επικεφαλής την NVIDIA κάνει το περίβλημα γύρω από έναν agent κώδικα να σπαταλά λιγότερα, αντί να φθηναίνει το μοντέλο. Ένας ερευνητής ΤΝ παρακολούθησε χιλιάδες εκτελέσεις, πρότεινε περίπου 150 αλλαγές και κράτησε τέσσερις. Η περίληψη αναφέρει επίδοση «συγκρίσιμη» με το βασικό περίβλημα, με 44,7 έως 49,0 τοις εκατό λιγότερα tokens και περίπου ένα τρίτο χαμηλότερο κόστος.

Υπέρ
  • Πραγματική μηχανική, με κώδικα σε άδεια MIT: συγχώνευση μιας επεξεργασίας με την εντολή που την ακολουθεί, συμπίεση του context μόνο όταν συμφέρει, αντικατάσταση τεράστιων εξόδων με δείκτες, ανάθεση της ανάγνωσης μεγάλων logs σε φθηνότερο μοντέλο με ντετερμινιστικό έλεγχο.
  • Τα κριτήρια αποδοχής ορίστηκαν πριν την αναζήτηση και έμειναν εκτός ελέγχου του agent που βελτιστοποιούσε, ώστε να μην μπορεί να επαναπροσδιορίσει την επιτυχία. Λογική δικλείδα όποτε μια ΤΝ ρυθμίζει μια ΤΝ.
Προσοχή
  • Ο πίνακας είναι ακριβέστερος, και προς τιμήν των συγγραφέων βρίσκεται εκεί: η διαμόρφωση που εξοικονομεί 49 τοις εκατό tokens σκοράρει 42,0 έναντι 44,8 της βάσης, περίπου 94 τοις εκατό. Εκείνη που σκοράρει υψηλότερα εξοικονομεί μόλις 6 τοις εκατό. Καμία ρύθμιση δεν δίνει και τα δύο νούμερα των τίτλων.
  • Η ωριαία εξοικονόμηση προϋποθέτει agent που τρέχει ασυνόδευτος όλο το εικοσιτετράωρο, και ένας από τους μηχανισμούς αρχειοθετεί τοπικά τις μεγάλες εξόδους εργαλείων: αποδοτικό, και άλλο ένα μέρος όπου καταλήγει αποθηκευμένο ό,τι πέρασε από το τερματικό.
Η γνώμη μαςΔεν είναι ελάττωμα της έρευνας, έτσι δουλεύουν οι περιλήψεις: η σύνοψη κρατά το καλύτερο νούμερο σε κάθε άξονα, ο πίνακας κρατά τον συμβιβασμό. Διάβασε τον πίνακα πριν την περίληψη. Το ένα σου λέει τι είναι δυνατό, το άλλο τι κοστίζει.

Πηγή: Liu κ.ά., «SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness», arXiv 2609.20519 (17/9/2026)

← Όλα τα Focus posts