Περίληψη

Η Google παρουσίασε τρία νέα μοντέλα Gemini με έμφαση στην ταχύτητα, στο χαμηλότερο κόστος και στην κυβερνοασφάλεια, αλλά η καθυστέρηση του ισχυρότερου Gemini 3.5 Pro εντείνει τις αμφιβολίες για την ανταγωνιστική της θέση.

Παράλληλα, η Anthropic εξασφάλισε δικαστική έγκριση για διακανονισμό 1,5 δισ. δολαρίων με συγγραφείς, ενώ η Poolside παρουσίασε ένα ισχυρό open-weight μοντέλο προγραμματισμού που μπορεί να λειτουργεί σε έναν ισχυρό desktop υπολογιστή.

Η γενικότερη τάση είναι η μετάβαση από την απλή χρήση μοντέλων στην καταγραφή πραγματικών εργασιακών διαδικασιών, στη δημιουργία επαναχρησιμοποιήσιμων AI skills και στην ανάπτυξη ασφαλών, τοπικά εγκατεστημένων agents.

Κύρια σημεία

  • Τρία νέα μοντέλα Gemini

Η Google παρουσίασε τα Gemini 3.6 Flash, 3.5 Flash-Lite και 3.5 Flash Cyber. Οι εκδόσεις καλύπτουν διαφορετικές ανάγκες: γενική αποδοτικότητα, υψηλή ταχύτητα με χαμηλό κόστος και εξειδίκευση στην κυβερνοασφάλεια.

  • Περιορισμένη βελτίωση στις επιδόσεις

Το Gemini 3.6 Flash εμφανίζει αναβαθμίσεις αποδοτικότητας, αλλά σε ορισμένες ανεξάρτητες συγκρίσεις δεν παρουσιάζει ουσιαστική βελτίωση έναντι του 3.5 Flash και υπολείπεται αντίστοιχων ανταγωνιστικών μοντέλων.

  • Το Gemini 3.5 Pro εξακολουθεί να καθυστερεί

Το μοντέλο που αναμένεται να ανταγωνιστεί τις κορυφαίες λύσεις της αγοράς παραμένει σε δοκιμές με συνεργάτες. Αυτό ενισχύει την εντύπωση ότι η Google διαθέτει μεγάλη χρήση και υποδομή, αλλά όχι ακόμη ξεκάθαρο frontier πλεονέκτημα.

  • Το Gemini 4 βρίσκεται ήδη σε εκπαίδευση

Η Google ξεκίνησε αυτό που χαρακτηρίζει ως το πιο φιλόδοξο pre-training run που έχει πραγματοποιήσει μέχρι σήμερα. Μεγάλο μέρος της μελλοντικής ανταγωνιστικής της θέσης φαίνεται να εξαρτάται από αυτή τη γενιά.

  • Διακανονισμός 1,5 δισ. δολαρίων για την Anthropic

Εγκρίθηκε η συμφωνία με συγγραφείς για περίπου 482.000 έργα που φέρεται να είχαν αποκτηθεί από πειρατικές πηγές. Η αποζημίωση πλησιάζει τα 3.000 δολάρια ανά τίτλο.

  • Νόμιμη η εκπαίδευση, παράνομη η πηγή των βιβλίων

Η κρίσιμη διάκριση του δικαστηρίου είναι ότι η εκπαίδευση AI μπορεί να θεωρείται fair use, αλλά η δημιουργία αρχείου εκατομμυρίων πειρατικών βιβλίων αποτελεί ξεχωριστή παραβίαση.

  • Διατηρείται ένα σημαντικό προηγούμενο για την AI

Παρά το τεράστιο κόστος του διακανονισμού, η Anthropic απέφυγε μια δίκη με πιθανές αποζημιώσεις εκατοντάδων δισεκατομμυρίων δολαρίων και διατήρησε ανέπαφη την ευνοϊκή απόφαση για τη χρήση νομίμως αποκτημένων βιβλίων στην εκπαίδευση μοντέλων.

  • AI workflow audit ως συμβουλευτική υπηρεσία

Προτείνεται μια πρακτική διαδικασία μέσω της οποίας ένας σύμβουλος:

    • εντοπίζει ένα συγκεκριμένο επιχειρηματικό πρόβλημα,
    • αξιολογεί την ωριμότητα AI μιας εταιρείας,
    • βρίσκει το workflow με τη μεγαλύτερη δυνητική απόδοση,
    • παρουσιάζει τις προτεινόμενες λύσεις,
    • μετατρέπει το audit σε έργο υλοποίησης.
  • Το audit πρέπει να οδηγεί σε μετρήσιμο έργο

Δεν αρκεί μια γενική παρουσίαση δυνατοτήτων AI. Το αποτέλεσμα πρέπει να προσδιορίζει bottleneck, εργατοώρες, κόστος, κίνδυνο, πιθανή εξοικονόμηση και επόμενο βήμα υλοποίησης.

  • Νέο open-weight μοντέλο προγραμματισμού από την Poolside

Το Laguna S 2.1 διαθέτει συνολικά 118 δισ. παραμέτρους, αλλά ενεργοποιεί μόνο 8 δισ. κάθε φορά. Έτσι μπορεί να λειτουργήσει σε ένα Nvidia DGX Spark και προσφέρεται με διαθέσιμα βάρη.

  • Παραμένει η υπεροχή των κινεζικών open models

Παρά τις υψηλές επιδόσεις του Laguna μεταξύ των δυτικών ανοικτών μοντέλων, εξακολουθεί να υπολείπεται του Kimi K3 και άλλων κινεζικών λύσεων.

  • Η αυτοφιλοξενία αποκτά επιχειρηματική σημασία

Μικρότερα και αποτελεσματικότερα open-weight μοντέλα μπορούν να λειτουργούν σε ιδιόκτητη υποδομή, προσφέροντας μεγαλύτερο έλεγχο δεδομένων, περιορισμό εξάρτησης από APIs και προβλέψιμο λειτουργικό κόστος.

  • Καταγραφή μιας διαδικασίας και μετατροπή της σε AI skill

Η Anthropic παρουσίασε λειτουργία με την οποία ο χρήστης καταγράφει την οθόνη του ενώ εκτελεί μια εργασία και το Claude δημιουργεί ένα επαναχρησιμοποιήσιμο skill βασισμένο στη συγκεκριμένη διαδικασία.

  • AI agents ως συνεργάτες σε ομαδικές συνομιλίες

Το Buzz του Jack Dorsey αποτελεί open-source χώρο εργασίας όπου agents μπορούν να συμμετέχουν σε ομαδικές συζητήσεις ως ψηφιακοί συνεργάτες.

  • Εξειδικευμένα συστήματα κυβερνοασφάλειας

Το Fugu-Cyber της Sakana AI συνδυάζει πολλούς εξειδικευμένους agents πίσω από ένα API, δείχνοντας ότι οι agent ομάδες αρχίζουν να ανταγωνίζονται τα ενιαία μεγάλα μοντέλα σε συγκεκριμένους τομείς.

  • Αξιολόγηση περιεχομένου από πολλαπλές AI περσόνες

Μια ενδιαφέρουσα πρακτική είναι η αξιολόγηση ενός έργου από διαφορετικές τεχνητές περσόνες —αναγνώστη, εκδότη, παραγωγό και επιχειρηματικό αξιολογητή— και η επανάληψη της διαδικασίας σε διαφορετικά μοντέλα, ώστε να εντοπίζονται κοινά συμπεράσματα και αδυναμίες.