Μετάβαση στο περιεχόμενο
Entagl

AI News · industry

AI Browser Agents το 2026: Τι είναι Πραγματικό και Τι Επικίνδυνο

Η OpenAI απέσυρε τον browser Atlas στις 9 Αυγούστου. Η πραγματική δράση μετακινήθηκε στους agents computer-use που χειρίζονται λογισμικό απευθείας. Δείτε πού κατατάσσονται, τι εξακολουθούν να κάνουν λάθος και την πραγματικότητα της ασφάλειας που οι επιχειρήσεις δεν μπορούν να αγνοήσουν.

Entagl Team9 λεπτά ανάγνωσης
AI Browser Agents το 2026: Τι είναι Πραγματικό και Τι Επικίνδυνο

Η OpenAI έκλεισε τον αποκλειστικό browser ChatGPT Atlas στις 9 Αυγούστου 2026, λιγότερο από έναν χρόνο μετά την κυκλοφορία του, και το μήνυμα πίσω από αυτή την κίνηση είναι η πραγματική ιστορία: ο αυτόνομος "AI browser" σβήνει, ενώ ο agent που χειρίζεται λογισμικό εκ μέρους σας είναι το σημείο όπου τρέχει ο κλάδος. Από τον Αύγουστο του 2026, τα κορυφαία μοντέλα computer-use μπορούν να εντοπίσουν έναν στόχο σε μια επαγγελματική οθόνη με ακρίβεια σχεδόν 88%, όμως ακόμη και το καλύτερο από αυτά ολοκληρώνει μόνο περίπου μία στις πέντε εργασίες πολλαπλών βημάτων από την αρχή ως το τέλος. Οι AI browser agents είναι ταυτόχρονα γνήσια χρήσιμοι και γνήσια αναξιόπιστοι, και το χάσμα ανάμεσα σε αυτές τις δύο αλήθειες είναι εκεί που πλέον κρίνεται κάθε απόφαση αγοράς.

Αυτό το άρθρο εξηγεί τι άλλαξε το 2026, πού πραγματικά κατατάσσονται οι agents computer-use σε παγκόσμιο επίπεδο, γιατί τα εντυπωσιακά νούμερα των benchmarks υπερτιμούν το τι μπορούν να κάνουν, και το πρόβλημα ασφάλειας που κανένας προμηθευτής δεν έχει λύσει. Αν διοικείτε μια επιχείρηση, το πρακτικό συμπέρασμα βρίσκεται στο τέλος.

Τι απέγιναν οι AI browsers το 2026;

Οι AI browsers ήταν το δημοφιλές προϊόν του 2025. Εταιρείες, μεγάλες και μικρές, προσπάθησαν να κυριαρχήσουν στη διεπαφή που χρησιμοποιεί ο κόσμος για να περιηγηθεί στο διαδίκτυο, ενσωματώνοντας ένα μοντέλο μέσα σε αυτήν. Το 2026 αυτό το στοίχημα ξεδιπλώθηκε γρήγορα. Η OpenAI επιβεβαίωσε ότι θα αποσύρει τον Atlas και θα ενσωματώσει τις λειτουργίες περιήγησής του στην εφαρμογή ChatGPT για desktop, με τον browser να προγραμματίζεται να σταματήσει να λειτουργεί στις 9 Αυγούστου (9to5Mac). Η The Browser Company πουλήθηκε στην Atlassian, και ανταγωνιστικοί AI-first browsers ενοποιήθηκαν ή άλλαξαν κατεύθυνση.

Ο κοινός παρονομαστής, όπως το έθεσε το TechCrunch, είναι ότι "η εστίαση έχει μετατοπιστεί στους agents και στην αυτοματοποίηση" (TechCrunch). Ένας ξεχωριστός browser δεν ήταν ποτέ το ζητούμενο. Το ζητούμενο είναι ένας agent που μπορεί να διαβάσει μια σελίδα, να κάνει κλικ, να πληκτρολογήσει και να ολοκληρώσει μια εργασία. Αυτή η δυνατότητα ενσωματώνεται πλέον στα εργαλεία που ο κόσμος ήδη χρησιμοποιεί, αντί να πωλείται ως ένας νέος προορισμός.

Το σήμα της ζήτησης είναι πραγματικό. Η Gartner αναμένει ότι το 40% των εταιρικών εφαρμογών θα κυκλοφορεί με AI agents ειδικούς για συγκεκριμένες εργασίες μέχρι το τέλος του 2026, από λιγότερο από 5% το 2025 (Gartner). Το ερώτημα δεν είναι πια αν θα έρθουν οι agents. Είναι αν μπορούμε να τους εμπιστευτούμε τα κλειδιά.

Τι είναι ένας agent computer-use, και σε τι διαφέρει από έναν AI browser;

Ένας agent computer-use (μερικές φορές ονομάζεται CUA) χειρίζεται το λογισμικό όπως ένας άνθρωπος: τραβάει ένα στιγμιότυπο οθόνης, αποφασίζει πού να κάνει κλικ ή τι να πληκτρολογήσει, ενεργεί και μετά κοιτάζει ξανά. Ένας AI browser είναι ένα από τα οχήματα παράδοσης αυτής της ιδέας, ένας browser Chromium με έναν agent προσαρτημένο πάνω του. Όμως ο υποκείμενος agent μπορεί εξίσου εύκολα να τρέξει μέσα σε μια εφαρμογή desktop, σε ένα cloud sandbox ή σε ένα λειτουργικό σύστημα.

Η διάκριση έχει σημασία επειδή οι δύο τρόποι αποτυχίας είναι διαφορετικοί. Ένας βοηθός συνομιλίας απαντά σε μια ερώτηση. Ένας agent computer-use εκτελεί μια ενέργεια, και μια ενέργεια έχει συνέπειες: μπορεί να υποβάλει μια φόρμα, να μετακινήσει χρήματα ή να διαγράψει ένα αρχείο. Γι' αυτό επίσης αυτή η κατηγορία agent είναι ένα βήμα πέρα από τους agents αγορών και ολοκλήρωσης παραγγελιών που καλύψαμε στο agentic commerce το 2026, και γι' αυτό χρειάζεται το επίπεδο διακυβέρνησης που περιγράψαμε στο τι νέο υπάρχει στους AI agents το 2026. Η δυνατότητα χωρίς έλεγχο δεν είναι προϊόν. Είναι κίνδυνος.

Πού κατατάσσονται οι agents computer-use αυτή τη στιγμή;

Δύο benchmarks έχουν σημασία, και μετρούν πολύ διαφορετικά πράγματα. Το ScreenSpot Pro ελέγχει το grounding: μπορεί το μοντέλο να δείξει το σωστό κουμπί, εικονίδιο ή πεδίο σε μια επαγγελματική διεπαφή υψηλής ανάλυσης; Δεν ελέγχει αν ο agent μπορεί να ολοκληρώσει τη γύρω ροή εργασίας. Στο δημόσιο στιγμιότυπο του ScreenSpot Pro με ημερομηνία 11 Αυγούστου 2026, οι πρωτοπόροι ήταν πολύ κοντά, και το πεδίο ήταν παγκόσμιο.

Κατάταξη Μοντέλο Εργαστήριο (χώρα) Άδεια ScreenSpot Pro
1 Claude Opus 4.8 Anthropic (ΗΠΑ) Κλειστό 87.9%
2 GPT-5.4 OpenAI (ΗΠΑ) Κλειστό 85.4%
3 Qwen3.8 Max Alibaba (Κίνα) Κλειστό 84.5%
4 Gemini 3.1 Pro Google (ΗΠΑ) Κλειστό 84.4%
5 Muse Spark Meta (ΗΠΑ) Κλειστό 84.1%
8 Muse Glimmer 30B Meta (ΗΠΑ) Ανοιχτά βάρη 75.4%
10 Holo2-235B H Company (Γαλλία) Ανοιχτά βάρη 70.6%
13 Qwen3.5 397B Alibaba (Κίνα) Ανοιχτά βάρη 65.6%
15 Nemotron 3 Nano Omni NVIDIA (ΗΠΑ) Ανοιχτά βάρη 57.8%

Πηγή: BenchLM ScreenSpot Pro leaderboard, στιγμιότυπο με ημερομηνία 11 Αυγούστου 2026. Οι κατατάξεις αναδιατάσσονται κάθε μήνα.

Δύο πράγματα ξεχωρίζουν. Πρώτον, ανάμεσα στα μοντέλα που βαθμολογήθηκαν στο ScreenSpot Pro στις 11 Αυγούστου 2026, ένα κλειστό μοντέλο των ΗΠΑ, το Claude (Opus 4.8) της Anthropic, ηγήθηκε στο grounding με 87.9%, όμως τα τέσσερα κορυφαία βρίσκονταν εντός τεσσάρων μονάδων μεταξύ τους, και ένα κινεζικό κλειστό μοντέλο, το Qwen3.8 Max της Alibaba, κατετάγη τρίτο, πάνω από μια ναυαρχίδα των ΗΠΑ. Δεύτερον, η βαθμίδα των ανοιχτών βαρών είναι πραγματική και παγκόσμια: το Muse Glimmer της Meta (ΗΠΑ), το Holo2 της H Company (Γαλλία), το Qwen της Alibaba (Κίνα) και το Nemotron της NVIDIA (ΗΠΑ) εμφανίζονται όλα, μαζί με την ανοιχτού κώδικα γενιά GUI-agent από κινεζικά εργαστήρια όπως το UI-TARS της ByteDance και το AutoGLM της Zhipu.

Διαβάστε αυτόν τον πίνακα ως έναν πίνακα κατάταξης εν κινήσει, όχι ως ένα μόνιμο στέμμα. Και τα δύο εργαστήρια των ΗΠΑ κυκλοφόρησαν νεότερες ναυαρχίδες μετά το στιγμιότυπο, το Claude Opus 5 της Anthropic (24 Ιουλίου 2026) και το GPT-5.6 της OpenAI (9 Ιουλίου 2026), και κανένα δεν έχει βαθμολογηθεί ακόμη στο ScreenSpot Pro, οπότε το προβάδισμα στο grounding διαβάζεται ως "το καλύτερο ανάμεσα στα μοντέλα που βαθμολογήθηκαν μέχρι τώρα", όχι ως ο τελευταίος λόγος. Σε αυτό το στιγμιότυπο η κορυφή είναι αμερικανική με μικρή διαφορά, το εύρος είναι παγκόσμιο, και η ανοιχτή βαθμίδα κλείνει την ψαλίδα. Αυτό το πεδίο αναδιατάσσεται κάθε μήνα.

Γιατί τα σκορ των benchmarks υπερτιμούν το τι μπορούν να κάνουν αυτοί οι agents

Το grounding είναι προϋπόθεση, όχι γραμμή τερματισμού. Το πιο δύσκολο ερώτημα είναι αν ένας agent ολοκληρώνει μια πραγματική εργασία πολλαπλών βημάτων, και η ειλικρινής απάντηση στα μέσα του 2026 είναι: συνήθως όχι.

Στο OSWorld 2.0, ένα benchmark ροών εργασίας μακρού ορίζοντα που κατά μέσο όρο περιλαμβάνουν περίπου 318 κλήσεις εργαλείων ανά εργασία, το καλύτερο μετρημένο σύστημα ολοκλήρωσε μόνο περίπου 20.6% των εργασιών από την αρχή ως το τέλος, ακόμη και ενώ σκόραρε 54.8% όταν μετρήθηκαν τα μερικά σημεία ελέγχου (ανάλυση της TestMu AI). Οποιοδήποτε νούμερο βλέπετε στην περιοχή 50% έως 70% σε αυτή την κατηγορία benchmark είναι σχεδόν σίγουρα βαθμολόγηση σημείων ελέγχου, όχι πλήρης ολοκλήρωση. Η ίδια ανάλυση επισημαίνει μια δεύτερη παγίδα: ένα σκορ OSWorld είναι συνήθως μια εκτίμηση από μία μόνο εκτέλεση, και η αξιοπιστία δεν μπορεί να συναχθεί από την επίλυση μιας εργασίας μία φορά. Τρέξτε την ίδια εργασία αρκετές φορές και τα ποσοστά ολοκλήρωσης πέφτουν.

Το πού δουλεύει ο agent έχει επίσης σημασία. Η ίδια ανάλυση αναφέρει περίπου 80% επιτυχία σε εργασίες web έναντι περίπου 35% σε εφαρμογές desktop, οπότε ένας agent που φαίνεται ικανός σε έναν browser είναι αισθητά λιγότερο αξιόπιστος τη στιγμή που τον εγκαταλείπει. Ακριβώς γι' αυτό ο "AI browser agent" ήταν η πρώτη μορφή: ο browser είναι η πιο φιλική επιφάνεια, δομημένη, ανεκτική και εύκολη στην παρατήρηση.

Το συμπέρασμα δεν είναι ότι οι agents computer-use είναι ψεύτικοι. Είναι ότι η δυνατότητα είναι πραγματική και βελτιώνεται, ενώ η αξιοπιστία υστερεί, κάθε σημαντική επιφάνεια εξακολουθεί να φέρει την ετικέτα beta ή preview, και τα σκορ μίας εκτέλεσης κολακεύουν την τεχνολογία. Για μια επίδειξη, το 20% ολοκλήρωσης είναι θαύμα. Για μια μη επιτηρούμενη επιχειρηματική διαδικασία, είναι λόγος να κρατάτε έναν άνθρωπο στη διαδικασία.

Το πρόβλημα ασφάλειας που κανείς δεν έχει λύσει

Το χάσμα αξιοπιστίας είναι ζήτημα παραγωγικότητας. Το χάσμα ασφάλειας είναι ζήτημα διακυβέρνησης, και είναι χειρότερο. Στο Black Hat USA 2026, ερευνητές από τα Zenity Labs επέδειξαν μια κατηγορία zero-click exploits που ονομάζουν "PleaseFix" και επηρεάζει τους agentic browsers σε όλους τους προμηθευτές (Dark Reading). Η βασική αιτία είναι δομική: ένας AI agent αντλεί περιεχόμενο από emails, ημερολόγια, έγγραφα και ιστοσελίδες, και δεν μπορεί να ξεχωρίσει αξιόπιστα μια νόμιμη οδηγία από μια κακόβουλη κρυμμένη μέσα σε αυτό το περιεχόμενο. Έτσι ακολουθεί και τις δύο.

Οι επιθέσεις που επιδείχθηκαν δεν είναι θεωρητικές. Μια δηλητηριασμένη πρόσκληση ημερολογίου κατέλαβε έναν agent χωρίς καμία αλληλεπίδραση χρήστη και έφτασε σε τοπικά αρχεία και σε ροές εργασίας διαχειριστή κωδικών. Ένας φαινομενικά συνηθισμένος σύνδεσμος πυροδότησε έναν άλλον agent να στέλνει μηνύματα phishing από τον ίδιο τον λογαριασμό μηνυμάτων του θύματος. Όπως το έθεσε η ομάδα της Zenity, ένας AI browser "ενεργεί στον ιστό ως ο υπάλληλός σας, ήδη συνδεδεμένος στο email, τα αρχεία, το ημερολόγιο και τις εφαρμογές εργασίας του". Ένας agent που κληρονομεί την πλήρη πιστοποιημένη πρόσβαση ενός ανθρώπου κληρονομεί και όλη την εμβέλεια της ζημιάς του.

Δεν υπάρχει καθαρό patch, επειδή η έκθεση προέρχεται από τον σχεδιασμό, όχι από ένα μεμονωμένο bug. Η συμβουλή των ερευνητών είναι αποκαλυπτική: υποθέστε ότι ο agent θα καταληφθεί, αποφασίστε τι χειρότερο θα μπορούσε να κάνει, και αφαιρέστε ό,τι δεν χρειάζεται πραγματικά. Αυτή είναι οδηγία διακυβέρνησης, όχι ενημέρωση λογισμικού. Γι' αυτό επίσης η εμπιστοσύνη των αγοραστών παραμένει περιορισμένη. Σε μια έρευνα του κλάδου, μόνο περίπου 20% των στελεχών δήλωσαν ότι θα εμπιστεύονταν έναν AI agent για την εκτέλεση οικονομικών συναλλαγών, έναντι 38% για ανάλυση δεδομένων χαμηλότερου διακυβεύματος (PwC AI Agent Survey). Η Gartner, από την πλευρά της, αναμένει ότι περισσότερα από 40% των έργων agentic AI θα ακυρωθούν μέχρι το τέλος του 2027, επικαλούμενη το κόστος, την ασαφή αξία και τους αδύναμους ελέγχους κινδύνου (Gartner).

Τι σημαίνει αυτό για τις επιχειρήσεις

Ιδού η πρακτική ανάγνωση. Ένας agent γενικού σκοπού που χειρίζεται έναν browser με την πλήρη συνδεδεμένη ταυτότητά σας είναι ισχυρός, αναξιόπιστος και δύσκολο να περιοριστεί. Για τις περισσότερες επιχειρηματικές εργασίες, δεν το χρειάζεστε αυτό. Χρειάζεστε το αποτέλεσμα (ένα κλεισμένο ραντεβού, μια απαντημένη ερώτηση, μια παραγγελία που αναζητήθηκε) το οποίο συλλαμβάνεται μέσα από μια στενή, ελεγχόμενη διαδρομή, με έναν άνθρωπο ικανό να παρέμβει.

Αυτή είναι η διαφορά ανάμεσα σε έναν agent στον οποίο δίνονται τα κλειδιά για τα πάντα και έναν agent στον οποίο δίνονται ακριβώς τα εργαλεία που απαιτεί μια εργασία. Στην Entagl, ο agent που απευθύνεται στους πελάτες είναι ένα pipeline πολλαπλών agents, όχι ένα μεμονωμένο μοντέλο που πιλοτάρει έναν browser. Ενεργεί μέσα από εργαλεία περιορισμένου εύρους και προσαρμοσμένες συναρτήσεις HTTP που καλούν μόνο τα συστήματα που προορίζεται να αγγίξει, κλείνει πραγματικά ραντεβού σε ένα πραγματικό ημερολόγιο, και μεταβιβάζει σε ένα ανθρώπινο inbox με guardrails εξόδου σε κάθε απάντηση. Δεν συνδέεται στους λογαριασμούς ενός πελάτη ούτε αυτοσχεδιάζει στον ανοιχτό ιστό, οπότε μια δηλητηριασμένη σελίδα ή μια κακόβουλη πρόσκληση ημερολογίου δεν έχει πουθενά να προσγειωθεί. Όπως υποστηρίξαμε στο human-in-the-loop AI, εξηγημένο, η αρχή σχεδιασμού είναι απλή: το AI ενεργεί, οι άνθρωποι διακυβερνούν.

Το μάθημα της στιγμής των browser-agents του 2026 δεν είναι "περιμένετε την τεχνολογία". Είναι "περιορίστε την τεχνολογία". Οι επιχειρήσεις που κερδίζουν με τους agents είναι εκείνες που δίνουν σε έναν agent μια σαφή δουλειά, την ελάχιστη πρόσβαση για να την κάνει, και έναν άνθρωπο στη διαδρομή κλιμάκωσης, αντί για τη μέγιστη αυτονομία ελπίζοντας ότι το περιεχόμενο που διαβάζει είναι πάντα ειλικρινές.

FAQ

Ποια είναι η διαφορά ανάμεσα σε έναν AI browser και έναν agent computer-use;

Ένας AI browser είναι ένας web browser με ενσωματωμένο έναν AI agent. Ένας agent computer-use είναι η υποκείμενη δυνατότητα: ένα μοντέλο που χειρίζεται λογισμικό κοιτάζοντας την οθόνη, κάνοντας κλικ και πληκτρολογώντας. Ο agent μπορεί να τρέξει μέσα σε έναν browser, σε μια εφαρμογή desktop ή σε ένα cloud sandbox. Το 2026 ο κλάδος απομακρύνθηκε από την πώληση αυτόνομων AI browsers και στράφηκε προς την ενσωμάτωση agents computer-use στα υπάρχοντα εργαλεία, γι' αυτό η OpenAI απέσυρε τον browser Atlas και μετέφερε τις λειτουργίες στο ChatGPT.

Είναι οι agents computer-use αρκετά αξιόπιστοι ώστε να τρέχουν επιχειρηματικές εργασίες χωρίς επιτήρηση;

Όχι για τις περισσότερες εργασίες υψηλού διακυβεύματος ακόμη. Σε μεγάλες ροές εργασίας πολλαπλών βημάτων, τα καλύτερα μετρημένα συστήματα ολοκληρώνουν μόνο περίπου 20% των εργασιών από την αρχή ως το τέλος, τα σκορ benchmark μίας εκτέλεσης υπερτιμούν την πραγματική αξιοπιστία, και οι agents είναι αισθητά ασθενέστεροι εκτός του browser. Για επιχειρηματική χρήση, το ασφαλές μοτίβο είναι ένας agent στενά περιορισμένου εύρους με έναν άνθρωπο στη διαδικασία, όχι πλήρης μη επιτηρούμενη αυτονομία.

Ποιος είναι ο κύριος κίνδυνος ασφάλειας με τους AI browser agents;

Το prompt injection μέσω περιεχομένου. Ένας agent δεν μπορεί να διαχωρίσει αξιόπιστα μια γνήσια οδηγία από μια κακόβουλη κρυμμένη σε ένα email, μια πρόσκληση ημερολογίου, ένα έγγραφο ή μια ιστοσελίδα, οπότε ένας επιτιθέμενος μπορεί να παρεισφρήσει κρυφές εντολές και να ανακατευθύνει τον agent χρησιμοποιώντας την ίδια τη συνδεδεμένη πρόσβαση του χρήστη. Ερευνητές επέδειξαν zero-click καταλήψεις σε πολλαπλούς agentic browsers στο Black Hat USA 2026. Ο μετριασμός είναι να περιοριστεί το τι μπορεί να προσεγγίσει ο agent, όχι να τον εμπιστευτούμε ότι θα συμπεριφερθεί σωστά.

Πώς πρέπει μια μικρή επιχείρηση να υιοθετήσει AI agents με ασφάλεια;

Ξεκινήστε με μια οριοθετημένη δουλειά (απάντηση σε μηνύματα πελατών, κλείσιμο ραντεβού, αναζήτηση παραγγελιών), δώστε στον agent μόνο τα εργαλεία και τα δεδομένα που χρειάζεται αυτή η δουλειά, κρατήστε έναν άνθρωπο ικανό να αναλάβει, και προτιμήστε πλατφόρμες που ενεργούν μέσα από ελεγχόμενα εργαλεία αντί για την οδήγηση του συνδεδεμένου σας browser. Αυτό συλλαμβάνει το κέρδος παραγωγικότητας ενώ κρατά την εμβέλεια της ζημιάς μικρή αν κάτι πάει στραβά.

Δείτε πώς ένας ελεγχόμενος, human-in-the-loop agent χειρίζεται πραγματικές συνομιλίες πελατών σε chat και φωνή. Κλείστε ένα demo 30 λεπτών και θα το προσαρμόσουμε στην επιχείρησή σας.

Πηγές: 9to5Mac και TechCrunch για τη μετατόπιση στους AI browsers· Gartner και Gartner για την υιοθέτηση και τις ακυρώσεις· BenchLM ScreenSpot Pro (11 Αυγούστου 2026) για το grounding· TestMu AI για τα ποσοστά ολοκλήρωσης στο OSWorld 2.0· Dark Reading για την έρευνα "PleaseFix" των Zenity Labs· PwC AI Agent Survey για την εμπιστοσύνη στους agents. Οι εκδόσεις των μοντέλων και οι κατατάξεις ισχύουν από τον Αύγουστο του 2026 και αλλάζουν κάθε μήνα.

Δημοσιεύτηκε από Entagl Team on