Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

Μετά από 2 μέρες που έκανα αρκετή χρήση, όσον αφορά τις προγραμματιστικές διεργασίες αρχικά, το Opus 5 είναι σημαντικά καλύτερο από το 4.8 ωστόσο, σε πραγματικά task χρειάζεται 2-3 φορές τον χρόνο και τα tokens του 4.8. Είναι εξαιρετικά μεθοδικό, αναλυτικό και δεν λαμβάνει αποφάσεις αν δεν έχει εξαντλήσει κάθε δυνατή πηγή πληροφοριών σχετικά με το εκάστοτε πρόβλημα. Αυτά στο effort level "high".

Ένα "πρόβλημα" που παρατηρώ, είναι πως στα σημεία επαφής με τον χρήστη, δεν είναι εξίσου ευχάριστο με το Opus 4.6 ή το Fable 5. Είναι σαν να έχεις έναν ultra-senior προγραμματιστή, specialist στα πάντα, ο οποίος όμως είναι φλύαρος και κάθεται να σου υπερ-αναλύει σε σεντόνια την υλοποίηση. Για όσους προτιμούν να του δώσουν συγκεκριμένες οδηγίες με σκοπό να κάνει εξαιρετικά στοχευμένες αλλαγές, θα το αγαπήσουν. Εάν θέλω να συζητήσω μια ιδέα για προσθήκες/αλλαγές στην αρχιτεκτονική, προτιμώ να το κάνω με το Fable και μετά να βάλει το Opus να το υλοποιήσει. Οι διαφορές που έχω εντοπίσει σε σχέση με το 5.6 Sol για όσο το χρησιμοποίησα από το API, περιορίζονται κυρίως στον τρόπο που προσεγγίζουν ένα πρόβλημα με το Sol να επικεντρώνεται σε προφανή προβλήματα στην αρχιτεκτονική, τελειώνοντας στο 1/4 του χρόνου των μοντέλων της Claude, που κάνουν κάθε πιθανή ή απίθανη προσομοίωση για να μαζέψουν όλες τις οριακές περιπτώσεις. Και το Sol γράφει πολύ καλά πάντως, εάν ξέρεις τι σου γίνεται και τι θέλεις, δεν έχεις πρόβλημα.

Στα υπόλοιπα tasks, κυρίως στο co-work που χρησιμοποιώ καθημερινά, όποιο μοντέλο μεταξύ των Fable/Opus 5 και να χρησιμοποιήσει κανείς, συνεχίζουν να δίνουν σαφώς καλύτερα αποτελέσματα σε σχέση με τον Copilot. Ειδικά στις παρουσιάσεις και το τι μπορεί να κάνει στο Excel είναι μέρα με τη νύχτα.

Στις Max συνδρομές, η ενσωματωμένη χρήση έχει αυξηθεί πολύ και το θέμα με τα όρια φαίνεται να έχει λυθεί το τελευταίο δίμηνο. Η OpenAI που δίνει απεριόριστη χρήση στο chat, συνεχίζει να είναι πιο γενναιόδωρη.
 
Μετά από 2 μέρες που έκανα αρκετή χρήση, όσον αφορά τις προγραμματιστικές διεργασίες αρχικά, το Opus 5 είναι σημαντικά καλύτερο από το 4.8 ωστόσο, σε πραγματικά task χρειάζεται 2-3 φορές τον χρόνο και τα tokens του 4.8. Είναι εξαιρετικά μεθοδικό, αναλυτικό και δεν λαμβάνει αποφάσεις αν δεν έχει εξαντλήσει κάθε δυνατή πηγή πληροφοριών σχετικά με το εκάστοτε πρόβλημα. Αυτά στο effort level "high".

Ένα "πρόβλημα" που παρατηρώ, είναι πως στα σημεία επαφής με τον χρήστη, δεν είναι εξίσου ευχάριστο με το Opus 4.6 ή το Fable 5. Είναι σαν να έχεις έναν ultra-senior προγραμματιστή, specialist στα πάντα, ο οποίος όμως είναι φλύαρος και κάθεται να σου υπερ-αναλύει σε σεντόνια την υλοποίηση. Για όσους προτιμούν να του δώσουν συγκεκριμένες οδηγίες με σκοπό να κάνει εξαιρετικά στοχευμένες αλλαγές, θα το αγαπήσουν. Εάν θέλω να συζητήσω μια ιδέα για προσθήκες/αλλαγές στην αρχιτεκτονική, προτιμώ να το κάνω με το Fable και μετά να βάλει το Opus να το υλοποιήσει. Οι διαφορές που έχω εντοπίσει σε σχέση με το 5.6 Sol για όσο το χρησιμοποίησα από το API, περιορίζονται κυρίως στον τρόπο που προσεγγίζουν ένα πρόβλημα με το Sol να επικεντρώνεται σε προφανή προβλήματα στην αρχιτεκτονική, τελειώνοντας στο 1/4 του χρόνου των μοντέλων της Claude, που κάνουν κάθε πιθανή ή απίθανη προσομοίωση για να μαζέψουν όλες τις οριακές περιπτώσεις. Και το Sol γράφει πολύ καλά πάντως, εάν ξέρεις τι σου γίνεται και τι θέλεις, δεν έχεις πρόβλημα.

Στα υπόλοιπα tasks, κυρίως στο co-work που χρησιμοποιώ καθημερινά, όποιο μοντέλο μεταξύ των Fable/Opus 5 και να χρησιμοποιήσει κανείς, συνεχίζουν να δίνουν σαφώς καλύτερα αποτελέσματα σε σχέση με τον Copilot. Ειδικά στις παρουσιάσεις και το τι μπορεί να κάνει στο Excel είναι μέρα με τη νύχτα.

Στις Max συνδρομές, η ενσωματωμένη χρήση έχει αυξηθεί πολύ και το θέμα με τα όρια φαίνεται να έχει λυθεί το τελευταίο δίμηνο. Η OpenAI που δίνει απεριόριστη χρήση στο chat, συνεχίζει να είναι πιο γενναιόδωρη.
Αυτό πάντως με το copilot που χρησιμοποιεί το ίδιο μοντέλο με το τελευταίο της OpenAI και τελικά τα Plugin της OpenAI σε Excel και PowerPoint να δουλεύουν αισθητά καλύτερα από το Copilot εκεί με ξεπερνά.
Πάντως συνεχίζω να φτιάχνω excel και powerpoint απευθείας στο chat του chatgpt και απλά κάνω τις τελικές διορθώσεις μέσα στα προγράμματα. Από το 5.4 βελτιώθηκε η κατάσταση και με το 5.5 και τώρα με το 5.6 πρακτικά θεωρώ ότι οι διαφορές με τις υλοποιήσεις της anthropic που ήταν απίστευτά μπροστά έχουν μειωθεί πάρα πολύ.
 
Έβγαλαν πολυσέλιδο οδηγό για το πως να γράφεις τα prompt σου στο Opus 5.
Και η αλήθεια είναι πως έχουν δίκιο, ξεκινούν μάλιστα με το πρόβλημα που ανέφερα παραπάνω, το ότι υπεραναλύει τις υλοποιήσεις σε εξαιρετικό βαθμό.

Δουλεύοντας το λίγο περισσότερο και με λυμένο το "nerdiness", είναι εξαιρετικό. Σαφώς καλύτερο από το 4.8 που αντικατέστησε.
Επίσης έκανα λίγες δοκιμές ακόμη όσον αφορά το development σε σχέση με το 5.6 Sol μέσα από το API στο Azure.

Στο claude code πλέον για το Opus 5, δεν στήνει οπωσδήποτε subagents, οπότε τα καθημερινά θέματα, ολοκληρώθηκαν εξαιρετικά γρηγορότερα από τις αρχικές μου δοκιμές, πλέον πιο γρήγορα από το Sol. Επίσης με αυτόν τον τρόπο, η συνδρομή max πρακτικά επιτρέπει να τρέχεις ένα session opus 5 24/7. Μόνο στο claude code, η δική μου χρήση τη τελευταία εβδομάδα είναι η παρακάτω.

1785182641753.png

Στο backend που με ενδιαφέρει -και μπορώ να αξιολογήσω τη λογική του τι γράφουν, και τα δύο, ενίοτε με διαφορετικές προσεγγίσεις, υλοποιούν τον στόχο που θέτεις. Σε κάτι πιο περίπλοκο που έβαλα μόνο στο Opus, να βελτιστοποιήσει όλα τα Integration tests μιας εφαρμογής, το έκανε θεαματικά, πλέον χρειάζεται όλη η σουίτα 8,5 φορές λιγότερο χρόνο για να τρέξει. Από περιέργεια κράτησα το codebase χωρίς τις βελτιστοποιήσεις ώστε να ζητήσω το ίδιο και από το Sol αύριο.

Εάν κάπου καταλήγω πάντως, είναι στο ότι τα μοντέλα της Anthropic συνολικά, είναι πολύ πιο ευχάριστα κατά τη διάδραση μαζί τους σε σχέση με κάθε άλλο lab. Το ότι μπορείς να τρέχεις τα πάντα σε container της Anthropic και με κλειστό PC, βλέποντας την πρόοδο από το κινητό σου δεν ξέρω αν το έχει και το codex, πάντως είναι εξαιρετικό. Όπως και να έχει, κουτσά - στραβά, όλες οι μεγάλες εταιρίες στον επόμενο χρόνο θα έχουν μοντέλα που να τα κάνουν όλα.

Σε άλλα νέα, η Microsoft παρουσίασε τη δική της λύση για cybersecurity:

1785182778311.png

Και η Kimi σήμερα έβγαλε διαθέσιμο το K3 δωρεάν, να το τρέξει ο καθένας στην υποδομή του.
Επειδή δεν ξέρεις τι σου ξημερώνει με τις ΗΠΑ, το κατέβασα και προσωπικά και στη δουλειά για παν ενδεχόμενο. Για να τρέξει βέβαια, θέλει πρακτικά ένα GB200 cluster, που και να θέλεις να το πληρώσεις, δεν υπάρχει.

Τέλος, 50% έκπτωση από την OpenAI για τα Terra & Luna μοντέλα της μέσω της openrouter.

1785183570588.png
 
Last edited:
Αυτό πάντως με το copilot που χρησιμοποιεί το ίδιο μοντέλο με το τελευταίο της OpenAI και τελικά τα Plugin της OpenAI σε Excel και PowerPoint να δουλεύουν αισθητά καλύτερα από το Copilot εκεί με ξεπερνά.
Πάντως συνεχίζω να φτιάχνω excel και powerpoint απευθείας στο chat του chatgpt και απλά κάνω τις τελικές διορθώσεις μέσα στα προγράμματα. Από το 5.4 βελτιώθηκε η κατάσταση και με το 5.5 και τώρα με το 5.6 πρακτικά θεωρώ ότι οι διαφορές με τις υλοποιήσεις της anthropic που ήταν απίστευτά μπροστά έχουν μειωθεί πάρα πολύ.
Τρέχω το 5.6 . Ζήτησα μέσω chat σε περιβάλλον work να μου φτιάξει ένα manual χωρισμένο σε 3x4 κουτάκια που να χωράνε σε μια Α4 που να διπλώνει. Χαλί μαύρο. Το ιδιο prompt το έδωσα στο codex και έμεινα χαζός. Όχι μόνο δεν χρειάστηκε εικόνες. Άνοιξε τον κώδικα που έχω γράψει για το εργαλείο και αντέγραψε pixel pixel πως φαίνονται τα γραφικά στην οθόνη του εργαλείου. Μάλιστα του έδωσα και ένα αρχείο dxf και έφτιαξε και την εικόνα του εργαλείου από το 3d αρχείο....
Δεν το είχα για τέτοια χρήση το codex...
 
To codex φτιάχτηκε αρχικά για να διευκολύνει τη χρήση σε εφαρμογές προγραμματισμού. Στην πράξη είναι είναι ένα πλαίσιο να στήνεις και να οργανώνεις πολυπρακτορικά συστήματα που κάνουν αυτόνομη εργασία. Όσο περισσότερο το μαθαίνεις τόσο βλέπεις ότι ο προγραμματισμός ήταν απλά το σημείο εκκίνησης.
Το χρησιμοποιώ για οτιδήποτε μπορώ να αυτοματοποιήσω. Το μόνο κακό που έχει είναι ότι έχιε όρια που είναι διαφορετικά ανάλογα με τη συνδρομή που έχεις. Μόνο για αυτό το λόγο χρησιμοποιώ το chat που είναι σχεδόν απεριόριστη η χρήση του για δουλειές που είτε θέλουν να δω απάντηση πριν συνεχίσω είτε δεν επείγουν τόσο για να έχω αποτέλεσμα στον ελάχιστο χρόνο, είτε τα βρίσκω ενδιαφέροντα - τα βαρετά που δεν θέλω να ασχοληθώ παραπάνω τα στέλνω στο codex.

Ξεκινώ δειλά δειλά να μαθαίνω να χρησιμοποιώ το computer use. Το πρώτο project που τρέχω για να δω πόσο μπορώ να το πιέσω και πόσο γρήγορο είναι, έχει να κάνει με το να το βάλω να πάρει πλήρη χρήση ενός virtual machine που τρέχω, να δει project προσομοιώσεων / βελτιστοποιήσεων, να μάθει από αυτά και να φτιάξει καινούργια project που περιλαμβάνουν και γράψιμο νέου κώδικα, recompiling του πυρήνα του ενός προγράμματος βελτιστοποίησης, τρέξιμο optimizations, κλπ...Θεωρητικά δεν υπάρχει κανένας λόγος να μην γίνεται. Το κακό ότι πρέπει να βρω 3-4 ημέρες συνεχόμενες να πέσω από πάνω και να παρακολουθώ πως το κάνει για να μάθω να το καθοδηγώ καλύτερα...
 
...
Και η Kimi σήμερα έβγαλε διαθέσιμο το K3 δωρεάν, να το τρέξει ο καθένας στην υποδομή του.
Επειδή δεν ξέρεις τι σου ξημερώνει με τις ΗΠΑ, το κατέβασα και προσωπικά και στη δουλειά για παν ενδεχόμενο. Για να τρέξει βέβαια, θέλει πρακτικά ένα GB200 cluster, που και να θέλεις να το πληρώσεις, δεν υπάρχει.
...
Και εγώ έχω αρχίσει και κατεβάζω μοντέλα "να υπάρχουν" γιατί ποτέ δεν ξέρεις. Επίσης έχω δει ότι παλαιότερα μοντέλα μπορούν να συνεχίσουν σε συγκεκριμένες εφαρμογές να αποδίδουν καλύτερα από νεώτερα / μεγαλύτερα μοντέλα όπως το Qwen3 4B Instruct 2507, οπότε δεν σβήνω και μοντέλα μόνο και μόνο επειδή είναι παλαιότερα.

Από την άλλη το πιο πιθανό για μένα είναι να πάρω ένα mini-pc με 128 GB unified memory (ή 192 αν περιμένω) και αν έρθει η ώρα που θα χρειαστεί να τρέξω 2 τέτοια μαζί με κόστος συνολικό ~7000-10000 ευρώ.

Επίσης ρεαλιστικά το μέγιστο που θα μπορούσε κάποιος να τρέξει σε κάποιο μικρό γραφείο είναι με ~25000 ευρώ 4 DGX Spark που το μεγαλύτερο μοντέλο που μπορούν να τρέξουν είναι το Nemotron 3 Ultra 550B-A55B NVFP4. Ε, κάτι μεγαλύτερο από αυτό (πχ. Kimi K3, GLM-5.2) δεν μπαίνω στον κόπο να τα κατεβάσω.
 
Όσο αφορά τις θέσεις εργασίας, έχουμε περάσει στο επόμενο στάδιο. Εκεί που είχαμε πολλές απολύσεις και απίστευτες μειώσεις νέων προσλήψεων ειδικά junior εργαζομένων, η αγορά αλλάζει και εταιρίες ψάχνουν για νέους με ευρείες γνώσεις. Θυμάμαι όταν ήμουν στο Λύκειο ψάχναμε να δούμε τι μας αρέσει για να εμβαθύνουμε και τελικά αυτό που σου έδινε ένα πλεονέκτημα στην αγορά εργασίας ήταν η εξειδίκευση.
Αυτό τώρα αντιστρέφεται, και θέλουμε πιο πολύπλευρη παιδεία. Πρέπει να έχεις βασικές γνώσεις οικονομικών, κοινωνιολογίας, ψυχολογίας, μηχανικής ανεξάρτητα τι δουλειά τελικά θα κάνεις. Το άρθρο μιλάει και για κριτική σκέψη, αλλά αυτό ήταν πάντα ζητούμενο τουλάχιστον στα δικά μου μάτια. Απλά αν κάποιος είχε άριστες εξειδικευμένες γνώσεις χωρίς κοινή λογική / κριτική σκέψη είχε απλά ένα ταβάνι στην εξέλιξή του που δεν ήταν σε καμιά περίπτωση καταδικαστική.


Το πιστεύω και εγώ. Αλλά το πιστεύω σήμερα Ιούλιο 2026. Δεν ξέρω για πόσο θα αντέξει και αυτό. Μπορεί να αντέξει για 2-3-5 χρόνια και μετά και αυτό να γίνει "last year". Ακόμη και τα σημερινά μοντέλα αν ξέρεις να τα χρησιμοποιήσεις κάνουν άνετα και καλύτερα δουλειές μεταπτυχιακού σε ένα εξειδικευμένο αντικείμενο. Το θέμα είναι ο χρήστης να καταλαβαίνει τι θέλει, πως να το ζητήσει και πως να ζητήσει από την ίδια την ΑΙ να του κάνει αμερόληπτη αξιολόγηση της εξόδου της και φυσικά να βελτιώσει την έξοδο αντίστοιχα μέχρι να επιτευχθεί το απαιτούμενο επίπεδο στην έξοδο.

Το βλέπω και σε φίλους που τους έχω βοηθήσει τους τελευταίους μήνες να αρχίσουν να χρησιμοποιούν τα LLM αποδοτικά για τη δουλειά τους. Ακόμη και άνθρωποι με τελείως διαφορετικό πεδίο ενασχόλησης αν θέλουν πραγματικά να μάθουν και έχουν και κριτική σκέψη φτάνουν σε λίγους μήνες στο 80-90% από αυτό που μπορεί να του προσφέρει ένα LLM μέσω chat. Το πρόβλημα αρχίζει όταν ξεκινάς να μιλάς για πολυπρακτορικά συστήματα και πως μπορείς να αρχίσεις να χρησιμοποιείς codex και claude code. Και προφανώς δεν μιλάω για προγραμματισμό. Μιλάω για νομικούς, κοινωνικούς επιστήμονες, ερευνητές. Και προφανώς ενώ τα codex / claude code / claude cowork κλπ αρχικά στήθηκαν σαν εργαλεία προγραμματισμού, πια είναι πλατφόρμες στησίματος και τρεξίματος πολυπρακτορικών συστημάτων. Εδώ είναι ελάχιστοι αυτοί που καταλαβαίνουν. Ελάχιστοι πιάνουν τι παίζει, κάθονται και διαβάζουν και μαθαίνουν γιατί αντιλαμβάνονται τι έχουν να κερδίσουν. Κάποιοι άλλοι στην ουσία ζητάνε στοχευμένη βοήθεια για workflows που πονάνε και φτάνουν σε ένα σημείο να καταλαβαίνουν, να στήνουμε μαζί ένα πλαίσιο εργασίας και να αρχίσουν να το χρησιμοποιούν. Κάποιοι απλά θα το χρησιμοποιούν επαναληπτικά σαν κλειστό εργαλείο, κάποιοι άλλοι θα το βελτιώσουν μόνοι τους και μαθαίνοντας μέσα από αυτό θα μάθουν τελικά να φτιάχνουν και άλλα workflows. Όμως η συντριπτική πλειοψηφία το χάνει. Ενώ μπορούσε να καταλάβει τι κανεις με το chat το άλλο απλά τους φαίνεται βουνό και το παρατάνε.

Στο σήμερα τώρα. Αν έχεις ευρείες γνώσεις και σε μάθουν πως λειτουργούν τα σημερινά εργαλεία θα είναι καλό και για σένα γιατί θα είσαι πολύ ευέλικτος στο που μπορείς να δουλέψεις και να είσαι και χρήσιμος για μια εταιρία. Οπότε τείνω να συμφωνήσω με όλα αυτά που λέει το άρθρο. Όμως αυτό που δεν ξέρω είναι για πόσο καιρό θα συνεχίσει αυτό και πότε η πραγματικότητα το αλλάξει και αυτό.

Δείτε τη συνέντευξη του Elon Musk στον Economist. Από τις ελάχιστες συνεντεύξεις που η δημοσιογράφος τον πίεσε πολύ για τις φασιστικές απόψεις που εκφράζει τελευταία και όχι μόνο σε μία ερώτηση αλλά σε συνέχεια ερωτήσεων. Αλλά πέρα από αυτό που είναι στο τελευταίο κομμάτι της συνέντευξης στο πρώτο μέρος τον ρωτάει για τα χρήματα, τη φορολογία κλπ και απαντά ότι τα χρήματα θα είναι irrelevant το 2035. Όταν τον ρωτάει τι θα κάνει ο κόσμος, πως θα βγάζει λεφτά τότε, απλά απαντάει Universal High Income (UHI). Όχι λίγα για να την παλέψεις, αλλά πολλά για να καταναλώσεις. Και αυτή πιστεύω είναι η συζήτηση του σήμερα. Όπως επίσης οι απόλυτες δηλώσεις του για τον πόλεμο στην Ουκρανία και επίσης η παραδοχή ότι η Κίνα έχει απλά κερδίσει, απλά δεν γνωρίζουμε το πότε, γιατί έχει τα πάντα σε μεγαλύτερο βαθμό (οκ οκ δεν έχουν τα καλύτερα τσιπ αυτή τη στιγμή, αλλά πλησιάζουν, έχουν απίστευτα περισσότερη διαθέσιμη ηλεκτρική ενέργεια, έχουν πολύ περισσότερους κορυφαίους προγραμματιστές ΑΙ, έχουν βελτιστοποιήσει το λογισμικό για να παίρνουν καλύτερα αποτελέσματα από χειρότερο hardware και το θέμα είναι αν θα πετύχουν η ΗΠΑ AGI πριν έρθει πλήρης εξισσορόπηση).

To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Προσωπικά το UHI βλέπω ότι είναι σίγουρα ένα από τα διαθέσιμα μονοπάτια προς τα εμπρός.
Κάποτε λίγοι εκμεταλλευόντουσαν άμεσα πολλούς ανθρώπους και ο φεουδάρχης / βασιλιάς έβγαζε πλούτο και είχε καλύτερη ζωή από τη δυστυχία των εργαζομένων.
Αργότερα το σύστημα χοντρικά απέκτησε πρόσβαση στη μηχανή και αυτό οδοήγησε στη δημιουργία στρωμάτωσης. Η μηχανή παρήγαγε αξία, το μεγαλύτερο κομμάτι το έπαιρναν η μετεξέλλιξη των φεουδαρχών, όμως μεσαία στρώματα έπαιρναν και αυτά ένα σημαντικό κομμάτι της υπεραξίας που παρήγαγε η μηχανή για την οικονομία.
Ήδη ο μέσος άνθρωπος του 2026 ζει καλύτερα από σχεδόν όλες τις απόψεις από ένα βασιλιά μισό αιώνα πριν.
Τώρα με το ΑΙ, την άνοδο των ρομπότ, την επιτάγχυνση της επιστήμης μπορούν όλες αυτές να παράγουν τέτοια ποσά πλούτου που να γίνουν όλοι οι άνθρωποι πλούσιοι.
Φυσικά υπάρχουν και άλλα μονοπάτια.
 
  • Like
Reactions: Th.ARvan
Day X με το Claude.
Ακόμη το ΑΙ είναι απλά ηλίθιο.
Πειράματα για best practices αποτυγχάνουν παταγωδώς.
Κάνω ένα api call στην Stripe για συνδρομές όπου μπορώ να δίνω trial period.
Η trial period είναι ρυθμιζόμενη με variable.
ΚΑΘΕ μα ΚΑΘΕ μοντέλο όταν λέω ότι μπορεί να είναι και 0, προσπαθεί να πιάσει το exception, να κάνει retry κλπ.
ΚΑΝΕΝΑ ρε δεν σκέφτεται απλά να μη στείλει την παράμετρο!
 
Day X με το Claude.
Ακόμη το ΑΙ είναι απλά ηλίθιο.
Πειράματα για best practices αποτυγχάνουν παταγωδώς.
Κάνω ένα api call στην Stripe για συνδρομές όπου μπορώ να δίνω trial period.
Η trial period είναι ρυθμιζόμενη με variable.
ΚΑΘΕ μα ΚΑΘΕ μοντέλο όταν λέω ότι μπορεί να είναι και 0, προσπαθεί να πιάσει το exception, να κάνει retry κλπ.
ΚΑΝΕΝΑ ρε δεν σκέφτεται απλά να μη στείλει την παράμετρο!
Αν του το πεις να μην τη στείλει, ότι αυτή είναι valid επιλογή, συνεχίζει να το κάνει;
 
Όσο αφορά τις θέσεις εργασίας, έχουμε περάσει στο επόμενο στάδιο. Εκεί που είχαμε πολλές απολύσεις και απίστευτες μειώσεις νέων προσλήψεων ειδικά junior εργαζομένων, η αγορά αλλάζει και εταιρίες ψάχνουν για νέους με ευρείες γνώσεις. Θυμάμαι όταν ήμουν στο Λύκειο ψάχναμε να δούμε τι μας αρέσει για να εμβαθύνουμε και τελικά αυτό που σου έδινε ένα πλεονέκτημα στην αγορά εργασίας ήταν η εξειδίκευση.
Αυτό τώρα αντιστρέφεται, και θέλουμε πιο πολύπλευρη παιδεία. Πρέπει να έχεις βασικές γνώσεις οικονομικών, κοινωνιολογίας, ψυχολογίας, μηχανικής ανεξάρτητα τι δουλειά τελικά θα κάνεις. Το άρθρο μιλάει και για κριτική σκέψη, αλλά αυτό ήταν πάντα ζητούμενο τουλάχιστον στα δικά μου μάτια. Απλά αν κάποιος είχε άριστες εξειδικευμένες γνώσεις χωρίς κοινή λογική / κριτική σκέψη είχε απλά ένα ταβάνι στην εξέλιξή του που δεν ήταν σε καμιά περίπτωση καταδικαστική.


Το πιστεύω και εγώ. Αλλά το πιστεύω σήμερα Ιούλιο 2026. Δεν ξέρω για πόσο θα αντέξει και αυτό. Μπορεί να αντέξει για 2-3-5 χρόνια και μετά και αυτό να γίνει "last year". Ακόμη και τα σημερινά μοντέλα αν ξέρεις να τα χρησιμοποιήσεις κάνουν άνετα και καλύτερα δουλειές μεταπτυχιακού σε ένα εξειδικευμένο αντικείμενο. Το θέμα είναι ο χρήστης να καταλαβαίνει τι θέλει, πως να το ζητήσει και πως να ζητήσει από την ίδια την ΑΙ να του κάνει αμερόληπτη αξιολόγηση της εξόδου της και φυσικά να βελτιώσει την έξοδο αντίστοιχα μέχρι να επιτευχθεί το απαιτούμενο επίπεδο στην έξοδο.

Το βλέπω και σε φίλους που τους έχω βοηθήσει τους τελευταίους μήνες να αρχίσουν να χρησιμοποιούν τα LLM αποδοτικά για τη δουλειά τους. Ακόμη και άνθρωποι με τελείως διαφορετικό πεδίο ενασχόλησης αν θέλουν πραγματικά να μάθουν και έχουν και κριτική σκέψη φτάνουν σε λίγους μήνες στο 80-90% από αυτό που μπορεί να του προσφέρει ένα LLM μέσω chat. Το πρόβλημα αρχίζει όταν ξεκινάς να μιλάς για πολυπρακτορικά συστήματα και πως μπορείς να αρχίσεις να χρησιμοποιείς codex και claude code. Και προφανώς δεν μιλάω για προγραμματισμό. Μιλάω για νομικούς, κοινωνικούς επιστήμονες, ερευνητές. Και προφανώς ενώ τα codex / claude code / claude cowork κλπ αρχικά στήθηκαν σαν εργαλεία προγραμματισμού, πια είναι πλατφόρμες στησίματος και τρεξίματος πολυπρακτορικών συστημάτων. Εδώ είναι ελάχιστοι αυτοί που καταλαβαίνουν. Ελάχιστοι πιάνουν τι παίζει, κάθονται και διαβάζουν και μαθαίνουν γιατί αντιλαμβάνονται τι έχουν να κερδίσουν. Κάποιοι άλλοι στην ουσία ζητάνε στοχευμένη βοήθεια για workflows που πονάνε και φτάνουν σε ένα σημείο να καταλαβαίνουν, να στήνουμε μαζί ένα πλαίσιο εργασίας και να αρχίσουν να το χρησιμοποιούν. Κάποιοι απλά θα το χρησιμοποιούν επαναληπτικά σαν κλειστό εργαλείο, κάποιοι άλλοι θα το βελτιώσουν μόνοι τους και μαθαίνοντας μέσα από αυτό θα μάθουν τελικά να φτιάχνουν και άλλα workflows. Όμως η συντριπτική πλειοψηφία το χάνει. Ενώ μπορούσε να καταλάβει τι κανεις με το chat το άλλο απλά τους φαίνεται βουνό και το παρατάνε.

Στο σήμερα τώρα. Αν έχεις ευρείες γνώσεις και σε μάθουν πως λειτουργούν τα σημερινά εργαλεία θα είναι καλό και για σένα γιατί θα είσαι πολύ ευέλικτος στο που μπορείς να δουλέψεις και να είσαι και χρήσιμος για μια εταιρία. Οπότε τείνω να συμφωνήσω με όλα αυτά που λέει το άρθρο. Όμως αυτό που δεν ξέρω είναι για πόσο καιρό θα συνεχίσει αυτό και πότε η πραγματικότητα το αλλάξει και αυτό.

Δείτε τη συνέντευξη του Elon Musk στον Economist. Από τις ελάχιστες συνεντεύξεις που η δημοσιογράφος τον πίεσε πολύ για τις φασιστικές απόψεις που εκφράζει τελευταία και όχι μόνο σε μία ερώτηση αλλά σε συνέχεια ερωτήσεων. Αλλά πέρα από αυτό που είναι στο τελευταίο κομμάτι της συνέντευξης στο πρώτο μέρος τον ρωτάει για τα χρήματα, τη φορολογία κλπ και απαντά ότι τα χρήματα θα είναι irrelevant το 2035. Όταν τον ρωτάει τι θα κάνει ο κόσμος, πως θα βγάζει λεφτά τότε, απλά απαντάει Universal High Income (UHI). Όχι λίγα για να την παλέψεις, αλλά πολλά για να καταναλώσεις. Και αυτή πιστεύω είναι η συζήτηση του σήμερα. Όπως επίσης οι απόλυτες δηλώσεις του για τον πόλεμο στην Ουκρανία και επίσης η παραδοχή ότι η Κίνα έχει απλά κερδίσει, απλά δεν γνωρίζουμε το πότε, γιατί έχει τα πάντα σε μεγαλύτερο βαθμό (οκ οκ δεν έχουν τα καλύτερα τσιπ αυτή τη στιγμή, αλλά πλησιάζουν, έχουν απίστευτα περισσότερη διαθέσιμη ηλεκτρική ενέργεια, έχουν πολύ περισσότερους κορυφαίους προγραμματιστές ΑΙ, έχουν βελτιστοποιήσει το λογισμικό για να παίρνουν καλύτερα αποτελέσματα από χειρότερο hardware και το θέμα είναι αν θα πετύχουν η ΗΠΑ AGI πριν έρθει πλήρης εξισσορόπηση).

To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Προσωπικά το UHI βλέπω ότι είναι σίγουρα ένα από τα διαθέσιμα μονοπάτια προς τα εμπρός.
Κάποτε λίγοι εκμεταλλευόντουσαν άμεσα πολλούς ανθρώπους και ο φεουδάρχης / βασιλιάς έβγαζε πλούτο και είχε καλύτερη ζωή από τη δυστυχία των εργαζομένων.
Αργότερα το σύστημα χοντρικά απέκτησε πρόσβαση στη μηχανή και αυτό οδοήγησε στη δημιουργία στρωμάτωσης. Η μηχανή παρήγαγε αξία, το μεγαλύτερο κομμάτι το έπαιρναν η μετεξέλλιξη των φεουδαρχών, όμως μεσαία στρώματα έπαιρναν και αυτά ένα σημαντικό κομμάτι της υπεραξίας που παρήγαγε η μηχανή για την οικονομία.
Ήδη ο μέσος άνθρωπος του 2026 ζει καλύτερα από σχεδόν όλες τις απόψεις από ένα βασιλιά μισό αιώνα πριν.
Τώρα με το ΑΙ, την άνοδο των ρομπότ, την επιτάγχυνση της επιστήμης μπορούν όλες αυτές να παράγουν τέτοια ποσά πλούτου που να γίνουν όλοι οι άνθρωποι πλούσιοι.
Φυσικά υπάρχουν και άλλα μονοπάτια.
Το παράδοξο είναι ότι αυτοί που φτιάχνουν τις ΑΙ δεν έχουν κανενός είδους γενικές γνώσεις. Το μόνο που ξέρουν είναι πως να βγάζουν χρήματα.
 
Οι άνθρωποι που φτιάχνουν τα top AI αυτή τη στιγμή είναι η αφρόκρεμα της επιστήμης της πληροφορικής.

Δεν πειράζει που δεν έχουν μελετήσει και ιστορία της τέχνης ξερωγω.

Αυτοί που "το μόνο που ξέρουν είναι πως να βγάζουν χρήματα" είναι οι σχετικοί μανατζαρέοι και μέτοχοι. Με αυτούς είναι που υπάρχει πρόβλημα.
 
Αυτό που βρίσκω περίεργο είναι γιατί δεν μαθαίνει μετά την πρώτη φορά που του το λες...

Δεν υπάρχει κάτι να μάθει.
Θέλω trial period; Του βάζω την παράμετρο.
Δεν θέλω; Δεν του βάζω την παράμετρο.
Δεν είναι λύση "του βάζω την παράμετρο 0 και προσπαθώ να κάνω catch το exception που πιθανόν να μου πετάξει για να το γυρίσω σαν error και να το διορθώσω".

Μήπως να διαβάσεις έναν οδηγό για kill critic για το claude; Σταματάει να συμφωνεί παντα μαζί σου και είναι πιο "brutal" στις απαντήσεις.

Μα έχω δίκιο. Το θέμα είναι να κάνει κριτική στον εαυτό του. Που το έχω βάλει πολλές φορές να πει "ναι, είμαι μ... " :p
Δεν έχεις δει bullying σε LLM ξανά...
 
Day X με το Claude.
Ακόμη το ΑΙ είναι απλά ηλίθιο.
Πειράματα για best practices αποτυγχάνουν παταγωδώς.
Κάνω ένα api call στην Stripe για συνδρομές όπου μπορώ να δίνω trial period.
Η trial period είναι ρυθμιζόμενη με variable.
ΚΑΘΕ μα ΚΑΘΕ μοντέλο όταν λέω ότι μπορεί να είναι και 0, προσπαθεί να πιάσει το exception, να κάνει retry κλπ.
ΚΑΝΕΝΑ ρε δεν σκέφτεται απλά να μη στείλει την παράμετρο!

Επειδή και εγώ χρησιμοποιώ Stripe για ένα από τα projects μου, το variable trial_period_days δεν πρέπει υποχρεωτικά να είναι >=0;
Μηδέν νομίζω δεν μπορεί να είναι, εάν είναι μηδέν, δεν του στέλνεις το πεδίο καθόλου.

Αυτό σου έγινε μέσα από το claude code με ποιό μοντέλο;
Εγώ έλεγξα μόλις τη λογική με το Opus 5 και το επιβεβαίωσε. Εν τω μεταξύ το συγκεκριμένο κομμάτι το είχε γράψει το Opus 4.6 και το έγραψε σωστά τότε.
 
Μηδέν νομίζω δεν μπορεί να είναι, εάν είναι μηδέν, δεν του στέλνεις το πεδίο καθόλου.

Ακριβώς. Το πιο απλό είναι να μην του στέλνεις καθόλου το πεδίο.
Στο prompt (που ξέρει το project) "Θέλω να έχω την επιλογή να μην έχει trial period" μου το βάζουν 0 και ξεκινάνε το overengineering (κλασσική φιλοσοφία τους).

Όταν στήνω proof of concept όπως αυτό, κάνουμε brainstorm με το opus, όταν τελειώσουμε σηκώνει subagents sonet και μετά κάνει το opus code review σε αυτά που έγραψαν οι subagents.
 
Last edited:
''''Τώρα με το ΑΙ, την άνοδο των ρομπότ, την επιτάγχυνση της επιστήμης μπορούν όλες αυτές να παράγουν τέτοια ποσά πλούτου που να γίνουν όλοι οι άνθρωποι πλούσιοι.'''
ολοι? ολοι-ολοι? σε τοπικη κλιμακα -πχ κρατος, η σε πλανητικη....κομματακι δυσκολο κατα την γνωμη μου...η ιστορια εχει αποδειξει πως αυτο ειναι αδυνατον, ανεξαρτητως πολιτικου κ οικονομικου συστηματος..θεωρητικως σε ουτοπικες κοινωνιες κ σε ουτοπικα πολιτικα κ οικονομικα συστηματα, μπορει να ναι ισοι-οικονομικως, η εστω με μικρες διαφορες..αλλα ολοι πλουσιοι, μαλλον δεν. στο παρον συστημα παντως αδυνατον..
υγ η εννοια πλουσιος, δεν υφισταται ως εννοια ανευ υπαρξεως πτωχου..
 
''''Τώρα με το ΑΙ, την άνοδο των ρομπότ, την επιτάγχυνση της επιστήμης μπορούν όλες αυτές να παράγουν τέτοια ποσά πλούτου που να γίνουν όλοι οι άνθρωποι πλούσιοι.'''
ολοι? ολοι-ολοι? σε τοπικη κλιμακα -πχ κρατος, η σε πλανητικη....κομματακι δυσκολο κατα την γνωμη μου...η ιστορια εχει αποδειξει πως αυτο ειναι αδυνατον, ανεξαρτητως πολιτικου κ οικονομικου συστηματος..θεωρητικως σε ουτοπικες κοινωνιες κ σε ουτοπικα πολιτικα κ οικονομικα συστηματα, μπορει να ναι ισοι-οικονομικως, η εστω με μικρες διαφορες..αλλα ολοι πλουσιοι, μαλλον δεν. στο παρον συστημα παντως αδυνατον..
υγ η εννοια πλουσιος, δεν υφισταται ως εννοια ανευ υπαρξεως πτωχου..
Είναι μεγάλη η κοινωνιολογική συζήτηση και τα πιθανά ενδεχόμενα πάρα πολλά.

Ισότητα σε απόλυτη τιμή δεν θα υπάρχει ποτέ. Κάποιος θα μπορεί να πηγαίνει διακοπές στη σελήνη και στον Άρη και κάποιοι δεν θα μπορούν (αλλά θα μπορούν να πηγαίνουν στη γη).
Θα μπορεί κάποιος "πλούσιος" να ζει 200 χρόνια όταν οι υπόλοιποι θα μπορούν για 100.
Αυτό που παρουσιάζεται σαν "ισότητα" είναι ένα σύστημα που όλοι θα έχουν ικανό εισόδημα να αγοράζουν καταναλωτικά αγαθά, τρόφιμα, στέγαση, μετακινήσεις και να έχουν πρόσβαση σε παιδεία και υγεία τέτοιου επιπέδου που για σήμερα μπορεί να έχει το κορυφαίο 10% παγκοσμίως. Και όλα αυτά χωρίς υποχρέωση δουλειάς - "δουλειά" θα κάνεις ότι σου αρέσει να περνάς το χρόνο σου συν άντε κάποια κοινωνικά καθήκοντα.
Ακόμη και να τα έχεις αυτά θα είναι δύσκολο για αρκετούς να βρουν νόημα στη ζωή και θα έχεις περίεργες καταστάσεις που έχει ακουμπίσει η επιστημονική φαντασία και σειρές τύπου Black Mirror χρόνια τώρα.
 
  • Like
Reactions: Deneb