Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

Μετά από 2 μέρες που έκανα αρκετή χρήση, όσον αφορά τις προγραμματιστικές διεργασίες αρχικά, το Opus 5 είναι σημαντικά καλύτερο από το 4.8 ωστόσο, σε πραγματικά task χρειάζεται 2-3 φορές τον χρόνο και τα tokens του 4.8. Είναι εξαιρετικά μεθοδικό, αναλυτικό και δεν λαμβάνει αποφάσεις αν δεν έχει εξαντλήσει κάθε δυνατή πηγή πληροφοριών σχετικά με το εκάστοτε πρόβλημα. Αυτά στο effort level "high".

Ένα "πρόβλημα" που παρατηρώ, είναι πως στα σημεία επαφής με τον χρήστη, δεν είναι εξίσου ευχάριστο με το Opus 4.6 ή το Fable 5. Είναι σαν να έχεις έναν ultra-senior προγραμματιστή, specialist στα πάντα, ο οποίος όμως είναι φλύαρος και κάθεται να σου υπερ-αναλύει σε σεντόνια την υλοποίηση. Για όσους προτιμούν να του δώσουν συγκεκριμένες οδηγίες με σκοπό να κάνει εξαιρετικά στοχευμένες αλλαγές, θα το αγαπήσουν. Εάν θέλω να συζητήσω μια ιδέα για προσθήκες/αλλαγές στην αρχιτεκτονική, προτιμώ να το κάνω με το Fable και μετά να βάλει το Opus να το υλοποιήσει. Οι διαφορές που έχω εντοπίσει σε σχέση με το 5.6 Sol για όσο το χρησιμοποίησα από το API, περιορίζονται κυρίως στον τρόπο που προσεγγίζουν ένα πρόβλημα με το Sol να επικεντρώνεται σε προφανή προβλήματα στην αρχιτεκτονική, τελειώνοντας στο 1/4 του χρόνου των μοντέλων της Claude, που κάνουν κάθε πιθανή ή απίθανη προσομοίωση για να μαζέψουν όλες τις οριακές περιπτώσεις. Και το Sol γράφει πολύ καλά πάντως, εάν ξέρεις τι σου γίνεται και τι θέλεις, δεν έχεις πρόβλημα.

Στα υπόλοιπα tasks, κυρίως στο co-work που χρησιμοποιώ καθημερινά, όποιο μοντέλο μεταξύ των Fable/Opus 5 και να χρησιμοποιήσει κανείς, συνεχίζουν να δίνουν σαφώς καλύτερα αποτελέσματα σε σχέση με τον Copilot. Ειδικά στις παρουσιάσεις και το τι μπορεί να κάνει στο Excel είναι μέρα με τη νύχτα.

Στις Max συνδρομές, η ενσωματωμένη χρήση έχει αυξηθεί πολύ και το θέμα με τα όρια φαίνεται να έχει λυθεί το τελευταίο δίμηνο. Η OpenAI που δίνει απεριόριστη χρήση στο chat, συνεχίζει να είναι πιο γενναιόδωρη.