Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

Αυτό από μόνο του απαντάει την ερώτηση.
Σκέψου vibe coders να έχουν απεριόριστα tokens σε κορυφαία μοντέλα, πόσο θα κοστίσουν σε μία εταιρία. :)
Όπου τον κώδικα που θα παράξουν δεν θα τον ξέρει κανείς, παρά μόνο αυτά, οπότε θα μείνει η εταιρία εγκλωβισμένη σε αυτά τα εργαλεία.

Δεν μιλάω για projects των 10-20 χιλιάδων γραμμών, αλλά για σοβαρά project που απαιτούν σοβαρούς προγραμματιστές και πολλές εργατοώρες.
Μιχάλη η εταιρία θα προσλάβει εσένα ή κάποιον με την εμπειρία σου και θα σου δώσει απεριόριστα token, όχι κάποιο vibe coder. Αλλά αντί να έχεις ομάδα γύρω σου θα έχεις...token...
Άντε να έχεις 1-2 βοηθούς (πραγματικούς προγραμματιστές) αντί για μια ομάδα 15 ανθρώπων.
 
Μα όλα τα επίπεδα προγραμματιστών χρειάζονται σε μία εταιρία.
Ούτε εγώ θα ασχοληθώ να φτιάξω μία φόρμα με 500 inputs, ούτε αξίζει το κόστος του ΑΙ για να τη στήσει.
Θα πάει σε έναν junior να τη στήσει, θα κάνει το code review ένας medium και θα περάσει στο QA team για τον τελικό έλεγχο π.χ. πριν πάει στο UAT.
Για proof of concepts π.χ. το AI είναι καλό. Να το μαστιγώνεις να γράφει τα tests, ένα αρχικό documentation, βαρετά πράγματα που είναι ρουτίνα.

Όσοι δεν είναι developers νομίζουν ότι το να είσαι προγραμματιστής σημαίνει "ξέρω να γράφω κώδικα".
Είναι σαν να λέμε "το να είσαι συγγραφέας σημαίνει ξέρω ορθογραφία και συντακτικό".
Αυτό ισχύει για τους juniors και αν.
 
Μα όλα τα επίπεδα προγραμματιστών χρειάζονται σε μία εταιρία.
Ούτε εγώ θα ασχοληθώ να φτιάξω μία φόρμα με 500 inputs, ούτε αξίζει το κόστος του ΑΙ για να τη στήσει.
Θα πάει σε έναν junior να τη στήσει, θα κάνει το code review ένας medium και θα περάσει στο QA team για τον τελικό έλεγχο π.χ. πριν πάει στο UAT.
Για proof of concepts π.χ. το AI είναι καλό. Να το μαστιγώνεις να γράφει τα tests, ένα αρχικό documentation, βαρετά πράγματα που είναι ρουτίνα.
Εδώ διαφωνούμε. Αυτή τη στιγμή ένας κορυφαίος προγραμματιστής μαζί με 2 καλούς μικρής εμπειρίας (3-5 έτη) προγραμματιστές και απεριόριστη πρόσβαση σε κορυφαία μοντέλα το κάνουν αυτό (δεν βάζω την παράμετρο κόστους εδώ, θέλω να δείξω τη δυνατότητα). Και το κόστος έχει πέσει δραματικά ήδη για tasks που τα έκαναν παραδοσιακά οι Junior - τα tokens για αυτά τα task είναι ο μισός μισθός ενός Junior και έχεις μειώσει το κοστολόγιο μειώνοντας στο μηδέν τον αριθμό τους.

Σε χώρες όπως η Ινδία ή ακόμη και η Ελλάδα όντως το ανθρώπινο δυναμικό είναι τόσο φθηνό που δεν συμφέρει οικονομικά να τους κόψεις μαζικά. Για πήγαινε στην Νορβηγία και δεν πως το βλέπουν αυτό όμως. Η λύση μέχρι πριν πολύ λίγο ήταν out-sourcing στην Ινδία, αλλά με τα μοντέλα, ειδικά αν πληρώσεις για υποδομές εσωτερικές κρατάς πλήρη έλεγχο. Δες και τον πίνακα στο τέλος του μηνύματος.

Σε 2 χρόνια τρομερά συντηριτικά είμαι απόλυτα σίγουρος ότι δεν θα χρειάζονται και οι δύο βοηθοί, αλλά αυτοί οι βοηθοί θα μπορούν να ανέβουν στο επίπεδο του πρώτου χοντρικά.

Ο προγραμματισμός θα γίνει niche επάγγελμα πολύ σύντομα.

Δυτική εταιρείαΈδρα / περιοχήΚινεζικό μοντέλο(-α)Τρόπος χρήσης του μοντέλου
Thomson ReutersΚαναδάς / Βόρεια ΑμερικήQwen3.6 → Snowdon → ThomsonΤο νέο ιδιόκτητο LLM Thomson της Thomson Reuters βασίζεται στο μοντέλο Snowdon, το οποίο αναπτύχθηκε σε συνεργασία με το Imperial College. Η δημοσιευμένη γενεαλογία του μοντέλου προσδιορίζει ως υποκείμενο foundation model το Qwen3.6-35B-A3B. Το μοντέλο εξειδικεύεται περαιτέρω με δεδομένα της Thomson Reuters στους τομείς της νομικής, φορολογίας, κανονιστικής συμμόρφωσης και ειδησεογραφίας, αρχικά για δομημένες εργασίες και document review στο CoCounsel Legal.
Anysphere / CursorΗΠΑMoonshot Kimi K2.5Το Kimi K2.5 αποτελεί το βασικό checkpoint για τα μοντέλα προγραμματισμού Composer 2 και Composer 2.5 της Cursor. Η Cursor εφαρμόζει πρόσθετο continued pre-training και εκτεταμένο reinforcement learning πάνω στο κινεζικό βασικό μοντέλο. Το Composer 2.5 διατίθεται στους πελάτες ως coding/agent model.
AirbnbΗΠΑAlibaba QwenΗ Airbnb χρησιμοποιεί εκτενώς μοντέλα Qwen στη multi-model υποδομή που υποστηρίζει τον AI agent εξυπηρέτησης πελατών. Ο CEO Brian Chesky έχει αναφέρει ότι το Qwen είναι ιδιαίτερα ελκυστικό λόγω ταχύτητας, επιδόσεων και χαμηλού κόστους. Η Airbnb δηλώνει ότι τα weights λειτουργούν χωρίς να διαβιβάζονται δεδομένα πελατών στην Alibaba.
DoorDashΗΠΑGLM, Qwen, Kimi, DeepSeekΗ ομάδα GenAI infrastructure της DoorDash δηλώνει ρητά ότι λειτουργεί η ίδια frontier open-weight models, κατονομάζοντας τα GLM, Qwen, Kimi και DeepSeek. Οι χρήσεις περιλαμβάνουν real-time GPU serving, high-throughput batch inference και fine-tuning για agents, αυτοματοποίηση και εξατομίκευση.
Uber / Uber EatsΗΠΑAlibaba Qwen / Qwen2Η Uber χρησιμοποιεί backbone βασισμένο στο Qwen στην αρχιτεκτονική πολυγλωσσικής σημασιολογικής αναζήτησης του Uber Eats. Το μοντέλο έχει fine-tuned με δεδομένα του Uber Eats και χρησιμοποιείται για embeddings περιεχομένου σε διαφορετικές κατηγορίες και αγορές.
CoinbaseΗΠΑZ.ai GLM-5.2, Moonshot Kimi 2.7Η Coinbase έχει μεταφέρει μέρος των εσωτερικών εργασιών μηχανικής λογισμικού σε οικονομικότερα open-weight models μέσω του εσωτερικού LLM gateway. Τα GLM-5.2 και Kimi 2.7 χρησιμοποιούνται ως χαμηλού κόστους/default επιλογές, ενώ αμερικανικά frontier models παραμένουν διαθέσιμα για δυσκολότερες εργασίες. Σε συνδυασμό με routing και caching, η Coinbase ανέφερε περίπου υποδιπλασιασμό των δαπανών AI.
LindyΗΠΑDeepSeek V4Η startup AI agents μετέφερε το 100% της κίνησης μοντέλων από την Anthropic στο DeepSeek V4 για workflows όπως email, ημερολόγιο, πωλήσεις και αυτοματοποίηση εξυπηρέτησης πελατών. Ο CEO Flo Crivello ανέφερε εξοικονόμηση αρκετών εκατομμυρίων δολαρίων ετησίως και περίπου συγκρίσιμες ή καλύτερες επιδόσεις σε επίπεδο εφαρμογής.
SiemensΓερμανίαDeepSeek, Alibaba QwenΗ Siemens αναφέρει ότι χρησιμοποιεί DeepSeek και Qwen, παράλληλα με Nvidia Nemotron και αμερικανικά/ευρωπαϊκά μοντέλα, στο πλαίσιο μιας multi-model στρατηγικής για βιομηχανική AI. Το σκεπτικό είναι η ευελιξία, το κόστος και η τεχνολογική κυριαρχία, αντί της εξάρτησης από έναν μόνο πάροχο.
ChapsVisionΓαλλίαAlibaba QwenΗ γαλλική εταιρεία enterprise data/AI χρησιμοποιεί Qwen παράλληλα με μοντέλα των Mistral, Anthropic και OpenAI. Η αρχιτεκτονική της δίνει έμφαση στη δυνατότητα αντικατάστασης παρόχων και στην αυτοτελή λειτουργία μοντέλων για λόγους ψηφιακής κυριαρχίας και επιχειρησιακής συνέχειας.
OrangeΓαλλίαΚινεζικά open-weight models· δεν έχουν δημοσιοποιηθεί συγκεκριμένες οικογένειεςΗ Orange δηλώνει ότι ήδη λειτουργεί συνδυασμό αμερικανικών, ευρωπαϊκών και κινεζικών μοντέλων και διαθέτει υποδομή ικανή να εκτελεί κινεζικά open-weight models σε ευρωπαϊκή υποδομή, αποφεύγοντας τη μεταφορά δεδομένων στον αρχικό Κινέζο δημιουργό.
Renault GroupΓαλλίαDeepSeekΗ Renault συνεργάζεται με Google, Microsoft, Mistral, Dataiku και DeepSeek στο πλαίσιο ενός διαφοροποιημένου οικοσυστήματος AI. Ωστόσο, η ίδια η Renault ανέφερε στο Reuters ότι η χρήση του DeepSeek δεν είναι ακόμη ουσιαστική σε μεγάλη κλίμακα, συνεπώς πρόκειται περισσότερο για αξιολόγηση ή περιορισμένη εφαρμογή παρά για ώριμη υιοθέτηση.
FloxyΕσθονίαDeepSeek V3Η εταιρεία συλλογής και επεξεργασίας δεδομένων φέρεται να μετέφερε εργασίες υψηλού όγκου, όπως text parsing και τυποποίηση δεδομένων, από το GPT-4o στο DeepSeek-V3. Ο CTO ανέφερε περίπου 92% μείωση του κόστους inference.
Substance LawΚαναδάςDeepSeek / μοντέλα οικογένειας GLMΗ καναδική δικηγορική εταιρεία ανέφερε ότι έχει μεταφέρει μέρος των workloads της σε κινεζικά open-weight models στο πλαίσιο στρατηγικής μείωσης κόστους και αύξησης του ελέγχου. Η δημόσια πληροφόρηση δεν είναι αρκετά λεπτομερής ώστε να αντιστοιχιστεί κάθε workload σε συγκεκριμένο checkpoint.
ExpertEdgeΗνωμένο ΒασίλειοDeepSeek / μοντέλα οικογένειας GLMΗ εταιρεία διαδικτυακής εκπαίδευσης έχει μεταφέρει μέρος των workloads της σε κινεζικά ανοικτά μοντέλα, δίνοντας έμφαση στο self-hosting και στη συνέχεια πρόσβασης και όχι μόνο στη μείωση κόστους.
 
Last edited:
Σε 2 χρόνια τρομερά συντηριτικά είμαι απόλυτα σίγουρος ότι δεν θα χρειάζονται και οι δύο βοηθοί, αλλά αυτοί οι βοηθοί θα μπορούν να ανέβουν στο επίπεδο του πρώτου χοντρικά.

Και σε 5 χρόνια δεν θα υπάρχουν junior με αυτή τη φιλοσοφία.
Οπότε που ακριβώς θα βρουν προγραμματιστές οι εταιρίες;
Προγραμματιστές όμως, όχι παιδάκια που ξέρουν να γράφουν κώδικα στην Χ γλώσσα.
Προγραμματιστή σε κάνει η εμπειρία, η τριβή με το αντικείμενο, όχι η γνώση πως να γράψεις κάτι σε μία γλώσσα.
Και ΔΕΝ γίνονται προγραμματιστές όσοι μαθαίνουν να γράφουν κάτι σε μία γλώσσα.
ΔΕΝ μπορείς να φανταστείς τι ακούω από παιδιά με 2-3 χρόνια εμπειρίας στον προγραμματισμό.
Πράγματα που αν με ρωτούσαν τα παιδιά μου στα 10 τους θα έτρωγαν δούλεμα.
 
Και σε 5 χρόνια δεν θα υπάρχουν junior με αυτή τη φιλοσοφία.
Οπότε που ακριβώς θα βρουν προγραμματιστές οι εταιρίες;
Προγραμματιστές όμως, όχι παιδάκια που ξέρουν να γράφουν κώδικα στην Χ γλώσσα.
Προγραμματιστή σε κάνει η εμπειρία, η τριβή με το αντικείμενο, όχι η γνώση πως να γράψεις κάτι σε μία γλώσσα.
Και ΔΕΝ γίνονται προγραμματιστές όσοι μαθαίνουν να γράφουν κάτι σε μία γλώσσα.
ΔΕΝ μπορείς να φανταστείς τι ακούω από παιδιά με 2-3 χρόνια εμπειρίας στον προγραμματισμό.
Πράγματα που αν με ρωτούσαν τα παιδιά μου στα 10 τους θα έτρωγαν δούλεμα.
Σε 5 χρόνια μπορεί κανένας μας σε οποιοδήποτε χώρο να έχει δουλειά και να συντηρουμαστε απο εννιαίο υψηλό εισόδημα...

Απλό παράδειγμα. 1 χρόνο πριν έπρεπε να φας άπειρο χρόνο να μάθεις να γράφεις αναλυτικότατα prompt για να πάρεις μια αξιοπρεπή απάντηση.

Σήμερα θες 1-2 λεπτά να διαμορφώσεις τι θες και σε 20 λεπτά έχεις ένα φουλ workflow στο codex/claude code που θα τρέχει για ώρες και θα πάρεις ένα αποτέλεσμα που θα δεις για 2-3 ώρες και θα είναι μετά απίστευτα καλό.

Ε, σε 1-2 χρόνια νομίζω ότι και αυτά που κάνουμε σε όλους τους κλάδους νοητικά θα μπορούν σε μεγάλο βαθμό. Εμείς μάλλον για κάποιο χρονικό διάστημα θα κατεβάζουμε ιδέες και θα συνδυάζουμε χώρους και προσεγγίσεις, θα τα περιγράφουμε απλά και τα ΑΙ εργαλεία θα αναλαμβάνουν την υλοποίηση. Μέχρι και αυτό να αλλάξει με το ASI...
 
Μα όλα τα επίπεδα προγραμματιστών χρειάζονται σε μία εταιρία.
Ούτε εγώ θα ασχοληθώ να φτιάξω μία φόρμα με 500 inputs, ούτε αξίζει το κόστος του ΑΙ για να τη στήσει.
Θα πάει σε έναν junior να τη στήσει, θα κάνει το code review ένας medium και θα περάσει στο QA team για τον τελικό έλεγχο π.χ. πριν πάει στο UAT.
Για proof of concepts π.χ. το AI είναι καλό. Να το μαστιγώνεις να γράφει τα tests, ένα αρχικό documentation, βαρετά πράγματα που είναι ρουτίνα.

Όσοι δεν είναι developers νομίζουν ότι το να είσαι προγραμματιστής σημαίνει "ξέρω να γράφω κώδικα".
Είναι σαν να λέμε "το να είσαι συγγραφέας σημαίνει ξέρω ορθογραφία και συντακτικό".
Αυτό ισχύει για τους juniors και αν.

Αυτό το pipeline θέλει 4 μέρες για κάτι αστείο. Εάν θέλεις αλλαγές στα api routers δηλαδή τι θα γίνουμε; Θα πάρει 6 μήνες αναλογικά;
Το βάζεις σε ένα μοντέλο της περιοπής, θα κοστίσει ως task 5-10€ μαζί με το code-review και θα το έχεις σε μια ώρα. Η ομάδα θα κοστίσει πολλαπλάσια.

Το 2026 φτάσαμε σε εξαιρετικό επίπεδο, όσον αφορά την υλοποίηση από μοντέλα. Αυτό που δεν παίζει ακόμη είναι οι αποφάσεις επί της αρχιτεκτονικής. Εάν δεν γνωρίζεις τι θέλεις και πηγαίνεις με οδηγό την ελπίδα του ότι θα πάρει αποφάσεις για εσένα το εκάστοτε μοντέλο, το αποτέλεσμα θα είναι κακό και θα δημιουργήσεις περισσότερα προβλήματα από όσα θα λύσεις.

Η λογική μου είναι, να έχεις κόσμο που καταλαβαίνει από αρχιτεκτονική, δώσε του τα εργαλεία, φτιάξε απαράβατα workflows που να πιάνουν προβλήματα στα code reviews και αποδέσμευσε χρόνο ώστε να αυξήσεις τον όγκο των παραδοτέων. Σε μεγαλύτερα features, το να βάλεις το claude να σου κάνει εξαντλητικό code & security review, να γράψει Integration tests και να τα τεστάρει live σε dev περιβάλλον, θα σου δώσει αποτελέσματα expert και όχι mid-level, θα το έχεις σε 3-4 ώρες -επειδή θα έχεις concurrency blocks στους sub-agents. Το workflow αυτό απλά δεν παίζει διαφορετικά. Και ρεαλιστικά δεν το έκανε και κανείς, τώρα μην κοροϊδευόμαστε μεταξύ μας. Στοχευμένο code-review γίνεται σε ένα μέσο blast radius και άντε οι λίγο πιο προχώ να τρέχουν github actions CI/CD.
 

Μοιαζει απιστευτο αλλα η ιατρικη ειναι απο τους χωρους οπου το ΑΙ σιγουρα θα κανει θραυση τουλαχιστον στον τομεα της πρωτης ιατρικης εκτιμησης επι του ασθενους.

Οι ιδιοι οι γιατροι μοιαζουν πραγματικα να "τα εχουν χαμενα" απο το πως μπορει να βρεθουν ξαφνικα σε δευτερη μοιρα σε αρκετες ειδικοτητες.
 

Μοιαζει απιστευτο αλλα η ιατρικη ειναι απο τους χωρους οπου το ΑΙ σιγουρα θα κανει θραυση τουλαχιστον στον τομεα της πρωτης ιατρικης εκτιμησης επι του ασθενους.

Οι ιδιοι οι γιατροι μοιαζουν πραγματικα να "τα εχουν χαμενα" απο το πως μπορει να βρεθουν ξαφνικα σε δευτερη μοιρα σε αρκετες ειδικοτητες.
Έχω δει πολλά post από ακτινολόγους που επιβεβαιωνουν τις γνωματεύσεις ΑΙ σε ακτινογραφιες.
 
Αυτό το pipeline θέλει 4 μέρες για κάτι αστείο. Εάν θέλεις αλλαγές στα api routers δηλαδή τι θα γίνουμε; Θα πάρει 6 μήνες αναλογικά;

Μα σε μια σοβαρή εταιρία δεν παίζει waterfall να περιμένει ο ένας τον άλλον.


Σε 5 χρόνια μπορεί κανένας μας σε οποιοδήποτε χώρο να έχει δουλειά και να συντηρουμαστε απο εννιαίο υψηλό εισόδημα...

Ίσως σε κάποια ανεπτυγμένη χώρα, όχι εδώ.
 
το προβλημα με την τεχνητη νοημοσυνη δεν θα το εχουν οι γιατροι αλλα οι ασθενεις..κ οι γιατροι ποτε δεν θα βρεθουν σε δευτερη μοιρα..ως εργαλειο χρησιμο για τους γιατρους αλλα ως εκει.. ..οσον αφορα το αρθρο του gazetta λεει ανοησιες..κατα πρωτον , εκει που γραφει πως δεν τα λενε ολα τα βιβλια, το πιο βλακωδες που εχω δει, καθοτι τα βιβλια ολα τα λενε, κ οι γιατροι κανουν ιατρικη μ αυτα που λενε τα βιβλια, κ η ΑΙ ο,τι απαντησεις δινει τις δινει απο βιβλια..κατα δευτερον το ευαγγελιο της ιατρικης σκεψης λεει , απο παντα, listen listen listen to the patient, it will give you the diagnosis.
η ιατρικη απαιτει κριτικη σκεψη , επαγωγικους κ παραγωγικους συλλογισμους,κ εν τελει την αποφαση την παιρνει ο ιατρος..μακαρι στην ιατρικη να εκανε 1+1=2 αλλα δυστυχως δεν...
ως βοηθημα , κ αξιοποιηση βασεων δεδομενων, καθοτι ο ιατρος ειναι αδυνατον να τα θυμαται ολα, χρησιμη η ΑΙ.αλλα ως εκει.κ παλιοτερα ο ιατρος ανοιγε βιβλια κ εψαχνε
στην ακτινοδιαγνωστικη βοηθα, πλην ομως κ κει χρειαζεται η κριτικη σκεψη αξιολογησης των κλινικων πληροφοριων για ορθη διαγνωση...

υγ η αρχικη πρωτη εκτιμηση γινεται με το ματι κ πεντες ερωτησεις..
 
Last edited:
Μα σε μια σοβαρή εταιρία δεν παίζει waterfall να περιμένει ο ένας τον άλλον.

Εάν θεωρήσουμε σοβαρές τις εταιρίες του MSCI world software & services, δεν υπάρχει καμία που να μην κάνει αυτοματοποιημένα code reviews σήμερα.
Μια σοβαρή εταιρία εφόσον δουλεύει agile, δίνει στους code reviewers το PR μόνο εφόσον περάσει green από όλα τα integration/unit tests και το όποιο αυτοματοποιημένο code-review από agents. Το να μην έχεις μεγάλα branches δεν λύνει το πρόβλημα, το μετριάζει. Εάν το έλυνε δεν θα είχαμε 2 feature και 10 bug fixes σε κάθε release.
 
Το είπα και εγώ, για ενδιάμεσα εργαλεία το ΑΙ είναι μια χαρά.
Το να πεις ότι μία εταιρία βασίζεται στο ΑΙ για να γράψει κώδικα είναι λάθος.
Και δεν γλυτώνεις τα bugs επειδή θα σου γράψει τον κώδικα ένα ΑΙ. Εκεί ειδικά το ΑΙ χάνει κατά κράτος.
Θα γλυτώσεις τα bugs με μερικούς QA testers και τα regrations με unit tests.
Το ΑΙ έχει ένα ταλέντο να σου δημιουργεί regrations χωρίς να χτυπάνε τα unit tests...
 
Εάν θεωρήσουμε σοβαρές τις εταιρίες του MSCI world software & services, δεν υπάρχει καμία που να μην κάνει αυτοματοποιημένα code reviews σήμερα.
Μια σοβαρή εταιρία εφόσον δουλεύει agile, δίνει στους code reviewers το PR μόνο εφόσον περάσει green από όλα τα integration/unit tests και το όποιο αυτοματοποιημένο code-review από agents. Το να μην έχεις μεγάλα branches δεν λύνει το πρόβλημα, το μετριάζει. Εάν το έλυνε δεν θα είχαμε 2 feature και 10 bug fixes σε κάθε release.
Το είπα και εγώ, για ενδιάμεσα εργαλεία το ΑΙ είναι μια χαρά.
Το να πεις ότι μία εταιρία βασίζεται στο ΑΙ για να γράψει κώδικα είναι λάθος.
Και δεν γλυτώνεις τα bugs επειδή θα σου γράψει τον κώδικα ένα ΑΙ. Εκεί ειδικά το ΑΙ χάνει κατά κράτος.
Θα γλυτώσεις τα bugs με μερικούς QA testers και τα regrations με unit tests.
Το ΑΙ έχει ένα ταλέντο να σου δημιουργεί regrations χωρίς να χτυπάνε τα unit tests...

Να δω μετά τα Χριστούγεννα πως θα παλιώσουν αυτά τα 2 μηνύματα... :D :D :D
 
  • Haha
Reactions: anderm
Και δεν γλυτώνεις τα bugs επειδή θα σου γράψει τον κώδικα ένα ΑΙ. Εκεί ειδικά το ΑΙ χάνει κατά κράτος.

Δεν γλυτώνεις bugs επειδή θα σου γράψει τον κώδικα το μοντέλο; Ίσχυε τον περασμένο Οκτώβρη.
Το μοντέλο, εάν το έχεις στήσει σωστά, για κάθε τι που γράφει, γράφει και το ανάλογο τέστ εξαρχής. Οποιαδήποτε αλλαγή σπάει κάτι, τη πιάνεις πρωτογενώς. Το βάζεις να κάνει edge case review σε βάθος που οι developers δεν κάνουν.

Εχθές και σήμερα, νεκρανάστησα ένα side-project το οποίο ήταν πεθαμένο προ 3ετίας και δεν υπήρχε περίπτωση να ασχοληθεί ποτέ κανένας μαζί του παρότι θεμελιωδώς ήταν καλό.
Με κόστος μια εβδομάδα ενός Senior, έγραψε 40k γραμμές για το refactoring που χρειάστηκε φέρνοντας τα dependencies εκεί που ζήτησα, υλοποίησε 3 νέα features, έκανε τον tester από τον Browser με ανοιχτά τα Backend logs, έκανε cyber review που τυπικά θέλεις κατ ελάχιστον 6-8k€ για το μέγεθος της εφαρμογής από εξειδικευμένη ομάδα και το παρέδωσε τέλειο. Δουλεύοντας με /goal.

1788255324976.png

Το status σήμερα είναι πως Opus/Fable/Sol γράφουν καλύτερα από το 90% των devs. Ναι, δεν είναι στο επίπεδο του Torvalds, αλλά εκτός και εάν αποφασίσεις να γράψεις kernel από το 0, δεν χρειάζεται να είναι στο επίπεδο του Torvalds για να είναι χρήσιμα.

Το σοκ του ότι γράφουν ψιλο-καλά το πάθαμε με το Sonnet 4.5 πέρυσι το φθινόπωρο. Αυτό, για κάθε τι που έγραφε ήθελε και fix, δεν δούλευε τίποτα με τη πρώτη. Σε 9 μήνες είμαστε εδώ που είμαστε και στους επόμενους 9 το ελάχιστο που θα γίνει είναι η δουλειά που το έβαλα εγώ να κάνει και βγήκε σε ποιότητα Α, να κοστίζει το μισό και να παραδίδεται στο 1/4 του χρόνου.
 
Το status σήμερα είναι πως Opus/Fable/Sol γράφουν καλύτερα από το 90% των devs.

Δεν μπορώ παρά να συμφωνήσω...
Δεν λέω όμως αυτό! Εγώ λέω ότι ο κώδικας που βγάζουν είναι junior και κάπου στον μήνα αν όχι πιο νωρίς ξεκινάνε τα regrations.
Το ένα δεν αποκλείει το άλλο... :ROFLMAO:
 
Τα regressions ξεκινάνε επειδή τα system instructions όταν πρωτοέπιασε το μοντέλο τη codebase παρέμειναν στατικά.
Μετά από μεγάλες αλλαγές, του κάνεις ένα /init να ξαναχτίσει το claude.md, του γράφεις και πως θέλεις να δουλεύει επιπλέον για να μην πελαγοδρομεί και το παλεύει.
 
... Δουλεύοντας με /goal...
Πόσο ζηλεύω τους προγραμματιστές (και κατ'επέκταση όλους όσους έχουν μετρήσιμα ποσοτικά KPIs).
Ναι βάζω goals με ποιοτικά KPIs, αλλά όπως γίνεται κατανοητό δεν είναι τόσο ακριβές, γιατί δεν ξέρεις και το πιθανό αποτέλεσμα νωρίτερα. Και επειδή δεν θέλεις να περιμένεις 3 ημέρες για να δεις τι έχει γίνει, το σπάω αναγκαστικά ακόμη σε βήματα. Το ιδανικό είναι το μέγιστο να είναι 12 ώρες περίπου.

Πάντως την προηγούμενη εβδομάδα τερμάτησα όλα τα όρια της pro συνδρομής μου. Στο CODEX έκανα και το reset. Τα max/ultra τρώνε τρελά tokens. To ultra επιταγχύνει πολύ τα πράγματα με παράλληλους agents (και χωρίς το διακόπτη για παραπάνω ταχύτητα). Αλλά το αποτέλεσμα μπορεί να είναι του ίδιου επιπέδου αν απλά αντί για παράλληλους agents βάλεις πολύ περισσότερους σειριακά και επίσης αντί για "max" thinking βάζεις δομές ελέγχου και βελτίωσης. Αλλά το allowance ακόμη και με μεγαλύτερα workflows πέφτει πολύ πιο αργά.

Επίσης είδα ότι υπάρχει όριο στο Pro και στο chat. Με κλείδωσαν την Πέμπτη και περιμένω αύριο να ξανανοίξει :ROFLMAO: :ROFLMAO:
Το έλιωσα βέβαια.

Τέλος κάτι αστείο. Αποφάσισα ποιο υπολογιστή θέλω να πάρω. Ακόμη δεν μπορεί ένα search να βρει το κατά απόλυτη τιμή χαμηλότερο κατάστημα στην ΕΕ. Ακόμη είδα ότι χρησιμοποιεί το chatgpt εκτενώς προσωρινά αποθηκευμένα site (μπορεί και μόλις 12-18 ωρών) που όμως μπορεί να μην είναι ενεργά στο τώρα γιατί πχ τελείωσε το απόθεμα. Στο extra thinking δεν σκέφτεται από μόνο του να τραβήξει τα αποτελέσματα σε πραγματικό χρόνο έστω για τα site που είναι έτοιμο να προτείνει. Θέλει να του πεις να κάνει double check για να μη ψάχνεσαι μετά.
 
  • Haha
Reactions: Tzimisce