Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

  • Αγαπητοί φίλοι και φίλες,

    Σας προσκαλούμε να γιορτάσουμε μαζί τα 20α γενέθλια του AVclub.

    Το Σάββατο 10 Οκτωβρίου, από τις 18:00 θα πραγματοποιήσουμε το πάρτι των γενεθλίων του φόρουμ μας στο Peñarrubia Lounge.

    Δηλώστε τη συμμετοχή σας εδώ, θα χαρούμε πολύ να σας δούμε από κοντά.

Η χρηματηστηριακή φούσκα είναι δεδομένο ότι θα σκάσει κάποια στιγμή. Σε αυτό συμφωνούμε απόλυτα.
Δύο εταιρίες είναι μόνο απίστευτα καλά τοποθετημένες. Η SpaceX και η Google. Οι άλλοι κανείς δεν ξέρει.

Βέβαια θα παίξει τρελό ρόλο αν έχουν γίνει οι IPOs τους ή όχι. Με τις IPOs θα σηκώσουν τρελό χρήμα, που θα είναι πραγματικό χρήμα στα ταμεία τους και λογικά θα μπορέσουν να αντέξουν τη φούσκα. Οι μικρότερες και περιφερειακές εταιρίες νομίζω ότι θα είναι αυτές που θα επηρρεαστούν περισσότερο...
To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Σχετικό βίντεο που λέει με απλά λόγια το πως και γιατί θα σκάσει η φούσκα (όχι φυσικά το πότε :) )
 
Να και κάτι καινούργιο!

Το Jev (από τη TypeSafe AI) αποτελεί μια νέα κλάση μοντελων τεχνητής νοημοσύνης, τα λεγόμενα System One Models, τα οποία είναι σχεδιασμένα να επικοινωνούν απευθείας με λογισμικό και όχι με ανθρώπους μέσω συνομιλίας:
  • Αντί για κείμενο, παράγει αποφάσεις: Το Jev εγκαταλείπει τη σύνθεση φυσικής γλώσσας (chat) και επιστρέφει αποκλειστικά τυποποιημένες, δομημένες τιμές (typed decisions) και πιθανότητες βάσει προκαθορισμένων σχημάτων.
  • Μηδενικές παραισθήσεις και λάθη κειμένου: Χάρη στον αυστηρό περιορισμό των εξόδων του, εξαλείφει πλήρως τα συντακτικά/τυπικά λάθη και τις «παραισθήσεις» (hallucinations), προσφέροντας παράλληλα αξιόπιστα βαθμονομημένα επίπεδα εμπιστοσύνης (calibrated confidence) σε κάθε του απόφαση.
  • Απίστευτη ταχύτητα: Λειτουργεί με παράλληλη δειγματοληψία αντί για τη διαδοχική παραγωγή token των κλασικών LLM, πετυχαίνοντας χρόνους απόκρισης της τάξης των 70–500ms (40 έως 200 φορές ταχύτερα) καθιστώντας το ιδανικό για αυτοματισμούς πραγματικού χρόνου.
  • Απίστευτα χαμηλό κόστος: Το κόστος εισόδου (Input Tokens) είναι μόλις $0.042 ανά εκατομμύριο tokens (περίπου 42 δολάρια ανά δισεκατομμύριο). Αυτό είναι περίπου 50 έως 100 φορές φθηνότερο από τα κορυφαία παραδοσιακά μοντέλα. Το κόστος εξόδου (Output Tokens) είναι τόσο χαμηλό πουη εταιρία χρεώνει $0. Το κόστος ανά απόφαση/περίπτωση διαμορφώνεται περίπου στα $0.0004, γεγονός που καθιστά για πρώτη φορά οικονομικά βιώσιμη την εκτέλεση ελέγχων ή αποφάσεων AI σε κάθε ξεχωριστή σειρά δεδομένων ενός τεράστιου dataset, κάτι που στα κλασικά LLM θα ήταν απαγορευτικά ακριβό. Σε stress tests σε πραγματικό χρόνο (όπως η εκτέλεση πράκτορα σε σύνθετα περιβάλλοντα με 10 κλήσεις ανά δευτερόλεπτο), το λειτουργικό κόστος διατηρήθηκε σε επίπεδα της τάξης των $7 ανά ώρα.

Όποιος θέλει να μάθει παραπάνω:
To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Και αν θέλει περισσότερα τεχνικά στοιχεία:
To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Υ.Γ. Θέλω να δω πότε θα βγάλουν οι Κινέζοι ένα open source...θα ήθελα να το βάλω στο Harness μου να διαλέγει εύκολα ποιο μοντέλο LLM να φορτώνει...
 

“Καμπανάκι” από τη Microsoft για το ΑΙ – “Μπορεί να δημιουργήσει ένα νέο είδος”​

1789718268320.png
Ο επικεφαλής του τμήματος τεχνητής νοημοσύνης της Microsoft, Μουσταφά Σουλεϊμάν, προειδοποίησε ότι, χωρίς επαρκείς δικλίδες ασφαλείας, η ανάπτυξη της τεχνητής νοημοσύνης θα μπορούσε να οδηγήσει στην εμφάνιση ενός νέου «είδους από πυρίτιο», το οποίο θα ανταγωνίζεται τον άνθρωπο.

Ο Σουλεϊμάν υποστήριξε ότι η ανταγωνίστρια εταιρεία Anthropic αντιμετωπίζει την τεχνητή νοημοσύνη σαν να είναι ανθρώπινη, χαρακτηρίζοντας αυτή την προσέγγιση «λανθασμένη» και προειδοποιώντας ότι θα μπορούσε να οδηγήσει στη δημιουργία τεχνολογίας την οποία η ανθρωπότητα δεν θα είναι σε θέση να ελέγξει.

Περισσότερα εδώ
 
Επόμενο Major release σήμερα για το Opus.
Το πρώτο στη γενιά μοντέλων 5.5, με υψηλότερες επιδόσεις από τα Fable και Astra στα περισσότερα tasks.
Θα το δοκιμάσω από αύριο και θα επανέλθω.


1790096153320.png

1790095493002.png

1790095657067.png 1790095665756.png
 
Σήμερα βγήκαν και τα GPT 6 Sol, 6 Luna.
Με 50% λιγότερο κόστος σε σχέση με τα 5.6
Και η Anthropic έριξε το κόστος του Opus 5.5 κατά 20% σε σχέση με το προηγούμενο μοντέλο.

Εκ πρώτης όψεως, το Sol που είναι το αντίστοιχο με το Opus δεν δείχνει κάποια δραματική βελτίωση σε σχέση με το προηγούμενο. Σίγουρα είναι αρκετά κάτω από το Astra.

1790108069688.png

1790108329792.png

1790108352100.png

Έβαλα όλα τα Benchmarks όπως τα συνθέτει η artificial analysis. Στο site της OpenAI φυσικά έχει ορισμένα επιλεγμένα, τα οποία -να με συγχωρούν, πέραν του ότι δεν συγκρίνουν με τα τελευταία μοντέλα, βγάζουν άλλα αντί άλλων αποτελέσματα. Παράδειγμα:

1790108770348.png

Εδώ το 5.6 Sol έχει καλύτερες επιδόσεις σε σχέση με το 6 Sol και ίδια απόδοση έχει και το 6 Luna. Πράγματα οριακά κωμικά.
Θα το διαβάσει κανείς και θα νομίζει πως το Fable και το Astra θα βγάλουν το ίδιο αποτέλεσμα +- 5% με το Luna.
 
Να ρωτήσω κάτι (ίσως και βλακεία) εσείς που κάνετε διατριβές με το ΑΙ :
Είναι γνωστό ότι το ΑΙ τραβάει data από οτιδήποτε site υπάρχει στο Internet.
Έχει διαπιστωθεί ότι διαβάζει και τα emails;
Αυτό το θεωρώ πολύ πιο τρομακτικό.
 
Να ρωτήσω κάτι (ίσως και βλακεία) εσείς που κάνετε διατριβές με το ΑΙ :
Είναι γνωστό ότι το ΑΙ τραβάει data από οτιδήποτε site υπάρχει στο Internet.
Έχει διαπιστωθεί ότι διαβάζει και τα emails;
Αυτό το θεωρώ πολύ πιο τρομακτικό.

Email πως να διαβάσει; Ότι είναι δημόσιο έχει ήδη διαβαστεί.
Τα πρώτα μοντέλα βασίζονταν σε μεγάλο βαθμό στο πλήθος δεδομένων που είχαν. Πλέον έχει αλλάξει αρκετά αυτό.
 
Ο οποίος προεδρος ως γνωστόν έχει εξαιρετική νοημοσύνη...

Για πείτε, για μετάφραση μεγάλων (300 σελίδες) επιστημονικων κειμένων από Αγγλικά σε Ελληνικά και από Ελληνικά σε Γερμανικά τι να κάνω; Το Gemini λέει να χρησιμοποιήσω DeepL, αλλά μια πρώτη δοκιμή με αποσπάσματα με τις δωρεάν εκδόσεις μου έδειξε ότι το Gemini έχει καλύτερο αποτέλεσμα από το DeepL.
Είμαι διατεθειμένος να πληρώσω συνδρομή, αλλά πώς γίνεται να μην χρησιμοποιηθεί το κείμενο από το ΑΙ για άλλους σκοπούς; Υπάρχουν και copyright στη μέση...
 
  • Haha
Reactions: Φρα.Πε.
Η Google έχει εξαιρετικά μοντέλα για multilingual.
Εάν δεν θέλεις να κρατηθεί ούτε το prompt λεπτό αφού πάρεις τα αποτελέσματα, τότε μπορείς να τρέξεις το prompt μέσω του Google Cloud Platform.

Φτιάχνεις τον λογαριασμό σου εκεί, και από το Gemini Enterprise Agent Platform επιλέγεις το Studio.
Επάνω αριστερά "New" -> Chat
Μοντέλο θα επιλέξεις το 3.7 Flash (έχει καλύτερες επιδόσεις για αυτό που θέλεις σε σχέση με το 3.8) και θα αλλάξεις από την επιλογή settings το thinking level σε high.

1790175343458.png

Δεν κρατάει καθόλου δεδομένα και το κόστος για να κάνεις τη δουλειά σου πιθανότατα θα είναι κάτω από 1€.
 
Μπορεί να διαβάσει τα δικά σου email εφόσον του δώσεις πρόσβαση με το κατάλληλο plugin

Όπου πρακτικά το gemini παίρνει πρόσβαση στο email σου απλά επειδή πάτησες ένα "αποδέχομαι" σε μία τεράστια σελίδα με terms and conditions και έχεις κάνει login μέσω gmail.
Και ως γνωστόν το free gemini χρησιμοποιείται "για να εκπαιδεύει το μοντέλο".
Άρα, τα emails σου χρησιμοποιούνται για να εκπαιδεύουν τα μοντέλα του.
Μπορεί αυτή τη στιγμή να υπάρχει στα terms and conditions ότι δεν θα χρησιμοποιήσει τα email σου, αλλά πολύ εύκολα τα αλλάζουν και σου στέλνουν ένα "αλλάξαμε τα terms and conditions" και είναι ok.
 
  • Sad
Reactions: DimAsi
...
Εδώ το 5.6 Sol έχει καλύτερες επιδόσεις σε σχέση με το 6 Sol και ίδια απόδοση έχει και το 6 Luna. Πράγματα οριακά κωμικά.
Θα το διαβάσει κανείς και θα νομίζει πως το Fable και το Astra θα βγάλουν το ίδιο αποτέλεσμα +- 5% με το Luna.
Ειδικά η openai τα έχει κάνει μεγάλη μαντάρα. Πως θα μπορέσει ο απλός χρήστης να διαλέξει μεταξύ:
- Chat GPT 6 Astra
- Chat GPT 6 Sol
- ChatGPT 6 Luna
- ChatGPT 5.6 Sol
- ChatGPT 5.6 Terra
- ChatGPT 5.6 Luna
ότι να ναι...
Μόνο το πρώτο ξέρεις πραγματικά τι είναι και πόσο κοστίζει. Στο chat πάντως αφήνει μόνο ακόμη:
- ChatGPT 6 Astra Pro
- ChatGPT 5.6 Sol (όλα τα thinking levels)

Φυσικά σε κάθε τέτοια περίπτωση, απλά το ρωτάς και η απάντηση του ChatGPT 6 Astra Max ήταν:
Model + thinking levelWhen to use itExample
1. GPT-6 Luna + LowSimple, clearly specified tasks with easily checked outputs. Prioritize speed.Extract dates and indicators; standardize terminology; make small formatting changes.
2. GPT-6 Sol + MediumEveryday default. Routine writing, research, spreadsheets and coding requiring judgment.Prepare a policy brief from supplied sources; write a data-processing script.
3. GPT-6 Sol + Extra HighThorough checking of a defined problem or existing deliverable.Audit spreadsheet formulas; reconcile conflicting figures; scrutinize methodological assumptions.
4. GPT-6 Astra + MediumBroad, ambiguous assignments requiring synthesis and coordination across several materials.Integrate technical, institutional and implementation considerations into a programme.
5. GPT-6 Astra + Extra HighThe most demanding analytical work, where depth matters more than turnaround time.Critique a research methodology; examine competing pathways; challenge a complex techno-economic assessment.
 
  • Like
Reactions: evanfotis
Τα 5.6 δεν υπάρχει λόγος να τα χρησιμοποιεί κανείς εφόσον τα 6 είναι στο μισό κόστος. Και στις συνδρομές φαντάζομαι θα περιλαμβάνεται μεγαλύτερη χρήση.
Ο βασικός μπούσουλας είναι για τα περισσότερα να χρησιμοποιείς το Sol και όταν κάτι είναι εξαιρετικά περίπλοκο, τότε το Astra.
 
  • Like
Reactions: Φρα.Πε.
Όπου πρακτικά το gemini παίρνει πρόσβαση στο email σου απλά επειδή πάτησες ένα "αποδέχομαι" σε μία τεράστια σελίδα με terms and conditions και έχεις κάνει login μέσω gmail.
Και ως γνωστόν το free gemini χρησιμοποιείται "για να εκπαιδεύει το μοντέλο".
Άρα, τα emails σου χρησιμοποιούνται για να εκπαιδεύουν τα μοντέλα του.
Μπορεί αυτή τη στιγμή να υπάρχει στα terms and conditions ότι δεν θα χρησιμοποιήσει τα email σου, αλλά πολύ εύκολα τα αλλάζουν και σου στέλνουν ένα "αλλάξαμε τα terms and conditions" και είναι ok.
Δεν το παίρνει και τόσο εύκολα. Μια μέρα το ρώτησα στο Android Auto αν έχει πρόσβαση στο calendar και μου είπε όχι και αν ήθελα να του παρέχω άδεια...προφανώς του είπα όχι...

Για αυτό στήνω το δικό μου AI Assistant. Αλλά δεν νομίζω ότι είναι μακριά η ημέρα που θα δώσουμε access γιατί απλά ο κόπος του να μην έχουμε θα γίνει τέτοιος που θα πούμε άντε στο...
 

Μεγάλο χαμόγελο όσο διάβαζα την παρακάτω παράγραφο...

During the course of its research, Claude noticed an unusual Reverse Transcriptases (RT) family and decided to examine it in greater detail. While combing through the raw DNA sequence near the RT, the agent exclaimed: “[The DNA next to the RT] is spectacular: I can see by eye a tandem repeat array … that's a CRISPR-like … repeat array?!”

Gemini translate:
Κατά τη διάρκεια της έρευνάς του, ο Claude παρατήρησε μια ασυνήθιστη οικογένεια RT και αποφάσισε να την εξετάσει με μεγαλύτερη λεπτομέρεια. Εξετάζοντας προσεκτικά την ακατέργαστη αλληλουχία DNA κοντά στο RT, ο πράκτορας αναφώνησε:
«[Το DNA δίπλα στο RT] είναι εντυπωσιακό: μπορώ να διακρίνω οπτικά μια συστοιχία διαδοχικών επαναλήψεων… πρόκειται για μια… συστοιχία επαναλήψεων που μοιάζει με CRISPR;!»

Βρήκε φυσικό μηχανισμό για τροποποίηση του DNA που δουλεύει παρόμοια με το CRISPR...

Διαβάζουμε πια καθημερινά τέτοιες ειδήσεις...
 
Πολύ καλά το κάνουν.
Ωστόσο πιο γρήγορα θα βγεί το Tesla Roadster παρά θα πάει datacenter στο διάστημα.

Για να έχουμε μια τάξη μεγέθους:


Το νεότερο σύστημα της Nvidia που αυτή τη στιγμή παραδίδει σε πελάτες είναι το παραπάνω.
Χρειάζεται 230KW ανά rack και έχει τροφοδοσία για 440KW (redundancies) ενώ ζυγίζει περίπου 1800 κιλά.

Σε λίγο το flagship τους θα είναι το NVL576, με 600KW ανά rack.
Αυτά είναι τα προβλήματα της υποδομής για AI που είναι και "latency tolerant", δεν υπάρχει πρόβλημα με τον χρόνο απόκρισης. Εάν πάμε σε άλλες εφαρμογές, μετριάζονται τα παραπάνω, αλλά φυσικά υπάρχουν τελείως άλλα προβλήματα.
 

Μεγάλο χαμόγελο όσο διάβαζα την παρακάτω παράγραφο...

During the course of its research, Claude noticed an unusual Reverse Transcriptases (RT) family and decided to examine it in greater detail. While combing through the raw DNA sequence near the RT, the agent exclaimed: “[The DNA next to the RT] is spectacular: I can see by eye a tandem repeat array … that's a CRISPR-like … repeat array?!”

Gemini translate:
Κατά τη διάρκεια της έρευνάς του, ο Claude παρατήρησε μια ασυνήθιστη οικογένεια RT και αποφάσισε να την εξετάσει με μεγαλύτερη λεπτομέρεια. Εξετάζοντας προσεκτικά την ακατέργαστη αλληλουχία DNA κοντά στο RT, ο πράκτορας αναφώνησε:
«[Το DNA δίπλα στο RT] είναι εντυπωσιακό: μπορώ να διακρίνω οπτικά μια συστοιχία διαδοχικών επαναλήψεων… πρόκειται για μια… συστοιχία επαναλήψεων που μοιάζει με CRISPR;!»

Βρήκε φυσικό μηχανισμό για τροποποίηση του DNA που δουλεύει παρόμοια με το CRISPR...

Διαβάζουμε πια καθημερινά τέτοιες ειδήσεις...
Ερώτηση: Βρήκε λοιπόν μια in vitro μέθοδο αντίστροφης μεταγραφής, σούπερ. Πως την βρήκε; Είχε δεδομένα σε real time τρέχοντα πειράματα κατόπιν ζήτησης; Ανέλυσε παλαιότερα πειράματα στα οποία τα υβριδικά μόρια είχαν αγνοηθεί ή δεν είχαν μελετηθεί επαρκώς από βιοεπιστήμονες;
 
Δεν είναι μέθοδος αντίστροφης μεταγραφής, είναι νέο ενζυμικό σύστημα εάν το καταλαβαίνω σωστά. Η αντίστροφη μεταγραφάση είχε ήδη εντοπιστεί στο παρελθόν, δεν την είχαν συσχετίσει με το array και τη προτεϊνη δίπλα της.
Το έκαναν με genome mining, υπολογιστική εξόρυξη γονιδιωμάτων.