Τεχνητή Νοημοσύνη – Νέα & Εργαλεία | Greek AI Network

Greek AI Network

  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI
No Result
View All Result
Τεχνητή Νοημοσύνη – Νέα & Εργαλεία | Greek AI Network
  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI
No Result
View All Result
Τεχνητή Νοημοσύνη – Νέα & Εργαλεία | Greek AI Network

Greek AI Network

No Result
View All Result
Home Νέα

Είπε ψέματα η xAI για τα benchmarks του Grok 3;

by Kyriakos Koutsourelis
24 Φεβρουαρίου, 2025
in Νέα
0
Οι συζητήσεις σχετικά με τους δείκτες αναφοράς τεχνητής νοημοσύνης - και τον τρόπο με τον οποίο αναφέρονται από τα εργαστήρια τεχνητής νοημοσύνης - ξεχειλίζουν στη δημοσιότητα. Αυτή την εβδομάδα, ένας υπάλληλος του OpenAI κατηγόρησε την εταιρεία AI του Elon Musk, xAI, ότι δημοσίευσε παραπλανητικά αποτελέσματα συγκριτικών μετρήσεων για το τελευταίο μοντέλο AI, το Grok 3. Ένας από τους συνιδρυτές της xAI, ο Igor Babushkin, επέμεινε ότι η εταιρεία είχε δίκιο. Translated with DeepL.com (free version)
Share on FacebookShare on Twitter

Οι Δημόσιες Συζητήσεις για τα Κριτήρια Αξιολόγησης της Τεχνητής Νοημοσύνης και η Διαμάχη με την xAI

Η συζήτηση γύρω από τα κριτήρια αξιολόγησης της τεχνητής νοημοσύνης και τον τρόπο με τον οποίο αυτά παρουσιάζονται από τα εργαστήρια AI έχει αρχίσει να γίνεται ευρέως γνωστή. Πρόσφατα, ένας υπάλληλος της OpenAI κατηγόρησε την εταιρεία τεχνητής νοημοσύνης του Elon Musk, xAI, για παραπλανητική παρουσίαση των αποτελεσμάτων αξιολόγησης του νέου της μοντέλου, Grok 3. Ο Igor Babushkin, συνιδρυτής της xAI, υπερασπίστηκε τη θέση της εταιρείας, υποστηρίζοντας ότι η προσέγγισή τους ήταν σωστή. Η αλήθεια πιθανώς βρίσκεται κάπου στο ενδιάμεσο.

Η Αμφιλεγόμενη Αξιολόγηση του Grok 3 και το AIME 2025

Σε μια ανάρτηση στο ιστολόγιο της xAI, η εταιρεία δημοσίευσε ένα γράφημα που δείχνει την απόδοση του Grok 3 στο AIME 2025, μια συλλογή από δύσκολα μαθηματικά προβλήματα από πρόσφατο διαγωνισμό. Κάποιοι ειδικοί έχουν εκφράσει αμφιβολίες για την εγκυρότητα του AIME ως κριτήριο αξιολόγησης για την τεχνητή νοημοσύνη. Παρ’ όλα αυτά, το AIME 2025 και παλαιότερες εκδοχές του τεστ χρησιμοποιούνται συχνά για να αξιολογηθεί η μαθηματική ικανότητα ενός μοντέλου.

Η Διαμάχη για τα Αποτελέσματα και το “cons@64”

Το γράφημα της xAI έδειξε ότι δύο παραλλαγές του Grok 3, το Grok 3 Reasoning Beta και το Grok 3 mini Reasoning, υπερείχαν του καλύτερου διαθέσιμου μοντέλου της OpenAI, o3-mini-high, στο AIME 2025. Ωστόσο, υπάλληλοι της OpenAI επισήμαναν ότι το γράφημα της xAI δεν περιλάμβανε τη βαθμολογία του o3-mini-high στο AIME 2025 με την προσθήκη “cons@64”.

Αναρωτιέστε τι είναι το “cons@64”; Πρόκειται για τη συντομογραφία του “consensus@64”, το οποίο ουσιαστικά δίνει σε ένα μοντέλο 64 προσπάθειες να απαντήσει σε κάθε πρόβλημα και λαμβάνει ως τελική απάντηση την πιο συχνά παραγόμενη. Όπως μπορείτε να φανταστείτε, το “cons@64” τείνει να αυξάνει σημαντικά τις βαθμολογίες των μοντέλων, και η παράλειψή του από ένα γράφημα μπορεί να δημιουργήσει την εντύπωση ότι ένα μοντέλο υπερέχει έναντι ενός άλλου, ενώ στην πραγματικότητα αυτό δεν ισχύει.

Η Πραγματική Απόδοση του Grok 3 και ο Ισχυρισμός της xAI

Οι βαθμολογίες του Grok 3 Reasoning Beta και του Grok 3 mini Reasoning στο AIME 2025 με την ένδειξη “@1” — που σημαίνει την πρώτη βαθμολογία που πέτυχαν τα μοντέλα στο κριτήριο — είναι χαμηλότερες από τη βαθμολογία του o3-mini-high. Το Grok 3 Reasoning Beta επίσης υπολείπεται ελαφρώς του μοντέλου o1 της OpenAI όταν αυτό είναι ρυθμισμένο σε “μέτρια” υπολογιστική ισχύ. Παρά ταύτα, η xAI διαφημίζει το Grok 3 ως την “εξυπνότερη τεχνητή νοημοσύνη στον κόσμο”.

Συμπεράσματα και Προκλήσεις για το Μέλλον της Αξιολόγησης AI

Η διαμάχη αυτή αναδεικνύει τις προκλήσεις που αντιμετωπίζει η κοινότητα της τεχνητής νοημοσύνης όσον αφορά την αντικειμενική αξιολόγηση και παρουσίαση των αποτελεσμάτων. Είναι σημαντικό οι εταιρείες να είναι διαφανείς και να παρέχουν πλήρη δεδομένα για τις επιδόσεις των μοντέλων τους, ώστε να αποφεύγονται παρανοήσεις και να διατηρείται η εμπιστοσύνη στο πεδίο. Καθώς η τεχνητή νοημοσύνη συνεχίζει να εξελίσσεται, η ανάγκη για αξιόπιστα και αμερόληπτα κριτήρια αξιολόγησης γίνεται όλο και πιο επιτακτική.

Αναμένουμε με ενδιαφέρον να δούμε πώς θα εξελιχθεί η συζήτηση αυτή και ποιες αλλαγές θα υιοθετηθούν για τη βελτίωση της αξιοπιστίας των κριτηρίων αξιολόγησης στο μέλλον.

Tags: AI NewsGrokxAI

ΣΧΕΤΙΚΑ ΑΡΘΡΑ

Η TypeSafe AI βγαίνει από τη φάση stealth και παρουσιάζει το Jev, ένα νέο μοντέλο τεχνητής νοημοσύνης που έχει σχεδιαστεί όχι για συνομιλίες, αλλά για γρήγορη και δομημένη λήψη αποφάσεων μέσα σε εφαρμογές λογισμικού. Πίσω από την εταιρεία βρίσκεται ο Diogo Almeida, πρώην στέλεχος της OpenAI και ένας από τους συνδημιουργούς του ChatGPT. Η ομάδα της TypeSafe εργάστηκε για περίπου δύο χρόνια πάνω στο Jev, επιχειρώντας να αντιμετωπίσει ορισμένους από τους περιορισμούς που εμφανίζουν τα παραδοσιακά Large Language Models όταν χρησιμοποιούνται για αυτοματοποίηση.
Νέα

Η TypeSafe λανσάρει το Jev για προγραμματιστική λογική

by Theodoros Kostogiannis
18 Σεπτεμβρίου, 2026
Η Pony.ai αποκάλυψε τη νέα γενιά του αυτόνομου ηλεκτρικού της φορτηγού, ενισχύοντας την παρουσία της στον τομέα των εμπορευματικών μεταφορών χωρίς οδηγό. Το T9 Robotruck, που αναπτύχθηκε από κοινού με την GAC Commercial Vehicle, υποστηρίζει αυτόνομη οδήγηση Level 4 και προορίζεται κυρίως για μεταφορές μεγάλων αποστάσεων και εφαρμογές logistics.
Νέα

Η Pony.ai παρουσιάζει αυτόνομο ηλεκτρικό φορτηγό για logistics

by Theodoros Kostogiannis
17 Σεπτεμβρίου, 2026
Η AI αναδιαμορφώνει την αγορά εργασίας στην Ιρλανδία
Νέα

AI και εργασία στην Ιρλανδία: τι δείχνει νέα έρευνα

by Kyriakos Koutsourelis
17 Σεπτεμβρίου, 2026
Google: Επένδυση 13 δισ. ευρώ στη Φινλανδία για AI data centers και ενέργεια
Νέα

Google: Επένδυση 13 δισ. ευρώ στη Φινλανδία για AI data centers και ενέργεια

by Kyriakos Koutsourelis
16 Σεπτεμβρίου, 2026
Η Microsoft AI επιχειρεί να θέσει σαφή όρια στο πόση αυτονομία μπορούν να αποκτήσουν τα προηγμένα συστήματα τεχνητής νοημοσύνης, παρουσιάζοντας το προσχέδιο του Humanist AI Code of Conduct. Το νέο πλαίσιο περιγράφει τους κανόνες που θα πρέπει να ακολουθούν τα μοντέλα AI της εταιρείας κατά την εκπαίδευση και τη λειτουργία τους. Κεντρική αρχή είναι ότι ο άνθρωπος πρέπει να διατηρεί πάντοτε τον τελικό έλεγχο. Ένα μοντέλο θα πρέπει ακόμη και να αποτυγχάνει στην εκτέλεση μιας εργασίας, εφόσον η ολοκλήρωσή της προϋποθέτει ουσιαστική παραβίαση των κανόνων ασφαλείας.
Νέα

Η Microsoft βάζει «κόκκινες γραμμές» στην αυτονομία της AI

by Theodoros Kostogiannis
15 Σεπτεμβρίου, 2026
Το άρθρο εξετάζει την αυξανόμενη ανησυχία γύρω από την ταχύτατη ανάπτυξη της Τεχνητής Νοημοσύνης (AI) και τις εκκλήσεις κορυφαίων στελεχών του κλάδου για επιβράδυνση. Προσωπικότητες όπως οι Dario Amodei (Anthropic), Sam Altman (OpenAI) και Elon Musk εκφράζουν προβληματισμό για τους πιθανούς κινδύνους των ολοένα ισχυρότερων μοντέλων AI.
Νέα

Οι ηγέτες της AI ζητούν επιβράδυνση, αλλά ποιος θα κάνει την αρχή;

by Theodoros Kostogiannis
14 Σεπτεμβρίου, 2026
Νέο εθνικό πρότυπο για την ασφαλή χρήση της AI στα σχολεία
Νέα

AI στα σχολεία: νέο πρότυπο για ασφάλεια και ιδιωτικότητα

by Kyriakos Koutsourelis
14 Σεπτεμβρίου, 2026
Το Aura 1.0 της Ramen αυτοματοποιεί το playtesting και το game development σε Unity και Unreal Engine με τη βοήθεια AI agents και των μοντέλων Claude της Anthropic.
Νέα

Η Ramen φέρνει AI agent για αυτοματοποιημένο game testing

by Theodoros Kostogiannis
13 Σεπτεμβρίου, 2026
Η NVIDIA χρησιμοποιεί Palantir Foundry, cuOpt και Nemotron 3.5 Lightning για βελτιστοποίηση και αυτοματοποίηση της εφοδιαστικής αλυσίδας παραγωγής AI hardware.
Νέα

Palantir και cuOpt βελτιστοποιούν την παραγωγή της NVIDIA

by Theodoros Kostogiannis
12 Σεπτεμβρίου, 2026
Next Post
Η Ιαπωνία βλέπει τη μετατόπιση του απορρήτου δεδομένων για να ενισχύσει την ανάπτυξη της τεχνητής νοημοσύνης Η κυβέρνηση εξετάζει το ενδεχόμενο να χαλαρώσει τους κανόνες συναίνεσης για τη χρήση ευαίσθητων προσωπικών πληροφοριών για να στηρίξει τη βιομηχανία τεχνητής νοημοσύνης. Η ιαπωνική κυβέρνηση εξετάζει σημαντικές αλλαγές στους κανονισμούς της για την προστασία των προσωπικών πληροφοριών, χαλαρώνοντας ενδεχομένως τους περιορισμούς σχετικά με τον τρόπο χειρισμού των ευαίσθητων προσωπικών δεδομένων. Η αλλαγή αυτή αποσκοπεί στην ενίσχυση της βιομηχανίας τεχνητής νοημοσύνης (AI) της χώρας.

Η Ιαπωνία βλέπει τη μετατόπιση του απορρήτου δεδομένων για να ενισχύσει την ανάπτυξη AI

Ο ρόλος της AI στον κυβερνοπόλεμο και την άμυνα του ΝΑΤΟ

Ο ρόλος της AI στον κυβερνοπόλεμο και την άμυνα του ΝΑΤΟ

Ώρα για ένα CERN στην Ευρωπαϊκή τεχνητή νοημοσύνη

Ώρα για ένα CERN στην Ευρωπαϊκή τεχνητή νοημοσύνη

Πρόσφατα Άρθρα

Microsoft Discovery και προσαρμοστική AI στην επιστημονική έρευνα

Microsoft Discovery και προσαρμοστική AI στην έρευνα

19 Σεπτεμβρίου, 2026
Η TypeSafe AI βγαίνει από τη φάση stealth και παρουσιάζει το Jev, ένα νέο μοντέλο τεχνητής νοημοσύνης που έχει σχεδιαστεί όχι για συνομιλίες, αλλά για γρήγορη και δομημένη λήψη αποφάσεων μέσα σε εφαρμογές λογισμικού. Πίσω από την εταιρεία βρίσκεται ο Diogo Almeida, πρώην στέλεχος της OpenAI και ένας από τους συνδημιουργούς του ChatGPT. Η ομάδα της TypeSafe εργάστηκε για περίπου δύο χρόνια πάνω στο Jev, επιχειρώντας να αντιμετωπίσει ορισμένους από τους περιορισμούς που εμφανίζουν τα παραδοσιακά Large Language Models όταν χρησιμοποιούνται για αυτοματοποίηση.

Η TypeSafe λανσάρει το Jev για προγραμματιστική λογική

18 Σεπτεμβρίου, 2026
Η AWS δίνει δωρεάν πρόσβαση στο Kiro σε εκατομμύρια φοιτητές

AWS: δωρεάν πρόσβαση στο Kiro για φοιτητές 132 ΑΕΙ

18 Σεπτεμβρίου, 2026

Ετικέτες

Adobe AI Agents AI News AI Tools AI Ρομποτική AI στην καθημερινότητα Alibaba Amazon AMD Anthropic Apple AWS Azure AI Chatbot ChatGPT Claude Copilot Deepmind DeepSeek Gemini GenAI Google Grok Huggingface IBM Intel Llama Machine Learning Meta Microsoft Mistral Nvidia OpenAI Oracle Perplexity Physical AI Samsung xAI Εκπαίδευση Επιχειρήσεις Ευρωπαϊκή Ένωση Ηνωμένες Πολιτείες Αμερικής Κίνα Μέσα Κοινωνικής Δικτύωσης Υγεία

Μενού

  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI
  • Σχετικά με εμάς
  • Βασικές έννοιες
  • Όροι Χρήσης
  • Ιδιωτικότητα

© 2024 Gain - Greek AI Network, all rights reserved.

No Result
View All Result
  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI

© 2024 Gain - Greek AI Network, all rights reserved.