-
Explosions dans la DMZ : Séoul exige des excuses, Pyongyang nie toute implication
-
Infections et cancers : des liaisons parfois dangereuses, souvent évitables
-
Milei en France en promoteur d'une Argentine ouverte aux affaires, mais qui patine
-
Mediapart dénonce la "violence sidérante" du RN après ses révélations sur Bardella
-
Ligue des nations: l'Angleterre gagne en République tchèque grâce au duo Gordon-Kane
-
Concurrence dans Android et la recherche en ligne: Google attaque des décisions de Bruxelles
-
Une ONG attaque OpenAI pour infraction à la loi sur les cyberattaques après l'incident Hugging Face
-
Ligue des nations: l'Espagne réussit son retour à la maison, Lamine Yamal inarrêtable
-
Sous l'oeil de Trump, les patrons de l'IA promettent de s'auto-réguler
-
Wall Street clôture en baisse, les taux touchent des sommets
-
Club Dorothée et Les Guignols favoris des téléspectateurs sur les 40 dernières années, selon un sondage
-
ONU: le Conseil de sécurité prolonge de six mois la force contre les gangs en Haïti
-
Angélique Kidjo exhorte les Africains à "créer ensemble"
-
Poussée de tension entre BFMTV, des lycéens et le maire de Saint-Denis
-
Trump plaide pour "l'auto-régulation" en recevant les grands patrons de l'IA
-
Espagne : face à la colère sociale, le gouvernement s'attaque à la crise du logement
-
Le Pacifique mexicain résiste au passage de l'ouragan Polo
-
En Espagne, Macron livre ses recettes contre la montée des "extrêmes" en Europe
-
Alerte près d'une base militaire en Angleterre: de l'essence mais aucun explosif retrouvé
-
Trump réunit les grands noms de l'IA à la Maison Blanche
-
Nombre de maternités: la mission "périnatalité" critique un modèle "insoutenable"
-
Foot: nouvelle passe d'armes entre l'UEFA et la Fifa
-
Foot: Manchester City reconnu "coupable" de "graves" infractions financières de 2009 à 2018 par la Premier League
-
Accusé d'antisémitisme, Bardella dénonce "une guerre totale" contre le RN, Mediapart fustige "la violence sidérante de l'extrême droite"
-
Birmanie : 50 morts sur un marché bombardé par l'armée, selon des sources humanitaires
-
Energie: l'Union européenne s'attend à un hiver difficile, avec des prix très élevés
-
La Bourse de Paris lestée par les incertitudes budgétaires, le taux français dépasse 4,80%
-
A Liverpool, Andy Burnham défend un réengagement de l'Etat et se projette au-delà de 2029
-
Les Bourses européennes terminent sans enthousiasme
-
Trump reçoit les patrons de l'IA à la Maison Blanche mardi
-
Thélyson Orélien, l'étoile fuyante
-
L'Iran menace de nouvelles frappes, dans l'attente d'une réponse américaine à son plan pour Ormuz
-
Allemagne: le Rhin à un niveau historiquement bas face à une sécheresse persistante
-
Slovaquie: une enseignante tuée et deux blessés dans une attaque au couteau dans une école
-
Macron en visite d'État en Espagne pour pousser une "Europe plus forte"
-
Allemagne: la plus haute éolienne du monde a atteint sa hauteur finale, à 365 mètres
-
"Ras-le-bol des bas salaires": la fonction publique dans la rue pour son pouvoir d'achat
-
Wall Street ouvre sans direction claire, surveille le pétrole et les taux
-
Equipe de France: l'état de grâce de Zidane
-
Slovaquie: une enseignante tuée et deux blessées dans une attaque au couteau dans une école
-
Cisjordanie: une violente attaque sur un village suscite de rares condamnations par Israël
-
Accusations d'antisémitisme : Bardella dénonce "une guerre totale" contre le RN, première crise pour la campagne Le Pen
-
Au Cameroun, les féminicides se multiplient, les familles réclament justice
-
A Liverpool, le Labour remobilisé derrière Andy Burnham mais attend des réponses
-
La Malaisie commence à renvoyer des ressortissants birmans, inquiétude de l'ONU
-
Budget : enquête ouverte après un signalement de Lecornu sur des fuites dans la presse
-
Alerte près d'une base militaire en Angleterre: confusion après la libération des suspects
-
Ecrits antisémites : Bardella dénonce "une guerre totale" contre le RN, première crise de campagne pour Le Pen
-
Chez les enseignants, le sentiment d'un grand déclassement
-
OpenAI renonce à un nouveau modèle d'IA à quelques heures de la grande conférence DevDay
Comprendre comment l'IA raisonne avant qu'elle ne devienne surpuissante, une urgence
Des humains l'ont programmée mais ne la comprennent pas complètement. L'intelligence artificielle (IA) générative reste un mystère, que des ingénieurs s'efforcent de percer avant que ses capacités n'explosent, pour éviter des dérapages.
"Les gens étrangers à ce milieu sont souvent surpris et alarmés d'apprendre que nous ne comprenons pas comment fonctionnent nos propres créations IA", a écrit, dans un long essai fin avril, Dario Amodei, le co-fondateur d'Anthropic, fleuron du secteur.
"Ils ont raison d'être préoccupés", a-t-il poursuivi. "Ce défaut de compréhension est sans précédent dans l'histoire de la technologie."
A la différence des programmes traditionnels, effectuant uniquement les tâches demandées, les modèles d'IA générative ne sont, en effet, qu'une rampe de lancement.
C'est "un échafaudage", selon l'expression de Chris Olah, ancien d'OpenAI aujourd'hui passé chez Anthropic et considéré comme l'un des inventeurs de la "mechanistic interpretability", qui déconstruit l'intelligence artificielle.
Cette jeune science, née au milieu des années 2010, s'attache à décrypter le cheminement qui mène d'une requête à une réponse, à travers une forêt de probabilités.
"Appréhender la totalité d'un grand modèle de langage", qui sert de base aux ChatGPT ou Gemini, "est une tâche incroyablement ambitieuse", explique à l'AFP Neel Nanda, chercheur chez DeepMind, le laboratoire d'IA de Google.
"C'est un peu comme essayer de décoder complètement le cerveau humain", selon lui, "ce que les neuroscientifiques essayent de faire depuis des décennies, sans y parvenir."
Confidentiel il y a encore quelques années, la discipline prend aujourd'hui une dimension nouvelle.
"Elle attire beaucoup nos étudiants", observe Mark Crovella, professeur d'informatique à l'université de Boston, "du fait de son potentiel à améliorer la sécurité des modèles, mais aussi parce que c'est un champ très stimulant intellectuellement."
- Tromper les humains -
Pour étudier ces phénomènes au plus près, retrace l'universitaire, la "mech interp", de son nom de code, ne se contente pas d'observer le résultat qu'offre un assistant IA à une demande.
"On observe les calculs à mesure qu'ils sont réalisés" par le programme d'IA, décrit-il.
La start-up Goodfire, en pointe sur le sujet, utilise des modèles d'interprétation, algorithmes IA à même de représenter des données sous forme d'étapes de raisonnement.
L'objectif est de saisir suffisamment bien la mécanique de l'IA générative pour la guider et corriger ses possibles errements.
Il s'agit d'empêcher les erreurs, mais aussi l'utilisation à des fins nocives ou de voir un modèle suffisamment autonome tromper les humains sur la nature de ses actions.
"Cela ressemble à une course contre la montre", situe Eric Ho, le patron de Goodfire, "avant que nous ne lancions des modèles d'IA extrêmement intelligents sans comprendre comme ils marchent."
Fin avril, Dario Amodei a fait état de "progrès récents", qui lui laissent penser que "nous sommes sur le point de trouver la clef de l'interprétabilité", au point de fixer une échéance, en 2027.
"Vu les avancées actuelles, il me semble plausible que d'ici 2027, nous disposions des outils à même de détecter, de façon fiable, les biais d'un modèle et ses intentions nocives" éventuelles, abonde Anh Nguyen, professeur à l'université d'Auburn.
Mark Crovella relève qu'à la différence du cerveau humain, "nous avons une représentation de chaque neurone dans ces modèles". "Nous pouvons voir tout ce qu'il se passe. La question, c'est comment l'interpréter."
Entrer dans le secret de l'IA générative rendrait possible, selon Dario Amodei, l'adoption de cette technologie dans des domaines où "un petit nombre d'erreurs pourrait être très préjudiciable", notamment pour ceux qui présentent des enjeux de sécurité importants.
Pour Neel Nanda, l'interprétabilité ouvrirait aussi la voie à des découvertes pour les humains, à l'instar du modèle AlphaZero de DeepMind, qui a dévoilé de nouvelles combinaisons au jeu d'échecs.
Par ailleurs, les premiers à maîtriser le raisonnement de l'IA générative pourront délivrer un label de fiabilité aux grands modèles qu'ils testeront, les rendant ainsi plus attractifs aux yeux de leurs clients potentiels.
"Il est clair pour nous, et pour Anthropic", qui a investi dans Goodfire, "que nous serons les premiers à le commercialiser", affirme Eric Ho.
Une percée américaine repositionnerait aussi les Etats-Unis en tête de la pyramide IA, position aujourd'hui contestée par la Chine.
"L'IA surpuissante va définir le destin de l'humanité", prévient Dario Amodei, "et nous devons comprendre nos propres créatures avant qu'elles ne transforment notre économie, nos vies et notre avenir."
V.F.Barreira--PC