-
Assolatte, prima volta a metà anno export formaggi sopra 3 miliardi
-
Tensione sui titoli di Stato, lo spread Btp-Bund a 90 punti
-
Gerwig, perchè Meryl Streep darà la voce al leone Aslan di Narnia
-
Ipsos, medici e scienziati considerati affidabili da oltre il 60% degli italiani
-
Silicon Box, in primavera inizia la costruzione dello stabilimento a Novara
-
Fabregas "Roma-Inter grande partita, non una sfida tra nostre rivali"
-
Il Piccolo Teatro ricorda Ornella Vanoni con Pacifico
-
Inps, controlli su assegno unico, rischio revisione importi
-
Le chitarre di Johnny Marr degli Smiths vendute all'asta per oltre 4 milioni
-
A Milano un murale di oltre 850 metri quadrati celebra Ornella Vanoni
-
Kallas, 'attacchi degli Houthi inaccettabili, Aspides innalza l'allerta'
-
Nations League: Cristiano Ronaldo ci sarà ancora, convocato dal Portogallo
-
Putin ha votato online per le elezioni parlamentari
-
Franco Nero al Ministero della Cultura per la stella sulla Walk of Fame
-
Lady Gaga, la bebè è nata con la maternità surrogata
-
Macron avverte, 'attacchi ibridi russi non resteranno senza risposta'
-
Macron, la Francia convocherà un vertice G7 sull'energia
-
Macron, serve piano per proteggere infrastrutture critiche da attacchi ibridi russi
-
Assopetroli, taglio bollo anche per auto a metano e biometano
-
Tanino Liberatore firma l'immagine del Bologna Jazz Festival 2026
-
Calcio: Gasperini 'oggi l'Inter più forte, ma vogliamo rimanere in alto'
-
Maluma e Shakira, è uscito il nuovo singolo Agua
-
Ancora nessun accordo tra i 27 Ue sul rinnovo delle sanzioni a Mosca
-
Giorgetti, copertura del dl bollo con risparmi Pnrr sono soldi nazionali
-
In sala 'The Invite', in amore vince chi sa cambiare
-
Giorgetti, 'sono speranzoso sull'uscita dalla procedura Ue per disavanzo'
-
Buffett lascia la presidenza di Berkshire Hathaway, al suo posto il figlio
-
MotoGp: Gp d'Austria, le Ktm le più veloci sul circuito di casa
-
Giorgetti, credo Bruxelles aperta a concederci spazio flessibilità energia
-
In rialzo i rendimenti dei titoli di Stato, Btp al 4,39%
-
Lagarde, 'lunedì lanciamo Pontes, per transazioni digitali tra le banche'
-
Sono in corso le riprese di Tony Pitony - Il Filmony
-
Lollobrigida, 40 milioni per la nuova "Cambiale Frantoi Oleari" Ismea
-
Lo spread della Francia sul Bund supera soglia 100 punti, ai massimi dal 2012
-
Da Getty a Cavani a Moretti, gli ospiti del Lucca film festival
-
Dell'Acqua (Arera), su energia sanzioni non bastano, serve transizione
-
Media, 'Riad propone una tregua di due settimane, ma Houthi scettici'
-
Pichetto Fratin, 'ben che vada, avremo il nucleare nel 2033-2034'
-
Osservato in tempo reale il primo salto quantico del suono
-
Pichetto Fratin, 'con governo Meloni aumento massiccio di rinnovabili'
-
Una mutazione genetica dietro i tumori al polmone nei non fumatori
-
L'Ue prepara il Servizio governativo di osservazione della Terra
-
Con Cinema in festa dal 21 al 24 settembre tutti i film in sala a 3,50 euro
-
Papiri di Ercolano, una nuova tecnica può leggere i testi perduti
-
Scoperto il pianeta più giovane, ha meno di un milione di anni
-
Calcio: Spagna, De La Fuente convoca Martinez dell'Inter
-
Sulla Luna il più grande cratere di recente formazione del Sistema solare
-
Il cervello non è uno solo, in realtà sono due organi distinti
-
Calcio: Lazio; Gattuso 'nessun contraccolpo da vicende esterne'
-
Francesco Renga, nuovo disco a dicembre poi da aprile il tour 'Live teatri'
Cybersicurezza, modelli di Ia superano molti attacchi, ma restano vulnerabili
AI4I pubblica studio sulla robustezza dei modelli di frontiera
Anche i sistemi di Intelligenza Artificiale più avanzati restano vulnerabili ad alcuni attacchi esterni. È quanto emerge dallo studio "Measuring the Residual Jailbreak Surface of Frontier Large Language Models" dell'Ai Security Lab dell'Istituto Italiano di Intelligenza Artificiale (AI4I), guidato da Nicola Franco. Attraverso la piattaforma open source HackAgent, i ricercatori hanno effettuato centinaia di migliaia di tentativi di jailbreak contro due modelli linguistici avanzati, utilizzando 7.826 intenti dannosi in dieci categorie di rischio, dalla cybersicurezza alla disinformazione. I risultati mostrano che i modelli bloccano la maggior parte degli attacchi: oltre l'88% nel caso di Claude Opus 4.8 e oltre il 93% per Fable 5. Tuttavia, sono state individuate centinaia di risposte dannose ottenute tramite tecniche automatizzate. Lo studio evidenzia inoltre che i tradizionali metodi di aggiramento basati su codifiche e artifici linguistici sono ormai in gran parte neutralizzati, mentre restano efficaci gli attacchi adattivi, capaci di apprendere dalle risposte del modello e modificare progressivamente la propria strategia. "La sicurezza dei sistemi di Intelligenza Artificiale richiede valutazioni indipendenti, continue e basate su evidenze empiriche", afferma Franco. "Misurare la robustezza dei modelli in condizioni avversariali è una componente essenziale della governance dell'Ai e della fiducia necessaria per la sua adozione su larga scala". Secondo i ricercatori, la sicurezza dell'Ia non può essere considerata acquisita una volta per tutte, ma richiede un processo continuo di verifica e miglioramento. Per Fabio Pammolli, sviluppare capacità autonome di valutazione dei sistemi di IA avanzati è "una componente essenziale della sovranità tecnologica" dell'Italia e dell'Europa.
P.Queiroz--PC