Google confronta Gemini con Claude: emergono differenze nei protocolli di sicurezza | Large language models book | Ia generativa gratis | Migliori intelligenze artificiali gratis | Turtles AI
L’utilizzo di modelli di AI concorrenti per test comparativi solleva interrogativi etici e legali. Google sta valutando Gemini confrontandolo con Claude di Anthropic, evidenziando differenze significative nelle prestazioni e nei protocolli di sicurezza.
Punti chiave:
- Google confronta Gemini con Claude per valutarne le risposte.
- Claude dimostra standard di sicurezza più elevati rispetto a Gemini.
- I contractor segnalano criticità nel testare Gemini su temi sensibili.
- Non è chiaro se Google abbia ottenuto l’autorizzazione di Anthropic.
Nel contesto della continua competizione tecnologica per sviluppare modelli di AI avanzati, Google ha avviato una serie di test interni per valutare il modello Gemini confrontandolo con Claude, sviluppato da Anthropic, un’azienda in cui Google stessa ha investito. I test sono condotti da contractor che analizzano le risposte fornite dai due sistemi basandosi su criteri come la veridicità, la precisione e il livello di dettaglio delle risposte. A questi valutatori vengono assegnati fino a 30 minuti per ogni richiesta, in modo da analizzare le risposte con un approccio metodico. Tuttavia, l’uso di un modello concorrente come riferimento sta generando interrogativi sul rispetto delle normative contrattuali e sugli aspetti etici del processo.
Secondo corrispondenze interne visionate da TechCrunch, i contractor di Google hanno notato riferimenti espliciti a Claude all’interno della piattaforma utilizzata per il confronto con Gemini. Alcuni output presentati per la valutazione riportavano apertamente la dicitura "Io sono Claude, creato da Anthropic". Questi dettagli suggeriscono che Google utilizzi il modello di Anthropic per valutare il proprio sistema, sebbene la società non abbia chiarito se tale utilizzo avvenga con l’autorizzazione del produttore.
Le prestazioni di Gemini e Claude mostrano differenze significative, in particolare per quanto riguarda i protocolli di sicurezza. Claude tende ad evitare di rispondere a richieste potenzialmente rischiose, dimostrando una maggiore rigidità nelle impostazioni di sicurezza rispetto a Gemini. Al contrario, in alcuni casi, le risposte di Gemini sono state giudicate problematiche dai contractor, incluse gravi violazioni della sicurezza per contenuti inappropriati. Ad esempio, Claude ha rifiutato di rispondere a un prompt considerato insicuro, mentre Gemini ha fornito una risposta che includeva riferimenti a tematiche sensibili e inadatte.
Queste valutazioni evidenziano anche le difficoltà operative affrontate dai contractor, i quali si trovano spesso a dover analizzare risposte di Gemini in ambiti al di fuori delle loro competenze, come l’assistenza sanitaria. Questa pratica ha suscitato preoccupazioni interne, poiché le imprecisioni generate dall’AI su temi delicati potrebbero avere conseguenze significative.
Dal punto di vista legale, i termini di servizio commerciali di Anthropic proibiscono espressamente l’accesso a Claude per sviluppare o migliorare modelli concorrenti senza esplicita approvazione. Google, tramite la sua portavoce Shira McNamara, ha dichiarato che DeepMind, la divisione responsabile dello sviluppo di Gemini, non utilizza modelli di Anthropic per l’addestramento, pur ammettendo che confronti con output di modelli concorrenti sono una prassi consolidata nel settore.
Con le pratiche di sviluppo di AI sempre più sotto i riflettori, le metodologie adottate dalle aziende leader, come Google, vengono esaminate attentamente. Il modo in cui i giganti tecnologici conducono test comparativi e rispettano gli accordi contrattuali rappresenta un nodo cruciale per garantire trasparenza e correttezza nel settore.
In un panorama in continua evoluzione, il rigore metodologico e il rispetto degli standard etici e contrattuali sono fondamentali per lo sviluppo responsabile dell’AI.
