120 milioni di voci in una fonte di conoscenza affidabile per le intelligenze artificiali di tutto il mondo. È l’obiettivo del Wikidata Embedding Project, la nuova iniziativa lanciata da Wikimedia Deutschland per permettere ai sistemi AI di dialogare con l’enciclopedia libera in modo più intelligente, attraverso una ricerca semantica basata su vettori.
Il progetto, sviluppato in collaborazione con Jina.AI e DataStax, va oltre la semplice ricerca per parola chiave. Grazie a un nuovo sistema, i modelli AI potranno comprendere il significato e le relazioni tra i concetti, ponendo domande in linguaggio naturale. Questo permetterà agli sviluppatori di usare i dati verificati di Wikipedia per migliorare l’accuratezza e l’affidabilità delle loro AI, tramite architetture di retrieval-augmented generation (RAG).
L’iniziativa assume anche un valore strategico. Come sottolineato dai responsabili del progetto, dimostra che “un’intelligenza artificiale potente non deve essere controllata da una manciata di aziende, ma può essere aperta, collaborativa e al servizio di tutti”.
L’annuncio arriva in un contesto di grande fermento, quasi in contemporanea con la proposta di Grokipedia da parte di Elon Musk, presentata come un’alternativa all’enciclopedia che Musk ha più volte definito “di parte” . A differenza del progetto strutturato di Wikimedia, però, quello di xAI manca al momento di dettagli tecnici e sconta i controversi precedenti del modello AI Grok, che in passato ha mostrato comportamenti imprevedibili.
Fonti: Techcrunch/ Wired