ChatGPT, Claude o il motore Stockfish integrato: scegli il tuo avversario e gioca in pochi secondi. Poi lascia che il motore analizzi ogni partita mossa per mossa: precisione, errori gravi e punti di svolta.
di Max Health Inc.
97 giocatori si sono già uniti alla lobby multigiocatore
«Provalo» apre AIHR, la cartella sanitaria di Max Health per cui questo progetto è un campo di prova.
Aggiungilo a ChatGPT con un clic, oppure inserisci il connettore qui sotto in un altro assistente.
Gli scacchi sono da tempo un punto di riferimento per l'intelligenza artificiale. Motori dedicati come Stockfish e AlphaZero giocano a livelli sovrumani grazie ad alberi di ricerca, funzioni di valutazione e apprendimento per rinforzo. Dimostrano che le macchine possono padroneggiare decisioni complesse quando i confini sono ben definiti.
La sanità condivide la stessa aspirazione: usare l'IA per prendere decisioni migliori, più velocemente. Addestrare i sistemi a riconoscere schemi, valutare le opzioni e raccomandare l'azione che porta a un esito migliore.
Per questo il progetto mette entrambi i tipi di IA sulla stessa scacchiera. Puoi giocare contro il motore Stockfish incluso, esatto e calcolatore e affidabile, oppure contro un grande modello linguistico come ChatGPT o Claude, che approssima il ragionamento riconoscendo schemi nei suoi dati di addestramento invece di calcolare varianti. Teniamo il modello nelle regole offrendogli solo mosse valide e verificando la sua scelta lato server. Ciononostante sbaglierà valutazioni, non vedrà tattiche e proporrà con sicurezza piani perdenti.
Sono esattamente gli stessi errori che vediamo quando i modelli linguistici vengono applicati alla sanità: raccomandazioni troppo sicure, contesto mancato e punti ciechi nei casi limite. Qui la differenza è che lo stesso motore valuta ogni mossa, così ogni errore è visibile subito invece di essere scoperto troppo tardi.
Questo ne fa un terreno di prova dal vivo per la domanda che la sanità affronta davvero: dove fallisce l'IA generica e come la misuriamo rispetto alla verità? Il motore è la verità di riferimento; il modello linguistico è il sistema in esame. È esattamente il tipo di valutazione che serve per costruire un'IA a cui affidare molto più di una partita a scacchi.