AI Memory permette a YAWBDB di conservare il contesto utile di un server, così le risposte dell'AI diventano più coerenti nel tempo.
Due cose scrivono nella memoria: tu, dal pannello, e il bot, che annota ciò che impara dalle conversazioni su Discord. Il sistema di memoria si gestisce dal pannello e nulla al suo interno viene mai rimosso automaticamente.

🧠 A cosa serve la memoria
La memoria può aiutare l'AI a ricordare informazioni come:
- Il lore del server
- Fatti sulla community
- Il tono preferito
- Battute ricorrenti
- Contesto su utenti o ruoli
- Terminologia specifica del server
- Regole o promemoria importanti
L'obiettivo è far sembrare le risposte dell'AI più consapevoli del server.
📒 Pagina Memoria
La pagina Memoria offre agli utenti autorizzati una vista completa delle voci di memoria salvate.
Da questa pagina puoi:
- Vedere le memorie per server
- Cercare per chiave o contenuto
- Aggiungere nuove memorie manualmente
- Modificare le memorie esistenti
- Eliminare le memorie obsolete
- Controllare i valori di confidenza
🔎 Filtri e paginazione
La memoria può essere filtrata per server e cercata all'istante.
Gli insiemi di memoria molto grandi sono paginati, così la pagina resta utilizzabile.
✍️ Voci di memoria manuali
Puoi aggiungere voci di memoria manualmente quando vuoi che l'AI sappia qualcosa di specifico.
Esempi:
server_theme: This server is about retro gaming.bot_tone: Replies should be friendly and concise.important_rule: Do not give support in public channels; direct users to tickets.
Usa voci brevi e chiare. Evita di riversare paragrafi enormi se non è necessario.
✏️ Modificare la memoria
Puoi modificare:
- Chiave
- Contenuto
- Confidenza
Modifica una memoria quando è ancora utile ma va corretta.
Eliminala quando è obsoleta o non più rilevante.
♻️ Nulla viene dimenticato alle tue spalle
Le voci non vengono mai rimosse automaticamente. Non c'è scadenza e non c'è nessun processo di pulizia: un fatto resta finché il bot stesso decide che non vale più, oppure finché qualcuno lo rimuove da questa pagina.
Ciò che controlli tu è quanta parte di memoria arriva all'AI. Numero massimo di voci di memoria inserite, nella pagina delle impostazioni di Risposte AI, stabilisce quanti fatti vengono inviati come contesto - da 1 a 1000, 20 per impostazione predefinita. Alzarlo dà all'AI più materiale con cui lavorare; abbassarlo rende le risposte più mirate. In entrambi i casi non viene eliminato nulla, quindi puoi alzarlo e abbassarlo liberamente.
L'età non è un motivo per dimenticare. Questo server parla francese è ancora vero dopo due anni, e nessuno lo ripeterà.
Come decide il bot
Ogni fatto inviato al modello porta il proprio numero, mostrato come [#12] nel contesto che il modello riceve. Quando il bot conclude che qualcosa non vale più - una regola cambiata, una preferenza ribaltata - risponde con quel numero e la voce smette di essere usata. Se venga eliminata o conservata per essere letta dipende dal tipo di memoria, qui sotto.
Può rimuovere solo un fatto che gli è stato effettivamente mostrato in quello scambio. Se cita un numero che non aveva davanti, non succede nulla: un numero indovinato non può raggiungere un fatto di un'altra conversazione, nemmeno uno reale dello stesso server.
Per questo Numero massimo di voci di memoria inserite conta due volte. Un fatto che non arriva mai al modello non può mai essere riesaminato da lui - resta finché qualcuno non lo rimuove da questa pagina. Con l'archivio consultabile questo non è più un vicolo cieco: un fatto che il bot cerca è anche un fatto che può correggere.
🧭 Scegliere un tipo di memoria
Il Tipo di memoria è una scelta per server, fatta in questa pagina Memoria - non nella pagina delle impostazioni di Risposte AI. Decide come il bot conserva ciò che sa e come lo recupera, e viene salvato nel momento in cui clicchi. Non è un menu a tendina: cliccalo e i sei tipi si aprono sopra la pagina, affiancati, ciascuno con ciò che fa, ciò che cambia, ciò che si sposterebbe passando a quel tipo e dove approfondire.
In cima alla pagina i sei tipi sono disegnati come un'unica scala, con la posizione del tuo server segnata, ancora prima di aprire il selettore.
La pagina delle impostazioni di Risposte AI contiene ancora le impostazioni che accompagnano il tipo attivo - i pesi della classificazione (recenza, importanza, rilevanza), quanti fatti vengono inseriti, e i modelli usati per il processo di consolidamento in background e per gli embedding semantici. Questa pagina ti dice esattamente dove si trova ciascuna di queste impostazioni, così non devi cercarle.
Classic è ciò che funziona oggi ed è il tipo predefinito. Un server che non apre mai questo campo continua a comportarsi esattamente come ha sempre fatto: un elenco semplice di fatti, con i più recentemente aggiornati inseriti in ogni risposta e nulla rimosso da solo.
Gli altri cinque aggiungono ciascuno una cosa in più rispetto al precedente, e vengono costruiti in ordine:
- Diario - disponibile ora. Un fatto che smette di essere vero viene ritirato invece di essere cancellato, così puoi ancora leggere cosa diceva. Vedi la sezione successiva.
- Archivio consultabile - disponibile ora. Il bot può cercare qualcosa invece di usare solo i fatti che gli sono stati consegnati, così ciò che sta oltre il tuo limite di inserimento smette di essere invisibile. Vedi la sezione dopo la prossima.
- Memoria classificata - disponibile ora. I posti vanno ai fatti più utili, non semplicemente ai più recenti.
- Memoria consolidata - disponibile ora. Un processo in background riunisce i duplicati e riscrive il riepilogo mentre il server è tranquillo, e propone ognuna di queste modifiche perché tu la approvi.
- Memoria semantica - corrispondenza per significato invece che per parole, così "parla francese" trova "la lingua del server è il francese". Il più potente dei sei, e l'unico con un costo associato.
L'unico tipo non ancora pronto è segnalato nella finestra e non può essere selezionato. Qualunque sia il tipo, valgono sempre le stesse due regole: tutti leggono la stessa memoria e nessuno elimina nulla da solo - quindi cambiare idea, e tornare indietro, non ti costa mai un fatto.
Con un solo server selezionato, la pagina Memoria ti dice cosa sposterebbe davvero un cambio, in numeri, prima che tu lo faccia.
📓 Diario - nulla viene cancellato, solo ritirato
Con il Diario, il bot non elimina più un fatto che decide essere obsoleto. Il periodo di validità del fatto semplicemente finisce: esce dal contesto fornito all'AI e resta in questa pagina con la data in cui si è fermato e, quando c'è, il fatto che lo ha sostituito.
Il bot ottiene anche la mossa che ne consegue. Invece di poter solo scartare [#12], può dire "questo non è più vero, ecco cosa lo sostituisce" - e gli viene detto, in modo esplicito, che la vecchia formulazione sopravvive. Una correzione che crede distruttiva è una correzione che esita a fare.
Leggere la cronologia
Quando qualcosa è stato ritirato, sopra la tabella compaiono tre schede:
- In vigore - ciò che il bot può effettivamente vedere. È la scheda predefinita ed è la vera risposta della pagina alla domanda "cosa sa il bot?".
- Ritirati - ciò che prima era vero. Barrati, con la data, il motivo se il bot l'ha indicato e il fatto sostitutivo.
- Tutti - entrambi, in un unico elenco.
Annullare una decisione sbagliata
A volte il bot sbaglia. Ripristina, su una riga ritirata, la riapre con un clic - è esattamente il motivo per cui la riga è stata conservata invece di essere eliminata. Il fatto sostitutivo, se c'era, viene lasciato volutamente com'è: due fatti possono essere veri contemporaneamente, e quale dei due debba andare è una tua scelta, non del pannello.
Elimina elimina comunque, su una riga ritirata come su qualsiasi altra. Una persona che rimuove un fatto da questa pagina ha deciso; nulla mette in discussione la sua scelta.
Passare al Diario e tornare indietro
Attivare il Diario non sposta nulla. Ogni fatto che hai già conta come ancora vero - cosa che già era - e mantiene la sua data di creazione.
Tornando a Classic, ciò che nel frattempo è stato ritirato resta esattamente dov'è: ancora in questa pagina, ancora non visto dal bot. Se vuoi riportare tutto davanti all'AI, la pagina Memoria offre Ripristina tutti i dati ritirati per quel solo server, e lo registra nel tuo registro di audit. Non viene mai fatto al posto tuo: ciò che il diario ha ritirato, l'ha ritirato per un motivo.
🔎 Archivio consultabile - il bot può cercare le cose
La memoria Classic ha un limite reale, e non è il numero di fatti che puoi salvare. È che tutto ciò che sta oltre Numero massimo di voci di memoria inserite è invisibile all'AI, per quanto sia vero. Alzare il limite è l'unica leva, e rende più costoso ogni singolo messaggio.
L'Archivio consultabile dà al bot l'altra leva. I fatti recenti gli vengono consegnati come al solito e, in più, può chiederne uno per nome - "cerca nella memoria: il compleanno di Paolo". Ciò che trova gli viene dato prima che risponda.
Quanto costa
Niente sui messaggi in cui il bot non cerca nulla, cioè la maggior parte. Quando cerca qualcosa, costa esattamente una chiamata in più all'AI - la domanda viene posta di nuovo con i fatti in mano. Mai due: un bot che nella seconda risposta chiede di cercare ancora viene ignorato.
La ricerca in sé è a testo integrale, eseguita dal database. Niente embedding, niente vettori, niente calcoli per messaggio e nessun servizio di terze parti coinvolto.
Cosa può raggiungere
Ogni fatto di quel server ancora in uso, in entrambi gli ambiti - i fatti sul server e i fatti sui suoi membri. È voluto: "il compleanno di Paolo" è un fatto su qualcuno che non è chi sta parlando, e una ricerca che potesse raggiungere solo i fatti di chi parla perderebbe la maggior parte delle domande che valgono la pena.
Ciò che non può raggiungere: qualsiasi cosa ritirata in un diario - chiudere la finestra di un fatto è proprio la decisione di non restituirlo - e qualsiasi cosa in un canale in cui la lettura della memoria non è consentita. Una ricerca è una lettura e rispetta la stessa impostazione Canali in cui la memoria può essere LETTA.
Un fatto trovato dal bot con una ricerca è anche un fatto che può correggere, alle stesse condizioni di quelli che gli sono stati consegnati.
Prima di passare: la prova a secco
Con un solo server selezionato, la pagina Memoria ti dice cosa ti costerebbe l'archivio, con numeri presi dai tuoi dati: quanti fatti ci sono da indicizzare, quanto testo sono e quanto tempo ha richiesto di recente una vera ricerca su di essi.
Attivarlo non sposta e non riscrive nulla. L'indice viene costruito sul testo già salvato ed esiste per ogni server, che facciano ricerche o no - quindi passare e tornare indietro è istantaneo in entrambi i casi.
🏅 Memoria classificata - i posti vanno ai fatti che li meritano
La memoria Classic consegna al modello gli ultimi N fatti modificati. Detto altrimenti: una regola con cui il tuo server vive da un anno perde il suo posto a favore delle chiacchiere di ieri, perché le chiacchiere sono state toccate più di recente.
La Memoria classificata assegna un punteggio a ogni fatto candidato su tre aspetti e consegna invece i migliori N:
- Quanto è recente.
- Quanto è importante - valutato dal modello nel momento in cui scrive il fatto, che è l'unico momento in cui il motivo per cui lo conserva ha ancora davanti agli occhi.
- Quanto c'entra con ciò che si sta dicendo in questo momento.
È una classifica, non un filtro. Nulla viene messo da parte per sempre, e un fatto che non entra nel taglio su un messaggio è di nuovo candidato sul successivo.
I pesi sono tuoi
Tre impostazioni nella pagina di Risposte AI - recenza, importanza, rilevanza - decidono quanto conta ciascun criterio, per server. Un server la cui memoria è fatta soprattutto di regole permanenti vorrà che l'importanza pesi più della freschezza; un server sociale molto attivo vorrà il contrario.
Viene letta anche la confidenza già salvata con ogni fatto. Agisce come moltiplicatore, e solo al ribasso: un fatto di cui il bot era incerto non supera uno di cui era certo.
Passare non costa nulla
Non c'è nessuna migrazione e nessuna fattura. Un fatto che nessuno ha ancora valutato si piazza a metà invece che in fondo, così la classifica funziona fin dal primo messaggio su ciò che hai già, e l'importanza si compila da sola man mano che il bot riscrive i fatti.
La prova a secco dice quanti dei tuoi fatti hanno già un punteggio e mostra quali guadagnerebbero un posto e quali lo perderebbero.
🧩 Memoria consolidata - il riordino avviene mentre il server è tranquillo
Una memoria che cresce finisce per dire la stessa cosa due volte con due nomi: language da una parte, lang dall'altra. Finora l'unico modo di gestirlo era a mano.
La Memoria consolidata aggiunge un processo in background sulla memoria di un server diventato tranquillo. Non gira mai nel mezzo di una risposta e - questa è la parte importante - non applica nulla da sola.
Propone, tu decidi
Il processo scrive delle proposte. Compaiono nella pagina Memoria una per una, con il fatto da tenere accanto al fatto che sostituirebbe, e ognuna ha tre risposte:
- Unisci - accetta il suggerimento del processo.
- Unisci nel senso opposto - tieni invece l'altro fatto. Quando due fatti sono in disaccordo, sei tu a sapere quale è ancora vero.
- Tieni entrambi - rifiuta. Il processo non lo chiederà di nuovo, a meno che uno dei due fatti non venga riscritto in seguito.
Nulla cambia finché non si clicca una di queste.
Un sì non cancella mai
Un'unione è una sostituzione nel senso del diario. Il fatto che si fa da parte chiude la sua finestra indicando quello che è rimasto, compare barrato in questa pagina con la sua data e il suo motivo, e Ripristina lo riporta indietro. Un'unione si annulla esattamente come qualsiasi altro ritiro.
Le contraddizioni non vengono mai unite. Due fatti che dicono cose opposte vengono segnalati perché una persona li risolva. Nulla nel processo sa quale dei due sia ancora vero.
Il riepilogo viene riscritto
Il riepilogo è l'unica riga di memoria che il bot legge per intero, ogni volta - quindi è anche la riga che invecchia per prima. È stata scritta una volta, con ciò che si sapeva allora.
Il processo prepara una bozza di ciò che direbbe oggi a partire dai fatti validi per tutto il server, e la pagina mette le due versioni affiancate: quello che il bot legge oggi e quello che leggerebbe invece. Stessa regola di un'unione - nulla lo sostituisce senza un sì, e la formulazione precedente viene ritirata invece che eliminata.
Il suo modello
Questo processo non è in gara con una risposta su Discord, quindi può girare su un modello più potente, o più economico, diverso da quello che risponde nel canale - con il proprio endpoint e la propria chiave, come ogni campo modello nel pannello.
Funziona anche senza alcun modello. Senza, il processo trova e propone comunque ogni coppia; un'unione semplicemente conserva il fatto vincente parola per parola invece di riscrivere i due in una sola frase. Il modello scrive soltanto la formulazione suggerita e la bozza del riepilogo.
Quando gira
Con una sua pianificazione, e si rifiuta da solo ogni volta che un passaggio non varrebbe la pena: una memoria troppo piccola per contenere duplicati, nulla di cambiato dall'ultimo passaggio, meno di un giorno dall'ultimo, o una proposta già in attesa di risposta. Un server che non è mai tranquillo ottiene comunque il suo passaggio dopo una settimana, perché è esattamente il server la cui memoria si riempie di duplicati.
Prima di passare: la prova a secco
La scheda ti dice, sui tuoi dati, quanti fatti sono salvati, quanti duplicati e quante contraddizioni un passaggio troverebbe, con cinque esempi reali presi dal tuo server.
Attivarla non sposta nulla. Il primo passaggio propone; decidi tu.
🧠 Memoria semantica - il significato invece delle parole
Ogni tipo precedente a questo risponde, in fondo, alla stessa domanda: questi due testi condividono delle parole? Per "parla francese" e "la lingua del server è il francese" la risposta è no - una parola in comune, e non è quella utile.
La Memoria semantica trasforma ogni fatto in un embedding: una direzione invece di una stringa. Due fatti che significano la stessa cosa puntano nella stessa direzione, con qualunque parola siano stati scritti, e la vicinanza tra loro è un numero che il pannello può confrontare.
Cosa cambia davvero
Due cose, e la seconda è quella che senti ogni giorno.
La ricerca smette di perdere cose. Quando il bot cerca un fatto che non gli è stato consegnato, smette di dipendere dal fatto che il membro abbia usato la stessa parola di chi ha annotato il fatto.
La classifica smette di dipendere dalle parole del messaggio. Con Classificata, un fatto ottiene il punteggio di rilevanza da dove è finito nei risultati della ricerca. Con Semantica il punteggio dipende da quanto è davvero vicino a ciò che si sta dicendo - la differenza tra "questo fatto è stato trovato" e "questo fatto riguarda questo".
Quanto costa
È l'unico tipo che invia i tuoi dati da qualche parte con una cadenza regolare, quindi vale la pena dichiarare chiaramente il costo:
- Una chiamata di embedding per ogni fatto scritto, una sola volta. Un fatto che non viene riformulato non viene mai incorporato due volte.
- Una chiamata per ogni messaggio abbastanza lungo da essere confrontato. Sotto i dodici caratteri non viene inviato nulla - "lol" non ha nulla con cui essere confrontato.
- Il confronto avviene nel pannello, non nel database, ed è per questo che il tipo funziona bene fino a qualche migliaio di fatti per server e non molto oltre.
Richiede un modello di embedding, indicato sullo stesso endpoint e con la stessa chiave del resto delle tue impostazioni AI.
Torna indietro da solo
Nessun modello indicato, un endpoint che rifiuta, un passaggio di recupero non ancora eseguito, o un modello di embedding appena cambiato - in tutti questi casi la ricerca torna a confrontare le parole invece di fallire. La risposta dice quale dei due è stato effettivamente usato, così un ripiego silenzioso resta visibile.
Cambiare il modello di embedding rifà gli embedding di tutto, e finché quel passaggio non è finito il server cerca per parole. Nel frattempo nulla si rompe.
Prima di passare: la prova a secco
La scheda ti dice quante chiamate farebbe il passaggio di recupero, su quanto testo, e quali dei tuoi fatti i vettori considerano già la stessa cosa.
Nessun prezzo in valuta. Metterci un importo significherebbe inventare una tariffa per l'endpoint che hai indicato, e un numero inventato in una pagina che parla di denaro è peggio di nessun numero.
🧹 Cancellare la memoria
Eliminare le voci una alla volta va bene per un singolo fatto sbagliato. Per altri due casi c'è Cancella la memoria, accanto al filtro del server una volta che ne hai scelto uno:
- Tutto ciò che riguarda questo server - quando la memoria si è allontanata tanto che ricominciare da capo conviene più di venti correzioni.
- Tutto ciò che riguarda un membro - quando qualcuno se n'è andato, o chiede di essere dimenticato. Inserisci il suo ID utente Discord.
È immediato e non si può annullare, e il bot ricomincia a imparare dalla conversazione successiva. Ogni cancellazione viene scritta nel tuo registro di audit con il nome di chi l'ha fatta e il numero di voci eliminate.
🔑 Controllo degli accessi
Le voci di memoria sono visibili a chiunque abbia accesso al team proprietario del server.
Modificarle è un diritto diverso: aggiungere, modificare, eliminare e cancellare richiedono tutti il permesso di configurare il server - lo stesso che servono le impostazioni delle funzioni. Senza, l'elenco resta comunque leggibile, e il pulsante Cancella la memoria semplicemente non c'è.
Non salvare nella memoria AI segreti sensibili, password, token privati o informazioni riservate.
🧵 Thread
La lettura e la scrittura della memoria seguono le impostazioni Canali in cui la memoria può essere LETTA e Canali in cui la memoria può essere SCRITTA, e un thread non è uno di quei canali, anche quando lo è il canale in cui è stato aperto. Per impostazione predefinita la memoria non viene né letta né scritta nei thread. L'opzione Includi i thread di Risposte AI (disattivata per impostazione predefinita) permette a un thread di seguire il canale in cui è stato creato; vedi Risposte AI. Tienila disattivata se un thread può essere aperto a persone che non dovrebbero vedere ciò che la memoria contiene.
✨ Memoria e qualità delle risposte
Più memoria non è sempre meglio.
Troppi fatti irrilevanti possono rendere l'AI meno concentrata.
Una buona memoria dovrebbe essere:
- Breve
- Accurata
- Pertinente
- Aggiornata
- Facile da capire
💡 Buone pratiche
- Rivedi la memoria dopo i grandi cambiamenti nel server.
- Elimina i fatti obsoleti.
- Cancella le voci di un membro quando chiede di essere dimenticato, invece di cercare le sue righe una per una.
- Mantieni le regole importanti chiare ed esplicite.
- Non salvare dati privati degli utenti a meno che tu non abbia un buon motivo e il permesso.
- Usa la memoria per migliorare il contesto, non per sostituire la moderazione o il giudizio dello staff.