Onderzoek heeft aangetoond dat de reconstructiescores van natuurlijke taal auto-encoders (NLA) de trouw van afzonderlijke beweringen niet kunnen verifiëren...
论文研究HuggingFace Daily Papers(社区热门论文)
Dagelijkse AI-briefing
Onderzoek heeft aangetoond dat de reconstructiescores van natuurlijke taal auto-encoders (NLA) de
trouw van afzonderlijke beweringen niet kunnen verifiëren; het model kan afhankelijk zijn van 'privécodes' in plaats van echte bewijzen. De auteurs stellen de RECAP-methode voor, waarbij gezamenlijk een lineaire kop wordt getraind op het doelmodel om ervoor te zorgen dat de opgegeven inhoud decodeerbaar blijft. Op Pythia-160M kunnen onafhankelijke probes betrouwbaar echte en valse beweringen onderscheiden (AUC 0,96) en kunnen ze ook bij tegenbewerkingen leugens markeren (AUC 0,95).
Fragment uit het originele artikel
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
Onderzoek heeft aangetoond dat de reconstructiescores van natuurlijke taal auto-encoders (NLA) de trouw van afzonderlijke beweringen niet kunnen verifiëren...