The Variational Fair Autoencoder

Christos Louizos, Kevin Swersky, Yujia Li, Max Welling, Richard Zemel

2015-11-03Sentiment Analysis General Classification

Abstract

We investigate the problem of learning representations that are invariant to certain nuisance or sensitive factors of variation in the data while retaining as much of the remaining information as possible. Our model is based on a variational autoencoding architecture with priors that encourage independence between sensitive and latent factors of variation. Any subsequent processing, such as classification, can then be performed on this purged latent representation. To remove any remaining dependencies we incorporate an additional penalty term based on the "Maximum Mean Discrepancy" (MMD) measure. We discuss how these architectures can be efficiently trained on data and show in experiments that this method is more effective than previous work in removing unwanted sources of variation while maintaining informative latent representations.

Results

Task	Dataset	Metric	Value	Model
Sentiment Analysis	Multi-Domain Sentiment Dataset	Average	78.36	VFAE
Sentiment Analysis	Multi-Domain Sentiment Dataset	Books	73.4	VFAE
Sentiment Analysis	Multi-Domain Sentiment Dataset	DVD	76.57	VFAE
Sentiment Analysis	Multi-Domain Sentiment Dataset	Electronics	80.53	VFAE
Sentiment Analysis	Multi-Domain Sentiment Dataset	Kitchen	82.93	VFAE

Related Papers

AdaptiSent: Context-Aware Adaptive Attention for Multimodal Aspect-Based Sentiment Analysis2025-07-17 AI Wizards at CheckThat! 2025: Enhancing Transformer-Based Embeddings with Sentiment for Subjectivity Detection in News Articles2025-07-15 DCR: Quantifying Data Contamination in LLMs Evaluation2025-07-15 SentiDrop: A Multi Modal Machine Learning model for Predicting Dropout in Distance Learning2025-07-14 GNN-CNN: An Efficient Hybrid Model of Convolutional and Graph Neural Networks for Text Representation2025-07-10 FINN-GL: Generalized Mixed-Precision Extensions for FPGA-Accelerated LSTMs2025-06-25 Unpacking Generative AI in Education: Computational Modeling of Teacher and Student Perspectives in Social Media Discourse2025-06-19 Characterizing Linguistic Shifts in Croatian News via Diachronic Word Embeddings2025-06-16