Vés al contingut principal
Universitat Autònoma de Barcelona

Un nou conjunt de dades permet a la UAB i el CVC estudiar l’estètica visual amb menys interferència interpretativa

15 juny 2026
Compartir a Bluesky Compartir a LinkedIn Compartir per WhatsApp Compartir per e-mail

Investigadors de la UAB i el CVC han presentat Minimum Semantic Content (MSC), un recurs obert per analitzar com les propietats visuals de baix nivell influeixen en la percepció de la bellesa. Publicat a Scientific Data, el treball presenta una base de dades més controlada per analitzar la relació entre característiques visuals i preferències estètiques amb menys interferències interpretatives.

Fulles

Per què algunes imatges ens semblen belles i d’altres no? La recerca en estètica empírica fa anys que intenta respondre a aquesta pregunta analitzant grans bases de dades d’imatges i comparant-ne les propietats visuals amb les valoracions dels observadors. Tanmateix, la majoria dels conjunts de dades utilitzats fins ara combinen dos nivells d’informació difícils de separar: les característiques visuals de baix nivell i el contingut semàntic d’alt nivell.

Les característiques de baix nivell inclouen propietats purament perceptives com el contrast, la lluminositat, la saturació, la textura, la simetria o la configuració espacial. En canvi, el contingut semàntic fa referència a la interpretació de l’escena, com ara la presència de persones, objectes, accions o significats culturals. Aquesta combinació dona lloc al que es coneix com a semantic gap, la discrepància entre la informació visual que conté una imatge i el significat que hi atribueixen els observadors humans. Aquest fenomen pot introduir biaixos en la predicció de la preferència estètica, ja que les valoracions sovint depenen més del significat que de les propietats visuals en si mateixes.

El nou conjunt de dades Minimum Semantic Content (MSC) s’ha desenvolupat precisament per reduir aquest problema i permetre un estudi més acotat de l’estètica visual. Ha estat creat per investigadors del Departament de Ciències de la Computació de la Universitat Autònoma de Barcelona, el Centre de Visió per Computador (CVC) i la Universitat de Saint Andrews, i inclou 10.426 imatges d’escenes naturals amb contingut semàntic reduït i homogeni. Cada imatge ha rebut 100 valoracions estètiques individuals d’observadors no experts, provinents d’un conjunt aproximat de 10.000 participants seleccionats mitjançant proveïment participatiu. El treball s’ha publicat en obert com a data descriptor a la revista Scientific Data.

L’objectiu del conjunt és permetre separar amb més precisió la contribució de les característiques visuals de baix nivell —més directament mesurables— de la influència del significat d’alt nivell, que tendeix a introduir-hi variabilitat subjectiva i cultural. Per aconseguir-ho, se n’han exclòs deliberadament imatges amb persones, animals, objectes fabricats, text o símbols amb càrrega semàntica, i s’ha treballat amb escenes naturals com vegetació, roques, cels o superfícies d’aigua. Segons l’equip investigador, aquest disseny permet aproximar millor l’anàlisi de la bellesa visual a les propietats perceptives, reduint la interferència de factors interpretatius. Alejandro Párraga, investigador del CVC i la UAB i autor de l’article, explica: «la majoria de les bases de dades utilitzades en estètica computacional no són neutres: contenen pistes semàntiques i significats culturals que poden influir fortament en la manera com les persones jutgen la bellesa. Amb MSC hem volgut crear un recurs que permeti aïllar millor la part perceptiva de l’experiència estètica».

El conjunt també incorpora versions beautified (estèticament millorades) i uglified (estèticament degradades) d’una part de les imatges, generades amb una eina pròpia anomenada Uglifier, que modifica propietats visuals de manera controlada sense introduir-hi nou contingut semàntic. Aquesta estratègia permet ampliar de manera sistemàtica el rang de preferències estètiques i millorar la cobertura de tot l’espectre de valoracions. «Això no elimina del tot la semàntica, però sí que la redueix i l’homogeneïtza prou per formular preguntes més precises sobre la relació entre les estadístiques de la imatge i la preferència estètica», afegeix Párraga.

Els resultats de validació mostren que aquesta redistribució té un impacte important en els models d’anàlisi. Així ho explica Oliver Penacchio, també investigador de la UAB i el CVC i autor de l’article: en comparar MSC amb bases de dades tradicionals, es modifiquen els resultats en el 84 % de les mètriques d’imatge analitzades, i en aproximadament un 20 % dels casos s’inverteix la relació observada entre les característiques visuals i la preferència estètica. Aquest fet suggereix que part del coneixement previ en estètica computacional podria estar condicionat per biaixos en la selecció i la distribució de les dades.

En conjunt, MSC proporciona una nova base per estudiar la percepció estètica amb un control més estricte del contingut semàntic. En reduir i homogeneïtzar els elements interpretatius de les imatges, el recurs permet analitzar amb més precisió el paper de les propietats visuals en la formació de les preferències estètiques. Això el converteix en una eina útil per aprofundir en l’estudi dels mecanismes perceptius que intervenen en la percepció de la bellesa visual.

La base de dades s’ha publicat en accés obert a través de l’Open Science Framework i inclou les imatges, les anotacions de valoració estètica i el programari de validació. Les imatges són de domini públic o estan sota llicències que en permeten la reutilització i la distribució, amb la qual cosa se’n facilita l’adopció per part de la comunitat científica.

Referències

Penacchio, O., Javed, A., Raducanu, B. et al. (2026). The Minimum Semantic Content (MSC) Dataset: A Large, Balanced Resource for Computational Aesthetics Research. Scientific Data 13, 470. https://doi.org/10.1038/s41597-026-06816-0 

Dins de