Multimídia e Dados Visuais/Musicais
08:00 - 08:15
I Speak Kanoê: Engineering a Dataset for an Endangered Isolated Language
08:15 - 08:30
BOSSA: Um Dataset Multimodal de Popularidade Musical Regional no Spotify Brasileiro
08:30 - 08:45
Cerrado Butterfly Dataset (CBD): An Image Dataset for Butterfly Identification in the Brazilian Cerrado
Informação, Notícias e Avaliações na Web
08:45 - 09:00
FakenewsBR: A Unified Portuguese Misinformation Corpus for Reproducible Data Integration Research
09:00 - 09:15
NewsFraud-SC: A Dataset of News about Corruption Extracted from SC Multiple Portals
09:15 - 09:30
Internet of Reviews: um dataset de características e avaliações de objetos inteligentes no mercado brasileiro
Dados Sociais, Comportamento e Interação na Web
09:30 - 09:45
BrStudentMH: A Reddit Dataset for Mental Health Analysis in the Brazilian University Context
09:45 - 10:30
===================== Margem para atrasos + Coffee break =====================
10:30 - 10:45
PlayReviewsPT: Um Dataset de 97 Milhões de Avaliações do Google Play em Português Brasileiro
Datasets e benchmarks para IA e bancos de dados
10:45 - 11:00
JABUTI-SQL: Um Benchmark em Português para Avaliação de Abordagens Text-to-SQL em Cenários Reais
11:00 - 11:15
C19EpidemiologyGraphs: A Spatial Graph Database With Global COVID-19 Epidemiological Vertex Features
11:15 - 11:30
DataCNPJ: Um Conjunto de Dados Público para Avaliação de Text-to-SQL e Schema-Linking em Inglês e em Português
Dados Públicos, Aplicações e Recomendação
11:30 - 11:45
DespesasGovPB: um conjunto de dados estruturado sobre despesas públicas do Governo da Paraíba
11:45 - 12:00
Um Dataset Sintético Multi-Cenário para Avaliação de Fairness em Sistemas de Recomendação de Recrutamento
12:00 - 12:30
Roda de conversa com as pessoas autoras