Thiago Alexandre Salgueiro Pardo.
Livre · Departamento de Ciências de Computação
- Departamento
- Departamento de Ciências de Computação
Currículo atualizado em 10/12/2025
Cita-se como: PARDO, Thiago Alexandre Salgueiro;PARDO, THIAGO A.S.;SALGUEIRO PARDO, THIAGO;SALGUEIRO PARDO, THIAGO ALEXANDRE;PARDO, THIAGO A. S.;PARDO, THIAGO
Resumo biográfico
Obteve os títulos de doutor e livre docente em Ciências da Computação e Matemática Computacional no ICMC, na USP, onde também realizou seu pós-doutorado. Na UFSCar, obteve seus títulos de mestre e graduado em Ciências da Computação. Atualmente é professor titular no ICMC-USP, onde atua desde 2006. Suas atividades de pesquisa concentram-se na área de Processamento de Linguagem Natural (PLN), ramo da Inteligência Artificial, abordando tópicos de análise de sentimentos, detecção de notícias falsas, sumarização automática, modelagem linguístico-computacional de níveis sintático, semântico e discursivo e métodos de análise textual automática. Em especial, tem trabalhado para aprimorar o processamento computacional da língua portuguesa, buscando avançar a fronteira do conhecimento e levar a área ao estado da arte. É coordenador do NILC (Núcleo Interinstitucional de Linguística Computacional), que é o maior e mais antigo grupo de PLN no Brasil, e membro fundador da Comissão Especial de PLN da Sociedade Brasileira de Computação. Tem apreço especial pelo ensino e pelo compartilhamento de conhecimento.
Indicadores
Áreas de atuação
03 registros- Ciencias Exatas E Da TerraCiência da ComputaçãoProcessamento de Línguas Naturais
- Ciencias Exatas E Da TerraCiência da ComputaçãoLingüística Computacional
- Ciencias Exatas E Da TerraCiência da Computação
Formação acadêmica
05 registros- 2005 – 2006Pós-DoutoradoConcluídoPós-Doutorado · Universidade de São PauloBolsa Conselho Nacional de Desenvolvimento Científico e Tecnológico
- 2002 – 2005DoutoradoConcluídoCiências da Computação e Matemática Computacional · Universidade de São Paulo“Métodos para Análise Discursiva Automática”Orientação: Maria das Graças Volpe NunesBolsa Fundação de Amparo à Pesquisa do Estado de São Paulo
- 2000 – 2002MestradoConcluídoCiência da Computação · Universidade Federal de São Carlos“DMSumm: Um Gerador Automático de Sumários”Orientação: Lucia Helena Machado RinoBolsa Fundação de Amparo à Pesquisa do Estado de São Paulo
- 1996 – 1999GraduaçãoConcluídoBacharelado Em Ciência da Computação · Universidade Federal de São CarlosOrientação: Lucia Helena Machado RinoBolsa Fundação de Amparo à Pesquisa do Estado de São Paulo
- Livre-docênciaConcluídoLivre-docência · Universidade de São Paulo
Idiomas
02 registros| Idioma | Leitura | Fala | Escrita | Compreensão |
|---|---|---|---|---|
| Inglês | Bem | Bem | Bem | Bem |
| Espanhol | Razoável | Pouco | Pouco | Razoável |
Atuação profissional
06 registros- 2025 – presenteVínculo atualDedicação exclusivaUniversidade de São PauloProfessor TitularServidor Publico40h/sem
- 2015 – 2025Dedicação exclusivaUniversidade de São PauloProfessor associadoServidor Publico40h/sem
- 2011 – presenteVínculo atualAdvances in Artificial IntelligenceMembro de corpo editorial
- 2006 – 2015Dedicação exclusivaUniversidade de São PauloProfessor doutorServidor Publico40h/sem
- 2003 – 2004University of Southern CaliforniaBolsista
- 1997 – 2002Universidade Federal de São CarlosColaborador
Produção bibliográfica
386 registros- 2025Multilingual Extractive Summarization: Investigating State-of-the-Art Methods for English and Brazilian PortugueseGermano Antonio Zani Jorge; Davi Alves Bezerra; Clarissa Castellã Xavier; Thiago Alexandre Salgueiro Pardo · 34th Brazilian Conference on Intelligent Systems (BRACIS 2024) · Springer · Belém
- 2025Socially Responsible and Explainable Automated Fact-Checking and Hate Speech DetectionVARGAS, FRANCIELLE; Thiago Alexandre Salgueiro Pardo; BENEVENUTO, FABRÍCIO · XXXVIII Concurso de Teses e Dissertações (CTD) do Congresso da Sociedade Brasileira de Computação · Maceió
- 2025The revision of linguistic annotation in the Universal Dependencies framework: a look at the annotators? behaviorDURAN, MAGALI; LOPES, LUCELENE; Thiago Alexandre Salgueiro Pardo · 19th Linguistic Annotation Workshop (LAW) · Vienna
- 2025Extending the Enhanced Universal Dependencies - addressing subjects in pro-drop languagesDURAN, MAGALI SANCHES; Elvis de Souza; Maria das Graças Volpe Nunes; Adriana Silvina Pagano; Thiago Alexandre Salgueiro Pardo · Eighth Workshop on Universal Dependencies (UDW) · Ljubljana
- 2025A sintaxe no tribunal: apresentando e explorando um corpus jurídico em português anotado sintaticamente segundo o modelo Universal DependenciesLOPES, LUCELENE; Maria das Graças Volpe Nunes; DURAN, MAGALI SANCHES; Thiago Alexandre Salgueiro Pardo · XVI Symposium in Information and Human Language Technology (STIL) · Fortaleza
- 2025Sumarização de opinião multidocumento para o português: comparando um método baseado em grafo com um LLMGustavo Sampaio Lima; Davi Fagundes Ferreira da Silva; Thiago Alexandre Salgueiro Pardo · X Scientific Initiation Workshop in Information Technology and Human Language (TILic) · Fortaleza
- 2024Towards Portparser - a highly accurate parsing system for Brazilian Portuguese following the Universal Dependencies frameworkLucelene Lopes; Thiago Alexandre Salgueiro Pardo · 16th International Conference on Computational Processing of Portuguese (PROPOR) · Santiago de Compostela
- 2024Grammar Induction for Brazilian Indigenous LanguagesDiego Pedro Gonçalves da Silva; Thiago Alexandre Salgueiro Pardo · 1st Workshop on NLP for Indigenous Languages of Lusophone Countries (ILLC-NLP) · Association for Computational Linguistics · Santiago de Compostela
- 2024HausaHate: An Expert Annotated Corpus for Hausa Hate Speech DetectionVARGAS, FRANCIELLE; GUIMARÃES, SAMUEL; MUHAMMAD, SHAMSUDDEEN HASSAN; ALVES, DIEGO; AHMAD, IBRAHIM SAID; ABDULMUMIN, IDRIS +3 autores · Proceedings of the 8th Workshop on Online Abuse and Harms (WOAH 2024) · Association for Computational Linguistics · Mexico City
- 2024Investigating Paraphrase Generation as a Data Augmentation Strategy for Low-Resource AMR-to-Text GenerationMarco A. Sobrevilla Cabezudo; Márcio Lima Inácio; Thiago Alexandre Salgueiro Pardo · 17th International Natural Language Generation Conference (INLG) · Association for Computational Linguistics · Tokyo
- 2024Improving Explainable Fact-Checking via Sentence-Level Factual ReasoningVARGAS, FRANCIELLE; Isadora Salles; Diego Alves; Ameeta Agrawal; Thiago Alexandre Salgueiro Pardo; BENEVENUTO, FABRÍCIO · Seventh Fact Extraction and VERification Workshop (FEVER) · Flórida
- 2024Anotação de córpus, um lugar privilegiado de observação linguística: o estudo das aposições do português brasileiro segundo o modelo Universal DependenciesDURAN, MAGALI; Thiago Alexandre Salgueiro Pardo · XVI Encontro de Linguística de Corpus (ELC) · Brasília
- 2024Syntactic parsing: where are we going?LOPES, LUCELENE; Thiago Alexandre Salgueiro Pardo; DURAN, MAGALI · 15th Symposium in Information and Human Language Technology (STIL) · Belém
- 2024PropBank e anotação de papéis semânticos para a língua portuguesa: O que há de novo?Claudia Freitas; Thiago Alexandre Salgueiro Pardo · 15th Symposium in Information and Human Language Technology (STIL) · Belém
- 2024Automatic Annotation of Enhanced Universal Dependencies for Brazilian PortugueseElvis de Souza; DURAN, MAGALI; Maria das Graças Volpe Nunes; Gustavo Sampaio; Giovanna Belasco; Thiago Alexandre Salgueiro Pardo · 15th Symposium in Information and Human Language Technology (STIL) · Belém
- 2024Genipapo - A Multigenre Dependency Parser for Brazilian PortugueseAriani Di Felippo; ROMAN, NORTON TREVISAN; Bryan K S Barbosa; Thiago Alexandre Salgueiro Pardo · 15th Symposium in Information and Human Language Technology (STIL) · Belém
- 2024Desambiguação de lema e atributos morfolóogicos na anotação do corpus Porttinari-baseLOPES, LUCELENE; DURAN, MAGALI; Thiago Alexandre Salgueiro Pardo · IX Jornada de Descrição do Português (JDP) · Belém
- 2024Inferências baseadas em sintaxe: a anotação de‬‭ sujeitos implícitosDURAN, MAGALI; Maria das Graças Volpe Nunes; Thiago Alexandre Salgueiro Pardo · IX Jornada de Descrição do Português (JDP) · Belém
- 2024Evaluating State-of-the-Art Extractive Summarization Methods for Brazilian PortugueseGermano Antonio Zani Jorge; Davi Alves Bezerra; Clarissa Castellã Xavier; Thiago Alexandre Salgueiro Pardo · 18th Ibero-American Conference on Artificial Intelligence (IBERAMIA) · Springer · Montevideo
- 2023SteamBR: a dataset for game reviews and evaluation of a state-of-the-art method for helpfulness predictionGermano Antonio Zani Jorge; Thiago Alexandre Salgueiro Pardo · XII Brazilian Workshop on Social Network Analysis and Mining (BraSNAM) · João Pessoa
- 2023NoHateBrazil: A Brazilian Portuguese Text Offensiveness Analysis SystemFrancielle Alves Vargas; Isabelle Carvalho; Wolfgang Schmeisser-Nieto; Fabrício Benevenuto; Thiago Alexandre Salgueiro Pardo · 14th Conference on Recent Advances in Natural Language Processing (RANLP) · Varna
- 2023Socially Responsible Hate Speech Detection: Can Classifiers Reflect Social StereotypesFrancielle Alves Vargas; Isabelle Carvalho; Ali Hurriyetoglu; Thiago Alexandre Salgueiro Pardo; Fabrício Benevenuto · 14th Conference on Recent Advances in Natural Language Processing (RANLP) · Varna
- 2023Predicting Sentence-Level Factuality of News and Bias of Media OutletsFrancielle Alves Vargas; Kokil Jaidka; Thiago Alexandre Salgueiro Pardo; Fabrício Benevenuto · 14th Conference on Recent Advances in Natural Language Processing (RANLP) · Varna
- 2023Tipologia de fenômenos ortográficos e lexicais em CGU: o caso dos tweets do mercado financeiroClarissa Lenina Scandarolli; Ariani Di Felippo; Norton T. Roman; Thiago Alexandre Salgueiro Pardo · VIII Jornada de Descrição do Português (JDP) · Belo Horizonte
- 2023Indução Gramatical para o Português: a Contribuição da Informação Mútua para Descoberta de Relações de DependênciaDiego Pedro Gonçalves da Silva; Thiago Alexandre Salgueiro Pardo · VIII Jornada de Descrição do Português (JDP) · Belo Horizonte
Produção técnica
35 registros- 2025The Universal Processing of the Portuguese LanguageThiago Alexandre Salgueiro PardoConferencia
- 2025The Universal Processing of the Portuguese LanguageThiago Alexandre Salgueiro PardoConferencia
- 2025The Universal Processing of the Portuguese LanguageThiago Alexandre Salgueiro PardoConferencia
- 2017Processamento de Linguagem Natural - Uma Visão GeralThiago Alexandre Salgueiro PardoSeminario
- 2015Análise de sentimentos e mineração de opiniões para o portuguêsThiago Alexandre Salgueiro PardoConferencia
Projetos
26 registrosProjetos de pesquisa e de desenvolvimento tecnológico registrados no Currículo Lattes.
- Em andamento2025 – presentePesquisa
INCT TILD-IAR - Inteligência Artificial Responsável para Linguística Computacional, Tratamento e Disseminação de Informação
A Inteligência Artificial (IA) tem revolucionado o modo como informação em linguagem natural é produzida, disseminada, recuperada, analisada, além de ajudar a combater desinformação e conteúdos tóxicos. Neste cenário, Linguística Computacional (LC) e Tratamento e Disseminação de Informação (TDI) têm desempenhado papéis fundamentais. LC estuda a modelagem computacional da linguagem humana, já TDI enfoca a organização, recuperação e disseminação de grandes volumes de informação, promovendo corretude, relevância, atualidade e adequação da informação. Áreas de pesquisas convergentes, impulsionadas por avanços tecnológicos como os Grandes Modelos de Linguagem, LC e TDI têm sido instrumentais para o sucesso de serviços usados cotidianamente, como redes sociais, plataformas de streaming e motores de busca, todos dependentes da IA. Todavia, reflexões recentes têm alertado para os riscos do desenvolvimento acrítico, desigual e não-sustentável da IA. Motivada por essas questões, esta proposta visa a criação do INCT em IA Responsável e Sustentável, INCT-TILD-IAR, que busca estimular pesquisas colaborativas em LC/TDI, atendendo as necessidades da sociedade brasileira e propiciando integração da capacidade de pesquisa instalada, hoje fragmentada em iniciativas isoladas que geram esforços redundantes e limitam o impacto das pesquisas. Com abrangência nacional, representatividade regional e diversidade de expertises, o INCT fomentará o desenvolvimento de algoritmos de LC/TDI, alavancando pesquisas e tecnologias brasileiras através da integração de comunidades e esforços. Princípios éticos da IA Responsável, como imparcialidade, explicabilidade e privacidade, guiarão os trabalhos, promovendo desenvolvimento equitativo e seguro. Desenvolvimento sustentável será outra prioridade, minimizando impacto ambiental e a dependência da Regra-do-Mais: mais hardware, energia, etc. Formação de recursos humanos, transferência tecnológica e divulgação científica são também pilares do Instituto.
EquipeThiago Alexandre Salgueiro Pardo, Marcos André Gonçalves (Responsável)
- Em andamento2024 – presentePesquisa
Identificação temporal de desinformação online por meio de aprendizado de máquina
O avanço das tecnologias de comunicação transformou o consumo de informações, com portais de notícias e mídias sociais se tornando fontes primárias para aquisição e compartilhamento de conteúdo. No entanto, essa facilidade de acesso também facilita a disseminação de desinformação, que pode causar impactos sociais, econômicos e de saúde pública. Diversas técnicas, especialmente de processamento de linguagem natural e aprendizado de máquina, têm sido desenvolvidas para identificar desinformação. Embora a maioria dos estudos foque em textos, há uma crescente exploração do uso de aprendizado de máquina multimodal, como a incorporação de imagens aos modelos, para melhorar a identificação de desinformação. Além disso, muitos estudos falham ao não considerar a natureza dinâmica da desinformação e suas mudanças ao longo do tempo, o que pode levar à degradação dos modelos empregados. Este projeto investigará a identificação de desinformação de forma multimodal e temporal, considerando-se a adaptação dos modelos a mudanças nos dados, permitindo a análise de diferentes narrativas ao longo do tempo.
Financiadores- Conselho Nacional de Desenvolvimento Científico e Tecnológico · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Renato M. Silva, Carolina Scarton, Ricardo Marcondes Marcacini, Diego Furtado Silva (Responsável), Leo Sampaio Ferraz Ribeiro, Jefersson A. dos Santos
- Em andamento2023 – presentePesquisa
Computação Heterogênea para Visão Computacional e Processamento de Linguagem Natural
Trata-se de um projeto de pesquisa no âmbito das Ciências da Computação, em subáreas inter-relacionadas de grande destaque atual e de interesse acadêmico e industrial, a saber: Processamento de Imagens e Processamento de Linguagem Natural. Com a análise, a modelagem e o tratamento computacional de dados de imagens e de língua, prevê-se o avanço da fronteira de conhecimento nessas frentes e, consequentemente, das aplicações relacionadas a essas duas modalidades complementares de dados.
Financiadores- Sociedade para Promoção da Excelência do Software Brasileiro · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Ariani Di Felippo, Fabio Gagliardi Cozman, Arnaldo Candido Junior, Solange Oliveira Rezende, Sandra Maria Aluísio, Roberto Marcondes Cesar Junior (Responsável), Miguel Oliveira Junior +6 integrantes
- Concluído2022 – 2024Pesquisa
Análise da linguagem em redes sociais para detecção precoce de transtornos de saúde mental
O projeto objetiva a investigação de modelos computacionais para detecção de sinais precoces de transtornos de depressão e ansiedade a partir de publicações em redes sociais. A investigação contempla a construção de uma base textual de grandes proporções rotulada com informações relacionadas à saúde mental de usuários Twitter em português, e o uso de métodos de aprendizado supervisionado (como redes neurais artificiais profundas, transformadores etc.) para detectar usuários com maior probabilidade de vir a desenvolver futuros transtornos deste tipo com antecipação suficiente para sinalizar estas situações antes de seu possível agravamento. Questões de pesquisa a serem investigadas incluem a detecção de transtornos de saúde mental a partir de dados textuais e a partir de características estruturais e comportamentais da rede social, e a interpretação e explicação destes modelos.
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Ivandré Paraboni (Responsável)
- Em andamento2020 – presentePesquisa
POrtuguese processing - Towards Syntactic Analysis and parsing (POeTiSA) in the Center for Artificial Intelligence (C4AI)
POeTiSA is a long term project that aims at growing syntax-based resources and developing related tools and applications for Brazilian Portuguese language, looking to achieve world state-of-the-art results in this area. On the resource side, we focus on the production of a large and comprehensive multi-genre corpus of Universal Dependencies-based part of speech and syntactically annotated texts, including mainly news texts and user-generated content (tweets and online comments). Regarding the tools, we aim to investigate recent neural and distributional-based methods for training robust parsing models for Portuguese. The project also envisions the production of applications on opinion mining and sentiment analysis tasks that may benefit from syntactic knowledge, as opinion summarization, helpfulness prediction, aspect idetification, deception detection and emotion classification. This project is part of the Natural Language Processing initiative (NLP2) of the Center for Artificial Intelligence (C4AI) of the University of São Paulo, sponsored by IBM and FAPESP (grant #2019/07665-4). The center is part of the FAPESP Engineering Research Centers Program and is committed to state-of-the-art research in Artificial Intelligence, exploring both foundational issues and applied research.
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · BOLSA
- IBM · BOLSA
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Ariani Di Felippo, Ivandré Paraboni, Oto Araújo Vale, Norton Trevisan Roman, Magali Duran, Evandro Eduardo Seron Ruiz +1 integrantes
- Concluído2018 – 2020Pesquisa
OPINANDO - Opinion Mining for Portuguese: Concept-based Approaches and Beyond
The OPINANDO project aimed at investigating issues of concept-level analysis for the Brazilian Portuguese language. We were particularly interested on three main research fronts, namely: (i) the identification of relevant texts to mine, which includes tackling text importance and filtering deceptive content; (ii) the analysis of the selected texts, performing the necessary semantic and discourse analysis and identifying subjective content and the corresponding aspects and polarities; and (iii) the synthesis of the relevant information, using text summarization and generation strategies and dealing with the related challenges in these tasks.
Financiadores- Universidade de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Oto Araújo Vale, Evandro Eduardo Seron Ruiz, Tiago Agostinho de Almeida
- Concluído2015 – 2018Pesquisa
TextLink - Structuring Discourse in Multilingual Europe
Effective discourse in any language is characterized by clear relations between sentences and coherent structure. But languages vary in how relations and structure are signalled. While monolingual dictionaries and grammars can characterise the words and sentences of a language and bilingual dictionaries can do the same between languages, there is nothing similar for discourse. For discourse, however, discourse-annotated corpora are becoming available in individual languages. The TextLink Action will facilitate European multilingualism by (1) identifying and creating a portal into such resources within Europe ?including annotation tools, search tools, and discourse-annotated corpora; (2) delineating the dimensions and properties of discourse annotation across corpora; (3) organising these properties into a sharable taxonomy; (4) encouraging the use of this taxonomy in subsequent discourse annotation and in cross-lingual search and studies of devices that relate and structure discourse; and (5) promoting use of the portal, its resources and sharable taxonomy. With partners from across Europe, TextLink will unify numerous but scattered linguistic resources on discourse structure. With its resources searchable by form and/or meaning and a source of valuable correspondences, TextLink will enhance the experience and performance of human translators, lexicographers, language technology and language learners alike.
EquipeThiago Alexandre Salgueiro Pardo, Liesbeth DEGAND (Responsável)
- Concluído2015 – 2017Pesquisa
Sumarização Automática Multidocumento para o Português: Novas Fronteiras
A Sumarização Automática Multidocumento (SAM) visa à criação de um único sumário (ou resumo, como mais comumente chamado) a partir de um conjunto de textos-fonte sobre um mesmo assunto. Com a enorme quantidade de informação disponível atualmente, principalmente on-line, a utilidade desse tipo de recurso é evidente. A SAM começou a ser investigada em meados dos anos 90 para a língua inglesa, e somente mais recentemente, a partir de meados da década passada, ela passou a ser alvo de investigações sistemáticas para a língua portuguesa. Com isso, atualmente há para o português corpora de referência para a SAM, ferramentas básicas de processamento e análise textual, e métodos de sumarização do estado da arte, que resultaram em recursos, ferramentas e aplicações amplamente disponíveis para a comunidade de pesquisa. Neste projeto, objetiva-se dar continuidade a essa linha de pesquisa. Por um lado, visa-se dar continuidade ao desenvolvimento e aprimoramento de recursos linguístico-computacionais e ferramentas de análise textual, que são essenciais para o avanço na área de SAM; por outro, visa-se investigar as novas fronteiras da sumarização, já investigadas para outras línguas e ainda inéditas para o português, em particular, a sumarização de atualização e de opiniões. Na sumarização de atualização, busca-se criar sumários que narrem somente as informações desconhecidas/novas para o leitor, levando-se em conta, portanto, o conhecimento prévio deste; na sumarização de opinião, busca-se sintetizar diversos textos opinativos sobre determinados objetos, como produtos eletrônicos, de forma a apoiar possíveis decisões e avaliações de usuários. Se, na primeira frente, a sumarização de atualização consiste em um desafio metodológico que dá continuidade ao que se tem feito na SAM para o português, na outra frente, tem-se em vista tanto a pesquisa como a aplicação para o usuário final. Acredita-se que, além da formação de recursos humanos e da criação de uma massa crítica de pesquisadores na área, tão pequena no Brasil, esse projeto tem potencial de trazer contribuições significativas para a área como um todo pela proposta de metodologias inovadoras.
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Pedro Paulo Balage Filho, Erick Galani Maziero, Paula Christina Figueira Cardoso, Fernando Antônio Asevedo Nóbrega, Márcio de Souza Dias, Roque E. López Condori, Guilherme Gonçalves +3 integrantes
- Concluído2013 – 2015Pesquisa
Processamento Semântico de Textos em Português Brasileiro
O objetivo geral do projeto de pesquisa, em parceria entre o ICMC-USP e a SAMSUNG, é avançar o estado da arte em processamento semântico de textos/documentos escritos em Português Brasileiro (PB), mais especificamente, permitir a anotação de papéis semânticos (SRL) e a desambiguação lexical de sentido (WSD) de verbos, e, com base nesses recursos e ferramentas, construir aplicações de mineração e sumarização de textos, com especial enfoque em opiniões sobre produtos encontradas na web. O projeto é coordenado pelos Profs. Thiago A. S. Pardo e Sandra M. Aluísio.
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Sandra Maria Aluísio, Magali Duran, Alessandro Y. Bokan Garay, Lucas V. Avanço, Marco A. Sobrevilla Cabezudo, Nathan S. Hartmann +3 integrantes
- Em andamento2012 – 2014Pesquisa
Informatividade e Topicalidade na Sumarização Multidocumento: Novos Desafios e Métodos
Diante da grande e crescente quantidade de informação disponível, principalmente on-line, e da escassez de tempo e das dificuldades para se lidar com todo esse conteúdo, aplicações de processamento textual têm se tornado cada vez mais relevantes. De origem relativamente recente (meados da década de 90), a sumarização automática multidocumento é uma destas aplicações. Seu objetivo é produzir automaticamente um único sumário (ou resumo, como mais comumente chamado) a partir de um grupo de textos sobre um mesmo tópico. No Brasil e para a língua portuguesa, somente nos últimos anos é que pesquisas nessa área começaram. A partir da criação de recursos e ferramental inéditos e do desenvolvimento de métodos e sistemas simples e ingênuos a abordagens mais sofisticadas, produziram-se resultados do estado da arte e, em alguns casos, melhores do que os obtidos em pesquisas internacionais e para outras línguas. Nesta proposta de pesquisa, com base na pesquisa recente na área, objetiva-se dar um passo além e investigar 3 principais questões correlacionadas que podem avançar o estado da arte, a saber: (i) como tratar conjunta e adequadamente a topicalidade nos textos e a informatividade dos sumários, (ii) como modelar e qual o impacto da combinação de métodos superficiais/estatísticos e profundos/linguísticos para a produção de sumários mais informativos e representativos da distribuição topical nos textos, e (iii) quais são as características do processo humano de sumarização que podem ser sistematizadas e formalizadas para que subsidiem as questões anteriores. Enquanto as duas primeiras questões lidam com a produção de sumários melhores, a última pode subsidiar novos métodos e dar direcionamentos diferentes para abordagens atuais. Acredita-se que, além da formação de recursos humanos e da criação de uma massa crítica de pesquisadores na área, tão pequena no Brasil, esse projeto tem potencial de trazer contribuições significativas para a área.
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Lucia Helena Macahdo Rino, Eloize Rossi Marques Seno, Ariani Di Felippo, Erick Galani Maziero, Maria Lucía Castro Jorge, Verônica Agostini +7 integrantes
- Desativado2010 – 2014Pesquisa
CLARIN - Common Language Resources and Technology Infrastructure
CLARIN is committed to establish an integrated and interoperable research infrastructure of language resources and its technology.
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Sandra Maria Aluísio, João Luís Garcia Rosa
- Concluído2009 – 2011Pesquisa
Sumarização automática multidocumento com base no modelo Cross-document Structure Theory (CST)
(FAPESP nro. 2009/05603-0) Com base na CST, investiga-se as várias tarefas relacionadas à sumarização multidocumento (ou seja, a produção de sumários/resumos a partir de um conjunto de textos), a saber: modelagem de conhecimento e análise textual, seleção de conteúdo textual para o sumário e pós-edição de sumários, dentre outras
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Lucia Helena Macahdo Rino, Eloize Rossi Marques Seno, Ariani Di Felippo, Vinícius Rodrigues de Uzêda, Priscila Aleixo, Erick Galani Maziero +10 integrantes
- Concluído2009 – 2017Pesquisa
sucinto - summarization for clever information access
The sucinto project aims at investigating and exploring generic and topic-focused multi-document summarization strategies for providing a more feasible and intelligent access to on-line information provided by news agencies. This commitment brings back old and well-known scientific challenges from the first studies in summarization in the 50s as well as introduces several new and exciting challenges, e.g., to deal with redundant, complementary and contradictory information, to normalize different writing styles and referring expression choices, to balance different perspectives and sides of the same events and facts, to properly deal with evolving events and their narration in different moments, and to arrange information pieces from different texts to produce coherent and cohesive summaries, among several others. An ultimate goal of this project is to pull the developed tools together as on-line applications for final users. This project takes into consideration not only classical approaches to single and multi-document summarization, but also new ones, following different paradigms and using knowledge of varied nature ranging from empirical and statistical data to semantic and discourse models. Research interests include (i) the modeling of the summarization process (content selection, planning, aggregation, generalization, substitution, information ordering, etc.) by means of Cross-document Structure Theory (CST), Rhetorical Structure Theory (RST), ontologies, and language and summarization statistical models, (ii) the investigation of related tasks as discourse parsing, topic detection, temporal annotation and resolution, coreference resolution, text-summary alignment, and multilingual processing, and (iii) the linguistic characterization of multi-document summaries and their manual production.
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Maria das Graças Volpe Nunes, Lucia Helena Macahdo Rino, Eloize Rossi Marques Seno, Ariani Di Felippo, Pedro Paulo Balage Filho, Erick Galani Maziero, Maria Lucía Castro Jorge +11 integrantes
- Concluído2009 – 2012Pesquisa
Sickle Cell Anemia Project
Exploração de métodos de mineração de textos biomédicos sobre a doença anemia falciforme.
EquipeThiago Alexandre Salgueiro Pardo, Pablo Freire Matos, Ricardo Rodrigues Ciferri (Responsável), Cristina Dutra de Aguiar Ciferri, Marina Teresa Pires Vieira, Juliana Lilian Duque
- Concluído2009 – 2011Pesquisa
TermiNet - Instantiation and Application of a Methodology for the Development of Terminological Wordnets in Brazilian Portuguese
(FAPESP nro. 2009/06262-1; MCT/CNPq Universal nro. 471871/2009-5) Due to the increasing necessity of processing specialized texts, domain-specific (or terminological) lexical databases have been built in many languages, especially in wordnet format. Despite the existence of a reasonable number of terminological wordnets in many languages, there is no clear and generic methodology for building them. For Brazilian Portuguese (BP), by the way, there is no domain-specific lexical database in wordnet model. Consequently, we propose: (i) to instantiate a generic NLP methodology for developing terminological wordnets, and (ii) apply it to build a terminological wordnet in BP. Such methodology distinguishes itself by conciliating the linguistic and computational facets of the NLP researches. So, besides the benefits to NLP domain, terminological wordnets may also contribute to the development of terminological/ terminographic products since the organization of lexical-conceptual knowledge is an essential step in building such products.
Financiadores- Conselho Nacional de Desenvolvimento Científico e Tecnológico · AUXILIO_FINANCEIRO
- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Ariani Di Fellipo (Responsável)
- Concluído2007 – 2010Pesquisa
PorSimples: Simplificação Textual do Português para Inclusão e Acessibilidade Digital
(FAPESP/Microsoft Research nro. 2007/54565-8) Desenvolvimento de recursos e ferramentas para simplificação de textos em português, visando ao auxílio de usuários com dificuldades de leitura e sua posterior inclusão digital
Financiadores- Microsoft Corporation · AUXILIO_FINANCEIRO
- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Maria das Graças Volpe Nunes, Sandra Maria Aluísio (Responsável), Renata Pontin de Mattos Fortes, Maria da Graça Campos Pimentel
- Concluído2006 – 2008Pesquisa
Sumarização Automática de Textos em Português: de Extratos para Abstracts
Investigação e desenvolvimento de técnicas de sumarização automática de textos em português
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Pedro Paulo Balage Filho, Vinícius Rodrigues de Uzêda, Priscila Aleixo, Daniel Kawamoto
- Concluído2006 – 2008Pesquisa
Tradução Automática, Alinhamento de Textos Bilíngües Espanhol-Português e Buscas Lingüisticamente Enriquecidas na Web e Bibliotecas Digitais
APES/MECD #116/06 Espanha: Tradução Automática, Alinhamento de Textos Bilíngües Espanhol-Português e Buscas Lingüisticamente Enriquecidas na Web e Bibliotecas Digitais. Descrição: Este projeto surge como resultado do interesse mútuo de dois grupos de pesquisadores da área de Processamento de Línguas Naturais (PLN) NILC/USP e DLSI/Universidade de Alicante, atualmente envolvidos em projetos de pesquisa afins e potencialmente aplicáveis em produtos de interesse comum e de impacto social e comercial não desprezível. É o caso de tradutores automáticos português-espanhol e de máquinas de busca para a web, enriquecidas com conhecimento lingüístico português e/ou espanhol
Financiadores- Coordenação de Aperfeiçoamento de Pessoal de Nível Superior · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Maria das Graças Volpe Nunes (Responsável), Helena Medeiros Caseli, Mikel Forcada
- Concluído2006 – 2008Pesquisa
Investigação e Desenvolvimento de Técnicas de Tradução Automática de Textos Envolvendo o Português do Brasil
O projeto visa ao desenvolvimento de tradutores automáticos com base nos modelos estatísticos recentes
Financiadores- · NAO_INFORMADO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Felipe Tassario Gomes, Wilker Ferreira Aziz
- Concluído2006 – 2008Pesquisa
Projeto PLN-Br: Recursos e Ferramentas para a Recuperação de Informação em Bases Textuais em Português do Brasil
CNPq (CTInfo) #550388/2005-2: Projeto PLN-Br: Recursos e Ferramentas para a Recuperação de Informação em Bases Textuais em Português do Brasil. Descrição: O objetivo geral deste projeto é a construção de um espaço interinstitucional de interação e intercâmbio de práticas de análise e investigação lingüístico-computacional acerca da representação e da recuperação de informação de natureza semântica e pragmático-discursiva veiculada por enunciados produzidos em português brasileiro. Este projeto conta com a participação de 7 grupos nacionais de PLN das seguintes instituições: USP/São Carlos (NILC), UFSCar, UNESP/Araraquara, PUC/RS, PUC/RJ, UNISINOS e Mackenzie/SP
Financiadores- Conselho Nacional de Desenvolvimento Científico e Tecnológico · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Maria das Graças Volpe Nunes (Responsável)
- Concluído2006 – 2010Pesquisa
FAROL - Fortalecimento e Integração das Competências do Processamento da Língua
CAPES/PROCAD #0035050: FAROL - Fortalecimento e Integração das Competências do Processamento da Língua. Descrição: O projeto proporciona uma integração intra-regional (entre PUCRS e UNISINOS e entre UFSCar e USP de São Carlos) e uma integração inter-regional (entre as regiões Sul e Sudeste), e explora as vocações institucionais na área do processamento da língua. Participam do projeto FAROL quatro equipes, sendo duas da região Sul (especificamente, do Programa de Pós-Graduação em Ciência da Computação da PUCRS, mestrado e doutorado, nota 4, e do Programa de Pós-Graduação em Computação Aplicada da UNISINOS, mestrado, nota 3), e duas da região Sudeste (a saber, do Programa de Pós-Graduação em Ciências da Computação e Matemática Computacional da USP de São Carlos, mestrado e doutorado, nota 5, e do Programa de Pós-Graduação em Ciências da Computação da UFSCar, mestrado, nota 3). Nesse sentido, nosso objetivo geral será de propiciar aos grupos envolvidos um fluxo mais efetivo de competências, que fortaleça a área do processamento da língua nos programas nota 3, e consolide esta área no programa nota 4, com o apoio do programa com nota 5. Ao mesmo tempo, as competências específicas na área do processamento da língua, as quais não são coincidentes nos quatro grupos, poderão fluir de modo a tecer-se um quadro de ligações o qual promoverá o desenvolvimento dos quatro grupos, cada um em determinados focos de pesquisa dos quais se poderá beneficiar na integração
Financiadores- Coordenação de Aperfeiçoamento de Pessoal de Nível Superior · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Maria das Graças Volpe Nunes (Responsável)
- Concluído2006 – 2008Pesquisa
ProCaCoSa: Processamento de Cadeias de Co-referência para a Sumarização Automática de Textos em Português
Proc. Nro. 507030/2004-4
Financiadores- Conselho Nacional de Desenvolvimento Científico e Tecnológico · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Lucia Helena Macahdo Rino, Renata Vieira
- Concluído2005 – 2007Pesquisa
Léxico-PB: Léxico Computacional de Português Brasileiro para Processamento de Língua Natural
CNPq (Fomento Tecnológico) #507004/2004-3: Léxico-PB: Léxico Computacional de Português Brasileiro para Processamento de Língua Natural. Descrição: O objetivo principal desse projeto é a construção de um léxico computacional de português brasileiro que maximize os seguintes critérios: (a) abrangência quanto ao número de entradas, cobrindo o português não-técnico, incluindo as variantes culta e vulgar; (b) cobertura quanto ao tipo dos atributos associados às entradas, sejam fonológicos, morfológicos, morfossintáticos e semânticos; (c) correção das informações nele contidas; (d) espectro de aplicação, ou seja, a utilidade que o léxico possa ter para aplicações diversas de PLN
Financiadores- Conselho Nacional de Desenvolvimento Científico e Tecnológico · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo, Maria das Graças Volpe Nunes (Responsável)
- Concluído1999 – 2000Desenvolvimento
TraSem - Especificação dos Traços Semânticos dos Itens Lexicais
Este projeto consistiu na investigação de possibilidade de especificação de conhecimento semântico no léxico do ReGra - REvisor GRAmatical - para melhorar seu desempenho.
Financiadores- Universidade de São Paulo · AUXILIO_FINANCEIRO
EquipeThiago Alexandre Salgueiro Pardo (Responsável), Lucia Helena Machado Rino, Maria das Graças Volpe Nunes, Ana Raquel Marchi, Gisele Montilha Pinheiro, Denise Kuhn, Ariani Di Felippo
- Concluído1997 – 2002Pesquisa
Investigação e Desenvolvimento de Técnicas de Sumarização Automática de Textos
Investigação e desenvolvimento de técnicas de sumarização automática de textos para o português do Brasil, enfocando-se abordagens superficiais e profundas.
Financiadores- Fundação de Amparo à Pesquisa do Estado de São Paulo · BOLSA
EquipeThiago Alexandre Salgueiro Pardo (Responsável)
Orientações
- Mestrado
desde 2025Pedro Lucas Castro de Andrade · OrientaçãoDiscriminação de notícias falsas geradas por humanos e por máquinas · Ciências da Computação e Matemática Computacional · Universidade de São PauloEm andamento - Doutorado
desde 2025Gustavo Sampaio Lima · OrientaçãoInvestigação de Estratégias Clássicas e Contemporâneas para Anotação de Papéis Semânticos para o Português · Ciências da Computação e Matemática Computacional · Universidade de São PauloEm andamento - Pós-doutorado
desde 2025Lucelene Lopes · Orientação· Universidade de São Paulo · Bolsa MotorolaEm andamento - Pós-doutorado
desde 2025Magali Sanches Duran · Orientação· Universidade de São Paulo · Bolsa IBMEm andamento - Doutorado
desde 2024Elvis Alves de Souza · OrientaçãoEnhanced Dependencies para o português: uma investigação sobre métodos computacionais para a anotação das dependências sintáticas enhanced do projeto Universal Dependencies · Ciências da Computação e Matemática Computacional · Universidade de São PauloEm andamento - Mestrado
desde 2023Germano Antonio Zani Jorge · OrientaçãoInvestigação de métodos de sumarização automática multigênero e multilíngue · Ciências da Computação e Matemática Computacional · Universidade de São PauloEm andamento - Mestrado
desde 2022Stephanie Briere Americo · OrientaçãoClassificação multimodelo de emoções para o português · Ciências da Computação e Matemática Computacional · Universidade de São Paulo · Bolsa Conselho Nacional de Desenvolvimento Científico e TecnológicoEm andamento
Bancas julgadoras
505 registros- 2025Mirelle Candida BuenoMLissard: Multilingual Long and Simple Sequential Reasoning Benchmarks · Ciência da Computação · Universidade Estadual de CampinasBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Matheus Matos MachadoIntegrating Semantic Web Technologies and Large Language Models: Ontologies and LLMs for Medication and Anaphylaxis Detection · Ciências da Computação e Matemática Computacional · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Caroline Barbosa de Oliveira LiraAbordagem Híbrida com foco em pessoas idosas para a detecção de fake news: Integração de Aprendizado de Máquina e Verificação Baseada em Conhecimento · Ciências da Computação e Matemática Computacional · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Anna Paula Figueiredo GonçalvesAvaliação de modelos de linguagem para criação de chatbots para a comunicação com as pessoas surdas que usam o Português como segunda língua · CIÊNCIA DA COMPUTAÇÃO · Universidade Federal de LavrasBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Rafael Rodrigues BrazDetecção de notícias falsas em domínios cruzados: uma abordagem com treinamento adversário e modelos de linguagem de grande porte · SISTEMAS DE INFORMAÇÃO · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Isadora Alves de SallesExplainable Hate Speech Detection in Brazilian Portuguese · Ciências da Computação · Universidade Federal de Minas GeraisBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Ana Margarida Dias da SilvaCausal Relation Extraction from Text using Transformers · Mestrado em Ciência de Dados · Universidade do PortoBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Juliano Leonardo SoaresRede de Atenção sobre Grafo de Conhecimento Causal (CausalKGAT) · Ciência da Computação · Universidade Estadual de CampinasBanca: Thiago Alexandre Salgueiro PardoMestrado
- 2025Osmar de Oliveira Braz JúniorAnálise e Tratamento de Incoerências em Textos Curtos · Ciências da Computação · Universidade Federal de Santa CatarinaBanca: Thiago Alexandre Salgueiro PardoDoutorado
- 2025Andressa Vieira e SilvaDetecção automática de ironia por meio de representações contextuais · Lingüística · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoDoutorado
- 2025Diego Alysson Braga MoreiraText-Guided Emergent Multimodal and Multilingual Representation · Ciência da Computação · Universidade Estadual de CampinasBanca: Thiago Alexandre Salgueiro PardoDoutorado
- 2025Lucas Rafael Costella PessuttoMultilingual Structured Sentiment Analysis via Machine Reading Comprehension · Computação · Universidade Federal do Rio Grande do SulBanca: Thiago Alexandre Salgueiro PardoDoutorado
- 2025Ricardo Saraiva GravaUm Método de Avaliação Automática para a Tarefa de Question Answering · Engenharia de Computação · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoExame de qualificação de mestrado
- 2025Ricelli Moreira Silva RamosAvaliação automatizada de escrita criativa no teste PISA · SISTEMAS DE INFORMAÇÃO · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoExame de qualificação de doutorado
- 2025José de Anchieta Araújo MarquesBeyond Transformers: Evaluating FCNN, LSTM, and Legal-BERTimbau for Judicial Decision Prediction in Labor Courts · Ciência da Computação · Universidade Estadual de CampinasBanca: Thiago Alexandre Salgueiro PardoExame de qualificação de doutorado
- 2025Luiza Gandolfi BariotoAutomated Machine Learning for the Discovery of Latent Knowledge in Medicine using Textual Data · Ciência da Computação · Universidade Federal de São CarlosBanca: Thiago Alexandre Salgueiro PardoExame de qualificação de mestrado
- 2025Magaly Lika FujimotoAnálise de Sentimentos Aplicada à Sumarização Multimodal para o Português Brasileiro · Ciências da Computação e Matemática Computacional · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoExame de qualificação de doutorado
- 2025William Jones BeckhauserEchoRAG: A Framework for Enhancing Language Models with Graph-RAG and In-Context Learning · Ciências da Computação · Universidade Federal de Santa CatarinaBanca: Thiago Alexandre Salgueiro PardoExame de qualificação de doutorado
- 2025Pedro Calciolari JardimEstágio em Desenvolvimento Web · Bacharelado em Ciências de Computação · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoGraduação
- 2025Kenzo Yves Yamashita NobreEstágio: Desenvolvimento de Assistente Virtual e Multicanal integrado com LLM · Bacharelado em Ciências de Computação · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoGraduação
- 2025Victor Lucas de Almeida FernandesEstágio em Ciência de Dados · Ciências de Computação · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoGraduação
- 2025Ângelo Antônio Bertoli GuidoEvolução da Arquitetura de um Chatbot com LLMs para Automação no Setor Imobiliário · Ciências de Computação · Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoGraduação
- 2025Processo seletivo para contratação de Docente temporário para o Departamento de Sistemas de Computação do ICMC-USP· Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoConcurso público
- 2025Concurso de livre-docência· Universidade de São PauloBanca: Thiago Alexandre Salgueiro PardoLivre-docência
- 2025Concurso de livre-docência· Universidade Estadual de CampinasBanca: Thiago Alexandre Salgueiro PardoLivre-docência
Revisor de periódico
04 registros- 2017 – presenteVínculo atualAlfa: Revista de Linguística (UNESP. São José do Rio Preto. Impresso)Revisor de periódico
- 2011 – 2011The Journal of Artificial Intelligence Research (Print)Revisor de periódico
- 2009 – 2009Journal of the Brazilian Computer SocietyRevisor de periódico
- 2007 – 2007Journal of Natural Language EngineeringRevisor de periódico
Prêmios e títulos
36 registros- 2025Finalista no Concurso de Teses e Dissertações (CTD) no 45º Congresso da Sociedade Brasileira de Computação (CSBC) com a tese de doutorado defendida por Francielle Alves VargasSociedade Brasileira de Computação
- 2025Prêmio Maria Carolina Monard de Teses de Doutorado em Computação na área de Inteligência Artificial para Francielle Alves VargasICMC-USP
- 2025Professor homenageado pela turma de Engenharia de Computação de 2022, por ocasião da Semana da Engenharia de Computação da USP/São Carlos em 2025USP
- 2024Professor homenageado por turma de Bacharelado em Sistemas de Informação, escolhido como melhor professor do 1º semestre de 2023 (referente à disciplina ministrada SCC0505 Introdução à Teoria)Universidade de São Paulo
- 2024Professor homenageado por turma de Bacharelado em Ciências de Computação, escolhido como melhor professor do 2º semestre de 2023 (referente à disciplina de Teoria de Computação e Linguagens Formais)ICMC-USP
- 2024Prêmio de melhor artigo no evento 15th Brazilian Symposium in Information and Human Language Technology (STIL)Sociedade Brasileira de Computação
- 2023Prêmio de melhor artigo no evento 14th Brazilian Symposium in Information and Human Language Technology (STIL)Sociedade Brasileira de Computação
- 2023Professor homenageado pela turma de Engenharia de Computação de 2019, por ocasião da Semana da Engenharia de Computação da USP/São Carlos em 2023USP
- 2022Prêmio de Excelência Docente "Prof. Horácio C. Panepucci" pela turma de 2019 do curso de Bacharelado em Física Computacional do IFSC-USPCentro de Estudos da Física de São Carlos (CEFiSC)
- 2022Prêmio de melhor tese de doutorado para o aluno Rafael Torres Anchiêta no PROPOR 2022 Best Dissertation AwardComitê gestor do PROPOR
- 2022Professor homenageado pela turma de Engenharia de Computação de 2017Universidade de São Paulo
- 2021Prêmio de Excelência Docente "Prof. Horácio C. Panepucci" pela turma de 2018 do curso de Bacharelado em Física Computacional do IFSC-USPCentro de Estudos da Física de São Carlos (CEFiSC)
- 2020Menção honrosa para tese de doutorado de Fernando A. A. Nóbrega no PROPOR 2020 Best Dissertation AwardUniversidade de Évora
- 2020Destaque de excelência docente no curso de Engenharia de Computação da EESC-USPSecretaria Acadêmica da Engenharia de Computação (SAECOMP)
- 2019Professor homenageado pela turma de Bacharelado em Ciências de Computação de 2015Universidade de São Paulo
- 2018Professor homenageado - eleito um dos melhores professores do 2o período de 2017 pela turma de Bacharelado em Ciências de ComputaçãoICMC-USP
- 2017Professor homenageado - eleito um dos melhores professores do 1o período de 2017 pela turma de Bacharelado em Sistemas de InformaçãoICMC-USP
- 2017Prêmio de 3o melhor artigo no evento 11th Brazilian Symposium in Information and Human Language Technology (STIL)Sociedade Brasileira de Computação
- 2017Prêmio de 3o melhor artigo no evento 6th Brazilian Conference on Intelligent Systems (BRACIS)Sociedade Brasileira de Computação
- 2016Prêmio de 2o lugar no PROPOR 2016 Best PhD Thesis on Language Technology for Portuguese AwardPROPOR
- 2015Prêmio de 3o melhor artigo no evento 10th Brazilian Symposium in Information and Human Language Technology (STIL 2015)SBC
- 2015Prêmio de 2o melhor artigo no evento 10th Brazilian Symposium in Information and Human Language Technology (STIL 2015)SBC
- 2014Melhor trabalho de Mestrado do aluno Fernando Antônio Asevedo Nóbrega no PROPOR 2014SBC
- 2013Professor homenageado pela turma de Bacharelado em Sistemas de Informação de 2009Universidade de São Paulo
- 2013Melhor trabalho de iniciação cientifica no evento VII Workshop de Iniciação Científica e TecnológicaInstituto de Ciências Matemáticas e de Computação da Universidade de São Paulo
Participação em eventos
116 registros- 2025X Scientific Initiation Workshop in Information Technology and Human Language (TILic)Ouvinte · Fortaleza
- 2025The Universal Processing of the Portuguese Language16th Symposium in Information and Human Language Technology (STIL) · Conferencista · Convidado · Fortaleza
- 202535th Brazilian Conference on Intelligent Systems (BRACIS)Ouvinte · Fortaleza
- 2025X Portuguese Description Conference (JDP)Ouvinte · Fortaleza
- 202545º Congresso da Sociedade Brasileira de Computação (CSBC)Ouvinte · Maceió
- 2025Curso de Qualidade no Ensino da Computação (CQ): ?Inteligência Artificial Generativa aplicada na Educação em Computação?Ouvinte · Maceió
- 2025Jornada de Atualização em Informática (JAI): ?Inteligência Artificial para a educação?Ouvinte · Maceió
- 2024IX Jornada de Descrição do Português (JDP)Ouvinte · Belém
- 20241o Workshop de Enriquecimento de Dados em Português (PaDAWan)Ouvinte · Belém
- 2024I Workshop: Inteligência Artificial no ICMC-USPOuvinte · São Carlos
- 20241st Workshop on NLP for Indigenous Languages of Lusophone CountriesOuvinte · Santiago de Compostela
- 202416th International Conference on Computational Processing of Portuguese (PROPOR)Ouvinte · Santiago de Compostela
- 202415th Symposium in Information and Human Language Technology (STIL)Ouvinte · Belém
- 202434th Brazilian Conference on Intelligent Systems (BRACIS)Ouvinte · Belém
- 202312nd Brazilian Conference on Intelligent Systems (BRACIS)Ouvinte · Belo Horizonte
- 20232nd Edition of the Universal Dependencies Brazilian Festival (UDFest-BR)Ouvinte · Belo Horizonte
- 202314th Symposium in Information and Human Language Technology (STIL)Ouvinte · Belo Horizonte
- 2022Universal Dependencies Brazilian Festival (UDFest-BR)Ouvinte
- 202215th International Conference on the Computational Processing of Portuguese (PROPOR)Ouvinte
- 2021XIV Symposium in Information and Human Language (STIL)Ouvinte
- 202110th Brazilian Conference on Intelligent Systems (BRACIS)Ouvinte
- 202118th National Meeting on Artificial and Computational IntelligenceOuvinte
- 2021VII Workshop de Iniciação Científica em Tecnologia da Informação e da Linguagem HumanaOuvinte
- 2021VII Jornada de Descrição do Português (JDP)Ouvinte
- 202014th International Conference on the Computational Processing of Portuguese (PROPOR)Ouvinte · Évora
Coautorias
16 coautores- 13 obras
- 11 obras
- 9 obras
- 9 obras
- 5 obras
- 4 obras
- 3 obras
- 3 obras
- 3 obras
- 2 obras
Na imprensa
betaVersão beta: esta seção é experimental e pode ser alterada ou removida a qualquer momento, e os dados podem estar incompletos ou incorretos.
