Word2Vec: Um algoritmo saussuriano | SciELO Preprints window.dataLayer = window.dataLayer || []; function gtag(){dataLayer.push(arguments);} gtag('js', new Date()); gtag('config', 'G-3TT8HYRH0Y'); Open Menu Registrar-se Acesso English Español Ir para o conteúdo principal Ir para o menu de navegação principal Ir para o rodapé Preprints Submissão Áreas do Conhecimento Ciências Agrárias Ciências Biológicas Ciências da Saúde Ciências Exatas e da Terra Ciências Humanas Ciências Sociais Aplicadas Engenharias Linguística, letras e artes Educação em Revista Memórias do Instituto Oswaldo Cruz 47º Encontro Anual da ANPOCS 48º Encontro Anual da ANPOCS 49º Encontro Anual da ANPOCS Sobre Sobre o Servidor Declaração de Privacidade Atualizações do Sistema Contato FAQ Ética no SciELO Preprints Avaliação de preprints Anotações em preprints (via Hypothesis) Avalie um preprint Notícias Início / Linguística, letras e artes Preprint / Versão 1 Word2Vec: Um algoritmo saussuriano article.authors6a0deaad07038 Leonardo Giamarusti Universidade Federal de Uberlândia image/svg+xml .st0{fill:#A6CE39;} .st1{fill:#FFFFFF;} https://orcid.org/0009-0001-9487-6892 DOI: https://doi.org/10.1590/SciELOPreprints.11678 Palavras-chave: Saussure, Processamento de Linguagem Natural, Word2Vec, Teoria do Valor Resumo Este artigo propõe uma leitura do funcionamento do Word2Vec, um algoritmo para geração de embeddings de palavras, à luz da Teoria do Valor (TdV) de Ferdinand de Saussure. O Word2Vec, nos últimos anos, tem sido bastante útil para diversas tarefas de PLN, tais como classificação de textos, análise de sentimentos e cálculos de probabilidade de ocorrências, devido ao manejo de vetores de alta dimensão. Defendo, portanto, que, por meio deste modelo de linguagem, é possível notarmos que algumas noções teóricas da linguística sausssuriana, a saber, o sistema, o signo e o valor, continuam sendo produtivos para refletir sobre aspectos teóricos e epistemológicos da determinação de significados nas línguas naturais; bem como de que forma esses sentidos parecem ser emulados por técnicas modernas de PLN, a exemplo do Word2Vec. Partimos de uma crítica às limitações do TF-IDF, passando pela influência da Semântica Distribucional e da Hipótese Distribucional em modelos vetoriais de linguagem modernos, para, enfim, propor que o Word2Vec apresenta indícios de poder operacionalizar, em níveis de semântica computacional, aquilo que Saussure já formulara conceitualmente no início do século XX, a saber: a ideia de que o significado de uma palavra não é fixo nem individual, mas relacional e determinado pelos valores semelhantes e dessemelhantes que a cercam. Nesse sentido, as fontes saussurianas mobilizadas, nesta pesquisa, para a delimitação dos conceitos abordados foram: o Curso de Linguística Geral; o conjunto de manuscritos Notes pour le 3e Cours; e o caderno de Émile Constantin, ouvinte do Terceiro Curso de Linguística Geral ministrado por Saussure em Genebra, entre 1910-1911. Nosso objetivo, assim, é propor que as noções saussurianas de similia e dissimilia podem ser percebidas nos bastidores teóricos do Word2Vec, promovendo uma aproximação entre o saussurianismo e o PLN contemporâneo. A hipótese que guia este trabalho, portanto, é a de que o Word2Vec pode ser lido como um algoritmo saussuriano , por aplicar computacionalmente a dinâmica dos valores linguísticos para emular a forma com que significados são determinados por meio da relação entre as palavras, conforme antecipara o mestre genebrino ainda no século passado. Downloads Os dados de download ainda não estão disponíveis. PDF Postado 17/04/2025 Como Citar Word2Vec: Um algoritmo saussuriano. (2025). Em SciELO Preprints . https://doi.org/10.1590/SciELOPreprints.11678 Formatos de Citação ACM ACS APA ABNT Chicago Harvard IEEE MLA Turabian Vancouver Baixar Citação Endnote/Zotero/Mendeley (RIS) BibTeX Série Linguística, letras e artes Copyright (c) 2025 Leonardo Giamarusti Este trabalho está licenciado sob uma licença Creative Commons Attribution 4.0 International License . Dados de financiamento Coordenação de Aperfeiçoamento de Pessoal de Nível Superior .citations-container { overflow-y: auto; overflow-x: hidden; max-height: 1000px; } Plaudit Declaração de dados Os dados de pesquisa estão contidos no próprio manuscrito Aviso de preprints Preprints são manuscritos não avaliados por um periódico científico ou já avaliados mas em processo de publicação. .block_announcements_article:not(:last-child) { padding-bottom: 1.5em; border-bottom: 1px solid; } .block_announcements_article { text-align: left; } .block_announcements #show-all{ font-style: italic; } Notícias SciELO Preprints adota obrigatoriedade de declaração de disponibilização de dados de pesquisa 19 agosto 2025 A partir de 1º de setembro de 2025 os manuscritos submetidos ao SciELO Preprints devem incluir uma declaração de disponibilidade de dados informando sobre onde e como os dados da pesquisa que deram origem ao artigo podem ser acessados. Atualização da Política Editorial e FAQ 21 maio 2025 Todos(as) os(as) autores(as) são solicitados(as) a consultarem a nossa Política Editorial e nossas FAQs antes de submeterem o seu manuscrito. Prêmio Ben Barres Spotlight: Inscrições abertas para 2024 20 maio 2024 Prêmios de até US$ 5.000 estão agora disponíveis para pesquisadores de origens sub-representadas ou países com financiamento limitado para apoiar sua pesquisa, carreira e comunidade. Preprints do SciELO Preprints nas ciências da vida ou biomédicas com pelo menos uma revisão disponível no Sciety são elegíveis! Show all announcements ... SciELO - Scientific Electronic Library Online Rua Dr. Diogo de Faria, 1087 – 9º andar – Vila Clementino 04037-003 São Paulo/SP - Brasil E-mail:
[email protected] app = {"hypothesisHandlerUrl":"https:\/\/preprints.scielo.org\/index.php\/scielo\/$$$call$$$\/plugins\/generic\/hypothesis\/controllers\/hypothesis\/"}; var pkpUsageStats = pkpUsageStats || {};pkpUsageStats.data = pkpUsageStats.data || {};pkpUsageStats.data.Submission = pkpUsageStats.data.Submission || {};pkpUsageStats.data.Submission[11678] = {"data":{"2025":{"4":"27","5":"24","6":"19","7":"12","8":"24","9":"14","10":"21","11":"10","12":"20"},"2026":{"1":"11","2":"7","3":"11","4":"21","5":"16"}},"label":"Todos os downloads","color":"79,181,217","total":237}; var pkpUsageStats = pkpUsageStats || {};pkpUsageStats.locale = pkpUsageStats.locale || {};pkpUsageStats.locale.months = ["Jan","Fev","Mar","Abr","Mai","Jun","Jul","Ago","Set","Out","Nov","Dez"];pkpUsageStats.config = pkpUsageStats.config || {};pkpUsageStats.config.chartType = "bar"; (function (w, d, s, l, i) { w[l] = w[l] || []; var f = d.getElementsByTagName(s)[0], j = d.createElement(s), dl = l != 'dataLayer' ? '&l=' + l : ''; j.async = true; j.src = 'https://www.googletagmanager.com/gtag/js?id=' + i + dl; f.parentNode.insertBefore(j, f); function gtag(){dataLayer.push(arguments)}; gtag('js', new Date()); gtag('config', i); }) (window, document, 'script', 'dataLayer', '3TT8HYRH0Y');
Text is read by the "Ask this paper" AI Q&A widget below.
Extraction quality varies by source — PMC NXML preserves structure
cleanly, OA-HTML may include some navigation residue, and OA-PDF can
have broken hyphenation. The publisher copy
(via DOI)
is the canonical version.