{"id":9243,"date":"2015-05-03T00:09:46","date_gmt":"2015-05-03T02:09:46","guid":{"rendered":"http:\/\/tarciziosilva.com.br\/blog\/?p=9243"},"modified":"2015-05-22T20:59:27","modified_gmt":"2015-05-22T22:59:27","slug":"mudancas-no-monitoramento-de-facebook-prepare-se","status":"publish","type":"post","link":"https:\/\/tarciziosilva.com.br\/blog\/mudancas-no-monitoramento-de-facebook-prepare-se\/","title":{"rendered":"Mudan\u00e7as no monitoramento de Facebook: prepare-se!"},"content":{"rendered":"<p style=\"text-align: justify;\">Neste primeiro de maio, ironicamente, o Facebook passou a &#8220;dificultar&#8221; o trabalho dos profissionais da querida \u00e1rea de monitoramento de m\u00eddias sociais. Nesta data passaram a valer as novas regras das APIs do Facebook. O principal impacto para o mercado de monitoramento de m\u00eddias sociais \u00e9 que nenhuma ferramenta, nem usu\u00e1rio, poder\u00e1 fazer coleta de dados brutos a partir de pesquisa de termos. Isto significa que n\u00e3o teremos mais acesso ao texto bruto ou ao perfil dos usu\u00e1rios (nem sequer \u00a0nome e avatar!) de quem mencionar as marcas em suas timelines (fora de p\u00e1ginas e grupos). \u00a0Somente ser\u00e1 poss\u00edvel coletar alguns indicadores e quantifica\u00e7\u00f5es j\u00e1 processadas, como: n\u00famero de men\u00e7\u00f5es a marcas; n\u00famero de men\u00e7\u00f5es a termos; n\u00famero de men\u00e7\u00f5es a atributos de um produto\/servi\u00e7o; distribui\u00e7\u00e3o demogr\u00e1fica de quem fala sobre cada termo buscado; circula\u00e7\u00e3o de links etc.<\/p>\n<p style=\"text-align: justify;\">Ilustrando de forma muito simples abaixo: se antes t\u00ednhamos acesso a todo o texto, link e avatar do usu\u00e1rio (na esquerda), agora cada post virar\u00e1 &#8220;apenas&#8221; um n\u00famero nos gr\u00e1ficos:<img loading=\"lazy\" decoding=\"async\" class=\"aligncenter size-large wp-image-9251\" alt=\"facebook monitoramento - antes e depois\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-monitoramento-antes-e-depois-600x221.png\" width=\"600\" height=\"221\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-monitoramento-antes-e-depois-600x221.png 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-monitoramento-antes-e-depois-150x55.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-monitoramento-antes-e-depois-300x110.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-monitoramento-antes-e-depois.png 1357w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/p>\n<p style=\"text-align: justify;\">Os impactos negativos desta mudan\u00e7a s\u00e3o os mais \u00f3bvios e imediatos. Em primeiro lugar, as marcas que tentavam descobrir problemas espec\u00edficos de consumidores individuais atrav\u00e9s do monitoramento de postagens p\u00fablicas n\u00e3o poder\u00e3o mais faz\u00ea-lo. Ag\u00eancias e consultorias de pesquisa que realizavam estudos qualitativos baseados no comportamento discursivo\/expressivo de usu\u00e1rios n\u00e3o poder\u00e3o mais fazer isto no Facebook (neste caso h\u00e1 algumas alternativas, mas de menor escala &#8211; e assunto pra outro post). A\u00e7\u00f5es de engajamento que envolviam a participa\u00e7\u00e3o ativa dos usu\u00e1rios em seus pr\u00f3prios perfis tamb\u00e9m minguar\u00e3o, pois n\u00e3o ser\u00e1 poss\u00edvel monitorar as men\u00e7\u00f5es para reportar resultados. Tudo isto traz impactos \u00f3bvios para os modelos de servi\u00e7os e receita de ag\u00eancias e ferramentas.<\/p>\n<p style=\"text-align: justify;\">Mas chorar pelo leite derramado n\u00e3o ajuda. Ent\u00e3o vamos\u00a0<strong>aproveitar<\/strong> o que for poss\u00edvel, dadas as condi\u00e7\u00f5es. Segue uma lista de materiais comentados que pode ajudar muito neste momento de disrup\u00e7\u00e3o.<\/p>\n<p style=\"text-align: justify;\">Pra come\u00e7o de conversa, gostaria de indicar tr\u00eas textos de profissionais que admiro e trabalham com monitoramento h\u00e1 tanto (ou mais) tempo que eu: o Roberto Cassano publicou no Medium da Frog o post &#8220;<strong><a href=\"https:\/\/medium.com\/@agenciafrog\/a-era-negra-do-monitoramento-b3b0ac7fd918\" target=\"_blank\">A Era Negra do Monitoramento<\/a><\/strong>&#8220;, o Eduardo Vasques da TV1 o texto &#8220;<strong><a href=\"https:\/\/www.linkedin.com\/pulse\/um-novo-desafio-nas-redes-sociais-crise-do-eduardo-vasques\" target=\"_blank\">A Crise do Monitoramento<\/a><\/strong>&#8221; e o Gabriel Ishida da dp6 com o texto &#8220;<strong><a href=\"http:\/\/www.midializado.com.br\/2015\/05\/sobre-api-do-facebook-e-o-seu-topic-data.html\" target=\"_blank\">Sobre a API do Facebook e o seu Topic Data<\/a><\/strong>&#8220;.\u00a0Apesar de achar os t\u00edtulos dos dois primeiros textos prejudiciais, pois tem muita gente que n\u00e3o l\u00ea ou se informa com aten\u00e7\u00e3o e podem criar um clima apocal\u00edptico, s\u00e3o observa\u00e7\u00f5es e coment\u00e1rios essenciais. Como comenta o Cassano, &#8221;\u00a0\u00e9 preciso desenvolver uma estrat\u00e9gia e uma metodologia, que use ferramentas para se alcan\u00e7ar os objetivos reconhecendo e explorando as enormes limita\u00e7\u00f5es e desafios impostos pelas novas plataformas e por uma maior maturidade do pr\u00f3prio consumidor, cada vez mais ciente da (correta) necessidade de preservar sua privacidade.&#8221; E, nas palavras do Vasques, \u00e9 hora de: &#8220;Abrir novas frentes de intera\u00e7\u00e3o e estimular ainda mais o di\u00e1logo para que os p\u00fablicos se manifestem nesses ambientes aos quais as marcas t\u00eam acesso. Ou seja, \u00e9 hora de se abrir para novos aprendizados.&#8221;<\/p>\n<p style=\"text-align: justify;\">O Ishida, pragm\u00e1tico desde o t\u00edtulo, lembra da import\u00e2ncia de se profissionalizar de verdade o trabalho em m\u00eddias sociais em todas suas esferas:<\/p>\n<blockquote>\n<p style=\"text-align: justify;\">N\u00e3o duvido nada que, daqui um tempo, algumas pessoas chegar\u00e3o perguntando: algu\u00e9m conhece uma ferramenta de gra\u00e7a que pegue esses dados do Facebook? E ainda por cima v\u00e3o xingar o Facebook por ter limitado os dados desse jeito. Se voc\u00ea quer dados legais, bem agregados, organizados, n\u00e3o s\u00f3 no Facebook, mas em todas as outras redes,\u00a0<b>voc\u00ea tem que pagar por uma ferramenta<\/b>. Social media n\u00e3o \u00e9 de gra\u00e7a, como ainda muita gente pensa. H\u00e1 um trabalho s\u00e9rio por tr\u00e1s de tudo.<\/p>\n<\/blockquote>\n<p style=\"text-align: justify;\">Antes de ir para as dicas t\u00e9cnicas, gostaria de lembrar da import\u00e2ncia de se pensar a atua\u00e7\u00e3o neste mercado n\u00e3o s\u00f3 em termos da receita que voc\u00ea vai ganhar hoje com uma plataforma espec\u00edfica. Mas tamb\u00e9m em termos de sa\u00fade da internet como um todo. O modelo de neg\u00f3cio do Facebook , ao contr\u00e1rio de empresas como Google e Twitter, n\u00e3o se baseia na livre circula\u00e7\u00e3o de informa\u00e7\u00f5es na internet, mas sim na constru\u00e7\u00e3o de barreiras para que tudo fique dentro do Facebook. N\u00e3o \u00e9 \u00e0 toa que Tim Berners-Lee, um dos inventores da web, alertou sobre o <a href=\"http:\/\/www.theguardian.com\/technology\/2014\/aug\/24\/internet-lost-its-way-tim-berners-lee-world-wide-web\" target=\"_blank\">perigo que o Facebook traz aos princ\u00edpios da internet<\/a>.<\/p>\n<p style=\"text-align: justify;\"><img loading=\"lazy\" decoding=\"async\" class=\"alignright size-medium wp-image-8765\" alt=\"eartquake\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2014\/07\/eartquake-300x287.jpg\" width=\"300\" height=\"287\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2014\/07\/eartquake-300x287.jpg 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2014\/07\/eartquake-150x143.jpg 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2014\/07\/eartquake.jpg 574w\" sizes=\"auto, (max-width: 300px) 100vw, 300px\" \/>Ano passado, nos 10 anos do Facebook, escrevi como o Facebook se tornou um &#8220;<a href=\"http:\/\/tarciziosilva.com.br\/blog\/10-anos-de-facebook-um-ponto-obrigatorio-de-passagem\/\" target=\"_blank\">ponto obrigat\u00f3rio de passagem<\/a>&#8220;, um n\u00edvel de centraliza\u00e7\u00e3o de poder muito perigoso. Para comparar, recomendo o texto, tamb\u00e9m de minha autoria &#8220;<a href=\"http:\/\/tarciziosilva.com.br\/blog\/sensores-humanos-250-milhoes-de-motivos-para-promover-o-twitter\/\" target=\"_blank\">250 milh\u00f5es de motivos para defender o Twitter<\/a>&#8220;. Para uma vis\u00e3o mais ligada \u00e0 pesquisa acad\u00eamica, leia o excelente texto &#8220;<a href=\"http:\/\/onlinelibrary.wiley.com\/doi\/10.1111\/j.1467-954X.2012.02121.x\/abstract\" target=\"_blank\">The redistribution of methods: on intervention in digital social research, broadly conceived<\/a>&#8221; da Noortje Marres. De 2012, discute como a abund\u00e2ncia de dados sociais hoje traz novas oportunidades e desafios para a constru\u00e7\u00e3o de conhecimento, especialmente para a pesquisa acad\u00eamica. Um dos motivos \u00e9 a centraliza\u00e7\u00e3o destes dados em corpora\u00e7\u00f5es como Facebook e Google. Tr\u00eas anos depois, o Facebook piorou bastante a situa\u00e7\u00e3o para todos.<\/p>\n<p style=\"text-align: justify;\"><span style=\"line-height: 1.5em;\">Ent\u00e3o vamos falar de como\u00a0<\/span><strong style=\"line-height: 1.5em;\">se preparar para o novo modelo de monitoramento no Facebook<\/strong><span style=\"line-height: 1.5em;\">. Em primeiro lugar, uma pequena revis\u00e3o de como vai funcionar. Como falamos acima, o Facebook n\u00e3o entregar\u00e1 os dados brutos para nenhuma ferramenta. Nem sequer para a Datasift, fornecedora de dados (que ferramentas como o BrandCare contratam). A Datasift vai ser a intermedi\u00e1ria para aplica\u00e7\u00e3o das regras nos dados, atrav\u00e9s de sistemas como <strong>Biblioteca de\u00a0<\/strong><strong>Classifiers<\/strong>,\u00a0<strong>Modelos Baseados em Regras<\/strong> e\u00a0<strong>Machine Learning Models<\/strong>. Abaixo um esqueminha utlizado pela Datasift em suas apresenta\u00e7\u00f5es:<br \/>\n<\/span><\/p>\n<p><img loading=\"lazy\" decoding=\"async\" class=\"size-full wp-image-9259 aligncenter\" alt=\"datasift - topic data - classifiers\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-topic-data-classifiers.png\" width=\"415\" height=\"298\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-topic-data-classifiers.png 415w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-topic-data-classifiers-150x107.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-topic-data-classifiers-300x215.png 300w\" sizes=\"auto, (max-width: 415px) 100vw, 415px\" \/><\/p>\n<p style=\"text-align: justify;\">Um detalhe importante de mencionar \u00e9 que este processamento de dados n\u00e3o acontecer\u00e1 nem sequer nos servidores da Datasift. Mas dentro dos servidores do Facebook. E, ao contr\u00e1rio do Twitter, n\u00e3o oferecer\u00e3o a possibilidade de coleta de dados retroativos (por exemplo, no BrandCare podemos coletar tweets desde 2006).<\/p>\n<p style=\"text-align: justify;\">O problema (e oportunidade) destas tr\u00eas l\u00f3gicas \u00e9 que a an\u00e1lise de sentimento ou classifica\u00e7\u00e3o automatizada s\u00e3o, como todos sabem, algo muito complexo. E consideravelmente imprecisa. Abaixo temos um exemplo de configura\u00e7\u00e3o na interface da Datasift. Em bom portugu\u00eas, uma das linhas significa que textos sobre estas marcas automotivas sendo monitoradas que contenham as palavras &#8220;recall, fault, broke down ou broken&#8221; ser\u00e3o marcadas com o c\u00f3digo de Feature(Caracter\u00edstica\/Aspecto) chamado Reliability (Confiabilidade).<\/p>\n<p><img loading=\"lazy\" decoding=\"async\" class=\"aligncenter size-large wp-image-9262\" alt=\"datasift presentation- rules\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-presentation-rules-600x300.png\" width=\"600\" height=\"300\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-presentation-rules-600x300.png 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-presentation-rules-150x75.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-presentation-rules-300x150.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/datasift-presentation-rules.png 646w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/p>\n<p>Em ferramentas de monitoramento como o BrandCare, transformamos o estabelecimento de regras para uma forma bem simples como na tela abaixo. Ou seja, para o usu\u00e1rio final o estabelecimento de regras simples como estas \u00e9 algo bem f\u00e1cil como na tela abaixo. No exemplo, esta s\u00e9rie de palavras como &#8220;barato&#8221; e &#8220;caro&#8221; s\u00e3o ligadas a um atributo: neste caso o aspecto &#8220;Pre\u00e7o&#8221;.<\/p>\n<p><img loading=\"lazy\" decoding=\"async\" class=\"aligncenter size-large wp-image-9265\" alt=\"brandcare - dashboard e commerce - regras\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/brandcare-dashboard-e-commerce-regras-600x342.png\" width=\"600\" height=\"342\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/brandcare-dashboard-e-commerce-regras-600x342.png 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/brandcare-dashboard-e-commerce-regras-150x85.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/brandcare-dashboard-e-commerce-regras-300x171.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/brandcare-dashboard-e-commerce-regras.png 1345w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/p>\n<p style=\"text-align: justify;\">Isto significa que quanto \u00e0s regras, parte das pr\u00e1ticas que ser\u00e3o feitas com a mudan\u00e7a de dados no Facebook j\u00e1 s\u00e3o realizadas em alguns projetos de monitoramento. No caso acima, esta e diversas outras regras s\u00e3o transformadas em gr\u00e1ficos com indicadores sobre as marcas monitoradas. Exemplificando, uma s\u00e9rie de regras e par\u00e2metros customizados s\u00e3o enviados para o Facebook e ele retorna dados que ser\u00e3o transformados pelas ferramentas em gr\u00e1ficos. \u00c9 como acontece quando se usa regras normalmente. No exemplo abaixo, uma s\u00e9rie de regras vira gr\u00e1fico de Tem\u00e1ticas, Sentimento, Palavras Negativas etc.<\/p>\n<p style=\"text-align: justify;\"><img loading=\"lazy\" decoding=\"async\" class=\"aligncenter size-large wp-image-9268\" alt=\"da regra ao dado\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/da-regra-ao-dado-600x234.png\" width=\"600\" height=\"234\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/da-regra-ao-dado-600x234.png 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/da-regra-ao-dado-150x58.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/da-regra-ao-dado-300x117.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/da-regra-ao-dado.png 1303w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/p>\n<p style=\"text-align: justify;\">Mas h\u00e1 um grande ponto que, na minha opini\u00e3o, \u00e9 um dos mais problem\u00e1ticos nesta mudan\u00e7a. Quem trabalha bem com regras de processamento de texto\/linguagem natural, melhora continuamente as informa\u00e7\u00f5es ao conferir, em amostras dos textos, se tais regras resultaram em aplica\u00e7\u00f5es adequadas de c\u00f3digos, tags e sentimento. Mas isto n\u00e3o ser\u00e1 poss\u00edvel mais com o Facebook. Voc\u00ea n\u00e3o poder\u00e1 conferir nos pr\u00f3prios dados se aquelas 200 regras adicionadas que processam 4000 keywords para gerar 40 tags diferentes est\u00e3o 100% precisas. Para fazer isto, ser\u00e1 preciso recorrer a uma compreens\u00e3o ampla das din\u00e2micas de conversa\u00e7\u00e3o, al\u00e9m de trabalhar com modelagem e testes utilizando outros par\u00e2metros textuais para se aplicar aos textos do Facebook.<br data-reactid=\".18v.1:4:1:$comment357321761139303_357325991138880:0.0.$right.0.$left.0.0.1.$comment-body.0.3.0.$end:0:$5:0\" \/><br data-reactid=\".18v.1:4:1:$comment357321761139303_357325991138880:0.0.$right.0.$left.0.0.1.$comment-body.0.3.0.$end:0:$7:0\" \/><span style=\"line-height: 1.5em;\">Neste momento, monitoramento e pesquisa digitais que englobem o Facebook se aproximam ainda mais da pesquisa acad\u00eamica e de \u00e1reas que envolvam a compreens\u00e3o profunda das estruturas lingu\u00edsticas e discursivas, al\u00e9m da organiza\u00e7\u00e3o da informa\u00e7\u00e3o. \u00c1reas como lingu\u00edstica de corpus, sociolingu\u00edstica,\u00a0<\/span><em style=\"line-height: 1.5em;\">text analytics<\/em><span style=\"line-height: 1.5em;\">, computa\u00e7\u00e3o social, NL (processamento natural da linguagem) tornam-se mais importantes. Como o Facebook vai deixar parte do trabalho &#8220;\u00e0s cegas&#8221;, \u00e9 importante ter o m\u00e1ximo de dom\u00ednio destas t\u00e9cnicas em grande escala (<\/span><em style=\"line-height: 1.5em;\">big data<\/em><span style=\"line-height: 1.5em;\">) para que os dados sejam o mais precisos poss\u00edveis e as estrat\u00e9gias e t\u00e1ticas resultantes\u00a0<\/span>deem<span style=\"line-height: 1.5em;\">\u00a0resultado.<\/span><\/p>\n<p style=\"text-align: justify;\">Para come\u00e7ar, recomendo revisitar as estrat\u00e9gias de cria\u00e7\u00e3o de Categorias e Tags em projetos de monitoramento de m\u00eddias sociais. Em whitepaper que escrevi na Social Figures, descrevo tr\u00eas t\u00e1ticas b\u00e1sicas para gerar as categorias e tags: decompor o produto\/servi\u00e7o; responder demanda de informa\u00e7\u00e3o do cliente; e descobrir informa\u00e7\u00f5es emergentes nas m\u00eddias sociais. \u00a0A materializa\u00e7\u00e3o destas t\u00e1ticas em listas de c\u00f3digos\/tags organizados \u00e9 o primeiro passo para cria\u00e7\u00e3o das regras e sistemas de processamento em seguida.<\/p>\n<p><a href=\"http:\/\/pt.slideshare.net\/socialfigures\/classificacao-tags-monitoramento-de-midias-sociais\" target=\"_blank\"><img loading=\"lazy\" decoding=\"async\" class=\"size-full wp-image-9278 aligncenter\" alt=\"decompor responder descobrir\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/decompor-responder-descobrir.png\" width=\"564\" height=\"220\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/decompor-responder-descobrir.png 564w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/decompor-responder-descobrir-150x58.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/decompor-responder-descobrir-300x117.png 300w\" sizes=\"auto, (max-width: 564px) 100vw, 564px\" \/><\/a><\/p>\n<p style=\"text-align: justify;\">Quanto a lingu\u00edstica de corpus, o Tom McEnery \u00e9 um dos principais estudiosos do tema na atualidade e lan\u00e7ou um curso online na FutureLearn chamado &#8220;<a href=\"https:\/\/www.futurelearn.com\/courses\/corpus-linguistics\">Corpus linguistics: method, analysis, interpretation<\/a>&#8220;. Compreender as mec\u00e2nicas da l\u00edngua e como tem sido estudadas ao longo das d\u00e9cadas pela lingu\u00edstica de corpus \u00e9 um passo essencial para aplicar heur\u00edsticas e proxies de dados para descobrir informa\u00e7\u00f5es. O McEnery tamb\u00e9m possui um livro b\u00e1sico sobre o tema chamado &#8220;<a href=\"http:\/\/www.amazon.com\/Corpus-Linguistics-Practice-Cambridge-Textbooks\/dp\/0521547369\" target=\"_blank\">Corpus Linguistics: Method, Theory and Practice<\/a>&#8220;.<\/p>\n<p style=\"text-align: justify;\">httpv:\/\/www.youtube.com\/watch?v=HQGcj2Cg-lY<\/p>\n<p style=\"text-align: justify;\"><img loading=\"lazy\" decoding=\"async\" class=\"alignright size-thumbnail wp-image-9214\" alt=\"discourse and social media\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/04\/discourse-and-social-media-150x224.jpg\" width=\"150\" height=\"224\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/04\/discourse-and-social-media-150x224.jpg 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/04\/discourse-and-social-media.jpg 231w\" sizes=\"auto, (max-width: 150px) 100vw, 150px\" \/>Focada em m\u00eddias sociais, a Michele Zappavigna estudou um corpus de 7 milh\u00f5es de tweets totalizando 100 milh\u00f5es de palavras. A pesquisadora australiana publicou um livro com os resultados, chamado\u00a0\u201c<strong>Discourse of Twitter and Social Media: How We Use Language to Create Affiliation on the Web<\/strong>\u201d, que j\u00e1 resenhei <a href=\"http:\/\/tarciziosilva.com.br\/blog\/discurso-no-twitter-e-midias-sociais-como-usamos-linguagem-para-criar-afiliacao-na-web\/\" target=\"_blank\">aqui no blog<\/a>. \u00c9 \u00fatil neste momento especialmente por tr\u00eas motivos. O primeiro \u00e9 para que todos lembrem o quanto o Twitter \u00e9 male\u00e1vel e amig\u00e1vel a pesquisas e gera\u00e7\u00e3o de informa\u00e7\u00f5es de todos os tipos. O segundo \u00e9 que a classifica\u00e7\u00e3o que a Zappavigna aplica em marcadores de Julgamento, Afeto e Aprecia\u00e7\u00e3o s\u00e3o \u00fateis para a cria\u00e7\u00e3o de regras que tragam dados al\u00e9m somente de aspectos e sentimentos. Por fim, Twitter e Blogs servir\u00e3o aos bons e cuidadosos profissionais que desejarem criar modelagens e testes das regras em textos reais e atuais antes de aplicar ao monitoramento tamb\u00e9m do Facebook. Tenho uma proposta de palestra no SMW sobre o tema (<a href=\"http:\/\/call4paperz.com\/events\/social-media-week-sao-paulo-2015\/proposals\/1666\" target=\"_blank\">vote, se interessar a voc\u00ea<\/a>).<\/p>\n<p style=\"text-align: justify;\">Al\u00e9m das regras e dos classifiers j\u00e1 prontos, outra possibilidade ser\u00e1 aplicar\u00a0<em>machine learning<\/em>\u00a0nos textos. Ainda n\u00e3o est\u00e1 perfeitamente claro como funcionar\u00e1, mas isto n\u00e3o significa que se deve ficar de bra\u00e7os cruzados. A aplica\u00e7\u00e3o mais frequente de aprendizado de m\u00e1quina em texto natural \u00e9 a\u00a0<strong>modelagem de t\u00f3picos<\/strong>. De modo bem geral, \u00e9 uma t\u00e9cnica que identifica, em uma lista\/corpus de textos, os t\u00f3picos a partir da frequ\u00eancia, aus\u00eancia e diferen\u00e7a de palavras-chaves. Temos cerca de 20 anos de estudos nesta \u00e1rea, sendo hoje o modelo mais comum o LDA &#8211;\u00a0Latent Dirichlet allocation.<\/p>\n<p><a href=\"http:\/\/dl.acm.org\/citation.cfm?doid=2133806.2133826\" target=\"_blank\"><img loading=\"lazy\" decoding=\"async\" class=\"size-large wp-image-9285 aligncenter\" alt=\"IntroToLDA\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/IntroToLDA-600x315.png\" width=\"600\" height=\"315\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/IntroToLDA-600x315.png 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/IntroToLDA-150x78.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/IntroToLDA-300x157.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/IntroToLDA.png 914w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/a><\/p>\n<p><a href=\"https:\/\/code.google.com\/p\/topic-modeling-tool\/\" target=\"_blank\"><img loading=\"lazy\" decoding=\"async\" class=\"alignright size-thumbnail wp-image-9287\" alt=\"topic modeling\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/topic-modeling-150x145.png\" width=\"150\" height=\"145\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/topic-modeling-150x145.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/topic-modeling-300x291.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/topic-modeling.png 596w\" sizes=\"auto, (max-width: 150px) 100vw, 150px\" \/><\/a><\/p>\n<p>Como \u00e9 frequente em se tratando de pesquisa acad\u00eamica, h\u00e1 ferramentas gratuitas que ajudam neste processo. Criada por David Newman e Arun Balagopalan, \u00e9 uma materializa\u00e7\u00e3o simples do LDA que, a partir de inputs em CSV\/TXT permite identificar os &#8220;t\u00f3picos&#8221; em uma s\u00e9rie de textos. Ferramentas do tipo, associadas ao conhecimento de monitoramento de m\u00eddias sociais, ajudam no processo de inferir termos que possam ser significativos a temas e t\u00f3picos no Facebook, mesmo estando parcialmente &#8220;\u00e0s cegas&#8221;.<\/p>\n<p><span style=\"line-height: 1.5em;\">Outra fonte essencial de informa\u00e7\u00e3o e aprendizado para os analistas neste momento \u00e9 o projeto <\/span><a style=\"line-height: 1.5em;\" href=\"http:\/\/tapor.ca\/\" target=\"_blank\">Tapor<\/a><span style=\"line-height: 1.5em;\">. O Text Analysis Portal for Research \u00e9 uma iniciativa de professores de algumas das principais universidades do Canad\u00e1 e re\u00fane quase 500 ferramentas para text analysis. S\u00e3o in\u00fameras possibilidades de processar, explorar e visualizar dados a partir de text analytics. Grande parte destas visualiza\u00e7\u00f5es n\u00e3o ser\u00e3o poss\u00edveis devido \u00e0s novas restri\u00e7\u00f5es do Facebook. Mas em parte delas tente imaginar: como eu posso fazer sistemas de\u00a0<\/span><em style=\"line-height: 1.5em;\">queries<\/em><span style=\"line-height: 1.5em;\"> que me permitam trazer dados t\u00e3o ricos?<\/span><\/p>\n<p><a href=\"http:\/\/tapor.ca\/\" target=\"_blank\"><img loading=\"lazy\" decoding=\"async\" class=\"size-large wp-image-9298 aligncenter\" alt=\"tapor\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/tapor-600x516.png\" width=\"600\" height=\"516\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/tapor-600x516.png 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/tapor-150x129.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/tapor-300x258.png 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/tapor.png 708w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/a><\/p>\n<p>Sempre importante lembrar que a limita\u00e7\u00e3o que o Facebook imp\u00f4s est\u00e1 na busca. Ou seja, ainda \u00e9 poss\u00edvel coletar dados de Facebook Pages, incluindo os coment\u00e1rios. O mesmo no caso dos Grupos. Abaixo, um exemplo de estudo de\u00a0benchmarking baseado em tipos de conte\u00fado publicados por marcas do segmento de fast fashion:<\/p>\n<p><img loading=\"lazy\" decoding=\"async\" class=\"size-large wp-image-9300 aligncenter\" alt=\"facebook pages\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-pages-600x337.jpg\" width=\"600\" height=\"337\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-pages-600x337.jpg 600w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-pages-150x84.jpg 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-pages-300x168.jpg 300w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/facebook-pages.jpg 960w\" sizes=\"auto, (max-width: 600px) 100vw, 600px\" \/><\/p>\n<p>O cruzamento da constru\u00e7\u00e3o de corpora tanto de textos antigos do Facebook quanto de texto atual de outras m\u00eddias sociais, modelagem de t\u00f3picos e compreens\u00e3o das estruturas lingu\u00edsticas das conversas e opini\u00f5es ser\u00e1 essencial para os analistas de dados. Mas tudo isto, claro, pode ser aplicado nas diversas m\u00eddias sociais e fontes de dados textuais. O que n\u00e3o pode continuar \u00e9 o crescente fechamento da internet no Facebook. Sempre defendi a necessidade de cria\u00e7\u00e3o de ambientes propriet\u00e1rios para as marcas ou organiza\u00e7\u00f5es. Agora, mais do que nunca, isto se torna essencial.<\/p>\n<p><span style=\"line-height: 1.5em;\">Al\u00e9m disto, \u00e9 importante lembrar que \u00e9 poss\u00edvel extrair ainda mais dados dos outros canais como Twitter, Blogs, Instagram, Google+, F\u00f3runs, Websites de modo geral, Google Trends, Wikipedia etc. Existem in\u00fameras metodologias e t\u00e9cnicas de gera\u00e7\u00e3o de informa\u00e7\u00f5es, provenientes da hist\u00f3ria das ci\u00eancias sociais e computacionais, que podem ser aplicadas para gerar mais e mais insights. A An\u00e1lise de Redes Sociais, por exemplo, era utilizada por uma pequena parcela de profissionais atrav\u00e9s de programas como NodeXL e Gephi. Ano passado, tive a oportunidade de integr\u00e1-la com o BrandCare, permitindo a escalabilidade destas aplica\u00e7\u00f5es para nossos clientes, com excelente resultado. E \u00e9 um tipo de metodologia que \u00e9 favorecida especialmente pela estrutura de dados e conversas no Twitter.<\/span><span style=\"line-height: 1.5em;\">\u00a0<\/span><\/p>\n<div id=\"attachment_9292\" style=\"width: 464px\" class=\"wp-caption aligncenter\"><img loading=\"lazy\" decoding=\"async\" aria-describedby=\"caption-attachment-9292\" class=\"size-full wp-image-9292 \" alt=\"nsmnss - completa\" src=\"http:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/nsmnss-completa.png\" width=\"454\" height=\"615\" srcset=\"https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/nsmnss-completa.png 454w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/nsmnss-completa-150x203.png 150w, https:\/\/tarciziosilva.com.br\/blog\/wp-content\/uploads\/2015\/05\/nsmnss-completa-300x406.png 300w\" sizes=\"auto, (max-width: 454px) 100vw, 454px\" \/><p id=\"caption-attachment-9292\" class=\"wp-caption-text\">Parte da rede da hashtag #NSMNSS<\/p><\/div>\n<p style=\"text-align: justify;\">Em resumo, n\u00e3o \u00e9 o fim ou a crise do monitoramento para fins comerciais. As mudan\u00e7as que o Facebook imp\u00f4s v\u00e3o impactar alguns tipos de projetos, mas n\u00e3o \u00e9 o fim do mundo. Bons profissionais, ag\u00eancias, ferramentas e afins continuar\u00e3o a realizar um bom trabalho. Mas, acima de tudo, que isto sirva de li\u00e7\u00e3o para lembrarmos que a internet \u00e9 uma ferramenta poderosa demais para ser tomada por modelos de neg\u00f3cio centralizadores.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Neste primeiro de maio, ironicamente, o Facebook passou a &#8220;dificultar&#8221; o trabalho dos profissionais da querida \u00e1rea de monitoramento de m\u00eddias sociais. Nesta data passaram a valer as novas regras das APIs do Facebook. O principal impacto para o mercado de monitoramento de m\u00eddias sociais \u00e9 que nenhuma ferramenta, nem usu\u00e1rio, poder\u00e1 fazer coleta de [&hellip;]<\/p>\n","protected":false},"author":6,"featured_media":0,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[2089,3,2101],"tags":[42,2371,2381,2378,2379,2380],"class_list":["post-9243","post","type-post","status-publish","format-standard","hentry","category-metricas-e-mensuracao","category-midias-sociais","category-monitoramento-2","tag-facebook","tag-linguistica-de-corpus","tag-machine-learning","tag-monitoramento-no-facebook","tag-text-analytics","tag-topic-modeling"],"_links":{"self":[{"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/posts\/9243","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/users\/6"}],"replies":[{"embeddable":true,"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/comments?post=9243"}],"version-history":[{"count":53,"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/posts\/9243\/revisions"}],"predecessor-version":[{"id":9311,"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/posts\/9243\/revisions\/9311"}],"wp:attachment":[{"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/media?parent=9243"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/categories?post=9243"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/tarciziosilva.com.br\/blog\/wp-json\/wp\/v2\/tags?post=9243"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}