Mostrando postagens com marcador datascience. Mostrar todas as postagens
Mostrando postagens com marcador datascience. Mostrar todas as postagens

16.6.18

A Ciência de Dados no 6º Festival Path


 O Festival Path é um evento único.

A cidade de São Paulo é presenteada a cada ano, desde 2013, com o Festival Path, um evento que reúne tecnologia, arte e negócios em torno de temas que envolvem bem-estar, sociedade e inovação.

Acontece em um fim de semana e conta com uma programação intensa distribuida em palcos, galerias, praças, museus, casas de show, teatros, centros culturais, ginásios, hooftops e outros locais.

Este ano foram mais de 400 horas de atividades em cerca de 30 espaços diferentes. Mais de 5 mil ingressos e 30 mil pessoas assistiram a dúzias de (mais de 25 ) shows, diversos (15) documentários, centenas de ( mais de 300) palestras e experimentaram Yoga, feiras gastronômicas, feiras makers, de games e de startups, além de estimularem seus sentidos em stands imersivos, lúdicos e interativos como o da Bombay Sapphire (https://www.bombaysapphire.com/), da Natura (http://www.natura.com.br), da WeWork (https://www.wework.com/pt-BR/ - www.facebook.com/WeWorkBrasil/), da Printi (https://www.printi.com.br), da Laje (https://www.laje-ac.com.br/site/index.php) de Ana Couto (http://www.anacouto.com.br), da Universa UOL (https://universa.uol.com.br) e outros.

Como é de esperar em eventos deste porte, havia fila pra tudo. O público, no entanto, é tão bom que nenhuma forma pegar fila se tornou algo maçante. Aliás, foi onde mais socializei trocando informações sobre a programação, fazendo novas amizades e debatendo a relevância dos diversos conteúdos. O público do Path é um evento à parte. Só vendo pra crer.
A organização do Path trouxe uma solução criativa e bem democrática para beneficiar o público. Todos os pagantes receberam alguns 'Fast Pass' (2 para cada dia) que permitiam que seus portadores ocupassem lugares reservados sem a necessidade de pegar fila. Assim cada um podia garantir a participação na sua palestra favorita sem problema.

50 profissionais que tiveram a missão de colaborar na criação do Trends Report Path. O objetivo foi mapear as principais tendências do evento através dos temas tratados nas 310 palestras. Ao final do segundo dia, Vanessa Mathias e Lu Bazanella, fundadoras da White Rabbit, apresentaram as “6 Macrotendências do Festival Path”, um resumo do que se encontra no relatório completo elaborado pela White Rabbit e O Panda Criativo (http://www.opandacriativo.com/trend).
O Report foi dividido em 6 categorias (Purpose First, Connected Dots, Bursting Bubbles, Humanism Renaissance, Hacking Health e Omnidesign) que sintetizam os futuros possíveis a partir do que já se verifica na prática hoje. Sem dúvida, um instrumento primordial para auxílio nas tomadas de decisão na indústria e no marketing. Conheça os detalhes de cada categoria no artigo da Up Future Sight ((https://medium.com/up-future-sight/as-seis-macrotendências-do-festival-path-2018-a8286c2a9324)) feito pela futurista Lídia Zuin (https://www.linkedin.com/in/lidiazuin/).
Desde meados de 2012 o cientista de dados tem sido considerado um cargo sexy. É um dos profissionais mais cobiçados no mercado e cada vez mais necessários em todo tipo de organização. Está entre as tendências mapeadas pelo Trends Report Path mas foi difícil categorizá-lo já que suas competências, talentos e aptidões permeiam todas elas.

O surgimento da computação ubíqua com surgimento dos smartphones e a computação em nuvem trouxe a percepção de que o volume de dados produzidos pelo homem e suas máquinas tendia ao infinito. Já não é mais humanamente possível contar e avaliar os dados na medida em que são criados. Ferramentas foram então desenvolvidas para colaborar. Essas ferramentas continuam em evolução e estão nas mãos dos cientistas de dados, pessoas que reunem em si habilidades estatísticas, computacionais e de negócios, verdadeiros unicórnios para o mundo corporativo.
A seguir apresento uma pequena síntese de duas palestras realizadas por cientistas da Cappra Data Science (https://cappra.com.br/) no Festival Path.

“Será muito difícil as pessoas consumirem algo na internet que não seja sob medida” Eric Schmidt

1. A ciência por trás dos algoritmos de recomendação

A apresentação de Dierê Fernandez (https://www.linkedin.com/in/diere/) da Cappra Data Science (https://cappra.com.br/) foi um espetáculo de dados, conceitos e referências. Explicou as lógicas usadas na criação de algoritmos e elencou seus muitos tipos; referenciou autores famosos como Alvin Tofler (Future Shock, 1970), Clay Shirky (Here Comes Everybody, 2008) e Eli Pariser (The Filter Bubble, 2011); e, revelou dados de algumas pesquisas.

“800 milhões de usuários do Instagram publicam 95 milhões de fotos por dia”

Por definição, algoritmos são “sequências finitas de instruções bem definidas”, logo, não se limitam ao mundo digital. Qualquer atividade rotineira pode ser considerada uma instrução algorítmica, desde escovar os dentes ou dirigir um carro até selecionar o que é spam no seu e-mail ou o que exibir na linha do tempo de sua rede social digital.
Pioneira no uso de algoritmos de recomendação no e-commerce, a Amazon (https://www.amazon.com) assume que vem deles cerca de 35% de suas vendas. No serviço de streaming Netflix (https://www.netflix.com), quase 80% do conteúdo assistido deriva de suas recomendações. Outros serviços online como o Spotify (https://www.spotify.com) e o OkCupid (https://www.okcupid.com) usam os algoritmos como ferramentas centrais de engajamento e retenção de usuários.

“Algoritmos são opiniões camufladas de tecnologia” Cathy O’Neil

Segundo ela, algoritmos e inteligência atificial são muito úteis para curadoria do consumo de informação e no auxílio a tomadas de decisão mas estes programas podem engendrar viéses e nos prender em ‘bolhas’ de informação. Criar algoritmos neutros é um desafio já que a subjetividade é uma grande característica humana e está sujeita a nuances sutis. Baseando-se apenas em histórico de comportamento um algoritmo está pouco suscetível ao novo, por isso, sistemas híbridos que levem em conta outras vaiáveis (como o contexto por exemplo) são mais assertivos e adequados. Essa preocupação foi exemplificada no experimento Bias In Bias Out (https://www.biasinbiasout.com/) da agência Mesa&Cadeira (https://www.mesa.do/) que traz reflexões sobre como os algoritmos espelham os preconceitos humanos.

“O uso de dados wireless e mobile será 2/3 do total do tráfego na Internet em 2021”
2. 10 coisas sobre o futuro inundado de dados

Ricardo Cappra (https://www.linkedin.com/in/cappra/) começa falando sobre o grande volume de dados produzidos hoje em dia. Esses dados estão disponíveis para análises com os mais diferentes escopos. Ele descreve o processo de transformação do ruído inaudível dos dados não-estruturados, até a ‘small data’, quando os dados se traduzem em informações úteis e podem ser cientificamente tratáveis, ou seja, são convertidos de dados irrrelevantes para dados relevantes.

“As pessoas não estão participando online estão deixando rastros”

Os 10 tópicos tratados em sua palestra foram divididos em Oportunidades e Riscos, sendo os primeiros:

- Ruído Ensurdecedor
- Cultura Analítica
- Cientistas de Dados
- Dados Contam Histórias
- Data4Good

Ele considera o ‘ruído’ uma grande oportunidade para a sociedade. Nasce daí a necessidade de se moldar uma ‘cultura analítica’ onde os ‘cientistas de dados’ (hoje em sua primeira geração) possam extrair ‘histórias’ relevantes e usar esse conhecimento para o bem coletivo. Enfatiza as oportunidades especialmente focadas no fomento da cultura analítica centrada nos pilares P3T, ou seja, people, process, policy and technology. Cita também alguns exemplos criativos para o desenvolvimento de uma cultura baseada em dados. O ‘Data4Good’ (https://www.cappralab.com/data4good/), uma hackathon (maratona de programação e ideias) realizada nas últimas edições da Campus Party (http://brasil.campus-party.org/) de Natal, Brasília e Salvador e o ‘DataWall’, uma visualização de dados orgânica (não-digital) feita coletivamente em ‘real time’ durante eventos.
Em contraponto, Cappra elenca os Riscos aos quais estamos sujeitos vivendo em um ‘mundo inundado de dados’:
- Caos
- Overdose
- Sociedade Condicionada
- Privacidade
- Decisões Sintéticas

O universo de dados desorganizados e caóticos é pouco útil. Seu uso inapropriado pode trazer prejuízos individuais e coletivos e até mesmo manipular governos e mercados. Cappra chama atenção ao cuidado que devemos ter com a overdose de informação.

Information Overload ou Infoxication (https://en.wikipedia.org/wiki/Information_overload) é um conceito atribuído ao sociólogo Georg Simmel (https://pt.wikipedia.org/wiki/Georg_Simmel) dos princípios do século XX e também foi tratado pelo psicólogo David Lewis (https://pt.wikipedia.org/wiki/David_Lewis) no seu artigo “Infofatigue Syndrome” (1990).

O cérebro humano não é capaz de processar o volume de informação disponível. Essa constatação permite a Cappra afirmar a necessidade de uma ‘inteligência aumentada’ só possível através de ‘cérebros sintéticos’ alimentados com algoritmos e inteligência artificial. No entanto, sua preocupação é centrada no uso da ciência como camada no tratamento da BigData. Só assim informações úteis podem ser utilizadas em tomadas de decisão e libertar a mente humana para o ato criativo já que esta é uma característica humana que as máquinas ainda não simulam.

Além disso, o cérebro é um músculo sujeito à fadiga. A mente cansada é pouco funcional, comumente falível e equivocada em momentos decisivos. Segundo Cappra, as decisões humanas podem ser de 3 tipos:
- aleatória ou criativa
- estruturada ou processual
- sistêmica ou analítica

O esforço mental exigido para cada uma dessas tarefas é bem diferente e ele assegura que com os instrumentos fornecidos pelas ciências de dados parte significativa das decisões processuais e analíticas podem ser automatizadas. Com algoritmos e IA as decisões artificiais ou sintéticas podem ser libertadoras.
Ainda quanto à cultura analítica, uma técnica estatística para análise de personalidade tem sido cada vez mais comum. A abordagem estatística de fatores psicológicos conhecida pela sigla OCEAN (https://en.wikipedia.org/wiki/Big_Five_personality_traits) tem sido utilizada para traçar o perfil de pessoas a partir de cinco traços de personalidade: abertura à experiência , conscienciosidade , extroversão , amabilidade e neuroticismo (openness to experience, conscientiousness, extraversion, agreeableness, and neuroticism).

Outros conceitos da psicologia e teóricos do comportamento como B. F. Skinner (https://en.wikipedia.org/wiki/B._F._Skinner) foram também citados. Ele fez uma alusão cômica ao famoso experimento da Caixa de Condicionamento Operante (conhecida como Skinner Box), chamando as experiências que o Facebook faz com seus usuários de ‘Zucker Box’ e apresentou correlações entre os testes de usabilidade (testes A/B) feitos por designers e desenvolvedores de sites e aplicativos.

Essas duas palestras foram realmente incríveis. Outras informações podem ser obtidas acompanhando o site e as redes sociais da Cappra Data Science.

Saiba mais:

Video campanha Path 2018
Projeto “Bias In / Bias Out”

DataWall no “Menos 30 Fest”

DataWall na “Campus Party 10”


#ReportTrendsPath
#FestivalPath
#Conectodos

19.4.18

3ª Conferência das Comunidades Python do Sudeste - #PythonSudeste 2018


Um evento feito pelas comunidades, para as comunidades.
Durante 3 dias São Paulo sediou um dos maiores encontros de Python do país.

A 3ª #PySE2018 foi realizada nos dias 30, 31 de março e 1º de abril na BandTec (http://www.digitalschool.com.br/faculdade/) com apoio da IDWall (https://idwall.co). Reuniu profissionais, estudantes, comunidades e entusiastas da linguagem que vieram de diversas partes do Brasil.

A organização foi encabeçada pelo Grupy-SP (https://github.com/grupy-sp) com a colaboração de outras comunidades Python e apoio da Associação Python Brasil (http://associacao.python.org.br). O engajamento foi grande e as inscrições foram disputadas. Os ingressos desta edição esgotaram com quase 15 dias de antecedência.

Toda concepção da Python Sudeste é colaborativa. As propostas de conteúdo são escolhidas por votação e todo dinheiro arrecadado volta em benefícios coletivos. O excedente é revertido para entidades de assistência e apoio em eventos futuros. As normas de conduta são levadas bem a sério sendo a política de inclusão e o repúdio ao assédio moral os pilares éticos exigidos no evento.

As Keynotes desta edição foram Paula Granjeiro (http://paulagrangeiro.com.br), Bernardo Fontes (https://github.com/berinhard) e Cassio Botaro (https://www.linkedin.com/in/cássio-botaro-6a2043b1/). Todos membros ativos e colaboradores assíduos da comunidade.

Além das Keynotes, nos três dias foram realizados diversos tutoriais, oficinas - introdutórias e avançadas, palestras técnicas, workshops e ligthning talks. Estas últimas são um show a parte pois permite que os participantes divulguem seus projetos, suas especialidades e interesses em pequenas palestras de até cinco minutos. É divertido, instigante e ajuda a manter as comunidades coesas.

Este ano as trilhas homenagearam mulheres pioneiras no mundo da programação: Ada Lovelace(https://pt.wikipedia.org/wiki/Ada_Lovelace), Grace Hopper (https://pt.wikipedia.org/wiki/Grace_Hopper), Dorothy Vaughan (https://pt.wikipedia.org/wiki/Dorothy_Vaughan), Mary Jackson (https://pt.wikipedia.org/wiki/Mary_Jackson) e Katherine Johnson (https://pt.wikipedia.org/wiki/Katherine_Johnson).

O PyBar é tradição nos encontros da comunidade e ocorreu em todos os dias do evento após a programação oficial em diferentes bares, restaurantes e karaokês de São Paulo. É um dos momentos mais mágicos pois é nessa hora que tiramos nossas dúvidas com descontração, criamos novos laços de amizades, animamos com o networking e encontramos novas oportunidades de trabalho e negócios.

O Python é como o canivete suíço das linguagens de programação pois abrange um grande ecossistema de soluções para web - do frontend ao backend - além de ser largamente utilizada na ciência de dados, no aprendizado de máquina e na inteligência artificial, na internet das coisas e muito mais.

É uma linguagem com crescente hype já há alguns anos. Nos EUA o Python já ultrapassou o Java como linguagem número 1 no ensino acadêmico e no Brasil a tendência é forte também nesse sentido. Características como a acentuada curva de aprendizagem favorecem a rápida adoção por empresas e o alto engajamento de iniciantes.

Na semana seguinte ao Python Sudeste ocorreu a Pytho Sul (https://pythonsul.org) - de 6 a 8 de abril em Florianópolis. Este ano teremos muitos eventos ainda como o PyData-DF, os AfroPython (https://www.facebook.com/AfroPython/), as DjangoGirls (https://djangogirls.org/), a Python Nordeste (https://2018.pythonnordeste.org), o Caipyra (http://caipyra.python.org.br) e o aguardado Python Brasil (https://2018.pythonbrasil.org.br) em outubro.

Muitas palestras foram gravadas e logo mais estarão em um dos canais da comunidade

http://pythonsudeste.org
https://www.facebook.com/pythonsudeste/
https://www.youtube.com/channel/UCLRXGSdAbsHGlSDMTTai51g

Quero deixar aqui meus parabéns e um sincero agradecimento a todas as comunidades de desenvolvedores Python, as verdadeiras estrelas de todos os eventos. Conheça algumas delas:
Grupy-SP
https://github.com/grupy-sp

SciPy-SP
https://www.facebook.com/SciPySP/

PyLadies-SP
https://www.facebook.com/PyLadiesSP/

Python-Rio
https://www.facebook.com/pythonrio

DjangoGirls
https://www.facebook.com/djangogirls

O que estão dizendo por aí:
https://escoladedados.org/2018/04/03/como-libertar-dados-publicos-usando-python/


Descubra as edições anteriores da Python Sudeste:
2016 - BH http://2016.pythonsudeste.org
2017 - Rio https://web.facebook.com/pg/pythonsudeste/photos/?tab=album&album_id=303043140123523
2018 - Sampa http://pythonsudeste.org

25.3.18

Ciência de Dados, Jornalismo e Gráficos

Segunda-feira (19/03/2018 foi dia de conhecer os poderes do Jornalismo junto a Ciência de Dados com a turma do Hack/Hackers São Paulo.

Você sabia que em 2009, Lula passou 25% do ano viajando? Que mais de 90% dos alunos dos cursos de Estética e Cosmédica são mulheres? Que o curso com maior percetagem de estudantes brancos é a Medicina? E que os salários dos juízes os tornam mais ricos que mais de 90% da população brasileira?...

Legal estes dados, não é? Individualmente e coletivamente o acesso a informação e a estruturação dos dados em grandes volumes (Big Data) trás experiências que norteiam o presente para um propósito futuro, resta-nos definirmos com clareza as metas, os objetivos que nos movem.

O cientista de dados Gabriel Zanlourenssi (mestrando em Ciência Política na USP, pesquisador da FGV-SP e do Núcleo de Estudos Comparados e Internacionais da USP) foi convidado para falar sobre a metologia usada pelo Nexo Jornal para gerar gráficos criativos com base em dados públicos.

Usando R Language e demonstrando cuidado minucioso na geração de gráficos, Gabriel expôs alguns dos resultados obtidos e citou referências internacionais e nacionais que norteiam a produção dos jornais baseado em dados.

Apontou a necessidade crescente de profissionais que reúnam a capacidade analítica interpretativa e a habilidade de manipular códigos de programação. Segundo ele, o mercado está aberto e à procura de 'fullstack developers' que entendam de política, economia e sociedade.

Conheça a página de gráficos do Nexo Jornal:
https://www.nexojornal.com.br/grafico/

Finalizando o encontro, o jornalista Reinaldo Chaves apresentou o resultado de uma 'raspagem' de dados que gerou o "Ruralômetro", uma página web que é uma ferramenta que permite o fácil acompanhamento do comportamento dos deputados federais da 'bancada ruralista' e suas relações com empresas do setor.

Reinaldo afirmou que antes desse trabalho pouco sabia sobre programação e ciência de dados tendo aprendido, no início, através de cursos gratuitos e vídeos no You Tube. Assim como eu, começou os estudos de Python pelo emblemático canal do professor Fernando Massanori, Python Para Zumbis.

Toda a documentação sobre o Ruralômetro você encontra no GitHub.

https://ruralometro.reporterbrasil.org.br