1000 resultados para Reconhecimento de imagens
Resumo:
The merit of the Karhunen-Loève transform is well known. Since its basis is the eigenvector set of the covariance matrix, a statistical, not functional, representation of the variance in pattern ensembles is generated. By using the Karhunen-Loève transform coefficients as a natural feature representation of a character image, the eigenvector set can be regarded as an feature extractor for a classifier.
Resumo:
The objective of this work is to use algorithms known as Boltzmann Machine to rebuild and classify patterns as images. This algorithm has a similar structure to that of an Artificial Neural Network but network nodes have stochastic and probabilistic decisions. This work presents the theoretical framework of the main Artificial Neural Networks, General Boltzmann Machine algorithm and a variation of this algorithm known as Restricted Boltzmann Machine. Computer simulations are performed comparing algorithms Artificial Neural Network Backpropagation with these algorithms Boltzmann General Machine and Machine Restricted Boltzmann. Through computer simulations are analyzed executions times of the different described algorithms and bit hit percentage of trained patterns that are later reconstructed. Finally, they used binary images with and without noise in training Restricted Boltzmann Machine algorithm, these images are reconstructed and classified according to the bit hit percentage in the reconstruction of the images. The Boltzmann machine algorithms were able to classify patterns trained and showed excellent results in the reconstruction of the standards code faster runtime and thus can be used in applications such as image recognition.
Resumo:
RESUMO - Métodos de reconhecimento de frutos baseados na utilização de diferentes descritores e classificadores foram estudados. Foi utilizada uma base de dados de 3.393 imagens de café e não-café anteriormente criada e rotulada manualmente. Testes quantitativos demonstraram a identificação de bagas com 93% de precisão e 77% de cobertura utilizando descritores HoG adicionados a mediana dos componentes de cor do formato La*b*, aliados ao classificador Gradient Boosting. Esses resultados melhoram o método anteriormente proposto por Santos (2015), e demonstram a possibilidade de evolução de métodos que podem ser aplicados em metodologias de agricultura de precisão, monitoramento e predição de safra.
Resumo:
A indústria de madeira tem dispensado especial atenção às etapas de classificação e seleção de madeira serrada. Sistemas de Visão Artificial têm sido propostos para automação dessas etapas na indústria. A identificação de características apropriadas para discriminar os defeitos da madeira em imagens digitais é um dos maiores desafios no desenvolvimento desta tecnologia. O objetivo deste trabalho foi avaliar, por meio de técnicas de análise multivariada, a capacidade de discriminar defeitos em tábuas de eucalipto, utilizando-se as características de percentis de imagens coloridas. Foram realizadas análises discriminantes linear e quadrática para classificação de defeitos e madeira limpa em imagens digitais de tábuas de eucaliptos. As características de percentis do histograma das bandas do vermelho, verde e azul, retiradas de dois tamanhos de blocos de imagens, foram utilizadas para desenvolvimento e teste das funções discriminantes. Foram usados 492 blocos, contendo os 12 defeitos estudados e madeira limpa, retirados das imagens de 40 tábuas amostradas aleatoriamente. As características foram analisadas com seus valores originais, escores dos componentes principais e escores das variáveis canônicas. Os menores erros globais de classificação foram 19 e 24% para funções discriminantes lineares com os escores das variáveis canônicas para tamanho de bloco de 64 x 64 e 32 x 32 pixels, respectivamente. Tendo em vista a magnitude desses erros, as características de percentis foram consideradas adequadas para discriminar defeitos e madeira limpa em imagens digitais.
Resumo:
Neste trabalho, foi aplicado o processamento de imagens digitais auxiliado pelas Redes Neurais Artificiais (RNA) com a finalidade de identificar algumas variedades de soja por meio da forma e do tamanho das sementes. Foram analisadas as seguintes variedades: EMBRAPA 133, EMBRAPA 184, COODETEC 205, COODETEC 206, EMBRAPA 48, SYNGENTA 8350, FEPAGRO 10 e MONSOY 8000 RR, safra 2005/2006. O processamento das imagens foi constituído pelas seguintes etapas: 1) Aquisição da imagem: as amostras de cada variedade foram fotografadas por máquina fotográfica Coolpix995, Nikon, com resolução de 3.34 megapixels; 2) Pré-processamento: um filtro de anti-aliasing foi aplicado para obter tons acinzentados da imagem; 3) Segmentação: foi realizada a detecção das bordas das sementes (Método de Prewitt), dilatação dessas bordas e remoção de segmentos não-necessários para a análise. 4) Representação: cada semente foi representada na forma de matriz binária 130x130, e 5) Reconhecimento e interpretação: foi utilizada uma rede neural feedforward multicamadas, com três camadas ocultas. O treinamento da rede foi realizado pelo método backpropagation. A validação da RNA treinada mostrou que o processamento aplicado pode ser usado para a identificação das variedades consideradas.
Resumo:
Trata-se de analisar os usos da racionalidade mimética em Jacques Lacan e Theodor Adorno, isto a fim de mostrar como, nos dois casos, encontramos uma estratégia de reflexão sobre a mimesis que a eleva à condição de elemento fundamental para uma teoria do reconhecimento que não se esgote na temática da intersubjetividade. Neste sentido, este estudo insere-se em uma pesquisa mais ampla a respeito dos modos de aproximação entre psicanálise lacaniana e Escola de Frankfurt no que diz respeito ao problema dos destinos da categoria de sujeito e dos processos de reconhecimento.
Resumo:
Sistemas de visão artificial são cada vez mais usados para auxiliar seres humanos a realizar diferentes tarefas. Estes sistemas são capazes de reconhecer padrões em imagens complexas. Técnicas de visão computacional têm encontrado crescente aplicação em estudos e sistemas de controle e monitoração de tráfego de automóveis. Uma das áreas de pesquisa que tem sido objeto de estudo por diferentes grupos é a leitura automática de placas de matrículas como forma de detectar transgressores, encontrar carros roubados ou efetuar estudos de origem/destino [BAR99]. Com o constante crescimento do volume de tráfego de automóvel e a limitada capacidade dos sensores convencionais, especialistas da área recorrem a técnicas de identificação automática de veículos para obter dados relativos ao escoamento de tráfego. A identificação automática de veículos tem tido essencialmente duas abordagens distintas: a utilização de transponders e a utilização de técnicas de visão computacional [INI85] . Estas são essencialmente úteis em casos em que não é viável obrigar os motoristas a instalar transponders em seus automóveis. No entanto, essas técnicas são mais sensíveis às condições atmosféricas e de iluminação tais como nevoeiros, chuva intensa, luz noturna, reflexos em superfícies, etc. Este trabalho apresenta um estudo de diversas técnicas de processamento de imagem objetivando o aperfeiçoamento de um sistema de identificação automática de placas de veículos. Este aperfeiçoamento está relacionado com a diminuição do tempo de execução necessário à localização e reconhecimento dos caracteres contidos nas placas dos veículos bem como a melhorar a taxa de sucesso no seu reconhecimento. A primeira versão do sistema de identificação da placas de veículos descrito em [SOU2000], desenvolvido no CPG-EE da UFRGS, denominado SIAV 1.0, localiza e extrai 91,3% das placas corretamente mas apresenta uma taxa de reconhecimento das placas de 37,3%, assim como um tempo de processamento não satisfatório. Neste trabalho, cujo sistema desenvolvido é denominado SIAV 2.0, a imagem é previamente processada através da aplicação de técnicas de realce da imagem. O principal objetivo das técnicas de realce é processar a imagem de modo que o resultado seja mais apropriado para uma aplicação específica do que a imagem original [GON93]. O sistema busca melhorar a qualidade da imagem eliminando ou suavizando sombras e reflexos presentes na cena em virtude da iluminação não controlada. Visando um menor tempo de execução durante o tratamento e análise da imagem um estudo estatístico baseado na distribuição gaussiana foi realizado de maneira a restringir a área de análise a ser processada. O SIAV possui duas redes neurais como ferramentas de reconhecimento de caracteres. A partir da análise dos diferentes modelos de redes neurais empregados na atualidade, foi desenvolvida uma nova arquitetura de rede a ser utilizada pelo SIAV 2.0 que oferece uma taxa de reconhecimento superior a rede neural usada no SIAV 1.0. Visando um melhor tempo de execução, a implementação em hardware dedicado para este modelo é abordado. Os testes foram realizados com três bancos de imagens obtidas por câmeras diferentes, inclusive por dispositivo "pardal" comercial. Estes testes foram realizados para verificar a efetividade dos algoritmos aperfeiçoados.
Resumo:
Em cenas naturais, ocorrem com certa freqüência classes espectralmente muito similares, isto é, os vetores média são muito próximos. Em situações como esta, dados de baixa dimensionalidade (LandSat-TM, Spot) não permitem uma classificação acurada da cena. Por outro lado, sabe-se que dados em alta dimensionalidade [FUK 90] tornam possível a separação destas classes, desde que as matrizes covariância sejam suficientemente distintas. Neste caso, o problema de natureza prática que surge é o da estimação dos parâmetros que caracterizam a distribuição de cada classe. Na medida em que a dimensionalidade dos dados cresce, aumenta o número de parâmetros a serem estimados, especialmente na matriz covariância. Contudo, é sabido que, no mundo real, a quantidade de amostras de treinamento disponíveis, é freqüentemente muito limitada, ocasionando problemas na estimação dos parâmetros necessários ao classificador, degradando portanto a acurácia do processo de classificação, na medida em que a dimensionalidade dos dados aumenta. O Efeito de Hughes, como é chamado este fenômeno, já é bem conhecido no meio científico, e estudos vêm sendo realizados com o objetivo de mitigar este efeito. Entre as alternativas propostas com a finalidade de mitigar o Efeito de Hughes, encontram-se as técnicas de regularização da matriz covariância. Deste modo, técnicas de regularização para a estimação da matriz covariância das classes, tornam-se um tópico interessante de estudo, bem como o comportamento destas técnicas em ambientes de dados de imagens digitais de alta dimensionalidade em sensoriamento remoto, como por exemplo, os dados fornecidos pelo sensor AVIRIS. Neste estudo, é feita uma contextualização em sensoriamento remoto, descrito o sistema sensor AVIRIS, os princípios da análise discriminante linear (LDA), quadrática (QDA) e regularizada (RDA) são apresentados, bem como os experimentos práticos dos métodos, usando dados reais do sensor. Os resultados mostram que, com um número limitado de amostras de treinamento, as técnicas de regularização da matriz covariância foram eficientes em reduzir o Efeito de Hughes. Quanto à acurácia, em alguns casos o modelo quadrático continua sendo o melhor, apesar do Efeito de Hughes, e em outros casos o método de regularização é superior, além de suavizar este efeito. Esta dissertação está organizada da seguinte maneira: No primeiro capítulo é feita uma introdução aos temas: sensoriamento remoto (radiação eletromagnética, espectro eletromagnético, bandas espectrais, assinatura espectral), são também descritos os conceitos, funcionamento do sensor hiperespectral AVIRIS, e os conceitos básicos de reconhecimento de padrões e da abordagem estatística. No segundo capítulo, é feita uma revisão bibliográfica sobre os problemas associados à dimensionalidade dos dados, à descrição das técnicas paramétricas citadas anteriormente, aos métodos de QDA, LDA e RDA, e testes realizados com outros tipos de dados e seus resultados.O terceiro capítulo versa sobre a metodologia que será utilizada nos dados hiperespectrais disponíveis. O quarto capítulo apresenta os testes e experimentos da Análise Discriminante Regularizada (RDA) em imagens hiperespectrais obtidos pelo sensor AVIRIS. No quinto capítulo são apresentados as conclusões e análise final. A contribuição científica deste estudo, relaciona-se à utilização de métodos de regularização da matriz covariância, originalmente propostos por Friedman [FRI 89] para classificação de dados em alta dimensionalidade (dados sintéticos, dados de enologia), para o caso especifico de dados de sensoriamento remoto em alta dimensionalidade (imagens hiperespectrais). A conclusão principal desta dissertação é que o método RDA é útil no processo de classificação de imagens com dados em alta dimensionalidade e classes com características espectrais muito próximas.
Resumo:
Com o advento dos sensores hiperespectrais se tornou possível em sensoriamento remoto, uma serie de diferentes aplicações. Uma delas, é a possibilidade de se discriminar classes com comportamentos espectrais quase idênticas. Porém um dos principais problemas encontrados quando se trabalha com dados de alta dimensionalidade, é a dificuldade em estimar os inúmeros parâmetros que se fazem necessários. Em situações reais é comum não se ter disponibilidade de tamanho de amostra suficiente, por exemplo, para se estimar a matriz de covariâncias de forma confiável. O sensor AVIRIS fornece uma riqueza de informações sobre os alvos, são 224 bandas cobrindo o espectro eletromagnético, o que permite a observação do comportamento espectral dos alvos de forma muito detalhada. No entanto surge a dificuldade de se contar com uma amostra suficiente para se estimar a matriz de covariâncias de uma determinada classe quando trabalhamos com dados do sensor AVIRIS, para se ter uma idéia é preciso estimar 25.200 parâmetros somente na matriz de covariâncias, o que necessitaria de uma amostra praticamente impraticável na realidade. Surge então a necessidade de se buscar formas de redução da dimensionalidade, sem que haja perda significativa de informação. Esse tipo de problema vem sendo alvo de inúmeros estudos na comunidade acadêmica internacional. Em nosso trabalho pretendemos sugerir a redução da dimensionalidade através do uso de uma ferramenta da geoestatística denominada semivariograma. Investigaremos se os parâmetros calculados para determinadas partições do transecto de bandas do sensor AVIRIS são capazes de gerar valores médios distintos para classes com comportamentos espectrais muito semelhantes, o que por sua vez, facilitaria a classificação/discriminação destas classes.
Resumo:
Fundação de Amparo à Pesquisa do Estado de São Paulo (FAPESP)
Resumo:
Atualmente, a disponibilização de informações alimentares e nutricionais em estabelecimentos da área de alimentação não é obrigatória. Porém, os consumidores podem, fácil e rapidamente, obter informações precisas em sites confiáveis ou por meio de aplicativos sobre a composição nutricional e calórica de alimentos. Estudos recentes mostram a importância não só do controle da ingestão diária de calorias, mas também do consumo de carboidratos, que são os nutrientes mais responsáveis por elevar o nível de glicose no sangue. O objetivo deste trabalho é propor um modelo para reconhecimento de alimentos em imagens de refeições por meio de técnicas de Processamento Digital de Imagens, possibilitando assim, a estimativa dos valores nutricionais, calóricos e glicêmicos dos alimentos identificados. Serão analisadas imagens de refeições e mediante reconhecimento, serão estimados os valores calóricos, nutricionais e glicêmicos de cada alimento identificado e da refeição. O procedimento de construção do artefato será conduzido pelo método Design Science Research. O resultado esperado com a finalização do trabalho é o modelo de reconhecimento de alimentos em imagens de refeições e de disponibilização de informações nutricionais, calóricas e glicêmicas validado.
Resumo:
No panorama socioeconómico atual, a contenção de despesas e o corte no financiamento de serviços secundários consumidores de recursos conduzem à reformulação de processos e métodos das instituições públicas, que procuram manter a qualidade de vida dos seus cidadãos através de programas que se mostrem mais eficientes e económicos. O crescimento sustentado das tecnologias móveis, em conjunção com o aparecimento de novos paradigmas de interação pessoa-máquina com recurso a sensores e sistemas conscientes do contexto, criaram oportunidades de negócio na área do desenvolvimento de aplicações com vertente cívica para indivíduos e empresas, sensibilizando-os para a disponibilização de serviços orientados ao cidadão. Estas oportunidades de negócio incitaram a equipa do projeto a desenvolver uma plataforma de notificação de problemas urbanos baseada no seu sistema de informação geográfico para entidades municipais. O objetivo principal desta investigação foca a idealização, conceção e implementação de uma solução completa de notificação de problemas urbanos de caráter não urgente, distinta da concorrência pela facilidade com que os cidadãos são capazes de reportar situações que condicionam o seu dia-a-dia. Para alcançar esta distinção da restante oferta, foram realizados diversos estudos para determinar características inovadoras a implementar, assim como todas as funcionalidades base expectáveis neste tipo de sistemas. Esses estudos determinaram a implementação de técnicas de demarcação manual das zonas problemáticas e reconhecimento automático do tipo de problema reportado nas imagens, ambas desenvolvidas no âmbito deste projeto. Para a correta implementação dos módulos de demarcação e reconhecimento de imagem, foram feitos levantamentos do estado da arte destas áreas, fundamentando a escolha de métodos e tecnologias a integrar no projeto. Neste contexto, serão apresentadas em detalhe as várias fases que constituíram o processo de desenvolvimento da plataforma, desde a fase de estudo e comparação de ferramentas, metodologias, e técnicas para cada um dos conceitos abordados, passando pela proposta de um modelo de resolução, até à descrição pormenorizada dos algoritmos implementados. Por último, é realizada uma avaliação de desempenho ao par algoritmo/classificador desenvolvido, através da definição de métricas que estimam o sucesso ou insucesso do classificador de objetos. A avaliação é feita com base num conjunto de imagens de teste, recolhidas manualmente em plataformas públicas de notificação de problemas, confrontando os resultados obtidos pelo algoritmo com os resultados esperados.
Resumo:
As novas tecnologias aplicadas ao processamento de imagem e reconhecimento de padrões têm sido alvo de um grande progresso nas últimas décadas. A sua aplicação é transversal a diversas áreas da ciência, nomeadamente a área da balística forense. O estudo de evidências (invólucros e projeteis) encontradas numa cena de crime, recorrendo a técnicas de processamento e análise de imagem, é pertinente pelo facto de, aquando do disparo, as armas de fogo imprimirem marcas únicas nos invólucros e projéteis deflagrados, permitindo relacionar evidências deflagradas pela mesma arma. A comparação manual de evidências encontradas numa cena de crime com evidências presentes numa base de dados, em termos de parâmetros visuais, constitui uma abordagem demorada. No âmbito deste trabalho pretendeu-se desenvolver técnicas automáticas de processamento e análise de imagens de evidências, obtidas através do microscópio ótico de comparação, tendo por base algoritmos computacionais. Estes foram desenvolvidos com recurso a pacotes de bibliotecas e a ferramentas open-source. Para a aquisição das imagens de evidências balísticas foram definidas quatro modalidades de aquisição: modalidade Planar, Multifocus, Microscan e Multiscan. As imagens obtidas foram aplicados algoritmos de processamento especialmente desenvolvidos para o efeito. A aplicação dos algoritmos de processamento permite a segmentação de imagem, a extração de características e o alinhamento de imagem. Este último tem como finalidade correlacionar as evidências e obter um valor quantitativo (métrica), indicando o quão similar essas evidências são. Com base no trabalho desenvolvido e nos resultados obtidos, foram definidos protocolos de aquisição de imagens de microscopia, que possibilitam a aquisição de imagens das regiões passiveis de serem estudadas, assim como algoritmos que permitem automatizar o posterior processo de alinhamento de imagens de evidências, constituindo uma vantagem em relação ao processo de comparação manual.
Resumo:
Dissertação para obtenção do Grau de Mestre em Engenharia Biomédica
Resumo:
Quando iniciei, no Bairro do Alto da Cova da Moura, o trabalho que deu origem a esta tese, apercebi-me que era ali que os tambores se poderiam reinventar, que os ritmos anteriormente vividos ou escutados se recriavam na batida do pilão, na forma de fazer rapé, no funaná, na música rap ou no Colá S. Jon. Foi neste contexto ambíguo de construções culturais simultaneamente reflexivas e experienciais que procurei uma estadia longa no terreno, a passagem para o interior do bairro, espaço-tempo da pesquisa, a construção de um objeto de estudo e de um percurso metodológico. A experiência de campo mostrava-se-me como um processo dialéctico e dinâmico, como construção dialógica e pragmática, através da qual trabalhava o terreno como um meio simultaneamente de comunicação e conhecimento e procurava encontrar nos métodos modos de reconstrução das condições de produção dos saberes. Residia aí o problema do espaço afetivo e intelectual, vital e ao mesmo tempo cognitivo, que é a observação de terreno enquanto diálogo e processo de palavra. Havia que ter em conta a experiência pragmática e comunicativa de terreno, através das resistências e da receção afável, dos mal entendidos e compromissos, dos rituais interativos, da tomada de consciência da observação do observador, que estão na base da construção e da legitimação do terreno como espaço-tempo da pesquisa. A inserção no terreno permitiu-me a viagem por muitos temas possíveis, por muitas áreas de investigação. O percurso realizado conduziu-me a este trabalho que constitui uma abordagem dos processos de produção e reprodução de um ritual cabo-verdiano, Colá S. Jon, na Cova da Moura, um dos bairros da periferia urbana de Lisboa. A tese é uma construção etnográfica, por comparação e contraste, de múltiplos fazeres, (re)fazeres a muitas vozes. Vozes dos que o fazem, repetem, dizem. Vozes do quotidiano ou escrita de poetas que o consideram, “prenda má grande dum pôve e que tá fazê parte de sê vida”(Frusoni). Saber dos antropólogos que o dizem “imagem e metáfora da forma como os cabo-verdianos se representam”, modo como se contam a si, para si, para os outros. É também representação de uma comunidade que se explica a si mesma, e ao explicar-se se constrói para si e para os outros a partir de dois eixos, de duas histórias que simultaneamente se cruzam e diferenciam: uma explicitada pelas palavras e simbolizada pela dança do colá, veiculando o contexto social e cultural das interações e dos processos sociais; outra sugerida pela dança do navio, representando a historicidade de um povo - o cruzamento dos destinos de homens e mulheres que atravessando os mares atraídos pela aventura, arrastados ou empurrados pela tragédia se juntaram e plantaram na terra escassa e pobre das Ilhas, no centro do Atlântico, daí partindo ainda hoje, numa repetição incessante do ciclo da aventura, da tragédia ou da procura, na “terra longe”, da esperança de uma vida melhor. A reconstituição do Colá S. Jon, fora do país de origem, confrontada com outras realidades sociais adquire, neste contexto, novas dimensões e sublinha outras já existentes. Adquire a forma elegíaca da recordação, espécie de realidade ontológica da origem fixada num tempo e num espaço; a de lugar de tensão dialéctica com a sociedade recetora no processo migratório e de consciência reflexiva da diversidade e alteridade resultante do encontro ou do choque com outra cultura; a de simulacro tornando-se objeto repetível, espetáculo em que ressaltam sobretudo a forma estética ou força dramática, um real sem origem na realidade ou produto de outra realidade, a da praxis ou conveniência política distante da participação dos seus atores. A tese coloca-nos perante o questionamento, o olhar reflexivo, da pesquisa antropológica: simultaneamente experiência social e ritual única, relação dialógica com os atores sociais, processo de mediação, de comunicação, e a consequente dimensão epistemológica, ética e política da antropologia. Coloca-nos também perante a viagem ritual - passagem ao terreno, à imagem e à escrita – e a consequente procura de reconhecimento e aceitação do percurso realizado. O processo de produção do filme Colá S. Jon, Oh que Sabe! completa-se com o da escrita, síntese de uma experiência e aparelho crítico do filme. Ambos tem uma matriz epistemológica comum. Resultam da negociação da diferença entre o “Eu” e o “Outro” e da complexa relação entre a experiência vivida no terreno, os saberes locais, os pressupostos teóricos do projeto antropológico. Ao mesmo tempo que recusam a generalização, refletem uma construção dialógica, uma necessária relação de tensão e de porosidade entre experiências e saberes, uma ligação ambígua entre a participação numa experiência vivida e a necessária distanciação objetivante que está subjacente em qualquer atividade de tradução ou negociação intercultural, diatópica.