To see the other types of publications on this topic, follow the link: Traitement multimodal.

Dissertations / Theses on the topic 'Traitement multimodal'

Create a spot-on reference in APA, MLA, Chicago, Harvard, and other styles

Select a source type:

Consult the top 50 dissertations / theses for your research on the topic 'Traitement multimodal.'

Next to every source in the list of references, there is an 'Add to bibliography' button. Press on it, and we will generate automatically the bibliographic reference to the chosen work in the citation style you need: APA, MLA, Harvard, Chicago, Vancouver, etc.

You can also download the full text of the academic publication as pdf and read online its abstract whenever available in the metadata.

Browse dissertations / theses on a wide variety of disciplines and organise your bibliography correctly.

1

Dourlens, Sébastien. "Multimodal interaction semantic architecture for ambient intelligence." Versailles-St Quentin en Yvelines, 2012. http://www.theses.fr/2012VERS0011.

Full text
Abstract:
Il existe encore de nombreux domaines dans lesquels des moyens doivent être explorés pour améliorer l'interaction homme-système. Ces systèmes doivent avoir la capacité de tirer avantage de l'environnement pour améliorer l'interaction. Et ceci afin d'étendre les capacités du système (machine ou robot) dans le but de se rapprocher du langage naturel utilisé par les êtres humains. Nous proposons une méthodologie pour résoudre le problème d'interaction multimodale adaptée aux différents contextes en définissant et modélisant une architecture distribuée qui s'appuie sur les standards du W3C et des
APA, Harvard, Vancouver, ISO, and other styles
2

Chlaily, Saloua. "Modèle d'interaction et performances du traitement du signal multimodal." Thesis, Université Grenoble Alpes (ComUE), 2018. http://www.theses.fr/2018GREAT026/document.

Full text
Abstract:
Bien que le traitement conjoint des mesures multimodales soit supposé conduire à de meilleures performances que celles obtenues en exploitant une seule modalité ou plusieurs modalités indépendamment, il existe des exemples en littérature qui prouvent que c'est pas toujours vrai. Dans cette thèse, nous analysons rigoureusement, en termes d'information mutuelle et d'erreur d'estimation, les différentes situations de l'analyse multimodale afin de déterminer les conditions conduisant à des performances optimales.Dans la première partie, nous considérons le cas simple de deux ou trois modalités, ch
APA, Harvard, Vancouver, ISO, and other styles
3

Caglayan, Ozan. "Multimodal Machine Translation." Thesis, Le Mans, 2019. http://www.theses.fr/2019LEMA1016/document.

Full text
Abstract:
La traduction automatique vise à traduire des documents d’une langue à une autre sans l’intervention humaine. Avec l’apparition des réseaux de neurones profonds (DNN), la traduction automatique neuronale(NMT) a commencé à dominer le domaine, atteignant l’état de l’art pour de nombreuses langues. NMT a également ravivé l’intérêt pour la traduction basée sur l’interlangue grâce à la manière dont elle place la tâche dans un cadre encodeur-décodeur en passant par des représentations latentes. Combiné avec la flexibilité architecturale des DNN, ce cadre a aussi ouvert une piste de recherche sur la
APA, Harvard, Vancouver, ISO, and other styles
4

Choumane, Ali Siroux Jacques. "Traitement générique des références dans le cadre multimodal parole-image-tactile." Rennes : [s.n.], 2008. ftp://ftp.irisa.fr/techreports/theses/2008/choumane.pdf.

Full text
APA, Harvard, Vancouver, ISO, and other styles
5

Choumane, Ali. "Traitement générique des références dans le cadre multimodal parole-image-tactile." Rennes 1, 2008. ftp://ftp.irisa.fr/techreports/theses/2008/choumane.pdf.

Full text
Abstract:
Nous nous intéressons dans cette thèse aux systèmes de communication homme-machine multimodale qui utilisent les modes suivants : la parole, le geste et le visuel. L'usager communique avec le système par un énoncé oral en langue naturelle et/ou un geste. Dans sa requête, encodée sur les différentes modalités, l'usager exprime son but et désigne des objets (référents) nécessaires à la réalisation de ce but. Le système doit identifier de manière précise et non ambiguë ces objets désignés. Afin d'améliorer la compréhension automatique des requêtes multimodales dans ce contexte, nous proposons un
APA, Harvard, Vancouver, ISO, and other styles
6

Sarrut, David Miguet Serge. "Recalage multimodal et plate-forme d'imagerie médicale à accès distant." [S.l.] : [s.n.], 2000. http://demeter.univ-lyon2.fr:8080/sdx/theses/lyon2/2000/sarrut_d.

Full text
APA, Harvard, Vancouver, ISO, and other styles
7

Sarrut, David. "Recalage multimodal et plate-forme d'imagerie médicale à accès distant." Lyon 2, 2000. http://theses.univ-lyon2.fr/documents/lyon2/2000/sarrut_d.

Full text
Abstract:
Les recherches présentées dans cette thèse s'insèrent dans divers projets concernant le recalage d'images médicales et l'étude de techniques haute-performance destinées aux environnements hospitaliers. Le recalage multimodal consiste à mettre en correspondance un couple d'images de façon à pouvoir fusionner les informations de chacune d'elles. Nous présentons tout d'abord une classification synthétique de nombreuses mesures de similarité en mettant l'accent sur les hypothèses sous-jacentes à la nature des liens entre les distributions d'intensités. Puis nous proposons plusieurs procédures d'in
APA, Harvard, Vancouver, ISO, and other styles
8

Cadène, Rémi. "Deep Multimodal Learning for Vision and Language Processing." Electronic Thesis or Diss., Sorbonne université, 2020. http://www.theses.fr/2020SORUS277.

Full text
Abstract:
Les technologies du numérique ont joué un rôle déterminant dans la transformation de notre société. Des méthodes statistiques récentes ont été déployées avec succès afin d’automatiser le traitement de la quantité croissante d’images, de vidéos et de textes que nous produisons quotidiennement. En particulier, les réseaux de neurones profonds ont été adopté par les communautés de la vision par ordinateur et du traitement du langage naturel pour leur capacité à interpréter le contenu des images et des textes une fois entraînés sur de grands ensembles de données. Les prog
APA, Harvard, Vancouver, ISO, and other styles
9

Chen, Jianan. "Deep Learning Based Multimodal Retrieval." Electronic Thesis or Diss., Rennes, INSA, 2023. http://www.theses.fr/2023ISAR0019.

Full text
Abstract:
Les tâches multimodales jouent un rôle crucial dans la progression vers l'atteinte de l'intelligence artificielle (IA) générale. L'objectif principal de la recherche multimodale est d'exploiter des algorithmes d'apprentissage automatique pour extraire des informations sémantiques pertinentes, en comblant le fossé entre différentes modalités telles que les images visuelles, le texte linguistique et d'autres sources de données. Il convient de noter que l'entropie de l'information associée à des données hétérogènes pour des sémantiques de haut niveau identiques varie considérablement, ce qui pose
APA, Harvard, Vancouver, ISO, and other styles
10

Delecraz, Sébastien. "Approches jointes texte/image pour la compréhension multimodale de documents." Thesis, Aix-Marseille, 2018. http://www.theses.fr/2018AIXM0634/document.

Full text
Abstract:
Les mécanismes de compréhension chez l'être humain sont par essence multimodaux. Comprendre le monde qui l'entoure revient chez l'être humain à fusionner l'information issue de l'ensemble de ses récepteurs sensoriels. La plupart des documents utilisés en traitement automatique de l'information sont multimodaux. Par exemple, du texte et des images dans des documents textuels ou des images et du son dans des documents vidéo. Cependant, les traitements qui leurs sont appliqués sont le plus souvent monomodaux. Le but de cette thèse est de proposer des traitements joints s'appliquant principalement
APA, Harvard, Vancouver, ISO, and other styles
11

Ranisavljević, Elisabeth. "Cloud computing appliqué au traitement multimodal d’images in situ pour l’analyse des dynamiques environnementales." Thesis, Toulouse 2, 2016. http://www.theses.fr/2016TOU20128/document.

Full text
Abstract:
L’analyse des paysages, de ses dynamiques et ses processus environnementaux, nécessite d’acquérir régulièrement des données des sites, notamment pour le bilan glaciaire au Spitsberg et en haute montagne. A cause des mauvaises conditions climatiques communes aux latitudes polaires et à cause de leur coût, les images satellites journalières ne sont pas toujours accessibles. De ce fait, les événements rapides comme la fonte de la neige ou l'enneigement ne peuvent pas être étudiés à partir des données de télédétection à cause de leur fréquence trop faible. Nous avons complété les images satellites
APA, Harvard, Vancouver, ISO, and other styles
12

Atif, Jamal. "Recalage non-rigide multimodal des images radiologiques par information mutuelle quadratique normalisée." Paris 11, 2004. http://www.theses.fr/2004PA112337.

Full text
APA, Harvard, Vancouver, ISO, and other styles
13

Delecraz, Sébastien. "Approches jointes texte/image pour la compréhension multimodale de documents." Electronic Thesis or Diss., Aix-Marseille, 2018. http://www.theses.fr/2018AIXM0634.

Full text
Abstract:
Les mécanismes de compréhension chez l'être humain sont par essence multimodaux. Comprendre le monde qui l'entoure revient chez l'être humain à fusionner l'information issue de l'ensemble de ses récepteurs sensoriels. La plupart des documents utilisés en traitement automatique de l'information sont multimodaux. Par exemple, du texte et des images dans des documents textuels ou des images et du son dans des documents vidéo. Cependant, les traitements qui leurs sont appliqués sont le plus souvent monomodaux. Le but de cette thèse est de proposer des traitements joints s'appliquant principalement
APA, Harvard, Vancouver, ISO, and other styles
14

Fares, Mireille. "Multimodal Expressive Gesturing With Style." Electronic Thesis or Diss., Sorbonne université, 2023. http://www.theses.fr/2023SORUS017.

Full text
Abstract:
La génération de gestes expressifs permet aux agents conversationnels animés (ACA) d'articuler un discours d'une manière semblable à celle des humains. Le thème central du manuscrit est d'exploiter et contrôler l'expressivité comportementale des ACA en modélisant le comportement multimodal que les humains utilisent pendant la communication. Le but est (1) d’exploiter la prosodie de la parole, la prosodie visuelle et le langage dans le but de synthétiser des comportements expressifs pour les ACA; (2) de contrôler le style des gestes synthétisés de manière à pouvoir les générer avec le style de
APA, Harvard, Vancouver, ISO, and other styles
15

Aron, Michaël. "Acquisition et modélisation de données articulatoires dans un contexte multimodal." Thesis, Nancy 1, 2009. http://www.theses.fr/2009NAN10097/document.

Full text
Abstract:
La connaissance des positions et des mouvements des articulateurs (lèvres, palais, langue...) du conduit vocal lors de la phonation est un enjeu crucial pour l’étude de la parole. Puisqu’il n’existe pas encore de système permettant l’acquisition de ces positions et de ces mouvements, ce travail de thèse s’intéresse à la fusion de plusieurs modalités d’imagerie et de capteurs de localisation pour l’acquisition des positions des articulateurs dans l’espace et dans le temps. Nous décrivons un ensemble de protocoles et de méthodes pour obtenir et fusionner automatiquement un important volume de do
APA, Harvard, Vancouver, ISO, and other styles
16

Ouenniche, Kaouther. "Multimodal deep learning for audiovisual production." Electronic Thesis or Diss., Institut polytechnique de Paris, 2023. http://www.theses.fr/2023IPPAS020.

Full text
Abstract:
Dans le contexte en constante évolution du contenu audiovisuel, la nécessité cruciale d'automatiser l'indexation et l'organisation des archives s'est imposée comme un objectif primordial. En réponse, cette recherche explore l'utilisation de techniques d'apprentissage profond pour automatiser l'extraction de métadonnées diverses dans les archives, améliorant ainsi leur accessibilité et leur réutilisation. La première contribution de cette recherche concerne la classification des mouvements de caméra. Il s'agit d'un aspect crucial de l'indexation du contenu, car il permet une catégorisation effi
APA, Harvard, Vancouver, ISO, and other styles
17

Kruk, Dominika. "Multimodal Imaging of the heart muscle - Analysis and visualization to aided diagnosis." Thesis, Bourgogne Franche-Comté, 2019. http://www.theses.fr/2019UBFCK070.

Full text
Abstract:
Le cœur joue un rôle vital dans le fonctionnement du corps humain. La fonction du cœur humain est de pomper le sang dans tout le corps, fournissant de l’oxygène et des nutriments aux tissus et en éliminant le dioxyde de carbone et d’autres déchets. Les maladies cardiovasculaires sont la première cause de décès dans le monde. Les maladies cardiaques sont principalement liées à un processus appelé athérosclérose. Ce processus cause un flux sanguin plus difficile à travers les artères et finalement il peut arrêter le flux sanguin. Il peut conduire à une crise cardiaque et un accident vasculaire c
APA, Harvard, Vancouver, ISO, and other styles
18

Meseguer, Brocal Gabriel. "Multimodal analysis : informed content estimation and audio source separation." Electronic Thesis or Diss., Sorbonne université, 2020. http://www.theses.fr/2020SORUS111.

Full text
Abstract:
Cette thèse propose l'étude de l'apprentissage multimodal dans le contexte de signaux musicaux. Tout au long de ce manuscrit, nous nous concentrerons sur l'interaction entre les signaux audio et les informations textuelles. Parmi les nombreuses sources de texte liées à la musique qui peuvent être utilisées (par exemple les critiques, les métadonnées ou les commentaires des réseaux sociaux), nous nous concentrerons sur les paroles. La voix chantée relie directement le signal audio et les informations textuelles d'une manière unique, combinant mélodie et paroles où une dimension linguistique com
APA, Harvard, Vancouver, ISO, and other styles
19

Rabhi, Sara. "Optimized deep learning-based multimodal method for irregular medical timestamped data." Electronic Thesis or Diss., Institut polytechnique de Paris, 2022. http://www.theses.fr/2022IPPAS003.

Full text
Abstract:
L'adoption des dossiers médicaux électroniques dans les systèmes d'information des hôpitaux a conduit à la définition de bases de données regroupant divers types de données telles que des notes cliniques textuelles, des événements médicaux longitudinaux et des informations statiques sur les patients. Toutefois, les données ne sont renseignées que lors des consultations médicales ou des séjours hospitaliers. La fréquence de ces visites varie selon l’état de santé du patient. Ainsi, un système capable d'exploiter les différents types de données collectées à différentes échelles de temps est esse
APA, Harvard, Vancouver, ISO, and other styles
20

Pouteau, Xavier. "Dialogue de commande multimodal en milieu opérationnel : une communication naturelle pour l'utilisateur ?" Nancy 1, 1995. http://www.theses.fr/1995NAN10419.

Full text
Abstract:
La communication multimodale entre un opérateur et une machine est souvent abordée comme un élément de solution à la complexité croissante des systèmes commandés. Pour autant, la propriété "multimodale" d'un système ne lui confère pas nécessairement la qualité d'être "naturel", ni efficace ou acceptable. Le travail présenté consiste donc dans une première partie à caractériser la communication multimodale du point de vue de l'utilisateur, c'est à dire par les modes effectivement utilisés par celui-ci (la parole et le geste), en situant notamment les niveaux d'interaction envisageables entre pa
APA, Harvard, Vancouver, ISO, and other styles
21

Ma, Ta-Yu. "Modèle dynamique de transport basé sur les activités." Marne-la-vallée, ENPC, 2007. https://pastel.archives-ouvertes.fr/pastel-00003309.

Full text
Abstract:
Le travail de recherche porte sur deux thèmes: 1. Développement d’un modèle dynamique multimodal basé sur les activités ; 2. Développement de méthodes de résolution de l’équilibre du réseau multimodal dynamique. Nous proposons un modèle dynamique multimodal simulant l’enchaînement des déplacements basé sur les activités. Deux nouvelles méthodes de résolution du problème d’équilibre du réseau sont proposées : 1. L’algorithme de colonie de fourmis en discrétisation temporelle ; 2. La méthode de l’Entropie Relative. Cette dernière constitue une avancée méthodologique qui considère que l’équilibre
APA, Harvard, Vancouver, ISO, and other styles
22

Znaidia, Amel. "Handling Imperfections for Multimodal Image Annotation." Phd thesis, Ecole Centrale Paris, 2014. http://tel.archives-ouvertes.fr/tel-01012009.

Full text
Abstract:
This thesis deals with multimodal image annotation in the context of social media. We seek to take advantage of textual (tags) and visual information in order to enhance the image annotation performances. However, these tags are often noisy, overly personalized and only a few of them are related to the semantic visual content of the image. In addition, when combining prediction scores from different classifiers learned on different modalities, multimodal image annotation faces their imperfections (uncertainty, imprecision and incompleteness). Consequently, we consider that multimodal image ann
APA, Harvard, Vancouver, ISO, and other styles
23

Zablocki, Éloi. "Multimodal machine learning : complementarity of textual and visual contexts." Electronic Thesis or Diss., Sorbonne université, 2019. http://www.theses.fr/2019SORUS409.

Full text
Abstract:
L'interaction entre le langage et la vision reste relativement peu explorée malgré un intérêt grandissant. Au-delà des différences triviales entre textes et images, ces deux modalités portent des sémantiques distinctes. D'une part, le langage peut exprimer une sémantique de haut niveau sur le monde, mais il est biaisé dans le sens qu’une grande partie de son contenu est implicite (sens commun). D'autre part, les images sont des agrégats de niveaux inférieurs informations, mais elles donnent accès plus directement aux statistiques du monde réel et peuvent être utilisées pour ancrer l'apprentiss
APA, Harvard, Vancouver, ISO, and other styles
24

Mitra, Jhimli. "Multimodal Image Registration applied to Magnetic Resonance and Ultrasound Prostatic Images." Phd thesis, Université de Bourgogne, 2012. http://tel.archives-ouvertes.fr/tel-00786032.

Full text
Abstract:
This thesis investigates the employment of different deformable registration techniques to register pre-operative magnetic resonance and inter-operative ultrasound images during prostate biopsy. Accurate registration ensures appropriate biopsy sampling of malignant prostate tissues and reduces the rate of re-biopsies. Therefore, we provide comparisons and experimental results for some landmark- and intensity-based registration methods: thin-plate splines, free-form deformation with B-splines. The primary contribution of this thesis is a new spline-based diffeomorphic registration framework for
APA, Harvard, Vancouver, ISO, and other styles
25

Bonazza, Pierre. "Système de sécurité biométrique multimodal par imagerie, dédié au contrôle d’accès." Thesis, Bourgogne Franche-Comté, 2019. http://www.theses.fr/2019UBFCK017/document.

Full text
Abstract:
Les travaux de recherche de cette thèse consistent à mettre en place des solutions performantes et légères permettant de répondre aux problèmes de sécurisation de produits sensibles. Motivé par une collaboration avec différents acteurs au sein du projet Nuc-Track,le développement d'un système de sécurité biométrique, possiblement multimodal, mènera à une étude sur différentes caractéristiques biométriques telles que le visage, les empreintes digitales et le réseau vasculaire. Cette thèse sera axée sur une adéquation algorithme et architecture, dans le but de minimiser la taille de stockage des
APA, Harvard, Vancouver, ISO, and other styles
26

Toulouse, Tom. "Estimation par stéréovision multimodale de caractéristiques géométriques d’un feu de végétation en propagation." Thesis, Corte, 2015. http://www.theses.fr/2015CORT0009/document.

Full text
Abstract:
Les travaux menés dans cette thèse concernent le développement d'un dispositif de vision permettant l'estimation de caractéristiques géométriques d'un feu de végétation en propagation. Ce dispositif est composé de plusieurs systèmes de stéréovision multimodaux générant des paires d'images stéréoscopiques à partir desquelles des points tridimensionnels sont calculés et les caractéristiques géométriques de feu tels que sa position, vitesse, hauteur, profondeur, inclinaison, surface et volume sont estimées. La première contribution importante de cette thèse est la détection de pixels de feu de vé
APA, Harvard, Vancouver, ISO, and other styles
27

Zhu, François. "Évaluation d’outils de post traitement en angiographie 3D pour les traitements endovasculaires en neuroradiologie interventionnelle." Electronic Thesis or Diss., Université de Lorraine, 2024. http://www.theses.fr/2024LORR0061.

Full text
Abstract:
Les avancées en neuroradiologie interventionnelle sont en constante évolution grâce aux progrès réalisés dans les dispositifs endovasculaires et les salles d'angiographie permettant l'angiographie 3D. Bien que l'angiographie 3D soit la référence pour l'analyse angioarchitecturale des pathologies vasculaires du système nerveux central, elle reste actuellement sous-utilisée sur le versant thérapeutique. Les traitements endovasculaires nécessitent des outils de guidage et de visualisation spécifiquement adaptés aux particularités anatomiques et aux exigences cliniques de chaque cas. Dans cette th
APA, Harvard, Vancouver, ISO, and other styles
28

Prévost, Clémence. "Multimodal data fusion by coupled low-rank tensor approximations." Electronic Thesis or Diss., Université de Lorraine, 2021. http://www.theses.fr/2021LORR0180.

Full text
Abstract:
Grâce au développement de nouvelles modalités, de plus en plus de signaux sont collectés chaque jour. Ainsi, il est fréquent que différents signaux renferment des informations sur un même phénomène physique. Cependant, un seul signal peut ne contenir que des informations partielles, d’où l’émergence de la fusion de données multimodales pour dépasser cette limitation. La fusion de données est définie comme le traitement conjoint de signaux issus de différentes modalités. Son but est d’exploiter à plein les capacités de chaque modalité à extraire du savoir sur le phénomène d’intérêt, tout en met
APA, Harvard, Vancouver, ISO, and other styles
29

Aderghal, Karim. "Classification of multimodal MRI images using Deep Learning : Application to the diagnosis of Alzheimer’s disease." Thesis, Bordeaux, 2021. http://www.theses.fr/2021BORD0045.

Full text
Abstract:
Dans cette thèse, nous nous intéressons à la classification automatique des images IRM cérébrales pour le diagnostic de la maladie d’Alzheimer (MA). Nous cherchons à construire des modèles intelligents qui fournissent au clinicien des décisions sur l’état de la maladie d’un patient à partir de caractéristiques visuelles extraites d’images IRM. L’objectif consiste à classifier les patients (sujets) en trois catégories principales : sujets sains (NC), sujets atteints de troubles cognitifs légers (MCI), et sujets atteints de la maladie d’Alzheimer (AD). Nous utilisons des méthodes d’apprentissage
APA, Harvard, Vancouver, ISO, and other styles
30

Fayech, Besma. "Régulation des réseaux de transport multimodal : systèmes multi-agents et algorithmes évolutionnistes." Lille 1, 2003. https://pepite-depot.univ-lille.fr/LIBRE/Th_Num/2003/50376-2003-323.pdf.

Full text
Abstract:
Le but des travaux présentés dans cette thèse est de proposer un système d'aide à la décision pour la régulation du trafic au sein d'un réseau de transport collectif multimodal. Nous définissons la régulation comme la réaffectation, à travers différentes décisions, des horaires et des itinéraires aux différents véhicules du réseau en cas de perturbation. Afin de mieux représenter les aspects statiques et dynamiques du réseau, nous proposons une modélisation hybride du système de transport (agents et graphes). Le Système Multi-Agent d'Aide à la Décision (SMAAD) proposé réalise les deux phases p
APA, Harvard, Vancouver, ISO, and other styles
31

De, goussencourt Timothée. "Système multimodal de prévisualisation “on set” pour le cinéma." Thesis, Université Grenoble Alpes (ComUE), 2016. http://www.theses.fr/2016GREAT106/document.

Full text
Abstract:
La previz on-set est une étape de prévisualisation qui a lieu directement pendant la phase de tournage d’un film à effets spéciaux. Cette proposition de prévisualisation consiste à montrer au réalisateur une vue assemblée du plan final en temps réel. Le travail présenté dans cette thèse s’intéresse à une étape spécifique de la prévisualisation : le compositing. Cette étape consiste à mélanger plusieurs sources d’images pour composer un plan unique et cohérent. Dans notre cas, il s’agit de mélanger une image de synthèse avec une image issue de la caméra présente sur le plateau de tournage. Les
APA, Harvard, Vancouver, ISO, and other styles
32

Abi, kanaan Marianne. "AI-Enhanced Emergency Call Handling : Development of Multimodal Machine Learning Models." Electronic Thesis or Diss., Besançon, Université Marie et Louis Pasteur, 2025. http://www.theses.fr/2025PAST2003.

Full text
Abstract:
Les centres d’appels d’urgence jouent un rôle essentiel dans la gestion des situations de crise, car ils sont les intervenants de première ligne qui facilitent l’intervention, déterminant souvent la différence entre la vie et la mort. Les progrès récents et rapides de l’intelligence artificielle (IA) ne peuvent être négligés, car ils ont ouvert de nouveaux horizons pour améliorer les capacités des services d’urgence. Avec des applications d’IA adéquates, il est possible d’aider les centres d’appels d’urgence à améliorer l’efficacité et la précision de la gestion des urgences, sauvant ainsi pot
APA, Harvard, Vancouver, ISO, and other styles
33

Alameda-Pineda, Xavier. "Egocentric Audio-Visual Scene Analysis : a machine learning and signal processing approach." Thesis, Grenoble, 2013. http://www.theses.fr/2013GRENM024/document.

Full text
Abstract:
Depuis les vingt dernières années, l'industrie a développé plusieurs produits commerciaux dotés de capacités auditives et visuelles. La grand majorité de ces produits est composée d'un caméscope et d'un microphone embarqué (téléphones portables, tablettes, etc). D'autres, comme la Kinect, sont équipés de capteurs de profondeur et/ou de petits réseaux de microphones. On trouve également des téléphones portables dotés d'un système de vision stéréo. En même temps, plusieurs systèmes orientés recherche sont apparus (par exemple, le robot humanoïde NAO). Du fait que ces systèmes sont compacts, leur
APA, Harvard, Vancouver, ISO, and other styles
34

Guislain, Maximilien. "Traitement joint de nuage de points et d'images pour l'analyse et la visualisation des formes 3D." Thesis, Lyon, 2017. http://www.theses.fr/2017LYSE1219/document.

Full text
Abstract:
Au cours de la dernière décennie, les technologies permettant la numérisation d'espaces urbains ont connu un développement rapide. Des campagnes d'acquisition de données couvrant des villes entières ont été menées en utilisant des scanners LiDAR (Light Detection And Ranging) installés sur des véhicules mobiles. Les résultats de ces campagnes d'acquisition laser, représentants les bâtiments numérisés, sont des nuages de millions de points pouvant également contenir un ensemble de photographies. On s'intéresse ici à l'amélioration du nuage de points à l'aide des données présentes dans ces photog
APA, Harvard, Vancouver, ISO, and other styles
35

Garcia, Geoffrey. "Une approche logicielle du traitement de la dyslexie : étude de modèles et applications." Thesis, Clermont-Ferrand 2, 2015. http://www.theses.fr/2015CLF22634/document.

Full text
Abstract:
Les troubles neuropsychologiques sont très répandus et posent de réels problèmes de santé publique. En particulier, dans notre société moderne où la communication écrite est omniprésente, la dyslexie peut s’avérer excessivement handicapante. On remarque néanmoins que le diagnostic et la remédiation de cette pathologie restent délicats et manquent d’uniformisation. Ceci semble malheureusement inhérent à la caractérisation clinique par exclusion de la dyslexie, à la multitude de praticiens différents impliqués dans une telle prise en charge ainsi qu’au manque d’objectivité de certaines méthodes
APA, Harvard, Vancouver, ISO, and other styles
36

Cantisani, Giorgia. "Neuro-steered music source separation." Electronic Thesis or Diss., Institut polytechnique de Paris, 2021. http://www.theses.fr/2021IPPAT038.

Full text
Abstract:
Dans cette thèse, nous abordons le défi de l'utilisation d'interfaces cerveau-machine (ICM) sur l'application spécifique de la séparation de sources musicales qui vise à isoler les instruments individuels qui sont mélangés dans un enregistrement de musique. Ce problème a été étudié pendant des décennies, mais sans jamais considérer les ICM comme un moyen possible de guider et d'informer les systèmes de séparation. Plus précisément, nous avons étudié comment l'activité neuronale caractérisée par des signaux électroencéphalographiques (EEG) reflète des informations sur la source à laquelle on po
APA, Harvard, Vancouver, ISO, and other styles
37

Vukotic, Verdran. "Deep Neural Architectures for Automatic Representation Learning from Multimedia Multimodal Data." Thesis, Rennes, INSA, 2017. http://www.theses.fr/2017ISAR0015/document.

Full text
Abstract:
La thèse porte sur le développement d'architectures neuronales profondes permettant d'analyser des contenus textuels ou visuels, ou la combinaison des deux. De manière générale, le travail tire parti de la capacité des réseaux de neurones à apprendre des représentations abstraites. Les principales contributions de la thèse sont les suivantes: 1) Réseaux récurrents pour la compréhension de la parole: différentes architectures de réseaux sont comparées pour cette tâche sur leurs facultés à modéliser les observations ainsi que les dépendances sur les étiquettes à prédire. 2) Prédiction d’image et
APA, Harvard, Vancouver, ISO, and other styles
38

Benaissa, Ezzeddine. "Plate-forme intelligente pour la chaîne logistique : approche basée sur un système multi-agents et les services web sémantiques, cas du transport multimodal des marchandises." Le Havre, 2013. http://www.theses.fr/2013LEHA0002.

Full text
Abstract:
Nous avons proposé dans cette thèses une nouvelle approche pour le développement d'une architecture distribuée à base de Système Multi-Agents (SMA) couplée à des Services Web Sémantiques (SWS) et ce afin d'aider à le prise de décision collaborative dans le contexte de l'entreprise étendue. Afin de valider notre approche, la châine de transport multimodal des marchandises a été prise comme cas d'application. Le réusltat des travaux de recherches réalisés se présente sous la forme d'une plateforme intelligente baptisée i-SEEC pour Intelligent System for Extended Enterprise Cooperation<br>We have
APA, Harvard, Vancouver, ISO, and other styles
39

Maman, Lucien. "Automated analysis of cohesion in small groups interactions." Electronic Thesis or Diss., Institut polytechnique de Paris, 2022. http://www.theses.fr/2022IPPAT030.

Full text
Abstract:
Au cours de la dernière décennie, un nouveau domaine de recherche multidisciplinaire appelé traitement des signaux sociaux (SSP) a émergé. Il vise à permettre aux machines de détecter, reconnaître et afficher les signaux sociaux humains. L'analyse automatisée des interactions de groupe est l'une des tâches les plus complexes abordée par ce domaine de recherche. Récemment, une attention particulière s'est portée sur l'étude automatisée des états émergents. En effet, ceux-ci jouent un rôle important dans les dynamiques d'un groupe car ils résultent des interactions entre ses membres. Dans cette
APA, Harvard, Vancouver, ISO, and other styles
40

Malik, Muhammad Usman. "Learning multimodal interaction models in mixed societies A novel focus encoding scheme for addressee detection in multiparty interaction using machine learning algorithms." Thesis, Normandie, 2020. http://www.theses.fr/2020NORMIR18.

Full text
Abstract:
Les travaux de recherche proposés se situe au carrefour de deux domaines de recherche, l'interaction humain-agent et l'apprentissage automatique. L’interaction humain-agent fait référence aux techniques et concepts impliqués dans le développement des agents intelligents, tels que les robots et les agents virtuels, capables d'interagir avec les humains pour atteindre un objectif commun. L’apprentissage automatique, d'autre part, exploite des algorithmes statistiques pour apprendre des modèles de donnée. Les interactions humaines impliquent plusieurs modalités, qui peuvent être verbales comme la
APA, Harvard, Vancouver, ISO, and other styles
41

Bezivin, Pauline. "Effets du sexe sur la maturation cérébrale et impacts sur la régulation émotionnelle à l’adolescence." Thesis, Université Paris-Saclay (ComUE), 2018. http://www.theses.fr/2018SACLS205.

Full text
Abstract:
A l'adolescence, la maturation cérébrale implique des changements anatomiques globaux et régionaux subtils, et estimer la morphologie exacte de certaines structures au cours du développement post-pubertaire est par conséquent difficile. L'effet du dimorphisme sexuel sur la maturation cérébrale n'a été que très peu exploré de façon prospective par l'imagerie par résonance magnétique. Dans ce contexte, ce travail de thèse est consacré à l'étude longitudinale des effets du sexe sur la maturation cérébrale à l'aide de deux méthodes pour contrôler et analyser les variations de positionnement spatia
APA, Harvard, Vancouver, ISO, and other styles
42

Neumann, Markus. "Automatic multimodal real-time tracking for image plane alignment in interventional Magnetic Resonance Imaging." Phd thesis, Université de Strasbourg, 2014. http://tel.archives-ouvertes.fr/tel-01038023.

Full text
Abstract:
Interventional magnetic resonance imaging (MRI) aims at performing minimally invasive percutaneous interventions, such as tumor ablations and biopsies, under MRI guidance. During such interventions, the acquired MR image planes are typically aligned to the surgical instrument (needle) axis and to surrounding anatomical structures of interest in order to efficiently monitor the advancement in real-time of the instrument inside the patient's body. Object tracking inside the MRI is expected to facilitate and accelerate MR-guided interventions by allowing to automatically align the image planes to
APA, Harvard, Vancouver, ISO, and other styles
43

Deschamps-Berger, Théo. "Social Emotion Recognition with multimodal deep learning architecture in emergency call centers." Electronic Thesis or Diss., université Paris-Saclay, 2024. http://www.theses.fr/2024UPASG036.

Full text
Abstract:
Cette thèse porte sur les systèmes de reconnaissance automatique des émotions dans la parole, dans un contexte d'urgence médicale. Elle aborde certains des défis rencontrés lors de l'étude des émotions dans les interactions sociales et est ancrée dans les théories modernes des émotions, en particulier celles de Lisa Feldman Barrett sur la construction des émotions. En effet, la manifestation des émotions spontanées dans les interactions humaines est complexe et souvent caractérisée par des nuances, des mélanges et étroitement liée au contexte. Cette étude est fondée sur le corpus CEMO, composé
APA, Harvard, Vancouver, ISO, and other styles
44

Hett, Kilian. "Multi-scale and multimodal imaging biomarkers for the early detection of Alzheimer’s disease." Thesis, Bordeaux, 2019. http://www.theses.fr/2019BORD0011/document.

Full text
Abstract:
La maladie d’Alzheimer est la première cause de démence chez les personnes âgées. Cette maladie est caractérisée par un déclin irréversible des fonctions cognitives. Les patients atteints par la maladie d’Alzheimer ont de sévères pertes de mémoire et ont de grandes difficultés à apprendre de nouvelles informations ce qui pose de gros problèmes dans leur vie quotidienne. À ce jour, cette maladie est diagnostiquée après que d’importantes altérations des structures du cerveaux apparaissent. De plus, aucune thérapie existe permettant de faire reculer ou de stopper la maladie. Le développement de n
APA, Harvard, Vancouver, ISO, and other styles
45

Laurençon, Hugo. "Foundation Vision-Language models." Electronic Thesis or Diss., Sorbonne université, 2025. http://www.theses.fr/2025SORUS004.

Full text
Abstract:
Ces dernières années, les grands modèles de langage (LLMs) ont montré des performances remarquables sur des tâches variées et ont commencé à être largement intégrés dans diverses applications. Les modèles vision-langage (VLMs), qui étendent les LLMs en incorporant en plus la compréhension d'images, offrent un potentiel supplémentaire. Ces modèles pourraient transformer des domaines tels que le développement web en traduisant des captures d'écran de pages web en code, faciliter la recherche d'informations via une navigation web autonome, et automatiser des tâches comme la classification et la s
APA, Harvard, Vancouver, ISO, and other styles
46

Andriamanampisoa, Fenohery Tiana. "Recalage multimodal 3D utilisant le modèle élastique, la méthode des éléments finis et l'information mutuelle dans un environnement parallèle." Toulouse 3, 2008. http://thesesups.ups-tlse.fr/332/.

Full text
Abstract:
Pour effectuer des superpositions et éventuellement des fusions des images en imagerie médicale, il est indispensable que les images soient mises en correspondance. Cette étude traite à la fois le recalage rigide et non rigide multimodal. On a choisi la rotation centrée, la translation et le changement d'échelle comme transformation rigide. Pour le recalage non rigide, on s'est basé sur le modèle des matériaux élastiques linéaires isotropes. L'utilisation de la méthode des éléments finis et du maillage uniforme est très attrayante. On a utilisé l'information mutuelle selon Mattes comme critère
APA, Harvard, Vancouver, ISO, and other styles
47

Mihoub, Alaeddine. "Apprentissage statistique de modèles de comportement multimodal pour les agents conversationnels interactifs." Thesis, Université Grenoble Alpes (ComUE), 2015. http://www.theses.fr/2015GREAT079/document.

Full text
Abstract:
L'interaction face-à-face représente une des formes les plus fondamentales de la communication humaine. C'est un système dynamique multimodal et couplé – impliquant non seulement la parole mais de nombreux segments du corps dont le regard, l'orientation de la tête, du buste et du corps, les gestes faciaux et brachio-manuels, etc – d'une grande complexité. La compréhension et la modélisation de ce type de communication est une étape cruciale dans le processus de la conception des agents interactifs capables d'engager des conversations crédibles avec des partenaires humains. Concrètement, un mod
APA, Harvard, Vancouver, ISO, and other styles
48

Harrando, Ismail. "Representation, information extraction, and summarization for automatic multimedia understanding." Electronic Thesis or Diss., Sorbonne université, 2022. http://www.theses.fr/2022SORUS097.

Full text
Abstract:
Que ce soit à la télévision ou sur internet, la production de contenu vidéo connaît un essor sans précédent. La vidéo est devenu non seulement le support dominant pour le divertissement, mais elle est également considérée comme l'avenir de l'éducation, l'information et le loisir. Néanmoins, le paradigme traditionnel de la gestion du multimédia s'avère incapable de suivre le rythme imposé par l'ampleur du volume de contenu créé chaque jour sur les différents canaux de distribution. Ainsi, les tâches de routine telles que l'archivage, l'édition, l'organisation et la recherche de contenu par les
APA, Harvard, Vancouver, ISO, and other styles
49

Sutour, Camille. "Vision nocturne numérique : restauration automatique et recalage multimodal des images à bas niveau de lumière." Thesis, Bordeaux, 2015. http://www.theses.fr/2015BORD0099/document.

Full text
Abstract:
La vision de nuit des pilotes d’hélicoptère est artificiellement assistée par un dispositif de vision bas niveau de lumière constitué d’un intensificateur de lumière (IL) couplé à une caméra numérique d’une part, et d’une caméra infrarouge (IR) d’autre part. L’objectif de cette thèse est d’améliorer ce dispositif en ciblant les défauts afin de les corriger.Une première partie consiste à réduire le bruit dont souffrent les images IL. Cela nécessite d’évaluer la nature du bruit qui corrompt ces images. Pour cela, une méthode d’estimation automatique du bruit est mise en place. L’estimation repos
APA, Harvard, Vancouver, ISO, and other styles
50

Commandeur, Frédéric. "Fusion d'images multimodales pour la caractérisation du cancer de la prostate." Thesis, Rennes 1, 2016. http://www.theses.fr/2016REN1S038/document.

Full text
Abstract:
Cette thèse s'inscrit dans le contexte de la caractérisation du cancer de la prostate à partir de données d'imagerie multimodale. L'objectif est d'identifier et de caractériser les tumeurs prostatiques à partir d'observation in-vivo, incluant imagerie par résonance magnétique multiparamétrique (IRMm), tomodensitométrie (TDM) et tomographie par émission de positons (TEP), avec une référence biologique sous forme de lames histologiques fournies par l'analyse anatomopathologique de la prostate après prostatectomie radicale. Nous proposons dans un premier temps deux méthodes de recalage afin de ré
APA, Harvard, Vancouver, ISO, and other styles
We offer discounts on all premium plans for authors whose works are included in thematic literature selections. Contact us to get a unique promo code!