1505073603
Decideo - Data Science, Big Data, Intelligence Augmentée

Advertise on podcast: Decideo - Data Science, Big Data, Intelligence Augmentée

This podcast has
86 episodes
Language
French
Explicit
No
Date created
2020/03/28
Latest episode
2025/09/02
Average duration
16 min.
Release period
32 days

Description

Decideo est la communauté d'information et d'échange autour des outils et meilleures pratiques d'analyse de données (Machine Learning, Business Intelligence, Big Data, Science des Données, Entrepôts de données…). Véritable réseau social des professionnels de la donnée, Decideo est disponible en français www.decideo.fr et en espagnol www.decideo.com. Opinions d'experts, actualités, agenda, offres d'emploi, sont disponibles en ligne et sur les applications mobiles gratuites. Decideo is the leading user community of Business Intelligence, Data Science, Big Data and Analytics professionals. Decideo is a real social network of data driven economy, available in French www.decideo.fr, and Spanish www.decideo.com. User stories, best practices, news, software reviews, agenda, job board… are available online, and through podcast and mobile applications.

Unlock Decideo - Data Science, Big Data, Intelligence Augmentée podcast Email contact info,
Listeners & Audience details

Email contact information

Direct podcast contact details

Listeners

Audience numbers & engagement insights

Audience details

Podcast Insights

Social media

Check Decideo - Data Science, Big Data, Intelligence Augmentée social media presence


Podcast episodes

Check latest episodes from Decideo - Data Science, Big Data, Intelligence Augmentée podcast


#5.10 Archives, documents, données... tant de points communs !
2025/09/02
Margot Georges est consultante en archivistique. Elle est également productrice du podcast Archivistica, consacré à ce domaine. Archivistica est disponible sur toutes les applications de podcast et sur https://shows.acast.com/archivistica Données et documents, archives et sauvegardes, bases de données et GED... nos métiers (de l'information, et de la donnée) utilisent des termes différents. Mais donc la signification est souvent plus proche qu'on ne l'imagine. Les "professionnels de l'information" et les "professionnels des données" semblent ne pas se comprendre... mais chacun n'adopte-t-il pas une position exagérée. Quelles sont nos divergences et nos convergences. De mon point de vue, les professionnels du traitement des documents ont énormément de choses à apprendre aux professionnels de la donnée. A condition que ces derniers acceptent d'écouter, et parfois de se remettre en question. Mais l'inverse est également vrai. Les professionnels du document doivent accepter que le monde évolue, et que la transformation numérique impact le fondement de leur métier. Les professionnels de la donnée ont également des choses à partager avec eux. Je rêve d'une entreprise où gouvernance des données, archives, documentation, informatique... se rencontreront autour d'une même table pour définir une stratégie commune, au service de la valorisation du patrimoine informationnel. Et Margot souhaite elle-aussi que nos métiers dialoguent plus ensemble.
#5.9 L'éthique de l'IA expliquée à mon fils, avec Enrico Panaï
2025/04/23
- On associe souvent l'éthique à la conscience humaine qui doit prendre des décisions. Or les IA n'ont pas de conscience, donc pourquoi doit-on parler d'éthique de l'IA ? - Vous avez choisi d'écrire votre livre en vous adressant à votre fils ? Pensez vous que les plus jeunes générations soient plus ou moins sensibles que nous à l'éthique ? - Comment circoncir l'éthique de l'IA ? En Chine le crédit social est acceptable, pas en Europe. En Iran, une IA générative développée par le pouvoir enseigne le Coran, aux Etats Unis les armes létales autonomes sont déjà une réalité... a quelle échelle devons nous raisonner ? Ce qui est acceptable ici, est banni ailleurs. - Comment l'entreprise doit-elle s'organiser ? Qui décide de l'éthique d'une personne morale ?
#5.8 Natalie Maroun nous parle de données et de communication de crise
2025/04/17
Natalie Maroun (Photo Crédit Lakhdar Bouzouaid) est directrice associée du Cabinet Element, spécialisé en communication de crise. Elle vient de publier chez Dunod, un ouvrage dans la collection "Boites à outils" : La boite à outils de la communication de crise. Nous avons eu envie de parler ensemble des données au service de la communication de crise. Cette étape que tout le monde redoute, nécessite pour être franchie avec succès d'avoir accès sans délai, aux bonnes données. Comment s'y préparer ? Pages : 192 pages Format : 190 x 240 mm Collection : BàO La Boîte à Outils Parution : avril 2025 Marque : Dunod Public : Professionnel EAN : 9782100874019
#5.7 Data Chain, une plateforme de données française, avec Sandra Mathieu de Adobis Group
2025/03/28
Aujourd'hui nous découvrons qu'à l'heure ou l'indépendance technologique doit être mieux préservée, il est possible de construire sa plateforme de données, avec des solutions 100% françaises. Nous en parlons avec Sandra Mathieu, co-fondatrice de Adobis Group. Adobis group, on ne connait pas encore bien votre entreprise, pourtant vous êtes un des seuls éditeurs de logiciels de "data platform" français. A une heure où on parle beaucoup de souveraineté, c'est un différenciateur ? - Alors cette plateforme, elle vient se frotter à de très nombreux acteurs, américains pour la plupart, Snowflake, Denodo, Databricks... quelles sont ses différences ? - Peut-on prendre un ou deux exemples de clients ? Pourquoi vous ont-ils choisi ?
#5.6 De l'IA oui, mais pas sans Data Spaces, avec Matthias de Bièvre, VISIONS
2025/02/28
L'IA on en parle à coups de milliards, de data centers, et de LLMs... mais on parle peu des données : expliquez nous l'importance des données dans le processus d'intelligence artificielle - On parle parfois des données synthétiques qui permettraient de compenser l'absence de données réelles. Vous n'y croyez pas ? - Vous mentionnez les data space, et vous dites que des milliards ont été investi sur le sujet. De quoi s'agit-il et ou sont passés les milliards ? Parce que honnêtement, personne ne connait ! - Aux Etats-Unis, ils sont plutôt bons pour la collecte de données, mais ils n'ont pas de data spaces... est-ce qu'on n'aurait pas encore une fois choisi la complexité en Europe ?
#5.5 Le nouveau SaaS, vous connaissez ?
2025/01/02
Un « nouveau » paradigme apparait, le SaaS ! Non, pas celui que vous croyez ! Vous vous dites, ça y est, on l'a perdu ! Il est resté en 1999 à la création de Salesforce ! Non, car si le SaaS est bien vivant depuis 25 ans, le nouveau SaaS pointerait le bout de son nez selon les oracles du marketing. Nous serions en train de passer du Software as a Service au Service as a Software. Que c'est beau le monde du marketing ! Allez, je vous explique. Le principe du Software as a Service a combiné depuis plus de deux décennies l'évolution technologique du cloud computing, et la migration du modèle d'achat de licences logicielles vers celui d'abonnement. Les deux éléments sont indépendants, mais en réalité ces deux évolutions ont été concomitantes. Au lieu d'acheter un logiciel, vous souscrivez à un abonnement, qui comprend le droit d'accès au logiciel, l'infrastructure technique, et les services associés. Un forfait en quelques sortes, mais payé chaque mois. À court terme, le coût en est bien plus intéressant et plus flexible, à long terme un peu moins, cependant dans un marché en évolution perpétuelle, tout le monde est gagnant. Mais voilà, l'intelligence artificielle (je ne sais pas trop ce qu'elle vient faire là), et 20 ans de SaaS ont épuisé les ressorts marketing et commerciaux. Il fallait réinventer ! Et l'on serait donc en train de remplacer le SaaS par le SaaS ! Le Service as a Software serait la combinaison d'une plate-forme technologique, et de services assurés par des humains… ou des IAs. Un bon exemple est le logiciel QuickBooks très populaire en Amérique du Nord, et qui permet à chacun de s'acquitter de ses travaux comptables et de ses déclarations fiscales. Ces dernières ne sont pas réalisées par le client, mais par un comptable, qui utilise le logiciel, complété de ses compétences. Et dans le cas de QuickBooks, le comptable pourrait être une IA. Cela fait dire à certains analystes que le développement des agents intelligents conduit cette transformation du marché. Le client ne s'abonne plus à un logiciel qu'il utilise, mais à un service que lui rend une IA, avec un peu d'humain, parfois. Si l'on reprend l'exemple de Salesforce, un commercial humain entre les données d'un nouveau client, puis les agents dans Salesforce créent automatiquement le flux d'actions de proposition, de relance, de vente. Les nouveaux SaaS remplaceraient donc certains humains chez leurs clients. Tout cela n'est pas totalement nouveau. D'abord, désolé de reparler du passé, mais cela existe depuis la nuit des temps, cela s'appelle de l'externalisation. Lorsque j'envoyais mes documents comptables à mon expert-comptable et qu'il les saisissait dans son logiciel pour ensuite réaliser mes déclarations fiscales, c'était donc déjà du Service as a Software. N'allons pas réinventer des mots qui n'apportent aucune nouveauté, juste pour être « moderne ». Tiens, clin d'œil, ils auraient pu faire comme la Modern Data Stack, et l'appeler Modern SaaS ! Plus sérieusement, la nouvelle donne vient de l'automatisation des processus. Là encore rien de nouveau, à part si cette automatisation est réalisée par des agents intelligents qui prendraient eux-mêmes, en fonction des circonstances, les bonnes décisions. Attention, pas un système expert qui se contente d'exécuter ce que l'expert a programmé – ça on le fait depuis les années 70 -, mais un véritable agent intelligent qui prendrait seul des décisions en fonction d'un entrainement à partir de données historiques. Selon Foundation Capital, cela représenterait un marché de presque 5000 milliards de dollars. Tout dépend bien sûr de ce que l'on met dedans. En tout cas, des dizaines d'entreprises sont déjà identifiées comme fournisseurs de Service as a Software. Si vous êtes un prestataire, qui réalise des travaux pour le compte de ses clients, de manière externalisée ; ne dites plus que vous faites de l'outsourcing, mais du Service as a Software, votre valorisation explosera peut-être ! Et puis, dites-moi ce que vous pensez de tout cela en commentaire.  
#5.4 Jean-Georges Perrin, Pape du Data Mesh et des Data Contracts
2024/11/16
Dans cet épisode, nous recevons Jean-Georges Perrin. Ce nom ne peut vous être inconnu si vous vous intéressé au "shift-left" qui émerge dans le monde des données. Les utilisateurs prennent peu à peu le contrôle de leurs données, et cela a été théorisé en 2020 dans un livre développant le concept de Data Mesh. Au Data Mesh, il manquait une dimension, celle du "comment". Jean-Georges Perrin a été un des premiers à mettre en application ce concept, chez Paypal. Et parmi les premiers, avec Andrew Jones, à s'intéresser aux supports du Data Mesh, les Data Contracts. Au point qu'il a lancé une initiative de standardisation open source des Data Contracts, ODCS (Open Data Contract Standard). Le projet Bitol, hébergé au sein de la fondation Linux, vise à permettre aux entreprises d'échanger, en interne ou en externe, des Data Products sur la base de standards open source. Très intéressant pour les entreprises... un peu moins pour les éditeurs de progiciels, comme nous en débattons dans le podcast. Un podcast plus long que d'habitude, 40' environ, mais qui vaut la peine d'être écouté jusqu'au bout ! Ecoutez-le en plusieurs fois si nécessaire.
#5.3 Cartographie des données et des systèmes avec David Bougearel de Cartographit
2024/10/20
Dans cet épisode, nous recevons David Bougearel, fondateur de Cartographit, un nouvel outil de cartographie du système d'information, qui s'appuie sur les normes de cartographie de l'ANSSI. Les différentes couches cartographiées incluent donc les couches des données, des processus et des applications. Cela fait-il de Cartographit un outil potentiel de gouvernance des données ? Nous abordons ce sujet et différentes questions connexes. - La cartographie du Système d'Information (SI) offre une vue d'ensemble, un inventaire global du SI, incluant les données (objets d'information). Cartographit permet non seulement de réaliser cet inventaire des données, mais aussi de les classifier selon leur niveau de sensibilité, de déterminer si elles sont des PII (données personnelles) et de connaître leur DICT. Cela offre ainsi une vision précise et détaillée des données. - Cependant, connaître les données est une première étape. Comprendre comment elles sont utilisées et où elles se trouvent ajoute une dimension essentielle. Cartographit permet de relier ces données aux processus métiers (vue fonctionnelle), aux actions techniques (quelles bases de données, quels flux ou quelles applications utilisent ces données) et de localiser physiquement ces données (par exemple : Bâtiment 1, Salle 44, Baie 1.1). - Grâce à une interface utilisateur (UI/UX) optimisée et à une navigation cartographique fluide, Cartographit permet de parcourir l'ensemble de son SI et d'explorer le fonctionnement de son entreprise, tant d'un point de vue technique que fonctionnel.
#5.2 IA ? Et si nous parlions français !
2024/09/11
Vous en avez assez d'entendre parler de LLM, de prompt, de text token, ou de adversarial machine learning ? Ça tombe bien, le 6 septembre dernier, le Journal Officiel de la République Française a publié, pour la rentrée des classes, la liste relative au vocabulaire de l'intelligence artificielle. La commission d'enrichissement de la langue française a retenu quatorze termes ; elle les a traduits, et définit.   Ainsi, vous pourrez parler de Grands Modèles de Langage, les GML ; d'instructions génératives pour les prompts, de jeton textuel pour les text token, et d'apprentissage antagoniste pour l'adversarial machine learning. Plus aucune excuse pour truffer vos textes et vos vidéos de ces anglicismes qui ne rendent pas hommage à notre langue. Ça fait plus chic ? C'est plus court ? Tout le monde le dit ? Toutes ces excuses sont valables, mais avec un petit effort, vous verrez que vos textes en ressortiront de meilleure facture. Et ne devenez pas ces directeurs marketing que je rencontre régulièrement et qui commencent leur présentation en s'excusant des mots anglais qu'ils utiliseront… sous prétexte que, vous savez, je vis aux States depuis plusieurs années, et je ne sais plus comment on dit en français. Cinq pages du JO du 6 septembre à imprimer donc, et à garder bien visible sur votre bureau. Ah tiens d'ailleurs, il y en a un qui manque ! Je n'ai pas trouvé la traduction de RAG, Retrieval Augmented Generation. Il va falloir continuer l'enrichissement du dictionnaire. J'ai trouvé sur Internet une traduction sous forme de Génération Augmentée de Récupération. Pourquoi pas. Qu'en pensez-vous ? A tiens, amis québécois qui nous écoutez, vous qui êtes si prompts à défendre la langue française, montrez l'exemple ! Le problème c'est que nous ne sommes pas toujours d'accord sur les traductions… Ainsi l'Office Québécois de la Langue Française recommande d'utiliser le terme de « requête » pour désigner les prompts. Alors requête ou instruction générative ? Qu'en pensez-vous ?
#5.1 Le MIT classe 777 risques potentiels liés à l'IA
2024/09/01
Le MIT a recensé 777 risques potentiels liés à l'IA dans une base de données partagée gratuitement Cet été, le MIT nous a fait un cadeau ! Le prestigieux organisme de recherche américain a publié un référentiel complet des risques liés à l'intelligence artificielle. L'objectif : vous aider à cartographier l'ensemble des risques qui pèsent sur votre entreprise afin de les mesurer, les quantifier et les mitiger par la suite. Si vous suivez mes contenus sur le thème de la gouvernance des données et de l'intelligence artificielle, vous avez déjà été sensibilisé au fait que la mise en place d'un cadre de gouvernance passe par l'identification et la cartographie des risques. Comment en effet atténuer quelque chose que l'on n'a pas référencé et mesuré ? Première tâche donc, l'identification et la cartographie des risques en matière d'intelligence artificielle. Risques liés aux données, aux modèles, aux usages, les risques sont nombreux. Et l'IA Act européen prévoit d'ailleurs l'obligation de les identifier et de les suivre, afin de classifier les modèles d'IA en fonction des risques encourus. Mais partir d'une feuille blanche et se gratter la tête en faisant le tour des bureaux n'est pas la méthode la plus efficace. Or il n'existait pas jusqu'à présent un référentiel unique, mais plusieurs référentiels, tous incomplets, et orientés. Ces derniers mois, les équipes du MIT ont réalisé un travail de compilation et d'organisation de l'ensemble des référentiels qu'ils ont pu identifier ; regroupant l'ensemble des risques dans une taxonomie commune. The AI Risk Repository est donc un travail de synthèse des risques en provenance de 43 taxonomies différentes. Au total, 777 risques ont été identifiés, regroupés et ordonnés dans la taxonomie du MIT. Ce travail de synthèse est fourni sous forme d'un fichier Excel ou Google Sheets. Avec 777 risques décrits, c'est évidemment beaucoup trop pour la très grande majorité des entreprises, et un important travail de compréhension et de sélection reste à faire. Par ailleurs chaque entreprise devra évaluer le degré de survenance de ce risque dans sa propre organisation ; ainsi que les impacts de cette survenance sur son métier. Personne ne peut faire ce travail à votre place. Mais bien sûr, remercions le MIT pour cette synthèse qui permet de partir de quelque chose, d'envisager à peu près tous les cas possibles, et ainsi de progresser dans cette cartographie des risques liés à l'IA. Le framework à déployer est donc le suivant : -              Commencez par prendre connaissance de la base de données des risques du MIT ; -              Sensibilisez la direction générale à l'importance, et parfois à l'obligation, de connaitre le niveau d'exposition de l'entreprise ; -              Programmez des ateliers avec les différentes personnes concernées, métier et informatique, afin de sélectionner dans la base du MIT les risques applicables à l'entreprise ; -              N'hésitez pas à vous faire accompagner dans cette phase afin de démarrer correctement ; un consultant spécialisé peut être un booster et un garde-fou ; -              Pour chacun de ces risques, évaluez leur probabilité de survenance, et les impacts, financiers et autres, de cette survenance éventuelle ; -              Reportez tout cela dans un outil spécialisé de gestion de risques ou à défaut dans une feuille Excel ; -              Mettez en place les stratégies de modération de ces risques ; -              Ne pas oublier de répéter ce processus, lorsque les risques changent ou au minimum une fois par an, afin de maintenir à jour cette cartographie. Alors je vous entends déjà critiquer ! Jamais je n'aurai le temps de faire cela, la DG ne nous donnera pas de budget, encore un truc qui va rester sur les étagères, bla bla bla… Vous avez raison de vous inquiéter ! Mais en même temps soyons direct, ce n'est pas un choix. Bien sûr, une PME peut choisir de prendre des risques, sans les mesurer, et en assumer par la suite les conséquences. Mais assurez-vous que cette décision de ne pas cartographier les risques liés à l'IA soit bien prise au plus haut niveau. Et un conseil, protégez vos arrières, et conservez bien la trace de cette décision. Et si votre DG est plus raisonnable, et comprend l'importance de connaitre et mesurer ces risques, allez-y progressivement. Posez les premiers jalons, et commencez les ateliers. Tiens, par exemple, commencez par les nouveaux projets ! Un nouveau POC d'IA ? Dès la phase de POC, rapprochez-vous des équipes, abordez le sujet, et cartographiez les risques à la volée. En incluant la gouvernance de l'IA dans la phase de design des projets, le fameux « Governance by design », vous rendrez le sujet beaucoup plus fluide. C'est ce que j'appelle le DevSecGovOps, penser à la gouvernance dès la phase de conception, et en faire un élément essentiel de la mise en production.
#4.24 Gagner aux JO, est-ce une question de data ?
2024/08/02
Vous avez 23 ans, vous mesurez 1 mètre 77, et vous pesez 72 kilos ? Vous avez, contrairement à moi, le profil idéal pour remporter le 100 mètres, épreuve reine de l'athlétisme aux jeux olympiques. Si en revanche vous avez plus de 27 ans… désolé, vous êtes déjà disqualifié par l'analyse statistique. Cependant, si vous êtes un peu en surpoids, jusqu'à 108 kilos, vous pouvez tenter le lancer de poids. Les grands triompheront au lancer de disque, quant aux plus petits qu'un mètre soixante… ils n'ont que peu de chance d'obtenir une médaille en athlétisme. Non, mesdames, je ne vous oublie pas. Et les statistiques semblent se rejoindre. Si vous avez 22 ans, que vous mesurez 1 mètre 66, et que vous pesez 57 kilos, la médaille du 100 mètres est à votre portée, mathématiquement. Là encore, quelques kilos supplémentaires vous permettront de tenter le lancer de poids. Les plus grandes lanceront le disque tandis que les plus petites triompheront au 10 000 mètres et au marathon. Commandité par JeffBet, un site de paris en ligne, l'étude porte sur les données de 222 500 athlètes olympiques, collectées depuis 120 ans. Pour JeffBet, remporter une épreuve dépend certes du courage, de la volonté, de l'entrainement, mais également de caractéristiques purement physiques. Et c'est l'idée de la société de paris en ligne, qui tente de convaincre que l'on peut améliorer ses probabilités de miser sur le gagnant, sans le connaitre, mais en étudiant uniquement ses données. Le livre Money Ball de Michael Lewis, publié en 2003, nous contait déjà l'histoire controversé d'un sélectionneur de baseball qui utilisait les données pour compenser le manque de moyens de son équipe, et identifier statistiquement les meilleurs joueurs. Alors que vous soyez pro-statistiques, persuadés que le monde est régi par la mathématique et les probabilités ; ou que vous soyez convaincu que les statistiques ne sont en aucun cas déterministes, oubliez un peu les data pendant quelques semaines, passez de bonnes vacances, et retrouvez de nouvelles émissions de votre podcast Decideo dès la rentrée de septembre pour une nouvelle saison, la cinquième !
#4.23 Gouvernance des données orientée métier, quelques prérequis
2024/07/09
Gouvernance des données : quelques prérequis organisationnels Ayant l'opportunité d'accompagner de nombreuses entreprises dans la mise en place d'une gouvernance des données orientée métier, je voudrais partager avec vous aujourd'hui quelques prérequis organisationnels. Eloignés des habituels conseils sur les outils à déployer, je constate que les premiers pas à réaliser, et pas les plus faciles, sont liés aux personnes et à l'organisation. Trois questions ! Qui ? Cela peut paraitre évident, mais dans la réalité, la nomination claire et affirmée de la personne chargée de coordonner la gouvernance des données dans l'entreprise n'est pas toujours une priorité. Or, sans bénéficier de l'onction de la direction générale sur le sujet, la personne en charge rencontra sur sa route toutes les embuches posées ça et là par les personnes qui ne voient pas dans leur intérêt qu'une gouvernance vienne fixer des bonnes pratiques là où ils préfèreraient que personne ne vienne mettre son nez. Donc, la première des choses à faire est de désigner une personne, de lui donner un titre de poste qui reflète cette fonction de mise en place des actions liées à la gouvernance, et de communiquer en interne sur le sujet. Récemment, un client m'expliquait que sa direction générale ne souhaitait pas envoyer un email pour indiquer à tous les employés que cette personne était maintenant en charge de mettre en place une gouvernance des données. Je lui souhaite bonne chance dans sa mission quand même la direction générale ne lui donne pas ses lettres de crédit ! Où ? La position de cette personne dans l'organisation est beaucoup plus importante que son titre. Je peux être nommé Data Governance Manager, mais si je suis au troisième sous-sol de l'organigramme dans une sous-direction, dépendant de la direction informatique… je n'aurai jamais l'oreille du comité de direction pour arbitrer les litiges qui apparaitront ; ni la crédibilité pour imposer aux métiers un code de conduite et des bonnes pratiques qui modifieront leurs habitudes. Les Américains ont choisi de placer la gouvernance des données, et de l'intelligence artificielle, directement au sein du comité de direction, en créant le poste de CIGO — Chief Information Governance Officer. Pas toujours facile dans les pays francophones de réunir le budget, la personne compétente, et la volonté de la direction générale pour créer ce niveau de poste. Du fait de mon expérience, je déconseille toute organisation dans laquelle le responsable de la gouvernance des données serait à plus d'un échelon du comité de direction. Je déconseille également — à quelques rares exceptions près — que la gouvernance des données orientée métier soit rattachée à l'informatique. Si elle ne peut pas être autonome, elle devrait être rattachée à l'audit, à une direction data ou digital. Le plus important est que le supérieur hiérarchique du responsable de la gouvernance puisse directement porter les messages au comité de direction, et obtenir sa validation ou son arbitrage. Là encore, il faut organiser et communiquer clairement en interne sur l'organisation, afin qu'il n'y ait aucune ambiguïté. Comment ? Qu'il s'agisse de la charte de gouvernance des données, du code de conduite de l'IA, de la classification des données sensibles, du catalogue des data products, de l'ontologie d'entreprise… la gouvernance des données passe par la formalisation d'un certain nombre de livrables. Outre ses qualités relationnelles, le responsable de la gouvernance doit faire preuve d'un excellent formalisme. Rédiger, expliquer, illustrer, présenter… est son quotidien. Outre l'indispensable traitement de texte qu'il utilisera quotidiennement, il a besoin d'un outil de diffusion du contenu qu'il produit. Tout sauf des classeurs qui resteront dans une étagère ! Un simple Wiki fera l'affaire, mais il lui permettra de diffuser ses livrables, de recueillir des commentaires, des suggestions, d'échanger avec sa communauté en interne. C'est le premier outil à mettre en œuvre, avant de passer à tout logiciel complexe. Ce portail accueillera son message de nomination, la composition du comité de gouvernance, puis viendront la charte de gouvernance des données, et l'ontologie ou le glossaire métier, en fonction du niveau de profondeur souhaité. Bon courage pour ces premières étapes. Comme elles touchent l'humain et l'organisation, elles sont à la fois indispensables et parfois les plus compliquées à accomplir.  
#4.22 La donnée sous tous les angles, avec Philippe Charpentier, CTO de NetApp
2024/07/01
Avec Philippe Charpentier, le CTO de NetApp France, nous abordons le "contenant" des données. Contenant et contenu sont mutuellement indispensables, et ils répondent tous deux à des contraintes différentes : - Les data sont enfin reconnues comme des actifs informationnelles de l'entreprise, il faut donc les protéger. Quels sont les enjeux actuels liés à la sécurité et à la confidentialité de ces données collectées par toutes les entreprises ? - Peut-on et doit-on tout conserver ? L'IA semble nous dire que oui, les lois sont un peu moins d'accord. Comment arbitrer ? - Un des éléments clef d'une stratégie data est aujourd'hui la gouvernance, comment s'assurer du cycle de vie et d'utilisation des données. Quid de la traçabilité de ces actifs tant immatériels. - En 2024, sur quoi les entreprises doivent-elles porter leur attention ?  Quels conseils leur donner en matière de data ?
#4.21 IBM se lance dans le data mesh avec Data Product Hub
2024/06/26
IBM se lance à son tour dans le data mesh et les data products. L'entreprise l'a annoncé cette semaine, à l'occasion d'un séminaire de présentation de son offre appelée IBM Data Product Hub. Cette tendance, le « shift left », consiste à transférer peu à peu la responsabilité des data aux utilisateurs métiers, et l'autonomie qui va avec. Que vous appliquiez à la lettre les principes du data mesh ou si vous créez simplement des data products pour remplacer vos entrepôts de données centralisés, vous allez passer par la recherche et l'installation d'une plateforme de jeux de données. Amazon, SAP, Microsoft mais également des éditeurs spécialisés comme Zeena, Meta-Analysis ou Orkestra Data se sont lancés dans la course. Nous en avons déjà parlé ici. Signe que le sujet du data mesh devient incontournable, IBM se lance à son tour. Difficile de remettre en question ses habitudes de centralisation ! IBM annonce Data Product Hub, une plateforme, centralisée, pour stocker les data products. Les sources de données sont des entrepôts de données ou des lakehouses – 57 connecteurs sont annoncés. Les jeux de données peuvent ensuite être analysés avec Tableau, Watsonx de IBM ou encore en Python via la librairie Pandas. Le plan de développement prévoit l'incorporation d'IA générative dans les prochaines versions, fin 2024 et début 2025. Les consommateurs de données peuvent envoyer des requêtes, demandant à accéder aux données qui les intéressent. Les producteurs de données peuvent personnaliser les formats de génération des jeux de données, pour s'adapter aux besoins de leurs consommateurs. La gouvernance de l'ensemble est bien sur facilitée. Si vous utilisez le catalogue de données IBM Knowledge Catalog, le Data Product Hub pourra s'y connecter. Une intégration avec Informatica est prévue fin 2024. Les jeux de données peuvent être générés et stockés, ou pourront être virtualisés à partir de fin 2024. La génération et la mise à jour des data products sera automatisée dans la version de début 2025. Point très important, des data contracts et des niveaux de service peuvent être implémentés afin de gouverner les échanges de données. Un tableau de bord de suivi est même prévu. Ces contrats « lisibles par la machine » permettront dans la version de début 2025, de mettre en place un suivi automatisé de la gouvernance. Le Data Product Hub de IBM sera disponible en version on-premise, à l'achat ou à la location, ainsi qu'en version SaaS hébergée dans le cloud IBM, ou dans d'autres grands clouds. Une version d'essai de 60 jours sera proposée par l'éditeur. La version perpétuelle sera proposée à partir de 250 000 $, ou en location à partir de 100 000 $ par an. Le Data Product Hub est un nouveau composant ajouté à la Data Fabric de IBM. Préparant le futur, et la monétisation des données, IBM inclut une fonction de place de marché – on appelle également cela un Data Space. Mais dès maintenant, les consommateurs de données peuvent l'utiliser pour rechercher un jeu de données répondant à leurs besoins. Avec toutes les difficultés que l'on constate lors des tentatives de création de catalogues de données métier, on peut espérer que les catalogues de jeux de données seront adoptés, par les producteurs et les consommateurs, et seront alors correctement catalogués !
#4.20 Cinq ans de prison, si vous tentez de prévoir les décisions d'un juge
2024/06/17
5 ans de prison, si vous tentez de prévoir la décision d'un juge … mais comme toujours, les lignes jaunes sont contournables, pour peu que l'on prenne le temps de comprendre la loi. Je vous parle ici d'une disposition liée à l'utilisation de l'intelligence artificielle dans le cadre de procédures judiciaires, tentant de prédire quel sera le comportement de tel ou tel juge dans une affaire, et pour les parties prenantes d'adapter leur stratégie. Aux Etats-Unis, vous l'avez certainement vu dans de nombreuses séries criminelles, la technologie est utilisée pour analyser le profil de jurés, et tenter de prévoir leur positionnement, mais également pour analyser les décisions prises par chaque juge. Rien de bien nouveau, car les prétoires ont toujours été le berceau de rumeurs et de bruits de couloir : untel donne plutôt raison aux femmes, untel n'aime pas les hispaniques, untel est contre l'autodéfense, etc. Depuis toujours, les avocats ont imaginé améliorer leur stratégie, persuadés que les juges sont biaisés… tout simplement parce qu'ils sont humains. Un peu comme on commentait au lycée les professeurs qui nous étaient affectés en début d'année, les avocats commentent les juges qui leur sont affectés en début de procès. Mais au fait, les juges qui portent des lunettes sont-ils plus sévères que ceux qui ont une bonne vue ? Et les juges aux cheveux blancs sont-ils plus tolérants avec les jeunes majeurs ? Quand aux juges qui conduisent une peugeot, sont-ils plus sévères que ceux qui conduisent une Audi, dans les cas de violence conjugale ? Questions absurdes ? Peut-être. Mais si l'apprentissage machine nous apprenait le contraire. Que l'âge, la vue, la couleur des cheveux, la voiture qu'ils conduisent présentaient une corrélation avec leurs décisions. Si cela était mathématiquement prouvé, qu'est-ce que cela prouverait justement ? Que la justice est humaine, et donc biaisée. Dans ce cas, pourquoi ne pas l'analyser, et en utiliser les résultats ? Peut-être mais avec des limites très claires. Une loi publiée en 2019 précise en effet que les données nominatives des juges ne peuvent pas être utilisées. Il est donc interdit de prévoir la décision d'un juge en particulier dans une affaire. Mais elle ne peut empêcher la prédiction basée sur des caractéristiques, tant que celles-ci ne permettent pas de remonter à la personne, au juge. Alors, les juges qui se savent analysés gardent-ils le même comportement ? Où cela va-t-il les inciter modifier leurs décisions ? Les études menées depuis 2019 semblent montrer que globalement ces caractéristiques interviennent très peu dans les décisions. En revanche, les tribunaux, par le profil des affaires qu'ils jugent et leur volume, prennent clairement des sanctions différentes. Entre Bobigny et Versailles, les peines appliquées sont clairement différentes dans certains types d'affaires ? En viendra-t-on à préférer une justice artificielle, un algorithme qui appliquerait la loi, rien que la loi, sans aucune humanité ? Un film espagnol, Justicia Artificial, devrait d'ailleurs sortir en septembre prochain sur le sujet.

Podcast reviews

Read Decideo - Data Science, Big Data, Intelligence Augmentée podcast reviews


0 out of 5
0 reviews

Podcast sponsorship advertising

Start advertising on Decideo - Data Science, Big Data, Intelligence Augmentée relevant audience podcasts


What do you want to promote?