Catégorie : Big Data

Monitoring Nifi via streaming de bulletin dans Hive 3

Monitoring Nifi via streaming de bulletin dans Hive 3

Publié le Modifié le

Contexte Dans le cadre du suivi de production et le monitoring Nifi, je vais vous présenter un moyen que nous utilisons pour sauvegarder l’ensemble des évènements « bulletin » au sein d’un cluster Nifi. Après avoir évoqué les enjeux, je vous présenterai l’implémentation technique ainsi qu’une alternative avec Impala. Composants utilisés CDP Private Cloud 7.1.2 …

Lire la suite

Architecture Druid

Architecture Druid

Publié le Modifié le

Apache Druid est une base de données analytique axé temps réel offrant la possibilité de persister des quantités de données immenses et d’en extraire de l’information à une vitesse hallucinante, le tout couvrant de nombreux use cases, Druid aurait donc tout pour plaire. Creusons l’architecture d’apache Druid ensemble. La dernière version stable de Druid est …

Lire la suite

La Cloudera Data Platform va plaire, mais à quel prix ?

La Cloudera Data Platform va plaire, mais à quel prix ?

Publié le Modifié le

Cloudera a depuis quelques mois sorti sa nouvelle plateforme Cloud native : Cloudera Data Platform. Elle se décline en plusieurs parties : de la gouvernance via SDX, une partie Cloud, piloté par Cloudera et déployable sur AWS et Azure (bientôt GCP) et enfin une partie hébergeable sur des serveurs chez soi avec une possibilité d’hybridation, possédant des capacités de déport de calcul dans un environnement conteneurisé Openshift.
Attention ! Les conteneurs sont à l’honneur pour ces offres attractives mais attention aux coûts cachés. Passons en revue ces différentes offres pour y voir plus clair

Lire la suite

GitLab version 13.5, quoi de neuf ?

GitLab version 13.5, quoi de neuf ?

Publié le Modifié le

La collaboration entre les utilisateurs est l’une des valeurs fondamentales de GitLab, et l’un des éléments clé du DevOps. Ce mois-ci, GitLab propose pas moins de 60 améliorations, dont plusieurs fonctionnalités destinées à la collaboration entre votre équipe, vos outils et vos pairs.

Lire la suite

GitLab version 13.4, quoi de neuf ?

GitLab version 13.4, quoi de neuf ?

Publié le Modifié le

Sortie le 22 septembre dernier, la dernière version de GitLab apporte son lot de nouveautés pour réduire les risques et accroître l’efficacité des équipes, améliorer l’expérience utilisateur et accélérer la CI/CD.

Lire la suite

Python 3.9, tour d’horizon et nouveautés

Python 3.9, tour d’horizon et nouveautés

Publié le Modifié le

Python 3.9, tour d’horizon Python 3.9 vient d’être annoncé le 6 Octobre 2020. Cette version amène plusieurs fonctionnalités très prometteuses. Corrige des bugs et se positionne par rapport à l’avenir du langage. A Cyrès, nous constatons une augmentation des développements Python, que ce soit dans le domaine du Big Data, des containeurs ou DevOps, Des …

Lire la suite

JupyterHub vs CDSW, comparatif : quelle solution choisir ?

JupyterHub vs CDSW, comparatif : quelle solution choisir ?

Publié le Modifié le

Avec la hausse des données à analyser et du besoin en Big Data, les Data Scientists ont de plus en plus besoin d’outils et plateformes répondant à leurs besoins tels que la suite Jupyter (JupyterHub) et Cloudera Data Science Workbench (CDSW).

Lire la suite

L’évolution prometteuse de Spark 3.0

L’évolution prometteuse de Spark 3.0

Publié le Modifié le

Novembre 2019, alors que je continuais à préparer ma présentation sur Spark en interne pour présenter cette technologie à mes collègues, j’ai été agréablement surpris de voir que Spark 3.0 a été annoncé en preview. Au fil des années, Spark a su s’imposer en tant que technologie majeur au niveau du data processing, et cette annonce appuie ce fait, de nombreuses nouveautés et changements ont été annoncés, ceci se traduisant par plus de 3000 tickets Jira, ce qui est énorme !

Lire la suite

Comment utiliser son budget innovation en tant que grand groupe ?

Comment utiliser son budget innovation en tant que grand groupe ?

Publié le Modifié le

Yohann Berhouc, Directeur Général de Cyrès a donné son point de vue en juin dernier sur la manière dont les grands groupes utilisent leur budget innovation au travers les différents départements qui les composent. Comment se constitue un budget innovation, comment les DSI s’organisent-elles en fonction de celui-ci, quels sont les objectifs de développement qui y sont associés. Des thèmes traités dans cet avis d’expert, publié initialement chez ZDnet.fr et Docaufutur.fr.

Lire la suite

Page Linkedin Cyrès

Facebook

Twitter

01/12/2021 @ 13:16
[Cas d'usage] Monitoring #apachenifi : un enjeux de taille.

On vous dévoile tout sur notre manière d'archiver et de mettre à disposition les données, sur la stack Cloudera CDP Private Cloud

#nifi #data #bigdata #cloudera

👉 https://t.co/AFDIbE98sB https://t.co/2qB3sEGxtN
cyresgroupe photo
01/06/2021 @ 11:39
Tour d'horizon sur l'architecture d'Apache Druid : une base de données analytique axée temps réel permettant d'enregistrer et de stocker de gros volumes de données et d’en extraire de l’information à une vitesse record ! #bigdata #apache
Par ici 👉 https://t.co/phEZEBvtw1 https://t.co/xOTk1AEixt
cyresgroupe photo