Pour gérer vos consentements :

LinkedIn rend Open Source FeatureFu, boîte à outils du Machine Learning

LinkedIn rend Open Source FeatureFu. Écrite en Java, cette boîte à outils est destinée à l’extraction de caractéristiques à partir de données utilisées dans l’apprentissage automatique, dont les moteurs de décision et la modélisation statistique (classification, clustering et normalisation). FeatureFu peut servir différents objectifs. Dans un billet de blog du 4 septembre, Bing Zhao, ingénieur logiciel chez LinkedIn, donne l’exemple du réseau social professionnel qui veut isoler et classer les préférences des membres pour différents flux apparaissant en page d’accueil. Et ce en comptant le nombre de ‘j’aime’ (likes) dans l’historique et de commentaires laissés par le membre dans chaque type de flux.

Java, Expr et FeatureFu

Dans l’exemple ci-dessus, les chiffres bruts doivent être combinés à un ratio ‘j’aime-par-commentaire’, avant de pouvoir être utilisés comme un élément stable, avec une formule mathématique du type : (1 + j’aime) / (10 + commentaires), commente l’ingénieur. Normalement, la formule doit être codée en ligne et tout changement apporté à cette formule implique une modification du code… Le processus est assez chronophage. « Avec Expr [une biblothèque légère écrite en Java] et FeatureFu, nous aurons simplement besoin d’écrire la formule comme une expression symbolique ‘(/ (+ 1 j’aime) (+ 10 commentaires))’ et de l’inclure dans le fichier de configuration du modèle », explique-t-il. Avant d’ajouter : « toute modification future de la formule ne nécessitera qu’un changement de configuration de l’expression symbolique elle-même : ‘(- (log2 (+ 10 commentaires)) (log2 (+ 1 j’aime)))’ ». Cette option est bien plus « flexible et agile » que la précédente, selon lui.

LinkedIn et l’écosystème

Le code source de FeatureFu est disponible sous licence Apache 2.0 sur Github. FeatureFu est le dernier d’une longue série d’outils rendus Open Source par Linkedin, parmi lesquels : Azkaban, Kafka, Samza, Voldemort et, plus récemment, le framework Pinot d’analyse de données en temps réel.

Lire aussi :

Linkedin, des investissements qui inquiètent les analystes
Machine Learning contre statistiques « classiques » : qui remportera le match ? (tribune)

crédit photo © isak55 – Shutterstock

Recent Posts

Le Réseau interministériel de l’État, sujet à dépendance

La Cour des comptes appelle à formaliser et à professionnaliser certains aspects du RIE, tout…

2 heures ago

Etalab en position de faiblesse au sein de la Dinum

La Cour des comptes attire l'attention sur le risque d'affaiblissement d'Etalab, privé, ces dernières années,…

5 heures ago

Une Dinum « balbutiante » sur l’open data et les logiciels libres

Missions historiques de la Dinum, l'ouverture des données publiques et la promotion des logiciels libres…

6 heures ago

Pour son premier LLM codeur ouvert, Mistral AI choisit une architecture alternative

Pour développer une version 7B de son modèle Codestral, Mistral AI n'a pas utilisé de…

1 jour ago

Microsoft x Inflection AI : l’autorité de la concurrence britannique lance son enquête

L’Autorité de la concurrence et des marchés (CMA) britannique ouvre une enquête sur les conditions…

1 jour ago

Thomas Gourand, nouveau Directeur Général de Snowflake en France

Thomas Gourand est nommé Directeur Général pour la France. Il est chargé du développement de…

1 jour ago