KYF - Keep Your Folio - Dashboard patrimonial 100% local, open-source & gratuit

Je fais une recherche pour determiner ce champs. C’est assez galère.

Dans la logique de simplifier la vie, je suppose qu’encoder une table ISIN vers code propriétaire est ce qui aurait le plus de sens. Avec un fallback qui faire une recherche Web pour les « nouveaux » / « exotiques » . « site:zonebourse.com ISIN » est un moyen simple d’avoir l’info, il y a peut etre mieux mais ca fait le job

Du coup, vous comprenez pourquoi j’éditais directement l’XML PP, ce qui n’est pas du tout satisfaisant. L’intégrer n’est pas compliquer mais ca change radicalement l’expérience utilisateur

1 « J'aime »

Pour les OPCVM, je suis passé par la base de données de Guillaume via son site Statavie.

Les prix sont mis à jour uniquement quand un actif est mis dans un contrat, ce qui évite les appels de prix sur Yahoo.

Keep Your Folio aura une base de données conséquente.

Des milliers d’actions, +2000 ETF, les OPCVM (ceux-ci dépendront de leurs remontées de prix de Yahoo Finance), ainsi que la base de données Coingecko pour les cryptos.

1 « J'aime »

Le convertisseur continue d’évoluer !

Parmi les nouveautés :

  • Import de plusieurs PDF en une seule fois : il est désormais possible de convertir plusieurs relevés simultanément.

  • Export au format ZIP : lors d’un traitement multiple, tous les fichiers générés sont regroupés dans une archive ZIP.

  • Affichage du texte brut : chaque PDF affiche désormais sa version texte extraite. Cela permet de vérifier facilement le contenu, de rechercher une information ou de faire un simple copier-coller si nécessaire.

  • Import du texte brut dans KYF : si un PDF n’est pas reconnu automatiquement, son texte brut peut être importé directement dans le Dashboard afin de tenter une lecture via le moteur d’analyse.

Il subsiste néanmoins une limite technique : certains établissements génèrent leurs PDF avec des polices propriétaires, des caractères réencodés ou une structure empêchant toute extraction fiable du texte. Dans ces cas précis, il est malheureusement impossible de récupérer les informations, que ce soit via le convertisseur automatique ou via le mode texte brut.

L’objectif est de rendre le convertisseur compatible avec le plus grand nombre de relevés possible, tout en proposant une solution de secours lorsque l’extraction automatique n’est pas envisageable.

@NB50816 J’ai testé le PDF que tu m’as envoyé, mais je n’ai malheureusement pas réussi à en extraire les données.

Il est difficile de savoir si cela provient de la qualité du document transmis ou si Swiss Life utilise une police propriétaire empêchant l’extraction du texte.

Peux-tu essayer avec le document PDF d’origine (non modifié) et me dire :

  • si les données sont correctement extraites ;

  • ou, à défaut, si le PDF s’affiche au moins en texte brut ?

Cela me permettra de mieux identifier l’origine du problème.

Merci d’avance pour ton retour !
Vous trouverez la nouvelle version Bêta à cette adresse : KYF — Convertisseur PDF v2.333

1 « J'aime »

Si je comprend bien la problématique, certaines entreprises génères des polices qui ne respectent pas les tables de correspondances standards (ex: unicode).

Sinon, extraire directement le texte fonctionnerai

Naivement, l’OCR même si cela n’est pas forcement fiable peut être une réponse
Il y a des lib JS offline, mais je ne sais pas ce que ca vaut. Mais je reserverai plutot ca au bitmap encodé une PDF

Sur c’est des tables de correspondances entre caractères. Ca s’apparente un peu à un chiffrement basique et c’est trivial à cassé (surtout que vous avez une idée du document à trouver)

C’est juste une idée « naive », je n’utilise pas votre outil et ca ne semble pas être forcement le point à regarder pour le moment

J’ai également testé une approche par OCR, mais le résultat n’était pas suffisamment intuitif pour l’utilisateur.

L’idée était de lui faire sélectionner les ISIN, les noms, les quantités ou les PRU directement sur le document. Les résultats étaient intéressants sur certains relevés, mais cela demandait une intervention manuelle. Je pense qu’une partie des utilisateurs n’aurait tout simplement pas pris le temps de le faire.

Je n’écarte toutefois pas cette solution. Si la V2 du convertisseur montre ses limites sur certains documents, elle pourrait devenir une option complémentaire à moyen terme.

Effectivement, certains courtiers utilisent des polices de caractères ou des encodages spécifiques qui rendent le texte illisible, même après un simple copier-coller d’un PDF sur PC.

C’est exactement ce qui rend le sujet compliqué : certains PDF ne contiennent pas réellement du texte exploitable, mais un encodage propriétaire. Le convertisseur doit donc s’adapter à plusieurs familles de documents plutôt qu’à un format universel.

Et malheureusement, je n’ai pas accès à suffisamment de relevés pour développer un parseur spécifique à chaque banque ou courtier, comme peut le faire Portfolio Performance grâce à sa communauté.

Un exemple concret est celui des relevés trimestriels et annuels du PER Bourso, dont le texte extrait est totalement inexploitable. Dans ce cas précis, un parseur dédié a dû être développé pour contourner le problème.