Versionnée et pratique

Documentation d’Equarith.

Installez Equarith, lancez votre première recherche, comprenez les résultats, automatisez vos processus et exportez des équations.

Importer et modifier les données

Equarith travaille avec des instantanés immuables de données numériques. Vous pouvez importer un fichier texte délimité, coller un tableau, le modifier dans la grille virtuelle ou charger un exemple généré. La recherche et les statistiques utilisent un instantané stable : aucun travail en arrière-plan ne lit une grille à moitié modifiée.

Moyens de charger des données

  • Sélectionnez Importer un fichier dans l’espace Données, utilisez Fichier > Importer un jeu de données… ou appuyez sur le raccourci d’importation pour choisir un fichier CSV, TSV ou texte numérique.
  • Glissez-déposez un fichier .csv, .tsv ou .txt sur l’espace Données pour ouvrir le même workflow d’importation.
  • Sélectionnez Coller des données pour lire un tableau séparé par des tabulations dans le presse-papiers. Si un jeu modifiable existe, les valeurs s’insèrent à partir de la sélection courante ; sinon, le presse-papiers devient un nouveau jeu de données.
  • Sélectionnez Charger un exemple pour générer localement un petit jeu de démonstration. Au démarrage normal, Distance de freinage est déjà chargé.

Une importation ou un collage ne remplace ou modifie les données du projet qu’après validation. Le fichier source et le contenu du presse-papiers ne sont jamais modifiés.

Données texte prises en charge

L’importeur accepte les fichiers CSV, TSV et les autres textes numériques délimités. Il peut détecter :

  • une séparation par virgule, point-virgule, tabulation ou espaces ;
  • la présence d’un en-tête sur la première ligne ;
  • une notation décimale avec point ou virgule ;
  • les encodages de texte usuels.

La boîte d’import affiche Aperçu des données et Diagnostics de l’aperçu. Vérifiez ou modifiez Séparateur, Ligne d’en-tête, Séparateur décimal, Encodage et Caractère de citation, puis sélectionnez Importer. Les choix d’encodage courants incluent UTF-8, ISO-8859-1 et US-ASCII ; vous pouvez saisir tout charset reconnu par l’environnement Java local.

L’aperçu affiche au plus cinq diagnostics individuels et résume les autres problèmes échantillonnés. Il reste volontairement borné pour préserver la réactivité. Le fichier complet n’est analysé et validé qu’après sélection de Importer, avant le remplacement du jeu de données actif.

La virgule ne peut pas servir simultanément de délimiteur de champs et de séparateur décimal. Pour des nombres à virgule, utilisez le point-virgule, la tabulation ou les espaces comme séparation de champs.

Valeurs manquantes, mal formées ou non finies

Par défaut, un champ vide, NA ou NaN est considéré comme manquant, sans distinction de casse. Les espaces en début et fin de champ sont ignorés et les lignes entièrement vides sont sautées.

Les infinis positifs ou négatifs et les autres valeurs numériques non finies sont invalides pour la recherche. Une ligne trop courte est complétée et une ligne trop longue est tronquée, avec affichage de diagnostics. Une structure de guillemets invalide provoque l’échec du fichier car les limites des champs ne peuvent plus être interprétées de façon sûre.

Examinez les nombres finaux de lignes, colonnes et valeurs manquantes ainsi que les diagnostics, plutôt que de vous fier uniquement à l’aperçu.

En-têtes et symboles de formule

Les noms de colonnes affichés sont transformés en symboles sûrs, uniques et utilisables dans les formules. Préférez des noms courts et distincts comme masse, vitesse et distance. Documentez les unités séparément ou ajoutez un suffixe concis, par exemple temps_s.

Le renommage d’une colonne met à jour le modèle tout en conservant son identité stable lorsque le format l’exige. Equarith évite les symboles de formule ambigus même si les en-têtes importés sont répétés ou contiennent de la ponctuation.

Modifier la grille

La grille est virtualisée et reste utilisable avec des données qui seraient trop volumineuses si chaque cellule devenait un contrôle d’interface.

  • Double-cliquez sur une cellule, ou appuyez sur Entrée ou F2, pour la modifier.
  • Déplacez-vous avec les touches fléchées.
  • Étendez une sélection avec Maj et utilisez le raccourci de la plateforme avec C ou V pour copier ou coller.
  • Les tableaux collés utilisent des cellules séparées par tabulation.
  • Ajoutez des lignes ou colonnes depuis les commandes de la grille.
  • Renommez une colonne depuis son en-tête.
  • Appuyez sur Suppr ou Retour arrière pour vider les cellules modifiables sélectionnées. Supprimez des lignes ou colonnes complètes avec la commande ou le menu contextuel adapté.
  • Annulez ou rétablissez les modifications avec les raccourcis habituels.

Les changements sont appliqués hors du thread d’interface JavaFX. Pendant une recherche, importation, collage, modification des cellules ou de la structure, annulation et rétablissement sont désactivés afin que l’instantané capturé et le projet visible ne divergent pas. Arrêtez la recherche, modifiez les données, puis sélectionnez de nouveau Démarrer pour utiliser le nouvel instantané.

Lignes participant à la recherche

Une ligne n’est admissible que si la cible et chacune des entrées sélectionnées contiennent des nombres finis. Les autres lignes sont exclues avant la séparation entraînement/test.

En mode Démo, la limite s’applique aux 200 premières lignes de la source avant ce filtrage. Deux cents lignes source peuvent donc produire moins de 200 lignes utilisables. Le mode Démo accepte aussi au maximum quatre entrées sélectionnées par recherche.

Les fonctions d’historique ont besoin de lignes source antérieures. Leurs lignes de chauffe et les lignes dont l’historique requis est invalide sont exclues avant la séparation. Une attribution aléatoire aux ensembles d’entraînement et de test ne change pas l’ordre chronologique utilisé par l’historique.

Le modèle général exige au moins trois lignes et deux colonnes, mais une recherche donnée doit aussi disposer d’assez de lignes admissibles pour la séparation demandée. La taille maximale pratique dépend de la mémoire disponible, du nombre de colonnes, des opérations actives et du nombre de workers. Equarith impose également des bornes de sécurité pour refuser des données denses déraisonnables.

Conseils de préparation

  • Examinez les nombres de valeurs manquantes et invalides avant de choisir les variables.
  • Utilisez des unités cohérentes dans chaque colonne.
  • Évitez les identifiants, dates ou catégories encodés par des nombres arbitraires, sauf si leur sens numérique est intentionnel.
  • Recherchez les doublons accidentels, valeurs impossibles et changements de régime de mesure.
  • Pour une validation réellement temporelle, utilisez une séparation séquentielle ; pour des observations interchangeables, utilisez une séparation aléatoire avec graine.
  • Ne supprimez pas automatiquement les valeurs aberrantes. Déterminez s’il s’agit d’erreurs, de cas rares valides ou du signe qu’une seule formule ne suffit pas.
  • La normalisation peut améliorer la recherche numérique ; les formules publiées sont retranscrites dans les unités d’origine.

Persistance et export

Un fichier importé et inchangé peut être enregistré par référence dans un projet, ou ses données peuvent être incorporées pour rendre le projet portable. Les données modifiées, collées ou générées sont incorporées. À la réouverture, les données référencées sont vérifiées par empreinte de contenu et par schéma.

Sélectionnez Exporter au format CSV pour écrire le jeu de données actuellement modifié. Effacer le jeu de données retire toutes les données du projet après confirmation ; cette action ne supprime pas le fichier source importé. Les exports de prédictions sont distincts : les CSV de l’espace Prédiction comprennent une colonne d’état par formule, tandis que ceux de Recherche et de la CLI contiennent les colonnes source et la prédiction, avec une cellule de prédiction vide pour un résultat non fini.

Poursuivez avec Configurer une recherche ou consultez Projets, récupération et checkpoints.