Lot U — le nombre de pages `Livre.NombrePages` est nullable, sans valeur par défaut : « 0 page » se lirait comme une donnée là où l'on veut dire « on ne sait pas ». Même raison que pour `TypeDocument.NonPrecise` — un défaut qui ne prétend rien n'a rien à reprendre, d'où une migration réduite à un `AddColumn`. Le service refuse un zéro plutôt que de l'écrire ; effacer le champ reste la façon de revenir à « inconnu ». Le préremplissage vient de `dc:format`, que rien ne lisait jusqu'ici. ⚠️ Ce champ n'est pas un nombre mais une phrase décrivant le support, et les notices déjà enregistrées sous Fixtures/ le montrent : « 1 vol. (113 p.) : ill., couv. ill. en coul. ; 18 cm », « 503 p. : couv. ill. ; 17 cm ». Les règles sont donc étroites — un nombre suivi de « p. » ou de « page(s) », rien d'autre — et tout le reste rend `null`. L'erreur n'est pas symétrique : un champ vide se remplit à la main en trois secondes, un chiffre faux s'enregistre sans que personne ne le voie. « 1 vol. » ne vaut pas 1, « 30 cm » ne vaut pas 30, et « (p. 45-90) », qui est une pagination de contribution, ne vaut rien. La valeur reste proposée dans un champ modifiable, et rien n'est déduit pour un ebook. Lot X — éditer une envie, et souhaiter une revue `PUT /api/souhaits/{id}` recalcule la clé d'œuvre et l'auteur normalisé : sans ce recalcul, le rapprochement « déjà au catalogue » continuerait de se faire sur l'ancienne forme, et le signalement mentirait sans le dire. Le filtre sur l'appelant fait partie de la clé de recherche, pas d'une vérification ultérieure — l'envie d'un autre est introuvable (404), jamais refusée (403). ⚠️ Une édition peut heurter l'unicité (utilisateur, œuvre, auteur), ce qu'un ajout ne peut pas : renommer une envie en une autre déjà présente répond par un message lisible, jamais par « UNIQUE constraint failed ». 400 et non 409, contrairement au doublon du catalogue : là-bas posséder deux exemplaires est légitime et l'appel se reconfirme, ici l'index l'interdit et il n'y a rien à confirmer. Le rang n'est pas touché — l'ordre a son propre point d'entrée. ⚠️ La couverture n'est écrite que si la charge utile en porte une. Aucun écran n'offre de champ « URL de couverture » pour une envie (décision actée), donc un remplacement inconditionnel l'aurait effacée à la première faute de frappe corrigée. `RevueSouhaitee` est une table sœur, et non des colonnes de plus sur `LivreSouhaite` : un numéro n'a pas d'auteur et se distingue par son numéro, deux choses que la clé d'unicité des envies de livres ne sait pas exprimer sans devenir fausse pour tout le monde. `NumeroNormalise` est NOT NULL avec un défaut vide — SQLite tient deux NULL pour distincts, et « Médor, sans numéro » s'ajouterait autant de fois qu'on cliquerait. L'ISSN est canonisé avec son tiret, seul code du projet rangé ainsi. Le coût de la table sœur est payé partout où il devait l'être : affichage, `.txt`, `.csv` et instantané hors-ligne `souhaits-revues`. ⚠️ Les revues forment une SECTION à part plutôt que des lignes entrelacées : chaque table numérote son rang indépendamment, et mélanger deux suites sans rapport produirait un ordre que personne n'a choisi. Le `.txt`, groupé par auteur, ne pouvait de toute façon pas les accueillir — elles n'en ont pas, et « Auteur non précisé » désigne des livres dont l'auteur est inconnu. Le CSV gagne une colonne « Type » : sans elle, un tri par titre rendrait revues et livres indiscernables, et la colonne des codes mêlerait ISBN et ISSN en silence. `ServiceRenormalisation` connaît la nouvelle table, avec la règle de collision déjà en place. ⚠️ L'ISSN y est canonisé à part : `Renormaliser` n'applique rien quand la clé ne bouge pas, un ISSN mal formé sur une ligne au titre inchangé y échapperait. `RevueSouhaitee` ne porte PAS de `CoverUrl` : rien à ajouter au garde de `GET /api/couvertures`. Vérifié en exécution : ISSN « 24666718 » rangé « 2466-6718 », édition de l'envie d'un autre en 404, et les deux exports portant bien les deux moitiés. 602 tests au vert (552 au départ), aucun avertissement de compilation. Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
151 lines
5.8 KiB
C#
151 lines
5.8 KiB
C#
using System.Xml.Linq;
|
|
using MaBibli.Shared.Dtos;
|
|
|
|
namespace MaBibli.Api.Services.Isbn;
|
|
|
|
/// <summary>
|
|
/// Lecture d'une réponse SRU de la BnF au schéma <c>dublincore</c>.
|
|
/// </summary>
|
|
/// <remarks>
|
|
/// Fonction pure : aucun accès réseau, ce qui permet de la tester sur des réponses réelles
|
|
/// enregistrées sur disque.
|
|
/// </remarks>
|
|
public static class BnfSruParser
|
|
{
|
|
private static readonly XNamespace Srw = "http://www.loc.gov/zing/srw/";
|
|
private static readonly XNamespace Dc = "http://purl.org/dc/elements/1.1/";
|
|
|
|
/// <summary>Nombre de notices annoncé par <c><srw:numberOfRecords></c>, ou 0.</summary>
|
|
public static int LireNombreDeNotices(string xml)
|
|
{
|
|
var doc = XDocument.Parse(xml);
|
|
var valeur = doc.Descendants(Srw + "numberOfRecords").FirstOrDefault()?.Value;
|
|
return int.TryParse(valeur, out var n) ? n : 0;
|
|
}
|
|
|
|
/// <summary>
|
|
/// Convertit la réponse SRU en candidats, champs déjà nettoyés de la ponctuation ISBD.
|
|
/// </summary>
|
|
/// <param name="xml">Corps de la réponse SRU.</param>
|
|
/// <param name="isbnInterroge">Forme d'ISBN qui a produit cette réponse (13 ou 10).</param>
|
|
/// <param name="urlCouverture">URL de couverture OpenLibrary à attacher (la BnF n'en fournit pas).</param>
|
|
public static IReadOnlyList<CandidatLivre> Parser(string xml, string isbnInterroge, string? urlCouverture)
|
|
{
|
|
var doc = XDocument.Parse(xml);
|
|
var candidats = new List<CandidatLivre>();
|
|
|
|
foreach (var record in doc.Descendants(Srw + "record"))
|
|
{
|
|
var data = record.Element(Srw + "recordData");
|
|
if (data is null)
|
|
{
|
|
continue;
|
|
}
|
|
|
|
// Plusieurs dc:creator sont possibles : un livre peut avoir plusieurs auteurs.
|
|
var auteurs = Tous(data, "creator")
|
|
.Select(NettoyageIsbd.Auteur)
|
|
.Where(a => a is not null)
|
|
.Select(a => a!)
|
|
.Distinct()
|
|
.ToList();
|
|
|
|
var titre = NettoyageIsbd.Titre(Premier(data, "title"));
|
|
|
|
// Certaines notices recollent le nom de l'auteur en fin de titre sans le séparateur
|
|
// ISBD — il faut donc les auteurs nettoyés avant de pouvoir finir le titre.
|
|
titre = NettoyageIsbd.RetirerAuteurEnFin(titre, auteurs);
|
|
|
|
if (titre is null)
|
|
{
|
|
// Une notice sans titre exploitable n'a aucun intérêt pour un pré-remplissage.
|
|
continue;
|
|
}
|
|
|
|
var identifiant = record.Element(Srw + "recordIdentifier")?.Value?.Trim();
|
|
|
|
candidats.Add(new CandidatLivre
|
|
{
|
|
Titre = titre,
|
|
Auteurs = auteurs,
|
|
Editeur = NettoyageIsbd.Editeur(Premier(data, "publisher")),
|
|
Annee = Premier(data, "date"),
|
|
Langue = Premier(data, "language"),
|
|
|
|
// ⚠️ Plusieurs dc:format cohabitent sur une notice (« 1 vol. (349 p.) », puis
|
|
// « 30 cm ») : on prend le PREMIER qui donne une pagination, et non le premier
|
|
// tout court, qui pourrait n'être qu'une dimension.
|
|
NombrePages = Tous(data, "format")
|
|
.Select(NettoyageIsbd.NombreDePages)
|
|
.FirstOrDefault(pages => pages is not null),
|
|
CoverUrl = urlCouverture,
|
|
Source = SourceMetadonnees.Bnf,
|
|
IsbnInterroge = isbnInterroge,
|
|
IdentifiantSource = identifiant,
|
|
UrlNotice = UrlNotice(identifiant),
|
|
});
|
|
}
|
|
|
|
return candidats;
|
|
}
|
|
|
|
private static string? UrlNotice(string? identifiant) =>
|
|
string.IsNullOrWhiteSpace(identifiant)
|
|
? null
|
|
: $"https://catalogue.bnf.fr/{identifiant}";
|
|
|
|
/// <summary>
|
|
/// Lit la <b>première</b> notice d'une réponse SRU interrogée par <c>bib.issn</c>.
|
|
/// </summary>
|
|
/// <remarks>
|
|
/// On ne renvoie qu'une notice, et sans laisser le choix : le but n'est pas de cataloguer
|
|
/// la revue — le modèle de données ne le permet pas — mais de <b>nommer</b> ce que
|
|
/// l'utilisateur vient de scanner. Un ISSN désigne un et un seul titre de périodique, donc
|
|
/// les notices suivantes ne diraient rien de plus.
|
|
/// <para>
|
|
/// Une notice de revue porte souvent <b>deux</b> <c>dc:title</c> : le titre clé qualifié
|
|
/// (« Médor (Bruxelles) ») puis le titre développé avec sa mention de responsabilité.
|
|
/// C'est le premier qu'on retient — le second est l'accroche commerciale, pas le nom.
|
|
/// </para>
|
|
/// </remarks>
|
|
/// <returns><c>null</c> si la réponse ne contient aucune notice exploitable.</returns>
|
|
public static PeriodiqueDetecte? ParserPeriodique(string xml, string issn)
|
|
{
|
|
var doc = XDocument.Parse(xml);
|
|
|
|
foreach (var record in doc.Descendants(Srw + "record"))
|
|
{
|
|
var data = record.Element(Srw + "recordData");
|
|
if (data is null)
|
|
{
|
|
continue;
|
|
}
|
|
|
|
var titre = NettoyageIsbd.TitrePeriodique(Premier(data, "title"));
|
|
if (titre is null)
|
|
{
|
|
continue;
|
|
}
|
|
|
|
return new PeriodiqueDetecte
|
|
{
|
|
Issn = issn,
|
|
Titre = titre,
|
|
Editeur = NettoyageIsbd.Editeur(Premier(data, "publisher")),
|
|
Annee = Premier(data, "date"),
|
|
};
|
|
}
|
|
|
|
return null;
|
|
}
|
|
|
|
private static string? Premier(XElement recordData, string nomLocal) =>
|
|
Tous(recordData, nomLocal).FirstOrDefault();
|
|
|
|
private static IEnumerable<string> Tous(XElement recordData, string nomLocal) =>
|
|
recordData.Descendants(Dc + nomLocal)
|
|
.Select(e => e.Value?.Trim())
|
|
.Where(v => !string.IsNullOrEmpty(v))
|
|
.Select(v => v!);
|
|
}
|