Entferne unerreichbaren Zweig im Rank-Muster, korrigiere Testnamen
src/ocr-extract.js: RANK_PATTERN enthielt [Xx], obwohl der Text an dieser Stelle bereits vollstaendig grossgeschrieben ist (normalizeToken laeuft vorher) - das kleine x konnte nie ankommen. Auf X reduziert, mit Kommentar begruendet. Die uebrigen Muster im Modul (CAPACITY_PATTERN, SPEED_PATTERN, PART_NUMBER_PATTERN, das formFactor-Muster, DATE_CODE_PATTERN) geprueft: keine weiteren unerreichbaren Zweige, alle nutzen bereits ausschliesslich Grossbuchstaben-Zeichenklassen bzw. Ziffern. test/ocr-extract.test.js: Testname behauptete "nur einer plausibel", der Referenztext enthaelt aber zwei plausible Datumscode-Kandidaten (1234 und 1908) - der Test belegt tatsaechlich, dass bei mehreren plausiblen Kandidaten der zuletzt vorkommende gewinnt. Umbenannt entsprechend. Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
This commit is contained in:
@@ -60,7 +60,7 @@ test('waehlt bei der Teilenummer den laengsten Bindestrich-Kandidaten, nicht den
|
||||
assert.equal(spec.partNumber, 'M386A8K40BM1-CRC4Y');
|
||||
});
|
||||
|
||||
test('verwirft den Datumscode, wenn mehrere vierstellige Bloecke vorkommen und nur einer plausibel ist', () => {
|
||||
test('bei mehreren plausiblen Datumscode-Kandidaten gewinnt der zuletzt vorkommende', () => {
|
||||
const spec = extractFields('SAMSUNG\n1234 5678\n64GB 2Rx4 PC4-2666\n9012\n1908');
|
||||
assert.equal(spec.dateCode, '1908');
|
||||
});
|
||||
|
||||
Reference in New Issue
Block a user