Terminate reading a cluster early if another cluster is encountered (fixes #164)

This commit is contained in:
Vanilagy
2025-10-21 16:18:48 +02:00
parent 0c4c13cea2
commit e676de4129
+42 -37
View File
@@ -637,7 +637,10 @@ export class MatroskaDemuxer extends Demuxer {
this.currentCluster = cluster; this.currentCluster = cluster;
if (dataSlice) { if (dataSlice) {
this.readContiguousElements(dataSlice); // Read the children of the cluster, stopping early at level 0 or 1 EBML elements. We do this because some
// clusters have incorrect sizes that are too large
const endPos = this.readContiguousElements(dataSlice, LEVEL_0_AND_1_EBML_IDS);
cluster.elementEndPos = endPos;
} }
for (const [, trackData] of cluster.trackData) { for (const [, trackData] of cluster.trackData) {
@@ -913,24 +916,31 @@ export class MatroskaDemuxer extends Demuxer {
} }
} }
readContiguousElements(slice: FileSlice) { readContiguousElements(slice: FileSlice, stopIds?: number[]) {
const startIndex = slice.filePos; const startIndex = slice.filePos;
while (slice.filePos - startIndex <= slice.length - MIN_HEADER_SIZE) { while (slice.filePos - startIndex <= slice.length - MIN_HEADER_SIZE) {
const foundElement = this.traverseElement(slice); const startPos = slice.filePos;
const foundElement = this.traverseElement(slice, stopIds);
if (!foundElement) { if (!foundElement) {
break; return startPos;
} }
} }
return slice.filePos;
} }
traverseElement(slice: FileSlice): boolean { traverseElement(slice: FileSlice, stopIds?: number[]): boolean {
const header = readElementHeader(slice); const header = readElementHeader(slice);
if (!header) { if (!header) {
return false; return false;
} }
if (stopIds && stopIds.includes(header.id)) {
return false;
}
const { id, size } = header; const { id, size } = header;
const dataStartPos = slice.filePos; const dataStartPos = slice.filePos;
assertDefinedSize(size); assertDefinedSize(size);
@@ -2174,6 +2184,8 @@ abstract class MatroskaTrackBacking implements InputTrackBacking {
if (id === EBMLId.Cluster) { if (id === EBMLId.Cluster) {
currentCluster = await demuxer.readCluster(elementStartPos, segment); currentCluster = await demuxer.readCluster(elementStartPos, segment);
// readCluster computes the proper size even if it's undefined in the header, so let's use that instead
size = currentCluster.elementEndPos - dataStartPos;
const { blockIndex, correctBlockFound } = getMatchInCluster(currentCluster); const { blockIndex, correctBlockFound } = getMatchInCluster(currentCluster);
if (correctBlockFound) { if (correctBlockFound) {
@@ -2190,44 +2202,37 @@ abstract class MatroskaTrackBacking implements InputTrackBacking {
// Undefined element size (can happen in livestreamed files). In this case, we need to do some // Undefined element size (can happen in livestreamed files). In this case, we need to do some
// searching to determine the actual size of the element. // searching to determine the actual size of the element.
if (id === EBMLId.Cluster) { assert(id !== EBMLId.Cluster); // Undefined cluster sizes are fixed further up
// The cluster should have already computed its length, we can just copy that result
assert(currentCluster);
size = currentCluster.elementEndPos - dataStartPos;
} else {
// Search for the next element at level 0 or 1
const nextElementPos = await searchForNextElementId(
demuxer.reader,
dataStartPos,
LEVEL_0_AND_1_EBML_IDS,
segment.elementEndPos,
);
size = nextElementPos.pos - dataStartPos; // Search for the next element at level 0 or 1
} const nextElementPos = await searchForNextElementId(
demuxer.reader,
dataStartPos,
LEVEL_0_AND_1_EBML_IDS,
segment.elementEndPos,
);
const endPos = dataStartPos + size; size = nextElementPos.pos - dataStartPos;
if (segment.elementEndPos !== null && endPos > segment.elementEndPos - MIN_HEADER_SIZE) { }
// No more elements fit in this segment
const endPos = dataStartPos + size;
if (segment.elementEndPos === null) {
// Check the next element. If it's a new segment, we know this segment ends here. The new
// segment is just ignored, since we're likely in a livestreamed file and thus only care about
// the first segment.
let slice = demuxer.reader.requestSliceRange(endPos, MIN_HEADER_SIZE, MAX_HEADER_SIZE);
if (slice instanceof Promise) slice = await slice;
if (!slice) break;
const elementId = readElementId(slice);
if (elementId === EBMLId.Segment) {
segment.elementEndPos = endPos; // We now know the segment's size
break; break;
} else {
// Check the next element. If it's a new segment, we know this segment ends here. The new
// segment is just ignored, since we're likely in a livestreamed file and thus only care about
// the first segment.
let slice = demuxer.reader.requestSliceRange(endPos, MIN_HEADER_SIZE, MAX_HEADER_SIZE);
if (slice instanceof Promise) slice = await slice;
if (!slice) break;
const elementId = readElementId(slice);
if (elementId === EBMLId.Segment) {
segment.elementEndPos = endPos;
break;
}
} }
} }
currentPos = dataStartPos + size; currentPos = endPos;
} }
// Catch faulty cue points // Catch faulty cue points