Coverage Report

Created: 2026-08-22 06:39

next uncovered line (L), next uncovered region (R), next uncovered branch (B)
/src/xpdf-4.06/xpdf/XRef.cc
Line
Count
Source
1
//========================================================================
2
//
3
// XRef.cc
4
//
5
// Copyright 1996-2003 Glyph & Cog, LLC
6
//
7
//========================================================================
8
9
#include <aconf.h>
10
11
#include <stdlib.h>
12
#include <stddef.h>
13
#include <string.h>
14
#include <ctype.h>
15
#include <limits.h>
16
#include "gmem.h"
17
#include "gmempp.h"
18
#include "gfile.h"
19
#include "Object.h"
20
#include "Stream.h"
21
#include "Lexer.h"
22
#include "Parser.h"
23
#include "Dict.h"
24
#include "Error.h"
25
#include "ErrorCodes.h"
26
#include "XRef.h"
27
28
//------------------------------------------------------------------------
29
30
32.4k
#define xrefSearchSize 1024  // read this many bytes at end of file
31
        //   to look for 'startxref'
32
33
//------------------------------------------------------------------------
34
// Permission bits
35
//------------------------------------------------------------------------
36
37
15.1k
#define permPrint    (1<<2)
38
15.1k
#define permChange   (1<<3)
39
15.1k
#define permCopy     (1<<4)
40
15.1k
#define permNotes    (1<<5)
41
32.4k
#define defPermFlags 0xfffc
42
43
//------------------------------------------------------------------------
44
// XRefPosSet
45
//------------------------------------------------------------------------
46
47
class XRefPosSet {
48
public:
49
50
  XRefPosSet();
51
  ~XRefPosSet();
52
  void add(GFileOffset pos);
53
  GBool check(GFileOffset pos);
54
589
  int getLength() { return len; }
55
630
  GFileOffset get(int idx) { return tab[idx]; }
56
57
private:
58
59
  int find(GFileOffset pos);
60
61
  GFileOffset *tab;
62
  int size;
63
  int len;
64
};
65
66
589
XRefPosSet::XRefPosSet() {
67
589
  size = 16;
68
589
  len = 0;
69
589
  tab = (GFileOffset *)gmallocn(size, sizeof(GFileOffset));
70
589
}
71
72
589
XRefPosSet::~XRefPosSet() {
73
589
  gfree(tab);
74
589
}
75
76
630
void XRefPosSet::add(GFileOffset pos) {
77
630
  int i;
78
79
630
  i = find(pos);
80
630
  if (i < len && tab[i] == pos) {
81
0
    return;
82
0
  }
83
630
  if (len == size) {
84
0
    if (size > INT_MAX / 2) {
85
0
      gMemError("Integer overflow in XRefPosSet::add()");
86
0
    }
87
0
    size *= 2;
88
0
    tab = (GFileOffset *)greallocn(tab, size, sizeof(GFileOffset));
89
0
  }
90
630
  if (i < len) {
91
10
    memmove(&tab[i + 1], &tab[i], (len - i) * sizeof(GFileOffset));
92
10
  }
93
630
  tab[i] = pos;
94
630
  ++len;
95
630
}
96
97
630
GBool XRefPosSet::check(GFileOffset pos) {
98
630
  int i;
99
100
630
  i = find(pos);
101
630
  return i < len && tab[i] == pos;
102
630
}
103
104
1.26k
int XRefPosSet::find(GFileOffset pos) {
105
1.26k
  int a, b, m;
106
107
1.26k
  a = - 1;
108
1.26k
  b = len;
109
  // invariant: tab[a] < pos < tab[b]
110
1.36k
  while (b - a > 1) {
111
106
    m = (a + b) / 2;
112
106
    if (tab[m] < pos) {
113
68
      a = m;
114
68
    } else if (tab[m] > pos) {
115
38
      b = m;
116
38
    } else {
117
0
      return m;
118
0
    }
119
106
  }
120
1.26k
  return b;
121
1.26k
}
122
123
//------------------------------------------------------------------------
124
// ObjectStream
125
//------------------------------------------------------------------------
126
127
class ObjectStream {
128
public:
129
130
  // Create an object stream, using object number <objStrNum>,
131
  // generation 0.
132
  ObjectStream(XRef *xref, int objStrNumA, int recursion);
133
134
5.35k
  GBool isOk() { return ok; }
135
136
  ~ObjectStream();
137
138
  // Return the object number of this object stream.
139
32.1k
  int getObjStrNum() { return objStrNum; }
140
141
  // Get the <objIdx>th object from this stream, which should be
142
  // object number <objNum>, generation 0.
143
  Object *getObject(int objIdx, int objNum, Object *obj);
144
145
private:
146
147
  int objStrNum;    // object number of the object stream
148
  int nObjects;     // number of objects in the stream
149
  Object *objs;     // the objects (length = nObjects)
150
  int *objNums;     // the object numbers (length = nObjects)
151
  GBool ok;
152
};
153
154
5.35k
ObjectStream::ObjectStream(XRef *xref, int objStrNumA, int recursion) {
155
5.35k
  Stream *str;
156
5.35k
  Lexer *lexer;
157
5.35k
  Parser *parser;
158
5.35k
  int *offsets;
159
5.35k
  Object objStr, obj1, obj2;
160
5.35k
  int first, i;
161
162
5.35k
  objStrNum = objStrNumA;
163
5.35k
  nObjects = 0;
164
5.35k
  objs = NULL;
165
5.35k
  objNums = NULL;
166
5.35k
  ok = gFalse;
167
168
5.35k
  if (!xref->fetch(objStrNum, 0, &objStr, recursion)->isStream()) {
169
44
    goto err1;
170
44
  }
171
172
5.30k
  if (!objStr.streamGetDict()->lookup("N", &obj1, recursion)->isInt()) {
173
13
    obj1.free();
174
13
    goto err1;
175
13
  }
176
5.29k
  nObjects = obj1.getInt();
177
5.29k
  obj1.free();
178
5.29k
  if (nObjects <= 0) {
179
15
    goto err1;
180
15
  }
181
182
5.28k
  if (!objStr.streamGetDict()->lookup("First", &obj1, recursion)->isInt()) {
183
157
    obj1.free();
184
157
    goto err1;
185
157
  }
186
5.12k
  first = obj1.getInt();
187
5.12k
  obj1.free();
188
5.12k
  if (first < 0) {
189
39
    goto err1;
190
39
  }
191
192
  // this is an arbitrary limit to avoid integer overflow problems
193
  // in the 'new Object[nObjects]' call (Acrobat apparently limits
194
  // object streams to 100-200 objects)
195
5.08k
  if (nObjects > 1000000) {
196
0
    error(errSyntaxError, -1, "Too many objects in an object stream");
197
0
    goto err1;
198
0
  }
199
5.08k
  objs = new Object[nObjects];
200
5.08k
  objNums = (int *)gmallocn(nObjects, sizeof(int));
201
5.08k
  offsets = (int *)gmallocn(nObjects, sizeof(int));
202
203
  // parse the header: object numbers and offsets
204
5.08k
  objStr.streamReset();
205
5.08k
  obj1.initNull();
206
5.08k
  str = new EmbedStream(objStr.getStream(), &obj1, gTrue, first);
207
5.08k
  lexer = new Lexer(xref, str);
208
5.08k
  parser = new Parser(xref, lexer, gFalse);
209
53.8k
  for (i = 0; i < nObjects; ++i) {
210
49.6k
    parser->getObj(&obj1, gTrue);
211
49.6k
    parser->getObj(&obj2, gTrue);
212
49.6k
    if (!obj1.isInt() || !obj2.isInt()) {
213
425
      obj1.free();
214
425
      obj2.free();
215
425
      delete parser;
216
425
      gfree(offsets);
217
425
      goto err2;
218
425
    }
219
49.2k
    objNums[i] = obj1.getInt();
220
49.2k
    offsets[i] = obj2.getInt();
221
49.2k
    obj1.free();
222
49.2k
    obj2.free();
223
49.2k
    if (objNums[i] < 0 || offsets[i] < 0 ||
224
49.0k
  (i > 0 && offsets[i] < offsets[i-1])) {
225
480
      delete parser;
226
480
      gfree(offsets);
227
480
      goto err2;
228
480
    }
229
49.2k
  }
230
4.17k
  lexer->skipToEOF();
231
4.17k
  delete parser;
232
233
  // skip to the first object - this generally shouldn't be needed,
234
  // because offsets[0] is normally 0, but just in case...
235
4.17k
  if (offsets[0] > 0) {
236
28
    objStr.getStream()->discardChars(offsets[0]);
237
28
  }
238
239
  // parse the objects
240
37.5k
  for (i = 0; i < nObjects; ++i) {
241
33.3k
    obj1.initNull();
242
33.3k
    if (i == nObjects - 1) {
243
4.17k
      str = new EmbedStream(objStr.getStream(), &obj1, gFalse, 0);
244
29.1k
    } else {
245
29.1k
      str = new EmbedStream(objStr.getStream(), &obj1, gTrue,
246
29.1k
          offsets[i+1] - offsets[i]);
247
29.1k
    }
248
33.3k
    lexer = new Lexer(xref, str);
249
33.3k
    parser = new Parser(xref, lexer, gFalse);
250
33.3k
    parser->getObj(&objs[i]);
251
33.3k
    lexer->skipToEOF();
252
33.3k
    delete parser;
253
33.3k
  }
254
255
4.17k
  gfree(offsets);
256
4.17k
  ok = gTrue;
257
258
5.08k
 err2:
259
5.08k
  objStr.streamClose();
260
5.35k
 err1:
261
5.35k
  objStr.free();
262
5.35k
}
263
264
5.35k
ObjectStream::~ObjectStream() {
265
5.35k
  int i;
266
267
5.35k
  if (objs) {
268
76.2k
    for (i = 0; i < nObjects; ++i) {
269
71.1k
      objs[i].free();
270
71.1k
    }
271
5.08k
    delete[] objs;
272
5.08k
  }
273
5.35k
  gfree(objNums);
274
5.35k
}
275
276
22.7k
Object *ObjectStream::getObject(int objIdx, int objNum, Object *obj) {
277
22.7k
  if (objIdx < 0 || objIdx >= nObjects || objNum != objNums[objIdx]) {
278
19
    obj->initNull();
279
22.6k
  } else {
280
22.6k
    objs[objIdx].copy(obj);
281
22.6k
  }
282
22.7k
  return obj;
283
22.7k
}
284
285
//------------------------------------------------------------------------
286
// XRef
287
//------------------------------------------------------------------------
288
289
32.4k
XRef::XRef(BaseStream *strA, GBool repair) {
290
32.4k
  GFileOffset pos;
291
32.4k
  Object obj;
292
32.4k
  XRefPosSet *posSet;
293
32.4k
  int i;
294
295
32.4k
  ok = gTrue;
296
32.4k
  errCode = errNone;
297
32.4k
  repaired = gFalse;
298
32.4k
  size = 0;
299
32.4k
  last = -1;
300
32.4k
  entries = NULL;
301
32.4k
  lastStartxrefPos = 0;
302
32.4k
  xrefTablePos = NULL;
303
32.4k
  xrefTablePosLen = 0;
304
32.4k
  streamEnds = NULL;
305
32.4k
  streamEndsLen = 0;
306
4.18M
  for (i = 0; i < objStrCacheSize; ++i) {
307
4.15M
    objStrs[i] = NULL;
308
4.15M
    objStrLastUse[i] = 0;
309
4.15M
  }
310
32.4k
  objStrCacheLength = 0;
311
32.4k
  objStrTime = 0;
312
313
32.4k
  encrypted = gFalse;
314
32.4k
  permFlags = defPermFlags;
315
32.4k
  ownerPasswordOk = gFalse;
316
317
551k
  for (i = 0; i < xrefCacheSize; ++i) {
318
519k
    cache[i].num = -1;
319
519k
  }
320
321
32.4k
#if MULTITHREADED
322
32.4k
  gInitMutex(&objStrsMutex);
323
32.4k
  gInitMutex(&cacheMutex);
324
32.4k
#endif
325
326
32.4k
  str = strA;
327
32.4k
  start = str->getStart();
328
329
  // if the 'repair' flag is set, try to reconstruct the xref table
330
32.4k
  if (repair) {
331
16.2k
    if (!(ok = constructXRef())) {
332
869
      errCode = errDamaged;
333
869
      return;
334
869
    }
335
15.3k
    repaired = gTrue;
336
337
  // if the 'repair' flag is not set, read the xref table
338
16.2k
  } else {
339
340
    // read the trailer
341
16.2k
    pos = getStartXref();
342
16.2k
    if (pos == 0) {
343
15.6k
      errCode = errDamaged;
344
15.6k
      ok = gFalse;
345
15.6k
      return;
346
15.6k
    }
347
348
    // read the xref table
349
589
    posSet = new XRefPosSet();
350
627
    while (readXRef(&pos, posSet, gFalse)) ;
351
589
    xrefTablePosLen = posSet->getLength();
352
589
    xrefTablePos = (GFileOffset *)gmallocn(xrefTablePosLen,
353
589
             sizeof(GFileOffset));
354
1.21k
    for (i = 0; i < xrefTablePosLen; ++i)  {
355
630
      xrefTablePos[i] = posSet->get(i);
356
630
    }
357
589
    delete posSet;
358
589
    if (!ok) {
359
563
      errCode = errDamaged;
360
563
      return;
361
563
    }
362
589
  }
363
364
  // get the root dictionary (catalog) object
365
15.3k
  trailerDict.dictLookupNF("Root", &obj);
366
15.3k
  if (obj.isRef()) {
367
15.3k
    rootNum = obj.getRefNum();
368
15.3k
    rootGen = obj.getRefGen();
369
15.3k
    obj.free();
370
15.3k
  } else {
371
13
    obj.free();
372
13
    if (!(ok = constructXRef())) {
373
5
      errCode = errDamaged;
374
5
      return;
375
5
    }
376
13
  }
377
378
  // now set the trailer dictionary's xref pointer so we can fetch
379
  // indirect objects from it
380
15.3k
  trailerDict.getDict()->setXRef(this);
381
15.3k
}
382
383
32.4k
XRef::~XRef() {
384
32.4k
  int i;
385
386
551k
  for (i = 0; i < xrefCacheSize; ++i) {
387
519k
    if (cache[i].num >= 0) {
388
143k
      cache[i].obj.free();
389
143k
    }
390
519k
  }
391
32.4k
  gfree(entries);
392
32.4k
  trailerDict.free();
393
32.4k
  if (xrefTablePos) {
394
589
    gfree(xrefTablePos);
395
589
  }
396
32.4k
  if (streamEnds) {
397
13.5k
    gfree(streamEnds);
398
13.5k
  }
399
4.18M
  for (i = 0; i < objStrCacheSize; ++i) {
400
4.15M
    if (objStrs[i]) {
401
4.17k
      delete objStrs[i];
402
4.17k
    }
403
4.15M
  }
404
32.4k
#if MULTITHREADED
405
32.4k
  gDestroyMutex(&objStrsMutex);
406
32.4k
  gDestroyMutex(&cacheMutex);
407
32.4k
#endif
408
32.4k
}
409
410
// Read the 'startxref' position.
411
16.2k
GFileOffset XRef::getStartXref() {
412
16.2k
  char buf[xrefSearchSize+1];
413
16.2k
  char *p;
414
16.2k
  int n, i;
415
416
  // read last xrefSearchSize bytes
417
16.2k
  str->setPos(xrefSearchSize, -1);
418
16.2k
  n = str->getBlock(buf, xrefSearchSize);
419
16.2k
  buf[n] = '\0';
420
421
  // find startxref
422
16.0M
  for (i = n - 9; i >= 0; --i) {
423
16.0M
    if (!strncmp(&buf[i], "startxref", 9)) {
424
722
      break;
425
722
    }
426
16.0M
  }
427
16.2k
  if (i < 0) {
428
15.5k
    return 0;
429
15.5k
  }
430
1.72k
  for (p = &buf[i+9]; isspace(*p & 0xff); ++p) ;
431
722
  lastXRefPos = strToFileOffset(p);
432
722
  lastStartxrefPos = str->getPos() - n + i;
433
434
722
  return lastXRefPos;
435
16.2k
}
436
437
// Read one xref table section.  Also reads the associated trailer
438
// dictionary, and returns the prev pointer (if any).  The [hybrid]
439
// flag is true when following the XRefStm link in a hybrid-reference
440
// file.
441
630
GBool XRef::readXRef(GFileOffset *pos, XRefPosSet *posSet, GBool hybrid) {
442
630
  Parser *parser;
443
630
  Object obj;
444
630
  GBool more;
445
630
  char buf[100];
446
630
  int n, i;
447
448
  // check for a loop in the xref tables
449
630
  if (posSet->check(*pos)) {
450
0
    error(errSyntaxWarning, -1, "Infinite loop in xref table");
451
0
    return gFalse;
452
0
  }
453
630
  posSet->add(*pos);
454
455
  // the xref data should either be "xref ..." (for an xref table) or
456
  // "nn gg obj << ... >> stream ..." (for an xref stream); possibly
457
  // preceded by whitespace
458
630
  str->setPos(start + *pos);
459
630
  n = str->getBlock(buf, 100);
460
2.41k
  for (i = 0; i < n && Lexer::isSpace(buf[i]); ++i) ;
461
462
  // parse an old-style xref table
463
630
  if (!hybrid &&
464
627
      i + 4 < n &&
465
562
      buf[i] == 'x' && buf[i+1] == 'r' && buf[i+2] == 'e' && buf[i+3] == 'f' &&
466
14
      Lexer::isSpace(buf[i+4])) {
467
14
    more = readXRefTable(pos, i + 5, posSet);
468
469
  // parse an xref stream
470
616
  } else {
471
616
    obj.initNull();
472
616
    parser = new Parser(NULL,
473
616
         new Lexer(NULL,
474
616
     str->makeSubStream(start + *pos, gFalse, 0, &obj)),
475
616
         gTrue);
476
616
    if (!parser->getObj(&obj, gTrue)->isInt()) {
477
375
      goto err;
478
375
    }
479
241
    obj.free();
480
241
    if (!parser->getObj(&obj, gTrue)->isInt()) {
481
143
      goto err;
482
143
    }
483
98
    obj.free();
484
98
    if (!parser->getObj(&obj, gTrue)->isCmd("obj")) {
485
12
      goto err;
486
12
    }
487
86
    obj.free();
488
86
    if (!parser->getObj(&obj)->isStream()) {
489
10
      goto err;
490
10
    }
491
76
    more = readXRefStream(obj.getStream(), pos);
492
76
    obj.free();
493
76
    delete parser;
494
76
  }
495
496
90
  return more;
497
498
540
 err:
499
540
  obj.free();
500
540
  delete parser;
501
540
  if (hybrid) {
502
0
    error(errSyntaxError, -1, "Invalid XRefStm link in trailer");
503
540
  } else {
504
540
    ok = gFalse;
505
540
  }
506
540
  return gFalse;
507
630
}
508
509
14
GBool XRef::readXRefTable(GFileOffset *pos, int offset, XRefPosSet *posSet) {
510
14
  XRefEntry entry;
511
14
  Parser *parser;
512
14
  Object obj, obj2;
513
14
  char buf[6];
514
14
  GFileOffset off, pos2;
515
14
  GBool more;
516
14
  int first, n, digit, newSize, gen, i, c;
517
518
14
  str->setPos(start + *pos + offset);
519
520
72
  while (1) {
521
1.64k
    do {
522
1.64k
      c = str->getChar();
523
1.64k
    } while (Lexer::isSpace(c));
524
72
    if (c == 't') {
525
9
      if (str->getBlock(buf, 6) != 6 || memcmp(buf, "railer", 6)) {
526
0
  goto err1;
527
0
      }
528
9
      break;
529
9
    }
530
63
    if (c < '0' || c > '9') {
531
0
      goto err1;
532
0
    }
533
63
    first = 0;
534
181
    do {
535
181
      digit = c - '0';
536
181
      if (first > (INT_MAX - digit) / 10) {
537
0
  goto err1;
538
0
      }
539
181
      first = (first * 10) + digit;
540
181
      c = str->getChar();
541
181
    } while (c >= '0' && c <= '9');
542
63
    if (!Lexer::isSpace(c)) {
543
0
      goto err1;
544
0
    }
545
120
    do {
546
120
      c = str->getChar();
547
120
    } while (Lexer::isSpace(c));
548
63
    n = 0;
549
118
    do {
550
118
      digit = c - '0';
551
118
      if (n > (INT_MAX - digit) / 10) {
552
0
  goto err1;
553
0
      }
554
118
      n = (n * 10) + digit;
555
118
      c = str->getChar();
556
118
    } while (c >= '0' && c <= '9');
557
63
    if (!Lexer::isSpace(c)) {
558
0
      goto err1;
559
0
    }
560
63
    if (first > INT_MAX - n) {
561
0
      goto err1;
562
0
    }
563
63
    if (first + n > size) {
564
8
      newSize = size ? size : 512;
565
8
      do {
566
8
  if (newSize > INT_MAX / 2) {
567
0
    goto err1;
568
0
  }
569
8
  newSize <<= 1;
570
8
      } while (first + n > newSize);
571
8
      entries = (XRefEntry *)greallocn(entries, newSize, sizeof(XRefEntry));
572
8.20k
      for (i = size; i < newSize; ++i) {
573
8.19k
  entries[i].offset = (GFileOffset)-1;
574
8.19k
  entries[i].type = xrefEntryFree;
575
8.19k
      }
576
8
      size = newSize;
577
8
    }
578
557
    for (i = first; i < first + n; ++i) {
579
998
      do {
580
998
  c = str->getChar();
581
998
      } while (Lexer::isSpace(c));
582
499
      off = 0;
583
4.97k
      do {
584
4.97k
  off = (off * 10) + (c - '0');
585
4.97k
  c = str->getChar();
586
4.97k
      } while (c >= '0' && c <= '9');
587
499
      if (!Lexer::isSpace(c)) {
588
1
  goto err1;
589
1
      }
590
498
      entry.offset = off;
591
498
      do {
592
498
  c = str->getChar();
593
498
      } while (Lexer::isSpace(c));
594
498
      gen = 0;
595
2.47k
      do {
596
2.47k
  gen = (gen * 10) + (c - '0');
597
2.47k
  c = str->getChar();
598
2.47k
      } while (c >= '0' && c <= '9');
599
498
      if (!Lexer::isSpace(c)) {
600
3
  goto err1;
601
3
      }
602
495
      entry.gen = gen;
603
495
      do {
604
495
  c = str->getChar();
605
495
      } while (Lexer::isSpace(c));
606
495
      if (c == 'n') {
607
488
  entry.type = xrefEntryUncompressed;
608
488
      } else if (c == 'f') {
609
6
  entry.type = xrefEntryFree;
610
6
      } else {
611
1
  goto err1;
612
1
      }
613
494
      c = str->getChar();
614
494
      if (!Lexer::isSpace(c)) {
615
0
  goto err1;
616
0
      }
617
494
      if (entries[i].offset == (GFileOffset)-1) {
618
361
  entries[i] = entry;
619
  // PDF files of patents from the IBM Intellectual Property
620
  // Network have a bug: the xref table claims to start at 1
621
  // instead of 0.
622
361
  if (i == 1 && first == 1 &&
623
4
      entries[1].offset == 0 && entries[1].gen == 65535 &&
624
4
      entries[1].type == xrefEntryFree) {
625
4
    i = first = 0;
626
4
    entries[0] = entries[1];
627
4
    entries[1].offset = (GFileOffset)-1;
628
4
  }
629
361
  if (i > last) {
630
14
    last = i;
631
14
  }
632
361
      }
633
494
    }
634
63
  }
635
636
  // read the trailer dictionary
637
9
  obj.initNull();
638
9
  parser = new Parser(NULL,
639
9
       new Lexer(NULL,
640
9
         str->makeSubStream(str->getPos(), gFalse, 0, &obj)),
641
9
       gTrue);
642
9
  parser->getObj(&obj);
643
9
  delete parser;
644
9
  if (!obj.isDict()) {
645
0
    obj.free();
646
0
    goto err1;
647
0
  }
648
649
  // get the 'Prev' pointer
650
  //~ this can be a 64-bit int (?)
651
9
  obj.getDict()->lookupNF("Prev", &obj2);
652
9
  if (obj2.isInt()) {
653
5
    *pos = (GFileOffset)(Guint)obj2.getInt();
654
5
    more = gTrue;
655
5
  } else if (obj2.isRef()) {
656
    // certain buggy PDF generators generate "/Prev NNN 0 R" instead
657
    // of "/Prev NNN"
658
0
    *pos = (GFileOffset)(Guint)obj2.getRefNum();
659
0
    more = gTrue;
660
4
  } else {
661
4
    more = gFalse;
662
4
  }
663
9
  obj2.free();
664
665
  // save the first trailer dictionary
666
9
  if (trailerDict.isNone()) {
667
4
    obj.copy(&trailerDict);
668
4
  }
669
670
  // check for an 'XRefStm' key
671
  //~ this can be a 64-bit int (?)
672
9
  if (obj.getDict()->lookup("XRefStm", &obj2)->isInt()) {
673
3
    pos2 = (GFileOffset)(Guint)obj2.getInt();
674
3
    readXRef(&pos2, posSet, gTrue);
675
3
    if (!ok) {
676
0
      obj2.free();
677
0
      obj.free();
678
0
      goto err1;
679
0
    }
680
3
  }
681
9
  obj2.free();
682
683
9
  obj.free();
684
9
  return more;
685
686
5
 err1:
687
5
  ok = gFalse;
688
5
  return gFalse;
689
9
}
690
691
76
GBool XRef::readXRefStream(Stream *xrefStr, GFileOffset *pos) {
692
76
  Dict *dict;
693
76
  int w[3];
694
76
  GBool more;
695
76
  Object obj, obj2, idx;
696
76
  int newSize, first, n, i;
697
698
76
  dict = xrefStr->getDict();
699
700
76
  if (!dict->lookupNF("Size", &obj)->isInt()) {
701
3
    goto err1;
702
3
  }
703
73
  newSize = obj.getInt();
704
73
  obj.free();
705
73
  if (newSize < 0) {
706
0
    goto err1;
707
0
  }
708
73
  if (newSize > size) {
709
46
    entries = (XRefEntry *)greallocn(entries, newSize, sizeof(XRefEntry));
710
4.25k
    for (i = size; i < newSize; ++i) {
711
4.21k
      entries[i].offset = (GFileOffset)-1;
712
4.21k
      entries[i].type = xrefEntryFree;
713
4.21k
    }
714
46
    size = newSize;
715
46
  }
716
717
73
  if (!dict->lookupNF("W", &obj)->isArray() ||
718
73
      obj.arrayGetLength() < 3) {
719
0
    goto err1;
720
0
  }
721
292
  for (i = 0; i < 3; ++i) {
722
219
    if (!obj.arrayGet(i, &obj2)->isInt()) {
723
0
      obj2.free();
724
0
      goto err1;
725
0
    }
726
219
    w[i] = obj2.getInt();
727
219
    obj2.free();
728
219
  }
729
73
  obj.free();
730
73
  if (w[0] < 0 || w[0] > 8 ||
731
73
      w[1] < 0 || w[1] > 8 ||
732
73
      w[2] < 0 || w[2] > 8) {
733
0
    goto err0;
734
0
  }
735
736
73
  xrefStr->reset();
737
73
  dict->lookupNF("Index", &idx);
738
73
  if (idx.isArray()) {
739
88
    for (i = 0; i+1 < idx.arrayGetLength(); i += 2) {
740
55
      if (!idx.arrayGet(i, &obj)->isInt()) {
741
0
  idx.free();
742
0
  goto err1;
743
0
      }
744
55
      first = obj.getInt();
745
55
      obj.free();
746
55
      if (!idx.arrayGet(i+1, &obj)->isInt()) {
747
0
  idx.free();
748
0
  goto err1;
749
0
      }
750
55
      n = obj.getInt();
751
55
      obj.free();
752
55
      if (first < 0 || n < 0 ||
753
54
    !readXRefStreamSection(xrefStr, w, first, n)) {
754
5
  idx.free();
755
5
  goto err0;
756
5
      }
757
55
    }
758
38
  } else {
759
35
    if (!readXRefStreamSection(xrefStr, w, 0, newSize)) {
760
10
      idx.free();
761
10
      goto err0;
762
10
    }
763
35
  }
764
58
  idx.free();
765
766
  //~ this can be a 64-bit int (?)
767
58
  dict->lookupNF("Prev", &obj);
768
58
  if (obj.isInt()) {
769
34
    *pos = (GFileOffset)(Guint)obj.getInt();
770
34
    more = gTrue;
771
34
  } else {
772
24
    more = gFalse;
773
24
  }
774
58
  obj.free();
775
58
  if (trailerDict.isNone()) {
776
34
    trailerDict.initDict(dict);
777
34
  }
778
779
58
  return more;
780
781
3
 err1:
782
3
  obj.free();
783
18
 err0:
784
18
  ok = gFalse;
785
18
  return gFalse;
786
3
}
787
788
89
GBool XRef::readXRefStreamSection(Stream *xrefStr, int *w, int first, int n) {
789
89
  long long type, gen, offset;
790
89
  int c, newSize, i, j;
791
792
89
  if (first + n < 0) {
793
0
    return gFalse;
794
0
  }
795
89
  if (first + n > size) {
796
2
    for (newSize = size ? 2 * size : 1024;
797
21
   first + n > newSize && newSize > 0;
798
19
   newSize <<= 1) ;
799
2
    if (newSize < 0) {
800
0
      return gFalse;
801
0
    }
802
2
    entries = (XRefEntry *)greallocn(entries, newSize, sizeof(XRefEntry));
803
2.88M
    for (i = size; i < newSize; ++i) {
804
2.88M
      entries[i].offset = (GFileOffset)-1;
805
2.88M
      entries[i].type = xrefEntryFree;
806
2.88M
    }
807
2
    size = newSize;
808
2
  }
809
3.29k
  for (i = first; i < first + n; ++i) {
810
3.21k
    if (w[0] == 0) {
811
5
      type = 1;
812
3.21k
    } else {
813
6.41k
      for (type = 0, j = 0; j < w[0]; ++j) {
814
3.21k
  if ((c = xrefStr->getChar()) == EOF) {
815
7
    return gFalse;
816
7
  }
817
3.20k
  type = (type << 8) + c;
818
3.20k
      }
819
3.21k
    }
820
8.35k
    for (offset = 0, j = 0; j < w[1]; ++j) {
821
5.14k
      if ((c = xrefStr->getChar()) == EOF) {
822
0
  return gFalse;
823
0
      }
824
5.14k
      offset = (offset << 8) + c;
825
5.14k
    }
826
3.21k
    if (offset < 0 || offset > GFILEOFFSET_MAX) {
827
0
      return gFalse;
828
0
    }
829
6.44k
    for (gen = 0, j = 0; j < w[2]; ++j) {
830
3.23k
      if ((c = xrefStr->getChar()) == EOF) {
831
1
  return gFalse;
832
1
      }
833
3.23k
      gen = (gen << 8) + c;
834
3.23k
    }
835
    // some PDF generators include a free entry with gen=0xffffffff
836
3.20k
    if ((gen < 0 || gen > INT_MAX) && type != 0) {
837
0
      return gFalse;
838
0
    }
839
3.20k
    if (entries[i].offset == (GFileOffset)-1) {
840
3.14k
      switch (type) {
841
127
      case 0:
842
127
  entries[i].offset = (GFileOffset)offset;
843
127
  entries[i].gen = (int)gen;
844
127
  entries[i].type = xrefEntryFree;
845
127
  break;
846
735
      case 1:
847
735
  entries[i].offset = (GFileOffset)offset;
848
735
  entries[i].gen = (int)gen;
849
735
  entries[i].type = xrefEntryUncompressed;
850
735
  break;
851
2.27k
      case 2:
852
2.27k
  entries[i].offset = (GFileOffset)offset;
853
2.27k
  entries[i].gen = (int)gen;
854
2.27k
  entries[i].type = xrefEntryCompressed;
855
2.27k
  break;
856
6
      default:
857
6
  return gFalse;
858
3.14k
      }
859
3.13k
      if (i > last) {
860
1.45k
  last = i;
861
1.45k
      }
862
3.13k
    }
863
3.20k
  }
864
865
75
  return gTrue;
866
89
}
867
868
// Attempt to construct an xref table for a damaged file.
869
16.2k
GBool XRef::constructXRef() {
870
16.2k
  int *streamObjNums = NULL;
871
16.2k
  int streamObjNumsLen = 0;
872
16.2k
  int streamObjNumsSize = 0;
873
16.2k
  int lastObjNum = -1;
874
16.2k
  rootNum = -1;
875
16.2k
  int streamEndsSize = 0;
876
16.2k
  streamEndsLen = 0;
877
16.2k
  char buf[4096 + 1];
878
16.2k
  str->reset();
879
16.2k
  GFileOffset bufPos = start;
880
16.2k
  char *p = buf;
881
16.2k
  char *end = buf;
882
16.2k
  GBool startOfLine = gTrue;
883
16.2k
  GBool space = gTrue;
884
16.2k
  GBool eof = gFalse;
885
223M
  while (1) {
886
223M
    if (end - p < 256 && !eof) {
887
70.0k
      memcpy(buf, p, end - p);
888
70.0k
      bufPos += p - buf;
889
70.0k
      p = buf + (end - p);
890
70.0k
      int n = (int)(buf + 4096 - p);
891
70.0k
      int m = str->getBlock(p, n);
892
70.0k
      end = p + m;
893
70.0k
      *end = '\0';
894
70.0k
      p = buf;
895
70.0k
      eof = m < n;
896
70.0k
    }
897
223M
    if (p == end && eof) {
898
16.2k
      break;
899
16.2k
    }
900
223M
    if (startOfLine && !strncmp(p, "trailer", 7)) {
901
27.4k
      constructTrailerDict((GFileOffset)(bufPos + (p + 7 - buf)));
902
27.4k
      p += 7;
903
27.4k
      startOfLine = gFalse;
904
27.4k
      space = gFalse;
905
223M
    } else if (startOfLine && !strncmp(p, "endstream", 9)) {
906
75.3k
      if (streamEndsLen == streamEndsSize) {
907
13.6k
  streamEndsSize += 64;
908
13.6k
  streamEnds = (GFileOffset *)greallocn(streamEnds, streamEndsSize,
909
13.6k
                sizeof(GFileOffset));
910
13.6k
      }
911
75.3k
      streamEnds[streamEndsLen++] = (GFileOffset)(bufPos + (p - buf));
912
75.3k
      p += 9;
913
75.3k
      startOfLine = gFalse;
914
75.3k
      space = gFalse;
915
223M
    } else if (space && *p >= '0' && *p <= '9') {
916
3.49M
      p = constructObjectEntry(p, (GFileOffset)(bufPos + (p - buf)),
917
3.49M
             &lastObjNum);
918
3.49M
      startOfLine = gFalse;
919
3.49M
      space = gFalse;
920
219M
    } else if (p[0] == '>' && p[1] == '>') {
921
696k
      p += 2;
922
696k
      startOfLine = gFalse;
923
696k
      space = gFalse;
924
      // skip any PDF whitespace except for '\0'
925
1.17M
      while (*p == '\t' || *p == '\n' || *p == '\x0c' ||
926
849k
       *p == '\r' || *p == ' ') {
927
477k
  if (*p == '\n' || *p == '\r') {
928
371k
    startOfLine = gTrue;
929
371k
  }
930
477k
  space = gTrue;
931
477k
  ++p;
932
477k
      }
933
696k
      if (!strncmp(p, "stream", 6)) {
934
197k
  if (lastObjNum >= 0) {
935
195k
    if (streamObjNumsLen == streamObjNumsSize) {
936
16.9k
      streamObjNumsSize += 64;
937
16.9k
      streamObjNums = (int *)greallocn(streamObjNums, streamObjNumsSize,
938
16.9k
               sizeof(int));
939
16.9k
    }
940
195k
    streamObjNums[streamObjNumsLen++] = lastObjNum;
941
195k
  }
942
197k
  p += 6;
943
197k
  startOfLine = gFalse;
944
197k
  space = gFalse;
945
197k
      }
946
218M
    } else {
947
218M
      if (*p == '\n' || *p == '\r') {
948
4.83M
  startOfLine = gTrue;
949
4.83M
  space = gTrue;
950
214M
      } else if (Lexer::isSpace(*p & 0xff)) {
951
22.7M
  space = gTrue;
952
191M
      } else {
953
191M
  startOfLine = gFalse;
954
191M
  space = gFalse;
955
191M
      }
956
218M
      ++p;
957
218M
    }
958
223M
  }
959
960
  // read each stream object, check for xref or object stream
961
211k
  for (int i = 0; i < streamObjNumsLen; ++i) {
962
195k
    Object obj;
963
195k
    fetch(streamObjNums[i], entries[streamObjNums[i]].gen, &obj);
964
195k
    if (obj.isStream()) {
965
164k
      Dict *dict = obj.streamGetDict();
966
164k
      Object type;
967
164k
      dict->lookup("Type", &type);
968
164k
      if (type.isName("XRef")) {
969
3.40k
  saveTrailerDict(dict, gTrue);
970
161k
      } else if (type.isName("ObjStm")) {
971
81.8k
  constructObjectStreamEntries(&obj, streamObjNums[i]);
972
81.8k
      }
973
164k
      type.free();
974
164k
    }
975
195k
    obj.free();
976
195k
  }
977
978
16.2k
  gfree(streamObjNums);
979
980
  // if the file is encrypted, then any objects fetched here will be
981
  // incorrect (because decryption is not yet enabled), so clear the
982
  // cache to avoid that problem
983
275k
  for (int i = 0; i < xrefCacheSize; ++i) {
984
259k
    if (cache[i].num >= 0) {
985
72.1k
      cache[i].obj.free();
986
72.1k
      cache[i].num = -1;
987
72.1k
    }
988
259k
  }
989
990
16.2k
  if (rootNum < 0) {
991
874
    error(errSyntaxError, -1, "Couldn't find trailer dictionary");
992
874
    return gFalse;
993
874
  }
994
15.3k
  return gTrue;
995
16.2k
}
996
997
// Attempt to construct a trailer dict at [pos] in the stream.
998
27.4k
void XRef::constructTrailerDict(GFileOffset pos) {
999
27.4k
  Object newTrailerDict, obj;
1000
27.4k
  obj.initNull();
1001
27.4k
  Parser *parser =
1002
27.4k
      new Parser(NULL,
1003
27.4k
     new Lexer(NULL,
1004
27.4k
         str->makeSubStream(pos, gFalse, 0, &obj)),
1005
27.4k
     gFalse);
1006
27.4k
  parser->getObj(&newTrailerDict);
1007
27.4k
  if (newTrailerDict.isDict()) {
1008
20.1k
    saveTrailerDict(newTrailerDict.getDict(), gFalse);
1009
20.1k
  }
1010
27.4k
  newTrailerDict.free();
1011
27.4k
  delete parser;
1012
27.4k
}
1013
1014
// If [dict] "looks like" a trailer dict (i.e., has a Root entry),
1015
// save it as the trailer dict.
1016
23.5k
void XRef::saveTrailerDict(Dict *dict, GBool isXRefStream) {
1017
23.5k
  Object obj;
1018
23.5k
  dict->lookupNF("Root", &obj);
1019
23.5k
  if (obj.isRef()) {
1020
20.5k
    int newRootNum = obj.getRefNum();
1021
    // the xref stream scanning code runs after all objects are found,
1022
    // so we can check for a valid root object number at that point
1023
20.5k
    if (!isXRefStream || newRootNum <= last) {
1024
20.5k
      rootNum = newRootNum;
1025
20.5k
      rootGen = obj.getRefGen();
1026
20.5k
      if (!trailerDict.isNone()) {
1027
5.15k
  trailerDict.free();
1028
5.15k
      }
1029
20.5k
      trailerDict.initDict(dict);
1030
20.5k
    }
1031
20.5k
  }
1032
23.5k
  obj.free();
1033
23.5k
}
1034
1035
// Look for an object header ("nnn ggg obj") at [p].  The first
1036
// character at *[p] is a digit.  [pos] is the position of *[p].
1037
3.49M
char *XRef::constructObjectEntry(char *p, GFileOffset pos, int *objNum) {
1038
  // we look for non-end-of-line space characters here, to deal with
1039
  // situations like:
1040
  //    nnn          <-- garbage digits on a line
1041
  //    nnn nnn obj  <-- actual object
1042
  // and we also ignore '\0' (because it's used to terminate the
1043
  // buffer in this damage-scanning code)
1044
3.49M
  int num = 0;
1045
10.2M
  do {
1046
10.2M
    num = (num * 10) + (*p - '0');
1047
10.2M
    ++p;
1048
10.2M
  } while (*p >= '0' && *p <= '9' && num < 100000000);
1049
3.49M
  if (*p != '\t' && *p != '\x0c' && *p != ' ') {
1050
1.16M
    return p;
1051
1.16M
  }
1052
2.40M
  do {
1053
2.40M
    ++p;
1054
2.40M
  } while (*p == '\t' || *p == '\x0c' || *p == ' ');
1055
2.33M
  if (!(*p >= '0' && *p <= '9')) {
1056
383k
    return p;
1057
383k
  }
1058
1.95M
  int gen = 0;
1059
3.81M
  do {
1060
3.81M
    gen = (gen * 10) + (*p - '0');
1061
3.81M
    ++p;
1062
3.81M
  } while (*p >= '0' && *p <= '9' && gen < 100000000);
1063
1.95M
  if (*p != '\t' && *p != '\x0c' && *p != ' ') {
1064
102k
    return p;
1065
102k
  }
1066
1.87M
  do {
1067
1.87M
    ++p;
1068
1.87M
  } while (*p == '\t' || *p == '\x0c' || *p == ' ');
1069
1.84M
  if (strncmp(p, "obj", 3)) {
1070
1.44M
    return p;
1071
1.44M
  }
1072
1073
400k
  if (constructXRefEntry(num, gen, pos - start, xrefEntryUncompressed)) {
1074
400k
    *objNum = num;
1075
400k
  }
1076
1077
400k
  return p;
1078
1.84M
}
1079
1080
// Read the header from an object stream, and add xref entries for all
1081
// of its objects.
1082
81.8k
void XRef::constructObjectStreamEntries(Object *objStr, int objStrObjNum) {
1083
81.8k
  Object obj1, obj2;
1084
1085
  // get the object count
1086
81.8k
  if (!objStr->streamGetDict()->lookup("N", &obj1)->isInt()) {
1087
785
    obj1.free();
1088
785
    return;
1089
785
  }
1090
81.0k
  int nObjects = obj1.getInt();
1091
81.0k
  obj1.free();
1092
81.0k
  if (nObjects <= 0 || nObjects > 1000000) {
1093
5.01k
    return;
1094
5.01k
  }
1095
1096
  // parse the header: object numbers and offsets
1097
76.0k
  Parser *parser = new Parser(NULL,
1098
76.0k
            new Lexer(NULL, objStr->getStream()->copy()),
1099
76.0k
            gFalse);
1100
71.9M
  for (int i = 0; i < nObjects; ++i) {
1101
71.9M
    parser->getObj(&obj1, gTrue);
1102
71.9M
    parser->getObj(&obj2, gTrue);
1103
71.9M
    if (obj1.isInt() && obj2.isInt()) {
1104
103k
      int num = obj1.getInt();
1105
103k
      if (num >= 0 && num < 1000000) {
1106
103k
  constructXRefEntry(num, i, objStrObjNum, xrefEntryCompressed);
1107
103k
      }
1108
103k
    }
1109
71.9M
    obj2.free();
1110
71.9M
    obj1.free();
1111
71.9M
  }
1112
76.0k
  delete parser;
1113
76.0k
}
1114
1115
GBool XRef::constructXRefEntry(int num, int gen, GFileOffset pos,
1116
504k
             XRefEntryType type) {
1117
504k
  if (num >= size) {
1118
17.0k
    int newSize = (num + 1 + 255) & ~255;
1119
17.0k
    if (newSize < 0) {
1120
0
      return gFalse;
1121
0
    }
1122
17.0k
    entries = (XRefEntry *)greallocn(entries, newSize, sizeof(XRefEntry));
1123
127M
    for (int i = size; i < newSize; ++i) {
1124
127M
      entries[i].offset = (GFileOffset)-1;
1125
127M
      entries[i].type = xrefEntryFree;
1126
127M
    }
1127
17.0k
    size = newSize;
1128
17.0k
  }
1129
1130
504k
  if (entries[num].type == xrefEntryFree ||
1131
444k
      gen >= entries[num].gen) {
1132
444k
    entries[num].offset = pos;
1133
444k
    entries[num].gen = gen;
1134
444k
    entries[num].type = type;
1135
444k
    if (num > last) {
1136
188k
      last = num;
1137
188k
    }
1138
444k
  }
1139
1140
504k
  return gTrue;
1141
504k
}
1142
1143
void XRef::setEncryption(int permFlagsA, GBool ownerPasswordOkA,
1144
       Guchar *fileKeyA, int keyLengthA, int encVersionA,
1145
826
       CryptAlgorithm encAlgorithmA) {
1146
826
  int i;
1147
1148
826
  encrypted = gTrue;
1149
826
  permFlags = permFlagsA;
1150
826
  ownerPasswordOk = ownerPasswordOkA;
1151
826
  if (keyLengthA <= 32) {
1152
826
    keyLength = keyLengthA;
1153
826
  } else {
1154
0
    keyLength = 32;
1155
0
  }
1156
6.03k
  for (i = 0; i < keyLength; ++i) {
1157
5.21k
    fileKey[i] = fileKeyA[i];
1158
5.21k
  }
1159
826
  encVersion = encVersionA;
1160
826
  encAlgorithm = encAlgorithmA;
1161
826
}
1162
1163
GBool XRef::getEncryption(int *permFlagsA, GBool *ownerPasswordOkA,
1164
        int *keyLengthA, int *encVersionA,
1165
0
        CryptAlgorithm *encAlgorithmA) {
1166
0
  if (!encrypted) {
1167
0
    return gFalse;
1168
0
  }
1169
0
  *permFlagsA = permFlags;
1170
0
  *ownerPasswordOkA = ownerPasswordOk;
1171
0
  *keyLengthA = keyLength;
1172
0
  *encVersionA = encVersion;
1173
0
  *encAlgorithmA = encAlgorithm;
1174
0
  return gTrue;
1175
0
}
1176
1177
15.1k
GBool XRef::okToPrint(GBool ignoreOwnerPW) {
1178
15.1k
  return (!ignoreOwnerPW && ownerPasswordOk) || (permFlags & permPrint);
1179
15.1k
}
1180
1181
15.1k
GBool XRef::okToChange(GBool ignoreOwnerPW) {
1182
15.1k
  return (!ignoreOwnerPW && ownerPasswordOk) || (permFlags & permChange);
1183
15.1k
}
1184
1185
15.1k
GBool XRef::okToCopy(GBool ignoreOwnerPW) {
1186
15.1k
  return (!ignoreOwnerPW && ownerPasswordOk) || (permFlags & permCopy);
1187
15.1k
}
1188
1189
15.1k
GBool XRef::okToAddNotes(GBool ignoreOwnerPW) {
1190
15.1k
  return (!ignoreOwnerPW && ownerPasswordOk) || (permFlags & permNotes);
1191
15.1k
}
1192
1193
1.91M
Object *XRef::fetch(int num, int gen, Object *obj, int recursion) {
1194
1.91M
  XRefEntry *e;
1195
1.91M
  Parser *parser;
1196
1.91M
  Object obj1, obj2, obj3;
1197
1.91M
  XRefCacheEntry tmp;
1198
1.91M
  int i, j;
1199
1200
  // check for bogus ref - this can happen in corrupted PDF files
1201
1.91M
  if (num < 0 || num >= size) {
1202
1.42k
    goto err;
1203
1.42k
  }
1204
1205
  // check the cache
1206
1.91M
#if MULTITHREADED
1207
1.91M
  gLockMutex(&cacheMutex);
1208
1.91M
#endif
1209
1.91M
  if (cache[0].num == num && cache[0].gen == gen) {
1210
545k
    cache[0].obj.copy(obj);
1211
545k
#if MULTITHREADED
1212
545k
    gUnlockMutex(&cacheMutex);
1213
545k
#endif
1214
545k
    return obj;
1215
545k
  }
1216
13.5M
  for (i = 1; i < xrefCacheSize; ++i) {
1217
12.8M
    if (cache[i].num == num && cache[i].gen == gen) {
1218
647k
      tmp = cache[i];
1219
2.62M
      for (j = i; j > 0; --j) {
1220
1.98M
  cache[j] = cache[j - 1];
1221
1.98M
      }
1222
647k
      cache[0] = tmp;
1223
647k
      cache[0].obj.copy(obj);
1224
647k
#if MULTITHREADED
1225
647k
      gUnlockMutex(&cacheMutex);
1226
647k
#endif
1227
647k
      return obj;
1228
647k
    }
1229
12.8M
  }
1230
721k
#if MULTITHREADED
1231
721k
  gUnlockMutex(&cacheMutex);
1232
721k
#endif
1233
1234
721k
  e = &entries[num];
1235
721k
  switch (e->type) {
1236
1237
263k
  case xrefEntryUncompressed:
1238
263k
    if (e->gen != gen) {
1239
6.35k
      goto err;
1240
6.35k
    }
1241
256k
    obj1.initNull();
1242
256k
    parser = new Parser(this,
1243
256k
         new Lexer(this,
1244
256k
     str->makeSubStream(start + e->offset, gFalse, 0, &obj1)),
1245
256k
         gTrue);
1246
256k
    parser->getObj(&obj1, gTrue);
1247
256k
    parser->getObj(&obj2, gTrue);
1248
256k
    parser->getObj(&obj3, gTrue);
1249
256k
    if (!obj1.isInt() || obj1.getInt() != num ||
1250
256k
  !obj2.isInt() || obj2.getInt() != gen ||
1251
256k
  !obj3.isCmd("obj")) {
1252
1.11k
      obj1.free();
1253
1.11k
      obj2.free();
1254
1.11k
      obj3.free();
1255
1.11k
      delete parser;
1256
1.11k
      goto err;
1257
1.11k
    }
1258
255k
    parser->getObj(obj, gFalse, encrypted ? fileKey : (Guchar *)NULL,
1259
255k
       encAlgorithm, keyLength, num, gen, recursion);
1260
255k
    obj1.free();
1261
255k
    obj2.free();
1262
255k
    obj3.free();
1263
255k
    delete parser;
1264
255k
    break;
1265
1266
24.1k
  case xrefEntryCompressed:
1267
#if 0 // Adobe apparently ignores the generation number on compressed objects
1268
    if (gen != 0) {
1269
      goto err;
1270
    }
1271
#endif
1272
24.1k
    if (e->offset >= (GFileOffset)size ||
1273
24.1k
  entries[e->offset].type != xrefEntryUncompressed) {
1274
248
      error(errSyntaxError, -1, "Invalid object stream");
1275
248
      goto err;
1276
248
    }
1277
23.8k
    if (!getObjectStreamObject((int)e->offset, e->gen, num, obj, recursion)) {
1278
1.17k
      goto err;
1279
1.17k
    }
1280
22.7k
    break;
1281
1282
434k
  default:
1283
434k
    goto err;
1284
721k
  }
1285
1286
  // put the new object in the cache, throwing away the oldest object
1287
  // currently in the cache
1288
278k
#if MULTITHREADED
1289
278k
  gLockMutex(&cacheMutex);
1290
278k
#endif
1291
278k
  if (cache[xrefCacheSize - 1].num >= 0) {
1292
62.7k
    cache[xrefCacheSize - 1].obj.free();
1293
62.7k
  }
1294
4.45M
  for (i = xrefCacheSize - 1; i > 0; --i) {
1295
4.17M
    cache[i] = cache[i - 1];
1296
4.17M
  }
1297
278k
  cache[0].num = num;
1298
278k
  cache[0].gen = gen;
1299
278k
  obj->copy(&cache[0].obj);
1300
278k
#if MULTITHREADED
1301
278k
  gUnlockMutex(&cacheMutex);
1302
278k
#endif
1303
1304
278k
  return obj;
1305
1306
444k
 err:
1307
444k
  return obj->initNull();
1308
721k
}
1309
1310
GBool XRef::getObjectStreamObject(int objStrNum, int objIdx,
1311
23.8k
          int objNum, Object *obj, int recursion) {
1312
23.8k
  if (recursion >= objectRecursionLimit) {
1313
0
    return gFalse;
1314
0
  }
1315
1316
  // check for a cached ObjectStream
1317
23.8k
#if MULTITHREADED
1318
23.8k
  gLockMutex(&objStrsMutex);
1319
23.8k
#endif
1320
23.8k
  ObjectStream *objStr = getObjectStreamFromCache(objStrNum);
1321
23.8k
  GBool found = gFalse;
1322
23.8k
  if (objStr) {
1323
18.5k
    objStr->getObject(objIdx, objNum, obj);
1324
18.5k
    cleanObjectStreamCache();
1325
18.5k
    found = gTrue;
1326
18.5k
  }
1327
23.8k
#if MULTITHREADED
1328
23.8k
  gUnlockMutex(&objStrsMutex);
1329
23.8k
#endif
1330
23.8k
  if (found) {
1331
18.5k
    return gTrue;
1332
18.5k
  }
1333
1334
  // load a new ObjectStream
1335
5.35k
  objStr = new ObjectStream(this, objStrNum, recursion + 1);
1336
5.35k
  if (!objStr->isOk()) {
1337
1.17k
    delete objStr;
1338
1.17k
    return gFalse;
1339
1.17k
  }
1340
4.17k
  objStr->getObject(objIdx, objNum, obj);
1341
4.17k
#if MULTITHREADED
1342
4.17k
  gLockMutex(&objStrsMutex);
1343
4.17k
#endif
1344
4.17k
  addObjectStreamToCache(objStr);
1345
4.17k
  cleanObjectStreamCache();
1346
4.17k
#if MULTITHREADED
1347
4.17k
  gUnlockMutex(&objStrsMutex);
1348
4.17k
#endif
1349
4.17k
  return gTrue;
1350
5.35k
}
1351
1352
// NB: objStrsMutex must be locked when calling this function.
1353
23.8k
ObjectStream *XRef::getObjectStreamFromCache(int objStrNum) {
1354
  // check the MRU entry in the cache
1355
23.8k
  if (objStrs[0] && objStrs[0]->getObjStrNum() == objStrNum) {
1356
15.8k
    ObjectStream *objStr = objStrs[0];
1357
15.8k
    objStrLastUse[0] = objStrTime++;
1358
15.8k
    return objStr;
1359
15.8k
  }
1360
1361
  // check the rest of the cache
1362
15.6k
  for (int i = 1; i < objStrCacheLength; ++i) {
1363
10.3k
    if (objStrs[i] && objStrs[i]->getObjStrNum() == objStrNum) {
1364
2.71k
      ObjectStream *objStr = objStrs[i];
1365
7.60k
      for (int j = i; j > 0; --j) {
1366
4.88k
  objStrs[j] = objStrs[j - 1];
1367
4.88k
  objStrLastUse[j] = objStrLastUse[j - 1];
1368
4.88k
      }
1369
2.71k
      objStrs[0] = objStr;
1370
2.71k
      objStrLastUse[0] = objStrTime++;
1371
2.71k
      return objStr;
1372
2.71k
    }
1373
10.3k
  }
1374
1375
5.35k
  return NULL;
1376
8.06k
}
1377
1378
// NB: objStrsMutex must be locked when calling this function.
1379
4.17k
void XRef::addObjectStreamToCache(ObjectStream *objStr) {
1380
  // add to the cache
1381
4.17k
  if (objStrCacheLength == objStrCacheSize) {
1382
0
    delete objStrs[objStrCacheSize - 1];
1383
0
    --objStrCacheLength;
1384
0
  }
1385
9.52k
  for (int j = objStrCacheLength; j > 0; --j) {
1386
5.34k
    objStrs[j] = objStrs[j - 1];
1387
5.34k
    objStrLastUse[j] = objStrLastUse[j - 1];
1388
5.34k
  }
1389
4.17k
  ++objStrCacheLength;
1390
4.17k
  objStrs[0] = objStr;
1391
4.17k
  objStrLastUse[0] = objStrTime++;
1392
4.17k
}
1393
1394
// If the oldest (least recently used) entry in the object stream
1395
// cache is more than objStrCacheTimeout accesses old (hasn't been
1396
// used in the last objStrCacheTimeout accesses), eject it from the
1397
// cache.
1398
// NB: objStrsMutex must be locked when calling this function.
1399
22.7k
void XRef::cleanObjectStreamCache() {
1400
  // NB: objStrTime and objStrLastUse[] are unsigned ints, so the
1401
  // mod-2^32 arithmetic makes the subtraction work out, even if the
1402
  // time wraps around.
1403
22.7k
  if (objStrCacheLength > 1 &&
1404
17.6k
      objStrTime - objStrLastUse[objStrCacheLength - 1]
1405
17.6k
        > objStrCacheTimeout) {
1406
0
    delete objStrs[objStrCacheLength - 1];
1407
0
    objStrs[objStrCacheLength - 1] = NULL;
1408
0
    --objStrCacheLength;
1409
0
  }
1410
22.7k
}
1411
1412
15.1k
Object *XRef::getDocInfo(Object *obj) {
1413
15.1k
  return trailerDict.dictLookup("Info", obj);
1414
15.1k
}
1415
1416
// Added for the pdftex project.
1417
0
Object *XRef::getDocInfoNF(Object *obj) {
1418
0
  return trailerDict.dictLookupNF("Info", obj);
1419
0
}
1420
1421
145k
GBool XRef::getStreamEnd(GFileOffset streamStart, GFileOffset *streamEnd) {
1422
145k
  int a, b, m;
1423
1424
145k
  if (streamEndsLen == 0 ||
1425
136k
      streamStart > streamEnds[streamEndsLen - 1]) {
1426
26.9k
    return gFalse;
1427
26.9k
  }
1428
1429
118k
  a = -1;
1430
118k
  b = streamEndsLen - 1;
1431
  // invariant: streamEnds[a] < streamStart <= streamEnds[b]
1432
502k
  while (b - a > 1) {
1433
384k
    m = (a + b) / 2;
1434
384k
    if (streamStart <= streamEnds[m]) {
1435
173k
      b = m;
1436
211k
    } else {
1437
211k
      a = m;
1438
211k
    }
1439
384k
  }
1440
118k
  *streamEnd = streamEnds[b];
1441
118k
  return gTrue;
1442
145k
}
1443
1444
722
GFileOffset XRef::strToFileOffset(char *s) {
1445
722
  GFileOffset x, d;
1446
722
  char *p;
1447
1448
722
  x = 0;
1449
2.36k
  for (p = s; *p && isdigit(*p & 0xff); ++p) {
1450
1.64k
    d = *p - '0';
1451
1.64k
    if (x > (GFILEOFFSET_MAX - d) / 10) {
1452
1
      break;
1453
1
    }
1454
1.64k
    x = 10 * x + d;
1455
1.64k
  }
1456
722
  return x;
1457
722
}