Coverage Report

Created: 2026-09-01 06:14

next uncovered line (L), next uncovered region (R), next uncovered branch (B)
/src/jansson/src/load.c
Line
Count
Source
1
/*
2
 * Copyright (c) 2009-2016 Petri Lehtinen <petri@digip.org>
3
 *
4
 * Jansson is free software; you can redistribute it and/or modify
5
 * it under the terms of the MIT license. See LICENSE for details.
6
 */
7
8
#ifndef _GNU_SOURCE
9
#define _GNU_SOURCE
10
#endif
11
12
#include "jansson_private.h"
13
14
#include <assert.h>
15
#include <errno.h>
16
#include <limits.h>
17
#include <stdio.h>
18
#include <stdlib.h>
19
#include <string.h>
20
#ifdef HAVE_UNISTD_H
21
#include <unistd.h>
22
#endif
23
24
#include "jansson.h"
25
#include "strbuffer.h"
26
#include "utf.h"
27
28
8.30M
#define STREAM_STATE_OK    0
29
23.8M
#define STREAM_STATE_EOF   -1
30
15.5M
#define STREAM_STATE_ERROR -2
31
32
547k
#define TOKEN_INVALID -1
33
520
#define TOKEN_EOF     0
34
1.20M
#define TOKEN_STRING  256
35
1.05M
#define TOKEN_INTEGER 257
36
10.0k
#define TOKEN_REAL    258
37
904
#define TOKEN_TRUE    259
38
395
#define TOKEN_FALSE   260
39
1.15k
#define TOKEN_NULL    261
40
41
/* Locale independent versions of isxxx() functions */
42
338k
#define l_isupper(c) ('A' <= (c) && (c) <= 'Z')
43
223k
#define l_islower(c) ('a' <= (c) && (c) <= 'z')
44
163k
#define l_isalpha(c) (l_isupper(c) || l_islower(c))
45
2.40M
#define l_isdigit(c) ('0' <= (c) && (c) <= '9')
46
#define l_isxdigit(c)                                                                    \
47
72.0k
    (l_isdigit(c) || ('A' <= (c) && (c) <= 'F') || ('a' <= (c) && (c) <= 'f'))
48
49
/* Read one byte from stream, convert to unsigned char, then int, and
50
   return. return EOF on end of file. This corresponds to the
51
   behaviour of fgetc(). */
52
typedef int (*get_func)(void *data);
53
54
typedef struct {
55
    get_func get;
56
    void *data;
57
    char buffer[5];
58
    size_t buffer_pos;
59
    int state;
60
    int line;
61
    int column, last_column;
62
    size_t position;
63
} stream_t;
64
65
typedef struct {
66
    stream_t stream;
67
    strbuffer_t saved_text;
68
    size_t flags;
69
    size_t depth;
70
    int token;
71
    union {
72
        struct {
73
            char *val;
74
            size_t len;
75
        } string;
76
        json_int_t integer;
77
        double real;
78
    } value;
79
} lex_t;
80
81
197
#define stream_to_lex(stream) container_of(stream, lex_t, stream)
82
83
/*** error reporting ***/
84
85
static void error_set(json_error_t *error, const lex_t *lex, enum json_error_code code,
86
2.85k
                      const char *msg, ...) {
87
2.85k
    va_list ap;
88
2.85k
    char msg_text[JSON_ERROR_TEXT_LENGTH];
89
2.85k
    char msg_with_context[JSON_ERROR_TEXT_LENGTH];
90
91
2.85k
    int line = -1, col = -1;
92
2.85k
    size_t pos = 0;
93
2.85k
    const char *result = msg_text;
94
95
2.85k
    if (!error)
96
0
        return;
97
98
2.85k
    va_start(ap, msg);
99
2.85k
    vsnprintf(msg_text, JSON_ERROR_TEXT_LENGTH, msg, ap);
100
2.85k
    msg_text[JSON_ERROR_TEXT_LENGTH - 1] = '\0';
101
2.85k
    va_end(ap);
102
103
2.85k
    if (lex) {
104
2.85k
        const char *saved_text = strbuffer_value(&lex->saved_text);
105
106
2.85k
        line = lex->stream.line;
107
2.85k
        col = lex->stream.column;
108
2.85k
        pos = lex->stream.position;
109
110
2.85k
        if (saved_text && saved_text[0]) {
111
2.11k
            if (lex->saved_text.length <= 20) {
112
1.82k
                snprintf(msg_with_context, JSON_ERROR_TEXT_LENGTH, "%s near '%s'",
113
1.82k
                         msg_text, saved_text);
114
1.82k
                msg_with_context[JSON_ERROR_TEXT_LENGTH - 1] = '\0';
115
1.82k
                result = msg_with_context;
116
1.82k
            }
117
2.11k
        } else {
118
740
            if (code == json_error_invalid_syntax) {
119
                /* More specific error code for premature end of file. */
120
598
                code = json_error_premature_end_of_input;
121
598
            }
122
740
            if (lex->stream.state == STREAM_STATE_ERROR) {
123
                /* No context for UTF-8 decoding errors */
124
287
                result = msg_text;
125
453
            } else {
126
453
                snprintf(msg_with_context, JSON_ERROR_TEXT_LENGTH, "%s near end of file",
127
453
                         msg_text);
128
453
                msg_with_context[JSON_ERROR_TEXT_LENGTH - 1] = '\0';
129
453
                result = msg_with_context;
130
453
            }
131
740
        }
132
2.85k
    }
133
134
2.85k
    jsonp_error_set(error, line, col, pos, code, "%s", result);
135
2.85k
}
136
137
/*** lexical analyzer ***/
138
139
2.21k
static void stream_init(stream_t *stream, get_func get, void *data) {
140
2.21k
    stream->get = get;
141
2.21k
    stream->data = data;
142
2.21k
    stream->buffer[0] = '\0';
143
2.21k
    stream->buffer_pos = 0;
144
145
2.21k
    stream->state = STREAM_STATE_OK;
146
2.21k
    stream->line = 1;
147
2.21k
    stream->column = 0;
148
2.21k
    stream->position = 0;
149
2.21k
}
150
151
8.30M
static int stream_get(stream_t *stream, json_error_t *error) {
152
8.30M
    int c;
153
154
8.30M
    if (stream->state != STREAM_STATE_OK)
155
280
        return stream->state;
156
157
8.30M
    if (!stream->buffer[stream->buffer_pos]) {
158
7.76M
        c = stream->get(stream->data);
159
7.76M
        if (c == EOF) {
160
980
            stream->state = STREAM_STATE_EOF;
161
980
            return STREAM_STATE_EOF;
162
980
        }
163
164
7.76M
        stream->buffer[0] = c;
165
7.76M
        stream->buffer_pos = 0;
166
167
7.76M
        if (0x80 <= c && c <= 0xFF) {
168
            /* multi-byte UTF-8 sequence */
169
3.47k
            size_t i, count;
170
171
3.47k
            count = utf8_check_first(c);
172
3.47k
            if (!count)
173
62
                goto out;
174
175
3.47k
            assert(count >= 2);
176
177
8.86k
            for (i = 1; i < count; i++)
178
5.45k
                stream->buffer[i] = stream->get(stream->data);
179
180
3.41k
            if (!utf8_check_full(stream->buffer, count, NULL))
181
135
                goto out;
182
183
3.27k
            stream->buffer[count] = '\0';
184
3.27k
        } else
185
7.76M
            stream->buffer[1] = '\0';
186
7.76M
    }
187
188
8.30M
    c = stream->buffer[stream->buffer_pos++];
189
190
8.30M
    stream->position++;
191
8.30M
    if (c == '\n') {
192
609
        stream->line++;
193
609
        stream->last_column = stream->column;
194
609
        stream->column = 0;
195
8.30M
    } else if (utf8_check_first(c)) {
196
        /* track the Unicode character column, so increment only if
197
           this is the first character of a UTF-8 sequence */
198
8.29M
        stream->column++;
199
8.29M
    }
200
201
8.30M
    return c;
202
203
197
out:
204
197
    stream->state = STREAM_STATE_ERROR;
205
197
    error_set(error, stream_to_lex(stream), json_error_invalid_utf8,
206
197
              "unable to decode byte 0x%x", c);
207
197
    return STREAM_STATE_ERROR;
208
8.30M
}
209
210
532k
static void stream_unget(stream_t *stream, int c) {
211
532k
    if (c == STREAM_STATE_EOF || c == STREAM_STATE_ERROR)
212
11
        return;
213
214
532k
    stream->position--;
215
532k
    if (c == '\n') {
216
197
        stream->line--;
217
197
        stream->column = stream->last_column;
218
532k
    } else if (utf8_check_first(c))
219
532k
        stream->column--;
220
221
532k
    assert(stream->buffer_pos > 0);
222
532k
    stream->buffer_pos--;
223
532k
    assert(stream->buffer[stream->buffer_pos] == c);
224
532k
}
225
226
1.16M
static int lex_get(lex_t *lex, json_error_t *error) {
227
1.16M
    return stream_get(&lex->stream, error);
228
1.16M
}
229
230
8.30M
static void lex_save(lex_t *lex, int c) { strbuffer_append_byte(&lex->saved_text, c); }
231
232
7.13M
static int lex_get_save(lex_t *lex, json_error_t *error) {
233
7.13M
    int c = stream_get(&lex->stream, error);
234
7.13M
    if (c != STREAM_STATE_EOF && c != STREAM_STATE_ERROR)
235
7.13M
        lex_save(lex, c);
236
7.13M
    return c;
237
7.13M
}
238
239
30
static void lex_unget(lex_t *lex, int c) { stream_unget(&lex->stream, c); }
240
241
532k
static void lex_unget_unsave(lex_t *lex, int c) {
242
532k
    if (c != STREAM_STATE_EOF && c != STREAM_STATE_ERROR) {
243
/* Since we treat warnings as errors, when assertions are turned
244
 * off the "d" variable would be set but never used. Which is
245
 * treated as an error by GCC.
246
 */
247
532k
#ifndef NDEBUG
248
532k
        char d;
249
532k
#endif
250
532k
        stream_unget(&lex->stream, c);
251
532k
#ifndef NDEBUG
252
532k
        d =
253
532k
#endif
254
532k
            strbuffer_pop(&lex->saved_text);
255
532k
        assert(c == d);
256
532k
    }
257
532k
}
258
259
174
static void lex_save_cached(lex_t *lex) {
260
412
    while (lex->stream.buffer[lex->stream.buffer_pos] != '\0') {
261
238
        lex_save(lex, lex->stream.buffer[lex->stream.buffer_pos]);
262
238
        lex->stream.buffer_pos++;
263
238
        lex->stream.position++;
264
238
    }
265
174
}
266
267
13.7k
static void lex_free_string(lex_t *lex) {
268
13.7k
    jsonp_free(lex->value.string.val);
269
13.7k
    lex->value.string.val = NULL;
270
13.7k
    lex->value.string.len = 0;
271
13.7k
}
272
273
/* assumes that str points to 'u' plus at least 4 valid hex digits */
274
16.5k
static int32_t decode_unicode_escape(const char *str) {
275
16.5k
    int i;
276
16.5k
    int32_t value = 0;
277
278
16.5k
    assert(str[0] == 'u');
279
280
82.8k
    for (i = 1; i <= 4; i++) {
281
66.3k
        char c = str[i];
282
66.3k
        value <<= 4;
283
66.3k
        if (l_isdigit(c))
284
5.81k
            value += c - '0';
285
60.5k
        else if (l_islower(c))
286
49.4k
            value += c - 'a' + 10;
287
11.0k
        else if (l_isupper(c))
288
11.0k
            value += c - 'A' + 10;
289
0
        else
290
0
            return -1;
291
66.3k
    }
292
293
16.5k
    return value;
294
16.5k
}
295
296
13.7k
static void lex_scan_string(lex_t *lex, json_error_t *error) {
297
13.7k
    int c;
298
13.7k
    const char *p;
299
13.7k
    char *t;
300
13.7k
    int i;
301
302
13.7k
    lex->value.string.val = NULL;
303
13.7k
    lex->token = TOKEN_INVALID;
304
305
13.7k
    c = lex_get_save(lex, error);
306
307
6.24M
    while (c != '"') {
308
6.23M
        if (c == STREAM_STATE_ERROR)
309
31
            goto out;
310
311
6.23M
        else if (c == STREAM_STATE_EOF) {
312
204
            error_set(error, lex, json_error_premature_end_of_input,
313
204
                      "premature end of input");
314
204
            goto out;
315
204
        }
316
317
6.23M
        else if (0 <= c && c <= 0x1F) {
318
            /* control character */
319
28
            lex_unget_unsave(lex, c);
320
28
            if (c == '\n')
321
1
                error_set(error, lex, json_error_invalid_syntax, "unexpected newline");
322
27
            else
323
27
                error_set(error, lex, json_error_invalid_syntax, "control character 0x%x",
324
27
                          c);
325
28
            goto out;
326
28
        }
327
328
6.23M
        else if (c == '\\') {
329
27.1k
            c = lex_get_save(lex, error);
330
27.1k
            if (c == 'u') {
331
18.0k
                c = lex_get_save(lex, error);
332
89.9k
                for (i = 0; i < 4; i++) {
333
72.0k
                    if (!l_isxdigit(c)) {
334
87
                        error_set(error, lex, json_error_invalid_syntax,
335
87
                                  "invalid escape");
336
87
                        goto out;
337
87
                    }
338
71.9k
                    c = lex_get_save(lex, error);
339
71.9k
                }
340
18.0k
            } else if (c == '"' || c == '\\' || c == '/' || c == 'b' || c == 'f' ||
341
1.56k
                       c == 'n' || c == 'r' || c == 't')
342
8.98k
                c = lex_get_save(lex, error);
343
67
            else {
344
67
                error_set(error, lex, json_error_invalid_syntax, "invalid escape");
345
67
                goto out;
346
67
            }
347
27.1k
        } else
348
6.20M
            c = lex_get_save(lex, error);
349
6.23M
    }
350
351
    /* the actual value is at most of the same length as the source
352
       string, because:
353
         - shortcut escapes (e.g. "\t") (length 2) are converted to 1 byte
354
         - a single \uXXXX escape (length 6) is converted to at most 3 bytes
355
         - two \uXXXX escapes (length 12) forming an UTF-16 surrogate pair
356
           are converted to 4 bytes
357
    */
358
13.3k
    t = jsonp_malloc(lex->saved_text.length + 1);
359
13.3k
    if (!t) {
360
        /* this is not very nice, since TOKEN_INVALID is returned */
361
0
        goto out;
362
0
    }
363
13.3k
    lex->value.string.val = t;
364
365
    /* + 1 to skip the " */
366
13.3k
    p = strbuffer_value(&lex->saved_text) + 1;
367
368
4.25M
    while (*p != '"') {
369
4.24M
        if (*p == '\\') {
370
23.0k
            p++;
371
23.0k
            if (*p == 'u') {
372
15.8k
                size_t length;
373
15.8k
                int32_t value;
374
375
15.8k
                value = decode_unicode_escape(p);
376
15.8k
                if (value < 0) {
377
0
                    error_set(error, lex, json_error_invalid_syntax,
378
0
                              "invalid Unicode escape '%.6s'", p - 1);
379
0
                    goto out;
380
0
                }
381
15.8k
                p += 5;
382
383
15.8k
                if (0xD800 <= value && value <= 0xDBFF) {
384
                    /* surrogate pair */
385
793
                    if (*p == '\\' && *(p + 1) == 'u') {
386
767
                        int32_t value2 = decode_unicode_escape(++p);
387
767
                        if (value2 < 0) {
388
0
                            error_set(error, lex, json_error_invalid_syntax,
389
0
                                      "invalid Unicode escape '%.6s'", p - 1);
390
0
                            goto out;
391
0
                        }
392
767
                        p += 5;
393
394
767
                        if (0xDC00 <= value2 && value2 <= 0xDFFF) {
395
                            /* valid second surrogate */
396
732
                            value =
397
732
                                ((value - 0xD800) << 10) + (value2 - 0xDC00) + 0x10000;
398
732
                        } else {
399
                            /* invalid second surrogate */
400
35
                            error_set(error, lex, json_error_invalid_syntax,
401
35
                                      "invalid Unicode '\\u%04X\\u%04X'", value, value2);
402
35
                            goto out;
403
35
                        }
404
767
                    } else {
405
                        /* no second surrogate */
406
26
                        error_set(error, lex, json_error_invalid_syntax,
407
26
                                  "invalid Unicode '\\u%04X'", value);
408
26
                        goto out;
409
26
                    }
410
15.0k
                } else if (0xDC00 <= value && value <= 0xDFFF) {
411
13
                    error_set(error, lex, json_error_invalid_syntax,
412
13
                              "invalid Unicode '\\u%04X'", value);
413
13
                    goto out;
414
13
                }
415
416
15.7k
                if (utf8_encode(value, t, &length))
417
15.7k
                    assert(0);
418
15.7k
                t += length;
419
15.7k
            } else {
420
7.21k
                switch (*p) {
421
199
                    case '"':
422
447
                    case '\\':
423
719
                    case '/':
424
719
                        *t = *p;
425
719
                        break;
426
4.51k
                    case 'b':
427
4.51k
                        *t = '\b';
428
4.51k
                        break;
429
1.38k
                    case 'f':
430
1.38k
                        *t = '\f';
431
1.38k
                        break;
432
194
                    case 'n':
433
194
                        *t = '\n';
434
194
                        break;
435
215
                    case 'r':
436
215
                        *t = '\r';
437
215
                        break;
438
194
                    case 't':
439
194
                        *t = '\t';
440
194
                        break;
441
0
                    default:
442
0
                        assert(0);
443
7.21k
                }
444
7.21k
                t++;
445
7.21k
                p++;
446
7.21k
            }
447
23.0k
        } else
448
4.21M
            *(t++) = *(p++);
449
4.24M
    }
450
13.2k
    *t = '\0';
451
13.2k
    lex->value.string.len = t - lex->value.string.val;
452
13.2k
    lex->token = TOKEN_STRING;
453
13.2k
    return;
454
455
491
out:
456
491
    lex_free_string(lex);
457
491
}
458
459
#ifndef JANSSON_USING_CMAKE /* disabled if using cmake */
460
#if JSON_INTEGER_IS_LONG_LONG
461
#ifdef _MSC_VER /* Microsoft Visual Studio */
462
#define json_strtoint _strtoi64
463
#else
464
526k
#define json_strtoint strtoll
465
#endif
466
#else
467
#define json_strtoint strtol
468
#endif
469
#endif
470
471
531k
static int lex_scan_number(lex_t *lex, int c, json_error_t *error) {
472
531k
    const char *saved_text;
473
531k
    char *end;
474
531k
    double doubleval;
475
476
531k
    lex->token = TOKEN_INVALID;
477
478
531k
    if (c == '-')
479
290
        c = lex_get_save(lex, error);
480
481
531k
    if (c == '0') {
482
36.6k
        c = lex_get_save(lex, error);
483
36.6k
        if (l_isdigit(c)) {
484
5
            lex_unget_unsave(lex, c);
485
5
            goto out;
486
5
        }
487
494k
    } else if (l_isdigit(c)) {
488
494k
        do
489
580k
            c = lex_get_save(lex, error);
490
580k
        while (l_isdigit(c));
491
494k
    } else {
492
52
        lex_unget_unsave(lex, c);
493
52
        goto out;
494
52
    }
495
496
531k
    if (!(lex->flags & JSON_DECODE_INT_AS_REAL) && c != '.' && c != 'E' && c != 'e') {
497
526k
        json_int_t intval;
498
499
526k
        lex_unget_unsave(lex, c);
500
501
526k
        saved_text = strbuffer_value(&lex->saved_text);
502
503
526k
        errno = 0;
504
526k
        intval = json_strtoint(saved_text, &end, 10);
505
526k
        if (errno == ERANGE) {
506
9
            if (intval < 0)
507
3
                error_set(error, lex, json_error_numeric_overflow,
508
3
                          "too big negative integer");
509
6
            else
510
6
                error_set(error, lex, json_error_numeric_overflow, "too big integer");
511
9
            goto out;
512
9
        }
513
514
526k
        assert(end == saved_text + lex->saved_text.length);
515
516
526k
        lex->token = TOKEN_INTEGER;
517
526k
        lex->value.integer = intval;
518
526k
        return 0;
519
526k
    }
520
521
5.19k
    if (c == '.') {
522
3.62k
        c = lex_get(lex, error);
523
3.62k
        if (!l_isdigit(c)) {
524
30
            lex_unget(lex, c);
525
30
            goto out;
526
30
        }
527
3.59k
        lex_save(lex, c);
528
529
3.59k
        do
530
7.01k
            c = lex_get_save(lex, error);
531
7.01k
        while (l_isdigit(c));
532
3.59k
    }
533
534
5.16k
    if (c == 'E' || c == 'e') {
535
1.57k
        c = lex_get_save(lex, error);
536
1.57k
        if (c == '+' || c == '-')
537
473
            c = lex_get_save(lex, error);
538
539
1.57k
        if (!l_isdigit(c)) {
540
89
            lex_unget_unsave(lex, c);
541
89
            goto out;
542
89
        }
543
544
1.48k
        do
545
1.70k
            c = lex_get_save(lex, error);
546
1.70k
        while (l_isdigit(c));
547
1.48k
    }
548
549
5.07k
    lex_unget_unsave(lex, c);
550
551
5.07k
    if (jsonp_strtod(&lex->saved_text, &doubleval)) {
552
6
        error_set(error, lex, json_error_numeric_overflow, "real number overflow");
553
6
        goto out;
554
6
    }
555
556
5.06k
    lex->token = TOKEN_REAL;
557
5.06k
    lex->value.real = doubleval;
558
5.06k
    return 0;
559
560
191
out:
561
191
    return -1;
562
5.07k
}
563
564
1.16M
static int lex_scan(lex_t *lex, json_error_t *error) {
565
1.16M
    int c;
566
567
1.16M
    strbuffer_clear(&lex->saved_text);
568
569
1.16M
    if (lex->token == TOKEN_STRING)
570
13.0k
        lex_free_string(lex);
571
572
1.16M
    do
573
1.16M
        c = lex_get(lex, error);
574
1.16M
    while (c == ' ' || c == '\t' || c == '\n' || c == '\r');
575
576
1.16M
    if (c == STREAM_STATE_EOF) {
577
477
        lex->token = TOKEN_EOF;
578
477
        goto out;
579
477
    }
580
581
1.16M
    if (c == STREAM_STATE_ERROR) {
582
147
        lex->token = TOKEN_INVALID;
583
147
        goto out;
584
147
    }
585
586
1.16M
    lex_save(lex, c);
587
588
1.16M
    if (c == '{' || c == '}' || c == '[' || c == ']' || c == ':' || c == ',')
589
615k
        lex->token = c;
590
591
546k
    else if (c == '"')
592
13.7k
        lex_scan_string(lex, error);
593
594
532k
    else if (l_isdigit(c) || c == '-') {
595
531k
        if (lex_scan_number(lex, c, error))
596
191
            goto out;
597
531k
    }
598
599
1.61k
    else if (l_isalpha(c)) {
600
        /* eat up the whole identifier for clearer error messages */
601
1.43k
        const char *saved_text;
602
603
1.43k
        do
604
161k
            c = lex_get_save(lex, error);
605
161k
        while (l_isalpha(c));
606
1.43k
        lex_unget_unsave(lex, c);
607
608
1.43k
        saved_text = strbuffer_value(&lex->saved_text);
609
610
1.43k
        if (strcmp(saved_text, "true") == 0)
611
453
            lex->token = TOKEN_TRUE;
612
985
        else if (strcmp(saved_text, "false") == 0)
613
198
            lex->token = TOKEN_FALSE;
614
787
        else if (strcmp(saved_text, "null") == 0)
615
582
            lex->token = TOKEN_NULL;
616
205
        else
617
205
            lex->token = TOKEN_INVALID;
618
1.43k
    }
619
620
174
    else {
621
        /* save the rest of the input UTF-8 sequence to get an error
622
           message of valid UTF-8 */
623
174
        lex_save_cached(lex);
624
174
        lex->token = TOKEN_INVALID;
625
174
    }
626
627
1.16M
out:
628
1.16M
    return lex->token;
629
1.16M
}
630
631
10.9k
static char *lex_steal_string(lex_t *lex, size_t *out_len) {
632
10.9k
    char *result = NULL;
633
10.9k
    if (lex->token == TOKEN_STRING) {
634
10.9k
        result = lex->value.string.val;
635
10.9k
        *out_len = lex->value.string.len;
636
10.9k
        lex->value.string.val = NULL;
637
10.9k
        lex->value.string.len = 0;
638
10.9k
    }
639
10.9k
    return result;
640
10.9k
}
641
642
2.21k
static int lex_init(lex_t *lex, get_func get, size_t flags, void *data) {
643
2.21k
    stream_init(&lex->stream, get, data);
644
2.21k
    if (strbuffer_init(&lex->saved_text))
645
0
        return -1;
646
647
2.21k
    lex->flags = flags;
648
2.21k
    lex->token = TOKEN_INVALID;
649
2.21k
    return 0;
650
2.21k
}
651
652
2.21k
static void lex_close(lex_t *lex) {
653
2.21k
    if (lex->token == TOKEN_STRING)
654
265
        lex_free_string(lex);
655
2.21k
    strbuffer_close(&lex->saved_text);
656
2.21k
}
657
658
/*** parser ***/
659
660
static json_t *parse_value(lex_t *lex, size_t flags, json_error_t *error);
661
662
2.16k
static json_t *parse_object(lex_t *lex, size_t flags, json_error_t *error) {
663
2.16k
    json_t *object = json_object();
664
2.16k
    if (!object)
665
0
        return NULL;
666
667
2.16k
    lex_scan(lex, error);
668
2.16k
    if (lex->token == '}')
669
721
        return object;
670
671
11.0k
    while (1) {
672
11.0k
        char *key;
673
11.0k
        size_t len;
674
11.0k
        json_t *value;
675
676
11.0k
        if (lex->token != TOKEN_STRING) {
677
75
            error_set(error, lex, json_error_invalid_syntax, "string or '}' expected");
678
75
            goto error;
679
75
        }
680
681
10.9k
        key = lex_steal_string(lex, &len);
682
10.9k
        if (!key)
683
0
            return NULL;
684
10.9k
        if (memchr(key, '\0', len)) {
685
1
            jsonp_free(key);
686
1
            error_set(error, lex, json_error_null_byte_in_key,
687
1
                      "NUL byte in object key not supported");
688
1
            goto error;
689
1
        }
690
691
10.9k
        if (flags & JSON_REJECT_DUPLICATES) {
692
0
            if (json_object_getn(object, key, len)) {
693
0
                jsonp_free(key);
694
0
                error_set(error, lex, json_error_duplicate_key, "duplicate object key");
695
0
                goto error;
696
0
            }
697
0
        }
698
699
10.9k
        lex_scan(lex, error);
700
10.9k
        if (lex->token != ':') {
701
28
            jsonp_free(key);
702
28
            error_set(error, lex, json_error_invalid_syntax, "':' expected");
703
28
            goto error;
704
28
        }
705
706
10.9k
        lex_scan(lex, error);
707
10.9k
        value = parse_value(lex, flags, error);
708
10.9k
        if (!value) {
709
792
            jsonp_free(key);
710
792
            goto error;
711
792
        }
712
713
10.1k
        if (json_object_setn_new_nocheck(object, key, len, value)) {
714
0
            jsonp_free(key);
715
0
            goto error;
716
0
        }
717
718
10.1k
        jsonp_free(key);
719
720
10.1k
        lex_scan(lex, error);
721
10.1k
        if (lex->token != ',')
722
552
            break;
723
724
9.58k
        lex_scan(lex, error);
725
9.58k
    }
726
727
552
    if (lex->token != '}') {
728
258
        error_set(error, lex, json_error_invalid_syntax, "'}' expected");
729
258
        goto error;
730
258
    }
731
732
294
    return object;
733
734
1.15k
error:
735
1.15k
    json_decref(object);
736
1.15k
    return NULL;
737
552
}
738
739
55.4k
static json_t *parse_array(lex_t *lex, size_t flags, json_error_t *error) {
740
55.4k
    json_t *array = json_array();
741
55.4k
    if (!array)
742
0
        return NULL;
743
744
55.4k
    lex_scan(lex, error);
745
55.4k
    if (lex->token == ']')
746
5.50k
        return array;
747
748
580k
    while (lex->token) {
749
580k
        json_t *elem = parse_value(lex, flags, error);
750
580k
        if (!elem)
751
49.2k
            goto error;
752
753
531k
        if (json_array_append_new(array, elem)) {
754
0
            goto error;
755
0
        }
756
757
531k
        lex_scan(lex, error);
758
531k
        if (lex->token != ',')
759
716
            break;
760
761
530k
        lex_scan(lex, error);
762
530k
    }
763
764
755
    if (lex->token != ']') {
765
230
        error_set(error, lex, json_error_invalid_syntax, "']' expected");
766
230
        goto error;
767
230
    }
768
769
525
    return array;
770
771
49.4k
error:
772
49.4k
    json_decref(array);
773
49.4k
    return NULL;
774
755
}
775
776
592k
static json_t *parse_value(lex_t *lex, size_t flags, json_error_t *error) {
777
592k
    json_t *json;
778
779
592k
    lex->depth++;
780
592k
    if (lex->depth > JSON_PARSER_MAX_DEPTH) {
781
2
        error_set(error, lex, json_error_stack_overflow, "maximum parsing depth reached");
782
2
        return NULL;
783
2
    }
784
785
592k
    switch (lex->token) {
786
2.04k
        case TOKEN_STRING: {
787
2.04k
            const char *value = lex->value.string.val;
788
2.04k
            size_t len = lex->value.string.len;
789
790
2.04k
            if (!(flags & JSON_ALLOW_NUL)) {
791
2.04k
                if (memchr(value, '\0', len)) {
792
1
                    error_set(error, lex, json_error_null_character,
793
1
                              "\\u0000 is not allowed without JSON_ALLOW_NUL");
794
1
                    return NULL;
795
1
                }
796
2.04k
            }
797
798
2.04k
            json = jsonp_stringn_nocheck_own(value, len);
799
2.04k
            lex->value.string.val = NULL;
800
2.04k
            lex->value.string.len = 0;
801
2.04k
            break;
802
2.04k
        }
803
804
525k
        case TOKEN_INTEGER: {
805
525k
            json = json_integer(lex->value.integer);
806
525k
            break;
807
2.04k
        }
808
809
4.97k
        case TOKEN_REAL: {
810
4.97k
            json = json_real(lex->value.real);
811
4.97k
            break;
812
2.04k
        }
813
814
451
        case TOKEN_TRUE:
815
451
            json = json_true();
816
451
            break;
817
818
197
        case TOKEN_FALSE:
819
197
            json = json_false();
820
197
            break;
821
822
577
        case TOKEN_NULL:
823
577
            json = json_null();
824
577
            break;
825
826
2.16k
        case '{':
827
2.16k
            json = parse_object(lex, flags, error);
828
2.16k
            break;
829
830
55.4k
        case '[':
831
55.4k
            json = parse_array(lex, flags, error);
832
55.4k
            break;
833
834
117
        case TOKEN_INVALID:
835
117
            error_set(error, lex, json_error_invalid_syntax, "invalid token");
836
117
            return NULL;
837
838
26
        default:
839
26
            error_set(error, lex, json_error_invalid_syntax, "unexpected token");
840
26
            return NULL;
841
592k
    }
842
843
591k
    if (!json)
844
50.6k
        return NULL;
845
846
541k
    lex->depth--;
847
541k
    return json;
848
591k
}
849
850
2.21k
static json_t *parse_json(lex_t *lex, size_t flags, json_error_t *error) {
851
2.21k
    json_t *result;
852
853
2.21k
    lex->depth = 0;
854
855
2.21k
    lex_scan(lex, error);
856
2.21k
    if (!(flags & JSON_DECODE_ANY)) {
857
2.21k
        if (lex->token != '[' && lex->token != '{') {
858
1.42k
            error_set(error, lex, json_error_invalid_syntax, "'[' or '{' expected");
859
1.42k
            return NULL;
860
1.42k
        }
861
2.21k
    }
862
863
781
    result = parse_value(lex, flags, error);
864
781
    if (!result)
865
738
        return NULL;
866
867
43
    if (!(flags & JSON_DISABLE_EOF_CHECK)) {
868
43
        lex_scan(lex, error);
869
43
        if (lex->token != TOKEN_EOF) {
870
19
            error_set(error, lex, json_error_end_of_input_expected,
871
19
                      "end of file expected");
872
19
            json_decref(result);
873
19
            return NULL;
874
19
        }
875
43
    }
876
877
24
    if (error) {
878
        /* Save the position even though there was no error */
879
24
        error->position = (int)lex->stream.position;
880
24
    }
881
882
24
    return result;
883
43
}
884
885
typedef struct {
886
    const char *data;
887
    size_t pos;
888
} string_data_t;
889
890
7.77M
static int string_get(void *data) {
891
7.77M
    char c;
892
7.77M
    string_data_t *stream = (string_data_t *)data;
893
7.77M
    c = stream->data[stream->pos];
894
7.77M
    if (c == '\0')
895
1.12k
        return EOF;
896
7.77M
    else {
897
7.77M
        stream->pos++;
898
7.77M
        return (unsigned char)c;
899
7.77M
    }
900
7.77M
}
901
902
2.21k
json_t *json_loads(const char *string, size_t flags, json_error_t *error) {
903
2.21k
    lex_t lex;
904
2.21k
    json_t *result;
905
2.21k
    string_data_t stream_data;
906
907
2.21k
    jsonp_error_init(error, "<string>");
908
909
2.21k
    if (string == NULL) {
910
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
911
0
        return NULL;
912
0
    }
913
914
2.21k
    stream_data.data = string;
915
2.21k
    stream_data.pos = 0;
916
917
2.21k
    if (lex_init(&lex, string_get, flags, (void *)&stream_data))
918
0
        return NULL;
919
920
2.21k
    result = parse_json(&lex, flags, error);
921
922
2.21k
    lex_close(&lex);
923
2.21k
    return result;
924
2.21k
}
925
926
typedef struct {
927
    const char *data;
928
    size_t len;
929
    size_t pos;
930
} buffer_data_t;
931
932
0
static int buffer_get(void *data) {
933
0
    char c;
934
0
    buffer_data_t *stream = data;
935
0
    if (stream->pos >= stream->len)
936
0
        return EOF;
937
938
0
    c = stream->data[stream->pos];
939
0
    stream->pos++;
940
0
    return (unsigned char)c;
941
0
}
942
943
0
json_t *json_loadb(const char *buffer, size_t buflen, size_t flags, json_error_t *error) {
944
0
    lex_t lex;
945
0
    json_t *result;
946
0
    buffer_data_t stream_data;
947
948
0
    jsonp_error_init(error, "<buffer>");
949
950
0
    if (buffer == NULL) {
951
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
952
0
        return NULL;
953
0
    }
954
955
0
    stream_data.data = buffer;
956
0
    stream_data.pos = 0;
957
0
    stream_data.len = buflen;
958
959
0
    if (lex_init(&lex, buffer_get, flags, (void *)&stream_data))
960
0
        return NULL;
961
962
0
    result = parse_json(&lex, flags, error);
963
964
0
    lex_close(&lex);
965
0
    return result;
966
0
}
967
968
0
json_t *json_loadf(FILE *input, size_t flags, json_error_t *error) {
969
0
    lex_t lex;
970
0
    const char *source;
971
0
    json_t *result;
972
973
0
    if (input == stdin)
974
0
        source = "<stdin>";
975
0
    else
976
0
        source = "<stream>";
977
978
0
    jsonp_error_init(error, source);
979
980
0
    if (input == NULL) {
981
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
982
0
        return NULL;
983
0
    }
984
985
0
    if (lex_init(&lex, (get_func)fgetc, flags, input))
986
0
        return NULL;
987
988
0
    result = parse_json(&lex, flags, error);
989
990
0
    lex_close(&lex);
991
0
    return result;
992
0
}
993
994
0
static int fd_get_func(int *fd) {
995
0
#ifdef HAVE_UNISTD_H
996
0
    uint8_t c;
997
0
    if (read(*fd, &c, 1) == 1)
998
0
        return c;
999
0
#endif
1000
0
    return EOF;
1001
0
}
1002
1003
0
json_t *json_loadfd(int input, size_t flags, json_error_t *error) {
1004
0
    lex_t lex;
1005
0
    const char *source;
1006
0
    json_t *result;
1007
1008
0
#ifdef HAVE_UNISTD_H
1009
0
    if (input == STDIN_FILENO)
1010
0
        source = "<stdin>";
1011
0
    else
1012
0
#endif
1013
0
        source = "<stream>";
1014
1015
0
    jsonp_error_init(error, source);
1016
1017
0
    if (input < 0) {
1018
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
1019
0
        return NULL;
1020
0
    }
1021
1022
0
    if (lex_init(&lex, (get_func)fd_get_func, flags, &input))
1023
0
        return NULL;
1024
1025
0
    result = parse_json(&lex, flags, error);
1026
1027
0
    lex_close(&lex);
1028
0
    return result;
1029
0
}
1030
1031
0
json_t *json_load_file(const char *path, size_t flags, json_error_t *error) {
1032
0
    json_t *result;
1033
0
    FILE *fp;
1034
1035
0
    jsonp_error_init(error, path);
1036
1037
0
    if (path == NULL) {
1038
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
1039
0
        return NULL;
1040
0
    }
1041
1042
0
    fp = fopen(path, "rb");
1043
0
    if (!fp) {
1044
0
        error_set(error, NULL, json_error_cannot_open_file, "unable to open %s: %s", path,
1045
0
                  strerror(errno));
1046
0
        return NULL;
1047
0
    }
1048
1049
0
    result = json_loadf(fp, flags, error);
1050
1051
0
    fclose(fp);
1052
0
    return result;
1053
0
}
1054
1055
0
#define MAX_BUF_LEN 1024
1056
1057
typedef struct {
1058
    char data[MAX_BUF_LEN];
1059
    size_t len;
1060
    size_t pos;
1061
    json_load_callback_t callback;
1062
    void *arg;
1063
} callback_data_t;
1064
1065
0
static int callback_get(void *data) {
1066
0
    char c;
1067
0
    callback_data_t *stream = data;
1068
1069
0
    if (stream->pos >= stream->len) {
1070
0
        stream->pos = 0;
1071
0
        stream->len = stream->callback(stream->data, MAX_BUF_LEN, stream->arg);
1072
0
        if (stream->len == 0 || stream->len == (size_t)-1)
1073
0
            return EOF;
1074
0
    }
1075
1076
0
    c = stream->data[stream->pos];
1077
0
    stream->pos++;
1078
0
    return (unsigned char)c;
1079
0
}
1080
1081
json_t *json_load_callback(json_load_callback_t callback, void *arg, size_t flags,
1082
0
                           json_error_t *error) {
1083
0
    lex_t lex;
1084
0
    json_t *result;
1085
1086
0
    callback_data_t stream_data;
1087
1088
0
    memset(&stream_data, 0, sizeof(stream_data));
1089
0
    stream_data.callback = callback;
1090
0
    stream_data.arg = arg;
1091
1092
0
    jsonp_error_init(error, "<callback>");
1093
1094
0
    if (callback == NULL) {
1095
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
1096
0
        return NULL;
1097
0
    }
1098
1099
0
    if (lex_init(&lex, (get_func)callback_get, flags, &stream_data))
1100
0
        return NULL;
1101
1102
0
    result = parse_json(&lex, flags, error);
1103
1104
0
    lex_close(&lex);
1105
0
    return result;
1106
0
}