Coverage Report

Created: 2026-09-04 06:43

next uncovered line (L), next uncovered region (R), next uncovered branch (B)
/src/jansson/src/load.c
Line
Count
Source
1
/*
2
 * Copyright (c) 2009-2016 Petri Lehtinen <petri@digip.org>
3
 *
4
 * Jansson is free software; you can redistribute it and/or modify
5
 * it under the terms of the MIT license. See LICENSE for details.
6
 */
7
8
#ifndef _GNU_SOURCE
9
#define _GNU_SOURCE
10
#endif
11
12
#include "jansson_private.h"
13
14
#include <assert.h>
15
#include <errno.h>
16
#include <limits.h>
17
#include <stdio.h>
18
#include <stdlib.h>
19
#include <string.h>
20
#ifdef HAVE_UNISTD_H
21
#include <unistd.h>
22
#endif
23
24
#include "jansson.h"
25
#include "strbuffer.h"
26
#include "utf.h"
27
28
13.6M
#define STREAM_STATE_OK    0
29
40.5M
#define STREAM_STATE_EOF   -1
30
27.0M
#define STREAM_STATE_ERROR -2
31
32
59.9k
#define TOKEN_INVALID -1
33
2.32k
#define TOKEN_EOF     0
34
249k
#define TOKEN_STRING  256
35
47.4k
#define TOKEN_INTEGER 257
36
2.74k
#define TOKEN_REAL    258
37
489
#define TOKEN_TRUE    259
38
393
#define TOKEN_FALSE   260
39
1.32k
#define TOKEN_NULL    261
40
41
/* Locale independent versions of isxxx() functions */
42
26.0k
#define l_isupper(c) ('A' <= (c) && (c) <= 'Z')
43
14.8k
#define l_islower(c) ('a' <= (c) && (c) <= 'z')
44
11.6k
#define l_isalpha(c) (l_isupper(c) || l_islower(c))
45
142k
#define l_isdigit(c) ('0' <= (c) && (c) <= '9')
46
#define l_isxdigit(c)                                                                    \
47
13.3k
    (l_isdigit(c) || ('A' <= (c) && (c) <= 'F') || ('a' <= (c) && (c) <= 'f'))
48
49
/* Read one byte from stream, convert to unsigned char, then int, and
50
   return. return EOF on end of file. This corresponds to the
51
   behaviour of fgetc(). */
52
typedef int (*get_func)(void *data);
53
54
typedef struct {
55
    get_func get;
56
    void *data;
57
    char buffer[5];
58
    size_t buffer_pos;
59
    int state;
60
    int line;
61
    int column, last_column;
62
    size_t position;
63
} stream_t;
64
65
typedef struct {
66
    stream_t stream;
67
    strbuffer_t saved_text;
68
    size_t flags;
69
    size_t depth;
70
    int token;
71
    union {
72
        struct {
73
            char *val;
74
            size_t len;
75
        } string;
76
        json_int_t integer;
77
        double real;
78
    } value;
79
} lex_t;
80
81
192
#define stream_to_lex(stream) container_of(stream, lex_t, stream)
82
83
/*** error reporting ***/
84
85
static void error_set(json_error_t *error, const lex_t *lex, enum json_error_code code,
86
2.55k
                      const char *msg, ...) {
87
2.55k
    va_list ap;
88
2.55k
    char msg_text[JSON_ERROR_TEXT_LENGTH];
89
2.55k
    char msg_with_context[JSON_ERROR_TEXT_LENGTH];
90
91
2.55k
    int line = -1, col = -1;
92
2.55k
    size_t pos = 0;
93
2.55k
    const char *result = msg_text;
94
95
2.55k
    if (!error)
96
0
        return;
97
98
2.55k
    va_start(ap, msg);
99
2.55k
    vsnprintf(msg_text, JSON_ERROR_TEXT_LENGTH, msg, ap);
100
2.55k
    msg_text[JSON_ERROR_TEXT_LENGTH - 1] = '\0';
101
2.55k
    va_end(ap);
102
103
2.55k
    if (lex) {
104
2.55k
        const char *saved_text = strbuffer_value(&lex->saved_text);
105
106
2.55k
        line = lex->stream.line;
107
2.55k
        col = lex->stream.column;
108
2.55k
        pos = lex->stream.position;
109
110
2.55k
        if (saved_text && saved_text[0]) {
111
1.82k
            if (lex->saved_text.length <= 20) {
112
1.64k
                snprintf(msg_with_context, JSON_ERROR_TEXT_LENGTH, "%s near '%s'",
113
1.64k
                         msg_text, saved_text);
114
1.64k
                msg_with_context[JSON_ERROR_TEXT_LENGTH - 1] = '\0';
115
1.64k
                result = msg_with_context;
116
1.64k
            }
117
1.82k
        } else {
118
734
            if (code == json_error_invalid_syntax) {
119
                /* More specific error code for premature end of file. */
120
612
                code = json_error_premature_end_of_input;
121
612
            }
122
734
            if (lex->stream.state == STREAM_STATE_ERROR) {
123
                /* No context for UTF-8 decoding errors */
124
244
                result = msg_text;
125
490
            } else {
126
490
                snprintf(msg_with_context, JSON_ERROR_TEXT_LENGTH, "%s near end of file",
127
490
                         msg_text);
128
490
                msg_with_context[JSON_ERROR_TEXT_LENGTH - 1] = '\0';
129
490
                result = msg_with_context;
130
490
            }
131
734
        }
132
2.55k
    }
133
134
2.55k
    jsonp_error_set(error, line, col, pos, code, "%s", result);
135
2.55k
}
136
137
/*** lexical analyzer ***/
138
139
2.84k
static void stream_init(stream_t *stream, get_func get, void *data) {
140
2.84k
    stream->get = get;
141
2.84k
    stream->data = data;
142
2.84k
    stream->buffer[0] = '\0';
143
2.84k
    stream->buffer_pos = 0;
144
145
2.84k
    stream->state = STREAM_STATE_OK;
146
2.84k
    stream->line = 1;
147
2.84k
    stream->column = 0;
148
2.84k
    stream->position = 0;
149
2.84k
}
150
151
13.6M
static int stream_get(stream_t *stream, json_error_t *error) {
152
13.6M
    int c;
153
154
13.6M
    if (stream->state != STREAM_STATE_OK)
155
140
        return stream->state;
156
157
13.6M
    if (!stream->buffer[stream->buffer_pos]) {
158
5.09M
        c = stream->get(stream->data);
159
5.09M
        if (c == EOF) {
160
1.88k
            stream->state = STREAM_STATE_EOF;
161
1.88k
            return STREAM_STATE_EOF;
162
1.88k
        }
163
164
5.09M
        stream->buffer[0] = c;
165
5.09M
        stream->buffer_pos = 0;
166
167
5.09M
        if (0x80 <= c && c <= 0xFF) {
168
            /* multi-byte UTF-8 sequence */
169
4.27M
            size_t i, count;
170
171
4.27M
            count = utf8_check_first(c);
172
4.27M
            if (!count)
173
72
                goto out;
174
175
4.27M
            assert(count >= 2);
176
177
12.8M
            for (i = 1; i < count; i++)
178
8.53M
                stream->buffer[i] = stream->get(stream->data);
179
180
4.27M
            if (!utf8_check_full(stream->buffer, count, NULL))
181
120
                goto out;
182
183
4.27M
            stream->buffer[count] = '\0';
184
4.27M
        } else
185
821k
            stream->buffer[1] = '\0';
186
5.09M
    }
187
188
13.6M
    c = stream->buffer[stream->buffer_pos++];
189
190
13.6M
    stream->position++;
191
13.6M
    if (c == '\n') {
192
21.9k
        stream->line++;
193
21.9k
        stream->last_column = stream->column;
194
21.9k
        stream->column = 0;
195
13.6M
    } else if (utf8_check_first(c)) {
196
        /* track the Unicode character column, so increment only if
197
           this is the first character of a UTF-8 sequence */
198
5.09M
        stream->column++;
199
5.09M
    }
200
201
13.6M
    return c;
202
203
192
out:
204
192
    stream->state = STREAM_STATE_ERROR;
205
192
    error_set(error, stream_to_lex(stream), json_error_invalid_utf8,
206
192
              "unable to decode byte 0x%x", c);
207
192
    return STREAM_STATE_ERROR;
208
13.6M
}
209
210
26.3k
static void stream_unget(stream_t *stream, int c) {
211
26.3k
    if (c == STREAM_STATE_EOF || c == STREAM_STATE_ERROR)
212
7
        return;
213
214
26.3k
    stream->position--;
215
26.3k
    if (c == '\n') {
216
10.8k
        stream->line--;
217
10.8k
        stream->column = stream->last_column;
218
15.4k
    } else if (utf8_check_first(c))
219
15.4k
        stream->column--;
220
221
26.3k
    assert(stream->buffer_pos > 0);
222
26.3k
    stream->buffer_pos--;
223
26.3k
    assert(stream->buffer[stream->buffer_pos] == c);
224
26.3k
}
225
226
192k
static int lex_get(lex_t *lex, json_error_t *error) {
227
192k
    return stream_get(&lex->stream, error);
228
192k
}
229
230
13.6M
static void lex_save(lex_t *lex, int c) { strbuffer_append_byte(&lex->saved_text, c); }
231
232
13.4M
static int lex_get_save(lex_t *lex, json_error_t *error) {
233
13.4M
    int c = stream_get(&lex->stream, error);
234
13.4M
    if (c != STREAM_STATE_EOF && c != STREAM_STATE_ERROR)
235
13.4M
        lex_save(lex, c);
236
13.4M
    return c;
237
13.4M
}
238
239
27
static void lex_unget(lex_t *lex, int c) { stream_unget(&lex->stream, c); }
240
241
26.7k
static void lex_unget_unsave(lex_t *lex, int c) {
242
26.7k
    if (c != STREAM_STATE_EOF && c != STREAM_STATE_ERROR) {
243
/* Since we treat warnings as errors, when assertions are turned
244
 * off the "d" variable would be set but never used. Which is
245
 * treated as an error by GCC.
246
 */
247
26.2k
#ifndef NDEBUG
248
26.2k
        char d;
249
26.2k
#endif
250
26.2k
        stream_unget(&lex->stream, c);
251
26.2k
#ifndef NDEBUG
252
26.2k
        d =
253
26.2k
#endif
254
26.2k
            strbuffer_pop(&lex->saved_text);
255
26.2k
        assert(c == d);
256
26.2k
    }
257
26.7k
}
258
259
170
static void lex_save_cached(lex_t *lex) {
260
377
    while (lex->stream.buffer[lex->stream.buffer_pos] != '\0') {
261
207
        lex_save(lex, lex->stream.buffer[lex->stream.buffer_pos]);
262
207
        lex->stream.buffer_pos++;
263
207
        lex->stream.position++;
264
207
    }
265
170
}
266
267
31.0k
static void lex_free_string(lex_t *lex) {
268
31.0k
    jsonp_free(lex->value.string.val);
269
31.0k
    lex->value.string.val = NULL;
270
31.0k
    lex->value.string.len = 0;
271
31.0k
}
272
273
/* assumes that str points to 'u' plus at least 4 valid hex digits */
274
3.00k
static int32_t decode_unicode_escape(const char *str) {
275
3.00k
    int i;
276
3.00k
    int32_t value = 0;
277
278
3.00k
    assert(str[0] == 'u');
279
280
15.0k
    for (i = 1; i <= 4; i++) {
281
12.0k
        char c = str[i];
282
12.0k
        value <<= 4;
283
12.0k
        if (l_isdigit(c))
284
4.92k
            value += c - '0';
285
7.11k
        else if (l_islower(c))
286
4.31k
            value += c - 'a' + 10;
287
2.79k
        else if (l_isupper(c))
288
2.79k
            value += c - 'A' + 10;
289
0
        else
290
0
            return -1;
291
12.0k
    }
292
293
3.00k
    return value;
294
3.00k
}
295
296
31.0k
static void lex_scan_string(lex_t *lex, json_error_t *error) {
297
31.0k
    int c;
298
31.0k
    const char *p;
299
31.0k
    char *t;
300
31.0k
    int i;
301
302
31.0k
    lex->value.string.val = NULL;
303
31.0k
    lex->token = TOKEN_INVALID;
304
305
31.0k
    c = lex_get_save(lex, error);
306
307
13.3M
    while (c != '"') {
308
13.3M
        if (c == STREAM_STATE_ERROR)
309
41
            goto out;
310
311
13.3M
        else if (c == STREAM_STATE_EOF) {
312
170
            error_set(error, lex, json_error_premature_end_of_input,
313
170
                      "premature end of input");
314
170
            goto out;
315
170
        }
316
317
13.3M
        else if (0 <= c && c <= 0x1F) {
318
            /* control character */
319
26
            lex_unget_unsave(lex, c);
320
26
            if (c == '\n')
321
1
                error_set(error, lex, json_error_invalid_syntax, "unexpected newline");
322
25
            else
323
25
                error_set(error, lex, json_error_invalid_syntax, "control character 0x%x",
324
25
                          c);
325
26
            goto out;
326
26
        }
327
328
13.3M
        else if (c == '\\') {
329
14.8k
            c = lex_get_save(lex, error);
330
14.8k
            if (c == 'u') {
331
3.39k
                c = lex_get_save(lex, error);
332
16.7k
                for (i = 0; i < 4; i++) {
333
13.3k
                    if (!l_isxdigit(c)) {
334
83
                        error_set(error, lex, json_error_invalid_syntax,
335
83
                                  "invalid escape");
336
83
                        goto out;
337
83
                    }
338
13.3k
                    c = lex_get_save(lex, error);
339
13.3k
                }
340
11.4k
            } else if (c == '"' || c == '\\' || c == '/' || c == 'b' || c == 'f' ||
341
4.74k
                       c == 'n' || c == 'r' || c == 't')
342
11.4k
                c = lex_get_save(lex, error);
343
61
            else {
344
61
                error_set(error, lex, json_error_invalid_syntax, "invalid escape");
345
61
                goto out;
346
61
            }
347
14.8k
        } else
348
13.3M
            c = lex_get_save(lex, error);
349
13.3M
    }
350
351
    /* the actual value is at most of the same length as the source
352
       string, because:
353
         - shortcut escapes (e.g. "\t") (length 2) are converted to 1 byte
354
         - a single \uXXXX escape (length 6) is converted to at most 3 bytes
355
         - two \uXXXX escapes (length 12) forming an UTF-16 surrogate pair
356
           are converted to 4 bytes
357
    */
358
30.6k
    t = jsonp_malloc(lex->saved_text.length + 1);
359
30.6k
    if (!t) {
360
        /* this is not very nice, since TOKEN_INVALID is returned */
361
0
        goto out;
362
0
    }
363
30.6k
    lex->value.string.val = t;
364
365
    /* + 1 to skip the " */
366
30.6k
    p = strbuffer_value(&lex->saved_text) + 1;
367
368
11.2M
    while (*p != '"') {
369
11.2M
        if (*p == '\\') {
370
12.4k
            p++;
371
12.4k
            if (*p == 'u') {
372
2.22k
                size_t length;
373
2.22k
                int32_t value;
374
375
2.22k
                value = decode_unicode_escape(p);
376
2.22k
                if (value < 0) {
377
0
                    error_set(error, lex, json_error_invalid_syntax,
378
0
                              "invalid Unicode escape '%.6s'", p - 1);
379
0
                    goto out;
380
0
                }
381
2.22k
                p += 5;
382
383
2.22k
                if (0xD800 <= value && value <= 0xDBFF) {
384
                    /* surrogate pair */
385
815
                    if (*p == '\\' && *(p + 1) == 'u') {
386
788
                        int32_t value2 = decode_unicode_escape(++p);
387
788
                        if (value2 < 0) {
388
0
                            error_set(error, lex, json_error_invalid_syntax,
389
0
                                      "invalid Unicode escape '%.6s'", p - 1);
390
0
                            goto out;
391
0
                        }
392
788
                        p += 5;
393
394
788
                        if (0xDC00 <= value2 && value2 <= 0xDFFF) {
395
                            /* valid second surrogate */
396
755
                            value =
397
755
                                ((value - 0xD800) << 10) + (value2 - 0xDC00) + 0x10000;
398
755
                        } else {
399
                            /* invalid second surrogate */
400
33
                            error_set(error, lex, json_error_invalid_syntax,
401
33
                                      "invalid Unicode '\\u%04X\\u%04X'", value, value2);
402
33
                            goto out;
403
33
                        }
404
788
                    } else {
405
                        /* no second surrogate */
406
27
                        error_set(error, lex, json_error_invalid_syntax,
407
27
                                  "invalid Unicode '\\u%04X'", value);
408
27
                        goto out;
409
27
                    }
410
1.40k
                } else if (0xDC00 <= value && value <= 0xDFFF) {
411
15
                    error_set(error, lex, json_error_invalid_syntax,
412
15
                              "invalid Unicode '\\u%04X'", value);
413
15
                    goto out;
414
15
                }
415
416
2.14k
                if (utf8_encode(value, t, &length))
417
2.14k
                    assert(0);
418
2.14k
                t += length;
419
10.1k
            } else {
420
10.1k
                switch (*p) {
421
1.66k
                    case '"':
422
2.53k
                    case '\\':
423
3.93k
                    case '/':
424
3.93k
                        *t = *p;
425
3.93k
                        break;
426
1.47k
                    case 'b':
427
1.47k
                        *t = '\b';
428
1.47k
                        break;
429
268
                    case 'f':
430
268
                        *t = '\f';
431
268
                        break;
432
3.74k
                    case 'n':
433
3.74k
                        *t = '\n';
434
3.74k
                        break;
435
539
                    case 'r':
436
539
                        *t = '\r';
437
539
                        break;
438
225
                    case 't':
439
225
                        *t = '\t';
440
225
                        break;
441
0
                    default:
442
0
                        assert(0);
443
10.1k
                }
444
10.1k
                t++;
445
10.1k
                p++;
446
10.1k
            }
447
12.4k
        } else
448
11.1M
            *(t++) = *(p++);
449
11.2M
    }
450
30.6k
    *t = '\0';
451
30.6k
    lex->value.string.len = t - lex->value.string.val;
452
30.6k
    lex->token = TOKEN_STRING;
453
30.6k
    return;
454
455
456
out:
456
456
    lex_free_string(lex);
457
456
}
458
459
#ifndef JANSSON_USING_CMAKE /* disabled if using cmake */
460
#if JSON_INTEGER_IS_LONG_LONG
461
#ifdef _MSC_VER /* Microsoft Visual Studio */
462
#define json_strtoint _strtoi64
463
#else
464
23.7k
#define json_strtoint strtoll
465
#endif
466
#else
467
#define json_strtoint strtol
468
#endif
469
#endif
470
471
25.3k
static int lex_scan_number(lex_t *lex, int c, json_error_t *error) {
472
25.3k
    const char *saved_text;
473
25.3k
    char *end;
474
25.3k
    double doubleval;
475
476
25.3k
    lex->token = TOKEN_INVALID;
477
478
25.3k
    if (c == '-')
479
4.02k
        c = lex_get_save(lex, error);
480
481
25.3k
    if (c == '0') {
482
6.88k
        c = lex_get_save(lex, error);
483
6.88k
        if (l_isdigit(c)) {
484
5
            lex_unget_unsave(lex, c);
485
5
            goto out;
486
5
        }
487
18.4k
    } else if (l_isdigit(c)) {
488
18.4k
        do
489
20.4k
            c = lex_get_save(lex, error);
490
20.4k
        while (l_isdigit(c));
491
18.4k
    } else {
492
51
        lex_unget_unsave(lex, c);
493
51
        goto out;
494
51
    }
495
496
25.3k
    if (!(lex->flags & JSON_DECODE_INT_AS_REAL) && c != '.' && c != 'E' && c != 'e') {
497
23.7k
        json_int_t intval;
498
499
23.7k
        lex_unget_unsave(lex, c);
500
501
23.7k
        saved_text = strbuffer_value(&lex->saved_text);
502
503
23.7k
        errno = 0;
504
23.7k
        intval = json_strtoint(saved_text, &end, 10);
505
23.7k
        if (errno == ERANGE) {
506
5
            if (intval < 0)
507
1
                error_set(error, lex, json_error_numeric_overflow,
508
1
                          "too big negative integer");
509
4
            else
510
4
                error_set(error, lex, json_error_numeric_overflow, "too big integer");
511
5
            goto out;
512
5
        }
513
514
23.7k
        assert(end == saved_text + lex->saved_text.length);
515
516
23.7k
        lex->token = TOKEN_INTEGER;
517
23.7k
        lex->value.integer = intval;
518
23.7k
        return 0;
519
23.7k
    }
520
521
1.53k
    if (c == '.') {
522
318
        c = lex_get(lex, error);
523
318
        if (!l_isdigit(c)) {
524
27
            lex_unget(lex, c);
525
27
            goto out;
526
27
        }
527
291
        lex_save(lex, c);
528
529
291
        do
530
626
            c = lex_get_save(lex, error);
531
626
        while (l_isdigit(c));
532
291
    }
533
534
1.50k
    if (c == 'E' || c == 'e') {
535
1.21k
        c = lex_get_save(lex, error);
536
1.21k
        if (c == '+' || c == '-')
537
698
            c = lex_get_save(lex, error);
538
539
1.21k
        if (!l_isdigit(c)) {
540
79
            lex_unget_unsave(lex, c);
541
79
            goto out;
542
79
        }
543
544
1.13k
        do
545
1.65k
            c = lex_get_save(lex, error);
546
1.65k
        while (l_isdigit(c));
547
1.13k
    }
548
549
1.42k
    lex_unget_unsave(lex, c);
550
551
1.42k
    if (jsonp_strtod(&lex->saved_text, &doubleval)) {
552
10
        error_set(error, lex, json_error_numeric_overflow, "real number overflow");
553
10
        goto out;
554
10
    }
555
556
1.41k
    lex->token = TOKEN_REAL;
557
1.41k
    lex->value.real = doubleval;
558
1.41k
    return 0;
559
560
177
out:
561
177
    return -1;
562
1.42k
}
563
564
166k
static int lex_scan(lex_t *lex, json_error_t *error) {
565
166k
    int c;
566
567
166k
    strbuffer_clear(&lex->saved_text);
568
569
166k
    if (lex->token == TOKEN_STRING)
570
30.5k
        lex_free_string(lex);
571
572
166k
    do
573
192k
        c = lex_get(lex, error);
574
192k
    while (c == ' ' || c == '\t' || c == '\n' || c == '\r');
575
576
166k
    if (c == STREAM_STATE_EOF) {
577
1.40k
        lex->token = TOKEN_EOF;
578
1.40k
        goto out;
579
1.40k
    }
580
581
165k
    if (c == STREAM_STATE_ERROR) {
582
125
        lex->token = TOKEN_INVALID;
583
125
        goto out;
584
125
    }
585
586
165k
    lex_save(lex, c);
587
588
165k
    if (c == '{' || c == '}' || c == '[' || c == ']' || c == ':' || c == ',')
589
107k
        lex->token = c;
590
591
57.9k
    else if (c == '"')
592
31.0k
        lex_scan_string(lex, error);
593
594
26.8k
    else if (l_isdigit(c) || c == '-') {
595
25.3k
        if (lex_scan_number(lex, c, error))
596
177
            goto out;
597
25.3k
    }
598
599
1.50k
    else if (l_isalpha(c)) {
600
        /* eat up the whole identifier for clearer error messages */
601
1.33k
        const char *saved_text;
602
603
1.33k
        do
604
10.1k
            c = lex_get_save(lex, error);
605
10.1k
        while (l_isalpha(c));
606
1.33k
        lex_unget_unsave(lex, c);
607
608
1.33k
        saved_text = strbuffer_value(&lex->saved_text);
609
610
1.33k
        if (strcmp(saved_text, "true") == 0)
611
245
            lex->token = TOKEN_TRUE;
612
1.09k
        else if (strcmp(saved_text, "false") == 0)
613
197
            lex->token = TOKEN_FALSE;
614
894
        else if (strcmp(saved_text, "null") == 0)
615
662
            lex->token = TOKEN_NULL;
616
232
        else
617
232
            lex->token = TOKEN_INVALID;
618
1.33k
    }
619
620
170
    else {
621
        /* save the rest of the input UTF-8 sequence to get an error
622
           message of valid UTF-8 */
623
170
        lex_save_cached(lex);
624
170
        lex->token = TOKEN_INVALID;
625
170
    }
626
627
166k
out:
628
166k
    return lex->token;
629
165k
}
630
631
18.2k
static char *lex_steal_string(lex_t *lex, size_t *out_len) {
632
18.2k
    char *result = NULL;
633
18.2k
    if (lex->token == TOKEN_STRING) {
634
18.2k
        result = lex->value.string.val;
635
18.2k
        *out_len = lex->value.string.len;
636
18.2k
        lex->value.string.val = NULL;
637
18.2k
        lex->value.string.len = 0;
638
18.2k
    }
639
18.2k
    return result;
640
18.2k
}
641
642
2.84k
static int lex_init(lex_t *lex, get_func get, size_t flags, void *data) {
643
2.84k
    stream_init(&lex->stream, get, data);
644
2.84k
    if (strbuffer_init(&lex->saved_text))
645
0
        return -1;
646
647
2.84k
    lex->flags = flags;
648
2.84k
    lex->token = TOKEN_INVALID;
649
2.84k
    return 0;
650
2.84k
}
651
652
2.84k
static void lex_close(lex_t *lex) {
653
2.84k
    if (lex->token == TOKEN_STRING)
654
60
        lex_free_string(lex);
655
2.84k
    strbuffer_close(&lex->saved_text);
656
2.84k
}
657
658
/*** parser ***/
659
660
static json_t *parse_value(lex_t *lex, size_t flags, json_error_t *error);
661
662
3.34k
static json_t *parse_object(lex_t *lex, size_t flags, json_error_t *error) {
663
3.34k
    json_t *object = json_object();
664
3.34k
    if (!object)
665
0
        return NULL;
666
667
3.34k
    lex_scan(lex, error);
668
3.34k
    if (lex->token == '}')
669
931
        return object;
670
671
18.4k
    while (1) {
672
18.4k
        char *key;
673
18.4k
        size_t len;
674
18.4k
        json_t *value;
675
676
18.4k
        if (lex->token != TOKEN_STRING) {
677
257
            error_set(error, lex, json_error_invalid_syntax, "string or '}' expected");
678
257
            goto error;
679
257
        }
680
681
18.2k
        key = lex_steal_string(lex, &len);
682
18.2k
        if (!key)
683
0
            return NULL;
684
18.2k
        if (memchr(key, '\0', len)) {
685
1
            jsonp_free(key);
686
1
            error_set(error, lex, json_error_null_byte_in_key,
687
1
                      "NUL byte in object key not supported");
688
1
            goto error;
689
1
        }
690
691
18.2k
        if (flags & JSON_REJECT_DUPLICATES) {
692
0
            if (json_object_getn(object, key, len)) {
693
0
                jsonp_free(key);
694
0
                error_set(error, lex, json_error_duplicate_key, "duplicate object key");
695
0
                goto error;
696
0
            }
697
0
        }
698
699
18.2k
        lex_scan(lex, error);
700
18.2k
        if (lex->token != ':') {
701
173
            jsonp_free(key);
702
173
            error_set(error, lex, json_error_invalid_syntax, "':' expected");
703
173
            goto error;
704
173
        }
705
706
18.0k
        lex_scan(lex, error);
707
18.0k
        value = parse_value(lex, flags, error);
708
18.0k
        if (!value) {
709
739
            jsonp_free(key);
710
739
            goto error;
711
739
        }
712
713
17.2k
        if (json_object_setn_new_nocheck(object, key, len, value)) {
714
0
            jsonp_free(key);
715
0
            goto error;
716
0
        }
717
718
17.2k
        jsonp_free(key);
719
720
17.2k
        lex_scan(lex, error);
721
17.2k
        if (lex->token != ',')
722
1.24k
            break;
723
724
16.0k
        lex_scan(lex, error);
725
16.0k
    }
726
727
1.24k
    if (lex->token != '}') {
728
132
        error_set(error, lex, json_error_invalid_syntax, "'}' expected");
729
132
        goto error;
730
132
    }
731
732
1.11k
    return object;
733
734
1.30k
error:
735
1.30k
    json_decref(object);
736
1.30k
    return NULL;
737
1.24k
}
738
739
44.6k
static json_t *parse_array(lex_t *lex, size_t flags, json_error_t *error) {
740
44.6k
    json_t *array = json_array();
741
44.6k
    if (!array)
742
0
        return NULL;
743
744
44.6k
    lex_scan(lex, error);
745
44.6k
    if (lex->token == ']')
746
218
        return array;
747
748
66.7k
    while (lex->token) {
749
66.7k
        json_t *elem = parse_value(lex, flags, error);
750
66.7k
        if (!elem)
751
43.9k
            goto error;
752
753
22.8k
        if (json_array_append_new(array, elem)) {
754
0
            goto error;
755
0
        }
756
757
22.8k
        lex_scan(lex, error);
758
22.8k
        if (lex->token != ',')
759
523
            break;
760
761
22.3k
        lex_scan(lex, error);
762
22.3k
    }
763
764
567
    if (lex->token != ']') {
765
247
        error_set(error, lex, json_error_invalid_syntax, "']' expected");
766
247
        goto error;
767
247
    }
768
769
320
    return array;
770
771
44.1k
error:
772
44.1k
    json_decref(array);
773
44.1k
    return NULL;
774
567
}
775
776
86.6k
static json_t *parse_value(lex_t *lex, size_t flags, json_error_t *error) {
777
86.6k
    json_t *json;
778
779
86.6k
    lex->depth++;
780
86.6k
    if (lex->depth > JSON_PARSER_MAX_DEPTH) {
781
2
        error_set(error, lex, json_error_stack_overflow, "maximum parsing depth reached");
782
2
        return NULL;
783
2
    }
784
785
86.6k
    switch (lex->token) {
786
12.3k
        case TOKEN_STRING: {
787
12.3k
            const char *value = lex->value.string.val;
788
12.3k
            size_t len = lex->value.string.len;
789
790
12.3k
            if (!(flags & JSON_ALLOW_NUL)) {
791
12.3k
                if (memchr(value, '\0', len)) {
792
2
                    error_set(error, lex, json_error_null_character,
793
2
                              "\\u0000 is not allowed without JSON_ALLOW_NUL");
794
2
                    return NULL;
795
2
                }
796
12.3k
            }
797
798
12.3k
            json = jsonp_stringn_nocheck_own(value, len);
799
12.3k
            lex->value.string.val = NULL;
800
12.3k
            lex->value.string.len = 0;
801
12.3k
            break;
802
12.3k
        }
803
804
23.7k
        case TOKEN_INTEGER: {
805
23.7k
            json = json_integer(lex->value.integer);
806
23.7k
            break;
807
12.3k
        }
808
809
1.32k
        case TOKEN_REAL: {
810
1.32k
            json = json_real(lex->value.real);
811
1.32k
            break;
812
12.3k
        }
813
814
244
        case TOKEN_TRUE:
815
244
            json = json_true();
816
244
            break;
817
818
196
        case TOKEN_FALSE:
819
196
            json = json_false();
820
196
            break;
821
822
658
        case TOKEN_NULL:
823
658
            json = json_null();
824
658
            break;
825
826
3.34k
        case '{':
827
3.34k
            json = parse_object(lex, flags, error);
828
3.34k
            break;
829
830
44.6k
        case '[':
831
44.6k
            json = parse_array(lex, flags, error);
832
44.6k
            break;
833
834
118
        case TOKEN_INVALID:
835
118
            error_set(error, lex, json_error_invalid_syntax, "invalid token");
836
118
            return NULL;
837
838
18
        default:
839
18
            error_set(error, lex, json_error_invalid_syntax, "unexpected token");
840
18
            return NULL;
841
86.6k
    }
842
843
86.5k
    if (!json)
844
45.4k
        return NULL;
845
846
41.0k
    lex->depth--;
847
41.0k
    return json;
848
86.5k
}
849
850
2.84k
static json_t *parse_json(lex_t *lex, size_t flags, json_error_t *error) {
851
2.84k
    json_t *result;
852
853
2.84k
    lex->depth = 0;
854
855
2.84k
    lex_scan(lex, error);
856
2.84k
    if (!(flags & JSON_DECODE_ANY)) {
857
2.84k
        if (lex->token != '[' && lex->token != '{') {
858
971
            error_set(error, lex, json_error_invalid_syntax, "'[' or '{' expected");
859
971
            return NULL;
860
971
        }
861
2.84k
    }
862
863
1.87k
    result = parse_value(lex, flags, error);
864
1.87k
    if (!result)
865
950
        return NULL;
866
867
925
    if (!(flags & JSON_DISABLE_EOF_CHECK)) {
868
925
        lex_scan(lex, error);
869
925
        if (lex->token != TOKEN_EOF) {
870
14
            error_set(error, lex, json_error_end_of_input_expected,
871
14
                      "end of file expected");
872
14
            json_decref(result);
873
14
            return NULL;
874
14
        }
875
925
    }
876
877
911
    if (error) {
878
        /* Save the position even though there was no error */
879
911
        error->position = (int)lex->stream.position;
880
911
    }
881
882
911
    return result;
883
925
}
884
885
typedef struct {
886
    const char *data;
887
    size_t pos;
888
} string_data_t;
889
890
8.61M
static int string_get(void *data) {
891
8.61M
    char c;
892
8.61M
    string_data_t *stream = (string_data_t *)data;
893
8.61M
    c = stream->data[stream->pos];
894
8.61M
    if (c == '\0')
895
1.66k
        return EOF;
896
8.61M
    else {
897
8.61M
        stream->pos++;
898
8.61M
        return (unsigned char)c;
899
8.61M
    }
900
8.61M
}
901
902
2.52k
json_t *json_loads(const char *string, size_t flags, json_error_t *error) {
903
2.52k
    lex_t lex;
904
2.52k
    json_t *result;
905
2.52k
    string_data_t stream_data;
906
907
2.52k
    jsonp_error_init(error, "<string>");
908
909
2.52k
    if (string == NULL) {
910
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
911
0
        return NULL;
912
0
    }
913
914
2.52k
    stream_data.data = string;
915
2.52k
    stream_data.pos = 0;
916
917
2.52k
    if (lex_init(&lex, string_get, flags, (void *)&stream_data))
918
0
        return NULL;
919
920
2.52k
    result = parse_json(&lex, flags, error);
921
922
2.52k
    lex_close(&lex);
923
2.52k
    return result;
924
2.52k
}
925
926
typedef struct {
927
    const char *data;
928
    size_t len;
929
    size_t pos;
930
} buffer_data_t;
931
932
5.01M
static int buffer_get(void *data) {
933
5.01M
    char c;
934
5.01M
    buffer_data_t *stream = data;
935
5.01M
    if (stream->pos >= stream->len)
936
316
        return EOF;
937
938
5.01M
    c = stream->data[stream->pos];
939
5.01M
    stream->pos++;
940
5.01M
    return (unsigned char)c;
941
5.01M
}
942
943
317
json_t *json_loadb(const char *buffer, size_t buflen, size_t flags, json_error_t *error) {
944
317
    lex_t lex;
945
317
    json_t *result;
946
317
    buffer_data_t stream_data;
947
948
317
    jsonp_error_init(error, "<buffer>");
949
950
317
    if (buffer == NULL) {
951
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
952
0
        return NULL;
953
0
    }
954
955
317
    stream_data.data = buffer;
956
317
    stream_data.pos = 0;
957
317
    stream_data.len = buflen;
958
959
317
    if (lex_init(&lex, buffer_get, flags, (void *)&stream_data))
960
0
        return NULL;
961
962
317
    result = parse_json(&lex, flags, error);
963
964
317
    lex_close(&lex);
965
317
    return result;
966
317
}
967
968
0
json_t *json_loadf(FILE *input, size_t flags, json_error_t *error) {
969
0
    lex_t lex;
970
0
    const char *source;
971
0
    json_t *result;
972
973
0
    if (input == stdin)
974
0
        source = "<stdin>";
975
0
    else
976
0
        source = "<stream>";
977
978
0
    jsonp_error_init(error, source);
979
980
0
    if (input == NULL) {
981
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
982
0
        return NULL;
983
0
    }
984
985
0
    if (lex_init(&lex, (get_func)fgetc, flags, input))
986
0
        return NULL;
987
988
0
    result = parse_json(&lex, flags, error);
989
990
0
    lex_close(&lex);
991
0
    return result;
992
0
}
993
994
0
static int fd_get_func(int *fd) {
995
0
#ifdef HAVE_UNISTD_H
996
0
    uint8_t c;
997
0
    if (read(*fd, &c, 1) == 1)
998
0
        return c;
999
0
#endif
1000
0
    return EOF;
1001
0
}
1002
1003
0
json_t *json_loadfd(int input, size_t flags, json_error_t *error) {
1004
0
    lex_t lex;
1005
0
    const char *source;
1006
0
    json_t *result;
1007
1008
0
#ifdef HAVE_UNISTD_H
1009
0
    if (input == STDIN_FILENO)
1010
0
        source = "<stdin>";
1011
0
    else
1012
0
#endif
1013
0
        source = "<stream>";
1014
1015
0
    jsonp_error_init(error, source);
1016
1017
0
    if (input < 0) {
1018
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
1019
0
        return NULL;
1020
0
    }
1021
1022
0
    if (lex_init(&lex, (get_func)fd_get_func, flags, &input))
1023
0
        return NULL;
1024
1025
0
    result = parse_json(&lex, flags, error);
1026
1027
0
    lex_close(&lex);
1028
0
    return result;
1029
0
}
1030
1031
0
json_t *json_load_file(const char *path, size_t flags, json_error_t *error) {
1032
0
    json_t *result;
1033
0
    FILE *fp;
1034
1035
0
    jsonp_error_init(error, path);
1036
1037
0
    if (path == NULL) {
1038
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
1039
0
        return NULL;
1040
0
    }
1041
1042
0
    fp = fopen(path, "rb");
1043
0
    if (!fp) {
1044
0
        error_set(error, NULL, json_error_cannot_open_file, "unable to open %s: %s", path,
1045
0
                  strerror(errno));
1046
0
        return NULL;
1047
0
    }
1048
1049
0
    result = json_loadf(fp, flags, error);
1050
1051
0
    fclose(fp);
1052
0
    return result;
1053
0
}
1054
1055
0
#define MAX_BUF_LEN 1024
1056
1057
typedef struct {
1058
    char data[MAX_BUF_LEN];
1059
    size_t len;
1060
    size_t pos;
1061
    json_load_callback_t callback;
1062
    void *arg;
1063
} callback_data_t;
1064
1065
0
static int callback_get(void *data) {
1066
0
    char c;
1067
0
    callback_data_t *stream = data;
1068
1069
0
    if (stream->pos >= stream->len) {
1070
0
        stream->pos = 0;
1071
0
        stream->len = stream->callback(stream->data, MAX_BUF_LEN, stream->arg);
1072
0
        if (stream->len == 0 || stream->len == (size_t)-1)
1073
0
            return EOF;
1074
0
    }
1075
1076
0
    c = stream->data[stream->pos];
1077
0
    stream->pos++;
1078
0
    return (unsigned char)c;
1079
0
}
1080
1081
json_t *json_load_callback(json_load_callback_t callback, void *arg, size_t flags,
1082
0
                           json_error_t *error) {
1083
0
    lex_t lex;
1084
0
    json_t *result;
1085
1086
0
    callback_data_t stream_data;
1087
1088
0
    memset(&stream_data, 0, sizeof(stream_data));
1089
0
    stream_data.callback = callback;
1090
0
    stream_data.arg = arg;
1091
1092
0
    jsonp_error_init(error, "<callback>");
1093
1094
0
    if (callback == NULL) {
1095
0
        error_set(error, NULL, json_error_invalid_argument, "wrong arguments");
1096
0
        return NULL;
1097
0
    }
1098
1099
0
    if (lex_init(&lex, (get_func)callback_get, flags, &stream_data))
1100
0
        return NULL;
1101
1102
0
    result = parse_json(&lex, flags, error);
1103
1104
0
    lex_close(&lex);
1105
0
    return result;
1106
0
}