|
| 1 | +from app.infrastructure.streaming.answer_streamer_nats import ( |
| 2 | + _MAX_COALESCE_BUFFER, |
| 3 | + _flush_oversized_tail, |
| 4 | + _take_whitespace_delimited_prefixes, |
| 5 | +) |
| 6 | + |
| 7 | + |
| 8 | +def _feed_tokens(parts: list[str]) -> tuple[str, list[str]]: |
| 9 | + """Mimic NatsAnswerStreamer token accumulation + coalescing.""" |
| 10 | + buf = "" |
| 11 | + out: list[str] = [] |
| 12 | + for p in parts: |
| 13 | + buf += p |
| 14 | + buf, emitted = _take_whitespace_delimited_prefixes(buf) |
| 15 | + out.extend(emitted) |
| 16 | + buf, forced = _flush_oversized_tail(buf, _MAX_COALESCE_BUFFER) |
| 17 | + out.extend(forced) |
| 18 | + return buf, out |
| 19 | + |
| 20 | + |
| 21 | +def test_take_prefixes_single_word_with_trailing_space() -> None: |
| 22 | + rest, emitted = _take_whitespace_delimited_prefixes("Куликов ") |
| 23 | + assert rest == "" |
| 24 | + assert emitted == ["Куликов "] |
| 25 | + |
| 26 | + |
| 27 | +def test_take_prefixes_incremental_kulikov() -> None: |
| 28 | + tail, emitted = _feed_tokens(["К", "ули", "ков", " "]) |
| 29 | + assert tail == "" |
| 30 | + assert emitted == ["Куликов "] |
| 31 | + |
| 32 | + |
| 33 | +def test_take_prefixes_multiple_words_one_buffer() -> None: |
| 34 | + rest, emitted = _take_whitespace_delimited_prefixes("a b c ") |
| 35 | + assert rest == "" |
| 36 | + assert emitted == ["a ", "b ", "c "] |
| 37 | + |
| 38 | + |
| 39 | +def test_take_prefixes_tail_without_whitespace_stays() -> None: |
| 40 | + rest, emitted = _take_whitespace_delimited_prefixes("Куликов") |
| 41 | + assert rest == "Куликов" |
| 42 | + assert emitted == [] |
| 43 | + |
| 44 | + |
| 45 | +def test_take_prefixes_leading_spaces_then_word() -> None: |
| 46 | + rest, emitted = _take_whitespace_delimited_prefixes(" Дмитрий ") |
| 47 | + assert rest == "" |
| 48 | + assert emitted == [" ", "Дмитрий "] |
| 49 | + |
| 50 | + |
| 51 | +def test_incremental_flushes_tail_on_done_semantics() -> None: |
| 52 | + tail, emitted = _feed_tokens(["часть"]) |
| 53 | + assert tail == "часть" |
| 54 | + assert emitted == [] |
| 55 | + |
| 56 | + |
| 57 | +def test_flush_oversized_tail_no_whitespace() -> None: |
| 58 | + long = "x" * (_MAX_COALESCE_BUFFER + 1) |
| 59 | + rest, forced = _flush_oversized_tail(long, _MAX_COALESCE_BUFFER) |
| 60 | + assert rest == "" |
| 61 | + assert forced == [long] |
| 62 | + |
| 63 | + |
| 64 | +def test_flush_oversized_tail_under_limit_unchanged() -> None: |
| 65 | + rest, forced = _flush_oversized_tail("word", _MAX_COALESCE_BUFFER) |
| 66 | + assert rest == "word" |
| 67 | + assert forced == [] |
| 68 | + |
| 69 | + |
| 70 | +def test_incremental_chunks_crossing_max_without_space() -> None: |
| 71 | + piece = "n" * 2000 |
| 72 | + tail, emitted = _feed_tokens([piece, piece, piece]) |
| 73 | + assert tail == "" |
| 74 | + assert len(emitted) == 1 |
| 75 | + assert len(emitted[0]) == 6000 |
0 commit comments