fix(mxl-compile,mxl-decompile): пустой текст ячейки и расхождение портов на нём

Пустой текст платформа хранит только самозакрывающимся тегом: в корпусе ERP
таких 1 224 460, а из 780 934 непустых блоков нет ни одного, где пусты все
языки. Компилятор же на `text: ""` писал блок с пустым элементом языка —
запись, которой в выгрузках не существует. Теперь любая пустая форма
(строка, пустой объект, все языки пустыми) даёт один и тот же тег, а
декомпилятор возвращает её канонической пустой строкой.

Отсюда же росло расхождение портов. Свёртка текста на пустой карте языков
возвращала null, если ДРУГОГО текста в макете нет вовсе: набор языков
документа при этом пуст. Дальше py писал пропуск колонки, а ps1 наступал
на разворачивание одноэлементного массива — список из одного $null
превращался в $null, и строка целиком уходила в пустые.

Проверено на 12 корпусных макетах: 1411 пустых текстов из 1411 вернулись
на место, JSON портов совпадает.
This commit is contained in:
Nick Shirokov
2026-08-16 12:30:19 +03:00
parent fef55043cf
commit e048fcff70
9 changed files with 186 additions and 14 deletions
@@ -1,5 +1,5 @@
#!/usr/bin/env python3
# mxl-compile v1.50 — Compile 1C spreadsheet from JSON
# mxl-compile v1.51 — Compile 1C spreadsheet from JSON
# Source: https://github.com/Nikolay-Shirokov/cc-1c-skills
import argparse
import hashlib
@@ -1210,10 +1210,10 @@ def main():
pairs = [(str(k), str(v)) for k, v in value.items()]
else:
pairs = [(lang, str(value)) for lang in text_languages]
# Пустой объект — отдельное состояние: тег текста есть, языков в нём нет. Платформа
# пишет его самозакрывающимся. Для авторинга бесполезно (визуально это тот же пустой
# текст, что и ""), поэтому в описании DSL записи нет — она нужна раундтрипу.
if not pairs:
# Пустой текст платформа хранит ТОЛЬКО самозакрывающимся тегом: в корпусе ERP таких
# 1 224 460, а из 780 934 непустых блоков ни одного со всеми пустыми языками нет.
# Поэтому и пустая строка, и пустой объект дают одну и ту же запись.
if not pairs or all(content == '' for _, content in pairs):
lines.append('\t\t\t\t\t<tl/>')
return
lines.append('\t\t\t\t\t<tl>')