# Where Quality Breaks in Compressed Short-Text Generation: Staged Bottleneck Localization

Canonical HTML: https://aogavrilov.com/fil/publications/where-quality-breaks/

Document language: fil

Kung Saan Bumibigay ang Kalidad sa Pagbuo ng Na-compress na Maiikling Teksto: Sunod-sunod na Pagtukoy sa Bottleneck

Yugtu-yugtong pagsusuri sa pagbuo ng compressed na maiikling teksto na naghihiwalay sa pagkawala ng kalidad sa rekonstruksiyon ng codec at sa latent generation.

[Alexey Gavrilov](https://orcid.org/0009-0006-3147-5430) 1 [Alan-Barsag Gazzaev](https://orcid.org/0009-0000-0334-312X) 1 [Sergey Muravyov](https://orcid.org/0000-0002-4251-1744) 1

1. [ITMO University, Saint Petersburg, Russia](https://en.itmo.ru/)

[Basahin ang buong papel sa HTML](https://aogavrilov.com/publications/where-quality-breaks/full-text/) Nahahanapang teksto na may mga pormula, talahanayan, larawan, at sanggunian.

Pinal na tinanggap na manuskrito (bersiyong inilathala ng may-akda na may DOI). © 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting or republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works. [Mga tuntunin sa paglalathala at muling paggamit](https://journals.ieeeauthorcenter.ieee.org/become-an-ieee-journal-author/publishing-ethics/guidelines-and-policies/post-publication-policies/) .

## Ang papel sa 30 segundo

**Tanong sa pananaliksik** Paano matutukoy nang hiwalay ang bahagi ng codec at ng latent generator sa pagkawala ng kalidad sa isang pipeline ng pagbuo ng compressed na teksto?

### Suliranin

Sa pagbuo ng compressed na maiikling teksto, maaaring magmula ang mahinang na-decode na teksto sa impormasyong nawala sa codec o sa mahinang latent-space generation. Pinagsasama ng mga end-to-end score ang dalawang uring ito ng kabiguan at maaaring maituon ang optimization sa maling bahagi.

### Pamamaraan

Binibigyan ng score ng yugtu-yugtong protocol ang mga orihinal na teksto, magkapares na rekonstruksiyon ng codec, output ng token-space MDLM, at output ng code-space diffusion gamit ang iisang panlabas na GPT-2 evaluator. Nananatiling mga diagnostic ang mga sukatan ng codebook at geometry, hindi mga pamalit sa kalidad ng na-decode na teksto.

### Pangunahing resulta

Itinataas ng rekonstruksiyon ng codec ang median external perplexity mula 15.17 tungong 27.36 at ang p95 mula 25.10 tungong 98.91. Gayunman, 30.9% pa ring mas mababa ang median perplexity ng code-space MDLM kaysa sa token-space MDLM.

### Kung bakit ito mahalaga

Ginagawang praktikal na pagkakasunod-sunod ng gawain ng resulta ang pagtukoy sa bottleneck ng codec: unahin ang pagpapahusay sa codec, saka ihambing ang token-space at code-space generation, at ituring lamang na makabuluhan ang pagbuti ng latent proxy kapag bumuti rin ang na-decode na teksto.

## Abstrak

Maaaring mabigo sa dalawang magkaibang yugto ang mga generator ng compressed na maiikling teksto: maaaring magtapon ng impormasyon ang codec bago magsimula ang generation, o maaaring lumikha ng mahihinang code ang latent generator. Kung hindi paghihiwalayin ang mga uring ito ng kabiguan, maaaring maubos ng mga mananaliksik ang compute sa pagpapahusay sa maling bahagi. Sinusuri namin ang problemang ito sa isang kontroladong 64-to-16 TinyStories case study na binuo gamit ang herarkikal na VQ-VAE-2 codec at masked discrete diffusion generator (MDLM). Gumagamit kami ng yugtu-yugtong validation protocol na naghihiwalay sa fidelity ng rekonstruksiyon ng codec, kalidad ng latent generation, at mga pantulong na latent diagnostic sa ilalim ng iisang panlabas na GPT-2 scorer, habang nag-uulat ng mga karagdagang semantic metric para sa geometry study. Sa sinubok na configuration, itinataas ng rekonstruksiyon ng codec lamang ang median external perplexity mula 15.17 tungong 27.36 (+80.4%) at ang p95 mula 25.10 tungong 98.91 (+294.1%), na nagpapakitang nangyayari ang pangunahing pagkawala ng kalidad bago magsimula ang latent generation. Sa ilalim ng parehong scorer, nananatiling higit na mahusay ang code-space MDLM kaysa token-space diffusion, na nagpapababa sa mean, median, at p95 nang 32.9%, 30.9%, at 36.6%, ayon sa pagkakasunod. Pinahuhusay ng geometry-aware regularization ang mga lokal na latent proxy ngunit hindi ang mga metric ng na-decode na teksto sa mga available na run. Metodolohikal, hindi algoritmiko, ang ambag: naglalahad ang papel ng magagamit-muling yugtu-yugtong pagsusuri para sa isang kongkretong pipeline at ipinakikita na, sa setting na ito, fidelity ng codec—hindi latent denoising—ang nagtatakda sa praktikal na pinakamataas na kalidad.

Inilathala sa 2026 39th Conference of Open Innovations Association (FRUCT)

Uri ng ambag Metodolohiya ng pagsusuri

Abril 28, 2026 isyu 1 pp. 69–76 Pangunahing kumperensiya

DOI [https://doi.org/10.23919/FRUCT70069.2026.11506553](https://doi.org/10.23919/FRUCT70069.2026.11506553)

## Mga nilalaman Sa pahinang ito

## Mahahalagang resulta

| Punto ng ebalwasyon | n | Mean PPL | Median PPL | p95 PPL |
| --- | --- | --- | --- | --- |
| Mga orihinal na teksto | 256 | 16.24 | 15.17 | 25.1 |
| Mga rekonstruksiyon ng codec | 256 | 37.26 | 27.36 | 98.91 |
| AR baseline | 251 | 30.98 | 23.27 | 56.11 |
| MDLM sa espasyo ng token | 256 | 44.74 | 38.42 | 93.6 |
| MDLM sa espasyo ng code | 256 | 30.01 | 26.55 | 59.36 |

**Pangunahing resulta.** Karamihan sa naobserbahang pagkawala ng kalidad ay nangyayari bago ang generation; gayunman, 30.9% pa ring mas mababa ang median perplexity ng code-space diffusion kaysa sa token-space diffusion.

I-download ang mga resulta: [CSV](https://aogavrilov.com/publications/where-quality-breaks/results.csv) [JSON](https://aogavrilov.com/publications/where-quality-breaks/results.json) [Markdown](https://aogavrilov.com/publications/where-quality-breaks/results.md) Panlabas na mirror: [Dataset card sa Hugging Face](https://huggingface.co/datasets/aogavrilov/where-quality-breaks-results)

## PDF at pagsipi

**Paano sipiin ang papel na ito** BibTeX ang inirerekomendang format. Ang lahat ng baryante sa ibaba ay binuo mula sa iisang tala ng publikasyon.

```
@inproceedings{Gavrilov2026WhereQuality,
  title      = {Where Quality Breaks in Compressed Short-Text Generation: Staged Bottleneck Localization},
  author     = {Gavrilov, Alexey and Gazzaev, Alan-Barsag and Muravyov, Sergey},
  booktitle  = {2026 39th Conference of Open Innovations Association (FRUCT)},
  publisher  = {IEEE},
  year       = {2026},
  pages      = {69--76},
  doi        = {10.23919/FRUCT70069.2026.11506553},
  url        = {https://doi.org/10.23919/FRUCT70069.2026.11506553},
  isbn       = {978-952-65246-5-8},
}
```

Mga file ng pagsipi: [Tekstong APA](https://aogavrilov.com/publications/where-quality-breaks/citation-apa.txt) [Tekstong IEEE](https://aogavrilov.com/publications/where-quality-breaks/citation-ieee.txt) [RIS](https://aogavrilov.com/publications/where-quality-breaks/citation.ris) [CSL-JSON](https://aogavrilov.com/publications/where-quality-breaks/citation.json) [Schema.org JSON-LD](https://aogavrilov.com/publications/where-quality-breaks/metadata.jsonld) [OAI-DC XML](https://aogavrilov.com/publications/where-quality-breaks/oai-dc.xml) [OpenAIRE v4 XML](https://aogavrilov.com/publications/where-quality-breaks/openaire.xml) [MODS XML](https://aogavrilov.com/publications/where-quality-breaks/mods.xml) [JATS 1.4 metadata XML](https://aogavrilov.com/publications/where-quality-breaks/metadata.jats.xml) [JATS 1.4 XML ng buong teksto](https://aogavrilov.com/publications/where-quality-breaks/full-text/article.jats.xml) [RDF Turtle](https://aogavrilov.com/publications/where-quality-breaks/metadata.ttl) [Hanay ng mga link (JSON)](https://aogavrilov.com/publications/where-quality-breaks/linkset.json) [Hanay ng mga link (HTTP)](https://aogavrilov.com/publications/where-quality-breaks/linkset) [RO-Crate](https://aogavrilov.com/publications/where-quality-breaks/ro-crate-metadata.json)

DOI: [https://doi.org/10.23919/FRUCT70069.2026.11506553](https://doi.org/10.23919/FRUCT70069.2026.11506553)

Buong gabay

## Buong gabay sa pananaliksik

## Pamamaraan

## 

Gumagamit ang papel ng iisang tagatasa sa tatlong yugto ng pagsusuri upang maiugnay ang bawat karagdagang transpormasyon sa nasusukat na agwat sa kalidad.

1. Muling buuin I-encode ang bawat 64-token na sample ng TinyStories bilang 16 na top-level code at agad itong i-decode upang sukatin ang pagkawala sa rekonstruksiyon ng codec.
2. Bumuo Bumuo gamit ang MDLM ng alinman sa mga text token o discrete latent code, pagkatapos ay i-decode ang mga sample sa espasyo ng code sa pamamagitan ng parehong sinanay na codec.
3. Ihambing Bigyan ng score ang mga orihinal, rekonstruksiyon, at nabuong teksto gamit ang iisang panlabas na protocol ng GPT-2, kabilang ang mga estadistika ng median at tail.

![Yugtu-yugtong pipeline sa pagbuo ng pinaikling teksto na naghahambing sa orihinal na teksto, rekonstruksiyon ng codec, code-space MDLM, at na-decode na teksto upang ihiwalay ang pagkawala sa codec sa pagkawala sa pagbuo.](https://aogavrilov.com/publications/where-quality-breaks/staged-codec-bottleneck-localization.svg)

**Inihihiwalay ng yugtu-yugtong pagtukoy sa bottleneck ang pagkawala sa rekonstruksiyon ng codec at ang pagkawala sa latent generation gamit ang iisang protocol sa pagsusuri ng na-decode na teksto.* Pinagmulan: [Paliwanag na diagram na ginawa ng may-akda batay sa inilathalang pamamaraan at mga resulta.](https://doi.org/10.23919/FRUCT70069.2026.11506553) . Mga tuntunin sa muling paggamit: [CC BY 4.0](https://creativecommons.org/licenses/by/4.0/) . Iminungkahing atribusyon: Gavrilov, Gazzaev, and Muravyov (2026), Where Quality Breaks in Compressed Short-Text Generation. [I-download ang SVG](https://aogavrilov.com/publications/where-quality-breaks/staged-codec-bottleneck-localization.svg) .*

### Pangunahing ideya

Hindi mababawi ng downstream generator ang impormasyong itinapon na ng codec. Samakatuwid, kailangang siyasatin ang yugto ng rekonstruksiyon bago bigyang-kahulugan ang mga resulta ng pagbuo sa espasyong latent.

### Pagkakaiba sa mga kaugnay na lapit

Iisang pinal na generation score ang iniuulat ng karaniwang end-to-end na paghahambing. Nagdaragdag ang protocol na ito ng checkpoint para sa magkapares na rekonstruksiyon at inihihiwalay ang mga health metric sa latent space mula sa ebidensiya sa na-decode na teksto.

### Ano ang bago

Ang ambag ay isang magagamit-muling yugtu-yugtong metodolohiya ng pagsusuri para sa isang kongkretong pipeline ng compressed na teksto, hindi isang bagong denoising algorithm.

## Mga tanong na tinutulungang sagutin ng papel na ito

## 

Magbukas ng tanong para sa maikling sagot na nakabatay sa papel. Nakalista sa Mga Limitasyon ang detalyadong mga hangganan ng ebidensiya.

1. Saang bahagi bumabagsak ang kalidad sa compressed na pagbuo ng maikling teksto? Sa sinubok na 64-to-16 pipeline ng TinyStories, lumilitaw ang pangunahing pagbaba ng kalidad sa rekonstruksiyon ng codec, bago magsimula ang pagbuo sa espasyong latent. Tumataas ang median external GPT-2 perplexity mula 15.17 para sa orihinal na teksto tungong 27.36 matapos ang rekonstruksiyon, samantalang tumataas ang p95 mula 25.10 tungong 98.91. Resulta ito para sa iisang configuration, hindi isang pangkalahatang pagraranggo ng mga codec.
2. Paano maihihiwalay ang pagkawala sa codec sa pagkawala sa pagbuo sa espasyong latent? Sinusuri ng nakayugtong na protocol ang mga orihinal, magkapares na rekonstruksiyon ng codec, at panghuling nabuong teksto gamit ang iisang panlabas na scorer. Tinatantiya ng agwat mula orihinal tungong rekonstruksiyon ang ambag ng codec, samantalang tumutulong ang paghahambing mula rekonstruksiyon tungong nabuong output na matukoy ang karagdagang pagkawala sa yugto ng pagbuo. Iniuulat nang hiwalay ang mga sukatan ng kalagayan ng latent at ang ebidensiya mula sa na-decode na teksto.
3. Paano dapat suriin ang pagbuo ng teksto gamit ang diskretong latent representation? Inirerekomenda ng papel na suriin ang fidelity ng rekonstruksiyon bago paghambingin ang mga generator, gamitin ang iisang tagatasa ng na-decode na teksto sa bawat yugto, at iulat ang estadistika sa gitna at mga dulo. Itinuturing din nito ang paggamit ng codebook, geometry, at iba pang latent na proxy bilang mga diyagnostiko, hindi pamalit sa kalidad ng na-decode na teksto.
4. Nahihigitan ba ng diffusion sa espasyo ng code ang diffusion sa espasyo ng token? Sa ilalim ng pinagsasaluhang scorer at sinubok na setup, binabawasan ng MDLM sa espasyo ng code ang mean, median, at p95 na perplexity nang 32.9%, 30.9%, at 36.6% kumpara sa MDLM sa espasyo ng token. Deskriptibo at partikular sa configuration ang paghahambing: hindi nito itinatatag ang pangkalahatang ranggo sa iba't ibang dataset, compression ratio, codec, o arkitektura ng diffusion.
5. Ginagarantiyahan ba ng mas mahuhusay na panukat ng latent geometry ang mas mahusay na nabuong teksto? Hindi. Sa mga available na magkatugmang run, napahusay ng geometry-aware regularization ang mga lokal na proxy sa espasyong latent ngunit hindi ang mga sukatan ng decoded text. Sinusuportahan ng resultang ito ang pag-audit sa bawat pagbuti ng proxy sa pinal na decoded output at ang pagtrato sa kawalan ng transfer bilang kapaki-pakinabang na negatibong resulta, sa halip na ebidensiya ng pagbuti ng pagbuo.

## Paghahambing sa mga kaugnay na lapit

## 

| Pamamaraan | Representasyon | Kontrol / pagsusuri | Ano ang pinananatili o sinusukat |
| --- | --- | --- | --- |
| Diffusion sa espasyo ng token | Mga token ng teksto | Kalidad ng pagbuo sa espasyo ng token | Katatasan at gawi ng tagapuntos sa tuwirang pagbuo |
| Compressed latent generation | Mga discrete latent code sa pamamagitan ng codec | Pinal na kalidad ng end-to-end na pagbuo | Pinagsamang gawi ng codec at latent generator |
| Yugtu-yugtong pagtukoy sa lokasyon ng bottleneck | Teksto, mga rekonstruksiyon ng codec, at mga discrete latent | Ihiwalay ang pagkawala sa codec sa pagkawala sa pagbuo | Kung saan humihina ang kalidad sa ilalim ng iisang scorer |

Nililinaw ng paghahambing ang pagkakaiba sa saklaw ng pagsusuri at ebidensiya; hindi ito pangkalahatang pagraranggo sa mga pamamaraan.

## Kaugnayan at saklaw

## 

Kapaki-pakinabang ang yugtu-yugtong protocol kapag ang isang generative pipeline ay may natutuhang codec at latent-space generator ngunit hindi malinaw ang pinagmumulan ng pagbaba ng kalidad ng output.

1. Compressed text generation gamit ang mga discrete latent
2. Katapatan ng rekonstruksiyon ng codec sa mga generative pipeline
3. Pagmomodelo ng wika gamit ang masked diffusion sa espasyo ng code
4. Pagtukoy sa bottleneck at pagsusuring magkakatugma sa bawat yugto
5. Pagsisiyasat sa mga pagpapahusay ng proxy sa espasyong latent laban sa na-decode na teksto

## Mga limitasyon

## 

- TinyStories lamang ang ginagamit sa empirikal na pag-aaral.
- Saklaw ng pangunahing pagsusuri ang isang agresibong 64-to-16 compression regime.
- Pinagsasama ng sinuring sistema ang isang hirarkikal na VQ-VAE-2 codec family at isang MDLM generator.
- Nakabatay ang mga paghahambing sa tig-iisang run at deskriptibo ang mga ito, hindi mga estadistikal na pagtatantiya mula sa maraming seed.
- Ang panlabas na GPT-2 perplexity ay pinagsasaluhang diagnostic, hindi pangkalahatang panukat ng kalidad semantiko.
- Hindi dapat tuwirang ilapat ang mga kongklusyon sa lahat ng dataset, arkitektura ng codec, o compression ratio.

## Mga sangguniang sinipi sa papel

## 

Tumutugma ang mga entry na ito sa may-bilang na seksiyong References sa PDF ng papel.

1. Subham Sekhar Sahoo, Marianne Arriola, Yair Schiff, Aaron Gokaslan, Edgar Marroquin, Justin T Chiu, Alexander Rush, Volodymyr Kuleshov. 2024 . [Simple and Effective Masked Diffusion Language Models](https://arxiv.org/abs/2406.07524) . Advances in Neural Information Processing Systems .
2. Aaron van den Oord, Oriol Vinyals, Koray Kavukcuoglu. 2017 . [Neural Discrete Representation Learning](https://arxiv.org/abs/1711.00937) . Advances in Neural Information Processing Systems .
3. Ali Razavi, Aaron van den Oord, Oriol Vinyals. 2019 . [Generating Diverse High-Fidelity Images with VQ-VAE-2](https://arxiv.org/abs/1906.00446) . Advances in Neural Information Processing Systems .
4. Jacob Austin, Daniel D. Johnson, Jonathan Ho, Daniel Tarlow, Rianne van den Berg. 2021 . [Structured Denoising Diffusion Models in Discrete State-Spaces](https://arxiv.org/abs/2107.03006) . Advances in Neural Information Processing Systems .
5. Aaron Lou, Chenlin Meng, Stefano Ermon. 2024 . [Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution](https://arxiv.org/abs/2310.16834) . Proceedings of the 41st International Conference on Machine Learning .
6. Xiaochuang Han, Sachin Kumar, Yulia Tsvetkov. 2023 . [SSD-LM: Semi-autoregressive Simplex-based Diffusion Language Model for Text Generation and Modular Control](https://doi.org/10.18653/v1/2023.acl-long.647) . Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics .
7. Xiang Lisa Li, John Thickstun, Ishaan Gulrajani, Percy Liang, Tatsunori B. Hashimoto. 2022 . [Diffusion-LM Improves Controllable Text Generation](https://arxiv.org/abs/2205.14217) . Advances in Neural Information Processing Systems .
8. Huiwen Chang, Han Zhang, Lu Jiang, Ce Liu, William T. Freeman. 2022 . [MaskGIT: Masked Generative Image Transformer](https://openaccess.thecvf.com/content/CVPR2022/html/Chang_MaskGIT_Masked_Generative_Image_Transformer_CVPR_2022_paper.html) . Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition .
9. Marjan Ghazvininejad, Omer Levy, Yinhan Liu, Luke Zettlemoyer. 2019 . [Mask-Predict: Parallel Decoding of Conditional Masked Language Models](https://doi.org/10.18653/v1/D19-1633) . Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing .
10. Emiel Hoogeboom, Didrik Nielsen, Priyank Jaini, Patrick Forré, Max Welling. 2021 . [Argmax Flows and Multinomial Diffusion: Learning Categorical Distributions](https://arxiv.org/abs/2102.05379) . Advances in Neural Information Processing Systems .
11. Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever. 2019 . [Language Models are Unsupervised Multitask Learners](https://cdn.openai.com/better-language-models/language-models.pdf) . OpenAI Technical Report .
12. Nils Reimers, Iryna Gurevych. 2019 . [Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks](https://doi.org/10.18653/v1/D19-1410) . Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing .
13. Tianyi Zhang, Varsha Kishore, Felix Wu, Kilian Q. Weinberger, Yoav Artzi. 2020 . [BERTScore: Evaluating Text Generation with BERT](https://arxiv.org/abs/1904.09675) . International Conference on Learning Representations .
14. Krishna Pillutla, Swabha Swayamdipta, Rowan Zellers, John Thickstun, Sean Welleck, Yejin Choi, Zaid Harchaoui. 2021 . [MAUVE: Measuring the Gap Between Neural Text and Human Text using Divergence Frontiers](https://arxiv.org/abs/2102.01454) . Advances in Neural Information Processing Systems .
15. Lianmin Zheng, Wei-Lin Chiang, Ying Sheng, Siyuan Zhuang, Zhanghao Wu, Yonghao Zhuang, Zi Lin, Zhuohan Li, Dacheng Li, Eric P. Xing, Hao Zhang, Joseph E. Gonzalez, Ion Stoica. 2023 . [Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena](https://arxiv.org/abs/2306.05685) . Advances in Neural Information Processing Systems, Datasets and Benchmarks Track .

## Mga mapagkukunan at reproducibility

## 

### Pahayag ukol sa datos

## Mga bersiyon

## 

1. **Nailathalang bersiyon** [IEEE / FRUCT, 2026](https://doi.org/10.23919/FRUCT70069.2026.11506553)
2. **Talaan sa arXiv** [Buksan ang preprint record, arXiv:2607.24176](https://arxiv.org/abs/2607.24176)
3. **Indeks ng pananaliksik sa AI** [Hugging Face Paper Page na may beripikadong pagkakakilanlan ng unang may-akda at naka-link na buod ng mga resulta](https://huggingface.co/papers/2607.24176)
4. **Manuskrito ng may-akda** [Lokal na PDF na naa-access bilang teksto](https://aogavrilov.com/publications/where-quality-breaks/paper.pdf)
5. **Talumpati sa kumperensiya** [Presentasyon sa FRUCT 39](https://www.youtube.com/watch?v=JExX7cxa63s)
6. **Indeks ng conference proceedings** [Opisyal na tomo ng FRUCT 39](https://fruct.org/publications/volume-39/fruct39)
7. **PDF ng conference proceedings** [Bukas na buong teksto ng FRUCT](https://www.fruct.org/files/publications/volume-39/fruct39/Gav.pdf)
8. **Buksan ang akademikong record** [OpenAlex](https://openalex.org/W7160914887)
9. **Rekord sa graph ng pagsipi** [Semantic Scholar](https://www.semanticscholar.org/paper/11b5a0e8f75f0dfd141659e9a82ac58982a65ce1)
10. **Buong tekstong ibinahagi ng may-akda** [ResearchGate](https://www.researchgate.net/publication/404794122_Where_Quality_Breaks_in_Compressed_Short-Text_Generation_Staged_Bottleneck_Localization)

Ang inilathalang DOI ang pangunahing bibliograpikong identifier. Nananatili ang pahinang ito bilang nag-iisang canonical project URL sa lahat ng bersiyon.

## Kaugnay na publikasyon

- [Inspectable Control for Structure-Preserving Software Regeneration](https://aogavrilov.com/fil/publications/inspectable-control/)

Basahin ang [Pagtukoy sa bottleneck ng codec](https://aogavrilov.com/fil/projects/codec-bottleneck-diagnosis/) gabay sa pananaliksik. [Tungkol sa may-akda](https://aogavrilov.com/about/) .

### Mga nakatuong tala sa pananaliksik

Mga sagot na nakatuon sa layunin, may malinaw na hangganan ng ebidensiya, at may mga link pabalik sa papel na ito.

- [Code-space at token-space masked diffusion: kung paano paghahambingin ang mga ito](https://aogavrilov.com/fil/research-notes/code-space-vs-token-space-masked-diffusion/)
