# Where Quality Breaks in Compressed Short-Text Generation: Staged Bottleneck Localization

Canonical HTML: https://aogavrilov.com/ur/publications/where-quality-breaks/

Document language: ur

دبے ہوئے مختصر متن کی تولید میں معیار کہاں متاثر ہوتا ہے: مرحلہ وار مقامِ رکاوٹ کی تعیین

مضغوط مختصر متن کی تولید کی مرحلہ وار تشخیص، جو کوڈیک کے بازتعمیراتی خسارے کو مخفی تولید کے خسارے سے الگ کرتی ہے۔

[Alexey Gavrilov](https://orcid.org/0009-0006-3147-5430) 1 [Alan-Barsag Gazzaev](https://orcid.org/0009-0000-0334-312X) 1 [Sergey Muravyov](https://orcid.org/0000-0002-4251-1744) 1

1. [ITMO University, Saint Petersburg, Russia](https://en.itmo.ru/)

[مکمل مقالہ HTML میں پڑھیں](https://aogavrilov.com/publications/where-quality-breaks/full-text/) فارمولوں، جدولوں، اشکال اور حوالوں سمیت قابلِ تلاش متن۔

حتمی منظور شدہ مسودہ (مصنف کی شائع کردہ DOI والی صورت)۔ © 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting or republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works. [اشاعت اور بازاستعمال کی شرائط](https://journals.ieeeauthorcenter.ieee.org/become-an-ieee-journal-author/publishing-ethics/guidelines-and-policies/post-publication-policies/) .

## مقالے کا 30 سیکنڈ میں خلاصہ

**تحقیقی سوال** دبے ہوئے متن کی تولیدی پائپ لائن میں معیار کے زوال کو کوڈیک اور فضائے نہاں کے مولّد سے الگ الگ کیسے منسوب کیا جا سکتا ہے؟

### مسئلہ

مضغوط مختصر متن کی تولید میں ناقص رمزکشائی شدہ متن، کوڈیک میں ضائع ہونے والی معلومات یا فضائے مخفی میں کمزور تولید کا نتیجہ ہو سکتا ہے۔ ابتدا تا انتہا اسکور ناکامی کی ان صورتوں میں امتیاز کو دھندلا دیتے ہیں اور بہتری کی کوششوں کو غلط جزو کی طرف موڑ سکتے ہیں۔

### طریقۂ کار

مرحلہ وار ضابطہ اصل نمونوں، اُن سے مربوط کوڈیک بازتعمیرات، token-space MDLM کے مخرجات، اور code-space diffusion کے مخرجات کو ایک ہی بیرونی GPT-2 جائزہ کار سے جانچتا ہے۔ codebook اور ہندسی پیمائشیں رمزکشائی شدہ متن کے معیار کا بدل نہیں، بلکہ تشخیصی اشاریے رہتی ہیں۔

### مرکزی نتیجہ

کوڈیک بازتعمیر خارجی پرپلیکسیٹی کے وسطانیے کو 15.17 سے 27.36 اور p95 کو 25.10 سے 98.91 تک بڑھاتی ہے۔ اس کے باوجود فضائے کوڈ MDLM، فضائے ٹوکن MDLM کے مقابلے میں وسطانی پرپلیکسیٹی 30.9% کم کرتا ہے۔

### یہ کیوں اہم ہے

یہ نتیجہ کوڈیک کے اختناقی مقام کی تشخیص کو ایک قابلِ عمل ترتیب دیتا ہے: پہلے کوڈیک کی بہتری کو ترجیح دی جائے، پھر token-space اور code-space تولید کا تقابل کیا جائے، اور مخفی قائم مقام پیمانوں میں بہتری کو صرف اسی وقت معتبر سمجھا جائے جب رمزکشائی شدہ متن بھی بہتر ہو۔

## خلاصہ

مضغوط مختصر متن کے مولّد دو مختلف مقامات پر ناکام ہو سکتے ہیں: کوڈیک تولید شروع ہونے سے پہلے معلومات ضائع کر سکتا ہے، یا مولّدِ نہاں کمزور کوڈ پیدا کر سکتا ہے۔ ناکامی کی ان صورتوں کو الگ کیے بغیر محققین غلط جزو کی بہتری پر حسابی وسائل صرف کر سکتے ہیں۔ ہم اس مسئلے کا مطالعہ ایک منضبط 64-سے-16 TinyStories مطالعاتی مثال میں کرتے ہیں، جو درجہ بند VQ-VAE-2 کوڈیک اور ماسک شدہ متفرد پھیلاؤ کے مولّد (MDLM) پر مبنی ہے۔ ہم مرحلہ وار توثیقی ضابطہ استعمال کرتے ہیں جو ایک مشترک خارجی GPT-2 اسکور کار کے تحت کوڈیک بازتعمیر کی وفاداری، نہاں تولید کے معیار، اور معاون نہاں تشخیصی پیمانوں کو الگ کرتا ہے، جبکہ ہندسی مطالعے کے لیے تکمیلی معنوی پیمانے بھی پیش کرتا ہے۔ آزمودہ تشکیل میں، صرف کوڈیک بازتعمیر خارجی پرپلیکسیٹی کے وسطانیے کو 15.17 سے 27.36 (+80.4%) اور p95 کو 25.10 سے 98.91 (+294.1%) تک بڑھا دیتی ہے، جس سے ظاہر ہوتا ہے کہ غالب معیاری خسارہ نہاں تولید شروع ہونے سے پہلے سامنے آتا ہے۔ اسی اسکور کار کے تحت فضائے کوڈ MDLM، فضائے ٹوکن پھیلاؤ سے نمایاں طور پر مضبوط رہتا ہے اور اوسط، وسطانیہ، اور p95 کو بالترتیب 32.9%، 30.9%، اور 36.6% کم کرتا ہے۔ ہندسی آگاہ ضابطہ بندی مقامی نہاں قائم مقام پیمانوں کو بہتر کرتی ہے، مگر دستیاب اجرا میں رمزکشائی شدہ متن کے پیمانوں کو بہتر نہیں کرتی۔ اس تحقیق کا حصہ الگورتھمی کے بجائے طریقہ جاتی ہے: مقالہ ایک مخصوص سلسلۂ عمل کے لیے قابلِ اعادہ مرحلہ وار تشخیص پیش کرتا اور دکھاتا ہے کہ اس ترتیب میں عملی معیار کی حدِ بالا نہاں شور ربائی کے بجائے کوڈیک وفاداری متعین کرتی ہے۔

مقامِ اشاعت 2026 39th Conference of Open Innovations Association (FRUCT)

نوعیتِ حصہ تشخیصی طریقۂ کار

28 اپریل 2026 شمارہ 1 صص۔ 69–76 مرکزی کانفرنس

DOI [https://doi.org/10.23919/FRUCT70069.2026.11506553](https://doi.org/10.23919/FRUCT70069.2026.11506553)

## مندرجات اس صفحے پر

## کلیدی نتائج

| جانچ کا مقام | n | اوسط PPL | میانہ PPL | p95 PPL |
| --- | --- | --- | --- | --- |
| اصل متون | 256 | 16.24 | 15.17 | 25.1 |
| کوڈیک بازتعمیرات | 256 | 37.26 | 27.36 | 98.91 |
| AR baseline | 251 | 30.98 | 23.27 | 56.11 |
| Token-space MDLM | 256 | 44.74 | 38.42 | 93.6 |
| فضائے کوڈ MDLM | 256 | 30.01 | 26.55 | 59.36 |

**کلیدی نتیجہ۔** مشاہدہ شدہ معیار کا بیشتر خسارہ تولید سے پہلے پیدا ہوتا ہے؛ اس کے باوجود code-space diffusion، token-space diffusion کے مقابلے میں perplexity کا وسطانیہ 30.9% کم کرتی ہے۔

نتائج ڈاؤن لوڈ کریں: [CSV](https://aogavrilov.com/publications/where-quality-breaks/results.csv) [JSON](https://aogavrilov.com/publications/where-quality-breaks/results.json) [مارک ڈاؤن](https://aogavrilov.com/publications/where-quality-breaks/results.md) بیرونی آئینہ: [Hugging Face ڈیٹا سیٹ کارڈ](https://huggingface.co/datasets/aogavrilov/where-quality-breaks-results)

## PDF اور حوالہ

**اس مقالے کا حوالہ یوں دیں** BibTeX تجویز کردہ وضع ہے۔ ذیل کی ہر صورت اسی اشاعتی record سے تیار کی گئی ہے۔

```
@inproceedings{Gavrilov2026WhereQuality,
  title      = {Where Quality Breaks in Compressed Short-Text Generation: Staged Bottleneck Localization},
  author     = {Gavrilov, Alexey and Gazzaev, Alan-Barsag and Muravyov, Sergey},
  booktitle  = {2026 39th Conference of Open Innovations Association (FRUCT)},
  publisher  = {IEEE},
  year       = {2026},
  pages      = {69--76},
  doi        = {10.23919/FRUCT70069.2026.11506553},
  url        = {https://doi.org/10.23919/FRUCT70069.2026.11506553},
  isbn       = {978-952-65246-5-8},
}
```

حوالہ جاتی فائلیں: [APA متن](https://aogavrilov.com/publications/where-quality-breaks/citation-apa.txt) [IEEE متن](https://aogavrilov.com/publications/where-quality-breaks/citation-ieee.txt) [RIS](https://aogavrilov.com/publications/where-quality-breaks/citation.ris) [CSL-JSON](https://aogavrilov.com/publications/where-quality-breaks/citation.json) [Schema.org JSON-LD](https://aogavrilov.com/publications/where-quality-breaks/metadata.jsonld) [OAI-DC XML](https://aogavrilov.com/publications/where-quality-breaks/oai-dc.xml) [OpenAIRE v4 XML](https://aogavrilov.com/publications/where-quality-breaks/openaire.xml) [MODS XML](https://aogavrilov.com/publications/where-quality-breaks/mods.xml) [JATS 1.4 میٹا ڈیٹا XML](https://aogavrilov.com/publications/where-quality-breaks/metadata.jats.xml) [مکمل متن JATS 1.4 XML](https://aogavrilov.com/publications/where-quality-breaks/full-text/article.jats.xml) [RDF Turtle](https://aogavrilov.com/publications/where-quality-breaks/metadata.ttl) [روابط کا مجموعہ (JSON)](https://aogavrilov.com/publications/where-quality-breaks/linkset.json) [روابط کا مجموعہ (HTTP)](https://aogavrilov.com/publications/where-quality-breaks/linkset) [RO-Crate](https://aogavrilov.com/publications/where-quality-breaks/ro-crate-metadata.json)

DOI: [https://doi.org/10.23919/FRUCT70069.2026.11506553](https://doi.org/10.23919/FRUCT70069.2026.11506553)

مکمل رہنما

## مکمل تحقیقی رہنما

## طریقۂ کار

## 

مقالہ تین جائزہ مراحل میں ایک scorer رکھتا ہے تاکہ ہر اضافی تبدیلی قابلِ پیمائش معیار خلا سے وابستہ ہو۔

1. بازتعمیر کریں ہر 64-token TinyStories نمونے کو 16 اعلیٰ سطحی رموز میں رمز بند کریں اور کوڈیک بازتعمیر کے نقصان کی پیمائش کے لیے فوراً اس کی رمز کشائی کریں۔
2. تولید کریں MDLM سے یا تو متنی ٹوکن یا منفصل خفی رموز تولید کریں، پھر فضائے رمز کے نمونوں کی اسی تربیت یافتہ کوڈیک کے ذریعے رمز کشائی کریں۔
3. تقابل کریں اصل متون، بازتعمیرات، اور مولّدہ متون کو ایک ہی بیرونی GPT-2 پروٹوکول سے اسکور کریں، جس میں median اور tail کے اعداد و شمار بھی شامل ہوں۔

![مضغوط متن کی مرحلہ وار تولیدی pipeline، جو اصل متن، کوڈیک بازتعمیر، code-space MDLM اور رمزکشائی شدہ متن کا تقابل کرکے کوڈیک کے خسارے کو تولیدی خسارے سے الگ کرتی ہے۔](https://aogavrilov.com/publications/where-quality-breaks/staged-codec-bottleneck-localization.svg)

**مرحلہ وار تعیینِ مقامِ اختناق، رمزکشائی شدہ متن کے ایک مشترک جائزہ جاتی ضابطے کے تحت کوڈیک کے بازتعمیراتی خسارے کو مخفی تولید کے خسارے سے الگ کرتی ہے۔* ماخذ: [شائع شدہ طریقے اور نتائج کی بنیاد پر مصنف کا تیار کردہ توضیحی خاکہ۔](https://doi.org/10.23919/FRUCT70069.2026.11506553) . دوبارہ استعمال کی شرائط: [CC BY 4.0](https://creativecommons.org/licenses/by/4.0/) . تجویز کردہ انتساب: Gavrilov, Gazzaev, and Muravyov (2026), Where Quality Breaks in Compressed Short-Text Generation. [SVG ڈاؤن لوڈ کریں](https://aogavrilov.com/publications/where-quality-breaks/staged-codec-bottleneck-localization.svg) .*

### کلیدی تصور

بعد کا generator وہ معلومات بازیافت نہیں کر سکتا جنہیں codec پہلے ہی ضائع کر چکا ہو۔ اس لیے نہاں تولید کے نتائج کی تعبیر سے پہلے بازتعمیر کے مرحلے کا محاسبہ ضروری ہے۔

### قریبی طریقوں سے فرق

معیاری ابتدا تا انتہا موازنے ایک حتمی تولیدی اسکور دیتے ہیں۔ یہ پروٹوکول جوڑی دار بازتعمیر checkpoint شامل کرکے مخفی فضا کے صحتی پیمانے ڈی کوڈ شدہ متن کے شواہد سے الگ کرتا ہے۔

### نیا کیا ہے

خدمت ایک مخصوص مضغوط متن pipeline کے لیے قابلِ بازاستعمال مرحلہ وار تشخیصی طریقۂ کار ہے، نیا denoising algorithm نہیں۔

## وہ سوالات جن کے جواب میں یہ مقالہ معاون ہے

## 

مقالے پر مبنی مختصر جواب کے لیے سوال کھولیں۔ شواہد کی تفصیلی حدود، حدود و قیود میں درج ہیں۔

1. دبائے ہوئے مختصر متن کی توليد میں معیار کہاں متاثر ہوتا ہے؟ آزمودہ TinyStories 64-to-16 پائپ لائن میں غالب زوال کوڈیک بازتعمیر کے مرحلے پر، فضائے نہاں میں تولید شروع ہونے سے پہلے، ظاہر ہوتا ہے۔ خارجی GPT-2 perplexity کا وسطانیہ اصل متن کے لیے 15.17 سے بڑھ کر بازتعمیر کے بعد 27.36 ہو جاتا ہے، جبکہ p95، 25.10 سے بڑھ کر 98.91 ہو جاتا ہے۔ یہ ایک مخصوص ترتیب کا نتیجہ ہے، کوڈیک کی کوئی آفاقی درجہ بندی نہیں۔
2. کوڈیک کے خسارے کو فضائے نہاں میں تولید کے خسارے سے کیسے الگ کیا جا سکتا ہے؟ مرحلہ وار دستور اصل نمونوں، ان سے جوڑی گئی کوڈیک باز تعمیرات، اور آخری تولید شدہ متن کو ایک مشترک بیرونی ممیز سے جانچتا ہے۔ اصل سے باز تعمیر تک فرق کوڈیک کے حصے کا تخمینہ دیتا ہے، جبکہ باز تعمیر اور تولید شدہ حاصل کے موازنے سے تولیدی مرحلے کے اضافی زیاں کا مقام متعین کرنے میں مدد ملتی ہے۔ نہاں صحت کے پیمانے غیر رمزشُدہ متن کی شہادت سے الگ بیان کیے جاتے ہیں۔
3. منفصل فضائے نہاں میں متن کی تولید کا جائزہ کیسے لیا جانا چاہیے؟ مقالہ generators کے موازنے سے پہلے reconstruction fidelity، ہر مرحلے پر یکساں decoded-text scorer اور مرکزی و دُمی statistics کی سفارش کرتا ہے۔ codebook usage، geometry اور latent proxies کو decoded text quality کا بدل نہیں بلکہ تشخیص سمجھتا ہے۔
4. کیا فضائے رمز کا پھیلاؤ، فضائے ٹوکن کے پھیلاؤ سے بہتر کارکردگی دکھاتا ہے؟ مشترک ممیز اور آزمودہ ترتیب میں code-space MDLM، token-space MDLM کے مقابلے میں mean، median اور p95 perplexity بالترتیب 32.9%، 30.9% اور 36.6% کم کرتا ہے۔ موازنہ توضیحی اور مخصوص ترتیب تک محدود ہے: یہ datasets، compression ratios، codecs یا diffusion architectures میں کوئی آفاقی درجہ بندی قائم نہیں کرتا۔
5. کیا فضائے خفی کی بہتر ہندسی پیمائشیں بہتر تولید شدہ متن کی ضمانت دیتی ہیں؟ نہیں۔ دستیاب مماثل اجرا میں ہندسی آگاہ باقاعدہ کاری نے فضائے نہاں کے مقامی قائم مقام پیمانے بہتر کیے، مگر رمز کشائی شدہ متن کے پیمانوں میں بہتری نہیں آئی۔ یہ نتیجہ تقاضا کرتا ہے کہ ہر قائم مقام بہتری کو آخری رمز کشائی شدہ ماحصل پر جانچا جائے، اور منتقلی کے فقدان کو تولید میں بہتری کی دلیل کے بجائے ایک مفید منفی نتیجہ سمجھا جائے۔

## قریبی طریقوں سے تقابل

## 

| طریقۂ کار | نمائندگی | کنٹرول / تشخیص | کیا محفوظ رکھا یا ناپا جاتا ہے |
| --- | --- | --- | --- |
| Token-space پھیلاؤ | متنی ٹوکن | فضائے ٹوکن میں تولید کا معیار | براہِ راست تولید کی روانی اور اسکورر کا رویہ |
| مضغوط نہاں تولید | کوڈیک کے ذریعے منفصل خفی رموز | حتمی سرے سے سرے تک تولیدی معیار | کوڈیک اور مولّدِ نہاں کا مشترکہ طرزِ عمل |
| مرحلہ وار bottleneck تعیینِ مقام | متن، کوڈیک بازتعمیرات اور منفصل مخفی متغیرات | کوڈیک خسارے کو تولیدی خسارے سے الگ کریں | ایک مشترک ممیز کے تحت معیار کہاں گرتا ہے |

موازنہ جائزے کے دائرے اور شواہد میں فرق کرتا ہے؛ یہ طریقوں کی آفاقی درجہ بندی نہیں۔

## تعلق اور دائرۂ کار

## 

مرحلہ وار دستور اس وقت مفید ہے جب تولیدی سلسلۂ کار میں سیکھا ہوا کوڈیک اور فضائے نہاں کا مولد دونوں ہوں، مگر حاصل کے معیار میں تنزل کا منبع واضح نہ ہو۔

1. مضغوط اور متفرد متغیراتِ نہاں پر مبنی متن کی تولید
2. تولیدی سلسلہ ہائے عمل میں کوڈیک بازتعمیر کی وفاداری
3. کوڈ کی فضا میں نقاب زدہ پھیلاؤ پر مبنی لسانی ماڈل سازی
4. مقامِ رکاوٹ کی تعیین اور مرحلہ جاتی مطابقت رکھنے والی جانچ
5. رمزکشائی شدہ متن کے مقابل فضائے نہاں کے قائم مقام پیمانوں میں بہتری کا محاسبہ

## حدود

## 

- تجرباتی مطالعہ صرف TinyStories تک محدود ہے۔
- مرکزی تجزیہ 64-سے-16 کی ایک شدید ضغاطتی ترتیب تک محدود ہے۔
- زیرِ جائزہ نظام ایک درجہ بند VQ-VAE-2 codec family کو ایک MDLM generator سے ملاتا ہے۔
- تقابلات ایک ایک اجرا پر مبنی ہیں اور متعدد random seeds سے حاصل کردہ شماریاتی تخمینوں کے بجائے توصیفی نوعیت رکھتے ہیں۔
- بیرونی GPT-2 perplexity ایک مشترک تشخیصی پیمانہ ہے، معنوی معیار کا آفاقی پیمانہ نہیں۔
- نتائج تمام datasets، codec architectures یا compression ratios پر براہِ راست منتقل نہ کیے جائیں۔

## مقالے میں حوالہ دیے گئے مراجع

## 

یہ اندراجات مقالے کی PDF میں عدد وار References حصے سے متناظر ہیں۔

1. Subham Sekhar Sahoo, Marianne Arriola, Yair Schiff, Aaron Gokaslan, Edgar Marroquin, Justin T Chiu, Alexander Rush, Volodymyr Kuleshov. 2024 . [Simple and Effective Masked Diffusion Language Models](https://arxiv.org/abs/2406.07524) . Advances in Neural Information Processing Systems .
2. Aaron van den Oord, Oriol Vinyals, Koray Kavukcuoglu. 2017 . [Neural Discrete Representation Learning](https://arxiv.org/abs/1711.00937) . Advances in Neural Information Processing Systems .
3. Ali Razavi, Aaron van den Oord, Oriol Vinyals. 2019 . [Generating Diverse High-Fidelity Images with VQ-VAE-2](https://arxiv.org/abs/1906.00446) . Advances in Neural Information Processing Systems .
4. Jacob Austin, Daniel D. Johnson, Jonathan Ho, Daniel Tarlow, Rianne van den Berg. 2021 . [Structured Denoising Diffusion Models in Discrete State-Spaces](https://arxiv.org/abs/2107.03006) . Advances in Neural Information Processing Systems .
5. Aaron Lou, Chenlin Meng, Stefano Ermon. 2024 . [Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution](https://arxiv.org/abs/2310.16834) . Proceedings of the 41st International Conference on Machine Learning .
6. Xiaochuang Han, Sachin Kumar, Yulia Tsvetkov. 2023 . [SSD-LM: Semi-autoregressive Simplex-based Diffusion Language Model for Text Generation and Modular Control](https://doi.org/10.18653/v1/2023.acl-long.647) . Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics .
7. Xiang Lisa Li, John Thickstun, Ishaan Gulrajani, Percy Liang, Tatsunori B. Hashimoto. 2022 . [Diffusion-LM Improves Controllable Text Generation](https://arxiv.org/abs/2205.14217) . Advances in Neural Information Processing Systems .
8. Huiwen Chang, Han Zhang, Lu Jiang, Ce Liu, William T. Freeman. 2022 . [MaskGIT: Masked Generative Image Transformer](https://openaccess.thecvf.com/content/CVPR2022/html/Chang_MaskGIT_Masked_Generative_Image_Transformer_CVPR_2022_paper.html) . Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition .
9. Marjan Ghazvininejad, Omer Levy, Yinhan Liu, Luke Zettlemoyer. 2019 . [Mask-Predict: Parallel Decoding of Conditional Masked Language Models](https://doi.org/10.18653/v1/D19-1633) . Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing .
10. Emiel Hoogeboom, Didrik Nielsen, Priyank Jaini, Patrick Forré, Max Welling. 2021 . [Argmax Flows and Multinomial Diffusion: Learning Categorical Distributions](https://arxiv.org/abs/2102.05379) . Advances in Neural Information Processing Systems .
11. Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever. 2019 . [Language Models are Unsupervised Multitask Learners](https://cdn.openai.com/better-language-models/language-models.pdf) . OpenAI Technical Report .
12. Nils Reimers, Iryna Gurevych. 2019 . [Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks](https://doi.org/10.18653/v1/D19-1410) . Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing .
13. Tianyi Zhang, Varsha Kishore, Felix Wu, Kilian Q. Weinberger, Yoav Artzi. 2020 . [BERTScore: Evaluating Text Generation with BERT](https://arxiv.org/abs/1904.09675) . International Conference on Learning Representations .
14. Krishna Pillutla, Swabha Swayamdipta, Rowan Zellers, John Thickstun, Sean Welleck, Yejin Choi, Zaid Harchaoui. 2021 . [MAUVE: Measuring the Gap Between Neural Text and Human Text using Divergence Frontiers](https://arxiv.org/abs/2102.01454) . Advances in Neural Information Processing Systems .
15. Lianmin Zheng, Wei-Lin Chiang, Ying Sheng, Siyuan Zhuang, Zhanghao Wu, Yonghao Zhuang, Zi Lin, Zhuohan Li, Dacheng Li, Eric P. Xing, Hao Zhang, Joseph E. Gonzalez, Ion Stoica. 2023 . [Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena](https://arxiv.org/abs/2306.05685) . Advances in Neural Information Processing Systems, Datasets and Benchmarks Track .

## وسائل اور قابلِ تکرار تحقیق

## 

### کوائف کا بیان

## نسخے

## 

1. **شائع شدہ نسخہ** [IEEE / FRUCT, 2026](https://doi.org/10.23919/FRUCT70069.2026.11506553)
2. **arXiv record** [قبل از اشاعت ریکارڈ کھولیں، arXiv:2607.24176](https://arxiv.org/abs/2607.24176)
3. **AI تحقیقی اشاریہ** [Hugging Face مقالہ صفحہ، جس پر پہلے مصنف کی تصدیق شدہ شناخت اور نتائج کا مربوط خلاصہ موجود ہے](https://huggingface.co/papers/2607.24176)
4. **مصنف کا manuscript** [متن تک قابلِ رسائی مقامی PDF](https://aogavrilov.com/publications/where-quality-breaks/paper.pdf)
5. **کانفرنس خطاب** [FRUCT 39 پیش کش](https://www.youtube.com/watch?v=JExX7cxa63s)
6. **مجموعۂ مقالاتِ کانفرنس کا اشاریہ** [FRUCT 39 کی سرکاری جلد](https://fruct.org/publications/volume-39/fruct39)
7. **مجموعۂ مقالاتِ کانفرنس PDF** [FRUCT کا آزاد مکمل متن](https://www.fruct.org/files/publications/volume-39/fruct39/Gav.pdf)
8. **علمی ریکارڈ کھولیں** [OpenAlex](https://openalex.org/W7160914887)
9. **حوالہ جاتی گراف کا ریکارڈ** [Semantic Scholar](https://www.semanticscholar.org/paper/11b5a0e8f75f0dfd141659e9a82ac58982a65ce1)
10. **مصنف کا فراہم کردہ مکمل متن** [ResearchGate](https://www.researchgate.net/publication/404794122_Where_Quality_Breaks_in_Compressed_Short-Text_Generation_Staged_Bottleneck_Localization)

شائع شدہ DOI بنیادی کتابیاتی شناختی ہے۔ یہ صفحہ تمام versions میں واحد canonical project URL ہے۔

## متعلقہ اشاعت

- [Inspectable Control for Structure-Preserving Software Regeneration](https://aogavrilov.com/ur/publications/inspectable-control/)

یہ پڑھیں: [کوڈیک تنگنائے کی تشخیص](https://aogavrilov.com/ur/projects/codec-bottleneck-diagnosis/) تحقیقی رہنما۔ [مصنف کا تعارف](https://aogavrilov.com/about/) .

### مرکوز تحقیقی نوٹس

شواہد کی حدود اور اس مقالے کی جانب واپسی کے روابط کے ساتھ، مقصد سے مخصوص جوابات۔

- [فضائے کوڈ اور فضائے ٹوکن میں ماسک شدہ diffusion: تقابل کیسے کیا جائے](https://aogavrilov.com/ur/research-notes/code-space-vs-token-space-masked-diffusion/)
