{"as_of":"2026-08-23T14:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2c354bf29926398babd6e552c756944237a8b7ce6ba4ff290d6397a82926834","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T19:22:41.760051Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:58:17.682502Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:59:58.186578Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00359","snapshot_observed_at":"2026-08-05T10:19:54.512634Z","title":"Exploring representation-aligned latent space for better generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04394","last_updated":"2025-09-04T17:05:59Z","snapshot_observed_at":"2026-08-16T13:24:04.947329Z","submitted_at":"2025-09-04T17:05:59Z","title":"Transition Models: Rethinking the Generative Learning Objective","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T10:19:54.512634Z"},"links":{"cited_paper":"/paper/2502.00359","citing_paper":"/paper/2509.04394"},"observation_digest":"sha256:f322b18e35b553b0d8965367eaf37ccd0b8fbfde03b4e215385b69527a5f620c","observation_id":"0dd6dc30-0fe0-444c-b6ca-3130e387073a","resolution":{"observed_at":"2026-08-05T10:19:54.512634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00359","snapshot_observed_at":"2026-08-05T05:27:34.339306Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05441","last_updated":"2026-08-20T09:18:56Z","snapshot_observed_at":"2026-08-23T14:09:04.265801Z","submitted_at":"2025-09-05T18:49:08Z","title":"Decoupling High and Low Frequencies for Faithful Image Generation with Fine Details","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T05:27:34.339306Z"},"links":{"cited_paper":"/paper/2502.00359","citing_paper":"/paper/2509.05441"},"observation_digest":"sha256:072f8792c3f8350eb9eb56b81a34f72c41a2daf67c20c9c11dae7ab6ec057fdd","observation_id":"17175a59-0d92-4d26-b05f-4bb7254613a3","resolution":{"observed_at":"2026-08-05T05:27:34.339306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00359","snapshot_observed_at":"2026-08-15T15:58:17.682502Z","title":"Exploring representation-aligned latent space for better generation.arXiv preprint arXiv:2502.00359, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10441","last_updated":"2025-09-12T17:48:57Z","snapshot_observed_at":"2026-08-17T01:17:35.796363Z","submitted_at":"2025-09-12T17:48:57Z","title":"InfGen: A Resolution-Agnostic Paradigm for Scalable Image Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:58:17.682502Z"},"links":{"cited_paper":"/paper/2502.00359","citing_paper":"/paper/2509.10441"},"observation_digest":"sha256:8cb44ad246d5a92c21c53025abaf180de3b7ede5aefdf8bcd36c0fef5d09a826","observation_id":"ea181610-5f1c-45d1-8912-b40ee9430c2c","resolution":{"observed_at":"2026-08-15T15:58:17.682502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00359","snapshot_observed_at":"2026-08-03T21:07:15.084222Z","title":"Exploring representation-aligned latent space for better generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16870","last_updated":"2026-05-25T20:19:17Z","snapshot_observed_at":"2026-08-13T12:48:27.495447Z","submitted_at":"2025-11-21T00:37:04Z","title":"Align & Invert: Solving Inverse Problems with Diffusion and Flow-based Models via Representation Alignment","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T21:07:15.084222Z"},"links":{"cited_paper":"/paper/2502.00359","citing_paper":"/paper/2511.16870"},"observation_digest":"sha256:1a071a736dc92e44edac5aa16ad5ecc1a69486d2a9358d8828189ab98ae11899","observation_id":"59914ac4-4221-446a-a6eb-ef12ec9abfc4","resolution":{"observed_at":"2026-08-03T21:07:15.084222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"cited_work":{"arxiv_id":"2502.00359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00359","snapshot_observed_at":"2026-07-04T16:59:58.186578Z","title":"Exploring representation-aligned latent space for better generation","venue":null,"work_id":"bdc748da-b5ad-4790-9833-df84b0b82230","year":2025},"citing_paper":{"arxiv_id":"2605.18324","last_updated":"2026-05-18T12:42:34Z","snapshot_observed_at":"2026-08-20T04:08:02.089607Z","submitted_at":"2026-05-18T12:42:34Z","title":"Improved Baselines with Representation Autoencoders","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-20T11:40:14.358108Z"},"links":{"cited_paper":"/paper/2502.00359","citing_paper":"/paper/2605.18324"},"observation_digest":"sha256:1d9904f66588c0d9b4570d58a4abe1ece203f3fc821837c0639db8732ea2fe4b","observation_id":"57b58dde-6d0b-4931-9320-869291269e00","resolution":{"observed_at":"2026-05-20T11:43:15.310707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"cited_work":{"arxiv_id":"2502.00359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00359","snapshot_observed_at":"2026-07-04T16:59:58.186578Z","title":"Exploring representation-aligned latent space for better generation","venue":null,"work_id":"bdc748da-b5ad-4790-9833-df84b0b82230","year":2025},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-08-08T16:38:03.178919Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2502.00359","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:88c4ecdae08c389d816bfdbe12f5cae6d41f792a245ea29ea27a7a71a5fc3fd0","observation_id":"14e7363e-f3cc-48bd-a964-02cf52b1e026","resolution":{"observed_at":"2026-07-04T16:59:58.188120Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00359/citation-record","integrity":"/paper/2502.00359/integrity","json":"/paper/2502.00359/citation-record.json","paper":"/paper/2502.00359"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:22:41.650688Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.650688Z"},"links":{"citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:fc9e31c64c5359312330a6fe383ec15eb63ba7cf3ee6ff20d5e5fe331693ce21","observation_id":"63cbf281-9170-40aa-bf99-e3ccdc974c76","resolution":{"observed_at":"2026-08-09T19:22:41.650688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-09T19:22:41.662040Z","title":"Ltx-video: Realtime video latent diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.662040Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:16349f5c31c2e5dcba28c1efda3c7945aa1b1ae07aaaeb568abff8a9ecb74196","observation_id":"12504990-287a-457e-9c7b-49da76e247e1","resolution":{"observed_at":"2026-08-09T19:22:41.662040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11972","last_updated":"2023-06-14T03:32:57Z","snapshot_observed_at":"2026-08-16T16:06:32.038168Z","submitted_at":"2022-12-22T18:55:45Z","title":"Scalable Adaptive Computation for Iterative Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11972","snapshot_observed_at":"2026-08-09T19:22:41.672852Z","title":"Scalable adaptive computation for iterative generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.672852Z"},"links":{"cited_paper":"/paper/2212.11972","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:12492ac274c4e69a0c805c0d0589995d9b3cb632b0d67b7a4835292f48747333","observation_id":"93346924-916f-44d6-abdc-67dd1712b7ec","resolution":{"observed_at":"2026-08-09T19:22:41.672852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:22:42.142863Z","title":"Calculate the value by sampling 10,000 samples from the ImageNet 256 × 256, encoded by V AE aligned with DINOv2-base","venue":null,"work_id":"fe7ae593-50b0-42df-9323-ac4da9068e8c","year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.760051Z"},"links":{"citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:1f848554e51d201e4ae8c459825c88597669eb22168035bd99d4b8a12474806b","observation_id":"674b5536-579b-4ed4-91fd-a7a17b211f10","resolution":{"observed_at":"2026-08-09T19:22:42.149858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-08-16T13:42:07.461220Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-09T19:22:41.685911Z","title":"Autoregres- sive image generation without vector quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.685911Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:be9917be98019070be2e7c7523a170b5281f813fd34a2c1b59585c65fa4a2a5d","observation_id":"8bfeee68-77e3-478d-bb90-dc568424a771","resolution":{"observed_at":"2026-08-09T19:22:41.685911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08740","last_updated":"2024-09-23T15:59:41Z","snapshot_observed_at":"2026-08-18T20:56:40.841401Z","submitted_at":"2024-01-16T18:55:25Z","title":"SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08740","snapshot_observed_at":"2026-08-09T19:22:41.690401Z","title":"S., Boffi, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.690401Z"},"links":{"cited_paper":"/paper/2401.08740","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:fc0dce046764d06d60bd31d5a608bcbab435249ec7ac5805daf842156439ba23","observation_id":"a0957f55-e720-4c4d-8c9e-0928a8d7310c","resolution":{"observed_at":"2026-08-09T19:22:41.690401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-09T19:22:41.696022Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.696022Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:ecc978e84403f8e9537e8c569bfc942e30bdb222f269e7c0c072cc9230b9b6e1","observation_id":"f5d1bc16-f266-4f5f-951b-2d02b1d10de9","resolution":{"observed_at":"2026-08-09T19:22:41.696022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-09T19:22:41.701679Z","title":"Sdxl: Im- proving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.701679Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:95c99335c0265bb40494be02ae65937006c69a215a61faf0db34d88f531572de","observation_id":"0e9e8d0e-0033-4cea-922d-42ae26b01b28","resolution":{"observed_at":"2026-08-09T19:22:41.701679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14477","last_updated":"2025-01-21T17:15:10Z","snapshot_observed_at":"2026-08-18T01:37:56.948673Z","submitted_at":"2024-05-23T12:06:00Z","title":"LiteVAE: Lightweight and Efficient Variational Autoencoders for Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14477","snapshot_observed_at":"2026-08-09T19:22:41.712378Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.712378Z"},"links":{"cited_paper":"/paper/2405.14477","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:56b9bf8746c64a5a2415eea7d92c3d9e4a00ad0ee41f062257c547b6b2819dc7","observation_id":"71d1aeb2-f071-4903-ab3b-9d00165b04e8","resolution":{"observed_at":"2026-08-09T19:22:41.712378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-09T19:22:41.717956Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.717956Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:8c636f361cf58c195b0a8a31a559a12df51a5c649d6e97bd0598712734fc4f2a","observation_id":"52dda38f-990b-4a26-97da-d0070d79705c","resolution":{"observed_at":"2026-08-09T19:22:41.717956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02905","last_updated":"2024-06-10T17:59:07Z","snapshot_observed_at":"2026-08-16T14:03:52.109479Z","submitted_at":"2024-04-03T17:59:53Z","title":"Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02905","snapshot_observed_at":"2026-08-09T19:22:41.723340Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.723340Z"},"links":{"cited_paper":"/paper/2404.02905","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:69035eedf4e38c44ba6e43aa85d1ab2493e1777c91e22e4dfc6e1743ec7c71da","observation_id":"c67b4aee-f6e5-4bd8-b5a9-42e83c91cf93","resolution":{"observed_at":"2026-08-09T19:22:41.723340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19115","last_updated":"2025-04-15T06:33:45Z","snapshot_observed_at":"2026-08-16T13:06:08.804118Z","submitted_at":"2024-10-24T19:29:02Z","title":"MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19115","snapshot_observed_at":"2026-08-09T19:22:41.729335Z","title":"Moge: Unlocking accurate monocular geometry estimation for open-domain images with optimal training supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.729335Z"},"links":{"cited_paper":"/paper/2410.19115","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:c3d3059a1b73d6dced224a933fb369fc00d878a3c8844e0a7b0639debd1433d8","observation_id":"439dde91-1c3f-44a8-b470-9bf9dcc2a380","resolution":{"observed_at":"2026-08-09T19:22:41.729335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-09T19:22:41.734531Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y ., Birodkar, V ., Gupta, A., Gu, X., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.734531Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:54a139b1915e6ee5c5aa99026370b4c42c10936917640f410b6c81ca3cc160f5","observation_id":"31528f0d-28b1-4a7f-84f0-173a35c0179a","resolution":{"observed_at":"2026-08-09T19:22:41.734531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-09T19:22:41.740025Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.740025Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:1fde9220eaff16160424de7a2e2d9295636f14b142057dcf2cb19af6ab6d2aa2","observation_id":"03242a35-2836-41b3-9c80-66e4d92f781d","resolution":{"observed_at":"2026-08-09T19:22:41.740025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08531","last_updated":"2024-10-11T05:03:56Z","snapshot_observed_at":"2026-08-16T13:10:28.370164Z","submitted_at":"2024-10-11T05:03:56Z","title":"Diffusion Models Need Visual Priors for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08531","snapshot_observed_at":"2026-08-09T19:22:41.744781Z","title":"Diffusion models need visual priors 10 Exploring Representation-Aligned Latent Space for Better Generation for image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.744781Z"},"links":{"cited_paper":"/paper/2410.08531","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:d54b0ca5ab22956f20a99eb2803733ec3fbc74f1148a62eb4c8297b793bc2959","observation_id":"0d0e2bee-3335-45e8-9081-02557826392b","resolution":{"observed_at":"2026-08-09T19:22:41.744781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06347","last_updated":"2023-10-10T06:32:24Z","snapshot_observed_at":"2026-08-16T14:53:34.650219Z","submitted_at":"2023-10-10T06:32:24Z","title":"JointNet: Extending Text-to-Image Diffusion for Dense Distribution Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06347","snapshot_observed_at":"2026-08-09T19:22:41.749891Z","title":"Jointnet: Extending text-to-image diffusion for dense distribution modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.749891Z"},"links":{"cited_paper":"/paper/2310.06347","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:b73a7303ee1dcd2fd262f56c9a57c752c69dc760f706df83889915a01e3cb97d","observation_id":"16d2aec5-6f51-4f94-80f1-1848dff47a24","resolution":{"observed_at":"2026-08-09T19:22:41.749891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-16T15:23:34.823593Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-09T19:22:41.755072Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.755072Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:52235f728eb31d2e56e62895a722e823de9a95d81dac2b2be52d4c28378fef98","observation_id":"eea0c7b9-9832-46ec-9bed-6bf4cc9eda5d","resolution":{"observed_at":"2026-08-09T19:22:41.755072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07724","last_updated":"2024-11-06T14:29:36Z","snapshot_observed_at":"2026-08-18T22:18:58.459639Z","submitted_at":"2024-04-11T13:16:47Z","title":"Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07724","snapshot_observed_at":"2026-08-09T19:22:41.681542Z","title":"Applying guidance in a limited interval improves sample and distribution quality in diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.681542Z"},"links":{"cited_paper":"/paper/2404.07724","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:35dcfeeb415d233e092bd3dfcf874bd11475dbac5030da41de93799205f79839","observation_id":"f72f7fe7-501b-424b-99c2-7919a3b51070","resolution":{"observed_at":"2026-08-09T19:22:41.681542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-08-17T13:08:14.312126Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-09T19:22:41.667667Z","title":"J., Norouzi, M., and Salimans, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.667667Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:d9bfd08dfcb72cac527d2646888fc67a343992d0b8cc70a71395627627b659cb","observation_id":"aec24685-9e55-41d0-ab9a-c43d6a855762","resolution":{"observed_at":"2026-08-09T19:22:41.667667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-16T14:57:07.361681Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-08-09T19:22:41.644873Z","title":"Emu: Enhancing image generation models us- ing photogenic needles in a haystack","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.644873Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:03e6ce10dc64a2faad3068a824daa228141478d92cb2bc6c93a079847aa1363a","observation_id":"0120051d-4919-4507-9805-ac357a9835a3","resolution":{"observed_at":"2026-08-09T19:22:41.644873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08034","last_updated":"2024-11-17T03:45:07Z","snapshot_observed_at":"2026-08-22T15:11:31.315605Z","submitted_at":"2024-11-12T18:59:35Z","title":"Scaling Properties of Diffusion Models for Perceptual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08034","snapshot_observed_at":"2026-08-09T19:22:41.707119Z","title":"Scaling properties of diffusion models for perceptual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.707119Z"},"links":{"cited_paper":"/paper/2411.08034","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:0d31c3c05d595dc0d647c1179dfc6da04f6141b752542dcaeecd953620850072","observation_id":"4bcd7db4-3eca-4331-9add-4844bfe52a34","resolution":{"observed_at":"2026-08-09T19:22:41.707119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05908","last_updated":"2021-01-03T16:56:46Z","snapshot_observed_at":"2026-08-18T07:14:08.407712Z","submitted_at":"2016-06-19T21:02:30Z","title":"Tutorial on Variational Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05908","snapshot_observed_at":"2026-08-09T19:22:41.656173Z","title":"Tutorial on variational autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.656173Z"},"links":{"cited_paper":"/paper/1606.05908","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:c85eda7863ded168de1259085068e3e63b44d49f59cf799f4645fa78b530a1a0","observation_id":"33e15fe3-6a11-4d0d-bf30-f4ea7eee12a4","resolution":{"observed_at":"2026-08-09T19:22:41.656173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-08-18T11:02:33.658704Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-08-09T19:22:41.638981Z","title":"Deep compression autoen- coder for efficient high-resolution diffusion models.arXiv preprint arXiv:2410.10733,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.638981Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:3b06bb0df7825da8c3e32e105aaedcf19351f1192f81199e2ba303a0ab826eaf","observation_id":"6365c104-0626-4fcb-9981-b5cb951e9c31","resolution":{"observed_at":"2026-08-09T19:22:41.638981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-09T19:22:41.632902Z","title":"Large scale gan training for high fidelity natural image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.632902Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:d5c1f064926cca4928660425dd1defbc46a1dbda135d4f9ee28f1e8392dd83ab","observation_id":"27fa7a92-5543-44eb-b20c-d7e44b0de7cc","resolution":{"observed_at":"2026-08-09T19:22:41.632902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-09T19:22:41.677178Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.677178Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:05aa51accdb7aae0e894cb370e39af909fc80b5b70f4ad041e980ebba3b63784","observation_id":"38f0bdc0-8870-41ab-a8b4-96e014cfc2c4","resolution":{"observed_at":"2026-08-09T19:22:41.677178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T13:58:33.079680Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 6 inbound Pith citation observations for arXiv:2502.00359."}