{"as_of":"2026-08-13T20:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc8dcc2e25560d5863d547cf94f87d29234635081976a92b6cd4dd445c3462ba","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:20:33.559040Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:44:24.318786Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.03578","last_updated":"2026-06-02T12:47:14Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T12:47:14Z","title":"Diffusing in the Right Space: A Systematic Study of Latent Diffusability","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-28T10:44:24.318786Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.03578"},"observation_digest":"sha256:4067fc678bf9bfbe9d56ea5685627333a03cb7ab073e786f997b0b4ac07b055b","observation_id":"47b10b4d-d5be-4f53-92fc-d1d8cd914d70","resolution":{"observed_at":"2026-07-02T02:36:27.606412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.05552","last_updated":"2026-06-04T01:06:52Z","snapshot_observed_at":"2026-07-06T23:45:33.157370Z","submitted_at":"2026-06-04T01:06:52Z","title":"Balancing Image Compression and Generation with Bootstrapped Tokenization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T03:07:33.054518Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.05552"},"observation_digest":"sha256:3fcc65bc769def63551546878c43ca55d89b94e7c949f8f6715a9fe225b26e85","observation_id":"2c151745-7ad7-4c49-998e-0b0fa5c660bc","resolution":{"observed_at":"2026-07-02T11:46:55.447804Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.08810","last_updated":"2026-06-15T19:27:43Z","snapshot_observed_at":"2026-08-13T14:06:40.885483Z","submitted_at":"2026-06-07T20:00:33Z","title":"Continuous Language Diffusion as a Decoder-Interface Problem","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T18:27:10.422343Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.08810"},"observation_digest":"sha256:ff4b4e87cca24ce7ad57aa537989b66df6fa350ffd36cca3e67446f144e35e21","observation_id":"abe6c91c-83f8-417f-bce3-b56488f3a6d8","resolution":{"observed_at":"2026-06-27T18:31:07.705436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.17590","last_updated":"2026-06-16T06:52:52Z","snapshot_observed_at":"2026-08-13T12:30:51.704665Z","submitted_at":"2026-06-16T06:52:52Z","title":"TivTok: Broadcasting Time-Invariant Tokens for Scalable Video Tokenization","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-06-27T01:20:32.508409Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.17590"},"observation_digest":"sha256:572ac9aba0d183abd3733586ef84280a5323cffee6731cc8c3ef185bd6261b80","observation_id":"df3d494b-7bc8-46ce-a6f7-bac05d6eaea1","resolution":{"observed_at":"2026-07-03T20:28:55.554344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08257/citation-record","integrity":"/paper/2506.08257/integrity","json":"/paper/2506.08257/citation-record.json","paper":"/paper/2506.08257"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:30.399891Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.399891Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:60aa2fe8bc31021131a90a99cebc88f83d17f182d6a1535eff7aa1e704582596","observation_id":"16ef8461-5182-4194-a6da-b794a777eaa2","resolution":{"observed_at":"2026-08-07T05:20:30.399891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.346990Z","title":"Why are conditional generative models better than unconditional ones? In NeurIPS 2022 Workshop on Score-Based Methods, 2022","venue":null,"work_id":"836ee28f-6798-411f-806f-e4da43240f2d","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.451006Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:a120b08aab92b284f7c08e4ed5f2649fc091a3907bfd14cac6a93c651105ed85","observation_id":"a2841993-cece-482b-94bb-4dc7bb384bb6","resolution":{"observed_at":"2026-08-07T05:20:38.351781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.330336Z","title":"Retrieval-augmented diffusion models","venue":null,"work_id":"30f5316c-84c8-4951-9d54-971455919eda","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.515158Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:186e1abd552fdc0eb1aa3fb3a2c03c5b0e9b400104a9f597377c510fece926f9","observation_id":"a944599e-2bf5-45d4-9fca-16a1c40ae1e3","resolution":{"observed_at":"2026-08-07T05:20:38.336162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.314125Z","title":"High fidelity visualization of what your self-supervised representation knows about","venue":null,"work_id":"2811a13d-2ff7-42e8-af8d-dcf0b96883dd","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.581145Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:fd6f122500b2b3ced3c86eea2c7b9d83352c53bf93c40c1d0da38565d1f9dcc0","observation_id":"eda6c2c0-d3c4-4491-8eb5-479228ce9b1e","resolution":{"observed_at":"2026-08-07T05:20:38.318753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.298497Z","title":"Efficient-VQGAN : Towards high-resolution image generation with efficient vision transformers","venue":null,"work_id":"5651b8e1-b0bf-476e-a987-0948424a3492","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.668965Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:4b145c8bc72b7f6cd4cf660a024aa44f992cf0f6f14604c8fb8104f0f058c89e","observation_id":"27dc9c4b-6dbe-41f6-8039-cf34e9895efc","resolution":{"observed_at":"2026-08-07T05:20:38.303443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.282870Z","title":"Instance-conditioned GAN","venue":null,"work_id":"fbd920ce-604d-4074-9359-4511acaa32b6","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.734511Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:0db4bed4b6a45c3094d9bfbfaa1f9ab3bc78ae4b556a9f411efe75f1f06abd55","observation_id":"62e717e5-4fb7-4f19-a948-a86c5ff0814d","resolution":{"observed_at":"2026-08-07T05:20:38.287286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.268062Z","title":null,"venue":null,"work_id":"51fc87cf-cb2c-49a0-b6f0-1ab48fedf70d","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.801178Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:a7f853058c79b4c40d9190774640fb1b2157c05a52646edd7dd50b90ca5e7f67","observation_id":"7051860a-9774-4dc8-8090-5f610e8d39b1","resolution":{"observed_at":"2026-08-07T05:20:38.272768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08583","last_updated":"2022-09-04T04:57:40Z","snapshot_observed_at":"2026-08-13T20:23:57.529615Z","submitted_at":"2022-04-18T22:57:29Z","title":"VQGAN-CLIP: Open Domain Image Generation and Editing with Natural Language Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08583","snapshot_observed_at":"2026-08-07T05:20:30.863466Z","title":"VQGAN-CLIP : Open domain image generation and editing with natural language guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.863466Z"},"links":{"cited_paper":"/paper/2204.08583","citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:639bc56a87367a9c34b181b49e6bd7e7e154ec3804e706341a5f2a25a95b9510","observation_id":"b0f08a11-acee-419d-a058-bf175aa68da0","resolution":{"observed_at":"2026-08-07T05:20:30.863466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.251707Z","title":"ImageNet : A large-scale hierarchical image database","venue":null,"work_id":"a8d26e35-016e-42dc-8f61-3fcb1d521ed5","year":2009},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.932178Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:650cc4d261083ac68452a18a7c6e1e8496e47e8e830b10d93edf5589196b3965","observation_id":"53434fb0-2c25-4d62-8e0e-799327489cf5","resolution":{"observed_at":"2026-08-07T05:20:38.256220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.000262Z","title":"and Nichol, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.000262Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:15ec99e893c04129902d11ba6c0f498754c6724bba2b629425495c36495f2ef2","observation_id":"66a1f18d-4358-43a5-8f0a-c69a0815d1ab","resolution":{"observed_at":"2026-08-07T05:20:31.000262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.226093Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"66a2e869-4441-401d-a10b-07e41a60ad9f","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.053282Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:aa36d105b3c794a009feaa17ce9ca22a0ca6cd03572aa0c475a1df3505468540","observation_id":"32b8c263-82ef-49e9-9559-8bca00f5122e","resolution":{"observed_at":"2026-08-07T05:20:38.230564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.210289Z","title":"H., Chechik, G., and Cohen-Or, D","venue":null,"work_id":"dfdf34a0-cf5d-4962-b080-37f5d0fa6908","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.102482Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:afc824e3cc9901e2ce07ab15b24685e04d2b15728e6fe8696df745bdd6abdd20","observation_id":"3e4b0dd7-a5c2-4cf0-803f-195574672eb4","resolution":{"observed_at":"2026-08-07T05:20:38.214950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.193895Z","title":"Generating images from caption and vice versa via CLIP -guided generative latent space search","venue":null,"work_id":"593575cd-ed74-4fd8-b247-ba71456706b1","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.194104Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:3ff10da01ed90e9f4eaac4a460107514e1c756a5254fcfd82ed85fcc83d557f6","observation_id":"d5a1c10b-e5cc-46f7-a869-7a357c68bb8c","resolution":{"observed_at":"2026-08-07T05:20:38.199309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.177027Z","title":"GANs trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"e6f129b7-e20b-42c3-a617-bb0863fbdfc5","year":2017},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.246934Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:a89fdf4a45164042c76d34892aee8986c0e277ea10fa6802a1b22ca7384e6e5d","observation_id":"54dc9eab-4240-4cc5-b363-a19128154dd4","resolution":{"observed_at":"2026-08-07T05:20:38.182456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.307672Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.307672Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:d09956a31027215fe7a79ea0e4bbeec4824c09607743482f7cd650251b790f19","observation_id":"580eb988-de0a-4f59-a6d3-548eab69fe4d","resolution":{"observed_at":"2026-08-07T05:20:31.307672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.065868Z","title":"Return of unconditional generation: A self-supervised representation generation method","venue":null,"work_id":"db557164-566f-4e7f-a1a0-02cefe5635e8","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.351182Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:6be3a377e2f8c08bc49660cc5132bb5f600a5e4edfe623889a2f87c7dfda698f","observation_id":"b7e625df-e501-4687-86fe-f6947afdbf39","resolution":{"observed_at":"2026-08-07T05:20:38.156129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.406422Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.406422Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:3d0643ec128b68b562b1a72859e362b4ae0dbe9b4ffc59e1dc5df1e6f730cf6c","observation_id":"eb8eee19-4730-45c5-8ba8-53f15d612ae1","resolution":{"observed_at":"2026-08-07T05:20:31.406422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:37.854173Z","title":"Challenging common assumptions in the unsupervised learning of disentangled representations","venue":null,"work_id":"3a120991-9613-4756-93ed-e65c069e4c9b","year":2019},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.478100Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:35db33cc6cbe13853def953d3c0fe612ebd14cc182aa96cfbb7dbf30efa82f72","observation_id":"ab85bd8f-845e-44ab-82e2-f586c2d4fc7c","resolution":{"observed_at":"2026-08-07T05:20:37.920846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:37.538444Z","title":"Finite scalar quantization: Vq-vae made simple","venue":null,"work_id":"762c027f-1b38-47ba-a8f2-082389915c84","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.540181Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:6ae23a28db9e0832c9ac511c7f7f0b26bd21f8bc307addf4f812d457ef66a57c","observation_id":"df791c3a-65c3-4929-8040-aa235491df21","resolution":{"observed_at":"2026-08-07T05:20:37.691027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:37.277226Z","title":"Styleclip: Text-driven manipulation of stylegan imagery","venue":null,"work_id":"902224ae-393f-4d01-83ea-f92c6b61c6e4","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.611743Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:9812475f3ad4bbf37e6c15cfb2dd28865ed505ac7d6580d6d0c06219bb2efa8f","observation_id":"e7ec8fb5-af7f-41b4-b33b-0bb2d87eeb7f","resolution":{"observed_at":"2026-08-07T05:20:37.360258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.684542Z","title":"and Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.684542Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:70f413e4b9f7e61e0f42235a52e1d8078313de6aadfee6dfddf2e0eac80407b4","observation_id":"78d31d65-f719-47e4-b946-3a852c97270b","resolution":{"observed_at":"2026-08-07T05:20:31.684542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.790839Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.790839Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:dc0620d5a3a14121670ef4dd175d898989069f24cca21616652bbc17ce0e6e3e","observation_id":"c2722306-e96f-4dee-89c4-1cd24b734266","resolution":{"observed_at":"2026-08-07T05:20:31.790839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.968133Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"2aaebb45-c50a-4086-9858-93ba6947ac31","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.876984Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:89afc42ea03f7b9a2843e0489522a05d5e676fcc12d51da5736c4eb0b29eb68d","observation_id":"5904539a-6718-4864-9e08-5cb53dac7fa9","resolution":{"observed_at":"2026-08-07T05:20:37.124661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.775145Z","title":"DynamicViT : Efficient vision transformers with dynamic token sparsification","venue":null,"work_id":"0bb37656-9dc5-45e2-a0a1-8920dc33e6a7","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.960363Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:a09e0c0e51150abdf9d7405c1c1f21e17d9ab3273fbbea8d1ff71264e3153765","observation_id":"0dbfa4f7-4d1f-4c4c-a045-00fe808c7fd6","resolution":{"observed_at":"2026-08-07T05:20:36.859164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.577694Z","title":"Generating diverse high-fidelity images with VQ-VAE-2","venue":null,"work_id":"ceb61d81-d40e-4914-b1d2-d0ccb0b72dcf","year":2019},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.031527Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:559f1d3907fe9d126e3632348a442c5fb59d391883eeed09288252caa3b9e817","observation_id":"5960a89f-84ff-4773-860c-de27e5877901","resolution":{"observed_at":"2026-08-07T05:20:36.689899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:32.108976Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.108976Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:6468665c06a8774f7d159093ef006bceb85c15d5b26f6a7e46cb711d6aebb464","observation_id":"8fc58433-f568-4061-82a2-47025a9899e6","resolution":{"observed_at":"2026-08-07T05:20:32.108976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.349813Z","title":"Improved techniques for training GANs","venue":null,"work_id":"0aa4f562-24ed-4032-bfad-a992774f47bc","year":2016},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.174276Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:5cc53fcd10696357e59a8bd3582d4fdfc78f6e22da91934711c72248648fd092","observation_id":"91b4e0a7-42fc-4535-bb8f-14fa3690cf45","resolution":{"observed_at":"2026-08-07T05:20:36.432216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.105974Z","title":"Image synthesis with a single (robust) classifier","venue":null,"work_id":"55813789-87d0-49c8-9751-2cd3c234536e","year":2019},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.260104Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:cc9e91b3b8cb056dbd7003364c655005d5ce3a79d4444e71831d207a71c18133","observation_id":"aee17a2c-1d2e-4484-9c73-6635508ab989","resolution":{"observed_at":"2026-08-07T05:20:36.219471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:35.777292Z","title":"KNN-Diffusion : Image generation via large-scale retrieval","venue":null,"work_id":"1d89736f-a945-48e2-8444-10782c331a44","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.349316Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:7451663ab48f00e2f9e34647a077bf29b5f6524d04f7ac74d0d6616146e333d2","observation_id":"ca19b30b-ef8c-4866-81ca-de882c9d7aec","resolution":{"observed_at":"2026-08-07T05:20:35.892169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-12T17:57:54.262483Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T05:20:32.375413Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.375413Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:7b8555746d71b49a68c747704383e6f149332350a75f3ce535b5b7f293039fe4","observation_id":"8c9dc712-c644-4933-98de-fe40710e92a7","resolution":{"observed_at":"2026-08-07T05:20:32.375413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:35.513094Z","title":"ADDP : Learning general representations for image recognition and generation with alternating denoising diffusion process","venue":null,"work_id":"d866fe64-5041-4369-827a-3f26c661466d","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.457393Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:f1dd964d48fc2e742801a211a77d561b9aaaba0d8c6118c3569d7d27a9f84519","observation_id":"68aaf7aa-668e-422e-b535-5eccf2854af2","resolution":{"observed_at":"2026-08-07T05:20:35.622605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:32.607625Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.607625Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:2ef286b1ad9a8860bd14b958dba609884264258900b43398bf5c3771e7d65db4","observation_id":"4a21e32e-e6b8-459a-a42f-484b364885d9","resolution":{"observed_at":"2026-08-07T05:20:32.607625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:35.251731Z","title":"Visual lexicon: Rich image features in language space","venue":null,"work_id":"0d7f408a-232b-475d-b4bc-938e66e218b8","year":2025},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.712870Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:deafe806d8d1eafabec74ca080ce9b99d37df4dbb12bdf78a5bb30f76f94bfd6","observation_id":"d9743a2c-40f9-4fa4-a29b-86f0ab179a18","resolution":{"observed_at":"2026-08-07T05:20:35.373678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T05:20:32.840889Z","title":"J., Wang, W., Lin, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.840889Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:11df53c4a796d1e5d6c6b9966844acdc0cb6e65a2ecf3d00209c6a1f45059b46","observation_id":"976a7ef7-fa83-4657-bb4d-d884df9f23f7","resolution":{"observed_at":"2026-08-07T05:20:32.840889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.989293Z","title":"Y., Zhang, H., Pang, R., Qin, J., Ku, A., Xu, Y., Baldridge, J., and Wu, Y","venue":null,"work_id":"a16a8189-efbe-416b-b694-6c585fbae8a4","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.927957Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:ee199bd20c82faad8e5ef8486f07ecf638767efedcd416fde4b69cdb410a4181","observation_id":"5d49759b-8e7c-4a91-be9c-294f50428eb3","resolution":{"observed_at":"2026-08-07T05:20:35.092014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.724838Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y., Birodkar, V., Gupta, A., Gu, X., Hauptmann, A","venue":null,"work_id":"e8207d68-baea-4c8e-91e5-51b35ebcd509","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.983924Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:240a95e2f76588d02e6edc3202aa1d2713006c2a062e33de489f1f6742306222","observation_id":"093d3f2c-7256-4cac-a003-9f1b702dfc56","resolution":{"observed_at":"2026-08-07T05:20:34.857050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.433170Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"e1fd527f-663e-4120-9aa0-fc9fa4901dcd","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.089984Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:697f4d93b83f4150ee49c365312aa52d68aeea4e258df0c3e40b76e87b6894ea","observation_id":"840a6b0f-6826-4586-b612-c6faef8f5df4","resolution":{"observed_at":"2026-08-07T05:20:34.587102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.250912Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"6c895427-631c-45d0-979c-2c096fb509e1","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.248030Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:0e3edf40d26d7b016937afed104ae904f57d74a40403e83877b190821bacc47b","observation_id":"bde1ae00-09c5-48bd-977e-419dcb7c348a","resolution":{"observed_at":"2026-08-07T05:20:34.329879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:33.361815Z","title":"A., Shechtman, E., and Wang, O","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.361815Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:f8e8fc525b1ee621e4c7bc3a12e693b9405b9f47a0065fe888cc6f5f03ff5fe6","observation_id":"2cb8bb48-33f3-42d0-87d7-1adfb5265624","resolution":{"observed_at":"2026-08-07T05:20:33.361815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:33.979742Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model","venue":null,"work_id":"d08bfffc-f772-445d-a0aa-694fc04153cb","year":2025},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.438712Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:f6c9e2add17ab9f7b5b6e638aab84df3e36df6d30d8bfe8693ce72033547a54f","observation_id":"dcffc91c-2b2c-4a81-bab5-eaa0bfe7855f","resolution":{"observed_at":"2026-08-07T05:20:34.079846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:33.744730Z","title":"Shifted diffusion for text-to-image generation","venue":null,"work_id":"0bd27b7d-7ac4-4983-b05a-c84a3c22f764","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.559040Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:a34dfc2f063a8cf870aff74b83a8783d947b35faa5c7ddb30fa163a122b83df2","observation_id":"26cf7926-9be0-4252-b2a1-0c3061d7342b","resolution":{"observed_at":"2026-08-07T05:20:33.818240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 4 inbound Pith citation observations for arXiv:2506.08257."}