{"as_of":"2026-08-15T14:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:69117365b3f06cd3648455f64b25232e2973e22dc219e1aec17241e65cc46f4f","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:59:54.011822Z","state":"measured"},{"denominator":124,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":124,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":46,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:33:41.234673Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-11T22:16:26.996599Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2511.13720"},"observation_digest":"sha256:329bda04655d1afafce299744d7b1ad637ee2028a697c58c6fa80f9fbc774ae9","observation_id":"9a4ba403-0c5a-42db-b951-4a9a467159c3","resolution":{"observed_at":"2026-05-11T22:16:27.646986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2511.19365","last_updated":"2026-04-08T04:08:23Z","snapshot_observed_at":"2026-08-11T04:23:34.279866Z","submitted_at":"2025-11-24T17:59:06Z","title":"DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T05:47:24.669763Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2511.19365"},"observation_digest":"sha256:e478a7be78560fbf94f9d7ffe7a71b9a1463641512ee31b18e2c4f98716c9402","observation_id":"2636d442-e3a0-4bb5-9808-0db4b105cab7","resolution":{"observed_at":"2026-05-17T05:49:08.329370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2511.20645","last_updated":"2026-04-16T17:04:25Z","snapshot_observed_at":"2026-08-14T05:00:16.800739Z","submitted_at":"2025-11-25T18:59:25Z","title":"PixelDiT: Pixel Diffusion Transformers for Image Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T04:30:07.417197Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2511.20645"},"observation_digest":"sha256:ca2612cf4fd5896a1e4122c3366d6981a31dbb189a297f1e63d077eb86520b36","observation_id":"b80c3618-e054-4934-b4c3-aa5c92c6f085","resolution":{"observed_at":"2026-05-17T04:31:31.147210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T14:53:02.682342Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.19311","last_updated":"2026-07-12T14:26:35Z","snapshot_observed_at":"2026-08-07T18:54:26.140556Z","submitted_at":"2025-12-22T12:00:12Z","title":"MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T14:53:02.682342Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2512.19311"},"observation_digest":"sha256:775684601b79e7b0661844e76125aa920f52f8916bcb748d0fe5e3e4792fde6d","observation_id":"fd0bc562-bfdb-460a-a208-93b8e7f8c989","resolution":{"observed_at":"2026-08-03T14:53:02.682342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2602.02493","last_updated":"2026-05-07T09:10:25Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T18:59:42Z","title":"PixelGen: Improving Pixel Diffusion with Perceptual Supervision","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T07:54:20.712620Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2602.02493"},"observation_digest":"sha256:264874fe47876b506f9eb515fd3a18a8d90fd5a27bafe986b665cf8f014cd116","observation_id":"698a6b94-3a5a-4420-a54e-83bfca4a18fc","resolution":{"observed_at":"2026-05-16T07:57:33.233070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T01:25:19.705115Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10099","last_updated":"2026-07-03T15:19:24Z","snapshot_observed_at":"2026-08-06T13:27:43.962812Z","submitted_at":"2026-02-10T18:58:04Z","title":"Learning on the Manifold: Unlocking Standard Diffusion Transformers with Representation Encoders","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T01:25:19.705115Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2602.10099"},"observation_digest":"sha256:b100ecd3cd910a6a69dad22717670a26b99768ef994575af88f9a2d09601c706","observation_id":"eda630be-4b6e-4800-ad88-7fa0895801be","resolution":{"observed_at":"2026-08-03T01:25:19.705115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.11521","last_updated":"2026-04-13T14:23:31Z","snapshot_observed_at":"2026-08-11T14:21:05.404965Z","submitted_at":"2026-04-13T14:23:31Z","title":"Continuous Adversarial Flow Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T15:25:53.420119Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.11521"},"observation_digest":"sha256:77fe65dd8da7fe5ea25b008f6f687a17799e5d9a50d0c7fc6dbea05b0da4f10b","observation_id":"bca9935b-5b2c-4163-9645-3ef9e60f9319","resolution":{"observed_at":"2026-05-11T10:31:05.071376Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.12525","last_updated":"2026-04-15T01:25:27Z","snapshot_observed_at":"2026-08-07T07:03:02.391631Z","submitted_at":"2026-04-14T09:56:25Z","title":"CoD-Lite: Real-Time Diffusion-Based Generative Image Compression","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:07:36.152482Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.12525"},"observation_digest":"sha256:129cc894315c2bde30df593cb914cd5bbaae3c9f25349c9916ee20a8fcefe2ce","observation_id":"89976e47-ee42-4646-89c7-2abf47801283","resolution":{"observed_at":"2026-05-11T11:11:04.259104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.16558","last_updated":"2026-04-17T08:39:56Z","snapshot_observed_at":"2026-08-12T14:30:51.387656Z","submitted_at":"2026-04-17T08:39:56Z","title":"Cross-Modal Generation: From Commodity WiFi to High-Fidelity mmWave and RFID Sensing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T08:14:04.769153Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.16558"},"observation_digest":"sha256:2b0ad8f270b79377acb1bfed76ecb74e51bac86a0f8a0b5b8937b25615fa32d7","observation_id":"76dcac84-433e-40da-b914-8ddaaeb8522c","resolution":{"observed_at":"2026-05-10T08:17:37.552218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.17492","last_updated":"2026-04-19T15:29:15Z","snapshot_observed_at":"2026-08-11T06:58:11.510404Z","submitted_at":"2026-04-19T15:29:15Z","title":"Coevolving Representations in Joint Image-Feature Diffusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T06:30:52.371482Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.17492"},"observation_digest":"sha256:9e69af17663d19d407dc3e9110e4f57f069b09d062d8713ad0eb91de032f8199","observation_id":"1aa53b58-6b0e-4bd5-b4e6-b669e71760c3","resolution":{"observed_at":"2026-05-10T06:31:30.449718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.20041","last_updated":"2026-04-21T22:52:26Z","snapshot_observed_at":"2026-08-14T11:41:47.904913Z","submitted_at":"2026-04-21T22:52:26Z","title":"Normalizing Flows with Iterative Denoising","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T02:11:31.246200Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.20041"},"observation_digest":"sha256:9e533f01a4d9dd9dde9a6d05f057a9dbc56572d5c413d9fb92cf38352926acb6","observation_id":"b1b5c675-50cf-4b17-bf49-bb280cc3fe5a","resolution":{"observed_at":"2026-05-11T13:11:19.800237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.21984","last_updated":"2026-04-27T04:48:56Z","snapshot_observed_at":"2026-08-10T22:07:38.647142Z","submitted_at":"2026-04-23T18:07:27Z","title":"Soft Anisotropic Diagrams for Differentiable Image Representation","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-09T21:45:13.698356Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.21984"},"observation_digest":"sha256:db7965959d381620a1ce0160755272e24a775e6b5d3bb5695d615ad1905d91f8","observation_id":"867a8d2c-0f9f-45f8-ae51-3dab21cac7d6","resolution":{"observed_at":"2026-05-09T21:48:36.648657Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.06421","last_updated":"2026-07-28T07:17:48Z","snapshot_observed_at":"2026-08-02T14:48:28.958067Z","submitted_at":"2026-05-07T15:27:46Z","title":"FREPix: Frequency-Heterogeneous Flow Matching for Pixel-Space Image Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T13:24:49.746981Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.06421"},"observation_digest":"sha256:c764e5f40dc3f066d5347315ecb0dc7fadbea2e7090e3d54da1301ab4040faf0","observation_id":"dd36c717-2c3f-43bf-908b-c86de742f2ee","resolution":{"observed_at":"2026-05-11T18:56:06.096986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-02T14:48:31.731548Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.06421","last_updated":"2026-07-28T07:17:48Z","snapshot_observed_at":"2026-08-02T14:48:28.958067Z","submitted_at":"2026-05-07T15:27:46Z","title":"FREPix: Frequency-Heterogeneous Flow Matching for Pixel-Space Image Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T14:48:31.731548Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.06421"},"observation_digest":"sha256:fd0b6e0868fc118a73f681d57aa77896773a8e4e3c3030ce7bd442e887cbf4e4","observation_id":"c4e3a370-0e2c-4bbb-ae91-15a5e3d5e418","resolution":{"observed_at":"2026-08-02T14:48:31.731548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.12013","last_updated":"2026-05-12T12:01:35Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T12:01:35Z","title":"L2P: Unlocking Latent Potential for Pixel Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T07:12:28.181595Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.12013"},"observation_digest":"sha256:0aad58c22fe1f7c5af5a71b990675043af6226c8054134ba96df2315dcae02bd","observation_id":"25814439-ceb4-4680-a6ab-8dcf75f16bbe","resolution":{"observed_at":"2026-05-13T07:17:29.781919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.15741","last_updated":"2026-06-03T01:59:39Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T08:51:55Z","title":"HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T19:08:26.689023Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.15741"},"observation_digest":"sha256:32f9e68b5453b84895d5c21ca71b32115eacbdf396e7335c0c0656118e3f9654","observation_id":"b7d7446c-c897-4846-ba0b-992726044a3b","resolution":{"observed_at":"2026-05-20T19:08:54.005833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.15741","last_updated":"2026-06-03T01:59:39Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T08:51:55Z","title":"HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T19:33:53.876614Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.15741"},"observation_digest":"sha256:d6bb2b41671d26afbedfd1aeb0dce4a2e207a6e7dc480a2620f202ea8bdb9670","observation_id":"8e6fdf2e-b99c-4e03-8693-69897a895eee","resolution":{"observed_at":"2026-06-30T19:35:00.961632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.17759","last_updated":"2026-05-18T02:25:07Z","snapshot_observed_at":"2026-08-15T06:05:37.431425Z","submitted_at":"2026-05-18T02:25:07Z","title":"FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T12:43:58.746650Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.17759"},"observation_digest":"sha256:86ac959139ae4071875adbc65290a3dae2ecd335f8fc6b936738d72953e072b9","observation_id":"9a442605-5bd9-4070-9c1a-fe04addd3e7d","resolution":{"observed_at":"2026-05-20T12:48:17.641600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:54.139888Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:b1fbfc103f59b5655d70a550c28a9268de9d0be0a200680509cd66b73c9b61d0","observation_id":"88d039c6-6602-45f8-8544-37539c525e6c","resolution":{"observed_at":"2026-05-20T12:03:15.355563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T18:39:40.667006Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:c51d19b87b89a573443c36e47b1880b763aa7919509e7ad8d84f4466fcfd3b1c","observation_id":"e2b33ecc-ae3e-4fcb-a1e9-06e23bc9f129","resolution":{"observed_at":"2026-06-30T19:15:01.305909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-02T13:49:19.275389Z","title":"Pixnerd: Pixel neural field diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T13:49:19.275389Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:a5c21df6a2f5e246a82ecddb8aaacf3458f24733c89dd8748e54c013d4f376e9","observation_id":"165f07d7-e767-4e66-b121-2203ed04eef2","resolution":{"observed_at":"2026-08-02T13:49:19.275389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.20147","last_updated":"2026-05-19T17:35:09Z","snapshot_observed_at":"2026-08-14T13:34:56.300162Z","submitted_at":"2026-05-19T17:35:09Z","title":"PixVerve: Advancing Native UHR Image Generation to 100MP with a Large-Scale High-Quality Dataset","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T05:19:30.372528Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.20147"},"observation_digest":"sha256:17dba630cd6c316808146abc9f67c76529f676ff81ea76257312c05b6f015295","observation_id":"34c15862-92a3-4d0e-a9b9-bfc26773722b","resolution":{"observed_at":"2026-05-20T05:23:03.893326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.21981","last_updated":"2026-05-21T04:21:43Z","snapshot_observed_at":"2026-07-06T23:32:20.708664Z","submitted_at":"2026-05-21T04:21:43Z","title":"RiT: Vanilla Diffusion Transformers Suffice in Representation Space","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T07:50:29.461854Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.21981"},"observation_digest":"sha256:fa6eaada9f0652ee09d285dbda6d5871a0e2e982d4a7c1619f89351b081d4c05","observation_id":"771fa597-21c5-4501-b5c5-6f2f1b84eb9d","resolution":{"observed_at":"2026-05-22T07:51:15.925358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.31604","last_updated":"2026-07-03T09:50:38Z","snapshot_observed_at":"2026-08-03T15:39:37.184662Z","submitted_at":"2026-05-29T17:59:55Z","title":"Representation Forcing for Bottleneck-Free Unified Multimodal Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T22:54:10.460872Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.31604"},"observation_digest":"sha256:762a8694b3290f6678e4f593876899026f5f61928984afdf7bfa33a451bf7d44","observation_id":"eb760fe6-10a6-43e0-88dd-318163137173","resolution":{"observed_at":"2026-07-01T19:16:00.947424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-07-12T15:31:57.426559Z","title":"PixNerd: Pixel neural field diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31604","last_updated":"2026-07-03T09:50:38Z","snapshot_observed_at":"2026-08-03T15:39:37.184662Z","submitted_at":"2026-05-29T17:59:55Z","title":"Representation Forcing for Bottleneck-Free Unified Multimodal Models","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-12T15:31:57.426559Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.31604"},"observation_digest":"sha256:261ad2d2194529a40555bf2c21b1ef0f4d193e70a777a4fdbac9c3fa1df94578","observation_id":"3963e05a-db2e-43bd-9c65-33860daaead3","resolution":{"observed_at":"2026-07-12T15:31:57.426559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.03455","last_updated":"2026-06-02T10:33:20Z","snapshot_observed_at":"2026-08-05T18:48:21.902772Z","submitted_at":"2026-06-02T10:33:20Z","title":"WavTTS: Towards High-Quality Zero-Shot TTS via Direct Raw Waveform Modeling","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T08:18:42.002083Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.03455"},"observation_digest":"sha256:b883b538ebece90845952a6e8d18c52ce41194fb01eecb04912dfbf7c82bbdec","observation_id":"550fec21-15f1-4126-bb4e-0a2ef6a59556","resolution":{"observed_at":"2026-07-02T05:16:39.848770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.09048","last_updated":"2026-06-08T05:36:42Z","snapshot_observed_at":"2026-07-06T23:48:26.076260Z","submitted_at":"2026-06-08T05:36:42Z","title":"BareWave: Waveform-Native Flow-Matching Text-to-Speech","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T15:14:03.681833Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.09048"},"observation_digest":"sha256:3cade3a18d1839240cfb66aeed4e37e96ee09d0bd5c42a2f8a0966f7ee81fde5","observation_id":"394dec80-c8cf-4a27-a695-71d650af5b02","resolution":{"observed_at":"2026-07-03T03:37:35.212704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-08-08T16:38:03.178919Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:e53100d89c4a1979bdd4b60032858b1252f651a67f2df6e579b8dbadb2e77dec","observation_id":"ec1791d9-f5fc-46de-ae9a-3078e7eb8099","resolution":{"observed_at":"2026-07-04T16:59:57.884703Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.26016","last_updated":"2026-07-08T10:57:01Z","snapshot_observed_at":"2026-08-02T07:36:10.167129Z","submitted_at":"2026-06-24T16:37:10Z","title":"MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-25T19:34:02.046104Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.26016"},"observation_digest":"sha256:63dd46dfcf2abfc638fa41529b6a0df2f380e8912c9c8b42352f041580947799","observation_id":"e8c5502d-25ca-484a-8350-64ab7815a91b","resolution":{"observed_at":"2026-07-04T20:50:11.427651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.27760","last_updated":"2026-06-26T06:39:06Z","snapshot_observed_at":"2026-07-31T06:11:06.764017Z","submitted_at":"2026-06-26T06:39:06Z","title":"PixelU: A U-Shaped Transformer for Efficient End-to-End Pixel Diffusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T04:31:57.169935Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.27760"},"observation_digest":"sha256:db631746f13eeba80d1e370b4bf4cc94d6f5df65d6dcdd14f2ed51f19473d7bd","observation_id":"0e5f91c9-dd49-4992-96cc-c28adce46b2b","resolution":{"observed_at":"2026-06-29T20:03:57.206271Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.27978","last_updated":"2026-06-26T11:27:39Z","snapshot_observed_at":"2026-08-08T23:47:35.895010Z","submitted_at":"2026-06-26T11:27:39Z","title":"Parallel Rollout Approximation for Pixel-Space Autoregressive Image Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T04:58:23.066578Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.27978"},"observation_digest":"sha256:ed48eef8c1d04091d64d8f838b62fee9733aec0945541d2c2a19c866d94ad9df","observation_id":"c598a02c-4799-443c-80ee-43fe9f1c2e98","resolution":{"observed_at":"2026-06-29T19:03:52.166667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2607.01803","last_updated":"2026-07-04T06:58:16Z","snapshot_observed_at":"2026-08-02T02:22:21.215897Z","submitted_at":"2026-07-02T07:18:37Z","title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-03T16:13:41.928049Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.01803"},"observation_digest":"sha256:6bc50110c5dc30d12b685435e56d7f241b34b83e475435961a463c4c972ef7f5","observation_id":"02a70814-6b68-4e17-8ead-39a1b5b165d3","resolution":{"observed_at":"2026-07-03T16:18:37.485853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-07-12T08:36:06.846852Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.01803","last_updated":"2026-07-04T06:58:16Z","snapshot_observed_at":"2026-08-02T02:22:21.215897Z","submitted_at":"2026-07-02T07:18:37Z","title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-12T08:36:06.846852Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.01803"},"observation_digest":"sha256:273458bde3a5d6748843665c93c72bc0eef7e460c5238ff97cb8678ab3c33ad6","observation_id":"8e31eb1d-0c48-4c42-8638-5f496ee4c250","resolution":{"observed_at":"2026-07-12T08:36:06.846852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T22:56:39.912445Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15585","last_updated":"2026-07-17T03:07:18Z","snapshot_observed_at":"2026-08-09T02:05:15.125977Z","submitted_at":"2026-07-17T03:07:18Z","title":"SPEED: One-Step Pixel Diffusion for High-quality Video Frame Interpolation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T22:56:39.912445Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.15585"},"observation_digest":"sha256:9a07b9452e224c089dce49407397da5fee60d6b627149d641d02190828df444f","observation_id":"a3fcabf2-b53c-4664-8dfa-812fda7d4e10","resolution":{"observed_at":"2026-08-01T22:56:39.912445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T17:35:33.745950Z","title":"Pixnerd: Pixel neural field diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17585","last_updated":"2026-08-12T11:53:54Z","snapshot_observed_at":"2026-08-15T13:09:26.973928Z","submitted_at":"2026-07-20T06:04:08Z","title":"Pixel-Space Diffusion Transformers","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T17:35:33.745950Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.17585"},"observation_digest":"sha256:66b5a43955abe9f2c48ec32bf965c5daf2ce53f2ede46b7eb51bc24bfc149765","observation_id":"16085e59-096f-4278-b340-4a540fc17d9d","resolution":{"observed_at":"2026-08-01T17:35:33.745950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T15:16:51.997812Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18510","last_updated":"2026-07-20T21:08:56Z","snapshot_observed_at":"2026-08-09T02:05:22.323664Z","submitted_at":"2026-07-20T21:08:56Z","title":"DuSPiT: Dual-Branch Sub-Patch Pixel Diffusion Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:16:51.997812Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.18510"},"observation_digest":"sha256:cb687e7730adadf4bd7176711cd578beb2b19c3de02b18cf68eca18514562ece","observation_id":"6a30bd83-8347-42b0-a6a8-39209ce4b62c","resolution":{"observed_at":"2026-08-01T15:16:51.997812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T11:10:14.438729Z","title":"Pixnerd: Pixel neural field diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19986","last_updated":"2026-07-22T10:19:43Z","snapshot_observed_at":"2026-08-12T17:06:57.150430Z","submitted_at":"2026-07-22T10:19:43Z","title":"STEREOFLOW: Progressive Stereo Matching with StereoDiT and Transition Flow Matching","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-01T11:10:14.438729Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.19986"},"observation_digest":"sha256:017013f71a6fff3c87fb77ab9571ce96f79caa82aec1bd11824feaa17b938a5d","observation_id":"c8a4f1bc-aaf3-4e7e-8012-7e731602c8ad","resolution":{"observed_at":"2026-08-01T11:10:14.438729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T04:30:08.106487Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-14T14:09:07.258818Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-08-01T04:30:08.106487Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:f40d1ba3a8411ab55657dc6ace95770a723b14f0da6f4bb731535dcbf6757577","observation_id":"c5f51ebe-82d7-4230-bc8c-cd2ad0b6c7e0","resolution":{"observed_at":"2026-08-01T04:30:08.106487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-07-30T18:58:28.472063Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26860","last_updated":"2026-07-29T12:44:19Z","snapshot_observed_at":"2026-08-12T23:39:20.547745Z","submitted_at":"2026-07-29T12:44:19Z","title":"Amortized Moment Matching for Visual Generation","version":1},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-07-30T18:58:28.472063Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.26860"},"observation_digest":"sha256:66769bfb0c6ed613b1669a7b614b3eff9d9413718bc2ca7cf7a8fcfd8f169db5","observation_id":"9bc2fdaa-3c9d-46d5-b490-527e801d9193","resolution":{"observed_at":"2026-07-30T18:58:28.472063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T00:34:35.546032Z","title":"PixNerd: Pixel neural field diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28760","last_updated":"2026-07-30T18:26:19Z","snapshot_observed_at":"2026-08-15T00:39:32.976416Z","submitted_at":"2026-07-30T18:26:19Z","title":"WaiT for the Signal: Simple Frequency-Aware Flow-Matching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T00:34:35.546032Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.28760"},"observation_digest":"sha256:3510e936afc6b7901f493db310166a27c307e23cffb01daf402f2e9dea899fe6","observation_id":"e2974533-4f18-42f0-afa4-b545b9d33fea","resolution":{"observed_at":"2026-08-03T00:34:35.546032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T13:23:49.050470Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29122","last_updated":"2026-07-31T07:52:08Z","snapshot_observed_at":"2026-08-08T01:44:11.895032Z","submitted_at":"2026-07-31T07:52:08Z","title":"A Frozen Pixel-Space Diffusion Model Can Guide Itself with Its Own Samples","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-03T13:23:49.050470Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.29122"},"observation_digest":"sha256:250c4b6b7d51053850f947f34fdcd0b07129fc5bb73832acad7620da44f8d106","observation_id":"6ac64400-5051-40bd-8e47-f9561f9d6f4b","resolution":{"observed_at":"2026-08-03T13:23:49.050470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T08:35:55.479259Z","title":"Pixnerd: Pixel neural field diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29363","last_updated":"2026-07-31T12:51:24Z","snapshot_observed_at":"2026-08-11T13:01:28.550051Z","submitted_at":"2026-07-31T12:51:24Z","title":"Stable Autoregressive Speech Generation with Low-Frame-Rate High-Dimensional Continuous Tokens","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-03T08:35:55.479259Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.29363"},"observation_digest":"sha256:62a9d7907ba9b4598a1f5f38373106e2c5b440d1a92cc16a1b55086eabbba3db","observation_id":"a84ee794-56e3-4c3b-8a00-67240b39af5e","resolution":{"observed_at":"2026-08-03T08:35:55.479259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T00:44:17.024044Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00562","last_updated":"2026-08-01T10:00:42Z","snapshot_observed_at":"2026-08-10T14:13:58.607131Z","submitted_at":"2026-08-01T10:00:42Z","title":"Beyond Token-Level Cross-Entropy: Fr\\'echet Distributional Post-Training for Autoregressive Image Generation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T00:44:17.024044Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.00562"},"observation_digest":"sha256:26e49aa04093957046d14cac74f2977365ddf4a2b1c5e63f60f6bca8bc667ca0","observation_id":"978693c8-3bce-4984-b593-5bfa0acc6e3c","resolution":{"observed_at":"2026-08-05T00:44:17.024044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-06T15:55:49.613668Z","title":"arXiv:2507.23268","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04818","last_updated":"2026-08-05T13:22:43Z","snapshot_observed_at":"2026-08-14T08:41:53.736719Z","submitted_at":"2026-08-05T13:22:43Z","title":"Rethinking Pixel Mean Flows via Interval Denoiser","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:55:49.613668Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.04818"},"observation_digest":"sha256:60fd494ad1f80e517910982ca1f2aa9bbd7ecb219733b0438a16b835fed144c5","observation_id":"67765856-ebff-432b-a69c-397b97b87296","resolution":{"observed_at":"2026-08-06T15:55:49.613668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-07T23:08:32.723442Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05811","last_updated":"2026-08-07T08:39:46Z","snapshot_observed_at":"2026-08-14T01:13:41.082687Z","submitted_at":"2026-08-06T09:44:00Z","title":"Energy-Guided Flow Matching","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:32.723442Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.05811"},"observation_digest":"sha256:8a1ba0c0b53f4a12cdd81850f48717fcad62397fa5f06c9cd7e6b615a0646007","observation_id":"8da19eea-a026-4635-bb5c-7d37417e1ee2","resolution":{"observed_at":"2026-08-07T23:08:32.723442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-10T04:33:41.234673Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05811","last_updated":"2026-08-07T08:39:46Z","snapshot_observed_at":"2026-08-14T01:13:41.082687Z","submitted_at":"2026-08-06T09:44:00Z","title":"Energy-Guided Flow Matching","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:41.234673Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.05811"},"observation_digest":"sha256:bbf3f688fff18ac07313cfe61a9bcb2ec757d47bb226233ad8713fb0d01c4349","observation_id":"e18e4028-0bdd-4d80-9916-4c0485de3130","resolution":{"observed_at":"2026-08-10T04:33:41.234673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23268/citation-record","integrity":"/paper/2507.23268/integrity","json":"/paper/2507.23268/citation-record.json","paper":"/paper/2507.23268"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.919084Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"b7987c4c-3983-4f42-821e-c20b3418d498","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.466775Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b27cdcd9fbf61d84531fd4091dceaaa32b226683d89b32dbc2b4ca522123691f","observation_id":"96fd7a67-89cb-43ee-8770-41aa4815ab6a","resolution":{"observed_at":"2026-08-06T10:59:55.924849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-11T01:06:46.210110Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01423","snapshot_observed_at":"2026-08-06T10:59:53.473492Z","title":"Reconstruction vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.473492Z"},"links":{"cited_paper":"/paper/2501.01423","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f03ede7fe6219ebd7ab854e5f2f16efd8751e6b9dc208c7fada0038c99357ae7","observation_id":"7dc8fd61-c9cd-4a30-b492-7dd3f91223b9","resolution":{"observed_at":"2026-08-06T10:59:53.473492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-08-13T23:46:55.707976Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-08-06T10:59:53.479817Z","title":"Deep compression autoencoder for efficient high-resolution diffusion models.arXiv preprint arXiv:2410.10733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.479817Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:3f96ad2db0dfeffbeb5ad5b7317faaadfa828437f9f51772a1fc5728f91f3281","observation_id":"f3dd9cc4-55f2-43c0-b42d-db7e68516358","resolution":{"observed_at":"2026-08-06T10:59:53.479817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-06T10:59:53.488694Z","title":"Large scale gan training for high fidelity natural image synthesis.arXiv preprint arXiv:1809.11096, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.488694Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:16b404cf65970a9297a754581036f3ed4ca895e32ba29b884e58680444b36ecc","observation_id":"7ff2ac42-a1d1-4a32-a7d2-5d17f6f1c768","resolution":{"observed_at":"2026-08-06T10:59:53.488694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.904281Z","title":"Stylegan-xl: Scaling stylegan to large diverse datasets","venue":null,"work_id":"2a96825c-5645-48e3-bc09-7030825b0ed2","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.496310Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7f04cf2becd3c2a8649b448b83388cc084acc482be4f1b4baac54e99d1e6cfd4","observation_id":"9760d303-2cf2-4e6b-920b-6392f410a0ac","resolution":{"observed_at":"2026-08-06T10:59:55.909157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.887454Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"254da452-214e-4b6e-b6b8-5ca0dc91b362","year":2018},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.504783Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:64a9bc5e01e8ce7ff9a03e3b4dc67b14d7d142ecaee315bed63ff3d20472443d","observation_id":"a31cd441-0277-48a0-907e-20b52a11fc94","resolution":{"observed_at":"2026-08-06T10:59:55.892714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.510997Z","title":"Repa-e: Unlocking vae for end-to-end tuning with latent diffusion transformers.arXiv preprint arXiv:2504.10483,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.510997Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:490c89ab16a9a0578f03c23ac04efcafac0b816fef342c5c53ad0168d6fba27b","observation_id":"dbde549e-f075-44d2-9a2c-eeeb03a6afd8","resolution":{"observed_at":"2026-08-06T10:59:53.510997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.871346Z","title":"Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021","venue":null,"work_id":"892352bc-e02c-4e71-bc3a-9a779589473f","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.516839Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:8d8beafef2534b8745d4e62cfff477071e52ee626b3fea9fe1c090195b9919f6","observation_id":"d058c70a-7984-41fd-a228-f0920a6a73f4","resolution":{"observed_at":"2026-08-06T10:59:55.876750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07963","last_updated":"2025-04-10T17:59:56Z","snapshot_observed_at":"2026-08-10T13:40:29.599895Z","submitted_at":"2025-04-10T17:59:56Z","title":"PixelFlow: Pixel-Space Generative Models with Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07963","snapshot_observed_at":"2026-08-06T10:59:53.523420Z","title":"Pixelflow: Pixel-space generative models with flow.arXiv preprint arXiv:2504.07963, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.523420Z"},"links":{"cited_paper":"/paper/2504.07963","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:6b5c9c410a23738f44c43c4ba2f95113a7b766d3ffe719db8caf1e569dc12754","observation_id":"f7b969ef-c99a-417f-a9f5-f508966d6c65","resolution":{"observed_at":"2026-08-06T10:59:53.523420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03350","last_updated":"2023-09-04T15:00:33Z","snapshot_observed_at":"2026-08-14T18:20:20.482137Z","submitted_at":"2023-09-04T15:00:33Z","title":"Relay Diffusion: Unifying diffusion process across resolutions for image synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03350","snapshot_observed_at":"2026-08-06T10:59:53.530303Z","title":"Relay diffusion: Unifying diffusion process across resolutions for image synthesis.arXiv preprint arXiv:2309.03350, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.530303Z"},"links":{"cited_paper":"/paper/2309.03350","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:be96691e0a89f7f560a519d96de4720696f3eb93772d98d3683babc92b8f6269","observation_id":"9bf2a504-67d4-4324-a21b-9225eef9b16a","resolution":{"observed_at":"2026-08-06T10:59:53.530303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.855996Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis.Communications of the ACM, 65(1):99–106, 2021","venue":null,"work_id":"3f923d0f-c481-448d-887e-5d61da16b17a","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.537881Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:636128fb073b1dae97fa8b40c96eb882221ba47fe81af50935892c3cfc1b95ce","observation_id":"bc48f103-38de-4e66-941c-b54f84062b06","resolution":{"observed_at":"2026-08-06T10:59:55.860949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.838927Z","title":"Implicit neural representations with periodic activation functions.Advances in neural information processing systems, 33:7462–7473, 2020","venue":null,"work_id":"82ba8d1e-d672-441d-9efd-38514df76510","year":2020},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.543906Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1a8e59824b05bbbe155f24f06f367098cf822dc5ed2b4bac4acb951e8dda2584","observation_id":"16e8c55f-ae56-44ec-905d-d2f226e2c9bf","resolution":{"observed_at":"2026-08-06T10:59:55.844676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.822786Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"fdf0c471-1613-4028-a5e1-801c05f5532f","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.551173Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:2a6681a792effed43ae247e3b2d8d542c797e4d28ce0b37d1bbb1fef602d0eef","observation_id":"0dddf612-161e-41e7-9474-fac0aed4a6bc","resolution":{"observed_at":"2026-08-06T10:59:55.828157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08740","last_updated":"2024-09-23T15:59:41Z","snapshot_observed_at":"2026-08-13T04:41:48.311151Z","submitted_at":"2024-01-16T18:55:25Z","title":"SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08740","snapshot_observed_at":"2026-08-06T10:59:53.556391Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers.arXiv preprint arXiv:2401.08740, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.556391Z"},"links":{"cited_paper":"/paper/2401.08740","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:62f5cb19d59f3e92650b612132c78a028cad72ac7a814c6ed67f6bbdc514a405","observation_id":"78920582-22b7-4b4f-b488-e3cb1af4ce87","resolution":{"observed_at":"2026-08-06T10:59:53.556391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05741","last_updated":"2025-04-09T04:23:38Z","snapshot_observed_at":"2026-08-13T19:30:08.590594Z","submitted_at":"2025-04-08T07:17:45Z","title":"DDT: Decoupled Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05741","snapshot_observed_at":"2026-08-06T10:59:53.563286Z","title":"Decoupled diffusion transformer.arXiv preprint arXiv:2504.05741, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.563286Z"},"links":{"cited_paper":"/paper/2504.05741","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:23a5fad754d6e2722edab34351a8707bf69b26da3dde7a4d602eb0cfb12b6e92","observation_id":"3a0155e0-346b-4061-9868-78ff42a6fa32","resolution":{"observed_at":"2026-08-06T10:59:53.563286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.806998Z","title":"Analyzing and improving the training dynamics of diffusion models","venue":null,"work_id":"f0f3d477-bf04-4910-be81-5516a553bcc2","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.570113Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e89c0553cda72bb5fa7c7dc1757cf3cdbec5ae945e867f4a254ab178417ef74d","observation_id":"3cc340b2-0c41-4ca3-a7d0-779ff450e7da","resolution":{"observed_at":"2026-08-06T10:59:55.812096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08531","last_updated":"2024-10-11T05:03:56Z","snapshot_observed_at":"2026-08-12T22:25:44.880419Z","submitted_at":"2024-10-11T05:03:56Z","title":"Diffusion Models Need Visual Priors for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08531","snapshot_observed_at":"2026-08-06T10:59:53.579486Z","title":"Diffusion models need visual priors for image generation.arXiv preprint arXiv:2410.08531, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.579486Z"},"links":{"cited_paper":"/paper/2410.08531","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7d61cd5bd5ca4919a3f5eff478ab21c34d00b6ff200a8c7c3c62d299893db30f","observation_id":"bed14cd8-c1eb-486f-ab19-58ea8399a1fa","resolution":{"observed_at":"2026-08-06T10:59:53.579486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.790642Z","title":"Exploring dcn-like architecture for fast image generation with arbitrary resolution.Advances in Neural Information Processing Systems, 37:87959–87977, 2024","venue":null,"work_id":"42f55b2b-308b-45a0-9d2f-7e9758e2cef9","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.586165Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:db1f526cec7a244b0708b7735f1a6164986816de72f8c6de3aeb2f3209471126","observation_id":"7204f52a-9f31-4d1c-a57b-66d84907a202","resolution":{"observed_at":"2026-08-06T10:59:55.795963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14224","last_updated":"2024-07-10T09:02:11Z","snapshot_observed_at":"2026-08-14T07:43:43.585018Z","submitted_at":"2024-05-23T06:53:18Z","title":"DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14224","snapshot_observed_at":"2026-08-06T10:59:53.591869Z","title":"Dim: Diffusion mamba for efficient high-resolution image synthesis.arXiv preprint arXiv:2405.14224, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.591869Z"},"links":{"cited_paper":"/paper/2405.14224","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:13db29571a3e0b9ad2c282e853c5bf1575b4891f57408c7fa0e65a824eb1d46f","observation_id":"f7eeabed-1928-4fa1-96b8-7f5b164d961a","resolution":{"observed_at":"2026-08-06T10:59:53.591869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12364","last_updated":"2025-04-16T15:09:45Z","snapshot_observed_at":"2026-08-07T16:01:46.917051Z","submitted_at":"2025-04-16T15:09:45Z","title":"DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12364","snapshot_observed_at":"2026-08-06T10:59:53.598965Z","title":"Dmm: Building a versatile image generation model via distillation-based model merging.arXiv preprint arXiv:2504.12364, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.598965Z"},"links":{"cited_paper":"/paper/2504.12364","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e655914e14d7f4d5d75bed036c3ea8c71b305e7083062157493e3bda52eae605","observation_id":"9cc4a7ac-446b-46fb-9e61-40aeb9d7baab","resolution":{"observed_at":"2026-08-06T10:59:53.598965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.774719Z","title":"Score identity distillation: Exponentially fast distillation of pretrained diffusion models for one-step generation","venue":null,"work_id":"297db24e-a5b5-40f5-b8e0-6a5908dd1b26","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.605270Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:75a6e18fa7397d9ccc423a74502805e156a0d558e174c904dd6d81da0dc99402","observation_id":"a148daa2-43b8-47c6-96aa-e3c4b67c9408","resolution":{"observed_at":"2026-08-06T10:59:55.780084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.756619Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":"add50dd7-d90b-4f5f-b1c3-3cf74a0f35a2","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.612388Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:6db765e33c315589cb7ab042e52ee5505c052831d4d142dd542c1e1350533e12","observation_id":"73ab942b-f3de-49e6-8936-c46d19814a69","resolution":{"observed_at":"2026-08-06T10:59:55.762231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.739016Z","title":"Understanding diffusion objectives as the elbo with simple data augmentation.Advances in Neural Information Processing Systems, 36:65484–65516, 2023","venue":null,"work_id":"c2a8888e-9fac-4f80-8ed5-940993b2d700","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.618113Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1eef2a4003fcdb8c8299b67c5be49c17d40cc4d85fb36220e7bdda0c50bab44a","observation_id":"1d210327-7806-4199-aea7-828af496cc3c","resolution":{"observed_at":"2026-08-06T10:59:55.744308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.719157Z","title":"simple diffusion: End-to-end diffusion for high resolution images","venue":null,"work_id":"14bbef32-86d4-43a6-892c-717ed8bec1d9","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.623216Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:587cfecf4b332aad529ec1e444d41c65358d7153e039ba06de62530e6d8195cb","observation_id":"e1ffc047-36c7-45f7-b660-402153b24c00","resolution":{"observed_at":"2026-08-06T10:59:55.724406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17437","last_updated":"2025-02-25T14:28:34Z","snapshot_observed_at":"2026-08-13T00:16:40.015338Z","submitted_at":"2025-02-24T18:59:56Z","title":"Fractal Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17437","snapshot_observed_at":"2026-08-06T10:59:53.628822Z","title":"Fractal generative models.arXiv preprint arXiv:2502.17437, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.628822Z"},"links":{"cited_paper":"/paper/2502.17437","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f8e579b15abb2bd268eebc046288851380bd5fd270e1ec298cb7d7ad06357db0","observation_id":"5e721986-4f87-406b-ae79-b323ac106e91","resolution":{"observed_at":"2026-08-06T10:59:53.628822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06329","last_updated":"2025-06-06T17:45:35Z","snapshot_observed_at":"2026-08-14T07:22:30.028311Z","submitted_at":"2024-12-09T09:28:06Z","title":"Normalizing Flows are Capable Generative Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06329","snapshot_observed_at":"2026-08-06T10:59:53.635782Z","title":"Normalizing flows are capable generative models.arXiv preprint arXiv:2412.06329, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.635782Z"},"links":{"cited_paper":"/paper/2412.06329","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:fe9689dab0c5921994a1e53e66e7a110bfcecfd22d3404114e265fe324a0cb9c","observation_id":"a8763492-f806-483f-9796-7a542edcbd4b","resolution":{"observed_at":"2026-08-06T10:59:53.635782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.701354Z","title":"Reverse-time diffusion equation models.Stochastic Processes and their Applications, 12(3):313–326, 1982","venue":null,"work_id":"687b21a8-6fdd-411b-9f31-8d5818ca3953","year":1982},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.642499Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:ed206c1a521afcf208896e74ed814ea4faaf2ac8ed475c80b009a386649db399","observation_id":"1ec32c64-d933-4ad0-82f6-f4e4cadd68e8","resolution":{"observed_at":"2026-08-06T10:59:55.706424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-06T10:59:53.651829Z","title":"Score-based generative modeling through stochastic differential equations.arXiv preprint arXiv:2011.13456, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.651829Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b0de674888c2ea24e47eea0d6815c68836b98e467d7e3ca2632954e085245554","observation_id":"41532b06-a287-42ff-91fb-afecd4bafd2b","resolution":{"observed_at":"2026-08-06T10:59:53.651829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.683779Z","title":"Elucidating the design space of diffusion-based generative models.Advances in Neural Information Processing Systems, 35:26565–26577, 2022","venue":null,"work_id":"4947cf34-dac3-43fe-914a-811030d00b6f","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.658998Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:2e6f26dbc53df12378b95650d4ae93edc5b278371a446e9efe9f307c8103cce7","observation_id":"fbf99e05-c698-4a56-bf6a-145c29a87251","resolution":{"observed_at":"2026-08-06T10:59:55.690754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.664833Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":"1ef52c47-7808-42bc-88a2-a0f0f11921c6","year":2020},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.664691Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:8e900e965363379a3bc3efc568b5063380cf03f44ed888d4b35103e318dd8663","observation_id":"df5b1330-0c3f-4fb3-8270-0f4a38e726a6","resolution":{"observed_at":"2026-08-06T10:59:55.671671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T10:59:53.673193Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.673193Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e672eeb2b6f358c8016e71fbc7e87b81f7330d8674084dff75ae5ff84965b885","observation_id":"e09922ea-00af-4fe4-9025-8293b73cf97d","resolution":{"observed_at":"2026-08-06T10:59:53.673193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T10:59:53.680104Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.680104Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:066b70a7676f058001905abf97a81cc1f6fc99d0934c54750909b7d71679c9eb","observation_id":"ef99423f-6e1f-4ff8-8692-67b9ef6fdfc4","resolution":{"observed_at":"2026-08-06T10:59:53.680104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.643838Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024","venue":null,"work_id":"0707a629-5350-474d-87db-426044b427dc","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.686698Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:59e2777c749bd5258fa776fae887fed65b5f2f19b6909308ba324a3eb8c4be46","observation_id":"54635678-97bf-429d-8d0d-fc95af2d2678","resolution":{"observed_at":"2026-08-06T10:59:55.650779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00522","last_updated":"2024-07-08T02:48:27Z","snapshot_observed_at":"2026-08-14T01:47:25.591274Z","submitted_at":"2024-03-01T13:30:51Z","title":"VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks","version":2},"cited_work":{"arxiv_id":"2403.00522","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.00522","snapshot_observed_at":"2026-08-06T10:59:54.749546Z","title":"VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks","venue":"cs.CV","work_id":"d48deb2f-40b9-4a7e-ad94-d3cf2cf2b4c8","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.695426Z"},"links":{"cited_paper":"/paper/2403.00522","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:fdf0727dfce4cf9fc93d3417d0b53c32715b2430fca0eb7a13be19e97627c5e4","observation_id":"1b636a14-23e1-4dd3-965e-2092e5b3d788","resolution":{"observed_at":"2026-08-06T10:59:54.761049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12376","last_updated":"2024-10-15T02:51:00Z","snapshot_observed_at":"2026-08-13T04:15:09.795316Z","submitted_at":"2024-02-19T18:59:07Z","title":"FiT: Flexible Vision Transformer for Diffusion Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12376","snapshot_observed_at":"2026-08-06T10:59:53.705503Z","title":"Fit: Flexible vision transformer for diffusion model.arXiv preprint arXiv:2402.12376, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.705503Z"},"links":{"cited_paper":"/paper/2402.12376","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:508fb8070183ef357d51ac2b1c635b20242a56a13179e98b6590f46de10ba38c","observation_id":"6f6e9f36-37e8-4ab2-a1b2-6c1e369abac8","resolution":{"observed_at":"2026-08-06T10:59:53.705503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07703","last_updated":"2025-03-10T17:58:33Z","snapshot_observed_at":"2026-07-06T20:50:09.622181Z","submitted_at":"2025-03-10T17:58:33Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07703","snapshot_observed_at":"2026-08-06T10:59:53.712528Z","title":"Seedream 2.0: A native chinese-english bilingual image generation foundation model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.712528Z"},"links":{"cited_paper":"/paper/2503.07703","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:a7b070e1fa428a7d8a4af8d1af0c8a333a6916a6f82bb86c005714a4a771d709","observation_id":"f310bc9e-816f-4994-bd9c-d465baa1a0bf","resolution":{"observed_at":"2026-08-06T10:59:53.712528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-06T10:59:53.722116Z","title":"Seedream 3.0 technical report.arXiv preprint arXiv:2504.11346, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.722116Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:cf1922d2d378bcd51df8af08f6b8898f7818ac023c062d8fd342b3e1d2ac31c0","observation_id":"bf1caafc-7334-4783-935b-22474b87b295","resolution":{"observed_at":"2026-08-06T10:59:53.722116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05472","last_updated":"2025-05-11T18:47:18Z","snapshot_observed_at":"2026-08-12T22:02:52.918587Z","submitted_at":"2025-05-08T17:58:57Z","title":"Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05472","snapshot_observed_at":"2026-08-06T10:59:53.729180Z","title":"Mogao: An omni foundation model for interleaved multi-modal generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.729180Z"},"links":{"cited_paper":"/paper/2505.05472","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:c0b6ce0020285066231a308f731daf65df69d0558c6a1098366f360cde57041f","observation_id":"aea3b6a8-289d-43ae-bdcf-b0ecb5354bc2","resolution":{"observed_at":"2026-08-06T10:59:53.729180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12517","last_updated":"2024-03-20T11:24:06Z","snapshot_observed_at":"2026-08-13T04:37:14.504674Z","submitted_at":"2024-01-23T06:21:34Z","title":"DDMI: Domain-Agnostic Latent Diffusion Models for Synthesizing High-Quality Implicit Neural Representations","version":2},"cited_work":{"arxiv_id":"2401.12517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.12517","snapshot_observed_at":"2026-08-06T10:59:54.598485Z","title":"DDMI: Domain-Agnostic Latent Diffusion Models for Synthesizing High-Quality Implicit Neural Representations","venue":"cs.LG","work_id":"0da307d8-af51-4fdb-a540-e8b308f773e6","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.735550Z"},"links":{"cited_paper":"/paper/2401.12517","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:38b1535dcc1b9ab361997a91307aa0379453448d6e59641dab01e17dd45da4bf","observation_id":"84171c69-50d3-4cbc-8cb3-b8314cbb4d9a","resolution":{"observed_at":"2026-08-06T10:59:54.606462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.622650Z","title":"Coco-gan: Generation by parts via conditional coordinating","venue":null,"work_id":"c5ac64a0-abf7-44cb-930f-fde81d83ce32","year":2019},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.743182Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:93f8946910d0fcbc66f2b3026385821678471183eb23f61121f42bd854915f1b","observation_id":"c05f2f03-7a0c-4e55-a5ff-d1d7eaef0f2a","resolution":{"observed_at":"2026-08-06T10:59:55.628393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.601807Z","title":"Image neural field diffusion models","venue":null,"work_id":"4a61bf8d-befd-4d16-9241-729bc2ec2311","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.753847Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:a861ddade3d4a2099ee74028a676928e72b0462fded18c34268a2ceef9be67ea","observation_id":"e8e6c4f0-7626-41b4-9c34-2d6b20a2b594","resolution":{"observed_at":"2026-08-06T10:59:55.608058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.580953Z","title":"Mip-nerf: A multiscale representation for anti-aliasing neural radiance fields","venue":null,"work_id":"52b5072b-8b53-45d8-bd78-dcd4a891db74","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.759705Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:0d259834c6c18f43dd74c1169632f8c29196893830f7e449ce8fddf6383567d4","observation_id":"e9aa5f08-2655-4c83-a416-a078164d5875","resolution":{"observed_at":"2026-08-06T10:59:55.587809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07751","last_updated":"2019-06-18T18:21:46Z","snapshot_observed_at":"2026-08-14T16:13:43.526790Z","submitted_at":"2019-06-18T18:21:46Z","title":"Neural Volumes: Learning Dynamic Renderable Volumes from Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07751","snapshot_observed_at":"2026-08-06T10:59:53.768072Z","title":"Neural volumes: Learning dynamic renderable volumes from images.arXiv preprint arXiv:1906.07751,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.768072Z"},"links":{"cited_paper":"/paper/1906.07751","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1192eb1baecddf057d42642b4dae4518938448e1887489ab51b87835d46a9a22","observation_id":"bc1c6fa8-78cf-4aa8-bd85-d3930ccc915b","resolution":{"observed_at":"2026-08-06T10:59:53.768072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10689","last_updated":"2023-02-01T06:00:21Z","snapshot_observed_at":"2026-08-02T09:26:48.635481Z","submitted_at":"2021-06-20T12:59:42Z","title":"NeuS: Learning Neural Implicit Surfaces by Volume Rendering for Multi-view Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10689","snapshot_observed_at":"2026-08-06T10:59:53.775528Z","title":"Neus: Learning neural implicit surfaces by volume rendering for multi-view reconstruction.arXiv preprint arXiv:2106.10689, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.775528Z"},"links":{"cited_paper":"/paper/2106.10689","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:ff556add747cfb7f67fe0ffa2d1bb163c3e9d23f03b78e627c897ec0f9780cbf","observation_id":"05fd149f-0d49-4c03-a783-714a18503706","resolution":{"observed_at":"2026-08-06T10:59:53.775528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.556308Z","title":"Monosdf: Exploring monocular geometric cues for neural implicit surface reconstruction.Advances in neural information processing systems, 35:25018–25032, 2022","venue":null,"work_id":"4777d2a0-d9cd-4636-ad25-7ff96d327a9f","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.782784Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:5e57186897c0eca13aca5f0c4a4b84b3a530a687af7ee49f25aa54b13e646367","observation_id":"f8988a38-361d-43db-84e4-80b5fafa8351","resolution":{"observed_at":"2026-08-06T10:59:55.563312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.531577Z","title":"Neus2: Fast learning of neural implicit surfaces for multi-view reconstruction","venue":null,"work_id":"c1953dd4-7cb9-442f-8566-ffb0f94a6c4b","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.790020Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:92901e91ea01b0a36ce02d34cdbaef2395b1da8720c0e75272f38d1b7a858be1","observation_id":"efcd25da-d08b-47a1-a8ca-794b9d77807d","resolution":{"observed_at":"2026-08-06T10:59:55.540218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.796811Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.796811Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:949573f836cda694d4773840f279edb8e59d67947b543852efd5936f1361d7f6","observation_id":"306cda42-dc7f-4b23-8114-2bec1fc08c4e","resolution":{"observed_at":"2026-08-06T10:59:53.796811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03841","last_updated":"2021-03-05T17:56:03Z","snapshot_observed_at":"2026-08-14T19:55:37.855479Z","submitted_at":"2021-03-05T17:56:03Z","title":"Generating Images with Sparse Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03841","snapshot_observed_at":"2026-08-06T10:59:53.805944Z","title":"Generating images with sparse representations.arXiv preprint arXiv:2103.03841, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.805944Z"},"links":{"cited_paper":"/paper/2103.03841","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:14526bd20921b04647ee19639576b63e072bf2f2ffb0c8f74ce9cb61ea887e43","observation_id":"fb840580-43b4-4d38-8a66-d564d86f3fd4","resolution":{"observed_at":"2026-08-06T10:59:53.805944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.812267Z","title":"Improved techniques for training gans.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.812267Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7c31be2bb434b2f31dbab093d5e947ba17dee71c854b48e809c3e22a15a4df4a","observation_id":"06edbe77-c0d3-4768-9712-39a3182ab7c4","resolution":{"observed_at":"2026-08-06T10:59:53.812267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.821371Z","title":"Improved precision and recall metric for assessing generative models.Advances in neural information processing systems, 32,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.821371Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f51295e656676c2c4f80fb2cc6286b7a8b2065b445b07ba39723dd98b8fe6644","observation_id":"79de7b13-37b4-41af-96ff-7a46eb246639","resolution":{"observed_at":"2026-08-06T10:59:53.821371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.458770Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152,","venue":null,"work_id":"d16e1ee9-e354-4653-b00d-0512cec0ea43","year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.828441Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:8f5c33a0a2f8a7e063d86bb5daa67a32d933c8c705c25031fa7a875d4a282243","observation_id":"427b4358-710a-466c-a370-0c5d29fdafa6","resolution":{"observed_at":"2026-08-06T10:59:55.466992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-12T17:58:56.652054Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-06T10:59:53.834821Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.834821Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:0702aeebe1e61a4338646546751a75b8e0a62ae8ee11239d4b2f7e4a92e9ee10","observation_id":"fab333f7-2fa0-46c1-824a-813dd7884057","resolution":{"observed_at":"2026-08-06T10:59:53.834821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-06T10:59:53.841329Z","title":"Scaling rectified flow transformers for high-resolution image synthesis.arXiv preprint arXiv:2403.03206, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.841329Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:5d9c8dc644b701d89335ec607d44378d68f286b9ef8ccf2f49c35adcfb7282a9","observation_id":"f4e0b3b1-3c1e-4b26-bdea-a24b43d3d6db","resolution":{"observed_at":"2026-08-06T10:59:53.841329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-06T10:59:53.847537Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.847537Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:885bb292bd5b8b2d103aea63cc2c9685dddff77e77cc64c3813df8eb919b83b4","observation_id":"4155688a-cd30-4744-bf8c-cbba159915ad","resolution":{"observed_at":"2026-08-06T10:59:53.847537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T10:59:53.854680Z","title":"Dinov2: Learning robust visual features without supervision.arXiv preprint arXiv:2304.07193, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.854680Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:cc28ebbb8c65b076159ed73a535ed9f0245843a6ea48fe89e94c3d80c05a7f6e","observation_id":"89d6eed4-214a-41d5-94b3-a7e16519685c","resolution":{"observed_at":"2026-08-06T10:59:53.854680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T10:59:53.860327Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.860327Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:43a4edb460d769e9d0e0b71c8ce06c9eefb8b2d36b6e3c19af38b67f91d4f947","observation_id":"864abfa3-9fe3-4fd6-b620-c27faa4809e6","resolution":{"observed_at":"2026-08-06T10:59:53.860327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07724","last_updated":"2024-11-06T14:29:36Z","snapshot_observed_at":"2026-08-13T00:32:43.044160Z","submitted_at":"2024-04-11T13:16:47Z","title":"Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07724","snapshot_observed_at":"2026-08-06T10:59:53.867895Z","title":"Applying guidance in a limited interval improves sample and distribution quality in diffusion models.arXiv preprint arXiv:2404.07724, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.867895Z"},"links":{"cited_paper":"/paper/2404.07724","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:ac086ebd2f5142051f3e768b999a079e51683b58669256f7cc1afa79ab8573bd","observation_id":"7b08d106-7f5a-4093-930b-b6f129a137cd","resolution":{"observed_at":"2026-08-06T10:59:53.867895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.433546Z","title":"Autoregressive image generation without vector quantization.Advances in Neural Information Processing Systems, 37:56424–56445, 2025","venue":null,"work_id":"17cd8edc-f336-4a84-8267-c1b1ee8fd09f","year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.874335Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:0b359a08f1350f5887f8a4ebeed5970ea486ee521e38c712091e34c8a812346d","observation_id":"45115753-f8d9-43d9-bfe6-a77d3f825137","resolution":{"observed_at":"2026-08-06T10:59:55.440748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-08-14T05:13:44.637603Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12095","snapshot_observed_at":"2026-08-06T10:59:53.881716Z","title":"Causal diffusion transformers for generative modeling.arXiv preprint arXiv:2412.12095, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.881716Z"},"links":{"cited_paper":"/paper/2412.12095","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:a2081c792a09193fcf0a0cc068b5b2fdb8939371796226be7d3c90cd7c0cafab","observation_id":"af11de0a-c6a3-49df-97ca-d7d0c46d971c","resolution":{"observed_at":"2026-08-06T10:59:53.881716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19722","last_updated":"2025-05-19T15:26:21Z","snapshot_observed_at":"2026-08-15T02:11:52.388323Z","submitted_at":"2024-11-29T14:14:59Z","title":"JetFormer: An Autoregressive Generative Model of Raw Images and Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19722","snapshot_observed_at":"2026-08-06T10:59:53.888044Z","title":"Jetformer: An autoregressive generative model of raw images and text.arXiv preprint arXiv:2411.19722, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.888044Z"},"links":{"cited_paper":"/paper/2411.19722","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:06ab29315b48edbe4fed5362a83b3bfa706616a51ec2b724440deaf35655fd4e","observation_id":"585c0a9f-14b0-47e6-b323-1836cb68460b","resolution":{"observed_at":"2026-08-06T10:59:53.888044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11972","last_updated":"2023-06-14T03:32:57Z","snapshot_observed_at":"2026-08-13T13:15:36.821586Z","submitted_at":"2022-12-22T18:55:45Z","title":"Scalable Adaptive Computation for Iterative Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11972","snapshot_observed_at":"2026-08-06T10:59:53.896912Z","title":"Scalable adaptive computation for iterative generation.arXiv preprint arXiv:2212.11972, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.896912Z"},"links":{"cited_paper":"/paper/2212.11972","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:bbfbd1131451a3ee42b8cfbaabea2e9faf3eb5253197041b13491d31f64a8c22","observation_id":"1baa3565-ea4d-4f45-8ac4-b275d4721aa4","resolution":{"observed_at":"2026-08-06T10:59:53.896912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-06T10:59:53.905189Z","title":"Show-o: One single transformer to unify multimodal understanding and generation.arXiv preprint arXiv:2408.12528, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.905189Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:52a05b120bc36c943b1fcdb21171da276c94a14e0be36979c870002425cce9f6","observation_id":"024db1c7-9df8-44b5-a6a7-eaf134eedad3","resolution":{"observed_at":"2026-08-06T10:59:53.905189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-13T23:30:37.164749Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-06T10:59:53.912933Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens.arXiv preprint arXiv:2410.13863, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.912933Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:57cfca59f3181fc0b5c94620e146f2280cfabfc18f0a2e8e215b67321808e6a9","observation_id":"5c1fca8e-0408-4be2-ad98-1f1751b53db4","resolution":{"observed_at":"2026-08-06T10:59:53.912933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-08T11:00:06.035456Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-08-06T10:59:53.920557Z","title":"Simplear: Pushing the frontier of autoregressive visual generation through pretraining, sft, and rl.arXiv preprint arXiv:2504.11455, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.920557Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:6895d8ce8906408688ea26de3ff2c70f3d1788b69a2437348c1ded0e6e3d8a1d","observation_id":"58a3e0a8-a21c-4cf7-bfe0-222a2597f7b7","resolution":{"observed_at":"2026-08-06T10:59:53.920557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-11T01:34:46.484513Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-06T10:59:53.927900Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model.arXiv preprint arXiv:2408.11039, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.927900Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1c0a447a7338250a64d988457eb500f8b090ca130291f5b53b06b2be9e3b7d64","observation_id":"7f82d161-f0d5-43b1-93b9-88f118c7d48e","resolution":{"observed_at":"2026-08-06T10:59:53.927900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.411974Z","title":"Segment anything","venue":null,"work_id":"2b9daed9-6b1e-4c55-a646-8633174c4698","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.934980Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e3bb6cf00f8e3158406c41fd7a090109fe0f40ebbee10e08997941904b662b75","observation_id":"b5bc82e8-483d-43c3-8e09-cf79cd233138","resolution":{"observed_at":"2026-08-06T10:59:55.419099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.384974Z","title":"Journeydb: A benchmark for generative image understanding.Advances in neural information processing systems, 36:49659–49678, 2023","venue":null,"work_id":"67262538-4443-4793-9131-c7052fd36e92","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.940269Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:0c526792c6e6a4eb86c39789935617e4eb3e901abc98ba982f0402f8cf716cc1","observation_id":"cfad6b7f-f91c-4648-94c3-11db06350d54","resolution":{"observed_at":"2026-08-06T10:59:55.392241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.364374Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"d8dc5a5a-74b8-4847-8dfe-ee26aa673c70","year":2015},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.946681Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:948e89e8c224ffb4a942900ceed51a194a65e85f24607a91a5ebe027991b96d5","observation_id":"03f1b303-c11a-4a47-8315-7f56c145b768","resolution":{"observed_at":"2026-08-06T10:59:55.371617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T10:59:53.953428Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.953428Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:4e3ca3d5ab299d060175bdf9cd2cf9671fe4786ff13f53161ca279e7be65ae88","observation_id":"52943ce2-ea6f-4bbd-84f9-b35e9fcd62ba","resolution":{"observed_at":"2026-08-06T10:59:53.953428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03131","last_updated":"2025-06-03T17:57:33Z","snapshot_observed_at":"2026-08-14T20:40:40.741621Z","submitted_at":"2025-06-03T17:57:33Z","title":"Native-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03131","snapshot_observed_at":"2026-08-06T10:59:53.959732Z","title":"Native-resolution image synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.959732Z"},"links":{"cited_paper":"/paper/2506.03131","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:64571f93260ae3f313d20c919eab24a5a993690c6c9cc8a18675d6e1b1a2c688","observation_id":"27e6125d-c332-49bb-83cc-97af61f0e6bc","resolution":{"observed_at":"2026-08-06T10:59:53.959732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09568","last_updated":"2025-05-14T17:11:07Z","snapshot_observed_at":"2026-08-14T20:53:25.133118Z","submitted_at":"2025-05-14T17:11:07Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09568","snapshot_observed_at":"2026-08-06T10:59:53.966506Z","title":"Blip3-o: A family of fully open unified multimodal models-architecture, training and dataset.arXiv preprint arXiv:2505.09568, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.966506Z"},"links":{"cited_paper":"/paper/2505.09568","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1b0d45a12a8c7f2758b69ededb0a9a90dd39fe306e447069b36e5df933c63a19","observation_id":"b7976e51-257a-48b5-b285-0e128d614f9c","resolution":{"observed_at":"2026-08-06T10:59:53.966506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13686","last_updated":"2024-11-04T13:24:18Z","snapshot_observed_at":"2026-08-13T00:25:14.101781Z","submitted_at":"2024-04-21T15:16:05Z","title":"Hyper-SD: Trajectory Segmented Consistency Model for Efficient Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13686","snapshot_observed_at":"2026-08-06T10:59:53.977618Z","title":"Hyper-sd: Trajectory segmented consistency model for efficient image synthesis.arXiv preprint arXiv:2404.13686,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.977618Z"},"links":{"cited_paper":"/paper/2404.13686","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:42510524c487b45c1010395bb76d751ebab122cd0f1fbb32ada3b41e1e049857","observation_id":"a3f57fec-6af9-4afb-bf20-e96af035ff87","resolution":{"observed_at":"2026-08-06T10:59:53.977618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03791","last_updated":"2025-05-29T01:03:51Z","snapshot_observed_at":"2026-08-15T07:13:23.225779Z","submitted_at":"2024-12-05T01:00:07Z","title":"INRFlow: Flow Matching for INRs in Ambient Space","version":2},"cited_work":{"arxiv_id":"2412.03791","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03791","snapshot_observed_at":"2026-08-06T10:59:54.073903Z","title":"INRFlow: Flow Matching for INRs in Ambient Space","venue":"cs.LG","work_id":"4fbf32ea-4e68-452f-b8a3-f028cf9a75da","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.983165Z"},"links":{"cited_paper":"/paper/2412.03791","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:c3d0d65950fff7f10d6d8098820dac1c7496848572a8d662e422f0b464fbdab7","observation_id":"2f06e1f2-00cf-4bb1-a63b-af1cdc3f0e85","resolution":{"observed_at":"2026-08-06T10:59:54.083025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.336624Z","title":"Efficient training with denoised neural weights","venue":null,"work_id":"07ae3c29-63cb-480c-b130-d4310f212e2a","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.988535Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b6bca5d06aac33c221b5a608cde47a3e1fcdc025caf1205afb790f837a8da325","observation_id":"ca782e5d-68e0-4032-a90c-b71062048f65","resolution":{"observed_at":"2026-08-06T10:59:55.348189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.317365Z","title":"Patch diffusion: Faster and more data-efficient training of diffusion models","venue":null,"work_id":"2781f413-83dc-4173-a03e-5d101dc82bfb","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.994341Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:da0241111d897f2e0e59ead62b0ede47981a1d075c36bd04ff9ff48923b90547","observation_id":"bb4ae31e-2d0e-4261-83ef-1a36ebe57ff4","resolution":{"observed_at":"2026-08-06T10:59:55.323690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.298804Z","title":"Arbitrary-scale image synthesis","venue":null,"work_id":"8ef5392a-010e-4aab-a5ab-71bc50a09093","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.999221Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:cf764b30fb8aa235c37256bf5f27d2f96d96871cca067ae9a3a5c6d344333177","observation_id":"2f99bd30-209b-4cab-b736-3d49ae2c8fbf","resolution":{"observed_at":"2026-08-06T10:59:55.304439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.275821Z","title":"Adversarial generation of continuous images","venue":null,"work_id":"216ced97-069e-4dab-9bed-4aa18cf5a6a4","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:54.005740Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:4a8f933da778ae9277c1db8b514e94e1749cdd1dde9258c196b60f2c3574ce6a","observation_id":"0217a6a4-f964-43bc-91c4-a5553c8acb6a","resolution":{"observed_at":"2026-08-06T10:59:55.283080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.249380Z","title":"Alias-free generative adversarial networks.Advances in neural information processing systems, 34:852–863, 2021","venue":null,"work_id":"d611d9f7-0979-4fff-9061-98792f9c8696","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:54.011822Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7ea8175fd5b88f8cd94b0b6fe42b2bc643f3269c08aee7a7767aa6f60ae26e23","observation_id":"1a7497d3-b635-4494-8a42-540373b1a498","resolution":{"observed_at":"2026-08-06T10:59:55.256522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T11:35:09.809757Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":32},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 46 inbound Pith citation observations for arXiv:2507.23268."}