{"as_of":"2026-08-18T15:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fee50d63845b268d4829712954d4c14dab9e5723ec3cb57e1c480e8aba9d8ee2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:33:40.976796Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T02:04:26.374263Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-08-11T23:48:15.266016Z","title":"Scene- script: Reconstructing scenes with an autoregressive struc- tured language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02193","last_updated":"2025-03-11T05:58:39Z","snapshot_observed_at":"2026-08-17T03:14:47.358032Z","submitted_at":"2024-12-03T06:15:04Z","title":"LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:48:15.266016Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2412.02193"},"observation_digest":"sha256:a78462e63538ceb12fc9fe5e109bbd2d29457053dce6feb03588cad746a742d8","observation_id":"967c1500-952a-46ca-adf0-f0d3bb7486a7","resolution":{"observed_at":"2026-08-11T23:48:15.266016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-08-11T17:08:47.777569Z","title":"Scene- script: Reconstructing scenes with an autoregressive struc- tured language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09401","last_updated":"2025-03-23T17:01:39Z","snapshot_observed_at":"2026-08-17T22:09:41.822296Z","submitted_at":"2024-12-12T16:08:03Z","title":"SLAM3R: Real-Time Dense Scene Reconstruction from Monocular RGB Videos","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:08:47.777569Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2412.09401"},"observation_digest":"sha256:00578919e1e9c0643995699cf2ab1f3392a775576ea363e1ac4c9bee14e8c3f7","observation_id":"aa03ce01-227d-4278-8841-fcb47d9a18e8","resolution":{"observed_at":"2026-08-11T17:08:47.777569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-08-11T11:36:22.473466Z","title":"Scene- script: Reconstructing scenes with an autoregressive struc- tured language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15200","last_updated":"2024-12-19T18:58:46Z","snapshot_observed_at":"2026-08-17T15:49:34.145311Z","submitted_at":"2024-12-19T18:58:46Z","title":"DI-PCG: Diffusion-based Efficient Inverse Procedural Content Generation for High-quality 3D Asset Creation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:36:22.473466Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2412.15200"},"observation_digest":"sha256:91425449557d105eb842955fe4afed846f5d533931cae511592de9ce7c5df8d1","observation_id":"f0f1d431-0761-409d-a8f0-4f7bfb0a9665","resolution":{"observed_at":"2026-08-11T11:36:22.473466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-08-15T18:33:40.976796Z","title":"Scenescript: Reconstructing scenes with an autoregressive structured language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19639","last_updated":"2025-06-24T14:00:31Z","snapshot_observed_at":"2026-08-17T09:48:42.239838Z","submitted_at":"2025-06-24T14:00:31Z","title":"HOIverse: A Synthetic Scene Graph Dataset With Human Object Interactions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:33:40.976796Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2506.19639"},"observation_digest":"sha256:f5a8eed97f024c070df34f135868f6c51319a5d239f432b8d61b2ae28b3f7e36","observation_id":"ac0cfaba-979f-4e17-be02-05eefe0e97e0","resolution":{"observed_at":"2026-08-15T18:33:40.976796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-08-06T22:36:12.691238Z","title":"Frost, Luke Holland, Camp- bell Orme, Jakob Engel, Edward Miller, Richard A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21348","last_updated":"2025-06-26T15:02:00Z","snapshot_observed_at":"2026-08-15T12:46:56.557032Z","submitted_at":"2025-06-26T15:02:00Z","title":"PanSt3R: Multi-view Consistent Panoptic Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:36:12.691238Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2506.21348"},"observation_digest":"sha256:06f1b5d22d3f7287b76b05645a7f636096e0a6143434ec07a3d89b92054d3f9f","observation_id":"749c70f8-4413-4952-b358-978351681e10","resolution":{"observed_at":"2026-08-06T22:36:12.691238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-07-13T17:23:44.758186Z","title":"13064,http://arxiv.org/abs/2403.13064, arXiv:2403.13064 [cs]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.26661","last_updated":"2026-07-01T17:46:52Z","snapshot_observed_at":"2026-08-17T20:13:17.136830Z","submitted_at":"2026-03-27T17:58:05Z","title":"GaussianGPT: Towards Autoregressive 3D Gaussian Scene Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T17:23:44.758186Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2603.26661"},"observation_digest":"sha256:d21cd2a50cdf545a2190915b32112b05bbe20e791b3b27ef47f47bccd8327205","observation_id":"0ee3be2e-b4b5-41ec-9b46-bf4711320178","resolution":{"observed_at":"2026-07-13T17:23:44.758186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":"2403.13064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-07-08T02:04:26.374263Z","title":"Scenescript: Reconstructing scenes with an autoregressive structured language model","venue":"cs.CV","work_id":"e33db30c-4465-4cfd-b71d-1a407bb43dd5","year":2024},"citing_paper":{"arxiv_id":"2605.18214","last_updated":"2026-05-22T16:21:46Z","snapshot_observed_at":"2026-08-15T17:06:21.880959Z","submitted_at":"2026-05-18T10:58:56Z","title":"EgoInteract: Synthetic Egocentric Videos Generation for Interaction Understanding and Anticipation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T11:01:17.353843Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2605.18214"},"observation_digest":"sha256:0fd0559832af8c0214c9ea7ebf7136cc10f0e14ee5bce4141cac62e77d2a1965","observation_id":"0fb3991c-b001-4307-a714-481ecf01a3d7","resolution":{"observed_at":"2026-05-20T11:03:13.576309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":"2403.13064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-07-08T02:04:26.374263Z","title":"Scenescript: Reconstructing scenes with an autoregressive structured language model","venue":"cs.CV","work_id":"e33db30c-4465-4cfd-b71d-1a407bb43dd5","year":2024},"citing_paper":{"arxiv_id":"2605.18214","last_updated":"2026-05-22T16:21:46Z","snapshot_observed_at":"2026-08-15T17:06:21.880959Z","submitted_at":"2026-05-18T10:58:56Z","title":"EgoInteract: Synthetic Egocentric Videos Generation for Interaction Understanding and Anticipation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T06:22:17.582854Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2605.18214"},"observation_digest":"sha256:fe75e3a9ae2c75080caabfb5875489d41b2fb926363b0b148af6260a3d0ea752","observation_id":"da0b08f2-5c64-4bb3-8c10-2a113cea61ee","resolution":{"observed_at":"2026-05-25T06:25:23.745016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model","version":1},"cited_work":{"arxiv_id":"2403.13064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13064","snapshot_observed_at":"2026-07-08T02:04:26.374263Z","title":"Scenescript: Reconstructing scenes with an autoregressive structured language model","venue":"cs.CV","work_id":"e33db30c-4465-4cfd-b71d-1a407bb43dd5","year":2024},"citing_paper":{"arxiv_id":"2607.06560","last_updated":"2026-07-07T17:58:33Z","snapshot_observed_at":"2026-08-15T08:35:30.089617Z","submitted_at":"2026-07-07T17:58:33Z","title":"Vision as Unified Multimodal Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T01:54:30.649092Z"},"links":{"cited_paper":"/paper/2403.13064","citing_paper":"/paper/2607.06560"},"observation_digest":"sha256:3ea208e3e985ca8ea34f8a8801629e4a07587894a6ebb1d0150f8450122c6bf6","observation_id":"fec34e38-0e46-405d-a881-ff6c68e85ed5","resolution":{"observed_at":"2026-07-08T02:04:26.375455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2403.13064/citation-record","integrity":"/paper/2403.13064/integrity","json":"/paper/2403.13064/citation-record.json","paper":"/paper/2403.13064"},"outbound":[],"paper":{"arxiv_id":"2403.13064","last_updated":"2024-03-19T18:01:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T14:08:17.044200Z","submitted_at":"2024-03-19T18:01:29Z","title":"SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2403.13064."}