{"as_of":"2026-08-18T12:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8626ff26b04543a6c209c7c6f5165be571dbbc6fa9d5c41c1d68d96f9cdc3da5","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:23:29.808191Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:54:08.595842Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T14:54:08.690646Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"cited_work":{"arxiv_id":"2411.11934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11934","snapshot_observed_at":"2026-08-11T14:54:08.690646Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","venue":"cs.CV","work_id":"f6e674b8-534e-49e1-a069-68e3f6fdd491","year":2024},"citing_paper":{"arxiv_id":"2412.11512","last_updated":"2024-12-16T07:42:49Z","snapshot_observed_at":"2026-08-15T20:19:09.049099Z","submitted_at":"2024-12-16T07:42:49Z","title":"SpatialMe: Stereo Video Conversion Using Depth-Warping and Blend-Inpainting","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:54:08.595842Z"},"links":{"cited_paper":"/paper/2411.11934","citing_paper":"/paper/2412.11512"},"observation_digest":"sha256:0994b940533d039f7e91a756795e55b8dc0d5be142b7221443f660ab40766491","observation_id":"cbdf4f5b-e590-4fc9-ba0e-4f5896e81dfe","resolution":{"observed_at":"2026-08-11T14:54:08.695650Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11934","snapshot_observed_at":"2026-07-31T23:33:59.264973Z","title":"arXiv preprint arXiv:2411.11934 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23934","last_updated":"2026-07-27T02:11:58Z","snapshot_observed_at":"2026-08-07T14:21:47.373100Z","submitted_at":"2026-07-27T02:11:58Z","title":"DECAF: De-Clustering for Adaptive Representational Unlearning","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-07-31T23:33:59.264973Z"},"links":{"cited_paper":"/paper/2411.11934","citing_paper":"/paper/2607.23934"},"observation_digest":"sha256:f38b214a2b9688e7619b432166b23350b93fd1e521e0a31b5b7acf08608a0a87","observation_id":"2f902a61-79fc-4423-92a8-8c8ec2f2f911","resolution":{"observed_at":"2026-07-31T23:33:59.264973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11934/citation-record","integrity":"/paper/2411.11934/integrity","json":"/paper/2411.11934/citation-record.json","paper":"/paper/2411.11934"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.515914Z","title":"Occlusion refinement for stereo video us- ing optical flow","venue":null,"work_id":"c31c0944-e683-49bc-a707-ccddfb0e284e","year":2012},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.163958Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:53d40d8ac7c710df1ec3b8531f8ccf751f83dffca1e6e1b3afbc8e06baa21775","observation_id":"ceafb5a0-b873-4bcf-b8d3-bdd3582aaefc","resolution":{"observed_at":"2026-08-12T18:23:31.519201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.507339Z","title":"visionos 2 brings new spatial computing experiences to apple vision pro","venue":null,"work_id":"ee0db7cf-aac4-496c-9463-64968fd21908","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.255703Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:8ee15c4195a4fcd06cfdb3d81a4cd40fd307e3b94427f19cb3e1e2ab3ed86779","observation_id":"276cc9ef-d40f-47be-ab3e-08820024941d","resolution":{"observed_at":"2026-08-12T18:23:31.510479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:28.303168Z","title":"Text2live: Text-driven layered image and video editing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.303168Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:533196916e24be74d34bd84084d5c2988743d4dcd71dab3319a4cf8dc86d2702","observation_id":"f8018693-50a1-487f-a0f3-340bb369b955","resolution":{"observed_at":"2026-08-12T18:23:28.303168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.483549Z","title":"Novel view synthesis with view-dependent effects from a single image","venue":null,"work_id":"19d9e176-6999-4615-ab21-760abf59b4d0","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.338552Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:343dc2a8c7300719ccf3be11566a0f28f870dceb83610eef9773f2996a612836","observation_id":"2322ed01-b3ed-4f4a-aea4-e879d6f36451","resolution":{"observed_at":"2026-08-12T18:23:31.496572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.433078Z","title":"Zoedepth: Zero-shot transfer by com- bining relative and metric depth, 2023","venue":null,"work_id":"fb535c6d-38d7-48db-a39f-00d72b3759fe","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.347084Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:b2040ca3bcba4eddc9c3912039e8ed859f4b152d1fa3b3d1553ccb46ff400415","observation_id":"c3717a45-bc2a-45d3-9e36-f4e19e01f10b","resolution":{"observed_at":"2026-08-12T18:23:31.459812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.381798Z","title":"A review of stereo-photogrammetry method for 3-d reconstruction in computer vision","venue":null,"work_id":"fd85d588-0707-4f0c-b559-3219ea440998","year":2019},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.356064Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:6c4d45375955abb6455e9c6418c655058a6f0b302dfeb43abf798092b6bb0030","observation_id":"3a953d08-b03f-4400-8f4a-a59d9dcac24f","resolution":{"observed_at":"2026-08-12T18:23:31.412083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-12T18:23:28.365169Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.365169Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:4f8f5f24b9b5a3e08db45e77cd941cdbe20201d04aa16e3d501532cf5c844fb8","observation_id":"52e97db3-16c8-4758-afbb-0b35f933e8a7","resolution":{"observed_at":"2026-08-12T18:23:28.365169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:28.389696Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.389696Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:1be87220bb5e7b5d93016f84c090bb53b5501551e9af3f77f6495e91124d2e33","observation_id":"abfe866e-7818-44ed-ae61-cb9554cb6c2a","resolution":{"observed_at":"2026-08-12T18:23:28.389696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.367856Z","title":"Large occlusion stereo","venue":null,"work_id":"b5a53f92-3bd6-4dd8-bfa9-93937a40dd41","year":1999},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.393356Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:d1f42cfc1cff849af08cdfea7a844a059c9628382f44951886499c8169a23e48","observation_id":"529847d8-98fb-4dae-b606-2117782393e2","resolution":{"observed_at":"2026-08-12T18:23:31.371333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.358697Z","title":"Video generation models as world simulators","venue":null,"work_id":"500798ca-cc51-4a7b-ae3a-c7b666dea7d1","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.396352Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:2ef909e79691e5f38dd4509f9a0e9bf64edbcbce31948ba35d0242597611087a","observation_id":"6dde1951-be8f-445c-99a3-799c99751ebb","resolution":{"observed_at":"2026-08-12T18:23:31.362140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.347892Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing, 2023","venue":null,"work_id":"41c04e5a-ccac-49e0-96b8-523f132c5172","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.399285Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:5923e0677ed70dfb43def5eefc4e1e7237d72e92fbb31ba83c88d5ea0342c68c","observation_id":"62c9dd30-3188-4363-a184-b92da386f94e","resolution":{"observed_at":"2026-08-12T18:23:31.353317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.338798Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"f1242025-ff9d-4b6b-bd83-1c1259bebe5e","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.402388Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:c289f4e73815d7fced4ca8e56e2d377ebbfec0332ff8c458e284fcf2f0d3cf5d","observation_id":"d6010749-c237-46af-8c96-8c07ee347874","resolution":{"observed_at":"2026-08-12T18:23:31.341975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-08-18T11:39:42.707769Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-12T18:23:28.405448Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.405448Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:1d3774ac30ee48c5b051fe3fae19d6c26c680ed9907f664184d9168c25564ac7","observation_id":"657c0d86-e8e2-4bb9-b5f4-0a7227053879","resolution":{"observed_at":"2026-08-12T18:23:28.405448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14627","last_updated":"2024-07-18T13:10:22Z","snapshot_observed_at":"2026-08-18T09:51:43.724737Z","submitted_at":"2024-03-21T17:59:58Z","title":"MVSplat: Efficient 3D Gaussian Splatting from Sparse Multi-View Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14627","snapshot_observed_at":"2026-08-12T18:23:28.409161Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.409161Z"},"links":{"cited_paper":"/paper/2403.14627","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:19b6456bd11aa71f6ddb68f8087ba72e3f92d4d6add596003222f2f4df066014","observation_id":"45027420-a9a9-4393-9417-4276d41e6488","resolution":{"observed_at":"2026-08-12T18:23:28.409161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.329763Z","title":"Animateanything: Fine- grained open domain image animation with motion guid- ance","venue":null,"work_id":"46ade6f7-44bb-408f-8cc0-41ffec86aff3","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.412066Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:14fc9ba7976e152db5fa42ad3c4725f2861f70c7324e16d8b06e8f2f4560d34b","observation_id":"af0034b1-af0b-4a1f-95a6-333bd24d1964","resolution":{"observed_at":"2026-08-12T18:23:31.333211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.267023Z","title":"Egnal and R.P","venue":null,"work_id":"4e45a8ef-9c29-4ae9-9e67-d83c6875c568","year":2002},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.414986Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:fc3a09071a5b846f648b6e09bb289a4a218854b055c343090de24d8b30c2577b","observation_id":"901220d8-f079-432b-a504-cfde5455a8d1","resolution":{"observed_at":"2026-08-12T18:23:31.305292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:28.418840Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.418840Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:909fb8a1d5f887dfa9d3fbd483d80de52b2e3eb50f472cc30ab4dda58cdf5deb","observation_id":"4893d2aa-67ac-4734-8a3b-7e2fda696ac7","resolution":{"observed_at":"2026-08-12T18:23:28.418840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.253387Z","title":"Dynamic view synthesis from dynamic monocular video, 2021","venue":null,"work_id":"0e3d2602-b593-492b-b2df-c97ff42613ee","year":2021},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.464884Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:56d3acd757641fee306ee62ef5f5222ae4132a2b867c041180067f8b9a523e99","observation_id":"bb1d2e61-ea21-4d6a-a42b-0aaa1e26798f","resolution":{"observed_at":"2026-08-12T18:23:31.256410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:28.553955Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.553955Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:c7b98d4de87324922a0187d7efd26e201b91be2effe53a9d3b560809bad61b1f","observation_id":"1eb6c3d5-e2b6-416d-9c37-c4503ea542bc","resolution":{"observed_at":"2026-08-12T18:23:28.553955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T18:23:28.619614Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.619614Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:dcdd8c2c71c74c89946a44a9caa02ba5a84bef455ae173ba2ecce61652906e65","observation_id":"b7da27d1-0969-47ed-afbc-874079721592","resolution":{"observed_at":"2026-08-12T18:23:28.619614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.239980Z","title":"Single- view view synthesis in the wild with learned adaptive mul- tiplane images","venue":null,"work_id":"cbd702b4-ca97-4bc5-b527-0ebee15ce252","year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.630330Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:a0ce50226bbc20b36170a180121bf9bca9a66e3daa9f1420249335df01fd2b84","observation_id":"efc67e89-9b64-45f5-aab7-0afed6959911","resolution":{"observed_at":"2026-08-12T18:23:31.243081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:28.633644Z","title":"Prompt-to-prompt image editing with cross attention control, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.633644Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:b70a52eb56288b13fee68bba16b905c3abd095bf8449477d27312f6938db7588","observation_id":"cc52de75-a0a5-4d5d-b495-544331d5cc8c","resolution":{"observed_at":"2026-08-12T18:23:28.633644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.227091Z","title":"Video diffu- sion models","venue":null,"work_id":"b38ccfbd-adcf-43a3-9a03-af610cd99293","year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.637083Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:afb03f061dff1b97b55b63c0964ce3bfaca9dc09682786bbc0cae8072313fae4","observation_id":"b591fc0e-8ce3-43b0-8a11-3c214699b44e","resolution":{"observed_at":"2026-08-12T18:23:31.230011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.194979Z","title":"Unifying corre- spondence, pose and nerf for pose-free novel view synthesis from stereo pairs, 2024","venue":null,"work_id":"972b243b-f9b5-40fb-aad8-6de44a8aa2b1","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.641398Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:f84d695a96f0eee4853d4de5f99f29722c3d53c3226994fe577661f8770922c3","observation_id":"2e4106c4-8b3c-47d9-847c-0c7116f17341","resolution":{"observed_at":"2026-08-12T18:23:31.220747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17117","last_updated":"2024-06-13T06:37:20Z","snapshot_observed_at":"2026-08-17T07:05:18.024386Z","submitted_at":"2023-11-28T12:27:15Z","title":"Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17117","snapshot_observed_at":"2026-08-12T18:23:28.644859Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.644859Z"},"links":{"cited_paper":"/paper/2311.17117","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:2bdc6a771909a4a21ad0a0d23f18e891c7c5ec2687e5f13712ceb4983e059968","observation_id":"4829ac92-5406-4c11-9e88-9c6f5d2f3ca0","resolution":{"observed_at":"2026-08-12T18:23:28.644859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02095","last_updated":"2024-11-27T07:59:25Z","snapshot_observed_at":"2026-08-16T18:10:25.611057Z","submitted_at":"2024-09-03T17:52:03Z","title":"DepthCrafter: Generating Consistent Long Depth Sequences for Open-world Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02095","snapshot_observed_at":"2026-08-12T18:23:28.648490Z","title":"Depthcrafter: Generating consistent long depth sequences for open-world videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.648490Z"},"links":{"cited_paper":"/paper/2409.02095","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:b8b8d120099af82087030fbac2dc14f2d86952296cf1a48e1634de92515cea4e","observation_id":"59931eb8-7462-49a6-a1c1-7d4242c97b4a","resolution":{"observed_at":"2026-08-12T18:23:28.648490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.148849Z","title":"Slide: Single image 3d photography with soft layering and depth-aware inpainting","venue":null,"work_id":"bfaae368-bc57-4526-a237-d22e1cfc10e0","year":2021},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.672945Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:403f50641861b95ba72aece47cfe7b0ba647ff184fea7154eaeb88069b23abdf","observation_id":"6d81f4bf-9e2f-4386-b7f0-d2222d601960","resolution":{"observed_at":"2026-08-12T18:23:31.171593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.085828Z","title":"Nvist: In the wild new view synthesis from a single image with transformers, 2024","venue":null,"work_id":"9d479e91-0da0-42e7-9be5-c147104b55d7","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.772245Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:f1a36f1f7fa13a004dc9c9670c6ab8595b1f884403d949b155a66bc2467f9ab8","observation_id":"385ed237-fac1-489d-a00e-e69876dc8487","resolution":{"observed_at":"2026-08-12T18:23:31.123306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.066415Z","title":"Ocai: Improving optical flow estimation by occlusion and consistency aware interpolation, 2024","venue":null,"work_id":"8ee42f07-61e2-4cff-83be-42bdc75cb3ac","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.843911Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:242c69ca9bb2b8b90f7c99e10d4e935c06388c6b4adcce4a99adc18b3b06f7a3","observation_id":"c8d0ffbf-cb89-45ee-8ca5-e9f56e01ccc5","resolution":{"observed_at":"2026-08-12T18:23:31.069707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.057044Z","title":"Multi-view stereo reconstruction of dense shape and complex appear- ance","venue":null,"work_id":"0827c20d-d8cd-4a45-a5d7-07e44a5ae648","year":2005},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.870177Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:1a9a494dab2f6ca0051b0b6a938168f1f67824b8aa79f689e9c455118949f761","observation_id":"9db273a6-09d9-4b94-9f30-80f3b9fe41ed","resolution":{"observed_at":"2026-08-12T18:23:31.060245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.048399Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation, 2024","venue":null,"work_id":"312f85c1-7d58-4149-9ad3-69c4a73db06b","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.873788Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:3fc2ef9a4db80836ccde36e378a3bbea1ea6bfef1672b3a0f7bf1809e70c7e5c","observation_id":"2a4193cd-d55f-4101-a54b-4e985489f14b","resolution":{"observed_at":"2026-08-12T18:23:31.051568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:28.877382Z","title":"3d gaussian splatting for real-time radiance field rendering, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.877382Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:378eb1606182f9337c6f8d4fe0f2e2ca9d0bac4cc9292bd0027b674c61433b5e","observation_id":"8a955abf-45f0-45b0-8842-8cea54d7e014","resolution":{"observed_at":"2026-08-12T18:23:28.877382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-16T15:45:51.619614Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-08-12T18:23:28.881946Z","title":"Text2video-zero: Text-to- image diffusion models are zero-shot video generators.arXiv preprint arXiv:2303.13439, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.881946Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:76d9bbda96b71f97c89546ae00984a82316f331a30144407f620ede2785c25ba","observation_id":"15f5d577-1d82-4602-a471-1084981ad86c","resolution":{"observed_at":"2026-08-12T18:23:28.881946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14125","last_updated":"2024-06-04T17:25:20Z","snapshot_observed_at":"2026-08-14T12:12:01.418974Z","submitted_at":"2023-12-21T18:46:41Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14125","snapshot_observed_at":"2026-08-12T18:23:28.950090Z","title":"Videopoet: A large language model for zero-shot video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.950090Z"},"links":{"cited_paper":"/paper/2312.14125","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:a988544c7fea683d4d7e04296384bafab3b090811a0bca7fd3e7d140d58b269b","observation_id":"c577559c-7abc-4630-9b4b-9fe2d836556b","resolution":{"observed_at":"2026-08-12T18:23:28.950090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.034173Z","title":"Learning blind video temporal consistency","venue":null,"work_id":"43590fb1-5417-4697-9e58-4a05b6a1be26","year":2018},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.016123Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:d5a76020f8879e8accee57d0c47a0d2db3582893ed7d16299b4eee4f4d247ec2","observation_id":"49617a81-59e8-4a0b-8a18-a7d322ed1636","resolution":{"observed_at":"2026-08-12T18:23:31.037535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12091","last_updated":"2025-04-26T13:48:44Z","snapshot_observed_at":"2026-08-13T22:43:20.403436Z","submitted_at":"2024-12-16T18:58:17Z","title":"Wonderland: Navigating 3D Scenes from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12091","snapshot_observed_at":"2026-08-12T18:23:29.029978Z","title":"Wonderland: Nav- igating 3d scenes from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.029978Z"},"links":{"cited_paper":"/paper/2412.12091","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:6348bfcff060874e7f1653ae1dca10270fcae295308c919af224f1330e24b477","observation_id":"3d15e891-22c5-47ea-9789-364ba94ea5fd","resolution":{"observed_at":"2026-08-12T18:23:29.029978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.025514Z","title":"Infinite na- ture: Perpetual view generation of natural scenes from a sin- gle image","venue":null,"work_id":"e0e3d76a-3469-4bc2-84ab-b69db1894c81","year":2021},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.033277Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:52de322fed6e20ac5f6bfe9c6d6a1916f37a5eb9973d5f687334dcd13496292f","observation_id":"81ea83e6-9774-420e-bb27-2d9a523c9800","resolution":{"observed_at":"2026-08-12T18:23:31.028639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:31.016343Z","title":"Sora: A review on background, technology, limitations, and opportunities of large vision models, 2024","venue":null,"work_id":"2fb6cbe9-8678-4b08-82c1-89ff482a7e78","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.036187Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:b1fb635b7b0dc2a3b7bac464eb7dd5609deb9dc7c34a868c9573b931a518ffcf","observation_id":"97330e72-d84d-47a1-9c6d-2d9aa7e31a70","resolution":{"observed_at":"2026-08-12T18:23:31.020002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T18:23:29.039914Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.039914Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:85979d5e50616d61005d7e5787d2f7aa51678cac886eb6c16cc27f700f16a05c","observation_id":"41007831-efb0-4788-a8da-3d7918b4f045","resolution":{"observed_at":"2026-08-12T18:23:29.039914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.871949Z","title":"Cohen, Bryce Evans, Johannes Kopf, and Richard Szeliski","venue":null,"work_id":"60a6e76b-b1fc-4b47-8c85-1d54bbcd0f2f","year":2017},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.042895Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:4438dcd837e11de2195b50c6c404a6d6093b0bd06f020ee2f075c0d2d335cc2d","observation_id":"e436741a-68a9-4b24-9152-4065b3a07299","resolution":{"observed_at":"2026-08-12T18:23:30.950920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.046358Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.046358Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:e4de8b1d59163cf7b00dfc6b3871415b3c30963024ee40a6b79b0d731e69da30","observation_id":"01273665-cebb-4d9c-85b7-872a1258fac5","resolution":{"observed_at":"2026-08-12T18:23:29.046358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.834503Z","title":"Multidiff: Consistent novel view synthesis from a single image","venue":null,"work_id":"04a47584-b245-44db-b5e3-077608b56d01","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.049562Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:7659b6e7d08a339a9d9103a0d76c3b4a9f8050ed53c596d7d1473eb909b1c01e","observation_id":"18fdff81-b3e2-44f3-a6c9-9d79590f04e1","resolution":{"observed_at":"2026-08-12T18:23:30.837907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.825344Z","title":"Softmax splatting for video frame interpolation, 2020","venue":null,"work_id":"7411f2a8-d04f-4baa-a73d-c56baf43aff0","year":2020},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.052902Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:ec6aac143d5b7ba5b093e033363c844d73c5de80dcc28b34b57a62c2a0a83647","observation_id":"eb379b81-4a7c-49e1-9131-62b7fd45efad","resolution":{"observed_at":"2026-08-12T18:23:30.828694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.817343Z","title":"What is spatial video on iphone 15 pro and vision pro","venue":null,"work_id":"d203711c-9e69-480f-b38e-6cfd22cd580b","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.056089Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:fe281669a2faf5f610a3b71db74d1ca11ba0afb64375c697cba2654bdc78539e","observation_id":"4d9dd7fc-c55e-40f1-b02f-6aa56e76e148","resolution":{"observed_at":"2026-08-12T18:23:30.820418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07926","last_updated":"2024-12-12T06:08:32Z","snapshot_observed_at":"2026-08-16T15:08:17.629067Z","submitted_at":"2023-08-15T17:59:56Z","title":"CoDeF: Content Deformation Fields for Temporally Consistent Video Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07926","snapshot_observed_at":"2026-08-12T18:23:29.059142Z","title":"Codef: Content deformation fields for temporally consistent video processing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.059142Z"},"links":{"cited_paper":"/paper/2308.07926","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:b93443879c1dade4e0ef1c1ffc049ac13d15b5e909c3caf0660ac068974e2e9f","observation_id":"d6ebd4f0-0186-4018-a04e-6fe986942140","resolution":{"observed_at":"2026-08-12T18:23:29.059142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.062454Z","title":"A survey of structure from motion*","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.062454Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:9a79b8af365bb22109fe7e817a6fb3d6e21b78639b000370be1795d86f3a5fce","observation_id":"4b5ee844-1e44-45cb-a84b-96fa2f53aead","resolution":{"observed_at":"2026-08-12T18:23:29.062454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.803949Z","title":"Sinmpi: Novel view synthesis from a single image with expanded multiplane images, 2023","venue":null,"work_id":"4fa0a139-df53-4d4a-997d-b1bb43ee9c65","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.065103Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:f2b7dcc51b6ff3c3020d19a3d4445e86cdcf31410defbc92a137d3a8d6ab267a","observation_id":"f1394ad2-9d82-4b48-bb86-c6fba4e9cb4f","resolution":{"observed_at":"2026-08-12T18:23:30.806919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-08-16T15:47:37.197317Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-12T18:23:29.068327Z","title":"Fatezero: Fus- ing attentions for zero-shot text-based video editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.068327Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:40ad246bbd59c95c32266a282dc9488d1d333579de7955e22ff9679fc132903d","observation_id":"9be588ca-4640-4966-a141-b2650ae046f1","resolution":{"observed_at":"2026-08-12T18:23:29.068327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.795348Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross-dataset transfer","venue":null,"work_id":"97c49595-3a9a-4b81-baee-574f99558afc","year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.126428Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:1a0ff92b23326b7d90df1380633c0b25d7b94b4d4729bb6371d7f8c4b5264264","observation_id":"8213a01d-3348-4874-a96c-4d8b6cc2631d","resolution":{"observed_at":"2026-08-12T18:23:30.798599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.193024Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.193024Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:f6c0906d953efd4b1826175e48b9ec4cd889ad5eb47032adabbcffc8169952e3","observation_id":"6f2e28c1-1261-4470-b452-7dc454d4d287","resolution":{"observed_at":"2026-08-12T18:23:29.193024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.611528Z","title":"A survey of image labelling for computer vision applications","venue":null,"work_id":"bfc5443a-c311-4c57-b1c1-b0b1f23fc327","year":2021},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.200249Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:245e36d5d2812f93c8302daeecfb881456a4b3db94c6fb5502996ec055e93647","observation_id":"dae9a8da-1fd5-466b-8017-7a12bdc6e081","resolution":{"observed_at":"2026-08-12T18:23:30.701381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.554434Z","title":"Scharstein","venue":null,"work_id":"fceb5f7c-36a6-430c-a19d-e337f14c5674","year":1999},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.203499Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:82325f6b1f0769f0e6e2875c34861838fe66c3b2dfefb40fc871dd06f0716381","observation_id":"de2ce403-759e-494b-9740-bc7ed7985a59","resolution":{"observed_at":"2026-08-12T18:23:30.557304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.545290Z","title":"Structure- from-motion revisited","venue":null,"work_id":"aef57d53-5a08-45b9-a64c-a268c879f8dd","year":2016},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.207289Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:b30f2f017e5af26af5fe5afebbbc2955b6b51f705cd3e1255f307329b4885f8b","observation_id":"2e965654-174d-445c-88fd-f1d4f66ea7f8","resolution":{"observed_at":"2026-08-12T18:23:30.548706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.536964Z","title":"Seitz, B","venue":null,"work_id":"d224476f-38ae-4153-9e41-156a5c1ad057","year":2006},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.210340Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:6da49611a83e16ec22031d93dc1a098d256376be05c0794a8188ec02fc14e0b5","observation_id":"3772ef6d-5bc4-494b-b69f-8afe55a2848f","resolution":{"observed_at":"2026-08-12T18:23:30.539870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.528416Z","title":"Self-supervised vis- ibility learning for novel view synthesis.*","venue":null,"work_id":"1138668c-4081-4278-9acb-8130b354984d","year":2021},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.213831Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:1f888706f6f8a3fcc9b807e9ad55f169217aec5420f494361959af443b8a79ad","observation_id":"772502d6-d96b-4d44-a7ba-f7b3fec2b6c0","resolution":{"observed_at":"2026-08-12T18:23:30.531806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.518534Z","title":"3d photography using context-aware layered depth 10 inpainting","venue":null,"work_id":"b6b8b5f6-6c39-47b0-8e28-b270237c8295","year":2020},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.216755Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:90f2f0cfac2433a6821c6292d207f97e1ed7373cf41027b75e1b93a4ce40bdfd","observation_id":"5618a177-d572-4dc6-9ee0-ea377666917d","resolution":{"observed_at":"2026-08-12T18:23:30.522562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-12T18:23:29.219992Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.219992Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:12b2bc5c97206cf498d2e640b486f69d8181f137a2ee101044704d859f1c0770","observation_id":"813acacd-b30a-476c-bd4c-54338b6cbf3e","resolution":{"observed_at":"2026-08-12T18:23:29.219992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.509157Z","title":"Train stable diffusion for inpainting, 2023","venue":null,"work_id":"9d1a94f5-d93a-4c08-acb2-cbea64db0261","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.223560Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:a9baa7687e77af4c7cf16044cb1c3ab55d72e985c134fca4e8dcb2802f1aed93","observation_id":"f2a36b54-bbee-41f1-84b4-482b585a9f51","resolution":{"observed_at":"2026-08-12T18:23:30.512486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.498600Z","title":"An overview of free view-point depth- image-based rendering (dibr)","venue":null,"work_id":"6fa75d27-c906-41fd-827b-a21b5cad3e83","year":2010},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.277138Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:cfbe6734f5c1ad70400e756a82dbcfa3d37789826438e9b73bbd1f99938866b0","observation_id":"f453b7cd-0d20-4056-b434-60dbbd03c18a","resolution":{"observed_at":"2026-08-12T18:23:30.502055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.344212Z","title":"Raft: Recurrent all-pairs field transforms for optical flow, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.344212Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:24b3233e302eaf72198af6a8df5ecc4f852010be5c399c314b18ec84b07e4496","observation_id":"b63b43eb-76e9-4a71-bcbb-f4177eeb1866","resolution":{"observed_at":"2026-08-12T18:23:29.344212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.410306Z","title":"Single-view view synthe- sis with multiplane images","venue":null,"work_id":"19b171e9-8a33-4e8e-9c03-7e1c95c2db19","year":2020},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.435741Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:6f9b8d63175780eef188474f1279a48cbc190d93c786e065d5badcd47d8ad8c7","observation_id":"51d9f583-3cc8-40d8-8b3e-46174badf724","resolution":{"observed_at":"2026-08-12T18:23:30.479067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.335772Z","title":"FVD: A new metric for video generation","venue":null,"work_id":"f88d1b20-1bc8-4fde-a1be-ea96d32ad245","year":2019},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.462200Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:2be4fe3dcc19275eb8ab89e2783c588b78bf545c4761fc691d97a7c6df078528","observation_id":"b90bef14-6380-40a8-98b0-a130a2877a33","resolution":{"observed_at":"2026-08-12T18:23:30.338393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.327288Z","title":"Generative camera dolly: Ex- treme monocular dynamic novel view synthesis","venue":null,"work_id":"cd32fdfa-274b-4c83-99e4-4ab8a63683a8","year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.469847Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:a1d138936b113a633651f8f798c88c0a4d11e18f6e10bb9c5280577e88b984e4","observation_id":"0200c928-203d-4d55-bd0a-f6be82806d6e","resolution":{"observed_at":"2026-08-12T18:23:30.330311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.473137Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.473137Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:18ccb7983ae364b057ae7c002bd41f2cbbf0e2680b257983a9427d25950acb86","observation_id":"73f5744f-0dfb-45b6-a03e-66ba4979987c","resolution":{"observed_at":"2026-08-12T18:23:29.473137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17599","last_updated":"2024-01-04T01:30:50Z","snapshot_observed_at":"2026-08-16T15:43:58.927323Z","submitted_at":"2023-03-30T17:59:25Z","title":"Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17599","snapshot_observed_at":"2026-08-12T18:23:29.477013Z","title":"Zero-shot video editing using off-the-shelf image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.477013Z"},"links":{"cited_paper":"/paper/2303.17599","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:a98745b6f95693050ae5292faf9af85f9fec17841eb76356ed82cfbb927223c4","observation_id":"00b5c380-f6fe-4d73-add1-75dade7dfa0c","resolution":{"observed_at":"2026-08-12T18:23:29.477013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10781","last_updated":"2023-02-21T16:18:40Z","snapshot_observed_at":"2026-08-16T15:53:47.710574Z","submitted_at":"2023-02-21T16:18:40Z","title":"Learning 3D Photography Videos via Self-supervised Diffusion on Single Images","version":1},"cited_work":{"arxiv_id":"2302.10781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.10781","snapshot_observed_at":"2026-08-12T18:23:29.872038Z","title":"Learning 3D Photography Videos via Self-supervised Diffusion on Single Images","venue":"cs.CV","work_id":"ae4186fe-b793-4bd7-92a1-252b16ee4997","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.481254Z"},"links":{"cited_paper":"/paper/2302.10781","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:071c85744ed62e3e85baf742e3d396a6c7f1b9f3d53557681eab88ea9ca82a09","observation_id":"2e3ea1b5-201d-456d-9fb4-9900f5c28690","resolution":{"observed_at":"2026-08-12T18:23:29.970231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.559780Z","title":"Videocomposer: Compositional video synthesis with motion controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.559780Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:f0be7fa420a304bd92d50abf0bef68f13b7b74c36714658c2ae5b46ca609fc3d","observation_id":"91976252-60bb-4040-a0ee-a3170a9ec5f5","resolution":{"observed_at":"2026-08-12T18:23:29.559780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.605573Z","title":"Photo wake-up: 3d character animation from a single photo","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.605573Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:56e3c4c42a6471297c22f231aea886fda3b59a952e70c70d010a39f16738bab3","observation_id":"c2e5b732-48bf-4a84-9876-307c4416631f","resolution":{"observed_at":"2026-08-12T18:23:29.605573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.303489Z","title":"Synsin: End-to-end view synthesis from a sin- gle image","venue":null,"work_id":"388c1402-5251-4cd6-8f60-121c682ccb79","year":2020},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.704438Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:a6efd3e1907316016f5a2a5c2b63e3e1800ae5fc4f48598104fd2ee868e3ea1e","observation_id":"7c1df035-8f79-491d-919b-27974fab02f5","resolution":{"observed_at":"2026-08-12T18:23:30.307007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.294783Z","title":"Image dis- tortions in stereoscopic video systems","venue":null,"work_id":"33192452-c873-4e5c-839d-d0bafd59b2db","year":1915},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.738823Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:210b589cfef8d6110ce0a7f3e3ef82d35f578648a7887d9d6c7d7fd1fae7e5aa","observation_id":"4fef1ae8-c19d-4037-b2a2-1504fe7510aa","resolution":{"observed_at":"2026-08-12T18:23:30.297693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.761847Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.761847Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:2384c7971ca94945309ed824164be0ed34be1a14ffcbaef2e0ab6af4fd5b531d","observation_id":"e86ac412-7bea-4d53-960c-a046100c98f4","resolution":{"observed_at":"2026-08-12T18:23:29.761847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.279323Z","title":"Sinnerf: Training neural radiance fields on complex scenes from a single image, 2022","venue":null,"work_id":"0ba59541-aff2-4633-b533-15615faa3ab1","year":2022},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.781211Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:00f52b9ce1a261dd498930689f70d6453d46e7538f738667735198c7722cfd76","observation_id":"efa878b6-7d6e-41d0-937a-efd97fabd651","resolution":{"observed_at":"2026-08-12T18:23:30.282824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:29.784625Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.784625Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:45b2a5be862488784aa8ead3222c2ec905b91a4b8ea13b91fa2ef5639339b60f","observation_id":"3c95e0fe-2325-415d-bf9f-c7c2fc3c7ea9","resolution":{"observed_at":"2026-08-12T18:23:29.784625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15364","last_updated":"2025-04-02T06:16:43Z","snapshot_observed_at":"2026-08-16T13:49:50.475377Z","submitted_at":"2024-05-24T08:56:19Z","title":"NVS-Solver: Video Diffusion Model as Zero-Shot Novel View Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15364","snapshot_observed_at":"2026-08-12T18:23:29.788012Z","title":"Nvs-solver: Video diffusion model as zero-shot novel view synthesizer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.788012Z"},"links":{"cited_paper":"/paper/2405.15364","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:4e689dedbd8239882c1fbfc6a2309ecb9aabdc717e51acb0197400cc5828a96d","observation_id":"e1986508-f48a-4a54-bee8-404f0e97622f","resolution":{"observed_at":"2026-08-12T18:23:29.788012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.263475Z","title":"Yu, Fereshteh Forghani, Konstantinos G","venue":null,"work_id":"2757b76c-7522-44fc-8c1d-8e30855ebc24","year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.791826Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:988b3cde7feea1a180ed868a1afa2bde3edd4c993c02492bf5ea8aa2e032a4cf","observation_id":"af4bfcf5-0def-4247-bc1c-e51f94674a67","resolution":{"observed_at":"2026-08-12T18:23:30.266620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.252326Z","title":"Stereoscopic video synthesis from a monoc- ular video","venue":null,"work_id":"4a85036a-7cc7-456e-b52b-06ad8441ad0c","year":2007},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.794563Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:521e1d4ba2f48afb7cac8c67f1c628c55fd9f85af9cedb58f1dc95b4b01fde57","observation_id":"3334a911-e09f-41bb-932d-86e5a9ef127f","resolution":{"observed_at":"2026-08-12T18:23:30.255897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17098","last_updated":"2023-11-28T02:37:16Z","snapshot_observed_at":"2026-08-16T15:29:13.668313Z","submitted_at":"2023-05-26T17:13:55Z","title":"ControlVideo: Conditional Control for One-shot Text-driven Video Editing and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17098","snapshot_observed_at":"2026-08-12T18:23:29.797826Z","title":"Controlvideo: Adding conditional control for one shot text-to-video editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.797826Z"},"links":{"cited_paper":"/paper/2305.17098","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:534337b9f4082800e0a0b8516636ceefe0eb15abeb3b2672a27eed06680651a4","observation_id":"136b52c3-b240-4363-b338-05a48f47c215","resolution":{"observed_at":"2026-08-12T18:23:29.797826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-08-16T00:52:41.730888Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-12T18:23:29.801413Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.801413Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:93e7670f888e50c60b8f8bc6424bbadcc68a5743ef6b5f988f33bcfcd1f1a359","observation_id":"5a45afbd-42c3-49a4-8b0d-4ae8b5f6c8b0","resolution":{"observed_at":"2026-08-12T18:23:29.801413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.239767Z","title":"Visual Comparison with Other Methods More results of comparison with other methods are shown in Figure 9","venue":null,"work_id":"66342755-977b-404a-81c2-8ff636c8921f","year":null},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.804812Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:8d2128ed5c9a23517ab759d353e2fe01572c7ee6b225cbf49d4b138b3d93aa32","observation_id":"dfb73e8d-306d-48b8-a686-50fb37419aa6","resolution":{"observed_at":"2026-08-12T18:23:30.243707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:23:30.138039Z","title":"compare to others","venue":null,"work_id":"319f4efe-bab0-464d-a861-e16a3bf71c33","year":null},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:29.808191Z"},"links":{"citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:1ed0ab2ca9947ce27b6c23bae5d5356cc113fc0c145b4cb16b78f663bc25d521","observation_id":"fa73b300-b268-4fdb-a9b7-e5bbeb8b03b2","resolution":{"observed_at":"2026-08-12T18:23:30.215293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 2 inbound Pith citation observations for arXiv:2411.11934."}