{"as_of":"2026-08-09T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:36097ca756087d6b91831060d1371d35af20b548cdcd6b5ef76ccc3326663fc0","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:17:22.812496Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T07:08:45.182462Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T07:12:28.594370Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"cited_work":{"arxiv_id":"2512.14236","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.14236","snapshot_observed_at":"2026-07-10T02:19:33.992432Z","title":"arXiv preprint arXiv:2512.14236 (2025)","venue":null,"work_id":"2b343793-7784-4659-bdcb-d402a5e7da4a","year":2025},"citing_paper":{"arxiv_id":"2605.12169","last_updated":"2026-05-12T14:16:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T14:16:47Z","title":"UniFixer: A Universal Reference-Guided Fixer for Diffusion-Based View Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T07:08:45.182462Z"},"links":{"cited_paper":"/paper/2512.14236","citing_paper":"/paper/2605.12169"},"observation_digest":"sha256:87f05d02f93741aed817f67701594c48df9f1f68a3272adba1c44338dee0212d","observation_id":"c7595fbe-6a83-4dab-a7a5-762414a21190","resolution":{"observed_at":"2026-07-10T02:19:33.992432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.14236/citation-record","integrity":"/paper/2512.14236/integrity","json":"/paper/2512.14236/citation-record.json","paper":"/paper/2512.14236"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:16.439371Z","title":"Lumiere: A space-time diffu- sion model for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.439371Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:ddb31f4d0b2ffeb0f561da483941f4e459656a562c3d5ea310ca09e836c86a1d","observation_id":"fb105b47-2eab-4bef-bcf0-301e32303068","resolution":{"observed_at":"2026-08-03T16:17:16.439371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:16.615720Z","title":"Visual competi- tion.Nature Reviews Neuroscience, 3(1):13–21, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.615720Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:24c0fc2ef8929406b52a18279e00521fb8e0da7dca3cfdf064af23f6a89f599b","observation_id":"9de5960b-d6f4-4772-a4af-7d6788364b39","resolution":{"observed_at":"2026-08-03T16:17:16.615720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-03T16:17:16.732660Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.732660Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:c5ae40040f907986ad53cbc157923f35a6b8357a8afd9a2037fe0900bb9360bf","observation_id":"64d7bba1-95eb-463a-8790-69038fee8925","resolution":{"observed_at":"2026-08-03T16:17:16.732660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-03T16:17:16.862067Z","title":"Depth Pro: Sharp monocular metric depth in less than a second.preprint arXiv:2410.02073, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.862067Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0d539e8af822ce733e6523dd6773762368e158b3bb2778c355ee3b404e5a284d","observation_id":"bb7827fe-7617-415d-880e-304b32eb99a1","resolution":{"observed_at":"2026-08-03T16:17:16.862067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:16.977305Z","title":"B Breese","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.977305Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:8f302d8cbc2ecad87a801dd5b3c243fd51c32269abbd53baf71133579dc5f378","observation_id":"27c2547d-01a7-452c-b269-1d020cbcf58d","resolution":{"observed_at":"2026-08-03T16:17:16.977305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.039606Z","title":"Com- parison of three different methods to merge multiresolution and multispectral data- landsat TM and SPOT panchromatic","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.039606Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d8d4c3a9a126103cd7ee9b683b3a40996ab0590a2f94e359f9948915adc29cd1","observation_id":"22578f75-77a6-4466-84fe-37e8fef5ab7e","resolution":{"observed_at":"2026-08-03T16:17:17.039606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.096210Z","title":"SVG: 3d stereoscopic video generation via denoising frame matrix","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.096210Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:31d0dc35332d3988072b2fc01ebf37cddc4b9c79839a97e5c74a09dd1d7b05c0","observation_id":"63a01113-d59d-4fdb-a851-754f0ca52196","resolution":{"observed_at":"2026-08-03T16:17:17.096210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.156838Z","title":"Guided super-resolution as pixel-to-pixel transformation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.156838Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:17a0a04b5be2d763a038aa1871f1d5989ae67bcee085c54965b74a9049dc1b08","observation_id":"715c9acb-3416-4023-9865-25f81d48c93d","resolution":{"observed_at":"2026-08-03T16:17:17.156838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.235419Z","title":"DeDoDe v2: Analyzing and improving the DeDoDe keypoint detec- tor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.235419Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:47924d84f62cbd77c685d3fe6bfa3e6ff532d00fa8e5987ad02b1df8cdac01d4","observation_id":"5c0521e4-5000-4451-9731-87e617e9fe6d","resolution":{"observed_at":"2026-08-03T16:17:17.235419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.289927Z","title":"Depth-image-based rendering (DIBR), compression, and transmission for a new approach on 3D- TV","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.289927Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0645cb9c461dbb4aa0c97cab8448714b0b0be59062eae42a07b118fe6b246b00","observation_id":"fd377fc3-9c68-4e9d-8646-453a9479a3c6","resolution":{"observed_at":"2026-08-03T16:17:17.289927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-03T16:17:17.352134Z","title":"An image is worth one word: Personalizing text-to-image gen- eration using textual inversion.preprint arXiv:2208.01618,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.352134Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:09a62883c511879eae61dd04a4e0e0fac4f867a0beb274478d99b6b54494104e","observation_id":"76716a05-873f-44a2-8474-2b31d118f3a3","resolution":{"observed_at":"2026-08-03T16:17:17.352134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.434590Z","title":"Fine-tuning image-conditional diffusion models is easier than you think","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.434590Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:a3adc683cd224890f0d56afacc443c0219122581f962e65a2b2309653ab927e1","observation_id":"ed9bf1f9-293f-4996-be1e-df878d5cf4ce","resolution":{"observed_at":"2026-08-03T16:17:17.434590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00135","last_updated":"2025-04-30T19:06:09Z","snapshot_observed_at":"2026-08-07T23:31:53.516680Z","submitted_at":"2025-04-30T19:06:09Z","title":"Eye2Eye: A Simple Approach for Monocular-to-Stereo Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00135","snapshot_observed_at":"2026-08-03T16:17:17.483150Z","title":"Eye2Eye: A simple approach for monocular-to-stereo video synthesis.preprint arXiv:2505.00135, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.483150Z"},"links":{"cited_paper":"/paper/2505.00135","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:8eb33eea04682885fdda8f4caa65745ecadba47880bd542e8b81941cb39f33f7","observation_id":"85292eb6-2fc4-4899-9a7c-ad44c0e93fd5","resolution":{"observed_at":"2026-08-03T16:17:17.483150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.544576Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.544576Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:5f49a9a274cf9b021d0d9bdc477269d46d3af7da4d08cd140759af10e9d33643","observation_id":"80a7ded6-5235-4fc6-ab7a-5d05d461ff80","resolution":{"observed_at":"2026-08-03T16:17:17.544576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.613919Z","title":"Epipolar transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.613919Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:ba59d6f71ba83aed26a1faa35052dcb0c085ccb802e26e404ea63dcf3e3910fc","observation_id":"5265fad0-b443-4101-9736-d07a23fae3fc","resolution":{"observed_at":"2026-08-03T16:17:17.613919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.729321Z","title":"Denoising diffu- sion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS), 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.729321Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:14804257451628522cbcb58b1705db146a958515a711190bdc87bcff086d5a8f","observation_id":"1aeb6f08-af3b-4119-b3b6-6016806a7f20","resolution":{"observed_at":"2026-08-03T16:17:17.729321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.855561Z","title":"Video dif- fusion models.Advances in Neural Information Processing Systems (NeurIPS), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.855561Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f4dc724d6dfbe935dd7557f253e84353bd9902f48b96887276761dca8021b60b","observation_id":"8516e5fc-1ae8-4654-bc43-43c6a328df9f","resolution":{"observed_at":"2026-08-03T16:17:17.855561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.980816Z","title":"DepthCrafter: Generating consistent long depth sequences for open-world videos","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.980816Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:660558ef4dfa29ba43ba7873b5579392390572928c27a71f16a6939b66e5ba7c","observation_id":"fe651e3e-49e6-4778-9bbf-9d7d41c194ec","resolution":{"observed_at":"2026-08-03T16:17:17.980816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06023","last_updated":"2025-06-06T12:14:24Z","snapshot_observed_at":"2026-08-08T15:12:16.165491Z","submitted_at":"2025-06-06T12:14:24Z","title":"Restereo: Diffusion stereo video generation and restoration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06023","snapshot_observed_at":"2026-08-03T16:17:18.025399Z","title":"Restereo: Diffusion stereo video generation and restoration.preprint arXiv:2506.06023, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.025399Z"},"links":{"cited_paper":"/paper/2506.06023","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:ce5fcc8c5f23f3b27c814259560cb1104ff36837a066db348a5faa3b0ce19bbc","observation_id":"545aadc6-9c74-4981-a4ba-32fbf5e2eeeb","resolution":{"observed_at":"2026-08-03T16:17:18.025399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.082930Z","title":"EpiDiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.082930Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:68d7764986a8acb42613d8bf342c9d369cb35c0a7cd6bd714f4e4bc6095dde58","observation_id":"97e97984-bf2c-41a1-a342-fdefa4dddaf5","resolution":{"observed_at":"2026-08-03T16:17:18.082930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.145435Z","title":"Depth map super-resolution by deep multi-scale guidance","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.145435Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:264abb0d9e96362477c0606f3983fbf9f47ed4140c18d18e3f5eb03e67f7c84a","observation_id":"83bcd1a3-ccc8-490e-8e1e-483cb0dec240","resolution":{"observed_at":"2026-08-03T16:17:18.145435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.195255Z","title":"Izadimehr, Milad Ghanbari, Guodong Chen, Wei Zhou, Xiaoshuai Hao, Mallesham Dasari, Christian Tim- merer, and Hadi Amirpour","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.195255Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:87b2aa3e4224cb4b21d06dbc3204d658e83daa3f7b08f1462ec1d1dca0066793","observation_id":"ac264673-e5df-4f7a-8967-585be8ff6478","resolution":{"observed_at":"2026-08-03T16:17:18.195255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.280775Z","title":"Stereo4D: Learning how things move in 3d from internet stereo videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.280775Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b7c3b2ec2a46a04f8555260a7d63b7923372b28ea4a0270d97c024e4d825d989","observation_id":"c272b1aa-d3e3-416f-8056-dd25c687a6f4","resolution":{"observed_at":"2026-08-03T16:17:18.280775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.385089Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.385089Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:8c987393be251913137081ad018fa054779e7dce84e8dab0dea43c56139ffafa","observation_id":"264e5009-a95f-4701-b00e-e0b41567d49d","resolution":{"observed_at":"2026-08-03T16:17:18.385089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.520057Z","title":"Marigold: Affordable adaptation of diffusion- based image generators for image analysis.IEEE Transac- tions on Pattern Analysis and Machine Intelligence (TPAMI),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.520057Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:571a149165ee1812028bd5181a994b46e4e9a52bafa47eefbc32f1e5f302b03a","observation_id":"98b6a010-1dc2-4e80-a420-644273ac2e73","resolution":{"observed_at":"2026-08-03T16:17:18.520057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.618519Z","title":"Auto-encoding varia- tional bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.618519Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:1e011b017a3a6c9b6f6fba1206962c42c60ea33ca15424e1aa5686aba1c45677","observation_id":"5decf424-6de9-4acb-b711-95204ee03c07","resolution":{"observed_at":"2026-08-03T16:17:18.618519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.680289Z","title":"2d-to- 3d image conversion by learning depth from examples","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.680289Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:707dbb8ce132134bf08bb20a9583703a4c6eb6f3890874273dc16f3326165e2a","observation_id":"e2d4b83c-68e5-43dc-a691-7cb95470fa90","resolution":{"observed_at":"2026-08-03T16:17:18.680289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.721481Z","title":"Visual discomfort of 3D TV: Assessment methods and modeling.Displays, 32(4):209–218, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.721481Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:e979e76f8a4fc58e782814b309bac8e2a39e6d2b58b6ee7681e16931d28d04db","observation_id":"ff646d38-18f3-49b9-8ce8-f758d6ac9721","resolution":{"observed_at":"2026-08-03T16:17:18.721481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.777527Z","title":"Stereo conversion with disparity-aware warping, compositing and inpainting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.777527Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:675f23a75bc8c8417d3b152f44679294a6ce76065c7fc547517f64dfd7bbd4cf","observation_id":"21293917-b73e-4148-816d-29f345a35777","resolution":{"observed_at":"2026-08-03T16:17:18.777527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.875791Z","title":"Guided depth super-resolution by deep anisotropic diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.875791Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:bc488d3efde48f90e8fcfed8a89d7472eb9e0b1ca8c6a7c36a45991ffecac0e5","observation_id":"eea3cf55-b37b-4b1d-8ed1-f348cc15d61b","resolution":{"observed_at":"2026-08-03T16:17:18.875791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.921447Z","title":"T2I-Adapter: Learn- ing adapters to dig out more controllable ability for text-to- image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.921447Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:9617e052d4f84f6870f156ab2f65d13c1fd3af3fccf4aadce2195c385339804a","observation_id":"5bb9b3bc-9ee4-4e82-aa5f-6d625a5ecd45","resolution":{"observed_at":"2026-08-03T16:17:18.921447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12036","last_updated":"2024-03-18T17:59:40Z","snapshot_observed_at":"2026-07-06T17:46:29.153377Z","submitted_at":"2024-03-18T17:59:40Z","title":"One-Step Image Translation with Text-to-Image Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12036","snapshot_observed_at":"2026-08-03T16:17:18.981689Z","title":"One-step image translation with text-to-image models.preprint arXiv:2403.12036, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.981689Z"},"links":{"cited_paper":"/paper/2403.12036","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:adc3a514f1e5562166cd731c02552796d11ab4859e967e15e30956341ea66238","observation_id":"cf6e3b79-a451-4ed3-ac7a-2d3678a067df","resolution":{"observed_at":"2026-08-03T16:17:18.981689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.102838Z","title":"UniDepth: Universal monocular metric depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.102838Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:ddda6212a644e839e1a3895817b5cb64feaf3ca3a0dc7e3883fc63e7d5dc8e4f","observation_id":"ffb52d61-afd4-48aa-ade2-37ea4284daa8","resolution":{"observed_at":"2026-08-03T16:17:19.102838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.203167Z","title":"UniDepthV2: Universal monocular metric depth estimation made simpler.IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.203167Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:04ab1288ef6f8b714aab3d391e9b8d87d149d60d4cb06b821f212a7ed61ce675","observation_id":"369c62d2-d942-4359-9f13-a40b07600a1a","resolution":{"observed_at":"2026-08-03T16:17:19.203167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.370533Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.370533Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:e814fe28c3f4b8da7b8f3f1402d587564a6f5c6b19ad6653108df962bb0321de","observation_id":"a56806fa-c9be-4e29-9863-6117697a4fd2","resolution":{"observed_at":"2026-08-03T16:17:19.370533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.489226Z","title":"Towards open-world generation of stereo images and unsu- pervised matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.489226Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b84b89b6cc4836964c0a47c0fb480713a98f59a1f52c74132b4083a5e4793447","observation_id":"fba05a65-315a-4acd-abe7-7bd3f8c59566","resolution":{"observed_at":"2026-08-03T16:17:19.489226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.638176Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.638176Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:74049d06c5da832d20194e40bd1f02a407008264e38313b250ea5b8914a32d37","observation_id":"e3f4e072-d9f0-48a1-af8a-1d233016c091","resolution":{"observed_at":"2026-08-03T16:17:19.638176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.781189Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.781189Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:1b3344c97b2db955046a2cccec220eb97bf8991e6cd7b1f06d6e4ba75bf95e86","observation_id":"d0158fe6-44e4-4348-87aa-7a6d722d5dc0","resolution":{"observed_at":"2026-08-03T16:17:19.781189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.882926Z","title":"Deepspeed: System optimizations enable train- ing deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.882926Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:bafb204c224b2e3ba57430f4a1aa656c6cb070e7ffd5f2841483f0875f6d7801","observation_id":"bfc62aef-377d-4782-b387-c18234d3d472","resolution":{"observed_at":"2026-08-03T16:17:19.882926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.040636Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.040636Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:78fba2f0677aacbe8921183a8cda12f185512a6d819c1ec638e87983089ad05b","observation_id":"58764ac7-68fa-40f4-8a3c-a41cf18534bf","resolution":{"observed_at":"2026-08-03T16:17:20.040636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.156400Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.156400Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:8ce88b1960e1728ca2c3a6752d1f6923cf289853f9139f4080f37230130a32a0","observation_id":"df18b10d-d3c3-46cc-8b22-b4029653fb87","resolution":{"observed_at":"2026-08-03T16:17:20.156400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.288634Z","title":"DreamBooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.288634Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:fb5bfbecb3e1b415c36da71eb9a1a1911cdf94f09de40c9c068bf4320447b090","observation_id":"8f3e2434-1158-41bc-a092-8668ccff5363","resolution":{"observed_at":"2026-08-03T16:17:20.288634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.402035Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in Neural Information Processing Systems (NeurIPS), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.402035Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:438eadcbc8a11dedf85a5ba9e2a075ae19d5dbb248dbb77e1c1f0ab46fc26eee","observation_id":"4872ced9-7dda-4f3d-b5a1-5f37293b0f10","resolution":{"observed_at":"2026-08-03T16:17:20.402035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-07-06T12:33:23.843893Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-03T16:17:20.492533Z","title":"Progressive distillation for fast sampling of diffusion models.arXiv preprint arXiv:2202.00512, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.492533Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b4a89fa69310144586fba2ca9e530f825b3b93fcf40c7de5f83a9ae5b0a5fc85","observation_id":"9616e8af-bb73-4241-9021-096b29e1b7fc","resolution":{"observed_at":"2026-08-03T16:17:20.492533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.625594Z","title":null,"venue":null,"work_id":null,"year":1940},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.625594Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:279f4dc6248d44b8bb1abd83f14250bb778ec54f905b20a6f67d1c5234512a1e","observation_id":"f43af82c-1fab-4566-9ce7-8279eb05e667","resolution":{"observed_at":"2026-08-03T16:17:20.625594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00262","last_updated":"2024-09-30T22:19:32Z","snapshot_observed_at":"2026-08-05T08:12:40.313243Z","submitted_at":"2024-09-30T22:19:32Z","title":"ImmersePro: End-to-End Stereo Video Synthesis Via Implicit Disparity Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00262","snapshot_observed_at":"2026-08-03T16:17:20.743644Z","title":"ImmersePro: End- to-end stereo video synthesis via implicit disparity learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.743644Z"},"links":{"cited_paper":"/paper/2410.00262","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0267fdc6e6d9e1f2a52381c7b78ac8d6757556996e854e86c04c282e646d9065","observation_id":"e9b3406e-e981-4957-a9ad-e031c62c3ee4","resolution":{"observed_at":"2026-08-03T16:17:20.743644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.899955Z","title":"The zone of comfort: Predicting visual discom- fort with stereo displays.Journal of Vision, 11(8):11–11,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.899955Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:e8a160387bcb9820b9fec3bf6a04bcbec42e7affcde610495fab4afa0d91071f","observation_id":"49522e4b-68b9-4045-a981-6ff3d7f24ff0","resolution":{"observed_at":"2026-08-03T16:17:20.899955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.022301Z","title":"3d photography using context-aware layered depth inpainting","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.022301Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:de96b948d13df9bdf2876b6f538ad40707d37039431162ee210744d9b6f77a2d","observation_id":"daf509b1-6855-4c01-84ff-2a1096f0e98e","resolution":{"observed_at":"2026-08-03T16:17:21.022301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.104389Z","title":"3d scene reconstruction with multi-layer depth and epipolar transformers","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.104389Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:88a976970c16fcdc16a9fa5965b05cd02d84a0e305ef0075a3a3d75ce7275230","observation_id":"eb478846-6220-4e52-bd89-b8578c580c4b","resolution":{"observed_at":"2026-08-03T16:17:21.104389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.187915Z","title":"M2SVid: End-to-end inpainting and refinement for monocular-to-stereo video conversion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.187915Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:cb01abccd51ed02f86b360695efb1c86e3c839d727eabb4ab30187fccf940652","observation_id":"6c4a5eef-d5bf-43a2-9bbd-9b7372358f29","resolution":{"observed_at":"2026-08-03T16:17:21.187915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.254224Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.254224Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:a565b6f6df3aeca9c86d7d8374ed39985268c62d648f16d0c8c1eea41eb15dde","observation_id":"3a42ac71-0164-4924-982d-d7cc0729996d","resolution":{"observed_at":"2026-08-03T16:17:21.254224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.302662Z","title":"What makes for a good stereoscopic image? InIEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.302662Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:1ad043f01c82b5e76c176fdc52b0a59eea26fec74368ce47998ca08f3767abe2","observation_id":"e6758838-c576-4e0c-9194-8c194c0a9a17","resolution":{"observed_at":"2026-08-03T16:17:21.302662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.345149Z","title":"RAFT: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.345149Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:dee8e23c205c1317888e5c3952d71b7ddd195ac359a4c2765e692ef623c2d307","observation_id":"d23272c3-8560-4092-8f13-ef968167f78e","resolution":{"observed_at":"2026-08-03T16:17:21.345149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.401631Z","title":"Methods for reducing vi- sual discomfort in stereoscopic 3d: A review.Signal Pro- cessing: Image Communication, 47:402–416, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.401631Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:726410d93ffb8cc8f858a7b552392c916f46138f657f043a7d2cc866ac4b3e27","observation_id":"c3dba04f-9d6b-40fc-9559-92b81080a2f5","resolution":{"observed_at":"2026-08-03T16:17:21.401631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.445233Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.445233Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0839517cd317c2b0a1eb03b6c6c9b5c74a9842561d730b287a11a8837bc697e5","observation_id":"decd62c9-c304-4325-b7cf-9b6450e3dc74","resolution":{"observed_at":"2026-08-03T16:17:21.445233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.505770Z","title":"A critical comparison of pansharpening algorithms","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.505770Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:619263747857c611a9f6fe58c1df5b8ba9e48f9601c2306a1b0001ab94b2f7d9","observation_id":"777e4ccb-0d96-49ce-8897-09262e2155de","resolution":{"observed_at":"2026-08-03T16:17:21.505770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.557573Z","title":"StereoDiffusion: Training- free stereo image generation using latent diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.557573Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:42256f2e22e56a025d95856e0a94ce03992498c41aef7f648ae52bf291cf7a82","observation_id":"164fe27f-0991-4b3b-817a-c3ed841f13a7","resolution":{"observed_at":"2026-08-03T16:17:21.557573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.600336Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE Transactions on Image Process- ing (TIP), 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.600336Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:13283cbc8c74b49eca689aa47cd15d0e511b10aea1e9ca15481b46d3d164f69f","observation_id":"f7bafa51-59a2-4781-8760-37d90236e552","resolution":{"observed_at":"2026-08-03T16:17:21.600336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.674503Z","title":"Learning stereo from single images","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.674503Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:7a22643d30dda23d37753e95a978a063f25a2bd0e762255468b578c4e1328231","observation_id":"bcc1a5e3-8649-47a1-9e44-4f174577b856","resolution":{"observed_at":"2026-08-03T16:17:21.674503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.753953Z","title":"FoundationStereo: Zero- shot stereo matching.IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.753953Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:049377a2910c4f785fd6eb0a9fd42bcadcd9cde1241a3f99ea08d3d8d4af7fcf","observation_id":"0351be57-a972-49ab-95be-82fe8f46ff48","resolution":{"observed_at":"2026-08-03T16:17:21.753953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.812226Z","title":"Direct and explicit 3d generation from a single image","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.812226Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:465407c9f68f7939f64cd1892cd3f8b2a43d50b61770e2d00336ed1988a9c1a2","observation_id":"ad412d91-5ae7-4c32-a02b-dc277ff305bc","resolution":{"observed_at":"2026-08-03T16:17:21.812226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.877808Z","title":"Deep3d: Fully automatic 2d-to-3d video conversion with deep convo- lutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.877808Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:4dbca4a894da0d6f4a9c4ed7d3cd16504571db5343475aef71df0c16c8acf93a","observation_id":"1f07206d-c6ca-412e-bb65-05986118f0d0","resolution":{"observed_at":"2026-08-03T16:17:21.877808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.944668Z","title":"Depth Anything: Unleash- ing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.944668Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:c59eef869bbc38b808835506e384e97b8c0df1177462094f72eab639921672e1","observation_id":"e1991907-c162-4e55-9325-0d9c3bd89d4d","resolution":{"observed_at":"2026-08-03T16:17:21.944668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.010226Z","title":"Any-to-Bokeh: One-step video bokeh via multi-plane image guided diffu- sion.preprint arXiv:2505.21593, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.010226Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f52c55fbffdb65a9beee0a05095d6aa7bb87ebc098fd50b2e60afeaa569b47fa","observation_id":"774a2661-b88d-44fe-b279-aa5d2f36989c","resolution":{"observed_at":"2026-08-03T16:17:22.010226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-03T16:17:22.040754Z","title":"IP- Adapter: Text compatible image prompt adapter for text-to- image diffusion models.preprint arXiv:2308.06721, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.040754Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0f25165adf4e072a2717ca4dfd7b4a7d06a69fc94585a27066d91957465462fd","observation_id":"f9d5c04b-9409-4e68-be88-1565d8ede969","resolution":{"observed_at":"2026-08-03T16:17:22.040754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.223310Z","title":"Tra- jectoryCrafter: Redirecting camera trajectory for monocu- lar videos via diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.223310Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:6c70ef189b3e107b7de832bd53119b490b1af4935e24c863c1b87328e806c58c","observation_id":"748e6041-8091-48f9-a1f8-2a4b63cb187e","resolution":{"observed_at":"2026-08-03T16:17:22.223310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.396310Z","title":"3D- TV content creation: automatic 2D-to-3D video conversion","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.396310Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:2bd8efe0810722704aadd3eb6838f98d41cedc59f567956dac246811a3a2e4b8","observation_id":"d691b288-f894-431c-ade5-7e1a256d8bb7","resolution":{"observed_at":"2026-08-03T16:17:22.396310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.498369Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.498369Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:1b3f56df5027bd804d1b23655ed8f564b8e197d0563649b23f9c8200696d5f8e","observation_id":"f2746c32-1449-4214-a65e-56a88f20c262","resolution":{"observed_at":"2026-08-03T16:17:22.498369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.563931Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.563931Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:a0257939f6cb06268572a13108396cf972fd9fcac73fb082e6405c5be3ff7bd4","observation_id":"9a13271e-0101-40d7-9b84-99a452177b30","resolution":{"observed_at":"2026-08-03T16:17:22.563931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.696121Z","title":"High-fidelity novel view synthesis via splatting-guided diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.696121Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:95c5694928448756d579dbe8f03f44dc081dd87fd9a2ec33be6e93f429c0dd92","observation_id":"8cf45379-e625-4702-b1aa-0c22bd6a7c12","resolution":{"observed_at":"2026-08-03T16:17:22.696121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07447","last_updated":"2024-09-11T17:52:07Z","snapshot_observed_at":"2026-08-07T23:33:01.135787Z","submitted_at":"2024-09-11T17:52:07Z","title":"StereoCrafter: Diffusion-based Generation of Long and High-fidelity Stereoscopic 3D from Monocular Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07447","snapshot_observed_at":"2026-08-03T16:17:22.757515Z","title":"StereoCrafter: Diffusion-based generation of long and high- fidelity stereoscopic 3d from monocular videos.preprint arXiv:2409.07447, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.757515Z"},"links":{"cited_paper":"/paper/2409.07447","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0873b587412eaeacc2d5b6583fb49918467804c080e14df27c7243b0e3aa4ba0","observation_id":"a4294b81-58e9-4cdd-901f-ed47092f0ea4","resolution":{"observed_at":"2026-08-03T16:17:22.757515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00625","last_updated":"2025-03-01T21:28:12Z","snapshot_observed_at":"2026-08-07T17:36:50.142935Z","submitted_at":"2025-03-01T21:28:12Z","title":"Perceptual Visual Quality Assessment: Principles, Methods, and Future Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00625","snapshot_observed_at":"2026-08-03T16:17:22.812496Z","title":"structurally","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.812496Z"},"links":{"cited_paper":"/paper/2503.00625","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:e86531805fe8aa3619de31fb613ff60e7908552ad7e4899fc084b6e0640d4d3c","observation_id":"854498bb-c204-4bb2-8fd3-b266eb11a273","resolution":{"observed_at":"2026-08-03T16:17:22.812496Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:57:43.940784Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 1 inbound Pith citation observation for arXiv:2512.14236."}