{"as_of":"2026-08-10T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7940a3a6dc8ff9eb7683159b329d712e10746ce0a8ad0e525b91cae8c00e2eb0","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:56:19.162495Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T19:49:46.222837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01037","snapshot_observed_at":"2026-08-02T19:49:46.222837Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.00887","last_updated":"2026-07-27T07:15:43Z","snapshot_observed_at":"2026-08-07T15:08:40.355828Z","submitted_at":"2026-03-01T03:22:42Z","title":"VEMamba: Efficient Isotropic Reconstruction of Volume Electron Microscopy with Axial-Lateral Consistent Mamba","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T19:49:46.222837Z"},"links":{"cited_paper":"/paper/2506.01037","citing_paper":"/paper/2603.00887"},"observation_digest":"sha256:85f5f6a5a189e9097d9e40babf44d1de4d8d8cc412812c8d21233b44c5de2873","observation_id":"8f21914b-3fef-446a-a88f-f5a3a8ad87b2","resolution":{"observed_at":"2026-08-02T19:49:46.222837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01037/citation-record","integrity":"/paper/2506.01037/integrity","json":"/paper/2506.01037/citation-record.json","paper":"/paper/2506.01037"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.793506Z","title":"Masked siamese networks for label-efficient learning","venue":null,"work_id":"407093ff-2dbe-4a3f-88b3-039efb6782ae","year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.831078Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:e9ec8f83373f89c2cb7676e1ca4e9b19db9d541d9539aac973abe7c55f98d501","observation_id":"9f00f10b-e390-4222-a235-877903fb1e7f","resolution":{"observed_at":"2026-08-07T11:56:19.796604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-08-09T05:07:43.521969Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-07T11:56:18.834828Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models.arXiv preprint arXiv:2405.04233, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.834828Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:fbfeee734861022cf96372d5832982e3c724b935e3443028b569a6cf43b61134","observation_id":"bbf9ac7e-42af-4848-945d-545a386a0e00","resolution":{"observed_at":"2026-08-07T11:56:18.834828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06847","last_updated":"2023-07-04T15:30:58Z","snapshot_observed_at":"2026-08-04T07:10:33.535606Z","submitted_at":"2021-06-12T20:00:32Z","title":"Video Super-Resolution Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06847","snapshot_observed_at":"2026-08-07T11:56:18.838603Z","title":"Video super-resolution transformer.arXiv preprint arXiv:2106.06847, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.838603Z"},"links":{"cited_paper":"/paper/2106.06847","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:1fa50ffa079bed0547e7d5e6ddc1769691f8a549e07e61b7f402eaf1c9914318","observation_id":"034fa7c8-621a-4c27-8b40-94772b905310","resolution":{"observed_at":"2026-08-07T11:56:18.838603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.784265Z","title":"Unsupervised learning of visual features by contrasting cluster assignments.Ad- vances in neural information processing systems, 33:9912– 9924, 2020","venue":null,"work_id":"96e1dd17-1a46-4cbb-8ecc-add02cbfdffe","year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.842780Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:d87a039b3cfd78654c5e8f9cf04e5b5d47e25fee5c364a9eee64e6d9f77be8f4","observation_id":"fd6c973d-7f9c-4c9f-81c4-8b36571680bd","resolution":{"observed_at":"2026-08-07T11:56:19.787573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.845930Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.845930Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:388b19abc0ab9b6d0cc5d66776fc62931638670c0509929cc5550bd37dc8c70b","observation_id":"bf930bbf-24db-4c9e-88b1-a4d0f559474e","resolution":{"observed_at":"2026-08-07T11:56:18.845930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.769723Z","title":"Diffusart: Enhancing line art coloriza- tion with conditional diffusion models","venue":null,"work_id":"385df812-cf7a-48e2-a587-0fc6e7a803a8","year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.849025Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:a25c8dc9cd5c5043dc5318a88a342c4dc187afc86339dc55ee6df66025b9fce7","observation_id":"4d40e281-f844-4a06-ba60-d3efc7100567","resolution":{"observed_at":"2026-08-07T11:56:19.773567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.852306Z","title":"Basicvsr: The search for essential compo- nents in video super-resolution and beyond","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.852306Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:31483f09056583b623bb29f6e053ec77fc6af41cc3bc0fc2566aaef5a47df02e","observation_id":"744a2e8a-27ea-4e74-9eac-b9826880cea3","resolution":{"observed_at":"2026-08-07T11:56:18.852306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.855637Z","title":"Basicvsr++: Improving video super- resolution with enhanced propagation and alignment","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.855637Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:2ac331fd3b2bc9dc3a724bb8cfffc88185df666c43b908b3d2e673426c256615","observation_id":"c8dc98ce-f4a5-46df-ae20-e00fba9e025f","resolution":{"observed_at":"2026-08-07T11:56:18.855637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.751294Z","title":"Investigating tradeoffs in real-world video super-resolution","venue":null,"work_id":"db7f4e2f-02a0-4894-b8b5-1a2cfcec931d","year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.858753Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:a12b8f6af99e1854900dc3634e17811546fc7fc8822eae735c4e752a66242a3d","observation_id":"96ade946-9782-48a1-91b5-3e6317809702","resolution":{"observed_at":"2026-08-07T11:56:19.754391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.741651Z","title":"Investigating tradeoffs in real-world video super-resolution","venue":null,"work_id":"7a1d45a2-9105-4e27-aa69-22aa50786679","year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.861548Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:662db38e7e46949e59b267dcb0f33f1423e9e522b4b91436fc0af7ffdc80a5ba","observation_id":"c678cae0-9a61-4aaf-93d2-dd633e4deb32","resolution":{"observed_at":"2026-08-07T11:56:19.744815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.732511Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"c1dd7fb6-3c6a-44a1-98dd-ab63a1e997b9","year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.865137Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:8d5dbdc095a6488f6895503092223abb73d0b54d11a2fbef7c8fb9a4f9d63a11","observation_id":"08e55f1c-df77-44fe-9982-d787181fba1a","resolution":{"observed_at":"2026-08-07T11:56:19.735976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.868328Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.868328Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:cf04ece72f8033280b43cc7b16d8a998b07076bc48fbc52accfd42417f35f7ea","observation_id":"2cbfe812-8f91-49a7-a50d-46746cf7bbc7","resolution":{"observed_at":"2026-08-07T11:56:18.868328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.871248Z","title":"Image quality assessment: Unifying structure and texture similarity.IEEE transactions on pattern analysis and ma- chine intelligence, 44(5):2567–2581, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.871248Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:e4eed61068d46b9ab5b969ea3d560c322458810aac13798bff83d468a1487bf0","observation_id":"2c7004ce-1bf9-4d04-b75d-c5ee06bdd6da","resolution":{"observed_at":"2026-08-07T11:56:18.871248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.712724Z","title":"Adaptive soft contrastive learning","venue":null,"work_id":"71e9f2bd-1af0-4bb1-a592-c6829a101cf1","year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.875061Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:c00fc569f804146b47d0066f33d186d09477c106eac1e00c22e73e7bba9637cd","observation_id":"08e4bf4f-dd56-4a17-ac8f-f687dd46bd6a","resolution":{"observed_at":"2026-08-07T11:56:19.716748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.702687Z","title":"Maskcon: Masked con- trastive learning for coarse-labelled dataset","venue":null,"work_id":"57d23e76-21e6-4b9d-be2c-41dc4fedaa38","year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.878320Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:e4c5ef2a5e858ac563188c1119a853dfb99af769bb961b297ad48d016b8629bd","observation_id":"7013b0cd-e4eb-4149-a0c7-3bd7e1ebe931","resolution":{"observed_at":"2026-08-07T11:56:19.706642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11288","last_updated":"2022-10-07T06:34:34Z","snapshot_observed_at":"2026-07-06T12:10:54.426809Z","submitted_at":"2021-11-22T15:49:20Z","title":"SSR: An Efficient and Robust Framework for Learning with Unknown Label Noise","version":2},"cited_work":{"arxiv_id":"2111.11288","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.11288","snapshot_observed_at":"2026-08-07T11:56:19.324543Z","title":"SSR: An Efficient and Robust Framework for Learning with Unknown Label Noise","venue":"cs.CV","work_id":"ff7142d3-238e-4109-92af-09af49bbf283","year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.881344Z"},"links":{"cited_paper":"/paper/2111.11288","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:292aa526ced5f90a91315932a1ce86a28b3580494b01f7cea95371816bd73a5e","observation_id":"b6bbb30d-ee4d-40ae-b4b0-abe6715fe4a3","resolution":{"observed_at":"2026-08-07T11:56:19.328138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.693390Z","title":"Self-supervised representation learning with cross-context learning between global and hypercolumn features","venue":null,"work_id":"06f79caa-ad60-49d3-b1d5-0ccedd3d5214","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.885391Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:b83fede7b5f8a25676a30ddb4b51291f738b163d4d57039be816b731a2b91d9c","observation_id":"6e27ce29-2ea3-48dd-9113-b7db7af17246","resolution":{"observed_at":"2026-08-07T11:56:19.697170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T11:56:18.888216Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.arXiv preprint arXiv:2312.00752, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.888216Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:7ba3b8f1a26f77960135426ef9cde4e2f03fa2e9938829b5bfe41679b426cb1d","observation_id":"148f795e-4f59-4b70-ba5c-6daab419e784","resolution":{"observed_at":"2026-08-07T11:56:18.888216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-07T11:56:18.966060Z","title":"Efficiently modeling long sequences with structured state spaces.arXiv preprint arXiv:2111.00396, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.966060Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:ef90c616731d4c118b079d7c5f63d2fb673bb5bf58f3228480d1f85f565d9b4a","observation_id":"5b82160f-94bc-472c-9405-7679d9d54809","resolution":{"observed_at":"2026-08-07T11:56:18.966060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-07T11:56:18.970269Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.970269Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:c2218364ef5e6702fc5ef990f8913e406d9a91c606e095961035549c89f46eaf","observation_id":"fe46dd98-d737-4676-98b7-60013c3bb5aa","resolution":{"observed_at":"2026-08-07T11:56:18.970269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.684617Z","title":"Diagonal state spaces are as effective as structured state spaces.Advances in Neural Information Processing Systems, 35:22982–22994,","venue":null,"work_id":"49bd33e6-a2d1-404e-bd9d-0e9a9aa81557","year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.973334Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:cb0a82c75c2bd30990ea9c8a90f434b6aa59ae5c3c36eb31e43131445e9dc524","observation_id":"4e3bf6c2-c51f-44f6-92fa-6adfdd164a2e","resolution":{"observed_at":"2026-08-07T11:56:19.687899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.674897Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":"6d384113-463d-4d07-8076-c4d22e9ecfc9","year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.976479Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:3bdbf64778b3a9fbac7be9c16ed304a0a93f13215ce7c40e0cb37dcbdbbc62a4","observation_id":"a97c5b24-41e1-4cb2-939c-ae5a130a1c56","resolution":{"observed_at":"2026-08-07T11:56:19.678331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.980300Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.980300Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:4d9d6dbdb59175c4e2edb7f4b01bebf0d30acc831a0ce661fc35780432202bb8","observation_id":"9910dc5b-7ef2-4f60-9bc7-d5728fb04e7f","resolution":{"observed_at":"2026-08-07T11:56:18.980300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:18.983520Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.983520Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:63362cc2babbf99828b1dc10af94c022529643d90e84004e861039c0de077610","observation_id":"65b7ebd9-6e9b-4ff2-9ed3-6637e4870e4d","resolution":{"observed_at":"2026-08-07T11:56:18.983520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-07T11:56:18.986388Z","title":"Imagen video: High definition video generation with diffusion mod- els.arXiv preprint arXiv:2210.02303, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.986388Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5b3b4c414be0a78177e9e3c1a5dc8a21efca30f269c27d1e38d8a0814966574d","observation_id":"04ab455e-7d80-4303-b027-f15d7e9c902d","resolution":{"observed_at":"2026-08-07T11:56:18.986388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.655857Z","title":"Long movie clip classification with state-space video models","venue":null,"work_id":"ac8ecf70-9228-48c3-8f99-97ff80f2fd28","year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.990452Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:7d8fde5dc3a5325f34e223114fc585daab6ac98fec0f29261e1dbda9c23777df","observation_id":"d95a4dd6-e385-432e-b431-a6a7c3d0a2d9","resolution":{"observed_at":"2026-08-07T11:56:19.659031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.646250Z","title":"Video super-resolution with recurrent structure-detail network","venue":null,"work_id":"a8aa8690-ce3c-4a58-a690-09d6e087c1ac","year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.993624Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:b7ec74d954a7bd5ef5f7d2741f0f8db280abc8796108a6bf4440ab29b75dbe68","observation_id":"05b132ca-3350-47d3-bd66-e4a89549bcb6","resolution":{"observed_at":"2026-08-07T11:56:19.649402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.636504Z","title":"Video super-resolution with temporal group attention","venue":null,"work_id":"81208622-4852-4c28-9c9c-40e0753f876c","year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:18.996923Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5c788f8d2b5384c5956d09b20fbc51a71ab700226f0450e2d7d68148637cee90","observation_id":"782e1d3d-8e88-4fd9-955d-b03dc6ed0248","resolution":{"observed_at":"2026-08-07T11:56:19.640005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05765","last_updated":"2020-08-20T02:00:20Z","snapshot_observed_at":"2026-07-06T09:46:51.647372Z","submitted_at":"2020-08-13T09:09:37Z","title":"Revisiting Temporal Modeling for Video Super-resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.05765","snapshot_observed_at":"2026-08-07T11:56:19.000179Z","title":"Re- visiting temporal modeling for video super-resolution.arXiv preprint arXiv:2008.05765, 2020","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.000179Z"},"links":{"cited_paper":"/paper/2008.05765","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:4e192d478e21c7a8b1167ea54f2a69b44c645a791fabe8b3a1942a592de049de","observation_id":"43734d44-ce6c-43d8-b085-185eca1a3953","resolution":{"observed_at":"2026-08-07T11:56:19.000179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.627434Z","title":"Dynamic filter networks","venue":null,"work_id":"99c2edee-3d4d-45b1-9769-22b1071ae368","year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.003381Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:4d50cc0a536391cd30e5fbb6a6ca1a1cbc6947437b6639015d7a133873a28288","observation_id":"d40aa5c5-edd8-4fd6-888e-50b24542005f","resolution":{"observed_at":"2026-08-07T11:56:19.630894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.618383Z","title":"Deep video super-resolution network using dynamic upsampling filters without explicit motion compen- sation","venue":null,"work_id":"90b3f7e2-146a-4724-8cfd-62248564d11b","year":2018},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.007388Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:9c93eaaa10574fdb68acb493264afa33f659b2c1a293646e17e25031aff44e68","observation_id":"223621cb-6c2c-45aa-a991-396fd551fb62","resolution":{"observed_at":"2026-08-07T11:56:19.621625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.609742Z","title":"A new approach to linear filtering and prediction problems","venue":null,"work_id":"1a3ea5c8-70a1-4688-b8e0-1235772b4be3","year":1960},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.010815Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5fdcf122709482271aa6d731b248fa474ff53d6ac601b3442f8a7a22b8711680","observation_id":"44e25c19-ab90-41a4-9c47-2f2469fe3a27","resolution":{"observed_at":"2026-08-07T11:56:19.612817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.014546Z","title":"Denoising diffusion restoration models.Advances in Neural Information Processing Systems, 35:23593–23606,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.014546Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:ce6689517db029f0741cc0ff2d9dc1fc49dcadaf2f3c3728345358cf20a851cf","observation_id":"8aa48af0-b0f2-422f-8305-d8e8dc439693","resolution":{"observed_at":"2026-08-07T11:56:19.014546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.018299Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.018299Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:a8b0513ecfb416b9003265554ad376faf4a914b9e9585b1bfdeae6784d1ef4ce","observation_id":"18a81fa8-9fdc-4f2c-bf74-3e406f793a86","resolution":{"observed_at":"2026-08-07T11:56:19.018299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.021791Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.021791Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:edf410cfee4982432d1ae706fe26cb9344941d9003982fbcba0a3daaa5198769","observation_id":"38674a40-0290-45d6-9d8f-69d13abb8e98","resolution":{"observed_at":"2026-08-07T11:56:19.021791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.585617Z","title":"A method for stochastic optimization","venue":null,"work_id":"d3c4dc30-3c4d-4d0a-80db-f3e9e6cac287","year":2015},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.025486Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:3de3109d86cdb4d42408d5f690918449f5ee755cd43923397360583300d79a87","observation_id":"03f230e9-0ed8-46c5-905f-ba60299019ac","resolution":{"observed_at":"2026-08-07T11:56:19.589464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.577260Z","title":"Open-sora-plan, 2024","venue":null,"work_id":"f77d8eff-b5d3-4703-9c43-28ccc62520b6","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.029779Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:dbdde87ef6452c7e89687edf2df55f3853d9d2b064a77784b6e062a87fe20fce","observation_id":"b7309f44-be06-43a5-80ac-39482b801f2d","resolution":{"observed_at":"2026-08-07T11:56:19.580191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.567833Z","title":"Learning blind video temporal consistency","venue":null,"work_id":"e4219c16-d449-43d1-a8c1-85527b4f8b32","year":2018},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.033972Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:bd1bca92cfc1321a42dd4542fba449bea0f16095693db9aa892c9c78461768da","observation_id":"ddd0b48b-9a92-4697-bb98-d15d1041a9ce","resolution":{"observed_at":"2026-08-07T11:56:19.571646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05892","last_updated":"2024-07-13T17:37:00Z","snapshot_observed_at":"2026-08-09T18:30:57.894416Z","submitted_at":"2024-02-08T18:30:50Z","title":"Mamba-ND: Selective State Space Modeling for Multi-Dimensional Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05892","snapshot_observed_at":"2026-08-07T11:56:19.037863Z","title":"Mamba- nd: Selective state space modeling for multi-dimensional data.arXiv preprint arXiv:2402.05892, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.037863Z"},"links":{"cited_paper":"/paper/2402.05892","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:c7ff79aca358e3ee39e373b49bc72589cd6e145409c015983a65ada0a8547929","observation_id":"a9424935-0413-47ce-867a-e7566c36f8fc","resolution":{"observed_at":"2026-08-07T11:56:19.037863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.558302Z","title":"Mucan: Multi-correspondence aggregation net- work for video super-resolution","venue":null,"work_id":"1dce909f-a742-4e66-9dd1-a0c982caaa25","year":2020},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.042239Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:6b56d55998872d6acf064ab79f5d6275356d6f0007c86b791fd7b90f427126b7","observation_id":"d403d388-a4a2-497d-8669-825f62bdf79a","resolution":{"observed_at":"2026-08-07T11:56:19.561706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10739","last_updated":"2024-11-25T01:45:35Z","snapshot_observed_at":"2026-07-06T17:31:13.010759Z","submitted_at":"2024-02-16T14:56:13Z","title":"PointMamba: A Simple State Space Model for Point Cloud Analysis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10739","snapshot_observed_at":"2026-08-07T11:56:19.045549Z","title":"Point- mamba: A simple state space model for point cloud analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.045549Z"},"links":{"cited_paper":"/paper/2402.10739","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:97e2c4825b6c5279f6da2d170c1071d3382c33a45d2400700de145df1816d739","observation_id":"ca1c07ec-e538-4452-b756-1cb097e3f3d9","resolution":{"observed_at":"2026-08-07T11:56:19.045549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.049545Z","title":"Recurrent video restoration trans- former with guided deformable attention.Advances in Neu- ral Information Processing Systems, 35:378–393, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.049545Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:b88842102238187405f0dc95316a42c94475d27d738436c9b0822d42a902aa90","observation_id":"6bb4e000-6d37-4389-9cb9-c212f5a72f7c","resolution":{"observed_at":"2026-08-07T11:56:19.049545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.053105Z","title":"Vrt: A video restoration transformer.IEEE Transactions on Image Processing, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.053105Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:6316334cbea0caac6752d0d24e25b08b3f3cb47a5d262eadb5adb8393acdaa57","observation_id":"ce7cba02-52de-42ff-bef1-2fc68aba6189","resolution":{"observed_at":"2026-08-07T11:56:19.053105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.539397Z","title":"On bayesian adaptive video super resolution.IEEE transactions on pattern analysis and ma- chine intelligence, 36(2):346–360, 2013","venue":null,"work_id":"782a78e1-364d-464d-8b2b-79ce2484a218","year":2013},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.056556Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:1a9150963275b27d2b4be23c7d3efbd92dd258097945f1e54ef903606acec1a3","observation_id":"1d98475d-f21d-4495-9dfc-db6221668d82","resolution":{"observed_at":"2026-08-07T11:56:19.542651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.060556Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.060556Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:02be3cf7751d5c1095dd320b8259ab2c79aab542ffb30c337508eca78518d31f","observation_id":"3a07e878-1866-4710-9f0f-cfe9e9fa317f","resolution":{"observed_at":"2026-08-07T11:56:19.060556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.064156Z","title":"completely blind","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.064156Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5e274b8d65467a3f74c37992724a610cd99a2fd5b6ec1e1e290c1e10dafc21cf","observation_id":"ef17ecad-34f4-4a34-b76b-6bdd1af0a92b","resolution":{"observed_at":"2026-08-07T11:56:19.064156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.520612Z","title":"Ntire 2019 challenge on video deblurring and super- resolution: Dataset and study","venue":null,"work_id":"31509077-a623-4e92-87a1-37d7f98c027a","year":2019},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.067602Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:45aba1a3b59f3d3c1588030c2a03f0a8f99355ae500503a8d35cde96140611d7","observation_id":"e6091e67-fc28-4119-8761-aee7266762c1","resolution":{"observed_at":"2026-08-07T11:56:19.524146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.511239Z","title":"S4nd: Modeling images and videos as multidimensional signals with state spaces.Advances in neural information processing systems, 35:2846–2861, 2022","venue":null,"work_id":"6641e53c-a7f3-4dd6-8b29-b6ece35a9225","year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.070486Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:fb4bd66a48a8ab2b38def98d38a286d1a049c3b29abc4f0243668006a5f8538b","observation_id":"8fea2f14-4ab8-4cdc-918d-5ebf529144c9","resolution":{"observed_at":"2026-08-07T11:56:19.514873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.502076Z","title":"Deep blind video super-resolution","venue":null,"work_id":"62d84895-d63f-4f89-8427-a5696572565a","year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.074315Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:d0f303a618be411d6624045b43eab4d968909812136c4c30835e017557791c72","observation_id":"4a15a2d3-e629-4d84-b1e1-c5bf9d510209","resolution":{"observed_at":"2026-08-07T11:56:19.505303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-07T11:56:19.077238Z","title":"Movie gen: A cast of media foundation models.arXiv preprint arXiv:2410.13720,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.077238Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:0a8a72aff42ac3631906f956c6603a9e2cf506bdcb301eaef814e6ad605625a8","observation_id":"57d1a527-e4bd-44ff-82ca-b4125f600380","resolution":{"observed_at":"2026-08-07T11:56:19.077238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T11:56:19.080961Z","title":"Hierarchical text-conditional image gener- ation with clip latents.arXiv preprint arXiv:2204.06125, 1 (2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.080961Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:505ac067e33797dbd77bff80a1711fdf7bac3b6b5180d6d435f0d0375e1d1fe4","observation_id":"f8112753-8235-4392-a3e4-1381d51fdaa4","resolution":{"observed_at":"2026-08-07T11:56:19.080961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.084715Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.084715Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:4b410b3dee29d44cd24365dac5c9e66d91440db8963e9eb0420f2cda767f4f12","observation_id":"59e2db3e-f0e8-4533-869d-905c587388b5","resolution":{"observed_at":"2026-08-07T11:56:19.084715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.487956Z","title":"Photorealistic text-to-image diffusion models with deep 10 language understanding.Advances in neural information processing systems, 35:36479–36494, 2022","venue":null,"work_id":"c66142b4-16ab-490a-9148-938b6e9275c7","year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.087986Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:366dae59f2bd1962b9328cdc1fa0d44d7b6bfb8b020c69e560ce489ee381b5c1","observation_id":"2798be9a-5a35-45c8-9da8-fee00f15bd42","resolution":{"observed_at":"2026-08-07T11:56:19.491482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04933","last_updated":"2023-03-03T18:35:28Z","snapshot_observed_at":"2026-07-06T13:40:19.948018Z","submitted_at":"2022-08-09T17:57:43Z","title":"Simplified State Space Layers for Sequence Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.04933","snapshot_observed_at":"2026-08-07T11:56:19.091847Z","title":"Simplified state space layers for sequence modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.091847Z"},"links":{"cited_paper":"/paper/2208.04933","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5bc9e8dc3c117551da7073507d380451d63fa51a84d783dac3e70535248926a9","observation_id":"97c8fec1-98f3-491e-8971-6eab84adfdd6","resolution":{"observed_at":"2026-08-07T11:56:19.091847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.478525Z","title":"Detail-revealing deep video super-resolution","venue":null,"work_id":"b240b432-57ad-4edb-80b4-d3075ea6d5b3","year":2017},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.095322Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:6e0693b6aee9fad37f323d5c6befccb28f947180cb27e6044e296fe99eb9a32c","observation_id":"8dfc46bb-dc6a-4a71-90d9-e02d9d6d6959","resolution":{"observed_at":"2026-08-07T11:56:19.481668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.098349Z","title":"Ex- ploring clip for assessing the look and feel of images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.098349Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:0ec0d87b23ba1b549749452a5471a5b8f3014eddf8762968d1e7d5ab6b8ec024","observation_id":"d700ec39-fa82-4f74-807f-f48898f9028f","resolution":{"observed_at":"2026-08-07T11:56:19.098349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.464865Z","title":"Selective structured state-spaces for long-form video understanding","venue":null,"work_id":"99c9295e-46a8-4ffb-8330-2f2c8507dcba","year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.101551Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:ab3d08a74d5dda1e1b91122cff0d85eb7bda3bc4b76393ffa87b101ec71edb6c","observation_id":"69de7a97-542b-4022-b964-9bb34b243741","resolution":{"observed_at":"2026-08-07T11:56:19.468079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.454704Z","title":"Exploiting diffusion prior for real-world image super-resolution.International Journal of Computer Vision, pages 1–21, 2024","venue":null,"work_id":"f61108cd-b36f-4007-a6ca-ab4503b6f517","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.104900Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:09acc31905b65ff4ee0a3918ae360b95ec355e69c3f2e3bcd7ece877ae7afd63","observation_id":"75a53956-49ee-4c89-99dc-31ab2df6d8ee","resolution":{"observed_at":"2026-08-07T11:56:19.458846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.445944Z","title":"Exploiting diffusion prior for real-world image super-resolution.International Journal of Computer Vision, pages 1–21, 2024","venue":null,"work_id":"4f673a6f-c406-4093-8912-39d9f4ecd736","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.108188Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:61554d8fcf0d9c4f438d88f26f0ab53be883437fb2e66d2a02357cbc96ce1b63","observation_id":"e7d98d0b-54b0-431e-9b94-83ee8403368d","resolution":{"observed_at":"2026-08-07T11:56:19.449176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.437198Z","title":"Edvr: Video restoration with enhanced deformable convolutional networks","venue":null,"work_id":"0f43b10e-fa35-4211-963b-710614c267ec","year":2019},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.111280Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:532e17c1c8dddfdc4a71655c17408dfaf8c3109cdfe70bd5e015d5da7167c922","observation_id":"d4fe3596-daa3-43c2-be3f-8debe269f603","resolution":{"observed_at":"2026-08-07T11:56:19.440295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.114233Z","title":"Real-esrgan: Training real-world blind super-resolution with pure synthetic data","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.114233Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:66238b13f282f7a6ce075759f7f30bd40771b53aa45819ca425a80d7c4996ef9","observation_id":"ea11cdb6-f5e0-41a2-a489-71bf545445bd","resolution":{"observed_at":"2026-08-07T11:56:19.114233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.117580Z","title":"Exploring video quality assessment on user gener- ated contents from aesthetic and technical perspectives","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.117580Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:11e30a193f6d91b0506bf72ddde62a07f34e09ee509da0d468bca40f785e1222","observation_id":"944ced1e-847e-44df-93c3-334dc73bc601","resolution":{"observed_at":"2026-08-07T11:56:19.117580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.418660Z","title":"Mitigating artifacts in real-world video super-resolution models","venue":null,"work_id":"83edc8a8-e911-4d09-bc83-fe88694b4e2a","year":null},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.120737Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:1e3d1df19a04b2cc029a2d18a8d6819345fc5701c11e86baa068aac6a6265bc3","observation_id":"3431231e-5a09-44bd-aba1-01d4ece6f8a0","resolution":{"observed_at":"2026-08-07T11:56:19.421763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.123676Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.123676Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:a71c0f3979187f893f1aaaa3030a3272a2266ffe20268922a9d20c4cc406de5c","observation_id":"fe7b2e1b-71ac-45c7-8d93-faf923e973be","resolution":{"observed_at":"2026-08-07T11:56:19.123676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.403311Z","title":"Segmamba: Long-range sequential modeling mamba for 3d medical image segmentation","venue":null,"work_id":"71c35a15-5b99-4c09-91fb-a3d8c681f4d1","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.126732Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:04e0ecae15036cb5a65eea2f08f7227742969227c8faba086d524e09b4c51816","observation_id":"f0e18d28-a00f-43b0-9f9b-c32a0a177aed","resolution":{"observed_at":"2026-08-07T11:56:19.407420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.393873Z","title":"Video enhancement with task-oriented flow.International Journal of Computer Vision, 127:1106– 1125, 2019","venue":null,"work_id":"585fec00-ba5e-48a4-a978-31fa936d9236","year":2019},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.130273Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5bd946183c55559b20f62b0a2641dbb957b28d6473a095f07971e2db40114875","observation_id":"010f26d6-032f-4b29-bab3-e1d34d55fe8f","resolution":{"observed_at":"2026-08-07T11:56:19.397162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14469","last_updated":"2024-07-09T14:18:01Z","snapshot_observed_at":"2026-07-06T16:11:10.831438Z","submitted_at":"2023-08-28T10:15:57Z","title":"Pixel-Aware Stable Diffusion for Realistic Image Super-resolution and Personalized Stylization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14469","snapshot_observed_at":"2026-08-07T11:56:19.133724Z","title":"Pixel-aware stable diffusion for realistic image super-resolution and personalized stylization.arXiv preprint arXiv:2308.14469, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.133724Z"},"links":{"cited_paper":"/paper/2308.14469","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5e53a07b6de4c69e3bc00623efe62bbe4e0bfc19ea7e7ca9d174255dc38b4172","observation_id":"a474a792-3a00-4a0d-a88b-2a6f07e2294b","resolution":{"observed_at":"2026-08-07T11:56:19.133724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.384299Z","title":"Real- world video super-resolution: A benchmark dataset and a de- composition based learning scheme","venue":null,"work_id":"7ec062f0-53cc-42fd-bb36-8c47a5286112","year":2021},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.137121Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:d07ec2a72055560b6429defd818a858be6b72467423621a1f504158afdaa0506","observation_id":"75a3a9f5-0702-4158-8476-2ce9929352d9","resolution":{"observed_at":"2026-08-07T11:56:19.387991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00853","last_updated":"2024-07-12T13:55:40Z","snapshot_observed_at":"2026-07-06T16:55:49.813116Z","submitted_at":"2023-12-01T14:40:07Z","title":"Motion-Guided Latent Diffusion for Temporally Consistent Real-world Video Super-resolution","version":2},"cited_work":{"arxiv_id":"2312.00853","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.00853","snapshot_observed_at":"2026-08-07T11:56:19.218826Z","title":"Motion-Guided Latent Diffusion for Temporally Consistent Real-world Video Super-resolution","venue":"cs.CV","work_id":"12bb3f37-f220-4d3f-8503-098cc69911c0","year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.140260Z"},"links":{"cited_paper":"/paper/2312.00853","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:c8ac1d1cfa8d4055d646d0b53ab7e2f54ba282039742d126d364c3ef48373369","observation_id":"54a8545f-f868-4e66-a3f0-3bf0d5276820","resolution":{"observed_at":"2026-08-07T11:56:19.222507Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.374173Z","title":"Progressive fusion video super-resolution network via exploiting non-local spatio-temporal correlations","venue":null,"work_id":"65b2e202-2058-42aa-a40a-78d9cc7a4949","year":2019},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.143782Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:daa7ca041e0e88774621fc8c635870c204e69e9b5096aba2cbe752682398f6df","observation_id":"35040288-4fdf-4d89-b6ae-35dc15780646","resolution":{"observed_at":"2026-08-07T11:56:19.378391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.147295Z","title":"Adding conditional control to text-to-image diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.147295Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:b6e6a45cb3b1c0cd2cee7da3d94fe7b58f77b29871a384e84f9bfb283fc9248d","observation_id":"93e61fcd-4dd4-4d7d-ba6b-acccdb0185d9","resolution":{"observed_at":"2026-08-07T11:56:19.147295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.151103Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.151103Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:89eaa7fafbeea9b951f58041d005ebd2da070f03b2de73371aa9bd0bc873fa40","observation_id":"9f539182-1f0d-4ecd-abbc-9eaee0c08d32","resolution":{"observed_at":"2026-08-07T11:56:19.151103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13987","last_updated":"2024-07-19T02:32:49Z","snapshot_observed_at":"2026-08-09T20:27:46.183177Z","submitted_at":"2024-07-19T02:32:49Z","title":"RealViformer: Investigating Attention for Real-World Video Super-Resolution","version":1},"cited_work":{"arxiv_id":"2407.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13987","snapshot_observed_at":"2026-08-07T11:56:19.202163Z","title":"RealViformer: Investigating Attention for Real-World Video Super-Resolution","venue":"cs.CV","work_id":"b26b1750-023d-46ed-bb06-c1513e65befc","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.154589Z"},"links":{"cited_paper":"/paper/2407.13987","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:5035b719099c686d54117f8dace81c0c98ed94cd47bf8ec494d7455d3018ac8d","observation_id":"a8168367-a5fe-45b4-bace-999f90d27620","resolution":{"observed_at":"2026-08-07T11:56:19.208043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:19.353422Z","title":"Upscale-a-video: Temporal- consistent diffusion model for real-world video super- resolution","venue":null,"work_id":"fc02ddde-dcf9-4819-a995-40768c50e86f","year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.158159Z"},"links":{"citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:8e9a57f04c9f4d21cfd1f1c0286806dc646f0d4fe8697218bd40c040eb875707","observation_id":"990d8255-c654-4444-b7e3-21c4e87d460d","resolution":{"observed_at":"2026-08-07T11:56:19.357372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-07T11:56:19.162495Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model.arXiv preprint arXiv:2401.09417, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:19.162495Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2506.01037"},"observation_digest":"sha256:83aceb9ed214f4db61fb1b3b6d7d96fb4d35634f0ed2d83c379348e4e8807c8a","observation_id":"0fefa1b4-b97e-4d33-a412-3401a32da63a","resolution":{"observed_at":"2026-08-07T11:56:19.162495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01037","last_updated":"2025-06-01T14:36:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T05:08:42.295320Z","submitted_at":"2025-06-01T14:36:25Z","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":3,"verified_fuzzy":37},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2506.01037."}