{"as_of":"2026-08-19T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc292da477415b572905b67755158b7f98cefc2f27b5d886ccb2ceeb9e0be972","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T02:48:08.925030Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.29166/citation-record","integrity":"/paper/2606.29166/integrity","json":"/paper/2606.29166/citation-record.json","paper":"/paper/2606.29166"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:f9deac99ec2265d19a2e124ce28ff7346d80f0db845b73fb7b2ff342afb643dd","observation_id":"ba2c0ae1-2747-4f13-9024-048875729a28","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:3780b2002d8d52813a04fd5a634a938e6fb81ec2842e8293fba14cdf5e01ee11","observation_id":"bbd6cd7d-2828-46c5-a1b3-a6e97f19ebee","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:71db43850a9c1877dd5df2549a665aaadf2df92c4ccb40f53bf0a17d484098f4","observation_id":"7d8f0c62-15b3-4ef0-9e52-fa6ff451da07","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Bjontegaard metric.https://github.com/ Anserw/Bjontegaard_metric, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:7788787af0e9cf81e40addf8d3cd24fefd9ef196bd11e21f5a0e7aaecbd0a5f7","observation_id":"8752dd72-f4fa-43a6-addb-dd7b35561b00","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Revisiting feature prediction for learning visual representations from video, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:b154c14c3da64657a75b6d3fb4b795c70e8687db0ec7fbf3351caef5722c9330","observation_id":"44ffddcb-2252-40d1-8640-171ef7ca8071","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"A simple framework for contrastive learning of visual representations, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:72fab43785ae6a3a8be4c1b52ce1e7392534673bf18587173606fa6c0a8fc85c","observation_id":"a9dae005-039d-4c43-87e8-8015554c3624","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:81acabd3f78b1ecd3cc5ac72834f47cd4814a4d251ac13919cd38faa5bd82975","observation_id":"8d7a4a8b-ef5e-4353-a963-0aee6196330a","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:1ffdad728c575d6b8a095cb16c4deffe9fcdb010ba99a24e1097636b70193935","observation_id":"6cc7dca4-019d-4c4f-9bf5-f3130a23884f","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:70cdef2ac0c251576493f2f1c752f49548e016eb005968f0878e21dcbd7dcdfb","observation_id":"149fc991-bc22-499a-a55e-7dbb9686c8e6","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:54:10.245730Z","title":"Leveraging compres- sion to construct transferable bitrate ladders.arXiv preprint arXiv:2512.12952, 2025","venue":null,"work_id":"3cc204e2-ef07-4f7e-be41-f26883f487fe","year":2025},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:8a85a0f3f4cc596294bc603e17427bb5ede105b1e03859b6b9318655fc50caaa","observation_id":"6bbb0d3d-930b-469c-9337-6ceb2b02871e","resolution":{"observed_at":"2026-06-30T02:54:10.248054Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Omnimae: Single model masked pretraining on images and videos","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:c7877ed879b14976393b7e2459b4150ecd1e03c861e8736cc6cbf4726efdbb01","observation_id":"0504f604-dbc4-4281-870a-69a77e8bdee1","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Richemond, Elena Buchatskaya, Carl Do- ersch, Bernardo Avila Pires, Zhaohan Daniel Guo, Moham- mad Gheshlaghi Azar, Bilal Piot, Koray Kavukcuoglu, R´emi Munos, and Michal Valko","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:cf3271902b54bc875a058f23caa0426e21ed5fb54b22098a553a8a4bd979d086","observation_id":"be5b1ca0-99cb-4a1b-aee4-d9e8b82b0692","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Momentum contrast for unsupervised visual rep- resentation learning, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:ae2cb92b56bd981c62d01cc09113a1dbee7de7c4c8bceade0e7f34ead7bb0de3","observation_id":"8dfafef5-7b85-4628-b9fe-00d047af0f65","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Rate distor- tion optimization over large scale video corpus with machine learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:b20a7c8a1af9a9af1b6cf38a4ac3a276feb0d698f7418beb8de53c589a4dde14","observation_id":"41e4e577-552d-4ee5-a5aa-b7c6b0cfef7f","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Katsenou, Joel Sole, and David Bull","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:8c488d8348ea9b6b49549abeca8efd9ca937b216b9faf2fdbe1ca4a619e74d96","observation_id":"0910338f-360a-41de-8c51-5cd79697150f","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Supervised contrastive learning.Advances in neural information processing systems, 33:18661–18673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:6e220f181f72802792279904f7eb8e6d98ffb2e023d85eb6f9bc4fea39130ea2","observation_id":"153e26d3-dc34-4a92-a001-32cb0a04ccd8","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Image quality assessment by separately evaluating detail losses and additive impairments.IEEE Transactions on Multimedia, 13 (5):935–949, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:b4344d72298eb21964031132253513d97787ab6edbd8a713d1040006860efa91","observation_id":"01100f92-e355-477e-8c83-e9932e4fc14e","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Towards perceptually-optimized compression of user generated content (ugc): Prediction of ugc rate-distortion category","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:5d6be27fd3298223149212d1ab714251d2c8ee5882acbb4e357208777d2d72dd","observation_id":"d82935d4-f34f-4956-9df0-c237cbed6d0c","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:214d2e937aada2a681720949defe81056de7e63989da0a927c35f387f9d5b81a","observation_id":"1974553b-af3b-4879-921b-366b9dad8b61","resolution":{"observed_at":"2026-06-30T02:54:10.256581Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Madhusudana, Neil Birkbeck, Yilin Wang, Balu Adsumilli, and Alan C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:32dfae1aeab60385d9e99e9d173959f28242269323e4ac825b2e6d885d0d2b3e","observation_id":"796cb716-3560-4183-998f-047b25cdfb92","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Madhusudana, Neil Birkbeck, Yilin Wang, Balu Adsumilli, and Alan C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:e5522952be66996e3cf509c793802dd9e06255a4f5510568794611aafdc03dc3","observation_id":"44df3e30-99da-4b19-aeb6-a01f66f7b5f1","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Menon, Hadi Amirpour, Mohammad Ghanbari, and Christian Timmerer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:9cbfbd470e3ce4183aa2a49d424e21af8d0cb288152478a46ca081dde68c1192","observation_id":"df7d3a66-750d-4858-af8d-f9a57f9982f9","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text- to-video Generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:e7a9483f4b752d7fb2534468c1db41aec99e621c91d7adf7d542c9c2f4caa277","observation_id":"bfa42fa8-a90f-43a2-bf22-61243f0c8084","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:c2c0ef6addaa1a722ba62d056352d31340006fe7a81ce372d4f08d641f21b2e0","observation_id":"66fd415d-efc3-4b06-8940-da9b8d01a5ac","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:364fe1e9573d90116270044c6ca629ce34fc2f18f56f8d1a1cabc78c79c6c56b","observation_id":"f04d189c-ddd0-41a5-ad7d-7a76dbcd4ac6","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Sheikh and A.C","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:bd04db520efe5634f3d1caf67732ca25d2071506526980cd54ac2cd3684ac80d","observation_id":"30ea0e62-d6a4-4b1c-9280-0b80692912e6","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Video quality as- sessment by reduced reference spatio-temporal entropic dif- ferencing.IEEE Transactions on Circuits and Systems for Video Technology, 23(4):684–694, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:5b39b489631696f14c3db7b7d0f247abd5ff5c041e2435b40257800d426c77d6","observation_id":"b01155ba-bfb0-46db-9aed-e11167e6f3db","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09754","last_updated":"2024-10-20T09:44:30Z","snapshot_observed_at":"2026-08-16T13:43:05.545178Z","submitted_at":"2024-06-14T06:44:01Z","title":"LAVIB: A Large-scale Video Interpolation Benchmark","version":2},"cited_work":{"arxiv_id":"2406.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09754","snapshot_observed_at":"2026-07-02T02:36:27.593338Z","title":"arXiv preprint arXiv:2406.09754 , year=","venue":null,"work_id":"8cd25ea8-97bb-4ba8-a878-91a21d186e53","year":2024},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"cited_paper":"/paper/2406.09754","citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:e6bd5477d27a1c713ff43f8badd70bcbfb6c8504482a752c855867ca054ace00","observation_id":"53866355-fe9c-4142-a94d-a40ce4900241","resolution":{"observed_at":"2026-06-30T02:54:10.252437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"AdaPool: Exponen- tial Adaptive Pooling for Information-Retaining Downsam- pling.arXiv preprint, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:e4bbefa974d6b70f016d992e1cd09c9710c9e7ef5bd6119c105ed3aab10113cd","observation_id":"13611432-71d1-45ed-8622-650ff86eccc2","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Benchmarking learning-based bitrate ladder prediction methods for adaptive video streaming","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:71f9723561fc308ad20d87fc9cf7f1f89e11b35105d07e275a76c92f4dc13bc5","observation_id":"511a79be-e353-4865-931f-71839b142dbe","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"VideoMAE: Masked Autoencoders are data-efficient learn- ers for self-supervised video pre-training.Advances in Neu- ral Information Processing Systems, 35:10078–10093, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:18c28ef21f7041daa83a21464cda90ec69b1e8752252acb0099cb17e61fc5b70","observation_id":"a680029c-01b8-45f6-9467-44d6e2ab4cc4","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"YouTube UGC Dataset for Video Compression Research","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:d85a8a8ae382741cb41b585d62f984f7bb24e38ac39a21254dd07d81ed79b61f","observation_id":"273d79cc-0560-4425-83b9-8a31a80a7d9a","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Bovik, H.R","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:796dd4c6f42fa2b01a8d53f1b026511d7ff2e2056f0ce134e433f519b35ec1bd","observation_id":"2a514b4c-63d2-4df7-9690-336d5f13780c","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:1c8ceeac5336655a0faf86ce258e49fdef66fd711778c69c987872740842f3fa","observation_id":"cce4b4d9-fd2b-4802-8367-53a44ed99a16","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:48:08.925030Z","title":"Fast encoding parameter selection for convex hull video encoding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T02:48:08.925030Z"},"links":{"citing_paper":"/paper/2606.29166"},"observation_digest":"sha256:77be8de94fe07160d1f50b00587f2d4f4f50f164a422b29c8d9f3dcef1d5af08","observation_id":"9c9c2e2d-7060-4766-a6e6-36b5a78e600a","resolution":{"observed_at":"2026-06-30T02:48:08.925030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.29166","last_updated":"2026-06-28T03:01:10Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T03:01:10Z","title":"A Self-Supervised Learning Framework for Video Encoding Complexity Clustering"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2606.29166."}