{"as_of":"2026-08-20T08:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:708e8af1330dd8a32f2662905d74c36a8596ae339574dc651125b84ca147ea73","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T19:17:01.216603Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.07072/citation-record","integrity":"/paper/2412.07072/integrity","json":"/paper/2412.07072/citation-record.json","paper":"/paper/2412.07072"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2007.10703","last_updated":"2020-07-21T10:45:05Z","snapshot_observed_at":"2026-08-12T13:03:08.015283Z","submitted_at":"2020-07-21T10:45:05Z","title":"Uncertainty-Aware Weakly Supervised Action Detection from Untrimmed Videos","version":1},"cited_work":{"arxiv_id":"2007.10703","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.10703","snapshot_observed_at":"2026-08-11T19:17:01.992715Z","title":"Uncertainty-Aware Weakly Supervised Action Detection from Untrimmed Videos","venue":"cs.CV","work_id":"96761781-a0ae-4ee4-823e-911ee9d79207","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.630207Z"},"links":{"cited_paper":"/paper/2007.10703","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:2ee7c735190347b4f0d6a0bdc7e52e4dd0a0e1268ec8ef65f8845df578bc932f","observation_id":"f0e23199-16b5-4b30-8023-2e4f43e1981c","resolution":{"observed_at":"2026-08-11T19:17:02.024741Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.884741Z","title":null,"venue":null,"work_id":"d5a6e6e6-1a41-4106-9547-ff4e747f3caa","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.650290Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ce4b1e99d8608e6e364d11c4e14a03414168f2f0551bea16f5a8ffde50423960","observation_id":"5527bde5-420c-402c-a484-d290c10aa15e","resolution":{"observed_at":"2026-08-11T19:17:03.915483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.12872","last_updated":"2020-05-28T17:37:23Z","snapshot_observed_at":"2026-08-14T22:50:00.733302Z","submitted_at":"2020-05-26T17:06:38Z","title":"End-to-End Object Detection with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.12872","snapshot_observed_at":"2026-08-11T19:16:59.674748Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.674748Z"},"links":{"cited_paper":"/paper/2005.12872","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:88719077c63aea16877519f837051367a1ccffefca1d552e3c030a8c5c932562","observation_id":"d4c3f6a6-cc7f-4a8a-9368-7e9c07edeecd","resolution":{"observed_at":"2026-08-11T19:16:59.674748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.714740Z","title":null,"venue":null,"work_id":"9d8bd6bc-e251-4333-913f-47b904dd67fb","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.714741Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ae643460af9b3a658a0855f8dfb7891a74fa68f4ae1cbb0bd8cf46eace71623f","observation_id":"f52dfece-ef32-434d-b656-c434f63604ba","resolution":{"observed_at":"2026-08-11T19:17:03.764746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:16:59.734926Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.734926Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:9952202cc1b5d140991c7e5408967ab266c51f4bf2a0837ee59f21f9981ceff4","observation_id":"e2a66422-d6c4-4c7d-8c77-9898702cdaad","resolution":{"observed_at":"2026-08-11T19:16:59.734926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:16:59.744738Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.744738Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:82442932a55b93f92718bf5c056241e76cc6717d0b6e93bc4066577aa1a74a88","observation_id":"59caaf9f-b318-4cb8-b9be-9bc772bc03b5","resolution":{"observed_at":"2026-08-11T19:16:59.744738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.394739Z","title":null,"venue":null,"work_id":"09486739-3a0e-4771-b35e-5a0f208d1338","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.754809Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6c826e81ef8219e7d0b56d692e0756cbf7e809e5abe1cc3bb459745b8c885d10","observation_id":"b078a8e2-63a8-4c26-9947-2c1fcd11077e","resolution":{"observed_at":"2026-08-11T19:17:03.424740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.264746Z","title":"S.; and Shah, M","venue":null,"work_id":"0fedf936-bbce-4c5a-8881-e72c0cf8c030","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.794752Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5f201e4fca7c32e0596082088b36ec9b0ea9f79711126197a495f733650c9e11","observation_id":"ff4b32b3-1aea-41b4-8197-b5f2c896394e","resolution":{"observed_at":"2026-08-11T19:17:03.294740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.123549Z","title":"S.; and Shah, M","venue":null,"work_id":"a94cacf7-f766-4282-a745-c2bdab9214b0","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.814737Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:3320dfc49384d6986896d026fb74249a93aef6b74a80925718acdd906fcd99a6","observation_id":"95e6d909-9e21-421f-9c6d-fca27b39e1e9","resolution":{"observed_at":"2026-08-11T19:17:03.174736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.004739Z","title":"D.; Jain, M.; Ghanem, B.; and Snoek, C","venue":null,"work_id":"259f5a1c-cd8d-404f-8025-4adae39fca60","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.844746Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e1fcb1b8e22bdb918142fd33cfa2cd9b3c2c033e4b830600c49a15613db63bc2","observation_id":"e481414d-6dda-46ef-aa78-523edd7341be","resolution":{"observed_at":"2026-08-11T19:17:03.054742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.863267Z","title":null,"venue":null,"work_id":"1b10987e-c698-4bca-8c82-194797ebf06c","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.864743Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:acde7fc29e329d1a47db9ecd2611d2907c45785b9825a31d28e917c7e8eb14d0","observation_id":"567e279b-854c-4875-969f-897b9faa909f","resolution":{"observed_at":"2026-08-11T19:17:02.866145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07157","last_updated":"2016-10-17T20:09:56Z","snapshot_observed_at":"2026-08-16T04:00:38.741336Z","submitted_at":"2016-05-23T19:45:55Z","title":"Unsupervised Learning for Physical Interaction through Video Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07157","snapshot_observed_at":"2026-08-11T19:16:59.885242Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.885242Z"},"links":{"cited_paper":"/paper/1605.07157","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:96a5834c3619b937bfee216274c29210c031d8571da08af4f29225b5cd2d6045","observation_id":"96d28f28-444f-43b2-9d9c-2515e07423a8","resolution":{"observed_at":"2026-08-11T19:16:59.885242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.854563Z","title":null,"venue":null,"work_id":"1dc74b79-7b03-42ee-8f81-db4eca0e84a0","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.915969Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:7ad25fea4fb28b0fae141776af67486594fd9e0a9b76443efbcdef8f45f19193","observation_id":"4f19a969-0027-47c4-af91-d563732a6645","resolution":{"observed_at":"2026-08-11T19:17:02.857820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.798969Z","title":"A.; Vondrick, C.; Pantofaru, C.; Li, Y.; Vijayanarasimhan, S.; Toderici, G.; Ricco, S.; Sukthankar, R.; Schmid, C.; and Malik, J","venue":null,"work_id":"07cafdcf-7681-4c23-828a-3f1203d3e2f1","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.929214Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:65f7d61a35c5d098391ea2e65b6068768f218e829782fb5ad8ff0e39c9ca06bd","observation_id":"a57e80f0-9e18-4b6f-b727-1e3379c133cb","resolution":{"observed_at":"2026-08-11T19:17:02.808392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.762964Z","title":null,"venue":null,"work_id":"198dd3aa-3223-436a-8ae4-ff26b05d49dc","year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.934520Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:2bb439eb3ee260c5b4bc4341fc585e1d0929c0e10eee670d1d77d835a8a179b1","observation_id":"18cfc2cc-91e2-4c87-a21a-f98de470d29b","resolution":{"observed_at":"2026-08-11T19:17:02.767189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.754346Z","title":null,"venue":null,"work_id":"bd97e3c8-7368-4aaf-95fb-7e8d75bc0646","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.947667Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:13fce2fcbd4aa3b1d41a3a714fccf298019bc1df089f09f1ebd393a175e0c707","observation_id":"676a377b-13eb-48ae-bed8-14dc9fc4924f","resolution":{"observed_at":"2026-08-11T19:17:02.757419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:16:59.950010Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.950010Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:cd8a0d60d5bb4976a57a2374b83b8fbaa2182409d4d1c988cb5090b85a566a69","observation_id":"519cb96c-8473-47af-b513-88b441999943","resolution":{"observed_at":"2026-08-11T19:16:59.950010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.730313Z","title":null,"venue":null,"work_id":"051b246f-0f28-4019-bdc8-22450240e563","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.965837Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:8850084f0c481ccf717f429131ac9831dcdd9810a7491c8a545b207fbda5e4db","observation_id":"f6ae9c20-1984-4274-ae1a-4a1586ddce12","resolution":{"observed_at":"2026-08-11T19:17:02.733121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.721113Z","title":null,"venue":null,"work_id":"66addd0c-4bff-4829-91b1-aee8a7e40765","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.969913Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:0710cba33afe33085f865e88ea6db83e81a2898d69997e8ff5b61e3bbbfb8ea1","observation_id":"c6a30fe1-3866-449b-8e29-eeee994ba70d","resolution":{"observed_at":"2026-08-11T19:17:02.725182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.702196Z","title":null,"venue":null,"work_id":"76838447-673c-4b4b-80a0-0110d9132af3","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.972174Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:357d12941688abb1d89af45ac88c8d845a986dbd0ed92a71b941ea00a6bcc0ff","observation_id":"00536c44-9d21-4a72-9b04-ef1e188f2c4d","resolution":{"observed_at":"2026-08-11T19:17:02.707583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06644","last_updated":"2021-10-18T12:53:47Z","snapshot_observed_at":"2026-08-16T18:26:44.584458Z","submitted_at":"2019-11-15T14:09:47Z","title":"You Only Watch Once: A Unified CNN Architecture for Real-Time Spatiotemporal Action Localization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.06644","snapshot_observed_at":"2026-08-11T19:16:59.984438Z","title":"o p \\\"u kl \\","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.984438Z"},"links":{"cited_paper":"/paper/1911.06644","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:34f02577ed228aed83a322fd19f99cf1ce50aba85b612d03d6c18b7f0e33c25a","observation_id":"69e195b8-e658-44f5-b79e-cc47ee928385","resolution":{"observed_at":"2026-08-11T19:16:59.984438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06010","last_updated":"2023-11-20T14:26:00Z","snapshot_observed_at":"2026-08-16T15:25:06.161510Z","submitted_at":"2023-06-09T16:27:14Z","title":"A Large-Scale Analysis on Self-Supervised Video Representation Learning","version":2},"cited_work":{"arxiv_id":"2306.06010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.06010","snapshot_observed_at":"2026-08-11T19:17:01.956122Z","title":"A Large-Scale Analysis on Self-Supervised Video Representation Learning","venue":"cs.CV","work_id":"54397a1a-36b8-4dd8-a27e-e68b531f29d5","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.005408Z"},"links":{"cited_paper":"/paper/2306.06010","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e2324364dccda8250a8cba86c47f4aa03d117adf687782f94efcef532aeba168","observation_id":"f5cb7d9f-37d5-4aa5-bb33-0fb9c730b803","resolution":{"observed_at":"2026-08-11T19:17:01.961590Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.685507Z","title":null,"venue":null,"work_id":"ed94d4b9-601b-42cb-855b-af56145829a5","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.019411Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:a9f2a4a726d221c9cea813edf938bba47f9d100bac4a50a61f53ccd48f0dfec1","observation_id":"4ea0f748-f024-428e-acba-74f63c96e075","resolution":{"observed_at":"2026-08-11T19:17:02.690291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02242","last_updated":"2017-03-15T14:22:41Z","snapshot_observed_at":"2026-08-14T21:36:15.005969Z","submitted_at":"2016-10-07T12:15:42Z","title":"Temporal Ensembling for Semi-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02242","snapshot_observed_at":"2026-08-11T19:17:00.054744Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.054744Z"},"links":{"cited_paper":"/paper/1610.02242","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5c4d394fd27ca05b58b3e0625cc476ab2fcb2131fb08bd77ed5999eaf03f45c4","observation_id":"3cdda4e0-9be4-46b2-b04d-0e1936f8276d","resolution":{"observed_at":"2026-08-11T19:17:00.054744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.667720Z","title":null,"venue":null,"work_id":"45a4ce82-db34-4915-98e9-767d7764a346","year":2013},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.091017Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:74bd96d7f7ca3a41c89175727cfab13395c283128e2ffcd92a2a96e3a09331da","observation_id":"2309be5e-c7f6-48e0-a5b4-835e144ee29b","resolution":{"observed_at":"2026-08-11T19:17:02.678162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04608","last_updated":"2020-08-22T14:45:35Z","snapshot_observed_at":"2026-08-14T12:04:41.858416Z","submitted_at":"2020-01-14T03:29:44Z","title":"Actions as Moving Points","version":3},"cited_work":{"arxiv_id":"2001.04608","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.04608","snapshot_observed_at":"2026-08-11T19:17:01.893041Z","title":"Actions as Moving Points","venue":"cs.CV","work_id":"bbd3cba1-f58a-4b2f-8251-7b6d107c0786","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.094266Z"},"links":{"cited_paper":"/paper/2001.04608","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:1dcc4c6a2a7ca0b53d977118467f3f995b84b160835807b3efda3b0a01f7c684","observation_id":"ea6d16d5-518c-48c9-b32b-6b9f0c137b5e","resolution":{"observed_at":"2026-08-11T19:17:01.905071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.651726Z","title":"E.; Fu, C.-Y.; and Berg, A","venue":null,"work_id":"57e8396b-f816-4390-916e-3ef8329422b4","year":2016},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.114922Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:c7142ea4d5750c7600e9a97a9ea169bddee6a0e9f36f7841b28029c1a5030821","observation_id":"ba96dec2-1da1-41e9-bb64-e6276f82f434","resolution":{"observed_at":"2026-08-11T19:17:02.657565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.637330Z","title":null,"venue":null,"work_id":"2a15175f-c61b-49ed-aa3b-a9934e0e4dfc","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.174749Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:72021d0ade14dbe07366d3876610b296d9d7e9730b28d452cc5ac93049201140","observation_id":"c140c390-0967-40e9-bf9d-050ffbb00f42","resolution":{"observed_at":"2026-08-11T19:17:02.642566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.622978Z","title":null,"venue":null,"work_id":"26cda347-e48f-45a6-b1b0-3b5e3e0fe5b2","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.207897Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d0078d89c810e5aa3332ea14e3f169f4dcc0356f927936633dd969bcd53eac28","observation_id":"3894a49a-2b53-47c5-98f5-3a410033089d","resolution":{"observed_at":"2026-08-11T19:17:02.626001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.614644Z","title":null,"venue":null,"work_id":"82527de8-55a8-4d20-ae94-86d105e8e0d2","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.217909Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:4e6e5d722f62e3d8a537ab5a782698493a045781eb24cbb38303c556eb54ff02","observation_id":"ebcbc639-71ef-4ddd-a3b1-93095c3d66da","resolution":{"observed_at":"2026-08-11T19:17:02.616883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.607153Z","title":null,"venue":null,"work_id":"84bdcc89-f322-4bff-a468-febfeb1e9c25","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.235049Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:fedea3f69e5f07836979ccc119964a4362fbf28611fed3351b12f572479ddd9e","observation_id":"5138a785-93df-4e6e-8ac3-911db9413e85","resolution":{"observed_at":"2026-08-11T19:17:02.609725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09143","last_updated":"2017-07-28T08:16:34Z","snapshot_observed_at":"2026-08-14T20:44:42.939918Z","submitted_at":"2017-07-28T08:16:34Z","title":"Localizing Actions from Video Labels and Pseudo-Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09143","snapshot_observed_at":"2026-08-11T19:17:00.264741Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.264741Z"},"links":{"cited_paper":"/paper/1707.09143","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:bd593ee150ebd956232c995ed8bbc6244a0e92256cb0a52b341b6dc58d366439","observation_id":"f4806af6-7b9e-43b9-ac2a-d032804e56a4","resolution":{"observed_at":"2026-08-11T19:17:00.264741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.600156Z","title":null,"venue":null,"work_id":"7139d0cd-afda-48d4-93d1-19e1824751b6","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.294827Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:624a8792089fa61f4ddf51238d094d8e161d93fb7714578d1fc15d2c0b6bf0be","observation_id":"d06ed2af-373e-4672-8c98-0b0503c3a409","resolution":{"observed_at":"2026-08-11T19:17:02.602629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.591660Z","title":null,"venue":null,"work_id":"ec3ac788-9ed7-4a4d-970a-3420cd3c8a32","year":2024},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.344747Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ad25d80bfac979f0f7dc3f6b8ffd7c05dfc6d0df48c488ce1e7b6156450cc46b","observation_id":"7c009b86-4d0e-433d-9f26-4623ef99f1f8","resolution":{"observed_at":"2026-08-11T19:17:02.594662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:00.370443Z","title":"Z.; Liu, Y.; Shao, J.; and Li, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.370443Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:4f9f0564028609debad89d30c0a52d16ed185c4aa322a56f4c68e801cab1c155","observation_id":"b7208893-f716-43fc-b68d-64f05761e41e","resolution":{"observed_at":"2026-08-11T19:17:00.370443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.578621Z","title":null,"venue":null,"work_id":"c1d6e498-5118-4649-bdd1-a77f25184bb0","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.395125Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:a1b28eea9946be0d6e45b5509a86d2c400506ef86f8803aa41758e662a0054e9","observation_id":"6a59208c-ac36-4f64-bf12-54d509df3c6c","resolution":{"observed_at":"2026-08-11T19:17:02.580711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.02672","last_updated":"2015-11-24T09:22:23Z","snapshot_observed_at":"2026-08-14T22:41:02.968843Z","submitted_at":"2015-07-09T19:52:19Z","title":"Semi-Supervised Learning with Ladder Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.02672","snapshot_observed_at":"2026-08-11T19:17:00.425676Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.425676Z"},"links":{"cited_paper":"/paper/1507.02672","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:1611099812af0e4e19f367a966c13f955b42a650d1c17f7ba020d07d593ccc18","observation_id":"4caf57dc-d6be-49b4-abc8-baede9aa0e81","resolution":{"observed_at":"2026-08-11T19:17:00.425676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.572205Z","title":null,"venue":null,"work_id":"4824e98f-320c-4080-af2b-be6013115196","year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.440512Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:8b949f1d9f9fbefe011709441cf4d641cf7d7e663b38ecbcbc62dfe3a1c60856","observation_id":"95691415-e950-410c-9b6a-065da2c0449f","resolution":{"observed_at":"2026-08-11T19:17:02.574391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.558373Z","title":"N.; Duarte, K.; Rawat, Y","venue":null,"work_id":"fc2f9f96-99ed-4353-a0cf-f63a73de83ce","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.494748Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:558769af4e9217afec9afe00bddc20a1435abc5edc4525648079d4cc8414ccc9","observation_id":"f64626a4-8e5a-4619-81ab-13b46f025d90","resolution":{"observed_at":"2026-08-11T19:17:02.564238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-15T21:30:31.645090Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-11T19:17:00.554745Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.554745Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:29a01ad4559f620f81dac9617f7ab30bd047804a7c9b744c90708c96a6d4355e","observation_id":"6636afb3-363a-4603-9a51-f053f3379167","resolution":{"observed_at":"2026-08-11T19:17:00.554745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.537767Z","title":null,"venue":null,"work_id":"24756d68-d038-4f1c-a0d6-b569d3785ca7","year":2016},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.585714Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:861ea60344235c03a781ba8a3353edc54e0bbc0076bb864dfebc932366b8555f","observation_id":"61ce492e-9513-4e75-a1ad-d7c62807284a","resolution":{"observed_at":"2026-08-11T19:17:02.542861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.528893Z","title":"S.; Saenko, K.; and Das, A","venue":null,"work_id":"37b87442-44ac-428a-a267-8175cfc61857","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.614748Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ac17e8410d66e8ebc5839feba57e1f57040f1300355732c4a7e21c593e7c55d3","observation_id":"efd70d79-42b5-4389-bb89-5f99e7e9965d","resolution":{"observed_at":"2026-08-11T19:17:02.531467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.520344Z","title":"J.; Kumar, A.; Vyas, S.; and Rawat, Y","venue":null,"work_id":"a2d587a4-5202-4284-b6a1-1774f0d24734","year":2024},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.654744Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ba9ddb584c764cba7d820a6338f577030f62a4102bbb48af77fd1644615b2054","observation_id":"7b272520-ed28-4686-8b85-2f906baa26de","resolution":{"observed_at":"2026-08-11T19:17:02.522490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.513816Z","title":"A.; Cubuk, E","venue":null,"work_id":"5cb3d02a-9b69-47c3-a8ff-3fb767c016f3","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.684746Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6dca6a5c7ff999760348a56d8845f3cffc9c833103d81d66d65e7d53fa52791f","observation_id":"118abe95-0b13-46d9-98f2-68b40ef9d9c5","resolution":{"observed_at":"2026-08-11T19:17:02.516289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.501299Z","title":null,"venue":null,"work_id":"03c776bd-32cb-446f-9a1e-d55eea69e5f3","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.724747Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:0706454b0e4c1af67691c0478c7e47597c453bf66ea0da15bd8b2123e08c912b","observation_id":"3fc60b04-e015-4cd2-8595-657a46388ae8","resolution":{"observed_at":"2026-08-11T19:17:02.508324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-11T19:17:00.764745Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.764745Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:eac735fe9d6f224f29d0c9a32f239110602f9d1b7f532bf88174e9ab9310c234","observation_id":"71e719cc-3a88-4b6a-9189-7ed70eff92ad","resolution":{"observed_at":"2026-08-11T19:17:00.764745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.473956Z","title":null,"venue":null,"work_id":"0a2b218e-b535-4491-903b-2abcc36e6b81","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.795381Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5c7f802f45fe716798fad7e82c1876d1db206fbc3507c8d4e24323e7b1a2e37f","observation_id":"e6c0e42d-53b4-4b3f-9b7f-528a3cd68c69","resolution":{"observed_at":"2026-08-11T19:17:02.483479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.460524Z","title":null,"venue":null,"work_id":"e8e15ce9-312b-47a1-aa77-341ed5736398","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.816932Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:98e12580680b6bc92951e975fd38aa6eebb49273cae3713bfbf79cf3de7708e7","observation_id":"15665083-40f1-4171-9285-ca9035cf0758","resolution":{"observed_at":"2026-08-11T19:17:02.462920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.442340Z","title":null,"venue":null,"work_id":"fa1b9e13-d226-401d-bba9-3cce67a8994f","year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.828177Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:05d6c1187a380a2ca0eeb83ae0d44b81b96cce75acd56d2c5bd91759de4051f6","observation_id":"f1ee6d6d-eecf-4fde-a41c-280fe55b0d4d","resolution":{"observed_at":"2026-08-11T19:17:02.444968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.434325Z","title":null,"venue":null,"work_id":"0fde87e2-dc54-48bc-a4d5-6943da42e4f0","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.832651Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:dc81ee0ba85322b4363f227477679c4629497795a22c0baeb54a990a7c9c15bd","observation_id":"53dc3e4d-dce7-49c2-9725-8748fd69db1f","resolution":{"observed_at":"2026-08-11T19:17:02.438082Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.427954Z","title":null,"venue":null,"work_id":"52ba6c43-9518-41dd-be56-ade443f9747f","year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.837677Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:c5dd7d9efb6214fadbd844c8c9bbe52d3d9e0828f13c51e05900e8fdc5975e72","observation_id":"8347ed15-2ccb-4097-972f-e812ffbcb451","resolution":{"observed_at":"2026-08-11T19:17:02.430161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15879","last_updated":"2023-03-28T10:47:06Z","snapshot_observed_at":"2026-08-16T15:44:45.609199Z","submitted_at":"2023-03-28T10:47:06Z","title":"STMixer: A One-Stage Sparse Action Detector","version":1},"cited_work":{"arxiv_id":"2303.15879","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.15879","snapshot_observed_at":"2026-08-11T19:17:01.777117Z","title":"STMixer: A One-Stage Sparse Action Detector","venue":"cs.CV","work_id":"4635a450-1938-4f8c-a023-124d2097e3fc","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.856981Z"},"links":{"cited_paper":"/paper/2303.15879","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:14765bddb596676fab8e3efd66b6f7f5faadbdd80f4546d0727eed778f510f56","observation_id":"cdb533d6-49e2-409e-9d47-1900f40da740","resolution":{"observed_at":"2026-08-11T19:17:01.801875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.413376Z","title":null,"venue":null,"work_id":"fa292c8b-8b6e-4119-8465-4c2148a93a27","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.859512Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:52b84b263a1e4dc41dccbef5ca02dcf5b06911abecc71f5236c58832fa14e050","observation_id":"5c9a1dbd-b254-4f4a-9d52-255af03fd9f0","resolution":{"observed_at":"2026-08-11T19:17:02.419430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09018","last_updated":"2021-08-06T16:28:39Z","snapshot_observed_at":"2026-08-16T18:16:37.203904Z","submitted_at":"2021-06-16T17:59:30Z","title":"End-to-End Semi-Supervised Object Detection with Soft Teacher","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09018","snapshot_observed_at":"2026-08-11T19:17:00.861766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.861766Z"},"links":{"cited_paper":"/paper/2106.09018","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ebfb0b11e81852b54ea069635681a8e9e80f0774a931070f2019173aae9e7b26","observation_id":"98b9a369-bd62-4683-8895-9a7e5eb67052","resolution":{"observed_at":"2026-08-11T19:17:00.861766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.365389Z","title":null,"venue":null,"work_id":"e3a5da6d-c65d-4cfd-a169-2665ed77ca7c","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.874768Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5ebefdb4a6df51fdfb5cf01e7fde8ccb14c50c35378dee88214aa804d918c5f4","observation_id":"7edcffa5-9fc5-45df-8faa-9675779acf76","resolution":{"observed_at":"2026-08-11T19:17:02.374734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00461","last_updated":"2018-09-03T06:16:13Z","snapshot_observed_at":"2026-08-14T18:33:52.839402Z","submitted_at":"2018-09-03T06:16:13Z","title":"YouTube-VOS: Sequence-to-Sequence Video Object Segmentation","version":1},"cited_work":{"arxiv_id":"1809.00461","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.00461","snapshot_observed_at":"2026-08-11T19:17:01.654750Z","title":"YouTube-VOS: Sequence-to-Sequence Video Object Segmentation","venue":"cs.CV","work_id":"cdf70443-17aa-4838-8f28-91706e968868","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.899915Z"},"links":{"cited_paper":"/paper/1809.00461","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:8f1ca50f40bdf4879b1a043c16a609b772cac3ac9ae5e975df9b00ed1573401f","observation_id":"cf454c68-8a99-46c0-b7f7-79a9448b3578","resolution":{"observed_at":"2026-08-11T19:17:01.675586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.03327","last_updated":"2018-09-06T04:19:45Z","snapshot_observed_at":"2026-08-20T04:50:05.503590Z","submitted_at":"2018-09-06T04:19:45Z","title":"YouTube-VOS: A Large-Scale Video Object Segmentation Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.03327","snapshot_observed_at":"2026-08-11T19:17:00.944745Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.944745Z"},"links":{"cited_paper":"/paper/1809.03327","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:74f3128fd3aed37d52ea693c4cd887fc5766a32c0d02dc4385c74a058b74cb3c","observation_id":"f57d4a2d-0b4d-4f20-8a83-3d9835524943","resolution":{"observed_at":"2026-08-11T19:17:00.944745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.348044Z","title":null,"venue":null,"work_id":"87a0fae9-7f90-4f7b-8358-1a176f2aa23a","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.974743Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d727a619e8e169c0781b8eaf0e300268604f5b3d6c2aac95f251bb38a854af37","observation_id":"0a35821e-4817-43b7-884e-94d2f25c3fff","resolution":{"observed_at":"2026-08-11T19:17:02.353353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06848","last_updated":"2023-06-08T01:49:33Z","snapshot_observed_at":"2026-08-16T15:55:32.138920Z","submitted_at":"2023-02-14T05:52:45Z","title":"YOWOv2: A Stronger yet Efficient Multi-level Detection Framework for Real-time Spatio-temporal Action Detection","version":2},"cited_work":{"arxiv_id":"2302.06848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.06848","snapshot_observed_at":"2026-08-11T19:17:01.504739Z","title":"YOWOv2: A Stronger yet Efficient Multi-level Detection Framework for Real-time Spatio-temporal Action Detection","venue":"cs.CV","work_id":"42236e40-06cf-48b6-9d79-10e28d7ced84","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.014748Z"},"links":{"cited_paper":"/paper/2302.06848","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:c29888c5f3440f9e67e2cd99669d47a3e872423f2017f5ee41b067a8b628c0c7","observation_id":"bf467960-7581-45a8-912b-d1cec67c7bf2","resolution":{"observed_at":"2026-08-11T19:17:01.539486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.322672Z","title":"S.; and Kautz, J","venue":null,"work_id":"89b0481e-70cd-4833-9f03-40290b90b40c","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.056911Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:80608113ea2face602c791daacd0faaa59f5fde65286c33d909242592e237e7c","observation_id":"80a04c4d-bdab-4d7f-9148-1ff9ad54b495","resolution":{"observed_at":"2026-08-11T19:17:02.334744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.303847Z","title":null,"venue":null,"work_id":"054c217b-6758-4bc1-acd7-4932af7e81e4","year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.084745Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:23c613fb1b5953a3bd8253a16ec92ac6e715b920937b26cab70cf18708b80fb0","observation_id":"c03ee336-b0a3-4898-8331-c25341d05e85","resolution":{"observed_at":"2026-08-11T19:17:02.310686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.265071Z","title":null,"venue":null,"work_id":"e920b2e8-d121-4ea0-937b-db853bb4864b","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.118942Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ef544a5b7080f8fb63c5f682b6300f7d7fe353a094e56c349c76caf7d2b1e62f","observation_id":"d88ca153-7d88-4460-b400-c4e76e82c638","resolution":{"observed_at":"2026-08-11T19:17:02.294975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00969","last_updated":"2022-05-10T07:39:03Z","snapshot_observed_at":"2026-08-16T18:34:16.021761Z","submitted_at":"2021-04-02T10:21:22Z","title":"TubeR: Tubelet Transformer for Video Action Detection","version":5},"cited_work":{"arxiv_id":"2104.00969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.00969","snapshot_observed_at":"2026-08-11T19:17:01.364844Z","title":"TubeR: Tubelet Transformer for Video Action Detection","venue":"cs.CV","work_id":"f40d9c70-3634-40c8-ac39-0f655ba8e38d","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.121437Z"},"links":{"cited_paper":"/paper/2104.00969","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d77f63be7f267bab0438161951a4db423983ce7c60a5adf3d19ca6b0318912cc","observation_id":"5bb50453-7da9-46d2-aeda-a8717a5edc93","resolution":{"observed_at":"2026-08-11T19:17:01.385720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.225127Z","title":null,"venue":null,"work_id":"7e8694a8-6151-4448-aaec-aa069f7696e4","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.142808Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5703cbdaa42a2c7ff9c0b3bc714af37ea8fa4c84bb591265e4571cb52cbc9d59","observation_id":"ae50adae-f221-4e44-933f-347360cdca96","resolution":{"observed_at":"2026-08-11T19:17:02.246546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:01.186876Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.186876Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:b13e4218e115bdb97f1a0d50f94127fdba9d00405a592c6507f7608ef27948eb","observation_id":"bc2a939a-1f71-440a-884f-1aa5a4471974","resolution":{"observed_at":"2026-08-11T19:17:01.186876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:01.216603Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.216603Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d0fa9fc650375f214d56f0cf153800ec2593c5fd9528b05cb2c961927c7807cf","observation_id":"587515b6-f6a6-4b59-982e-630e0a980598","resolution":{"observed_at":"2026-08-11T19:17:01.216603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T01:58:07.016575Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":7,"verified_fuzzy":10},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2412.07072."}