{"as_of":"2026-08-18T10:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ef3a536a085d85478df4e28a0d61a02dcb3a261885d501da78642656cccfbd4","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:24:56.889476Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.13123/citation-record","integrity":"/paper/2505.13123/integrity","json":"/paper/2505.13123/citation-record.json","paper":"/paper/2505.13123"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1705.07750","last_updated":"2018-02-12T17:10:11Z","snapshot_observed_at":"2026-08-14T20:59:05.330633Z","submitted_at":"2017-05-22T13:57:53Z","title":"Quo Vadis, Action Recognition? A New Model and the Kinetics Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07750","snapshot_observed_at":"2026-08-15T20:24:56.648065Z","title":"Quo vadis, action recognition? A new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.648065Z"},"links":{"cited_paper":"/paper/1705.07750","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:10145fe89d66a4fd3cf415bc5b0929bbeb519b49b6c62814eba1ce3c0d1f9c29","observation_id":"b95d5db5-3dd8-459a-84c9-9d908ec12779","resolution":{"observed_at":"2026-08-15T20:24:56.648065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.580270Z","title":"Prompt-enhanced multiple instance learning for weakly supervised video anomaly detection","venue":null,"work_id":"90fd0902-27c8-4afd-83b2-714f23875991","year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.655399Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:67c850e5e30655e84a392b24bfe3dd8f1c6ea48c21402e99d2fd83cf843d5a62","observation_id":"23dc0409-d132-4b0a-a330-b2898e811c49","resolution":{"observed_at":"2026-08-15T20:24:57.586536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.660976Z","title":"Tevad: Improved video anomaly de- tection with captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.660976Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:cc18b920a5e6d1849823ed6ee6ebe0249047652ca721147a851eef99320c4aea","observation_id":"95fdad44-fabb-4749-8a84-b0f4d9edaebb","resolution":{"observed_at":"2026-08-15T20:24:56.660976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.551752Z","title":"Mgfn: Magnitude- contrastive glance-and-focus network for weakly-supervised video anomaly detection","venue":null,"work_id":"54e92bc3-bf5a-49ee-8c63-4f1b5411ddbd","year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.667995Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:4874f822fcb08366329afc91ed0c828e148cd306628a586beaee73440f843129","observation_id":"7f83dc07-f600-4cf0-a7c1-fe2eb096d372","resolution":{"observed_at":"2026-08-15T20:24:57.557159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.533657Z","title":"Look around for anomalies: Weakly-supervised anomaly detection via context-motion relational learning","venue":null,"work_id":"70b27454-22ef-45ff-8e89-a880ab51be45","year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.674728Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:fdaf2a9fde55a7226548d3c4722185865bc0fa89b98dbbc35e50289af8a694d8","observation_id":"9efd73f2-8bd3-410f-8e01-32a011d7ca07","resolution":{"observed_at":"2026-08-15T20:24:57.539223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.517035Z","title":"Learning an augmented rgb representation with cross-modal knowl- edge distillation for action detection","venue":null,"work_id":"84e0da0c-dbe9-4ad9-8d16-fe11be430910","year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.681653Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:983df2a182be35cc74ab38e5858a8dccd668155ecc67590c20d681289e4de669","observation_id":"42800668-7253-46f6-9cf3-9662f9240a32","resolution":{"observed_at":"2026-08-15T20:24:57.522366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.501023Z","title":"Vpn: Learning video-pose embedding for activities of daily living, 2020","venue":null,"work_id":"17de4814-bf7d-4560-bc03-e922ffdef0e4","year":2020},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.688346Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:904e8b198fca97ace595a88b46e50942aefad9bb06434e35fa130227d9812533","observation_id":"64d08770-84c6-4403-9cce-ccb880f760cc","resolution":{"observed_at":"2026-08-15T20:24:57.506467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.483446Z","title":"Vpn++: Rethinking video-pose embeddings for understand- ing activities of daily living","venue":null,"work_id":"e9b264e2-b8ab-4218-85ef-9f873b423c20","year":null},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.693676Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:0202e376baf4c9b95d9988bdea07627fb1bd909724e7a0ad13cdbd4bd173f6d6","observation_id":"e2492c97-e8e5-4eb4-85d8-df95798da993","resolution":{"observed_at":"2026-08-15T20:24:57.489605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.699457Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.699457Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:7951da83d5186c9c9ffe26b7b7964afd31891535095825d3654ea8eff81a2c90","observation_id":"1452f70c-58e7-42cc-8b2e-38608524338c","resolution":{"observed_at":"2026-08-15T20:24:56.699457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.455815Z","title":"Clip-tsa: Clip-assisted temporal self-attention for weakly-supervised video anomaly detection","venue":null,"work_id":"a620872d-741e-42f4-bc50-4ebf14f72d2f","year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.705078Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:132cd540a3f961a0fe8c9492fbe4a181362ae402eb4677a6722a6912b8d51400","observation_id":"7ce29d11-59a1-4dbc-913d-a90f32250bef","resolution":{"observed_at":"2026-08-15T20:24:57.461380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-15T11:35:18.832923Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-15T20:24:56.710897Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.710897Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:c917379550b7a43df5fc1f3f66a35ca344a9718ece7d710140a4d7dc0696ee15","observation_id":"ff7b3e0d-c30d-463d-9751-d86189c2c057","resolution":{"observed_at":"2026-08-15T20:24:56.710897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.717625Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.717625Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:ba4b22b18706d8b4246d849187beacaa064ca90098a37823057d9fb64cbcc24e","observation_id":"69409e2d-c2b9-45fa-b135-b3ee0e75212f","resolution":{"observed_at":"2026-08-15T20:24:56.717625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.723104Z","title":"Scale-aware spatio-temporal relation learning for video anomaly detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.723104Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:95de53a62a5887aaa3d1175f475d3398f9dd97197dbc7f252d3c863558c62a2d","observation_id":"68f95dab-52ef-4961-9b67-ca8bc2a953dc","resolution":{"observed_at":"2026-08-15T20:24:56.723104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.418359Z","title":"Self-training multi- sequence learning with transformer for weakly supervised video anomaly detection","venue":null,"work_id":"1ca56d22-c58d-4ab9-8f65-b6bf87b99c87","year":2022},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.727968Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:cbebce5b9fff1c1743fa1a50d8867f54ce71ead539b92cbe637378a7e84742de","observation_id":"f84d907f-048b-4570-a522-cc4c32e5db63","resolution":{"observed_at":"2026-08-15T20:24:57.423402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08197","last_updated":"2024-04-16T01:13:35Z","snapshot_observed_at":"2026-08-16T14:01:33.379050Z","submitted_at":"2024-04-12T02:04:34Z","title":"Scaling (Down) CLIP: A Comprehensive Analysis of Data, Architecture, and Training Strategies","version":2},"cited_work":{"arxiv_id":"2404.08197","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.08197","snapshot_observed_at":"2026-08-15T20:24:56.998981Z","title":"Scaling (Down) CLIP: A Comprehensive Analysis of Data, Architecture, and Training Strategies","venue":"cs.CV","work_id":"3fbb4c46-4634-49e9-aab7-932bbd4c855b","year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.733349Z"},"links":{"cited_paper":"/paper/2404.08197","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:f07a139791f35b566746ffcb9e838b62f792dd7d4b7a3332a32eb148cfe7d54c","observation_id":"ca3fbca4-a234-4013-b681-b13c2a57cb37","resolution":{"observed_at":"2026-08-15T20:24:57.007406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.402050Z","title":"Social mil: Interaction-aware for crowd anomaly de- tection","venue":null,"work_id":"bfbcd38e-9b8f-4493-a1cf-10c913644c50","year":2019},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.739363Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:faa58a0411a6d837d0e925aec60255ba065dc94895a76b6644959ef0d37eea70","observation_id":"93eed785-4ea6-4f20-b6ca-0de2dd6cd244","resolution":{"observed_at":"2026-08-15T20:24:57.407157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.744849Z","title":"Localizing anomalies from weakly-labeled videos","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.744849Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:6ebc34e1f7a68cbb4dfa686b57778c378907d75cb17df476b01e0a663a844ba7","observation_id":"7668f47a-152f-4946-8a46-8861bf148c0b","resolution":{"observed_at":"2026-08-15T20:24:56.744849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.375868Z","title":"Unbiased multiple instance learning for weakly supervised video anomaly detection","venue":null,"work_id":"1f7d4363-2251-40cb-98eb-43a677b5cc47","year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.749952Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:03461fe3fb27b5e9b215cb49ca6df0b8f541dbfe043c95616a5a334de41bf109","observation_id":"40606378-cffa-415d-844c-113d137359e2","resolution":{"observed_at":"2026-08-15T20:24:57.381201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.359941Z","title":"Weakly-supervised joint anomaly detection and classification","venue":null,"work_id":"cce5ad81-f1f2-4899-81b4-fb74b98ba6a8","year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.755273Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:7f87b338d0f3b7459a2bbc1b3296da2d0362f1deb00ecf72a10690d76e3867b0","observation_id":"ebee4e73-0dc9-4290-825a-ee4dfe9615c2","resolution":{"observed_at":"2026-08-15T20:24:57.365128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.343828Z","title":"Dam: Dissimilarity attention module for weakly-supervised video anomaly detection","venue":null,"work_id":"8c1e965b-74b9-4af3-8641-090a9b7cff85","year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.760788Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:369ec58dc3bf833bf48de5ee82026d2d43dac6b0e50177154d2d9002bb5cf2f3","observation_id":"e78410e6-5420-4578-96d5-353d082d0d81","resolution":{"observed_at":"2026-08-15T20:24:57.349369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.766365Z","title":"Human- scene network: A novel baseline with self-rectifying loss for weakly supervised video anomaly detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.766365Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:2054c525470d14d8834964466079d8ee50983b8103ba9b88870088b412d998ae","observation_id":"7f31b0e0-2c02-4b10-95e1-e4a2c77a3a41","resolution":{"observed_at":"2026-08-15T20:24:56.766365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-15T20:24:56.771501Z","title":"Repre- sentation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.771501Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:d69689ee6ee4ff754d235d19087c88c5ab39e47bb295490fe6e85927a0645f80","observation_id":"65ec70e5-b51e-4bdb-89a4-34accaec034d","resolution":{"observed_at":"2026-08-15T20:24:56.771501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.314720Z","title":"Dance with self-attention: A new look of conditional ran- dom fields on anomaly detection in videos","venue":null,"work_id":"6a850221-ddfe-4dbf-afba-20df05d48a8d","year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.777178Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:c318896eab617ada6e54c507e5915bd97c431809deeb833be832b41cc1dd7029","observation_id":"f48e365e-0b0f-4543-9814-677fec1fe853","resolution":{"observed_at":"2026-08-15T20:24:57.319762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.782065Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.782065Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:2178278147a6759af90595308127ca09331c667bb85a46bed60e5de640d0d033","observation_id":"a742a6a7-24d6-4252-8446-0f15dba9e65e","resolution":{"observed_at":"2026-08-15T20:24:56.782065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.287519Z","title":"Fine-tuned clip models are efficient video learners","venue":null,"work_id":"b301ecad-7000-4612-9568-2b32f9ed3e9a","year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.787494Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:4896b2d299c821c0c939148024186486a7ff556337623354d4d614927ddaa1a8","observation_id":"7c317c1c-19c2-46e3-bdd9-a92f477efa0d","resolution":{"observed_at":"2026-08-15T20:24:57.292668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.272160Z","title":"Just add π! pose induced video transformers for understanding activities of daily liv- ing","venue":null,"work_id":"5bfef1a5-0b92-4ba4-8801-4f59d409821a","year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.792653Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:f018e827e25a51dcc3159de61e406c12a3a5549206c1c42db55c0e8ce9c4e04d","observation_id":"e2e3ba5b-954f-4ebf-aa30-bb04f6e01d07","resolution":{"observed_at":"2026-08-15T20:24:57.277141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.256663Z","title":"Real-world anomaly detection in surveillance videos","venue":null,"work_id":"d8692fb9-78a7-40cc-ac41-f8efdc8d4692","year":2018},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.798474Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:0ee585fd5a8ac2748f3c3a065d2d25b1cc589d6b02e2a1ee0e636bab0a27e377","observation_id":"6804f9d8-6d43-4199-8573-8ceda99f2f69","resolution":{"observed_at":"2026-08-15T20:24:57.261712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.805747Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.805747Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:f2aee4dbdd020358b17fce0ec8c51df9ead8d052b50ec1600c93f90f6954a8f4","observation_id":"86474913-626d-40cd-9b2d-2d4284e77608","resolution":{"observed_at":"2026-08-15T20:24:56.805747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.228492Z","title":"Weakly-supervised video anomaly detection with robust temporal feature magni- tude learning","venue":null,"work_id":"36d10d95-6274-46da-83e8-82d01cba3487","year":2021},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.812436Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:e7dd60910dd91c49176ffbc08512de664dd0f2b59ad141ca572b224225528fd2","observation_id":"74758ab5-26c0-4739-be7f-e9e0baf81e6d","resolution":{"observed_at":"2026-08-15T20:24:57.234239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.211906Z","title":"Weakly supervised video anomaly detection via center- guided discriminative learning","venue":null,"work_id":"7cffa73d-bab5-4ba8-a0f0-9aa811d2f7f3","year":2020},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.819412Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:075b8f34fbfe5bec0a10699e8fc166075c47e3c2281b5f6d6635e6a9ebeeb8ea","observation_id":"1bc1b032-66c1-4fa5-8dd9-0fdf34a24bd8","resolution":{"observed_at":"2026-08-15T20:24:57.217403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.195275Z","title":"Yolov7: Trainable bag-of-freebies sets new state-of-the-art for real-time object detectors","venue":null,"work_id":"58eec779-91c2-4bda-91bf-462234a3e2b7","year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.824540Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:071881466f8d41dc5de15136ac1ea9d70210b993379d9a18e471472c6d97e2ba","observation_id":"49b9cb86-74ab-4069-aa88-2faf6ed6c841","resolution":{"observed_at":"2026-08-15T20:24:57.201038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.179067Z","title":"Not only look, but also listen: Learning multimodal violence detection under weak supervision","venue":null,"work_id":"af431707-6e36-4881-a2e6-61ef61f71c70","year":2020},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.830446Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:de7eb3e08dcdf609d5f5f80220159454651963e2441c9967b9673c210940ffa2","observation_id":"147ee4fd-5f06-423b-89cf-2d4b2a8a7acd","resolution":{"observed_at":"2026-08-15T20:24:57.184406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.163494Z","title":"Vadclip: Adapting vision-language models for weakly supervised video anomaly detection","venue":null,"work_id":"3c4fcf28-8c2d-4673-b11b-c9e375238220","year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.836512Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:daffbc77ff3a33a61cc7259b9454ef6eb7b1d79e91e46fda3a00e6d5f6e2a3ce","observation_id":"c628dcd7-3a88-42bb-adb3-7dd12b8bff55","resolution":{"observed_at":"2026-08-15T20:24:57.168381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-15T20:24:56.841803Z","title":"Depth any- thing v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.841803Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:8d58cd9809f11e5c4ba9a323102a3931194fa3959ca4eb6cda79c86581df373e","observation_id":"54c40331-a4c4-4ad8-bfc8-cfb92aebddf4","resolution":{"observed_at":"2026-08-15T20:24:56.841803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.147440Z","title":"Text prompt with nor- mality guidance for weakly supervised video anomaly detec- tion","venue":null,"work_id":"ac81b256-d00c-4a8e-9af3-84a364032cec","year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.847626Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:718dd4b95c8a41223e9c4f7044594b7c919db7c8a048a6121a361375861bc8c4","observation_id":"51214634-1f10-422e-8818-f187adf2fb04","resolution":{"observed_at":"2026-08-15T20:24:57.152886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.852980Z","title":"Modality-aware contrastive instance learning with self-distillation for weakly-supervised audio-visual violence detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.852980Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:8f5b467ade36bac63d595dcd40d91916e258222aeefad68623e38af91afb0986","observation_id":"76f64d8f-92bd-4db2-880a-52a986c915ca","resolution":{"observed_at":"2026-08-15T20:24:56.852980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.118488Z","title":"A self-reasoning framework for anomaly detection using video-level labels","venue":null,"work_id":"971ef897-9084-4a07-ae84-41a628c834e3","year":2020},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.858793Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:a89da4cbe02b3cd861380749b9a39e8564620daffbcec02b4135d5062789c058","observation_id":"0f9f73d9-196b-4a22-9c99-d54eb9181e76","resolution":{"observed_at":"2026-08-15T20:24:57.124437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:56.863574Z","title":"Exploiting completeness and uncertainty of pseudo labels for weakly supervised video anomaly detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.863574Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:2493ce8d393d3e308dd11529107e848fde34eb15484ea26c8e04162152be7290","observation_id":"5d2012f1-9070-4ee5-8369-67c395266c08","resolution":{"observed_at":"2026-08-15T20:24:56.863574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.087239Z","title":"Temporal con- volutional network with complementary inner bag loss for weakly supervised anomaly detection","venue":null,"work_id":"a3758933-1c71-44f1-8e4c-b007c326f926","year":2019},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.868460Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:9bcfc6d0c869530b9602f2ff4506547acd7813174d83ee658e68776d68230fb2","observation_id":"aca5a216-c972-486c-a39a-6bd99eb7cdcf","resolution":{"observed_at":"2026-08-15T20:24:57.093197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.071360Z","title":"Li, and Ge Li","venue":null,"work_id":"8819acbb-02d1-42e3-a9ae-6b1d2d81d8a7","year":2019},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.873467Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:249cb07fc50184fb1e4ed7d7673a1a3fef176e9cd4716a7a878189bd0aedb372","observation_id":"7486cbcf-d03c-4524-a743-8d2354094cb0","resolution":{"observed_at":"2026-08-15T20:24:57.076132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05160","last_updated":"2023-02-10T10:39:40Z","snapshot_observed_at":"2026-08-18T01:58:13.564414Z","submitted_at":"2023-02-10T10:39:40Z","title":"Dual Memory Units with Uncertainty Regulation for Weakly Supervised Video Anomaly Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05160","snapshot_observed_at":"2026-08-15T20:24:56.878401Z","title":"Dual memory units with uncertainty regulation for weakly supervised video anomaly detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.878401Z"},"links":{"cited_paper":"/paper/2302.05160","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:856254286af05c7e3153409cb3bc7f01e89e6bb09d936f5e9fd753a6e7aa88b6","observation_id":"1e9d7f87-abff-401c-aad5-74441c072566","resolution":{"observed_at":"2026-08-15T20:24:56.878401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:24:57.053771Z","title":"Advancing video anomaly detection: A concise re- view and a new dataset","venue":null,"work_id":"9151751f-1a1a-4b04-9ade-2e7052848b80","year":2024},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.883569Z"},"links":{"citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:272d4cbfe5db3729b4cc5ef31748008709c31521592f068af7b2045593f64c7b","observation_id":"aa25fad3-a07c-47f0-8b44-15d3934c9e7a","resolution":{"observed_at":"2026-08-15T20:24:57.059072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10211","last_updated":"2019-07-24T02:36:28Z","snapshot_observed_at":"2026-07-06T08:09:45.736165Z","submitted_at":"2019-07-24T02:36:28Z","title":"Motion-Aware Feature for Improved Video Anomaly Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10211","snapshot_observed_at":"2026-08-15T20:24:56.889476Z","title":"Motion-aware feature for improved video anomaly detection","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:24:56.889476Z"},"links":{"cited_paper":"/paper/1907.10211","citing_paper":"/paper/2505.13123"},"observation_digest":"sha256:d19511512b85e88d278b6d9c9e4c80358da2caf9c593ff24bc8268b5bd046b0b","observation_id":"b2d06a8f-dfd9-4911-9641-01fe7db2386a","resolution":{"observed_at":"2026-08-15T20:24:56.889476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.13123","last_updated":"2025-05-19T13:51:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T01:58:32.562420Z","submitted_at":"2025-05-19T13:51:57Z","title":"Just Dance with $\\pi$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2505.13123."}