{"as_of":"2026-08-10T06:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73623d270c2a5183cea98e1098d21e88d0d412f6d67008c10bfec9179254268f","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:32:52.985834Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.15905/citation-record","integrity":"/paper/2507.15905/integrity","json":"/paper/2507.15905/citation-record.json","paper":"/paper/2507.15905"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.future.2015.01.001","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Rafiqul Islam","venue":"Future Generation Computer Systems","work_id":"325e6d0f-5886-4ea0-a9a4-7f3a1ccd9165","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.351770Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:a7318030b1694e106f5383791f6db14e64952b4cab745fd19d8ce1db39d056a5","observation_id":"6de50b0f-e558-491a-a3f5-b712f8bbb102","resolution":{"observed_at":"2026-08-06T15:32:53.098549Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:48.495537Z","title":"doi: https://doi.org/10.1016/j","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.495537Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:eb34bc901473522f0270b196ded6225b988fe02698ccd3f15463d328812061ee","observation_id":"b33657c0-30da-4e53-ae5c-9fefdfbb6732","resolution":{"observed_at":"2026-08-06T15:32:48.495537Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01390","last_updated":"2023-08-07T17:53:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-02T19:10:23Z","title":"OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01390","snapshot_observed_at":"2026-08-06T15:32:48.679148Z","title":"Openflamingo: An open- source framework for training large autoregressive vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.679148Z"},"links":{"cited_paper":"/paper/2308.01390","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:7fa255198c8f4ea8d40951cc77e7b1141077f788d60b72df6cac76c3645bff8b","observation_id":"8ff44637-db97-466e-84c9-edb60e06e990","resolution":{"observed_at":"2026-08-06T15:32:48.679148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-06T15:32:48.979584Z","title":"On the oppor- tunities and risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.979584Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:0cf944a782345a80d89ed26ec70ff07cf7c1d23eedecb97861de4b3a201e444a","observation_id":"d0711552-5a3c-40ef-8ab3-68b6fc03ab3d","resolution":{"observed_at":"2026-08-06T15:32:48.979584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i12.26720","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Behzad Bozorgtabar, Dwarikanath Mahapatra, and Jean-Philippe Thiran","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"aa461c5a-4e4f-48f9-ac0c-da232d862c52","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.059668Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:2e2ab1f64d7dc2370141979a1c00935eb7f9839ef313b52444d635958cb8c5b4","observation_id":"857493ad-8940-41fa-9ca1-9d2d69a6a05e","resolution":{"observed_at":"2026-08-06T15:32:53.077194Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:49.141587Z","title":"doi: https://doi.org/10.1016/j","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.141587Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:6df7b3f8e980c3a60c1561e2e630c1b686af5f7ebd67dd2db2bbef49014e61dc","observation_id":"1fb5a569-a169-4e22-8610-a4631c2210ab","resolution":{"observed_at":"2026-08-06T15:32:49.141587Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.03407","last_updated":"2019-01-23T06:26:15Z","snapshot_observed_at":"2026-08-02T04:09:49.783205Z","submitted_at":"2019-01-10T21:36:57Z","title":"Deep Learning for Anomaly Detection: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.03407","snapshot_observed_at":"2026-08-06T15:32:49.334575Z","title":"Deep learning for anomaly detection: A survey","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.334575Z"},"links":{"cited_paper":"/paper/1901.03407","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:e5c17155b24ba2da30fd11eb2e51949bd855bd2ae2c79f1e7d588ddbcfe6c74c","observation_id":"47e6d330-381f-4097-8c0a-48f2aab9ae69","resolution":{"observed_at":"2026-08-06T15:32:49.334575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02178","last_updated":"2022-03-04T17:17:31Z","snapshot_observed_at":"2026-07-06T11:54:38.041673Z","submitted_at":"2021-10-05T17:07:53Z","title":"MobileViT: Light-weight, General-purpose, and Mobile-friendly Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02178","snapshot_observed_at":"2026-08-06T15:32:49.398509Z","title":"doi: 10.1016/j.neunet.2021.12.008","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.398509Z"},"links":{"cited_paper":"/paper/2110.02178","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:3535295edc6730813a9ae6dddbb870f245e4328451d4f38fbac7ef051753c64e","observation_id":"37f36c2e-d66d-447f-873e-3bee9fd02252","resolution":{"observed_at":"2026-08-06T15:32:49.398509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:49.494410Z","title":"Tevad: Im- proved video anomaly detection with captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.494410Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:5498938de682e9be05e8cf30c91a7da13b74b0a21c30f5cb0cda28789138bb4f","observation_id":"ad10f51a-4cb4-4589-a246-206cfeb4b831","resolution":{"observed_at":"2026-08-06T15:32:49.494410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/electronics11152306","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Matan Jacob Cohen and Shai Avidan","venue":"Electronics","work_id":"146ba1ff-a34e-4b61-a912-a736cd55e905","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.594627Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:81f594e6f6d39428d1b35ce1ad1c4318a97799ae8a91a0ee0c9385f907f2f918","observation_id":"4582dda2-7ae3-4f33-9bb1-47724f9cd714","resolution":{"observed_at":"2026-08-06T15:32:53.067666Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1142/s0129065722500307","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"doi: 10.1142/s0129065722500307","venue":"International Journal of Neural Systems","work_id":"9b4995f9-c504-44b6-bcef-7845560fb264","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.696680Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:5e6fcae5d45134e7d126d66e3e3e55ea784a487d5d2f950ae7224f0fa88ed827","observation_id":"cde10241-4238-4268-ac31-ac50a650ff13","resolution":{"observed_at":"2026-08-06T15:32:53.057140Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5220/0011669400003417","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"doi: 10.5220/0011669400003417","venue":null,"work_id":"ca27d1d4-d8df-44a8-a2ed-68f53ff2b4ce","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.770587Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:6c3797a3c2b12dd785478ed244407cbe8b008e6119cbfd87b7b94a54b582babc","observation_id":"189bbed4-f110-4aae-a478-c70520f47a1b","resolution":{"observed_at":"2026-08-06T15:32:53.047473Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:49.869509Z","title":"doi: https://doi.org/10.1016/j.optlastec.2023.110296","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.869509Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:60995fd0cbcd11ae234ab579e396366328892096fcfc279e90653ae326cedff4","observation_id":"5137a19e-aa8f-4abd-9350-be67e3de4cdd","resolution":{"observed_at":"2026-08-06T15:32:49.869509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.773656Z","title":"Enhancing few-shot video anomaly detection with key-frame selection and relational cross transformers","venue":null,"work_id":"b32415ac-f532-4d19-94a1-b83bc67f1231","year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.939734Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:17bc111ff65ac17e36ec311595742fab40a5c266f3738553e484cd5fab5cf8c8","observation_id":"946c122f-63ca-4c63-bcb8-75fb4b3a32bd","resolution":{"observed_at":"2026-08-06T15:32:54.776102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3464423","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Yan Fu, Bao Yang, and Ou Ye","venue":"ACM Computing Surveys","work_id":"bcd4d13f-1ce4-4f3f-a002-39083a5c8a51","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.049718Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:ed55278b65906c4b313a3e342dc507d47b463af727f67e9a242441df9c1d6421","observation_id":"b8f90f99-6822-4abf-aa9f-e608acc7c441","resolution":{"observed_at":"2026-08-06T15:32:53.038868Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.766419Z","title":"Filo: Zero-shot anomaly detection by fine-grained description and high-quality localization","venue":null,"work_id":"06bb2a8b-0e4b-4905-85e3-23fa3556e52d","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.122335Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:2fa964bf5198f301a0c1f6be3e4c8b1c383efff5fc5f2c16fe9cf672875c53a3","observation_id":"d3416954-0d28-4b1d-8024-96567873cdd6","resolution":{"observed_at":"2026-08-06T15:32:54.769006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.11642","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.367621Z","title":"doi: https://doi.org/10.1016/j.eswa.2021.116429","venue":null,"work_id":"65ef5f0e-c4d4-4a60-8705-1bbf9032bcd8","year":2021},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.220718Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:1859dc4272dc02839106c45f17e8838a35cd755d6e831a6bf5be5eee10617ddc","observation_id":"c38dd506-4775-49f9-b01f-03ea3e77bc01","resolution":{"observed_at":"2026-08-06T15:32:54.371701Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32347","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.312287Z","title":"Jongheon Jeong, Yang Zou, Taewan Kim, Dongqing Zhang, Avinash Ravichandran, and Onkar Dabeer","venue":null,"work_id":"a4ec58d1-1258-4661-b2b1-be35f8c81559","year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.313837Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:f824711a7c00524ee7eca0614a437dbc50b0279337dd5547c22909f8a912d2d5","observation_id":"9a11af61-55d9-489e-a6ba-5da13a62413d","resolution":{"observed_at":"2026-08-06T15:32:54.316500Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.03524","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.206090Z","title":"Chao Jia, Yinfei Yang, Ye Xia, Yi-Ting Chen, Zarana Parekh, Hieu Pham, Quoc V","venue":null,"work_id":"a0976d01-02de-405b-9773-c2dbdec03e53","year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.370999Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:02392bafc282377538b117e9ad2ca60f0a8404360a32cd71cf4a86496f429568","observation_id":"343fdf29-7752-4bf6-b74f-efc20b505373","resolution":{"observed_at":"2026-08-06T15:32:54.210561Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T15:32:50.487154Z","title":"Visual prompt tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.487154Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:35bf6368a24fe017dfdcf814087cc43152591900dc90a629e80d0e30f6832104","observation_id":"f73be18a-5baf-4e13-9ee8-6d464a5dfeca","resolution":{"observed_at":"2026-08-06T15:32:50.487154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09453","last_updated":"2025-02-21T04:50:45Z","snapshot_observed_at":"2026-08-06T23:07:59.630081Z","submitted_at":"2024-10-12T09:16:09Z","title":"MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09453","snapshot_observed_at":"2026-08-06T15:32:50.564287Z","title":"Mmad: The first-ever comprehensive benchmark for multimodal large language models in industrial anomaly detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.564287Z"},"links":{"cited_paper":"/paper/2410.09453","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:7f80528dbd6c7c5986decb05a45d0ad4f55e78dc34b152b5b0e69987c35ac4b4","observation_id":"64081e69-ca6e-4f2c-baf8-59a4d0b21066","resolution":{"observed_at":"2026-08-06T15:32:50.564287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05136","last_updated":"2023-07-03T23:03:22Z","snapshot_observed_at":"2026-08-10T02:30:47.939136Z","submitted_at":"2022-12-09T22:28:24Z","title":"CLIP-TSA: CLIP-Assisted Temporal Self-Attention for Weakly-Supervised Video Anomaly Detection","version":3},"cited_work":{"arxiv_id":"2212.05136","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.05136","snapshot_observed_at":"2026-08-06T15:32:54.123279Z","title":"CLIP-TSA: CLIP-Assisted Temporal Self-Attention for Weakly-Supervised Video Anomaly Detection","venue":"cs.CV","work_id":"19bc631a-840c-47bb-b6ad-45c0f18f0036","year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.659635Z"},"links":{"cited_paper":"/paper/2212.05136","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:261df636905d2df611487fd7681aee959d5144b70a0d036cad143d9274d54d98","observation_id":"f55ae34d-9738-4757-a2a0-2a0c336cccb6","resolution":{"observed_at":"2026-08-06T15:32:54.126247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.11118","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.111600Z","title":"doi: https://doi.org/10.1016/j.knosys.2023.111186","venue":null,"work_id":"208ff358-8a9d-4d6d-8f15-5d250dd86192","year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.741754Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:4141e9e62ea2cb10519466574a0a05c98a809d55eb441ebd149b1850ea07d548","observation_id":"03fa416e-13c3-401e-86b1-943d4954f5f0","resolution":{"observed_at":"2026-08-06T15:32:54.115636Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:50.819617Z","title":"doi: 10.1145/3505244","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.819617Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:7d72729d65c3b29c1d1d8595fb4cc459803c519fec99629fc5b8d2959ce8f3f0","observation_id":"e6fa4d6e-d2d8-401f-aa12-04cd2f7223b0","resolution":{"observed_at":"2026-08-06T15:32:50.819617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.758007Z","title":"Convolutional networks and applica- tions in vision","venue":null,"work_id":"cb457c8e-1605-46e9-87ec-3879f285831c","year":2010},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:50.921981Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:29a7a117350e88eb107767a7c5352172161b31068e228fb1afe41cdf8ae4be5d","observation_id":"3f78db25-9c54-4163-9834-a1ade05d30ce","resolution":{"observed_at":"2026-08-06T15:32:54.761782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12540","last_updated":"2023-11-14T09:10:14Z","snapshot_observed_at":"2026-08-09T23:01:31.795140Z","submitted_at":"2023-07-24T06:04:12Z","title":"UniFormaly: Towards Task-Agnostic Unified Framework for Visual Anomaly Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12540","snapshot_observed_at":"2026-08-06T15:32:51.004167Z","title":"Selformaly: Towards task-agnostic unified anomaly detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.004167Z"},"links":{"cited_paper":"/paper/2307.12540","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:217290f49f53e32ec2957f414c819a6d71543c74364b324f55cbceb10db2c45b","observation_id":"b271272d-6331-47d0-b669-e7978e54836c","resolution":{"observed_at":"2026-08-06T15:32:51.004167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18808","last_updated":"2025-03-24T15:50:19Z","snapshot_observed_at":"2026-08-07T16:40:48.835229Z","submitted_at":"2025-03-24T15:50:19Z","title":"CRCL: Causal Representation Consistency Learning for Anomaly Detection in Surveillance Videos","version":1},"cited_work":{"arxiv_id":"2503.18808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18808","snapshot_observed_at":"2026-08-06T15:32:53.950494Z","title":"CRCL: Causal Representation Consistency Learning for Anomaly Detection in Surveillance Videos","venue":"cs.CV","work_id":"d1415c64-5986-47b0-8a22-cecb973d334a","year":2025},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.233188Z"},"links":{"cited_paper":"/paper/2503.18808","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:255cdb7953d81d23f458216d1ebbaaadbac0096bf679a300df1ce8229117e105","observation_id":"2132df8e-393a-46bc-99a3-410125c6014d","resolution":{"observed_at":"2026-08-06T15:32:53.953249Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14565","last_updated":"2025-06-28T09:36:36Z","snapshot_observed_at":"2026-07-06T19:54:05.139608Z","submitted_at":"2024-11-21T20:29:59Z","title":"Privacy-Preserving Video Anomaly Detection: A Survey","version":2},"cited_work":{"arxiv_id":"2411.14565","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.14565","snapshot_observed_at":"2026-08-06T15:32:53.939860Z","title":"Privacy-Preserving Video Anomaly Detection: A Survey","venue":"cs.CV","work_id":"df72ebe8-c87a-41f4-8412-5bc35edb6b6a","year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.397699Z"},"links":{"cited_paper":"/paper/2411.14565","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:b1d42f2e4509d19deabadc3a73d89d52f3c079c4ca68036aad4d07d068881c0d","observation_id":"d4a2cbb8-9f3c-403f-b493-75b2c5bbf6b4","resolution":{"observed_at":"2026-08-06T15:32:53.942793Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-08T11:15:37.346201Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-06T15:32:51.587979Z","title":"P- tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.587979Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:9102cabfc18853eb808e194c38ed39a4d4d09e8d1a9c2bed9a88087425eddfc1","observation_id":"65dce568-9abe-404f-9b29-ccb3305d24c5","resolution":{"observed_at":"2026-08-06T15:32:51.587979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10781","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.920920Z","title":"doi: https://doi.org/10.1016/j.engappai.2023.107810","venue":null,"work_id":"ed9527e8-5262-4126-8fed-cae75fa085dc","year":1976},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.753980Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:1267e60f4faef26f4dbd39ff29fc3e8c1134fd0bca70bdf010675af4fa6aa782","observation_id":"c9986d48-f657-486d-9354-dc1fd749e169","resolution":{"observed_at":"2026-08-06T15:32:53.924534Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.33226","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.866062Z","title":"doi: 10.1109/tpami.2023.3322604","venue":null,"work_id":"8c30326c-a761-48b8-9315-c41c73df93f9","year":1939},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.885810Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:5b10c282c31df2f9c5d459f1a6046ef01c42546c25755ee038a53957113295c1","observation_id":"0e762aea-265c-414e-ace0-80f6dd4eadd2","resolution":{"observed_at":"2026-08-06T15:32:53.870475Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1612.00390","last_updated":"2016-12-15T16:39:32Z","snapshot_observed_at":"2026-07-06T05:20:59.857848Z","submitted_at":"2016-12-01T19:28:59Z","title":"Anomaly Detection in Video Using Predictive Convolutional Long Short-Term Memory Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.00390","snapshot_observed_at":"2026-08-06T15:32:52.020505Z","title":"Anomaly detection in video using predictive convo- lutional long short-term memory networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.020505Z"},"links":{"cited_paper":"/paper/1612.00390","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:58bb36ffb8b97f5fc9ff2d91eeb863b3b48d17bfbf9e37071a31e301ab7e0cc4","observation_id":"f1cde587-47d3-49f1-8c21-cd1302794634","resolution":{"observed_at":"2026-08-06T15:32:52.020505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.750589Z","title":"Vt-adl: A vision transformer network for image anomaly detection and localization","venue":null,"work_id":"3b02e6f4-188e-42d7-986e-3a45d3be2fb3","year":2021},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.316045Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:c27fa26fa568536e29d3b9eb1b6ad7a417eacafae4700c635ef9c3bae1ae4a45","observation_id":"0f60eac8-e9f7-439f-b263-e34c6fa30fd0","resolution":{"observed_at":"2026-08-06T15:32:54.753131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.95762","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.780604Z","title":"2021.9576231","venue":null,"work_id":"73970250-e35a-4b1d-8d2b-b0cae5858e55","year":2021},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.498358Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:2f299d562060601b69d26248f28ffc630143580efe68839859e83096ef8f4bc0","observation_id":"545dfa2e-0e4a-41c6-a12f-187a86857e51","resolution":{"observed_at":"2026-08-06T15:32:53.784565Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21794","last_updated":"2025-06-18T17:03:35Z","snapshot_observed_at":"2026-08-10T02:15:41.534857Z","submitted_at":"2024-07-31T17:59:58Z","title":"Generalized Out-of-Distribution Detection and Beyond in Vision Language Model Era: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21794","snapshot_observed_at":"2026-08-06T15:32:52.654522Z","title":"Zachary Novack, Julian McAuley, Zachary C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.654522Z"},"links":{"cited_paper":"/paper/2407.21794","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:25b4fe7b1d3e709aa027882d8066899e720eda6fc400b900abcff95f50c7290d","observation_id":"821328a0-4cb2-442e-929c-8f6004480219","resolution":{"observed_at":"2026-08-06T15:32:52.654522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.740996Z","title":null,"venue":null,"work_id":"50831e84-7c25-4dbd-a7e7-c5779f38607e","year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.826812Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:1ac5e482850cd4bb8a13effda1922083954c6948391ea7812b83545790cc727b","observation_id":"3f164892-d289-4584-aa85-c4dc3c650a99","resolution":{"observed_at":"2026-08-06T15:32:54.745116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.733005Z","title":"OpenAI, Josh Achiam, Steven Adler, Sandhini Agarwal, and et al","venue":null,"work_id":"9cbff44c-b481-48e4-a3f0-dfd0ad86550c","year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.832020Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:d6bcd2cdefaa279ae2dd102c37827f9773c13f5f7dc3e7321e4898a221cd1af6","observation_id":"69893b92-70e2-4740-ad21-d59568d8b184","resolution":{"observed_at":"2026-08-06T15:32:54.735523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.912235Z","title":"Maxime Oquab, Timothée Darcet, Théo Moutakanni, Huy Vo, Marc Szafraniec, Vasil Khalidov, Pierre Fernandez, Daniel Haziza, Francisco Massa, Alaaeldin El-Nouby, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.912235Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:fc98e69d9acacacecc6e5055aae94bb00c8243c7f45e62f9014fb4aa84cd4c13","observation_id":"6812e002-03d9-405d-aacf-05be5eeb0cf7","resolution":{"observed_at":"2026-08-06T15:32:52.912235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/1742-6596/2638/1/012005","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Yatian Pang, Wenxiao Wang, Francis E","venue":"Journal of Physics Conference Series","work_id":"fd6238f0-6f17-4afb-a929-52b3a43c32f6","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.916683Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:747f48b1188486c4b7d1fb92f18baa7cd83cf50c1f7db65c2899c84a7cb7f022","observation_id":"9a8bbc78-bbe0-4f00-9c87-864252b248f6","resolution":{"observed_at":"2026-08-06T15:32:53.023099Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T15:32:52.922588Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.922588Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:32a9ab2641bf2628e399d3aba51d42ca0efdb6c250324c1525b9e887674f6afb","observation_id":"26d39f44-65f0-40a6-9cf9-06b2219ad4fa","resolution":{"observed_at":"2026-08-06T15:32:52.922588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10350","last_updated":"2024-02-15T22:43:02Z","snapshot_observed_at":"2026-08-02T05:48:26.880299Z","submitted_at":"2024-02-15T22:43:02Z","title":"Large Language Models for Forecasting and Anomaly Detection: A Systematic Literature Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10350","snapshot_observed_at":"2026-08-06T15:32:52.925183Z","title":"Large language models for forecasting and anomaly detection: A systematic literature review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.925183Z"},"links":{"cited_paper":"/paper/2402.10350","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:a61c246ababe4da49968a4cdd967f8e2e8e5a5a517cb4372b91df72e6345eb2a","observation_id":"c33d950a-8363-429f-921f-23d63771b062","resolution":{"observed_at":"2026-08-06T15:32:52.925183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.927916Z","title":"Masato Tamura","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.927916Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:5e3c93b960e3fde1757efb91796dc86722c6abb5ac37160e265c869090b20b7a","observation_id":"01f1c050-f994-4b0b-939c-7932915df764","resolution":{"observed_at":"2026-08-06T15:32:52.927916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T15:32:52.930556Z","title":"Training data-efficient image transformers & distillation through attention, 2021a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.930556Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:8a648c6889dce63786fe6d341d3669da09b228169cfb822c8e0eb419132e3f7a","observation_id":"56ce0060-6d19-4485-9809-215768537d0e","resolution":{"observed_at":"2026-08-06T15:32:52.930556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.933317Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.933317Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:60cbe5d23830dcec51339585b5143743384aaf36d855650ae9ffcade0f8496df","observation_id":"b83f73ed-92aa-4b55-ab33-21bc189e710a","resolution":{"observed_at":"2026-08-06T15:32:52.933317Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-06T15:32:52.935753Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.935753Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:b4712d8dd083884c5ee89e0a84840aaded7aa37eab16f1b92d664467ef3421e8","observation_id":"5028aa1b-6ede-4a2e-a3d5-8961d33fe551","resolution":{"observed_at":"2026-08-06T15:32:52.935753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.725342Z","title":"Anodfdnet: A deep feature difference network for anomaly detection, 2022b","venue":null,"work_id":"aef3d7c4-79d1-4380-b5c5-cbeef967e5de","year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.939505Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:d56f004892775e5a8ddae120e37a579cd241575de8b7968942f79b64dff0c76e","observation_id":"d00a3782-8f2a-43d0-8471-973f7be95fda","resolution":{"observed_at":"2026-08-06T15:32:54.727925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11681","last_updated":"2023-12-15T09:42:25Z","snapshot_observed_at":"2026-07-06T16:09:12.888489Z","submitted_at":"2023-08-22T14:58:36Z","title":"VadCLIP: Adapting Vision-Language Models for Weakly Supervised Video Anomaly Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11681","snapshot_observed_at":"2026-08-06T15:32:52.944516Z","title":"Zexin et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.944516Z"},"links":{"cited_paper":"/paper/2308.11681","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:57b0c58a4c603a9356ec1008812309875bf391f9abda7fcf4c41908cd67b89eb","observation_id":"4074c7df-7cad-4954-af06-c9bd16ab20c5","resolution":{"observed_at":"2026-08-06T15:32:52.944516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.717258Z","title":"Limits to visual representational correspondence be- tween convolutional neural networks and the human brain","venue":null,"work_id":"b738028a-38f8-4cff-805c-e70c274078cd","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.947646Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:f0e798cdbfd9c9e805aefdc08ff10b2384414f54b0ddcc5c7a4d84b302ae439a","observation_id":"d71f0a73-2676-4a78-be85-ea3b6633104d","resolution":{"observed_at":"2026-08-06T15:32:54.719941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.710054Z","title":"Attention-based mis- aligned spatiotemporal auto-encoder for video anomaly detection","venue":null,"work_id":"c46c8544-1043-4e35-ae98-f126f5b79c29","year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.950268Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:ffda8ceac6851914e9bdbcf71ec46b9d08c11a4fc0031223fdc5a62e4158bf0e","observation_id":"db3ca23b-72b3-44a6-aa3b-65b878580e44","resolution":{"observed_at":"2026-08-06T15:32:54.712473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-06T15:32:52.952898Z","title":"The dawn of lmms: Preliminary explorations with gpt-4v (ision)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.952898Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:de4a81dcb0cbe8c80c7753bc1351c32beb106cfc870aedd61a3d15cd4472a837","observation_id":"4e70c0fe-65d6-4051-b943-9463fe917ada","resolution":{"observed_at":"2026-08-06T15:32:52.952898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i4.25604","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Visual anomaly detection via dual-attention trans- former and discriminative flow, 2023a","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"5515a44e-8383-4ee6-813e-c41e0864b2a3","year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.955780Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:c4b41a5c232d49031b6b09da3360ac43de5527d31638aea5ff512979edde33fd","observation_id":"db4802e5-96fd-4999-9f26-a6e59597c0ad","resolution":{"observed_at":"2026-08-06T15:32:54.705131Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01234","last_updated":"2025-07-16T15:38:41Z","snapshot_observed_at":"2026-07-06T17:38:34.497555Z","submitted_at":"2024-03-02T15:34:31Z","title":"Active Deep Kernel Learning of Molecular Properties: Realizing Dynamic Structural Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01234","snapshot_observed_at":"2026-08-06T15:32:52.958316Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.958316Z"},"links":{"cited_paper":"/paper/2403.01234","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:50762e391b962e34e340a736964a64b5d08c5ee9290ce5b4b0c3dc5629d73b8d","observation_id":"92897c01-2073-4614-8a5e-1a0404dd2539","resolution":{"observed_at":"2026-08-06T15:32:52.958316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.31091","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.427520Z","title":"Luca Zanella, Willi Menapace, Massimiliano Mancini, Yiming Wang, and Elisa Ricci","venue":null,"work_id":"213f3384-e231-410b-b4aa-5f388efd4e38","year":2021},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.960711Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:bcdde42639d6ca6215896df40c0a71fabbe2c9168a7fd32a9f00b2da2d8d7a91","observation_id":"1874f78d-81a9-47b7-871e-2aeee0192e5d","resolution":{"observed_at":"2026-08-06T15:32:53.431808Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.963057Z","title":"Visualizing and understanding convolutional networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.963057Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:25ab678425dd955bfd530cda6f7c0f3bed28999791b69833aed0441aded9592f","observation_id":"f51298b4-68ad-47fb-b4b8-c0a9c8e9a1b6","resolution":{"observed_at":"2026-08-06T15:32:52.963057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14289","last_updated":"2023-07-01T07:26:22Z","snapshot_observed_at":"2026-08-08T16:17:33.420400Z","submitted_at":"2023-06-25T16:37:25Z","title":"Faster Segment Anything: Towards Lightweight SAM for Mobile Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14289","snapshot_observed_at":"2026-08-06T15:32:52.965687Z","title":"Faster segment anything: Towards lightweight sam for mobile applica- tions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.965687Z"},"links":{"cited_paper":"/paper/2306.14289","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:db67b40cb2e201f81480db9a8564e902b0507c5967a53845f82678febdf38349","observation_id":"57859aad-6aa1-409b-ae1e-51d870f7cdb3","resolution":{"observed_at":"2026-08-06T15:32:52.965687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02612","last_updated":"2024-04-16T11:35:37Z","snapshot_observed_at":"2026-07-06T16:43:13.809278Z","submitted_at":"2023-11-05T10:01:18Z","title":"GPT-4V-AD: Exploring Grounding Potential of VQA-oriented GPT-4V for Zero-shot Anomaly Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02612","snapshot_observed_at":"2026-08-06T15:32:52.968330Z","title":"Exploring plain vit reconstruction for multi-class unsupervised anomaly detection, 2023c","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.968330Z"},"links":{"cited_paper":"/paper/2311.02612","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:0e29a6a0cb3a3138a4bc42aa1a7b85bde0434bff6159e96b414f2798274312ed","observation_id":"b9d34aba-a19a-4764-a935-16bbdc78c44a","resolution":{"observed_at":"2026-08-06T15:32:52.968330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.971175Z","title":"doi: https://doi.org/10.1016/j.vrih.2022.07.006","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.971175Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:e676ad3fd482c0dd30c9597c35400c0ae4cab934f8ae8ba5a0cf92fbfb4ccda0","observation_id":"056942a5-eccf-4b9b-8e17-17306296e5f8","resolution":{"observed_at":"2026-08-06T15:32:52.971175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.690860Z","title":"Improved anomaly detection based on loss prediction","venue":null,"work_id":"4423dba6-7359-458d-b842-c5b88bd3f5dc","year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.973734Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:29f86871d27c0f4225f8305d635f89a3c5a17046be6f53870f7279173d77717f","observation_id":"c0a20065-7455-46b1-9851-2a5e4c83c6eb","resolution":{"observed_at":"2026-08-06T15:32:54.693290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5963.2022","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.324112Z","title":"Xuan Zhang, Shiyu Li, Xi Li, Ping Huang, Jiulong Shan, and Ting Chen","venue":null,"work_id":"b4eb750c-7c70-4047-b1ff-a0086c257935","year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.976839Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:bfab421b1466261122172562a22d48430576ae4166f4125a056017a195b89b81","observation_id":"510db1a5-67e5-4b0d-b6d3-b307b1a3c081","resolution":{"observed_at":"2026-08-06T15:32:53.328720Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.980037Z","title":"Yu, and Lichao Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.980037Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:0d80667febdbae1610ee2d7beeceeba80762c86c8ecd56ff139fad25679785df","observation_id":"daa29b1d-2ec1-439f-b57e-41629c5079bf","resolution":{"observed_at":"2026-08-06T15:32:52.980037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.11421","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.244050Z","title":"doi: https://doi.org/10.1016/j.measurement.2024.114216","venue":null,"work_id":"d735adea-d65b-4a29-9fdd-d20d47c0f71d","year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.983128Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:25c3aeccb2acdfe020fbb654dd160b877f754e5a4ae753593ce0b21a2443ba2c","observation_id":"e96665cf-1532-4ce5-9068-6ff8b2e97f94","resolution":{"observed_at":"2026-08-06T15:32:53.248313Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.11826","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:53.174925Z","title":"doi: https: //doi.org/10.1016/j.eswa.2022.118269","venue":null,"work_id":"e24ac848-406e-430e-b92c-041c48073825","year":2022},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.985834Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:e6c222148dbc74ff6725b399da0561ad1918c7ab9556e2f9e70b5a455ea36caa","observation_id":"07da6526-482b-46db-aa5e-c6f635a3b5b0","resolution":{"observed_at":"2026-08-06T15:32:53.179834Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:48.819466Z","title":"Paul Bergmann, Michael Fauser, David Sattlegger, and Carsten Steger","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.819466Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:eba4c1f5d22c28f7fb1a3d566b69b78eb2e6a8999d8f367fa9d2258d24c1f532","observation_id":"19d8bc76-a618-41a0-b6b6-12085851fe4d","resolution":{"observed_at":"2026-08-06T15:32:48.819466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.55379","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.045669Z","title":"Yann LeCun, Yoshua Bengio, and Geoffrey Hinton","venue":null,"work_id":"7789d39e-19a7-4a39-afaa-bc35fd1e058e","year":2010},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.001801Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:4bb29a5ac2a579c5c7fc4649e34296382966b61e3dd27d2bd7cd24ac3671ed5d","observation_id":"44187f40-43ce-4504-a475-8e3aac8bbfab","resolution":{"observed_at":"2026-08-06T15:32:54.049554Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02680","last_updated":"2022-06-06T15:31:35Z","snapshot_observed_at":"2026-08-03T05:32:57.281028Z","submitted_at":"2022-06-06T15:31:35Z","title":"Separable Self-attention for Mobile Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02680","snapshot_observed_at":"2026-08-06T15:32:52.190864Z","title":"Mobilevitv2: Learning general-purpose vision repre- sentations for mobile devices","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.190864Z"},"links":{"cited_paper":"/paper/2206.02680","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:533cf593f766626eb6407a339cc3e305188979c4b65b530aa086c01bd2909f18","observation_id":"153ebc47-14e2-4368-9189-86f6dcd7815a","resolution":{"observed_at":"2026-08-06T15:32:52.190864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:52.942164Z","title":"Cvt: Introducing convolutions to vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.942164Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:2bcf620fbfee21ba2b916ddbae399d0d0b8a10b0af1bdcce7cc55b12598f384c","observation_id":"0d33dda3-8201-4b4e-9da3-d38188f680ef","resolution":{"observed_at":"2026-08-06T15:32:52.942164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00625","last_updated":"2025-02-14T07:34:39Z","snapshot_observed_at":"2026-07-06T18:23:57.071938Z","submitted_at":"2024-06-02T06:08:26Z","title":"SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection","version":4},"cited_work":{"arxiv_id":"2406.00625","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.00625","snapshot_observed_at":"2026-08-06T15:32:53.640756Z","title":"SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection","venue":"cs.CV","work_id":"204fc217-da8f-4104-8f2c-159bef7cfb33","year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:52.920072Z"},"links":{"cited_paper":"/paper/2406.00625","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:73e201e27c554ec21b88c1ecc65f9c2b868b1b63add026b2de013ea45bb9c487","observation_id":"f8cdc5d6-13a9-433e-8562-755b99e46141","resolution":{"observed_at":"2026-08-06T15:32:53.643810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:48.893251Z","title":"BigScience Workshop","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.893251Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:810d27e21fe441ccb111312b14e4562a960b680fc79c6d91b4f756091eddd7aa","observation_id":"14fd36d9-35e5-404d-a2b8-f6421eba3cb6","resolution":{"observed_at":"2026-08-06T15:32:48.893251Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:32:54.781242Z","title":"A-vae: Attention based variational autoencoder for traffic video anomaly detection","venue":null,"work_id":"53ff9f47-da2a-479d-ab61-71879df1a41c","year":2023},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.569009Z"},"links":{"citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:d29cc0a6147f5e9fdda690357d3b45cb5e8dd8a44ced8c8ea1b9c72cccaa4b96","observation_id":"8bd67b78-ea24-46e5-bc49-e6d87a166f10","resolution":{"observed_at":"2026-08-06T15:32:54.784246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02178","last_updated":"2020-10-05T17:24:48Z","snapshot_observed_at":"2026-08-06T12:12:18.289356Z","submitted_at":"2020-10-05T17:24:48Z","title":"Mind the Pad -- CNNs can Develop Blind Spots","version":1},"cited_work":{"arxiv_id":"2010.02178","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.02178","snapshot_observed_at":"2026-08-06T15:32:54.677597Z","title":"Mind the Pad -- CNNs can Develop Blind Spots","venue":"cs.CV","work_id":"a08aa10e-98d3-432e-9010-1ccd92357673","year":2020},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.430425Z"},"links":{"cited_paper":"/paper/2010.02178","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:983757e55c4ae8faf187b9050cd0813227f6ad0b4ac7abaee866469217d291b8","observation_id":"4af4e430-7d1c-4db7-a3d9-42f0544c7b70","resolution":{"observed_at":"2026-08-06T15:32:54.681036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08420","last_updated":"2021-08-19T00:49:01Z","snapshot_observed_at":"2026-08-07T21:09:54.846761Z","submitted_at":"2021-08-19T00:49:01Z","title":"D3D-HOI: Dynamic 3D Human-Object Interactions from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.08420","snapshot_observed_at":"2026-08-06T15:32:48.747249Z","title":"Addressing ethical risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:48.747249Z"},"links":{"cited_paper":"/paper/2108.08420","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:dd5ff8bb913ad7829f8d78a5f63b3cf92dff11f8ffbeea686b47bf2ed7965fcc","observation_id":"d37fc4e1-9a45-4adf-a1cd-3e827d2fefb1","resolution":{"observed_at":"2026-08-06T15:32:48.747249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02782","last_updated":"2023-11-16T09:10:22Z","snapshot_observed_at":"2026-08-05T02:34:26.969013Z","submitted_at":"2023-11-05T22:13:12Z","title":"Towards Generic Anomaly Detection and Understanding: Large-scale Visual-linguistic Model (GPT-4V) Takes the Lead","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02782","snapshot_observed_at":"2026-08-06T15:32:49.214107Z","title":"2nd place win- ning solution for the cvpr2023 visual anomaly and novelty detection challenge: Multimodal prompting for data-centric anomaly detection, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:49.214107Z"},"links":{"cited_paper":"/paper/2311.02782","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:9b4701f0f3711afe2c7302e607478ca9f1ad27c2e7047304db3f2e43cebf4044","observation_id":"a1a2226f-13a8-47df-b020-48b14c39ec3a","resolution":{"observed_at":"2026-08-06T15:32:49.214107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16753","last_updated":"2024-01-30T05:16:52Z","snapshot_observed_at":"2026-07-06T17:22:15.248410Z","submitted_at":"2024-01-30T05:16:52Z","title":"MuSc: Zero-Shot Industrial Anomaly Classification and Segmentation with Mutual Scoring of the Unlabeled Images","version":1},"cited_work":{"arxiv_id":"2401.16753","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.16753","snapshot_observed_at":"2026-08-06T15:32:53.960530Z","title":"MuSc: Zero-Shot Industrial Anomaly Classification and Segmentation with Mutual Scoring of the Unlabeled Images","venue":"cs.CV","work_id":"808b2ca6-2d7d-4fbe-ad92-d0f7f0ddd7a3","year":2024},"citing_paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:32:51.106248Z"},"links":{"cited_paper":"/paper/2401.16753","citing_paper":"/paper/2507.15905"},"observation_digest":"sha256:cd3fbc16041c1ff5780647d8ac57f07cc843e8dcf86a37d8dac542b6e49cd01e","observation_id":"3cbfde70-e9c0-42da-8236-5096c636530e","resolution":{"observed_at":"2026-08-06T15:32:53.965219Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.15905","last_updated":"2025-07-21T12:01:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T01:30:02.567154Z","submitted_at":"2025-07-21T12:01:04Z","title":"Foundation Models and Transformers for Anomaly Detection: A Survey"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":4,"metadata_mismatch":12,"parse_uncertain":0,"unresolved":33,"verified_exact":14,"verified_fuzzy":10},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2507.15905."}