{"as_of":"2026-08-10T23:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98fcd8451f0b9a25e95ccfa31eec51a7c40b555ad37cc83d07bade27f6b12746","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:03:31.639280Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:20:58.030616Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T21:06:38.124724Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-08-07T13:20:58.030616Z","title":"Can multimodal large language models be guided to improve industrial anomaly detection?arXiv preprint arXiv:2501.15795, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22039","last_updated":"2026-07-29T09:31:57Z","snapshot_observed_at":"2026-08-07T21:55:46.500544Z","submitted_at":"2025-05-28T07:02:15Z","title":"OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:58.030616Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2505.22039"},"observation_digest":"sha256:a827dfd717c69e37e7baed27637aabeede870e8f733bd5c8bb431486a95673e6","observation_id":"bf93753c-c81c-4d61-aa73-993475a430bb","resolution":{"observed_at":"2026-08-07T13:20:58.030616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-08-06T14:58:42.623068Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-10T20:16:56.874028Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:42.623068Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:3c510162ede1305d839c2c62ba465994c17e3271b47c04300e8df5219605faf5","observation_id":"57437c8c-ddc2-45a8-aa45-aa22c5afefaa","resolution":{"observed_at":"2026-08-06T14:58:42.623068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-08-06T12:40:08.912929Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21619","last_updated":"2025-07-29T09:18:22Z","snapshot_observed_at":"2026-08-07T23:36:20.034251Z","submitted_at":"2025-07-29T09:18:22Z","title":"EMIT: Enhancing MLLMs for Industrial Anomaly Detection via Difficulty-Aware GRPO","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T12:40:08.912929Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2507.21619"},"observation_digest":"sha256:3aa7dade8427ba7106127b167aa9cbbc536f65c474ea46c41eb3bf4b5da8964c","observation_id":"34e8e425-fae2-4883-8d95-e557d56e9e67","resolution":{"observed_at":"2026-08-06T12:40:08.912929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-08-06T00:53:23.322660Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04175","last_updated":"2025-08-06T08:00:27Z","snapshot_observed_at":"2026-08-07T13:51:30.195940Z","submitted_at":"2025-08-06T08:00:27Z","title":"AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T00:53:23.322660Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2508.04175"},"observation_digest":"sha256:ab66aa8d014600c61866905b97b9e07eb7b16dc6d4374c9776dcc313b256bd82","observation_id":"570ebd84-7f3b-4f71-8ff5-5ed22a4e5b9e","resolution":{"observed_at":"2026-08-06T00:53:23.322660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-08-05T18:34:02.796027Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14504","last_updated":"2025-08-20T07:53:13Z","snapshot_observed_at":"2026-08-08T14:33:59.557550Z","submitted_at":"2025-08-20T07:53:13Z","title":"PB-IAD: Utilizing multimodal foundation models for semantic industrial anomaly detection in dynamic manufacturing environments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T18:34:02.796027Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2508.14504"},"observation_digest":"sha256:b51d729d473cc6aeac79a851a8c7377b846aa26f03f6979ec3d52b46f818ac97","observation_id":"077587d2-98f8-4071-8f38-d87d8f1a3d28","resolution":{"observed_at":"2026-08-05T18:34:02.796027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":"2501.15795","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can multimodal large language models be guided to improve industrial anomaly detection?","venue":null,"work_id":"b55b8d7f-dff2-46c2-a8a3-8143fa0648c8","year":2025},"citing_paper":{"arxiv_id":"2602.17419","last_updated":"2026-05-07T12:09:13Z","snapshot_observed_at":"2026-07-06T22:46:26.082843Z","submitted_at":"2026-02-19T14:50:58Z","title":"EAGLE: Expert-Augmented Attention Guidance for Tuning-Free Industrial Anomaly Detection in Multimodal Large Language Models","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T21:05:11.117495Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2602.17419"},"observation_digest":"sha256:230456a5e99857aae469ea74ea54f6b91f866f5935233407629bb735d69aef5a","observation_id":"95a56f7b-1f65-4fe5-92af-3c0f359d48f2","resolution":{"observed_at":"2026-05-15T21:06:38.126298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":"2501.15795","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can multimodal large language models be guided to improve industrial anomaly detection?","venue":null,"work_id":"b55b8d7f-dff2-46c2-a8a3-8143fa0648c8","year":2025},"citing_paper":{"arxiv_id":"2603.13779","last_updated":"2026-04-21T06:55:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-14T06:14:44Z","title":"AD-Copilot: A Vision-Language Assistant for Industrial Anomaly Detection via Visual In-context Comparison","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T11:54:18.587529Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2603.13779"},"observation_digest":"sha256:0f547f709d72bab4bac853378852d453ff1c01ce3a9d46958ba9981621879eab","observation_id":"56ee13e5-42b9-42e2-9c4c-95dc813bfed1","resolution":{"observed_at":"2026-05-15T11:55:33.332412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15795/citation-record","integrity":"/paper/2501.15795/integrity","json":"/paper/2501.15795/citation-record.json","paper":"/paper/2501.15795"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T14:03:30.881245Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:30.881245Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:4bec958dd45a99715a27b3e177d37171cfa28016ced2060054b088546c05ccdd","observation_id":"99ba9d0e-9795-4680-a978-ad2c609abb5b","resolution":{"observed_at":"2026-08-10T14:03:30.881245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:33.006197Z","title":"Mvtec ad–a comprehensive real-world dataset for unsupervised anomaly detection","venue":null,"work_id":"7daf7ed7-4322-4f91-a28a-f0acba337af7","year":2019},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:30.912168Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:cecc15261a94a42b593952b9e259552d0d9f62110aa0e8c6e0e37510a0177623","observation_id":"95c1819b-3930-4171-a424-cd83eca5fb28","resolution":{"observed_at":"2026-08-10T14:03:33.023028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16402","last_updated":"2024-01-29T18:41:21Z","snapshot_observed_at":"2026-08-09T08:20:16.324902Z","submitted_at":"2024-01-29T18:41:21Z","title":"A Survey on Visual Anomaly Detection: Challenge, Approach, and Prospect","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16402","snapshot_observed_at":"2026-08-10T14:03:30.950201Z","title":"A sur- vey on visual anomaly detection: Challenge, approach, and prospect","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:30.950201Z"},"links":{"cited_paper":"/paper/2401.16402","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:5ceb716b2cd7483a0c465e0ac52c5ff1f87734ba3ce7714427cbed9669587fb8","observation_id":"b1e9870d-f13c-4876-ae3c-b5949295a663","resolution":{"observed_at":"2026-08-10T14:03:30.950201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.967693Z","title":"Surface defect detection methods for industrial products: A review","venue":null,"work_id":"985eac07-2599-4577-acf6-a67f2a6e1d19","year":2021},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:30.989715Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:913b1ff42c767d50cdd63d0fbf494b29ec5b7186af3807673f3b7e1e920ed9eb","observation_id":"b7e51970-d4bf-4eb4-b564-264ac589a3c8","resolution":{"observed_at":"2026-08-10T14:03:32.982222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-10T14:03:31.051771Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.051771Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:ec42ec6325f94a2d36a80f1dcc0d2b01aec21985e3f7adac3687c5e8de92f170","observation_id":"87912c0f-976b-4315-854d-1651e61fd5d8","resolution":{"observed_at":"2026-08-10T14:03:31.051771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-10T14:03:31.069770Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.069770Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:f7e5a7ff728f4bce8beac3f9062c012ba5bf58461df22d50b20fe790085779cb","observation_id":"ef9f4337-e101-41f3-90a4-ba86dafbc33c","resolution":{"observed_at":"2026-08-10T14:03:31.069770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21439","last_updated":"2024-09-25T06:14:03Z","snapshot_observed_at":"2026-07-06T18:54:54.118506Z","submitted_at":"2024-07-31T08:43:17Z","title":"MLLM Is a Strong Reranker: Advancing Multimodal Retrieval-augmented Generation via Knowledge-enhanced Reranking and Noise-injected Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21439","snapshot_observed_at":"2026-08-10T14:03:31.085402Z","title":"Mllm is a strong reranker: Advancing multimodal retrieval-augmented generation via knowledge-enhanced reranking and noise-injected training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.085402Z"},"links":{"cited_paper":"/paper/2407.21439","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:22afd94189cbd70a0a4b26b878408a730009aea394c01ce5194bcc013c212bd1","observation_id":"1bb00841-177b-4903-9002-8156b2501165","resolution":{"observed_at":"2026-08-10T14:03:31.085402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.098792Z","title":"Vmad: Visual-enhanced multimodal large lan- guage model for zero-shot anomaly detection.arXiv preprint arXiv:2409.20146, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.098792Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:e5bbdf1ff57c607a492009a868409daa350c7ad0b584ba5dc2711768dd642ea1","observation_id":"aeace695-1092-4cea-affe-9316c40c8bed","resolution":{"observed_at":"2026-08-10T14:03:31.098792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.899061Z","title":"Cantor: Inspiring multimodal chain-of-thought of mllm","venue":null,"work_id":"88bbec2e-3657-4c97-9eda-c71f041166b2","year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.132952Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:e22e464694f4a6613b41e9fd7534501c843b24eb424c88612f14a8209bb3071f","observation_id":"a825f4f6-f2a7-4eae-91a1-6ae14fb2ea4e","resolution":{"observed_at":"2026-08-10T14:03:32.908906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.834680Z","title":"Anomalygpt: Detecting in- dustrial anomalies using large vision-language models","venue":null,"work_id":"3808d290-bed7-430e-bf11-3ca6a80418e3","year":1932},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.167140Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:fc42a428909ef1b3c9901433c34fadfecf6036b7ab25b20a8f5778fb0935884f","observation_id":"0da3166e-2d12-4eb5-a550-7f363aa795ea","resolution":{"observed_at":"2026-08-10T14:03:32.859473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.178546Z","title":"Reveal: Retrieval-augmented visual-language pre-training with multi-source multimodal knowledge mem- ory","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.178546Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:9fc21452a21c12425fccc9a34bce27300355f30c665a388b02cbc735f68abdde","observation_id":"358bf62b-f01a-4195-9f10-66e1f0f86633","resolution":{"observed_at":"2026-08-10T14:03:31.178546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.757067Z","title":"Winclip: Zero- /few-shot anomaly classification and segmentation","venue":null,"work_id":"c189e34f-de4f-446a-9740-87412cb58f4b","year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.210477Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:89a423cc42ab6ca6951bbd6e13144457a9f3bcb466fa6a9b651d6629e31d5f8b","observation_id":"453f34f9-5a8c-4745-b1d2-32a4ffcd1908","resolution":{"observed_at":"2026-08-10T14:03:32.793159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09453","last_updated":"2025-02-21T04:50:45Z","snapshot_observed_at":"2026-08-10T08:40:13.723354Z","submitted_at":"2024-10-12T09:16:09Z","title":"MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09453","snapshot_observed_at":"2026-08-10T14:03:31.220351Z","title":"Mmad: The first-ever comprehensive benchmark for mul- timodal large language models in industrial anomaly detec- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.220351Z"},"links":{"cited_paper":"/paper/2410.09453","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:30c509ff958314d409d7fa64e2f4a40ab9418d9d44ee10925e251e4938c37411","observation_id":"7993e364-238e-4880-af64-d2dd371c1ec7","resolution":{"observed_at":"2026-08-10T14:03:31.220351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.713906Z","title":"Billion- scale similarity search with GPUs","venue":null,"work_id":"594ff0d6-58ff-4313-b3d3-312485546bd5","year":2019},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.226432Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:979837e896fd8b33b1c5d5efea770dc382931fdd7a2cd33d1e38f2ce71e44fc9","observation_id":"cd4aa0e1-1536-4502-9e6a-411bb855ad57","resolution":{"observed_at":"2026-08-10T14:03:32.723615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.699033Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks","venue":null,"work_id":"ba76dd3d-5d34-45a9-9320-025cd66c1d2b","year":2020},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.234338Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:196d9fccef5d4eb229e527ffc662213074ca624b43729db321f72c4a74032028","observation_id":"ff2cc32d-3fff-4b0f-b3dd-fbb94c98e141","resolution":{"observed_at":"2026-08-10T14:03:32.704141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.684734Z","title":"Llava-onevision: Easy visual task transfer, 2024","venue":null,"work_id":"f4b451ec-8d46-469a-a3d5-f6399670bb34","year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.245410Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:0aa2cb0d69e6b571047e728dce4b16920f3bde8e303a4a20c574812c97dcd64f","observation_id":"32742275-1a0e-4409-a543-2aa3df58e391","resolution":{"observed_at":"2026-08-10T14:03:32.689652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.670330Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models, 2024","venue":null,"work_id":"d627b5a0-b859-4bd1-8c12-63ada20c3231","year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.253257Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:0ff00a4016debaa411d2de212f5ae165547aad4532017ae23a4cc77c055b8b49","observation_id":"be4be849-b7cc-4051-8823-bed55a968b66","resolution":{"observed_at":"2026-08-10T14:03:32.674588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19070","last_updated":"2025-01-17T06:13:20Z","snapshot_observed_at":"2026-07-06T16:40:08.030032Z","submitted_at":"2023-10-29T16:49:45Z","title":"Myriad: Large Multimodal Model by Applying Vision Experts for Industrial Anomaly Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19070","snapshot_observed_at":"2026-08-10T14:03:31.261951Z","title":"Myriad: Large multimodal model by applying vi- sion experts for industrial anomaly detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.261951Z"},"links":{"cited_paper":"/paper/2310.19070","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:92b0a0207ec4e23b8a9c1b8f761aad0b574d36815688fda913c8b65eb4c4fa74","observation_id":"ea85c018-af0d-44c2-9b95-50508f9349c3","resolution":{"observed_at":"2026-08-10T14:03:31.261951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.657286Z","title":"Promptad: Zero-shot anomaly detection using text prompts","venue":null,"work_id":"2e608138-3527-4c3d-8401-a733b2df6953","year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.274181Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:f074dc4dfceacbf94443e3df7446dbda0ce2b5756d5b6cdf7707ecfa2b9313cf","observation_id":"33c293e0-26ff-437c-b882-a2c071f3dbf4","resolution":{"observed_at":"2026-08-10T14:03:32.661322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.280614Z","title":"Improved baselines with visual instruction tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.280614Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:ebbc69bec8e41eb1b6c031cbeb8c12bc09861428fbe7a47439b780044226bd53","observation_id":"60f58039-d5c4-4aa9-b9e5-bc24282f9f70","resolution":{"observed_at":"2026-08-10T14:03:31.280614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.284753Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.284753Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:ccb790b2b94867a0d5504ddd1af62bb6e243f1e83c2c1fc1bc012afbc795522b","observation_id":"6bae4ad5-4e27-4c39-8363-b1a2806f39da","resolution":{"observed_at":"2026-08-10T14:03:31.284753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.624557Z","title":"Learning customized visual models with retrieval-augmented knowledge","venue":null,"work_id":"c29abfad-99cd-4cb4-a659-7f340e0702cb","year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.288917Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:5115a921884fd9454b15c72d4ef7e867492dfa5883fe30aa17a69fc3e13b1035","observation_id":"6ae1c3bd-0e2e-406c-8820-a5faba3e7ab7","resolution":{"observed_at":"2026-08-10T14:03:32.629130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.591893Z","title":"Deep indus- trial image anomaly detection: A survey","venue":null,"work_id":"afe75dca-510d-47d5-9927-7f242902117e","year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.293185Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:e182685e0e9b8b88e3f93928858e9c267741ad23f713b2caefbd64f7b132842b","observation_id":"20ce5825-c837-4851-a47a-604577024c04","resolution":{"observed_at":"2026-08-10T14:03:32.615541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13805","last_updated":"2026-05-15T05:14:37Z","snapshot_observed_at":"2026-08-10T12:19:02.869819Z","submitted_at":"2024-03-20T17:59:55Z","title":"RAR: Retrieving And Ranking Augmented MLLMs for Visual Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13805","snapshot_observed_at":"2026-08-10T14:03:31.297504Z","title":"Rar: Retrieving and ranking augmented mllms for visual recogni- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.297504Z"},"links":{"cited_paper":"/paper/2403.13805","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:3d8cd4a4b8c84ef2b8e6349d0645424b8ec35fbbd2b29e22c00d5ea2153d7de8","observation_id":"4bd083ee-eab3-46f2-b241-e715c62304e4","resolution":{"observed_at":"2026-08-10T14:03:31.297504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.548016Z","title":"Efficient and robust approximate nearest neighbor search using hierarchical nav- igable small world graphs","venue":null,"work_id":"f9166e1d-f5f0-4f36-a375-8343966894b1","year":2018},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.302318Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:a4dd03de1a2e660572e10db91b46b2ff628acf413732405611cdaa72f652a0f1","observation_id":"84e0c488-db44-468f-89f8-393bbf15b98d","resolution":{"observed_at":"2026-08-10T14:03:32.563372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.485296Z","title":null,"venue":null,"work_id":"ca601aac-1ab7-44c4-9c9d-d758e6dd48cb","year":2018},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.306415Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:23abfe2517d378c7f5af0df035614995e50b334de7909b94ba73c15ea3b82662","observation_id":"2b01791c-265e-44ef-8a2d-f134bdc41cc9","resolution":{"observed_at":"2026-08-10T14:03:32.512975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.310840Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.310840Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:5fc91267f18f662a04960311e1dc96649a51d43a10080eeb792a43e7cdec197f","observation_id":"d347ae66-872b-4495-86a9-a82c1bcfca28","resolution":{"observed_at":"2026-08-10T14:03:31.310840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.409006Z","title":"Fully convolutional cross-scale-flows for image- based defect detection","venue":null,"work_id":"d3624527-1236-4d1b-81ed-750e6b1e0543","year":2022},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.315090Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:448b26da79cc63eb7da012b8fe52015bfe3a7a5d4620849c42edf826cb4c214d","observation_id":"c4e22230-961b-4cdc-b2de-735e738d7687","resolution":{"observed_at":"2026-08-10T14:03:32.442330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.315558Z","title":"Deep learning for unsupervised anomaly lo- calization in industrial images: A survey","venue":null,"work_id":"3ebf8faa-a9f7-45aa-8ac5-2b8f21e64bdf","year":2022},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.319137Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:b7275abb18fca1ca767109240195bdfefb477e1a1d56f09a122b3238a7ff4ce9","observation_id":"dde64bcd-8e87-47ee-892b-77e9f81f6490","resolution":{"observed_at":"2026-08-10T14:03:32.354457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.248103Z","title":"Support vector data description","venue":null,"work_id":"e58ef734-b5dc-46a9-b470-42af4ca9e9da","year":2004},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.363863Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:9c6590d5b3476c46e419ad45e99c92382a96f38306f828661be047ae267ad948","observation_id":"8d231e54-7ef3-4abb-88e2-b8fff87a8691","resolution":{"observed_at":"2026-08-10T14:03:32.270993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-10T14:03:31.449223Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.449223Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:fa09dfc913ab82a3de573e8a6b9390f5b1382d5c66b252e224d606e550698306","observation_id":"edaa49ac-76f5-4e60-9e2b-d5964bf23afd","resolution":{"observed_at":"2026-08-10T14:03:31.449223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.474466Z","title":"Chain-of-thought prompting elicits reasoning in large lan- guage models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.474466Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:6313baaf06849cad53219cc522f12d097ba08e98fece69346a08ffe093a32651","observation_id":"3d99f16a-3d98-4455-a644-fabcd8689fe8","resolution":{"observed_at":"2026-08-10T14:03:31.474466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03958","last_updated":"2024-02-15T01:03:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-07T23:48:36Z","title":"Simple synthetic data reduces sycophancy in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03958","snapshot_observed_at":"2026-08-10T14:03:31.522707Z","title":"Simple synthetic data reduces sycophancy in large lan- guage models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.522707Z"},"links":{"cited_paper":"/paper/2308.03958","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:eb7afc2ff42572444e853206a48b7ddc0b462bf642ef471de349f7dcfefa1ae1","observation_id":"95547cb0-85a7-458f-bd5c-be44f8789979","resolution":{"observed_at":"2026-08-10T14:03:31.522707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-10T14:03:31.547592Z","title":"Minicpm-v: A gpt-4v level mllm on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.547592Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:1f23e11a67cad0eb1ee5a3adfcf741bf946d12be577535a3ec6692e2eb094281","observation_id":"f972dcc8-9438-43fa-8503-ac71b087c2a5","resolution":{"observed_at":"2026-08-10T14:03:31.547592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.225315Z","title":"Patch svdd: Patch-level svdd for anomaly detection and segmentation","venue":null,"work_id":"3571922b-ad75-4a15-bd2f-a16643f2a866","year":2020},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.571639Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:4f25111a2616814a7e383bb476a383e9d536d3980ddf48e25d9698c66f6c7898","observation_id":"09f19506-76b0-4f4f-80e2-c43afc14ebfe","resolution":{"observed_at":"2026-08-10T14:03:32.229736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.586651Z","title":"Rag-driver: Gen- eralisable driving explanations with retrieval-augmented in- context learning in multi-modal large language model.arXiv preprint arXiv:2402.10828, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.586651Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:426c7fa68f746aa675da49d5fa54f53506d9fa7badffe8d4936d150ffa772339","observation_id":"5469bdbd-6b0b-48f2-a505-9ad7058296e1","resolution":{"observed_at":"2026-08-10T14:03:31.586651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.210334Z","title":"Recon- struction by inpainting for visual anomaly detection","venue":null,"work_id":"032202d2-e3a6-447f-83ab-823ee89f3584","year":2021},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.595546Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:934c182826134633acfb7c89a12e4bed25eb8c5e0ae5f09c2bcc5d5eebd3c329","observation_id":"7fb324ef-22d9-40d7-a378-c11227397ae2","resolution":{"observed_at":"2026-08-10T14:03:32.215475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-07-06T14:47:34.480641Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-10T14:03:31.604152Z","title":"Multimodal chain-of- thought reasoning in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.604152Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:2db348a9c45c57b5a03bacf11809b41bbd8127f846c348908b35eac1897c5c75","observation_id":"0fff4939-0f9e-468d-81b1-47dbe501d478","resolution":{"observed_at":"2026-08-10T14:03:31.604152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10868","last_updated":"2023-12-01T02:58:09Z","snapshot_observed_at":"2026-07-06T15:05:31.386599Z","submitted_at":"2023-03-20T05:07:41Z","title":"Retrieving Multimodal Information for Augmented Generation: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10868","snapshot_observed_at":"2026-08-10T14:03:31.618493Z","title":"Retrieving multimodal information for augmented generation: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.618493Z"},"links":{"cited_paper":"/paper/2303.10868","citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:3be14f49ae6f5a04b5a91dbf6c63675ff48acefeb6010ae45fd3eef632143464","observation_id":"15d85996-bfac-4501-a97e-ecead5da2b58","resolution":{"observed_at":"2026-08-10T14:03:31.618493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:31.628664Z","title":"Anomalyclip: Object-agnostic prompt learn- ing for zero-shot anomaly detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.628664Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:8e2f7a9051f4e67f8463677a11d0849fd7892722cd17e35d89de2a469b34e6cc","observation_id":"ec5a2709-208e-43ce-b7ae-3804cb4bcef4","resolution":{"observed_at":"2026-08-10T14:03:31.628664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:32.194000Z","title":"fold\": \"<Fold Defect>\\n Description: A raised, irregular line…","venue":null,"work_id":"53edb1ab-e174-4f0c-8ffb-efef3726cf72","year":2022},"citing_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T14:03:31.639280Z"},"links":{"citing_paper":"/paper/2501.15795"},"observation_digest":"sha256:5bc6a16b03e738ef401d8357fa17d2ab4954a7bc8441b37bd9047c2e21077496","observation_id":"0fe084cb-7e98-4057-b0b1-8d725cc54dd3","resolution":{"observed_at":"2026-08-10T14:03:32.200210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T13:54:36.304936Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 7 inbound Pith citation observations for arXiv:2501.15795."}