{"as_of":"2026-08-22T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9cabdeff365806bf3f46fddcbe3c3a56ac1cc7e547e5dc40aff2f133e9fddc5","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:29:47.147600Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T10:11:48.674949Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T10:13:11.865097Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"cited_work":{"arxiv_id":"2501.11309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11309","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.11309 (2025)","venue":null,"work_id":"44295ef9-ffe5-474b-9b59-6c5fbacb76a2","year":2025},"citing_paper":{"arxiv_id":"2506.09082","last_updated":"2026-05-03T04:37:38Z","snapshot_observed_at":"2026-08-18T09:58:59.618504Z","submitted_at":"2025-06-10T05:43:34Z","title":"AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models","version":5},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-05-19T11:12:41.130806Z"},"links":{"cited_paper":"/paper/2501.11309","citing_paper":"/paper/2506.09082"},"observation_digest":"sha256:a0ab4cb826929d897a99f8bb27e48f9684e1b61bec6a3494b7c927d0d1f532cd","observation_id":"15b8ea6a-b29f-4c6a-a88b-b4ba33d34aa3","resolution":{"observed_at":"2026-05-19T11:13:02.843198Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"cited_work":{"arxiv_id":"2501.11309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11309","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.11309 (2025)","venue":null,"work_id":"44295ef9-ffe5-474b-9b59-6c5fbacb76a2","year":2025},"citing_paper":{"arxiv_id":"2605.18681","last_updated":"2026-05-18T17:21:48Z","snapshot_observed_at":"2026-08-12T12:25:02.437849Z","submitted_at":"2026-05-18T17:21:48Z","title":"Learning Quantifiable Visual Explanations Without Ground-Truth","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-20T10:11:48.674949Z"},"links":{"cited_paper":"/paper/2501.11309","citing_paper":"/paper/2605.18681"},"observation_digest":"sha256:fac9b02c601d3f0d577ff3e2e55040d09fa2e0435593a18ae70f3b65c7541b64","observation_id":"1a4fa6e2-062b-42e0-98dd-a168f2027a55","resolution":{"observed_at":"2026-05-20T10:13:11.866931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.11309/citation-record","integrity":"/paper/2501.11309/integrity","json":"/paper/2501.11309/citation-record.json","paper":"/paper/2501.11309"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.422792Z","title":"Explainable artificial intelligence (xai): Concepts, taxonomies, opportunities and challenges toward responsible ai","venue":null,"work_id":"d7b7dfc8-e894-4e37-8e19-dfde1ae06ad6","year":2020},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.923253Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:bef6b71262c3189e7806f7180ac812791e0f35416da5929e744772a739b401d8","observation_id":"d770d96c-1e34-4420-8379-61e9adeba06c","resolution":{"observed_at":"2026-08-10T18:29:48.427929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.405711Z","title":"On pixel-wise explanations for non-linear classifier decisions by layer-wise relevance propagation","venue":null,"work_id":"f62409a6-33c2-4afd-9c3b-bdde04171a9a","year":2015},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.928638Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:717e24aa0855c2cd6c0d5deb2585c9e56791ba638281e729093e3f7109a55c28","observation_id":"70e04b0c-3c2b-4171-840f-c306e3ac73ea","resolution":{"observed_at":"2026-08-10T18:29:48.410979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.390037Z","title":"How to explain individual classification decisions","venue":null,"work_id":"68fafa56-f47d-41bc-b277-6f3419469b34","year":2010},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.933548Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:0699d3a60998cd853ddaa982e51274ea8a06272a244968d5b471c2946b324cd6","observation_id":"a57c59f0-7c12-49fa-a01d-ff3b2f0866b8","resolution":{"observed_at":"2026-08-10T18:29:48.395208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.374066Z","title":"Grounding everything: Emerging localiza- tion properties in vision-language transformers","venue":null,"work_id":"921dbdae-195b-4078-983d-bce017fad153","year":2024},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.938892Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:4894ec39c44c501b073cbd7051dd042fd8a37bc44dcd8a72f2d2e690eaaf97ba","observation_id":"d0448f37-90a4-4744-839a-e32cd6c13fef","resolution":{"observed_at":"2026-08-10T18:29:48.379454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.358120Z","title":"Concise explanations of neural net- works using adversarial training","venue":null,"work_id":"44de1da1-f5b6-46c4-8d2a-44fbc1a8bc47","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.944202Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:385edf12b6a52cc4a6e7321f682ba058e9529b41badb40a4d4ca34232d4ca061","observation_id":"02344b8d-78dd-47fe-9057-e031d71fb4f9","resolution":{"observed_at":"2026-08-10T18:29:48.362882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.341788Z","title":"Grad-cam++: General- ized gradient-based visual explanations for deep convolu- tional networks","venue":null,"work_id":"6a4ca092-4ea3-4ac8-9990-e425bf45ddbb","year":2018},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.949433Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:cdd1de63e7cc5e22a30d2b354e8fbf74c4d50f3d0fe5ab8b0effae28d83227c8","observation_id":"1c0b4e97-2204-4518-bcd5-c2326d538fed","resolution":{"observed_at":"2026-08-10T18:29:48.346961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:46.954442Z","title":"Transformer inter- pretability beyond attention visualization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.954442Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:ddb3a82b3bd5990ba5865c663941ca57fe3f31fcf293ff0ab4b1f81d973fb473","observation_id":"bdd7df2e-7de0-423f-8ae7-ea442697b6af","resolution":{"observed_at":"2026-08-10T18:29:46.954442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.314727Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"45ebfd25-1121-4367-b85f-61897776aee9","year":2009},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.959554Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:2567e9b7ab380e506f28b9f6dc1a68afc54fe94dba6b66302082c058b3d708df","observation_id":"cccdff92-1c4e-4541-b6eb-4456d6ac879b","resolution":{"observed_at":"2026-08-10T18:29:48.320414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:46.964056Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.964056Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:34e2a160260947b62326bcc086657e3f8e5070543e645930b9875c75e1e3ae76","observation_id":"90edf51f-ffda-4557-a4e0-9de40aa225c5","resolution":{"observed_at":"2026-08-10T18:29:46.964056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.287367Z","title":"Explainable and interpretable models in computer vision and machine learning","venue":null,"work_id":"76b26771-1d80-4d2e-8699-21dfc36790d6","year":2018},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.968642Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:19ac150b8ecc499667a68faf85447b5298debd3b6b58fdc724682bf3fa51f341","observation_id":"dc317560-30c6-4454-bab9-b42de21c003e","resolution":{"observed_at":"2026-08-10T18:29:48.292602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.272213Z","title":"Un- derstanding deep networks via extremal perturbations and smooth masks","venue":null,"work_id":"0b80e9db-dfc7-439c-8434-0a2551c44d15","year":2019},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.973097Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:0a8c2d92d369adc548ca484049589be5f65de3da2463dd32de90faec4d59ec28","observation_id":"59ecf29b-b8a8-40e7-8bb9-e3c4fd8f108f","resolution":{"observed_at":"2026-08-10T18:29:48.277030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.256506Z","title":"Interpretable explanations of black boxes by meaningful perturbation","venue":null,"work_id":"a3c84a4f-ad2a-4e73-bb91-11900adecf26","year":2017},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.977852Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:042cfe38a84bb77e528e0e765fc72c475b4fc52e90ab7b88a8846c6b27023204","observation_id":"13832846-8e61-4dfc-8f0c-ac07374b2b83","resolution":{"observed_at":"2026-08-10T18:29:48.261659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.240215Z","title":"Axiom-based grad-cam: Towards accurate visualization and explanation of cnns","venue":null,"work_id":"9f4ddeec-8beb-4ddb-9649-3f1eab9634a5","year":2020},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.982885Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:e9dea4f6388ecccd3f3cd0e2958680a0aeb2e6437caa9490146d510394915752","observation_id":"6c4c2743-3763-41fc-8ce0-77eeb108d7a2","resolution":{"observed_at":"2026-08-10T18:29:48.245277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.224115Z","title":"Deletion and insertion tests in regression models","venue":null,"work_id":"c9f71f5a-03a6-4be4-919c-4af557433a21","year":2023},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.987344Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:1d08cf4dd9c1ffa9056f3b5a4d5fa39b5bb4c458b4fc03239dc5b4689e755ddf","observation_id":"e07364ef-230d-4ddf-8b4e-d2d3d057414d","resolution":{"observed_at":"2026-08-10T18:29:48.229442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.207763Z","title":"Delving deep into rectifiers: Surpassing human-level perfor- mance on imagenet classification","venue":null,"work_id":"88a2cbf1-293b-439e-851f-39d6a523eeae","year":2015},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.991644Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:8b316be130f8ae32e5769e83c10c6e8da4e9e4ec55da4c33013503220ae8d6ea","observation_id":"0caa2384-aaa2-4db5-82fd-883cdfa9ebbd","resolution":{"observed_at":"2026-08-10T18:29:48.213367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.191971Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"4b49ab19-445c-46b4-86f5-9ae4897db009","year":2016},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:46.995901Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:e13ec2c2a5559ab32b264b8ddb2db26fba6f94b0a8274d183dec378af386176a","observation_id":"1efa27a5-f291-4dfd-a3a3-a9eefe2959ac","resolution":{"observed_at":"2026-08-10T18:29:48.196770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.175438Z","title":"Layercam: Exploring hierarchical class activation maps for localization","venue":null,"work_id":"2a90f86f-8c55-453b-a974-5e84c243d4ef","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.000718Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:66cb6da002dcd983dbf1d9e962640ad032587fc83f2923662b9dd22eec6b7a9d","observation_id":"a836eb4c-5b16-4b49-b95c-c6c2456e5f44","resolution":{"observed_at":"2026-08-10T18:29:48.181608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T18:29:47.005633Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.005633Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:e8c3fdd08db85c437dc6b0c93cbc2996e54f95da76184c73d756f5f747fedd86","observation_id":"b8d29c90-6097-49ce-8a3c-8d8b11ac4546","resolution":{"observed_at":"2026-08-10T18:29:47.005633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16756","last_updated":"2025-01-02T15:54:29Z","snapshot_observed_at":"2026-08-22T04:01:22.626214Z","submitted_at":"2024-09-25T09:07:46Z","title":"Navigating the Maze of Explainable AI: A Systematic Approach to Evaluating Methods and Metrics","version":3},"cited_work":{"arxiv_id":"2409.16756","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.16756","snapshot_observed_at":"2026-08-10T18:29:47.340143Z","title":"Navigating the Maze of Explainable AI: A Systematic Approach to Evaluating Methods and Metrics","venue":"cs.CV","work_id":"1e37b699-4a3d-4bcc-8541-8b759765b322","year":2024},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.010473Z"},"links":{"cited_paper":"/paper/2409.16756","citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:b5150d39db0a9ad6217899a7d13ec322bc3143cce64bd9eeee7c7976c5c10e7b","observation_id":"f8196dd6-95cd-48ee-92ea-8c9642cd7b6d","resolution":{"observed_at":"2026-08-10T18:29:47.347423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.157614Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"f5dc351c-ff90-485e-a107-46f8dd6971a7","year":2013},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.015333Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:bb0866b5aeb3a9dd50b67149a0a908c402d72d5b7cf4d8b7e47d91f900533fa0","observation_id":"7460b8e0-0770-4a78-a22b-e1234218246f","resolution":{"observed_at":"2026-08-10T18:29:48.163695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.141650Z","title":"Lundberg and Su-In Lee","venue":null,"work_id":"47e7190a-148c-4142-8be1-79d6a044c57d","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.019604Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:25f8aaca4b75b31b503f645c4a7e50851c8d2aa14cbefc6022cb4c758bb3d12e","observation_id":"b5f3b151-336c-47e7-870a-7dc2a4863a0b","resolution":{"observed_at":"2026-08-10T18:29:48.146420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.097679Z","title":"A Unified Approach to Interpreting Model Predictions","venue":null,"work_id":"5b7c54bc-2335-4805-ba4d-bb90b40c0c9d","year":2017},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.024229Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:0ec36af78eb0bc7f49426c4c36ece7e59c402699d8a253172311e6716c3b6851","observation_id":"61065609-d1d4-4d38-93c1-526b2f1bccee","resolution":{"observed_at":"2026-08-10T18:29:48.130946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-10T18:29:47.028935Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.028935Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:052e57326c711bfe5f6058a13d1fc34fd243ffa5911f87377aea76db7ea8d584","observation_id":"0b11d38c-f7ce-4460-a340-5897219cd4a3","resolution":{"observed_at":"2026-08-10T18:29:47.028935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08027","last_updated":"2025-02-27T07:06:50Z","snapshot_observed_at":"2026-08-19T11:48:23.302681Z","submitted_at":"2024-07-10T20:10:56Z","title":"Fish-Vista: A Multi-Purpose Dataset for Understanding & Identification of Traits from Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08027","snapshot_observed_at":"2026-08-10T18:29:47.034008Z","title":"Fish-vista: A multi-purpose dataset for understanding & identification of traits from images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.034008Z"},"links":{"cited_paper":"/paper/2407.08027","citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:7d61fb1f6866ec1a6c4c54a4ea7facd87dddbc983f334b94fb54b6358e9f9a78","observation_id":"347f8503-cfb7-4b29-b0ce-bb21c540a4e7","resolution":{"observed_at":"2026-08-10T18:29:47.034008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.080108Z","title":"Explainable artificial intelligence: a comprehensive review","venue":null,"work_id":"eab9b229-85f8-4477-abcc-22ddec8233f2","year":2022},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.038870Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:52ce3dc9159a7ac076317ca48c5dae20d6126416ba081699d2ca83ae68770568","observation_id":"c46ff567-153f-4995-be8c-47400f3d421f","resolution":{"observed_at":"2026-08-10T18:29:48.085770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.064426Z","title":"Eigen-cam: Class activation map using principal compo- nents","venue":null,"work_id":"c30bca90-4c30-4cbb-80f8-27e4caa36d50","year":2020},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.043636Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:9b4f1a64433c2df5f4be9a76130339d9f2c78063e59fb9f3b99d1f63a553418e","observation_id":"9e6bcb93-316f-483f-b156-c20314949d08","resolution":{"observed_at":"2026-08-10T18:29:48.069463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.048603Z","title":"Evet: enhancing visual explanations of deep neural networks using image transformations","venue":null,"work_id":"a36ab506-b290-4121-992c-7be966518db5","year":2021},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.048554Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:5d5bf195ade97ba87f939d2977aa0fbee22c269be1484e18f31e854d6d170f4f","observation_id":"7d63b1ff-2b96-4596-bb9d-d3d682ae76c4","resolution":{"observed_at":"2026-08-10T18:29:48.053553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-10T18:29:47.053583Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.053583Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:327e1f38d1440e73a5a8e847d936848e022b67845ede68647874f48b4fcae44a","observation_id":"56159ea1-96bf-4c3c-9b50-a6bc5fba7bc4","resolution":{"observed_at":"2026-08-10T18:29:47.053583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.033146Z","title":"A simple interpretable transformer for fine-grained im- age classification and analysis","venue":null,"work_id":"9c580d7e-7439-489e-b0c6-93553b0657f5","year":2024},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.058222Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:329a9c368ebb52f78922e8fcdbce0d86debd88bd4fd7ac5713bb157f50f869c9","observation_id":"5ff48101-5b97-4d2d-96e3-0ad12089d991","resolution":{"observed_at":"2026-08-10T18:29:48.038412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:48.017966Z","title":"Rise: Randomized input sampling for explanation of black-box models","venue":null,"work_id":"cb62756d-ee20-44a0-8cd4-ebb092e92b3e","year":2018},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.062864Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:e2e44bf7e4427c16426cde94370a3dc1b9572f36bd54cc7a59589cff6533bb57","observation_id":"3a265fe7-869b-448e-ad85-2e8af295db81","resolution":{"observed_at":"2026-08-10T18:29:48.022783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.965837Z","title":"Birds 525 species - image classification","venue":null,"work_id":"48f716ec-a746-4590-b876-d7a93aac815e","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.067508Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:d5b11e091650f561e00911b17cb8c578c8000752553b054a483e5610ead18f5e","observation_id":"e2fd95bb-77ce-4b39-a372-ba52d9540ca2","resolution":{"observed_at":"2026-08-10T18:29:47.988717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.910493Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"c7157b5a-3d5e-46e6-8f19-bd2ca4948363","year":2021},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.071741Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:bc9f933dfc1694894e51d8062f6b6fd885f0117462250132a93f266c192d4cfb","observation_id":"eaaa4db8-9926-4e11-81d7-7acfa3610680","resolution":{"observed_at":"2026-08-10T18:29:47.923243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.894284Z","title":"Ablation-cam: Visual explanations for deep convolutional network via gradient- free localization","venue":null,"work_id":"ca37dd09-6964-441d-8898-43e811167816","year":2020},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.075963Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:bd87bfdfb25375d704bcea375ffd256fe79c026aabb5c703691fc5a5e6059407","observation_id":"79a8e6f9-ea7a-4d02-a801-28588069bce7","resolution":{"observed_at":"2026-08-10T18:29:47.899264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.879074Z","title":"There and back again: Revisiting backpropagation saliency methods","venue":null,"work_id":"ce819d2c-cf66-4d3c-a5c4-ab7b6cd98ce8","year":2020},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.080662Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:084bbbed5b57f1745fb50574fa219f020e5482462863de71ccce915e47e730b3","observation_id":"ecfc7ed9-160c-4c45-9808-5e15c7d17d48","resolution":{"observed_at":"2026-08-10T18:29:47.883761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.863279Z","title":"” why should i trust you?” explaining the predictions of any classifier","venue":null,"work_id":"ee6f1a53-cce9-4126-8c4f-fad18f187e54","year":2016},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.085194Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:694f4037f3844260e2c7dd232adb3c5e1a31a8526402d2d510e05bc4603f6be6","observation_id":"60971a07-9b04-444c-a0d8-01b5d0bcb0c2","resolution":{"observed_at":"2026-08-10T18:29:47.868681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.795589Z","title":"Imagenet-21k pretraining for the masses,","venue":null,"work_id":"fcafceee-8c0a-4828-aa33-e2308169dff1","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.089958Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:d58cfbe422a4226af38381e22ca416cbdb619119cadc4f5f1d7503f590913527","observation_id":"bf01c684-0448-4cce-a60e-faf31d64ddf7","resolution":{"observed_at":"2026-08-10T18:29:47.828611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.759080Z","title":"Grad-cam: Visual explanations from deep networks via gradient-based localization","venue":null,"work_id":"e215ea14-dcd1-4f66-95ba-52d3c389b02f","year":2017},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.095325Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:f0cc6c677720049067175f142c18ef509d2e53215360902844e6d6e10440021d","observation_id":"83000b95-cfa4-4798-9edb-6d0f1800c9fd","resolution":{"observed_at":"2026-08-10T18:29:47.764038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03825","last_updated":"2017-06-12T19:53:30Z","snapshot_observed_at":"2026-08-21T17:36:12.443942Z","submitted_at":"2017-06-12T19:53:30Z","title":"SmoothGrad: removing noise by adding noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03825","snapshot_observed_at":"2026-08-10T18:29:47.099604Z","title":"Smoothgrad: removing noise by adding noise","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.099604Z"},"links":{"cited_paper":"/paper/1706.03825","citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:a6085c21dbab65e4587bc124e27ee2b23b9e5235740207331172c6895a615f13","observation_id":"d1a60983-9f78-412f-8682-d0959c814c4d","resolution":{"observed_at":"2026-08-10T18:29:47.099604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.743273Z","title":"Going deeper with convolutions","venue":null,"work_id":"79510e40-b9b0-4a77-9b04-5b70e1a020f8","year":2015},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.104484Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:3d9b617f0bb7eb90ec11cbd7805c9665a02dcc50828e8c07d2ce8db207138acb","observation_id":"fcf77bde-38b1-4521-bc82-258b0d441b54","resolution":{"observed_at":"2026-08-10T18:29:47.748361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.726521Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":"b069f19d-7e1e-42a2-af60-06104ef0f527","year":2011},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.109304Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:2c5975c3157f06ddeb7c203edc224016c18a078977897c52d0aa384bfe1f4c15","observation_id":"99f0eac1-5af0-4400-8f2b-02f116444d1b","resolution":{"observed_at":"2026-08-10T18:29:47.732288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.710348Z","title":"Score-cam: Score-weighted visual explanations for convolutional neural networks","venue":null,"work_id":"09086a3e-7b0f-4ead-bb45-a63621ad4e6e","year":2020},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.114179Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:7d938579189c0a4319869362e5c7f6c5bde260fd277b51be689207974ff1317f","observation_id":"17e07ee1-6879-4795-a0ba-cb64680cbb71","resolution":{"observed_at":"2026-08-10T18:29:47.715639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.617818Z","title":"Fine-grained image analysis with deep learning: A survey","venue":null,"work_id":"e1a70c1f-1fc7-4c68-90bb-4a10e75844d4","year":2021},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.119046Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:2f599bb55f0542b32f3596f99b052a80e21b28fcbbf8776d1921f49ba62709ef","observation_id":"c97c6b73-3a20-4426-a218-49987cff192d","resolution":{"observed_at":"2026-08-10T18:29:47.678406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.123950Z","title":"Protopformer: Concentrating on prototypical parts in vision transform- ers for interpretable image recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.123950Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:75f0d2d0146cca76bc272e542b5a632b4669a12e106c49d1d7ddd1c2a81e651c","observation_id":"a9f2b9bb-992c-4653-8d62-fafe6cfb679b","resolution":{"observed_at":"2026-08-10T18:29:47.123950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.459122Z","title":"On the (in) fidelity and sensitivity of explanations","venue":null,"work_id":"d5f752ad-2f2c-48bd-802b-9e729e64d13d","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.128538Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:c4bcd3f6a0734046a7adcd6bc7e6e3761254c49c73c61cce7a3f2de2d4233b44","observation_id":"79324c24-e3a8-48ad-be43-f5f255e3fd61","resolution":{"observed_at":"2026-08-10T18:29:47.526122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.428537Z","title":"A survey on deep learning-based fine-grained object classifi- cation and semantic segmentation","venue":null,"work_id":"0db58c96-c13d-406c-994a-2a59aaf9ef50","year":2017},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.133493Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:7bcf2ee5afa22d9268a67a7d35f207d3870f4fe04689aab6cfb11dc9c4656971","observation_id":"1cbcc46d-e7f6-4fef-bed2-e85acaefae45","resolution":{"observed_at":"2026-08-10T18:29:47.434227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.411910Z","title":"Learn- ing multi-attention convolutional neural network for fine- grained image recognition","venue":null,"work_id":"c5e83bb8-4cb3-4bd8-a694-daacc2726d97","year":null},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.138245Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:0684064b56e3fbb39215be3879eb708b367d2a1e585437884dcacf0fd2044cab","observation_id":"3cb03b2b-2476-4444-9383-4525cdd8f95b","resolution":{"observed_at":"2026-08-10T18:29:47.417352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.394765Z","title":"Looking for the devil in the details: Learning trilinear atten- tion sampling network for fine-grained image recognition","venue":null,"work_id":"20bb5dbd-cd8e-413e-807c-a00839ced919","year":2019},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.143214Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:0e3396f53a700ff266110be2ed0e3a8ab3189d13d1a1b598c9e01081a56e63d4","observation_id":"1f1a491c-9589-4da0-9d62-771362faf45b","resolution":{"observed_at":"2026-08-10T18:29:47.399846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:29:47.377888Z","title":"bird” as comparing pairs in the zero-shot classification setting. It shows the “ground truth","venue":null,"work_id":"fb9f86db-db1d-4d74-a4c4-85422e7ef8ef","year":2016},"citing_paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T18:29:47.147600Z"},"links":{"citing_paper":"/paper/2501.11309"},"observation_digest":"sha256:034ff870f3926f5b166736d0b0725c7bad8663ae9a520321162ab9a7fb95d015","observation_id":"636ccb02-bda1-4876-a1ae-5dd5d0483c32","resolution":{"observed_at":"2026-08-10T18:29:47.383352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.11309","last_updated":"2025-03-31T15:30:00Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T11:48:56.074619Z","submitted_at":"2025-01-20T07:23:11Z","title":"Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":39},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 2 inbound Pith citation observations for arXiv:2501.11309."}