{"as_of":"2026-08-09T23:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a2584498c4a809a8e58f7fe553afa67fdfeda18cac45bb370ebccc046b3ace7","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T04:59:35.053286Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09164/citation-record","integrity":"/paper/2607.09164/integrity","json":"/paper/2607.09164/citation-record.json","paper":"/paper/2607.09164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"On pixel-wise explanations for non-linear classifier decisions by layer-wise relevance propagation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:d5990f9a3672adaf828af4831f7614c1f987de49f46b28197be7782b12c96469","observation_id":"bbfee72e-257c-4359-8be0-248b36cff804","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Legrad: An ex- plainability method for vision transformers via feature formation sensitivity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:df6ba6f197b2fbd58994eab38079db19fea8b18fc4300348b056ff726e90444d","observation_id":"4e21f141-ff79-4c50-a96e-0f0bb8f9c700","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"What made you do this? understanding black-box decisions with sufficient input subsets","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:372f411f120251c680df94981eb474fb29d3f7b635173691924d7289415eec1f","observation_id":"a17bf99b-3ca4-43f5-9da6-c958a3c65a3f","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Grad-cam++: Gener- alized gradient-based visual explanations for deep con- volutional networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:ed395888a87831e636e7482adbc161ad04af67565f1ba7631299c0c0f11717d9","observation_id":"b648b7e4-d987-4aea-a46d-bbe325d321c3","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Transformer inter- pretability beyond attention visualization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:b2bc9338bdf382da2c6e9ac9da59adb70e1b14bbb9d92492084945a02155e2d0","observation_id":"1368e75a-23eb-4794-92a3-593d8dd164c7","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Real time image saliency for black box classifiers.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:a78a10b7d1caa0ce8c9606828231281bfdf922d44e2f3737090ff3434e9f4cc3","observation_id":"8afc0452-1de8-457e-b15b-3be8c00ff815","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Under- standing deep networks via extremal perturbations and smooth masks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:72ff1f4a0d9b1a6f79f140baf3e0ed5adbabea85dd99d97eb11a122b1cc32794","observation_id":"4c99b49f-22e1-4c9f-82d8-052072aed5d5","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Interpretable explana- tions of black boxes by meaningful perturbation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:2a050cabbc5ee1238af193531df59bb04ffecd17d04b63e5c276e7dacbcbc09f","observation_id":"736b8a52-afa5-4ea8-a090-43a25a454349","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.02312","last_updated":"2020-08-19T06:04:28Z","snapshot_observed_at":"2026-08-09T19:21:42.518488Z","submitted_at":"2020-08-05T18:42:33Z","title":"Axiom-based Grad-CAM: Towards Accurate Visualization and Explanation of CNNs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.02312","snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Axiom-based grad-cam: To- wards accurate visualization and explanation of cnns","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"cited_paper":"/paper/2008.02312","citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:6945b7c05035e219fa8e4068b8e3250fb782276eb3f9e44615bc8f0a6e6fdd5b","observation_id":"168c6443-59bf-4dda-88d9-e59c98356b59","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Alignsam: Aligning seg- ment anything model to open context via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:0046fe96c38f93ec55d170e6e7342ddbe8c78b95e28e96f6f60ede87c39c363c","observation_id":"c690cbbe-f640-403a-9681-e1dca22175f8","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Layercam: Exploring hierarchical class activation maps for localization.IEEE transactions on image processing, 30:5875–5888, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:3be46ec046c6a40eec255f2915a4b46ef9e2597c40a07f97188e5c182017174c","observation_id":"70e421b7-f991-4f20-867a-23d1c32109e2","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"igos++ integrated gradient optimized saliency by bilateral per- turbations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:db077a734e05c9f6f32838cae2e441f6bd915f5e86641d2fffe9db5f48ab6cc0","observation_id":"d694554d-1e70-488f-94b2-97401642f459","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:1e9d3bbe2037734089b28510b0e518c39b1943c5327348d13fcab346c011fd28","observation_id":"67bfc659-23f0-40fe-b1b2-0ba92d6aa96e","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Vision diffmask: Faithful interpretation of vision trans- formers with differentiable patch masking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:c7ea598cb47963ce38b07eb7aa83740dcb8aa5a0a2aa4b263c7e0e41075b4c0c","observation_id":"5a535c7f-0d3b-4fcc-b3de-617109c2c0ed","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.07421","last_updated":"2018-09-25T18:16:18Z","snapshot_observed_at":"2026-07-06T06:45:42.492990Z","submitted_at":"2018-06-19T18:41:30Z","title":"RISE: Randomized Input Sampling for Explanation of Black-box Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.07421","snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Rise: Ran- domized input sampling for explanation of black-box models.arXiv preprint arXiv:1806.07421, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"cited_paper":"/paper/1806.07421","citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:2beef1f8b6a9c374a5179b123c5f667d2c0f49898f4c29b189818c0fd6c548e6","observation_id":"217d718d-0a48-44f6-bc19-685d3492b641","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Visualizing deep networks by optimizing with integrated gradients","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:750bc8f96193cb034eca9c2472ae172d7b0c84cb19b554cb7224c57cf65b5de6","observation_id":"4afd0c40-fa9e-4de7-aa10-ba80e9ec3faa","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Grad-cam: Visual explanations from deep net- works via gradient-based localization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:1faa4702bb9103926885a2692b74516724f5df6e58a5c3aeef73adc23906edd7","observation_id":"faaf8d5b-86d0-40fa-9322-8ae3ebf3443c","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Learning important features through propagating activation differences","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:b5a52a8c5c4538c31d3d5678d8b897dc3be1bc78c21c5f7b6186bfff05104cd5","observation_id":"15b6996b-c2c3-487c-a7ce-7521bad36841","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-07-06T03:31:30.452356Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Deep inside convolutional networks: Visualising image classification models and saliency maps.arXiv preprint arXiv:1312.6034, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:8deefd3ae2c7c11f0790230eb9c745f1ea0a75d363e645d88e5b8a714c35d605","observation_id":"67221fc0-7e1e-47dd-9047-610052173e76","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03825","last_updated":"2017-06-12T19:53:30Z","snapshot_observed_at":"2026-07-06T05:46:32.599765Z","submitted_at":"2017-06-12T19:53:30Z","title":"SmoothGrad: removing noise by adding noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03825","snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Smoothgrad: removing noise by adding noise.arXiv preprint arXiv:1706.03825,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"cited_paper":"/paper/1706.03825","citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:89b75fe7b14f9b8b4fdabe803d4b618d0b5b83d153cf51ebe06594e474881963","observation_id":"1f15ece5-3e2f-4a5f-94a6-e5a281cb71da","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Ax- iomatic attribution for deep networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:687003d2b8da15a9b5438c5a27a74854930c8339056346fb5cddc320d325f788","observation_id":"007af550-fd6c-407c-8073-bb727a0bc5b8","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Diffuse attend and seg- ment: Unsupervised zero-shot segmentation using sta- ble diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:530d2b877e7cbcd8edf5c73e48e29eb26dd5844ce85cb120e45bde00a2757bc0","observation_id":"4c9fdad7-2a3b-4127-8eeb-b3e92011e254","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Score-cam: Score-weighted visual explanations for con- volutional neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:5c7ca3a5ff2d4d432b27339e9b30ef1e1977801198c85687e84918f7baba06c9","observation_id":"f6edf706-74f6-4ce5-b22c-e60b22a790e0","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Salient object detection: a mini review.Frontiers in Signal Pro- cessing, 4:1356793, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:55fcf2e26764db053dd59037b15738d54d25a4ae5685b54e46b1ed8239244737","observation_id":"d8b92084-ac3d-49c9-9461-2ecc8d13aaa0","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Dave: Distribution-aware attribution via vit gradient decompo- sition.arXiv preprint arXiv:2602.06613, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:f284eb7df6648a2156abb0ed6cbd4c40730974dfa0c2efb7ebaa889de7ce8a54","observation_id":"21869549-ca5a-4640-b08e-587eb84d3cd2","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Learning deep features for discriminative localization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:fab76122feb9ab9a0419bfc4eea138413646f38bf9fbef827de9331963e29c09","observation_id":"5aa8ab7f-f167-42f5-894f-4a3319f007c1","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model.arXiv preprint arXiv:2401.09417,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:8789f27e5e64c1527f75978df7058447ebe70aea88df39bc26a26553c85d8c38","observation_id":"35dbe31d-a43b-4b0a-806b-e1a1a9c1884c","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:59:35.053286Z","title":"informa- tion removal","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T04:59:35.053286Z"},"links":{"citing_paper":"/paper/2607.09164"},"observation_digest":"sha256:e3be7caa13d3278393cdfa68928d0d9225ae57e8920f3a1625c98e19bdc3c555","observation_id":"cac3c488-cbdf-4e40-8d65-134a03dec76d","resolution":{"observed_at":"2026-07-13T04:59:35.053286Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09164","last_updated":"2026-07-10T07:41:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T04:00:36.923391Z","submitted_at":"2026-07-10T07:41:13Z","title":"What Pixels Are Enough? SEAMS: Sufficiency Saliency via MSE-Preservation Soft-Masks"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2607.09164."}