{"as_of":"2026-08-09T06:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0195bc0600ae0ccb8c87d00869d6aacfcb15fe30d4379cd7983aa06b5cca6ba","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:02:11.666342Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T06:10:20.420575Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04059","snapshot_observed_at":"2026-08-03T06:10:20.420575Z","title":"Attributing data for sharpness-aware minimization.CoRR, abs/2507.04059, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00329","last_updated":"2026-07-22T02:36:11Z","snapshot_observed_at":"2026-08-08T05:44:04.990003Z","submitted_at":"2026-01-30T21:31:40Z","title":"In-Run Data Shapley for Adam Optimizer","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T06:10:20.420575Z"},"links":{"cited_paper":"/paper/2507.04059","citing_paper":"/paper/2602.00329"},"observation_digest":"sha256:867a7e8fc1c4b79cafa35186b7d57b58d1807976c6f6418a8e1008e0b24bbd4a","observation_id":"1319ece6-7896-4d51-b873-a37d8ec87ba1","resolution":{"observed_at":"2026-08-03T06:10:20.420575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04059/citation-record","integrity":"/paper/2507.04059/integrity","json":"/paper/2507.04059/citation-record.json","paper":"/paper/2507.04059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.466300Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":"dc6b7c69-1e0f-4dbe-986e-11eca399e9f9","year":2009},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.687671Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:e59be4c7712c2af5d3e075a47d9734eaaa6d2a323b88e1df7f7d02d5767c0b8a","observation_id":"6f5959e9-00f7-4383-a952-a736e878d95d","resolution":{"observed_at":"2026-08-06T20:02:12.469258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.459160Z","title":"Sharpness- aware minimization leads to low-rank features","venue":null,"work_id":"41522456-1d0b-4ef6-915e-fd75ebc62996","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.728346Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:65401848714b75f6d25c5b8df8dfbd3fb48922340678e07dc62213bc9736bdd7","observation_id":"27883883-6e69-4837-949e-66c2e89b8318","resolution":{"observed_at":"2026-08-06T20:02:12.461558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.451417Z","title":"Towards understanding sharpness-aware minimization","venue":null,"work_id":"dc3205c2-4738-4561-aec5-92d0234f41ff","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.772885Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:86d70fc75a40f9e2ca518dc45516eea4e6d5e3c47bbd30906e65999a7c035b93","observation_id":"7151007d-0620-479d-950f-85a539aadbbf","resolution":{"observed_at":"2026-08-06T20:02:12.454197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08529","last_updated":"2022-03-15T23:33:33Z","snapshot_observed_at":"2026-08-09T03:19:54.179105Z","submitted_at":"2021-10-16T09:44:06Z","title":"Sharpness-Aware Minimization Improves Language Model Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08529","snapshot_observed_at":"2026-08-06T20:02:05.826901Z","title":"Sharpness-aware minimization improves language model generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.826901Z"},"links":{"cited_paper":"/paper/2110.08529","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:1636527b8e3d4e7f180d70191145a05c02bcb99f099476fd6cf4cd35fcb42831","observation_id":"de2c7554-1a22-4484-8dce-d62dc30addc4","resolution":{"observed_at":"2026-08-06T20:02:05.826901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.442947Z","title":"Influence functions in deep learning are fragile","venue":null,"work_id":"586c162d-5e82-40ff-9569-ddc6e3bd0d81","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.859848Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:d57bc9888b1a756055377db1392f0e017ab489309840ca6ea0b8f1865381ddad","observation_id":"eb8c36a8-eac8-4d0c-a3b6-b4bd61961f5b","resolution":{"observed_at":"2026-08-06T20:02:12.445685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.434759Z","title":"Un- derstanding the origins of bias in word embeddings","venue":null,"work_id":"cdac60f4-a542-49de-8fd4-3850d334bbb8","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.911916Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c76da555eb2f1694d40ee27f90849fa611315cb81749aecdf1185f07837270b8","observation_id":"80785932-dfa7-4f1b-bb93-c98df5824275","resolution":{"observed_at":"2026-08-06T20:02:12.437631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.426520Z","title":"Entropy-sgd: Biasing gradient descent into wide valleys","venue":null,"work_id":"dc2da23d-f1af-4f84-ba59-1f5d31ff8a33","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.969780Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:05b626cab9c55dde7a8b8ed290239a5e91684195cc111e9a407900b5b37e1933","observation_id":"8a77e1ce-6da6-4f5c-95b2-77f6a743b59f","resolution":{"observed_at":"2026-08-06T20:02:12.429482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.418171Z","title":"Multi-stage influence function","venue":null,"work_id":"b52ba6bc-9cc0-4188-b629-3d7027e2eaec","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.009181Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:652e310802be3a5e7a49e7c3f10fc5609956285c278829316ca3930489dbd50f","observation_id":"d8c30c5c-9c6a-49a9-97db-d35645608096","resolution":{"observed_at":"2026-08-06T20:02:12.420819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01548","last_updated":"2022-03-13T18:58:43Z","snapshot_observed_at":"2026-07-06T11:15:26.915483Z","submitted_at":"2021-06-03T02:08:03Z","title":"When Vision Transformers Outperform ResNets without Pre-training or Strong Data Augmentations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01548","snapshot_observed_at":"2026-08-06T20:02:06.057895Z","title":"When vision transformers outperform resnets without pre-training or strong data augmentations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.057895Z"},"links":{"cited_paper":"/paper/2106.01548","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:20bb37a3399b9f0669771dc036f0a6bba35a6cfdaaaa9f872378437505294340","observation_id":"29ed7f32-3fd8-434c-a9c0-0bbfff544124","resolution":{"observed_at":"2026-08-06T20:02:06.057895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.409609Z","title":"Detection of influential observation in linear regression","venue":null,"work_id":"faf18169-f878-43db-9bab-932a71d1ee3c","year":2000},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.113595Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:fdc5de65643a7bc2dde9198b8eb8d82be0c541fffc9edba1793291466a767917","observation_id":"5c7b5b88-1fbc-48eb-a530-17ca61fe7b25","resolution":{"observed_at":"2026-08-06T20:02:12.412580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:06.162305Z","title":"Characterizations of an empirical influence function for detecting influential cases in regression","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.162305Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:450a3fd86141b8564c24ddcff748cf8a9e34a209fdea35c8529cdcb2cb8000a2","observation_id":"048ed343-a8f1-4d08-854e-d49f4fd97bde","resolution":{"observed_at":"2026-08-06T20:02:06.162305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.395676Z","title":"The theory of max-min and its application to weapons allocation problems, volume 5","venue":null,"work_id":"242a64a8-c032-486e-83a9-57445c5df58e","year":2012},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.225748Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:673089eefa2df358a77080ca35496e845723860d0a8c9ba5a3ed3fa75b8befcd","observation_id":"9d5e6f38-e7be-4ff4-b143-7394496a681a","resolution":{"observed_at":"2026-08-06T20:02:12.398197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.388219Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":"1b812ffc-1728-4cf6-b060-81eac313fa74","year":2009},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.286092Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:d32678c7300061fed1e3490c1fb8e0095c15292136cedead2f44389867f60bb2","observation_id":"df0102a3-ee11-4b5e-bcdc-7cb2f780ceab","resolution":{"observed_at":"2026-08-06T20:02:12.390661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03141","last_updated":"2022-05-28T15:35:32Z","snapshot_observed_at":"2026-08-09T06:09:10.757790Z","submitted_at":"2021-10-07T02:20:37Z","title":"Efficient Sharpness-aware Minimization for Improved Training of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03141","snapshot_observed_at":"2026-08-06T20:02:06.339881Z","title":"Efficient sharpness-aware minimization for improved training of neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.339881Z"},"links":{"cited_paper":"/paper/2110.03141","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:d35463033167d3f6fbfb8eb47c8a7bc95b4ae5ee25fad44c256fd3f798e256f2","observation_id":"07d788d8-3dee-4b27-bb15-8a3b6d7e6505","resolution":{"observed_at":"2026-08-06T20:02:06.339881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.380065Z","title":"What neural networks memorize and why: Discovering the long tail via influence estimation","venue":null,"work_id":"32f3713f-4c3e-4771-a062-c12612ecd119","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.402965Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:fdcccd9100522046bdfda770c2c521f8865e779457127f808826f6d3f39c9e49","observation_id":"58481b64-b0f2-4da2-b2a1-bf0a7f0c257a","resolution":{"observed_at":"2026-08-06T20:02:12.382538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01412","last_updated":"2021-04-29T16:44:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-03T19:02:10Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01412","snapshot_observed_at":"2026-08-06T20:02:06.457173Z","title":"Sharpness-aware mini- mization for efficiently improving generalization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.457173Z"},"links":{"cited_paper":"/paper/2010.01412","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:18bfa36298e4b1f9e8f1642c3d4385a75ecfe347f17cd41625c1e6af836cec12","observation_id":"ac30bb66-b358-40ba-84b9-f0d114410d00","resolution":{"observed_at":"2026-08-06T20:02:06.457173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:06.514723Z","title":"short-length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.514723Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:5f09f2d1f50846ae6a0a98a6b33eec4552c134c7d620b6a3b5c20cb00724ac25","observation_id":"34dcc8fb-aa5b-4c91-b2da-bcb2bd00e370","resolution":{"observed_at":"2026-08-06T20:02:06.514723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06112","last_updated":"2024-02-04T16:31:50Z","snapshot_observed_at":"2026-08-07T22:49:29.672224Z","submitted_at":"2023-10-09T19:40:25Z","title":"Theoretical Analysis of Robust Overfitting for Wide DNNs: An NTK Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06112","snapshot_observed_at":"2026-08-06T20:02:06.580845Z","title":"Theoretical analysis of robust overfitting for wide dnns: An ntk approach","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.580845Z"},"links":{"cited_paper":"/paper/2310.06112","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:7c00cb2f97ce436e6a33c372e95cfe80a45f809eeec71e83b110e4fc109fc0f3","observation_id":"af93d81d-0306-47f6-bd26-9657bf65f60a","resolution":{"observed_at":"2026-08-06T20:02:06.580845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.372069Z","title":"Data shapley: Equitable valuation of data for machine learning","venue":null,"work_id":"c9ac0c45-3157-4be0-9ce4-91adb2be436d","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.695792Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:d7a4bf0058e6f5c9c1a85bd4e4bdafeeb463d0b34bbc75f9f304d2e9cec8b4ba","observation_id":"45104d74-4a91-4ee2-accc-1f2ff0ae1315","resolution":{"observed_at":"2026-08-06T20:02:12.374728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.363766Z","title":"Mixed-privacy forgetting in deep networks","venue":null,"work_id":"0c79aae1-40bf-4a23-881a-df5c82581a78","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.834811Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:09ca6aab9881c7ace93111b4e75f9c431f064c5be3c8ddf75589c181342c3f76","observation_id":"fefbba0b-5f41-4150-a07f-7b03a7de729b","resolution":{"observed_at":"2026-08-06T20:02:12.366501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:06.942920Z","title":"Eternal sunshine of the spotless net: Selective forgetting in deep networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.942920Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:74a535de249faf55cc17d16749b20dfb719ff2745e1a2d127d5b67bca10ccde0","observation_id":"1e9fa2d3-fb8d-4ea7-9f32-c7462c6b87cc","resolution":{"observed_at":"2026-08-06T20:02:06.942920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.06676","last_updated":"2020-05-14T00:45:23Z","snapshot_observed_at":"2026-08-09T04:56:18.627164Z","submitted_at":"2020-05-14T00:45:23Z","title":"Explaining Black Box Predictions and Unveiling Data Artifacts through Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.06676","snapshot_observed_at":"2026-08-06T20:02:07.027256Z","title":"Explaining black box predictions and unveiling data artifacts through influence functions","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.027256Z"},"links":{"cited_paper":"/paper/2005.06676","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:f1838eb48b37ef43ab07cb0d4d107ecd054dca884b86756b563d8c06cce2624a","observation_id":"4577a052-ab1f-4dc8-a192-a4e13b33e542","resolution":{"observed_at":"2026-08-06T20:02:07.027256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:07.134012Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.134012Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:13b5b0250f57af7cdf80caa9f0a3cb84ae4c3a08bdf11b9ae3a24f4ad79a8b9b","observation_id":"4852de92-2d25-43a5-aefb-ea73dcefb76e","resolution":{"observed_at":"2026-08-06T20:02:07.134012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.346437Z","title":"Simplifying neural nets by discovering flat minima","venue":null,"work_id":"e463b724-06d5-4538-aaff-76a803efed68","year":1994},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.179033Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:003df8b6ae5799c2c59648148218e947fb8570253a2152e4e0779f6a95c6e12a","observation_id":"8b8cf768-3308-4c38-86a9-b109949be359","resolution":{"observed_at":"2026-08-06T20:02:12.349001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.338684Z","title":"Flat minima","venue":null,"work_id":"313eb118-c35e-442d-8fb1-9c01762e61fd","year":1997},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.257961Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:9631b1c37c4e2d0232f98cad8186b42bf88651255e30ea31119461a4c4fedae8","observation_id":"c5c42590-f4f3-4a24-be94-87a9b4c8e09e","resolution":{"observed_at":"2026-08-06T20:02:12.341015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09112","last_updated":"2023-10-23T13:28:35Z","snapshot_observed_at":"2026-08-09T04:53:10.483192Z","submitted_at":"2023-01-22T12:29:03Z","title":"Differentially Private Natural Language Models: Recent Advances and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09112","snapshot_observed_at":"2026-08-06T20:02:07.325958Z","title":"Differentially private natural language models: Recent advances and future directions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.325958Z"},"links":{"cited_paper":"/paper/2301.09112","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:8c9708ce8b27263b51310bf47db73d705be5cb72187b95b983e056831733d946","observation_id":"ceb13d4c-9935-4cab-b87f-5da93ea611cc","resolution":{"observed_at":"2026-08-06T20:02:07.325958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15476","last_updated":"2025-02-01T12:03:52Z","snapshot_observed_at":"2026-08-07T22:49:28.669491Z","submitted_at":"2024-05-24T11:55:46Z","title":"Editable Concept Bottleneck Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15476","snapshot_observed_at":"2026-08-06T20:02:07.414490Z","title":"Editable concept bottleneck models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.414490Z"},"links":{"cited_paper":"/paper/2405.15476","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:44412b8ac82a17dc7d6ce92064584291322daf7463a7b11fd07e623e266ebfec","observation_id":"14043fd2-e6a2-4972-9376-a0a116b34c49","resolution":{"observed_at":"2026-08-06T20:02:07.414490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11667","last_updated":"2025-01-31T23:36:04Z","snapshot_observed_at":"2026-08-08T05:43:45.182949Z","submitted_at":"2024-11-18T15:45:41Z","title":"Dissecting Representation Misalignment in Contrastive Learning via Influence Function","version":2},"cited_work":{"arxiv_id":"2411.11667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11667","snapshot_observed_at":"2026-08-06T20:02:12.020561Z","title":"Dissecting Representation Misalignment in Contrastive Learning via Influence Function","venue":"cs.LG","work_id":"ab06afe7-3785-4c7a-9b34-6ea5bf667638","year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.522251Z"},"links":{"cited_paper":"/paper/2411.11667","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:2be8a16cc410d613f07bbb75b399f4bcafc54559b88f7f7100b72b3e0d98360b","observation_id":"e411ff96-d8af-47fb-9a85-b01dbc310002","resolution":{"observed_at":"2026-08-06T20:02:12.023582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.329893Z","title":"Privacy-preserving sparse generalized eigenvalue problem","venue":null,"work_id":"cf03575c-a2cd-456f-8ffe-c0da2de08654","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.640176Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:cb8603d03a2065c0045890d26ea27416046b7390bc1023907a7e87783570817b","observation_id":"b399b709-3eb6-4760-a73c-454f5dcf346a","resolution":{"observed_at":"2026-08-06T20:02:12.333177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.322107Z","title":"Robust statistics","venue":null,"work_id":"9e713c23-a3e6-4916-aaea-f7a2f21211d6","year":1981},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.767171Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:137c8123ec587b095821d9fcca17d06f0535587fac605b98a1d483e8dd6a28b1","observation_id":"338bb633-edbf-49a5-959e-518f0dde7d02","resolution":{"observed_at":"2026-08-06T20:02:12.324586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-07-31T19:09:21.589864Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-06T20:02:07.851201Z","title":"Averaging weights leads to wider optima and better generalization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.851201Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:eeaffa2d4b15fdef92f6dcac237bc63356bb688784f80eb90c0ae7d1b3d6461a","observation_id":"37f4b75e-6887-49dc-906b-2c603f442a4e","resolution":{"observed_at":"2026-08-06T20:02:07.851201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.313984Z","title":"Towards efficient data valuation based on the shapley value","venue":null,"work_id":"6e08d8d1-8559-42ea-86cf-9d41ea88f065","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.936269Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:718333d3c4b72b86e29c20b55d94f7b9567343710aef08021eab9693e8a6f605","observation_id":"6c64f9eb-b518-46f4-92f9-5df8936890c2","resolution":{"observed_at":"2026-08-06T20:02:12.317442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-07-06T05:10:58.923264Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04836","snapshot_observed_at":"2026-08-06T20:02:08.019516Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.019516Z"},"links":{"cited_paper":"/paper/1609.04836","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:27efa9ee7da0a65b34e8073fc75cf39425323e0a5b57a4d60ea5e2548b1c3f6c","observation_id":"ed265c71-12fa-42f3-a4b3-3b44f53ef3aa","resolution":{"observed_at":"2026-08-06T20:02:08.019516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.305648Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":"fa2db8d8-6640-433b-99d0-1cda425c6ca4","year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.126788Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:99b18302e0ba5fad1452a1f289624c78309a3d140410e08c3a436039264959cb","observation_id":"56e007d7-1c49-44d4-9134-b4c86189fd0c","resolution":{"observed_at":"2026-08-06T20:02:12.308237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.297530Z","title":"Asam: Adaptive sharpness- aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":"76d85a3c-9b5a-477d-804d-6fc454b833bd","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.286599Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:b261bc9947eb158fe26ffad26b22a6cb37c629868623681b1074964775b71cf0","observation_id":"000ae659-333b-4d01-bf6b-281ea6be1bc0","resolution":{"observed_at":"2026-08-06T20:02:12.300520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.290127Z","title":"Beta shapley: a unified and noise-reduced data valuation framework for machine learning","venue":null,"work_id":"eb159182-4b0c-4390-9019-29830793fde3","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.456622Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:17732c0265bce23dce31f8a697376e323d1f9495b7e13c2cfdc3ce4a5420dda9","observation_id":"0a96316d-bac3-41a6-b65b-1b0210b78628","resolution":{"observed_at":"2026-08-06T20:02:12.292687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:08.552605Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.552605Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:36d07ebc6ca594a58a227ee58d2408790e39b9ad91e8e99faf16aef207ca61f0","observation_id":"a0ca9953-b2a0-4237-bd03-1c3a585386d9","resolution":{"observed_at":"2026-08-06T20:02:08.552605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.277833Z","title":"Taad: Time-varying adversarial anomaly detection in dynamic graphs","venue":null,"work_id":"ec9516ee-9539-40af-95a7-4ce9543d1a4a","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.638083Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:5a6643f18ca9247beb3d530751351d0f37f7dc98f9df7cb15562f2e7ff73ba19","observation_id":"691b1a41-aa55-4669-8122-475aee919661","resolution":{"observed_at":"2026-08-06T20:02:12.280398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:08.701477Z","title":"Certified minimax unlearning with generalization rates and deletion capacity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.701477Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:ad2319dad0f0b3dc5f428de61175724de35ca43d5b1059a631987fafbc8caca8","observation_id":"1df482fe-a191-4299-af0f-4b227a07717a","resolution":{"observed_at":"2026-08-06T20:02:08.701477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10468","last_updated":"2024-09-05T15:47:45Z","snapshot_observed_at":"2026-08-07T22:51:48.145160Z","submitted_at":"2024-08-20T00:40:49Z","title":"Tracing Privacy Leakage of Language Models to Training Data via Adjusted Influence Functions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10468","snapshot_observed_at":"2026-08-06T20:02:08.850086Z","title":"Tracing privacy leakage of language models to training data via adjusted influence functions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.850086Z"},"links":{"cited_paper":"/paper/2408.10468","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c129168cd030e4c7362afaf2e3ddd8480eb3f9b481ba95cc850f09fd6f447a6d","observation_id":"11560f73-d871-4cce-99cf-ac5ce6f6818a","resolution":{"observed_at":"2026-08-06T20:02:08.850086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.265416Z","title":"Towards efficient and scalable sharpness-aware minimization","venue":null,"work_id":"c0d58245-2539-4339-a175-584166ae9968","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.954553Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:93dbeeb8d664bf1eeef583daf2b414cdca8c6319c7ff49c6918a79ec967a323f","observation_id":"389afcc4-152d-4a6e-ba8a-fb90cbe1a25e","resolution":{"observed_at":"2026-08-06T20:02:12.267890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07874","last_updated":"2017-11-25T03:53:32Z","snapshot_observed_at":"2026-07-06T05:43:42.722222Z","submitted_at":"2017-05-22T17:38:10Z","title":"A Unified Approach to Interpreting Model Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07874","snapshot_observed_at":"2026-08-06T20:02:09.042708Z","title":"A unified approach to interpreting model predictions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.042708Z"},"links":{"cited_paper":"/paper/1705.07874","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:6cf28c939fe67665fc86abd3a1013813e99e7a76ab48a75194523ac9d5b9902b","observation_id":"96f613c4-c8e5-4399-85a7-83ef8ab13c20","resolution":{"observed_at":"2026-08-06T20:02:09.042708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.256623Z","title":"Privacy-preserving low-rank adaptation against membership inference attacks for latent diffusion models","venue":null,"work_id":"f9aa00cf-1214-411c-b889-efcff324f4e6","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.142122Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:75f55b2b80e62d2ef79a89ac855e49896a6327d8ba91f528ff7fb25f97363edb","observation_id":"faf44026-f3e5-4a38-b75b-4cbde63faadc","resolution":{"observed_at":"2026-08-06T20:02:12.259962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.270948Z","title":"Towards deep learning models resistant to adversarial attacks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.270948Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:4103172e0f6f26c202de8cae5619a2843d66648bd1eec0bbf2dfc8ff72cb3e80","observation_id":"cf81a162-dc17-49fc-8a3a-7ce8ea59d820","resolution":{"observed_at":"2026-08-06T20:02:09.270948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.331386Z","title":"Exploring generalization in deep learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.331386Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:f0c2c155432504aa00ed01a608a7166e34e64bf00b00e44c9ef1785478550901","observation_id":"5630248e-072e-498f-9b80-6f88c8f08d67","resolution":{"observed_at":"2026-08-06T20:02:09.331386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14186","last_updated":"2023-04-03T17:37:50Z","snapshot_observed_at":"2026-08-07T22:49:29.096522Z","submitted_at":"2023-03-24T17:56:22Z","title":"TRAK: Attributing Model Behavior at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14186","snapshot_observed_at":"2026-08-06T20:02:09.426200Z","title":"Trak: Attributing model behavior at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.426200Z"},"links":{"cited_paper":"/paper/2303.14186","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c874991f2f37085589432c02bb212054c914a590dcea9666c2493b0a54d804e1","observation_id":"c18e484c-500f-41e8-93cd-d21c6f3ef836","resolution":{"observed_at":"2026-08-06T20:02:09.426200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.555002Z","title":"Estimating training data influence by tracing gradient descent","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.555002Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:85c33ff8ecc866f77b779127d37513600d398ec4765df70c223424de7d40f577","observation_id":"43954f1a-3b41-4a44-9f14-a8a77bd48cb2","resolution":{"observed_at":"2026-08-06T20:02:09.555002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.236912Z","title":"Generalized federated learning via sharpness aware minimization","venue":null,"work_id":"c4de2952-19b0-4b34-9313-c6e5faa98d71","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.623551Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:9297edef6d92f429f67591ccf25c9d2c507480b2799f6d885718139f8d5e8f10","observation_id":"ed919782-3e66-4baf-8c90-b60cf3a35886","resolution":{"observed_at":"2026-08-06T20:02:12.239339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15963","last_updated":"2025-01-27T11:14:04Z","snapshot_observed_at":"2026-08-07T22:49:28.149295Z","submitted_at":"2025-01-27T11:14:04Z","title":"Evaluating Data Influence in Meta Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15963","snapshot_observed_at":"2026-08-06T20:02:09.747575Z","title":"Evaluating data influence in meta learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.747575Z"},"links":{"cited_paper":"/paper/2501.15963","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:fd5169c0a35c952852eb3931668a7582c8d6edcac210ed49b6c8c15ece8ab2b4","observation_id":"e2915214-8635-4745-a2d2-22d64b7f6400","resolution":{"observed_at":"2026-08-06T20:02:09.747575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.886322Z","title":"why should i trust you?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.886322Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:789a1178611843ca692c93502c15938ef66d10803eacc6d9647748929b27724f","observation_id":"17fc5865-8db8-4e28-93fe-8ae8e04509c1","resolution":{"observed_at":"2026-08-06T20:02:09.886322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.226763Z","title":"Theoretical and practical perspectives on what influence functions do","venue":null,"work_id":"4254da6b-4990-40c0-a154-80498619f559","year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.990644Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:1673d7def35b74cc5bd077f441a05986d726e2e8fd587ffc4d5d05c134ca2e34","observation_id":"9fc2f2a3-af9a-4c62-abfc-026f96491c1a","resolution":{"observed_at":"2026-08-06T20:02:12.229121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.220455Z","title":"Adversarial training for free!Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"bc53b7f8-eb06-44ee-b0d7-33ca7d476cc8","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.171275Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:e6bd86191386acc13ad9bf57f740c6f4e7fb7e97e57218cd222c4d82a9810ee3","observation_id":"721fbaee-bad8-4e20-943c-e22ad8748832","resolution":{"observed_at":"2026-08-06T20:02:12.222955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.214215Z","title":"The ham10000 dataset, a large collection of multi-source dermatoscopic images of common pigmented skin lesions","venue":null,"work_id":"c8ff4389-e485-40c3-adc9-6b30c835e62a","year":2018},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.228922Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:ae748be46029f95b15ca66125c4f5bafd1f9b1ef19a832887a489b3e0abed643","observation_id":"47165dba-06c3-466e-99b7-c4d715a789d5","resolution":{"observed_at":"2026-08-06T20:02:12.216694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.207828Z","title":"Generalized linear models in non-interactive local differential privacy with public data","venue":null,"work_id":"8125250f-eb69-4ef5-bcf2-7f384fa8e64a","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.356695Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:e2397a571f4c4f0dd7a8f535dbe5659260356f69f14a5687b2e07c8950d41257","observation_id":"05285cd3-6cbc-40e7-90d1-3d0552a30c3e","resolution":{"observed_at":"2026-08-06T20:02:12.210300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.201463Z","title":"Repairing without retraining: Avoiding disparate impact with counterfactual distributions","venue":null,"work_id":"481aba89-3139-44ec-bd70-ad4f45a5700d","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.461231Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:a7059c6ff776939f61d8b3d3439dba2a7cd6a8c5c8b398334c880e59d19368c0","observation_id":"66b71c33-aabf-49a9-85bb-b2ef67ee97de","resolution":{"observed_at":"2026-08-06T20:02:12.203758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.195556Z","title":"The shapley value","venue":null,"work_id":"892378ae-7d43-4e28-ac69-dae4268c8595","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.608501Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c37c82d42c60f29910ba67b6f4ed838c3c8df0842103c88b27e90de28a583496","observation_id":"3d84cd81-af46-4ad4-a84a-4c08020ffc23","resolution":{"observed_at":"2026-08-06T20:02:12.197608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.189210Z","title":"R-drop: Regularized dropout for neural networks","venue":null,"work_id":"b927a0c9-3d97-4efe-8701-0c9812c401b9","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.739362Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:4d62937be401f279f9e7a4e27dde03797225cb40a86d6cc658be0ed0a882a6f9","observation_id":"657244ff-9a34-4c5e-a1ac-2d59459cfc60","resolution":{"observed_at":"2026-08-06T20:02:12.191502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-07T17:47:02.067367Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T20:02:10.809020Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.809020Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:346fce61238e61075ec70a839dc1cf5d55c024c51f920fa44daa9e6f0eab26f3","observation_id":"a4b53896-a980-4e21-bb80-20510d0c1b40","resolution":{"observed_at":"2026-08-06T20:02:10.809020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.182314Z","title":"Practical differentially private and byzantine-resilient federated learning","venue":null,"work_id":"6f6c5e83-e9e1-43b5-b648-03c7b3aa8da7","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.907131Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:30d60b19f61c5d4f8b515cefd4f11d4ff14944224dc6ddc671c99a7328429d62","observation_id":"6df251cf-1d34-4c59-9346-e0368acd9c3c","resolution":{"observed_at":"2026-08-06T20:02:12.184835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.175227Z","title":"Preserving node-level privacy in graph neural networks","venue":null,"work_id":"3f4bde29-0856-494d-998b-4008eb4b8295","year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.995027Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:eedac6053dc0b1fc6f627894adcb8caadebf97ce58292ede37e26fdee5140edf","observation_id":"e7fea94d-37fa-4b60-9602-0624c88221f3","resolution":{"observed_at":"2026-08-06T20:02:12.177589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.168375Z","title":"A theory to instruct differentially- private learning via clipping bias reduction","venue":null,"work_id":"59648026-0c48-48b0-b0ee-6d4a5a22bfd9","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.107372Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:06c3bc9c77900443614efa821b91f424ade83cee5fe108f66854b9c2e6d02f11","observation_id":"c33fe4c2-35cc-498c-9347-6d9c8ac9facd","resolution":{"observed_at":"2026-08-06T20:02:12.171179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.161637Z","title":"Data valuation using reinforcement learning","venue":null,"work_id":"4771aaf5-9b75-4029-b282-f2cf88426bca","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.201437Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:faa007346b1a5d78a5552269abc9d00cd240b1a7e1d079e8eae23ecd9db6f923","observation_id":"41f6a1c1-2f34-4a1c-9492-c25a9112e118","resolution":{"observed_at":"2026-08-06T20:02:12.163900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10941","last_updated":"2017-05-31T04:56:25Z","snapshot_observed_at":"2026-08-05T12:22:57.956907Z","submitted_at":"2017-05-31T04:56:25Z","title":"Spectral Norm Regularization for Improving the Generalizability of Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10941","snapshot_observed_at":"2026-08-06T20:02:11.281313Z","title":"Spectral norm regularization for improving the generaliz- ability of deep learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.281313Z"},"links":{"cited_paper":"/paper/1705.10941","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:1c1726ed6add68028276849b0e58925f99bfc93b0160f85d2e2c6005eccb9c9d","observation_id":"fb3fd92f-db83-4b0a-a328-6c91a5a62089","resolution":{"observed_at":"2026-08-06T20:02:11.281313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17515","last_updated":"2025-02-22T14:57:28Z","snapshot_observed_at":"2026-08-07T17:56:23.145727Z","submitted_at":"2025-02-22T14:57:28Z","title":"Towards User-level Private Reinforcement Learning with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17515","snapshot_observed_at":"2026-08-06T20:02:11.411545Z","title":"Towards user-level private reinforcement learning with human feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.411545Z"},"links":{"cited_paper":"/paper/2502.17515","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:4db263281c8237d75e4e8e8a0595abe6afa3d037afc5b451880ac5929e04d6f3","observation_id":"63a5fe04-5eb8-410c-8678-0e7792f78026","resolution":{"observed_at":"2026-08-06T20:02:11.411545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09022","last_updated":"2025-02-14T05:46:53Z","snapshot_observed_at":"2026-08-08T02:39:29.302698Z","submitted_at":"2025-02-13T07:19:05Z","title":"Mechanistic Unveiling of Transformer Circuits: Self-Influence as a Key to Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.09022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09022","snapshot_observed_at":"2026-08-06T20:02:11.896730Z","title":"Mechanistic Unveiling of Transformer Circuits: Self-Influence as a Key to Model Reasoning","venue":"cs.AI","work_id":"b1bf29c3-d149-47bf-8475-4cdd22aae598","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.474879Z"},"links":{"cited_paper":"/paper/2502.09022","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:42e3029d093b998fa403a9f7200abc81c8383dfa1dea7055648ff4bbb1f08486","observation_id":"3d07b06f-dd56-4116-8543-90e42b0b70d5","resolution":{"observed_at":"2026-08-06T20:02:11.960151Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.154910Z","title":"Improved rates of differentially private nonconvex-strongly-concave minimax optimization","venue":null,"work_id":"084ac562-9fa4-4b6d-8ffa-09cb7fa09f3a","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.558279Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:cfca5de81e45c6ffbaba8a476e0e91b26d1866a5f5b7d75f8ec5559bdb8fc5c5","observation_id":"6a8a13c6-2915-4d41-b5b9-e3118f6df2bd","resolution":{"observed_at":"2026-08-06T20:02:12.157570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.147982Z","title":"Penalizing gradient norm for efficiently improving generalization in deep learning","venue":null,"work_id":"c5330061-f765-44c4-8816-8407e18aad03","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.563707Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:354ae37b651f0f40c179603507148a830e92daa9288c9c008d3901f40597114d","observation_id":"c291337a-4a4d-442e-acf3-0dd049b536de","resolution":{"observed_at":"2026-08-06T20:02:12.150675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07347","last_updated":"2020-06-07T18:39:33Z","snapshot_observed_at":"2026-08-07T22:51:12.935770Z","submitted_at":"2020-05-15T03:54:53Z","title":"Towards Assessment of Randomized Smoothing Mechanisms for Certifying Adversarial Robustness","version":3},"cited_work":{"arxiv_id":"2005.07347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.07347","snapshot_observed_at":"2026-08-06T20:02:11.750553Z","title":"Towards Assessment of Randomized Smoothing Mechanisms for Certifying Adversarial Robustness","venue":"cs.LG","work_id":"6307f4a5-0484-492c-936a-06aeab737134","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.666342Z"},"links":{"cited_paper":"/paper/2005.07347","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:9dbe058feb17551907970a3d843e9573b1656db20ef64a4354f72cb9a584d92d","observation_id":"ed97e6a5-ff57-4d96-b752-47c17672bc2a","resolution":{"observed_at":"2026-08-06T20:02:11.810878Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":38},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 1 inbound Pith citation observation for arXiv:2507.04059."}