{"as_of":"2026-08-09T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c192b616220508538894fce8a201eedb492c3d7f0c1df39d7649ef54e50fe71","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:52:24.316919Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.01628/citation-record","integrity":"/paper/2502.01628/integrity","json":"/paper/2502.01628/citation-record.json","paper":"/paper/2502.01628"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1802.08760","last_updated":"2018-06-18T18:01:43Z","snapshot_observed_at":"2026-07-06T06:25:07.039294Z","submitted_at":"2018-02-23T23:11:07Z","title":"Sensitivity and Generalization in Neural Networks: an Empirical Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.08760","snapshot_observed_at":"2026-08-09T14:52:24.178284Z","title":"Sensitivity and generalization in neural networks: an empirical study","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.178284Z"},"links":{"cited_paper":"/paper/1802.08760","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:4e3f389ce9793c0a2ab6b4601e61efd206e879643f1ca7ee50d2335184877a87","observation_id":"102a43c6-6c10-44c2-a2c9-d720c7e8c292","resolution":{"observed_at":"2026-08-09T14:52:24.178284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-09T14:52:24.183100Z","title":"Mechanistic interpretability for ai safety–a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.183100Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:a81ecf01b4b8ff084a91ae3da3aea0f6e027cc9e74fb432fd143a09b1979f2e8","observation_id":"4a7662aa-3bf3-4142-a0e0-aa8436a774d3","resolution":{"observed_at":"2026-08-09T14:52:24.183100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.901592Z","title":"Deepspeed data efficiency: Improving deep learning model quality and training efficiency via efficient data sampling and routing","venue":null,"work_id":"44daddb9-3e4a-472b-a1bb-b667f17ba8dc","year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.187240Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:62dec5c26821b2d070b24fecca3e676276a71dd875a86fe9b07f65d9938fd07d","observation_id":"44def21d-3d22-47a6-ac37-c4f8835322bd","resolution":{"observed_at":"2026-08-09T14:52:24.905351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.890925Z","title":"Patch diffusion: Faster and more data-efficient training of diffusion models","venue":null,"work_id":"ff0f886c-df29-4d87-8868-4a20c741c803","year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.191281Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:60472b428d0d33aa73659e088699222f90f79294dbfdb0f45a8ea12fd6f4904f","observation_id":"67aba9e7-0b4a-45ed-849d-bae551cd6f3f","resolution":{"observed_at":"2026-08-09T14:52:24.894701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02177","last_updated":"2022-01-06T18:43:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-06T18:43:37Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02177","snapshot_observed_at":"2026-08-09T14:52:24.194973Z","title":"Grokking: Gen- eralization beyond overfitting on small algorithmic datasets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.194973Z"},"links":{"cited_paper":"/paper/2201.02177","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:f62d04e7b27b0c188e82b4dc34a36430e717dc2265016f2b651c8c562264b2e6","observation_id":"1680d706-828c-4864-8ef8-9906365643ff","resolution":{"observed_at":"2026-08-09T14:52:24.194973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13624","last_updated":"2023-07-27T13:13:11Z","snapshot_observed_at":"2026-08-08T15:51:26.409443Z","submitted_at":"2021-08-31T05:28:42Z","title":"Towards Out-Of-Distribution Generalization: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.13624","snapshot_observed_at":"2026-08-09T14:52:24.198888Z","title":"Towards out-of-distribution generalization: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.198888Z"},"links":{"cited_paper":"/paper/2108.13624","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:a9e9390f012c4e5fb63a9c8d5b4d9218e653e32a1003f751092984adfdeaf376","observation_id":"0d404136-77dd-4203-bcc0-ae3449fd358f","resolution":{"observed_at":"2026-08-09T14:52:24.198888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.879430Z","title":"The clock and the pizza: Two stories in mechanistic explanation of neural networks","venue":null,"work_id":"385ddf10-c212-4240-b4c7-cc4bcd3f1883","year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.203066Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:419137a309c123e1b7062c2f254ba9f04e7870a9b27d8f65ba4e087db8663b6c","observation_id":"88716a04-3edf-4fea-9aef-34ed59ddd9fb","resolution":{"observed_at":"2026-08-09T14:52:24.883493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01117","last_updated":"2023-03-23T13:42:27Z","snapshot_observed_at":"2026-08-04T09:38:24.844846Z","submitted_at":"2022-10-03T17:58:04Z","title":"Omnigrok: Grokking Beyond Algorithmic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01117","snapshot_observed_at":"2026-08-09T14:52:24.206473Z","title":"Omnigrok: Grokking beyond algorithmic data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.206473Z"},"links":{"cited_paper":"/paper/2210.01117","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:32f63110148ece0a9db65c6174e0aeb223e5648cc6a29963f07b2761a204fbe7","observation_id":"20da7631-c5b4-4c0b-aaf2-9966d38eade9","resolution":{"observed_at":"2026-08-09T14:52:24.206473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.210577Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.210577Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:d9065b7b996b4de2c27b87da30a0a67eeee2c3926e21dae87bfc9db85c4e066e","observation_id":"7334ddb7-91ef-42aa-a822-410f898160cb","resolution":{"observed_at":"2026-08-09T14:52:24.210577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15213","last_updated":"2024-02-25T18:32:18Z","snapshot_observed_at":"2026-08-08T01:23:24.701475Z","submitted_at":"2023-10-23T17:55:24Z","title":"Function Vectors in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15213","snapshot_observed_at":"2026-08-09T14:52:24.214327Z","title":"Function vectors in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.214327Z"},"links":{"cited_paper":"/paper/2310.15213","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:87f04751f44d2f448e0de7a5ff0d96bd2e21da103515877bee0bb5b9051ff021","observation_id":"578f3ed6-7282-4f8e-9702-7dc8d71f438c","resolution":{"observed_at":"2026-08-09T14:52:24.214327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02207","last_updated":"2024-03-04T18:25:29Z","snapshot_observed_at":"2026-08-06T19:42:39.893943Z","submitted_at":"2023-10-03T17:06:52Z","title":"Language Models Represent Space and Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02207","snapshot_observed_at":"2026-08-09T14:52:24.218471Z","title":"Language models represent space and time","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.218471Z"},"links":{"cited_paper":"/paper/2310.02207","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:5863df31b7546f013d459b2fdd05f0d7f713452b2fadd93575606419d39220d6","observation_id":"9a4bad1f-eefa-4a1c-99a3-97f616ee2db1","resolution":{"observed_at":"2026-08-09T14:52:24.218471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.00737","last_updated":"2021-06-01T19:23:20Z","snapshot_observed_at":"2026-08-09T19:52:58.456549Z","submitted_at":"2021-06-01T19:23:20Z","title":"Implicit Representations of Meaning in Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.00737","snapshot_observed_at":"2026-08-09T14:52:24.222318Z","title":"Implicit representations of meaning in neural language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.222318Z"},"links":{"cited_paper":"/paper/2106.00737","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:f9debf1c78e50af1098bd62813e3a24882aa4d1e78d7db01563bbd1540da8d93","observation_id":"fc1cf0a9-e9ab-4928-923d-493eadee344d","resolution":{"observed_at":"2026-08-09T14:52:24.222318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06129","last_updated":"2021-09-14T07:10:41Z","snapshot_observed_at":"2026-08-09T22:26:32.058280Z","submitted_at":"2021-09-13T17:09:40Z","title":"Can Language Models Encode Perceptual Structure Without Grounding? A Case Study in Color","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06129","snapshot_observed_at":"2026-08-09T14:52:24.225953Z","title":"Can language models encode perceptual structure without grounding? a case study in color","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.225953Z"},"links":{"cited_paper":"/paper/2109.06129","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:c682f5641cda223c3af22067c3c7f3584225191d125c1fd737bf06167142b6c9","observation_id":"ef7e79c9-0a31-4841-af6c-f798d1e5a39b","resolution":{"observed_at":"2026-08-09T14:52:24.225953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-09T14:52:24.229613Z","title":"The geometry of truth: Emergent linear structure in large language model representations of true/false datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.229613Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:05341b5a13a265342ed1b4d8a93b46fc5b99071614b497edc2eaafb979d54830","observation_id":"cab92dcf-5c92-422e-ac3c-5366dc57c62b","resolution":{"observed_at":"2026-08-09T14:52:24.229613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10381","last_updated":"2024-03-15T15:10:41Z","snapshot_observed_at":"2026-08-02T05:15:18.689615Z","submitted_at":"2024-03-15T15:10:41Z","title":"Monotonic Representation of Numeric Properties in Language Models","version":1},"cited_work":{"arxiv_id":"2403.10381","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.10381","snapshot_observed_at":"2026-08-09T14:52:24.650351Z","title":"Monotonic Representation of Numeric Properties in Language Models","venue":"cs.CL","work_id":"8be7a8fe-43be-48d6-b231-c40a3fa6f75f","year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.233389Z"},"links":{"cited_paper":"/paper/2403.10381","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:81149a1c00c318cedcd774b1d37b5bf40db6f87b9d1fe7bcf21193ef53dee07d","observation_id":"07a406c5-166e-43b3-be6d-e6a19395c2e7","resolution":{"observed_at":"2026-08-09T14:52:24.656332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01506","last_updated":"2025-02-18T02:23:45Z","snapshot_observed_at":"2026-08-08T08:00:18.563674Z","submitted_at":"2024-06-03T16:34:01Z","title":"The Geometry of Categorical and Hierarchical Concepts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01506","snapshot_observed_at":"2026-08-09T14:52:24.236880Z","title":"The geometry of categorical and hierarchical concepts in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.236880Z"},"links":{"cited_paper":"/paper/2406.01506","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:b0effe609d93fb93c00c7f57a14787486e19bbb643c76aeaab8f7517629b415c","observation_id":"2b9a855a-6b4b-4a76-a015-8918834e4232","resolution":{"observed_at":"2026-08-09T14:52:24.236880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05110","last_updated":"2024-02-07T18:59:12Z","snapshot_observed_at":"2026-07-06T17:26:59.606509Z","submitted_at":"2024-02-07T18:59:12Z","title":"Opening the AI black box: program synthesis via mechanistic interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05110","snapshot_observed_at":"2026-08-09T14:52:24.240283Z","title":"Opening the ai black box: program synthesis via mechanistic interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.240283Z"},"links":{"cited_paper":"/paper/2402.05110","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:c26ea1167137e489c9743b44c7b1f6b0b1680831ffe33e8a237025d460e763cd","observation_id":"4de17097-1730-48ff-ba7a-b9005720c448","resolution":{"observed_at":"2026-08-09T14:52:24.240283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19750","last_updated":"2025-03-30T23:55:03Z","snapshot_observed_at":"2026-07-06T19:39:51.480716Z","submitted_at":"2024-10-10T17:58:47Z","title":"The Geometry of Concepts: Sparse Autoencoder Feature Structure","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19750","snapshot_observed_at":"2026-08-09T14:52:24.243940Z","title":"The geometry of concepts: Sparse autoencoder feature structure","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.243940Z"},"links":{"cited_paper":"/paper/2410.19750","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:9e0fb68399a95479936e66b04faa190bfa347a0fd6921110c8f80d49a997129f","observation_id":"25b3b621-fc1d-42a2-a252-82566c9b5a5e","resolution":{"observed_at":"2026-08-09T14:52:24.243940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00070","last_updated":"2025-05-02T05:27:38Z","snapshot_observed_at":"2026-08-08T10:10:41.531442Z","submitted_at":"2024-12-29T18:58:09Z","title":"ICLR: In-Context Learning of Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00070","snapshot_observed_at":"2026-08-09T14:52:24.247836Z","title":"Iclr: In-context learning of representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.247836Z"},"links":{"cited_paper":"/paper/2501.00070","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:7dc6c1a615bcf1c946574641ed93b13e54e3b89bb20d75cca83f05edece7a2fd","observation_id":"b53388a2-3ccf-4462-b05b-63196849e882","resolution":{"observed_at":"2026-08-09T14:52:24.247836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.868511Z","title":"Towards understanding grokking: An effective theory of representation learning","venue":null,"work_id":"698d7061-b8fe-4db0-90ca-60ac97d50f30","year":2022},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.251475Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:3edfbdd05824929944403e715b82e48119159b2b9a7ab1326123490ace2de487","observation_id":"f0596d9c-7117-44d0-aabd-2f8668a99bfb","resolution":{"observed_at":"2026-08-09T14:52:24.872293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-09T14:52:24.255125Z","title":"Not all language model features are linear","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.255125Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:cb371fd2c8c00465bf884906b07d8c351ef5cf36c4fef130b0c665583ce54adf","observation_id":"bd548730-d06c-4725-b01c-4da06c7ccaeb","resolution":{"observed_at":"2026-08-09T14:52:24.255125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.857842Z","title":"Enhancing hydrological extremes prediction accuracy: Integrating diverse loss functions in transformer models","venue":null,"work_id":"291c5fb7-6ebf-4539-a060-07526d39e2dd","year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.258782Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:b9cdc82f67cbd330eb7166f7ec6ab0f3d64a2a66ec4047ae41882ec3c2c1cb1d","observation_id":"8975b174-8c9b-47c2-a032-a986e02cb2b7","resolution":{"observed_at":"2026-08-09T14:52:24.861861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.847587Z","title":"Echocardiographic image segmenta- tion with vision transformers: A comparative analysis of different loss functions","venue":null,"work_id":"4d456d61-4858-4ba4-b0b8-1f04f327cb49","year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.262349Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:146e40fb99ccfbfd757a5943bbe91985e0efa77f5fd316d2a71ab076d9a09336","observation_id":"df756787-b901-4e34-b28d-b81c9d32969a","resolution":{"observed_at":"2026-08-09T14:52:24.851232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.836658Z","title":"Gener- alised dice overlap as a deep learning loss function for highly unbalanced segmentations","venue":null,"work_id":"af911468-5330-4220-9960-d032c6af47d4","year":2017},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.265892Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:d0321b68d4e1ffcd298cf29715860d2fc43942e75aba1038cf0aff03162d8a16","observation_id":"e4651027-5d4f-4418-8be0-da4ca17e263e","resolution":{"observed_at":"2026-08-09T14:52:24.840529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.824534Z","title":"Topology-aware focal loss for 3d image segmentation","venue":null,"work_id":"f2a7e17f-325c-42c1-ad06-4e5f56e56f24","year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.269859Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:bcf2c3d3322ad6bc90a5e47d34fd4139417fc3559cb982e752de20ba9444a064","observation_id":"adcc43a8-544c-40d9-8262-02ae7ae3f4d8","resolution":{"observed_at":"2026-08-09T14:52:24.829391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.273581Z","title":"Tversky loss function for image segmentation using 3d fully convolutional deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.273581Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:1fbad06ef78e310b6e5d969bfeefacdaa75583d7611935ca3d29ec39dfc022af","observation_id":"c38495d7-4411-404c-9824-1f9b2efd383e","resolution":{"observed_at":"2026-08-09T14:52:24.273581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.803223Z","title":"Hybrid wind speed forecasting using iceemdan and transformer model with novel loss function","venue":null,"work_id":"09ab9e88-4200-41c2-bfa5-65d3edfdf2df","year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.277646Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:40c2beeeb18dabc46268b282052eef7967629a1b71d2e7cd47384189b5a5af52","observation_id":"93213a57-2a8b-4f5d-9f71-8accc736c23e","resolution":{"observed_at":"2026-08-09T14:52:24.807305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.281383Z","title":"Predicting o-glcnacylation sites in mammalian proteins with transformers and rnns trained with a new loss function","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.281383Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:258fea3b96f7941fd58b61fc59cc18bea2e4ace68ddbc7f7b3d2c0d86fadc493","observation_id":"fef288ef-69fb-4244-a4ea-d2999bdd3ab1","resolution":{"observed_at":"2026-08-09T14:52:24.281383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16929","last_updated":"2025-04-23T17:59:01Z","snapshot_observed_at":"2026-08-07T15:59:47.774507Z","submitted_at":"2025-04-23T17:59:01Z","title":"I-Con: A Unifying Framework for Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16929","snapshot_observed_at":"2026-08-09T14:52:24.285184Z","title":"I-con: A unifying framework for representation learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.285184Z"},"links":{"cited_paper":"/paper/2504.16929","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:134e45932ed8153b5bd9df57b19cbb5ceb118fc00bb580b4f0eac12db4a2f40a","observation_id":"913822dd-9408-4016-852b-5bb9354c221b","resolution":{"observed_at":"2026-08-09T14:52:24.285184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.792185Z","title":"A comprehensive survey of loss functions in machine learning","venue":null,"work_id":"ff7a29cc-3f9c-496d-b46f-cb244a5e1610","year":2022},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.289322Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:b66686831bf517d556243de8d20c65fd490f9598b7d854952e05d8ae76b33027","observation_id":"a04f2b07-6152-4a75-b14c-e52c1a0d58a8","resolution":{"observed_at":"2026-08-09T14:52:24.796127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.781000Z","title":"Contrastive learning models for sentence representations","venue":null,"work_id":"b4eb2c60-d9c7-4902-97d5-17c1c1318407","year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.293029Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:da102cfb446e1b340e37890142dd31c66da9140582cf278aabcd189a5a15a74e","observation_id":"e5c3c3f3-b9fa-47d6-8663-35f5875bf35a","resolution":{"observed_at":"2026-08-09T14:52:24.784963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09564","last_updated":"2018-02-23T22:30:45Z","snapshot_observed_at":"2026-08-02T12:41:42.936552Z","submitted_at":"2017-07-29T22:36:35Z","title":"A PAC-Bayesian Approach to Spectrally-Normalized Margin Bounds for Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09564","snapshot_observed_at":"2026-08-09T14:52:24.296587Z","title":"A pac-bayesian approach to spectrally-normalized margin bounds for neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.296587Z"},"links":{"cited_paper":"/paper/1707.09564","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:443dda4c1cf38173b45822526d19cd7c075b2a4ae93c111eb04ee7e61f8ad737","observation_id":"6e8fb561-82e6-4c68-b26e-9f4f1f776fdf","resolution":{"observed_at":"2026-08-09T14:52:24.296587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-09T14:52:24.300509Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.300509Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:a890a8f527d4a00db81ebcb7304851477da31be15866a9f6ab37842729ab5d13","observation_id":"dbea4976-f0b0-4229-a84f-bc63b8832c69","resolution":{"observed_at":"2026-08-09T14:52:24.300509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.304482Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.304482Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:1d2091e3e9d30d6da95d6614f2b92059912ade07b04a109ff07a2c4e6aef3eaa","observation_id":"e8d7f559-92ca-4b96-aa49-1e2bb29e670f","resolution":{"observed_at":"2026-08-09T14:52:24.304482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.308447Z","title":"Supervised contrastive learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.308447Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:7c6165f76456f858fcc9699f83718969646a8fc4f7abf0710257347663168858","observation_id":"972686be-12cd-484a-bb15-64753c8c0ff5","resolution":{"observed_at":"2026-08-09T14:52:24.308447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12471","last_updated":"2019-10-01T18:41:05Z","snapshot_observed_at":"2026-07-06T06:42:15.167440Z","submitted_at":"2018-05-31T13:52:06Z","title":"Neural Network Acceptability Judgments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.12471","snapshot_observed_at":"2026-08-09T14:52:24.312828Z","title":"Neural network acceptability judgments","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.312828Z"},"links":{"cited_paper":"/paper/1805.12471","citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:0b985720de8ccd982b470b0a3bfb6fc151bef5bac114c83035baee291c1639bd","observation_id":"600f3437-2ef5-41e2-9932-cfbdf4ce259c","resolution":{"observed_at":"2026-08-09T14:52:24.312828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:52:24.758005Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":"d77e9f68-0d36-4ea7-87b2-2f5c271f3fb0","year":2013},"citing_paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T14:52:24.316919Z"},"links":{"citing_paper":"/paper/2502.01628"},"observation_digest":"sha256:e3835f78a87439971f8596ddc23e3c8a5c0aa7e486b615c11df2a6aec77c40b1","observation_id":"9d97207b-9cda-404d-81c0-91e8d275e313","resolution":{"observed_at":"2026-08-09T14:52:24.762016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.01628","last_updated":"2025-07-10T04:29:17Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T22:27:16.789499Z","submitted_at":"2025-02-03T18:57:17Z","title":"Harmonic Loss Trains Interpretable AI Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2502.01628."}