{"as_of":"2026-08-19T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad5a081fb13e6aed68450fdd55d3c9ea7fd974705d3a965852de26065e6bdb9b","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:55:02.868112Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:11:13.013810Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01172","snapshot_observed_at":"2026-08-01T07:11:13.013810Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21574","last_updated":"2026-07-23T17:54:37Z","snapshot_observed_at":"2026-08-19T01:24:54.661356Z","submitted_at":"2026-07-23T17:54:37Z","title":"Surprisal Theory is Tautological (without Rational Grounding)","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T07:11:13.013810Z"},"links":{"cited_paper":"/paper/2506.01172","citing_paper":"/paper/2607.21574"},"observation_digest":"sha256:991414242c9232fa2c4cfa3b4b12d7af2011117b76ab288b681047e7f775c5ab","observation_id":"ce8d93ba-0f2c-4015-aa42-8ba1f7ae2749","resolution":{"observed_at":"2026-08-01T07:11:13.013810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01172/citation-record","integrity":"/paper/2506.01172/integrity","json":"/paper/2506.01172/citation-record.json","paper":"/paper/2506.01172"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.274682Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.274682Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:a4c8e3f6306594520c3a7f4922bb61496c4a84f8c27f48e762445f4f24054a05","observation_id":"968836bf-c362-4e51-ab2f-54847270c8f7","resolution":{"observed_at":"2026-08-07T11:55:02.274682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.287670Z","title":"Barr, Roger Levy, Christoph Scheepers, and Harry J","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.287670Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:d84a6a0ca3b2e22594c860259b13291511fda02d987cd1f032a4e7f71e35ae3a","observation_id":"4a608228-279e-403c-85b4-e7735fca4c2b","resolution":{"observed_at":"2026-08-07T11:55:02.287670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.297374Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.297374Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c7a24dbbc8dff235fc6cf6103e5b43c03fc98fdbee574a93393143d3b9c4f798","observation_id":"322f75a1-db47-4d81-b126-d74558d161a1","resolution":{"observed_at":"2026-08-07T11:55:02.297374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.183986Z","title":null,"venue":null,"work_id":"77436eb8-33b0-4711-b760-f2c94e649076","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.305585Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:8864104bd2ca87d8d25aca207c8a2edfad19acf904406e4349ae1a277176a714","observation_id":"8961308c-955d-4911-8450-1d0a878498c7","resolution":{"observed_at":"2026-08-07T11:55:04.197844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.133014Z","title":null,"venue":null,"work_id":"14c6f119-4121-4409-a5cf-7ab5b99fee32","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.315707Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:9bb40af80d3f40ee83f697ef1ae23492e6b67edf13347a7327cc3d3346e64d12","observation_id":"ed0310fc-4810-4cbc-9ef8-dab004b19357","resolution":{"observed_at":"2026-08-07T11:55:04.160285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.073288Z","title":null,"venue":null,"work_id":"c9f82c07-5c84-4087-8583-f721b299e475","year":1920},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.326697Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:2d8ecc3bfd48a857b74926f2609e9bba67cb1c1740ef3e88e339108bb48fbd3e","observation_id":"f9dacca9-13d9-4554-911d-5e99a634378d","resolution":{"observed_at":"2026-08-07T11:55:04.101736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.336053Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.336053Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:5545d4555ed350d4143bf860297e4960add18adb0e552f525de944d16e11eb97","observation_id":"6e6e8820-882b-41b5-b9e1-1fe151355ad7","resolution":{"observed_at":"2026-08-07T11:55:02.336053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/3-540-63246-8_12","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Lecture notes in computer science","work_id":"c5a2ce58-4e1f-4ba6-b9b9-5b1e5f63b115","year":1997},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.343867Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:9f9a000c7353dcac6cfe492186edd346fae61a17072a11c47d633df07a57e944","observation_id":"3227d12e-f00d-41ce-a229-2ffb194b7429","resolution":{"observed_at":"2026-08-07T11:55:03.147209Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10579-020-09503-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":"Tily, Idan Blank, Anastasia Vishnevetsky, Steven Piantadosi, and Evelina Fedorenko","venue":"Language Resources and Evaluation","work_id":"0867b020-4b81-4f04-ad70-5a0856c9a9a4","year":2021},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.356088Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:d19f5ca8878aff47803fc66fcd6d40a7e991537db72f85b8b760d93233c579ce","observation_id":"3505a9ac-42bd-44ba-8acd-b9ca2eeb84bc","resolution":{"observed_at":"2026-08-07T11:55:03.099726Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T11:55:02.367531Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.367531Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:3c2b78fb1dac8cb9bbafdb18a2e3ce356628c6625e25075313bd82159ee958ef","observation_id":"1e5e4d80-b5de-41f2-973d-d490289c8314","resolution":{"observed_at":"2026-08-07T11:55:02.367531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.377183Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.377183Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:6d37a954bd687ce346794791b0462c31e0a7aab1c70282c3794230d1920a1b83","observation_id":"c726c632-025e-414a-8cfe-fd0bb63733fa","resolution":{"observed_at":"2026-08-07T11:55:02.377183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.018567Z","title":null,"venue":null,"work_id":"aa94337c-875f-464c-9d6f-748103b84447","year":2001},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.383270Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:26a2601b07bae352e62bddbed7566acfa27a67cb6971001a41325a360b5ec14e","observation_id":"1929da3b-b191-49fb-b060-d422f645e911","resolution":{"observed_at":"2026-08-07T11:55:04.032764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.393438Z","title":"Clark, and Philipp Koehn","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.393438Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:0e1f835c4c891b350747906fd936bb0f454b5385f4a5fe3336b95ef12b43d3de","observation_id":"8fdfd97f-bd09-47cd-a07a-90dfacb8ab09","resolution":{"observed_at":"2026-08-07T11:55:02.393438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.dam.2004.04.012","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Discrete Applied Mathematics","work_id":"69e7369a-e629-4708-8f28-9766778c4a01","year":2005},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.401218Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:40e15b477b1386c8a12c28425a1de61655e13a89239183f5490aa2551ce61ec9","observation_id":"76cca9b1-0b43-4f19-99a3-058f7cdc3503","resolution":{"observed_at":"2026-08-07T11:55:03.056423Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.969872Z","title":null,"venue":null,"work_id":"c3fa0e29-fe2f-4556-bade-7a9a41f9d80a","year":2003},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.410683Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:2df6db303c69c41dca217ac386bf6c50980f485f45b3b6458ba2b7093c58e1f9","observation_id":"80a6ca9e-51ba-4879-9daa-09aa0d847516","resolution":{"observed_at":"2026-08-07T11:55:03.987777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T11:55:02.418060Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.418060Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:4f2c13559a08f883cc59a8d904ec0145787374de730f8e3fa26bbee1c8ce7d35","observation_id":"ce83a66d-0184-4b4a-88ff-9a9e9332a444","resolution":{"observed_at":"2026-08-07T11:55:02.418060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.935328Z","title":"Nelson Francis","venue":null,"work_id":"de9ce601-3bb1-474c-91cf-a3152b809015","year":1967},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.425842Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:824919a1669363fe7706d80d35c0cb1803df0af23e38e16224f572e2aac19f09","observation_id":"3a47aee8-bf28-4074-90bd-7cb42bd34dca","resolution":{"observed_at":"2026-08-07T11:55:03.946803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.437476Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.437476Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c79b919766e963ceb0acde52bc08f3256d8c059279979bc80841ea7aa6e306a9","observation_id":"94f026fb-1cb3-445c-9959-057d70a1fb5b","resolution":{"observed_at":"2026-08-07T11:55:02.437476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.447433Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.447433Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:eb75624d6d440477fee04d0cfaa070f6ef87312fc0594dfaf6bdd81a7d3a2bd4","observation_id":"af938671-5e66-4822-8891-d5690497b19f","resolution":{"observed_at":"2026-08-07T11:55:02.447433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.891616Z","title":null,"venue":null,"work_id":"a867d0ed-1b95-4f94-af37-a9d431fe32ee","year":2019},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.456187Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:67e769967508ba8a6e94f83423e5ee1e015123207588c1a73debc2ff6a942741","observation_id":"4ae90f9f-ec8e-48e0-95c1-9846f207b7b3","resolution":{"observed_at":"2026-08-07T11:55:03.911311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.465284Z","title":"Luke and Kiel Christianson","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.465284Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c15c04a4b780d2c72dbd3446b8b023efd71f94a87eea6f120e9c421569ee695e","observation_id":"af205181-e91d-4cf0-a51c-44a1f490afbd","resolution":{"observed_at":"2026-08-07T11:55:02.465284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.475089Z","title":"Ivanova, Idan A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.475089Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:4bb3b281188a758f04ad68817bb23e93e096f7349fa089f35839dfd7ac5bad09","observation_id":"6a1b9dce-8508-4a13-ab99-df90f855a1de","resolution":{"observed_at":"2026-08-07T11:55:02.475089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.838956Z","title":"Smith, and Yanai Elazar","venue":null,"work_id":"77adcede-46a8-40d2-ba56-1b06b0c31d3a","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.484089Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:31621bea09c1a1eff4b804c36e97909bda9e0e2da1347a2bd95e3008cad8365a","observation_id":"4435cce4-cb65-47af-827b-f080b6d4427e","resolution":{"observed_at":"2026-08-07T11:55:03.864254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.801467Z","title":null,"venue":null,"work_id":"2eda52e6-3f0d-4e43-8cd4-678a180ae4d5","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.492949Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c6bca0d85044eb175d650be3e00f13818fb967049bb352ca66f2cb7bd37cd1ea","observation_id":"a36dfa31-d1b0-4b85-a226-beb8500f30d0","resolution":{"observed_at":"2026-08-07T11:55:03.817177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.511467Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.511467Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:e9ff944fd4983ba8861f2e2763278507174d33498df2a38ea9a383cf7f7f1815","observation_id":"fa17703d-d16d-4db8-973f-6302d51836bb","resolution":{"observed_at":"2026-08-07T11:55:02.511467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.748562Z","title":null,"venue":null,"work_id":"bdfbfdab-907b-4eb0-87d9-3997c9207d36","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.535293Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:71ddd51daf6979ce6c470edf7c2422278b4e7afd736d6de50e159ebc65f0ea74","observation_id":"570dcbc7-8979-4ba7-9e22-50666a0aee2a","resolution":{"observed_at":"2026-08-07T11:55:03.769254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.701948Z","title":null,"venue":null,"work_id":"f1763144-4c73-464b-bc8f-c2aa6f857886","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.562720Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:1408cbf229fe5d40508d005a25855ba417ac1c7ee7ac27f1a7b2ba1b2e535e31","observation_id":"4de5c190-9390-4c92-bfaa-425312e22038","resolution":{"observed_at":"2026-08-07T11:55:03.713943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.664474Z","title":null,"venue":null,"work_id":"152e6c0a-96da-446a-ad76-a1f607b25d2e","year":2009},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.591765Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:ba32b17ced192acd3167d8bad58c7ad64993b37207ba7c685e496180f9305099","observation_id":"186435b9-7f44-42fc-88b0-73df377aeecd","resolution":{"observed_at":"2026-08-07T11:55:03.678360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.617095Z","title":null,"venue":null,"work_id":"192883c9-eff5-47f7-aeae-e8b7e084c8cc","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.616633Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:f2e2233e0d7344de0ba21e501a4223ec832eea3ecda0e74dd527d1bbf8f4edec","observation_id":"b5f5269a-4ab4-498e-8005-b4032b0c40e5","resolution":{"observed_at":"2026-08-07T11:55:03.638789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.566754Z","title":null,"venue":null,"work_id":"5f445ed3-7939-4f8e-b5a1-d4caf0063141","year":2019},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.646682Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:9dd17ba20a70077c4ba725d2fd6a7f71f12377ee0b49ccee8268337f920611f3","observation_id":"465f72df-27ec-4896-9a3d-74951c6ca7e9","resolution":{"observed_at":"2026-08-07T11:55:03.597886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3701.34337","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.386783Z","title":null,"venue":null,"work_id":"dc581e5a-e8ed-45f5-98dd-5f2dc9119f7e","year":2020},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.676043Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:6ac8dfe1c835f552106da825b00ccbacc9c4014721d2fdcf3a6f2b3d329080c1","observation_id":"061869f0-7229-4059-ac6b-538f58f0d7e9","resolution":{"observed_at":"2026-08-07T11:55:03.405889Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0022-5371(83)90236-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Journal of Verbal Learning and Verbal Behavior","work_id":"da615758-1992-4b93-96d2-af465f69a32a","year":1983},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.706877Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c28ff1f475049497b73dcb767faa2ede910e71b10f88986e997bb60161a04c3e","observation_id":"c5a5dc01-43d8-4066-8a54-4f9ee4c6c6f4","resolution":{"observed_at":"2026-08-07T11:55:02.964269Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.724722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.724722Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:37a0562561e90c31c78664f7551e59fae99e5f31b82fbefce1f1f48012e7a19d","observation_id":"e42ba496-38f7-485f-9cc8-a0fe870453b9","resolution":{"observed_at":"2026-08-07T11:55:02.724722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.750156Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.750156Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:f5af34df1bc56119bf608c50d57bd411be20f010cb96ed3defc5ab78846eb4bd","observation_id":"dceb68eb-b08e-4396-a63b-d8300eaea3b2","resolution":{"observed_at":"2026-08-07T11:55:02.750156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.773448Z","title":"Smith and Roger Levy","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.773448Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:7715396bdbbe2e565143952baad8ece052e8e4e24c80a6b588edbbf3d208d56c","observation_id":"ec6b1419-c981-4965-a73f-d1ace31849f8","resolution":{"observed_at":"2026-08-07T11:55:02.773448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.507752Z","title":null,"venue":null,"work_id":"06f2436b-d448-4491-8a7e-3a5e1839af2d","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.800446Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:6e40a15dcbe0f371bf3681f0b66481a4c9cbfc40e6a0f4197b7a8d60de41a06f","observation_id":"509b4c55-397e-416b-ab25-54bb28dcddf2","resolution":{"observed_at":"2026-08-07T11:55:03.536854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.836447Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.836447Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:00010f4df37453cce9fbef33cbf46a95b82d1a84ac5c618799a73f1ab6f0f7f0","observation_id":"4074eca7-f6a8-4e62-80f5-d74700ae1095","resolution":{"observed_at":"2026-08-07T11:55:02.836447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.458714Z","title":null,"venue":null,"work_id":"a97e6510-3733-47be-8ea0-d82d5d435203","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.868112Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:b6f319d029a9f63751ab044b485ab32e158c82d387602db02e239136553a7720","observation_id":"3d548478-e8ea-4f74-8f36-9b647b57f697","resolution":{"observed_at":"2026-08-07T11:55:03.478059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":31,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2506.01172."}