{"as_of":"2026-08-10T09:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:adf39e7d349613521e6eba0fc6efd95e189310e3662b7e0f442cd4aea0770d0b","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:50:54.252154Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:12:02.029189Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:04:00.572602Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-08-06T14:12:02.029189Z","title":"A statistical physics of language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19703","last_updated":"2025-07-30T07:58:56Z","snapshot_observed_at":"2026-08-09T10:53:15.040762Z","submitted_at":"2025-07-25T22:48:37Z","title":"The wall confronting large language models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:12:02.029189Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2507.19703"},"observation_digest":"sha256:dd6931f2c6e04ca8b92c8210ff1e80e3317d234bcbeed3f4c97de5884048e200","observation_id":"cb34fdfe-81bf-4c22-bab9-05611277ea36","resolution":{"observed_at":"2026-08-06T14:12:02.029189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":"2506.04374","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-06-29T22:04:00.572602Z","title":"Carson and A","venue":null,"work_id":"bca7e922-849d-4061-8ce8-e5379f5b67da","year":2025},"citing_paper":{"arxiv_id":"2604.18464","last_updated":"2026-04-20T16:19:02Z","snapshot_observed_at":"2026-07-06T23:05:17.639285Z","submitted_at":"2026-04-20T16:19:02Z","title":"Semantic Step Prediction: Multi-Step Latent Forecasting in LLM Reasoning Trajectories via Step Sampling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T06:06:49.805066Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2604.18464"},"observation_digest":"sha256:6b9d60934728f198836cd378b0c8856d10e2270ab843a6c58d5865f3b526e083","observation_id":"7b4d4f39-60cd-4177-b72d-2d66b6201c3a","resolution":{"observed_at":"2026-05-10T06:11:20.492711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":"2506.04374","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-06-29T22:04:00.572602Z","title":"Carson and A","venue":null,"work_id":"bca7e922-849d-4061-8ce8-e5379f5b67da","year":2025},"citing_paper":{"arxiv_id":"2606.07559","last_updated":"2026-07-18T19:19:00Z","snapshot_observed_at":"2026-08-02T13:16:35.534776Z","submitted_at":"2026-05-25T10:44:42Z","title":"Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T21:54:30.991573Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2606.07559"},"observation_digest":"sha256:4cf9866b2abfb1b4126b6f8e10c88ab629d36f9d5e1c1ea64a4effe5967d3de0","observation_id":"b9161e76-0153-47dc-8365-de53eb1a9ec6","resolution":{"observed_at":"2026-06-29T22:04:00.574224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-08-02T13:16:37.673532Z","title":"A statistical physics of language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07559","last_updated":"2026-07-18T19:19:00Z","snapshot_observed_at":"2026-08-02T13:16:35.534776Z","submitted_at":"2026-05-25T10:44:42Z","title":"Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T13:16:37.673532Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2606.07559"},"observation_digest":"sha256:4b7448e489452cde3f86d837e1ed330377e736aad39e35c5e2399902e8f21813","observation_id":"ce70dd7e-be5a-44a5-bb67-2944beeb60da","resolution":{"observed_at":"2026-08-02T13:16:37.673532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04374/citation-record","integrity":"/paper/2506.04374/integrity","json":"/paper/2506.04374/citation-record.json","paper":"/paper/2506.04374"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.000524Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.000524Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:4d6db2b92c7c9ab0362333d942131c01c86a2b9d182f432ebfcc12dade48abba","observation_id":"41d2fb2e-a6e1-47c7-879a-27322d6ac4f7","resolution":{"observed_at":"2026-08-07T10:50:54.000524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T10:50:54.009552Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.009552Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:d45b9cfb101d152b29413d2e88f9151bb32700797e45e532e991b095d1d392e1","observation_id":"dbe64074-d129-4f06-8c87-3e923c209807","resolution":{"observed_at":"2026-08-07T10:50:54.009552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13673","last_updated":"2025-05-19T11:12:27Z","snapshot_observed_at":"2026-08-08T23:24:12.994765Z","submitted_at":"2023-05-23T04:28:16Z","title":"Physics of Language Models: Part 1, Learning Hierarchical Language Structures","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13673","snapshot_observed_at":"2026-08-07T10:50:54.016634Z","title":"Physics of language models: Part 1, learning hierarchical language structures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.016634Z"},"links":{"cited_paper":"/paper/2305.13673","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:045cd5999e9140fbdc068bb7afe093ccad611c47c15c7db3a54ed7de6b5117ff","observation_id":"3eee5651-e97b-4df9-9dc3-1e8d810da519","resolution":{"observed_at":"2026-08-07T10:50:54.016634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T10:50:54.023714Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.023714Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:077b46d5f33fb7886e1ce6948477a8e6729e8936228100d397b7e7dc8209052d","observation_id":"2ea8cd50-a7b1-4a74-9d8d-3e61e5850a18","resolution":{"observed_at":"2026-08-07T10:50:54.023714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-08-07T10:50:54.031563Z","title":"PIQA : Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.031563Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:7f5f99849caae77d75be64dc7f72de2e477861ac96ea1f76887943741cd408c0","observation_id":"b6756eb6-b362-4847-82ad-8f709e2c0e15","resolution":{"observed_at":"2026-08-07T10:50:54.031563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.977305Z","title":"Language models are few-shot learners","venue":null,"work_id":"e720fa51-d8ea-4b3b-a58c-9d1a8a06caa6","year":1901},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.038393Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:93f2e70f1694aa8d87265a126bc6044f20bca2125b8654bd989bf9fb3bbceb85","observation_id":"ad646ed8-29dd-4694-bdc8-2b765aea35de","resolution":{"observed_at":"2026-08-07T10:50:54.984027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.044654Z","title":"Computational principles of memory","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.044654Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:ad6655116aff8a0f3e5d4f7de04d76c71ceed0f19380598142cd632d74af5bb0","observation_id":"f4bf926a-8808-4193-8f73-7bbd6a6fc776","resolution":{"observed_at":"2026-08-07T10:50:54.044654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.051673Z","title":"B ool Q : Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.051673Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:bcde74be7e52cfbef5d1a3b0a3c4ed5b134083fc5f24a516a97ae75021c4a14e","observation_id":"1fc5574d-f462-473c-9935-eb88fdd96ec4","resolution":{"observed_at":"2026-08-07T10:50:54.051673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:50:54.057619Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.057619Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:264998a7ab370971d992aa60a488159f261a601d1b24cf7cddbf664374b2e43a","observation_id":"ff18284e-300e-4ed2-b8da-ace4802c8d9d","resolution":{"observed_at":"2026-08-07T10:50:54.057619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.063449Z","title":"The rotation of eigenvectors by a perturbation","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.063449Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:4264f078d7e2188a653a08db60a02dd17bc93d4b588e562a069719765e1bf17a","observation_id":"96ac5b62-cdcd-4d0d-9dc7-5bd4b3805782","resolution":{"observed_at":"2026-08-07T10:50:54.063449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-07T10:50:54.069960Z","title":"DeepSeek LLM : Scaling open-source language models with longtermism","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.069960Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:5bf0f24a2715f600aff27717c852b0fd147b5ba427275297c7a0f6a0319250a9","observation_id":"99a03c65-33d5-40c6-b0a5-1b47a6b462a6","resolution":{"observed_at":"2026-08-07T10:50:54.069960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.077006Z","title":"Maximum likelihood from incomplete data via the EM algorithm","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.077006Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:5857c66b84aa570b0835f518fc6d6d2a91fc1dba9ae77d5f08e9a7cf8832f230","observation_id":"4614e809-2fc7-4f57-9929-ed222df58631","resolution":{"observed_at":"2026-08-07T10:50:54.077006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.959943Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":"77d16908-7bd2-42f1-a2c9-f3cebeec4bef","year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.083055Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:920aea3115b9e5bf24dc2791fa1bec19e964888e25914df523359beb16aadbf0","observation_id":"04b2d0e7-d5bf-41b6-b030-6cf49d4b4fb2","resolution":{"observed_at":"2026-08-07T10:50:54.965521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T10:50:54.088711Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.088711Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:b2bf9ad83fef4baa375c21110eea1ac7aa9f83b0f2907dc2faf487f974b83dd3","observation_id":"f7fccd80-3790-4d98-a2e6-28f5475d3fbd","resolution":{"observed_at":"2026-08-07T10:50:54.088711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.094716Z","title":"Did A ristotle use a laptop? A question answering benchmark with implicit reasoning strategies","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.094716Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:0494917195e79468d9d16a95784d43469c19c2fc395ac772fe281ea2882ee9e3","observation_id":"19544e3c-a527-442d-b994-300555438ce1","resolution":{"observed_at":"2026-08-07T10:50:54.094716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.101932Z","title":"Variational learning for switching state-space models","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.101932Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:244981ad71a29c83fe6f4d7593dbe7d3bbb9fdcd4a1f694925236fbfa76118e0","observation_id":"b22568c9-1c05-41ad-a723-c0ffe29a9410","resolution":{"observed_at":"2026-08-07T10:50:54.101932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.108154Z","title":"Note on the derivatives with respect to a parameter of the solutions of a system of differential equations","venue":null,"work_id":null,"year":1919},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.108154Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:f1f61b4d74ec9b92b2a100013b97f50737e1e21d65bb1949d4831413997d56e7","observation_id":"04fc1318-2b4e-4d18-8b0b-f20c5d3eae5f","resolution":{"observed_at":"2026-08-07T10:50:54.108154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.942295Z","title":"A new approach to the economic analysis of nonstationary time series and the business cycle","venue":null,"work_id":"ea39f761-172d-43fd-b842-7c86484774a3","year":1989},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.114907Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:835a75d4df8653327a99208592e2b34f2a3c78cb7eb0831de613adc706bca757","observation_id":"7212d7cc-02fd-4f8d-9d61-3872ea39d8ac","resolution":{"observed_at":"2026-08-07T10:50:54.948243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.121006Z","title":"Ridge regression: Biased estimation for nonorthogonal problems","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.121006Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:0dcaf5dad1f53ccef2ea0833e087135d58d0b48b2691a18ab09b48b2cdece022","observation_id":"a7de34f1-32ec-4c75-9626-8efefaf3d0ad","resolution":{"observed_at":"2026-08-07T10:50:54.121006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T10:50:54.127341Z","title":"Mistral 7b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.127341Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:4c5aec29a9c14fd337c542cfeedcace4a271323523c9dd117e7de6cb1aebef28","observation_id":"b338ff0e-75f0-4b85-9d1b-08fca85f5d44","resolution":{"observed_at":"2026-08-07T10:50:54.127341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.135171Z","title":"Principal Component Analysis","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.135171Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:6a85ba717364cec2b9042ba7e2033fc853c4cd879e8094e70dda3ad5a9f1c418","observation_id":"14ac315b-453d-4a76-8b91-c4a84c4ee2e5","resolution":{"observed_at":"2026-08-07T10:50:54.135171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.920518Z","title":"Emergent world representations: Exploring a sequence model trained on a synthetic task","venue":null,"work_id":"8dba7fb6-4d04-4c8f-bc44-2c812cc943e1","year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.141571Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:e8890ded77f691faafb3c195cf90e477b07113f39f54dad945afaf3f69b72bf9","observation_id":"fc54f6e5-1019-44ea-b2ea-9aa2c362cc3a","resolution":{"observed_at":"2026-08-07T10:50:54.927809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.149002Z","title":"T ruthful QA : Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.149002Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:5242b5d88d6c89ade01c1d98885ab9ce5fe9df30ddd235872e08110185359e7f","observation_id":"3f659613-6d9f-4e04-9584-453567f223d9","resolution":{"observed_at":"2026-08-07T10:50:54.149002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08001","last_updated":"2024-04-08T07:37:31Z","snapshot_observed_at":"2026-07-06T17:59:00.124173Z","submitted_at":"2024-04-08T07:37:31Z","title":"Xiwu: A Basis Flexible and Learnable LLM for High Energy Physics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08001","snapshot_observed_at":"2026-08-07T10:50:54.156219Z","title":"Linguistic interpretability of transformer-based language models: A systematic review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.156219Z"},"links":{"cited_paper":"/paper/2404.08001","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:ff222b663401039043697c659927763af7310d9c1b746e379d16bf7dadfb6cb2","observation_id":"1b578b2d-d39f-4fb5-ba82-190995151895","resolution":{"observed_at":"2026-08-07T10:50:54.156219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.162855Z","title":"Can a suit of armor conduct electricity? A new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.162855Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:14f0da0305ed28368e54e8fc5bd258a75e379e72680416351464c2362d5f2fa8","observation_id":"abd62857-16bd-4bd2-911e-993031b6e5e2","resolution":{"observed_at":"2026-08-07T10:50:54.162855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00941","last_updated":"2023-09-07T20:36:48Z","snapshot_observed_at":"2026-07-06T16:13:34.788427Z","submitted_at":"2023-09-02T13:37:34Z","title":"Emergent Linear Representations in World Models of Self-Supervised Sequence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00941","snapshot_observed_at":"2026-08-07T10:50:54.169589Z","title":"Emergent linear representations in world models of self-supervised sequence models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.169589Z"},"links":{"cited_paper":"/paper/2309.00941","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:4ef59f0c527fc257aabfff1087f93249db61fb70d39dcb14f333c54e1eadef33","observation_id":"740cb4f6-0837-459f-8fa0-a3c2cf3d6896","resolution":{"observed_at":"2026-08-07T10:50:54.169589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.901441Z","title":"Stochastic Differential Equations: An Introduction with Applications","venue":null,"work_id":"dc354c4e-2803-4fe1-b1cd-d882c01a824a","year":2003},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.176571Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:652cf9efa70776fa1870ed1fb914e25a91d5f6a4956c4ae84db3d7dfe2c93046","observation_id":"5b077623-4249-4d22-9fd8-f8387d348f3c","resolution":{"observed_at":"2026-08-07T10:50:54.908578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-07T10:50:54.183246Z","title":"In-context learning and induction heads","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.183246Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:ab9714c96974da93c9b9a0db9ced9489273e745631c047224ef9f00404d2432f","observation_id":"5cac4c0d-fe73-44bc-8099-7dd1b1c0f1b8","resolution":{"observed_at":"2026-08-07T10:50:54.183246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.883551Z","title":"A tutorial on hidden markov models and selected applications in speech recognition","venue":null,"work_id":"88cf6136-95a3-472c-a1df-77ba6b4392ce","year":1989},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.187908Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:2d0b6d4e7611a5e9ce88a6566a6ad6596b088f9897d92dbef71e9c0247895057","observation_id":"3c35130a-41a2-4f2c-afb0-bad9a21ccc75","resolution":{"observed_at":"2026-08-07T10:50:54.889631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.865764Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"b7e05c2b-f56b-49f6-857b-775e8ed0773c","year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.193352Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:b57a41e791a65e49dc22bceefa0513b5eae83a33492001a194092951442ddd03","observation_id":"1f9716f9-a6f7-4903-a6e3-b0e9d80c21c1","resolution":{"observed_at":"2026-08-07T10:50:54.870858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-61530-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.320707Z","title":"The Fokker-Planck Equation: Methods of Solution and Applications , volume 18 of Springer Series in Synergetics","venue":null,"work_id":"dd815be9-5d5b-4333-964a-8bae76cd60d6","year":1989},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.200463Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:7054c02a8b3ceab959ae44e70d920f1d3562fcd88667963a344fa2061b8eb80c","observation_id":"e37ca0ce-c5d3-49ae-ad1c-cbe891143ffe","resolution":{"observed_at":"2026-08-07T10:50:54.329744Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.205766Z","title":"Optimal sequence memory in driven random networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.205766Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:8b90512e049629de8caefdd66b924ee704bcd616405b1023f27a8f12eee8e411","observation_id":"2ae1510a-b18e-40e3-9cf6-6c77df26fb9b","resolution":{"observed_at":"2026-08-07T10:50:54.205766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.211795Z","title":"C ommonsense QA : A question answering challenge targeting commonsense knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.211795Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:af267cd70a187f2235676d944a0752eee4c50b1bfd4635929baeb5fb9a3867da","observation_id":"4f59e42b-5357-403a-9a9e-04b38a02f705","resolution":{"observed_at":"2026-08-07T10:50:54.211795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05320","last_updated":"2022-01-14T06:49:15Z","snapshot_observed_at":"2026-07-06T12:27:19.431793Z","submitted_at":"2022-01-14T06:49:15Z","title":"CommonsenseQA 2.0: Exposing the Limits of AI through Gamification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.05320","snapshot_observed_at":"2026-08-07T10:50:54.218307Z","title":"C ommonsense QA 2.0: Exposing the limits of AI through gamification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.218307Z"},"links":{"cited_paper":"/paper/2201.05320","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:5ad1c5f26420741364e0f473e69759e1964a70606c2cdf45904e5ec6c1ac0d6a","observation_id":"91ee295a-9d23-4090-bf35-bc0cc37b6b13","resolution":{"observed_at":"2026-08-07T10:50:54.218307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T10:50:54.224781Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.224781Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:96acac01a1fa66f62d4cd86cb1b4bf00d2ff7014a28aae5a1c6aaf7e234cace0","observation_id":"d3181f48-78d3-4fe9-8eb7-8f20c45eff53","resolution":{"observed_at":"2026-08-07T10:50:54.224781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.843899Z","title":"Attention is all you need","venue":null,"work_id":"7290c4a6-0359-4b2d-8bea-8730d7a8b69d","year":2017},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.233299Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:34c0e2c65f2aadfbbae36996046e34a639213f2cea60f6aabe00e1ebce88ba66","observation_id":"1988d3ee-b90c-4584-bb52-87a7f01ac4ce","resolution":{"observed_at":"2026-08-07T10:50:54.851812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10001","last_updated":"2023-06-01T05:38:00Z","snapshot_observed_at":"2026-08-07T18:44:16.941060Z","submitted_at":"2022-12-20T05:20:54Z","title":"Towards Understanding Chain-of-Thought Prompting: An Empirical Study of What Matters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10001","snapshot_observed_at":"2026-08-07T10:50:54.238608Z","title":"Towards understanding chain-of-thought prompting: An empirical study of what matters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.238608Z"},"links":{"cited_paper":"/paper/2212.10001","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:bdff8194293c0ff4b88a53a0bbd405bcd1848fe54a178bbcbe7e253d2c6d5259","observation_id":"b820f736-39c1-48c9-8252-0031a060102b","resolution":{"observed_at":"2026-08-07T10:50:54.238608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T10:50:54.245026Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.245026Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:f05815aa82cc28803a819d1f0632bf2d53d065b3da0b3ff57c4d5a3542d412fb","observation_id":"e5f1a811-8ce9-4c62-837a-99b20aba19c8","resolution":{"observed_at":"2026-08-07T10:50:54.245026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.252154Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.252154Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:757efd4424d8f8c11dbd92aad103fb47ff94035aa226b0e6f931df2eb8f8fde3","observation_id":"654f070f-9d6c-426c-a158-56f2cfc17430","resolution":{"observed_at":"2026-08-07T10:50:54.252154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T23:25:32.370031Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 4 inbound Pith citation observations for arXiv:2506.04374."}