{"as_of":"2026-08-10T16:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0416e6ccb7baee76c2171304d207723b31a545c26b9d381e0992625339eb043c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:21:38.144629Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T00:33:52.628412Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":"2310.08540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2310.08540 [cs]","venue":null,"work_id":"f6369a53-a1ba-413a-b752-bc46e5d75120","year":2023},"citing_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T12:58:27.430374Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2301.00234"},"observation_digest":"sha256:ab1d0343f44fde7f5fc1c50d258b631dc5bfa573d730663e2ef269f29c8936b1","observation_id":"a8d7fcd6-955c-4bce-8e16-aca8cdf94b8b","resolution":{"observed_at":"2026-05-12T12:58:27.549625Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-08-07T14:21:38.144629Z","title":"Do pretrained transformers really learn in-context by gradient descent? arXiv preprint arXiv:2310.08540, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19426","last_updated":"2025-06-05T08:20:31Z","snapshot_observed_at":"2026-08-09T15:38:55.027294Z","submitted_at":"2025-05-26T02:37:26Z","title":"The Role of Diversity in In-Context Learning for Large Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:21:38.144629Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2505.19426"},"observation_digest":"sha256:e3b269a7de816a1238d2d53bd224a6b489a74a0e989f421385f7fc893563ec3d","observation_id":"2109c450-790a-4dc0-b879-1194a1b2b11a","resolution":{"observed_at":"2026-08-07T14:21:38.144629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":"2310.08540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2310.08540 [cs]","venue":null,"work_id":"f6369a53-a1ba-413a-b752-bc46e5d75120","year":2023},"citing_paper":{"arxiv_id":"2506.04289","last_updated":"2026-05-11T09:35:19Z","snapshot_observed_at":"2026-08-02T06:08:01.726521Z","submitted_at":"2025-06-04T10:15:05Z","title":"Relational reasoning and inductive bias in transformers and large language models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T11:31:37.942517Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2506.04289"},"observation_digest":"sha256:3df915123a04facb8918cb3d6106c7715cb331900377fca182cac290e123b7a8","observation_id":"40fd2e3a-7623-47cf-bc56-a9e2ef42d7db","resolution":{"observed_at":"2026-05-19T11:32:17.057473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-08-07T10:33:41.646967Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05200","last_updated":"2025-08-28T16:07:16Z","snapshot_observed_at":"2026-08-09T04:21:50.390154Z","submitted_at":"2025-06-05T16:12:51Z","title":"Transformers Meet In-Context Learning: A Universal Approximation Theory","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:33:41.646967Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2506.05200"},"observation_digest":"sha256:ae2eabc771cc49e3ddf38e68e569bf62513899985cb7203d071cd0559b5f0d1f","observation_id":"43f50103-e083-430a-b5da-18b7258417fa","resolution":{"observed_at":"2026-08-07T10:33:41.646967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-08-06T18:03:14.967182Z","title":"Do pretrained transformers really learn in-context by gradient descent? arXiv preprint arXiv:2310.08540, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09440","last_updated":"2025-07-13T01:09:26Z","snapshot_observed_at":"2026-08-10T11:50:08.740691Z","submitted_at":"2025-07-13T01:09:26Z","title":"Transformers Don't In-Context Learn Least Squares Regression","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:03:14.967182Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2507.09440"},"observation_digest":"sha256:a03c56a6aeb82fc2931545bb2fa44f72f5f27050800f8736da83ed6a3c88c7d8","observation_id":"4637800a-69f2-4bdf-a36b-dcc194d23490","resolution":{"observed_at":"2026-08-06T18:03:14.967182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":"2310.08540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2310.08540 [cs]","venue":null,"work_id":"f6369a53-a1ba-413a-b752-bc46e5d75120","year":2023},"citing_paper":{"arxiv_id":"2604.23267","last_updated":"2026-05-18T09:56:09Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T12:19:25Z","title":"Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-08T08:06:25.436395Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2604.23267"},"observation_digest":"sha256:3d6ffedcc991dfc1f4d95ee87813e074d7fb7d27cc4a437c283d3132377e17f2","observation_id":"29504811-0214-4f2c-b03a-4db3e8496101","resolution":{"observed_at":"2026-05-11T20:46:12.470216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":"2310.08540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2310.08540 [cs]","venue":null,"work_id":"f6369a53-a1ba-413a-b752-bc46e5d75120","year":2023},"citing_paper":{"arxiv_id":"2604.23267","last_updated":"2026-05-18T09:56:09Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T12:19:25Z","title":"Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-21T00:33:22.181383Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2604.23267"},"observation_digest":"sha256:ffad15f590cfc3dae9822d5210fe69d23e3b58a29993b11981e246b68e195b4e","observation_id":"fe6d1080-e341-46aa-9d55-944692354211","resolution":{"observed_at":"2026-05-21T00:33:52.630143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?","version":5},"cited_work":{"arxiv_id":"2310.08540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2310.08540 [cs]","venue":null,"work_id":"f6369a53-a1ba-413a-b752-bc46e5d75120","year":2023},"citing_paper":{"arxiv_id":"2605.08277","last_updated":"2026-05-08T06:33:42Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T06:33:42Z","title":"Mitigating Many-shot Jailbreak Attacks with One Single Demonstration","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T00:50:19.648405Z"},"links":{"cited_paper":"/paper/2310.08540","citing_paper":"/paper/2605.08277"},"observation_digest":"sha256:6129bc31518d41d0bd37e7748864ef9ceca5cc21a5145e590f6bac3b470f795c","observation_id":"a4a73ce1-3014-44c2-855b-484563b2c91a","resolution":{"observed_at":"2026-05-12T00:51:15.042381Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2310.08540/citation-record","integrity":"/paper/2310.08540/integrity","json":"/paper/2310.08540/citation-record.json","paper":"/paper/2310.08540"},"outbound":[],"paper":{"arxiv_id":"2310.08540","last_updated":"2024-06-03T04:18:11Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T11:49:53.800203Z","submitted_at":"2023-10-12T17:32:09Z","title":"Do pretrained Transformers Learn In-Context by Gradient Descent?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2310.08540."}