{"as_of":"2026-08-09T11:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:364d95a02d2aaac1bc57852b5791f0e418502bc99209cac707d6fca51462324d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:14:47.520785Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-07T05:14:47.520785Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.520785Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:13eb5b73623c9515c1be4ca4ae246784b22f0ce5b3b3f08aa7d89ca6e56d73e8","observation_id":"ac5546ec-9df7-4b56-ab61-5bdf12648fba","resolution":{"observed_at":"2026-08-07T05:14:47.520785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-06T20:31:47.992493Z","title":"Looped transformers are better at learning learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02754","last_updated":"2025-07-03T16:16:34Z","snapshot_observed_at":"2026-08-06T20:19:29.715939Z","submitted_at":"2025-07-03T16:16:34Z","title":"Fast and Simplex: 2-Simplicial Attention in Triton","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:31:47.992493Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2507.02754"},"observation_digest":"sha256:5aa63e5f3911d2c21563c8cce621f2d79c51ccf5be2afd97d58c383f9818fc94","observation_id":"7baf9805-b726-47c2-987a-4119f5be4ac3","resolution":{"observed_at":"2026-08-06T20:31:47.992493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-06T18:33:20.499325Z","title":"Looped transformers are better at learning learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07996","last_updated":"2025-07-10T17:59:53Z","snapshot_observed_at":"2026-08-06T18:25:28.097317Z","submitted_at":"2025-07-10T17:59:53Z","title":"Skip a Layer or Loop it? Test-Time Depth Adaptation of Pretrained LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:20.499325Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2507.07996"},"observation_digest":"sha256:bf2ab533d432222bef45b92d3cf782e588dc474c5f16f2fe7916515c6f6c343e","observation_id":"d55f31ec-99ae-4bfe-8207-672fe36795e3","resolution":{"observed_at":"2026-08-06T18:33:20.499325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2508.16745","last_updated":"2026-05-07T14:29:44Z","snapshot_observed_at":"2026-08-02T06:49:37.602255Z","submitted_at":"2025-08-22T18:57:08Z","title":"Beyond Memorization: Extending Reasoning Depth with Recurrence, Memory and Test-Time Compute Scaling","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-18T20:49:26.966293Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2508.16745"},"observation_digest":"sha256:df85455ba393f60e293890dbfe3cecd989a83752314e75aa5f9a9c6a58efae98","observation_id":"b9b74d5d-665c-43f4-9b29-319a00aed38e","resolution":{"observed_at":"2026-05-18T20:51:50.783909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2510.12773","last_updated":"2026-05-18T21:02:06Z","snapshot_observed_at":"2026-08-03T04:39:11.410726Z","submitted_at":"2025-10-14T17:51:26Z","title":"Dr.LLM: Dynamic Layer Routing in LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T20:01:48.806709Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2510.12773"},"observation_digest":"sha256:cf2738c9d708a95620d3faf08cbb3aca81d32233c7ec3d3c4649e7f1183ae904","observation_id":"b3344619-5ac2-4f1c-902f-6e11c86e0e45","resolution":{"observed_at":"2026-05-21T20:04:20.322992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T07:43:11.620446Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:741c2437d4ae61f0eacf6c97345ff60d239189f305b26f962fc48cfaae9b5147","observation_id":"db66b97e-dea3-4dbc-9e00-e7702aea514c","resolution":{"observed_at":"2026-05-15T07:43:11.911968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-04T07:31:11.348348Z","title":"Looped transformers are better at learning learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T07:31:11.348348Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:7f359d7d6d353713b53bb7c2ba63ef3f82ffd55b1bfb97853257948b10c93499","observation_id":"d1a238ee-4dfc-455e-8966-3ed5eb746f64","resolution":{"observed_at":"2026-08-04T07:31:11.348348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-03T21:06:30.161963Z","title":"Looped transformers are better at learning learning al- gorithms.arXiv preprint arXiv:2311.12424,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16886","last_updated":"2026-05-30T04:11:13Z","snapshot_observed_at":"2026-08-09T04:09:44.376695Z","submitted_at":"2025-11-21T01:54:23Z","title":"Latent Reasoning in TRMs is Secretly a Policy Improvement Operator","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T21:06:30.161963Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2511.16886"},"observation_digest":"sha256:3f08e292d20ce206d2bb49746a41a6deafd75ca9fc2051fc3975e3508306c54c","observation_id":"f05a28e1-9b46-4a09-90ea-5f15886d9229","resolution":{"observed_at":"2026-08-03T21:06:30.161963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-07-15T12:09:16.468055Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.09221","last_updated":"2026-05-29T05:28:18Z","snapshot_observed_at":"2026-07-15T12:09:13.856257Z","submitted_at":"2026-03-10T05:42:13Z","title":"Beyond Test-Time Memory: State-Space Optimal Control for LLM Reasoning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-15T12:09:16.468055Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2603.09221"},"observation_digest":"sha256:2f28c0e2ab2a783bd000c340ca30b72213bfa7d7ebbe930f6c5e904ecd897ab8","observation_id":"52f26761-85b8-4931-b7c4-f7990128c0c8","resolution":{"observed_at":"2026-07-15T12:09:16.468055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:22.543462Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:f03ca5d51a7c592b84c21e9e94eaca6a7cfbd2c3d25b49c778b3f3428019cf2c","observation_id":"1a52b37d-f2a8-42a4-90c4-04421df42e89","resolution":{"observed_at":"2026-05-11T07:06:00.069258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-02T16:35:03.415864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T16:35:03.415864Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:fe4a701596e2d8effaeacb72936814d2d723311b6d5ccc299c9a89e825c7b8f2","observation_id":"c381031a-4e2b-4f29-9acd-b300de2f44c9","resolution":{"observed_at":"2026-08-02T16:35:03.415864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.11791","last_updated":"2026-04-13T17:55:36Z","snapshot_observed_at":"2026-08-02T14:25:36.633868Z","submitted_at":"2026-04-13T17:55:36Z","title":"A Mechanistic Analysis of Looped Reasoning Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:19.680424Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.11791"},"observation_digest":"sha256:59a649e9a908dac37605248aacd19f450baea190ef224cfef9d73bad0acf5297","observation_id":"31921472-32b9-46a1-bc72-4cf406615250","resolution":{"observed_at":"2026-05-11T09:41:02.876059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.12946","last_updated":"2026-04-14T16:43:37Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T16:43:37Z","title":"Parcae: Scaling Laws For Stable Looped Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-10T15:33:04.442462Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.12946"},"observation_digest":"sha256:b0bbec271c954f29413915efc10c6a4de26290e7517bb7fbb0db99d1571fcdbb","observation_id":"43603986-8bb0-43de-92a8-5773eda409a9","resolution":{"observed_at":"2026-05-11T10:21:01.161581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.15259","last_updated":"2026-04-22T15:48:32Z","snapshot_observed_at":"2026-07-06T23:02:49.302337Z","submitted_at":"2026-04-16T17:35:49Z","title":"Stability and Generalization in Looped Transformers","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T12:21:16.015362Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.15259"},"observation_digest":"sha256:ffe55d62be68f3095f8128316da897e9fbe4d26c4a787310e34561f7ee48fc6b","observation_id":"b6054488-d2eb-4ff5-a763-8ef5437f399a","resolution":{"observed_at":"2026-05-10T12:25:22.705878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.18839","last_updated":"2026-04-20T21:06:12Z","snapshot_observed_at":"2026-07-06T23:05:35.374092Z","submitted_at":"2026-04-20T21:06:12Z","title":"One Step Forward and K Steps Back: Better Reasoning with Denoising Recursion Models","version":1},"reference_index":213,"source":"arxiv_source","source_observed_at":"2026-05-10T04:56:35.796962Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.18839"},"observation_digest":"sha256:84039d13fe3b19a1ea0229d3318b3b55262fe220ddab6267bc14177c537b8c72","observation_id":"73035e9e-ba65-4284-ba4c-c9b39f1056e4","resolution":{"observed_at":"2026-05-10T11:05:09.039941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.21254","last_updated":"2026-07-02T01:19:03Z","snapshot_observed_at":"2026-08-06T10:48:44.855597Z","submitted_at":"2026-04-23T03:46:14Z","title":"Hyperloop Transformers","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T23:09:35.640412Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.21254"},"observation_digest":"sha256:9a9c914a07541a101174fa9f5a18f328ca45885c446dab69a716ffd51ed44bae","observation_id":"569ef911-975d-46cf-85e5-a1d0c5f74f1f","resolution":{"observed_at":"2026-05-11T14:16:04.406242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.07588","last_updated":"2026-05-08T11:02:11Z","snapshot_observed_at":"2026-08-08T22:51:07.276144Z","submitted_at":"2026-05-08T11:02:11Z","title":"Revisiting Transformer Layer Parameterization Through Causal Energy Minimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T02:17:32.226166Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.07588"},"observation_digest":"sha256:0977c4732db27a66fc7c4780ea62812532856584de9659fc1598ddaf6caec3a3","observation_id":"fe12ed9a-f66f-4efa-9fa8-c276beb8bebe","resolution":{"observed_at":"2026-05-11T03:45:59.117926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.07721","last_updated":"2026-05-19T08:08:32Z","snapshot_observed_at":"2026-08-02T23:35:32.635346Z","submitted_at":"2026-05-08T13:25:27Z","title":"Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T02:44:36.697450Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.07721"},"observation_digest":"sha256:8bd0f3c3cdaef75d9540be3ac6731515c00dfe672a7c9e6543cb97eef9c6a7c9","observation_id":"e8ddfa5d-10cd-4553-b6d3-1c76b514440d","resolution":{"observed_at":"2026-05-11T02:45:57.716481Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.07721","last_updated":"2026-05-19T08:08:32Z","snapshot_observed_at":"2026-08-02T23:35:32.635346Z","submitted_at":"2026-05-08T13:25:27Z","title":"Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T23:01:17.957634Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.07721"},"observation_digest":"sha256:1b5710f8caad57c5af0cfd4d71b6052ec623dae0e91ff621ef9d34f32ca23a94","observation_id":"1c218afb-52a6-4e0b-986e-27ab182ee108","resolution":{"observed_at":"2026-05-20T23:03:50.651160Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.18797","last_updated":"2026-05-25T04:21:17Z","snapshot_observed_at":"2026-08-02T05:53:57.809613Z","submitted_at":"2026-05-11T07:21:53Z","title":"Simply Stabilizing the Loop via Fully Looped Transformer","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T23:19:28.027625Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.18797"},"observation_digest":"sha256:daa74749e3b0bf578fe82d716b33588a64eabaf4b13324ee70ee711e37d5132e","observation_id":"3551defe-cbb4-421c-814c-4e3073f3fa90","resolution":{"observed_at":"2026-05-20T23:23:51.684336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.19376","last_updated":"2026-05-20T08:03:28Z","snapshot_observed_at":"2026-08-02T08:01:51.109959Z","submitted_at":"2026-05-19T05:20:56Z","title":"Generative Recursive Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T05:58:23.543870Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.19376"},"observation_digest":"sha256:f2f446ccb6ccb1a2e1cb67f5973e645efb2ff71528085ab5c9500141c4cf441a","observation_id":"3b1fd5bd-2445-47b0-839f-b2140b0b7226","resolution":{"observed_at":"2026-05-20T06:03:05.463229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.19376","last_updated":"2026-05-20T08:03:28Z","snapshot_observed_at":"2026-08-02T08:01:51.109959Z","submitted_at":"2026-05-19T05:20:56Z","title":"Generative Recursive Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T07:40:30.199868Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.19376"},"observation_digest":"sha256:de6b7e35c09e072edd2b863b3c48d529fbfd660e32c4d4a32651fbb54be9062a","observation_id":"8a8dd166-6c65-4af3-9702-5e4eae77798f","resolution":{"observed_at":"2026-05-21T07:44:03.156867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.26106","last_updated":"2026-05-25T17:58:24Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:58:24Z","title":"Looped Diffusion Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T23:13:12.343355Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.26106"},"observation_digest":"sha256:36c74c6d3105166099d02bcda38f0f953efee442d2932dad562564baf0a6b128","observation_id":"a6e68ede-ad75-41ad-b49f-088426e09b66","resolution":{"observed_at":"2026-06-29T23:14:01.184995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.26733","last_updated":"2026-05-26T09:11:12Z","snapshot_observed_at":"2026-08-06T20:28:00.477691Z","submitted_at":"2026-05-26T09:11:12Z","title":"Stabilizing Recurrent Dynamics for Test-Time Scalable Latent Reasoning in Looped Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T20:04:32.090919Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.26733"},"observation_digest":"sha256:6f47393e65caf044105db2dcb7b89d238178243c0f5a502ad009542248010284","observation_id":"9957a063-9204-423c-9b06-2d22fc0f5c8e","resolution":{"observed_at":"2026-07-01T16:55:50.838803Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.06574","last_updated":"2026-06-04T17:59:58Z","snapshot_observed_at":"2026-07-06T23:46:24.981618Z","submitted_at":"2026-06-04T17:59:58Z","title":"Skip a Layer or Loop It? Learning Program-of-Layers in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T01:56:34.435152Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.06574"},"observation_digest":"sha256:313508bbb515fe1ed99c09f9420c294ce92b6ea81e6a04c6931ed4169bfdbffa","observation_id":"fd9c3b51-829e-4261-ab83-584983581290","resolution":{"observed_at":"2026-07-02T12:36:57.360001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.06624","last_updated":"2026-06-08T15:12:03Z","snapshot_observed_at":"2026-08-02T09:46:22.331867Z","submitted_at":"2026-06-04T18:21:03Z","title":"Principles and Practice of Deep Representation Learning: or a Mathematical Theory of Memory","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-06-28T03:07:52.730713Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.06624"},"observation_digest":"sha256:cb61c15b13ca17071689e083e20f72b7f3766f85f77484d049d72f6682dcb7b6","observation_id":"1084b777-ea73-4ac9-9046-56a4404a6605","resolution":{"observed_at":"2026-07-02T11:46:55.246863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.18022","last_updated":"2026-06-16T15:02:49Z","snapshot_observed_at":"2026-08-02T11:08:23.417300Z","submitted_at":"2026-06-16T15:02:49Z","title":"Recursive Scaling in Masked Diffusion Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-27T01:44:05.022187Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.18022"},"observation_digest":"sha256:c6c704ea0d2ac0a17d579dea179bd00000fe4ea87e10276374c42c349d3f25e9","observation_id":"43d26cc0-a137-4cff-9282-77c60f3b052c","resolution":{"observed_at":"2026-07-03T19:58:54.919466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.18208","last_updated":"2026-06-16T17:37:27Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:37:27Z","title":"Looped World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T01:49:57.105358Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.18208"},"observation_digest":"sha256:f6523fe9243b693894034c3ceca976bbaef624359a4b738b7f0d57fc83d4890c","observation_id":"eee62f3c-a5a5-4ef0-92c9-68408c9250b9","resolution":{"observed_at":"2026-07-03T19:28:52.391390Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.18208","last_updated":"2026-06-16T17:37:27Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:37:27Z","title":"Looped World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T01:49:57.105358Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.18208"},"observation_digest":"sha256:cfa5b229b5cbd4a8c24c487642855d528ca2981fbc4cc09d228f0183598eb214","observation_id":"b15ff817-c0ff-4df8-8d55-fe8c76a7a16c","resolution":{"observed_at":"2026-06-27T01:50:21.199353Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.29983","last_updated":"2026-06-29T08:58:09Z","snapshot_observed_at":"2026-08-03T21:27:41.768539Z","submitted_at":"2026-06-29T08:58:09Z","title":"Stabilizing Extrapolation in Looped Transformers via Learned Stochastic Stopping","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T07:29:23.786653Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.29983"},"observation_digest":"sha256:1335a3de85601d4b60730b1fc7f3ab6e2f8974b6d0e02f34568dd0e1b314956f","observation_id":"9a756ddc-2c12-40c6-abf3-478c746104a7","resolution":{"observed_at":"2026-06-30T07:34:20.928414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-02T08:13:30.565694Z","title":"Eric Zelikman, Georges Harik, Yijia Shao, Varuna Jayasiri, Nick Haber, and Noah D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20519","last_updated":"2026-07-08T02:54:03Z","snapshot_observed_at":"2026-08-06T23:41:10.107122Z","submitted_at":"2026-07-08T02:54:03Z","title":"Adaptive Depth in Looped Transformers: Diagnosing Learned Halting Gates and Trajectory Readouts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T08:13:30.565694Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2607.20519"},"observation_digest":"sha256:84169b3e20032debe8e60d34c0276a4111364aafc4559a45c73bd357d02c44ad","observation_id":"ee72711e-bd43-474d-b726-73b7fc11920f","resolution":{"observed_at":"2026-08-02T08:13:30.565694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-01T10:14:11.657461Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20594","last_updated":"2026-07-22T16:04:31Z","snapshot_observed_at":"2026-08-07T01:30:36.940347Z","submitted_at":"2026-07-22T16:04:31Z","title":"When Does Recurrence Become an Algorithm? Convergence Selection in Weight-Tied Looped Transformers","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T10:14:11.657461Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2607.20594"},"observation_digest":"sha256:a0be9151acc9595ff4097f679fd67d791639a4bc39072327b9ac8b7458c5dfe5","observation_id":"41107749-7689-400b-b356-323262ca2c0b","resolution":{"observed_at":"2026-08-01T10:14:11.657461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2311.12424/citation-record","integrity":"/paper/2311.12424/integrity","json":"/paper/2311.12424/citation-record.json","paper":"/paper/2311.12424"},"outbound":[],"paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2311.12424."}