{"as_of":"2026-08-13T14:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c64fe86d6f96ff32ed0eda883857edd6d34da27dd9c6c38dcbabe40eb1c42b52","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:26:53.877030Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09444/citation-record","integrity":"/paper/2608.09444/integrity","json":"/paper/2608.09444/citation-record.json","paper":"/paper/2608.09444"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.789105Z","title":"The case for co-designing model architectures with hardware","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.789105Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:ea233b09d7a58f8c53cbdf21d91df0ba2cd651c270e50dd1ab98cf6a9cf3dd39","observation_id":"07d25cd3-f1e5-4507-8412-848e36fd7d10","resolution":{"observed_at":"2026-08-11T17:26:53.789105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20672","last_updated":"2025-02-28T16:44:24Z","snapshot_observed_at":"2026-08-12T22:14:08.632340Z","submitted_at":"2024-10-28T02:15:45Z","title":"Relaxed Recursive Transformers: Effective Parameter Sharing with Layer-wise LoRA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20672","snapshot_observed_at":"2026-08-11T17:26:53.794727Z","title":"Relaxed recursive transformers: Effective parameter sharing with layer-wise lora, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.794727Z"},"links":{"cited_paper":"/paper/2410.20672","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:45cd382a2763e305ca2c341118b093d19ac6cdb554667f2cc54c644c17e1a1b4","observation_id":"088afc54-22b2-4fff-90dc-7b7c51bc9ccc","resolution":{"observed_at":"2026-08-11T17:26:53.794727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.798373Z","title":"Mixture-of-recursions: Learning dynamic recursive depths for adaptive token-level computation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.798373Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:d71b66fa6139e65abecf85b46ff6da14fb88052a73fdddd9240d7a5c6a7c0424","observation_id":"d2b8e30d-b719-4bef-90af-b6b593ac74b4","resolution":{"observed_at":"2026-08-11T17:26:53.798373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.801140Z","title":"Pondernet: Learning to ponder","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.801140Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:2e4d11e900336271842c2a636bb84c7ecaf23644d1c2ec84b9a6879440fad90b","observation_id":"bff012b2-d1d8-4338-8f49-b6fb8497de2f","resolution":{"observed_at":"2026-08-11T17:26:53.801140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.420729Z","title":"Scaling laws meet model architecture: Toward inference-efficient LLM s","venue":null,"work_id":"0ef778a1-2b9a-45f6-8612-d24bdec080a0","year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.804088Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:9a0267cb81ce06899bba283678db404cbaecbbb72f4b05f1016a647454740395","observation_id":"753741f2-42f6-4fcb-bd56-86db4b8e597f","resolution":{"observed_at":"2026-08-11T17:26:54.423545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10661","last_updated":"2026-05-11T14:43:36Z","snapshot_observed_at":"2026-08-12T14:37:44.567991Z","submitted_at":"2026-05-11T14:43:36Z","title":"bViT: Investigating Single-Block Recurrence in Vision Transformers for Image Recognition","version":1},"cited_work":{"arxiv_id":"2605.10661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10661","snapshot_observed_at":"2026-08-11T17:26:54.276410Z","title":"bViT: Investigating Single-Block Recurrence in Vision Transformers for Image Recognition","venue":"cs.CV","work_id":"18f87887-8cf0-4b68-89ab-f6c7054435b8","year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.806969Z"},"links":{"cited_paper":"/paper/2605.10661","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:eac42d255d2cac40bcfc0c5fdcd37c7d5182ea0fff6b91dccc44dcf6b2a40f30","observation_id":"df33bc29-1644-4ad8-ae69-6dbb772d0563","resolution":{"observed_at":"2026-08-11T17:26:54.279659Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T17:26:53.810250Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.810250Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:aeb3a9056eabb96b502809e7bdadcc8a23834dfa03d98937fbf65c571fdf759c","observation_id":"02c02286-f084-4583-805a-7d37db453be2","resolution":{"observed_at":"2026-08-11T17:26:53.810250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.412814Z","title":"Adaptive loops and memory in transformers: Think harder or know more? In Workshop on Latent & Implicit Thinking Going Beyond CoT Reasoning , 2026","venue":null,"work_id":"b24ec646-f48f-48d8-8ae5-755b812bc468","year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.813239Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:bde4065da958701cda6cd33a9b98d24e0c97c1f2991e5ea3199e4f558711e625","observation_id":"2c420b19-2e83-49f5-80f8-32768cc50ddf","resolution":{"observed_at":"2026-08-11T17:26:54.415921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.08577","last_updated":"2026-04-26T03:36:00Z","snapshot_observed_at":"2026-08-11T04:11:06.503601Z","submitted_at":"2025-11-11T18:57:02Z","title":"Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.08577","snapshot_observed_at":"2026-08-11T17:26:53.815625Z","title":"Think-at-hard: Selective latent iterations to improve reasoning language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.815625Z"},"links":{"cited_paper":"/paper/2511.08577","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:26d748ca176884b8ea521e569e9628fe7f246c2960d76ab0020f892a2f3058b0","observation_id":"ef472a37-498d-428b-8ac5-cb4bde71c066","resolution":{"observed_at":"2026-08-11T17:26:53.815625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.405482Z","title":"Bartoldson, Bhavya Kailkhura, Abhinav Bhatele, and Tom Goldstein","venue":null,"work_id":"979e8618-bc14-480c-bf96-1211b98326fb","year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.818788Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:94c477b31dc2b9c0f0e946ced020254855cae99dc6247632ba48e86f3015bc30","observation_id":"d6853c67-7e6d-4dc3-a47e-feba7b49319c","resolution":{"observed_at":"2026-08-11T17:26:54.408249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.821396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.821396Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:052e0ab0a7b394dca049bd8354dfc628a47017b2f1591c493cd54d2747d83e45","observation_id":"92fafeda-e169-4a4a-b9e8-f36376cb7f6f","resolution":{"observed_at":"2026-08-11T17:26:53.821396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07822","last_updated":"2026-08-11T05:59:57Z","snapshot_observed_at":"2026-08-13T14:26:09.685479Z","submitted_at":"2026-04-09T05:24:32Z","title":"Loop, Think, & Generalize: Implicit Reasoning in Recurrent-Depth Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07822","snapshot_observed_at":"2026-08-11T17:26:53.824303Z","title":"Loop, think, & generalize: Implicit reasoning in recurrent-depth transformers, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.824303Z"},"links":{"cited_paper":"/paper/2604.07822","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:d04dc92519a8e8606d68bf4539eaa85278de6d653bdbca3ca67d765fee3dfdb6","observation_id":"4eaf625f-7734-4716-b8cd-d91535f716f2","resolution":{"observed_at":"2026-08-11T17:26:53.824303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.827094Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.827094Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:9e492540c4055669feb58cddea3a0f88a9450fecbb8458c1f8148636acc28be8","observation_id":"450f3610-3738-4148-b99e-f309e2ccd511","resolution":{"observed_at":"2026-08-11T17:26:53.827094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09165","last_updated":"2026-06-30T06:15:20Z","snapshot_observed_at":"2026-08-11T15:12:03.236118Z","submitted_at":"2026-05-09T20:58:18Z","title":"Sparse Layers are Critical to Scaling Looped Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09165","snapshot_observed_at":"2026-08-11T17:26:53.829565Z","title":"Hu, and Jonathan May","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.829565Z"},"links":{"cited_paper":"/paper/2605.09165","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:20c5e1bfc5c70d9e1db9effaeb400750cd2af38b28e3d79fcc1cc11a9f01983e","observation_id":"5d5002f9-3e51-4bb0-8e9d-c5940efec03f","resolution":{"observed_at":"2026-08-11T17:26:53.829565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.02023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.187402Z","title":"Ponderlm-3: Adaptive token-wise pondering with differentiable masking, 2026","venue":null,"work_id":"a04f1971-4353-4b1d-b89c-628597944668","year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.832304Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:ce9b6a89f419d671ae8a9049167c42d7a9527bc1ee092d9217954a80891990c6","observation_id":"8eae1555-8ed8-4101-a38c-cf743b1ee22e","resolution":{"observed_at":"2026-08-11T17:26:54.192954Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.393238Z","title":"Co TF ormer: A chain of thought driven architecture with budget-adaptive computation cost at inference","venue":null,"work_id":"00a6e6ae-00b0-412d-a153-88f9f97ce11d","year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.834694Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:aac65be9faf6d5a4e711f639a3604c53498921e3b4e807e89e3be83210b53b86","observation_id":"75ff262c-039a-48c8-845d-0da0641bcc9b","resolution":{"observed_at":"2026-08-11T17:26:54.396219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-11T17:26:53.837099Z","title":"Mixture-of-depths: Dynamically allocating compute in transformer-based language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.837099Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:0faefd7d5114db6f53389b30a80446a61fd102aed276c1c2dc46632ce08a50e6","observation_id":"ad71a3a8-e3a2-41fd-8f74-0acaaad2c10f","resolution":{"observed_at":"2026-08-11T17:26:53.837099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21106","last_updated":"2026-05-07T08:18:20Z","snapshot_observed_at":"2026-07-06T23:07:47.244208Z","submitted_at":"2026-04-22T21:51:11Z","title":"How Much Is One Recurrence Worth? Iso-Depth Scaling Laws for Looped Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21106","snapshot_observed_at":"2026-08-11T17:26:53.839937Z","title":"How much is one recurrence worth? iso-depth scaling laws for looped language models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.839937Z"},"links":{"cited_paper":"/paper/2604.21106","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:6b56dacfd7fcb48e8829720cfb3cb6e6bd430411b38758ff9ddd27d5bd33178f","observation_id":"a74457df-b3f4-44f8-9647-9986ca738d81","resolution":{"observed_at":"2026-08-11T17:26:53.839937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.842642Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.842642Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:a926b6c9d1e3187016ee3915102c2b972e037f052307f5a91a1111c8e5e928c9","observation_id":"a960c856-479f-4e8b-a928-f084c9dfbdeb","resolution":{"observed_at":"2026-08-11T17:26:53.842642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.382172Z","title":"ShareGPT , 2023","venue":null,"work_id":"00e7b35e-ec41-418e-802f-3c20f782f9d2","year":2023},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.845224Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:07c77abb85ddbcf8d28f8d56dcf31176cd3d2522769876ab8991f96e666b18ac","observation_id":"45a25439-f503-460a-a12a-aba2e95c9d48","resolution":{"observed_at":"2026-08-11T17:26:54.384847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.848072Z","title":"Loopvit: Scaling visual arc with looped transformers, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.848072Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:5ad6e02dc265500a556e98035847f184d5d1762d4a6f9a957785aadb351e97a6","observation_id":"9dbee458-2f5d-47d6-8dfd-6456401816e7","resolution":{"observed_at":"2026-08-11T17:26:53.848072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.850843Z","title":"Adaponderlm: Gated pondering language models with token-wise adaptive depth, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.850843Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:03e607cd6e7417b858c13f90852e38706d5c477b07dd9e38f25d8fdc23c9d59c","observation_id":"a716a677-3d23-405d-9393-7f77573d4d87","resolution":{"observed_at":"2026-08-11T17:26:53.850843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.20122284","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.896425Z","title":"Michaelov, Chris, Chessing234, Hanwool Albert Lee, Janna, Leonid Sinev, Khalid, Kiersten Stokes, and Zdeněk Kasner","venue":null,"work_id":"d0e9e482-0c63-4497-a02a-52a05ba873f8","year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.853674Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:28db50b499ace0b8399940061bd4ba7035198d40fef85e48df5178252e14aab4","observation_id":"20caf359-8308-4ce8-bce2-b44e9d6b9365","resolution":{"observed_at":"2026-08-11T17:26:53.900773Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.856773Z","title":"Sparse universal transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.856773Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:bf062312104804c32dccb680788dd6285db0ce21b298b6ce7983195e7d737097","observation_id":"74c28abf-0699-4ca1-8df6-c6dd9b9748f8","resolution":{"observed_at":"2026-08-11T17:26:53.856773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.371002Z","title":"Hashimoto","venue":null,"work_id":"4c809b8e-5484-469e-b40b-17dec4c9d24c","year":2023},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.859773Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:464d07ef5e3f506662a60382eb588e69447f2d6e074a1fc5c9d67a2fe8b16b19","observation_id":"0391ffa2-8574-4df9-82e1-02603bc55cc5","resolution":{"observed_at":"2026-08-11T17:26:54.373762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.363399Z","title":"Recurrent-depth VLA : Implicit test-time compute scaling of vision-language-action models via latent iterative reasoning","venue":null,"work_id":"c4f87794-1486-4b2d-9f0c-be0e96ec07c4","year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.862780Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:0abee7849bb25df88d2aedb7323eae4d12c3819a48ddd66f4ddd9d743f0085b9","observation_id":"20baffb5-6d18-4dd5-8451-7f5a8354d8d2","resolution":{"observed_at":"2026-08-11T17:26:54.366259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07721","last_updated":"2026-05-19T08:08:32Z","snapshot_observed_at":"2026-08-02T23:35:32.635346Z","submitted_at":"2026-05-08T13:25:27Z","title":"Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07721","snapshot_observed_at":"2026-08-11T17:26:53.865582Z","title":"Memory-efficient looped transformer: Decoupling compute from memory in looped language models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.865582Z"},"links":{"cited_paper":"/paper/2605.07721","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:31b907544e208971e2cce5e0152d146c61feae3df90961a5834a73c71c3efea4","observation_id":"a69a7bd4-7729-4b38-aba0-b2b9062f0def","resolution":{"observed_at":"2026-08-11T17:26:53.865582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.868554Z","title":"Roofline: an insightful visual performance model for multicore architectures","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.868554Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:e0f842213d0c3b826c44824a91723fc7e03942137128597bd8e64b1732cfe911","observation_id":"31f6872b-67a5-4257-87d8-92778a46b074","resolution":{"observed_at":"2026-08-11T17:26:53.868554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:53.871322Z","title":"Transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.871322Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:86b7c974a1a5a6bacb779956cb0813b60b91bc1cae53b8dc57f09c823e18b1db","observation_id":"86448520-d82a-4a52-b769-286694514a76","resolution":{"observed_at":"2026-08-11T17:26:53.871322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:54.350911Z","title":"Orca: A distributed serving system for Transformer-Based generative models","venue":null,"work_id":"0ecf65e5-6e07-4481-a23b-f6b3f231f6b4","year":2022},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.874188Z"},"links":{"citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:109984bb384bcd57adcae147b50089b9b8d9286cb3e0ec20f8ad0c46517aef65","observation_id":"a57946e7-11f6-4ad6-8262-701b53fa4ca6","resolution":{"observed_at":"2026-08-11T17:26:54.353756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.25741","snapshot_observed_at":"2026-08-11T17:26:53.877030Z","title":"Scaling latent reasoning via looped language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:53.877030Z"},"links":{"cited_paper":"/paper/2510.25741","citing_paper":"/paper/2608.09444"},"observation_digest":"sha256:c6eea1ce7167243360f0078555ae6b2d6136d34b7f88447ee5888fbc55134032","observation_id":"368f2810-e0ac-4aa5-9843-89cae2bbf036","resolution":{"observed_at":"2026-08-11T17:26:53.877030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09444","last_updated":"2026-08-10T11:20:14Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T14:22:37.253617Z","submitted_at":"2026-08-10T11:20:14Z","title":"Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":3,"verified_fuzzy":8},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2608.09444."}