{"as_of":"2026-08-13T02:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0cdc2ad50d7f36c46deae39be68c70a544e11d941e8ccd2c818fd036ba726105","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:10:44.211578Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.10024/citation-record","integrity":"/paper/2508.10024/integrity","json":"/paper/2508.10024/citation-record.json","paper":"/paper/2508.10024"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.036760Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.036760Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:f1ad75c0b2983fb2db5d1573e586fc8b7271f88659beae8b0d13e22c29a38a61","observation_id":"344915d5-90d4-4c97-8f7a-ad7eab5c64f3","resolution":{"observed_at":"2026-08-05T23:10:44.036760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.042158Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.042158Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:90fede6555b6214dde00b9d2ae286a1c1e2eb1f2ad293b73210a4eb89174896f","observation_id":"4cdd9f5e-3667-41de-ac49-73db37f39acb","resolution":{"observed_at":"2026-08-05T23:10:44.042158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07279","last_updated":"2025-03-25T03:36:21Z","snapshot_observed_at":"2026-08-12T22:29:58.318557Z","submitted_at":"2024-11-11T18:59:45Z","title":"The Surprising Effectiveness of Test-Time Training for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07279","snapshot_observed_at":"2026-08-05T23:10:44.047194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.047194Z"},"links":{"cited_paper":"/paper/2411.07279","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:422603b8bd8aa915bc6f321dc412b89acf664bb3c0783bc7ecf0e5b6261795c4","observation_id":"74ec1a39-c551-448f-9705-6d172b09a4a8","resolution":{"observed_at":"2026-08-05T23:10:44.047194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.054069Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.054069Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:4493f661fc2584a550d20a305cab42808b3a271aedb31c2abba76b24e7492501","observation_id":"41961f94-23e3-470f-a6cb-897cab5012ae","resolution":{"observed_at":"2026-08-05T23:10:44.054069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.697369Z","title":null,"venue":null,"work_id":"faac6f62-9a54-43d5-8aa7-4df3f8dc4239","year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.058918Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:170bf1531432a986b34d0192f27ed082cf02baf2a57962d5a6df257716f8e6f6","observation_id":"1c427908-7322-4bc7-9079-b23901ea2543","resolution":{"observed_at":"2026-08-05T23:10:44.702736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-05T23:10:44.063482Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.063482Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:09710e761ef80f171aaea16e3028ebf733c69328cd99c3ad9d72cfd5d01da36c","observation_id":"374bac5d-5ab6-4735-8b88-ff6ea3cd00fc","resolution":{"observed_at":"2026-08-05T23:10:44.063482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.681413Z","title":null,"venue":null,"work_id":"a8ba07dd-3453-48a3-ad97-bd66d8c742a2","year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.069444Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:7afa62e86f901b0d6eeee7349e3511fe56f4c814e9f74a2047adcaa75130eb00","observation_id":"aa87b629-3953-4ff6-befa-cc90fce7a1ae","resolution":{"observed_at":"2026-08-05T23:10:44.686235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.665864Z","title":null,"venue":null,"work_id":"44857e59-2e39-40f4-85af-387e4e434f8e","year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.074648Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:92772e3c992e7a49bd80059d93a8cef21cce99a01cc6a85cd44b8b3dc3d735b9","observation_id":"45d252b9-f008-4dd5-ac00-345b71793eaa","resolution":{"observed_at":"2026-08-05T23:10:44.670784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.079840Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.079840Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:eb20cf158dd92a86ffcfa54a9c2a4f37837f1804a83deb79ca62de38a5272a29","observation_id":"adacce55-2791-4850-adc4-f7fa011f5d3b","resolution":{"observed_at":"2026-08-05T23:10:44.079840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-05T23:10:44.084481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.084481Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:5b534800461208cfc75a8efa9d8cdcb48ed2d0ceccc08ed375f6a96b784cf311","observation_id":"7a79853e-abc5-46b8-bfb9-80275f57846f","resolution":{"observed_at":"2026-08-05T23:10:44.084481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T23:10:44.089466Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.089466Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:926031b29e3b6d5d97eb03b06ae932729f9ee66c887a67dada32bc2bb713bc7f","observation_id":"561413b3-a232-4fcc-8d27-9377081c05bf","resolution":{"observed_at":"2026-08-05T23:10:44.089466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-05T23:10:44.095242Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.095242Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:799389a1028d19285e8bc09e150b647c7cedab964a2613ae77a8a02aa297a3de","observation_id":"280230d6-64d4-4751-9c2f-a99e0b6d1ba4","resolution":{"observed_at":"2026-08-05T23:10:44.095242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08281","last_updated":"2025-10-23T09:36:08Z","snapshot_observed_at":"2026-07-31T05:45:37.385210Z","submitted_at":"2024-01-16T11:12:36Z","title":"The Faiss library","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08281","snapshot_observed_at":"2026-08-05T23:10:44.100337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.100337Z"},"links":{"cited_paper":"/paper/2401.08281","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:07084cf1bca59d8d77c7792d2dde94d1022414605725da34a5a0d783cbd8b5b6","observation_id":"61fe6d85-3a04-4131-a6e0-2d35eeb5bcd6","resolution":{"observed_at":"2026-08-05T23:10:44.100337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T23:10:44.105714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.105714Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:0ec9416e1368e621a8415f3584c15c17797cb1a17b2ac596048f600fd13fa638","observation_id":"6c4af2d0-33d0-4aac-927e-b92620a18ed5","resolution":{"observed_at":"2026-08-05T23:10:44.105714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.110303Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.110303Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:a2ca111b216c1780a1d16f1787eda170873e94205ae6bb17f7b31492273cbf10","observation_id":"8394fbf0-3247-44ac-93ea-b66b57dbb175","resolution":{"observed_at":"2026-08-05T23:10:44.110303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-05T23:10:44.115189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.115189Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:9e828e298e5156a38dfbdb2687bd9b0a34e4123f3cf7ddb870deba671e3a18f8","observation_id":"6a9ef5d0-148c-4d73-9895-b9929bc6699b","resolution":{"observed_at":"2026-08-05T23:10:44.115189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.639595Z","title":null,"venue":null,"work_id":"f2385d23-a385-4e78-a802-0f5cf7fac3c0","year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.120278Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:6fa5a3f4c7af5cc336149fa9718695797d57315e062356f30b857ac67240481b","observation_id":"4b608b2f-4f65-4640-b2be-8747f7418d1f","resolution":{"observed_at":"2026-08-05T23:10:44.644380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.125039Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.125039Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:40916a3a082bacfd982903d8bf9f5b8a6b07e1bf7fca9bee4f1c84ea548c277f","observation_id":"b7a5bd36-2d30-4d68-8f12-4576f91a23b6","resolution":{"observed_at":"2026-08-05T23:10:44.125039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08020","last_updated":"2025-02-08T19:39:09Z","snapshot_observed_at":"2026-08-12T22:26:14.086766Z","submitted_at":"2024-10-10T15:17:49Z","title":"Efficiently Learning at Test-Time: Active Fine-Tuning of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08020","snapshot_observed_at":"2026-08-05T23:10:44.130565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.130565Z"},"links":{"cited_paper":"/paper/2410.08020","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:c68bbcfc5ed7962a52bddb30d9a2bd478e20244b653522513fcf1511a56a6d6b","observation_id":"2319e5b2-34e9-4b20-8b26-d2555df7a2b4","resolution":{"observed_at":"2026-08-05T23:10:44.130565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.613028Z","title":null,"venue":null,"work_id":"5aa782d3-1a5d-473f-b4d7-bf01b5c2d66d","year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.135827Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:b02fa7d234d8ce8ae64c8e1f498ab909f6336cb6df3fd123d5d68d16c6c6192d","observation_id":"01aab481-8d5b-478d-b45e-50ebd2aeac57","resolution":{"observed_at":"2026-08-05T23:10:44.617905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T23:10:44.140230Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.140230Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:c9d7cfff6930758100030afa83bdfba34b83097d82fe5a9d9a67fc44277a1f2e","observation_id":"3ff0f3fd-709f-49a3-8e53-246a7ef8605a","resolution":{"observed_at":"2026-08-05T23:10:44.140230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-13T01:26:47.642290Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-05T23:10:44.144923Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.144923Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:30cb3d489c1aadb58c41bad61f59ef49ce834faa1fe65c9b93532e46abcc8d81","observation_id":"0338bae2-1de3-4c39-bd0a-00e7cd4d9793","resolution":{"observed_at":"2026-08-05T23:10:44.144923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.597131Z","title":null,"venue":null,"work_id":"7651eb0f-f565-4004-b1cd-4836e33cc8d2","year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.149734Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:538a75dd343a8b4bd4559580b571634629f335d0d9fcb61ae8a7c8e97328b99d","observation_id":"449724e7-a8c7-41b9-8bfe-25836214166f","resolution":{"observed_at":"2026-08-05T23:10:44.602090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.155763Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.155763Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:cbb139f6ed47a1ae3fca7eb350ee9233c4312f54e12bd27f32a1fd2d3f82cf7e","observation_id":"4669651b-1eec-430c-b9b6-03056f028a4f","resolution":{"observed_at":"2026-08-05T23:10:44.155763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19255","last_updated":"2024-07-02T03:46:03Z","snapshot_observed_at":"2026-08-12T01:24:56.729161Z","submitted_at":"2024-02-29T15:26:14Z","title":"GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19255","snapshot_observed_at":"2026-08-05T23:10:44.161130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.161130Z"},"links":{"cited_paper":"/paper/2402.19255","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:3fd9eb1977244749b14b28178f419844f3fa0010ea8d5a0a5834e5cea2c0c123","observation_id":"c26b4548-2955-4d1d-8e15-10a847931c94","resolution":{"observed_at":"2026-08-05T23:10:44.161130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01352","last_updated":"2026-03-02T20:56:17Z","snapshot_observed_at":"2026-08-04T07:18:25.941807Z","submitted_at":"2025-07-02T04:40:29Z","title":"Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01352","snapshot_observed_at":"2026-08-05T23:10:44.165790Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.165790Z"},"links":{"cited_paper":"/paper/2507.01352","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:fc6185c8dc24948e0227541d9a19ae2ba0066aa9d8d12e8bc92da01a1d5e7e17","observation_id":"3e5259e9-b824-4001-b121-ee36b189f5f2","resolution":{"observed_at":"2026-08-05T23:10:44.165790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-12T22:19:40.954210Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-05T23:10:44.171212Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.171212Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:dd84aaffd62e36cd9e264d5fff52efe3917a2e44dbed3dba1d1059e863d974d5","observation_id":"60d69caf-a079-4794-bd96-2a2dbf4cf237","resolution":{"observed_at":"2026-08-05T23:10:44.171212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.176132Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.176132Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:33fb8ee30d079e7315c3653197c8e97ea102f115b8bc03aa880567ff50d4bf73","observation_id":"2d153143-de86-4792-a0fe-fab93046c785","resolution":{"observed_at":"2026-08-05T23:10:44.176132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.181686Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.181686Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:8d961c93e7b33c7521b95209a300ceb00702675488c18d5d585a645a1291e984","observation_id":"fde28215-8457-4e8c-8fda-5c783ae2ae42","resolution":{"observed_at":"2026-08-05T23:10:44.181686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.550073Z","title":null,"venue":null,"work_id":"8b8b6cf4-5d95-48ed-ac64-fa9b05ec45bc","year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.187184Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:700630e44695286179fbfd245751dc3389e90a6f6b0540fdbbaadbbcb5447d1f","observation_id":"17d7362f-12b2-48f1-992b-a8404646988d","resolution":{"observed_at":"2026-08-05T23:10:44.556132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.191639Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.191639Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:149667a33f404404d8468eff1bf7c31f594f2e7cd0857ecef36b8f8108d1ccf5","observation_id":"b669ef56-685c-448f-a90a-6563c533875a","resolution":{"observed_at":"2026-08-05T23:10:44.191639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T23:10:44.196011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.196011Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:10633cd3bd997c93808164cd7c0f18e89d8b2717eeb1996e0d921e980723fd87","observation_id":"bee500b3-d4f3-4958-b69a-c003a8ab1055","resolution":{"observed_at":"2026-08-05T23:10:44.196011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-05T23:10:44.201614Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.201614Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:41e214a2ea555b33d087ea4fd6fd2908894dd29e766c8877077cd68eda274d77","observation_id":"2c62a03b-ada0-4784-9116-5c54e452a17d","resolution":{"observed_at":"2026-08-05T23:10:44.201614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-09T13:23:52.437582Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-05T23:10:44.206752Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.206752Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:a64a65dbf883396932f69f6d65a8db085ee602e252a5e2057b6392ac16921d52","observation_id":"f0daeea1-79bf-40f1-ac95-85ea06d2e06f","resolution":{"observed_at":"2026-08-05T23:10:44.206752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01933","last_updated":"2023-10-09T15:38:46Z","snapshot_observed_at":"2026-08-09T04:45:14.956800Z","submitted_at":"2023-04-04T16:31:37Z","title":"LLM-Adapters: An Adapter Family for Parameter-Efficient Fine-Tuning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01933","snapshot_observed_at":"2026-08-05T23:10:44.211578Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.211578Z"},"links":{"cited_paper":"/paper/2304.01933","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:f8220d4fcb276801657f5fa1de3c3bbde5ad0237f3c7f5329c7100c8ef5594d8","observation_id":"5d2400ab-5de5-4e47-ac6f-7ac799c3523a","resolution":{"observed_at":"2026-08-05T23:10:44.211578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T15:32:28.577900Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2508.10024."}