{"as_of":"2026-08-19T19:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba6bbd6197157f93ff82bb5697fd0d19f25d0cc91a2a6b65cc3d886d090e581f","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:23:45.610470Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:44:35.167445Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:08:21.920833Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-08-07T15:44:35.167445Z","title":"O mer Faruk Akg \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13988","last_updated":"2025-05-20T06:36:45Z","snapshot_observed_at":"2026-08-18T17:17:03.017013Z","submitted_at":"2025-05-20T06:36:45Z","title":"The Hallucination Tax of Reinforcement Finetuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:35.167445Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2505.13988"},"observation_digest":"sha256:f38e03f3195a392def215983c95bca96f3eae28c9853fd788c8d681028dc9956","observation_id":"9e7e68fb-7fad-46bd-a097-8001bb4f84c5","resolution":{"observed_at":"2026-08-07T15:44:35.167445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-08-07T14:44:29.928994Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17716","last_updated":"2025-05-23T10:33:14Z","snapshot_observed_at":"2026-08-16T17:10:52.194207Z","submitted_at":"2025-05-23T10:33:14Z","title":"Get Experience from Practice: LLM Agents with Record & Replay","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:29.928994Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2505.17716"},"observation_digest":"sha256:efce87cf2a2e32d445b5a23bd7ad554edbe1af30fd2bb47a4768d9b086ecf47f","observation_id":"26c69b02-4de2-4ea3-a0f2-f3937dc3a5f9","resolution":{"observed_at":"2026-08-07T14:44:29.928994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-08-07T14:46:00.411568Z","title":"O mer Faruk Akg \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17794","last_updated":"2025-05-23T12:11:40Z","snapshot_observed_at":"2026-08-17T10:54:27.040749Z","submitted_at":"2025-05-23T12:11:40Z","title":"RECIPE-TKG: From Sparse History to Structured Reasoning for LLM-based Temporal Knowledge Graph Completion","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:46:00.411568Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2505.17794"},"observation_digest":"sha256:0935c53558476209812c3fc0f301f563b98a4730a129d993f4eb6be161292e55","observation_id":"60dacb50-4306-4873-9a21-8dd28b6d64cd","resolution":{"observed_at":"2026-08-07T14:46:00.411568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-08-07T04:45:42.738769Z","title":"Shangshang Wang, Julian Asilis, Ömer Faruk Akgül, Enes Burak Bilgin, Ollie Liu, and Willie Neiswanger","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09967","last_updated":"2025-06-13T18:01:49Z","snapshot_observed_at":"2026-08-17T02:15:57.666681Z","submitted_at":"2025-06-11T17:44:01Z","title":"Resa: Transparent Reasoning Models via SAEs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:45:42.738769Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2506.09967"},"observation_digest":"sha256:04115f2e7e1f0adc1719749252b1bf8f055a8d444a788606fed8c1e8ef6f14cc","observation_id":"c81686f5-7c51-41d6-8b98-efe0d11c8567","resolution":{"observed_at":"2026-08-07T04:45:42.738769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-08-07T00:28:43.564233Z","title":"Tina: Tiny reasoning models via lora, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14530","last_updated":"2025-06-17T13:55:13Z","snapshot_observed_at":"2026-08-19T14:52:05.284583Z","submitted_at":"2025-06-17T13:55:13Z","title":"Sharp Generalization Bounds for Foundation Models with Asymmetric Randomized Low-Rank Adapters","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:43.564233Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2506.14530"},"observation_digest":"sha256:1c916567715251b115d3a7ec80b3cb5f3266355fb49b3db0e96870211ced1193","observation_id":"69f5e61a-5f4d-4ef7-a578-3c7f63f99790","resolution":{"observed_at":"2026-08-07T00:28:43.564233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Tina: Tiny reasoning models via lora","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-14T22:25:11.633208Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:dadcf8d67881e122532faa0893187c3fe503515cde94e4bec5e953012d697143","observation_id":"f803da0e-4eef-40ce-bd83-f7d3c4e7a549","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2604.05426","last_updated":"2026-04-10T07:32:38Z","snapshot_observed_at":"2026-08-15T11:17:48.436952Z","submitted_at":"2026-04-07T04:40:17Z","title":"ALTO: Adaptive LoRA Tuning and Orchestration for Heterogeneous LoRA Training Workloads","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T20:21:27.428360Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2604.05426"},"observation_digest":"sha256:8de78bb278e2e67d897465fb63e9c98cc4323ebcc66979f80d5a7bb0f2725fc0","observation_id":"aa6226c3-a3b8-4163-89af-c413d067b0cf","resolution":{"observed_at":"2026-05-10T22:00:48.481454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2604.12160","last_updated":"2026-04-14T00:35:39Z","snapshot_observed_at":"2026-08-17T19:01:38.102107Z","submitted_at":"2026-04-14T00:35:39Z","title":"PubSwap: Public-Data Off-Policy Coordination for Federated RLVR","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T16:05:27.319466Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2604.12160"},"observation_digest":"sha256:e3acdde25cedf4bfd729875636b381905bd4351225d56384d3c70830fdeab193","observation_id":"778680e8-6a2d-4598-a560-5dee44fcee29","resolution":{"observed_at":"2026-05-11T09:21:00.199168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2604.18381","last_updated":"2026-04-20T15:04:57Z","snapshot_observed_at":"2026-08-11T17:15:27.258874Z","submitted_at":"2026-04-20T15:04:57Z","title":"Learning from Less: Measuring the Effectiveness of RLVR in Low Data and Compute Regimes","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T04:55:18.468593Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2604.18381"},"observation_digest":"sha256:3e07cfe736c28a324053ddaa976e4b4fc272e4c05df93eeb169fb2e9edaa11ce","observation_id":"5aa77fee-cc7c-4e87-b549-895aaab2cd76","resolution":{"observed_at":"2026-05-10T11:10:09.643586Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2604.18936","last_updated":"2026-04-21T00:21:05Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-21T00:21:05Z","title":"Fine-Tuning Small Reasoning Models for Quantum Field Theory","version":1},"reference_index":217,"source":"pdf_text","source_observed_at":"2026-05-10T03:23:18.770963Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2604.18936"},"observation_digest":"sha256:01be29bc6bfab39e47840137f94cbf0aea30f5a6f98229c3a3caf60bc1161f35","observation_id":"bca76dd8-d124-488b-86e6-3bdd0ca0e7d0","resolution":{"observed_at":"2026-05-11T12:31:05.510711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2604.21905","last_updated":"2026-04-23T17:50:23Z","snapshot_observed_at":"2026-07-06T23:08:23.939574Z","submitted_at":"2026-04-23T17:50:23Z","title":"Low-Rank Adaptation Redux for Large Models","version":1},"reference_index":199,"source":"pdf_text","source_observed_at":"2026-05-09T21:48:48.992712Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2604.21905"},"observation_digest":"sha256:cb379ec6dbbfdb279b5309015c34936c17c3d2f46727949a3e7870322f3ec203","observation_id":"be1cb815-e181-4e9f-a394-4b51bd1878a6","resolution":{"observed_at":"2026-05-11T14:26:03.892303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2605.06241","last_updated":"2026-05-08T19:48:19Z","snapshot_observed_at":"2026-08-14T16:39:32.391961Z","submitted_at":"2026-05-07T13:25:05Z","title":"Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T10:33:02.741857Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2605.06241"},"observation_digest":"sha256:397c9c9c50d8585f0c1a199bbf1d0648e19ead11851b627531bd9d0e7a73b5a5","observation_id":"2d50b0c6-e537-4a7e-9773-4074901fff47","resolution":{"observed_at":"2026-05-11T20:01:09.753151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2605.06241","last_updated":"2026-05-08T19:48:19Z","snapshot_observed_at":"2026-08-14T16:39:32.391961Z","submitted_at":"2026-05-07T13:25:05Z","title":"Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T01:10:54.313745Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2605.06241"},"observation_digest":"sha256:34ae617e63e538374b4eab92aa984efcb636ef613bbf3b36ef93cfd3e80c6a13","observation_id":"40df2ba8-c027-4b3b-bd91-bf2d4ff37b25","resolution":{"observed_at":"2026-05-12T08:26:24.155287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":"2504.15777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-07-03T14:08:21.920833Z","title":"Tina: Tiny reasoning models via LoRA.arXiv preprint arXiv:2504.15777, 2025b","venue":null,"work_id":"c1ef596d-9edc-4ce5-8034-1d13826b4e2e","year":2025},"citing_paper":{"arxiv_id":"2606.12883","last_updated":"2026-06-11T04:19:32Z","snapshot_observed_at":"2026-08-15T12:32:37.485308Z","submitted_at":"2026-06-11T04:19:32Z","title":"The Hidden Power of Scaling Factor in LoRA Optimization","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-06-27T07:14:08.479610Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2606.12883"},"observation_digest":"sha256:9df348708a2b9b6d2f9bba4d0c55650841b87f52e85ed45d34aec77e20eb5b9a","observation_id":"71d24292-4caf-4320-a2d2-ed5383256db0","resolution":{"observed_at":"2026-07-03T14:08:21.922153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15777","snapshot_observed_at":"2026-08-01T01:28:55.596043Z","title":"Tina: Tiny Reasoning Models via","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27787","last_updated":"2026-07-30T07:21:34Z","snapshot_observed_at":"2026-08-17T04:15:29.793152Z","submitted_at":"2026-07-30T07:21:34Z","title":"LoRA Scaffolded Policy Optimization (LSPO): A Sampling-Time Low-Rank Scaffold for Recovering Reinforcement-Learning Gradient on Zero-Reward Cliff Prompts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T01:28:55.596043Z"},"links":{"cited_paper":"/paper/2504.15777","citing_paper":"/paper/2607.27787"},"observation_digest":"sha256:e1ae499bcde74c919cb88f8d7974925dca256a78e555cf3495626e8f2620fce6","observation_id":"0f0a37e7-5dd7-44d0-9cc5-833ec769b190","resolution":{"observed_at":"2026-08-01T01:28:55.596043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.15777/citation-record","integrity":"/paper/2504.15777/integrity","json":"/paper/2504.15777/citation-record.json","paper":"/paper/2504.15777"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:23:46.368374Z","title":null,"venue":null,"work_id":"5a20c4ea-d97e-4006-965b-c47727a70f01","year":2021},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.605382Z"},"links":{"citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:623367df75f6fb89b50abd0183f00f084c6da1d02b7695f80d6e190019ecb7b1","observation_id":"93e319e8-24f5-4ae5-b0a7-ae5b9802b4a1","resolution":{"observed_at":"2026-08-16T11:23:46.373412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-17T04:59:59.434643Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-16T11:23:45.308358Z","title":"Quy-Anh Dang and Chris Ngo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.308358Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:369eb477c2d8cc0e197b242f4bde144eee8eaff29bf80ef4f27be81db799c2e1","observation_id":"ee612c02-d691-44f1-b249-b1eb26906b3f","resolution":{"observed_at":"2026-08-16T11:23:45.308358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:23:45.353089Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.353089Z"},"links":{"citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:eb33ac17b372d55fa807c69ef06c533469717ad0ff4935350c42f315473259be","observation_id":"8df13247-50ae-41a8-b0e4-cff5b629206a","resolution":{"observed_at":"2026-08-16T11:23:45.353089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T11:23:45.358170Z","title":"Clémentine Fourrier, Nathan Habib, Hynek Kydlíček, Thomas Wolf, and Lewis Tunstall","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.358170Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:d560a4e1c2e1895da053cc61d8677d1764d96fba92467e7ea38a0df86c83642e","observation_id":"0333a5c3-edd7-4876-8a57-d7f74b48414d","resolution":{"observed_at":"2026-08-16T11:23:45.358170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-16T11:23:45.368112Z","title":"Dan Hendrycks, Collin Burns, Saurav Kadavath, Akul Arora, Steven Basart, Eric Tang, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.368112Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:9b37ca99f41c68f9700cf07a584a4ca535681ac7d2cc87c8b2a5215d3185de9e","observation_id":"672c5063-0b93-46b8-9135-ef6f5327bf90","resolution":{"observed_at":"2026-08-16T11:23:45.368112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T11:23:45.378486Z","title":"Jingcheng Hu, Yinmin Zhang, Qi Han, Daxin Jiang, and Heung-Yeung Shum Xiangyu Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.378486Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:e9d156063b025c2162efe72ecd13dcfff33ea8c7bae94f3a228e241584191154","observation_id":"c5d92ddf-84b4-4c1f-b3a6-4b2eb3652684","resolution":{"observed_at":"2026-08-16T11:23:45.378486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-13T15:08:13.316080Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-16T11:23:45.383186Z","title":"Hugging Face","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.383186Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:c8e70b4e8727155071b8d2904f6c18193164fea55f9eb03a371f65e81e7a0ce2","observation_id":"d1d64196-4f45-4af1-9615-00bb001e7f69","resolution":{"observed_at":"2026-08-16T11:23:45.383186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-16T11:23:45.387459Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.387459Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:00a7d8b1b595e01938524f4e7653a2516677458a07f075a19383133f4a6348ab","observation_id":"cf495bd9-6d10-4434-a121-7c1523b3eb8e","resolution":{"observed_at":"2026-08-16T11:23:45.387459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08967","last_updated":"2024-12-13T04:44:11Z","snapshot_observed_at":"2026-08-16T14:26:54.639216Z","submitted_at":"2024-01-17T04:43:21Z","title":"ReFT: Reasoning with Reinforced Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08967","snapshot_observed_at":"2026-08-16T11:23:45.393231Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.393231Z"},"links":{"cited_paper":"/paper/2401.08967","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:7b80c245e24a91f96b0a899e7eb5ee92f1f91f96d526bf0daae48667236df4cf","observation_id":"2ba93b16-607f-4523-bbb9-445bfa16c279","resolution":{"observed_at":"2026-08-16T11:23:45.393231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06781","last_updated":"2025-02-10T18:57:29Z","snapshot_observed_at":"2026-08-16T03:56:33.383172Z","submitted_at":"2025-02-10T18:57:29Z","title":"Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06781","snapshot_observed_at":"2026-08-16T11:23:45.398469Z","title":"Sourab Mangrulkar, Sylvain Gugger, Lysandre Debut, Younes Belkada, Sayak Paul, and Benjamin Bossan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.398469Z"},"links":{"cited_paper":"/paper/2502.06781","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:8c469451a604a0f82bdd27694c225added756db5cafe249c44f68883a6f5c1ef","observation_id":"d3fa8dc7-43d5-4184-8561-086666a81455","resolution":{"observed_at":"2026-08-16T11:23:45.398469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09413","last_updated":"2024-12-22T10:44:13Z","snapshot_observed_at":"2026-08-16T16:04:15.848709Z","submitted_at":"2024-12-12T16:20:36Z","title":"Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09413","snapshot_observed_at":"2026-08-16T11:23:45.403389Z","title":"Niklas Muennighoff, Zitong Yang, Weijia Shi, Xiang Lisa Li, Li Fei-Fei, Hannaneh Hajishirzi, Luke Zettlemoyer, Percy Liang, Emmanuel Candès, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.403389Z"},"links":{"cited_paper":"/paper/2412.09413","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:5ebd1fd435123b030023bd5915c1b9d68534a8af6e326abcfab120bdd31bdd26","observation_id":"3b4ef344-0a96-484c-8b2f-82c8d69b565e","resolution":{"observed_at":"2026-08-16T11:23:45.403389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-16T11:23:45.409312Z","title":"NovaSky Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.409312Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:224744f789e17d47c594b55d72756210922de03bf05adc6aceaeb4d410bf15d3","observation_id":"bf225b99-10bf-42f2-ac2f-ec0162c2cc2b","resolution":{"observed_at":"2026-08-16T11:23:45.409312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-08-19T11:46:55.171293Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-16T11:23:45.471487Z","title":"OpenThoughts Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.471487Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:b785bee470ea6d5f5ac7dbbe42de0c4f164a12e4d8a261ef45e66c8489f693f1","observation_id":"1475e24b-a7fb-4bcd-b20d-e46c73213376","resolution":{"observed_at":"2026-08-16T11:23:45.471487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06195","last_updated":"2024-08-12T14:42:13Z","snapshot_observed_at":"2026-08-16T22:23:21.433393Z","submitted_at":"2024-08-12T14:42:13Z","title":"Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06195","snapshot_observed_at":"2026-08-16T11:23:45.548721Z","title":"Samyam Rajbhandari, Jeff Rasley, Olatunji Ruwase, and Yuxiong He","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.548721Z"},"links":{"cited_paper":"/paper/2408.06195","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:2412148724a34a02d19f615ff3aa54e44f7cc99b9cc4691f143ca06a3c49670a","observation_id":"ead0f956-3be5-4904-bbca-b5672bb68b71","resolution":{"observed_at":"2026-08-16T11:23:45.548721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T11:23:45.584679Z","title":"15 Tina: Tiny Reasoning Models via LoRA Guangming Sheng, Chi Zhang, Zilingfeng Ye, Xibin Wu, Wang Zhang, Ru Zhang, Yanghua Peng, Haibin Lin, and Chuan Wu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.584679Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:428dabd0cdecdae8616955ce157be040ba472550a09c63ff0d3481d132e0b13c","observation_id":"f5c56728-56cd-4861-bd6e-e87a258b960c","resolution":{"observed_at":"2026-08-16T11:23:45.584679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:23:45.590102Z","title":"URL http://dx.doi.org/10.1145/3689031.3696075","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.590102Z"},"links":{"citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:dff297a567809273972f57ebebd2ae2e77fa977457415215bf2509918c464812","observation_id":"8c500d0c-fc56-4b20-9602-d778023207bf","resolution":{"observed_at":"2026-08-16T11:23:45.590102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-16T11:23:45.595331Z","title":"Weihao Zeng, Yuzhen Huang, Qian Liu, Wei Liu, Keqing He, Zejun Ma, and Junxian He","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.595331Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:3d2498310e2bf66f61ad4d8ad2db24037f30513fef49c17c7dfce203f0649233","observation_id":"29bed85c-3af7-48f9-a4a8-359ddbb6dfa9","resolution":{"observed_at":"2026-08-16T11:23:45.595331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-16T11:23:45.600284Z","title":"16 Tina: Tiny Reasoning Models via LoRA Appendix A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.600284Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:e2291090b07943ae38cb43f623829ff740616011f72ea20bbdb8a41792162778","observation_id":"a66c1970-8e8c-4ff3-95f5-23e5d83bd78b","resolution":{"observed_at":"2026-08-16T11:23:45.600284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:23:46.227255Z","title":"lighteval vllm $MODEL_ARGS","venue":null,"work_id":"c2171dd2-8b06-479b-ba60-8811df519d78","year":2000},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.610470Z"},"links":{"citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:0c50b39f3f4d62bb89bd394bbbd96b49b8c017c9ba47b6791eb94e67d842b443","observation_id":"906306fb-3cd2-4f06-bece-673d7a4a8c9f","resolution":{"observed_at":"2026-08-16T11:23:46.328979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-16T11:23:45.579251Z","title":"David Rein, Betty Li Hou, Asa Cooper Stickland, Jackson Petty, Richard Yuanzhe Pang, Julien Dirani, Julian Michael, and Samuel R Bowman","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.579251Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:e4100ae6e99ace08242050b2868f0192b11069273505e9b1a62adaebc8ac9f4a","observation_id":"976172a2-c570-4479-aff5-4a1ba8979b61","resolution":{"observed_at":"2026-08-16T11:23:45.579251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-16T11:23:45.373588Z","title":"Edward J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.373588Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:45de73ce17996b3cb566b30294205064b294e3c4803172ea20a2b29176ac369a","observation_id":"5cff9742-1706-4ac7-aea8-1cf28b566d0a","resolution":{"observed_at":"2026-08-16T11:23:45.373588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:23:45.363347Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.363347Z"},"links":{"citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:5d7d32f538efec0a07c4c76eeb48b71022169dab8169c64cea88ad8315bc144f","observation_id":"e189e2a0-512a-4af4-9621-e6db0cf5cc4b","resolution":{"observed_at":"2026-08-16T11:23:45.363347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:23:45.257899Z","title":"Cudo Compute","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.257899Z"},"links":{"citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:2bd226f33f78a581cb20d4e88341e4d263a22363ba85b55df3671b38516879e9","observation_id":"51193c9b-d6ea-45a3-a06b-207ad1df89b9","resolution":{"observed_at":"2026-08-16T11:23:45.257899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-17T16:48:59.674177Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-16T11:23:45.237203Z","title":"Zeyuan Allen-Zhu and Yuanzhi Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.237203Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:c23b93a550fa785437846d09f468fa3f974287e4a00689f836e20e940d3ae72b","observation_id":"047a7e4d-dcb1-4d2d-bd78-32f1e2b4e7b4","resolution":{"observed_at":"2026-08-16T11:23:45.237203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 15 inbound Pith citation observations for arXiv:2504.15777."}