{"as_of":"2026-08-09T17:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ebda3c7f382692cb6ee504176dc75f7f056266c98355ac175ed86aa5ebed0f1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:31:59.876018Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:06:16.575794Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-08T17:31:59.876018Z","title":"Sutherland","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05911","last_updated":"2025-02-09T14:11:30Z","snapshot_observed_at":"2026-08-09T10:26:49.594398Z","submitted_at":"2025-02-09T14:11:30Z","title":"GRAIT: Gradient-Driven Refusal-Aware Instruction Tuning for Effective Hallucination Mitigation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T17:31:59.876018Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2502.05911"},"observation_digest":"sha256:7762cea14bbc046168b53b705e41934018d1141036d02062c1041d0797d61188","observation_id":"65f3cb4c-1b59-4f7e-b1bc-d7bbeb5920f2","resolution":{"observed_at":"2026-08-08T17:31:59.876018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-07T14:41:41.745767Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17988","last_updated":"2025-08-05T11:46:13Z","snapshot_observed_at":"2026-08-09T03:58:02.739776Z","submitted_at":"2025-05-23T14:55:22Z","title":"Towards Revealing the Effectiveness of Small-Scale Fine-tuning in R1-style Reinforcement Learning","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:41:41.745767Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2505.17988"},"observation_digest":"sha256:5b2aa2c61b14c18dd1118c31971a01ba02de47e12fb1ab63acb7b2b8f4164d17","observation_id":"cd2a7a68-530a-49df-9b75-a23b2a061db7","resolution":{"observed_at":"2026-08-07T14:41:41.745767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-07T14:29:32.572317Z","title":"Learning dynamics of llm finetuning.arXiv preprint arXiv:2407.10490, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18830","last_updated":"2025-05-24T18:58:51Z","snapshot_observed_at":"2026-08-09T02:47:56.222742Z","submitted_at":"2025-05-24T18:58:51Z","title":"On the Effect of Negative Gradient in Group Relative Deep Reinforcement Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:32.572317Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2505.18830"},"observation_digest":"sha256:56b7c0af299d15bae76e4c55cf2cc4d0a149b431d7b6aadb777b7281a746c648","observation_id":"cb0aa861-d8ce-4d6a-9d29-a536550589d8","resolution":{"observed_at":"2026-08-07T14:29:32.572317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-07T00:54:49.770445Z","title":"Sutherland","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00018","last_updated":"2025-07-04T08:16:16Z","snapshot_observed_at":"2026-08-07T00:41:17.848176Z","submitted_at":"2025-06-15T05:42:29Z","title":"Implicit Reward as the Bridge: A Unified View of SFT and DPO Connections","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:49.770445Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2507.00018"},"observation_digest":"sha256:857e8d9433906c745f952745553c93c8fbaf036b3098336e35c64873a5e221e4","observation_id":"1990d6db-a32b-4898-9e51-03d125c24718","resolution":{"observed_at":"2026-08-07T00:54:49.770445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-05T17:21:25.280778Z","title":"True R :","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.16546","last_updated":"2025-08-22T17:10:37Z","snapshot_observed_at":"2026-08-09T01:56:02.075811Z","submitted_at":"2025-08-22T17:10:37Z","title":"RL Is Neither a Panacea Nor a Mirage: Understanding Supervised vs. Reinforcement Learning Fine-Tuning for LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T17:21:25.280778Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2508.16546"},"observation_digest":"sha256:26f65a4f209bf98129c9b5aed4d5b442ba4b8259deca97200104347c480a5fed","observation_id":"bf3bf01c-0ebf-45bb-ae2d-bdd292bf06fc","resolution":{"observed_at":"2026-08-05T17:21:25.280778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-04T12:12:57.561553Z","title":"Sutherland","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.03595","last_updated":"2026-07-10T05:48:25Z","snapshot_observed_at":"2026-08-06T13:46:23.950295Z","submitted_at":"2025-10-04T00:52:48Z","title":"Decoupling Task-Solving and Output Formatting in LLM Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T12:12:57.561553Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2510.03595"},"observation_digest":"sha256:491e76bd6bf30f124c087fd831ceecf51c0d41eb6e56fca8639356020caac40c","observation_id":"5a6839e6-4658-44d7-a60d-2cff956cb3ee","resolution":{"observed_at":"2026-08-04T12:12:57.561553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2512.00778","last_updated":"2026-05-15T09:26:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-30T08:27:59Z","title":"What Is Preference Optimization Doing, and Why?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T18:37:48.161545Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2512.00778"},"observation_digest":"sha256:efa3ece9e79dbd7d63df005bb9b26b50cbab118772f3ae7ea7b62488a163c10a","observation_id":"d78c3bd0-1096-4aa4-a769-25da7a428295","resolution":{"observed_at":"2026-05-21T18:40:28.947037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2602.23964","last_updated":"2026-04-28T09:24:17Z","snapshot_observed_at":"2026-08-07T15:28:21.148415Z","submitted_at":"2026-02-27T12:17:06Z","title":"RAD-DPO: Robust Adaptive Denoising Direct Preference Optimization for Generative Retrieval in E-commerce","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T19:05:00.826786Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2602.23964"},"observation_digest":"sha256:6fbbe4994308e7e33d98f92659ada5bb73e5bbe9e67a619091cee0998cc86717","observation_id":"a9d916c5-57f6-4e1b-b752-dce11ca7e33d","resolution":{"observed_at":"2026-05-15T19:06:30.680839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-14T21:37:04.895721Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13910","last_updated":"2026-06-26T10:54:34Z","snapshot_observed_at":"2026-08-07T21:40:32.906749Z","submitted_at":"2026-03-14T11:46:27Z","title":"Scene Generation at Absolute Scale: Utilizing Semantic and Geometric Guidance From Text for Accurate and Interpretable 3D Indoor Scene Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T21:37:04.895721Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2603.13910"},"observation_digest":"sha256:5afec9fceacad6fe3a6426393ed3a96cae0089510816e9b77ac10af8ff887575","observation_id":"2e158d72-527a-4118-b4f8-b930dae0cf75","resolution":{"observed_at":"2026-07-14T21:37:04.895721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2604.16995","last_updated":"2026-04-18T13:49:47Z","snapshot_observed_at":"2026-07-06T23:04:10.324443Z","submitted_at":"2026-04-18T13:49:47Z","title":"SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T06:57:03.100519Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2604.16995"},"observation_digest":"sha256:141a63e8858c58b019fde948fc4a3853b0ab8c6f6f866c503987d6ca24ca00a9","observation_id":"fc835128-3a56-42a2-86bb-8a2e16499593","resolution":{"observed_at":"2026-05-10T07:01:49.448711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.02626","last_updated":"2026-05-04T14:15:24Z","snapshot_observed_at":"2026-07-30T07:44:04.614445Z","submitted_at":"2026-05-04T14:15:24Z","title":"Gradient-Gated DPO: Stabilizing Preference Optimization in Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T18:35:13.659698Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.02626"},"observation_digest":"sha256:e40769c10d8c9c81901bd8c7e498e625bfed9f9abcf8e8f38ea3d2f4bf54446c","observation_id":"9f7172db-7504-4c33-a776-885f13b0e1b7","resolution":{"observed_at":"2026-05-09T06:20:41.735163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.07353","last_updated":"2026-05-08T07:08:25Z","snapshot_observed_at":"2026-07-06T23:19:46.018236Z","submitted_at":"2026-05-08T07:08:25Z","title":"Confidence-Aware Alignment Makes Reasoning LLMs More Reliable","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T02:10:40.020460Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.07353"},"observation_digest":"sha256:390655fec270b0545ad90a3eee65f21e2ccb610381f70a4b787e7d80e742d4d2","observation_id":"66c2ec75-2ba5-422c-b88f-6e502a0d3042","resolution":{"observed_at":"2026-05-11T03:50:58.188744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.08378","last_updated":"2026-05-08T18:36:25Z","snapshot_observed_at":"2026-08-02T18:04:56.183678Z","submitted_at":"2026-05-08T18:36:25Z","title":"Reinforcement Learning for Scalable and Trustworthy Intelligent Systems","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-12T01:47:40.772146Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.08378"},"observation_digest":"sha256:fbdac2770667ee418e28417d36a43c145a63334b04827b638d11c2ce61cc8179","observation_id":"665c7c56-9e73-4710-84ed-43ddd4ecf1cb","resolution":{"observed_at":"2026-05-12T07:51:38.989430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.08666","last_updated":"2026-05-09T04:07:20Z","snapshot_observed_at":"2026-08-02T05:46:41.345933Z","submitted_at":"2026-05-09T04:07:20Z","title":"The Cancellation Hypothesis in Critic-Free RL: From Outcome Rewards to Token Credits","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T01:24:03.186413Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.08666"},"observation_digest":"sha256:26b5c2def6669ba2164264834ad5da393dceece6043837625acb848965f3f334","observation_id":"c72d8732-7680-4b17-a552-4319e9f2cd63","resolution":{"observed_at":"2026-05-12T08:01:29.036187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2606.01558","last_updated":"2026-06-01T02:02:23Z","snapshot_observed_at":"2026-08-04T16:32:29.186022Z","submitted_at":"2026-06-01T02:02:23Z","title":"Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-28T15:45:26.891621Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2606.01558"},"observation_digest":"sha256:ad0d995b67c4c2bffe204520648e97868673b6c1929a14ab2a2afc1e8131b0c9","observation_id":"98f421c5-036b-410b-960f-f19f950996bc","resolution":{"observed_at":"2026-07-01T22:06:16.577368Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-13T00:42:24.432562Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09053","last_updated":"2026-07-10T02:50:21Z","snapshot_observed_at":"2026-08-07T20:27:31.901176Z","submitted_at":"2026-07-10T02:50:21Z","title":"An Emergent Mirage: Is Emergent Misalignment and Realignment Indeed a Robust Phenomenon?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-13T00:42:24.432562Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.09053"},"observation_digest":"sha256:fbc886736c41656ff04dbfb983443c3e739c3f1a4a4dd3fdb5ab084a0895812c","observation_id":"f47741bd-d9bb-435e-b246-cee0ddd3d33c","resolution":{"observed_at":"2026-07-13T00:42:24.432562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-02T02:24:42.877960Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14371","last_updated":"2026-07-15T21:17:42Z","snapshot_observed_at":"2026-08-07T13:04:16.701334Z","submitted_at":"2026-07-15T21:17:42Z","title":"Supervised Fine-Tuning vs. In-Context Learning: An Equilibrium Analysis of LLM Personalization under Congestion","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T02:24:42.877960Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.14371"},"observation_digest":"sha256:2d437248db09eea6b1f8ac3d5c48c38eaae26352289194ac0308aa52045d8fa1","observation_id":"bf00b194-6eb2-423c-b23f-bb76c5b8a4bf","resolution":{"observed_at":"2026-08-02T02:24:42.877960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-01T06:05:53.145003Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-06T10:51:59.521588Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.145003Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:d86d2e89eb46a29051b59a00bce6e5ea3762376a8fa874eeb52f3e10df332ffe","observation_id":"8d174774-00f0-4a18-81b0-4d95a0f5b50f","resolution":{"observed_at":"2026-08-01T06:05:53.145003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.10490/citation-record","integrity":"/paper/2407.10490/integrity","json":"/paper/2407.10490/citation-record.json","paper":"/paper/2407.10490"},"outbound":[],"paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2407.10490."}