{"as_of":"2026-08-22T23:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3fa26a9174a064c80c5ca4988d885a3e98be09af675591a01306346f25d3e15","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:36:16.943206Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.00913/citation-record","integrity":"/paper/2505.00913/integrity","json":"/paper/2505.00913/citation-record.json","paper":"/paper/2505.00913"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.728923Z","title":"Better fine-tuning by reducing representational collapse","venue":null,"work_id":"54bd06df-4071-4702-8151-7f33a7dd8b5e","year":2021},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.769153Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:024b67e2a1d32ed9e4e436ccef2b32d583aceef57d83134077ac4bfe817d8bd2","observation_id":"abbdf05a-27e3-4733-9e7a-df5806c456c3","resolution":{"observed_at":"2026-08-16T04:36:17.734972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.711886Z","title":"Uncertainty-based offline reinforcement learning with diversified q-ensemble","venue":null,"work_id":"73a46b50-8fc1-479b-a4fb-0ac422128244","year":2021},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.774503Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:d8e4a446aa00ac815201b048e94cf8c06fcf0535da25e95332f08dd491260876","observation_id":"0d80a7c6-2237-4d0c-b21a-4263038d234a","resolution":{"observed_at":"2026-08-16T04:36:17.717634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.695245Z","title":"Efficient online reinforcement learning with offline data","venue":null,"work_id":"14b7d077-445c-4934-808f-1557cb4bf60b","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.779542Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:c43fa918e4d42b115e5b3bfbaa59fc03d31eee57c91b3a72ce10e62e309ef4a0","observation_id":"e9b84a2e-142f-46d1-81fb-61ce15a303e4","resolution":{"observed_at":"2026-08-16T04:36:17.700399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.13515","last_updated":"2021-06-08T09:36:51Z","snapshot_observed_at":"2026-08-18T07:30:08.326151Z","submitted_at":"2021-02-24T16:51:02Z","title":"Beyond Fine-Tuning: Transferring Behavior in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2102.13515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.13515","snapshot_observed_at":"2026-08-16T04:36:17.095576Z","title":"Beyond Fine-Tuning: Transferring Behavior in Reinforcement Learning","venue":"cs.LG","work_id":"f7c941b2-434c-4cd0-b60b-93586bfd3b1f","year":2021},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.784670Z"},"links":{"cited_paper":"/paper/2102.13515","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:124897e6b82e0a27625a98f8948ca455daee778712a5f003b0c5adf72b809868","observation_id":"260701c3-7656-4d66-8d5d-d8dd7dd741ff","resolution":{"observed_at":"2026-08-16T04:36:17.101120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:16.789652Z","title":"D4rl: Datasets for deep data-driven reinforcement learning, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.789652Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:007c504cafaf202fa684f368946ab0b6d82e194c1bdaa8a208b5adb18e2ee03f","observation_id":"643ba63d-2e5f-48f4-a328-bf63821e0288","resolution":{"observed_at":"2026-08-16T04:36:16.789652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.667701Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"da626fee-38d8-4a51-aefa-a050f27fbb5f","year":null},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.795605Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:00daaa40276c038747d7ea94fd84bae61d888dad945eab0ffff3023ac664f7ff","observation_id":"1b7e1202-5c74-4ac0-9664-5437ab4967f6","resolution":{"observed_at":"2026-08-16T04:36:17.672992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-17T07:51:41.384508Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-16T04:36:16.800812Z","title":"Soft actor-critic algorithms and applications","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.800812Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:90558c9fb6791558eac6399fa6cbea2ebcfe9c9f25553140a4779bc51557ea17","observation_id":"a5e3219e-371e-4f88-8d84-f7d75f847493","resolution":{"observed_at":"2026-08-16T04:36:16.800812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.651034Z","title":"Never stop learning: The effectiveness of fine-tuning in robotic reinforcement learning","venue":null,"work_id":"b8eddff5-5871-4fe3-ae1c-2cb2af30791d","year":2020},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.806653Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:b4c9094c59b24d7c6c24044cd11e7f732f0b7d413eae7618d49ff89003c919b6","observation_id":"af8c9b2e-91ac-4cc8-8e11-2cac9dc72316","resolution":{"observed_at":"2026-08-16T04:36:17.656657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:16.812426Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.812426Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:8b667c5b05b8771bedb4a566397bb6afeb62a3ffdf21cc7a0f2e2e33c218ab26","observation_id":"ee18c2c5-6c4a-4c23-b242-1a0dd4d3e380","resolution":{"observed_at":"2026-08-16T04:36:16.812426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:16.817722Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.817722Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:80035cadecb9d5438ff7945fcfd8af8293e6f337b1476663ce6ce925d9cc3f08","observation_id":"0589a237-57fc-4093-b517-944141ea5f70","resolution":{"observed_at":"2026-08-16T04:36:16.817722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.611166Z","title":"Batch policy learning under constraints","venue":null,"work_id":"d84ed98e-654c-40b6-bfb1-0aae0ffc1aca","year":2019},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.823506Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:7c0719fe32a64676d7765675f741f7a707c6c530d3e2ac174b0294f4eac764ef","observation_id":"b4d1ed15-0e51-4382-beb9-9fa0c17d93c5","resolution":{"observed_at":"2026-08-16T04:36:17.617350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.594603Z","title":"Offline-to-online reinforcement learning via balanced replay and pessimistic q-ensemble","venue":null,"work_id":"561f4d33-c2c6-41f8-a3db-9a718581f895","year":2021},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.828652Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:d1722f35a585373ecc78295d8d358dab8281f5a7e5f60e1c0240c1fa1fdc3235","observation_id":"52bdf500-3393-478b-97e1-6070e30f9252","resolution":{"observed_at":"2026-08-16T04:36:17.599548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15669","last_updated":"2023-05-25T02:40:32Z","snapshot_observed_at":"2026-08-22T06:48:52.372703Z","submitted_at":"2023-05-25T02:40:32Z","title":"PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15669","snapshot_observed_at":"2026-08-16T04:36:16.833663Z","title":"PROTO : Iterative policy regularized offline-to-online reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.833663Z"},"links":{"cited_paper":"/paper/2305.15669","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:f8b4dc80fbc3ed93d7676c4d2fdab35972b2b131bb1411c8431d5e6c61913cd3","observation_id":"d14939d2-811f-4349-902e-f5568813e83c","resolution":{"observed_at":"2026-08-16T04:36:16.833663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17396","last_updated":"2023-03-30T14:08:31Z","snapshot_observed_at":"2026-08-16T16:39:52.102279Z","submitted_at":"2023-03-30T14:08:31Z","title":"Finetuning from Offline Reinforcement Learning: Challenges, Trade-offs and Practical Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17396","snapshot_observed_at":"2026-08-16T04:36:16.838706Z","title":"Finetuning from offline reinforcement learning: Challenges, trade-offs and practical solutions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.838706Z"},"links":{"cited_paper":"/paper/2303.17396","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:00c453724dd6a926241d05382a3e7743f6171f437936200fda732072cecac29c","observation_id":"b947f760-9d8b-4324-8f10-3ea13d31eceb","resolution":{"observed_at":"2026-08-16T04:36:16.838706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.578476Z","title":"Mildly conservative q-learning for offline reinforcement learning","venue":null,"work_id":"d2d5df48-4855-4537-923b-cedfb9179c58","year":2022},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.844233Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:6b1e461184ba3ecd88434afd8cbe20856aeadfa64106b4eaef219e0b25c0ff8f","observation_id":"1a09c52b-aa45-4a2b-a87b-12279bda810d","resolution":{"observed_at":"2026-08-16T04:36:17.583740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.562302Z","title":"What happens to BERT embeddings during fine-tuning? In Proceedings of the Third BlackboxNLP Workshop on Analyzing and Interpreting Neural Networks for NLP, 2020","venue":null,"work_id":"e8eea64b-7dc5-47d0-95bc-a0b16ccaeb8e","year":2020},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.849556Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:7f36f121c6066aeb9b24ad4c397834a9e2bc46c5c37f6ea143e391722cf20cac","observation_id":"2f1022f5-8d99-46b9-b1c3-78afd8e0e534","resolution":{"observed_at":"2026-08-16T04:36:17.567654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-08-15T03:52:49.245753Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-16T04:36:16.854533Z","title":"AWAC : Accelerating online reinforcement learning with offline datasets","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.854533Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:5995e69be4e7425c2aa4c1721279d0edb42bd48f86468aba08948d7d3fd2e3b3","observation_id":"6b85b54d-a397-48ab-a3ba-89b0bc106076","resolution":{"observed_at":"2026-08-16T04:36:16.854533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.545168Z","title":"Cal- QL : Calibrated offline RL pre-training for efficient online fine-tuning","venue":null,"work_id":"4b596274-6feb-4c49-9cd1-6e9b8ff93f67","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.859831Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:9cf5160efecdaf5b859a0f271389ae288d62fbfb3ad219676aaddee2ec85feb5","observation_id":"75fdffd1-2bd2-487f-b89f-3fcd7d24d7e9","resolution":{"observed_at":"2026-08-16T04:36:17.550359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.528071Z","title":"Peters, Sebastian Ruder, and Noah A","venue":null,"work_id":"48e16525-757b-4c72-86c6-8ed1e31d478f","year":2019},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.864585Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:fe084344f41cbe8e3f9458d220d8753e03d6047dd3ee9eb9beb3aa014498101c","observation_id":"e2d31116-b694-442f-b5f0-a5f6e7e6589e","resolution":{"observed_at":"2026-08-16T04:36:17.533875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.511254Z","title":"Lifelong generative modeling","venue":null,"work_id":"306a94c4-ca98-49e7-bf43-87d09dff39b4","year":2020},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.869811Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:4237fc03bed3910ba54a99a21939d98f74e7f5a756fbbb12625a1d3132797fa1","observation_id":"1e1d142d-36b2-4595-8e21-6ae532e37754","resolution":{"observed_at":"2026-08-16T04:36:17.516804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11603","last_updated":"2023-11-21T22:23:43Z","snapshot_observed_at":"2026-08-16T16:58:17.273697Z","submitted_at":"2022-05-23T20:00:22Z","title":"Representation Projection Invariance Mitigates Representation Collapse","version":3},"cited_work":{"arxiv_id":"2205.11603","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.11603","snapshot_observed_at":"2026-08-16T04:36:17.001046Z","title":"Representation Projection Invariance Mitigates Representation Collapse","venue":"cs.CL","work_id":"e06d718f-e133-454a-94b0-f5f4582e528b","year":2022},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.875268Z"},"links":{"cited_paper":"/paper/2205.11603","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:849579afb618175c9a4d666a6bd8a8b4c9e8628afc0997cf330fb0893618cae7","observation_id":"685a03cc-7966-4db8-86f4-b2cb4106d446","resolution":{"observed_at":"2026-08-16T04:36:17.008398Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.494155Z","title":"Chase Kew, Xue Bin Peng, Sehoon Ha, Jie Tan, and Sergey Levine","venue":null,"work_id":"7adc763f-fc45-4cf2-87f9-7493f608cd3f","year":2022},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.882474Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:4192f0872265dab370340934706558ce42c02cc66ae3eed52f64e0571a1a8456","observation_id":"35999ff6-b12b-4719-bcb8-75496e120019","resolution":{"observed_at":"2026-08-16T04:36:17.499250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.477006Z","title":"Hybrid RL : Using both offline and online data can make RL efficient","venue":null,"work_id":"e1feba9b-297f-4a8d-86c4-ab9f10781775","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.887688Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:8be4b7a18bfcd6af7761e16525918ce78c9d5bccda0a25e423af380930db81a9","observation_id":"974868de-e9bd-4fa3-80aa-0661f0395d6a","resolution":{"observed_at":"2026-08-16T04:36:17.482254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.458872Z","title":"Jump-start reinforcement learning","venue":null,"work_id":"0b8d1e8b-702b-4535-8a64-a5ea8efb5765","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.894178Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:22c6a6e24889492b8f7206f2e6b38d76dbab23798e86b8a47c0bf48b789038e2","observation_id":"13655328-65e4-4987-900e-772c09a5aecc","resolution":{"observed_at":"2026-08-16T04:36:17.464570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.322478Z","title":"Unifying task specification in reinforcement learning","venue":null,"work_id":"76762379-23a6-4960-ae62-231f0c504ea1","year":2017},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.899004Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:4662f172a9f8536076d053b9659eb32f4ce88dc5f3e9e778b234b4418b1343b5","observation_id":"22bd276e-fa3d-45ad-a418-20ed20a860d0","resolution":{"observed_at":"2026-08-16T04:36:17.328030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.304642Z","title":"Principal component analysis","venue":null,"work_id":"19885b59-78bd-42ff-be3c-bb046b2441d1","year":1987},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.903798Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:1de6cfccd0ec6dbf620ffe8fb9eac31028f5cd5d7848a208f0d21dfa1a120364","observation_id":"b4c8b9a2-4e5e-402c-883b-8ee6a27753fa","resolution":{"observed_at":"2026-08-16T04:36:17.310244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.286530Z","title":"The in-sample softmax for offline reinforcement learning","venue":null,"work_id":"0e079ef5-1fbd-4104-a2ac-cee7b552efcf","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.909902Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:48d5f563217536e879b5105cb74b65a1a99d5bda9e0cc4ed072e7f119ee1bb20","observation_id":"a6e61f75-a133-4724-9c85-dd81b3badb60","resolution":{"observed_at":"2026-08-16T04:36:17.291514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.267950Z","title":"Policy expansion for bridging offline-to-online reinforcement learning","venue":null,"work_id":"cdbdaad4-93bf-4b41-9203-c75bbc6e4ee2","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.915313Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:78005daac286d78af4404c9cc95bfc1bbe9a383ef2a164de17dbaca108ea70d4","observation_id":"09915a35-83f3-4540-bf1e-50e2dddcdc70","resolution":{"observed_at":"2026-08-16T04:36:17.273450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.250355Z","title":"Revisiting few-sample BERT fine-tuning","venue":null,"work_id":"7cb79054-2e9a-46bc-a57e-05046d0ed495","year":2021},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.920535Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:c52372d7f968b927fc857bc0c1ce91ea90cc70ed7e6a84d40ac6ff6aef4f9111","observation_id":"cfd53953-dfe1-4471-a020-c27a27bd84ab","resolution":{"observed_at":"2026-08-16T04:36:17.255884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.191955Z","title":"Improving offline-to-online reinforcement learning with q-ensembles","venue":null,"work_id":"90df62f9-b523-4849-b5b9-3ba832860ceb","year":2023},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.925805Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:44a7aed8c7b1d038e86a692c714cb2b9499e367a8f7c42db812f2851fe790520","observation_id":"1c3d3448-63e7-4fbf-919e-4035b2731f7b","resolution":{"observed_at":"2026-08-16T04:36:17.237706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13846","last_updated":"2022-10-25T09:08:26Z","snapshot_observed_at":"2026-08-18T07:29:36.505370Z","submitted_at":"2022-10-25T09:08:26Z","title":"Adaptive Behavior Cloning Regularization for Stable Offline-to-Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13846","snapshot_observed_at":"2026-08-16T04:36:16.930897Z","title":"Adaptive behavior cloning regularization for stable offline-to-online reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.930897Z"},"links":{"cited_paper":"/paper/2210.13846","citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:5f6268ec581ff406154ae9f2fd2ee01a02fd3910e8e64471f612cd193289e728","observation_id":"7343f87a-f002-40c3-be93-01dda982d4f5","resolution":{"observed_at":"2026-08-16T04:36:16.930897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:17.127594Z","title":"A closer look at how fine-tuning changes BERT","venue":null,"work_id":"f09bb1f6-085b-49db-bd49-46d6913a2376","year":2022},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.936303Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:2b8a1e00155d7f5b7e41b01339903f5fa97ede0c68ab4c73ba84378c248a89cd","observation_id":"9ae51680-4193-4afc-a52a-366523899af4","resolution":{"observed_at":"2026-08-16T04:36:17.132998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:36:16.943206Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T04:36:16.943206Z"},"links":{"citing_paper":"/paper/2505.00913"},"observation_digest":"sha256:e2f7a5cf587a63a52828c2f41b85137909a1346223497f3c9d07b56b4125c679","observation_id":"eee4ff75-b745-4e23-b330-8d3ad99afe32","resolution":{"observed_at":"2026-08-16T04:36:16.943206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.00913","last_updated":"2025-05-01T23:19:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T07:29:56.891929Z","submitted_at":"2025-05-01T23:19:07Z","title":"Fine-Tuning without Performance Degradation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":22},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2505.00913."}