{"as_of":"2026-08-18T23:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e3b7f86324a88a7b97ba9634d0b135588c8784fa918208cdfa9c0eb64ac6e7e","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T06:05:57.170198Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22039/citation-record","integrity":"/paper/2607.22039/integrity","json":"/paper/2607.22039/citation-record.json","paper":"/paper/2607.22039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:50.941204Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:50.941204Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:9f9fce67416cb2d758a1ca1242c7a7c0a04a5cb7217d600f868d1d9689b9bd01","observation_id":"06df0665-ec5e-4d2c-9425-9ae16114aa68","resolution":{"observed_at":"2026-08-01T06:05:50.941204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07666","last_updated":"2025-12-31T04:06:49Z","snapshot_observed_at":"2026-08-07T23:28:24.025478Z","submitted_at":"2024-08-14T16:58:48Z","title":"Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07666","snapshot_observed_at":"2026-08-01T06:05:51.004275Z","title":"arXiv preprint arXiv:2408.07666 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.004275Z"},"links":{"cited_paper":"/paper/2408.07666","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:9dd685c5af26b3133648c715198720fd10f41922c082f80d9073aa60695b4942","observation_id":"b164dcec-2b65-4923-a9fe-d4aac32e17f7","resolution":{"observed_at":"2026-08-01T06:05:51.004275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.121787Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.121787Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:0567211babcf92b86dfb85b098dad32b0fa0ea0f4f7eca907bd75eb0d0f7f890","observation_id":"88d2356a-b557-4d4d-803f-b4148708361a","resolution":{"observed_at":"2026-08-01T06:05:51.121787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04339","last_updated":"2024-04-13T16:31:25Z","snapshot_observed_at":"2026-08-16T14:36:49.442374Z","submitted_at":"2023-12-07T14:59:15Z","title":"Merging by Matching Models in Task Parameter Subspaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04339","snapshot_observed_at":"2026-08-01T06:05:51.230965Z","title":"arXiv preprint arXiv:2312.04339 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.230965Z"},"links":{"cited_paper":"/paper/2312.04339","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:af63ca5c12d4a75f269ed6476b4c322921c51f2469d27432c0d012fe945f4c4c","observation_id":"32d96f41-490c-48f5-9cae-e869ceddfdcd","resolution":{"observed_at":"2026-08-01T06:05:51.230965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.360725Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.360725Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:9d5df2dea4ba518a417c2375fa4e4bb96b6910ba529aa451e2f49138028bbcac","observation_id":"7b418895-d70c-429f-8039-3bd9628e4cd1","resolution":{"observed_at":"2026-08-01T06:05:51.360725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07813","last_updated":"2024-05-13T14:54:37Z","snapshot_observed_at":"2026-08-18T04:24:50.711366Z","submitted_at":"2024-05-13T14:54:37Z","title":"Localizing Task Information for Improved Model Merging and Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07813","snapshot_observed_at":"2026-08-01T06:05:51.450484Z","title":"arXiv preprint arXiv:2405.07813 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.450484Z"},"links":{"cited_paper":"/paper/2405.07813","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:5da2a8b7289186ac33ae5c0d356cafaa56645a6b913ec3ec66c3315926e4f120","observation_id":"f922df50-1310-4fa8-b722-27139009b60d","resolution":{"observed_at":"2026-08-01T06:05:51.450484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04089","last_updated":"2023-03-31T15:27:01Z","snapshot_observed_at":"2026-08-13T03:27:01.609831Z","submitted_at":"2022-12-08T05:50:53Z","title":"Editing Models with Task Arithmetic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04089","snapshot_observed_at":"2026-08-01T06:05:51.545110Z","title":"arXiv preprint arXiv:2212.04089 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.545110Z"},"links":{"cited_paper":"/paper/2212.04089","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:a8b752f609eaeef0b31b256975f8c34515091ffc79d7e7dd3be119024ad2d8ee","observation_id":"330bba0e-8871-492f-9b5d-fc9777e42ef2","resolution":{"observed_at":"2026-08-01T06:05:51.545110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.611131Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.611131Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:5933aea768f1c9b7d71d72cd65d3d06c99f7b9ff0d7011045861e93de27ebbb9","observation_id":"1cb4f1ea-e9e8-411b-88ca-0dfa8d6fa693","resolution":{"observed_at":"2026-08-01T06:05:51.611131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.692740Z","title":"CoRR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.692740Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:430f5d5fc5f80da2f3997353ecd00c517f5661bf99c256a0961b1b6143c91673","observation_id":"73ca2799-01a8-48bb-b3bc-684b08ba91ab","resolution":{"observed_at":"2026-08-01T06:05:51.692740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.785211Z","title":"Proceedings of the 37th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.785211Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:9ff3fe4b2f5c8d7284b7209e29f8e33dd0aa47bd3b62f8a6a9f144c2d14e5fe1","observation_id":"6a5ad21e-3b0c-40e4-8253-59daa9f39861","resolution":{"observed_at":"2026-08-01T06:05:51.785211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.882767Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.882767Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:db89e71e16dc6dc5f972f1a4d0c461c0ccc3eacd95acfafbad469cfee014ed9f","observation_id":"d2df20c7-9f9d-4056-ad92-3013b647cf6c","resolution":{"observed_at":"2026-08-01T06:05:51.882767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:51.972422Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:51.972422Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:ea04dbe68622913a92be6dd3c123bf483d4d064c48e7744ff99cd00f7a2c8374","observation_id":"d95b9602-bc6d-4bf9-a478-c70af074dc7d","resolution":{"observed_at":"2026-08-01T06:05:51.972422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.02312","last_updated":"2020-01-07T23:13:35Z","snapshot_observed_at":"2026-08-14T00:44:14.500200Z","submitted_at":"2020-01-07T23:13:35Z","title":"Stochastic Weight Averaging in Parallel: Large-Batch Training that Generalizes Well","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.02312","snapshot_observed_at":"2026-08-01T06:05:52.045668Z","title":"arXiv preprint arXiv:2001.02312 , year=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.045668Z"},"links":{"cited_paper":"/paper/2001.02312","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:f7c757ac101b6be6752371d7bc995113429546effd5c3f92b290dc1e729986e2","observation_id":"36ad303a-b79b-4d0a-8c7a-dbc9a0f9ba00","resolution":{"observed_at":"2026-08-01T06:05:52.045668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-08-14T19:36:09.254749Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-01T06:05:52.157845Z","title":"arXiv preprint arXiv:1803.05407 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.157845Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:96062429c066ae40df32bd4402bfbc747567cbb4c43dd83f0802e461b524d710","observation_id":"2e7ef861-5da1-4dbb-a1ae-de08a76279e6","resolution":{"observed_at":"2026-08-01T06:05:52.157845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:52.270205Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.270205Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:84f60a1eaf11f961ce8d7e6e03737c560ef407c3b63740b23f9e341557819208","observation_id":"1ccd4d0a-8f7e-46c9-83fa-f71d8067c776","resolution":{"observed_at":"2026-08-01T06:05:52.270205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:52.349286Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.349286Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:9197fc25c136a7788a33c7df7a44b4020c51a2757cb926cb0f747de1f52dd042","observation_id":"bdc050b0-793e-4fee-b393-20f2cec1c38f","resolution":{"observed_at":"2026-08-01T06:05:52.349286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:52.478738Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.478738Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:0cde15c7f9f0f4d2c3a5b57f8f856e8d0b24e20f5d6105609caea8679f625169","observation_id":"fe2d2787-6c12-4964-86b5-6f04b1ba715f","resolution":{"observed_at":"2026-08-01T06:05:52.478738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-16T14:57:46.371369Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-01T06:05:52.644358Z","title":"arXiv preprint arXiv:2309.14316 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.644358Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:16b420565dd1b915df8cf12f68d8c50c55684e2dcccce3e51c574a472c2b58f3","observation_id":"eba78512-6d08-45be-ac40-6aad70068da7","resolution":{"observed_at":"2026-08-01T06:05:52.644358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20311","last_updated":"2024-07-29T17:52:40Z","snapshot_observed_at":"2026-08-16T13:30:08.098351Z","submitted_at":"2024-07-29T17:52:40Z","title":"Physics of Language Models: Part 2.1, Grade-School Math and the Hidden Reasoning Process","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20311","snapshot_observed_at":"2026-08-01T06:05:52.779108Z","title":"arXiv preprint arXiv:2407.20311 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.779108Z"},"links":{"cited_paper":"/paper/2407.20311","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:587473febc7d4d2704e1f19e04967944fcdd98d34e43e1a0f7f3eb9fbfb961fb","observation_id":"f95dbf6d-fb09-494e-91e7-48e4c24f91b3","resolution":{"observed_at":"2026-08-01T06:05:52.779108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01769","last_updated":"2024-10-03T15:30:12Z","snapshot_observed_at":"2026-08-16T13:13:15.747030Z","submitted_at":"2024-10-02T17:25:37Z","title":"Quantifying Generalization Complexity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01769","snapshot_observed_at":"2026-08-01T06:05:52.898913Z","title":"arXiv preprint arXiv:2410.01769 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.898913Z"},"links":{"cited_paper":"/paper/2410.01769","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:c960c597de052abdc404451ddaacb286cdad2f8e3eb699d4ed8979a09ac5dd4f","observation_id":"8410c22e-4d1f-4afb-8801-971b92b1665a","resolution":{"observed_at":"2026-08-01T06:05:52.898913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:53.015855Z","title":"What Do Learning Dynamics Reveal About Generalization in","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.015855Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:36100bc9e6bdc4047828b0f06dff5add62128eeca4a51d0fdab844ca955c6861","observation_id":"ada029d9-5956-4296-b492-854d8deec6a9","resolution":{"observed_at":"2026-08-01T06:05:53.015855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-16T13:34:16.091068Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-01T06:05:53.145003Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.145003Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:65a91fc9bb0916677f59b2f3f86d9bee68364be4b466cd3744de89d467184561","observation_id":"8d174774-00f0-4a18-81b0-4d95a0f5b50f","resolution":{"observed_at":"2026-08-01T06:05:53.145003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03793","last_updated":"2025-05-31T16:36:42Z","snapshot_observed_at":"2026-08-16T20:04:43.467541Z","submitted_at":"2025-05-01T15:07:32Z","title":"LENSLLM: Unveiling Fine-Tuning Dynamics for LLM Selection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03793","snapshot_observed_at":"2026-08-01T06:05:53.307070Z","title":"arXiv preprint arXiv:2505.03793 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.307070Z"},"links":{"cited_paper":"/paper/2505.03793","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:2260857861d5b3ecb2e21152d1297f5ee676b011fdfe8672f553ba67a88ac878","observation_id":"9c45545e-a2ef-40c8-9486-a68a0ee71104","resolution":{"observed_at":"2026-08-01T06:05:53.307070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-01T06:05:53.493883Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.493883Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:2bc7a1b5952701db43b11885f338fad0d130977d1b8a94bd16991577dc16b697","observation_id":"0039bceb-7ca8-4543-810c-7dab9bbb038d","resolution":{"observed_at":"2026-08-01T06:05:53.493883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-01T06:05:53.649795Z","title":"arXiv preprint arXiv:2407.10671 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.649795Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:87c92b46f127588e57434b48538c27dc1df8fdc30cc52d53012dc686935b50eb","observation_id":"c5ab4e4f-956a-49c1-8193-2a5a81bcd3f6","resolution":{"observed_at":"2026-08-01T06:05:53.649795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T06:05:53.797517Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.797517Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:fca92bcd76ec01de98c5325f058a482b11d274ca40b19569dc18eddb1c131742","observation_id":"13bda98a-2068-4c54-9b5b-2a6eff05ba0e","resolution":{"observed_at":"2026-08-01T06:05:53.797517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:53.945679Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.945679Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:b32f7a03aba2d1bc65626eb1906c02afbf6cce4b84848999588d5df58f3b9840","observation_id":"860dfd0c-aa4f-437f-b169-48b90016f0d5","resolution":{"observed_at":"2026-08-01T06:05:53.945679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:54.079866Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.079866Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:ab2e69c30665ef864b40744a623af1e759e34791843ecaccceb067bbdfdaabba","observation_id":"ee0de622-a589-479a-9897-857dc1eaf2fe","resolution":{"observed_at":"2026-08-01T06:05:54.079866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-14T06:11:14.515796Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-01T06:05:54.217980Z","title":"arXiv preprint arXiv:2109.01652 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.217980Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:8dd25d33600a581c88f7c83b1086b465150f017c42353d0070eb65766f93e2bb","observation_id":"6c59b6a9-bcd0-4949-9abc-fa4a61093e0e","resolution":{"observed_at":"2026-08-01T06:05:54.217980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-01T06:05:54.341994Z","title":"arXiv preprint arXiv:2501.12948 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.341994Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:aceacfb1224af1fb7cae9114f88450726c037668ee56506718dac88bae580261","observation_id":"5cca6af8-8e2f-481a-9d71-b09c7b5bdc7b","resolution":{"observed_at":"2026-08-01T06:05:54.341994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:54.459435Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.459435Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:5e7398771d6f94196dc9c6aba77bc43ee81517c70a9b683c3662b79010f1b12d","observation_id":"289fac9f-adec-40e9-bda5-d53a408cb475","resolution":{"observed_at":"2026-08-01T06:05:54.459435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14740","last_updated":"2024-02-26T18:26:25Z","snapshot_observed_at":"2026-08-09T14:30:33.899591Z","submitted_at":"2024-02-22T17:52:34Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14740","snapshot_observed_at":"2026-08-01T06:05:54.590344Z","title":"arXiv preprint arXiv:2402.14740 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.590344Z"},"links":{"cited_paper":"/paper/2402.14740","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:334d6f19b16cc198a3e363852b8cd2b88f0dc9161e594f2e263ee2a409b62cdf","observation_id":"393c9667-0dc0-40b9-a3c5-b2b3eb581052","resolution":{"observed_at":"2026-08-01T06:05:54.590344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:54.699696Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.699696Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:20385fe6425550c8dfa1ce4505f8d8e0d9a21b762af9634a5a42fbcea42373cc","observation_id":"5ef39d0b-de10-4c80-8a42-7803ad3f8a02","resolution":{"observed_at":"2026-08-01T06:05:54.699696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:54.779974Z","title":"OpenMathInstruct-2: Accelerating","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.779974Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:0036996fd574afdebb20af7f0be51bb43d623564785dc15a4c21c37941872826","observation_id":"b5a338d5-78b6-4df5-8d1f-c4f448739518","resolution":{"observed_at":"2026-08-01T06:05:54.779974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:54.862550Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.862550Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:82f1c3e33c1818e9f96c1202393ecf3d288ad23d1a6d53b27cf0109227559cf2","observation_id":"dfd607cb-0c88-4f38-8e07-97e40981afa2","resolution":{"observed_at":"2026-08-01T06:05:54.862550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:54.941987Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:54.941987Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:c7f73c1f935a65fd51226db30b937a4f5784fce7d13bf8b4822e2340910c33d4","observation_id":"ff3e786a-dbbe-4583-ba20-1f3a46ef4e31","resolution":{"observed_at":"2026-08-01T06:05:54.941987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.014722Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.014722Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:1f0bac6493600584742ee6f6ba8b8286faa3cc100d45e3949398bc4c93b75d5b","observation_id":"aee9eb66-a38e-442b-9d76-1377c3f3a86d","resolution":{"observed_at":"2026-08-01T06:05:55.014722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.074436Z","title":"Task Arithmetic in the Tangent Space: Improved Editing of Pre-Trained Models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.074436Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:57d1d79c18ac9c5b70023d442d9572ec9a2781bc67f73c88e41e931e49e247ee","observation_id":"aefc9fb8-22aa-4dbd-a734-9a8300c869ae","resolution":{"observed_at":"2026-08-01T06:05:55.074436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.183390Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.183390Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:6f0ba948f49605838b8c80b3ec1c275b085221ac59c594c0a3289abda393a6d2","observation_id":"75ad2fbc-9d9d-425d-8b97-92aa5aa0f55e","resolution":{"observed_at":"2026-08-01T06:05:55.183390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.252357Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.252357Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:093e5fbf392ed8c3f79afcd278cc86c15cadbb4e2d454cb0f2c2bd7fbf08d29b","observation_id":"48f3d2d1-e1bb-4bd6-8c52-d857553e2209","resolution":{"observed_at":"2026-08-01T06:05:55.252357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.306197Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.306197Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:4db43a10d125f6ab130f5b8f54fd8a9039194d792acc7ea3f7bbe8bf78c488b4","observation_id":"ccb72ada-c4f4-4ccc-b483-0c24275cf065","resolution":{"observed_at":"2026-08-01T06:05:55.306197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.358950Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.358950Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:c2fc5bb49ddcc139e2e8f1e50306e276948d148c781c07ebf936578fda716cf3","observation_id":"31a7bb4d-1880-4c07-8812-cdb6046d06c3","resolution":{"observed_at":"2026-08-01T06:05:55.358950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.417129Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.417129Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:d0bc648eca122cec48b3667b098f9c21fc2c381a4b9bd41ce6af093877259cc1","observation_id":"9d250c81-b5a6-4022-8457-38e443c31451","resolution":{"observed_at":"2026-08-01T06:05:55.417129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-01T06:05:55.461374Z","title":"arXiv preprint arXiv:2110.14168 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.461374Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:4ccd80c9c4d9d1b64c6376aa846f2d8f7cd1fb0de009c56a3b4f36368eb2729a","observation_id":"86811cc8-cee8-48c1-90f7-4c1174670e06","resolution":{"observed_at":"2026-08-01T06:05:55.461374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-01T06:05:55.547079Z","title":"arXiv preprint arXiv:2103.03874 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.547079Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:5effb22228cbd0c77008af6e7ec5bd92715cd6afc75b9d7d3a21e75bac920a5c","observation_id":"70ecba10-f1c2-4b66-af57-e1ee0195f5f5","resolution":{"observed_at":"2026-08-01T06:05:55.547079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:55.645993Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.645993Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:20c3689e0b39fd4f6c9c8b1cd0a460f5cd17b254ac4032a0ffd2edfc9764808b","observation_id":"0990f357-14a0-4e75-9ded-59ffb584d99f","resolution":{"observed_at":"2026-08-01T06:05:55.645993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-01T06:05:55.706544Z","title":"arXiv preprint arXiv:2107.03374 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.706544Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:b90c85b6341996a105d476fb9d25da5c476caebebd8bdfad05f702ba58331019","observation_id":"4f422ead-f77e-4181-8a04-ac6c9be17d8c","resolution":{"observed_at":"2026-08-01T06:05:55.706544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-01T06:05:55.761293Z","title":"arXiv preprint arXiv:2108.07732 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.761293Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:c92df2fb4f7b68ec9f67970b428fe0e18f1e8f7c8f467eeb71c206739f316e58","observation_id":"178880e9-0e33-4808-ac40-d6bd2bbb36ba","resolution":{"observed_at":"2026-08-01T06:05:55.761293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-01T06:05:55.817624Z","title":"arXiv preprint arXiv:2406.19314 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.817624Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:2fee0eeb49de83d3b2bd1151b0051ec4de6e7d126bb3aed54b3e127c8a3b4f80","observation_id":"27bedb12-c561-4d34-ae58-f2ff13ef687c","resolution":{"observed_at":"2026-08-01T06:05:55.817624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-01T06:05:55.864631Z","title":"arXiv preprint arXiv:2311.07911 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.864631Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:0d432d686cad1fc2cedfdb33751afebfd80a2abf3e24d5c760b3c89a7586f18a","observation_id":"a921cb4f-312a-485d-929e-12d7307e61a9","resolution":{"observed_at":"2026-08-01T06:05:55.864631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23123","last_updated":"2025-03-04T06:22:40Z","snapshot_observed_at":"2026-08-16T13:04:30.008201Z","submitted_at":"2024-10-30T15:31:54Z","title":"On Memorization of Large Language Models in Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23123","snapshot_observed_at":"2026-08-01T06:05:55.977186Z","title":"arXiv preprint arXiv:2410.23123 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:55.977186Z"},"links":{"cited_paper":"/paper/2410.23123","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:cbf8e068b8604e1345ff4ea6bfeb6a899bd689b1197348156acc20239d65d5de","observation_id":"a6e792da-d85f-4ec4-a1e1-f9b8abf76e23","resolution":{"observed_at":"2026-08-01T06:05:55.977186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:56.045853Z","title":"Cognition , volume=","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.045853Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:d52f5844c5cfc2348a6afe2578dadb9e67a93666c0236fa725de94c07454d658","observation_id":"5b09b0ec-445a-4e4d-bceb-ee6aa0d1ac27","resolution":{"observed_at":"2026-08-01T06:05:56.045853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15698","last_updated":"2023-09-27T14:40:12Z","snapshot_observed_at":"2026-08-16T14:57:10.140230Z","submitted_at":"2023-09-27T14:40:12Z","title":"Deep Model Fusion: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15698","snapshot_observed_at":"2026-08-01T06:05:56.106373Z","title":"arXiv preprint arXiv:2309.15698 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.106373Z"},"links":{"cited_paper":"/paper/2309.15698","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:39275762b94496c7172c3499772fc320a59285375d02e6e7f978edd8d3ae4c80","observation_id":"1b20e4f6-8b79-4467-b31f-5c236c4a2124","resolution":{"observed_at":"2026-08-01T06:05:56.106373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18036","last_updated":"2026-04-22T02:19:48Z","snapshot_observed_at":"2026-08-13T12:55:19.647806Z","submitted_at":"2025-02-25T09:48:53Z","title":"Harnessing Multiple Large Language Models: A Survey on LLM Ensemble","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18036","snapshot_observed_at":"2026-08-01T06:05:56.168066Z","title":"arXiv preprint arXiv:2502.18036 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.168066Z"},"links":{"cited_paper":"/paper/2502.18036","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:d114e5e1edada3bf343ff8558fac17b6caa0dde76e8a0a0b3f74be4664ca8ea0","observation_id":"aa51fb11-6c49-409d-a388-9808d598f494","resolution":{"observed_at":"2026-08-01T06:05:56.168066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-08-18T04:26:49.778619Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-01T06:05:56.227896Z","title":"arXiv preprint arXiv:2405.11143 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.227896Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:9670156cc13235d901b3d6b1c17859041a5a838c80faa00d9ea91129df0ad8e6","observation_id":"33ec3258-ecfc-4de7-afad-2a9cd95bd552","resolution":{"observed_at":"2026-08-01T06:05:56.227896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:56.277500Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.277500Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:1136095ea1d146fff5f35ae49db9f768ffb9761020c192053af898eb07db966e","observation_id":"9b8ec3cb-9dd7-491f-aacc-6d3a592d5584","resolution":{"observed_at":"2026-08-01T06:05:56.277500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:56.337527Z","title":"SIAM Journal on Control and Optimization , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.337527Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:c5f8856f05f7732bdb28796655063f30c44e85de9acf60facb2e61d1bb2fc08d","observation_id":"7dc1f821-79c0-4fda-ad59-cdd3b72ac956","resolution":{"observed_at":"2026-08-01T06:05:56.337527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:56.394682Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.394682Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:70fe673b60b44dcd1a44ab63cb6be07ada9edf6625529cf43e04c8b6fc798eb1","observation_id":"017fb786-f91a-4607-86f9-d9a8c3c0b37f","resolution":{"observed_at":"2026-08-01T06:05:56.394682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T06:05:56.454645Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.454645Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:e954a05723fce5e7975b6b35c299ee1adece760feadf2b888db336fd1c391283","observation_id":"e1d0c07b-05c0-4ab3-aa57-3f22d4103419","resolution":{"observed_at":"2026-08-01T06:05:56.454645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:56.514358Z","title":"arXiv preprint arXiv:2505.11711 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.514358Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:a38d3f087455e1977fe94e3605778a9b26ad7e467856c97f8c8b2912704df917","observation_id":"fb1e3dc4-9fbc-4a3a-ab7a-8b88034e80b2","resolution":{"observed_at":"2026-08-01T06:05:56.514358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04259","last_updated":"2025-09-04T14:38:08Z","snapshot_observed_at":"2026-08-16T22:58:22.322439Z","submitted_at":"2025-09-04T14:38:08Z","title":"RL's Razor: Why Online Reinforcement Learning Forgets Less","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04259","snapshot_observed_at":"2026-08-01T06:05:56.617121Z","title":"arXiv preprint arXiv:2509.04259 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.617121Z"},"links":{"cited_paper":"/paper/2509.04259","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:f228197daa748dcba12b24ba3b60347df6f58650a344018ed6d139a3a2aeb1d7","observation_id":"2c7d888f-4d85-4092-bf1f-e17bf16d2b21","resolution":{"observed_at":"2026-08-01T06:05:56.617121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06089","last_updated":"2024-07-08T16:29:08Z","snapshot_observed_at":"2026-08-18T00:42:07.586569Z","submitted_at":"2024-07-08T16:29:08Z","title":"Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06089","snapshot_observed_at":"2026-08-01T06:05:56.733057Z","title":"arXiv preprint arXiv:2407.06089 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.733057Z"},"links":{"cited_paper":"/paper/2407.06089","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:00624f8ab79b19ecec2cc9c0c42a53c9063d07ed497768561e514eeddec75b1d","observation_id":"9f4e1571-7c45-4938-975c-b37406cd49b7","resolution":{"observed_at":"2026-08-01T06:05:56.733057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08998","last_updated":"2025-03-12T02:17:31Z","snapshot_observed_at":"2026-08-17T14:54:29.713551Z","submitted_at":"2025-03-12T02:17:31Z","title":"From Task-Specific Models to Unified Systems: A Review of Model Merging Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08998","snapshot_observed_at":"2026-08-01T06:05:56.852664Z","title":"arXiv preprint arXiv:2503.08998 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.852664Z"},"links":{"cited_paper":"/paper/2503.08998","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:703f2d2f8c6770b9935766494b1bec6efb4e2707d8b44ef86d0fae36e51ba4e4","observation_id":"5f866290-39fb-4028-a590-e8b6045638d9","resolution":{"observed_at":"2026-08-01T06:05:56.852664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:56.922707Z","title":"IEEE Transactions on Audio, Speech and Language Processing , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:56.922707Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:53f15ed5002570cb834ac5ae2a84070b3ea55f2b5df476260835b4fd3e8ec83e","observation_id":"353ff426-3008-421c-96a3-fe515b25796b","resolution":{"observed_at":"2026-08-01T06:05:56.922707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08425","last_updated":"2025-07-11T09:11:18Z","snapshot_observed_at":"2026-08-16T11:15:48.987642Z","submitted_at":"2025-07-11T09:11:18Z","title":"A Survey of Large Language Models in Discipline-specific Research: Challenges, Methods and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.08425","snapshot_observed_at":"2026-08-01T06:05:57.027679Z","title":"arXiv preprint arXiv:2507.08425 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:57.027679Z"},"links":{"cited_paper":"/paper/2507.08425","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:83a9195d6f36f9a4c987454a8f9666451805dc4f56fd2030899ca5a43c95ebb0","observation_id":"7bd55e0c-8d90-4bf8-9b89-3332c8fa6972","resolution":{"observed_at":"2026-08-01T06:05:57.027679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:57.092765Z","title":"arXiv preprint arXiv:2510.02272 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:57.092765Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:b5763dd81bf186f7a4ac3d6e6833abb93b5b40793356ad2a826dd887e6980e39","observation_id":"8dec89af-8356-4972-9a06-3254e02abaf1","resolution":{"observed_at":"2026-08-01T06:05:57.092765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:05:57.170198Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:57.170198Z"},"links":{"citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:2b582eec77c27df6f5ac23169dee919c1a3835296cc69847ee3226b8e9603de6","observation_id":"a41194b2-bd5b-4055-bc08-edffbdadf414","resolution":{"observed_at":"2026-08-01T06:05:57.170198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T05:15:09.557071Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2607.22039."}