{"as_of":"2026-08-17T22:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:228e65c3c1082c984f01ce68fedf8b2c2bc384c648b7e1c11c1df09d6a8ae8a0","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:57:06.700921Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.17023/citation-record","integrity":"/paper/2412.17023/integrity","json":"/paper/2412.17023/citation-record.json","paper":"/paper/2412.17023"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.13187","last_updated":"2025-01-27T10:19:44Z","snapshot_observed_at":"2026-08-16T14:08:13.299258Z","submitted_at":"2024-03-19T22:56:53Z","title":"Evolutionary Optimization of Model Merging Recipes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13187","snapshot_observed_at":"2026-08-11T05:57:06.535460Z","title":"Evolutionary optimization of model merging recipes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.535460Z"},"links":{"cited_paper":"/paper/2403.13187","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:833293cd49ed645d4c41ec998b106f764fb382d15d1e475b51ee3108b5e31683","observation_id":"535f30fa-205c-4392-ba4e-a0b968f537c5","resolution":{"observed_at":"2026-08-11T05:57:06.535460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.164113Z","title":"Multitask learning","venue":null,"work_id":"f019e3f1-f984-490f-b706-74bf948e76ca","year":1997},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.540844Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:0d24ad7104639651f8118d717a9c4060824df232d458895aa66f5ee6c8d60698","observation_id":"080af17f-f475-4361-8df0-d23bc8e23449","resolution":{"observed_at":"2026-08-11T05:57:07.167875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.154485Z","title":"Remote sensing image scene classification: Benchmark and state of the art","venue":null,"work_id":"83d49598-35eb-46ef-be83-e6c700fbb913","year":2017},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.544875Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:45a62a4110bba463d9c58e5f23997cb83cab5d2f116aa0ad9fdbe718bd6fcf4d","observation_id":"47d7ce49-9a41-40ac-a9aa-6435626ee817","resolution":{"observed_at":"2026-08-11T05:57:07.158141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.548954Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.548954Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:9be8193965b282b7e6319bfedaf60af9b097226a7c104b6847a42930aa0925ec","observation_id":"c51a200a-1cb6-4fce-88f5-e023336a029a","resolution":{"observed_at":"2026-08-11T05:57:06.548954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06795","last_updated":"2024-08-10T00:02:00Z","snapshot_observed_at":"2026-08-16T14:35:44.139362Z","submitted_at":"2023-12-11T19:10:55Z","title":"Model Breadcrumbs: Scaling Multi-Task Model Merging with Sparse Masks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06795","snapshot_observed_at":"2026-08-11T05:57:06.552657Z","title":"Model breadcrumbs: Scaling multi-task model merging with sparse masks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.552657Z"},"links":{"cited_paper":"/paper/2312.06795","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:3d3ce34327cc2a572395e650d7f877fc732b12e48b927dfce981633b6addeb14","observation_id":"58679a11-012f-4924-92d2-53407bb12543","resolution":{"observed_at":"2026-08-11T05:57:06.552657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.139350Z","title":"Pareto manifold learning: Tackling multiple tasks via ensembles of single-task models","venue":null,"work_id":"5d66bbb0-9e64-4765-a036-d8870c9d9196","year":null},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.556280Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:292fc981f80c2480525c7fda2ab94aa313bc9023d516b9b855899bd23abb4737","observation_id":"683fdb23-d5b3-4ca7-b8b8-e994b5cf7150","resolution":{"observed_at":"2026-08-11T05:57:07.142600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.559455Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.559455Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:625001bc829d1882acf64e9168e213dca66fa8fce440e6f6138a0338e7ccabb1","observation_id":"5cff9c83-4e38-4ba5-ad86-e55e38734d61","resolution":{"observed_at":"2026-08-11T05:57:06.559455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.124922Z","title":"Essentially no barriers in neural network energy landscape","venue":null,"work_id":"17c48fdc-4af1-49b3-8fc4-647e1c55d63c","year":2018},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.562820Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:57f3d787d66e737a6061dd54d33efc23b9117da0b31463e0f715685f23db75e9","observation_id":"66b180cb-2d54-4825-b801-b5a90bf4af09","resolution":{"observed_at":"2026-08-11T05:57:07.128241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01412","last_updated":"2021-04-29T16:44:25Z","snapshot_observed_at":"2026-08-15T12:34:14.131778Z","submitted_at":"2020-10-03T19:02:10Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01412","snapshot_observed_at":"2026-08-11T05:57:06.565762Z","title":"Sharpness-aware minimization for efficiently improving generalization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.565762Z"},"links":{"cited_paper":"/paper/2010.01412","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:d7089b8bdeec7676b1eedd3b030b3bcff6302a47ec6aabb9ecbc9af76f0c58ac","observation_id":"8c289baa-8c2a-481f-8b4b-617096275ce9","resolution":{"observed_at":"2026-08-11T05:57:06.565762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.115476Z","title":"Linear mode connectivity and the lottery ticket hypothesis","venue":null,"work_id":"fb4d60c7-cd89-4981-99ef-72fd374863d7","year":2020},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.569085Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:53d4512839bdfeeef2d0a4a0c9bc805724a163602b95c28d8bfe91676f767b58","observation_id":"d649154c-1de9-4e80-a293-fec34b263b70","resolution":{"observed_at":"2026-08-11T05:57:07.119010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.105506Z","title":"Loss sur- faces, mode connectivity, and fast ensembling of dnns","venue":null,"work_id":"06182abb-379c-4b90-9c68-904f8321f5a6","year":2018},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.572790Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:21e417a02f3463f078e8d858b19f61c58cb2df4da9f0b114e13fc1f48a6c6a54","observation_id":"ef07292e-2d54-497f-a753-5296e66c5a93","resolution":{"observed_at":"2026-08-11T05:57:07.109546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-17T18:27:55.545560Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-11T05:57:06.577402Z","title":"Arcee’s mergekit: A toolkit for merging large language mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.577402Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:0ba3b4412347cbe1df20047f8ef0562f27f27d397345097c46e8743440621475","observation_id":"efff6bbb-86ca-4724-9b0d-1fc748a7bab3","resolution":{"observed_at":"2026-08-11T05:57:06.577402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.096203Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover clas- sification","venue":null,"work_id":"ad5116aa-dbc6-4168-9ab9-c0bb7c7937d4","year":2019},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.581113Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:025ac26b4b8ade6b6c5c8dcf612eeeae554c9af3242aecfb82d0c47d609e6bf8","observation_id":"10ef56c0-e660-47c1-b3a3-b85dc1467c60","resolution":{"observed_at":"2026-08-11T05:57:07.099185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.088117Z","title":"Editing models with task arithmetic","venue":null,"work_id":"110bd6c8-6515-4ef1-8d56-7e1f3ace7a5a","year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.584336Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:59fa841aa52a99710d5466f4ca3e6461206a8eb092f17ce01cfec451dc38bd5b","observation_id":"233059b0-5a37-4f1a-86b0-ec80309ecf19","resolution":{"observed_at":"2026-08-11T05:57:07.090913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.079572Z","title":"Patching open-vocabulary models by interpolating weights","venue":null,"work_id":"50592bbc-8214-44f3-b472-30374762dbe2","year":2022},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.587645Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:64a8ddb260cadb7e07dc42ae8bdfa16e2bece7231965733841990ef8ee461c22","observation_id":"2ad29394-4fa0-494a-a2f9-e33a6ab3c8d7","resolution":{"observed_at":"2026-08-11T05:57:07.082628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.070293Z","title":"Garipov, D","venue":null,"work_id":"b3c61f6f-c83a-44d7-8064-7fbafa0badc7","year":2018},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.591022Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:a4bf00f08cb0a32f08f6517ee874457bee491d0468e425ce36975ae76691f7da","observation_id":"9fbfbcb2-6e39-4c32-bd08-dfdf10dcc272","resolution":{"observed_at":"2026-08-11T05:57:07.073567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09849","last_updated":"2025-05-21T23:53:00Z","snapshot_observed_at":"2026-08-16T16:07:30.940052Z","submitted_at":"2022-12-19T20:46:43Z","title":"Dataless Knowledge Fusion by Merging Weights of Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09849","snapshot_observed_at":"2026-08-11T05:57:06.594291Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.594291Z"},"links":{"cited_paper":"/paper/2212.09849","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:564b6bac836418eef86397836868df9ffb18947ed105ce43620d078b76669f30","observation_id":"360414f8-f989-47d7-9207-5244ac4e061b","resolution":{"observed_at":"2026-08-11T05:57:06.594291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.060559Z","title":"3d object representations for fine-grained catego- rization","venue":null,"work_id":"6df6406d-28ec-4a69-a6fe-06916a5c9871","year":2013},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.598089Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:adc4846445db6654881d81fed238aea10b75af46fc38e9d7af80bb933630cab1","observation_id":"bb3e6940-208e-4b1b-811e-9d55da2e5422","resolution":{"observed_at":"2026-08-11T05:57:07.064276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.601579Z","title":"The mnist database of handwritten digits","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.601579Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:391f3c6f6edf93a948a9a2f51d7b75382a21dc31ac920fdb9ec335614cf4a3ca","observation_id":"0ca3b0e6-2cd4-4764-9b1c-4677dd1f77b8","resolution":{"observed_at":"2026-08-11T05:57:06.601579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15698","last_updated":"2023-09-27T14:40:12Z","snapshot_observed_at":"2026-08-16T14:57:10.140230Z","submitted_at":"2023-09-27T14:40:12Z","title":"Deep Model Fusion: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15698","snapshot_observed_at":"2026-08-11T05:57:06.605206Z","title":"Deep model fusion: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.605206Z"},"links":{"cited_paper":"/paper/2309.15698","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:f17ccca8edeb4f83b3aa2bd489edb011b25a1155cc2ac1a15ef33684e3569e43","observation_id":"b43e8baf-5886-49c7-bc1a-e615dfe8d172","resolution":{"observed_at":"2026-08-11T05:57:06.605206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.045415Z","title":"Kobyzev, Mehdi Rezagholizadeh, Ahmad Rashid, A","venue":null,"work_id":"e172dfed-edc3-41fb-a263-e49308de64cc","year":2022},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.609061Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:404b690b54219e51738ef79a05862f862b6b12fa8eb80c4f2514be65524d606d","observation_id":"76aec5c7-1376-4009-9d29-7eebecb986f0","resolution":{"observed_at":"2026-08-11T05:57:07.048889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.035154Z","title":"Magmax: Leveraging model merging for seamless continual learning","venue":null,"work_id":"14cb7ea5-2f73-4a84-b9eb-6977b327c520","year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.612784Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:c2317fc83ef11673bce9a4fcd316b848de14868875b91d3687bcf99d94f48467","observation_id":"854902bb-7784-40d5-b53f-1b2d41a6cedc","resolution":{"observed_at":"2026-08-11T05:57:07.039224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.025301Z","title":"Reading digits in natural images with unsupervised feature learning","venue":null,"work_id":"491ee4ac-6958-4cc5-9a17-c22c6b92b39f","year":2011},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.616248Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:fbc4becb06dbe139162687f8716570e8bb4cc9ac78a03176eefce9ce445bea05","observation_id":"d5db3b08-3a12-426e-9247-d20b8acf2b49","resolution":{"observed_at":"2026-08-11T05:57:07.029055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.014552Z","title":"What is being transferred in transfer learn- ing? Advances in neural information processing sys- tems, 33:512–523, 2020","venue":null,"work_id":"ed871df3-62a9-4967-9f6d-03344b662180","year":2020},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.619486Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:5cbe3855e1dbdf4310b9c6646167aa9c54dc17b9609a1628914eff24882f2225","observation_id":"527c1dfc-a6bd-4ef8-9d2d-be958dcec800","resolution":{"observed_at":"2026-08-11T05:57:07.018639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:07.004664Z","title":"Task arithmetic in the tangent space: Improved editing of pre-trained models","venue":null,"work_id":"b179c254-3ff5-4be3-a114-f7aa9ded7e7b","year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.623154Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:bf70add067582d04ccce618fb3f1acd3a290908e8fcb8919200cd7fae4d05db7","observation_id":"51a31bbe-00dc-4297-8296-aa4c530dbb7b","resolution":{"observed_at":"2026-08-11T05:57:07.008487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.996107Z","title":"Learning transferable visual models from natural lan- guage supervision","venue":null,"work_id":"39defb6e-d19c-4d75-965a-007a9af4ef31","year":2021},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.626491Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:c3edad2331e46df2d68887385fe05a070771c54c66a418c3800460e5aa01a4b4","observation_id":"405233b7-88b1-425d-9243-52b9c288e576","resolution":{"observed_at":"2026-08-11T05:57:06.998878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.988311Z","title":"Model ratatouille: Recycling diverse models for out- of-distribution generalization","venue":null,"work_id":"037b6891-081d-4751-93b8-7b6eb19ab295","year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.629882Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:f990faff936bf793132d6e4fdcb9fc99e9f3d1ce1cc179b46dbab055b4fcd7d1","observation_id":"d7a5e94a-03ea-44f5-816a-da64341bd18a","resolution":{"observed_at":"2026-08-11T05:57:06.991210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.980203Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine- tuned on diverse rewards","venue":null,"work_id":"54e38363-318a-480c-8aa7-f7321cfeadf9","year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.633497Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:6116c32536ed5d9ea6261acbb7fff852d73445a6752b6ab2ee69c87ccc5140b6","observation_id":"cafcf2d8-4e67-47e3-ae13-acb8f5458ed8","resolution":{"observed_at":"2026-08-11T05:57:06.983153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16768","last_updated":"2024-06-24T16:24:34Z","snapshot_observed_at":"2026-08-16T13:40:04.078262Z","submitted_at":"2024-06-24T16:24:34Z","title":"WARP: On the Benefits of Weight Averaged Rewarded Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16768","snapshot_observed_at":"2026-08-11T05:57:06.636580Z","title":"Warp: On the benefits of weight averaged rewarded policies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.636580Z"},"links":{"cited_paper":"/paper/2406.16768","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:9291dc9aff17c82fc015db46b48a2b8a7e8d42c212bfd12c155a0007230c0ca9","observation_id":"aead0e7d-5b5d-4a4e-9e6a-e63e1c18ff80","resolution":{"observed_at":"2026-08-11T05:57:06.636580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.971152Z","title":"Diverse weight averaging for out-of- distribution generalization","venue":null,"work_id":"f6804def-89f4-4e31-9793-8a8b0105002c","year":2022},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.640113Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:4bc7275ff1278cfcf6b16504d735b386b46a5785f64e4911b127ca2e4069d722","observation_id":"a65283e5-b91e-4252-8990-39a254f77f57","resolution":{"observed_at":"2026-08-11T05:57:06.974543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08207","last_updated":"2022-03-17T17:53:01Z","snapshot_observed_at":"2026-08-14T04:21:28.978034Z","submitted_at":"2021-10-15T17:08:57Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08207","snapshot_observed_at":"2026-08-11T05:57:06.643319Z","title":"Multitask prompted training enables zero-shot task generalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.643319Z"},"links":{"cited_paper":"/paper/2110.08207","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:2288e6c7f35f67de4e65cfe228ff2e047b87288e12688244d1d4e2ec00493ff3","observation_id":"4a89338e-a30e-4b1d-80e4-97465fa5a094","resolution":{"observed_at":"2026-08-11T05:57:06.643319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.961425Z","title":"The german traffic sign recognition benchmark: a multi-class classification competition","venue":null,"work_id":"5ca04dcb-09ac-4705-bc1e-420c840b5107","year":2011},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.647176Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:86e829cb12e52dd7a4af800d372ff9825cd356c46042db539199bbdd37cf61ec","observation_id":"e97e9bea-c59d-42cb-854f-8d2e365e92f7","resolution":{"observed_at":"2026-08-11T05:57:06.965385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.952362Z","title":"Weight averaging for neural net- works and local resampling schemes","venue":null,"work_id":"e1ab8951-92e1-44b5-8b53-11e16b880de9","year":1996},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.650409Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:2c489a9c3b8ec99c5d33cd6a9566e8758f781264625c76c08e13f643c57dacc8","observation_id":"e204957f-d249-41eb-b600-32c60c7acac1","resolution":{"observed_at":"2026-08-11T05:57:06.955845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.943053Z","title":"Multi-task learning for dense prediction tasks: A survey","venue":null,"work_id":"e9ea09f9-a424-4aa4-af87-e975487d9b9d","year":2021},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.653539Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:8b82be62cad95887f1fb0b249bac567bdb927e69b732072c6b206543893fb30a","observation_id":"e4c70447-db15-4e5f-aa09-c0488e34fb38","resolution":{"observed_at":"2026-08-11T05:57:06.946710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.933227Z","title":"Lo- calizing task information for improved model merging and compression","venue":null,"work_id":"5234730d-dc1c-4705-925d-0d132bf9c6ba","year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.656709Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:2bd53b18a6842719fee296826cb0c0f7a83676048e1ab21c06b931d406ca8b0d","observation_id":"191e95a1-f644-4f0e-a190-bafe910130b8","resolution":{"observed_at":"2026-08-11T05:57:06.936739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.922742Z","title":"Learning neural network subspaces","venue":null,"work_id":"138ad117-f88f-42e2-9fc2-51b73d61ed03","year":2021},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.660444Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:76ad9fe76c143d4f47dc719a8daaa56e950c147192b69205e0577d82915e40a7","observation_id":"20b067f5-70bb-47dc-85c8-f228f7ff8f03","resolution":{"observed_at":"2026-08-11T05:57:06.926683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.911455Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy with- out increasing inference time","venue":null,"work_id":"3f3f5550-4759-4e12-837e-2f43b5a31e1a","year":2022},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.663830Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:5954f6523013e22f863e2ab10f333a0e907927a470d09418da4eb78521bf1dc8","observation_id":"f84e9ed5-d113-486b-85f1-de0e6a5ee243","resolution":{"observed_at":"2026-08-11T05:57:06.915570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.899966Z","title":"Robust fine- tuning of zero-shot models","venue":null,"work_id":"1ca4b7a9-627b-42cb-b57e-35a663ef0dd0","year":2022},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.666697Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:dea5db40dd87d39d31a594f24bc7ce379e1255576db55bc0efc8498076c3b2bd","observation_id":"3def5264-35ba-4002-8729-f22b1faa65ef","resolution":{"observed_at":"2026-08-11T05:57:06.904545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.890332Z","title":"Under- standing and improving information transfer in multi- task learning","venue":null,"work_id":"e5a7ac62-af0a-4398-a63f-cb59ec857f05","year":2020},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.669476Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:c78e55283d37e48524a7d98dc4cd2e69fe63e5cb1ce152ec8b4f6c201a468211","observation_id":"24ed4d57-ebb3-40c0-9d28-47c7b5be15dc","resolution":{"observed_at":"2026-08-11T05:57:06.893489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03592","last_updated":"2024-05-22T17:52:31Z","snapshot_observed_at":"2026-08-16T14:03:33.898248Z","submitted_at":"2024-04-04T17:00:37Z","title":"ReFT: Representation Finetuning for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03592","snapshot_observed_at":"2026-08-11T05:57:06.672151Z","title":"Manning, and Christopher Potts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.672151Z"},"links":{"cited_paper":"/paper/2404.03592","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:7606b979823f39182bbc718df5d400fab67a7e69c0893df94bf586124afadfe4","observation_id":"6c1aea1e-464d-4acf-9b87-7e1bedf3fc7e","resolution":{"observed_at":"2026-08-11T05:57:06.672151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.881148Z","title":"Sun database: Explor- ing a large collection of scene categories","venue":null,"work_id":"ef35a96a-40e9-4451-9a32-5c77b712a951","year":2016},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.675117Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:10fdf0c4351f5a62968fb914d52a3e03ac9fa6c114c40ad42dbba1fd27103179","observation_id":"f292a39b-7ac4-416c-8b72-6c12233e9c41","resolution":{"observed_at":"2026-08-11T05:57:06.884365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13534","last_updated":"2023-12-08T16:45:22Z","snapshot_observed_at":"2026-08-16T14:41:05.977260Z","submitted_at":"2023-11-22T17:14:54Z","title":"LM-Cocktail: Resilient Tuning of Language Models via Model Merging","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13534","snapshot_observed_at":"2026-08-11T05:57:06.677794Z","title":"Lm-cocktail: Resilient tuning of language models via model merging","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.677794Z"},"links":{"cited_paper":"/paper/2311.13534","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:4c74033d5174f2079413947d98273c5df2126ca3e6b7cbebfc2f9ed6855649cb","observation_id":"00623323-3a15-4431-9b1e-48072d4d569f","resolution":{"observed_at":"2026-08-11T05:57:06.677794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.870747Z","title":"TIES-merging: Resolving interference when merging models","venue":null,"work_id":"7ac9e873-1803-47c5-93e5-f1e3d314ef24","year":2023},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.680794Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:b175f5f8916b634dd429a25a82022ca26aae81f5c52b992365bb9b52d513b1a4","observation_id":"62623c47-76ab-48d7-a000-cab7c5d358f0","resolution":{"observed_at":"2026-08-11T05:57:06.874526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.684071Z","title":"Ties-merging: Resolving interference when merging models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.684071Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:71a13e8a1ad2dfa442fc2653ed4254edea1cd08876e0007d6b17db7cdb0918b3","observation_id":"38a91a51-e979-4597-8be2-ebe42efb141b","resolution":{"observed_at":"2026-08-11T05:57:06.684071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.853847Z","title":"Repre- sentation surgery for multi-task model merging","venue":null,"work_id":"64385f10-5cae-49d8-bdb0-c1fbc3188ac6","year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.687250Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:ca6dce777b2461dc8cc2cd41a93a93304e068d0dc46257bcded8e18bec707db9","observation_id":"91d9f37c-114e-46cb-880a-a89d590b569d","resolution":{"observed_at":"2026-08-11T05:57:06.857701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.841685Z","title":"Adamerg- ing: Adaptive model merging for multi-task learning","venue":null,"work_id":"64bf7bcf-72b9-497b-9cb2-f2e192e73500","year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.690533Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:f529ac8b63100636c563595156135c7a524c4f1e9265622ba3eb34603a563159","observation_id":"ca38396e-577f-4b2c-9f3a-d498ffb5c73b","resolution":{"observed_at":"2026-08-11T05:57:06.847094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18961","last_updated":"2024-04-29T05:23:10Z","snapshot_observed_at":"2026-08-16T13:57:06.256891Z","submitted_at":"2024-04-29T05:23:10Z","title":"Unleashing the Power of Multi-Task Learning: A Comprehensive Survey Spanning Traditional, Deep, and Pretrained Foundation Model Eras","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18961","snapshot_observed_at":"2026-08-11T05:57:06.693783Z","title":"Unleashing the power of multi- task learning: A comprehensive survey spanning tra- ditional, deep, and pretrained foundation model eras","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.693783Z"},"links":{"cited_paper":"/paper/2404.18961","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:18da46f9b8909f227f85b2d9da537feb0627ddbf933fdb5081e49bab41786d46","observation_id":"1120ca73-18d7-4870-ba37-2d4e6685ed1a","resolution":{"observed_at":"2026-08-11T05:57:06.693783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:57:06.697303Z","title":"Language models are super mario: Absorbing abilities from homologous models as a free lunch","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.697303Z"},"links":{"citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:19866b8cc5f9d4d9c9a68aaebdb5557bc812cf077870164f42f7bc7ea3cdf8c3","observation_id":"10796c63-252f-4f99-8557-1ec0a7340fd5","resolution":{"observed_at":"2026-08-11T05:57:06.697303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03660","last_updated":"2024-05-28T08:44:15Z","snapshot_observed_at":"2026-08-16T14:21:10.541653Z","submitted_at":"2024-02-06T03:28:36Z","title":"On the Emergence of Cross-Task Linearity in the Pretraining-Finetuning Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03660","snapshot_observed_at":"2026-08-11T05:57:06.700921Z","title":"Cross-task linearity emerges in the pretraining-finetuning paradigm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.700921Z"},"links":{"cited_paper":"/paper/2402.03660","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:6aaf09d8347a05f597ebaf50435db49b251d08e55e3cb39ba5627d1df7f1d564","observation_id":"5dce9e2b-babc-491d-99fa-5c029bab29bc","resolution":{"observed_at":"2026-08-11T05:57:06.700921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2412.17023."}