{"as_of":"2026-08-16T06:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a50e4141eb52d295bc847711e32fe87ea008b9bf74fb7dafeba0afb64d512de","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:05:15.754793Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:15:10.490081Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:51.039526Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":"2411.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-07-04T13:39:51.039526Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":"afcd1eae-3857-488b-a438-30b2eb3fa272","year":2024},"citing_paper":{"arxiv_id":"2408.07666","last_updated":"2025-12-31T04:06:49Z","snapshot_observed_at":"2026-08-07T23:28:24.025478Z","submitted_at":"2024-08-14T16:58:48Z","title":"Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities","version":5},"reference_index":260,"source":"pdf_text","source_observed_at":"2026-05-17T22:16:04.386706Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2408.07666"},"observation_digest":"sha256:b5c0e0ed7951a54d1be507f46df6f4880894623c937d8304b2fe9e85c5f9fc9c","observation_id":"b9abf6f2-7360-4e2c-8a5e-ce60f2a4984c","resolution":{"observed_at":"2026-05-17T22:16:04.783864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-08-11T19:24:43.601245Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06712","last_updated":"2024-12-09T18:01:13Z","snapshot_observed_at":"2026-08-15T17:49:30.290283Z","submitted_at":"2024-12-09T18:01:13Z","title":"How to Merge Your Multimodal Models Over Time?","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T19:24:43.601245Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2412.06712"},"observation_digest":"sha256:8b46883a3a98b0e856a3c35d89340d682dc7ca60059c04d4559e00a9809d65de","observation_id":"f6381a1a-1a8c-423a-8b4f-d76154386d0d","resolution":{"observed_at":"2026-08-11T19:24:43.601245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-08-10T22:38:48.743220Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01230","last_updated":"2025-05-26T13:01:08Z","snapshot_observed_at":"2026-08-16T04:21:25.392242Z","submitted_at":"2025-01-02T12:45:21Z","title":"Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T22:38:48.743220Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2501.01230"},"observation_digest":"sha256:4be0dbbc621373cce486276ae0d158e84266eb08b07897a1ce520124c6fb7762","observation_id":"fb2dadad-3c63-4805-be1a-e310fa9c060c","resolution":{"observed_at":"2026-08-10T22:38:48.743220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-08-10T20:03:11.230419Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09522","last_updated":"2025-01-16T13:17:24Z","snapshot_observed_at":"2026-08-14T17:33:08.484861Z","submitted_at":"2025-01-16T13:17:24Z","title":"Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-10T20:03:11.230419Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2501.09522"},"observation_digest":"sha256:9d5a445fb8e16280468a4999135c758a914439b58843d273d961464819bba779","observation_id":"dd60ba66-56bf-4a1b-bbb3-67faf2827888","resolution":{"observed_at":"2026-08-10T20:03:11.230419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-08-07T15:18:16.048377Z","title":"Multi-task model merging via adaptive weight disentanglement.arXiv preprint arXiv:2411.18729, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15875","last_updated":"2025-05-21T16:34:37Z","snapshot_observed_at":"2026-08-13T21:17:05.274891Z","submitted_at":"2025-05-21T16:34:37Z","title":"Decouple and Orthogonalize: A Data-Free Framework for LoRA Merging","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:18:16.048377Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2505.15875"},"observation_digest":"sha256:834c8e6f82a9abec692bf66bd9cc784847eebe53445af5b24f48afef81592ec7","observation_id":"77dde7e8-deb1-4bc6-88a9-c84577022529","resolution":{"observed_at":"2026-08-07T15:18:16.048377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":"2411.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-07-04T13:39:51.039526Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":"afcd1eae-3857-488b-a438-30b2eb3fa272","year":2024},"citing_paper":{"arxiv_id":"2604.17078","last_updated":"2026-04-18T17:34:56Z","snapshot_observed_at":"2026-08-15T15:12:28.057516Z","submitted_at":"2026-04-18T17:34:56Z","title":"Understanding and Enforcing Weight Disentanglement in Task Arithmetic","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T06:35:33.560079Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2604.17078"},"observation_digest":"sha256:5a4cbaa26ce6cd04e803c82ac5bb128fc9aeb8b55763d6adcee2483a23d2e397","observation_id":"02e018f8-4f26-4546-ac24-136f8cb24e7e","resolution":{"observed_at":"2026-05-10T06:36:36.485713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":"2411.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-07-04T13:39:51.039526Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":"afcd1eae-3857-488b-a438-30b2eb3fa272","year":2024},"citing_paper":{"arxiv_id":"2605.20948","last_updated":"2026-05-20T09:35:04Z","snapshot_observed_at":"2026-08-14T03:42:20.388820Z","submitted_at":"2026-05-20T09:35:04Z","title":"Memory Grafting: Scaling Language Model Pre-training via Offline Conditional Memory","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-21T05:49:14.789955Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2605.20948"},"observation_digest":"sha256:f03fd59a6ac3bf03fd5efe517403b6c79cc88a7b246828476b4d7e9bc972e971","observation_id":"9f303378-2cb1-4b38-963e-0601f83672e0","resolution":{"observed_at":"2026-05-21T05:49:40.735723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":"2411.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-07-04T13:39:51.039526Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":"afcd1eae-3857-488b-a438-30b2eb3fa272","year":2024},"citing_paper":{"arxiv_id":"2606.03391","last_updated":"2026-06-02T09:33:33Z","snapshot_observed_at":"2026-08-14T08:22:12.239939Z","submitted_at":"2026-06-02T09:33:33Z","title":"When Model Merging Breaks Routing: Training-Free Calibration for MoE","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T11:47:22.486110Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2606.03391"},"observation_digest":"sha256:8dd8276bf79502ef5867f61ed268af7a56f1fd780815ade3068e1f29d727fe2a","observation_id":"2dcf83e3-7f94-4e42-89ed-bc396851a153","resolution":{"observed_at":"2026-07-02T01:36:25.372527Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":"2411.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-07-04T13:39:51.039526Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":"afcd1eae-3857-488b-a438-30b2eb3fa272","year":2024},"citing_paper":{"arxiv_id":"2606.18627","last_updated":"2026-06-23T03:37:22Z","snapshot_observed_at":"2026-08-03T04:42:05.437110Z","submitted_at":"2026-06-17T02:48:35Z","title":"PACT: Preserving Anchored Cores in Task-vectors for Model Merging","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T21:57:07.546038Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2606.18627"},"observation_digest":"sha256:a79cf3d9142d7821d8ed3db17f73d96a2ba5459c0525e36f3260ae9a1cbf502c","observation_id":"a1fe8fdc-893d-4e6b-b3aa-c286f19ac7b3","resolution":{"observed_at":"2026-07-03T23:39:03.964781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":"2411.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-07-04T13:39:51.039526Z","title":"Multi-task model merging via adaptive weight disentanglement","venue":null,"work_id":"afcd1eae-3857-488b-a438-30b2eb3fa272","year":2024},"citing_paper":{"arxiv_id":"2606.26902","last_updated":"2026-08-13T02:17:24Z","snapshot_observed_at":"2026-08-16T06:09:29.176258Z","submitted_at":"2026-06-25T11:34:33Z","title":"Learning to Recover Task Experts from a Multi-Task Merged Model","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-26T05:01:39.683081Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2606.26902"},"observation_digest":"sha256:80a757a0ffbe0d77e1002c2f3a5ed78190392a44da8256cceb5fd2eec2357416","observation_id":"95aab0c1-624a-4763-831c-ca5b9b057b08","resolution":{"observed_at":"2026-07-04T13:39:51.041245Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-08-06T00:32:46.610154Z","title":"arXiv preprint arXiv:2411.18729 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01184","last_updated":"2026-08-02T12:09:37Z","snapshot_observed_at":"2026-08-16T06:31:16.713230Z","submitted_at":"2026-08-02T12:09:37Z","title":"SAFE-Merge: Data-Free Continual Model Merging with General Knowledge Preservation","version":1},"reference_index":230,"source":"arxiv_source","source_observed_at":"2026-08-06T00:32:46.610154Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2608.01184"},"observation_digest":"sha256:1ce8ab1750f7ebf6c00eed242890d0a06be221fd256250a2ade176d260054dac","observation_id":"3b058864-c054-496e-9cb3-a9b4248e25b2","resolution":{"observed_at":"2026-08-06T00:32:46.610154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18729","snapshot_observed_at":"2026-08-15T22:15:10.490081Z","title":"Multi-task model merging via adaptive weight disen- tanglement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12842","last_updated":"2026-08-13T05:26:37Z","snapshot_observed_at":"2026-08-16T06:10:36.391303Z","submitted_at":"2026-08-13T05:26:37Z","title":"CABS+: Efficient and Scalable Model Merging via Conflict-Aware Sparsification and Adaptive Weight Allocation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:15:10.490081Z"},"links":{"cited_paper":"/paper/2411.18729","citing_paper":"/paper/2608.12842"},"observation_digest":"sha256:550ae2df16c68cb5634d22564a5ba664f6777e3281a0af73c97a3932672d1ad2","observation_id":"067e8b91-3bc9-4868-9b9f-a9a3a26a9bb7","resolution":{"observed_at":"2026-08-15T22:15:10.490081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.18729/citation-record","integrity":"/paper/2411.18729/integrity","json":"/paper/2411.18729/citation-record.json","paper":"/paper/2411.18729"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.195628Z","title":"Git re-basin: Merging models modulo permutation symmetries","venue":null,"work_id":"4675622a-761e-42ad-a7b1-5489ee75bae1","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.611571Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:cc3da8224c95733a521411b52d2ddbc448d903334894ead3d19dced312b3fe4e","observation_id":"3ba0308a-b249-4c2e-b3b7-fa5e4b891727","resolution":{"observed_at":"2026-08-12T11:05:16.198666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.186715Z","title":"Lan- guage models are Homer simpson! safety re-alignment of fine-tuned language models through task arithmetic","venue":null,"work_id":"b60fecc2-a2ec-4039-b740-2cccf4889fd9","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.615284Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:909ad3f9900b12a0fce6d06350d61073de7c36f0f295eceb279450f24d8c7884","observation_id":"eb94627c-d951-43d3-b09e-6cb2dfdec307","resolution":{"observed_at":"2026-08-12T11:05:16.190142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.177762Z","title":"Remote sens- ing image scene classification: Benchmark and state of the art","venue":null,"work_id":"dd8a1079-e3d6-465d-acc3-1514ec966d17","year":2017},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.618605Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:19cc93d8b2ee4cd062293347c97c41beb5afa5a40acebf5a35114a2ef6951cfb","observation_id":"748dc33e-556f-41cf-bd9f-9f0bfee6cef4","resolution":{"observed_at":"2026-08-12T11:05:16.181046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.621759Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.621759Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:dfab33d2d788adcc5845a6800ebf60d5f96e9092e41abe5fb070397e4802792c","observation_id":"e8e137d0-4457-42cb-9a81-9fd33415ded7","resolution":{"observed_at":"2026-08-12T11:05:15.621759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.163675Z","title":"Knowledge neurons in pretrained transform- ers","venue":null,"work_id":"2a1ae252-b8a0-48f2-9f16-afd5e1199dd9","year":2022},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.625094Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:1167d8733b9475dae3dfc57f199e44f03666bf92c83f9d5e08df93a930f72909","observation_id":"756a8cf6-6a03-4cd7-9699-a5efc383e4b1","resolution":{"observed_at":"2026-08-12T11:05:16.167053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.155171Z","title":"Orthogonal gradient descent for continual learning","venue":null,"work_id":"691263b6-0f70-4b5e-9f73-939ccfd17a40","year":2020},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.628424Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:1d3ce90c5baebe5c553c2f137b0e330c11059ef1c68647f2e57478191a80bba1","observation_id":"7625d420-9620-4126-a0a8-41f1ee70dccd","resolution":{"observed_at":"2026-08-12T11:05:16.158347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.145941Z","title":"Adaptive orthogonal projection for batch and online contin- ual learning","venue":null,"work_id":"46dbf6ea-1e55-45d7-afee-9161b10eb5f3","year":2022},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.631464Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:ad77f4118cd7a7e86dcda758cccddf10b17876d2d89125c94fcb222ef41e9d92","observation_id":"90c690bf-4701-4ae3-a19a-bfc2f2c80a43","resolution":{"observed_at":"2026-08-12T11:05:16.149030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.136888Z","title":"Localize-and-stitch: Efficient model merging via sparse task arithmetic","venue":null,"work_id":"5a184c8c-aa62-4a53-896e-cbb2db88f623","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.634647Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:784e1faee1742a3ea0e585bf1ea187db5b032b77b176a0c5216d764b84f1daf2","observation_id":"1132dfe3-017a-4753-b29d-8d08a326ccb5","resolution":{"observed_at":"2026-08-12T11:05:16.140169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.637416Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.637416Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:ad6cd990694e12d919d67a50ad60e765720f8edd9441faa62e88528452d15995","observation_id":"cb5e5022-96a1-4c00-ac0e-5ad6ef3dcc6a","resolution":{"observed_at":"2026-08-12T11:05:15.637416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.123583Z","title":"Editing models with task arithmetic","venue":null,"work_id":"8805308b-aef3-4168-b441-9accf79abe00","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.640140Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:88ad66d33299132c83ad1055e47267d714d963678367919440c9150d4527ce18","observation_id":"5c55f9cf-b6ae-41ea-a611-7e77a662136c","resolution":{"observed_at":"2026-08-12T11:05:16.126927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.115681Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":"8ef9b980-2ab0-4564-93cd-1a6d76bfafe7","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.643063Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:4cba9ea2bce49cd17acd45b07550bbb68cff0c0b4cef2ca553968c01323560c9","observation_id":"926fc5d7-413a-4f7d-be7a-3a0fc57ecb92","resolution":{"observed_at":"2026-08-12T11:05:16.118802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.107194Z","title":"REPAIR: REnormalizing permuted activations for interpolation repair","venue":null,"work_id":"c016617a-851f-4422-a3e1-aae6603ccb99","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.645851Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:2eaaead41799b5b25ecc05edf59b723d7cfe1932109bf3a13c06697ee5abbe92","observation_id":"f9a31f4a-7aa1-4eff-bd94-7d3da9d31a15","resolution":{"observed_at":"2026-08-12T11:05:16.110296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.097293Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"bb0eef8b-0b48-4339-8aec-fae6cfb6abe7","year":2013},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.649000Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:67d5a384a3d45c52a140b7d4dd13f24b3eb49d91b852a8f4e1d39df067d6613e","observation_id":"49dd3519-ebb2-44a8-8590-5c19eb484245","resolution":{"observed_at":"2026-08-12T11:05:16.100616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.087976Z","title":"The mnist database of handwritten digits","venue":null,"work_id":"7f63e32b-dd0d-4ddd-a392-fcca31081245","year":1998},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.651720Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:77db83254be456783f9559f871e04b308d758b655c0f2413d2ab328c51f8ac32","observation_id":"f52d46d5-3131-4a63-a45c-681318db10f0","resolution":{"observed_at":"2026-08-12T11:05:16.091272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.078578Z","title":"Towards continual learning desiderata via hsic-bottleneck orthogonalization and equian- gular embedding","venue":null,"work_id":"6f2fcf37-e254-4f60-95fb-c0946fd5d965","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.654685Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:a5f1b9f7eeec564f768cd06bbf7ec2f0357108cb96dff5519be77ede11383aeb","observation_id":"274f761c-3e2b-4929-9b41-560869602b52","resolution":{"observed_at":"2026-08-12T11:05:16.081827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.068865Z","title":"Model-protected multi-task learning","venue":null,"work_id":"3ab30a3e-06e8-49a5-be18-002b4ced3e58","year":2022},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.657495Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:303a54541817a23c88387d79a61f36fbffe2939bb9567c88c476d4c5b8d8fa22","observation_id":"fbd606ef-e6a9-4934-b4d5-893c55731d2c","resolution":{"observed_at":"2026-08-12T11:05:16.072104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.060546Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":"8c19fdf0-2125-4197-9cb7-d2561f2cd705","year":2019},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.660283Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:8a4e56a366a5dbc71f9fff0aa6db50ccb1ff159df8c6c56ab43d247b27854b67","observation_id":"c81a6616-2e4e-404d-a6b2-0b562a83d2ad","resolution":{"observed_at":"2026-08-12T11:05:16.063593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.052090Z","title":"Twin-merging: Dynamic integration of modular expertise in model merging","venue":null,"work_id":"737942a1-dae7-43db-abb2-ead4bbce4ed0","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.663231Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:27acb12653ec639399d88130691792693f6507ffe925b7c1b795eacab16ecaa3","observation_id":"c33b4422-edf7-4c4a-894e-f5c9e5e04e45","resolution":{"observed_at":"2026-08-12T11:05:16.055490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.043786Z","title":"Merging models with fisher-weighted averaging","venue":null,"work_id":"022b862e-b01e-4a0b-acdd-1130aeee4e07","year":2022},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.665831Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:8db32645b41824e00a872ecc3818ff5e0218f42a41f5d1e24f5166feabf79816","observation_id":"4dbb69c8-be78-4b35-8419-b05e8b8a2eb5","resolution":{"observed_at":"2026-08-12T11:05:16.047083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.035330Z","title":"Learning to route among specialized experts for zero- shot generalization","venue":null,"work_id":"7fe45c30-68a5-4c1f-9c7d-bfb13eac965b","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.668512Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:9a5a0649fb0d05b2d52e756be7df47c885ba8ac02b6fb2bdb6026d4c78342555","observation_id":"aa0a2762-76c1-4d4f-94f4-488922d2de3c","resolution":{"observed_at":"2026-08-12T11:05:16.038489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.026199Z","title":"Task arithmetic in the tangent space: Improved editing of pre-trained models","venue":null,"work_id":"689c8995-619b-4765-9d29-d64e063de5a9","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.671589Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:434b275ff409f5303e16ea6e83ee3f27b94f573c91a46a37a3e749aba5518ce8","observation_id":"a108a3af-8432-4f6d-8b34-5a9c35e2569c","resolution":{"observed_at":"2026-08-12T11:05:16.029321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.017399Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"a7bee4b6-ec3e-4506-8192-9532729a66f2","year":2021},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.674086Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:7b9795d460c0250f5a61f5b8443321b45606d386140c36987ae1bd9fb68d1de4","observation_id":"63849d2d-52a6-4bd9-a9e8-1b5bf957c652","resolution":{"observed_at":"2026-08-12T11:05:16.020652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:16.008711Z","title":null,"venue":null,"work_id":"448f8a46-24ae-441f-b55c-67f7a0a2932b","year":2020},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.676826Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:afb26bf3f85e3148734ecfde952311a1433f1cc09218b1dea7a6f7a9c3ca0aa6","observation_id":"d32c5850-80b1-49b6-a3ec-ebd50a5593a2","resolution":{"observed_at":"2026-08-12T11:05:16.011676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.999785Z","title":"Continual learning with scaled gradient projection","venue":null,"work_id":"90b5092e-0b39-4442-9b4c-73faa1bc27b1","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.679554Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:54b448d70fcdfa40196ab5abf39b912b36836bd857089ef1a6aaa8c0dd094ccd","observation_id":"09fd2d29-1b5d-4dc5-a42b-8cfdf3e7b71f","resolution":{"observed_at":"2026-08-12T11:05:16.003032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.991107Z","title":"Multitask prompted training enables zero-shot task general- ization","venue":null,"work_id":"4ceeec01-15db-4ade-a6c4-b911fb3b7fe3","year":2022},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.682132Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:b5e13f878e3c2e2c6b30a9056a9b8824071cd1e552638840d7e47da6e9e11e51","observation_id":"b780059e-5c0d-4315-8cfe-1fea2a8f538f","resolution":{"observed_at":"2026-08-12T11:05:15.994466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.981312Z","title":"The german traffic sign recognition bench- mark: a multi-class classification competition","venue":null,"work_id":"7757d2af-8d02-45f3-80b4-e85ab61ccd5e","year":null},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.684949Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:7458c25d0afdb2c3cf9d3e468dea1a3c301081e9972414c5a85234b8217773bd","observation_id":"8634cacb-64f0-461e-bc70-a2fc649636a7","resolution":{"observed_at":"2026-08-12T11:05:15.985029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.973081Z","title":"Parameter-efficient multi-task model fusion with partial linearization","venue":null,"work_id":"228a7e6b-9d1e-4bd8-95a8-f01471559136","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.688001Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:4502bdba59d5a31790c3497acc1f3388fa7ba7681fcdff3770a837c525a0a453","observation_id":"a6a29392-ac25-4eb3-962f-53645fed2011","resolution":{"observed_at":"2026-08-12T11:05:15.976206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.964839Z","title":"Parameter-efficient multi-task model fusion with partial linearization","venue":null,"work_id":"ccce15ed-65cf-4b11-ab94-10c0e0b5f1ee","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.690703Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:ff826587f4e3008ef9955fa5638c4f5a88478c3ccc0830bd159b918a388f21b1","observation_id":"f10b6767-7886-4582-9249-f6b0d9234e7e","resolution":{"observed_at":"2026-08-12T11:05:15.967950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.956410Z","title":"Tran, Xavier Garcia, Jason Wei, Xuezhi Wang, Hyung Won Chung, Dara Bahri, Tal Schuster, Steven Zheng, Denny Zhou, Neil Houlsby, and Donald Metzler","venue":null,"work_id":"68186114-97de-4490-b05d-8474e1eb923a","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.693635Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:ddba1342f3a2f8c98b54ca8683dba32d441b7fe6350582f80658bad59eea1828","observation_id":"c0ee7363-9a79-4181-a1ca-a793f6642d1f","resolution":{"observed_at":"2026-08-12T11:05:15.959640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.948337Z","title":"Is fine-tuning needed? pre-trained language models are near perfect for out-of-domain detection","venue":null,"work_id":"6ead1990-dd93-4125-b858-3e0f943e558f","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.697541Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:c00929fe0569e6005f2afba734b8205d201197438818e4cace772bc57c6fcab9","observation_id":"8071ed3f-2cca-4cc5-a9c8-e31ca6e40f63","resolution":{"observed_at":"2026-08-12T11:05:15.951481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.940080Z","title":"Knowledge fusion of large language models","venue":null,"work_id":"f79a374d-66b8-4f39-9933-f0d850656ed8","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.700083Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:94cd78071d3c82d4abfa879c1c438f77a217e70ea6489e917f772a451d831dbc","observation_id":"2f186ccb-a036-42e0-a94e-cee678121f4d","resolution":{"observed_at":"2026-08-12T11:05:15.943133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.931120Z","title":"GLUE: A multi-task benchmark and analysis platform for natural language un- derstanding","venue":null,"work_id":"3280c59f-d502-483c-83a9-c0dc014cb4bd","year":2018},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.703088Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:eeddb3d56aafd3da95fde4fc17b79589bb4926d201408adc3662c077ea23a17f","observation_id":"7e9355b6-f48c-42f1-9f87-9380eb45540b","resolution":{"observed_at":"2026-08-12T11:05:15.934290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.922204Z","title":"Localizing task infor- mation for improved model merging and compression","venue":null,"work_id":"30437d39-c999-46d2-8bb3-483e70d5bd99","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.705972Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:d707488de449c04a3be1294eb7545caca76ca4b94379c281e1236a9afd451adf","observation_id":"4fa5ecba-90bf-4999-8cd0-e65ca882f84f","resolution":{"observed_at":"2026-08-12T11:05:15.926010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.914023Z","title":"A comprehensive survey of continual learning: Theory, method and application","venue":null,"work_id":"40e5fecc-bd61-4078-afc6-ba20dd58b43a","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.708976Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:1d40070a80f689124b98dd8ffbe4ff854bfe58ba590117aee66d2d2862e9dd4d","observation_id":"476aded7-1294-491a-8ffb-a2aad3004b7e","resolution":{"observed_at":"2026-08-12T11:05:15.917183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14152","last_updated":"2023-10-22T02:23:44Z","snapshot_observed_at":"2026-08-13T18:59:18.024748Z","submitted_at":"2023-10-22T02:23:44Z","title":"Orthogonal Subspace Learning for Language Model Continual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14152","snapshot_observed_at":"2026-08-12T11:05:15.712044Z","title":"Or- thogonal subspace learning for language model continual learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.712044Z"},"links":{"cited_paper":"/paper/2310.14152","citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:60aa289b67c884ef7cc2a09225c3ecf22556b9f8253d71a4f5f6bf878f2f9a3e","observation_id":"d2346e32-efe7-4a97-b37e-16f1d86260b9","resolution":{"observed_at":"2026-08-12T11:05:15.712044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.905172Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":"9b33105a-5064-433b-a77f-9e40f87e0d05","year":2022},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.715345Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:d3e42b7537b0e377a206397bf13d207321612a1462e8cc945de2a44bcc1d8f54","observation_id":"805d8b28-7b81-4cf2-a470-ab18136e5b68","resolution":{"observed_at":"2026-08-12T11:05:15.908891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.896924Z","title":"Sun database: Exploring a large col- lection of scene categories","venue":null,"work_id":"7c1ce4f2-9265-444c-aeb5-d6fb4170a2c6","year":2016},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.718625Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:e001da80d5f860c1c5ad4e3365d09688d32343f31f45e45f3c4b477aceb71b54","observation_id":"03f0f4d6-5d96-471a-ab9f-3732801c1b84","resolution":{"observed_at":"2026-08-12T11:05:15.899950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.888108Z","title":"Active finetuning: Exploiting an- notation budget in the pretraining-finetuning paradigm","venue":null,"work_id":"908bd1f3-924a-4bbb-baf4-703d75501147","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.721809Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:79e713bc9aa764d005023aff59026e03d516dae166834cf40ec5179f2ed7a01f","observation_id":"99547a45-8b53-40da-b787-03d50f44c5c2","resolution":{"observed_at":"2026-08-12T11:05:15.891306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.879878Z","title":"Ties-merging: resolving interfer- ence when merging models","venue":null,"work_id":"2f88caf3-0fce-4c88-878f-252955e7e0a5","year":2023},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.724884Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:c40b81dcd77d0e9eff8f69a9a9789167c218c46b645cca35194a71a7f29dda59","observation_id":"e3496901-4129-4b2f-ab65-b858ccc2070f","resolution":{"observed_at":"2026-08-12T11:05:15.882820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.871191Z","title":"Model merging in llms, mllms, and beyond: Methods, theories, applications and opportunities","venue":null,"work_id":"681a9ac6-0a88-4604-96f1-77d4c1473077","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.728045Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:0d01db435eccbba8fdaa805719a1eee47b57cf6262924e549d8b4d3617c01f58","observation_id":"23c3e567-92ec-45dc-a7a7-1d2bec4e41ed","resolution":{"observed_at":"2026-08-12T11:05:15.874340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.862436Z","title":"Representation 10 surgery for multi-task model merging","venue":null,"work_id":"ec5f545b-6ef6-4888-ace7-cfc029b6ac33","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.730988Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:e2819a7ba5b2131544e7105900f908c1acae09b1ccff3d3df7d0ab730cf84ce3","observation_id":"394efd8c-99a5-43f6-ab57-b08696bc1452","resolution":{"observed_at":"2026-08-12T11:05:15.865557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.853670Z","title":"Adamerging: Adap- tive model merging for multi-task learning","venue":null,"work_id":"9171de33-6e2f-4049-a21f-0f04dab49c21","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.733775Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:7f9481ccf59dadc36ba8ae048faff1cbafb3c6cf954ea273219d9a1e5342ea05","observation_id":"a4fa28ee-1dee-44b9-9bdd-d2ddf5e9a8f4","resolution":{"observed_at":"2026-08-12T11:05:15.857125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.844649Z","title":"On the dimensionality of word embedding","venue":null,"work_id":"650575f1-69df-47a5-80c4-ced15af8dba4","year":2018},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.736886Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:7e9cacddf023221241a12d51bbecee0a5f3650525ef1e1499172475370fda482","observation_id":"8bd2782c-9ed4-498f-8b7a-8d8d852a89bc","resolution":{"observed_at":"2026-08-12T11:05:15.848020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.835399Z","title":"Language models are super mario: Absorbing abilities from homologous models as a free lunch","venue":null,"work_id":"972390b4-131a-4286-bc6e-731ca54af48a","year":2024},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.739768Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:8e06fcc3ebb00896a35e3059e00561aded5fa89396c9a136d0dd0280ec5f6a24","observation_id":"52020132-4fed-4cc9-8bdd-d79d59abd6ec","resolution":{"observed_at":"2026-08-12T11:05:15.838718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.826435Z","title":"Reading digits in natural images with unsuper- vised feature learning","venue":null,"work_id":"ee1fc72c-d501-45d6-bffc-20c2f32645ed","year":2011},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.742933Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:c637a537976788d088053b34da49a71184bf0c10a90f4a7308e963f60de292f2","observation_id":"0aae24c6-4228-40f1-a7d3-a5cf9a7f48f8","resolution":{"observed_at":"2026-08-12T11:05:15.829571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.817129Z","title":"Contin- ual learning of context-dependent processing in neural net- works","venue":null,"work_id":"84e4d843-22ab-4b0d-a9c4-7decab1ddd6f","year":2019},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.745701Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:72bfa435afc118cda0d59d39096dde086012cdec6f026b521ee76fa0c4a4eeba","observation_id":"95dd5c97-f0f3-4849-90ba-d10f533dc947","resolution":{"observed_at":"2026-08-12T11:05:15.820392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.808029Z","title":null,"venue":null,"work_id":"f0b947b8-1b26-4c6d-b48e-fc17258bc8f2","year":null},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.748634Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:cb8e883e14da91ecf133533e06d747ec6d0f5a6cb2e9018ec34453cf53f66f83","observation_id":"5caf2ea4-d398-46db-955a-35dc8ae1ab95","resolution":{"observed_at":"2026-08-12T11:05:15.811042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.799444Z","title":"Calculate Resources and Environment","venue":null,"work_id":"14fe6ffb-afe6-455d-92cb-af801d296df5","year":2000},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.751980Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:6d6e023bedc69630f73a29502a983e4b6bcd99f858ee0952246216708bd450e3","observation_id":"18aeaa59-1e62-44cf-a40c-af9883895962","resolution":{"observed_at":"2026-08-12T11:05:15.802414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:05:15.788036Z","title":"Performance on ViT-B/16 Table 4 presents the performance of various merging meth- ods applied to ViT-B/16","venue":null,"work_id":"c4ae21c6-ea5b-4423-a237-6cec31221960","year":null},"citing_paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:15.754793Z"},"links":{"citing_paper":"/paper/2411.18729"},"observation_digest":"sha256:4918a09c5df80865ca538f1812109e230557422e7d319d8dfbd238a38b90fae7","observation_id":"54a865bd-4fbc-4917-af57-2dc5535dd32e","resolution":{"observed_at":"2026-08-12T11:05:15.792878Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18729","last_updated":"2025-01-09T03:34:55Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T18:36:23.555197Z","submitted_at":"2024-11-27T20:08:55Z","title":"Multi-Task Model Merging via Adaptive Weight Disentanglement"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 12 inbound Pith citation observations for arXiv:2411.18729."}