{"as_of":"2026-08-14T15:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:794718c8744d60abb77d53fa46e55fca0baba89b906968b926d3e8a006312ab2","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:06:09.023142Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T06:34:55.089754Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:15:29.234678Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"cited_work":{"arxiv_id":"2411.18615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18615","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.18615 (2024) 42","venue":null,"work_id":"e7291489-400d-49c2-829c-efc58cc093ee","year":2024},"citing_paper":{"arxiv_id":"2604.13560","last_updated":"2026-04-15T07:09:05Z","snapshot_observed_at":"2026-08-13T06:18:03.593073Z","submitted_at":"2026-04-15T07:09:05Z","title":"Parameter-efficient Quantum Multi-task Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T14:13:39.288961Z"},"links":{"cited_paper":"/paper/2411.18615","citing_paper":"/paper/2604.13560"},"observation_digest":"sha256:16e2e3d2bab383a221a0853225f223377dd8a03ac189a403eb5904fe54e4b195","observation_id":"56c69f23-8f3f-4e4c-9209-7964d708943f","resolution":{"observed_at":"2026-05-10T14:15:29.236706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"cited_work":{"arxiv_id":"2411.18615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18615","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.18615 (2024) 42","venue":null,"work_id":"e7291489-400d-49c2-829c-efc58cc093ee","year":2024},"citing_paper":{"arxiv_id":"2604.17257","last_updated":"2026-04-21T06:47:04Z","snapshot_observed_at":"2026-08-11T09:18:25.699659Z","submitted_at":"2026-04-19T04:41:55Z","title":"REZE: Representation Regularization for Domain-adaptive Text Embedding Pre-finetuning","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-10T06:14:28.893342Z"},"links":{"cited_paper":"/paper/2411.18615","citing_paper":"/paper/2604.17257"},"observation_digest":"sha256:a9c9661f1c683b85149dbcf3124a7ed0f2ef0e1fd4d6bb824dedfe124fd663a5","observation_id":"7ad50e89-7695-4a26-a9ff-bfc608672555","resolution":{"observed_at":"2026-05-10T06:16:20.959995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18615","snapshot_observed_at":"2026-07-14T06:34:55.089754Z","title":"Proactive gradient conflict mitigation in multi-task learning: A sparse training perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11163","last_updated":"2026-07-13T06:57:02Z","snapshot_observed_at":"2026-08-02T05:26:21.947350Z","submitted_at":"2026-07-13T06:57:02Z","title":"Unified Gradient Projection: Language-Balanced Continual Learning for Multilingual Low-Resource ASR","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T06:34:55.089754Z"},"links":{"cited_paper":"/paper/2411.18615","citing_paper":"/paper/2607.11163"},"observation_digest":"sha256:10282122731c4f6615e2434d8d44bf511bc7ec44e6608ce1c5a2901711d9ae28","observation_id":"7934230b-ffc6-434f-8d8c-9cdc099920b0","resolution":{"observed_at":"2026-07-14T06:34:55.089754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.18615/citation-record","integrity":"/paper/2411.18615/integrity","json":"/paper/2411.18615/citation-record.json","paper":"/paper/2411.18615"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.343307Z","title":"Segnet: A deep convolutional encoder-decoder architecture for image segmentation","venue":null,"work_id":"2f1c6988-f12b-4bf6-be0a-a65621771ff0","year":2017},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.916564Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:dd1c137b4bda9056dd555ee439e1a4b3c4e75bd31fc07605b8cee6a394e75e98","observation_id":"293aaaa3-c32a-4caa-ae8c-8b8a11fff76a","resolution":{"observed_at":"2026-08-12T11:06:09.346020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.336165Z","title":"Sparse multi-task reinforcement learning","venue":null,"work_id":"30db313c-76c2-483a-bff2-3c73f6082db4","year":2014},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.920391Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:eeff71025500669553f3da101e0ec6d37df09986a62629b2b79120a399df6b88","observation_id":"ed0e6c8b-2749-49c0-a754-281a5d64d6e4","resolution":{"observed_at":"2026-08-12T11:06:09.338753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.328439Z","title":"Sam fails to segment anything? – sam- adapter: Adapting sam in underperformed scenes: Camou- flage, shadow, and more, 2023","venue":null,"work_id":"4e9f3a8c-c941-4ec5-94d4-1d3502c136fb","year":2023},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.923161Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:cc8ed08fdfcd58dc5a12701165374bd9a96c99bb74d619751e40047983e7dce7","observation_id":"342ed0c3-9247-4d99-b9f9-661ba6d96b59","resolution":{"observed_at":"2026-08-12T11:06:09.331697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.320389Z","title":"Just pick a sign: Optimizing deep multitask models with gra- dient sign dropout","venue":null,"work_id":"720bc462-7709-496a-aa7c-f43f536eef26","year":2020},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.925822Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:3171b3c88a2cbca94f7879002fbd46d60ee7939e13e7de3e8510c9d83ca0993f","observation_id":"9e269cd5-a0d9-4418-874c-0c57594c95c5","resolution":{"observed_at":"2026-08-12T11:06:09.323190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.928598Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.928598Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:057bd0226ac297498cbf749db10fc852198474cd121c451fcf83093d09de286b","observation_id":"e5d3a967-e3d4-4cd4-8415-ca5c459cc05f","resolution":{"observed_at":"2026-08-12T11:06:08.928598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.307477Z","title":"Indoor semantic segmentation using depth in- formation, 2013","venue":null,"work_id":"c54fa7ad-011d-4487-addf-632c3bcadef3","year":2013},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.931478Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:2568724cb4ad37c140455f1063e60b8461ac1542c327f717e17f3716c279c016","observation_id":"63a10601-9a4f-4992-bd7b-75afc00ee6c4","resolution":{"observed_at":"2026-08-12T11:06:09.311046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.299033Z","title":"Imagenet: A large-scale hierarchical im- age database","venue":null,"work_id":"ba1067cd-798c-4b65-8233-4e1f34421815","year":2009},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.934566Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:1ed9a78092923fd7562c2cbc5bee45c77626c2738c550ef8fe8d81a4e255d317","observation_id":"537e07c1-47da-4bb3-923d-b92757493df8","resolution":{"observed_at":"2026-08-12T11:06:09.302230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T11:06:08.937239Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.937239Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:f73663a47b490eaa711c5384140caca1ee8968b822453f340a52e90554cc075a","observation_id":"e833b021-5560-4e4d-88e4-735ca7b39cc5","resolution":{"observed_at":"2026-08-12T11:06:08.937239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.290671Z","title":"On interpretability of artificial neural networks: A survey","venue":null,"work_id":"1499b457-7df1-4d5e-ad47-ca049eec5685","year":2020},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.940255Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:7aa3878c3b824b3ed9d735439ee33391bd673d3ccd07773ecbbb1846037047cc","observation_id":"c0650d54-1ccd-42d3-87de-6ec3e61f21f4","resolution":{"observed_at":"2026-08-12T11:06:09.293860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-12T11:06:08.943008Z","title":"The lottery ticket hy- pothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.943008Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:e09faf8c203809762508347c0db8d06e6b0db6daa2d6e26cd3a4302f87771f36","observation_id":"76a03b92-5b83-430f-8d16-9d261104fd57","resolution":{"observed_at":"2026-08-12T11:06:08.943008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.945960Z","title":"On the effectiveness of parameter-efficient fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.945960Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:b2fb463beebc793bdbc0dee9a8061a97dff455780717743fda9ebaaf1ad9efea","observation_id":"f18fc1aa-a899-4ad0-b6af-7fb9b365f283","resolution":{"observed_at":"2026-08-12T11:06:08.945960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.949271Z","title":"Learn- ing to branch for multi-task learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.949271Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:20154501a77f95d6197d74adcb39b859c6b03ee3b9f89fe271883eb6edd34de9","observation_id":"e84766de-a6c3-4a1c-8290-751d4c4bbbda","resolution":{"observed_at":"2026-08-12T11:06:08.949271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.275557Z","title":"Learn- ing both weights and connections for efficient neural net- work","venue":null,"work_id":"f20b8596-3c9c-4aa0-893c-7d7498063ace","year":2015},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.952346Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:9fbbca63a48ad8da341d41c1b605da151f3e9d9ff16e0f1b796c4a0adfb5cbf2","observation_id":"3d08b2a1-de3a-4883-a7dd-e121b9d56582","resolution":{"observed_at":"2026-08-12T11:06:09.278329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.955002Z","title":"Multi-task learning using uncertainty to weigh losses for scene geome- try and semantics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.955002Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:f2fcfae902e12cc57ef6613e9e5a2c40eced7974d09a5cd2260d6e4df81e11af","observation_id":"934774f6-5d2f-4b49-9eec-523940a6fa30","resolution":{"observed_at":"2026-08-12T11:06:08.955002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.957997Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.957997Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:b3f688a8367b5d316c0447281c936b88dbb06f0e77b3dac02714a3ede840362b","observation_id":"8ee95ccb-df8e-4970-870b-30857eddb52a","resolution":{"observed_at":"2026-08-12T11:06:08.957997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.04838","last_updated":"2021-09-10T12:46:32Z","snapshot_observed_at":"2026-08-13T18:14:02.071239Z","submitted_at":"2021-09-10T12:46:32Z","title":"Block Pruning For Faster Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.04838","snapshot_observed_at":"2026-08-12T11:06:08.960534Z","title":"Block pruning for faster transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.960534Z"},"links":{"cited_paper":"/paper/2109.04838","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:4feed09e32eff6e4e55dac72770b5354386e86320785a2822f85737de061e21b","observation_id":"4d3bca07-8ad6-457f-9959-00a481216acc","resolution":{"observed_at":"2026-08-12T11:06:08.960534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.258118Z","title":"Conflict-averse gradient descent for multi-task learn- ing","venue":null,"work_id":"01150a8a-97e2-4c0b-9b95-76ad4ded9a8b","year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.963308Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:9408c19522ea12c49d10331c036b9541e87e13f760ca95ac0e966af441fc0453","observation_id":"0bffadae-1918-4ee6-9f4c-dd3fbe987376","resolution":{"observed_at":"2026-08-12T11:06:09.261263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.249196Z","title":"Famo: Fast adaptive multitask optimization, 2023","venue":null,"work_id":"c68916ca-8840-4ad1-9959-de959a2073c5","year":2023},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.965715Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:9246a9ac3944795fe93e5d42281bb87d9016a25a33ff26d9a8f04b371db104a7","observation_id":"7d01e526-b8f8-42a3-ad6f-40e8caead4d4","resolution":{"observed_at":"2026-08-12T11:06:09.252488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.240244Z","title":"Towards impartial multi-task learning","venue":null,"work_id":"abca05f0-8e4d-4c3a-95a4-0a8320163739","year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.968457Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:88804ef667c38f1ae4d4cb9647b9d92259f35ff487cc211bad8265fc59f446e3","observation_id":"67d4af19-60ce-4753-9508-2602a8e1278c","resolution":{"observed_at":"2026-08-12T11:06:09.243061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.231572Z","title":"End- to-end multi-task learning with attention","venue":null,"work_id":"b18c9608-6e13-4e0a-aa8d-e860c5ea3e48","year":2019},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.970858Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:841f0df87af9e3dc04ca85774de87e6a4bccf4c64eaf1adb54bae2860f2d4306","observation_id":"322945b6-fab6-4acf-a699-ae5fbb5f7cba","resolution":{"observed_at":"2026-08-12T11:06:09.235160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.973303Z","title":"Deep learning face attributes in the wild","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.973303Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:8008191df10c684a8fe29335db949232ba36563126bb98244ce27a715121d9b7","observation_id":"96cd3366-1cfa-406e-ac5a-a11a980fc945","resolution":{"observed_at":"2026-08-12T11:06:08.973303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.217319Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"8ef5a0b8-8a2e-455f-aa9d-2384d51d86fe","year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.975739Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:81333b3ca821266b93dbc88a167c0ea8337b15dd0d58ad16045ca43b13b8a7c2","observation_id":"7621df7c-b601-4902-8448-24aa303ee30f","resolution":{"observed_at":"2026-08-12T11:06:09.221220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.208568Z","title":"Attentive single-tasking of multiple tasks","venue":null,"work_id":"2cc1d576-a838-4268-9330-b9aac88a1bf1","year":2019},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.978159Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:1d4ebea4603879916ef0b762dcd521918c51f82fe24aeba528e6df6a6d46c2f7","observation_id":"664ab58e-c6a3-447b-9c98-38d3b04d703b","resolution":{"observed_at":"2026-08-12T11:06:09.211935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.200276Z","title":"Cross-stitch networks for multi-task learning","venue":null,"work_id":"06456ed6-937d-4790-8dbf-780c6be7619f","year":2016},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.980533Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:3ac49343d37a847b9318792f7ceb9805da80b1c039ee6159e11ea4b3271eb1f5","observation_id":"ff7d9a49-a812-46d6-8ab2-d67a2df7be77","resolution":{"observed_at":"2026-08-12T11:06:09.203403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.191062Z","title":"Parameter efficient train- ing of deep convolutional neural networks by dynamic sparse reparameterization","venue":null,"work_id":"12e3bf71-42d0-4502-bc48-99faa29ce6aa","year":2019},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.983116Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:f58ab500e1ed9f24cae50573aef473ec6d88d45920bbd5da87d19a2ab237cc11","observation_id":"852c5bd6-2f88-498b-8e2d-d5f02d2ea999","resolution":{"observed_at":"2026-08-12T11:06:09.194003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.183135Z","title":"Multi- task learning as a bargaining game, 2022","venue":null,"work_id":"a650f01a-83dd-4427-aa68-344707f2821f","year":2022},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.985487Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:9012f97647330ea09cdec338a7cb4260094de187b2f009e82043c0ce68f17e2a","observation_id":"16df5d8e-c638-4bac-9aad-d2b344629ab8","resolution":{"observed_at":"2026-08-12T11:06:09.186015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.174648Z","title":"Movement pruning: Adaptive sparsity by fine-tuning","venue":null,"work_id":"db48e676-b0c3-4784-8bfc-971a46f484cf","year":2020},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.987912Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:97fc1ea80c64bb0167c075599df923b28778dadbfdf07f1f0defc7d9e41bdca2","observation_id":"060eb3b6-a794-4db9-bb20-c429f7e9f16d","resolution":{"observed_at":"2026-08-12T11:06:09.177651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.165534Z","title":"Multi-task learning as multi-objective optimization","venue":null,"work_id":"4ceab743-bf05-4e88-b54b-5b6b75f1a9e4","year":2018},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.990642Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:d4c89a1f03decfec4dd3131c37be491a4af5a90e6bc34d55a9ec402ce80a1d4d","observation_id":"251838c5-8ad6-428f-8ac1-b18df44a9ef5","resolution":{"observed_at":"2026-08-12T11:06:09.168744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11289","last_updated":"2023-02-22T11:14:16Z","snapshot_observed_at":"2026-08-13T12:39:36.203917Z","submitted_at":"2023-02-22T11:14:16Z","title":"Recon: Reducing Conflicting Gradients from the Root for Multi-Task Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11289","snapshot_observed_at":"2026-08-12T11:06:08.993379Z","title":"Recon: Reducing conflicting gradi- ents from the root for multi-task learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.993379Z"},"links":{"cited_paper":"/paper/2302.11289","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:eb977e177436e90ca7dcefd15854208185a9c2d6a0dbf7170b62e388fbb8772d","observation_id":"b4c87c19-dd74-40a7-81a6-467a9f7c8980","resolution":{"observed_at":"2026-08-12T11:06:08.993379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.156254Z","title":"Learning sparse sharing architectures for multiple tasks","venue":null,"work_id":"e00e76ba-fc40-4670-854d-9f6e27b6d3d2","year":2020},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.996366Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:17427c355b5f502838e977eedbfde9c1f6a93f928de44615c74fadeda6ab1e69","observation_id":"16b64028-2e64-4f45-8f13-aa6f846bcb56","resolution":{"observed_at":"2026-08-12T11:06:09.159680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:08.999074Z","title":"Multi-task learning for dense prediction tasks: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:08.999074Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:e229e2043e904b57fe5f13638ce7183c526bc8eb9eaad574345736c493e738e9","observation_id":"aa76ab45-a0a0-46c5-9756-0cdb40b7937d","resolution":{"observed_at":"2026-08-12T11:06:08.999074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14509","last_updated":"2022-03-04T18:14:27Z","snapshot_observed_at":"2026-07-06T11:52:39.902598Z","submitted_at":"2021-09-29T15:44:26Z","title":"PAC-Bayes Information Bottleneck","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.14509","snapshot_observed_at":"2026-08-12T11:06:09.001625Z","title":"Pac-bayes information bottleneck","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.001625Z"},"links":{"cited_paper":"/paper/2109.14509","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:502f56f34f72e6fde425357ce2ae8f4cfdb0f29efbc440d0b5d5ef216bb48310","observation_id":"3917a510-ef47-4ad5-a86d-b4c719afb59f","resolution":{"observed_at":"2026-08-12T11:06:09.001625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.142177Z","title":"Pad-net: Multi-tasks guided prediction-and-distillation net- work for simultaneous depth estimation and scene parsing","venue":null,"work_id":"832f03d9-8a00-4ea6-889a-9a6396c5c513","year":2018},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.004464Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:524f3f10504dc6bd30055966e6c9a18959c4f4b91405b3da9411604ef8a9902c","observation_id":"52292be9-3762-46a9-8091-b9cd093dc10f","resolution":{"observed_at":"2026-08-12T11:06:09.145114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05687","last_updated":"2021-09-13T03:39:52Z","snapshot_observed_at":"2026-08-05T01:06:28.807438Z","submitted_at":"2021-09-13T03:39:52Z","title":"Raise a Child in Large Language Model: Towards Effective and Generalizable Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05687","snapshot_observed_at":"2026-08-12T11:06:09.006926Z","title":"Raise a child in large language model: Towards effective and generalizable fine-tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.006926Z"},"links":{"cited_paper":"/paper/2109.05687","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:e44d43e7ad04b5a3d095426638375154d26ba80b08b0319f9dbe31d991214238","observation_id":"b1412fd6-421e-4df1-853c-aa690408d661","resolution":{"observed_at":"2026-08-12T11:06:09.006926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.133884Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":"0be04916-a351-4504-93f5-0b6a0daef42d","year":2020},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.009977Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:fc5fb40415e94756099350489c21c753a6c0940985ab077a028aaee7308a6be9","observation_id":"229bfbcd-9d35-4079-ac96-05320bc55e18","resolution":{"observed_at":"2026-08-12T11:06:09.137122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-12T11:06:09.012657Z","title":"A large-scale study of representation learning with the visual task adaptation benchmark","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.012657Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:7e8a6831bf6a01a146fea7a324755c2c4fd86c120525b8b1a9277b8e03b7886b","observation_id":"5f85dab9-6d0c-439f-a9ca-fd9bee716163","resolution":{"observed_at":"2026-08-12T11:06:09.012657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.124997Z","title":"A survey on multi-task learning","venue":null,"work_id":"fc02f82e-ee10-407c-9384-80cc8655464b","year":2021},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.015298Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:babf6c5276b767d6fc7a990d87dde42bea0946cd5bcceac2aa3853e7c186bc61","observation_id":"fd272273-1c0c-4526-bc54-5e085b9dcd70","resolution":{"observed_at":"2026-08-12T11:06:09.128010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.115772Z","title":"Joint task-recursive learning for semantic segmentation and depth estimation","venue":null,"work_id":"fd446dab-942d-4dc8-83e7-d5c56732f274","year":2018},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.018115Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:97d3f236d23622ee1814394d3ae2d17c86b345f1d6eaeb4ef49db8a77316baac","observation_id":"f51cabe0-20ac-4e7a-bac0-e18eff2315c3","resolution":{"observed_at":"2026-08-12T11:06:09.119327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:06:09.105095Z","title":"Pattern-affinitive propagation across depth, surface normal and semantic segmentation","venue":null,"work_id":"ec806161-3bcd-4772-9dba-35d7fcf9a156","year":2019},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.020647Z"},"links":{"citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:e210e1e464fa5242f449deb348a54a59a33da35e4239ccbb9b6606f5543f09f7","observation_id":"b217b1f7-aaec-4c7c-a885-42ed73691068","resolution":{"observed_at":"2026-08-12T11:06:09.109763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10136","last_updated":"2024-06-11T22:45:49Z","snapshot_observed_at":"2026-08-13T05:00:43.204753Z","submitted_at":"2023-12-15T18:59:05Z","title":"Gradient-based Parameter Selection for Efficient Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10136","snapshot_observed_at":"2026-08-12T11:06:09.023142Z","title":"Gradient- based parameter selection for efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:09.023142Z"},"links":{"cited_paper":"/paper/2312.10136","citing_paper":"/paper/2411.18615"},"observation_digest":"sha256:dadb465e2f18a0de4aedd0b23bef898ce4c4073e22c8becc5ff01c91a8fcb53b","observation_id":"04a4403c-ac7a-4b23-abcd-0acd4517857d","resolution":{"observed_at":"2026-08-12T11:06:09.023142Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.18615","last_updated":"2024-11-27T18:58:22Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T14:58:03.999734Z","submitted_at":"2024-11-27T18:58:22Z","title":"Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 3 inbound Pith citation observations for arXiv:2411.18615."}