{"as_of":"2026-08-10T06:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3de05dffc45d870cea8251690f2684af890ee4c110dcf2a777005eedf58604d8","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:48:38.958431Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07485/citation-record","integrity":"/paper/2507.07485/integrity","json":"/paper/2507.07485/citation-record.json","paper":"/paper/2507.07485"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:50.749880Z","title":"Mult: an end-to-end multitask learning transformer","venue":null,"work_id":"d1f01e62-db3d-4ad5-ba4f-b7995c098bc0","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.674604Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ea80f9ca7d2428da4656e5c49ee96a49b690c45ed5394697c0a71c78bdd4738a","observation_id":"fecf09e9-5969-4f7e-bf2d-d734db82bb85","resolution":{"observed_at":"2026-08-06T18:48:50.861375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:50.485725Z","title":"Stochastic filter groups for multi-task cnns: Learning specialist and gener- alist convolution kernels","venue":null,"work_id":"7d0fa78f-4af6-42a4-b369-96c019478330","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.824263Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:98340b2ef49e03a4c3bb1d0431fbee925f712c3a4e8ac058bc60804912fae974","observation_id":"4ce171c5-55b1-489f-bf0b-93d6a1fe8326","resolution":{"observed_at":"2026-08-06T18:48:50.615095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.10292","last_updated":"2021-05-11T17:58:18Z","snapshot_observed_at":"2026-08-09T03:02:09.246139Z","submitted_at":"2020-08-24T09:49:19Z","title":"Automated Search for Resource-Efficient Branched Multi-Task Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.10292","snapshot_observed_at":"2026-08-06T18:48:30.167420Z","title":"Automated search for resource- efficient branched multi-task networks","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.167420Z"},"links":{"cited_paper":"/paper/2008.10292","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:39414c4ed74fd1fb227f1b26dee684d90421f184d294b07bd75680a6e1fd3a50","observation_id":"781e05b3-2753-423b-bf3d-c812e0ef5d9f","resolution":{"observed_at":"2026-08-06T18:48:30.167420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:50.234381Z","title":"Multi-task learning for multi-objective evolutionary neural architecture search","venue":null,"work_id":"68b939e8-f32d-4b7c-b5ff-1099997579f0","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.395849Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ec3d271e970101d46eae4989ea509da13a70800981cae64b7ecac1f371f35f1f","observation_id":"062bc205-5f6a-4c00-b9ae-4bc6f3972921","resolution":{"observed_at":"2026-08-06T18:48:50.358067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.936724Z","title":"Multitask learning","venue":null,"work_id":"dbbd5ba4-dfee-4256-92bc-8192c0bb10f1","year":1997},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.559093Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:c03fbcd24806b5333a0542199a2062a6f806bf46ffe56b2f334a600c36bf8ab4","observation_id":"c814037d-3c1d-4800-a4c5-c637e019db2c","resolution":{"observed_at":"2026-08-06T18:48:50.090105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.688165Z","title":"Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks","venue":null,"work_id":"6df46c2b-5188-4081-9d83-ccce91772acf","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.763211Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:7e697e10b224bf15a1a28c160da5341572263057735dab96f7477f65e9cae0b6","observation_id":"f7629f9a-a29d-47bc-9f21-6d7e35c753dc","resolution":{"observed_at":"2026-08-06T18:48:49.775173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.472989Z","title":"Just pick a sign: Optimizing deep multitask models with gra- dient sign dropout","venue":null,"work_id":"70a456e5-28b8-4e3a-8000-eff6dd038e34","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.921696Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e07dc10bc63c28091228b219cba7de642e33f859b80ae857ef0bdd028554c6c6","observation_id":"f251ddd1-8f31-4d54-8287-db81035d507b","resolution":{"observed_at":"2026-08-06T18:48:49.575397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.206164Z","title":"Mod-squad: Designing mixtures of experts as modular multi-task learners","venue":null,"work_id":"f6b4a539-2866-404e-a28a-3a28d86f68a4","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.143715Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:035306d0cf6f253cebd560ee5ec173ab730a5c31cf78b710f58a6eb0247e752b","observation_id":"271a6ac8-cfd8-43a5-b202-a1900ac92752","resolution":{"observed_at":"2026-08-06T18:48:49.321291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09796","last_updated":"2020-09-10T19:31:04Z","snapshot_observed_at":"2026-08-09T08:30:49.737024Z","submitted_at":"2020-09-10T19:31:04Z","title":"Multi-Task Learning with Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09796","snapshot_observed_at":"2026-08-06T18:48:31.272266Z","title":"Multi-task learning with deep neural networks: A survey","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.272266Z"},"links":{"cited_paper":"/paper/2009.09796","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:89cfb1cf3de83a59f40056f9da7ecd413e98b07884a6fbab4ad5a14ab8ebdc6a","observation_id":"80058b8f-1dba-4fa1-a457-33252f403a32","resolution":{"observed_at":"2026-08-06T18:48:31.272266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.946683Z","title":"Instance-aware se- mantic segmentation via multi-task network cascades","venue":null,"work_id":"8e38afb2-7f52-4a01-95e5-401d417cff8b","year":2016},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.426283Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:3d5688014b93fff971505a8829070cea90234645e9467ccfd5f213bfb8951b6a","observation_id":"e312c736-64f7-4f70-bcbb-99c8b1739038","resolution":{"observed_at":"2026-08-06T18:48:49.073544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.646346Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"97495d23-40bc-403a-bd54-b6b201c23532","year":2009},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.569245Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:549e5777d96df052164b46f4e7736468692fe96663cfb03772d591cc3e79f0b0","observation_id":"78f7444d-0501-47ae-83fc-361f8ff61f02","resolution":{"observed_at":"2026-08-06T18:48:48.777014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.412515Z","title":"Multiple-gradient descent algorithm (mgda) for multiobjective optimization","venue":null,"work_id":"f0077a96-6dc4-4edd-8625-7b766dc4e6e3","year":2012},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.734799Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:5ff41d706927b07311a557576a5cf26f7313a22ca3a8a61608a0207eabaa4bf3","observation_id":"c1ba4ce6-f68f-40a8-ae16-0dcc16fcecff","resolution":{"observed_at":"2026-08-06T18:48:48.515634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T18:48:31.876135Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.876135Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:da5fefa4da54406b7702cba83ede049df58a53c617516eb3c33532b1c2b015e2","observation_id":"8aa0341d-b011-49e0-ac54-d62edcb87143","resolution":{"observed_at":"2026-08-06T18:48:31.876135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.098354Z","title":"Representation similar- ity analysis for efficient task taxonomy & transfer learning","venue":null,"work_id":"ff3b5874-443d-4bfd-a336-14c0b12f022a","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.009274Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:859d8716345b93077f344ac99869a80a5e868697f6f608526eed18bd61a2b594","observation_id":"8e5222a8-b794-4e34-af9e-b3e5612ae5da","resolution":{"observed_at":"2026-08-06T18:48:48.247012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:32.150261Z","title":"Predicting depth, surface nor- mals and semantic labels with a common multi-scale con- volutional architecture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.150261Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:6073899173b2aad2515ab6f6dda763452cddeae73f3bfb5b58669cd3780840b5","observation_id":"21c91871-9fb6-497d-9cd5-11db67abaa2a","resolution":{"observed_at":"2026-08-06T18:48:32.150261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.836118Z","title":"The pascal visual object classes challenge 2012 (voc2012) development kit","venue":null,"work_id":"0b5347ff-f96c-4d1b-baf4-2f4dfd28c5f7","year":2012},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.351733Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:d67444b549598f4915663f2f67361fc5d62737ab26c41752d0c519c24c526d1f","observation_id":"1bb1cfdc-f3be-48fc-9250-cbe574e0f54f","resolution":{"observed_at":"2026-08-06T18:48:47.918033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:32.524698Z","title":"M 3vit: Mixture-of-experts vision transformer for efficient multi- task learning with model-accelerator co-design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.524698Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e2d735b0b2b718588ca9ad711ae997458e330a801d57b59c2cc3de2bfbedb6ea","observation_id":"3ae8bae1-0345-4983-8602-646612e55f58","resolution":{"observed_at":"2026-08-06T18:48:32.524698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.08734","last_updated":"2017-01-30T18:06:07Z","snapshot_observed_at":"2026-08-08T23:54:34.458489Z","submitted_at":"2017-01-30T18:06:07Z","title":"PathNet: Evolution Channels Gradient Descent in Super Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.08734","snapshot_observed_at":"2026-08-06T18:48:32.677340Z","title":"Pathnet: Evolution channels gradient descent in super neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.677340Z"},"links":{"cited_paper":"/paper/1701.08734","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:5e9a86e92c699db4516ef29d471bb4deeeededb7f83a7b5e2399037ca417c2cb","observation_id":"aa8e72a3-5413-4bd5-8498-4538cbde0eed","resolution":{"observed_at":"2026-08-06T18:48:32.677340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.609408Z","title":"Nddr-cnn: Layerwise feature fusing in multi-task cnns by neural discriminative dimensionality reduction","venue":null,"work_id":"1de74a91-ee04-4d5b-843c-8d096c9a06b3","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.808495Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ae00e1d70846c5ac827f0c5956ebe2e7647213743a4b78378edbe6d7a70c4a98","observation_id":"55ffe5c8-fd40-40a0-9fe0-f630d4d7a200","resolution":{"observed_at":"2026-08-06T18:48:47.738040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.316897Z","title":"Mtl-nas: Task-agnostic neural architecture search towards general-purpose multi-task learning","venue":null,"work_id":"928df65f-87c1-45a2-9eef-7c1cb60ea540","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.957285Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:6b2cdfbc9f0070fc7174bdef40526f741a9fe715f9eb521379c8d3aeb57f0368","observation_id":"328cc590-f052-4edb-aded-2558016eca5a","resolution":{"observed_at":"2026-08-06T18:48:47.478632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.139230Z","title":"Recon: Reducing conflicting gradients from the root for multi-task learning","venue":null,"work_id":"e1086d58-4216-4fd4-9095-418157b803ef","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.108298Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:b4c6248d56b9b6cfdfc92433a123540d7d0ba0e4928728efd9a421ba56706d9d","observation_id":"6390a255-898d-405f-b071-1f50578df0a2","resolution":{"observed_at":"2026-08-06T18:48:47.201119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:33.250866Z","title":"Dynamic task prioritization for multitask learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.250866Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:191125cbaaaa06a7dbb9799b302a80148f798347e7c2672b50fa1f1452fcd077","observation_id":"31949ec6-e944-4300-9505-72631582833f","resolution":{"observed_at":"2026-08-06T18:48:33.250866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.869179Z","title":"Learn- ing to branch for multi-task learning","venue":null,"work_id":"5c595cf1-0e1c-4fe2-8f90-6fb07a271b32","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.462644Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:81857291f4663d5c3550aacee0eb40a6a3b6749f15ea798e4a42c1bdaefdcc99","observation_id":"5b586913-eb12-47a9-98e7-bfbd92dfb6e4","resolution":{"observed_at":"2026-08-06T18:48:47.015886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.772341Z","title":"Learn- ing to branch for multi-task learning","venue":null,"work_id":"f2d1a59f-89d3-4059-ae83-d5eda1063335","year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.656219Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:959fcc56744886f16be70fd4e7d546eee8dde55007819e46ee047f16038f8097","observation_id":"7007754f-2ec5-4cb3-abae-d9597b560b02","resolution":{"observed_at":"2026-08-06T18:48:46.811512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.676893Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"9de867c5-7398-4084-ae60-c25fefbefe47","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.795485Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:b6a4b7f9f797ddeb85b96936083af903910419a31558e0723d1c8f3a977f924a","observation_id":"41e9c13c-fd13-4b41-9188-f3e6db761062","resolution":{"observed_at":"2026-08-06T18:48:46.713260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.498477Z","title":"Going beyond multi-task dense prediction with synergy em- bedding models","venue":null,"work_id":"d80822a3-9793-4469-8bb4-570805ba13be","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.916832Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:613db28dfff265405ff8505a1aaca712b619c97a427f4a3bd5fb132e711768df","observation_id":"40b64a45-bd0e-4aff-be0c-db1c058ef4cd","resolution":{"observed_at":"2026-08-06T18:48:46.613906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02631","last_updated":"2022-02-16T11:20:05Z","snapshot_observed_at":"2026-08-09T00:20:02.441313Z","submitted_at":"2021-03-03T19:03:52Z","title":"RotoGrad: Gradient Homogenization in Multitask Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.02631","snapshot_observed_at":"2026-08-06T18:48:34.097023Z","title":"Rotograd: Gradi- ent homogenization in multitask learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.097023Z"},"links":{"cited_paper":"/paper/2103.02631","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:7c7c92efc3287f2636d47f038c5dcfae1ac272f8aaf565be2e6f3a0f0b551650","observation_id":"ada1e55c-6c7a-40ed-b5c7-a0907fbbcf0b","resolution":{"observed_at":"2026-08-06T18:48:34.097023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.317913Z","title":"Quantifying task pri- ority for multi-task optimization","venue":null,"work_id":"429a7e18-2647-4bf0-894b-5ab0a5b20135","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.224503Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:fc62f7ff9d0e8233f297852e4cd5c67bcec40510fd71ff34d9af6d56aae022cb","observation_id":"502fb8a2-ebe6-40e6-800c-033f6bd6f215","resolution":{"observed_at":"2026-08-06T18:48:46.375068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11986","last_updated":"2025-04-22T15:24:22Z","snapshot_observed_at":"2026-08-07T18:12:40.637599Z","submitted_at":"2025-02-17T16:26:05Z","title":"Selective Task Group Updates for Multi-Task Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11986","snapshot_observed_at":"2026-08-06T18:48:34.286201Z","title":"Selective task group updates for multi-task optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.286201Z"},"links":{"cited_paper":"/paper/2502.11986","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e87528d3a6a0e7e9e81e4afa77c2493bfc526482f3e3778d9095fbb0f4e94b59","observation_id":"92a15a07-2a8a-4bc7-beb6-36fa4161daaa","resolution":{"observed_at":"2026-08-06T18:48:34.286201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.057727Z","title":"Forkmerge: Mitigating negative transfer in auxiliary-task learning","venue":null,"work_id":"afb988de-c6b0-46d2-a9e9-2c3d25c5329a","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.405324Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ba41f4e318e36e3554429eb3bf06af08c9b714a6a747ed9f54f0fd6b1e96bb6f","observation_id":"e0749efc-7a4a-4f3c-86f2-1493cab64f1b","resolution":{"observed_at":"2026-08-06T18:48:46.206402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.905799Z","title":"Principal component anal- ysis: A review and recent developments","venue":null,"work_id":"f71a1054-b623-49ff-a869-e8ea4e7a301d","year":2016},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.586586Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:92490ea8858c9876f0c85a0d808f56b79e081fa42557620dbbc19ec73ac578d0","observation_id":"24d4da77-9638-4616-a28a-7fd7021f617d","resolution":{"observed_at":"2026-08-06T18:48:45.957099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:34.688994Z","title":"Multi-task learning using uncertainty to weigh losses for scene geome- try and semantics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.688994Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:89f59c24792b652dea3c30ab6a05f3cff7d72bc1a9d9a0e9e5764ecf19f2384d","observation_id":"43b4b6af-e5b9-423f-873c-0b4a6334ed34","resolution":{"observed_at":"2026-08-06T18:48:34.688994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.634081Z","title":"Evo- lutionary architecture search for deep multitask networks","venue":null,"work_id":"34b72e44-c1ab-437f-935a-bd12a0c90c9c","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.780014Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:bbf533999195eb0fa1d2dd4109ca7f67d4f60570b69d99358c4b05cfe75f3b7b","observation_id":"7020b02c-f09a-44f4-bfc0-4b65d0e4a87f","resolution":{"observed_at":"2026-08-06T18:48:45.775092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.382699Z","title":"Conflict-averse gradient descent for multi-task learn- ing","venue":null,"work_id":"b9ce703e-c5c1-4e9e-affb-e3a332459c94","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.879410Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:4d8400ec7a3ee87d33c8cd6c8d8a19e5931267f1feb4f21b93a6412bb9963cee","observation_id":"4a0c7629-4be0-4e65-976b-52b455fe8688","resolution":{"observed_at":"2026-08-06T18:48:45.481085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.192815Z","title":"Famo: Fast adaptive multitask optimization","venue":null,"work_id":"fdfb7305-f077-411b-9e60-03ec9542d819","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.962590Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:7c12ebecfa2bb11b000751ef15fe672f8966cc538a1127dd7c6209050ed46e5e","observation_id":"8fd9ff9e-ca99-4f1a-835f-60ba30fa728c","resolution":{"observed_at":"2026-08-06T18:48:45.270545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.923727Z","title":"Towards impartial multi-task learning","venue":null,"work_id":"418392d8-ca57-4c22-b1a1-9bb95a109350","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.060933Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:9aa042bae4d47e821b1988f9870fd1723dc40d595e063d37c55825f58a3ebdeb","observation_id":"fb01b006-a983-4f5c-a8a7-83bb4a82f424","resolution":{"observed_at":"2026-08-06T18:48:45.067762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.648144Z","title":"End- to-end multi-task learning with attention","venue":null,"work_id":"029a1106-795b-447f-bf0d-9b857e9e5f1b","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.182541Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:fcad36b4360d74878ed2851640018ba7289643353c2390f637323f6dbefcdf16","observation_id":"01be7dfd-985a-44f4-ae07-7a4c96f7b208","resolution":{"observed_at":"2026-08-06T18:48:44.762597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.287041Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.287041Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:cab882ee85afde8a7d1c6dac51b636c95039db0f6da57fcc76452e24d70e5f87","observation_id":"d57134b6-bd90-4ef0-b56f-a2e30141bdb3","resolution":{"observed_at":"2026-08-06T18:48:35.287041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.513425Z","title":"Fully-adaptive feature shar- ing in multi-task networks with applications in person at- tribute classification","venue":null,"work_id":"2267c1fe-3b4e-44a4-88cd-ccb6fb159f1f","year":2017},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.355872Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:12bdb94d8474f53c7c1452b9e455853d73529f7595322e8535c6877edf2159bb","observation_id":"a65ed0cb-76dc-42ac-aae5-0a0315da0c76","resolution":{"observed_at":"2026-08-06T18:48:44.563854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.441034Z","title":"Modeling task relationships in multi-task learning with multi-gate mixture-of-experts","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.441034Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:26b93b71468ed2a76634f9f32bf1369d7975b054acc9f6f50d76b6aef54cc053","observation_id":"a34c10d1-8c33-4033-a004-39822818204e","resolution":{"observed_at":"2026-08-06T18:48:35.441034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.361900Z","title":"Attentive single-tasking of multiple tasks","venue":null,"work_id":"d723f910-3f6b-4928-82ec-3f0ce9d234d3","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.523440Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:0635f57202391d09a71ee2d58fc6ce9b5833f14e10347638d4f6a845d21d4882","observation_id":"98fbd9d7-b3e9-4909-adc3-55f9b66a5176","resolution":{"observed_at":"2026-08-06T18:48:44.439519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.607735Z","title":"The role of context for object detection and semantic segmentation in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.607735Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:11da8041793241c2a12214a464091f23f135315de1a407c7f10aef95ac6e51ca","observation_id":"a787a70f-02d7-436c-879d-f3080c931f82","resolution":{"observed_at":"2026-08-06T18:48:35.607735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.139266Z","title":"Multimodal contrastive learn- ing with limoe: the language-image mixture of experts","venue":null,"work_id":"aacbbd2a-5259-4aef-8f06-badbb289316d","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.673934Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:4b1d248cd51d9d774e88d87bf417db7b0b27fe997aed1968a44fa4fce6af28e9","observation_id":"6f9977dd-c985-4a50-9c98-ca0b78ac5fda","resolution":{"observed_at":"2026-08-06T18:48:44.237370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01017","last_updated":"2022-07-08T12:00:51Z","snapshot_observed_at":"2026-08-09T06:27:19.794815Z","submitted_at":"2022-02-02T13:21:53Z","title":"Multi-Task Learning as a Bargaining Game","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01017","snapshot_observed_at":"2026-08-06T18:48:35.755632Z","title":"Multi- task learning as a bargaining game","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.755632Z"},"links":{"cited_paper":"/paper/2202.01017","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:a49faae5e3da56d287e7510cac786ab96733daa5b22d05e59ba50d75665fb822","observation_id":"5c2ef916-3732-4d8a-8444-c2fe7656f3e6","resolution":{"observed_at":"2026-08-06T18:48:35.755632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.898406Z","title":"What is being transferred in transfer learning? Advances in neural information processing systems , 33:512–523, 2020","venue":null,"work_id":"8f7df5a2-83e1-44f9-a8e4-298039c87add","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.848027Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:06a1959d2b3b9d0138065df8a40f629de4b493e64a82568c9f662bcf2034516d","observation_id":"6dd9ca90-b607-43e8-8346-9b6f91d8f335","resolution":{"observed_at":"2026-08-06T18:48:44.014755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05226","last_updated":"2019-06-12T16:01:35Z","snapshot_observed_at":"2026-07-06T07:59:51.589340Z","submitted_at":"2019-06-12T16:01:35Z","title":"Continual and Multi-Task Architecture Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05226","snapshot_observed_at":"2026-08-06T18:48:35.937987Z","title":"Continual and multi-task architecture search","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.937987Z"},"links":{"cited_paper":"/paper/1906.05226","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:406441b3ab739b1e4411967428ba2a2da5313451034332591185eda8c09582b6","observation_id":"cd0f000a-516a-4889-b533-445f8385c292","resolution":{"observed_at":"2026-08-06T18:48:35.937987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.663290Z","title":"Scaling vision with sparse mix- ture of experts","venue":null,"work_id":"65af57fd-0cf0-4501-a6d8-355d6c5fba92","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.090614Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ce0f000ad0ad8439d72fe3a39ca798c2b96a8376bff31ce68477c6d7a177e5e2","observation_id":"da61be4d-5d47-4736-a2fc-5eb3ae4fd660","resolution":{"observed_at":"2026-08-06T18:48:43.721845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.358693Z","title":"Multi-task learning as multi-objective optimization","venue":null,"work_id":"6b83d321-f05e-4bdc-b613-5b744b69792b","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.181436Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:a6c8a3030a86846b445aac8b8bffa021ba6487eac6710e0a9962ce28820c813d","observation_id":"3fd05bf1-56f6-4acd-80ad-3727789be5da","resolution":{"observed_at":"2026-08-06T18:48:43.529171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.085538Z","title":"Independent component alignment for multi-task learning","venue":null,"work_id":"ee27f77a-97db-4044-9c77-5b17cb4cd1f3","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.329380Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:7d7972a78ab72a181d027a1aaf383af7055252ca3c0ab61a7ae689d305153090","observation_id":"9a674533-8282-43d5-9997-5d25bd8048b6","resolution":{"observed_at":"2026-08-06T18:48:43.215508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.900387Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"52ddee6e-c977-44ed-a51f-fd0d2e205116","year":2012},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.444238Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:dd27b9b65e40320e36530295dbe25b86c7da208229761c047ad9f9e8c0d2e488","observation_id":"9c8a074e-d57f-4d34-8396-c17399a594c8","resolution":{"observed_at":"2026-08-06T18:48:42.959890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.713883Z","title":"One-shot neural architecture search for deep multi-task learning in computer vision, 2020","venue":null,"work_id":"39809945-ca23-48ff-a35f-fe9a8c10d28b","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.527790Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:371baa7e3d2fd4626a4a9fc118b67749ea39b65b1556524e7f6be14b9384bcaa","observation_id":"f7bc6950-d762-4f85-b4b1-91c685c38310","resolution":{"observed_at":"2026-08-06T18:48:42.816738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T18:48:36.638196Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.638196Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:38e83340f822bcffdba547a32723aed6071de1ca033ef10c501bc004a1e86808","observation_id":"dd7494ac-ae7d-42e1-b7e7-6cb833c42ac9","resolution":{"observed_at":"2026-08-06T18:48:36.638196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.449910Z","title":"Gradient adversarial training of neural networks","venue":null,"work_id":"22334496-ccf3-4430-9f8e-fe0e731ce614","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.763733Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:eadd36aeabcdfffb54aea61afa6a2f277a45696eec46d7a1c14184ee69273b51","observation_id":"b2dc4f2a-1093-494d-b60d-e3fbf638ea9f","resolution":{"observed_at":"2026-08-06T18:48:42.551703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.183522Z","title":"Task switching network for multi-task learn- ing","venue":null,"work_id":"d851d610-f823-4b5e-ba7c-dad812369800","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.882047Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:a6f78e6fa0fbe991682985a31fb472d4762ec9373c1650f742415264caa77c60","observation_id":"e980d482-c870-425b-b834-4244c732c338","resolution":{"observed_at":"2026-08-06T18:48:42.309014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02920","last_updated":"2020-08-13T06:44:45Z","snapshot_observed_at":"2026-08-06T04:07:36.980294Z","submitted_at":"2019-04-05T08:00:32Z","title":"Branched Multi-Task Networks: Deciding What Layers To Share","version":5},"cited_work":{"arxiv_id":"1904.02920","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.02920","snapshot_observed_at":"2026-08-06T18:48:39.076367Z","title":"Branched Multi-Task Networks: Deciding What Layers To Share","venue":"cs.CV","work_id":"2d5752a0-ede0-4a08-a0b7-110db9e0dedd","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.001910Z"},"links":{"cited_paper":"/paper/1904.02920","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ac04bf6714eed96b39b93675a06ea40b46c3979d6a1f3fd33e25369152a04dbe","observation_id":"67394e19-30d7-41ce-af5c-3f2be19b2c8b","resolution":{"observed_at":"2026-08-06T18:48:39.185135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.011685Z","title":"Mti-net: Multi-scale task interaction networks for multi-task learning","venue":null,"work_id":"6f562cbb-2533-40f0-858c-4b850fbc2e39","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.146416Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:1aa3847bcf09c4101e9265c42b737d546ef60acb90378b855645ae8069759dbe","observation_id":"28a406ea-d2d0-4640-8161-f6d115e98168","resolution":{"observed_at":"2026-08-06T18:48:42.068353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.283345Z","title":"Pyramid vision transformer: A versatile backbone for dense prediction without convolutions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.283345Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:642d1fc1a8f7a5e271bf6b9653e0c2fe7d963c6fa59cbea864407175f19ee6e1","observation_id":"8d16a64b-0a07-453b-a56f-191b8eb8ea8e","resolution":{"observed_at":"2026-08-06T18:48:37.283345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.00154","last_updated":"2021-10-08T06:56:25Z","snapshot_observed_at":"2026-07-06T11:34:22.048470Z","submitted_at":"2021-07-31T05:52:21Z","title":"CrossFormer: A Versatile Vision Transformer Hinging on Cross-scale Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.00154","snapshot_observed_at":"2026-08-06T18:48:37.392730Z","title":"Crossformer: A versatile vision transformer hinging on cross-scale attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.392730Z"},"links":{"cited_paper":"/paper/2108.00154","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:311da0e3ff3536ea9741d0a9d9b637ebb91441aecdd261e1c286474b17ff664e","observation_id":"e18ffccc-cc9d-44c7-84aa-1bb21af7bc7b","resolution":{"observed_at":"2026-08-06T18:48:37.392730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.699617Z","title":"Segformer: Simple and efficient design for semantic segmentation with transform- ers","venue":null,"work_id":"a13411a7-6673-4901-a8fd-c4d1242168d9","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.501985Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:908ddeac74de281190f4643ec863d888a771337edb7862920c31d2e5719fe8c6","observation_id":"913535d4-8906-4dbf-b644-9988673d876c","resolution":{"observed_at":"2026-08-06T18:48:41.838741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.537365Z","title":"Pad-net: Multi-tasks guided prediction-and-distillation net- work for simultaneous depth estimation and scene parsing","venue":null,"work_id":"f31817ab-b180-4cea-9984-19f7008cdaa2","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.614147Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f5b16017daf24992d4fb3079a231486131ea132604cb038e489b37c99348e34e","observation_id":"05e3e9f1-943a-4afa-bdeb-a041cdade615","resolution":{"observed_at":"2026-08-06T18:48:41.606439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.228111Z","title":"Mtformer: Multi-task learn- ing via transformer and cross-task reasoning","venue":null,"work_id":"bccdae42-fbeb-4efc-9df9-9ac5adf27c49","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.714586Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:093f49c4b4c5e905bbe5cff073585fcdfeec2a611d017ec584f170848d6f920d","observation_id":"f7fcbc18-4270-45a4-a582-d5f2604a1d53","resolution":{"observed_at":"2026-08-06T18:48:41.417387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.012040Z","title":"Multi-task learning with multi-query trans- former for dense prediction","venue":null,"work_id":"18e58fd8-6580-47cb-93fa-a2c6ad2a988e","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.825793Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:4041737b6d442244b3ed62520dceaaf73443b339f8d41a82de547576f110fbf8","observation_id":"f18c0010-f9fa-47b8-b651-af4f2b875a9b","resolution":{"observed_at":"2026-08-06T18:48:41.135657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.723273Z","title":"Demt: De- formable mixer transformer for multi-task learning of dense prediction","venue":null,"work_id":"56f007d3-2316-4296-8a06-da6b3e0ed3c0","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.918671Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:59dd0919c69fa32d999445933455e4c29ad09a9fe59215240960502169990db0","observation_id":"7fca0a7a-dc59-4eec-a708-9867c2828fab","resolution":{"observed_at":"2026-08-06T18:48:40.822560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00641","last_updated":"2021-07-01T17:56:09Z","snapshot_observed_at":"2026-08-10T03:12:30.956293Z","submitted_at":"2021-07-01T17:56:09Z","title":"Focal Self-attention for Local-Global Interactions in Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00641","snapshot_observed_at":"2026-08-06T18:48:38.030618Z","title":"Focal self-attention for local-global interactions in vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.030618Z"},"links":{"cited_paper":"/paper/2107.00641","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:09cf5078fa714e81fbd57606d00578b1ea74e751b04fdda8c533d4aec28d4471","observation_id":"11e92a37-aad1-48f9-a5f7-6c9e5cae0ffe","resolution":{"observed_at":"2026-08-06T18:48:38.030618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:38.155006Z","title":"Inverted pyramid multi-task trans- former for dense scene understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.155006Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:bb14eb285e184a8849d105b002622efeff5d2b978350889d5660ea8fce7139b0","observation_id":"2e1d4645-e548-49e7-99a9-a46558994a44","resolution":{"observed_at":"2026-08-06T18:48:38.155006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.268166Z","title":"Taskprompter: Spatial-channel multi-task prompting for dense scene understanding","venue":null,"work_id":"99ee1d9d-61f2-4177-83be-fb29db3a7f58","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.405272Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e50624fe59bbdc929dfff8757773833bdce9eccfd0b9867da28ea25a87a9009b","observation_id":"29ee07f6-4be9-4786-a623-fc009c317de8","resolution":{"observed_at":"2026-08-06T18:48:40.354497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.118832Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":"00af5cea-5db8-4785-bd8b-9c1852ecb2cf","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.563905Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:a5ae247a649114d7c752d5f7989526bc5fff8dc1ec5d58b71455da82b5ca0547","observation_id":"60517d35-9d75-41de-a6ab-3a962973cac4","resolution":{"observed_at":"2026-08-06T18:48:40.183323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:39.857523Z","title":"Taskonomy: Disentangling task transfer learning","venue":null,"work_id":"b1215ccb-7201-4850-8341-663f3b952a7f","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.657342Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:3afda8b1f6771411e416500710797f19b45c599b597ff43459611d507be8cd30","observation_id":"8673fcda-e495-4afb-987a-029f101123e6","resolution":{"observed_at":"2026-08-06T18:48:39.989515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05144","last_updated":"2022-10-11T04:54:05Z","snapshot_observed_at":"2026-07-06T14:03:25.739373Z","submitted_at":"2022-10-11T04:54:05Z","title":"Mixture of Attention Heads: Selecting Attention Heads Per Token","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05144","snapshot_observed_at":"2026-08-06T18:48:38.748604Z","title":"Mixture of attention heads: Selecting attention heads per token","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.748604Z"},"links":{"cited_paper":"/paper/2210.05144","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:44945833f4354099cc5fb0c64d076e58a70e265c1b1ea31929c185f8d30ce2d3","observation_id":"c0620691-263f-49d0-9227-6f2bacb2b558","resolution":{"observed_at":"2026-08-06T18:48:38.748604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:39.634899Z","title":"Facial landmark detection by deep multi-task learning","venue":null,"work_id":"1acd56c8-2bee-4ea2-a456-c6d009a2d911","year":2014},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.852732Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:5ee485877ef980849fc17140e3e13db29964134d50e3d291aca8fac2205717cb","observation_id":"a70b8529-464f-4dcf-adbd-8a729a2d4d4b","resolution":{"observed_at":"2026-08-06T18:48:39.702232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:39.389465Z","title":"Pattern-affinitive propagation across depth, surface normal and semantic segmentation","venue":null,"work_id":"27b8228f-0286-4d11-97f7-621a86c5fd4c","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.958431Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:3b5f6c9575f7114f6e8881d612dcc0fd912a6dea575ad1e1beabe3f90bc0d5cf","observation_id":"427396f2-410a-43f5-bb85-290f1c047da9","resolution":{"observed_at":"2026-08-06T18:48:39.470318Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.454700Z","title":"2, 8, 12","venue":null,"work_id":"af60381f-7caf-4845-b443-64ae10132b79","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":530,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.262858Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f67398db9dc97990887d30cc23f3a67c0eb46ef6f8ae1913c05f417fc4533fad","observation_id":"2fe39442-677e-4ae9-90f2-384e5dd3d5ad","resolution":{"observed_at":"2026-08-06T18:48:40.585241Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T14:09:21.739254Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":21,"verified_exact":1,"verified_fuzzy":48},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2507.07485."}