{"as_of":"2026-08-17T23:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34da43a54a89fc00af24f7718f7b7a3b0c5450d11ce07df3b6a1ca6e5f2adf8a","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:33:54.859934Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:39:31.501650Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T22:40:50.020823Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"cited_work":{"arxiv_id":"2412.10028","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.10028","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1f4363d9-60dc-47c7-8870-4551109c1348","year":2024},"citing_paper":{"arxiv_id":"2604.04908","last_updated":"2026-04-06T17:52:58Z","snapshot_observed_at":"2026-08-13T00:59:07.586625Z","submitted_at":"2026-04-06T17:52:58Z","title":"HI-MoE: Hierarchical Instance-Conditioned Mixture-of-Experts for Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T19:39:31.501650Z"},"links":{"cited_paper":"/paper/2412.10028","citing_paper":"/paper/2604.04908"},"observation_digest":"sha256:c412a2b88a6c2c81c3fa72f28c04d4fc9ecb6e2f635488f5e51dde0ff5fc51b7","observation_id":"7514d116-b4f1-4658-84ad-3c2ad0c33d9b","resolution":{"observed_at":"2026-05-10T22:40:50.023378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.10028/citation-record","integrity":"/paper/2412.10028/integrity","json":"/paper/2412.10028/citation-record.json","paper":"/paper/2412.10028"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.430729Z","title":"End-to-end object detection with transformers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.430729Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:f3c45430e584709d3b998bb133b9d9786a0fc15e68409dcfc49178f453cd098f","observation_id":"c7ec077b-d7cf-40f3-87a1-13d929db8662","resolution":{"observed_at":"2026-08-11T16:33:54.430729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.436063Z","title":"Dab-detr: Dynamic anchor boxes are better queries for detr,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.436063Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:748ba41158e08fcdb18173a1b09c8fa113a7e5d5ee9e4a54d384f04ba3878de2","observation_id":"7697b90d-53f9-4691-aae0-80766bb384de","resolution":{"observed_at":"2026-08-11T16:33:54.436063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.441077Z","title":"Conditional detr for fast training convergence,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.441077Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:7b269ffb2b032be3f0aa948ff9c5feac2e81259f365b16dd91fd9014188fe30a","observation_id":"89becba2-621a-4b9c-ac31-1faa6e9acdb3","resolution":{"observed_at":"2026-08-11T16:33:54.441077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.446614Z","title":"Anchor detr: Query design for transformer-based detector,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.446614Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:3269afac2d006526b43b1aac95c3cbbc7e2b862eeb1f3e9b0fc4721efd57bef9","observation_id":"dbc87e6a-e714-496e-b3b9-af3bae78d74e","resolution":{"observed_at":"2026-08-11T16:33:54.446614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.451355Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.451355Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:4902ddff8befb0cb1ab338306872a604736f0686509993069f14a937fe088e84","observation_id":"7a39950d-a290-4fd4-8827-12b40e36670b","resolution":{"observed_at":"2026-08-11T16:33:54.451355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.456172Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.456172Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:b33823d458e3a586b3540fd1e35632c0f0a34eb7cb94ebad7832f8ddb5b1926a","observation_id":"b23f107a-539f-4e18-bd02-bfa5b22bafa0","resolution":{"observed_at":"2026-08-11T16:33:54.456172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.460826Z","title":"Fcos: A simple and strong anchor-free object detector,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.460826Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:b8ad74bf69388d841efe04652c252289e8f3188619410c252bb3dd50b06913a7","observation_id":"4ab03a1a-2ad6-4a24-bc52-be9d30540493","resolution":{"observed_at":"2026-08-11T16:33:54.460826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.465034Z","title":"Detrs with hybrid matching,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.465034Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:b15b7c548569c1d1a8df002f985dfa3b80857d2ffb0cfda29a3a0427cef1da91","observation_id":"86a561f8-e3ac-4749-bd90-b62e250446c7","resolution":{"observed_at":"2026-08-11T16:33:54.465034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.469064Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.469064Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:c9a1337db6c42890fdada54ffa44e1ff84ce17530983a615ce744240e3e6bf15","observation_id":"e13728aa-b77d-40bc-b9b8-a05390879066","resolution":{"observed_at":"2026-08-11T16:33:54.469064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.473086Z","title":"Rethinking transformer- based set prediction for object detection,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.473086Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:f3bff69fbb7902163926d38cf4e9b64d80afe276740d09462e23538cfad3d3bc","observation_id":"9d6a207c-ec0d-4aa4-a349-9aef4b864da0","resolution":{"observed_at":"2026-08-11T16:33:54.473086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.477516Z","title":"Deformable detr: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.477516Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:60bea3847207b5978897ac08cc0ace4aa459b80813b91ec7c5bc9d456a39ded4","observation_id":"90ad6db7-5177-4178-b169-df96e28a036b","resolution":{"observed_at":"2026-08-11T16:33:54.477516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.481479Z","title":"Align-detr: Improving detr with simple iou-aware bce loss,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.481479Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:32bc4302d0eb2f08cfca2695a6e26982d519a66b08e30e47e7e23f8234566dbf","observation_id":"931a49c4-ff08-4d77-ac3a-d102a4759f68","resolution":{"observed_at":"2026-08-11T16:33:54.481479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.485510Z","title":"Dac-detr: Divide the attention layers and conquer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.485510Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:b20c04645803aaafc2464530d11e3189ce128fabdbb04ca1b7a5e80c3de84601","observation_id":"33652c7b-9566-4058-8734-f2590749d753","resolution":{"observed_at":"2026-08-11T16:33:54.485510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.489581Z","title":"Ms-detr: Efficient detr training with mixed supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.489581Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:3a5c22bd05f952b179d318840b9c34766274ee4bd6f87d1543142c9fc60c5f3f","observation_id":"0eb926cb-4f56-4959-bdeb-21c392e50122","resolution":{"observed_at":"2026-08-11T16:33:54.489581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.493833Z","title":"Dn-detr: Accelerate detr training by introducing query denoising,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.493833Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:13b160b17ed303776208ab03de07fb228b716d15fb484188c1b42cbab9b8d0b7","observation_id":"64fdd8cb-8df3-4e4b-bc01-81058f95c300","resolution":{"observed_at":"2026-08-11T16:33:54.493833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.498078Z","title":"Group detr: Fast detr training with group-wise one-to-many assignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.498078Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:3b57ccb5c720d233827dde1b12d1def71159906c08deb6e1db2ab79bad9ae509","observation_id":"bf8ce0c5-d53a-4b48-b828-f289416f87ea","resolution":{"observed_at":"2026-08-11T16:33:54.498078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06137","last_updated":"2022-12-12T18:59:58Z","snapshot_observed_at":"2026-08-16T16:09:12.679911Z","submitted_at":"2022-12-12T18:59:58Z","title":"NMS Strikes Back","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06137","snapshot_observed_at":"2026-08-11T16:33:54.502168Z","title":"Nms strikes back,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.502168Z"},"links":{"cited_paper":"/paper/2212.06137","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:eb430adcdd187f032b8bd8eb14dbb6d5ea6c27add66f6eeab9504a0472ec976a","observation_id":"09df03e9-31af-452e-8a8b-b69b5ea7850e","resolution":{"observed_at":"2026-08-11T16:33:54.502168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.506812Z","title":"Varifocalnet: An iou-aware dense object detector,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.506812Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:e7b0dea0ced3b8fc1eb19f72f335ffe0bde7fcddda59459dec3be33772a5a2e0","observation_id":"c18c9a1c-7e5d-4714-a1b5-62ac002d72d1","resolution":{"observed_at":"2026-08-11T16:33:54.506812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.511064Z","title":"Detection transformer with stable matching,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.511064Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:c33f47d066bcf0c2cc0c6135ef77eb22d600a7c21b6e376885efc0006e8d5f37","observation_id":"17082541-a120-4290-985a-2622fef3d543","resolution":{"observed_at":"2026-08-11T16:33:54.511064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:54.515074Z","title":"Rank-detr for high quality object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.515074Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:9519bee60f25e4e28e199bc74e6b74728539cec99f9a4237cefdc68e8ef803c5","observation_id":"e468fc94-d7e2-4a4f-9e92-d3316f6acd62","resolution":{"observed_at":"2026-08-11T16:33:54.515074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.108081Z","title":"Mr. detr: Instructive multi-route training for detection transformers,","venue":null,"work_id":"441a8386-b981-4b16-ac93-bdb7f300b522","year":2025},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.519103Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:0dc8e09466c0d9014a9bef8990e74c9969a59e23d9afaaf007ea8be6d667616d","observation_id":"e178b26f-fb4a-4d26-9783-3812454269e5","resolution":{"observed_at":"2026-08-11T16:33:56.112989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.092951Z","title":"Objects365: A large-scale, high-quality dataset for object detection,","venue":null,"work_id":"719526c5-6057-4b87-ac92-4dc4f94f170c","year":2019},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.523121Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:497eaf783c7fa86e2875031c8b523d62cba9b29fde5a204ebd1c396c4e2b1311","observation_id":"8da5b88a-f694-4b3c-bb58-486bbf6cbb3a","resolution":{"observed_at":"2026-08-11T16:33:56.098139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.077054Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":"a5d70e0b-4f87-4577-be16-a1568f294e77","year":2020},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.527500Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:48d5036f7ba8df789b9d71f95f05c60a73120f579ff21635f31e652ecc7536a8","observation_id":"1c85e327-0a36-4bac-ad2b-b8d27ff5db45","resolution":{"observed_at":"2026-08-11T16:33:56.081952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08430","last_updated":"2021-08-06T03:22:14Z","snapshot_observed_at":"2026-08-17T22:45:24.694319Z","submitted_at":"2021-07-18T12:55:11Z","title":"YOLOX: Exceeding YOLO Series in 2021","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08430","snapshot_observed_at":"2026-08-11T16:33:54.531581Z","title":"Yolox: Exceeding yolo series in 2021,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.531581Z"},"links":{"cited_paper":"/paper/2107.08430","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:6638fb4a559781040060a4c53002746e3c6929c9657cb3869038bd190ad64a55","observation_id":"baa5889b-8ddb-4013-927d-b308f55d7e25","resolution":{"observed_at":"2026-08-11T16:33:54.531581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.062874Z","title":"You should look at all objects,","venue":null,"work_id":"dbfe4a13-4e2c-4733-a520-11082add3201","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.535772Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:6ced329c5c19bff7042a3daf4f2cfde84d93aa806a4015aec98aea6b16b359b4","observation_id":"1da70c25-6124-4c69-b87b-0c5729e0f6f4","resolution":{"observed_at":"2026-08-11T16:33:56.067306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.048490Z","title":"Dynamic detr: End-to-end object detection with dynamic attention,","venue":null,"work_id":"423f554c-b1cc-47a4-8d77-fc16290363fe","year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.540277Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:c1f4f9932939bc1fd8fb88c99a482601cf7aa8584208a58bd695a562111b48c2","observation_id":"027cf4c0-14e4-4e75-bf79-087b14c45faa","resolution":{"observed_at":"2026-08-11T16:33:56.052761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.034323Z","title":"Fast convergence of detr with spatially modulated co-attention,","venue":null,"work_id":"6a68162c-1839-4175-9165-d0ab2a0d4e02","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.544960Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:e155872cdeaa3b368ddc31a486c752e7455eb656822bea94700a3db2dd315278","observation_id":"3989934d-42e4-41c4-a0b6-6683a9a49c48","resolution":{"observed_at":"2026-08-11T16:33:56.038797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.019457Z","title":"Cascade-detr: delving into high-quality universal object detection,","venue":null,"work_id":"9f2d47a1-b764-4e7f-9f85-53831d84f907","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.549799Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:3313b2472c37afa67c0326e998df673144ae64b21ffd383439a85324becf1998","observation_id":"f1b7985f-6184-4b0e-bfc2-4c664a71aa5b","resolution":{"observed_at":"2026-08-11T16:33:56.024267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:56.004953Z","title":"Ease-detr: Easing the competition among object queries,","venue":null,"work_id":"2d715cc1-d290-4d4e-9144-77c1c2860ca5","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.554237Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:74cc906da579a69f27d93b661bc848c60dcc55ff8d8f5fb387ce12a8e9821ef2","observation_id":"19685670-49ed-4b5f-9bfb-223f61b2361b","resolution":{"observed_at":"2026-08-11T16:33:56.009757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.991097Z","title":"Relation detr: Exploring explicit position relation prior for object detection,","venue":null,"work_id":"f1d923bf-a9f1-4cd5-aaea-48a400f5c47d","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.558685Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:8c1586f921fcf4e377a2a6327d2f59ea89a1215c66f664fc0570716f17f7632b","observation_id":"8b00a220-7ce3-4c3b-839a-841467bdfee4","resolution":{"observed_at":"2026-08-11T16:33:55.995391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.975903Z","title":"Sap-detr: bridging the gap between salient points and queries-based transformer detector for fast model convergency,","venue":null,"work_id":"3c4fcc90-5ac9-49f3-be29-c6e4e08b67d3","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.562727Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:388a265be0cd492c16771edc1895a53077f6209928f19cff8b913c7da7521b13","observation_id":"d499709b-db5e-490a-bf21-209cee2b9278","resolution":{"observed_at":"2026-08-11T16:33:55.980771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.958772Z","title":"Accelerating detr convergence via semantic-aligned matching,","venue":null,"work_id":"393d6c58-02e1-416e-b382-c65055830943","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.566586Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:1e9805563b80afe47d773d0f77bf169e9ee06ec39be736211749e19d772d7b41","observation_id":"ed4feb12-f1bf-4bba-9cd0-c0df13cf7b40","resolution":{"observed_at":"2026-08-11T16:33:55.964198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.944066Z","title":"Hybrid proposal refiner: Revisiting detr series from the faster r-cnn perspective,","venue":null,"work_id":"ed1f957b-d563-46c2-9043-ecdae5936562","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.570421Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:6ed6a0246702939af8227cc5313c0065cc3fafaddcd0dca521f6f5d326932627","observation_id":"88438831-f892-4e0e-b192-add21fa0ad71","resolution":{"observed_at":"2026-08-11T16:33:55.948213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01463","last_updated":"2025-03-03T12:19:06Z","snapshot_observed_at":"2026-08-16T12:53:37.606164Z","submitted_at":"2025-03-03T12:19:06Z","title":"MI-DETR: An Object Detection Model with Multi-time Inquiries Mechanism","version":1},"cited_work":{"arxiv_id":"2503.01463","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01463","snapshot_observed_at":"2026-08-11T16:33:55.087922Z","title":"MI-DETR: An Object Detection Model with Multi-time Inquiries Mechanism","venue":"cs.CV","work_id":"4124c907-d6ba-4bf9-9fa1-9f5213f493d0","year":2025},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.574148Z"},"links":{"cited_paper":"/paper/2503.01463","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:ba1ffe985613f9a961820b30a67fb5c419b92995fa809b42a3ee5444509daeb7","observation_id":"fc175814-5931-4b72-9b71-8a7e6ac40d5c","resolution":{"observed_at":"2026-08-11T16:33:55.092844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01318","last_updated":"2021-04-03T06:14:24Z","snapshot_observed_at":"2026-08-16T18:34:07.449476Z","submitted_at":"2021-04-03T06:14:24Z","title":"Efficient DETR: Improving End-to-End Object Detector with Dense Prior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01318","snapshot_observed_at":"2026-08-11T16:33:54.579100Z","title":"Efficient detr: improving end-to-end object detector with dense prior,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.579100Z"},"links":{"cited_paper":"/paper/2104.01318","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:89ca225afe601c20f8ba25deac1a3cacfec2c6c1366a49cd8ba867772e5c24a3","observation_id":"b263c9ff-a5e3-4860-8b45-dc2a85bd5d80","resolution":{"observed_at":"2026-08-11T16:33:54.579100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.928602Z","title":"Salience detr: Enhancing detection transformer with hierarchical salience filtering refinement,","venue":null,"work_id":"9d997037-f439-41bc-9707-f01884af4ff6","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.583796Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:c0738ed08c6da6e08ce430a070d4c59e449c6d10fa36e62071e5f89a51eb3019","observation_id":"bf06848f-4b38-4d6e-a3b3-c1385bdd4226","resolution":{"observed_at":"2026-08-11T16:33:55.933603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.914161Z","title":"Dense distinct query for end-to-end object detection,","venue":null,"work_id":"8a0e0e44-dff8-4e58-9e0b-c69b38619bed","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.587926Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:85adb7b4910cb1ddb0b8a6e2d0a932ff886920ab12e93fbf7db214d0a6f7ccf1","observation_id":"28f11678-7fb0-4dda-90b5-812644b064c3","resolution":{"observed_at":"2026-08-11T16:33:55.918779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.899845Z","title":"Sparse detr: Efficient end-to-end object detection with learnable sparsity,","venue":null,"work_id":"d73bcd27-0cdf-425f-b8bd-49de98cd0048","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.592248Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:0faa862b592f6ef61282f5e5831d1d2944d58c354ad8b61bc7333d1220fbfaaa","observation_id":"7a26813e-ef69-4a4e-b505-46bd3845d42d","resolution":{"observed_at":"2026-08-11T16:33:55.904608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.00860","last_updated":"2022-03-02T04:21:12Z","snapshot_observed_at":"2026-08-17T17:03:02.740735Z","submitted_at":"2022-03-02T04:21:12Z","title":"D^2ETR: Decoder-Only DETR with Computationally Efficient Cross-Scale Attention","version":1},"cited_work":{"arxiv_id":"2203.00860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.00860","snapshot_observed_at":"2026-08-11T16:33:55.046265Z","title":"D^2ETR: Decoder-Only DETR with Computationally Efficient Cross-Scale Attention","venue":"cs.CV","work_id":"edb6479b-1b9f-4f9e-aecb-22a687c9ada2","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.597018Z"},"links":{"cited_paper":"/paper/2203.00860","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:3793d1b3ab432e54e8e01907944d55df11d6336e621f06d79819c5922ff55447","observation_id":"32ef7462-5f05-4713-9cef-2f04ae23b1e2","resolution":{"observed_at":"2026-08-11T16:33:55.053239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.886060Z","title":"Detrs beat yolos on real-time object detection,","venue":null,"work_id":"3e428a0e-2eb6-4537-a6a3-71281e9f7f8b","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.601556Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:bd71159f7328d0106dc3f419da36b13c770280271748e39739ce2031db6f7fc8","observation_id":"8a5c3650-f2e0-407d-81ef-1210b83dbee4","resolution":{"observed_at":"2026-08-11T16:33:55.890326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.872007Z","title":"Lite detr: An interleaved multi-scale encoder for efficient detr,","venue":null,"work_id":"c197f28a-625c-4ed6-8878-ffbc2863fd5c","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.606198Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:2e6acaa4cb4875ea136650ae585b71d1b27b09e8392237893104dc5679399357","observation_id":"4ce589a4-8a6a-4d71-8902-23579e790fb2","resolution":{"observed_at":"2026-08-11T16:33:55.876722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03459","last_updated":"2024-06-05T17:07:24Z","snapshot_observed_at":"2026-08-16T13:45:48.489705Z","submitted_at":"2024-06-05T17:07:24Z","title":"LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03459","snapshot_observed_at":"2026-08-11T16:33:54.610695Z","title":"Lw-detr: A transformer replacement to yolo for real-time detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.610695Z"},"links":{"cited_paper":"/paper/2406.03459","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:794852a422fb08b3803dcf2c6a6314893ae68b168d79740d6b1c3f8b662b91d1","observation_id":"a50348a8-c7d7-4aae-9b8b-eb855952d1b6","resolution":{"observed_at":"2026-08-11T16:33:54.610695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.856043Z","title":"Decoupled detr: Spatially disentangling localization and classification for improved end-to-end object detection,","venue":null,"work_id":"e0aee4ee-6658-457a-90cc-f1e8eb0dbace","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.615480Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:8834e174ec6a001515b45977a976fbfdb83a8add3ea4459eea744353a0bcf551","observation_id":"c84b2baa-6146-4659-9364-d15431883ae0","resolution":{"observed_at":"2026-08-11T16:33:55.861319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.841117Z","title":"Bridging the gap between anchor-based and anchor-free detection via adaptive training sample selection,","venue":null,"work_id":"7e3ba40c-23ee-4fde-ba3a-5fd0f2b4be98","year":2020},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.619727Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:cf4ce01b4e911c85ec7b745f4c3b90e72284ac7a1ab00da5f1d3a87021638452","observation_id":"7f2386de-8de5-4f20-9c4a-8ba738fca218","resolution":{"observed_at":"2026-08-11T16:33:55.845614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.826290Z","title":"Ota: Optimal transport assignment for object detection,","venue":null,"work_id":"57c47b5e-7b44-4395-b87f-f630a03ba656","year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.623607Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:344f6ac6809d5c537a4cc929e28498a992c55b66753bd2286edaa130f6e48a13","observation_id":"50a779ce-358e-49d4-89b3-08e6ef9578ee","resolution":{"observed_at":"2026-08-11T16:33:55.830943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.810859Z","title":"Tood: Task- aligned one-stage object detection,","venue":null,"work_id":"8fd0750e-1ce3-490a-9cec-2625776d477a","year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.627715Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:235715c3530f26a0829cc69b7d9a19325796db4dfb097c857f78df7eda4a5ab8","observation_id":"c6b72893-dadf-4e53-bb77-738ab232ec38","resolution":{"observed_at":"2026-08-11T16:33:55.815547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.794946Z","title":"Adamixer: A fast-converging query-based object detector,","venue":null,"work_id":"7f1ccab2-1cf6-41a9-849c-79f6cdc402b4","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.631865Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:e2beafe0da6a6f5250a984a1228b108f6fd70c8358216ed5dff8107a8c748a6e","observation_id":"474d39c2-890e-4869-a47f-fcbfc1e13ff7","resolution":{"observed_at":"2026-08-11T16:33:55.800479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.781123Z","title":"Recurrent glimpse-based decoder for detection with transformer,","venue":null,"work_id":"baf0394c-b832-4402-925b-d84b55cd3a00","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.635966Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:70f3830a0a37b09cd65d4e0eccabbec9c0b6dbd46f9ff68ba5a6909757b90478","observation_id":"9fc28622-c1bc-4b61-9e82-e7792e114d5c","resolution":{"observed_at":"2026-08-11T16:33:55.785462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.766306Z","title":"Querydet: Cascaded sparse query for accelerating high-resolution small object detection,","venue":null,"work_id":"fb7862d8-f276-4818-99d1-e8a146f59d52","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.639817Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:9a4c15cf33c36b8d463dc3907b3619b380878fd64388ce21e36131b278e3cc99","observation_id":"9599052a-760b-4efc-8310-4b7f4f30cca0","resolution":{"observed_at":"2026-08-11T16:33:55.771298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.750714Z","title":"Exploring plain vision transformer backbones for object detection,","venue":null,"work_id":"26222537-d524-4e09-98b7-daafa3fd7c8c","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.643840Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:f567784db779037f23d3e52f2c5debd9a201dde771256bc28bc342ca6b3e0ccb","observation_id":"080c3634-08b2-4a32-9252-dd64f60a6d3a","resolution":{"observed_at":"2026-08-11T16:33:55.755577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.736222Z","title":"Cf-detr: Coarse-to-fine transformers for end-to-end object detection,","venue":null,"work_id":"1da92307-a95a-4393-ae01-f3e6c4139095","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.648456Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:24c04ebaede1b83f5edef9295927ff4751b1b66f14ffbff09290b9511fbcd7c5","observation_id":"f0c72f3e-1dc2-4cc7-a468-5edda1aca3cb","resolution":{"observed_at":"2026-08-11T16:33:55.740595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.722322Z","title":"Feataug-detr: Enriching one-to-many matching for detrs with feature augmentation,","venue":null,"work_id":"c078fd7c-4a10-4ca4-ac41-b11a9ca361cd","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.652378Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:08d2485e3a04b911a060ceb789ada2d9a91c285e4379303966fbd282a4a93000","observation_id":"5cf9ccba-9231-483e-85b1-35ba223add6a","resolution":{"observed_at":"2026-08-11T16:33:55.726905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.707731Z","title":"The hungarian method for the assignment problem,","venue":null,"work_id":"cc6dfcc3-d93f-4eae-973e-ac0f69ec8b7a","year":1955},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.656281Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:958d2b0977edc69f2e712da0a37b60f9285e7c1cdc7952acbe2f07b945ef0445","observation_id":"6707c09c-ceab-471b-879c-aeb6827b729a","resolution":{"observed_at":"2026-08-11T16:33:55.712658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.693099Z","title":"Learning dynamic query combinations for transformer-based object detection and segmentation,","venue":null,"work_id":"11d5cb1a-e7f9-4f54-8d88-332d0174368c","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.660277Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:d4cd692c8c1dca8effc784882274517a1f46d5e40ce8bb7f9040ada255ae4681","observation_id":"009d8058-5e5c-494d-be97-213cc6533997","resolution":{"observed_at":"2026-08-11T16:33:55.697395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.677970Z","title":"Stageinteractor: Query-based object detector with cross-stage interaction,","venue":null,"work_id":"ecdb3d64-bc6d-477b-936a-a766e0aaea6f","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.664582Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:e28b9be76d8c6d79066a4edac61195337eb98ee09243d7d5259fdd03a288f9ea","observation_id":"eb180c1f-30cc-4c4b-88f1-36bbe998ac6e","resolution":{"observed_at":"2026-08-11T16:33:55.683266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.663619Z","title":"Enhanced training of query-based object detection via selective query recollection,","venue":null,"work_id":"248aea29-74b8-4d9e-83d4-07b754496c29","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.669590Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:db41a939a2b26c301f370613583c22ed1680c12fde81dc6e846442c272fdcd64","observation_id":"eb009c67-2251-4590-adda-8dfcb8cadd04","resolution":{"observed_at":"2026-08-11T16:33:55.668222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.648822Z","title":"Detrs with collaborative hybrid assignments training,","venue":null,"work_id":"a6caa958-2c10-4421-8317-979a77c69cd9","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.674804Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:44eeac1264aa0ce28d9898214ea8a2fe6682baea69e3286d134693f8787cd1ea","observation_id":"cd255b1c-039a-4c02-85d4-f7afa0010044","resolution":{"observed_at":"2026-08-11T16:33:55.653513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.634057Z","title":"Kd-detr: Knowledge distillation for detection transformer with consistent distillation points sampling,","venue":null,"work_id":"90d3f3d0-0163-4411-b408-9acecfbd54fc","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.679612Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:3f56760a0d334a1bb1e920bae225f86d48254d6d03ad9e1201fbdc45a1842d7c","observation_id":"609d7897-3434-4507-a243-c80768d55e0e","resolution":{"observed_at":"2026-08-11T16:33:55.638845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.616781Z","title":"Detrdistill: A universal knowledge distillation framework for detr-families,","venue":null,"work_id":"a8651388-43a1-4a2c-9858-362d42e1d755","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.684629Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:8ad5c6d75b8b734472ae72901aab0aa8bfc51ecdf6b6a7a97e4f8054c0b56b51","observation_id":"57590114-4eb7-4d08-871a-636b45999426","resolution":{"observed_at":"2026-08-11T16:33:55.622354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.601703Z","title":"Teach- detr: Better training detr with teachers,","venue":null,"work_id":"2f1bb10d-4090-4f17-b03a-986791e5936f","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.689753Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:1f3793415472a14df9436cf6bdeaf4563d24cf26bb98d80bc3ab839dbbae1ff6","observation_id":"b2e7ce8c-f02b-436c-a8ef-50f96b4525ae","resolution":{"observed_at":"2026-08-11T16:33:55.606375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T16:33:54.694383Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.694383Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:d7532b59e4b127443b4e25a3a803c9714c3b88c4281a1fb7a62a409029d0e4d4","observation_id":"c2ecfb65-707c-4eb7-b0a8-13393cf7f76a","resolution":{"observed_at":"2026-08-11T16:33:54.694383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.586865Z","title":"Delving deep into label smoothing,","venue":null,"work_id":"4cb5018c-d435-49dc-9b5e-897c6bedd7be","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.699047Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:bf75506eac96253ef651f920c508954482944c4f2342cdcdb042263d51e4c23c","observation_id":"971c6247-5d91-47f9-a370-4067807625b1","resolution":{"observed_at":"2026-08-11T16:33:55.591740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.572191Z","title":"Adaptive mixtures of local experts,","venue":null,"work_id":"0a1202ea-e23e-4b69-bd22-f1390f3a8902","year":1991},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.703706Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:ca2f3da7f2922c30c656b720347a19a9376592c9d91d0a0b63fd14bbd9694b7d","observation_id":"e8f35cdd-2a29-447e-9ae8-d26b80216d2f","resolution":{"observed_at":"2026-08-11T16:33:55.576687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.557980Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":"1c602d8d-2a57-443c-98c3-08606f2e622d","year":2017},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.708212Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:deda6e0b733e52808d72f4ad5f7a698edb3ded64200e6b4713f7e6420ef7a37b","observation_id":"40dabc58-b284-4990-b54b-eda97cbf0e56","resolution":{"observed_at":"2026-08-11T16:33:55.562416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.541189Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":"29ecda8a-ae0a-49b5-b55c-9364c510fafe","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.712238Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:ffae7da997560bca4b2b39d6dea0dc36428c39750c947fb0d19ab931cd07212f","observation_id":"a4dc593e-3721-42a9-9c37-cc3acbac7f66","resolution":{"observed_at":"2026-08-11T16:33:55.546171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-11T16:33:54.716204Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.716204Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:2db2411ae8f4dd228bded8b2443c36664e877e0d998d1df0b7f3a6cb7a4634c1","observation_id":"9c0ce407-7854-4028-951e-ebf097e256ab","resolution":{"observed_at":"2026-08-11T16:33:54.716204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.527560Z","title":"Scaling vision with sparse mixture of experts,","venue":null,"work_id":"2aef5728-9098-47e0-8c70-6d63351f27ae","year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.720676Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:ff3387091db342d0e339dcb828c19ea7cc9d470a078ee4b0d33300d683ea2d51","observation_id":"95962f6f-7cf6-41cc-bebe-61a754e37214","resolution":{"observed_at":"2026-08-11T16:33:55.532033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12015","last_updated":"2022-02-24T10:56:17Z","snapshot_observed_at":"2026-08-16T17:18:58.644497Z","submitted_at":"2022-02-24T10:56:17Z","title":"Learning to Merge Tokens in Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12015","snapshot_observed_at":"2026-08-11T16:33:54.724486Z","title":"Learning to merge tokens in vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.724486Z"},"links":{"cited_paper":"/paper/2202.12015","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:b914d41cbd48b7b345eee59c248dd5c00cd2d8cc7f6b0688a879d20e34ee33fd","observation_id":"2b52d29b-94fb-415b-a611-045ebc16810b","resolution":{"observed_at":"2026-08-11T16:33:54.724486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09636","last_updated":"2022-10-04T10:07:03Z","snapshot_observed_at":"2026-08-16T17:05:44.280272Z","submitted_at":"2022-04-20T17:29:48Z","title":"Residual Mixture of Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.09636","snapshot_observed_at":"2026-08-11T16:33:54.729228Z","title":"Residual mixture of experts,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.729228Z"},"links":{"cited_paper":"/paper/2204.09636","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:85248d49ca934b63f0dcbe6aa36f89aa46388ba19f90d551a8793d9c16db5edc","observation_id":"5b388247-9497-46ea-a7c5-79b46660f18b","resolution":{"observed_at":"2026-08-11T16:33:54.729228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.513582Z","title":"Robust mixture-of-expert training for convolutional neural networks,","venue":null,"work_id":"472e54ea-4d1f-45c1-ae4a-e726eb3fc737","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.733602Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:ca31b3a83e51bd008a91a558ac7197426bc77727619642ff2cf2dbcd0b49feb7","observation_id":"55d27258-1260-42f8-9120-369a83dce0da","resolution":{"observed_at":"2026-08-11T16:33:55.517865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11633","last_updated":"2024-09-09T02:17:12Z","snapshot_observed_at":"2026-08-16T13:33:48.508986Z","submitted_at":"2024-07-16T11:55:23Z","title":"Scaling Diffusion Transformers to 16 Billion Parameters","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11633","snapshot_observed_at":"2026-08-11T16:33:54.737557Z","title":"Scaling diffusion transformers to 16 billion parameters,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.737557Z"},"links":{"cited_paper":"/paper/2407.11633","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:f1ef4cff5a84ffd09649620d184665e71e9a9b80567f09e8b525194f6c006cc7","observation_id":"604f694f-43a9-4261-88f5-220759b82eca","resolution":{"observed_at":"2026-08-11T16:33:54.737557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.499479Z","title":"M 3vit: Mixture-of-experts vision transformer for efficient multi- task learning with model-accelerator co-design,","venue":null,"work_id":"865e014e-85e7-472d-bd68-48452072a8db","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.741850Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:40e2814b5b112d2c0d5ce4e07cff4d4bffce5395e8f8e3f442d3828f591df6d0","observation_id":"a6100cbd-506c-4089-a3da-12755c868b95","resolution":{"observed_at":"2026-08-11T16:33:55.503934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.485954Z","title":"Mod-squad: Designing mixtures of experts as modular multi-task learners,","venue":null,"work_id":"051641cf-1400-4a2f-80fe-7327ef0296e6","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.746225Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:902fe8a15c5b9434a69217df0cbd400c5be1bb9de413fd7707eda69cdf2fe5de","observation_id":"4e7f2b78-d5dc-4966-92c6-47212ecc2349","resolution":{"observed_at":"2026-08-11T16:33:55.490343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.472516Z","title":"Adamv-moe: Adaptive multi-task vision mixture-of-experts,","venue":null,"work_id":"50d47898-7912-4e3d-bd49-2d934a45186c","year":2023},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.750535Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:8dd4bdc4753c32e7b7cac1e20ce87fdb4d80426f8681e1b4cfb0a4a191b8e670","observation_id":"72ffebf5-f228-4a92-ba3a-ddd17717dca3","resolution":{"observed_at":"2026-08-11T16:33:55.476710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.457332Z","title":"Multi-task dense prediction via mixture of low-rank experts,","venue":null,"work_id":"8359314e-ca7b-44de-91c5-75f67fc3a4d5","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.754912Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:0610353b7824b5ef81e3de46ee925cb3ba44cc5dc50f0aa5480bfa406bb4a466","observation_id":"39976d04-5002-4254-b4b1-14aa9f2c136b","resolution":{"observed_at":"2026-08-11T16:33:55.462225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.441617Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":"f6f8eb12-9e0e-4cfb-831e-f389fda197a1","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.758856Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:d1c44c82630f99c0200ad43e6e916052f08019f10c2fed1e8bdf2bdf06a8c468","observation_id":"9eb4c0ce-c24a-4470-9aae-d9931c721b54","resolution":{"observed_at":"2026-08-11T16:33:55.446768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T16:33:54.762716Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.762716Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:d5ce34813d55f6ccf4417d57e54c601ed4e04da11c8b630ad6d3b4f5ced09570","observation_id":"fa6b58d2-a9b1-451a-951e-33724dc7479d","resolution":{"observed_at":"2026-08-11T16:33:54.762716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-16T19:09:26.533311Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-11T16:33:54.766980Z","title":"Auto- prompt: Eliciting knowledge from language models with automatically generated prompts,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.766980Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:65116be86011c2c18cf7cf457f721bcedf42901761aa25840b9ff733e1aeee2f","observation_id":"e1609f71-5557-4d8d-b511-e4b74428a322","resolution":{"observed_at":"2026-08-11T16:33:54.766980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.426573Z","title":"How can we know what language models know?","venue":null,"work_id":"bd9e2fa3-29ec-4a1d-b9b8-e176f5f0ca0d","year":2020},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.771542Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:269b3b7e79a576b100a0b3f9306717eff458492bcf84593011908330e93124aa","observation_id":"5c314bc5-4cbb-4683-a587-58fd6e4983d0","resolution":{"observed_at":"2026-08-11T16:33:55.431544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.411709Z","title":"Prefix-tuning: Optimizing continuous prompts for generation,","venue":null,"work_id":"ea588ff1-a849-4c43-a492-90a9963c5a0f","year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.775834Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:545274103923cd2800629606951956305b0c522295d34f1d695d9874c4d77fb5","observation_id":"ec28fec8-24db-402a-8f3f-898fec88e1f2","resolution":{"observed_at":"2026-08-11T16:33:55.416463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.396546Z","title":"The power of scale for parameter- efficient prompt tuning,","venue":null,"work_id":"58ce38f7-5411-4a43-b560-cc73c8930314","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.780204Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:e71a27cedcac036bdfd19a2e275c2fcab8c05e3057253dfa52488a12cd0551b4","observation_id":"e7142ee4-1f9d-4aa5-84df-1a48099cd7ba","resolution":{"observed_at":"2026-08-11T16:33:55.401480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.382120Z","title":"P-tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks,","venue":null,"work_id":"55d250f2-fb50-4ce8-9eab-a290cbca254e","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.784170Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:28473b3b90b7826c3b0a3c5471c557471f1c1a1997f017856fd32419ea388985","observation_id":"0d32c0e2-6dec-4c98-b16c-7e32afc9504b","resolution":{"observed_at":"2026-08-11T16:33:55.386706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.367713Z","title":"Learning to prompt for vision-language models,","venue":null,"work_id":"bf2f4598-a20e-4a48-83b9-ca8c9f6215db","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.788353Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:f94776e4a6da2852c63d98700359460874a27ef719c241a9945801773ed35c63","observation_id":"a59968da-668d-4450-a60a-5ebb8f38cabc","resolution":{"observed_at":"2026-08-11T16:33:55.372292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.353931Z","title":"Prompting visual- language models for efficient video understanding,","venue":null,"work_id":"cc4c2738-ed37-461c-8330-e6714cea7232","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.792454Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:e53f2a56f67c1c4784c0664223d686dc2f296ffdd6edae27054511c7c2a44d39","observation_id":"a33ba3b2-067d-4ff7-be16-03880e20386a","resolution":{"observed_at":"2026-08-11T16:33:55.358326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.339084Z","title":"Learning to prompt for continual learning,","venue":null,"work_id":"d1556fde-de9e-435c-a773-4013bdac4010","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.796764Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:85b7c5dd2a6a05fd5e8a94829f00c4e55df8ca66c2e8b83068a2d869dd5dcee2","observation_id":"de88f1f1-3191-4b4f-955b-5147c1e37c1d","resolution":{"observed_at":"2026-08-11T16:33:55.343727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11594","last_updated":"2025-02-18T03:59:44Z","snapshot_observed_at":"2026-08-16T12:57:48.752020Z","submitted_at":"2025-02-17T09:28:31Z","title":"iMOVE: Instance-Motion-Aware Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11594","snapshot_observed_at":"2026-08-11T16:33:54.800846Z","title":"imove: Instance-motion-aware video understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.800846Z"},"links":{"cited_paper":"/paper/2502.11594","citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:1ee8ba7b6328926d25114b9d5d0ff5fbf7d06fa2559351a3d957b79847e9b509","observation_id":"90eb5d10-253c-48ea-977f-07e0d606acdf","resolution":{"observed_at":"2026-08-11T16:33:54.800846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.324352Z","title":"Visual prompt tuning,","venue":null,"work_id":"b14dfcea-c1d7-44cd-8502-79781ddb0100","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.805906Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:52f9cfa6991447d5c34279a29af0d2f615b9531984ec1ea71e8be467d4bd75b9","observation_id":"28254876-26d1-42a2-8543-6658788ec8f8","resolution":{"observed_at":"2026-08-11T16:33:55.329252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.309364Z","title":"Multitask vision-language prompt tuning,","venue":null,"work_id":"17aabf49-a7aa-4963-b743-9766d649e46d","year":2024},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.810659Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:aef742f86fdb6d7283297b47a3ab7f3596c01649aa94a9aed77f9cc5bdc7c2dc","observation_id":"a2def400-62e8-4e6d-a356-fc5bcc21df7d","resolution":{"observed_at":"2026-08-11T16:33:55.314020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.294896Z","title":"Improving visual prompt tuning for self-supervised vision transformers,","venue":null,"work_id":"836037ff-e03d-4387-b933-8d63165aa811","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.815080Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:25e4d830c6218e41c8d6bda604219c5248e553e77c41a3503a446dca8c08949c","observation_id":"00dd38ee-e5f5-4429-8f27-319ff4a36c3e","resolution":{"observed_at":"2026-08-11T16:33:55.299557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.280206Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":"abb25100-1385-46e7-af9a-7d0eced44b22","year":2014},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.819835Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:d1715d2d4ec647a426d38e5b356beeab999d6fa17020a32fdc40b4ed3c2fc6ab","observation_id":"1d4ce540-0d5e-4f44-9fe7-6b2b67f8ed38","resolution":{"observed_at":"2026-08-11T16:33:55.284985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.265188Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"cb4cea3e-1eaa-429c-8d4a-3d9ed2d38b44","year":2016},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.824787Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:c98d630e1b00515a3b8bb0615cb83c43005818ec32334710e7a46bc628fd37b4","observation_id":"b30faacc-58bc-4037-a9a4-074cb97d6578","resolution":{"observed_at":"2026-08-11T16:33:55.269725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.251111Z","title":"Panoptic segmentation,","venue":null,"work_id":"1d28608f-22c4-4fdc-9169-b73047151bfe","year":2019},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.829370Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:065f439740a4d0fbdc9518655775364dd4d1eae071d9e9c0276fb93a931fd78b","observation_id":"44abf132-cb65-446d-a7d3-2b8776d08d83","resolution":{"observed_at":"2026-08-11T16:33:55.255319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.235339Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"ed5fdd8e-fcac-40b5-a912-d1930b5d7534","year":2021},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.833845Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:935ac6b35e1ffede414c28326ec6a9e67a2f5ff8a8d865c4912e9250b63fef76","observation_id":"e03e2e07-b9e9-4b61-a651-df200e63505c","resolution":{"observed_at":"2026-08-11T16:33:55.240651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.219130Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":"fdb7dd52-c009-4a3c-bb1c-3d313fc6c99f","year":2009},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.838367Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:f476cfd7ba20b715655f9df0cf9fbbf73a9b17eee08266126dfa871ea7fde6bd","observation_id":"69ec2e81-c7ab-4470-aac6-a88cff87e4bf","resolution":{"observed_at":"2026-08-11T16:33:55.224035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.202544Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":"3c49e10f-dcc7-45c5-8f46-c42c2f039501","year":2017},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.842889Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:63f749ac0114d1b8a225d42ca57b17fd40f2387e6aabc913843fbd9e86ea524a","observation_id":"b25c0363-6b18-4c39-9edc-37ed9be5f66d","resolution":{"observed_at":"2026-08-11T16:33:55.207687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.185637Z","title":"v-clr: View-consistent learning for open-world instance segmentation,","venue":null,"work_id":"2b0ee890-fe25-4a3d-9b74-dcd9272b68a8","year":2025},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.847423Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:dbba342934fb81e80f32f20b46ac14505cc07505f9f709e5efb1db56c204f313","observation_id":"f1ff4395-9e41-4eba-a14b-0a13d01ef9d6","resolution":{"observed_at":"2026-08-11T16:33:55.191837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.170295Z","title":"Mask dino: Towards a unified transformer-based framework for object detection and segmentation,","venue":null,"work_id":"8bac714b-585b-479b-818e-ca8d0c016ea2","year":null},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.851488Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:a5ddaf5b4735778eeb0be3756c787d02fffc00c5de88a9c3fcd51f65a6a57dea","observation_id":"59a92fa2-48a5-4bdf-ba00-c195ea9ae600","resolution":{"observed_at":"2026-08-11T16:33:55.174774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.154507Z","title":"Masked- attention mask transformer for universal image segmentation,","venue":null,"work_id":"25d33944-c851-49b7-a2be-a5763a883b84","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.855535Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:9f6580cfb8da52c38e77493e248b9d1eac4ddf579601dcc040bfc8dec0787cea","observation_id":"467c00de-3949-4c03-a6d4-181895a54930","resolution":{"observed_at":"2026-08-11T16:33:55.159656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:55.136989Z","title":"Panoptic segformer: Delving deeper into panoptic segmentation with transformers,","venue":null,"work_id":"41f54f05-5102-4dfe-8784-59179b4210a9","year":2022},"citing_paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts","version":4},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T16:33:54.859934Z"},"links":{"citing_paper":"/paper/2412.10028"},"observation_digest":"sha256:ec9e1d65466ecce7f0275b525da5c823aa94b28c606076c815ee0539abd266cf","observation_id":"c1ea760f-afd9-45b5-92fd-7605b4c724c6","resolution":{"observed_at":"2026-08-11T16:33:55.141910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.10028","last_updated":"2025-06-26T15:06:14Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T09:04:36.513140Z","submitted_at":"2024-12-13T10:39:27Z","title":"Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":66},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 1 inbound Pith citation observation for arXiv:2412.10028."}