{"as_of":"2026-08-15T14:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ccdecd9f35c1014037465206158f8536edd075e60c85e973c36abb6701573289","coverage":[{"denominator":255,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:10:37.391059Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01473/citation-record","integrity":"/paper/2608.01473/integrity","json":"/paper/2608.01473/citation-record.json","paper":"/paper/2608.01473"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.007161Z","title":"arXiv (Cornell University) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.007161Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f79edef5beb2fc181d59ad0126e483084f31cc17ca711ca4cbb87d10853bdc53","observation_id":"169b94c0-8257-4844-b957-83d5fd8a99ae","resolution":{"observed_at":"2026-08-06T00:10:37.007161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.10348","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.575241Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":"217be048-103c-4873-a8b2-2dc9ddf6ae8f","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.011987Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6e95224b7944e3ea367d8610d2f638bcb43ad6d8e7ce57779de3affcae1d97ee","observation_id":"818b632f-7f21-4d6d-83c5-edc346504939","resolution":{"observed_at":"2026-08-06T00:10:40.579428Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-06T00:10:37.016076Z","title":"arXiv (Cornell University) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.016076Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f9c3fb4324ab78ce0dd0fa1790cd0edefca4263188a6f66837e803e74c790c08","observation_id":"645b7ed2-131f-452e-b4b9-395fa480e57c","resolution":{"observed_at":"2026-08-06T00:10:37.016076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.020439Z","title":"and Kondo, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.020439Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f538d7c3701af1e7343ac6672a13aa830275fbcf68de45559e94dff9b5ff0714","observation_id":"4d5c4665-2308-4fd0-ac90-364072c3786c","resolution":{"observed_at":"2026-08-06T00:10:37.020439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.024556Z","title":"2019 , url =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.024556Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ff255ddc3beb5bc8901dfab5ab51f7e1d68a6818b17e22eb6151d8b8756afbe9","observation_id":"d131dda0-2acb-4f9c-b290-6e016169528b","resolution":{"observed_at":"2026-08-06T00:10:37.024556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jsurg.2020.07.037","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"and Sheikh, Mohd Raashid , title =","venue":"Journal of surgical education","work_id":"a1f32f49-e75f-4759-a7ba-3dabb22fe637","year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.028865Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:44e4f3f9beeb59dc11d03a00cf3e290dbfe8f53fe498503011f0e8cb7ea4401c","observation_id":"e1690456-0c8c-42a0-872d-598bad35c787","resolution":{"observed_at":"2026-08-06T00:10:38.222553Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.041802Z","title":"2023 IEEE International Conference on Robotics and Automation (ICRA) , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.041802Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:af2796e0f74a7fe6ee0b73f98f2c568e741cdfdd4d1cda8a09ae7d85206b4ab6","observation_id":"cdd9b5fa-1bbf-4284-be9f-b3b27866a0b9","resolution":{"observed_at":"2026-08-06T00:10:37.041802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10260","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.425843Z","title":"Information Fusion , publisher =","venue":null,"work_id":"35f864aa-d5d7-4880-938c-d1ad77cae7e1","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.045151Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0e8507f7450a43366480f08ae0035242f72964ecec4f0129b578b52b7fec9cda","observation_id":"ebae9398-023b-489b-8ac8-df1f01401c10","resolution":{"observed_at":"2026-08-06T00:10:40.430279Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.048975Z","title":"and Hasan, S.A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.048975Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:8df4d055f8a2d662dd95a145ba438e600fd3c63f8c6a2e03955ca858ee414ac2","observation_id":"e7a43cd6-1ee3-4e98-83b9-9363c88e2c6a","resolution":{"observed_at":"2026-08-06T00:10:37.048975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2017.285","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"2017 IEEE International Conference on Computer Vision (ICCV) , publisher =","venue":null,"work_id":"28829f56-fe3a-4013-899c-f54052b5260b","year":2017},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.052753Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:23b34c157694fd604d1397c51248354214bd80e94ca870ec0d5deb4a4f63522f","observation_id":"a41667f2-06eb-4031-84cb-db9be645c8b4","resolution":{"observed_at":"2026-08-06T00:10:38.205674Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33018102","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , publisher =","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"789e0005-dee6-4dde-af5d-029d755164fd","year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.056788Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:56f1b8affb6a6dee91164e0a6ff286344ad60deec21dade8e45b5a252c68b211","observation_id":"10dd161d-8255-45e9-9fa3-28aa96c8a796","resolution":{"observed_at":"2026-08-06T00:10:38.193701Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8009.2026","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.357048Z","title":"Neural Horizons The Uncharted Future of Deep Learning , publisher =","venue":null,"work_id":"33b4651d-6148-4c2c-83f9-0ee4e10e647f","year":2026},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.060805Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:071c5cd91e967f30613034e06f52c6de838e50190258446201fb2e38986d1880","observation_id":"62db99fe-8354-4900-8048-2ae54022a412","resolution":{"observed_at":"2026-08-06T00:10:40.361768Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.063894Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.063894Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:410ad9b89265ef9f520c65aa2e9519d20b5e12abd1b53c71e85262b1699bec12","observation_id":"24e87150-4ce1-41c8-bde2-fd57f194f947","resolution":{"observed_at":"2026-08-06T00:10:37.063894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.067190Z","title":"and Zhu, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.067190Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:358e45cbab2d1c7fbb725a8927277edeb93ccf657edae12ba612d884d02b4b6c","observation_id":"79d5bf9d-1bcc-4657-8db7-7a31ee25ebad","resolution":{"observed_at":"2026-08-06T00:10:37.067190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.070388Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.070388Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0f58d6230237f785b124088b677bbcd85af42618708510047a4d118c3a206c48","observation_id":"e9433083-955c-43e9-bd5d-cf48bf36128a","resolution":{"observed_at":"2026-08-06T00:10:37.070388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.073516Z","title":"2024 IEEE International Conference on Robotics and Automation (ICRA) , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.073516Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:e58d2430041cffcdff9f0a1ae499123dc5f52fec06e4e110b4fffdf05b88872a","observation_id":"b88db407-f431-41d4-880e-ddc9fc1eaf6c","resolution":{"observed_at":"2026-08-06T00:10:37.073516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-2992","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Advances in Neural Information Processing Systems 37 , publisher =","venue":null,"work_id":"d2fd869f-c512-4076-aa6d-3e0f595f3dad","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.076652Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f139a5de56c8ee06327e28e6a5c7d7271f78caa5756e9705117d5e108fc31c4d","observation_id":"8e5ad94f-b60d-4216-9701-4d61f9c9398c","resolution":{"observed_at":"2026-08-06T00:10:38.178109Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00464-019-06775-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Surgical Endoscopy , publisher =","venue":"Surgical Endoscopy","work_id":"620953b7-5840-4bad-8683-33b72044778e","year":2020},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.080604Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:dbafb70243e9ea80f17199d385aa5491af4d129840fcfa1b41443ea9c44d23e0","observation_id":"6786700e-a32d-4601-9b88-c28d032c95a9","resolution":{"observed_at":"2026-08-06T00:10:38.166573Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.084322Z","title":"Science China Information Sciences , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.084322Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:06031a90ca3a619160c4ab44c24adeff9ae29f5d9cfa46414b181e677f64be66","observation_id":"a4e6196d-f1b3-431a-9116-9647c35345fe","resolution":{"observed_at":"2026-08-06T00:10:37.084322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.088596Z","title":"Proceedings of the 1st International Conference on Data Science and Engineering , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.088596Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:392327cc9db36655673fe98a0fd3d5d4d24474632b920b4ca9c4401808a2cb25","observation_id":"b392f1ab-2400-4678-9b0d-7d0ef5aabdc4","resolution":{"observed_at":"2026-08-06T00:10:37.088596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.092925Z","title":"2023 IEEE International Conference on Medical Artificial Intelligence (MedAI) , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.092925Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b1d5d033ef19b99584da648ef54d25af916d7c00e22b0432cd3328ef25e9f5cd","observation_id":"8780350b-b65a-4166-8627-b64db77324ed","resolution":{"observed_at":"2026-08-06T00:10:37.092925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.097082Z","title":"and Ligero, Marta and Sainath, Srividhya and Ghaffari Laleh, Narmin and El Nahhas, Omar S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.097082Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d62815e93f17e3be0b1186a03f9c0e5c2b922398daaca8b3d0adf8362e5b3463","observation_id":"249d418f-3060-4769-bcf7-f1e44ed01fb5","resolution":{"observed_at":"2026-08-06T00:10:37.097082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-024-01127-3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"npj Digital Medicine , publisher =","venue":"npj Digital Medicine","work_id":"6ebbbe4d-6b73-43fb-8ff3-d73b947c29db","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.101083Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:28737199c35f18a7de7ad6c32984ece9194f384db1e726d0a4da622c7c0e0bfc","observation_id":"6475d2a4-f927-4a08-8be7-34566848a4bf","resolution":{"observed_at":"2026-08-06T00:10:38.145158Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.104751Z","title":"and Garrido-Merchan, E.C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.104751Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:32cc103a7d267986cca2a7081363497c6fa58f7fb18bb192caf3fa2bd27be14b","observation_id":"3b759ae5-33c0-4600-9109-e46e1288f1d9","resolution":{"observed_at":"2026-08-06T00:10:37.104751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.00640","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.045388Z","title":"2018 IEEE/CVF Conference on Computer Vision and Pattern Recognition , publisher =","venue":null,"work_id":"b286037a-f9a1-497f-8563-ce5650214816","year":2018},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.108563Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ac2c61c22c3efa7217aedd2fd47bb6a6694964c75dd1480892240cf3cd029e59","observation_id":"0909fd58-12a7-4e49-8387-c44b915d59b3","resolution":{"observed_at":"2026-08-06T00:10:40.049998Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.112275Z","title":"and Xu, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.112275Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:1d43e7b954f23b04eac01c8740fdc105b1afc80bc7621802d092de32b0e12d3a","observation_id":"7c227ef3-51d6-4949-8812-3ef48632f7db","resolution":{"observed_at":"2026-08-06T00:10:37.112275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.116206Z","title":"and Nie, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.116206Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:9a9846d2cb3820747f2098e0057c27ea5964e2a5a6042130f06bca35341d8ec7","observation_id":"0b57c8fc-6a1d-4acd-bfd5-5f1624d3727c","resolution":{"observed_at":"2026-08-06T00:10:37.116206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.120263Z","title":"and Cheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.120263Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:232e9fa6878aa469ab15c997dc6b408542d938a8baacb98f1aa035246edaa76b","observation_id":"15d44eea-81f3-4c05-a2fb-4a8c96f9c23d","resolution":{"observed_at":"2026-08-06T00:10:37.120263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.124255Z","title":"and Shen, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.124255Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:604ea758725c5b81b56df5ca312e756dd96edfc2ba95fe24dc27640f4215ce35","observation_id":"d4d15a73-df52-4c78-a89a-5731364459b9","resolution":{"observed_at":"2026-08-06T00:10:37.124255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.132010Z","title":"and Li, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.132010Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b266b4a95f492af8c922e183192ce32178d2dab29cc3c0cb02b8158a3590ff6b","observation_id":"0e493f17-cb1a-4c68-93a6-445701fd70d3","resolution":{"observed_at":"2026-08-06T00:10:37.132010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.135905Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.135905Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:001bd4b2ea3b6bf022902ac3f80eca27c83f40dcc914b5f7999a86ceba2a88be","observation_id":"79473409-e34f-4723-bf81-e92e87008b9c","resolution":{"observed_at":"2026-08-06T00:10:37.135905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.139891Z","title":"and Jeong, C.W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.139891Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:28ee3d750bd38f340bc27dafdcfed384255c1c17d8b89c94eec8545fc503c0d0","observation_id":"e7073911-2d6c-44b9-ae28-7938a5f4d34b","resolution":{"observed_at":"2026-08-06T00:10:37.139891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.143758Z","title":"and Hussain, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.143758Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d6e3013423aba0dff47748ecc6b2c5b5364b5ed171a9e110606114fb3cf0a299","observation_id":"99d5f515-780e-4bb1-9cf1-fb1e8940ca62","resolution":{"observed_at":"2026-08-06T00:10:37.143758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.147206Z","title":"ACM Computing Surveys , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.147206Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6dd365a045c3610a2984ca66d3d4c82ba6d5e04c8ac44edff18d4c746079fe6a","observation_id":"041438f5-1ce6-4867-8d5b-d10b7ea66171","resolution":{"observed_at":"2026-08-06T00:10:37.147206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.151047Z","title":", title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.151047Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:a2c74a9eb1ddf54f3b9352dc05736a9ad832d03c5dc87256981f0c64725396a8","observation_id":"bbbf7f98-699e-42de-ab5c-a2d2fd5aca96","resolution":{"observed_at":"2026-08-06T00:10:37.151047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.157463Z","title":"Advances in Neural Information Processing Systems 36 , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.157463Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:94f9f543d9c047a5d37716cd01f09dd3a56bf5b96cbd2c84a669b4ab79cd42de","observation_id":"561409ff-0307-4487-9dd2-f08e38e97e13","resolution":{"observed_at":"2026-08-06T00:10:37.157463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.160801Z","title":"and Li, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.160801Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f66fcb7be8791241438b18d05003435a38dee1f415eb30e6545c8f9930ffa49c","observation_id":"b2715f4a-bac2-48a8-8819-45cdfa5c42c7","resolution":{"observed_at":"2026-08-06T00:10:37.160801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.163895Z","title":"and Skinner, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.163895Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f72d83f501ea0d146b7a0c376dcdbf214e65260e9f96c0318eb8175037eaf58d","observation_id":"73608816-febe-406a-8ad7-9e038ca2a9da","resolution":{"observed_at":"2026-08-06T00:10:37.163895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.167177Z","title":"2019 , url =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.167177Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:372a165172d03753c2b73b92d65663b7d675f3f91999855a86d7f9bdc1bac329","observation_id":"0ec23f80-b56f-48aa-92ab-8d1fe83f20e3","resolution":{"observed_at":"2026-08-06T00:10:37.167177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.171081Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.171081Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:28ff29cf001261c76601dd180aeeb41685c2598d4604964142aea3b3e699216d","observation_id":"c1a975c1-3278-42b0-ab1a-39e54b085647","resolution":{"observed_at":"2026-08-06T00:10:37.171081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73033-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":"Computer Vision -- ECCV 2024 , series =","venue":"Lecture notes in computer science","work_id":"093b0779-2a38-4712-8009-7e2b0ad82590","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.174850Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:74a804c49d1815327b71ba8799aecafb1def45c9daf198badb0f5db9b6901230","observation_id":"1897ba11-9a1c-4950-b115-064012f73b3a","resolution":{"observed_at":"2026-08-06T00:10:38.118488Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.178354Z","title":"2026 , doi =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.178354Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:cd6e9bb36ca73e80725aa8b52899fe6f05423dde211c2aa0c6f473bf0eee0e40","observation_id":"e805b9eb-8abc-4cd8-b362-32baf6036538","resolution":{"observed_at":"2026-08-06T00:10:37.178354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.182354Z","title":"and Zhu, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.182354Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:bc874a95f976dc115915ad2a9f6f2323b82c7e4b0f904d03359c68643672e252","observation_id":"3ee758be-2a1b-4677-ac4a-c3682ea237a5","resolution":{"observed_at":"2026-08-06T00:10:37.182354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.188978Z","title":"Advances in Neural Information Processing Systems 36 , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.188978Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:9c02db5a89869b52f5e24f6029a97b0486f9b73b28f2a2795f6c0da2d44e33e7","observation_id":"ef8d1fa1-9574-4551-a1ae-e7e01562171c","resolution":{"observed_at":"2026-08-06T00:10:37.188978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.192428Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.192428Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:54ab37b01ad2470858e5dc8e1e75195e79ad36f0e46636c11738710e29dae901","observation_id":"a2df8324-642b-4b17-8a42-3bed19b472f2","resolution":{"observed_at":"2026-08-06T00:10:37.192428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.195549Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.195549Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f3313673f5f92a86a11a8a41a2fec7c19359cd9a2d705b875a6a6c30b56aad95","observation_id":"60743eb9-c5c3-405a-a5fa-022d1b46c06b","resolution":{"observed_at":"2026-08-06T00:10:37.195549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30118","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.692000Z","title":"IEEE Transactions on Biomedical Engineering , publisher =","venue":null,"work_id":"f97ae8cd-a863-445d-bcc0-200a505e2e17","year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.199404Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:56e89af544d0a87952feb9af450ef34e353f5e9336c99839ff16baae757812f0","observation_id":"ca2a4523-8caa-42a7-9b6d-c2bce2374feb","resolution":{"observed_at":"2026-08-06T00:10:39.696544Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.202943Z","title":"and Alapatt, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.202943Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b7765a1596419396b3534f0fa7e8554a731b0d540699a4dc52eb7a2e124b49cf","observation_id":"972364cf-ef17-4b68-9c09-4f42db36d23c","resolution":{"observed_at":"2026-08-06T00:10:37.202943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10343","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.611266Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":"2bfa3df2-876a-4cfe-8dc2-0b6c62979dbc","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.206431Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f49d48ba562b266f37131f0dfa19ba1fc68831d0f84858316b6d627bbcd8476b","observation_id":"ce7a8f2a-a98d-4f80-8e79-1ad10fe539b8","resolution":{"observed_at":"2026-08-06T00:10:39.615590Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.210040Z","title":"and Darcet, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.210040Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3f9c11489bfb67682b0762cbd6fdc55a4c82da3398e95ee48106f044d1c8978a","observation_id":"f85681d2-3e04-468a-aad5-be6225ec77c7","resolution":{"observed_at":"2026-08-06T00:10:37.210040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.213346Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.213346Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0b951a348d9ec2717f7a99119737c8d055d4f0ffb2f6af03d1627493cf1ac281","observation_id":"8e56816b-c0e0-47b9-9291-03a74c6227a6","resolution":{"observed_at":"2026-08-06T00:10:37.213346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.216566Z","title":"2024 International Joint Conference on Neural Networks (IJCNN) , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.216566Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6feaab0c3922825237418a51ed5b2dc419e6bc66b7894a595ae442eefb784fff","observation_id":"8f2d3901-401a-4588-b773-ca8670765461","resolution":{"observed_at":"2026-08-06T00:10:37.216566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.219674Z","title":"and Kim, J.W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.219674Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:2e61246971d8baa7612a10b761039279c31477a195cb8464daa3f4c1bb49aaca","observation_id":"7a160bb8-ce64-4e62-899a-4acdf0947fb4","resolution":{"observed_at":"2026-08-06T00:10:37.219674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.222881Z","title":"and Tu, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.222881Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:2323778fc5f7c4f222ca6878e4c2909dbece77dd63ce2a8b205f867e2ea0b18c","observation_id":"016075e4-6b1b-4e06-9df6-1e2787dac922","resolution":{"observed_at":"2026-08-06T00:10:37.222881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.226047Z","title":"and Cho, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.226047Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:572065e2733a6aa35df2fe0d724039cc48294fbb84f860304832276d6754c9d0","observation_id":"3d12a3d2-cac7-48c7-950d-385ae7db94e8","resolution":{"observed_at":"2026-08-06T00:10:37.226047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.229835Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.229835Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:1148f5723ec06e6968711f6538e8bb8d49ae5e0d3d6359519dee9720d4630977","observation_id":"3bbf68c2-ba96-4146-a01c-b6f1df43699e","resolution":{"observed_at":"2026-08-06T00:10:37.229835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.233750Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.233750Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:635f4a253df500ec01547db727030d358f0b7831fdf7725fbad6d5bf5f6a181d","observation_id":"8910312e-4244-450b-b23e-83d9a9c5436e","resolution":{"observed_at":"2026-08-06T00:10:37.233750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-021-98390-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", title =","venue":"Scientific Reports","work_id":"5025e0df-00e7-41b7-97c6-f44d65735f6a","year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.237811Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5a4c77727cddad7bc180ff0731a0258c192ba98f8e33b1e725fa14ef7c748ba6","observation_id":"8e7c4974-b259-42a8-a8b8-88f787ad1945","resolution":{"observed_at":"2026-08-06T00:10:38.089644Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.240989Z","title":"and Kida, T","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.240989Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ace02970e16e0d0ddb8a7485068afb0488de8076a18ae44806faae225d75a800","observation_id":"323e0091-83d4-47d6-a07c-99ca8c26aee0","resolution":{"observed_at":"2026-08-06T00:10:37.240989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10324","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.473817Z","title":"and Liu, Jiangfeng and Wang, Jing and Wang, Binglu and Yang, Juntao , title =","venue":null,"work_id":"a65707ab-64b8-41a4-a59c-ec0688794ec8","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.244985Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:2266561ea8074bd0b080a1dd6894335668658fcabf7f015d1f93e02e2528d7a6","observation_id":"b36706cd-19dc-4c99-aa58-be0f44936978","resolution":{"observed_at":"2026-08-06T00:10:39.478510Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.248263Z","title":"Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing , publisher =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.248263Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ca408f0ea461b50fdfbd6eae3e5cf087ca097fa4f9fe4e45c322edd69d4f2bcb","observation_id":"e1918b88-a00c-4491-bd5a-f1c4c7360c36","resolution":{"observed_at":"2026-08-06T00:10:37.248263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.bionlp-1.35","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"and Mullappilly, Sahal Shaji and Cholakkal, Hisham and Anwer, Rao Muhammad and Khan, Salman and Laaksonen, Jorma and Khan, Fahad , title =","venue":null,"work_id":"d8e75648-c10a-4a16-be24-3a7598fc2ae8","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.251979Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:4187f2e0c7ade2e70d4ffd35b918990e8db0b886eb490cb757183345d30f3411","observation_id":"05ec1f25-679f-4516-9a14-98f1bc0d2230","resolution":{"observed_at":"2026-08-06T00:10:38.072150Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.255415Z","title":"Proceedings of the 38th International Conference on Machine Learning , publisher =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.255415Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6dbd8220efa2e1161e720bbaa9f8ffb87ba861108ba7bebe797d97dce88ffe30","observation_id":"4ed55af9-5c1c-494e-bdd0-550b5c900279","resolution":{"observed_at":"2026-08-06T00:10:37.255415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.259344Z","title":"and Martin, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.259344Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:09c65783e58a3361633456882ffa0a04e2bd6e3ec1c69758219ae97470349bfb","observation_id":"c79f9e90-1244-48bb-87e2-36859abb28aa","resolution":{"observed_at":"2026-08-06T00:10:37.259344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.263368Z","title":"and Azizi, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.263368Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:c0ab09cdabfb2ba33b28a3a48650862f61c06d3d522a52b797af20ec18b83b1f","observation_id":"d4a69d45-d3eb-4831-a447-bd445e4674cb","resolution":{"observed_at":"2026-08-06T00:10:37.263368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.267059Z","title":"and Shehata, Sherif and Mutter, Didier and Marescaux, Jacques and de Mathelin, Michel and Padoy, Nicolas , title =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.267059Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:8940e27c6c200acc5534b35d0623db334770c3405d88b584cfa9ed56ac0228a3","observation_id":"41cac4d7-1a4b-4961-8b05-27ef768110cd","resolution":{"observed_at":"2026-08-06T00:10:37.267059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-84300-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":"From Human Attention to Computational Attention , publisher =","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","work_id":"35f9ff32-139f-4ff1-a6f1-dafffa263d03","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.270806Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6ac0c38c8b373b835bfd68e2646cd14e5ba4e3b5a51336f3e66fe507b82f27b9","observation_id":"ec0c9978-a960-4a0e-9ba2-58b69604726c","resolution":{"observed_at":"2026-08-06T00:10:38.061715Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10277","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.024198Z","title":null,"venue":null,"work_id":"cb0dc2e7-ce4f-477a-838a-c7b369cbd3f3","year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.274697Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:42fb7b1b916487f91483c4425667acaf4a3222fa0079f76be7117528d67ca653","observation_id":"bddf6200-1ab5-420b-b3bb-748dd8562d54","resolution":{"observed_at":"2026-08-06T00:10:39.308103Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.278561Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.278561Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:218a75f661af104f57fa0611e31bbeb19582ba8d0e2bb0d2605fd26f4d62e6f3","observation_id":"a218bb70-1f25-4000-94e9-5f327e68761c","resolution":{"observed_at":"2026-08-06T00:10:37.278561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.281695Z","title":"2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.281695Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:685004a7d0b32507dd10d6ff42d9f1cdbd9f9676f09905b6a9a99130d2ae74e4","observation_id":"d60d24f7-f34c-4418-8da8-1bb23c780e6b","resolution":{"observed_at":"2026-08-06T00:10:37.281695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.284819Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.284819Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:7c211abd1587c092c9ce74cbe2b139611cf569114fd9facf8572785464404c0d","observation_id":"a94551c7-314b-43c6-8354-066c6d043c0f","resolution":{"observed_at":"2026-08-06T00:10:37.284819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.288108Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.288108Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:969364f2715b556042f6489c6b98e86736db98dd3786046c1d46a5785eba6b1f","observation_id":"824ba28d-7ef0-40ab-bae8-d7c84b9498a8","resolution":{"observed_at":"2026-08-06T00:10:37.288108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.291563Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.291563Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:77cde5978f1345d7eb8e82f8a40b2d2b90222c3b289f3d1bb474afe4661d91f9","observation_id":"84da6114-17da-4cc6-960a-3af4773806a9","resolution":{"observed_at":"2026-08-06T00:10:37.291563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.295552Z","title":"and Duan, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.295552Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:8f36bcd2a3ea21f32aa0acc97329135a126f5f1abc03af72b9e775ce495d421d","observation_id":"f4fac706-4cb2-40db-a9af-2d024ca65a97","resolution":{"observed_at":"2026-08-06T00:10:37.295552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44172-024-00271-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Communications Engineering , publisher =","venue":"Communications Engineering","work_id":"7e91af53-6a62-465b-9add-2eff91b383d2","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.298998Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:df6c0654b4372bf4c48eb4e612b181673eb479b57ff8ad4dd0d7c439caaac8c4","observation_id":"fb4aafa9-40ea-4c4f-89ff-5c598b5b40dd","resolution":{"observed_at":"2026-08-06T00:10:38.051733Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.302298Z","title":"and Shu, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.302298Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:39368f391dca94e7a79c6ae09acaa82e061adbdb97a3afd2462c4990eeb2871c","observation_id":"e06a8199-597e-47a4-addc-44d74f7b047c","resolution":{"observed_at":"2026-08-06T00:10:37.302298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.306570Z","title":"and Yu, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.306570Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:4a2e68128298c9b1db012ded529aad8ad68d5f963a982c7b5afd2315c4de445e","observation_id":"355177be-5f96-42d0-96bd-749cb290939b","resolution":{"observed_at":"2026-08-06T00:10:37.306570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.310403Z","title":"and Yu, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.310403Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:18deb8477de173ebf59088e11a0fbe3f2dd91e2fbdc43da6506b7c0ba42c1c60","observation_id":"81b7b4d1-9600-4d52-ae99-d5377e08e657","resolution":{"observed_at":"2026-08-06T00:10:37.310403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28173","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.865776Z","title":"IEEE Transactions on Neural Networks and Learning Systems , publisher =","venue":null,"work_id":"ca213af7-3c3a-4363-8d89-7263c592aebd","year":2018},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.313819Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:7e7d6047142599b8fc7cc1df1bda3dbd12df5fb092fe474a70bbff76521d3ec6","observation_id":"5f10686e-1811-44ea-9a10-3bbf9b7fd5de","resolution":{"observed_at":"2026-08-06T00:10:38.871658Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11548-024-03141-y","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"and Navab, Nassir and Srivastav, Vinkle and Padoy, Nicolas , title =","venue":"International Journal of Computer Assisted Radiology and Surgery","work_id":"031e3e86-ae3c-4018-8ea7-15a647da6ac3","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.317713Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:cdb77b99608cae09aff298e0e9b3f7ae2c0f1739d765af841262054f16939a44","observation_id":"55b8687a-c832-47cf-9c93-2405e2a6a3df","resolution":{"observed_at":"2026-08-06T00:10:38.040915Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-3907","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Advances in Neural Information Processing Systems 37 , publisher =","venue":null,"work_id":"c85198cc-963e-4d94-930b-d85f572a5a42","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.322460Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:69bc8b549469adc563351dcebee381c5165f3829b9aafb80ed30b02c46cd2337","observation_id":"d07c83fc-df4b-4e14-b44d-e4455686833a","resolution":{"observed_at":"2026-08-06T00:10:38.030515Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.326739Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.326739Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:77ec364edc34c967072d32662ee81b10a65244cd6353ad1720b11e64545d3081","observation_id":"3c13843e-2329-43b3-9b31-d934dabaf23c","resolution":{"observed_at":"2026-08-06T00:10:37.326739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.330695Z","title":"and Marescaux, Jacques and Mascagni, Pietro and Navab, Nassir and Padoy, Nicolas , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.330695Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:67c292288eff859d6b1df56dbd51867ca0f34d05e272d9dc7742a6394e8e0bcb","observation_id":"2aa87f89-5952-4c06-a660-c8aee7a50317","resolution":{"observed_at":"2026-08-06T00:10:37.330695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.334040Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.334040Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:71511a592e78c183ccffaf596db71675514d49ddf5193676c1946676147e5006","observation_id":"86a1b598-68e4-444e-9439-42b0c54fca90","resolution":{"observed_at":"2026-08-06T00:10:37.334040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s42492-024-00160-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Visual Computing for Industry, Biomedicine, and Art , publisher =","venue":"Visual Computing for Industry Biomedicine and Art","work_id":"a444ee10-f4d9-4b8d-9601-1219be44edab","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.337227Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:de5a22e746ae9b7c552f980dfee7093350808ce395f6da4d1b8088c4e8e71eeb","observation_id":"df3d41a1-47ec-499d-b907-a5f160f9aaff","resolution":{"observed_at":"2026-08-06T00:10:38.013076Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.341216Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.341216Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:a7c2b782e48a3e038258b2c43c5b4c79152c5d56eb7c4805635a9f18fb365cfa","observation_id":"14afca63-9d05-4b0d-ac58-89a0c046d6c0","resolution":{"observed_at":"2026-08-06T00:10:37.341216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.344873Z","title":"and Bai, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.344873Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d9ea532ce5c42e53e0b7c4185dc084f2ff87cfa7ed7c7f978745348239c27f59","observation_id":"51ae2646-91a5-4383-b01f-adc54196f809","resolution":{"observed_at":"2026-08-06T00:10:37.344873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.636","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , publisher =","venue":null,"work_id":"4e3c5183-4814-4f26-9fa9-df94d9042298","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.348456Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0de8994d557fef7782d997ff048f007ecfde3b15f73e368237ca636c042cf1fe","observation_id":"09b521a5-3a46-4d21-816a-35e836b43014","resolution":{"observed_at":"2026-08-06T00:10:38.001750Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.351840Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.351840Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:067f2b7c34ea0e8cd57fae81dca6c3ae1d168aeaf1f07dce06c8f919c67c5b59","observation_id":"3b759929-a8a7-4d4e-875f-dcb544e37da2","resolution":{"observed_at":"2026-08-06T00:10:37.351840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.63317/4jh5knz54ake","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Proceedings of the Language Resources and Evaluation Conference , publisher =","venue":null,"work_id":"3a626c21-73f9-4d37-8047-dedabc44e2c2","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.355018Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:e8b0c285c8d7f21a0b6f377fe54a3c01792e59b8d801c50b8d6a1ad708fd7210","observation_id":"d0aaa78f-4232-4df0-836f-c49c4424bd38","resolution":{"observed_at":"2026-08-06T00:10:37.991236Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.358458Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.358458Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f6b035e56cc6dbaf2c8398a65f867105c663fb9dbf097cb2290a55b4ae008f6a","observation_id":"364223b7-c1a2-4e92-95cf-04ec42277613","resolution":{"observed_at":"2026-08-06T00:10:37.358458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.362667Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.362667Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f9190f15cff1a779f3bdafda807fe25482d39fb8fce8124e6bb1005fdc315efa","observation_id":"4edcc406-502c-422f-aedd-a066db0cfe99","resolution":{"observed_at":"2026-08-06T00:10:37.362667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.366271Z","title":"Proceedings of Machine learning and systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.366271Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:76ac2ff781ce87b9fd79a3fb6074391282f18da05b85ec845d3df2d64abc0781","observation_id":"d6fbb573-58c4-4cad-9828-cbc1e51ab474","resolution":{"observed_at":"2026-08-06T00:10:37.366271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.369912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.369912Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3496ff0332c849c77303c3449b82792ab26d3e3e89360d4470d7b5515de2177b","observation_id":"81f3e913-3ffb-4566-a378-4ae6244aaa7a","resolution":{"observed_at":"2026-08-06T00:10:37.369912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-08-13T10:44:26.934833Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-06T00:10:37.373216Z","title":"arXiv preprint arXiv:2508.10104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.373216Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:287542304d3dba2d8d57a346f93de6a50b120f34699916c2986224473382ea20","observation_id":"170bbe89-5d06-4c80-8f3b-82bee741376b","resolution":{"observed_at":"2026-08-06T00:10:37.373216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.12477","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.624078Z","title":"arXiv preprint arXiv:2501.12477 , year=","venue":null,"work_id":"6b9c415b-e94c-4435-9804-24c7f4e35cf7","year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.376803Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:49df583dc0d350ada7a3cf8946ff9e23507b0db95bdaca6f967b931303bc6083","observation_id":"b63ac69d-817d-42f1-8911-1f3341c61105","resolution":{"observed_at":"2026-08-06T00:10:38.630135Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.380483Z","title":"International Conference on Medical Image Computing and Computer-Assisted Intervention , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.380483Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f7824a3da25e55ce9c023ee71fa6d878c252f96225b6f339a38d0788d746844b","observation_id":"14e85782-b8a9-405d-8f1b-38530456f3ac","resolution":{"observed_at":"2026-08-06T00:10:37.380483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-06T00:10:37.384400Z","title":"arXiv preprint arXiv:2403.12945 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.384400Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:01ec0e8f72f13bd9659368f2a3bf56f6309eb7232b32b8dc3e63ee9f421cd481","observation_id":"2a153a74-f97f-4955-8f55-c249c3f49b55","resolution":{"observed_at":"2026-08-06T00:10:37.384400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.388022Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.388022Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:41bd7f1b9103aa79f91e303d13e635a979d1103144f0d31fdd1f907467e9de73","observation_id":"b4f03e3a-fb92-4f16-bcb2-caa5685d3d57","resolution":{"observed_at":"2026-08-06T00:10:37.388022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.391059Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.391059Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:af0ab0671b2e18fe791bd9485232b904ac26c3bb374d12839d16d2cd6dbcc476","observation_id":"e3e108b5-2533-4478-986c-8339b117f712","resolution":{"observed_at":"2026-08-06T00:10:37.391059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T11:04:31.557325Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":74,"verified_exact":19,"verified_fuzzy":0},"total_outbound_references":255},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 255 outbound references and 0 inbound Pith citation observations for arXiv:2608.01473."}