{"as_of":"2026-08-21T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b5002b8200eb4cae8db306f62576c3c40f9a4a63bd69b13cbe246ed6dcbf702","coverage":[{"denominator":85,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":85,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:06:30.680985Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06510/citation-record","integrity":"/paper/2507.06510/integrity","json":"/paper/2507.06510/citation-record.json","paper":"/paper/2507.06510"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.515732Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.515732Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:f5b74c1c676d81aa9d768aa324a2b099fedad8a15aaefdeb2d4079c8d263330e","observation_id":"ea9d75de-5aae-46fe-aeb0-8c3ed4469ebd","resolution":{"observed_at":"2026-08-06T19:06:30.515732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.518313Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.518313Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:525874498cc92ed13941b1ae24ac10b826706d7ca25a14e831477bff0ad625ca","observation_id":"0e689754-7b55-4a5b-8909-1b6e0b96b834","resolution":{"observed_at":"2026-08-06T19:06:30.518313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.520560Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.520560Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ad2d2eb578fef77d140f6edb8a43ac76ec6f560d6e21d588ade7dc98278b6edd","observation_id":"ad75ca5f-159b-458f-8c51-e2ffc3d749b5","resolution":{"observed_at":"2026-08-06T19:06:30.520560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.522748Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.522748Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7a3bc50ed384ec400a8a5f561d4157f493c5dd5cae9adf896974473a284b3a12","observation_id":"5792a0e1-95ec-4a64-b3ac-9c4a9f78a338","resolution":{"observed_at":"2026-08-06T19:06:30.522748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.525533Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.525533Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3bb24f6e2e3e55fc09b83f6fcddaee53198f726a6e05fa893979bb0b1df2f6be","observation_id":"6ae4b3e2-1047-4b7a-af32-6ae0c8d96924","resolution":{"observed_at":"2026-08-06T19:06:30.525533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.179633Z","title":null,"venue":null,"work_id":"8144fefc-4d0b-4227-945f-710cba9fea6f","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.527589Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0d89eca84ee61d6344dbe9f30d196d7fb991afb1eca10d0a0fff1319e558b324","observation_id":"cce1f801-e704-404a-a428-21c9100d1c47","resolution":{"observed_at":"2026-08-06T19:06:31.181770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.173698Z","title":null,"venue":null,"work_id":"ff445a56-030d-477d-b576-1650c485aa3a","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.529766Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ea7a93dcbd00dc85cbc72c7b9356bb31e6ff04246e89b063f3847b5483776a3c","observation_id":"840dd4f0-012c-4811-8058-1557feda8a44","resolution":{"observed_at":"2026-08-06T19:06:31.175945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.167730Z","title":null,"venue":null,"work_id":"9c7f80e9-5842-4f34-855b-cd50a567859c","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.531693Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0ddf215951bf8545707c3c69285c3b66532ba81f93959e833b9f46bd6c2dd363","observation_id":"cc3eeb2d-1b4d-47c8-9d17-6c4143261c45","resolution":{"observed_at":"2026-08-06T19:06:31.169838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.161616Z","title":"Tamura, H","venue":null,"work_id":"2da04461-4b58-4e53-a65f-4a3d6e94f02e","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.533581Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d910f2361678197242272aa0f0c4be8c3126944d6799ae58a0f367b0be02b832","observation_id":"c949a46c-3ba5-4b79-b4e5-b2b42bb0921a","resolution":{"observed_at":"2026-08-06T19:06:31.164066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.155358Z","title":"Zhang, D","venue":null,"work_id":"4a0ddc97-8367-4d28-bdd1-f56a74f26287","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.535586Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:8bcbcea0f5123f9be9fd48ca8a6edb2c761c0c4761e002f93c00dc223b3c952c","observation_id":"9a4112ab-6f39-4215-b939-cc03835edbd3","resolution":{"observed_at":"2026-08-06T19:06:31.157415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.149679Z","title":null,"venue":null,"work_id":"08ef6df0-5fd3-451d-a141-c83cfd766f97","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.537666Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:8af984ee6d81dfdf44ade9247aca06be470ea1895eebe8b3f804fa6a5c1b5f4a","observation_id":"f0e4de5c-d157-407c-8f8d-2c8a44663bcb","resolution":{"observed_at":"2026-08-06T19:06:31.151664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.143564Z","title":"Zhang, Y","venue":null,"work_id":"9887facf-55e5-4b8b-9e05-dd9f0c4fe78e","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.539631Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:2a2acbdcab958fc6f60b65b4c022192303206eeb78ca0ca7b4addf749c602782","observation_id":"50edd7af-2731-42c6-bcb5-f4ca08e935d2","resolution":{"observed_at":"2026-08-06T19:06:31.145758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.137820Z","title":null,"venue":null,"work_id":"c2a5c1cb-2cc0-49e4-b475-a3e91049efcf","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.541706Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:fc5de22624383a31d367d7dc933ef8816956cce70dd0a4e3c2f267479eb51858","observation_id":"962def8c-7e70-499a-aa38-41e013a406e7","resolution":{"observed_at":"2026-08-06T19:06:31.139931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.131509Z","title":null,"venue":null,"work_id":"3ae35431-cd53-4186-815a-b4d8460b241a","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.543485Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:50bc9eede74eb48d922cc9d9ce3b89cd73f74a12f664973f9f5db4f980f8166f","observation_id":"2c352c1f-76be-4065-8e45-08c6214662f4","resolution":{"observed_at":"2026-08-06T19:06:31.133984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.125628Z","title":null,"venue":null,"work_id":"0f1e47d0-55fd-4b88-9887-389e087b1c2e","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.545237Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:eec54144aa5a166be3db41f338dee86d2e05ea32666459bd15bea86093f82b52","observation_id":"c94a1d4c-c5ab-4e35-b23a-fb3feaa22030","resolution":{"observed_at":"2026-08-06T19:06:31.127783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.119773Z","title":null,"venue":null,"work_id":"f53ee2b6-38e8-4a88-8571-22c39dbf2cd1","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.546893Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:71cc001b6391cbee8862e5547e956c6552626278fabee9debde757191cb504e9","observation_id":"7f51bf63-ff6d-4fb0-9287-128b77041e97","resolution":{"observed_at":"2026-08-06T19:06:31.121833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04474","last_updated":"2015-05-17T23:21:35Z","snapshot_observed_at":"2026-08-19T22:00:06.074211Z","submitted_at":"2015-05-17T23:21:35Z","title":"Visual Semantic Role Labeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04474","snapshot_observed_at":"2026-08-06T19:06:30.548878Z","title":"Gupta, J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.548878Z"},"links":{"cited_paper":"/paper/1505.04474","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:779d59f04c918b24b11e556ba9f6d9028b394096b2ef87063e3705b3944e841a","observation_id":"bd5e347a-aea2-4b3f-bd76-aeba812e76f9","resolution":{"observed_at":"2026-08-06T19:06:30.548878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.113750Z","title":"Ulutan, A","venue":null,"work_id":"63ad5e38-abfa-47c4-bfdc-126e22c560ed","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.550996Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:b270d219fbf1f3feddff2eaadaa2b8425a35a3b055f1574dc3c005d2066feade","observation_id":"4690dfff-9b3a-465e-92a2-805a16808b25","resolution":{"observed_at":"2026-08-06T19:06:31.115906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.107601Z","title":null,"venue":null,"work_id":"53b40549-33c9-48eb-84ae-213b84a49f72","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.553143Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a6e2581944d1698f145acb4935edde14c251fa8545957ea5c7dc9d7fa1f22f4b","observation_id":"dba21fef-d6ce-42fd-890d-56e6fd780116","resolution":{"observed_at":"2026-08-06T19:06:31.110117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.101673Z","title":"Gupta, A","venue":null,"work_id":"8ae01c64-93b6-4f6e-b280-171ef5f53783","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.555044Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:72e23fa616808f487c8d20ad8c01f23374a7926b26e84e35e34a13ae6ad5b8d4","observation_id":"07e66959-8440-4668-8e5f-c8d9b4c5f4d3","resolution":{"observed_at":"2026-08-06T19:06:31.103838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.095517Z","title":null,"venue":null,"work_id":"a6c1cc06-32a6-4ab6-8688-7c383b4af2f4","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.556866Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a4a57dd410243c085ab96e10ec62f0c4bc28bf2c257c60674c238d33e2e72d5d","observation_id":"0b8dcbc0-693c-41df-b3fd-c13366023b2b","resolution":{"observed_at":"2026-08-06T19:06:31.097823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.089300Z","title":null,"venue":null,"work_id":"83090908-7ed7-4df9-91b2-c6f5f9806302","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.558698Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a9d5be0298860b230e1603343fa2d230796862323ac828ceaaf4c9556dd45a48","observation_id":"dbaeba22-4e16-4e74-b3a4-8498b9b4385e","resolution":{"observed_at":"2026-08-06T19:06:31.091378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.083167Z","title":null,"venue":null,"work_id":"1bd7b336-4543-49d6-9b8e-9a4a61829a1a","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.560595Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9f3ffb019a1e835787049e55e65f551532353ba0b64ba0dbac93adb6a18701d4","observation_id":"d64d0341-f576-4589-af67-7b42905240af","resolution":{"observed_at":"2026-08-06T19:06:31.085479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.077246Z","title":null,"venue":null,"work_id":"201ba98c-bdf6-4a1a-a1a7-62489fe361e9","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.562605Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:eef97c2c214ea4f240ad4fb993bfdfe1842af566089cfe379d538483e00294cf","observation_id":"a1f501b6-4aae-4890-b435-c98f09690e48","resolution":{"observed_at":"2026-08-06T19:06:31.079389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.070859Z","title":null,"venue":null,"work_id":"57d21ff8-0117-440d-956d-02c9b486264a","year":2018},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.564377Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7b2e9782065aa8eeb2d9e30fae8f121f2dd3f4a3d55f4d6fa71cace23e71053c","observation_id":"f6d43d2a-8a80-4674-ac2f-d2a14f1e3e84","resolution":{"observed_at":"2026-08-06T19:06:31.073263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.064542Z","title":null,"venue":null,"work_id":"74f043ef-6c49-4e98-89ee-6e5dc0cb8fbf","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.566263Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:1defd17ca72c9727fe70318b6d0a50b42b79622638d9d010f2b61ab7e623f104","observation_id":"75de9edc-5e5a-4082-93ee-8894bc70c9bc","resolution":{"observed_at":"2026-08-06T19:06:31.066796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.058418Z","title":null,"venue":null,"work_id":"1e857a9a-1806-40ab-b324-b0c189dc0f8d","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.568028Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:acfc1f660570cc487f8496747998bfe34f4774ce8fa405fb04700166590e376b","observation_id":"cb1bc14e-b9e3-4d95-82d7-d13af7be08f9","resolution":{"observed_at":"2026-08-06T19:06:31.060702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.052560Z","title":null,"venue":null,"work_id":"14c2f296-405b-4d83-adbf-5d2dd1e17c4f","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.570126Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:fe3fc6c97c09a276564a4fa1d31b34b5e03e5ae7a1403e642179e013658e5430","observation_id":"18a6729d-7d57-4cac-acfb-971849644a8e","resolution":{"observed_at":"2026-08-06T19:06:31.054615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.046739Z","title":"Zhong, X","venue":null,"work_id":"8998d3a3-6364-4e4b-aaec-61251e2bd103","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.571945Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9480c63a62102e68a97d6fc6b0d66409097152f56c48a3b8d9ffd72235c79bdb","observation_id":"b761514e-8ec4-4fde-b187-472a8aa6bd67","resolution":{"observed_at":"2026-08-06T19:06:31.048740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.040343Z","title":null,"venue":null,"work_id":"f6a31fa9-c3fd-410f-9589-a54433a5896c","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.573802Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:075a2f581e8bc2ec7cedef015648aa10eee9358742acb8f08c6e0f8686c09e16","observation_id":"5d3318a8-d5d2-4c68-a536-e30c48b0045d","resolution":{"observed_at":"2026-08-06T19:06:31.042468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.034382Z","title":"Radford, J","venue":null,"work_id":"d5344c8a-f59a-4cc7-9eb7-6432e3615c78","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.575606Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:01033bb713160c24f7c59a1e9a603924846d4e718b6faa7d63edda9986d26bc3","observation_id":"ace63cea-4341-499d-88d9-e7e193d32884","resolution":{"observed_at":"2026-08-06T19:06:31.036715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.028274Z","title":null,"venue":null,"work_id":"c680d0ae-d748-4c5c-9586-1e91baf384eb","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.577561Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:64c5a093f234a1da1c3a3a603d97ce384b344f7d0c9bdaa29f2822f718d09da8","observation_id":"327a9e42-7d81-4df0-8ddb-dc9012f8f8f5","resolution":{"observed_at":"2026-08-06T19:06:31.030422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.021683Z","title":null,"venue":null,"work_id":"6eb087d8-300b-49df-a2bd-a2cfbe4ebb73","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.579386Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:985c7d1a41bcc72904acfca7d9de7b34bae7249f0f35086be0b98cb90e2ea930","observation_id":"a57fe27d-a400-46b0-afee-dc6b830f24b6","resolution":{"observed_at":"2026-08-06T19:06:31.024125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.014963Z","title":null,"venue":null,"work_id":"187ea4ff-e7d2-42ee-ac8a-c37c5589accf","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.581577Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:976de5b5d978bbe2c3171fd868a10606b0a84edaaada266108bfad0ee0fed97a","observation_id":"13fb7d13-1ad4-4e7c-bb21-5367de96579a","resolution":{"observed_at":"2026-08-06T19:06:31.017449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.007940Z","title":null,"venue":null,"work_id":"b808d009-df3f-4be6-bde1-6e92fdd35ee3","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.583359Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:632caf0b59968beb23a37f330af5ba1bc10595727a6ddbb278fefdaab6713b39","observation_id":"7617333c-2705-4a54-aaa6-3b5767baa50e","resolution":{"observed_at":"2026-08-06T19:06:31.010261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:31.001716Z","title":null,"venue":null,"work_id":"3c800f2a-b2d5-4e54-acd4-e058cc4dc6bc","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.585444Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:2cc69fe01713d9f70e584f5f5aabf491229c2df96b365e2a581e478895f89c01","observation_id":"7212532c-6921-408b-b01b-64cc1fe97748","resolution":{"observed_at":"2026-08-06T19:06:31.003956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.995186Z","title":"Zhong, J","venue":null,"work_id":"4066ec63-f53e-4a29-9d80-fe3e7753878a","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.587365Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:5eb21e05cf48c08a46a0cf9ad34cbac1f67f3abc5d8c7f20ea3bc74c1d136403","observation_id":"606f9912-4ed6-4339-a1a1-7a7e0b0d0388","resolution":{"observed_at":"2026-08-06T19:06:30.997551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.988665Z","title":null,"venue":null,"work_id":"9c3a1a84-9e39-41f0-aac1-a1d2fcae34a7","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.589127Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d78d544904971dfa391aad02d6cb0f26acae8e07e4e5b045f54b5fd69cb05c67","observation_id":"eaba8dbd-7492-4220-8706-b8b534079720","resolution":{"observed_at":"2026-08-06T19:06:30.990884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.982728Z","title":"Bansal, N","venue":null,"work_id":"ef9865cf-e03d-4113-9f53-ce961fbd1cb5","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.590936Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:f490fc217a85561a80f990193655b86a7f1274a8581af1a8dba4e0890c9806fb","observation_id":"7a6d721d-a777-459a-8bc7-4e51e2c607fa","resolution":{"observed_at":"2026-08-06T19:06:30.984907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.976848Z","title":null,"venue":null,"work_id":"f5750cda-4b5e-41b4-bc7e-8cd70a8d2faf","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.592750Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:75234b9d5db0bc442dbff554a2742d51d55035f3d3cf2d02a9b1962b980b0ce0","observation_id":"e8eafec0-5dd1-4eae-980b-dc1bafadc06f","resolution":{"observed_at":"2026-08-06T19:06:30.979016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.971011Z","title":null,"venue":null,"work_id":"fd9dac3c-b246-4e82-a30d-f9f0c22f2445","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.594725Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:44ec58f338135c905d59ca4c042da002056f6bd0616d9053f6f3d11f95a27421","observation_id":"68ce2f9d-80df-4d32-bebd-37c02a704f6a","resolution":{"observed_at":"2026-08-06T19:06:30.973100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.965110Z","title":null,"venue":null,"work_id":"b926e5f7-0055-4af4-8fc3-1b4f15dbea46","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.596658Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:61d341f80944631eae1df34cb71386a129c4bb93645ae8695e39fb66cef141fe","observation_id":"5a895d0d-b2bf-4cf3-a310-e974164f8323","resolution":{"observed_at":"2026-08-06T19:06:30.967224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.959531Z","title":null,"venue":null,"work_id":"b50586bf-c9dc-434d-b153-55f071a250c0","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.598452Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:c325e41df943e7b08acfc0dcfb1eaf8c41053fa4dc2f170fccef9cfcb56b83f3","observation_id":"c7b71b9d-4ed4-47a0-a191-48ccbfaea515","resolution":{"observed_at":"2026-08-06T19:06:30.961533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.953807Z","title":null,"venue":null,"work_id":"ffb8f826-fdd3-4d63-9020-e8c2b7795953","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.600376Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:1a34d234e393c69a7574d145f6a56c583a42e7b78ab75649ea09147f83921959","observation_id":"edd7ff91-2ff5-4a66-9e2d-534b016258f7","resolution":{"observed_at":"2026-08-06T19:06:30.956048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.948164Z","title":"Zhang, S","venue":null,"work_id":"b8074455-5012-4736-bbdb-e897fdde2aaf","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.602063Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:5147b8d95ed81c0e3feff785633d6e351949605d0f387783924b1fed84753cb5","observation_id":"0b163358-69e8-4b6b-9660-bf3f12a3dfdb","resolution":{"observed_at":"2026-08-06T19:06:30.950151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.942488Z","title":null,"venue":null,"work_id":"a4ee2538-784a-45f9-b91c-5b81f3e5a1c9","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.604090Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:37799b3d62858f00b4ab38adc7a65360b0a8c200819727e9a0587c292d2e1d9a","observation_id":"4be0df52-d5c1-4331-861c-59591ce1b5cb","resolution":{"observed_at":"2026-08-06T19:06:30.944499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.936470Z","title":"Xiong, X","venue":null,"work_id":"795d9c11-3fba-4f0c-8be5-46d0f4a27271","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.606023Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ccc48bff84545f2794266ee8aed2f66f8c003f6520c0d2c22fdae078db69d3a9","observation_id":"0d9b8b18-7ad1-4e8e-b63b-ead30e7031f1","resolution":{"observed_at":"2026-08-06T19:06:30.938633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.930587Z","title":"Carion, F","venue":null,"work_id":"d5a6edfb-e5c8-4a66-97ee-0c8a9bccc64f","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.607886Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7953982964e5919d44530285a0a646f28450295133e6a610e33cef0ce8a56740","observation_id":"54016b51-5ae3-4287-a755-c5f7ac9ef0ff","resolution":{"observed_at":"2026-08-06T19:06:30.932780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.924956Z","title":null,"venue":null,"work_id":"e7d29a23-ba74-4e3e-b414-0296516889cd","year":2015},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.609814Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d3843c50b51e344b3383b01dc21c3a4b072553c19796e38b271ba3d2776ec1a3","observation_id":"7c1d977d-e041-49ce-886e-fe40a5b49c68","resolution":{"observed_at":"2026-08-06T19:06:30.926969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.919246Z","title":null,"venue":null,"work_id":"acf706e3-fb08-4dc0-842f-ae990c5c35b2","year":2016},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.611777Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:bfc67259f02c5ce6adacee00d721fc6a2abc0e804a672f5c9f050d86faae0d9b","observation_id":"d98f04a2-0e0e-42b1-9d32-3bc6638aabd9","resolution":{"observed_at":"2026-08-06T19:06:30.921169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.913476Z","title":"Loshchilov","venue":null,"work_id":"6bcefc96-5973-4246-a60f-4695e8a779ea","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.613611Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:bf0ad11cf0d98cb985539ee7b78a440e8608f1ed55bbe8b17450dbe834f51c07","observation_id":"4118d0f1-a990-4d41-a1e7-927315f32147","resolution":{"observed_at":"2026-08-06T19:06:30.915531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.907907Z","title":null,"venue":null,"work_id":"9e2b0429-bd1e-4a0c-9982-91f9bb628b5a","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.615875Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:4d66044c2e6d374060384dcdf4c572e1da8fdd1255b17c6b06461fbaa1354fcb","observation_id":"5dcc6e56-50f8-4963-9d35-b86de4303400","resolution":{"observed_at":"2026-08-06T19:06:30.909979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.902111Z","title":"Bansal, S","venue":null,"work_id":"23807e21-f402-4ca4-92da-04e331638666","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.617889Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ddd244447f54c4f32fec24318ce4ab7a0351b9fb8b4eb8963069f23751335f99","observation_id":"59867246-07e5-4375-8720-c34a4d773117","resolution":{"observed_at":"2026-08-06T19:06:30.903968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.896537Z","title":"Gupta, A","venue":null,"work_id":"1de660db-968a-4663-a0d8-90397723340d","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.620080Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e6ab517fe1d89cd25dde1eb00fbce0f32499a9b8df1fcccd7f2531512c303058","observation_id":"e773e787-f1db-412a-bebd-8ae486c21d37","resolution":{"observed_at":"2026-08-06T19:06:30.898532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.890416Z","title":null,"venue":null,"work_id":"80266adc-7bab-45f8-bc80-8862e0876459","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.622005Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ea740581ab6bece9d72056e02ee7d271ce7d45aa24848daaae31dbd484e015f3","observation_id":"93ca6fd4-d75a-4260-a36d-f40ba15ef849","resolution":{"observed_at":"2026-08-06T19:06:30.892641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.884275Z","title":null,"venue":null,"work_id":"0e71584d-7cf9-4d78-b693-12358e138035","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.623862Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3bdf32820c835c8df189ce529c23b4959a735685f27dc9169146ec6c54cc4cca","observation_id":"c83081f9-f0ab-4ad8-adad-f622f8d6223d","resolution":{"observed_at":"2026-08-06T19:06:30.886689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.878431Z","title":null,"venue":null,"work_id":"e57d10f7-6f2f-4187-b925-21d4e9f3572d","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.625735Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:311914bf555c1ee30cace8338591c20c64f30b31dedfb5c5edc24bbf593ff629","observation_id":"3e6b089e-d851-4eeb-b3c4-7f93d38db674","resolution":{"observed_at":"2026-08-06T19:06:30.880357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.872600Z","title":"Peyre, I","venue":null,"work_id":"706e356e-9ec6-4d48-a20a-235d143b49f4","year":2019},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.627652Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:4b573d08bc4da3e24da3f09295f8431d252b978b99b0efc459e7d7efe78cce30","observation_id":"a04bc32c-f999-455b-a266-6e03be624833","resolution":{"observed_at":"2026-08-06T19:06:30.874570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.866722Z","title":null,"venue":null,"work_id":"58ccc530-3c80-4209-9955-ff8748c11ddf","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.629521Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e2fc7308e832230921e7b4ec911140252937bf59744249c13f10044953a76ad5","observation_id":"e41795fb-91af-4040-a743-a22ce00fd019","resolution":{"observed_at":"2026-08-06T19:06:30.868770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.861076Z","title":null,"venue":null,"work_id":"ebae1c84-bf50-45c2-8f1f-88cb84679a75","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.631662Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7829ee1134162dfdb45a4a7d529da4c38b22a9940b4fb43bf9e320a98974dd27","observation_id":"98f7e3e3-d0a7-4928-a81f-c985665b119e","resolution":{"observed_at":"2026-08-06T19:06:30.862972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.855378Z","title":null,"venue":null,"work_id":"9b924d9f-9101-4997-9efe-cf582463805b","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.633593Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:14db036c28a9f9568cfa43233dd4971014912ae84272fc11196b6fc5e7189278","observation_id":"2b40dd2f-1635-4a6b-8c21-cf7eaa2b2432","resolution":{"observed_at":"2026-08-06T19:06:30.857335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.849852Z","title":null,"venue":null,"work_id":"692533c6-3fda-4489-870a-941747192cf5","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.635489Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a0850c882e7a27d74f2ce7c62b857d919f63a5316aa5d9d4da5f6b75243b702f","observation_id":"08714303-8c01-4acd-814d-c12ce6bbcb0a","resolution":{"observed_at":"2026-08-06T19:06:30.851781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.844057Z","title":"Zhang, D","venue":null,"work_id":"c8bf6b69-a305-4fd7-872f-675b181c9dc6","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.637424Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:3706174b3b91dac1bf7c7899053d832fe2a2f6dca51a85e3605eacd1ce97cc0c","observation_id":"2b98c2b4-06da-40b6-8a02-2c02b5a7ace4","resolution":{"observed_at":"2026-08-06T19:06:30.846207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.838072Z","title":null,"venue":null,"work_id":"d2d81a1f-37f7-432e-909e-8f0db870876e","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.639268Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d1adcff5ec757c3534b38def3f8ef8fb76f7d8cb1a21feb97f2694698fd0ffc5","observation_id":"31e5c11d-0e83-4891-92c9-34b7fb8691a2","resolution":{"observed_at":"2026-08-06T19:06:30.840176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.832310Z","title":"Iftekhar, H","venue":null,"work_id":"422b4426-1d09-422e-a37f-57617c390a30","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.641397Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:227dbc9df04d80a8dc1555478fa1656559bf3e296acc8b54e9a46009d65023e8","observation_id":"9773363a-5e11-464a-b9df-111a63920c79","resolution":{"observed_at":"2026-08-06T19:06:30.834398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.826248Z","title":null,"venue":null,"work_id":"1e801d98-43ca-4744-ab62-550d77d8ffb7","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.643272Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:16cf62ec9a2c0d1528e21714b6369ca05ef73adb3571328b2d0f656ad5bf2ba2","observation_id":"1beb2d65-bcc8-4201-ae26-fe909d29d446","resolution":{"observed_at":"2026-08-06T19:06:30.828229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.820499Z","title":null,"venue":null,"work_id":"9b268aaf-5b78-4986-9b85-7d75c744b58e","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.645064Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:c1148748fa8977a8ddb0c8c4450fb111db5308198a973a9bf4886d54fc184417","observation_id":"94fcb759-a9c8-4cf1-92dc-1f6588e527e2","resolution":{"observed_at":"2026-08-06T19:06:30.822548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.814474Z","title":null,"venue":null,"work_id":"057abc01-a139-4dbb-a43f-ef2d3245bf77","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.646876Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d9df0cd5c338afc9aa764e3449e7b0a4c188d0db4e8b8ee93c31411426cfa13e","observation_id":"9ce8ba8a-a69f-4de3-8e8f-982248a00b94","resolution":{"observed_at":"2026-08-06T19:06:30.816581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.808715Z","title":null,"venue":null,"work_id":"f5132207-4deb-49ff-a3bb-08034773efae","year":2020},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.648854Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:ad771f572aa57f933b6a7a5f5ffd067ff13c5ab74df9fbeaa8fcf73707184a5d","observation_id":"d14d5fef-231d-4dac-8bcd-cd446bfa3a32","resolution":{"observed_at":"2026-08-06T19:06:30.810805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.802674Z","title":null,"venue":null,"work_id":"5910ccd6-0d64-457b-b65e-04eda480fefa","year":null},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.650620Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0c18067c3953fc6bcfd2e489426db4fc3b21fa7fd93144982f22e5a533e8c3e8","observation_id":"aaa781e3-cce0-4e55-b24a-7522ae4dd61c","resolution":{"observed_at":"2026-08-06T19:06:30.804799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.797005Z","title":null,"venue":null,"work_id":"81e49950-62f5-46cb-a071-c2211633a31b","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.652707Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:e7f251de67bd6421fc983276235ce91e6c9292c12dfcac2adf82e4ce0764eb57","observation_id":"38f94b91-fd82-45f9-bb41-7ee052706a31","resolution":{"observed_at":"2026-08-06T19:06:30.798997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.790896Z","title":null,"venue":null,"work_id":"711585ab-69bc-4122-9ad3-5d1396167988","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.654755Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:2b364e65475296e2f32b98f7db8ba51d4ab90a54659f2b79b3753c0b8efff1f9","observation_id":"ee425de8-7647-4ba0-80ed-9a709c2036fd","resolution":{"observed_at":"2026-08-06T19:06:30.793210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.784394Z","title":"Dosovitskiy, L","venue":null,"work_id":"3f493790-d97c-4dc3-90f4-5fa73d3e1d97","year":2021},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.656794Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:c72d83872ec21cfd3d3be9c8aec11f54229c9cfbec7d49d365087d2e7b42f8ee","observation_id":"18eddb26-b027-4f34-98b0-5f9d075bc770","resolution":{"observed_at":"2026-08-06T19:06:30.786595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.778374Z","title":null,"venue":null,"work_id":"05a4bbc1-d0a7-46c3-b669-1b1c626d36e9","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.658714Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:f11a5f5d512e79e796df82d6744a61d6cf007f2708bdb5529a89cd4cfe847c23","observation_id":"a2142139-3ce5-48fe-88ab-cbfd429137fd","resolution":{"observed_at":"2026-08-06T19:06:30.780448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T19:06:30.660532Z","title":"Zhang, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.660532Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:0a48e7f376911bd82b01603cc5cbd2d56721e45b1674668c623650757ff683c0","observation_id":"948353d1-6474-487a-b5de-b74294e8260b","resolution":{"observed_at":"2026-08-06T19:06:30.660532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.772560Z","title":null,"venue":null,"work_id":"cc0db442-64af-4bc7-b798-bb2387ceb97a","year":2018},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.662860Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:59200a7dc21942fdf683c863a64283fd68e5f711482c3b5d1ca978b701f8792c","observation_id":"19d18244-06c6-42ed-afe3-5437ec0b58f4","resolution":{"observed_at":"2026-08-06T19:06:30.774466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.766680Z","title":null,"venue":null,"work_id":"8f292724-0428-4476-99bc-e013d6fcbafd","year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.664724Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:fac720dad9dea1ce5d2b809146dc62b114d261c9626214016922216d718e4dc2","observation_id":"90c76da4-0567-4ec1-b912-550c70ecef75","resolution":{"observed_at":"2026-08-06T19:06:30.768689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15657","last_updated":"2024-10-21T05:51:51Z","snapshot_observed_at":"2026-08-16T13:07:33.184079Z","submitted_at":"2024-10-21T05:51:51Z","title":"CL-HOI: Cross-Level Human-Object Interaction Distillation from Vision Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.15657","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15657","snapshot_observed_at":"2026-08-06T19:06:30.707983Z","title":"CL-HOI: Cross-Level Human-Object Interaction Distillation from Vision Large Language Models","venue":"cs.CV","work_id":"69f79538-fe07-4b99-9ef1-6e29455591d2","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.666682Z"},"links":{"cited_paper":"/paper/2410.15657","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:7c0158b6c92dbeadc30c445c3b5d5e121b4e9950aaac491cb66b0cd2ab88ce85","observation_id":"a5d16240-30d0-468a-afd4-72470474a9a4","resolution":{"observed_at":"2026-08-06T19:06:30.712217Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.760195Z","title":null,"venue":null,"work_id":"9d3f5bde-1b6a-42cb-a088-3b8cd13a6ddf","year":2014},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.669016Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d0c92ab0e2eefcb9298b60138ce3d9dedb9869dac355e99cfce734528d01d4d7","observation_id":"06d7c4d4-f7e0-4685-84e5-7910ac52ca30","resolution":{"observed_at":"2026-08-06T19:06:30.762352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T19:06:30.670859Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.670859Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9d7531fe23b182456a1068ba1bcc595faabcaba8405d81a1a3e9f01e801ff023","observation_id":"5c19eb7e-18d2-4d05-9e55-df881a629782","resolution":{"observed_at":"2026-08-06T19:06:30.670859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.753910Z","title":"Vaswani, N","venue":null,"work_id":"2dfe651e-1a56-4791-9a2f-f10c3c0fe664","year":2017},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.673067Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:d097dbab8817661f27516a5215f27ce0064562a97c0fafb37cd22a2ad0a15e3f","observation_id":"8ebf5ebe-0b95-46e5-be55-1925d0c25e1a","resolution":{"observed_at":"2026-08-06T19:06:30.755829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.747699Z","title":null,"venue":null,"work_id":"bcdf4725-cf3f-4347-bbf8-08a2dce97137","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.674872Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:4c2442b4d8de480a3588c1672f5b7f5a02ad6d9570d381ae7496a5199feba959","observation_id":"c59552ad-cd67-464c-bd5b-a7fd14a6058e","resolution":{"observed_at":"2026-08-06T19:06:30.749834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.741400Z","title":null,"venue":null,"work_id":"b87814f2-1eb1-4381-854f-ef9e7703d5ef","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.677026Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:9bb6af47c96e37e2da9f9e8ff783d9ffe74b9fddb6d9106bc07a821b93b3c426","observation_id":"b6b579a6-389a-4d22-86fc-6cdb9093c394","resolution":{"observed_at":"2026-08-06T19:06:30.743566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.735197Z","title":null,"venue":null,"work_id":"835903ca-f533-458f-b025-0cbcf5ab8ab0","year":2024},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.679056Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:a5ef2335d0cbf8bc60234c231f3140c1233a7ca805d0980ed45065b3d7489470","observation_id":"bb21e392-49fa-43b2-a76a-18c7be3253e8","resolution":{"observed_at":"2026-08-06T19:06:30.737267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:30.728761Z","title":"EF Only” and “EF+LSG","venue":null,"work_id":"30c31b2f-845b-44ed-8b15-fda994f53548","year":2022},"citing_paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:30.680985Z"},"links":{"citing_paper":"/paper/2507.06510"},"observation_digest":"sha256:42a1f1e08075e5f24398502872ce0132a43acea08829e533562b5f79455242c2","observation_id":"6a0cca0a-f73b-471a-8488-b8594f25ca9b","resolution":{"observed_at":"2026-08-06T19:06:30.730867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06510","last_updated":"2025-07-09T03:16:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T14:35:22.405564Z","submitted_at":"2025-07-09T03:16:39Z","title":"Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection"},"reference_resolution":{"displayed":85,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":85},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 85 of 85 outbound references and 0 inbound Pith citation observations for arXiv:2507.06510."}