{"as_of":"2026-08-22T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff8d24a0152d2c05ee42a847d4973faa8137829c5ebd32bcde373fb6922907c6","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:48:27.991615Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.03879/citation-record","integrity":"/paper/2501.03879/integrity","json":"/paper/2501.03879/citation-record.json","paper":"/paper/2501.03879"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.299681Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.299681Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:914d3b81bb5799f48a356063d28598468a5ff2ca354796aaa91cc0a3a1daef66","observation_id":"7caabb3d-d4e1-4f68-861b-bf58ef6f5024","resolution":{"observed_at":"2026-08-10T21:48:26.299681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.326484Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.326484Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:22c797cdb06e4f70d2561003084569d25d74f38a36f29f98c8f3ea47561cfbf9","observation_id":"28ebce41-c479-4ab8-b236-b7c05d2523e2","resolution":{"observed_at":"2026-08-10T21:48:26.326484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.937980Z","title":"Cont: Contrastive neural text generation","venue":null,"work_id":"c5d5d712-eb35-4fff-a4ad-b670684b635d","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.412782Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:f3895f605b01444134001e87c461aa80e14d01f8a3ff754f40e9f1a0e6b4c488","observation_id":"c5dda510-aa6e-4ff7-a2c5-8b5fb5be5e39","resolution":{"observed_at":"2026-08-10T21:48:30.022910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.488123Z","title":"Scanqa: 3d question answering for spatial scene understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.488123Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e26db532dcd6cafb3e3953dce02567e66b1aac4457463109b100873c3c3b9ef1","observation_id":"4544a78f-ec8a-402b-be71-47c7dc93a570","resolution":{"observed_at":"2026-08-10T21:48:26.488123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T21:48:26.493104Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.493104Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:6c24e5344d41bcb449c7c2b332796238a2a31fd49e184347142f8fd891003222","observation_id":"39643184-a576-4313-878a-6e3b146a9551","resolution":{"observed_at":"2026-08-10T21:48:26.493104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.497897Z","title":"and Lavie, A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.497897Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:dcf18b4de8a2107753d71b26bc834b5cb028f14a2670f544702ecb4a803fdbc3","observation_id":"b3ec04d4-1ab7-4e72-9ce2-914c5a704194","resolution":{"observed_at":"2026-08-10T21:48:26.497897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.900637Z","title":"Grit-vlp: Grouped mini-batch sampling for efficient vision and language pre-training","venue":null,"work_id":"a38718a3-de7f-4448-a7cf-8ceda7f07955","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.502062Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:cf86cff154156ff1ca793052a82495e55f32e032c5b34707029433662c16cfc3","observation_id":"f4e59d8f-8d44-4172-a68a-2e01e8c3d7ad","resolution":{"observed_at":"2026-08-10T21:48:29.905724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.885707Z","title":"3djcg: A unified framework for joint dense captioning and visual grounding on 3d point clouds","venue":null,"work_id":"15cb89b3-1587-4ea8-8e57-c2ba1ebb4009","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.507494Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:7f386e7fabbbfdb63669dd0fd3b3ad08adfc5585d2b44f32bffd352318a58aa1","observation_id":"061659df-143b-4e1a-a067-f22cde328c0c","resolution":{"observed_at":"2026-08-10T21:48:29.890286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.511972Z","title":"Honeybee: Locality-enhanced projector for multimodal llm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.511972Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:6c90cb0aacd7327ac9f1030f22e5dd729499e05ffe8f69eee93b9bcbc997f308","observation_id":"58c0e82d-72e7-4b58-b13f-3e571313d597","resolution":{"observed_at":"2026-08-10T21:48:26.511972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-15T22:26:43.274625Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-10T21:48:26.516664Z","title":"X., Funkhouser, T., Guibas, L., Hanrahan, P., Huang, Q., Li, Z., Savarese, S., Savva, M., Song, S., Su, H., et al","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.516664Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:df2eb5a9b8776c9e08b7a2cf1f9e6457da306f5efaf53d24ed68910bce66780e","observation_id":"02c7370e-0322-4994-8a03-7d385b3e04a6","resolution":{"observed_at":"2026-08-10T21:48:26.516664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12501","last_updated":"2024-02-19T20:08:48Z","snapshot_observed_at":"2026-08-16T14:17:11.528452Z","submitted_at":"2024-02-19T20:08:48Z","title":"Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection","version":1},"cited_work":{"arxiv_id":"2402.12501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12501","snapshot_observed_at":"2026-08-10T21:48:28.426535Z","title":"Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection","venue":"cs.CL","work_id":"e2bd35f1-cb45-4291-a3e6-3b5ac4a4405d","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.521483Z"},"links":{"cited_paper":"/paper/2402.12501","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:91e6f132fec262c097747b880ca8be8c81c2ce5e93c61ea52129d219e0648f67","observation_id":"7df4fa98-be40-457d-ad55-7d4b71e5b948","resolution":{"observed_at":"2026-08-10T21:48:28.523336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.813710Z","title":"Language conditioned spatial relation reasoning for 3d object grounding","venue":null,"work_id":"7b884bfa-1177-4e7e-af29-53268f02cd10","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.526612Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:9ef468a5287858bf9831269635c07e4cea6b5c1959bde41469cabadec32c4f61","observation_id":"5aea0609-a8fe-4bbe-8601-51c7b4d4024a","resolution":{"observed_at":"2026-08-10T21:48:29.864146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.564674Z","title":"End-to-end 3d dense captioning with vote2cap-detr","venue":null,"work_id":"35e9d989-5f4c-46e2-9abb-bdeb8dfc56d3","year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.531253Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:7379ad62e7cc070c539bece8144249ca8f6e3cd71d2d147a880efc04c6084936","observation_id":"b6a28f74-a71e-4415-b5bf-2c2b18e0eaa1","resolution":{"observed_at":"2026-08-10T21:48:29.720330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.549379Z","title":"Ll3da: Visual interactive instruction tuning for omni-3d understanding reasoning and planning","venue":null,"work_id":"77ece7e2-2612-4982-af38-61d1959ac5c2","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.535032Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c9f2715749a508014998bdb2ef6dd7ae91ec4edfce6246f12f26cef311ea3cd2","observation_id":"1fd03218-e748-4830-b514-92384b7218c4","resolution":{"observed_at":"2026-08-10T21:48:29.554510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.533624Z","title":null,"venue":null,"work_id":"46a8dca0-57be-46d2-92fc-9911d7f00d64","year":2021},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.539263Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:7a2cc6a6b00f2821b452e69653faf3bfdd6f86a76d91e804f6b91764cd0dfb2d","observation_id":"145c03e3-412e-4a79-8156-34b84d87e749","resolution":{"observed_at":"2026-08-10T21:48:29.538747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.560131Z","title":"X., Savva, M., Halber, M., Funkhouser, T., and Nie ner, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.560131Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:64e98e14def47c60d45a64673d1b6fe446bbc9e220bdbf3944b2c45e30bafe59","observation_id":"f4da19a2-90a8-40c3-a8c2-25888ab2d987","resolution":{"observed_at":"2026-08-10T21:48:26.560131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.645925Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.645925Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:a91d1d3fe05fe1c2ceaf0497d81703481cbf351feae10698075e8a41e5a661f8","observation_id":"c17274ca-4ed9-412d-a532-054b95dfbd63","resolution":{"observed_at":"2026-08-10T21:48:26.645925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T21:48:26.739675Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.739675Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:73b844e171fabc40ead64bd1fa9b5ca3ccbd56f73b13f12bcf5403be6327faf0","observation_id":"ad0e20be-64a3-4286-a225-c710568559c1","resolution":{"observed_at":"2026-08-10T21:48:26.739675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11401","last_updated":"2024-03-22T18:52:51Z","snapshot_observed_at":"2026-08-19T20:46:34.203025Z","submitted_at":"2024-03-18T01:18:48Z","title":"Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11401","snapshot_observed_at":"2026-08-10T21:48:26.868837Z","title":"Scene-llm: Extending language model for 3d visual understanding and reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.868837Z"},"links":{"cited_paper":"/paper/2403.11401","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:6b05ab8825a4693fa00ba90e2dfa3482435a4982e8500efd1867452794e03324","observation_id":"9d84bc00-778c-479e-9640-4fe393d8eaad","resolution":{"observed_at":"2026-08-10T21:48:26.868837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.983771Z","title":"Detecting and preventing hallucinations in large vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.983771Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:110da12c7ea304e88acfa59d9e8738c75f6c2ff57bdb93a6bef36044797e43d8","observation_id":"f8df9538-ca08-4f60-9c78-fe46812253a5","resolution":{"observed_at":"2026-08-10T21:48:26.983771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-08-18T11:08:09.822131Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-10T21:48:26.988637Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.988637Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:dc6d4574a192345fce3c12284c3af9d04ee97ffc355cd6ed5411bbcbe264ad44","observation_id":"ea930fc1-ced0-4f12-be11-471d0703ff7e","resolution":{"observed_at":"2026-08-10T21:48:26.988637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-10T21:48:26.993391Z","title":"and Gimpel, K","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.993391Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e45647fc1be70b58e93e81a23d570f816642aa524a91497086a20dab54b23f81","observation_id":"e859bf68-a441-466b-bb1a-8bb872b246af","resolution":{"observed_at":"2026-08-10T21:48:26.993391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-08-16T14:56:35.674907Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-10T21:48:26.999401Z","title":"Reference-free monolithic preference optimization with odds ratio","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.999401Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:88259c7de86052b905b7256257bebc3765e73752166213e2a6564ae2d04f5c0a","observation_id":"0b64bf11-b2d3-44e6-86ce-e42c6d310600","resolution":{"observed_at":"2026-08-10T21:48:26.999401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.004600Z","title":"3d-llm: Injecting the 3d world into large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.004600Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:73e617ce63500419f5ebaa4a649f5c03332d05281a6f254f565155239de4a331","observation_id":"7376d52c-1cb0-44c5-9887-e4ce9f99f5a9","resolution":{"observed_at":"2026-08-10T21:48:27.004600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08168","last_updated":"2024-09-28T03:56:28Z","snapshot_observed_at":"2026-08-19T04:55:44.810836Z","submitted_at":"2023-12-13T14:27:45Z","title":"Chat-Scene: Bridging 3D Scene and Large Language Models with Object Identifiers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08168","snapshot_observed_at":"2026-08-10T21:48:27.009762Z","title":"Chat-3d v2: Bridging 3d scene and large language models with object identifiers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.009762Z"},"links":{"cited_paper":"/paper/2312.08168","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:fb3eaa1070fe0b9ff6303580301646e5039d850e593343a8c0cd29f9cc916964","observation_id":"907e174d-fdc8-404d-b5db-bf8aa789b7cb","resolution":{"observed_at":"2026-08-10T21:48:27.009762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.477284Z","title":"An embodied generalist agent in 3d world","venue":null,"work_id":"0ee933a9-1ba1-4885-bcbf-9cff6665e75f","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.016074Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e43b8d8a9622f92b09f205a329c9c09890e73fde4ce93051cc4feef4dbe35853","observation_id":"2e352672-3fe9-440d-a04c-1a09de14c71c","resolution":{"observed_at":"2026-08-10T21:48:29.482609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01185","last_updated":"2023-05-02T22:46:46Z","snapshot_observed_at":"2026-08-16T16:27:12.995446Z","submitted_at":"2022-10-03T18:56:35Z","title":"ContraCLM: Contrastive Learning For Causal Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01185","snapshot_observed_at":"2026-08-10T21:48:27.021444Z","title":"U., Wang, Z., Nan, F., Li, X., Tan, M., Nallapati, R., Ray, B., Bhatia, P., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.021444Z"},"links":{"cited_paper":"/paper/2210.01185","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:96d3cee8b8e636fac3e9139c2d1e2582a98ae56a92a1a391e5cdf9e3f1990350","observation_id":"3223d6d8-4d8b-42ed-9e74-c8927c15f0bf","resolution":{"observed_at":"2026-08-10T21:48:27.021444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.409060Z","title":"Bootstrapping vision-language learning with decoupled language pre-training","venue":null,"work_id":"3a0cfebe-0e8a-4f59-8500-f10491a8a58d","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.027081Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3e0eb8f5c9b0159645a70fadfa7f657f0a4c28e249353cf35f15327603005f75","observation_id":"5dbdaa2f-3a25-43b1-bba3-fee4c827c489","resolution":{"observed_at":"2026-08-10T21:48:29.466528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-10T21:48:27.031550Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.031550Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:0fe132f01c0422d18b559aab5b7d75653b5415ca60c9c925f8de3333ca6a4295","observation_id":"1c5137e5-da9c-4bdd-a37b-3bb79772401c","resolution":{"observed_at":"2026-08-10T21:48:27.031550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.241890Z","title":"L., Bansal, M., and Liu, J","venue":null,"work_id":"6d92a34e-3963-4422-93de-9443ca147eac","year":2021},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.036655Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:fa56eecd165a2b672c38513eca8e9e3044d2c3096ca914118084ef815637d17f","observation_id":"a140425f-c0ec-4903-bb9c-f2ebc5b204b0","resolution":{"observed_at":"2026-08-10T21:48:29.328687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.041603Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.041603Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:85f18d696800564fe724aa0ce5deccdd484f4b554b28799d7a6ab2a659bfa54d","observation_id":"dd2380ff-9970-4e35-b715-792e8b8a58dc","resolution":{"observed_at":"2026-08-10T21:48:27.041603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.046499Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.046499Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:cbbe0aba22b0f1e143485757ca0794bbd89d60b54298b5821ff1e604eafc3623","observation_id":"8973470f-ca4b-4455-970a-b1deae07e9e5","resolution":{"observed_at":"2026-08-10T21:48:27.046499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.051330Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.051330Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:244ad41baf0321c67010614bdc1161b3cb9c03965239e700e665d34fab688cd6","observation_id":"e123e7a5-7e1b-4075-b8fc-c3f094ac7ab0","resolution":{"observed_at":"2026-08-10T21:48:27.051330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.055940Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.055940Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:773e75d2baa2db8758484cab1817c3d2281d86c9d5e194610cb07751fd5597ee","observation_id":"c36d4596-e9ec-49f7-8339-257f67e36e31","resolution":{"observed_at":"2026-08-10T21:48:27.055940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.102283Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.102283Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:f38a2c038f401182292fe2e0447034ed1e363fcf0657b6b5435f57c17304e250","observation_id":"3c8d95ce-90f6-4eef-a3e4-a1655c2120a7","resolution":{"observed_at":"2026-08-10T21:48:27.102283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16804","last_updated":"2022-03-31T05:19:38Z","snapshot_observed_at":"2026-08-16T17:10:22.844058Z","submitted_at":"2022-03-31T05:19:38Z","title":"BRIO: Bringing Order to Abstractive Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16804","snapshot_observed_at":"2026-08-10T21:48:27.273833Z","title":"Brio: Bringing order to abstractive summarization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.273833Z"},"links":{"cited_paper":"/paper/2203.16804","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3a3e094230043c4d431d6a5d8c34a4881921c00e5bd5f247909f7df097b7faf1","observation_id":"2bf68995-3482-4df4-9bd3-4d0af9823717","resolution":{"observed_at":"2026-08-10T21:48:27.273833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.176706Z","title":"Scalable 3d captioning with pretrained models","venue":null,"work_id":"604ce98d-37bc-45df-b236-0226d9bfbfe3","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.361679Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:7c86a42197278e9f773935d184bf63d367f4d64890879006c0532588e460bbb1","observation_id":"89810cc6-6a75-4756-8b18-e1e3dfc206eb","resolution":{"observed_at":"2026-08-10T21:48:29.182024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07474","last_updated":"2023-04-12T20:05:41Z","snapshot_observed_at":"2026-08-16T22:30:06.161719Z","submitted_at":"2022-10-14T02:52:26Z","title":"SQA3D: Situated Question Answering in 3D Scenes","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07474","snapshot_observed_at":"2026-08-10T21:48:27.366951Z","title":"Sqa3d: Situated question answering in 3d scenes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.366951Z"},"links":{"cited_paper":"/paper/2210.07474","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c24c5d3782011de56d2b91738b8a84a24aa9967f42fbef62b94cf6d337e2a052","observation_id":"f7ae0f13-03a1-47e9-829e-8ac4747cb558","resolution":{"observed_at":"2026-08-10T21:48:27.366951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.371627Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.371627Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3ed4bf8119a478f3d6f6cc011043409bb60766bb7d017bf8e9b1338a5785e28e","observation_id":"35b73b15-5ec6-4e12-8b32-ba45471de13d","resolution":{"observed_at":"2026-08-10T21:48:27.371627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.376225Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.376225Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:f6610d631fd7622f7d5498d004dcb76350ac06f5e6f0d30419ca04907ac58635","observation_id":"928d637c-e913-4640-8b28-6d859f480fc4","resolution":{"observed_at":"2026-08-10T21:48:27.376225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.141013Z","title":"Advances and perspectives in collaborative robotics: a review of key technologies and emerging trends","venue":null,"work_id":"7fac11be-1a98-4cdd-9edd-c7f87a83c6d7","year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.382201Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3e3a71f11249ab6e94e609abb09db9333f0d35b5e01e494c2841b2bad24c9d4b","observation_id":"3427e288-41f0-49fb-9630-8abe245c45c3","resolution":{"observed_at":"2026-08-10T21:48:29.146144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.012828Z","title":"Gpt4point: A unified framework for point-language understanding and generation","venue":null,"work_id":"57cca9b4-80d4-468f-a7f4-95edb8c9948a","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.386676Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:8fdf9a08d14ae54559aee6338794fb9c85b91347a1be0f92f100538a4746ed07","observation_id":"e670e6fb-7f3d-439a-93d0-ad706ff61bbb","resolution":{"observed_at":"2026-08-10T21:48:29.130662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-10T21:48:27.390781Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.390781Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:b90c96a74c5bd105a1c98d2e6b7b6703e35fa4e6d8872d8729295e44efb6bcd5","observation_id":"49129600-0c70-4aa3-9c67-81cba00d6ca3","resolution":{"observed_at":"2026-08-10T21:48:27.390781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-10T21:48:27.396273Z","title":"and Gurevych, I","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.396273Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:d988411f38713816b66c6a4c790e5847c1ba6a7fab0ef8b6f79335f164b502f1","observation_id":"db0175b4-dbc8-485c-9f06-88a481c24751","resolution":{"observed_at":"2026-08-10T21:48:27.396273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04592","last_updated":"2021-01-24T22:19:30Z","snapshot_observed_at":"2026-08-18T17:53:57.208912Z","submitted_at":"2020-10-09T14:18:53Z","title":"Contrastive Learning with Hard Negative Samples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04592","snapshot_observed_at":"2026-08-10T21:48:27.401731Z","title":"Contrastive learning with hard negative samples","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.401731Z"},"links":{"cited_paper":"/paper/2010.04592","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:332c8abc70f52f3be6e1dc70d60e3afcea9c22c6bfcceaadfa78a34ffe95b833","observation_id":"a3a3e04d-15ba-490d-9a09-9e0cbe665b3b","resolution":{"observed_at":"2026-08-10T21:48:27.401731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.773547Z","title":"Language-grounded indoor 3d semantic segmentation in the wild","venue":null,"work_id":"774e21ba-1901-4597-a969-64c21dd9777a","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.406669Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:b39c30980897e68bc19cb74e326ca57f420b1fc71305079d6c19b49c7b245e2e","observation_id":"c194bf40-4a57-43aa-84ed-fd85486b768d","resolution":{"observed_at":"2026-08-10T21:48:28.881270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18654","last_updated":"2025-02-28T00:26:42Z","snapshot_observed_at":"2026-08-16T13:48:24.061169Z","submitted_at":"2024-05-28T23:36:00Z","title":"Mitigating Object Hallucination in MLLMs via Data-augmented Phrase-level Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18654","snapshot_observed_at":"2026-08-10T21:48:27.485988Z","title":"\\\"O ., and Pfister, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.485988Z"},"links":{"cited_paper":"/paper/2405.18654","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:9cee8d8c8bb2988be7b5962ebf995247ec387e9a0e1c068d12fdfc2ed82904ac","observation_id":"9604f3b8-9588-4a8f-be45-cda265433c89","resolution":{"observed_at":"2026-08-10T21:48:27.485988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.758118Z","title":"and Koustoumpardis, P","venue":null,"work_id":"80c19f67-5b4c-4f12-9fa4-41cfd8d4cce9","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.490780Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:5381c122757ead491bc9c7443e15aa15b5a9856f554380f7bd91c5b42293eecb","observation_id":"cd0d7682-2547-4068-8473-29de6317ac55","resolution":{"observed_at":"2026-08-10T21:48:28.762830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-10T21:48:27.495110Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.495110Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:ac320036c638315beeecf84ae5336b524c80e080a91bfdede31124d8cd11fe28","observation_id":"87f6535b-a278-4a92-89d1-09822afc238d","resolution":{"observed_at":"2026-08-10T21:48:27.495110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T21:48:27.500267Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.500267Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:7a87ac1bf3b82b2fd3e07fad261f9a11b27054efc408c938c1cc90c489f350e9","observation_id":"07420348-b81c-40ef-b3e2-05140a782ec9","resolution":{"observed_at":"2026-08-10T21:48:27.500267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.505942Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.505942Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:d6548b923deb20fe2a6e513527e9542a13d20016f98f0a2661a1fffb0ed1db9b","observation_id":"58a3ea3a-ffe9-4441-879a-153a3195a736","resolution":{"observed_at":"2026-08-10T21:48:27.505942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.514505Z","title":"Cider: Consensus-based image description evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.514505Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:7431fe31aef34a7ffb8c40e979ed3e3cc15dee782cbc6330c1bd817638e261d8","observation_id":"3a5a071a-e59f-4a71-87e7-90787dbc6bae","resolution":{"observed_at":"2026-08-10T21:48:27.514505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08769","last_updated":"2023-08-17T03:52:15Z","snapshot_observed_at":"2026-08-20T07:15:08.903665Z","submitted_at":"2023-08-17T03:52:15Z","title":"Chat-3D: Data-efficiently Tuning Large Language Model for Universal Dialogue of 3D Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08769","snapshot_observed_at":"2026-08-10T21:48:27.520318Z","title":"Chat-3d: Data-efficiently tuning large language model for universal dialogue of 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.520318Z"},"links":{"cited_paper":"/paper/2308.08769","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:8f2c20fbc81912c6cd80f4a0ee3417c194088e2fc9e584201330de4325115f86","observation_id":"ffedf3cc-2089-4b54-bbf4-ba1ef83e7434","resolution":{"observed_at":"2026-08-10T21:48:27.520318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-16T15:04:12.996129Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-10T21:48:27.526667Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.526667Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:dbd380cfa1228a845ca137a25352e017d3ba55511dcfc89d55a3bb342ad411f6","observation_id":"0e08e82a-1f50-4ed4-9adc-c01f18a53f3b","resolution":{"observed_at":"2026-08-10T21:48:27.526667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11138","last_updated":"2024-06-06T06:03:34Z","snapshot_observed_at":"2026-08-16T14:17:49.323334Z","submitted_at":"2024-02-17T00:09:32Z","title":"Contrastive Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2402.11138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11138","snapshot_observed_at":"2026-08-10T21:48:28.088388Z","title":"Contrastive Instruction Tuning","venue":"cs.CL","work_id":"4bd95202-694a-4939-8182-21d853c1e41a","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.531725Z"},"links":{"cited_paper":"/paper/2402.11138","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:2ba06b27f9f1df674cec1687110b2c3205ed281699c71863bc74094279e10d60","observation_id":"6c7ee131-1dec-4813-9179-a90a076da1d4","resolution":{"observed_at":"2026-08-10T21:48:28.094689Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05132","last_updated":"2025-03-20T23:06:14Z","snapshot_observed_at":"2026-08-18T22:21:59.498243Z","submitted_at":"2024-06-07T17:59:59Z","title":"3D-GRAND: A Million-Scale Dataset for 3D-LLMs with Better Grounding and Less Hallucination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05132","snapshot_observed_at":"2026-08-10T21:48:27.536522Z","title":"F., and Chai, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.536522Z"},"links":{"cited_paper":"/paper/2406.05132","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:04d052aafcde3fd4c6fea747f465f8609118ef8f256ccc6abaf6885f6690f9ea","observation_id":"ba4c14e4-3ec0-4d57-bf35-ae7e34aae2ce","resolution":{"observed_at":"2026-08-10T21:48:27.536522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.722331Z","title":"Point-bert: Pre-training 3d point cloud transformers with masked point modeling","venue":null,"work_id":"32e0f8cd-5aee-4417-8652-65b0189e8eb6","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.541148Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:dbab651dfa67591040541c2dc8d9dd1c650a3ce36bbbdee80c440591c586ec9c","observation_id":"db07c3f3-5494-432e-ac24-3b5949de8334","resolution":{"observed_at":"2026-08-10T21:48:28.727456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08487","last_updated":"2024-06-14T00:52:35Z","snapshot_observed_at":"2026-08-16T13:43:37.776811Z","submitted_at":"2024-06-12T17:59:49Z","title":"Beyond LLaVA-HD: Diving into High-Resolution Large Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08487","snapshot_observed_at":"2026-08-10T21:48:27.570775Z","title":"Beyond llava-hd: Diving into high-resolution large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.570775Z"},"links":{"cited_paper":"/paper/2406.08487","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c75f02814b59daa3fba06f9e1f565ab9cb2ea9c5d7566ae913e464db1d085533","observation_id":"b9ef01a3-a29c-4a5e-9094-8278d42682ff","resolution":{"observed_at":"2026-08-10T21:48:27.570775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.705802Z","title":"Click: Controllable text generation with sequence likelihood contrastive learning","venue":null,"work_id":"e0ba59a1-b79c-4e92-a8ea-d50c44e6bafa","year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.680548Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:641ce4d0268f3806bad476a3b6c977afc01ca76cdc8900a1986ba6ebce5dc592","observation_id":"5a483eb4-e3cf-4bbd-a352-220337543f0c","resolution":{"observed_at":"2026-08-10T21:48:28.711424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.688916Z","title":"Lima: Less is more for alignment","venue":null,"work_id":"94de45ce-3b30-4f8c-ac96-afed87db38cf","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.761673Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:4cfe5f4ac4d7ff49ea4d43b1fe7df508679ce7dffe436670ccede0df66508724","observation_id":"dafc9267-fc16-4791-b6cb-f08ed2f099e4","resolution":{"observed_at":"2026-08-10T21:48:28.694638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.672657Z","title":"Uni3d: Exploring unified 3d representation at scale","venue":null,"work_id":"77c90979-e181-43f7-aef9-d8de5656b515","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.875113Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:612fe88d56207a6559e811c24595b8afe6fb26ee1f4137eaae6d79f3e18396a0","observation_id":"e06730dc-7927-4c02-9466-83cc0853dad0","resolution":{"observed_at":"2026-08-10T21:48:28.678174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.991615Z","title":"3d-vista: Pre-trained transformer for 3d vision and text alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.991615Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:70f2400e8476d98b6ab99eb4a8a0ad0d62a18e6844ec85bb4c3f54135af80af1","observation_id":"1e48be94-5faf-4e68-b0cf-6d361b8977aa","resolution":{"observed_at":"2026-08-10T21:48:27.991615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T00:27:44.617873Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2501.03879."}