{"as_of":"2026-08-11T13:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:425e465b781ed9146fa30400c96cf103cb5c6925c327dd6358e2ec38c1e79071","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:54:12.249927Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":5,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-05-16T02:56:41.658658Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2306.13549"},"observation_digest":"sha256:27daeaec77e785d243d22095eed95097b75cebd6445a7f1b77231bbbbce853d4","observation_id":"58b9a34b-0eaf-450d-acd2-6515ad04d066","resolution":{"observed_at":"2026-05-16T02:56:41.954357Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-17T03:03:26.723464Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2311.07575"},"observation_digest":"sha256:0a2167d63556afd83d5d10b45a2ab2aebc913f8f2b20264adbf9079502ca2dab","observation_id":"b303b711-1fca-418d-8524-c287e939785d","resolution":{"observed_at":"2026-05-17T03:03:26.779545Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2403.14624","last_updated":"2024-08-18T08:10:16Z","snapshot_observed_at":"2026-08-04T04:40:00.850270Z","submitted_at":"2024-03-21T17:59:50Z","title":"MathVerse: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-17T01:29:30.032408Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2403.14624"},"observation_digest":"sha256:da00faa570868133a013b4a900342fa6f3412dd893d9d28c693a3cf32faf8d0d","observation_id":"19f05398-b6b3-49d5-b118-89ea80e7978f","resolution":{"observed_at":"2026-05-17T01:29:30.146288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T06:01:53.730356Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2407.07895"},"observation_digest":"sha256:511196454a8d36d696e710169e7007197fe71e45aa1b4ab48aa1e7e5490dcff3","observation_id":"84121b69-b692-4d17-b069-7a39544b3a85","resolution":{"observed_at":"2026-05-11T06:01:54.002228Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-11T11:54:12.249927Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14837","last_updated":"2024-12-19T13:27:58Z","snapshot_observed_at":"2026-08-11T11:50:01.103117Z","submitted_at":"2024-12-19T13:27:58Z","title":"ObjVariantEnsemble: Advancing Point Cloud LLM Evaluation in Challenging Scenes with Subtly Distinguished Objects","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T11:54:12.249927Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2412.14837"},"observation_digest":"sha256:aea73d02dcb441ee75a52971e407b8483166dd0229dbdf77959c00a56dbe81fc","observation_id":"c56ffbaf-ca7a-48d0-99c4-ddd88aa970cc","resolution":{"observed_at":"2026-08-11T11:54:12.249927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-10T22:38:21.594099Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01163","last_updated":"2025-04-24T06:33:35Z","snapshot_observed_at":"2026-08-10T23:07:26.597440Z","submitted_at":"2025-01-02T09:33:13Z","title":"3D-LLaVA: Towards Generalist 3D LMMs with Omni Superpoint Transformer","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T22:38:21.594099Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2501.01163"},"observation_digest":"sha256:e105d904168d2496d61e98bf08def4f050fd5c2f48cc5a687fdd6a549a650c5e","observation_id":"e00940a1-fa89-420c-abb2-07f3d0ab5619","resolution":{"observed_at":"2026-08-10T22:38:21.594099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-10T21:48:27.526667Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-11T11:48:14.668173Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.526667Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:d20669d9a307367b2321c2b05f8d442211835123a499a95e091f6b2f276786ff","observation_id":"0e08e82a-1f50-4ed4-9adc-c01f18a53f3b","resolution":{"observed_at":"2026-08-10T21:48:27.526667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-10T20:39:12.665081Z","title":"Pointllm: Empowering large language models to understand point clouds,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07819","last_updated":"2025-01-14T03:50:23Z","snapshot_observed_at":"2026-08-10T23:07:26.347586Z","submitted_at":"2025-01-14T03:50:23Z","title":"3UR-LLM: An End-to-End Multimodal Large Language Model for 3D Scene Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:39:12.665081Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2501.07819"},"observation_digest":"sha256:0f3d3ca3daaa6553e5b8a6782974f0fcae5366b6f700cf04741301d87eed23cf","observation_id":"eb0cf1c9-3fa3-4b9b-9c30-52b079489d09","resolution":{"observed_at":"2026-08-10T20:39:12.665081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-08T04:54:02.124890Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08503","last_updated":"2025-06-06T01:51:44Z","snapshot_observed_at":"2026-08-10T01:48:02.036551Z","submitted_at":"2025-02-12T15:34:45Z","title":"Revisiting 3D LLM Benchmarks: Are We Really Testing 3D Capabilities?","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T04:54:02.124890Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2502.08503"},"observation_digest":"sha256:e91a23069aa928a324ce9d2711422fe56d43fefee79e23bb6eaa2b544ed25090","observation_id":"a1f4ca3b-ebdc-441c-a061-efbf5d027bd3","resolution":{"observed_at":"2026-08-08T04:54:02.124890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-07T11:03:01.866129Z","title":"Pointllm: Empowering large language models to understand point clouds.arXiv preprint arXiv:2308.16911, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03605","last_updated":"2025-06-04T06:28:16Z","snapshot_observed_at":"2026-08-08T19:12:57.330137Z","submitted_at":"2025-06-04T06:28:16Z","title":"Generating 6DoF Object Manipulation Trajectories from Action Description in Egocentric Vision","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:01.866129Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2506.03605"},"observation_digest":"sha256:a81aa01c047934aa2ac670e1d4c21a8c175b3ecf2ed85cb77211fecc8b455321","observation_id":"31f97f64-9b56-4d71-aa35-d99cc0f5a528","resolution":{"observed_at":"2026-08-07T11:03:01.866129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-07T10:28:53.592815Z","title":"Pointllm: Empowering large language models to understand point clouds.arXiv preprint arXiv:2308.16911, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05331","last_updated":"2025-06-05T17:59:02Z","snapshot_observed_at":"2026-08-09T02:08:19.234840Z","submitted_at":"2025-06-05T17:59:02Z","title":"MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.592815Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2506.05331"},"observation_digest":"sha256:a43e84d60146395f5d20606d0b08bab701460a152011743e448c55c4e1bbc4c7","observation_id":"344c3894-eb95-42dc-9bf5-a910bba323e6","resolution":{"observed_at":"2026-08-07T10:28:53.592815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-06T21:53:02.513697Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23120","last_updated":"2025-06-29T06:58:08Z","snapshot_observed_at":"2026-08-11T01:19:42.067209Z","submitted_at":"2025-06-29T06:58:08Z","title":"Enhancing Spatial Reasoning in Multimodal Large Language Models through Reasoning-based Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:53:02.513697Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2506.23120"},"observation_digest":"sha256:d74a04daf29eba77ccc1ab92bed742f8b6c24993ba1f58f5bfd8947e175ba291","observation_id":"8e24a87e-fa6e-47ec-80aa-350393141259","resolution":{"observed_at":"2026-08-06T21:53:02.513697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T20:44:17.158713Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09987","last_updated":"2025-08-13T17:59:28Z","snapshot_observed_at":"2026-08-09T07:45:34.680113Z","submitted_at":"2025-08-13T17:59:28Z","title":"Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T20:44:17.158713Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2508.09987"},"observation_digest":"sha256:8d984301f786e2bb78dc2fbfa5c8734d3a20a22f9b262d0350afb7e042dddb1b","observation_id":"6a496748-550e-4b94-9a5a-8e115ba8c9a7","resolution":{"observed_at":"2026-08-05T20:44:17.158713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2601.21798","last_updated":"2026-05-15T11:47:00Z","snapshot_observed_at":"2026-08-02T04:56:07.337606Z","submitted_at":"2026-01-29T14:42:46Z","title":"CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-21T14:48:21.787919Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2601.21798"},"observation_digest":"sha256:9f88ae0f5796b915d70e639d67b695e9a46299874da4a77e3ac23b0082b3ba48","observation_id":"44692333-e098-417a-a654-422bfac6020c","resolution":{"observed_at":"2026-05-21T14:50:14.728483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2603.27507","last_updated":"2026-04-26T20:14:44Z","snapshot_observed_at":"2026-08-10T23:52:35.908557Z","submitted_at":"2026-03-29T04:16:04Z","title":"Chat-Scene++: Exploiting Context-Rich Object Identification for 3D LLM","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-14T21:31:00.764078Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2603.27507"},"observation_digest":"sha256:d861eae18bb0d6885659405e7c5f50ed96194517b8126166dddf922dab702f88","observation_id":"fb7f232f-1d86-428d-a350-aee2585f70f7","resolution":{"observed_at":"2026-05-14T21:32:59.393660Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2605.00663","last_updated":"2026-05-08T08:29:03Z","snapshot_observed_at":"2026-08-02T07:41:35.517099Z","submitted_at":"2026-05-01T13:45:16Z","title":"Affordance Agent Harness: Verification-Gated Skill Orchestration","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-09T18:40:53.380512Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2605.00663"},"observation_digest":"sha256:1f53ed5a2f190021e44d3cdd61b9bab159167d611b2a2ef5ac7ad3ee0bf248b5","observation_id":"84ec85aa-a649-40e1-9ef7-8dde3a05a5b0","resolution":{"observed_at":"2026-05-11T16:06:34.630394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2605.00663","last_updated":"2026-05-08T08:29:03Z","snapshot_observed_at":"2026-08-02T07:41:35.517099Z","submitted_at":"2026-05-01T13:45:16Z","title":"Affordance Agent Harness: Verification-Gated Skill Orchestration","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-11T01:55:07.248106Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2605.00663"},"observation_digest":"sha256:4228ae2c050de8cc100eb0b8f5b31abbc5d41b841bf8f28c9f47bc281e180baf","observation_id":"7f8de01e-6136-4854-b565-d4b5e9b64ae4","resolution":{"observed_at":"2026-05-11T04:10:55.785639Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2606.03460","last_updated":"2026-06-02T10:37:38Z","snapshot_observed_at":"2026-07-31T21:02:59.160230Z","submitted_at":"2026-06-02T10:37:38Z","title":"From 3D Perception to Safety Reasoning: A Graph-Based Framework for Real-Time Underground Mine Monitoring","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T10:44:00.642366Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2606.03460"},"observation_digest":"sha256:4a5dbb6fbd244c2ff462478aa56b5c6f4d564d224a72fea8e7025d67ffd9a5a3","observation_id":"468c9436-4a99-4780-a720-9b29f161dc2b","resolution":{"observed_at":"2026-07-02T02:46:27.779918Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2606.04381","last_updated":"2026-06-03T02:54:59Z","snapshot_observed_at":"2026-07-06T23:44:28.265478Z","submitted_at":"2026-06-03T02:54:59Z","title":"From Symbolic to Geometric: Enabling Spatial Reasoning in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T06:58:39.117228Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2606.04381"},"observation_digest":"sha256:767aa9a1335b69273d14d5ca093e5861012d4d33d678cf7f088a3ea7d52ea2a6","observation_id":"c5a4d80e-b56e-4371-8523-ef12c672fff3","resolution":{"observed_at":"2026-07-02T07:26:45.808225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":"2308.16911","doi":"10.48550/arxiv.2308.16911","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024.doi:10.48550/arXiv.2308.16911","venue":"arXiv (Cornell University)","work_id":"ce992739-1a55-4f67-9b72-a7847c57a23a","year":2024},"citing_paper":{"arxiv_id":"2606.17888","last_updated":"2026-06-16T13:09:32Z","snapshot_observed_at":"2026-08-08T01:57:17.698279Z","submitted_at":"2026-06-16T13:09:32Z","title":"MathVis-Fine: Aligning Visual Supervision with Necessity via Progressive Dependency-Guided Training for Multimodal Mathematical Reasoning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-27T01:23:40.564561Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2606.17888"},"observation_digest":"sha256:adca51a67f789b929c0d20f4526dac1872834e27bb127818776f67fba6168982","observation_id":"c563d40b-a124-4e43-a2e1-12f1e116d70e","resolution":{"observed_at":"2026-07-03T20:18:57.806629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-02T06:23:49.818915Z","title":"2308.16911 , archiveprefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12752","last_updated":"2026-07-15T04:28:35Z","snapshot_observed_at":"2026-08-07T19:36:05.834855Z","submitted_at":"2026-07-14T13:19:06Z","title":"Hallo4D: Multi-Modal Hallucination Mitigation for Consistent Spatio-Temporal Generation","version":2},"reference_index":227,"source":"arxiv_source","source_observed_at":"2026-08-02T06:23:49.818915Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2607.12752"},"observation_digest":"sha256:86cae2cea1927b1d3b71551298ea38b715025f93ea892f0d623a62398e95da6d","observation_id":"ef0f21d6-cfd6-4951-8373-88c9de408106","resolution":{"observed_at":"2026-08-02T06:23:49.818915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-01T13:28:41.335244Z","title":"Pointllm: Empowering large language models to understand point clouds, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-10T19:39:26.237037Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.335244Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:289abdfcd8f0b47ea81ff91b6d70ad0ff1ea8bc9edcc21b324b8b57ebe93eb8c","observation_id":"8d5cbfb9-d64d-4d45-8f92-dad97c174035","resolution":{"observed_at":"2026-08-01T13:28:41.335244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2308.16911/citation-record","integrity":"/paper/2308.16911/integrity","json":"/paper/2308.16911/citation-record.json","paper":"/paper/2308.16911"},"outbound":[],"paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T23:07:10.208283Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2308.16911."}