{"as_of":"2026-08-23T20:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a10a3c64f6f01f845c74adb6f601f22d9128a47dcc9e73ba7bb2e1f78406d3fb","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T06:02:37.419517Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19256/citation-record","integrity":"/paper/2504.19256/integrity","json":"/paper/2504.19256/citation-record.json","paper":"/paper/2504.19256"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.995433Z","title":"Lightweight object detection algorithm for robots with improved yolov5,","venue":null,"work_id":"d45708ee-91a2-421c-93b6-2f636404af9e","year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.210554Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:a5ba01fb4365da331faaab6a843eab4fd507a50171d1b6f47a24fb021c9f968f","observation_id":"6746c509-bbeb-4b27-8062-7d8c148b5565","resolution":{"observed_at":"2026-08-16T06:02:38.001279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.978556Z","title":"V oxnet: A 3d convolutional neural net- work for real-time object recognition,","venue":null,"work_id":"6d8645ca-582d-401b-8ff3-7519571504c9","year":2015},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.218522Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:42c74e1d757db52a461a18349bef46696b131361f3fe8b9d4d2c87ca26792afe","observation_id":"417e31b7-6504-4d63-ae0a-2318f2f3d72d","resolution":{"observed_at":"2026-08-16T06:02:37.984039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.962256Z","title":"Fuzzy lightweight cnn for point cloud object clas- sification based on voxel,","venue":null,"work_id":"43e2d8e8-e6c9-49b0-8f8e-2fb9fe2bee90","year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.225553Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:702a95c4e1bbeb5f6840171f28711ebec631ec03ee6730520f8af0406361266c","observation_id":"08befce2-b574-4f68-9d21-1178eb2a6438","resolution":{"observed_at":"2026-08-16T06:02:37.966846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.944721Z","title":"Similarity measurement and retrieval of three-dimensional voxel model based on symbolic operator,","venue":null,"work_id":"01256aec-dc8c-4794-aca4-00b5fed87b3c","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.232634Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:41e29a01f1bac14cb05650f859fdfaaab7e3cf71b26a7730e06e649f0130ef1d","observation_id":"054970a2-fec0-43b6-afe2-865a37c32db7","resolution":{"observed_at":"2026-08-16T06:02:37.950253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.236913Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.236913Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:e51c8e36ba789851a0cdc2b1a3593e7a1a2816a650ee589728ef3b5e5abb4dda","observation_id":"e5e8c158-886e-402d-ad66-a59beb0691f8","resolution":{"observed_at":"2026-08-16T06:02:37.236913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15463","last_updated":"2024-06-16T15:07:23Z","snapshot_observed_at":"2026-08-18T04:02:09.999476Z","submitted_at":"2024-05-24T11:36:26Z","title":"PoinTramba: A Hybrid Transformer-Mamba Framework for Point Cloud Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15463","snapshot_observed_at":"2026-08-16T06:02:37.240837Z","title":"Pointramba: A hybrid transformer-mamba framework for point cloud analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.240837Z"},"links":{"cited_paper":"/paper/2405.15463","citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:9947a9287433d65eef44440cc41aa523b24e1f4b292609f1b6cc2452c1033883","observation_id":"445bd4fe-8084-4de5-b4a7-40093416b774","resolution":{"observed_at":"2026-08-16T06:02:37.240837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.248472Z","title":"Masked autoencoders for point cloud self-supervised learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.248472Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:22083505f6d4fa81520067a3e324ccbdc806eb4555a70d4356e038bec8c456e3","observation_id":"1f021e2e-cefb-4985-b1c7-d30bd62f4580","resolution":{"observed_at":"2026-08-16T06:02:37.248472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00762","last_updated":"2024-10-11T07:27:00Z","snapshot_observed_at":"2026-08-18T03:10:03.497714Z","submitted_at":"2024-03-01T18:59:03Z","title":"Point Cloud Mamba: Point Cloud Learning via State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00762","snapshot_observed_at":"2026-08-16T06:02:37.252561Z","title":"Point could mamba: Point cloud learning via state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.252561Z"},"links":{"cited_paper":"/paper/2403.00762","citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:302a5abaff8cdedf23e6a553fddaebffae4a61e4d0444dd246d312177aab6bef","observation_id":"1b62a641-1c6c-488b-92b5-157f5a119420","resolution":{"observed_at":"2026-08-16T06:02:37.252561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.911725Z","title":"Multi-view saliency guided deep neural network for 3-d object retrieval and classification,","venue":null,"work_id":"fdb56674-558b-434e-8f28-7d946a658361","year":2019},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.256912Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:cf13fbbdd6aeb2ef535b729540766f3a44c6d769f8fe71de1615144d4304e8cf","observation_id":"6a284161-e4ea-4780-a0a1-7ba7f04d7a34","resolution":{"observed_at":"2026-08-16T06:02:37.918077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.894041Z","title":"Review of multi-view 3d object recognition methods based on deep learning,","venue":null,"work_id":"1eefa926-547a-4d40-8eaa-a5391345de59","year":2021},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.262841Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:5cd0bc13e5fe5f02e88107261020334819e0c87df2505e301b5a9d252304b5a2","observation_id":"6e6bb3fb-98ab-4765-9ee9-c0f2bae50245","resolution":{"observed_at":"2026-08-16T06:02:37.900787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.879812Z","title":"Simultaneous multi-view object recognition and grasping in open-ended domains,","venue":null,"work_id":"489bd26d-d218-4aee-9459-972ae5cb584f","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.269015Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:defd3ea1f99432e1655a7a8bb65f59e99cc8a23cc5230b6297156927ec605c2b","observation_id":"e1b85963-03c1-404e-9b55-8ec0d613af03","resolution":{"observed_at":"2026-08-16T06:02:37.883503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.869912Z","title":"Selective multi- view deep model for 3d object classification,","venue":null,"work_id":"30f50df0-206f-4f99-a7be-1724c13e0d4b","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.275584Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:93c940499cda4793af6d08bef369f9b15cbd6fc27910ab12fe547a9c6fa919fc","observation_id":"0a4d6de0-2d5e-48d7-9767-bcee576d91ea","resolution":{"observed_at":"2026-08-16T06:02:37.872874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.855327Z","title":"Ovpt: Optimal viewset pooling transformer for 3d object recognition,","venue":null,"work_id":"1484d107-babc-4728-9554-7f8bc2380d94","year":2022},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.281035Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:1d94a545010b3c5b983eeb2509087152e3f58a07e493ba2af4f85da1169cc0b7","observation_id":"60bca35e-c43f-4532-a418-f66f2866aca6","resolution":{"observed_at":"2026-08-16T06:02:37.861742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.838727Z","title":"MVT: multi-view vision transformer for 3d object recognition,","venue":null,"work_id":"b79d8c99-0eb6-47a3-91a9-11ba65e19bd9","year":2021},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.290730Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:8774adbafcf46aa0377c3eb1c0b07c70b5ff40b4bd08ef516b504a651a2a75bc","observation_id":"16c976e4-e2ff-4945-ae12-462e28223386","resolution":{"observed_at":"2026-08-16T06:02:37.842892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.818505Z","title":"Early or late fusion matters: Efficient rgb- d fusion in vision transformers for 3d object recognition,","venue":null,"work_id":"145acaba-ab64-4d91-abe0-acc3a800df07","year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.300808Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:cc0fd6ddc5b73920ccb134d2f52f9bc388a3ea344d6acca53cab973e7e580709","observation_id":"777ad4c9-b49f-4009-9f30-b48055b3736e","resolution":{"observed_at":"2026-08-16T06:02:37.827510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.801281Z","title":"Multi-view attention-convolution pooling network for 3d point cloud classification,","venue":null,"work_id":"0895f4d0-1179-4bb0-86af-b42458e0398d","year":2022},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.307346Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:f297bab8856076184377124f750253561e394230cce57f27f853898d93b81730","observation_id":"6869a8f4-3452-46c1-b5a5-7a5141ba1bc4","resolution":{"observed_at":"2026-08-16T06:02:37.807425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.786595Z","title":"Learning to select views for efficient multi-view understanding,","venue":null,"work_id":"8c505d3f-10bd-4b10-aeeb-fab1f5ced83c","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.313806Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:40f0f29c6a81db57e3ec2bbf75726b5e77d63891e435003b8a3d2bf2a64c8972","observation_id":"fb5cf8df-6687-4cd2-bee1-43ff0d3f5acd","resolution":{"observed_at":"2026-08-16T06:02:37.791438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.772764Z","title":"Do vision transformers see like convolutional neural networks?","venue":null,"work_id":"83769310-6592-4807-ac87-3d99d5cb14c8","year":2021},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.319603Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:56480e064dc2ab46a5d62b7bb8317e50d9ef89ae2d31ca53e4634d9a6d2e0118","observation_id":"ed4f4cc4-a6f2-49f8-b022-953dc5099cf9","resolution":{"observed_at":"2026-08-16T06:02:37.777151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.760327Z","title":"Antipodal robotic grasping using generative residual convolutional neural network,","venue":null,"work_id":"c74a35b2-b2cc-4fca-b3b8-fb15b0b8d1a3","year":2020},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.324917Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:062830d1d7e126dc08d27273e04446f34f22bc7abac36a9e55d81892dc6d75b1","observation_id":"3b3b0d0a-708b-4bed-bbed-697ce307a64b","resolution":{"observed_at":"2026-08-16T06:02:37.764550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.747662Z","title":"Mvsalnet: Multi-view augmentation for rgb-d salient object detection,","venue":null,"work_id":"4c95d4d7-8f53-4c28-868e-85cb8d79ce6a","year":2022},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.329977Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:ca0c1bc088c3e9b8615c8500f66f19ab34b6e2399069a571f68e30a662bff5c0","observation_id":"a12ef3c0-aa6f-425a-aa2a-361d988442c5","resolution":{"observed_at":"2026-08-16T06:02:37.752611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01592","last_updated":"2019-06-04T17:09:23Z","snapshot_observed_at":"2026-08-19T09:44:31.956659Z","submitted_at":"2019-06-04T17:09:23Z","title":"Dominant Set Clustering and Pooling for Multi-View 3D Object Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01592","snapshot_observed_at":"2026-08-16T06:02:37.334804Z","title":"Dominant set clustering and pooling for multi-view 3d object recognition,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.334804Z"},"links":{"cited_paper":"/paper/1906.01592","citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:7edb9d1bfca04318afa73da1b2dcb5b3b271debb4d10a639d573c7952f64c0a4","observation_id":"037124ad-449e-4698-b110-0159bbb33e4c","resolution":{"observed_at":"2026-08-16T06:02:37.334804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.341018Z","title":"3d shapenets: A deep representation for volumetric shapes,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.341018Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:996f1e0c40fb406888fb48829b4a42ce68a7504073f2fa635327028360314289","observation_id":"d94fe06a-9b6f-46cc-a76d-e2bdb11ccbd2","resolution":{"observed_at":"2026-08-16T06:02:37.341018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.346210Z","title":"Omniobject3d: Large-vocabulary 3d object dataset for realistic perception, reconstruction and generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.346210Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:59e8cfa5d94f4b7e0ea57e78058b4f6cba877442bf0ca479deb46bc88790ad53","observation_id":"aca9cbc6-0af5-49ac-aab4-dec1a2f0e234","resolution":{"observed_at":"2026-08-16T06:02:37.346210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-16T06:02:37.351243Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.351243Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:0a81399adacfdf9459458930af087e3acc86d0055bd1edb4498a6da9befa0baa","observation_id":"591d03e6-b9d9-4774-a079-1bd69d129f44","resolution":{"observed_at":"2026-08-16T06:02:37.351243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10091","last_updated":"2018-03-27T14:06:16Z","snapshot_observed_at":"2026-08-16T19:02:53.267757Z","submitted_at":"2018-03-27T14:06:16Z","title":"Point Convolutional Neural Networks by Extension Operators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10091","snapshot_observed_at":"2026-08-16T06:02:37.356743Z","title":"Point convolutional neural networks by extension operators,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.356743Z"},"links":{"cited_paper":"/paper/1803.10091","citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:8375a6e94edb15fdf2bb4f07c05ce04d68f1429b9dd52a63222788c2675643ae","observation_id":"4c505e66-7214-4366-bbb7-f04704cf362a","resolution":{"observed_at":"2026-08-16T06:02:37.356743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.706955Z","title":"A voxelized point clouds representation for object classification and segmentation on 3d data,","venue":null,"work_id":"8e64279c-9c5b-4477-b435-35426ab332a7","year":2022},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.362241Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:6a24f308ceda4fc57bc25d32c735265457a8bfeadfa2acd3ee2a0114bda45d64","observation_id":"a7451ed1-e997-437f-b1a1-24b6abf31899","resolution":{"observed_at":"2026-08-16T06:02:37.716110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.367398Z","title":"Multi- view convolutional neural networks for 3d shape recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.367398Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:f458feabf098207a928cc5dec3f1e4011053c993425b3f1d9ce7b22c773244ae","observation_id":"a8b4fd42-f1a5-45fb-a3bf-2e23e0a09d13","resolution":{"observed_at":"2026-08-16T06:02:37.367398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.681411Z","title":"Mvtn: Learn- ing multi-view transformations for 3d understanding,","venue":null,"work_id":"5a32a7ea-86be-4b53-9f2d-e17f5cac59e2","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.372114Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:3e06e500a49ad942152e91f7aee2160b96fc733748bacf0d9ba3f84cf75a6fcf","observation_id":"a8351b1b-5bd7-4bb3-b76d-fa47ea6b4040","resolution":{"observed_at":"2026-08-16T06:02:37.686232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.669179Z","title":"Tensor multi-task learning for multi- view representation of 3d shape,","venue":null,"work_id":"11a86431-1340-43a6-8ce1-9ee33e39cf7b","year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.382278Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:1c3665fe5946d1920e228fb86fa2aee9108cfd1ca4d145646f4ef5c88487b982","observation_id":"ea85ebf8-6bfe-447d-84f4-f3890e076dfc","resolution":{"observed_at":"2026-08-16T06:02:37.673331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.654876Z","title":"A viewpoint- guided prototype network for 3d shape classification,","venue":null,"work_id":"be018e7a-65b5-4370-9bfb-849429d29c81","year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.387154Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:1dfb53984025a26d44f1688162f1cb2bfd8a7d3cb5f2c696307107ac94659c84","observation_id":"40fea9e7-e1b6-43ea-847c-4c995579b16f","resolution":{"observed_at":"2026-08-16T06:02:37.660060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.639474Z","title":"Lifelong ensemble learning based on multiple representations for few-shot object recognition,","venue":null,"work_id":"311e52dd-c8ec-4d68-8468-d89f91d4ccc8","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.391903Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:bbd8a74f784c7e75bf07be472f28e3707b930d9e9ea53e4a77a0193f233c544e","observation_id":"07ff0614-64cf-4286-a2bc-d318462b099b","resolution":{"observed_at":"2026-08-16T06:02:37.643657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.621214Z","title":"Towards lifelong assistive robotics: A tight coupling between object perception and manipulation,","venue":null,"work_id":"f0fdfe8b-9a9f-421b-8eb9-be84f84465a2","year":2018},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.401753Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:f84be9586b2e93cf070fbc72bf96ff86c2fbe924ecfc32da6fbc80f97de51451","observation_id":"989be2e2-34b8-4980-8ba0-b9a1ae8d18d6","resolution":{"observed_at":"2026-08-16T06:02:37.625794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.604288Z","title":"Orthographicnet: A deep transfer learning approach for 3-d object recognition in open-ended domains,","venue":null,"work_id":"0fc3d57d-d8ee-4a7f-93af-18a2d4c25367","year":2020},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.409846Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:3b13fc1e915d8326cf1eed4dcf5250c3b6cd3999f58ed0fe6eef5953871d01c0","observation_id":"ee4097dc-11ae-4ff3-a56e-54abe66f0d05","resolution":{"observed_at":"2026-08-16T06:02:37.610686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.587086Z","title":"Mvgrasp: Real-time multi-view 3d object grasping in highly cluttered environments,","venue":null,"work_id":"35a8c206-a3a4-4f51-b1a6-ccc8501d5642","year":2023},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.415123Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:183b75118ad2c0762d4619848a1dbf10ef68346f459dfc5ddb75ec3f31e784f7","observation_id":"c3a66f88-d921-4e86-a80a-5ea397df1b0a","resolution":{"observed_at":"2026-08-16T06:02:37.592582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:02:37.567641Z","title":"Towards open-world grasping with large vision-language models,","venue":null,"work_id":"e76ec71d-bef9-4795-84a3-ff7a918c680c","year":2024},"citing_paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T06:02:37.419517Z"},"links":{"citing_paper":"/paper/2504.19256"},"observation_digest":"sha256:52c7f822bf23c6b01b0e1cc19592d77db0bdbd6d2891b988e64dcf1191883b2b","observation_id":"2d40c6b1-43c5-4d68-bf16-9cde88b4dcc1","resolution":{"observed_at":"2026-08-16T06:02:37.574999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.19256","last_updated":"2025-08-13T13:41:47Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T01:39:14.910785Z","submitted_at":"2025-04-27T14:30:16Z","title":"LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2504.19256."}