{"as_of":"2026-08-15T05:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a76c7675a2b1872130b79763ae644dab86f84ee66d68e3533e73857f5cd89428","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:22:33.842715Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.01595/citation-record","integrity":"/paper/2412.01595/integrity","json":"/paper/2412.01595/citation-record.json","paper":"/paper/2412.01595"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.513593Z","title":"Lang, Sourabh V ora, Venice E","venue":null,"work_id":"6c3eafdb-05e9-407c-a5b3-9b91daf463a4","year":null},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.637869Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:c826152a7c0f81461c776e01695dd75bc38f3d1bdfb92a2cb176196b8a81764d","observation_id":"cdc9e3be-2d1a-4e44-89b2-05585f9779e4","resolution":{"observed_at":"2026-08-12T04:22:34.518155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.497446Z","title":null,"venue":null,"work_id":"f24d2691-9f89-401b-be2f-033c161bd89e","year":2018},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.642743Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:161258fea8288394531c043f0cc4340c25af8f8c15467a02b0fe7006252297a8","observation_id":"333367f6-3946-49bd-b6af-3ab04b60e2e1","resolution":{"observed_at":"2026-08-12T04:22:34.502188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.481842Z","title":"Residual Graph Convolu- tional Network for Bird’s-Eye-View Semantic Segmentation","venue":null,"work_id":"db4694a2-bc56-47e8-8730-cfeccba4694b","year":2024},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.647992Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:07a5fcf480dd0b761246484bc3744e86a6f912a514ff599fc8fc2627242ee5f2","observation_id":"b7625db6-9f3f-4cbb-816f-aa339b0be3e8","resolution":{"observed_at":"2026-08-12T04:22:34.487472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04584","last_updated":"2022-06-09T16:05:08Z","snapshot_observed_at":"2026-08-14T17:55:14.665846Z","submitted_at":"2022-06-09T16:05:08Z","title":"Efficient and Robust 2D-to-BEV Representation Learning via Geometry-guided Kernel Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04584","snapshot_observed_at":"2026-08-12T04:22:33.653948Z","title":"Efficient and robust 2d-to-bev representation learning via geometry-guided ker- nel transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.653948Z"},"links":{"cited_paper":"/paper/2206.04584","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:5f51b4fb3d51a014af61b8d0e546da9fb0da9bf7215a8447ba7d7ee42263f752","observation_id":"d1a11595-0afa-4dd7-ae2f-5b72a736bb25","resolution":{"observed_at":"2026-08-12T04:22:33.653948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.466639Z","title":"MMDetection3D: Open- MMLab next-generation platform for general 3D object detection","venue":null,"work_id":"02dfa375-4447-482c-a26a-80fd4e1ccc40","year":2020},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.659311Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:a464740c44b90365df8ae620d45a71f36d50d4578552627fb53363624204e5a2","observation_id":"8b6fcf4a-81b2-4a6d-a846-09cbd6945b40","resolution":{"observed_at":"2026-08-12T04:22:34.471564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.451803Z","title":"Exploring recurrent long-term temporal fusion for multi-view 3d perception","venue":null,"work_id":"4d059ed8-fe26-4a63-9bf8-1c5e902b785a","year":2024},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.664514Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:542204eebab581608ff43778436dca0e2cab307a910c60b5682a0a04606d5f32","observation_id":"9095ddb1-eb34-43f9-a8c4-eab5637673c6","resolution":{"observed_at":"2026-08-12T04:22:34.456507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.437386Z","title":"Simple-bev: What really mat- ters for multi-sensor bev perception? In Proc","venue":null,"work_id":"7f77b3d3-a3fb-4fe0-b497-d47a8969a9b5","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.669023Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:6ddb3b29eb535eedcbb6c63def25571e76f8c2925c665fef1680a870c8745d93","observation_id":"e84b8d89-dfc8-42a3-988d-615ce663459a","resolution":{"observed_at":"2026-08-12T04:22:34.441985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.422690Z","title":"Multiple View Ge- ometry in Computer Vision","venue":null,"work_id":"b96903a1-e609-44a5-ba36-079da12decb6","year":2004},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.674073Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:af315fd89efc9b395edf23b2eacafce36cd20b90de36f4da7b93a55517e6f621","observation_id":"bfa12310-deb0-4e35-98d5-00da3de7820f","resolution":{"observed_at":"2026-08-12T04:22:34.427526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.408566Z","title":"Epipolar transformers","venue":null,"work_id":"97262417-456b-4735-8302-4d61112bed9f","year":2020},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.679589Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:16ffb3790a1c95a8b5c8f3c054a642921b929d494defda3f6896c6f9d47b6d7f","observation_id":"eb137b1e-0569-41ca-847c-9a60536277f3","resolution":{"observed_at":"2026-08-12T04:22:34.412891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.393842Z","title":"Fiery: Future instance prediction in bird’s- eye view from surround monocular cameras","venue":null,"work_id":"146743fb-3adc-4993-9e91-2fe732f4207b","year":2021},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.683946Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:738ec3b445715e6664169381df333a82fdc0fd21e416c35e39d24fbf792ddc03","observation_id":"8b165f57-0a69-4fbf-b841-7cabff368185","resolution":{"observed_at":"2026-08-12T04:22:34.398812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-12T04:22:33.689116Z","title":"Bevdet: High-performance multi-camera 3d object de- tection in bird-eye-view","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.689116Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:6e2ef57fed7c6ebca61e931733499e221dea55835e70bd4c915fe9e0b54f3ddd","observation_id":"5adb3a35-6a19-4034-994b-83b754307f6a","resolution":{"observed_at":"2026-08-12T04:22:33.689116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.379235Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"c868723b-9a7e-4f27-89b0-bb0dc8a64a35","year":2015},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.694218Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:eb95784e6aa4559f285e3ee758a0df554c06760bcbd52eb806294ddc7110363c","observation_id":"2c02132e-5e25-494f-94e2-ac866e3727a6","resolution":{"observed_at":"2026-08-12T04:22:34.383807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.364292Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object de- tection","venue":null,"work_id":"c0e212b3-52e8-486a-9be8-d50db2633fed","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.699804Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:92bdfe98e746df35e190e5025c5aa0abc0aa81f602935152eb23f959e17ea3d1","observation_id":"a0d04bcc-5656-46fb-b281-0dd9ea327ce2","resolution":{"observed_at":"2026-08-12T04:22:34.369330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.349867Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"496d2047-71e8-46a7-a05f-c6a86f8daa28","year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.704684Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:7106604df201198df546d98ef2257d46abe8685ad15849707c033394668ddecd","observation_id":"d9760819-88c9-40b0-994b-2b6fa0c9c144","resolution":{"observed_at":"2026-08-12T04:22:34.354769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.334605Z","title":"Localization is all you evaluate: Data leakage in online mapping datasets and how to fix it","venue":null,"work_id":"fe9e03ae-8e6d-4082-a660-957291f9203b","year":2024},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.709195Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:9ad82d71dba4bbcdd6c3491c6cd8a8a810623024ec078b44081b1a0805c6b9d6","observation_id":"bd97e380-0935-4990-a277-4249d5db1b03","resolution":{"observed_at":"2026-08-12T04:22:34.339966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.319566Z","title":"Focal Loss for Dense Object Detection","venue":null,"work_id":"d23e07a4-cacb-4e1b-a48f-65eab1a439e7","year":null},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.713620Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:29a07537ddae09c151c9dcd205594eb9b2a206cc4a37f5fdccc194f0f6486693","observation_id":"04b4c713-9d9c-46b5-9370-6b464fe73b08","resolution":{"observed_at":"2026-08-12T04:22:34.325095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.304874Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"f77121b7-5149-4bcb-81b0-8cceba5ebfa2","year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.718546Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:c44aa4f6b9ca4db61569d1d4b831a2c071d3d44dfcb849586aac790d67c44059","observation_id":"1ec9d63f-82ec-4d7a-80a4-3cc4bbc086c3","resolution":{"observed_at":"2026-08-12T04:22:34.309754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.290258Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images","venue":null,"work_id":"0840d127-2309-40ad-9cdd-cfc36b7cbbe7","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.722966Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:cb09ae354d4373198687c714c790595481c8b012d656f31d2d51bea3c4c4b630","observation_id":"e26657fa-323d-4b13-9e50-535e61c8f391","resolution":{"observed_at":"2026-08-12T04:22:34.295089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.276267Z","title":"Bevfusion: Multi- task multi-sensor fusion with unified bird’s-eye view repre- sentation","venue":null,"work_id":"04f3e437-8193-45a1-9dea-f659c6ca6b01","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.728154Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:4b26196d3ddcd280457416ff1fd0e031db5923059f169c0e83801ba9a4316128","observation_id":"75b94e9b-4401-4af2-826e-36bc2e8bd73f","resolution":{"observed_at":"2026-08-12T04:22:34.281056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.262146Z","title":"Transfusion: Cross-view fusion with transformer for 3d human pose estimation","venue":null,"work_id":"4ec2519f-b290-4c06-be42-3bc0439e1da4","year":2021},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.732654Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:1fc34dda3616cee01ebf22846a5b60ee14ecb7050dd300c2571fba9511434937","observation_id":"504b0e6f-1ec1-483e-9300-8ddcc738e57b","resolution":{"observed_at":"2026-08-12T04:22:34.266894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.247768Z","title":"BAEFormer: Bi-Directional and Early Interaction Transformers for Bird’s Eye View Seman- tic Segmentation","venue":null,"work_id":"25a66b99-cb99-42c6-9749-46b3ee8e9350","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.737410Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:ee9befec69e9f99452a98ce0c9e059c1874503b9a2b8b68c378c20c3e628ba65","observation_id":"15447b90-a407-43ac-b39a-d60052e747ed","resolution":{"observed_at":"2026-08-12T04:22:34.252286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.231996Z","title":"BEVSegFormer: Bird’s Eye View Semantic Segmentation From Arbitrary Camera Rigs","venue":null,"work_id":"0d57d819-cfa3-4936-bf65-8e3658a468d1","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.742276Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:7223f7da5b82e28767f329db022e387c982a94b59776a3cb8a0baf6cdc05bd23","observation_id":"817d9bdc-3648-41ca-b29d-cfe499bb2e25","resolution":{"observed_at":"2026-08-12T04:22:34.237503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.217457Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unproject- ing to 3d","venue":null,"work_id":"80fd08b9-8e92-4487-8e78-4f212077d773","year":2020},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.747707Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:05c4564e9a2b729328a028b4bdf7aefed642a8051158c2a5aa8140b493fb44f6","observation_id":"4f742fe4-5026-4342-9c65-a4b022606791","resolution":{"observed_at":"2026-08-12T04:22:34.222297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.202577Z","title":"UniFusion: Unified Multi-View Fusion Transformer for Spatial-Temporal Representation in Bird’s-Eye-View","venue":null,"work_id":"95eda379-9209-45ee-9837-d647ef04587f","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.752994Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:59a34afb2221514133e1867f5e38f4a6947b3330a669be535f930b8083e1bf5e","observation_id":"691b7cbf-9cb1-4aa2-98ac-21bc7958964d","resolution":{"observed_at":"2026-08-12T04:22:34.207330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.08188","last_updated":"2018-11-20T11:31:53Z","snapshot_observed_at":"2026-08-14T17:56:16.689293Z","submitted_at":"2018-11-20T11:31:53Z","title":"Orthographic Feature Transform for Monocular 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.08188","snapshot_observed_at":"2026-08-12T04:22:33.757788Z","title":"Ortho- graphic feature transform for monocular 3d object detection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.757788Z"},"links":{"cited_paper":"/paper/1811.08188","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:2b160e6ed959e52ac762e519763a9745b28c23393f033d5e59583d1af8ab2bbe","observation_id":"38ca7a17-97f4-48a7-8a9f-5c602ca1cad6","resolution":{"observed_at":"2026-08-12T04:22:33.757788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.188390Z","title":"Translating images into maps","venue":null,"work_id":"a5b7f543-bc8e-4c11-84ec-8d8f4e4e07cf","year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.762815Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:908a642de162e4644c605487ff97141f111bccd43ca36cef5dd2f6f1cd366f38","observation_id":"8cf9547a-2e5f-46a5-9478-f44419f429d7","resolution":{"observed_at":"2026-08-12T04:22:34.192903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05319","last_updated":"2024-11-25T18:59:25Z","snapshot_observed_at":"2026-08-13T05:29:13.065831Z","submitted_at":"2023-11-09T12:36:10Z","title":"TLCFuse: Temporal Multi-Modality Fusion Towards Occlusion-Aware Semantic Segmentation-Aided Motion Planning","version":2},"cited_work":{"arxiv_id":"2311.05319","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.05319","snapshot_observed_at":"2026-08-12T04:22:33.953859Z","title":"TLCFuse: Temporal Multi-Modality Fusion Towards Occlusion-Aware Semantic Segmentation-Aided Motion Planning","venue":"cs.RO","work_id":"9c70c4a3-428c-44de-bfeb-33ac4c6b5711","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.767205Z"},"links":{"cited_paper":"/paper/2311.05319","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:00e995ec64c903269f9f1400bf341dc36bbcd28550baf0ea7373fd9185b001b5","observation_id":"202f0643-7f4f-402a-bb4b-f75d31708323","resolution":{"observed_at":"2026-08-12T04:22:33.959477Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.174389Z","title":"Super-convergence: Very fast training of neural networks using large learning rates","venue":null,"work_id":"ac89e0fd-d1ef-4d4b-9d5b-008363549718","year":2019},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.771881Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:a383da42ecf29a9b71d3fbd7e79a16865401c670691721187115b8ea67af3ed9","observation_id":"206269b7-4db8-45b1-afd0-df0513ddf57d","resolution":{"observed_at":"2026-08-12T04:22:34.179106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.159351Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":"da39bd87-34cf-4751-913e-8b261f8ba93f","year":2019},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.776442Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:d422846af5d448c07c9e9560a207b045137012a7589f1c74b0297830e99bbaa2","observation_id":"175fb418-f431-4bcd-9449-dade3755426b","resolution":{"observed_at":"2026-08-12T04:22:34.164206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.144021Z","title":"Gomez, Lukasz Kaiser, and Il- lia Polosukhin","venue":null,"work_id":"b6b27293-1a38-4f81-8d7b-bcb7db754a9b","year":null},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.781471Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:4768a2d5e40a2d30010863c103c17c7b805663fbba03173ee3eed6d41c1dfacd","observation_id":"33d58d19-0707-462a-98eb-695f6554ef86","resolution":{"observed_at":"2026-08-12T04:22:34.148982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.128779Z","title":"UniTR: A Unified and Efficient Multi-Modal Transformer for Bird’s-Eye-View Representation","venue":null,"work_id":"4500d723-7f92-401b-a60a-32e17109d0d1","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.785969Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:56f64ddc5966492e16de64f977fc52386b2d5f63af9c75f725b4cf6a54e4301d","observation_id":"1cd0e0df-4318-4c71-a1e7-03739b3a3303","resolution":{"observed_at":"2026-08-12T04:22:34.133572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.112357Z","title":"Argoverse 2: Next Generation Datasets for Self-driving Perception and Forecasting","venue":null,"work_id":"4133d7ad-cc97-46b5-abf2-090ad5c2115a","year":2021},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.791335Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:28de87b547aa2acaaf6fcd4db7c48e5d3cf1375503aae21fedc9d1350baa7b1a","observation_id":"c732b49a-aed9-482c-a33a-438ee4c81276","resolution":{"observed_at":"2026-08-12T04:22:34.118145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05088","last_updated":"2022-04-19T05:40:19Z","snapshot_observed_at":"2026-08-13T20:32:07.447002Z","submitted_at":"2022-04-11T13:43:25Z","title":"M$^2$BEV: Multi-Camera Joint 3D Detection and Segmentation with Unified Birds-Eye View Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05088","snapshot_observed_at":"2026-08-12T04:22:33.796356Z","title":"M2BEV: Multi-Camera Joint 3D Detection and Segmenta- tion with Unified Birds-Eye View Representation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.796356Z"},"links":{"cited_paper":"/paper/2204.05088","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:1bc20cabace5e1c407bb814c3afb0450f046e74e732e26e0c846f6911bc8faef","observation_id":"0ec12c6f-3f8f-4a7c-8ac7-63167a597ef0","resolution":{"observed_at":"2026-08-12T04:22:33.796356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02202","last_updated":"2022-09-25T07:19:32Z","snapshot_observed_at":"2026-08-15T02:19:33.141646Z","submitted_at":"2022-07-05T17:59:28Z","title":"CoBEVT: Cooperative Bird's Eye View Semantic Segmentation with Sparse Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02202","snapshot_observed_at":"2026-08-12T04:22:33.801435Z","title":"CoBEVT: Cooperative bird’s eye view semantic segmentation with sparse transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.801435Z"},"links":{"cited_paper":"/paper/2207.02202","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:78cfdf3b858739595d764afda121c94d7504dc22965159ed9e52c9a4a92f1c80","observation_id":"17cef558-b495-49d8-a306-ed02a91f1fbe","resolution":{"observed_at":"2026-08-12T04:22:33.801435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.096520Z","title":"(cross modal trans- former: Towards fast and robust 3d object detection)","venue":null,"work_id":"9374def5-d9a0-4dbe-b63e-d95a80d0d946","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.806654Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:97bde9061c0310c5eca82dddafa7683c4c691546807f1dcd570d326bbbb5a033","observation_id":"c793fc78-18bb-4319-84d8-039de826776b","resolution":{"observed_at":"2026-08-12T04:22:34.101663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.079218Z","title":"BEVFormer v2: Adapting Modern Image Backbones to Bird’s-Eye-View Recognition via Perspective Supervision","venue":null,"work_id":"e0752411-6b05-4add-b0de-36d5a520fbc9","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.811200Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:38759046de5edd6893a25e345dedf1f9ef67af242350a1bec85fc2dad5442a1b","observation_id":"e1f51c97-67ab-4963-b18f-8da29357067a","resolution":{"observed_at":"2026-08-12T04:22:34.084195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.063727Z","title":"Parametric Depth Based Feature Representation Learning for Object Detection and Segmentation in Bird’s-Eye View","venue":null,"work_id":"6ab844a2-d6ad-447e-8aa1-d563747c5065","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.815628Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:b68cdbce6ce28387fa49298772f0447d529b0d0a10cf7cfeffb28fe7d739fc1c","observation_id":"e7714f91-c5e0-45df-a723-7dfe96a321b8","resolution":{"observed_at":"2026-08-12T04:22:34.068596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.048333Z","title":"Streammapnet: Streaming mapping network for vectorized online hd map construction","venue":null,"work_id":"436d75ec-b9e7-47dc-bcac-7ed45b77e44d","year":null},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.820389Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:2624c59a483c45eced6bbb0d3dfde6f02415cfa228454da6236bccabaa617b12","observation_id":"eaaf41a6-6705-4f16-a77e-6008bcd4fd7d","resolution":{"observed_at":"2026-08-12T04:22:34.053344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09743","last_updated":"2022-05-19T17:55:35Z","snapshot_observed_at":"2026-08-14T17:54:58.375340Z","submitted_at":"2022-05-19T17:55:35Z","title":"BEVerse: Unified Perception and Prediction in Birds-Eye-View for Vision-Centric Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09743","snapshot_observed_at":"2026-08-12T04:22:33.826920Z","title":"Beverse: Unified per- ception and prediction in birds-eye-view for vision-centric autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.826920Z"},"links":{"cited_paper":"/paper/2205.09743","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:9191ce976c066d6ba18886dd15a80dd45ffa902247e579dfc5012b1e6087b9f8","observation_id":"813b7e29-4d2c-4ff0-a39e-507825add350","resolution":{"observed_at":"2026-08-12T04:22:33.826920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.031819Z","title":"Cross-view trans- formers for real-time map-view semantic segmentation","venue":null,"work_id":"3ca3052d-27cd-4de6-af63-b43c0d10fe45","year":2022},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.833290Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:05f109e7cd1475e0c3de7dc6e3e1eecefe7f29e47b08589e13477b92dc9bb56b","observation_id":"57f01232-4655-428b-8083-b0d5e1073793","resolution":{"observed_at":"2026-08-12T04:22:34.038188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:22:34.016325Z","title":"Matrixvt: Efficient multi-camera to bev transformation for 3d perception","venue":null,"work_id":"ce0a7654-32d2-435a-9a21-79f9c5c24407","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.838355Z"},"links":{"citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:9bce38d42dc4818bc24fb1de191d7e8d0d4d3b9cbe8801c9b93cb4033a1fbd80","observation_id":"3d3a8e5f-6a27-45a4-8ac1-e8b54c54030a","resolution":{"observed_at":"2026-08-12T04:22:34.021851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10421","last_updated":"2024-08-23T04:51:18Z","snapshot_observed_at":"2026-08-13T10:30:46.707296Z","submitted_at":"2023-08-21T02:13:40Z","title":"UniM$^2$AE: Multi-modal Masked Autoencoders with Unified 3D Representation for 3D Perception in Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2308.10421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.10421","snapshot_observed_at":"2026-08-12T04:22:33.880257Z","title":"UniM$^2$AE: Multi-modal Masked Autoencoders with Unified 3D Representation for 3D Perception in Autonomous Driving","venue":"cs.CV","work_id":"d2e60f2c-f903-4e76-a542-f27bef2d2ef3","year":2023},"citing_paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:33.842715Z"},"links":{"cited_paper":"/paper/2308.10421","citing_paper":"/paper/2412.01595"},"observation_digest":"sha256:b886347d1cd092c38427afb73d4c04358a647efdcdb08e6a5148077b5b41225c","observation_id":"791afc6c-ab45-43bc-9281-61f64a0f9617","resolution":{"observed_at":"2026-08-12T04:22:33.887451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.01595","last_updated":"2024-12-02T15:15:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T23:13:44.688082Z","submitted_at":"2024-12-02T15:15:10Z","title":"Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":33},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.01595."}