Pith. sign in

Paper Citation Record · LEDGER

Stream-T1: Test-Time Scaling for Streaming Video Generation

As of 4 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 3 inbound Pith citation observations for arXiv:2605.04461.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2605.04461 v1

Coverage vector

measured 57 of 57 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-08T18:16:14.985693Z

measured 60 of 60 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-04T06:34:03.388597+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-01T03:30:25.729920Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-05-21T07:59:50.595450Z

Reference resolution

57 of 57 outbound references displayed

  • verified exact35
  • verified fuzzy20
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch2

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 4f7159f5-d5ca-4da8-a1fe-9bbd642afe20 · outbound

This paper cites Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs.

Stream-T1: Test-Time Scaling for Streaming Video Generation Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.447330Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:066dde731f5f39cc943200fb3a644c25ba85c5fe7f74b75ec4dcc53a55a7290e

Observation 3c6afa20-1390-48d2-8661-cd799312933a · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Stream-T1: Test-Time Scaling for Streaming Video Generation Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-10T22:58:52.491420Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:de0defcc166d9f6187e9bf4aeeb0670f51ddf0f1d1ed9a0b2919f35b520b355f

Observation 3dc4a080-ea58-4fce-b65a-3d07585834ef · outbound

This paper cites SkyReels-V2: Infinite-length Film Generative Model.

Stream-T1: Test-Time Scaling for Streaming Video Generation SkyReels-V2: Infinite-length Film Generative Model

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-14T20:23:04.486750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:be272f4d95ad9b29d3dee3eb4acc5380ee666e0a182bbd1646228c3344fb52fd

Observation ad65406b-a55c-40de-8ae7-716a00eba102 · outbound

This paper cites Autoregressive Video Generation without Vector Quantization.

Stream-T1: Test-Time Scaling for Streaming Video Generation Autoregressive Video Generation without Vector Quantization

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-17T15:07:39.939813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:4a80c08ba045d5f026ec4ac5bd6ee9da7147aabea37db83c65b366a6b904aef8

Observation 62b5c462-02c7-4d39-970d-8885c0eaeed1 · outbound

This paper cites Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing.

Stream-T1: Test-Time Scaling for Streaming Video Generation Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.381562Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d0bb3582decb12f4a8ffd543b45e122a79596edb4fe3e96dba617d956b4da9e3

Observation 3d9dc62f-0c40-47ca-8fa6-dfd6c9c18e24 · outbound

This paper cites Long-Context Autoregressive Video Modeling with Next-Frame Prediction.

Stream-T1: Test-Time Scaling for Streaming Video Generation Long-Context Autoregressive Video Modeling with Next-Frame Prediction

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-16T23:05:17.562899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:7aeaee67e7ae960ab4683d44abe43eb8ae1c71db37b691757beb6770e0acbbb9

Observation 909a02e4-251c-41e5-bcee-7595e15f8751 · outbound

This paper cites Deepseek-r1 incentivizes reasoning in llms through reinforcement learning.Nature, 645(8081): 633–638.

Stream-T1: Test-Time Scaling for Streaming Video Generation Deepseek-r1 incentivizes reasoning in llms through reinforcement learning.Nature, 645(8081): 633–638

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.821157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:9a22e770811090d8a6ce7c9a883014bfea10f5d3654195cc964fcd3ba111fff6

Observation 65c0da35-7216-4f86-8628-4d5a715e1344 · outbound

This paper cites AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning.

Stream-T1: Test-Time Scaling for Streaming Video Generation AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-10T22:52:19.777506Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:fb302f505426cb72a3995666607785a2d4e0f98fdce808222bc3d253a7a2dffa

Observation 6715b68a-f580-4a69-8dd2-338dbb1ddbc4 · outbound

This paper cites Scaling Image and Video Generation via Test-Time Evolutionary Search.

Stream-T1: Test-Time Scaling for Streaming Video Generation Scaling Image and Video Generation via Test-Time Evolutionary Search

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.266097Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:5a1216aad4a34a882d601e3059c5df299f8ff4c885be86370b22151cc3aea06d

Observation e0127b0a-35f7-4e7e-9a01-0c0503386fb4 · outbound

This paper cites Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion.

Stream-T1: Test-Time Scaling for Streaming Video Generation Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:36:53.812910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:4015463e45cecb92488eed582094e5b992b5f80e88db0090bec2472619d82cea

Observation 8f711057-a0b5-44d5-a349-bbccdb4eb557 · outbound

This paper cites Vbench: Comprehensive benchmark suite for video generative models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Vbench: Comprehensive benchmark suite for video generative models

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.870560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:8bc495e68c7cee1de92d17fc55fe70c72ad6a5ca2e2e43a50950396f76234a89

Observation 7bb3c82a-7a6f-4a27-836f-096ee7152f90 · outbound

This paper cites Vbench++: Comprehensive and versatile benchmark suite for video generative models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Vbench++: Comprehensive and versatile benchmark suite for video generative models

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.879025Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:8aa7c9a628b3e9612a446df7035966bdca9ac7ed8a89572fb2be02001364f006

Observation 3b8763fd-e4ac-4670-a9d0-0fb45e4269f8 · outbound

This paper cites OpenAI o1 System Card.

Stream-T1: Test-Time Scaling for Streaming Video Generation OpenAI o1 System Card

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-09T06:40:39.115011Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f8e632606cadf608df55c8c8cea1a0f948da85cf8abde6262e3b61b7bf7c2a39

Observation 7d99f900-7788-4e94-b41d-4aebef16200e · outbound

This paper cites Videoar: Autoregressive video generation via next-frame & scale prediction.

Stream-T1: Test-Time Scaling for Streaming Video Generation Videoar: Autoregressive video generation via next-frame & scale prediction

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.339531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:eef62c103310772ba65e9b74c659e43cd1d1e31d454264203422c21f92b641c4

Observation f6947854-683c-41f2-b89e-56e9b32ff3c8 · outbound

This paper cites Compositional image synthesis with inference-time scaling.

Stream-T1: Test-Time Scaling for Streaming Video Generation Compositional image synthesis with inference-time scaling

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.865958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d6bfbb4187bc4e3d7cc65743350ad9725be5acfb6435484a5533488281daac5d

Observation df1188a5-0226-4137-af9c-92abd584f8ca · outbound

This paper cites VideoPoet: A Large Language Model for Zero-Shot Video Generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoPoet: A Large Language Model for Zero-Shot Video Generation

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-15T17:51:05.830483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:6fb3dd647754054d5026b5735b0b142af18af283e54116503621d85ee83563ca

Observation 4fd06467-db47-4681-a9cc-fd471207dcea · outbound

This paper cites HunyuanVideo: A Systematic Framework For Large Video Generative Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation HunyuanVideo: A Systematic Framework For Large Video Generative Models

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.218180Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:a5ee175a459f32d9b814d0ecc95d0f2aa6af18376e69a967aa790852b07f72c8

Observation 74d05e05-d655-41fe-88a3-0d0485ec1a98 · outbound

This paper cites Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion.

Stream-T1: Test-Time Scaling for Streaming Video Generation Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion

Reference 18

Resolution
verified exact
local_arxiv, observed 2026-05-09T06:40:39.314786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:a09c2e6380f9780057ac38a16ead56f8e7f632711bcfde3a66b00fe4788613b2

Observation 61cae0a0-9cd7-4099-8f74-0cd8adccd9f8 · outbound

This paper cites Reflect-dit: Inference-time scaling for text-to-image diffusion transformers via in-context reflection.

Stream-T1: Test-Time Scaling for Streaming Video Generation Reflect-dit: Inference-time scaling for text-to-image diffusion transformers via in-context reflection

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.874861Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:3af63a03e577b6f5d67504b62da61f8337cb1565d594822efa6bb74bbd1b1bdf

Observation 04239bbe-1acd-41a1-9541-253eaec0a5d3 · outbound

This paper cites ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.477796Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:156010693be106c1c2dacbc4a1ac4772a11a84fcd84154029d47b00901fd8e31

Observation dc1b731f-471c-45cd-8ce4-7847e798e7fd · outbound

This paper cites Video-t1: Test-time scaling for video generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Video-t1: Test-time scaling for video generation

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.882705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:19818d7494927d6cad7e63b4d5dca364ce484b50acb054224aa19797840aa92e

Observation 66880af5-85db-4903-b231-7690dabf1a4f · outbound

This paper cites Improving Video Generation with Human Feedback.

Stream-T1: Test-Time Scaling for Streaming Video Generation Improving Video Generation with Human Feedback

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-13T15:30:03.116566Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:a90b7e4e92c8e1c83bc9d298fff2aaf3500664cea87f825068fa18f4d7da3bec

Observation f7354b2f-6c8c-453c-9065-8fa80bd029e2 · outbound

This paper cites Rolling Forcing: Autoregressive Long Video Diffusion in Real Time.

Stream-T1: Test-Time Scaling for Streaming Video Generation Rolling Forcing: Autoregressive Long Video Diffusion in Real Time

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-16T11:15:29.350628Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:befa523bb0737f0844de1bbe9e120d2defed8dc4d8aa25f589f972aa94929121

Observation 11ce872f-0adc-4370-8d30-fe73dc63e331 · outbound

This paper cites Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling.

Stream-T1: Test-Time Scaling for Streaming Video Generation Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling

Reference 24

Resolution
metadata mismatch
arxiv_id, observed 2026-05-09T06:40:39.485808Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:7b1605216a0e1ae5c9fa07b53b1390d8773d68ff5e18ed44e1330363635cb2e2

Observation 3c65e886-ca8e-42a6-8e6b-7a87b8ed35e0 · outbound

This paper cites Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-16T18:17:55.281442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:b06084ffe1d60b247ccdbeec28864b73c9d7a360f583e4f5e2584a4a0a441ce0

Observation 2dd9ee08-7cf5-4c0b-8a38-eb59955c3898 · outbound

This paper cites Hpsv3: Towards wide-spectrum human preference score.

Stream-T1: Test-Time Scaling for Streaming Video Generation Hpsv3: Towards wide-spectrum human preference score

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.861770Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:77184ef042b8c6ca0367fa58a36eb20d1a357ab8469c5430659c1b046f0da7b5

Observation ade03136-71a8-4912-9f04-a07fb80f24da · outbound

This paper cites s1: Simple test-time scaling.

Stream-T1: Test-Time Scaling for Streaming Video Generation s1: Simple test-time scaling

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.903273Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:66976ddc78863efacc21d1f0534d3d386096a151937b2f6277f1ae2c93c0b9a1

Observation 0cf6b9c5-b46f-4135-bd5e-660e33622907 · outbound

This paper cites Inference-time text-to-video alignment with diffusion latent beam search.

Stream-T1: Test-Time Scaling for Streaming Video Generation Inference-time text-to-video alignment with diffusion latent beam search

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.103311Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:27aff317f93a3ba362cf24f445f6b01a65b966604137548ae1a00b690b276649

Observation bc704297-30ac-4fb3-ad8b-50ac6474299e · outbound

This paper cites Movie Gen: A Cast of Media Foundation Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Movie Gen: A Cast of Media Foundation Models

Reference 29

Resolution
verified exact
arxiv_id, observed 2026-05-11T14:16:26.778393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:cc40115e2f79b0fb771b5a9af38be664ee111e8c7f95169683433bf507e5cae9

Observation 107a2c90-1a1a-4181-8dcb-4d79596b5c4d · outbound

This paper cites Hierarchical spatio-temporal decoupling for text-to-video generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Hierarchical spatio-temporal decoupling for text-to-video generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.910413Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:87db065f5c795539383afc212e6e4a0e2425ed7ea8370e41b156ab523979afed

Observation 39d4d151-904e-4457-97ad-d7ef043020d3 · outbound

This paper cites Test-Time Scaling of Diffusion Models via Noise Trajectory Search.

Stream-T1: Test-Time Scaling for Streaming Video Generation Test-Time Scaling of Diffusion Models via Noise Trajectory Search

Reference 31

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.091834Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:7b9a117ce3ab4f6c644fae79d0fdfce6a43455be82d38f79f7b23d327606bbfa

Observation acbfbd2e-cde1-4a99-ba18-0f24fb52ba72 · outbound

This paper cites Next Block Prediction: Video Generation via Semi-Autoregressive Modeling.

Stream-T1: Test-Time Scaling for Streaming Video Generation Next Block Prediction: Video Generation via Semi-Autoregressive Modeling

Reference 32

Resolution
metadata mismatch
arxiv_id, observed 2026-05-09T06:40:39.120481Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:4b1c2c273f6ad439a4a09a0698d8555e9ade4cfccdbef8038b7dd0727b0642cc

Observation d305d8ff-05a2-4c3e-bbac-521b50e38849 · outbound

This paper cites Make-A-Video: Text-to-Video Generation without Text-Video Data.

Stream-T1: Test-Time Scaling for Streaming Video Generation Make-A-Video: Text-to-Video Generation without Text-Video Data

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:13:03.403852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:394d31f616c9fe87b3b5f61268dd5cb225a1c28ef10d828a920d19edcfde8a03

Observation 2cb6755b-5e14-44d8-aacd-392a6db0ebd6 · outbound

This paper cites A General Framework for Inference-time Scaling and Steering of Diffusion Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation A General Framework for Inference-time Scaling and Steering of Diffusion Models

Reference 34

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.324015Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:b2051f242bdde5baa66cc4e87e59d4444df5672228d6214991ffe9009026e9e2

Observation 70ecedaf-ca48-4702-9e34-27e454f1bfb5 · outbound

This paper cites Scaling llm test-time compute optimally can be more effective than scaling parameters for reasoning.

Stream-T1: Test-Time Scaling for Streaming Video Generation Scaling llm test-time compute optimally can be more effective than scaling parameters for reasoning

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.848682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:8d911c65b325ad44c85d9297b3e2367c6697adbb8976c773891fe239cba4f8f1

Observation 5c3ef276-96e2-4404-99cc-22d40cdeb3c9 · outbound

This paper cites MAGI-1: Autoregressive Video Generation at Scale.

Stream-T1: Test-Time Scaling for Streaming Video Generation MAGI-1: Autoregressive Video Generation at Scale

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:31:15.871842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:03404aa3d753c1d4dca9589382d3f3597f1e95a8d29b0544dfe764d3ff442e0b

Observation 35c4deb3-a411-475e-9f6d-1c20d6826baf · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Wan: Open and Advanced Large-Scale Video Generative Models

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.207640Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:8797e9e07101ae672fb6ff61c064567d4f249ea7978db675735b8cf75922fc0c

Observation dd8db599-1797-480b-9f2c-971706144eba · outbound

This paper cites ModelScope Text-to-Video Technical Report.

Stream-T1: Test-Time Scaling for Streaming Video Generation ModelScope Text-to-Video Technical Report

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-05-12T19:47:29.701736Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:70d87f8dd2174273148313a16bc618e8502fd98982ec28ed54eceb48cd4d72f1

Observation c829bd25-08ae-432f-8423-98522d6f6920 · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

Stream-T1: Test-Time Scaling for Streaming Video Generation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.142753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:738dee43929743afe9f48d2b36e82bacd2624fef5c8a4fe8fde92644e0ce644b

Observation 9f0ec689-0be9-4d5c-9a38-6012b7a46624 · outbound

This paper cites Art-v: Auto-regressive text-to-video generation with diffusion models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Art-v: Auto-regressive text-to-video generation with diffusion models

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.857511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:43ede1813bdea15fb38777685e06502e2acf5b88e0282e12df3415949525dadf

Observation 7bf32e41-c4eb-4ce7-b45f-dfac6686e222 · outbound

This paper cites Imagerysearch: Adaptive test-time search for video generation beyond semantic dependency constraints.

Stream-T1: Test-Time Scaling for Streaming Video Generation Imagerysearch: Adaptive test-time search for video generation beyond semantic dependency constraints

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.808027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:e3a43af48ea772dc37012edccc7935f951fa6854a1c16e58fd41cae1cf45dc41

Observation c8397314-d288-40d6-bf01-a5fb63cfef56 · outbound

This paper cites Imagereward: Learning and evaluating human preferences for text-to-image generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Imagereward: Learning and evaluating human preferences for text-to-image generation

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.816117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:0eee4df3da4456221ab7c20bd5209689e03436bbfa8522364a82364eb1d6fa70

Observation 6bf7f549-062f-4b36-bfcd-988b7d0e379f · outbound

This paper cites Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.812066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:b365ef77945d2caf2658f791e0d9ee01bf842214912ae0bb8df6e7f51e771300

Observation 7ad2f95b-98e4-4565-82e2-eed46028c0c8 · outbound

This paper cites VideoGPT: Video Generation using VQ-VAE and Transformers.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoGPT: Video Generation using VQ-VAE and Transformers

Reference 44

Resolution
verified exact
arxiv_id, observed 2026-05-13T17:24:33.857072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d6062122688223b08bf16f77a0fccc6eb767270dae2c7921144e8b64ca7bd4a4

Observation 06318ebc-7ac9-44b7-a820-312cb886c746 · outbound

This paper cites LongLive: Real-time Interactive Long Video Generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation LongLive: Real-time Interactive Long Video Generation

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-15T03:52:59.837830Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d6ebd8933dccd10c495a76bfb0ba12508207278805cf06a3a43442149abe15b1

Observation 0c5b2909-fc77-4327-a299-c52a0c577301 · outbound

This paper cites CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer.

Stream-T1: Test-Time Scaling for Streaming Video Generation CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-10T18:26:22.534732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:caa1b68a020f5374752e95338ebe91a51add0d3779aa8ef7d2309d995943ccf3

Observation 99ae0156-79f0-4524-a1f9-2415b49af3a4 · outbound

This paper cites From slow bidirectional to fast autoregressive video diffusion models.

Stream-T1: Test-Time Scaling for Streaming Video Generation From slow bidirectional to fast autoregressive video diffusion models

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.853255Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:40fc7c0e7907b3fc269477939413f87c9fda83190284fb6d75a03de56b320a06

Observation 43281fb9-6d34-4319-a0fe-f0ba1e9f1583 · outbound

This paper cites VideoMAR: Autoregressive Video Generatio with Continuous Tokens.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoMAR: Autoregressive Video Generatio with Continuous Tokens

Reference 48

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.187032Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:92e728db195127b3975d7db8c251d941060bc3c7264a3220bc42075665f93903

Observation eac90085-e369-41b6-a08b-70ad1001f64d · outbound

This paper cites Lumos-1: On autoregressive video generation with discrete diffusion from a unified model perspective.

Stream-T1: Test-Time Scaling for Streaming Video Generation Lumos-1: On autoregressive video generation with discrete diffusion from a unified model perspective

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.826129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:913c50a841289b7b77448bb8caec9fee73f3ddb98419ac0ddbdd36f0c76823e6

Observation 2091afb9-3c76-45d6-89e7-6f5d9847b3ae · outbound

This paper cites VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:20:00.737157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:ad636482467fce9c8d9b18963f978b4a68e58bfa26c58432b4cfd355b35cb213

Observation 5c7dba27-deb6-45e2-8e89-72a35e1fda04 · outbound

This paper cites Show-1: Marrying pixel and latent diffusion models for text-to-video generation.International Journal of Computer Vision, 133(4):1879–1893.

Stream-T1: Test-Time Scaling for Streaming Video Generation Show-1: Marrying pixel and latent diffusion models for text-to-video generation.International Journal of Computer Vision, 133(4):1879–1893

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.844510Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:06faedbacb4b5aa3141b1b9e1115b2fe1e034b8ba45b5bca21506da0fbc72666

Observation cf2b85a0-724e-4107-90b1-9350996c6eb3 · outbound

This paper cites A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?.

Stream-T1: Test-Time Scaling for Streaming Video Generation A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?

Reference 52

Resolution
verified exact
arxiv_id, observed 2026-05-13T18:07:52.994249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f071a485b2ef74e55410d423aa63378a7c0241057d34a46de810c6e3f19dd583

Observation a71c6540-4dd1-4ff4-8c21-eb12c53c9052 · outbound

This paper cites Learning multi-dimensional human preference for text-to-image generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Learning multi-dimensional human preference for text-to-image generation

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.839643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:b3b4e4c5c4e720398af5f889f9d44302f3bf9ee001c5a9a7e08129f701c062c9

Observation 92812db4-1efa-4262-92c6-c7c569e5754f · outbound

This paper cites LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion.

Stream-T1: Test-Time Scaling for Streaming Video Generation LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion

Reference 54

Resolution
verified exact
arxiv_id, observed 2026-06-30T02:17:18.172894Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:453b11f28793bfa975bf8f2ad371b6426e0dddbdcfe0124dc7d97f2b2e322145

Observation e2ca6090-c584-4851-a333-cadcca0038f2 · outbound

This paper cites MagicVideo: Efficient Video Generation With Latent Diffusion Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation MagicVideo: Efficient Video Generation With Latent Diffusion Models

Reference 55

Resolution
verified exact
arxiv_id, observed 2026-05-15T18:47:57.649874Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:eb37a58ee609a6ca1469cce537ffaf318ca761725141060114dcbfb9ca597024

Observation a8101fbc-fa68-41d4-afa1-88924aeb5ad3 · outbound

This paper cites Golden noise for diffusion models: A learning framework.

Stream-T1: Test-Time Scaling for Streaming Video Generation Golden noise for diffusion models: A learning framework

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.830495Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:00ed6abedb6a5a50752cf79bb342dd5b25c3a13d976e56a4ab6ae865afa433ae

Observation 7998b363-a012-4fea-9d78-3db92aa0dc4a · outbound

This paper cites From reflection to perfection: Scaling inference-time optimization for text-to-image diffusion models via reflection tuning.

Stream-T1: Test-Time Scaling for Streaming Video Generation From reflection to perfection: Scaling inference-time optimization for text-to-image diffusion models via reflection tuning

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.834970Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:ef3894538e4cd8a17ea3a0d07fa7a4838496c6fc592e7d9e56a9d8aad525c384

Pith citing papers

Observation 57015be4-cfba-4881-a9db-a6971606329b · inbound

Lance: Unified Multimodal Modeling by Multi-Task Synergy cites this paper.

Lance: Unified Multimodal Modeling by Multi-Task Synergy Stream-T1: Test-Time Scaling for Streaming Video Generation

Reference 109

Resolution
verified exact
local_arxiv, observed 2026-05-20T11:48:14.790869Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-20T11:46:52.658984Z digest=sha256:a017f3c6f16dad08ebf00caf4e24614d53c6b97bcda4f7200514ec7e42c6bf69

Observation 7b56ca82-b68f-4341-bcee-62a0d9a38c9b · inbound

Lance: Unified Multimodal Modeling by Multi-Task Synergy cites this paper.

Lance: Unified Multimodal Modeling by Multi-Task Synergy Stream-T1: Test-Time Scaling for Streaming Video Generation

Reference 110

Resolution
verified exact
local_arxiv, observed 2026-05-21T07:59:50.598285Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-21T07:56:34.034047Z digest=sha256:e4985d3a7c750928c6edc9d7236b61eea9d2fa08fd9cae2a1612db730f85dde4

Observation 94b9d04a-88fc-45ed-a1c9-918dae59bee0 · inbound

CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion cites this paper.

CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion Stream-T1: Test-Time Scaling for Streaming Video Generation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-01T03:30:25.729920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T03:30:25.729920Z digest=sha256:3cbc011080a7be16ebce2ff3dacc0d43b3f199af6d7280f02ff57907c7f98127