{"as_of":"2026-08-20T12:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:258ac95afd0faf6d63e8acc13ef96e5afc4df444b95165af28a62f7870943a4a","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T20:01:07.220797Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T16:57:23.819308Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-24T20:04:52.865413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"cited_work":{"arxiv_id":"1907.07911","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.07911","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","venue":"cs.CV","work_id":"757ba212-81c4-42ba-b485-b8656230fdfe","year":2019},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"cited_paper":"/paper/1907.07911","citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:852beb93ed9620963713e847414abd2e6d5daaa3e746db65dd8956994b017e11","observation_id":"ec12b5e0-ab16-4f15-a7fa-127e215d9f70","resolution":{"observed_at":"2026-05-24T20:04:52.868632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.07911","snapshot_observed_at":"2026-08-12T16:57:23.819308Z","title":"Locality-constrained spatial transformer network for video crowd counting","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2411.13056","last_updated":"2025-03-06T08:28:09Z","snapshot_observed_at":"2026-08-15T13:53:57.555378Z","submitted_at":"2024-11-20T06:08:21Z","title":"Efficient Masked AutoEncoder for Video Object Counting and A Large-Scale Benchmark","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T16:57:23.819308Z"},"links":{"cited_paper":"/paper/1907.07911","citing_paper":"/paper/2411.13056"},"observation_digest":"sha256:e7c9e4971bd15c49c36ee85fad38b13a4d40a281019b2da87bf69826c5690082","observation_id":"626e37d2-a91a-4636-9903-0addb52abe50","resolution":{"observed_at":"2026-08-12T16:57:23.819308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1907.07911/citation-record","integrity":"/paper/1907.07911/integrity","json":"/paper/1907.07911/citation-record.json","paper":"/paper/1907.07911"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"cited_work":{"arxiv_id":"1907.07911","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.07911","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","venue":"cs.CV","work_id":"757ba212-81c4-42ba-b485-b8656230fdfe","year":2019},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"cited_paper":"/paper/1907.07911","citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:852beb93ed9620963713e847414abd2e6d5daaa3e746db65dd8956994b017e11","observation_id":"ec12b5e0-ab16-4f15-a7fa-127e215d9f70","resolution":{"observed_at":"2026-05-24T20:04:52.868632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Crowd counting for single image","venue":null,"work_id":"336e4d9e-6855-47bd-94a8-e98ed49ada13","year":null},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:28587dc7c93c92e42953fc9f1feceff2e6b4a108c833444c4e2767341f2efd73","observation_id":"595ef660-3621-4126-bc57-01d2c119580a","resolution":{"observed_at":"2026-05-24T20:16:22.173518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3804ef9e-20db-4dbe-8828-abec623c7550","year":2000},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:6d9dc1e582723bf84b841deb251f09df0198c2a9c5fb9067cccefb585567ed7d","observation_id":"4f7087e4-469a-4084-85f8-15d22cc706f4","resolution":{"observed_at":"2026-05-24T20:16:22.205354Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b41fb68e-e3c7-4267-91f5-aa6820c51c8c","year":null},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:7190d4fcf176fb659ff55872adaece8d89d658ef371dd6efa31ced850e6f329e","observation_id":"a087ebd6-74fc-4405-8a8d-c9e51b5ebbc0","resolution":{"observed_at":"2026-05-24T20:16:22.176997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We also report the perfor- mance of our method without LST","venue":null,"work_id":"1a0b0d47-52b6-4376-b8bc-f2ecb1fb972c","year":2000},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:24c6a2aac8682d7a484b3e336ccfd9ba9575130f3e3228221f76486ee1ffa223","observation_id":"d5e42f4f-ae75-4cd5-b248-f8f432290a1d","resolution":{"observed_at":"2026-05-24T20:16:22.180769Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speciﬁ- cally, we ﬁrst leverage a density map regression module to es- timate the density map of each frame","venue":null,"work_id":"62cbf07c-b191-4cab-bf7e-e40548b1afbf","year":null},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:973fca982e5fdd47cffa7ed265a732a7779989bc97ed5c02fa4c0b5aa5a7191a","observation_id":"6de382e4-3d82-4e29-85e3-9071b3cf6595","resolution":{"observed_at":"2026-05-24T20:16:22.155602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast crowd density estimation with convolutional neural net- works","venue":null,"work_id":"a41a7020-a8fb-48c5-ac8b-c382e25b7a26","year":2015},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:598d569245db3221fe1876b6f4f88fc28a343acae714c9481c5ce34d51a90581","observation_id":"707e77d7-089d-4df0-9661-6cf571f823ff","resolution":{"observed_at":"2026-05-24T20:16:22.158980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-scene crowd counting via deep convolutional neural networks","venue":null,"work_id":"d117be25-7e40-4829-8e34-d178a07ff05c","year":2015},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:7d0b0d2777f667bb6e441031da1ba8fde2fe77150aae6cfcc202d0e1375364cd","observation_id":"579de131-8fbf-4de0-85b5-0a1ac3ca40bf","resolution":{"observed_at":"2026-05-24T20:16:22.165631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single- image crowd counting via multi-column convolutional neural network","venue":null,"work_id":"cf427e22-215e-4d06-980e-9a499ff44d12","year":2016},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:e6d02fb0b438d894f198a97491e6769d9823fbadd9581c0f5af5c40854daefaa","observation_id":"84ddcaef-5d1a-48ff-8e5f-76c85e832a17","resolution":{"observed_at":"2026-05-24T20:16:22.152430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Context-aware trajectory prediction","venue":null,"work_id":"a2797b3c-e0cb-4f1f-a9f0-6c7ca7b68257","year":2017},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:0b7f93efe2a894fb4a0f45c993a6c0b6dae85638c9f067703f9767620cdebca1","observation_id":"bbe1e688-360d-421a-bdb8-a85d3a83b011","resolution":{"observed_at":"2026-05-24T20:16:22.210006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Histograms of oriented gradi- ents for human detection","venue":null,"work_id":"6841b43a-e8b4-4823-a2cf-56d6410eb171","year":2005},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:e2f996bc5267883f29233d3acab51f9d8b8939fc141565de370e739b97903ec7","observation_id":"15586605-b4aa-46cf-a93d-f3f43602c90c","resolution":{"observed_at":"2026-05-24T20:16:22.213739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pedestrian detection via classiﬁcation on riemannian manifolds","venue":null,"work_id":"6520aa61-6921-4ffb-a0a1-a3c702fec780","year":2008},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:1e809e741d57ef0aee674349f2b5b2337daae108333b0273ac15007b4dd3806c","observation_id":"88e12c8d-bf87-4a19-bacd-6e988bfb1686","resolution":{"observed_at":"2026-05-24T20:16:22.216932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fcn-rlstm: Deep spatio-temporal neural networks for vehicle counting in city cameras","venue":null,"work_id":"bd96c188-4901-4c28-86cd-608aa5103bfa","year":2017},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:280532af3163ff4ce04bebc5e3d285527bb279a10eb0f059dae13e2fddb4a549","observation_id":"a716b6ff-6a2a-43ad-85f4-765080f50f0b","resolution":{"observed_at":"2026-05-24T20:16:22.162163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatiotemporal model- ing for crowd counting in videos","venue":null,"work_id":"8d558fc2-0cf3-4a8b-8a31-849ffe6940de","year":2017},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:30a574efba29cd9da099301bc0414453ea7886593f9905891684a2fa4e3ac396","observation_id":"54bd09ec-3058-4162-8a2a-553e0384ece7","resolution":{"observed_at":"2026-05-24T20:16:22.184582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Switching convolutional neural network for crowd counting","venue":null,"work_id":"35be8467-461f-472d-8981-5da2f9a96cdc","year":2017},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:db8da98dcb0d086b90b9b4adff0a3132c9115df5137834d8a3f0323b204442b4","observation_id":"b4d377da-683f-47c1-ab72-789ba40a0734","resolution":{"observed_at":"2026-05-24T20:16:22.187632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Csrnet: Dilated con- volutional neural networks for understanding the highly congested scenes","venue":null,"work_id":"587e3cd4-a655-41b2-9e7f-1703fb546db3","year":2018},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:fe6894386e474ccc95b250aa643cbf68da7f34f4255b7796bd7b57f245130e50","observation_id":"94c83749-5bac-48f3-8a8c-feb9c20ff15b","resolution":{"observed_at":"2026-05-24T20:16:22.149758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards perspective-free object counting with deep learning","venue":null,"work_id":"66303abe-4dee-45c8-aa5d-51709f131eb2","year":2016},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:c7421b9597920755e1598038cfe79c9e2d9645190abc246e7116b98a981df043","observation_id":"f4cda0e8-4c94-4c3f-962d-d2023b53257c","resolution":{"observed_at":"2026-05-24T20:16:22.143952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deci- denet: counting varying density crowds through atten- tion guided detection and density estimation","venue":null,"work_id":"6dbcf9fb-50b8-4546-b495-6196b1733dde","year":2018},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:2709c28c37d1ebfeee6bff9c0aed04071d349aa5fb427cdb043106449f384d2e","observation_id":"6c7d8a33-72fe-4f86-a215-bb1fbe371d47","resolution":{"observed_at":"2026-05-24T20:16:22.146814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Composition loss for counting, density map estimation and localization in dense crowds","venue":null,"work_id":"91cb32dd-9383-4d7e-9552-38345c707087","year":2018},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:20b16c4d0e3ced5ea2af96961b83ef49caa24fc8a36041cd6d16c19898948990","observation_id":"49fcadc2-198b-4894-aff2-5a03f753dda3","resolution":{"observed_at":"2026-05-24T20:16:22.138041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatial transformer networks","venue":null,"work_id":"1c118cca-aa67-41b6-a362-f75c50aa8ccb","year":2015},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:13a58ab7722a09dcb04ececd42e1ee709aafec0e7547fae61456a09654d6abca","observation_id":"2b1cad2f-d8d6-4660-8900-5d0c59b03094","resolution":{"observed_at":"2026-05-24T20:16:22.128664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Su- pervised transformer network for efﬁcient face detec- tion","venue":null,"work_id":"2c33497c-9d02-4aeb-b8c7-c3114548fe32","year":2016},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:8ae0aa1e66cf1eaafffa507a3fbf2f4ea484e7bc09fe625d453d33b9eba1f2e1","observation_id":"3a241c82-a1bb-40f6-8e42-a7345042b91d","resolution":{"observed_at":"2026-05-24T20:16:22.125874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"To- ward end-to-end face recognition through alignment learning","venue":null,"work_id":"9db36710-642e-4d68-b03d-646d9541ca57","year":2017},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:80b5d08ec8a7f7cde234cd14f1242d577d13ff11829967d158cbf04c13db8196","observation_id":"b1ea1f6c-35f8-495d-870f-d501f266e4d0","resolution":{"observed_at":"2026-05-24T20:16:22.131962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recursive spatial transformer (rest) for alignment-free face recognition","venue":null,"work_id":"5ee4a446-3518-40a2-be05-5493d1231849","year":2017},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:825c2ec7af4fd5444ab05d36fbc88953b71ed1a3728c04e95ecdf2c015cf7801","observation_id":"75f5c233-d2e3-4dec-837a-e4364184fd46","resolution":{"observed_at":"2026-05-24T20:16:22.134909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.00601","last_updated":"2018-07-02T11:21:27Z","snapshot_observed_at":"2026-08-20T09:24:25.319085Z","submitted_at":"2018-07-02T11:21:27Z","title":"Crowd Counting using Deep Recurrent Spatial-Aware Network","version":1},"cited_work":{"arxiv_id":"1807.00601","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.00601","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Crowd Counting using Deep Recurrent Spatial-Aware Network","venue":"cs.CV","work_id":"cd946e5d-e6ea-46c2-8c29-cd3dabf4c6fd","year":2018},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"cited_paper":"/paper/1807.00601","citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:3aee7771f201887ad32092f617d0292557e9331e4120ed7f1857faac292d7e11","observation_id":"a1eb0e71-c3e4-486d-97e7-d6d582c8ee1e","resolution":{"observed_at":"2026-05-24T20:04:52.862666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Counting in dense crowds using deep features","venue":null,"work_id":"181433cd-ddb6-41e7-bed3-0e5894df2d3c","year":2015},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:cd1ad54ccb95cb7aa070019c36d76fc65472f0a032d7a821ab76c13695b66476","observation_id":"ea4b8fb7-1f69-464c-8fb1-0ccf5250dc79","resolution":{"observed_at":"2026-05-24T20:16:22.141058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Privacy preserving crowd monitoring: Counting people without people models or tracking","venue":null,"work_id":"770de8f1-3da4-4947-a780-7efedc7be47f","year":2008},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:874e5444242fdd17555ae9620900f147bc6a970db3dd82897fe2a35e769c09b6","observation_id":"b83f8514-b4b6-42bb-8bdc-9089ebfcda27","resolution":{"observed_at":"2026-05-24T20:16:22.190750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Face recognition us- ing kernel ridge regression","venue":null,"work_id":"306dab7a-aa5d-4ed5-bd62-a96e144df29d","year":2007},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:e65bb5ed8c832ede1ed8bf9b1b391c8a1e70e8a701f244f3b032ef7330eb3659","observation_id":"8f850ae9-2312-486b-b90b-ca753f78c629","resolution":{"observed_at":"2026-05-24T20:16:22.202596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feature mining for localised crowd counting","venue":null,"work_id":"a41a75c5-97be-4293-8bb2-7a55effad4ca","year":null},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:915e55ba35f044e5b43154548e11944a7cb1b9070e4753ca0561f78c12424f63","observation_id":"bbe75999-7fca-4d6d-8a7f-ece49576b808","resolution":{"observed_at":"2026-05-24T20:16:22.199615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cumulative attribute space for age and crowd density estimation","venue":null,"work_id":"43548a3a-9689-4283-bd00-d2983d67bd5d","year":2013},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:83a9a897d17798d93dc321e3f2dd6c31cdadabd46b0d71171ccd440e14b9c5ab","observation_id":"b7754e7b-54fe-41e2-85c9-2331acff2b36","resolution":{"observed_at":"2026-05-24T20:16:22.193567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Count forest: Co-voting uncertain number of targets using random forest for crowd density estimation","venue":null,"work_id":"349f6cc3-6a37-4a24-95c0-46531219ecf0","year":2015},"citing_paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-24T20:01:07.220797Z"},"links":{"citing_paper":"/paper/1907.07911"},"observation_digest":"sha256:c21a89071a124943409596c1086dc4b1a43c97a3ac7328c3a3faff872f6127c8","observation_id":"1553ccea-f3c2-4916-887c-1ca09905955c","resolution":{"observed_at":"2026-05-24T20:16:22.196681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1907.07911","last_updated":"2019-07-18T07:25:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T13:29:56.479033Z","submitted_at":"2019-07-18T07:25:26Z","title":"Locality-constrained Spatial Transformer Network for Video Crowd Counting"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 2 inbound Pith citation observations for arXiv:1907.07911."}