{"schema_version":"1.0","language":"zh-CN","generated_from":"NEWVAR 从零开始学AI structured Markdown","write_access":false,"full_text_access":false,"content_boundary":"This endpoint exposes metadata, objectives, prerequisites, labs and source summaries. It does not expose chapter body text or answer text.","chapter":{"slug":"vision-transformers-evaluation","title":"视觉Transformer、生成视觉与评估","english_title":"Vision transformers and evaluation","chapter_number":52,"volume":3,"volume_title":"第三卷：主要AI分支","month":13,"unit_title":"计算机视觉","review_status":"draft","updated_at":"2026-08-06","estimated_hours":8,"focus":"理解图像分块、全局注意力、生成质量评估和数据偏见。","objectives":["理解图像分块、全局注意力、生成质量评估和数据偏见。","解释核心数学关系并完成最小实现","运行单变量实验并记录失败样例","完成工程线或研究线至少一项迁移任务"],"prerequisites":["detection-segmentation"],"exercise_count":3,"tracks":["engineering","research"],"human_url":"/learn/vision-transformers-evaluation"},"labs":[{"id":"lab-vision-transformers-evaluation","chapter_slug":"vision-transformers-evaluation","title":"视觉Transformer、生成视觉与评估：单变量实验","kind":"patch_size","data_status":"教学模拟","variable":{"label":"图像块尺寸","unit":"px","min":2,"max":32,"step":2,"default":16},"objective":"只改变“图像块尺寸”，观察结果、代价和风险如何一起变化，理解理解图像分块、全局注意力、生成质量评估和数据偏见。","static_fallback":"静态替代：把图像块尺寸分别设为2px、16px和32px，手工比较三组教学模拟输出。","keyboard":"聚焦滑块后使用方向键微调，Page Up/Page Down大步调整，Home/End到达边界。","measurement_note":"页面数值由公开公式生成，只用于教学，不代表真实模型性能或现实世界因果效果。","source_ids":["S026","S027","S028","S071"]}],"project":{"id":"project-13","month":13,"title":"制作一个公开图像数据的可解释识别器","brief":"完成数据许可检查、增强、分类、混淆分析、显著性审查和CPU部署。","deliverables":["问题与边界说明","可运行最小实现","实验记录与失败分析","来源与许可清单","风险、隐私与人工闸门","复现README"]},"sources":[{"id":"S026","author":"Stanford University","title":"CS231n: Deep Learning for Computer Vision","source_level":"大学课程一手资料","published_at":"2026","accessed_at":"2026-08-06","doi_or_url":"https://cs231n.stanford.edu/"},{"id":"S027","author":"Kaiming He et al.","title":"Deep Residual Learning for Image Recognition","source_level":"同行评审论文预印本","published_at":"2015","accessed_at":"2026-08-06","doi_or_url":"https://arxiv.org/abs/1512.03385"},{"id":"S028","author":"Alexey Dosovitskiy et al.","title":"An Image is Worth 16x16 Words","source_level":"同行评审论文预印本","published_at":"2020","accessed_at":"2026-08-06","doi_or_url":"https://arxiv.org/abs/2010.11929"},{"id":"S071","author":"Margaret Mitchell et al.","title":"Model Cards for Model Reporting","source_level":"同行评审论文预印本","published_at":"2018","accessed_at":"2026-08-06","doi_or_url":"https://arxiv.org/abs/1810.03993"}]}