arXiv:2608.00829cs.RO2026-08

机器人自动生成极简线条人脸肖像,从识脸到作画全程自动。

GeminiPainter's sequence-formed pipeline comprised of perception, cognition, planning, and action stages

论文配图:GeminiPainter's sequence-formed pipeline comprised of perception, cognition, planning, and action stages
图 1 · 摘自论文原文
  • 分感知、认知、规划、执行四阶段,用AI将人脸转为单线草图
  • 用户评分超4.3,生成画像清晰、动作流畅、体验有趣
  • 适合对机器人艺术创作感兴趣的开发者和设计师

我们提出一个自主机器人肖像生成系统,结合实时人脸检测、基于AI的草图生成与机械臂作画。系统捕获视频帧,提取面部区域,利用Gemini Vision API将其转化为极简单线草图,通过图论路径规划优化笔触顺序,并在6-自由度协作机械臂上执行平滑轨迹。该感知-认知-行动流程融合计算机视觉、神经艺术抽象、运动优化与机器人控制。用户在5分制评分中对草图质量(4.33)、执行感受(4.53)和整体体验(4.65)均给予高度评价,表明生成画像具有可识别性、吸引力与互动性。

原文摘要 · Abstract (English)

We present an autonomous robotic portrait-generation system combining real-time face detection, AI-based sketch generation, and robotic drawing. The system captures video frames, extracts facial regions, converts them into minimalist single-line sketches using the Gemini Vision API, optimizes stroke order through graph-based path planning, and executes smooth trajectories on a 6-DoF collaborative manipulator. This perception-cognition-action pipeline integrates computer vision, neural artistic abstraction, motion optimization, and robot control. User ratings on a 5-point scale were high for sketch quality 4.33, perceived execution 4.53, and user experience 4.65, indicating recognizable, appealing, and engaging robotic portraits.

机器人绘画AI艺术视觉生成

Thank you to arXiv for use of its open access interoperability. PaperDance 不是 arXiv 官方产品;中文卡片由大模型生成,请以原文为准。