时政
财经
科技

#专注达

Dr.Hash“Wesley”
Dr.Hash“Wesley”
2025-06-09 12:47:26

这个图的背景音是什么?

预览
#图像识别#背景音分析#音频技术
karminski-牙医
karminski-牙医
2025-05-26 07:25:00

有人已经开始尝试把大模型装到玩具上了哈哈哈 看到个博主Complex-Indication使用树莓派 Zero 2 的摄像头采集图像,然后使用wifi上传到电脑,电脑使用 SmolVLM 来识别图像,再将控制命令传回去进行控制。不过刚开始完全不能运行,不过他用200张图微调了下模型,挂了个LoRA后,机器人就能走了! 他使用的 prompt 是这样的(我翻译成了中文):根据图像选择以下一项行动

#大模型#玩具应用#树莓派
没有更多了 🤐