时政
财经
科技
虚拟货币
其他
登录
#图像识别
关注
我真的没有拼多多
5天前
下班后,用v0两小时不到快速糊了一款表情识别器demo 百度最近新开源了一个多模态的模型,我测试了一下它的图像识别能力,非常强大,甚至对于面部表情都能很好的识别。 基于此模型,开发了一个表情识别特效网站,看看你能做出多少种表情来吧,欢迎大家试玩! 网址在评论区第一条 (使用的具体模型:ERNIE 4.5-VL-28B-A3B-Thinking)
#表情识别
#多模态模型
#ERNIE 4.5-VL-28B-A3B-Thinking
#图像识别
#特效网站
分享
评论 0
0
Andy Stewart
1周前
懒猫相册基于AI大模型找相似重复照片太方便了
懒猫家族新成员亮相,AI算力舱引发热议!· 106 条信息
#AI大模型
#懒猫相册
#重复照片
#图像识别
#效率工具
分享
评论 0
0
XiaoPeng
1个月前
类似这种图,识别图上的标签,速度最快的模型是哪个?当然也要比较准确。
#图像识别
#模型速度
#模型准确率
#技术选择
#AI模型
分享
评论 0
0
阿橡
2个月前
这个有点厉害的,只要点击照片,然后跟手机说“删掉塑料袋”。它就真的只把塑料袋删掉了……塑料袋里面装的东西还飘在空中…… 识别的过于精准了。 Google Pixel 10/Pro/Fold Impressions: Magnets!
#Google Pixel 10
#图像识别
#AI
#塑料袋
#精准
分享
评论 0
0
Gorden Sun
2个月前
Thyme:像o3一样分析图片 视觉多模态模型,会分析用户需求,针对复杂问题写代码来辅助解决。例如识别非常小的区域内的文字,会写代码执行放大+裁剪的操作,然后再识别图像解决问题。跟OpenAI o3的操作类似。 项目地址: Github:
#Thyme
#o3
#视觉多模态模型
#代码辅助
#图像识别
分享
评论 0
0
Dr.Hash“Wesley”
5个月前
这个图的背景音是什么?
#图像识别
#背景音分析
#音频技术
分享
评论 0
0
karminski-牙医
5个月前
有人已经开始尝试把大模型装到玩具上了哈哈哈 看到个博主Complex-Indication使用树莓派 Zero 2 的摄像头采集图像,然后使用wifi上传到电脑,电脑使用 SmolVLM 来识别图像,再将控制命令传回去进行控制。不过刚开始完全不能运行,不过他用200张图微调了下模型,挂了个LoRA后,机器人就能走了! 他使用的 prompt 是这样的(我翻译成了中文):根据图像选择以下一项行动:前进,向左,向右,后退。若视野被障碍物阻挡,则选择后退。若左侧有障碍物,则选择向右。若右侧有障碍物,则选择向左。若没有障碍物,则选择前进。根据图像选择以下一项行动:前进,向左,向右,后退。若视野被障碍物阻挡,则选择后退。若左侧有障碍物,则选择向右。若右侧有障碍物,则选择向左。若没有障碍物,则选择前进。
#大模型
#玩具应用
#树莓派
#图像识别
#SmolVLM
#微调模型
#机器人控制
#LoRA
#机器学习
分享
评论 0
0
个人主页
通知
我的投稿
我的关注
我的拉黑
我的评论
我的点赞