利用Google AIY Vision Kit 自制人类检测器(下)

Google Vision OCR Google Vision OCR 爬坑建议 首先安装 Google Vision composer require google/cloud-vision 第一次使用的时候真的遇到的问题很多,文档是英文的,自己慢慢摸索的途中不免进行去百度和google搜索 但是搜索出来的结果却不尽人意,可能是搜索方式不太对哈哈~,其实使用蛮简单,因为是别人现成对轮子,只不过使用对时候坑比较多, 所以特别列出... 阅读详情

掌握了Google AIY Vision Kit的硬件组装,也有了基本测试经验后,接下来将会为人类检测器及加入编程。此外 ,本文也找到一些有趣的例子供大家参考。

试玩示范代码后,建议大家也可试玩系统或官网中其他代码。有些需要使用镜头的代码,如 「image_classification_camera.py」,能通过镜头辨认出来视觉中的物件。另一些不需要使用镜头的预设代码, 例如Dish Classifier,就可以由一幅相片中,分辨出相片中有甚么食物,即使你不懂得人工智能的原理,也可以很容易地操作这些代码。

 

系统范例代码

https://github.com/google/aiyprojects-raspbian/tree/aiyprojects/src/examples

官网其他范例

https://aiyprojects.withgoogle.com/models

硬件线路及接驳

现在开始制作「人类检测器」,过程里会使用到GPIO接驳伺服马达,因此需要使用Bonnet板上的接口,大家可按照下面的线路图,将伺服马达SG90及Bonnet板上的接口接驳起来。

 

接着会制作一个简单的支架,将AIY Vision kit及伺服马达固定起来。最后,在伺服马达的延长杆贴上指针就完成硬件上的装嵌。

人类检测器编程

代码方面,可以参照GPIO资料夹中的预设代码码「servo_example.py」与「face_detection_camera.py」,再加以修改及结合。以下是我们组合的「人类检测器」代码,命名为HumanDetect.py。新结合及修改的代码码,可以放在AIY套件中的任何位置,笔者喜欢将代码放在AIY的套件桌面上,就像一般个人电脑一样。以下会讲解以下代码中的细节。

HumanDetect.py代码码:

 

代码说明:

 

储存代码HumanDetect.py后,再利用Python3 IDE执行此代码,「人类检测器」就会运作起来。

制作AIY Maker经验分享

当Vision Kit执行使用镜头的预设代码,例如face_camera_trigger.py。当执行数次后,它偶尔会出现不能再继续运作的情况,而再次执行代码后,会出现错误讯息。笔者认为是AIY Vision Kit未能够停止之前运作中的Python代码,其后遇上此情况,在terminal中,输入指令「killall python」,之前的代码就可强制停止所有代码,接着预设代码就可以再次执行。

人类检测器示范

作者简介

明爱胡振中中学资讯及通讯科技科科主任  庄庆荣

任教ICT 及数学科,于大学修读工程学科,对科技、数学及电脑学科有浓厚兴趣,喜爱思考各种知识的综合应用,期待为学生带来学习上的刺激。

Google Vision API Google Cloud Console (https://cloud.google.com/vision/docs/setup?hl=zh_CN) 1.创建项目 2.启用结算功能 3.启用 API 4.创建服务帐号 创建服务帐号: 在 Cloud Console 中,转到创建服务帐号页面。 转到“创建服务帐号” 选择您的项目。 在服务帐号名称字段中,输入一个名称。Cloud Console 会根据此名称填充服务帐号 ID字段。 在服务帐号说明字段中,输入说明。例如,Service . 阅读详情

相关推荐

苹果官方架构之VisionKit 视觉扫描文档组件

VisionKit 使用iOS相机扫描文档,就像您在Notes应用程序中捕获的文档一样。 概述 VisionKit是一个小型框架,可让您的应用使用系统的文档扫描仪。将文档摄影机显示为视图控制器,它像Notes中的摄影机功能一样覆盖整个屏幕。在您自己的视图控制器中实现,以接收来自文档摄像机的回调,例如完成的扫描。VNDocumentCameraViewControllerDelegate 可用性 iOS 13.0以上 Mac Catalyst 13.0以上 话题 文件扫描 在文档上构造可识别的文本 使用

iCloudEnd的博客 2422

XR-FRAME平面AR能力

AR-增强现实绝对是未来的新方向。微信的XR-FRAME是浪尖开发ARCoder小程序的一个主要框架。但是XR-FRAME实际上是基于微信的另一种能力,也即是VisionKit 视觉能力 ,XR-FRAME对其进行了封装,使得用户可以直接使用WXML直接开发AR小程序,而XR-FRMAE作为一种插件使用,限制是不能直接和其他通用的WXML混合编程。今天普及另一个知识点平面识别和距离。摄像头实现平面...

大数据星球-浪尖 1280

带有google-vision的文本识别:使用Google Vision API的OCR实现

使用Google Vision API进行简单文本识别 文本识别是检测图像和视频流中的文本并识别其中包含的文本的过程。 一旦检测到,识别器便确定每个块中的实际文本,并将其划分为行和单词。 描述 文本识别是通过Google Vision API实现的。 如何运作 首先,您必须将选定的图像转换为Base64格式。 在这种情况下,我们将使用HTML 5功能(画布)对其进行转换。 Canvas允许您使用toDataURL()方法获取绘制图像的Base64格式。 然后,您可以通过https://vision.googleapis.com/v1/images:annotate将数据发布到Google Vision REST API。 您可以阅读完整的文档。 语言 内置HTML,AngularJS和纯JavaScript。

Google AIY Vision Kit安装及国内配置

鉴于中国特色,我们出色的Great Wall要求我们IT从业人员具备高超的应变和适应能力。当然如果自认为没有这种基本能力,玩这种老外的东东,基本上很难上手,不是智商不够,而是现实太残酷。想当年,研发大多采用Google查资料,那真的叫一个准。虽然现在国内已经无法直接上Google了,只能默默的百度各种翻页,甚至翻上10页都找不到合适的(吐槽下)。从业以来,多年的绕弯弯经验让我这次装Google AIY Vision Kit如鱼得水。

lida2003的专栏 2173

视频AI系统工具:强大的图像识别和分析工具Google Cloud Vision API介绍

Google Cloud Vision API是一种基于云计算的图像分析服务,它利用深度学习算法对图像进行标记、分类、描述等操作,以便更好地理解和利用图像数据。它适用于多种应用场景。无论是内容审核、安全监控还是智能零售,它都能提供高效、准确的解决方案。,能够实现对象识别、场景识别、文字识别、 面部检测、地标检测、 徽标检测、显式内容检测、图像属性检测 等功能。广泛的应员工在如下场景:图像分类和标记、文字识别和提取、人脸检测和分析、图像内容过滤、零售和电商、医疗影像分析、自动驾驶。

weixin_70208651的博客 7062

Google Vision API 创建及调用 for mac

Google Vision API 创建及调用 for mac

eleven_8的博客 2165

利用Google AIY Vision Kit 自制人类检测器(上)

近年就人工智能这个议题,在报章杂志,或各式各样的研讨会中,也能够找到与人工智能有关的讨论;加上数年全球掀起Maker风,世界各地都大量地使用各种不同的电子开发版例如Microbit、Arduino或树莓派等,制作出多样化的Maker专案。两者结合,可考虑用Google AIY Project进行制作,毕竟AIY简单易用,适合学生以及Maker将人工智能的技术应用到自己制作的作品。以下是我们学校制作...

引力空间 万物互联 984

Google AIY | Vision Kit开箱深入试用

听说DF君从Google那边弄来了AIY Vision Kit, 还亲手做了一个开箱视频.     作为一个充满好奇心的瓶子, 怎么可以错过, 向老大两手一摊, 开心得把Vision Kit搞到了手:)   先来一个正面照:   不得不说一下, 这次Google用了Intel 的黑科技MovidiusVPU加速器, 处理起图片来速度杠杠的, 又不需要联网, 再加上Googl...

1164

使用Google Vision API进行计算机视觉图像创意分析

介绍计算机视觉可以用来从图像、视频和音频中提取有用的信息。它允许计算机看到并理解从视觉输入中可以收集到什么信息。在接收到视觉输入后,它可以在图像中收集有价值的信息,并确定必须采取的下一步。Google Vision API是一种Google云服务,它允许使用计算机视觉从图像输入中提取有价值的信息。作为初学者,你可以使用此服务获得对图像的有意义的见解。下图显示了Google视觉API的工作原理。上图...

深度学习与计算机视觉 4989

Google Cloud Vision API:强大的视觉分析工具及其在Spring Boot中的应用

Google Cloud Vision API 是 Google 提供的一项强大的视觉分析服务,它通过先进的机器学习模型,帮助开发者轻松地在应用程序中集成图像识别功能。:自动为图像生成描述性标签,帮助快速理解图像内容。:识别图像中的人脸,并提供面部特征的详细信息。:识别图像中的地标,并提供详细的地理位置信息。:从图像中提取文本内容,支持多种语言。:检测图像中是否包含成人内容、暴力内容等,帮助过滤不适当的内容。

m0_73355421的博客 2970

Google Vision API的线分割算法

Google Vision 提供了 2 种光学字符识别(OCR)选项。第二种选项适用于从文章中提取数据(密集文本,如报纸/书籍)。此选项具有智能分段方法,可以合并附近的单词形成行和段落。此功能对于文本内容稀疏的图像(如零售发票)不适用,这些图像中与同一行相关的数据位于两个角落(产品名称和价格之间有巨大的间隔/空白)。对于这些图像,OCR以不同的顺序分段行。如果单行中两个单词的距离太远,那么谷歌视觉会将它们识别为两个单独的段落/行。下面图片显示了谷歌视觉典型发票的样本输出。

技术文档翻译分享 464

利用Googlevision library实现人脸检测功能

利用Googlevision library实现人脸检测功能 原文地址 基于Google vision实现人脸检测功能 前言 之前写了一篇人脸检测的文章是基于OpenCV的CascadeClassifier来实现的,基于OpenCV实现人脸检测。这次我们来探讨如何通过Googlevision来实现人脸检测。 笔者之前在用Google vision做人脸检测的时候,用的是Google Mob...

weixin_33885253的博客 537

Google AIY Vision Kit 智能相机开发指南

Google AIY Vision Kit 是一款基于树莓派的智能相机开发套件,它结合了树莓派的强大计算能力Vision Bonnet(视觉扩展板)的专用AI加速功能。这个DIY套件让开发者能够轻松构建具备计算机视觉能力的智能设备,是学习人工智能和嵌入式视觉系统的绝佳平台。 ## 核心组件解析 ### 硬件架构 1. **Vision Bonnet视觉扩展板**: - 主控芯片:My...

gitblog_00050的博客 569

Google Vision面部识别(Android)

为什么80%的码农都做不了架构师?>>> ...

weixin_33863087的博客 1020

【亲测免费】 Google Cloud Vision 项目下载及安装教程

Google Cloud Vision 是一个开源项目,提供了使用 Google Cloud Vision API 的示例代码。该项目包含了多种编程语言和移动平台的示例,帮助开发者快速上手并集成 Google Cloud Vision API 到他们的应用中。示例代码涵盖了图像识别、人脸检测、标签检测等功能。 ## 2. 项目下载位置 要下载 Google Cloud Vision 项目,可以...

gitblog_01285的博客 1067

ZXing图像处理库比较:ZXing vs ZBar vs Google Vision

ZXing("Zebra Crossing")是一个开源的条形码扫描库,支持多种1D和2D条形码格式。目前项目处于维护模式,主要通过社区贡献的补丁进行更新,仅考虑错误修复和 minor 增强。本文将对ZXing与其他主流条形码处理库ZBar和Google Vision进行详细比较,帮助开发者根据项目需求选择合适的解决方案。 ## 库基本信息对比 ### 核心概述 ZXing是一个用Java实...

gitblog_01178的博客 699

PDF补丁丁:终极PDF元数据编辑与文档管理解决方案

PDF补丁丁是一款功能全面的PDF工具箱,专为需要深度编辑和管理PDF文档的用户设计。它不仅能编辑书签、剪裁页面、解除限制,更重要的是提供了专业的PDF元数据编辑功能,让您能够精准修改文档的作者、标题、主题等关键信息。无论您是普通用户需要整理个人文档,还是专业人士需要批量处理工作文件,PDF补丁丁都能提供高效便捷的解决方案。 ## 📋 常见问题:为什么需要专业的PDF元数据管理? 在日常工作

gitblog_01277的博客 632

探索未来视觉Google Cloud Vision API 示例项目解析

随着人工智能的蓬勃发展,图像识别技术已经成为解锁数据洞察的关键。今天,我们要向您介绍一个曾经备受瞩目的项目——**Google Cloud Vision API 示例**。虽然这个仓库本身已经标记为不活跃,但它留下了宝贵的财富,引导开发者们步入智能视觉处理的殿堂。让我们一起深入了解这一宝藏库,即便它已迁移至各语言特定的存储库中,其价值仍然不容小觑。 ## 项目介绍 Google Cloud V...

gitblog_00356的博客 961
上一篇: 利用Google AIY Vision Kit 自制人类检测器(上)
下一篇: 载誉而归!Gravitylink荣膺第九届中国财经峰会“最具创新力企业”奖项!
钛灵科技
博客等级 码龄9年 152粉丝 76原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值