首页 / 行业
Nomad AI计划开发适用于更广泛音频识别的应用
2021-01-25 12:52:00
Nomad AI由法国人Vivien Seguy于2018年创立,运营着三个App:和弦自动识别 Chord AI、图片识别词典Yomiwa(日语)和HanYou(中文)。公司注册于爱沙尼亚,得益于其e-residency政策(无论你实际居住在哪里,都可以在爱沙尼亚创建一家公司,并在线管理),Vivien可以一边工作一边旅行。现由于疫情原因回到家乡法国中部的克莱蒙费朗Clermont-Ferrand,办公室设在联合办公空间Turing 22。
Vivien 拥有法国巴黎综合理工学院(École Polytechnique)数学与计算机科学学士学位、英国帝国理工学院应用数学硕士学位,日本京都大学机器学习博士学位。Chord AI、Yomiwa和HanYou的iOS版属于Vivien的公司Nomad AI,他现在全职运营这三个App。Guillaume Bellec现任洛桑联邦理工学院(École Polytechnique Fédérale de Lausanne EPFL)博士后研究员,Chord AI的Android版在他注册的公司Bellec Research名下;Antoine Rolet目前在东京做自由软件工程师,Yomiwa和HanYou的Android版由他注册的公司管理。
进入博士项目前,Vivien已开始着手制作一个日语OCR(光学字符识别)应用。后于博士期间结识Antoine Rolet,正式开始开发日语词典Yomiwa,并进一步将其改编成中文词典HanYou。两个App分别发布于2013年和2014年,是最早的几款具有OCR功能的应用之一,甚至早于谷歌翻译。在Apple Store和Play store上有很多日语和中文词典的应用,以Pleco为代表,Pleco内容更加丰富,得益于其多年来与专业词典编辑的合作关系。Vivien表示,Yomiwa和HanYou是唯一具有光学识别、形态文字分析、手写识别、自动从新闻中获取词表等独特功能的词典应用,并计划进一步充实词典内容。Yomiwa和HanYou可以免费下载使用,一些特殊功能,如相机OCR或全自动每日单词列表,需要通过购买 “专业版 ”来解锁。模式为单次付费,而非会员制。
音频识别是Vivien更感兴趣的领域。博士期间Vivien和Antoine Rolet一起做了一个关于盲源分离的研究项目,目的是将混合的声音从单一的录音中分离出来。同时,Vivien的合伙人又发表了一篇名为 “Spectral Optimal Transport ”的论文,利用Vivien的研究课题--最优传输来建立一个钢琴音符识别算法。后来,Vivien在ICLR2018会议上认识了另一位博士生Guillaume Bellec,他也是一位业余音乐人,他们开始一起讨论如何实现这个想法,Chord AI项目由此才正式开始。
Chord AI利用机器学习算法自动识别音乐中的和弦、调性、节拍等,可以从本地文件、麦克风、甚至在同一设备中播放的YouTube上来获取音频。Vivien强调了大量准确标注数据的重要性。几个创始人最开始在公开的注释数据集(如Isophonics、JAAH和Billboard )训练算法,数据在数量和质量上非常有限,无法达到目标精度,Vivien希望能够实现在和弦识别方面远超最新研究论文中的最先进结果。因此他们很快就开始建立自己的数据库,并自己对音频进行标注,还对音乐进行程序化合成。他们还专门做了一个私人的iOS应用,专门用来简化用和弦和节拍注释歌曲的过程。因此,Vivien表示Chord AI在识别和弦精度上高于同类公司,如Chord Tracker和Chordify;Yamaha的应用 “Chord Tracker ”似乎比Chordify或MyChord精度更高,但它只能从本地文件中获取音频。Chord AI现可以免费下载和使用大部分功能。一些特殊的功能,如高级和弦识别或音高转换,需要解锁 “专业版”才能使用。费用为10美元/次(截至2021年1月),并不是会员模式。
Chord AI的iOS和Android版本共有约15万活跃用户,日下载增量1000次(大约50%在美国,30%在亚洲,20%在欧洲)。每天在这1000个新用户中,约有5%的用户最终购买了 “专业版”。Vivien表示,Chord AI在法国约有200-300万潜在用户,世界范围内潜在用户超过1亿。Yomiwa的iOS和Android版本共有约30万活跃用户,日下载增量300次,约有2%的新用户最终购买了“专业版”。 HanYou的iOS和Android版本拥有约3万活跃用户,日下载增量50次,约有3%的新用户最终购买了“专业版”。2020年,Chord AI、Yomiwa和HanYou的营业总额约为10万美金。Vivien预计三个App的总营业额在2021年至少能翻三倍。
Vivien正在筹划与Guillaume一起围绕Chord AI成立一个初创公司,并开发另一个不仅限于音乐,而是适用于更广泛音频的应用。总部将位于欧洲,但没有确定具体的城市。目前Nomad AI还没有融过资,前期费用都由创始人承担。现计划为新初创公司筹集100万欧元,用于团队建设,增添一名COO、一名CMO、两到三名机器学习工程师。
责任编辑:tzh
最新内容
手机 |
相关内容
电流互感器作用 电流互感器为什么
电流互感器作用 电流互感器为什么一端要接地?,作用,误差,原因,连接,测量,短路故障,电流互感器(Current Transformer,简称CT)是一种用于新一代8通道脑电采集芯片研制成功,
新一代8通道脑电采集芯片研制成功,铠侠与西部数据已中止合并谈判,合并,芯片,脑电,新一代,通道,产品,近日,一项重要的科技突破在全球范语音芯片故障的原因简述
语音芯片故障的原因简述,原因,故障,芯片,语音,温度,确保,TS5A3157DCKR语音芯片是一种集成电路,用于处理和识别语音信号。通常由数字DigiKey 凭借品牌更新荣获四项 Mar
DigiKey 凭借品牌更新荣获四项 MarCom 大奖,四项,机构,明尼苏达州,公司,行业,产品,全球供应品类丰富、发货快速的商业现货技术元件什么是同步检波器,同步检波器的基本
什么是同步检波器,同步检波器的基本结构、 特点、工作原理、应用、安装要点、 常见故障现象及原因,同步,工作原理,安装,现象,结构,芯朋微:服务器配套系列芯片已通过客
芯朋微:服务器配套系列芯片已通过客户验证 可应用于AI服务器,服务器,客户,芯片,验证,人工智能,公司,芯朋微是一家专注于人工智能芯片什么是气体继电器,气体继电器的基本
什么是气体继电器,气体继电器的基本结构、优缺点、工作原理、应用、如何选用、动作原因及维护建议,继电器,维护,结构,原因,工作原理汽车芯片持续旺盛的需求下,IGBT/MCU
汽车芯片持续旺盛的需求下,IGBT/MCU为何还一芯难求,需求,汽车芯片,用于,原因,控制,芯片,汽车芯片是现代汽车中的重要部件,用于控制和