光鉴科技的反卷思维,让科技不再难做

自主创新,是科技企业的必然选项,亦是资本寒冬下逆向而行的风向标。

光鉴科技的反卷思维,让科技不再难做

文 | 智能相对论

作者 | 陈壹

中国企业的全球竞争力,正从“拼人力、拼产能”转为“拼技术、拼创新”的新阶段。据世界知识产权组织发布的《世界知识产权指标报告》显示,2022年中国专利申请量约160万件,排名世界第一。而在最近发布的全球百强科技创新集群排名中,中国百强科技创新集群数量,也首次跃居世界第一。

在资本市场中,自主创新的企业并不受限于所谓「资本寒冬」的桎梏。近期,刚完成2亿元人民币B轮融资的光鉴科技,正是乘着“技术创新”转换成商业价值、产业价值而得到资本的青睐。

“依靠底层技术创新,突破专利封锁,并已经实现商业落地。”科兴科创投资负责人陈彦伯表示,光鉴科技的创新技术和商业化平衡也给资本市场带来不一样的投资体验。

可见不管从全球竞争,还是企业发展来看,自主创新正变得越来越重要,甚至成为必选项。那么坚持自主创新,到底意味着什么?

创新不止,从打破行业壁垒到不断拓宽技术边界

所谓自主创新有两层含义,一是创新,二是技术自主,两者缺一不可。这是产品的需要,更是商业落地的需要。尤其是在越来越复杂的国际形式中,技术如果不自主,也很难有真正的创新,进而拥有更大的商业价值。

2017年,苹果在iPhone X中推出Face ID功能,3D结构光技术首次被大规模应用到消费级市场,这对全球3D视觉产业来说,无疑是一个产业拐点。但要想抓住机会分享技术变革的红利,却还要靠技术自主。

遗憾的是,苹果公司的技术自主显然对国内企业不是友好的。苹果“VCSEL(垂直腔面发射激光器)+DOE”3D结构光方案有全方位的“专利保护”,让国内企业拥有“产业机会”的同时,也带来了专利风险与供应链壁垒。

若按照惯例,产品研发方向沿着“苹果方案”走,针对应用层面小幅度升级,永远只是“追赶者”。并且模仿并不存在实质的壁垒,产品将趋于同质化,行业的一众模仿者在一开始就会出现必然的内卷。换一个视角,这也意味着技术面前不存在什么「将就」的中间选项,当涉及到壁垒问题,“自主创新”则是这道题有且唯一的最优解。

破而后立,不生则死。

因此,光鉴科技也正式开启了反卷之路——“EEL(边发光激光器)+WFP(纳米光子芯片)”方案,不仅打破了苹果技术的专利壁垒,且相比苹果方案效率更高,成本更低,更实现了核心元器件的国产化,从而有效推动了国内从技术到供应链的发展。

光鉴科技的反卷思维,让科技不再难做

(光鉴科技“EEL+WFP”方案示意图)

之后,光鉴科技以该方案为基础,联合中兴打造了首款真全面屏手机,打破苹果户外10万Lux性能要求,并与OPPO共同推出柔性OLED屏下3D概念手机,让国内企业在争夺全球技术制高点也有了“更多自主选择权”。

光鉴科技的反卷思维,让科技不再难做

(首款柔性OLED屏下3D概念机)

与手机端的合作,最大意义在于中国技术企业打破了技术模仿的刻板印象,用领先苹果方案的技术壁垒和测试数据,佐证了光鉴科技有能力领先于国际的技术水准。

另外,市场的需求也正在拓宽科技企业在不同赛道里的成长空间,而自主创新也成为光鉴科技乘上追击的优势,使其实现一加一大于二的效果。

光鉴科技自研的sToF技术,仅通过一组光学硬件,使机器人可以完成结构光和ToF深度重建,实现近距离超高精度和中远距离的高精度3D成像。结合光鉴的3D视觉感知的能力,用底层的原理性创新实现了性能、成本双突破。

机器的视觉还不局限于人眼可以感知的维度,在对应空间的三维之外,还有偏振、相位等更多极具价值的物理信息,超越3D的多维视觉是人工智能感知世界的未来发展方向。因为多维视觉不仅能够准确捕捉目标物体的外在形貌,还可以对于内部的纹理进行成像。例如可以同时捕捉手掌的掌纹和掌静脉图像,应用于更安全和便捷的生物识别场景。

今年5月,搭载由光鉴科技提供硬件支持的微信刷掌闸机设备落地于大兴机场全线,意味着刷掌支付时代正式到来。紧随其后,该项技术已经在交通、运动、校园、零售、餐饮、办公、共享充电等多个场景落地,不断拓宽刷掌技术的应用边界。

光鉴科技的反卷思维,让科技不再难做

(北京地铁大兴机场线乘客刷掌坐地铁)

可以看到,正是通过不断坚持自主创新,光鉴科技如今不仅有了“立身之本”——成为行业领先的3D视觉技术解决方案提供商。也找到了其更大的“发展之道”——通过自主创新,做万物互联时代,数字世界到真实世界的视觉信息链接者。

除了创新,光鉴科技没想过其他选择

坚持自主创新,做业界领先甚至是首创的事,当然很酷,但风险也很高。但在光鉴科技看来,科技公司若不创新,便没有存在的意义。

一方面,在逆全球化大趋势下,不从基础领域的科技创新,只是上层应用创新,很容易被针对、“卡脖子”。另一方面,中国科技快速发展,在很多领域已经走在全球前列,前面已经没有“模仿者”,只能去做“开创者”。在这两大背景下,自主创新就成了必选项。

参与光鉴科技多轮融资的一村淞灵总经理刘涛就表示,在逆全球化背景下,科技自主、供应链自主闭环显得尤为重要。这也是其看好光鉴科技的原因——以朱力博士为代表的核心创始团队,集技术、产品、工程于一身,从“刷脸”到“刷掌”,从“屏下3D感知”到“3D视觉基础设施”,充分体现了他们作为优秀科技人才创业的商业嗅觉。

光鉴科技的反卷思维,让科技不再难做

(光鉴科技行业解决方案与商业落地领域)

而光鉴科技在“感知周期”积累的足够的经验与能力,光鉴团队具备的大厂基因与国际视野,也让其相信光鉴科技在AIoT时代能不断实现自我突破。因为他们不向市场内卷,而向技术外卷要答案,即瞄准市场需求和痛点,更务实地进行创新。

从“刷脸支付”到“刷掌支付”就是很好的例子。从现阶段来看,刷脸支付已经成为主流的移动支付方式,但不管从便捷性和用户体验上,仍有升级的必要性。

相较于刷脸支付,刷掌支付具备更高的主动性,不存在对准摄像头这个行为动作限制,仅通过伸出手掌即可支付。与此同时,刷掌支付设备并不一定需要屏幕做交互,既节省了空间成本,也降低了硬件成本,使其拥有进入更多场景的可能性。

光鉴科技的反卷思维,让科技不再难做

(刷掌闸机应用场景)

所以,光鉴科技的创新不是要解决一个新创造的问题,而是去思考世界上,有哪些充分有价值的问题解决得不够好,然后用更有效的方法去将其解决。

这一问题在智能座舱领域也有所体现。光鉴科技推出软硬件一体化的3D视觉智能座舱解决方案,使座舱交互进化为结合视觉、声音、听觉等感知的全座舱智能交互。这种升级并不是要打破现有智能座舱的格局,而是以3D视觉感知为基础,让驾乘人员获得更加智能、便捷、人性化的体验,这也是光鉴科技认为智能座舱的意义所在。

光鉴科技的反卷思维,让科技不再难做

(光鉴科技车规级3D深度相机)

这种思维范式,让光鉴科技对市场拥有更深的了解,使技术更好地赋能于行业与用户,不再是为了所谓的创新而“创新”,从而实现技术创新到商业落地的完美闭环。

不以竞争对手为导向聚焦创新反而没对手

众所周知,3D视觉被称为第四次视觉革命,是智能设备上的“智慧之眼”,目前已被广泛用在手机、汽车、支付、机器人等诸多领域,成为高速增长中的千亿大市场。

市场很大,但也很卷。那怎么破除“内卷”的呢?光鉴科技的答案是——不把精力放在竞争对手上,不为销售额去“无效内卷”,而是聚焦技术创新,死磕市场需求,这让其在关键业务上“没有对手”。

所谓的“没有对手”,并不是指没有同行竞争,而是通过自主创新走出一条属于光鉴科技自己的路。

事实上,3D视觉领域链条很长、可选择的差异性也很多,企业可以从硬件发力,也可以从软件入手,既能从光学领域突破,也可以在算法和计算上做文章,都能分得一杯羹。

但光鉴科技选择全链条发力自主创新,全栈技术布局。通过将光学传感、智能感知、感知计算三个方向相结合,形成光学+软件+硬件完整系统,在不同场景中为人工智能提供共性的视觉感知能力,使技术更快、更好的实现商业化落地,也更适合市场需求,这些构成了光鉴科技的核心竞争力。

能做到这一点,一方面,是三个创始人分别是美国加州大学伯克利分校和斯坦福大学的博士,本身在光学和算法领域有很深的积累;另一方面是光鉴科技拥有顶级的光学与3D视觉团队,其中80%的员工都是研发人员,且都来自国内外一流院校,有优秀的产业经验和创新能力。

但最重要的是,光鉴科技以技术第一性原理选择方向,以更少的产品线,提供更多的服务,适配更多场景。这其中的主要原因是,光鉴科技专注解决智能设备与人和物理空间交互,总结技术共性,创造出最大公约数的技术路线,造就更高效的自主创新发展方向。

这也是光鉴科技被资本看好的理由之一。科兴科创投资负责人陈彦伯就表示,3D视觉是感知层在AI时代数据重塑的重要接入口,3D视觉技术在移动支付、消费电子、汽车座舱、机器人等垂直场景具有高度复用性,也能为用户提供前所未有的交互体验。而光鉴科技凝聚光电产业链内顶尖的团队,依靠底层技术创新,突破专利封锁,并已经实现商业落地,光鉴科技将成为 3D 视觉行业领军企业。

简单来说,光鉴科技不仅踏上万物互联视觉基础设施这条“没有对手”的创新道路,还在技术和商业落地上,证明自己是一辆能快速前进的“列车”,又在人才储备上积攒了“厚积薄发”的动力,自然就成了资本和市场的“香饽饽”。

结语

同为清华大学校友的美团创始人王兴曾说过,找到用户需求基本方向和技术变革方向之间的交集,才有可能冲上时代的“浪潮之巅”。

回顾光鉴科技的发展,从手机行业的屏下3D技术,到支付领域的刷掌支付,再到机器人和汽车智能座舱的空间交互。每次都精准踏在了市场需求与技术变革的结合点上,并用实力接住一波又一波的时代浪潮。

如今随着感知的成熟、算法和计算的逐渐完善,3D视觉技术已成为万物互联时代的视觉感知基础。坚持自主创新的光鉴科技,作为视觉信息的链接者,也正凭借其100%自主可控的3D视觉技术,迎来万物互联时代的大舞台,不断走向智能感知时代的“浪潮之巅”。

*本文图片均来源于网络

此内容为【智能相对论】原创,

仅代表个人观点,未经授权,任何人不得以任何方式使用,包括转载、摘编、复制或建立镜像。

部分图片来自网络,且未核实版权归属,不作为商业用途,如有侵犯,请作者与我们联系。

•AI产业新媒体;

•澎湃新闻科技榜单月度top5;

•文章长期“霸占”钛媒体热门文章排行榜TOP10;

•著有《人工智能 十万个为什么》

•【重点关注领域】智能家电(含白电、黑电、智能手机、无人机等AIoT设备)、智能驾驶、AI+医疗、机器人、物联网、AI+金融、AI+教育、AR/VR、云计算、开发者以及背后的芯片、算法等。

主题测试文章,只做测试使用。发布者:智能相对论,转转请注明出处:http://www.zgtmt.com/?p=25663

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2024年1月10日 下午11:42
下一篇 2024年1月11日

相关推荐

  • 化妆品公司侵权赵丽颖被强执30万

    #两公司侵权赵丽颖被强执30万# 天眼查法律诉讼信息显示,7月16日,广东万禧生物科技有限公司、广州蓓茵生物科技有限公司及何某、刘某新增一条被执行人信息,执行标的30万余元,涉及赵丽颖与上述被执行人相关人格权纠纷案件,执行法院为佛山市三水区人民法院。案件流程信息显示,该案已于去年多次开庭。 广东万禧生物科技有限公司、广州蓓茵生物科技有限公司分别成立于2019…

    2024年7月17日
  • #上海临港等成立创投合伙企业# 出资额2.9亿

    天眼查App显示,近日,上海临港策源创业投资合伙企业(有限合伙)成立,执行事务合伙人为上海临港数科私募基金管理有限公司,出资额2.9亿人民币,经营范围为创业投资。合伙人信息显示,该基金由上海临港、临港数科基金共同出资。 天眼查信息:https://www.tianyancha.com/company/7101080645

    2024年8月29日
  • 全球唯一的付费制会员电商,开辟了一条“新道路”

    在零售行业的版图之上,以品质和服务为核心的会员店模式正加速崛起。 放眼国内市场,山姆线下会员店业绩持续增长,斩获了大量高复购率的忠实消费者,更是以一己之力带动了在全球不断关店的沃尔玛。 在线上,会员制模式的潜力也得到了验证。经过四年时间,作为全网唯一的付费制会员电商, 1号会员店目前已经拥有近300万付费会员,而它将电商与付费会员制相互融合的模式,正在开辟出…

    2024年9月14日
  • 率先全面开放,文心一言为何一骑绝尘?

    率先全面开放,文心一言为何一骑绝尘?

    摘要: 大模型在国内正掀起新一代技术浪潮。

    连续两天,半夜爆出大消息。先是华为新机深夜上线,让芯片国产替代的步伐更进一步;次日晚,百度文心一言官宣向公众全面开放——两大劲爆消息直接点燃科技圈。

    8月31日凌晨,百度官方公众账号即发布推文,称“文心一言向全社会开放”,用户可以在应用商店下载“文心一言APP”或登陆“文心一言官网”体验。包括百度文心一言在内,一共有8个企业/机构的大模型位列第一批名单,可以正式上线面向公众提供服务,值得注意的是,被看作文心一言竞争者的阿里通义千问、360智脑、讯飞星火等,不在首批获批名单中。

    随后“文心一言APP”在各大应用商店冲上热榜,在苹果App Store上更是直接登顶免费榜榜首,成为当日热门应用,这无疑让百度再一次占得了先机。

    此前,在获得备案审批之前,各家只能小范围内测,用户需要“排队”申请内测资格,由此大大限制了大模型在用户层面的推广,如今大模型备案获批和全面开放,大模型的步伐有望迈入下一阶段。

    秉持着技术自主的理念,将资金大规模倾斜到自主技术研发的百度和华为,可以说是殊途同归,而软硬件领域的“双子星”联袂,共同推动技术投入走向“开花结果”。

    技术坚守,换来厚积薄发

    大模型在国内掀起新一代技术浪潮,迅速席卷了整个互联网,而百度在大模型赛道上的步伐一直领先。2019年第一个发布了文心大模型,2023年,大厂中最早推出大语言模型“文心一言”,如今又率先获批、得到认可,正式向全社会开放。

    百度之所以快速踩在了大模型的全球性技术风口上,是建立在百度雄厚的技术基底之上。

    早从2010年开始,百度就已经着手布局AI相关技术的研发,近十年来,累计研发投入超过 1400 亿元。其中2022 年研发费用高达 214.16 亿元,占百度核心收入比例达到 22.4%。与全球其他大厂相比,这些投入也是数一数二。

    在高研发成本的持续投入下,这些年从最初探索深度学习等基础技术,到推动AI在互联网等场景试点落地,再到如今扎根千行百业、大力推进AI工业化大生产等,百度既完成了在芯片、框架、模型和应用四层构架对应的自研技术积累,具备了做AI基础设施供给者的前提条件,又成功引领了AI技术成果在产业层面的实践,降低了人工智能的开发和应用门槛。

    2222222222222222

    这也使得百度无论在技术专利、技术产品还是技术应用上,都占据了领先地位。以专利来看,根据由国家工业信息安全发展研究中心、工信部电子知识产权中心发布的《中国人工智能专利技术分析报告(2022)》显示,百度AI专利申请量1.68万件,连续五年保持中国第一;专利授权量上,百度仍以5705件专利授权量位列第一。

    文心一言大模型,正是百度多年技术积累和产业实践的水到渠成,而基于技术和实践的领先优势,文心一言问世不到半年,在国内外多家调研机构、权威媒体和高校等发布的大模型评测报告中,表现优异。

    33333333333333

    如IDC最新发布的《AI大模型技术能力评估报告,2023》,报告显示,百度文心大模型3.5拿下12项指标的7个满分,综合评分第一,算法模型第一,行业覆盖第一。其中算法模型是大模型能力最为核心的要素,百度文心大模型在这一维度获得了唯一的满分。

    更令外界欣喜的是,从测评来看,百度文心一言大模型能力从5月至今不断提升,正在逐渐赶上国外大模型。

    百度「AI大底座」的全栈能力,助力文心一言进化

    31日凌晨全面开放后,百度文心一言APP迅速飙升至苹果商店免费榜榜首,成为首个登顶应用商店榜首的中文AI原生应用。

    用户的反响,透露出他们对文心一言表现出的强劲进化能力的期待。自今年3月发布至今,文心一言快速成长,熟练掌握的创作体裁超过200个,内容丰富度是发布初期的1.6倍,思维链长度是初期的2.1倍,知识点覆盖达到初期的8.3倍。在一些公开测评中,文心大模型3.5版支持下的文心一言中文能力突出,甚至有超出GPT-4的表现。

    444444444444444

    这很大程度上得益于百度飞桨,百度拥有自研的深度学习平台飞桨,它有力支撑了大模型的高效训练和推理。通过飞桨端到端自适应混合并行训练技术以及压缩、推理、服务部署的协同优化,文心大模型训练速度达到原来的3倍,推理速度达到原来的30多倍。

    飞桨和文心一言,一个是框架平台,一个是大模型,这两者之间正好处在人工智能技术体系里面很重要的两层,它们之间有很强的协同优化潜力,由此飞桨领先的训练技术,能够优化大模型的训练效率。

    百度不单单在框架层和模型层拥有关键技术。进入人工智能时代,IT技术的技术栈发生了根本性变化,从过去三层转变为“芯片-框架-模型-应用”四层,百度则是全球为数不多、进行全栈布局的人工智能公司。从高端芯片昆仑芯,到飞桨深度学习框架,再到文心预训练大模型,及搜索、智能云、自动驾驶、小度等应用,各层都有领先业界的关键自研技术。

    5555555555555

    如框架层上,百度从2016年就开源了飞桨深度学习框架,目前这一框架已经集成了深度学习核心训练和推理框架、基础模型库、端到端开发套件等工具组件,在中国市场份额中排行第一。

    全栈布局的优势在于,可以在技术栈的四层架构中,实现端到端优化,大幅提升效率,飞桨和文心一言的优化,就是最典型的例子。另外,芯片、框架、大模型和终端应用场景,也可以形成一个高效的反馈闭环,帮助大模型不断去调优迭代,越做越好。

    比如文心一言与搜索、信息流等应用层的协同。百度的搜索服务,每天响应几十亿次真实的用户使用需求,每天进行1万亿次深度语义推理与匹配,能够提供最真实、最及时的反馈,从而倒逼大模型、深度学习框架和芯片的优化。相对地,文心一言应用于搜索,也将带来搜索的变革。

    除了全栈自研的「AI 大底座」,百度智能云推出的两大AI工程平台—「AI 中台」和「百度百舸· AI 异构计算平台」,也分别在开发和资源层面进行提效,加速训练过程。这给文心一言的成长提供了最坚实的技术支撑,也成为其追赶国外大模型的底气。

    核心能力升级,百度加速大模型落地时代到来

    5月底举行的2023万象·百度移动生态大会上,百度搜索宣布“AI伙伴”开始内测。这款全能的“Al伙伴”能够听懂用户的任何问题,并用语音进行互动,还能帮助用户标记答案中的重点,提供权威的来源。在演示中,“Al伙伴”完整地提供了一篇人工智能大会主持词。

    百度旗下各类用户侧产品正在利用大模型进行重构,而基于大模型基座和云平台进行开发生态的建设也在同步推进。前不久,百度承办的2023 WAVE SUMMIT上,推出了“超级助理”和“Comate X智能编程助手”。

    理解、生成、逻辑和记忆,构成了一个人工智能或者通用人工智能系统最基本的能力,从文心一言在C端及B端应用上的表现来看,这四大核心能力正在快速提升,而背后展示出的则是百度在知识增强、检索增强、对话增强方面的关键技术能力和差异化优势。

    庞大的知识图谱和搜索基础上对真实数据和用户需求的理解,是百度多年来构建技术护城河和打造内容生态的基础,因而作为百度自主研制的知识增强大语言模型,文心一言在知识增强和检索增强方面天然具有优势。

    据悉,百度文心大模型拥有世界上最大规模知识图谱,包含50亿实体、5500 亿级事实,每天调用量超过400亿次。

    在对话增强方面,百度深耕对话技术多年,前不久,王海峰带领团队完成的「知识与深度学习融合的通用对话技术及应用」成果,荣获了「2022 年度吴文俊人工智能科技进步奖特等奖」,这是该奖项设立以来颁发的首个特等奖。对话技术所涉及的记忆机制、上下文理解和对话规划能力,能够帮助文心一言实现更好的对话连贯性、合理性和逻辑性。

    百度已经构建了面向中文、服务应用、富含知识的多样化训练数据,并建立起人类反馈、奖励模型和策略优化之间的飞轮机制,随着真实用户的反馈越来越多,文心一言的效果会越来越好,能力也越来越强。

    而今,文心一言率先面向用户全面开放,也就说未来能获得更海量的真实世界中的人工反馈,这将进一步改进基础模型,助力文心一言加速迭代、提升能力。而且,对用户层面的放开,会刺激大模型竞争焦点转向应用层,激起应用开发的创造活力,基于文心一言的领先,百度未来或将率先带来杀手级应用,真正引领大模型进入落地时代。

    这亦是用户想从这场技术性浪潮看到的,弯道超车,占领新一代技术变革的制高点。

    道总有理,曾用名歪道道,互联网与科技圈新媒体。同名微信公众号:道总有理(daotmt)。本文为原创文章,谢绝未保留作者相关信息的任何形式的转载。

    2023年9月1日

发表回复

您的电子邮箱地址不会被公开。 必填项已用*标注

联系我们

邮件:939297903@qq.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信