当前标签:计算机视觉

FacialRecognition.app

FacialRecognition.app

FacialRecognition.app是一款基于AI人脸搜索的应用,可通过照片快速找到目标人物的社交媒体账号。

入选ECCV 2026!清华开源空间模型打败Gemini:真正的空间智能是在世界变化中持续学习

入选ECCV 2026!清华开源空间模型打败Gemini:真正的空间智能是在世界变化中持续学习

清华大学与要求。清华与腾讯混元联合提出的GEM框架GEM,通过在视觉语言模型预训练中引入深度图生成任务,在空间推理上超越Gemini 2.0等模型,并开源。

又一百亿估值独角兽诞生!AI软件监控创企拿下新融资,去年年化营收破6亿

又一百亿估值独角兽诞生!AI软件监控创企拿下新融资,去年年化营收破6亿

AI软件监控赛道跑出第13家百亿独角兽,计算机视觉创企Netradyne以13.5亿美元估值完成9000万美元融资,其年化营收已突破6亿人民币大关,押注车队安全与行为分析的精细化市场。

让智能体看见世界:CV × AI Agent 的行业场景新实践

让智能体看见世界:CV × AI Agent 的行业场景新实践

让智能体“看见”世界,不只是给AI装上摄像头,而是通过计算机视觉与自主决策的融合,在真实产业场景中释放乘数效应。

GeoEvident

GeoEvident

GeoEvident是一个用于法证室内外照片识别和调查证据的人工智能地理定位平台。

DanceBetter

DanceBetter

DanceBetter 是一款基于人工智能的舞蹈教练工具,通过实时动作分析帮助你精准提升舞技。

美图AI视觉大模型

美图AI视觉大模型

美图AI视觉大模型是美图推出的一项智能美学AI视觉技术,融合人工智能与图像美学,服务于多场景视觉创作需求。

刚刚,李飞飞世界模型新成果发布

刚刚,李飞飞世界模型新成果发布

斯坦福教授李飞飞创业公司World Labs发布最新空间智能模型Marble,输入一张图像或提示词即可生成更大、更清晰、风格多样的3D世界。

中国图象图形学学会

中国图象图形学学会

中国图象图形学学会是专注于图像图形学科发展与应用推广的全国性专业学术组织。

1毫秒级,最快的人体动作捕捉服,开源715万帧数据集

1毫秒级,最快的人体动作捕捉服,开源715万帧数据集

人体动作捕捉技术实现毫秒级精度,同时开源包含6000万帧的超大数据集

Digital-Standard(Windows版)

Digital-Standard(Windows版)

Digital-Standard(Windows版)是一款仅用普通相机即可实现高精度全身追踪的解决方案。

人脸融合

人脸融合

人脸融合技术可将指定人脸特征智能融合至模板人物,生成自然逼真的换脸效果。

天目

天目

天目是一个集成了高精度视觉识别技术的智能系统。

阿里云天池大赛

阿里云天池大赛

阿里云天池大赛是一个汇聚全球开发者的AI算法竞赛平台,提供海量赛题、丰富数据集和高额现金奖励,助力技术提升与行业创新。

Caffe

Caffe

Caffe 是一个表达强大、高速的深度学习框架。

Segment Anything

Segment Anything

Segment Anything 是 Meta AI 推出的革命性图像分割模型,能够通过简单的交互(如点击或框选)实现对图像中任意物体的精准分割。

百度识图

百度识图

以图搜图、智能识别与相似图片搜索工具,上传图片即可快速查找全网信息。

T-Rex Label

T-Rex Label

T-Rex Label 是一款开箱即用的 AI 智能数据标注工具,专注于快速构建高质量标注数据集。

ARC实验室

ARC实验室

ARC实验室是腾讯PCG专注于智能媒体前沿技术探索的核心研究团队。

ControlNet

ControlNet

ControlNet 是一种用于精细控制 AI 图像生成的神经网络架构。