首页
学习
活动
专区
圈层
工具
发布
首页标签计算机视觉

#计算机视觉

RK3576/Orin + Gemini335 机器人视觉专题(三) CameraInfo 内参详解:像素坐标如何反投影成 X/Y/Z

散帅集合

这次实测中,从 /camera/color/camera_info 读取到的内参为:

200

OpenAI又走了一员大将,这次腾讯要的是多模态命脉

不惑

腾讯云TDP | 产品KOL (已认证)

清华本科,港中文MMLab硕士。硕士导师是汤晓鸥教授和王晓刚教授,这俩名字在计算机视觉圈里分量不言而喻。汤晓鸥教授后来创办了商汤科技,可惜2023年底离世了。

5110

顶刊再突破!实验室在TPAMI 2026上发表文章

Amusi

近日,西南财经大学新财经综合实验室最新的研究成果“A General Image Fusion Approach Exploiting Gradient Tra...

5310

研究院9篇论文获TPAMI、IJCV、ECCV 2026录用

Amusi

IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)由 IEEE Com...

5910

RK3576/Orin + Gemini335 机器人视觉专题(二) 从 Depth 图到目标距离:不用 YOLO,先用 fake bbox 跑通测距

散帅集合

等这条链路跑通后,下一篇只需要把 fake bbox 替换成 YOLO 检测出来的真实 bbox。

11910

从视频检测到机器人视觉 RK3576 / Orin + Gemini335 + YOLO 机器人视觉开发合集导读

散帅集合

很多人从传统视频、安防、FPV 图传、嵌入式视觉开发转到机器人视觉时,都会遇到一个共性问题:

10210

从视频检测到机器人视觉 RK3576 / Orin + Gemini335 + YOLO 机器人视觉开发合集导读

散帅集合

很多人从传统视频、安防、FPV 图传、嵌入式视觉开发转到机器人视觉时,都会遇到一个共性问题:

10210

《Image Generators are Generalist Vision Learners》深度解读:当“生成”开始取代“识别”,计算机视觉正在进入世界模型时代

heidsoft

论文地址: arXiv 原文:https://arxiv.org/html/2604.20329v2

14910

Python 3.13降级到3.11:一次d2l库安装的踩坑与解决全记录

AI重构职业生涯探索

最近我在跟随bibi博主 李沐学习深度学习时,遇到了一个典型但又令人头疼的问题:在Python 3.13.13环境下安装d2l库时,反复出现各种版本兼容性错误,...

13900

融合“身份证识别+活体检测+数据比对”的人脸核身技术,赋能政务、金融、民生、互联网等多个领域的数字化实名认证场景

中科逸视OCR专家

人脸核身技术并非简单的图像比对,而是一套融合了计算机视觉、深度学习与生物特征识别的复杂系统工程。其核心原理可概括为以下三个关键环节:

40710

【开源项目推荐】这个ai追踪系统让视觉跟踪变得如此简单!

小开 ALSKai

SAMURAI是一个创新的计算机视觉追踪系统,它基于Meta最新发布的SAM 2(Segment Anything Model)模型开发。该系统通过结合运动感知...

12400
领券