登录社区云,与社区用户共同成长
邀请您加入社区
MV2DFusion是一个多模态3D目标检测框架,通过融合图像和点云数据进行3D检测。其核心架构包含三个并行分支:图像分支使用Faster R-CNN提取2D特征并生成深度分布Query;点云分支基于FSDV2生成精确3D Query;融合分支通过6层Transformer Decoder整合双模态信息。训练流程包括2D检测训练、RoIAlign特征提取、Query生成和Transformer解码
通过3D工业相机采集点云数据,结合AI算法精准识别,实现±1mm识别精度和±2mm抓取精度
本文介绍了如何创建一个名为pixel_splat的Python 3.10虚拟环境并配置深度学习开发环境。主要步骤包括:1) 使用conda创建环境并安装指定版本的PyTorch(2.7.1)、torchaudio和torchvision;2) 通过环境配置文件(environment.yml)更新环境依赖,包含基础库(如OpenSSL、SQLite等)和Python包(NumPy、Matplotl
项目背景3D 打印技术在制造业、医疗、建筑等领域的应用日益广泛,但打印过程中容易出现缺陷(如拉丝、麻点、粘连等),影响产品质量。传统的缺陷检测方法依赖于人工检查或简单的传感器检测,效率较低且容易出错。基于深度学习的目标检测技术能够自动、高效地识别 3D 打印缺陷,并在实时监控中提供准确的检测结果。项目目标本项目旨在利用 YOLOv10 目标检测算法,构建一个高效、准确的 3D 打印缺陷检测系统。系
本项目基于YOLOv8深度学习框架,开发了一套专门用于3D打印质量检测的智能视觉系统。系统能够准确识别和分类三种常见的3D打印缺陷:spaghetti(杂乱丝状缺陷)、zits(表面凸点缺陷)和stringing(拉丝缺陷)。通过5870张高质量标注图像(训练集4696张,验证集587张,测试集587张)的训练,模型实现了对细微打印缺陷的精确检测。系统针对3D打印的特殊检测需求进行了多项创新优化:
AI+法律:赋能司法提质增效,重塑法律服务新生态
针对3D打印过程中常见的表面缺陷检测需求,本研究基于YOLOv8目标检测算法构建了一套自动缺陷识别系统,用于检测三类典型打印缺陷:spaghetti(拉丝状废料)、zits(凸点)和stringing(拉丝细线)。系统采用4696张训练图像、587张验证图像和587张测试图像进行模型训练与评估。实验结果表明,模型在测试集上的整体mAP@0.5达到0.877,其中spaghetti类别的检测表现最为
相较于传统通用算力芯片,系列产品针对性解决了大模型推理带宽不足、数据延迟高、算力利用率低等行业痛点,在架构创新、性能表现、自主可控、场景适配与规模化落地方面具备差异化核心优势,可为云端大模型推理、高端人工智能算力部署提供高效、安全、可控的底层硬件支撑。整体而言,产品以原创 3D 架构创新为核心,以全栈自研和国产化供应链为支撑,精准切入大模型推理算力刚需,凭借高性能、高可控、高适配、高性价比的综合优
从 NeRF 到 3D Gaussian Splatting:三维重建技术全解一、引言三维重建是计算机视觉的圣杯问题之一。2020年 NeRF 横空出世,用神经网络隐式表示三维场景,取得了惊艳的新视角合成效果。但 NeRF 推理慢(秒级/帧),2023年 **3D Gaussian
摘要:梅卡曼德3D视觉引导系统成功解决汽车制造中螺栓上料难题。针对小尺寸、高反光、散乱堆叠的金属螺栓,系统采用Mech-Eye PRO M工业相机实现亚毫米级成像,结合AI算法实时规划抓取路径,节拍达3s/件。实际应用表明,该方案有效克服环境光干扰和多规格混线挑战,实现99%以上的抓取成功率,助力客户实现全自动化生产,显著提升效率并降低人力成本。系统通过"3D视觉+AI+智能规划"技术闭环,为制造
BEV感知+Occupancy网络:3D目标检测与占据栅格预测一、引言自动驾驶的核心挑战之一是精确理解周围的三维环境。传统2D检测丢失深度信息、LiDAR昂贵且稀疏。**BEV(Bird's Eye View)感知**将多视角相机图像统一变换
一、引言昔者,《庆余年》之热播,引发天下观众之热议。今者,其续作《庆余年2》之中,一场盛大的婚礼更是瞩目。而此婚礼之上,唯一之凤冠,竟出自一款名为Blender之软件之手,辅以3D打印之技术,成就其非凡之美。夫此软件,诞生于三十载前,至今仍能保持其魅力,其背后之奥秘,值得吾辈深入探讨。二、Blender之历史与魅力Blender者,一款开源之3D图形软件也。自上世纪末诞生以来,历经数十载之发展,依
在移动设备上运行复杂的 3D 应用一直是技术难题。一方面,移动设备的硬件性能有限,难以流畅运行复杂的 3D 场景;另一方面,传统的 JavaScript 开发方式在性能上存在瓶颈。WebAssembly 的出现为这一问题带来了新的解决方案。通过 WebAssembly 与 Three.js 的结合,可以显著提升 3D 应用的性能,让复杂的 3D 场景在移动设备上也能流畅运行。那么,WebAssem
本文介绍了RANSAC算法在圆拟合中的应用。RANSAC通过随机选取3个点拟合圆,计算其余点到圆的残差,统计满足阈值的内点数量,迭代寻找最优解。文中给出了Mathematica实现代码,包括三点确定圆的辅助函数和主算法流程。该算法相比最小二乘法对异常点具有更好的鲁棒性,拟合效果更优。代码实现了随机采样、内点统计和最终非线性最小二乘优化等关键步骤,通过可视化验证了其有效性。
当你创建一个自定义造型(Morph)并调整了骨架(Rigging)以适应这个新造型后,你需要确保这两者能够协同工作。仅仅调整骨架是不够的,因为这个调整只在你手动操作时生效。当你把造型滑块从 0% 调到 100% 时,你希望骨架也随之平滑地从原始位置过渡到调整后的位置。这就是 "ERC Freeze to Morph Target" 的作用。"ERC" 代表 "Enhanced Remote Con
本文介绍了在Unity中实现角色平滑动画切换和动作匹配的技术方案。重点内容包括:1) 使用PMX模型转FBX模型并导入Unity;2) 通过InputSystem实现输入控制;3) 采用Character Controller进行角色移动;4) 使用Cinemachine虚拟相机跟随;5) 分享两种移动旋转模式(自由视角和锁定视角);6) 利用Root Motion技术实现动画与位移同步;7) 通
Unity动画系统入门指南 本文详细介绍了Unity中Animation动画页签的各项功能设置,包括: 基础信息设置:涵盖导入约束、动画压缩类型等核心选项,重点讲解不同压缩方式的适用场景。 动画剪辑设置:包括时间轴控制、循环播放选项、根运动配置等,特别强调如何实现动作无缝循环。 曲线功能:演示如何通过动画曲线控制参数变化,实现如角色跑动时特效强弱变化等效果。 动画事件:介绍如何在关键帧添加事件触发
四元数 q 由一个实部 w 和一个三维向量部分 v 组成:其基本规则蕴含了非交换性这里的乘法是叉积。因为 p 在公式中被左右各“操作”了一次,旋转角会叠加。为了得到总角度 θ,我们构造 q 时必须使用半角这不仅解决了代数封闭性,还引出了四元数的双倍覆盖(Double Cover)特性:q 和 −q 在三明治变换下对 p的作用是完全一样的:在三明治变换中,如果我们把 q 替换为 −q,所以,从代数结
CIMPro提供了一个成熟的、开箱即用的可视化“画布”和“工具箱”,你只需要专注于你最擅长的部分:业务数据的对接、处理与交互逻辑的开发,即可高效地将复杂的数据库数据、物联网实时数据转化为直观、交互式的3D可视化应用。软件内置丰富的图表组件库(柱状图、饼图、折线图等),你可以直接在3D场景旁通过拖拽方式配置图表,并绑定后台数据,快速构建综合态势驾驶舱。对于Java开发者而言,它的价值在于:你将不再需
作者:姜尔 本文介绍了使用SuperMap iObject Java提取倾斜摄影三维模型单体建筑的方法。通过ModelBuilder3D#extractBuildings方法,基于建筑物轮廓面数据集和S3M格式的倾斜摄影数据,可生成带真实纹理的LOD2.1级精细建筑模型。文章详细说明了参数配置,包括SCP路径、矢量面数据、贴合设置等,并提供了完整的Java示例代码。该方法支持对建筑矢量面进行放大偏
本文探讨了3D查看器从简单渲染工具到智能文档生成系统的演进历程。作者最初通过手动复制代码注释生成文档(1.0阶段),随后采用模板和搜索引擎提高效率(2.0阶段),最终引入大语言模型实现自动化(3.0阶段)。文章重点分析了各阶段的技术特点:早期Doxygen等工具的局限性,模板系统的结构化优势,以及当前AI生成面临的"幻觉"问题。通过实际案例(如几何分析API文档生成),展示了如何结合代码语义理解与
基于 SuperMap iClient3D for WebGL 的大华 RTSP 流与 WebSocket 地址视频投放方法
Spark2.0是WorldLabs开源的3D Gaussian Splatting(3DGS)Web渲染器,专注于高效渲染已有的3DGS资产而非重建。它通过全局排序、LoD分层和流式加载技术,解决了传统浏览器渲染3DGS时加载慢、内存占用高和混合排序错误的问题。Spark2.0支持主流3DGS格式,与THREE.js深度集成,并采用WebGL2以确保广泛兼容性。其核心创新包括LoDSplatTr
DataX 是阿里巴巴开源的异构数据源离线同步工具。它将数据同步过程抽象为 Reader、Framework 和 Writer 三部分:Reader 从源端读取数据,Framework 负责调度和传输,Writer 将数据写入目标端。GreatSQL 完全兼容 MySQL 协议和 MySQL 语法,因此目标端使用 DataX 的插件写入。源端 openGauss 与 PostgreSQL 生态有较
ccstatusline 是一款高度可定制的状态栏格式化工具,能在终端中显示 Claude Code 的实时运行指标,目前在 GitHub 上已有9k+ Star,社区活跃度很高。支持50+ 种可定制组件组件类型具体指标用途模型信息当前使用的模型(Opus/Sonnet/Haiku)确认 AI "脑子"的档次Token 用量输入/输出 Token 数、累计用量控制成本,避免账单爆炸响应速度首 To
OpenAI疑似泄露GPT-5.6测试版本,引发AI圈震动。该模型展现出三大突破性升级:1.5M Token的超长上下文窗口、多Agent协同推理能力显著提升,以及性价比优势。实测显示,其在3D建模和游戏生成方面表现惊艳,能精准处理复杂空间关系和动态光影效果。文章通过代码示例展示了其推荐架构,并建议开发者适应Agent协作模式,善用长上下文优势。面对OpenAI的快速迭代(约每7周更新旗舰模型),
本文完整记录Windows环境下CLI-Anything对接Codex与本地Blender的全流程部署方案。先梳理本地软件路径,分步完成Codex技能安装、Blender环境变量配置、Blender CLI工具与cli-hub管理工具部署;针对Windows特有中文路径编码、路径反斜杠转义、控制台GBK解码、无软链接权限四大兼容问题修改源码修复;搭建完整渲染链路完成多层功能验证,同时给出场景创建、
从实验室里的“3D困境”到Marble的“一键生成”,技术的进步正在打破专业与大众的壁垒,让3D建模从“少数人的技能”变成“多数人的工具”。李飞飞团队用Marble证明,空间智能不仅是一个前沿概念,更是能解决实际问题、推动科研创新的落地技术。对于研究生和科研从业人员而言,Marble不仅是提升工作效率的“利器”,更是探索空间智能前沿方向的“窗口”——它让我们能以更低的成本验证科研假设,以更灵活的方
摘要:本文呈现了五种超现实视觉创意方案。1)3D商业风格樱桃汁产品图,通过冷凝水珠、飞溅液体等动态元素展现高端质感;2)3D人物从宝丽来照片中立体浮现的光学错觉效果;3)漫画角色突破画框的互动场景;4)橙汁冲浪的奇幻饮料广告;5)以剪纸艺术表现的珠江新城天际线,融合现代建筑与传统工艺。所有方案均强调超高分辨率(8K)、极致细节和超现实表现手法,通过光影、材质和动态元素的精心设计,创造出兼具艺术性与
💡 **写在前面**:随着 Cursor、GitHub Copilot、通义灵码等 AI 编程工具的爆发,**“提示词质量”直接决定了代码生成的上限**。内置距离场着色器,根据顶点到波前的距离动态控制点云模型的 `opacity` 与 `size`,使沉船/海底地形被“扫描”后渐显。静止时转为微风晴空循环。2. **明确技术边界**:在提示词开头固定引擎版本与依赖(如 `Three.js r16
你说的“按现成的马上抄”,在工业 AI 里其实叫**“知识复用”和“程序化生成”**。消费级 AI(如 Tripo3D):更多是“猜”形状,生成好看但不能用的模型。工业级 AI(如 MeshCoder, CAD-GPT):确实是在“抄”逻辑。它学习的是**“怎么造”(代码/指令),而不是“造出来是什么”**(像素/网格)。这种思路让 AI 从一个“画图的”变成了一个懂规范的“助理工程师”,这才是工
在学习OpenGL的过程中,我们通常会经历这样一个过程:先学会画一个三角形,然后学会给三角形贴上纹理,再然后... 发现这个三角形只能呆在那里,一动不动。如何让我们的图形动起来?答案就是——坐标变换。本文将从一个初学者的视角,解析如何通过GLM数学库和变换矩阵,让一张简单的纹理图片在屏幕上实现平滑的左右移动。简单来说,矩阵就是一个"数字表格"。在图形学中,我们通常使用4×4矩阵来表示各种变换(平移
谷歌GeminiAI新增3D交互功能,可生成动态模拟模型,帮助直观理解科学概念。用户可通过调整参数实时观察分子结构、天体运动等复杂现象的变化过程。该功能适用于物理、化学、数学等多个学科,需使用GeminiPro模型并配合特定指令(如"展示给我")触发。目前教育版和Workspace账号暂不支持,功能正在逐步开放中。这项升级显著提升了AI辅助学习的可视化效果和互动体验。
摘要: 本文记录了使用 Claude Code(AI 编程助手)仅通过 6 轮对话(耗时不到 2 小时)完成 3D 智慧校园数据大屏 开发的完整流程。项目基于 Three.js 和 Chart.js,包含等距视角校园场景、动态昼夜切换、车辆移动、粒子喷泉、数据图表等交互功能。 核心方法: 分步迭代:每轮对话聚焦单一目标(如基础场景→交互→优化→扩展→数据集成→细节打磨),确保 AI 上下文清晰。