登录社区云,与社区用户共同成长
邀请您加入社区
在融创壹号院、金茂府、龙湖青云阙等标杆项目中,验证了“AI辅助+UE5实时渲染”的混合工作流的商业价值。从户型图到三维漫游、从静态渲染图到动态影片,AI技术的介入让“视频”从“昂贵的一次性投入”变成了“可批量生产的高效资产”。公司自研的AI 3D视觉算法可从CAD图纸自动生成三维建筑白模——识别图纸中的建筑轮廓、层高、门窗位置后自动生成,再由美术师精修。这种“AI生成初稿、人工精修细节”的模式,正
传统 3D 资产创建要么依赖多视角摄影测量,要么产出不可编辑的黑盒网格,手工建模更是耗时。img2threejs给出截然不同的方案:AI Agent 仅凭单张参考图,逐阶段“雕刻”出可运行的 Three.js 源码——粗模→结构→形体→材质→表面→光照→交互→优化,每步独立质量门控,验收不过则自动修正规格或代码。工程上,所有几何计算与校验下沉至Python 标准库,昂贵的多模态Token仅用于看图
本文介绍了一个基于Node.js的自动化文章发布系统,通过HTTP API实现Markdown文章采集到发布的完整工作流。系统核心功能包括:1)接收文章内容并自动生成标准化文件名(含日期);2)保存至指定目录并更新文章索引;3)触发编译流程生成HTML页面;4)验证链接有效性并返回访问URL。配套的智能体"宁明"能自动撰写科技类文章,通过五角星按钮触发社交平台内容采集,并调用该
摘要:本文介绍了一种突破性的三维空间智能体系统(3D Spatial Agent),由镜像视界科技研发,通过SpaceOS™空间计算操作系统实现从目标识别到战术控制的跨越。系统解决了传统视频监控的四大缺陷:目标丢失、无空间坐标、无轨迹认知和无预测能力。核心创新包括三维坐标绑定(精度≤30cm)、全路径建模、行为判定和趋势预判四大作战属性,构建了感知→锁定→跟踪→建模→预测→控制的闭环能力。相比传统
AI研究正转向解决现实约束:5篇新论文揭示关键趋势 Agent世界模型:提出分层框架(预测器/模拟器/演化器)解决不同环境下的动态建模问题,强调环境预测能力比工具调用更重要。 低成本Scaling Law:通过主动实验选择策略,仅用10%预算即可准确预测模型扩展规律,解决传统方法实验成本过高问题。 多图理解:提出CGC方法解决跨图对象混淆问题,通过组合对比训练增强多图归因能力,避免注意力泄漏。 长
eve init。
本文介绍了使用Python Motion Planning库进行3D路径规划的基础操作。首先通过设置随机种子确保结果可复现,然后导入相关库并创建31x31x31的栅格地图。通过添加75个随机障碍物并进行3格膨胀处理,生成测试环境。文章详细说明了栅格地图的坐标系转换原理,并提供了可视化检查3D网格地图的代码示例。最后介绍了如何保存3D可视化结果,指出需要关闭交互模式并注释show()方法。完整代码展
在计算机视觉与交互式显示技术飞速发展的今天,已不再是科幻电影中的专属概念。它正逐步走入现实——从博物馆的虚拟文物展示到医疗手术中的三维成像辅助,再到AR/VR场景中更沉浸式的体验,其核心驱动力之一就是。本文将带你走进一个,使用构建一个模拟“空中投影”的程序,让你能在普通显示器上看到类似全息的效果!
DETR3D将DETR的集合预测范式引入多视角3D检测:用可学习的3D参考点代替2Danchor,通过3D→2D投影从多视角图像中采样特征,实现端到端的NMS-free 3D检测。
传统雷达-相机融合方法大多先将不同模态统一到 BEV 空间,再进行拼接或注意力融合。但这种方式默认两种模态在 BEV 中已经较好对齐,而现实中雷达特征往往稀疏、相机 BEV 又容易受深度误差影响。CVPR 2025 的 RaCFormer 提出了一种 query-based 的双视角融合框架,让 object query 同时从图像视角和 BEV 视角主动采样特征,并结合雷达辅助深度估计、时序动态
它没有搞复杂的模型架构,而是从采样策略入手,用简单的OLC策略解决了“找新类别、控成本”的核心问题,再结合CRB形成Open-CRB框架,既保证性能,又兼顾实用性。简单说,这个任务的目标是:用最少的标注成本,让3D检测模型适应真实开放场景,既能认熟类别,又能识别没见过的新类别。最近,Zhuoxiao Chen等学者提出的Open-CRB框架,首次把3D目标检测主动学习带入了“开放世界”,用极低的标
LSM6DSV16XTR是意法半导体推出的高性能六轴IMU芯片,集成3D加速度计和陀螺仪,采用2.5×3mm紧凑封装。其核心创新包括:1)三核架构实现多任务并行处理;2)嵌入式MLC支持运动模式识别;3)低功耗SFLP算法实现高效姿态解算;4)Qvar技术实现无接触手势控制。该芯片工作电流仅0.65mA,支持±16g加速度和±4000°/s角速度测量,通过I²C/SPI接口通信,内置4.5KB F
CVPR 2025 的 CorrBEV 关注的不是传统 3D 检测里“平均分再涨一点”,而是一个更接近真实落地的问题:遮挡目标漏检。论文借鉴人类的 amodal perception,引入视觉原型和语言原型作为先验知识,再通过 correlation learning 注入到 3D query 学习中,同时结合随机像素丢弃和多模态对比学习增强训练。它的意义不只是提升了整体 3D 检测性能,更重要的
先给所有已经在玩 ComfyUI、本地大模型、AI 配音的朋友一个定死的结论:你之前花时间学的所有 AI 技能,全部能无缝搬进 Unity 里做 3D 游戏,不用重新学一套。而且比你纯做 AI 绘图、纯做漫剧强太多了 —— 你可以把 AI 生成的所有素材,变成一个真正能玩、能互动、能打包成 PC / 手机端的 3D 游戏。这篇文章就是写给和我一样,手里有 A770 16G 显卡,已经搭好了本地 A
AI Agent(智能体)乱战:2026年,我们离“数字员工”还有多远?
人工智能(AI)技术的快速发展为解决上述问题提供了全新的思路与方法。通过机器学习、深度学习、融合AI大模型工具辅助科研、物理信息神经网络等AI技术,可以实现对增材制造过程的实时监控、缺陷智能检测、工艺参数优化以及全流程质量控制,从而显著提升增材制造的质量稳定性和生产效率,推动增材制造技术向智能化、绿色化、高效化方向发展。
本文系统介绍了CenterPoint,一种基于中心点的3D目标检测与跟踪方法。其核心思想是将3D目标表示为BEV平面中心点,并回归尺寸、高度、朝向和速度等属性。文章详细解析了CenterPoint的8阶段流程:点云输入、体素化/Voxel化、特征编码、Backbone处理、Center Head多任务预测(热力图、偏移、高度、尺寸、朝向、速度)、Top-K解码和后处理。重点对比了Sparse 3D
本项目基于YOLOv12深度学习框架,开发了一套高效、精准的3D打印缺陷识别检测系统,能够自动识别并分类常见的3D打印缺陷,包括Spaghetti(拉丝)、Zits(麻点)、Stringing(丝状残留)三类。系统采用PyTorch框架训练优化模型,结合YOLO格式数据集,实现了高精度的目标检测能力。此外,系统配备了用户友好的UI界面,支持登录注册功能,便于用户管理和使用。项目提供完整的Pytho
模拟导游实训室市场已有20年发展历史,传统技术架构为:VR景区导览(全景图/视频播放)+ AI语音评分(ASR+关键词匹配)+ 导游全流程模拟(流程编排)。技术背景:传统方案的技术瓶颈。
我们将开发一个真实世界的医生预约平台,多个医生可以管理他们的日程安排,患者可以预约,管理员可以监控整个系统。本课程专为那些没有或很少使用PHP经验的初学者而设计,但即使是高级学习者也会发现它很有用,因为我们实现了真实医疗系统中通常需要的医生可用性,预约,患者管理和高级报告等现实生活功能。管理面板功能:1.管理员可以创建、编辑和删除医生。9.管理员可以看到医生添加的日期和时间表。管理员可以看到重要的
本文介绍了实现3D饼状图/环状图的核心方法。通过pieChart.js中的getPie3D函数,可以配置3D饼图的多个参数,包括空心占比、视角距离、旋转角度、高度和透明度等。该函数主要处理数据排序、颜色设置、比例计算,并生成相应的3D参数方程。实现特点包括:支持自定义颜色数组、自动计算各扇区比例、添加交互标签和提示框等可视化元素。最终生成的图表具有立体效果,并可通过legend显示各数据项占比。函
C++11引入的Lambda表达式是一种创建匿名函数对象的简洁方式,它允许在代码中内联定义函数,无需单独命名。Lambda表达式的基本语法为:[捕获列表](参数列表) mutable(可选) exception(可选) -> 返回类型(可选) { 函数体 }。这种语法结构使得开发者能够更方便地编写一次性使用的函数对象,特别是在STL算法中作为谓词使用。
本文介绍了C++/C#游戏开发常用的引擎和图形库。主流游戏引擎包括Cocos2d-x、Unity和Unreal Engine等跨平台工具。图形库部分涵盖了Dear ImGui、Godot、raylib和Sokol等轻量级方案,以及OpenGL、Vulkan和DirectX三大3D图形API。这些开源项目提供了从2D到3D、从移动端到PC端的完整游戏开发解决方案,适合不同需求的开发者使用。文中提供了
Next.js 是由 Vercel 开发的 React 全栈框架,被世界上一些最大的公司所使用。Next.js 通过扩展最新的 React 特性并集成强大的基于 Rust 的 JavaScript 工具链,使您能够创建全栈 Web 应用程序,实现最快的构建速度。它提供了开箱即用的解决方案,包括服务器端渲染、静态站点生成、API 路由等核心功能,是现代 Web 开发的首选框架。🔗 GitHu
让我们再来认识一下它吧!它是一个基于 Vue 3 的声明式 3D 场景构建框架,让你可以用写 Vue 组件的方式,轻松构建 Three.js 3D 场景,无需手动处理渲染器、相机、光照等繁琐细节。<TresMesh>简单、直观、响应式,这就是 TresJS 的魅力。维度v5.0 提升性能WebGPU支持、ESM-only、事件优化易用性CLI工具、响应式 composables、标准化事件可维护性
本文介绍了使用Open3D库进行点云数据读取和可视化的基本操作。
本文介绍如何使用 py3dbp 解决三维装箱问题。文章包含了从基本概念、实战案例到最终生成动态GIF可视化的流程及代码实现。在物流、仓储和制造业中,如何将不同尺寸的物品高效地装入一个有限的容器(如卡车、集装箱或箱子)是一个经典且极具挑战性的问题。这就是著名的三维装箱问题(3D Bin Packing Problem, 3D-BPP)。解决好这个问题能显著节约运输成本、提高空间利用率。Python社
本文介绍了在Vue3项目中集成Three.js创建立方体的基本流程。首先简要介绍了Three.js的核心概念(场景、相机、渲染器等),然后详细说明了环境配置和项目设置步骤。通过分步代码演示了如何初始化场景、设置透视相机、创建立方体几何体并应用材质,最后整合为完整代码。文章特别强调了代码结构优化的重要性,建议将不同功能模块封装为独立函数,以提高代码可读性和可维护性。整个实现过程展示了Three.js
本文介绍了一个基于Vue3和Three.js的Web3D编辑器开发项目。项目采用现代前端技术栈,实现了3D场景搭建、对象管理、材质编辑、动画制作等核心功能。主要内容包括: 项目架构设计:使用Vue3组合式API和TypeScript构建模块化系统,采用Pinia进行状态管理。 核心功能实现: Three.js场景初始化与基础设置 3D对象管理系统(增删改查、选择变换) 材质编辑器与纹理管理系统 动
🌐。