<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[CV_Autobot的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/CV_Autobot</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; CV_Autobot]]></copyright><item><title><![CDATA[推理专场 | 行深智能开源框架EdgeFM：专为边缘端场景优化的通用大模型推理引擎]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161499618</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161499618</guid><author>CV_Autobot</author><pubDate>Thu, 28 May 2026 17:02:55 +0800</pubDate><description><![CDATA[EdgeFM（Edge Foundation Model）：是一个专为边缘端场景优化的通用大模型推理引擎。针对边缘端推理的独特需求，提供高效的多模态理解、语言生成和决策推理能力，广泛应用于自动驾驶、具身智能、机器人控制等边缘端智能系统，助力边缘端大模型应用的快速部署。所以，今天自动驾驶之心联合行深智能和大家聊聊边缘端大模型高效推理引 —EdgeFM。有很多小伙伴咨询我们部署这块有没有好一些的开源方案，边缘端的大模型推理目前也是业内的刚需。本文只做学术分享，如有侵权，联系删文。点击下方直播预约👇👇👇。]]></description><category></category></item><item><title><![CDATA[自动驾驶之心招募合作老师了～]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161466929</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161466929</guid><author>CV_Autobot</author><pubDate>Wed, 27 May 2026 11:00:00 +0800</pubDate><description><![CDATA[当下，端到端、VLA、世界模型依然是企业招聘的热门岗位。然而，技术栈一直在更新，甚至每个季度都可能有所不同，很多内容开始跟不上产业的脚步了。现向全平台粉丝招募合作老师，希望能和自动驾驶之心在端到端、VLA、世界模型等多个方向上共同发力！在读博士或以上，自己有端到端自动驾驶、VLA、世界模型、闭环仿真等方向的顶会paper发表经验；自动驾驶之心一直希望能把行业最新的内容呈现给大家，也希望和更多优秀的大佬一起合作研发课程。包括但不限于： 端到端自动驾驶、VLA、世界模型等多个方向。我们在找什么样的老师？]]></description><category></category></item><item><title><![CDATA[地平线最新的世界模型HorizonDrive，藏了很多工程细节......]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161466185</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161466185</guid><author>CV_Autobot</author><pubDate>Wed, 27 May 2026 11:00:00 +0800</pubDate><description><![CDATA[更关键的是，如果 teacher 本身不能处理带误差的历史，那么 student 在长程蒸馏里学到的监督信号也会被污染。一方面，受显存限制，teacher 能直接监督的时间窗口是有限的，这使得学生没法在更长的序列上学习。实践中，还可以通过缩减冗余的去噪步数来提升误差收集的效率，并每隔一段时间更新误差集，让模型在收集误差-学习误差-收集误差的循环中不断进化。它的好处是直接，几何一致性也更容易提升；也就是说，它不能只在干净的GT上生成下一段未来，还要学会在自己生成出来的、有偏差的历史上继续恢复正常的场景。]]></description><category></category></item><item><title><![CDATA[全新一代理想L9正式发布，第一眼我心动了]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161467029</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161467029</guid><author>CV_Autobot</author><pubDate>Tue, 26 May 2026 14:29:42 +0800</pubDate><description><![CDATA[点击下方卡片，关注“自动驾驶之心”公众号戳我-> 领取自动驾驶近30个方向学习路线>>自动驾驶前沿信息获取→自动驾驶之心知识星球2026年5月15日，理想汽车正式发布具身智能旗舰SUV——全新一代理想L9。新车提供Ultra版和Livis版两个版本，Ultra版全国统一零售价45.98万元，Livis版全国统一零售价50.98万元，5月17日起正式开启交付，用户可在理想汽车全国零售中心体验，或通过理想汽车App预约试驾。全新一代理想L9是理想汽车面向具身智能时代打造的旗舰产品。所谓具身智能，是指这辆车不只执]]></description><category></category></item><item><title><![CDATA[华科&酷睿程GemDepth：超越VGGT，深度估计新SOTA]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161405103</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161405103</guid><author>CV_Autobot</author><pubDate>Mon, 25 May 2026 14:00:00 +0800</pubDate><description><![CDATA[值得强调的是，DA3 和 VGGT 是依赖于超过 1.10B 的庞大参数量来拟合这些轨迹的，而 GemDepth 仅使用了 0.58B 的参数量就实现了同等量级的几何精度。具体而言，在极具挑战性的高动态数据集 Bonn ，我们的方法在点云重建的核心指标 F1 上取得了突破性进展，从 78.44（DepthAnything3）大幅跃升至 90.43，相对提升高达 15.3%。通过执行基于轨迹的特征聚合，它在捕获纯粹运动线索的同时，减轻了复杂空间上下文的干扰，从而确保了稳健的空间结构一致性和无闪烁的深度序列。]]></description><category></category></item><item><title><![CDATA[一名自动驾驶算法工程师的窘境]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161403756</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161403756</guid><author>CV_Autobot</author><pubDate>Mon, 25 May 2026 14:00:00 +0800</pubDate><description><![CDATA[融资、扩张、挖人、堆算力、堆数据，太多的公司在做智驾（彼时还可以称之为“自动驾驶”），也有很多的公司都在讲 Robotaxi，讲 L4 落地，讲“未来三年会彻底改变出行”。做 CV 的、做 SLAM 的、做机器人方向的，甚至还有不少做搜广推、大数据的人转过来。模型、训练框架、部署优化、数据闭环等等，太多的工作和新的东西，让我会明显感觉自己在变强。虽然我天天吐槽，虽然我也焦虑，虽然我也会研究大模型、研究 Agent、研究具身智能，甚至也想过转方向。感知、预测、规划、控制、高精地图、仿真、定位、云端调度……]]></description><category></category></item><item><title><![CDATA[半个智驾圈，撑起了具身智能的黄埔军校......]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161351366</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161351366</guid><author>CV_Autobot</author><pubDate>Sat, 23 May 2026 11:11:00 +0800</pubDate><description><![CDATA[一家通用具身智能机器人公司，聚焦于构建机器人“通用大脑”与“操作智能”，突破手、眼、脑协同的关键瓶颈，将具身智能转化为一种可广泛部署、持续进化的基础设施，以通用基础模型研发与通用专家模型落地应用双线驱动，致力于为全球客户提供软硬一体、高可靠性的具身智能解决方案。作为一家智能定义体能，AI定义本体的公司，众擎正以坚定而持续的资源投入，构建从高动态本体到多模态基模的数据飞轮，全面引领具身智能的量产跃迁与持续进化。，原小鹏汽车首席科学家，创办智平方。，原理想汽车智能驾驶总裁，创办昆仑行，主攻具身智能大模型。]]></description><category></category></item><item><title><![CDATA[VLA没死，世界模型也不是终局......]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161350886</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161350886</guid><author>CV_Autobot</author><pubDate>Sat, 23 May 2026 11:11:00 +0800</pubDate><description><![CDATA[我们为大家汇总了3DGS和NeRF的相关技术领域，3DGS的算法原理、自动驾驶场景重建与闭环仿真、NeRF与自动驾驶仿真，NeRF与自动驾驶感知，同时我们也邀请到诸位学术界大佬分享3DGS和NeRF的最新工作，这里全都有！这里的活跃度，不是靠“签到”撑起来的，是靠真实的行业讨论撑起来的。针对2025年最火的自动驾驶VLA，我们详细梳理了最新的综述、VLA开源数据集、作为语言解释器的相关算法、模块化VLA、端到端VLA和推理增强VLA，更有诸多关于VLA量产的讨论，在这里有你想知道的一切~]]></description><category></category></item><item><title><![CDATA[韩旭开喷了，他说特别讨厌VLA、世界模型这些名词......]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161328015</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161328015</guid><author>CV_Autobot</author><pubDate>Fri, 22 May 2026 11:08:58 +0800</pubDate><description><![CDATA[从高速 NOA 到城区 NOA，从有图到无图，从规则到端到端，车企和Tier1已经把用户对智能驾驶的预期明显抬高。但相比单纯讨论大模型、世界模型、VLA 和端到端，接管里程至少把讨论拉回了自动驾驶最现实的问题：系统能力有没有经过道路验证，安全边界能不能被量化，运营风险是否可控。模型训练得再好，最终都要上车，进入真实道路，面对不可控交通参与者、复杂天气、施工改道、非标行为和安全事故风险。对文远来说，把 L4 能力、仿真系统、端到端模型和车规算力平台下沉到量产智驾，是一种更现实的技术商业化路径。]]></description><category></category></item><item><title><![CDATA[定了！特斯拉宣布监督版FSD登陆中国]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161296149</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161296149</guid><author>CV_Autobot</author><pubDate>Thu, 21 May 2026 09:59:45 +0800</pubDate><description><![CDATA[近日，特斯拉中国发布多个与智能驾驶测试相关的招聘岗位，引发行业对其FSD加速落地中国市场的相关猜测。界面新闻以消费者身份咨询特斯拉官方客服，对方回复称：“6.4万元智能辅助驾驶功能并不是所有车辆都适配，部分只适配3.2万元的增强辅助驾驶功能。公司正根据国家相关法规要求积极推进审批工作，一旦审批就绪尽快推送给国内客户。5月21日，特斯拉官方宣布监督版FSD的最新布局，其中提到监督版FSD可以在中国使用。本文只做学术分享，如有侵权，联系删文。>>自动驾驶前沿信息获取。编辑 | 自动驾驶之心。]]></description><category></category></item><item><title><![CDATA[港股全场景L4级自动驾驶第一股！驭势科技正式在港交所挂牌上市]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161267083</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161267083</guid><author>CV_Autobot</author><pubDate>Wed, 20 May 2026 14:27:10 +0800</pubDate><description><![CDATA[此前，驭势科技还已获得中科创星、上海国盛、深创投、中金、广发信德、国开制造业基金、洪泰基金、博世创投、东风资管、中信证券、尚珹资本、澜亭资本、创新工场、重科控股、新鼎资本、中关村龙门投资、腾云资本、力鼎资本、国科嘉和、淳信宏图、真格基金、湖南湘江投资、银泰华盈、达泰资本、科源产业基金、橡果资本、重庆两江战新基金、青山资本等数十家VC/PE及产业资本的投资。在巩固现有场景领先地位的同时，不断拓展全场景应用生态，以更优质的产品与服务回馈社会，以更出色的业绩回报投资者的信任。]]></description><category></category></item><item><title><![CDATA[余凯说，各家智驾技术路线没有本质区别。]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161267055</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161267055</guid><author>CV_Autobot</author><pubDate>Wed, 20 May 2026 14:27:10 +0800</pubDate><description><![CDATA[模型从哪里开始接管，输出到哪个层级，规划控制是否完全学习化，安全冗余如何保留，规则模块怎么兜底，后处理是否影响最终行为，这些问题都会决定端到端系统的真实形态。从这个角度看，我们觉得余凯的判断是并不是说技术路线没有意义，而是在提醒大家，概念层级的差异不是真正的壁垒，踏实搞落地系统，真正把硬骨头啃下来。它要能复现真实风险，不然策略在仿真里可行，但是实车过不了，就没有多大的价值。同样讲数据闭环，有的只是做数据采集和回传，有的已经能完成自动挖掘、场景聚类、数据清洗、仿真重建、模型训练、闭环评测和 OTA 迭代。]]></description><category></category></item><item><title><![CDATA[只用自动驾驶数据，一定不可能完美解决自动驾驶。]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161236634</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161236634</guid><author>CV_Autobot</author><pubDate>Tue, 19 May 2026 09:03:30 +0800</pubDate><description><![CDATA[从早年的目标追踪、MXNet，到图森未来，再到如今小米自动驾驶，他对 AI 的判断是长期站在模型、系统和工程落地的交叉处观察所得。从早期图像特征，到 BEV、Occupancy，再到现在的多模态表征、3D foundation model 和运动表征，自动驾驶一直在寻找更适合真实道路场景的世界编码方式。理解世界，对应的是感知、表征、多模态理解、3D 空间理解、运动理解和时序理解。我们其实想表达的是，自动驾驶下一阶段的瓶颈，可能不只在于继续堆更多驾驶轨迹，系统能否理解这些轨迹背后的世界结构，可能更重要。]]></description><category></category></item><item><title><![CDATA[理想最新的工作 MindVLA-U1，再一次升级......]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161205522</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161205522</guid><author>CV_Autobot</author><pubDate>Mon, 18 May 2026 11:48:21 +0800</pubDate><description><![CDATA[消融实验也说明了这个点。模型先通过语言头预测当前场景的 intent token，例如左转、右转、直行等，再把这个 intent embedding 加入动作 MLP 的时间嵌入中，引导 flow matching 生成轨迹。从技术的角度看，这个设计的意义在于，语言损失和动作损失虽然共享骨干参数，但它们作用在不同输出位置，通过不同 readout head 读出结果。这样保留了连续动作，但动作 token 没有真正进入 VLM 的自注意力计算，VLM 更像一个感知特征提取器，动作生成仍然偏 VA。]]></description><category></category></item><item><title><![CDATA[如果秋招你想入行自动驾驶端到端]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161205470</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161205470</guid><author>CV_Autobot</author><pubDate>Mon, 18 May 2026 11:48:21 +0800</pubDate><description><![CDATA[由于无法保证模型直出会有100%的准确率，因此会通过一些轨迹的平滑优化算法来使得最终输出的轨迹更加的稳定和可靠，本章会介绍目前一些常用的轨迹平滑算法，既有多模态轨迹打分搜索的算法，也有轨迹平滑的算法。看了很多我们的文章，也相信端到端是之后的趋势，包括他之前在职的公司也在转行端到端。最后的一章重点会对量产的一些经验进行分享，会从数据、模型、场景、规则等多个视角来剖析如何使用合适的工具和手段解决相应的问题，当面临一个实际的可落地的系统时，如何更合理的选用不同的策略和方法，从而能够快速提升一个系统的能力边界。]]></description><category></category></item><item><title><![CDATA[中科大CLOVER：让自动驾驶不只是「给答案」，而要学会反复想、认真选、继续改]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161174997</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161174997</guid><author>CV_Autobot</author><pubDate>Sun, 17 May 2026 19:28:21 +0800</pubDate><description><![CDATA[在 12,146 个 NAVSIM 场景中，当评分器预测分数高于 0.95 时，对应候选的真实平均分达到 0.9753，真实分数不低于 0.90 的比例达到 96.69%。通俗讲，就是评分器选出来的篮子里，好轨迹比例要比原来的候选池更高。对 proposal-selection 方法来说，这类指标更难，因为候选轨迹之间如果切换不稳定，即使每一帧看起来都不错，整体舒适性也可能被扣分。vector-Pareto 则更像现实驾驶中的多种合理取舍：有的轨迹更保守，有的轨迹进度更好，有的轨迹更舒适。]]></description><category></category></item><item><title><![CDATA[从“像素对齐“到“锚点对齐“：小米汽车PointForward重塑前馈3DGS]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161126740</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161126740</guid><author>CV_Autobot</author><pubDate>Fri, 15 May 2026 11:02:45 +0800</pubDate><description><![CDATA[对于属于同一实例的所有查询点，我们将它们转换到同一个规范化坐标系下——在这个坐标系中，实例的局部运动被"剥离"了，只剩下来自不同视角的外观信息。(3) 避免了密集场景流预测中的误差累积。例如在 3m 位移下，PointForward 的 FID（33.71）远低于 STORM（81.54）和 DG GT（77.51），说明点对齐表示能够保持更强的几何一致性，在新视角下生成更准确的渲染结果。此外，点对齐表示的扩展性也是一个值得探索的方向——如何在保持质量的同时处理更大规模的场景和更多的查询点。]]></description><category></category></item><item><title><![CDATA[何小鹏，四问具身智能。]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161094826</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161094826</guid><author>CV_Autobot</author><pubDate>Thu, 14 May 2026 17:34:19 +0800</pubDate><description><![CDATA[车在天气良好、交通顺畅、道路清晰的环境里跑再多遍，也解决不了鬼探头、复杂博弈、施工绕行、遮挡误判和规则模糊这些真正困难的问题。物体材质、摩擦、形变、遮挡、摆放方式、夹爪精度、桌面高度、任务流程，本体差异，都会影响最终执行结果。加速、刹车、变道、绕行之后，周围车辆如何反应，行人是否会突然出现，前车异常减速背后是否有遮挡风险，这些问题都需要系统具备对未来交通演化的推演能力。真正拉开差距的地方，往往更慢，也更重。真正有价值的数据，通常来自系统不确定、模型失败、驾驶员接管、急刹、误检、漏检、复杂博弈和边界场景。]]></description><category></category></item><item><title><![CDATA[具身单月狂揽了200亿？！]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161065713</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161065713</guid><author>CV_Autobot</author><pubDate>Wed, 13 May 2026 11:01:06 +0800</pubDate><description><![CDATA[出手最多：从联合领投千寻智能的10亿元新轮次融资，到连投深朴智能、首形科技的A轮，再到抢下破壳机器人（许华哲创办）、原识之智和若伴智能的天使轮，顺为不仅是在投项目，更是在具身智能的全生命周期里“疯狂圈地”；当融资的关键词变成“工程化迭代”和“商业化卡位”，资本不再满足于听实验室里的论文汇报，他们要看的是产线上的成功率，是真实场景里的鲁棒性，是能不能在非结构化环境里精准地捏起一个杯子。大批的大额融资入场，也意味着“小打小闹”的作坊模式正式谢幕，具身智能正式进入了“资源密集型”竞争阶段。]]></description><category></category></item><item><title><![CDATA[座舱，也开始卷世界模型。南洋理工一篇Driver-WM解析......]]></title><link>https://blog.csdn.net/CV_Autobot/article/details/161065480</link><guid>https://blog.csdn.net/CV_Autobot/article/details/161065480</guid><author>CV_Autobot</author><pubDate>Wed, 13 May 2026 11:01:06 +0800</pubDate><description><![CDATA[给定同步的座舱内视频和车外交通观测，模型在 latent space 里预测未来驾驶员状态，并解码成未来骨架轨迹，同时用驾驶员行为、情绪、交通上下文和车辆状态这些语义任务做辅助正则。从 GAIA、DriveDreamer 到各类 latent world model，大家讨论的重点大多是外部世界：车道线怎么变化，周围车辆怎么运动，未来场景怎么生成，规划策略怎么在世界模型里做 rollout。效率上，Driver-WM 更像一个轻量 rollout head，而不是每次都要重新跑重型生成模型的模块。]]></description><category></category></item></channel></rss>