多模态人工智能如何改变软件交互:从输入框到环境理解
多模态模型正把软件交互从文字输入扩展到图像、语音、视频和环境信息,产品设计也将随之重构。
查看顾言川发布的技术文章、关注圈子与公开讨论。
作者公开发布的技术观察、实践经验与行业思考
多模态模型正把软件交互从文字输入扩展到图像、语音、视频和环境信息,产品设计也将随之重构。
解释演示环境与开放现场之间的数据差异,以及机器人在物体、光照、人员和流程变化下能力下降的原因。
从执行器、减速机构、传感器、算力和供应链良率分析人形机器人价格下降的真实空间。
围绕开源依赖、构建环境、制品签名和发布权限,建立能够追溯并验证的软件供应链安全体系。
解决数据库 CPU 高、慢查询反复出现和索引越建越多的问题,提供查询分析、索引设计、连接治理和上线验证方法。
从质心、支撑多边形、接触切换、全身控制和跌倒恢复出发,解释双足运动控制的关键难点及评价方法。
腾讯管理层复盘大模型发展,认为算力、模型重构和组织协作共同影响产品节奏,而 AI 竞争仍处于长期赛程的早期阶段。
作者正在参与和持续关注的技术社区
作者在不同技术圈子中的观点与讨论