其实这项技术与去年10月19日,Meta发布的通过MEG(另外一种大脑活动检测工具)重构人类大脑成像过程有点类似。都是通过EEG、MEG等工具捕获大脑微弱活动电流,检测这些磁场变化,然后获得脑部活动数据。
雷军表示,这两项技术的获奖,标志着小米在底层核心技术能力以及操作系统领域,实现了重大突破。它们不仅代表着公司技术实力的积累,也体现了小米工程师团队敢于挑战高峰的勇气与决心。
项目地址:https://github.com/wenquanlu/HandRefiner/
CogAgent还提供了可视化代理的能力,能够返回任何给定任务的计划、下一步行动和带有坐标的具体操作。它还增强了与图形用户界面相关的问题解答功能,可以处理与网页、PC应用程序、移动应用程序等任何图形用户界面截图相关的问题。另外,通过改进预培训和微调,CogAgent还增强了OCR相关任务的能力。这些功能的提升使得CogAgent在多个基准测试上实现了最先进的通用性能。
部分规范打标案例: