← 全部日期

AI & CV 每日科普 · 2026年7月4日

6 条当日/近期热点 · 工程师向浅科普

【主题】Kimi K2.7 Code 进入 GitHub Copilot 模型选择器

解读 GitHub 把 Kimi K2.7 Code 作为可选编码模型正式推给 Copilot 用户,这是 Copilot 里少见的开源权重模型入口。对工程师来说,它适合做低成本代码生成、重构和脚本任务,但上线到团队流程前仍要用真实仓库评估补全质量、工具调用和延迟。

来源 GitHub Changelog

【主题】Copilot 浏览器工具让代理能检查真实网页

解读 VS Code 中的 Copilot browser tools 已正式可用,代理可以打开隔离浏览器、访问共享页面并把页面信息带回对话。它对前端回归、表单检查和文档站点验证很有用,但企业需要配置域名访问、权限审批和日志策略。

来源 GitHub Changelog

【主题】Copilot CLI 在 Actions 中减少 PAT 依赖

解读 GitHub 现在允许 Copilot CLI 在 GitHub Actions 中使用内置 GITHUB_TOKEN,而不是单独保存个人访问令牌。对平台工程团队来说,这能降低长期密钥泄露风险,也让 AI 辅助 CI 任务更容易接入组织级计费和额度管理。

来源 GitHub Changelog

【主题】OpenCV COOL 面向 Graviton 优化视觉预处理

解读 AWS 和 OpenCV 发布 Cloud Optimized OpenCV Library,把常见图像处理算子预先针对 Graviton ARM 实例优化。很多 CV 服务的瓶颈并不在模型,而在 resize、blur、contour 等预处理;这个版本给团队一个在云上降 CPU 成本的测试方向。

来源 AWS Physical AI Blog

【主题】JoyAI-Image-Edit-Plus 强调多图一致编辑

解读 京东开源的 JoyAI-Image 更新了 Edit-Plus,主打指令式、多图像编辑和更好的场景一致性。它适合电商、广告素材和设计工具做原型验证,但实际落地仍要看人物、文字、品牌元素是否稳定,以及是否能接入审核流程。

来源 GitHub

【主题】OmniAgent-RL-7B 用主动感知处理长视频

解读 OmniAgent-RL-7B 在 Hugging Face 发布,模型通过观察、思考、行动循环决定何时看图像、听音频或截取片段。这个思路对长视频理解很实用,因为系统不必粗暴读取所有帧,可用于安防、机器人巡检和媒体审核的高效检索。

来源 Hugging Face