Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型
Google DeepMind 发布 Gemma 4 12B,一款面向笔记本电脑的统一无编码器多模态模型,可直接处理视觉和音频输入。
推荐理由:Gemma 4 12B把视觉、音频输入直接接入语言模型骨干,兼顾多模态推理与本地运行资源要求;其开源权重、部署工具和开发文档对想在笔记本上构建智能体应用的团队具有较高实用价值。
软硬件、开源项目与服务发布
Google DeepMind 发布 Gemma 4 12B,一款面向笔记本电脑的统一无编码器多模态模型,可直接处理视觉和音频输入。
推荐理由:Gemma 4 12B把视觉、音频输入直接接入语言模型骨干,兼顾多模态推理与本地运行资源要求;其开源权重、部署工具和开发文档对想在笔记本上构建智能体应用的团队具有较高实用价值。
Google Research 推出由 Gemini Enterprise Agent Platform 托管的 Cross-Corpus Retrieval,并加入 Agentic RAG 与 Sufficient Context Agent,以支持多数据源、多跳查询和缺失信息的迭代检索。
推荐理由:Google以官方研究结果说明了该平台托管版的工作机制、评测设置与公开预览状态,对评估企业多数据源检索的可追溯性和准确性具有直接参考价值。
Google Research 发布 PHRM 研究系统,利用日常手机使用中的前置摄像头和深度学习,在后台估算心率与每日静息心率。研究使用超过 35 万个视频片段和近 700 名经同意的研究参与者,释放面向合资格研究人员申请访问的数据集与预训练 PHRM-mini 模型。
推荐理由:公布手机摄像头被动估算心率与静息心率的研究系统、数据集及预训练模型,并披露实验室和真实生活验证结果及申请条件。
Google Research在GitHub开源水文建模框架、训练流程和文档,采用Apache 2.0许可,供研究人员和预报机构训练及微调洪水预报模型。框架包含LSTM模型和Caravan数据集训练流程,Google称新版相较前一版本将有测站流域的可靠预测期延长6天、无测站流域延长1天。Google还与CHMI合作验证其模型,并开发了接入Delft-FEWS的适配器。
推荐理由:Google开源水文建模框架,提供模型架构、训练流程与文档,并支持本地数据接入及Delft-FEWS集成,便于机构构建和定制洪水预报模型。
Home Assistant 2026.6 推出从实体出发、使用自身数据实时预览的卡片选择器,并改进自动化编辑器,加入目标数量、条件测试状态和步骤备注。版本还使 Infrared 可接收事件、为 Z-Wave 智能锁加入凭证管理,并将蓝牙与 ESPHome 代理默认扫描模式改为 Auto。Labs 中新增区域触发器和条件,同时包含不兼容配置变更,升级前需核对。
推荐理由:卡片选择器、自动化编辑器和蓝牙扫描改进贴近日常配置与维护,兼容变更和Labs功能说明也较完整,适合自托管用户评估升级影响。
Open WebUI v0.9.6新增官方知识库同步工具 oikb,支持将本地目录及多种远程来源与知识库增量同步,并加入知识库文件夹、文件系统工具和按对话启用技能等功能。
推荐理由:v0.9.6新增知识库同步、文件夹和文件系统工具,并集中修复多项访问控制、路径穿越与权限绕过问题;同时涉及数据库迁移和部署配置要求,升级前需重点核对兼容性。
Python 3.15.0b2 是 Python 3.15 开发中的第二个 beta 版本,发布团队计划安排四项 beta。官方建议第三方项目在 beta 阶段测试新功能和错误修复,并建议常规生产版本等待 3.15.0rc1,以降低 ABI 变更风险。
Mozilla 宣布 Firefox 151 桌面版支持 Web Serial API,网页应用可通过 JavaScript 直接连接兼容的串口设备,无需原生软件。Mozilla 与 Adafruit 测试了 ESP32-S2 等设备,并通过按站点和端口授权控制访问;该 API 仍位于 WICG,WHATWG 标准化工作正在推进。
推荐理由:Firefox 151 桌面版支持 Web Serial,开发者可直接通过网页连接串口设备;其权限控制和真实硬件测试案例,为个人及小团队评估硬件编程工作流提供参考。
SIG-Etcd 发布 etcd v3.7.0-beta.0,首个 beta 引入 RangeStream RPC,使调用方可以分块接收结果集;同时移除 v2store,改为完全使用 v3store。
推荐理由:首个 beta 引入 RangeStream 并移除 v2store,直接影响依赖兼容性与大结果集处理;项目同时明确 v3.4 将停止更新,适合评估升级风险与测试方向。
Google Research宣布,基于Gemini的科研工具ERA已在Nature发表,并开始通过Gemini for Science逐步开放。ERA可依据科学问题和成功指标检索文献、编写代码、探索方案并评估结果,已用于流行病预测、径流预测、CO₂监测、太阳能优化和零售预测等研究。
推荐理由:ERA以Gemini生成并优化科研代码,Google同时宣布其在Nature发表及逐步开放,能帮助读者了解AI辅助科学计算的工具范围与应用案例。
Google 在 Project Genie 实验性原型中推出由 Street View 驱动的实景地点生成能力,并面向全球符合条件的 Google AI Ultra 订阅者逐步开放。该功能可让用户选择美国地点及“Ocean World”“Desert Sands”“B&W film”等风格生成世界;Project Genie 仍属于 Google Labs 的实验性研究原型。
推荐理由:这项更新把 Street View 实景影像接入生成式世界模型,为 AI 智能体和机器人研究提供更贴近真实地点的交互环境,同时扩大了实验原型的可用范围。
Google DeepMind 发布 Gemini Omni Flash,这是 Gemini Omni 系列的首个模型,可将图像、音频、视频和文本组合输入,生成受现实世界知识支持的高质量视频,并支持通过自然语言进行多轮编辑。
推荐理由:Gemini Omni Flash将多模态理解、生成与对话式视频编辑整合,并分阶段进入Gemini app、Google Flow、YouTube Shorts及API;其输入组合、跨轮编辑、角色一致性和SynthID验证机制,对内容创作者与开发者的实际工作流具有直接参考价值。
Google 发布 Gemini for Science,包含 Google Labs 的三个实验原型及 Google Antigravity 的 Science Skills。
推荐理由:同时推出科学工具原型与桌面技能集合,覆盖假设生成、计算发现和文献分析;其并行验证、引用支持及机构合作为科研团队评估适用性提供明确线索。
Google DeepMind推出Gemini 3.5 Flash,用于执行复杂、智能体式工作流,官方称其在编程和智能体基准测试中优于Gemini 3.1 Pro。Gemini 3.5 Flash现已面向全球用户及开发者、企业平台提供,Gemini 3.5 Pro仍在内部使用,计划下月推出。
推荐理由:Google DeepMind发布Gemini 3.5 Flash,覆盖智能体、编程和长流程任务,并同步提供API及多平台入口;其性能、速度与部署范围信息可供开发者评估。
Kubernetes v1.36 将 Mixed Version Proxy 从 Alpha 提升至 Beta,并默认启用,用于将旧版 API server 无法识别的资源请求代理给可处理的对等 API server。
推荐理由:Kubernetes v1.36 将 Mixed Version Proxy 提升至 Beta 并默认启用,可帮助多控制面集群升级时正确路由未知资源请求;升级前需核对 feature gate、peer CA 和对等网络配置。
Kubernetes v1.36 正式弃用 Service 的 .spec.externalIPs 字段,使用该字段时将产生警告。官方预计至少到 v1.40 才会在 kube-proxy 中禁用相关行为,用户可选择重新启用;至少到 v1.43 将彻底禁用且无法重新启用。
推荐理由:明确给出弃用、禁用和彻底移除的时间线,并说明可用的迁移方案,有助于管理员评估兼容性、访问控制与替代架构。
Kubernetes v1.36以独立PodGroup API重构工作负载调度,并引入拓扑感知调度、工作负载感知抢占及DRA支持。其PodGroup调度周期支持成组调度,Job controller可在限定条件下自动创建Workload和PodGroup。这些改进均属Alpha功能,需启用相应特性门;v1.37目标包括API进入Beta及扩展调度能力。
推荐理由:新API架构、调度周期及启用条件说明完整,可用于评估Alpha阶段能力、兼容性限制与测试配置。
Kubernetes v1.36正式提供PSI指标的稳定接口,可观测节点、Pod和容器级别的CPU、内存与I/O资源争用。SIG Node在80多个Pod的高密度工作负载上测试,Kubelet和内核额外CPU开销处于文中所述范围。使用Linux 4.20及以上内核、cgroup v2并启用PSI后可采集指标,Windows节点不支持这些指标。
推荐理由:Kubernetes v1.36将PSI指标从测试阶段推进至GA,并给出高密度负载性能数据、节点兼容条件与采集方式,便于团队评估生产部署成本和监控接入方案。
Google DeepMind等机构在Nature发表Co-Scientist研究,提出一个基于Gemini的多代理AI系统,用于生成、辩论、改进和排序科学研究假设。团队正通过Hypothesis Generation向个人研究者逐步开放该实验工具,并表示其不能替代科学或临床专业知识。
推荐理由:明确介绍Co-Scientist的多代理工作流、假设生成与验证机制及研究案例,并说明实验工具的分阶段开放,对科研人员评估其辅助研究价值具有参考意义。
Kubernetes v1.36 将卷组快照支持提升至 GA,相关 API 升级为 groupsnapshot.storage.k8s.io/v1。该功能仅支持 CSI 卷驱动,可为多个 PersistentVolumeClaim 创建崩溃一致性快照,并将快照恢复到新卷;GA 还包含稳定性、缺陷修复及 restoreSize 报告改进。
推荐理由:明确宣布卷组快照进入 GA,API 升为 v1,适合 CSI 存储驱动和 Kubernetes 存储团队评估集成路径与恢复流程。