跳到正文

全部动态

今日 100 条
7月7日周二
  1. Hugging Face Blog71

    Hugging Face 与 SkyPilot 推出零出站存储的跨云 AI 工作负载方案

    Hugging Face 与 SkyPilot 联合推出 `store: hf`,可通过 `hf://` URL 将 Hugging Face Bucket 或 Hub 仓库挂载到 SkyPilot 任务,并在 20+ 云、Kubernetes、Slurm 和本地集群间调度 GPU。

    推荐理由:为跨云运行 AI 工作负载提供统一存储接入,团队可按 GPU 资源调度云端或本地集群,减少跨云读取成本与迁移负担。

7月4日周六
  1. Hugging Face Transformers80

    Hugging Face Transformers 发布 v5.13.0

    Hugging Face Transformers v5.13.0 新增 KimiK 2.5、MiMo-V2-Flash、Qwen3 ASR、MiniCPM3 等模型支持。

    推荐理由:新增多类模型支持、统一导出接口并集中修复生成、缓存与量化问题,同时包含迁移要求,升级前需核对兼容性。

7月2日周四
  1. Brave Blog66

    Brave 1.92 开始提供 Containers 以隔离标签页身份

    Brave 浏览器 1.92 更新加入 Containers,允许用户将标签页隔离,使 Cookie 和存储不会在容器之间共享。Containers 可用于同时登录不同社交媒体账号,或分别以管理员和普通用户身份测试应用;该功能已内置于 Windows、macOS 和 Linux,正在数日內分阶段推出。

    推荐理由:Brave 1.92 新增 Containers,可在同一网站隔离 Cookie 与存储,支撑多身份管理和测试工作流;功能内置于各桌面平台,并分阶段推送。

7月1日周三
  1. Google Research Blog67

    Google Research 将 Heat Resilience 数据扩展至全球 50 多个城市

    Google Research 发布覆盖全球 50 多个城市、9 个国家的建筑级屋顶反射率扩展数据集,并通过 Heat Resilience Earth Engine App 公开提供。

    推荐理由:扩展数据集与 Earth Engine App 为城市规划提供建筑级屋顶反射率,30厘米分辨率和公开下载能力有助于定位降温干预对象,兼具研究与实践价值。

6月30日周二
  1. Google Research Blog70

    Google发布面向表格数据的零样本基础模型TabFM

    Google发布TabFM,一种面向表格数据分类与回归的零样本基础模型,可通过单次前向推理处理未见过的新表。模型采用行列交替注意力、行压缩和上下文学习架构,并完全使用数亿个合成数据集训练;现已提供于Hugging Face和GitHub,并原生集成至Google Cloud BigQuery。

    推荐理由:TabFM将表格分类与回归改写为零样本上下文预测,并通过BigQuery开放使用,适合评估减少特征工程和调参工作的企业分析方案。

6月26日周五
  1. Kubernetes Blog66

    Headlamp 发布 Cluster API 插件首个 Alpha 版本

    Headlamp 发布 Cluster API 插件首个 Alpha 版本,为浏览器中的 Kubernetes 集群生命周期管理提供专门界面。

    推荐理由:首个 Alpha 版本将 Cluster API 资源、拓扑关系、扩缩容与引导配置集中到 Headlamp,并为平台团队提供可视化排障入口;其适用边界和后续改进仍需社区验证。

6月25日周四
  1. Google DeepMind Blog75

    Google DeepMind 将 computer use 原生整合至 Gemini 3.5 Flash

    Google DeepMind 在 Gemini 3.5 Flash 中原生提供内置的 computer use 工具,可让智能体在浏览器、移动端和桌面环境中观察、推理并执行操作。开发者可通过 Gemini API 和 Gemini Enterprise Agent Platform 使用;Google 还提供可选的企业防护系统,用于敏感或不可逆操作确认及识别间接提示注入后自动停止任务。

    推荐理由:把此前独立的 computer use 模型原生整合进 Gemini 3.5 Flash,并提供企业安全控制与参考实现,便于开发者评估和构建跨平台智能体。

6月23日周二
  1. Python Insider71

    Python 3.15.0 beta 3 发布,进入功能冻结前的测试阶段

    Python 3.15.0b3 已发布,这是计划中的四次 beta 预览之一,自 3.15.0b2 以来包含约 195 项缺陷修复、构建改进和文档变更。该版本仍不推荐用于生产环境,官方建议常规生产版本等待 3.15.0rc1,以降低 ABI 变更风险;下一次预发布版本 3.15.0b4 计划于 2026-07-18 发布。

    推荐理由:官方发布信息明确了测试范围、兼容性风险与后续节点,适合 Python 项目维护者评估升级准备和生产环境使用边界。

6月17日周三
  1. Google DeepMind Blog54

    Google DeepMind与英国政府开发AI规划原型,加速住宅规划审批

    Google DeepMind与英国政府共同开发面向地方规划部门的AI规划原型,目标将规划申请的决策处理时间缩短50%。该原型已在Barnet、Camden和Dorset开展早期试用,可汇总资料、标记相关政策、归纳反馈并起草评估报告,但最终决定权仍由规划人员掌握。政府计划从2027年向英国所有地方议会提供该工具。

  2. Google Research Blog71

    Google发布用于自然恢复规划的Earth AI矢量数据集

    Google Research发布基于Earth AI的矢量数据集,将Farmscapes 2020中的地图转换为可操作的树篱、石墙和小树林清单。方法结合高分辨率深度学习、亚米级影像、1米LiDAR和Google Earth Engine,用于识别并分类英格兰数百万个精细尺度地物。Google还表示将继续研究其在林牧复合系统及“泄漏”识别中的用途。

    推荐理由:将此前高分辨率栅格地图转为可操作的矢量数据集,补充了生态规划与碳核算所需的精细尺度信息。

6月16日周二
  1. Google DeepMind Blog52

    Google 发布 AI Control Roadmap,强化内部 AI 代理安全控制

    Google 发布 AI Control Roadmap,通过将内部 AI 代理视为潜在“内部威胁”,建立基于威胁建模、可信 AI 监督和分级响应的多层安全体系。团队已分析一百万条 coding agent 任务轨迹,并将数据用于 Gemini Spark agent 的实时监测;文章还发布了面向政策制定者的《Three Layers of Agent Security》技术框架。

6月13日周六
  1. Google Research Blog57

    加州大学圣迭戈分校计划用 2,000 部 Pixel 手机构建低碳计算平台

    加州大学圣迭戈分校研究者计划提取退役智能手机主板,组建由 2,000 部 Pixel 手机组成的通用计算平台,为数百名研究者和学生提供低成本、低碳的云计算。平台将以 Kubernetes 管理容器化应用,并按 25–50 部设备组成自管理集群;20 部手机的早期实验可支持 75 名以上学生的高峰提交率,完整系统预计于 Fall 2026 启动。

6月11日周四
  1. Google DeepMind Blog72

    Google DeepMind 发布 DiffusionGemma,专用 GPU 上文本生成最高提速 4 倍

    Google DeepMind 发布实验性开放模型 DiffusionGemma,以文本扩散并行生成整块文本,在专用 GPU 上最高实现 4 倍文本生成速度。该 26B MoE 模型推理时激活 3.8B 参数,单张 NVIDIA H100 可达 1000+ tokens/s,量化后可装入 18GB VRAM 的高端消费级 GPU。

    推荐理由:提供开放权重、硬件吞吐数据和微调工具链,并明确适用场景与质量取舍,便于开发者评估速度敏感型本地工作流是否值得试用。

6月9日周二
  1. Google DeepMind Blog73

    Google 发布 Gemini 3.5 Live Translate 实时语音翻译模型

    Google 发布 Gemini 3.5 Live Translate,可自动检测 70 多种语言并持续生成近实时语音到语音翻译,保留说话者的语调、节奏和音高。模型通过 Gemini Live API 和 Google AI Studio 面向开发者公测,Google Meet 企业私有预览同月开始,Google Translate 则在 Android 和 iOS 全球推出。

    推荐理由:明确覆盖模型能力、开发者接口、企业预览和移动端上线路径,并区分公测、私有预览与全球推出,便于评估实时语音翻译的可用范围和接入方式。

  2. Google DeepMind Blog74

    Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型

    Google DeepMind 发布 Gemma 4 12B,一款面向笔记本电脑的统一无编码器多模态模型,可直接处理视觉和音频输入。

    推荐理由:Gemma 4 12B把视觉、音频输入直接接入语言模型骨干,兼顾多模态推理与本地运行资源要求;其开源权重、部署工具和开发文档对想在笔记本上构建智能体应用的团队具有较高实用价值。

6月5日周五
  1. Google Research Blog69

    Google Research 发布 Gemini Enterprise Agent Platform 托管版 Agentic RAG

    Google Research 推出由 Gemini Enterprise Agent Platform 托管的 Cross-Corpus Retrieval,并加入 Agentic RAG 与 Sufficient Context Agent,以支持多数据源、多跳查询和缺失信息的迭代检索。

    推荐理由:Google以官方研究结果说明了该平台托管版的工作机制、评测设置与公开预览状态,对评估企业多数据源检索的可追溯性和准确性具有直接参考价值。

6月4日周四
  1. Google Research Blog69

    Google开源水文建模框架以支持AI洪水预报

    Google Research在GitHub开源水文建模框架、训练流程和文档,采用Apache 2.0许可,供研究人员和预报机构训练及微调洪水预报模型。框架包含LSTM模型和Caravan数据集训练流程,Google称新版相较前一版本将有测站流域的可靠预测期延长6天、无测站流域延长1天。Google还与CHMI合作验证其模型,并开发了接入Delft-FEWS的适配器。

    推荐理由:Google开源水文建模框架,提供模型架构、训练流程与文档,并支持本地数据接入及Delft-FEWS集成,便于机构构建和定制洪水预报模型。

6月3日周三
  1. Home Assistant Blog82

    Home Assistant 2026.6 发布:实体导向的卡片选择器与自动化改进

    Home Assistant 2026.6 推出从实体出发、使用自身数据实时预览的卡片选择器,并改进自动化编辑器,加入目标数量、条件测试状态和步骤备注。版本还使 Infrared 可接收事件、为 Z-Wave 智能锁加入凭证管理,并将蓝牙与 ESPHome 代理默认扫描模式改为 Auto。Labs 中新增区域触发器和条件,同时包含不兼容配置变更,升级前需核对。

    推荐理由:卡片选择器、自动化编辑器和蓝牙扫描改进贴近日常配置与维护,兼容变更和Labs功能说明也较完整,适合自托管用户评估升级影响。

6月2日周二
5月29日周五
  1. Google Research Blog74

    Google Research 展示 I/O 2026 研究与产品进展

    Google Research 在 I/O 2026 介绍了 Gemini for Science、Google Health app、MedGemma、Synaptics Coralboard、Google Antigravity 2.0 等项目及相关研究进展。

    推荐理由:文章集中梳理 Google I/O 2026 的研究与产品进展,覆盖科学、医疗、边缘硬件、开发者平台及量子计算,适合了解官方发布范围与落地方向。

5月22日周五
5月21日周四
  1. Go Blog72

    Go 推出 pkg.go.dev API 以查询已发布模块元数据

    Go 推出官方 pkg.go.dev API,用于查询已发布 Go 模块及其包、版本、搜索结果、符号、依赖关系和漏洞信息。API 采用无状态、仅 GET 的架构,目前主要端点位于 /v1beta,并提供 OpenAPI 规范和 pkgsite-cli 参考客户端;存在模块路径歧义时,API 会要求客户端明确指定模块。

    推荐理由:为工具、IDE 和自动化流程提供直接的 Go 模块元数据访问,接口设计、无状态 GET 架构及版本解析规则有助于降低集成成本并明确客户端行为。

5月20日周三
  1. Kubernetes Blog71

    etcd 3.7.0-beta.0 发布:引入 RangeStream 并移除 v2store

    SIG-Etcd 发布 etcd v3.7.0-beta.0,首个 beta 引入 RangeStream RPC,使调用方可以分块接收结果集;同时移除 v2store,改为完全使用 v3store。

    推荐理由:首个 beta 引入 RangeStream 并移除 v2store,直接影响依赖兼容性与大结果集处理;项目同时明确 v3.4 将停止更新,适合评估升级风险与测试方向。

  2. Google Research Blog68

    Google Research发布ERA并逐步开放Computational Discovery

    Google Research宣布,基于Gemini的科研工具ERA已在Nature发表,并开始通过Gemini for Science逐步开放。ERA可依据科学问题和成功指标检索文献、编写代码、探索方案并评估结果,已用于流行病预测、径流预测、CO₂监测、太阳能优化和零售预测等研究。

    推荐理由:ERA以Gemini生成并优化科研代码,Google同时宣布其在Nature发表及逐步开放,能帮助读者了解AI辅助科学计算的工具范围与应用案例。

5月18日周一
  1. Google DeepMind Blog61

    Google 在 Project Genie 中推出 Street View 实景地点生成能力

    Google 在 Project Genie 实验性原型中推出由 Street View 驱动的实景地点生成能力,并面向全球符合条件的 Google AI Ultra 订阅者逐步开放。该功能可让用户选择美国地点及“Ocean World”“Desert Sands”“B&W film”等风格生成世界;Project Genie 仍属于 Google Labs 的实验性研究原型。

    推荐理由:这项更新把 Street View 实景影像接入生成式世界模型,为 AI 智能体和机器人研究提供更贴近真实地点的交互环境,同时扩大了实验原型的可用范围。

  2. Google DeepMind Blog72

    Google DeepMind 发布 Gemini Omni Flash 多模态视频生成模型

    Google DeepMind 发布 Gemini Omni Flash,这是 Gemini Omni 系列的首个模型,可将图像、音频、视频和文本组合输入,生成受现实世界知识支持的高质量视频,并支持通过自然语言进行多轮编辑。

    推荐理由:Gemini Omni Flash将多模态理解、生成与对话式视频编辑整合,并分阶段进入Gemini app、Google Flow、YouTube Shorts及API;其输入组合、跨轮编辑、角色一致性和SynthID验证机制,对内容创作者与开发者的实际工作流具有直接参考价值。

5月17日周日
  1. Google DeepMind Blog60

    Google 发布 Gemini for Science 科学工具与实验

    Google 发布 Gemini for Science,包含 Google Labs 的三个实验原型及 Google Antigravity 的 Science Skills。

    推荐理由:同时推出科学工具原型与桌面技能集合,覆盖假设生成、计算发现和文献分析;其并行验证、引用支持及机构合作为科研团队评估适用性提供明确线索。

5月16日周六
  1. Google DeepMind Blog75

    Google DeepMind发布Gemini 3.5 Flash,面向智能体与编程任务

    Google DeepMind推出Gemini 3.5 Flash,用于执行复杂、智能体式工作流,官方称其在编程和智能体基准测试中优于Gemini 3.1 Pro。Gemini 3.5 Flash现已面向全球用户及开发者、企业平台提供,Gemini 3.5 Pro仍在内部使用,计划下月推出。

    推荐理由:Google DeepMind发布Gemini 3.5 Flash,覆盖智能体、编程和长流程任务,并同步提供API及多平台入口;其性能、速度与部署范围信息可供开发者评估。

5月14日周四
  1. Kubernetes Blog75

    Kubernetes v1.36推进工作负载感知调度

    Kubernetes v1.36以独立PodGroup API重构工作负载调度,并引入拓扑感知调度、工作负载感知抢占及DRA支持。其PodGroup调度周期支持成组调度,Job controller可在限定条件下自动创建Workload和PodGroup。这些改进均属Alpha功能,需启用相应特性门;v1.37目标包括API进入Beta及扩展调度能力。

    推荐理由:新API架构、调度周期及启用条件说明完整,可用于评估Alpha阶段能力、兼容性限制与测试配置。

5月13日周三
  1. Kubernetes Blog70

    Kubernetes v1.36:PSI指标正式达到GA

    Kubernetes v1.36正式提供PSI指标的稳定接口,可观测节点、Pod和容器级别的CPU、内存与I/O资源争用。SIG Node在80多个Pod的高密度工作负载上测试,Kubelet和内核额外CPU开销处于文中所述范围。使用Linux 4.20及以上内核、cgroup v2并启用PSI后可采集指标,Windows节点不支持这些指标。

    推荐理由:Kubernetes v1.36将PSI指标从测试阶段推进至GA,并给出高密度负载性能数据、节点兼容条件与采集方式,便于团队评估生产部署成本和监控接入方案。

5月12日周二
  1. Google DeepMind Blog75

    Google DeepMind发布Co-Scientist多代理科学研究伙伴

    Google DeepMind等机构在Nature发表Co-Scientist研究,提出一个基于Gemini的多代理AI系统,用于生成、辩论、改进和排序科学研究假设。团队正通过Hypothesis Generation向个人研究者逐步开放该实验工具,并表示其不能替代科学或临床专业知识。

    推荐理由:明确介绍Co-Scientist的多代理工作流、假设生成与验证机制及研究案例,并说明实验工具的分阶段开放,对科研人员评估其辅助研究价值具有参考意义。

5月9日周六
  1. Kubernetes Blog72

    Kubernetes v1.36 将卷组快照功能提升至 GA

    Kubernetes v1.36 将卷组快照支持提升至 GA,相关 API 升级为 groupsnapshot.storage.k8s.io/v1。该功能仅支持 CSI 卷驱动,可为多个 PersistentVolumeClaim 创建崩溃一致性快照,并将快照恢复到新卷;GA 还包含稳定性、缺陷修复及 restoreSize 报告改进。

    推荐理由:明确宣布卷组快照进入 GA,API 升为 v1,适合 CSI 存储驱动和 Kubernetes 存储团队评估集成路径与恢复流程。

5月8日周五
  1. Kubernetes Blog72

    Kubernetes v1.36 推进 DRA 驱动扩展、资源分配与新能力

    Kubernetes v1.36 扩展了 Dynamic Resource Allocation(DRA)的驱动支持与资源管理能力,并让多项核心功能进入 Beta 或 Stable。新能力包括支持 PodGroups 中的 ResourceClaim、管理 CPU 和内存等节点可分配资源,以及提供资源池可用性视图。

    推荐理由:系统梳理 Kubernetes v1.36 中 DRA 的稳定、Beta 与 Alpha 变化,覆盖设备选择、分区、健康状态、PodGroups 和节点资源,适合评估迁移节奏与驱动适配工作。

5月7日周四
  1. Kubernetes Blog69

    Kubernetes v1.36 引入服务端分片 List 和 Watch alpha 功能

    Kubernetes v1.36 引入服务端分片 List 和 Watch alpha 功能,由 API Server 按哈希范围过滤事件,减少控制器副本接收和处理无关对象。

    推荐理由:明确说明 Kubernetes v1.36 的 alpha 机制、配置方式与回退判断,便于控制器作者评估大规模集群的分片改造成本,但启用前仍需验证服务端支持。