跳到正文

#AI

今日 13 条
9月30日周三
  1. Google Research Blog57

    Google Research 提出 Diffusion Controller 统一 AI 图像生成控制

    Google Research 提出 Diffusion Controller,将扩散模型的去噪过程建模为连续控制问题,以轻量控制网络调整生成轨迹。实验基于 Stable Diffusion v1.4,比较 SFT、奖励加权损失和 PPO;完全开放版本相对基线取得 90% 胜率。该框架面向灰盒与白盒环境,并支持通过单一推理时引导强度参数调整控制约束。

  2. Ollama 官方发布65

    Ollama v0.35.1-rc0支持显式模型能力声明

    Ollama发布v0.35.1-rc0,为Modelfile增加CAPABILITY声明,并为create请求增加可追加的capabilities字段。该版本在GGUF和safetensors创建、继承及Modelfile导出中保留这些声明,并要求System One请求先具备decision能力。

    推荐理由:该候选版本补齐模型能力声明与创建请求字段,并调整System One调度依据;对需要明确能力配置、模型继承和导出流程的开发者具有直接的兼容性与集成价值。

  3. Microsoft 开发者博客75

    使用 GitHub Copilot Plugins 实现一致的 AI 辅助工程

    Microsoft 开发者团队介绍了如何用 GitHub Copilot plugins 打包和分发迁移与现代化工作流中的共享指令、技能及 MCP 配置。文章说明,插件可采用版本化发布,通用架构指导与具体应用上下文分别管理,并可通过支持的客户端和内部 marketplace 安装、更新与回滚。

    推荐理由:文章以企业迁移与现代化工具包为案例,说明如何用 GitHub Copilot plugins 管理共享指令、技能和 MCP 配置,适合评估 AI 辅助工程规范的分发与治理方式。

9月29日周二
  1. Hugging Face Blog76

    NVIDIA 发布开放表格基础模型 Kumo Tabular

    NVIDIA 发布 Kumo Tabular,可通过一次前向推理完成表格分类与回归,无需训练、调参或特征工程。该模型仅使用人工表格预训练,提供 Small、Medium、Large 三种规模,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 评测中位居榜首;代码和权重已公开。

    推荐理由:提供无需训练、调参或特征工程的表格分类与回归方案,并公开代码、权重、许可和评测结果,便于团队评估其精度、效率及实际数据上的适用性。

  2. GitHub Blog64

    GitHub 更新开发者政策:透明度、州级政策及后续关注事项

    GitHub公布H1 2026透明度中心数据,政府下架请求从2025年全年98件增至上半年708件,主要源于报告方法和内部统计口径调整,并非内容移除增加。GitHub还回顾内容溯源、AI透明度和年龄验证等州级立法进展,并表示将关注DMCA Section 1201规则制定及年轻人访问AI工具等议题。

    推荐理由:文章同时说明政府下架请求统计口径变化,并梳理内容溯源、年龄验证等州级法案及后续政策议题;对开发者理解合规影响和参与开源政策讨论有参考价值。

  3. Immich 官方发布73

    Immich 发布 v3.3.0-rc.0 首个候选版本

    Immich 发布 v3.3.0-rc.0,这是 v3.3 的首个候选版本,并非稳定版。更新可能包含缺陷或破坏性变更,官方要求升级前备份数据库和媒体库。

    推荐理由:正式版前的候选版本覆盖服务端、网页端和移动端多项功能与修复,并提供明确测试入口;其不稳定性与潜在破坏性变更要求自托管用户先备份再评估升级。

  4. Hugging Face Blog64

    Multiverse Computing 发布 ProvenanceGuard:面向 MCP 智能体的来源感知验证

    Multiverse Computing 发布 ProvenanceGuard,通过保留 MCP 工具输出及来源 ID,逐项检查声明的证据支持与来源归属,而不将多源证据合并后验证。

    推荐理由:该研究将来源归属检查引入MCP智能体验证,并公开离线实验、误拦截与多源识别局限,便于评估敏感场景中的事实核查方案。

  5. Cloudflare Blog70

    Cloudflare 介绍用 AI 工具 CryptoLabe 推进后量子迁移

    Cloudflare 正开发内部工具 CryptoLabe,以两阶段扫描发现代码中的密码学用法、评估迁移分类,并生成面向产品经理和工程师的报告。该工具依托 Workers、Durable Objects、Workflows、AI Gateway 等组件,但仍在演进,尚未提供客户使用;Cloudflare 也强调扫描结果需由相关工程师复核,公开的提示词只是起点。

    推荐理由:披露 CryptoLabe 的分阶段扫描、分类、编排与人工复核方法,并说明缺少 ground-truth 数据集和完整覆盖,可供团队设计后量子迁移盘点流程时参考。

  6. JetBrains Blog52

    JetBrains 发布《2026 年 Kotlin 现状报告》

    JetBrains 发布《2026 年 Kotlin 现状报告》,回顾 Kotlin 十五年的发展与应用扩展。受访 Kotlin 开发者中,93% 至少使用一种 AI 编程工具,81% 已使用或可能尝试 AI 编程代理;超过半数开发者参与后端项目。报告结合 JetBrains 研究、独立行业数据和实际采用证据,覆盖移动端、后端、多平台及 AI 辅助开发。

  7. JetBrains Blog51

    开发者软件质量保障工具与实践指南

    软件质量保障应从发布前测试转向贯穿软件开发生命周期的持续检查,并在自动化分析与人工评审之间保持平衡。指南按阶段介绍静态分析、单元与集成测试、功能与UI测试、性能测试和安全测试,同时说明工具选型、CI/CD集成及shift-left等实践。

  8. Ubuntu Blog72

    Ubuntu 26.04.1 LTS 桌面版正式发布

    Ubuntu 26.04.1 LTS 桌面版现已开放下载安装,整合 Ubuntu 26.04 LTS 初次发布后识别出的修复与改进。该版本采用 GNOME 50,引入 Papers、Loupe、Ptyxis 和 Resources,并提供最新开发工具链、官方 CUDA 仓库及 TPM 支持的全盘加密等功能。

    推荐理由:文章集中说明 Ubuntu 26.04.1 LTS 的修复整合、桌面迁移、开发与 AI 工具链、企业安全能力及支持周期,适合升级评估和部署规划参考。

  9. GitLab Blog49

    GitLab Duo Agent Platform 与 Claude Code:兼顾速度与合规的 AI 编码治理

    GitLab Duo Agent Platform 可将 Claude Code 作为编码界面纳入受治理的软件开发生命周期,使相关操作受到约束、记录并可审查。该平台以统一治理平面处理合并请求,并支持在机构自有单租户环境部署 AI Gateway、连接 Amazon Bedrock 等模型提供商。2026年2月,NIST启动了首个面向智能体 AI 安全标准的联邦项目。

  10. GitHub Blog80

    GitHub开源AI安全代理发现24个Android漏洞

    GitHub Security Lab Taskflow Agent 通过定制的 Android 审计 taskflow 报告了24个漏洞,案例包括 OsmAnd 位置追踪和 Wikipedia Android 账户接管。

    推荐理由:文章提供可复现的移动应用审计流程、具体漏洞案例与运行命令,同时明确说明模型在严重性判断、误报和人工复核方面的局限,对安全研究和工具选型有实际参考价值。

  11. Microsoft 开发者博客66

    GitHub Copilot app 入门:免费开源实战课程

    GitHub Copilot app 推出免费开源入门课程,通过一个 React、Vite 与 TypeScript 示例项目讲解 AI 编码智能体的使用和审查。课程包含设置及七个实践章节,覆盖会话模式、git worktree、GitHub 工作流、自定义智能体、MCP 服务器、插件、Canvases 与自动化;学习者需要 Copilot 计划,或登录自己的模型提供方。

    推荐理由:通过同一示例项目串联会话模式、Git worktree、差异审查、测试与预览,适合开发者练习如何指挥智能体并人工验证结果。

  12. Anthropic Python SDK69

    Anthropic Python SDK v1.9.0 更新 API、诊断与流式工具调用

    Anthropic Python SDK 发布 v1.9.0,新增 between_tools thinking 类型、claude-sonnet-5-5、workspace rate limits 继承信息、Managed Agents 事件过滤类型值及 diagnostics GA。

    推荐理由:本次版本更新扩展 API 类型、诊断与流式工具调用能力,并修复文件上传和请求头处理问题,对 SDK 集成与兼容性维护有直接参考价值。

  13. AWS News Blog62

    AWS 周报:Amazon Bedrock 新增 GPT-6 Sol、GPT-6 Luna 与 Claude Opus 5.5,及多项服务更新

    AWS 周报汇总了 GPT-6 Sol、GPT-6 Luna 和 Claude Opus 5.5 在 Amazon Bedrock 的推出,以及 CloudWatch Omni、EventBridge、SageMaker HyperPod Inference Gateway 等更新。文章还介绍了 Strands harness、AI agent skills 和 AWS 近期活动信息。

    推荐理由:汇总了模型、可观测性、事件总线、推理网关和消息技能等多项 AWS 更新,并说明关键能力与使用方式,适合评估近期云端 AI 开发方案。

9月28日周一
  1. JetBrains Blog70

    JetBrains 发布 Air Teams,面向团队共享代理开发工作流

    JetBrains 发布 Air Teams,为团队提供共享代理开发工作区、统一云环境、云端任务和项目级权限管理。Automations 可由事件或计划触发,团队可复用代码审查、问题修复和依赖更新等模板;Air Teams 已面向 JetBrains 商业客户开放,个人客户访问仍计划后续扩展。

    推荐理由:JetBrains 将 Air 从个人桌面应用扩展为团队级代理开发平台,提供可复用的自动化、云环境、云端任务和项目权限管理,适合评估团队如何规范并持续运行重复性开发工作。

  2. JetBrains Blog65

    Rider 2026.2.3 发布:Monitoring 新增 AI 性能分析

    Rider 2026.2.3 在 Monitoring 工具窗口加入 AI 性能分析,可让 AI agent 通过 dottrace-analyze skill 调查最近会话及旧快照中的性能瓶颈和热路径。

    推荐理由:该版本提供基于运行数据的 AI 性能分析入口,并修复 Windows 缩放场景下的组件故障;功能范围与订阅、插件条件明确,便于团队评估采用与升级。

  3. Hugging Face Blog69

    Holo4发布:面向多种软件接口的通用计算机操作代理模型

    H Company发布Holo4系列代理模型,包括27B稠密版和35B-A3B Mixture of Experts版本,均可通过H Models API使用。Holo4可在GUI、代码沙箱、MCP和API之间调用能力,权重提供BF16、FP8、NVFP4和4-bit GGUF格式;其公开基准测试结果显示,在OSWorld 2.0上27B版本得分为61.7%,35B-A3B版本为30.9%。

    推荐理由:Holo4提供27B稠密版与35B-A3B混合专家版,统一支持GUI、代码、MCP和API,并公开基准测试轨迹,便于开发者评估其跨接口代理能力。

  4. NVIDIA Developer Blog30

    使用 NVIDIA OpenShell 为 AI 智能体添加运行时控制

    NVIDIA OpenShell 可用于为 AI 智能体添加运行时控制,使智能体在获得目标后编写代码、使用工具,并随新信息出现持续工作。此类智能体需要访问工作区、计算资源、数据、凭据和外部服务,可用于调查软件故障、运行实验,以及持续数天或数周执行关键业务操作和研究。

9月26日周六
9月25日周五
  1. Microsoft Security Blog80

    Storm-3168:利用被盗服务主体实施智能体驱动的云攻击

    Microsoft Security Research 发现 Storm-3168 关联的恶意云活动,受害租户的两个被盗服务主体先进行 Azure 资源枚举,随后执行资源破坏和凭据收集。攻击在 35 分钟内发起 150 多次破坏或凭据收集操作,尝试删除 Azure 存储账户、SQL 数据库、Key Vault、Function App 等资源;文章同时说明未观察到赎金说明或成功的数据外传。

    推荐理由:文章提供 Storm-3168 利用被盗服务主体攻击 Azure 的完整时间线、行为链和 IOC,并明确区分资源破坏、凭据收集与未证实的数据外泄,便于云安全团队复盘和制定防护措施。

  2. Ollama 官方发布64

    Ollama v0.40.0-rc0 默认在 Apple Silicon 上使用 MLX 运行模型

    Ollama v0.40.0-rc0 发布,Apple Silicon 设备上受 MLX runtime 支持的模型架构将默认通过 MLX 运行。预发布期间还会测试并启用更多模型,文中以 qwen3.8 展示 `ollama pull` 与 `ollama run` 命令。

    推荐理由:该预发布版本明确了 Apple Silicon 上 MLX 的默认执行路径,并给出模型拉取与运行命令,便于相关用户验证兼容性及运行时行为。