跳到正文

#开发

今日 0 条
9月25日周五
  1. CNX Software61

    MemBrowse持续追踪固件内存占用,开源项目免费

    MemBrowse可在CI中持续追踪嵌入式固件的RAM与Flash占用,支持GitHub Actions、GitLab CI、Jenkins及其他CI系统。其开源CLI解析项目的ELF文件和链接脚本并上传报告,还可比较目标、展示历史趋势,并通过用户设定阈值使超限CI失败。公共仓库中的开源项目可免费使用且支持不限数量的追踪目标;闭源项目起价为每月99美元,最多追踪10个目标。

  2. Simon Willison17

    commit-rewriter 0.2

    Simon Willison 发布了题为“commit-rewriter 0.2”的内容。现有正文仅说明该内容发布于 2026 年 9 月 24 日,未提供 commit-rewriter 0.2 的功能、具体变化或使用方式。

  3. GitHub Blog65

    GitHub Copilot:聊天何时是错误的界面

    GitHub Copilot app 中的 canvas 是可定制的全栈应用,能与 GitHub Copilot agent 双向通信,并执行常规计算机程序可完成的操作。文章通过 Connect 4、Winget、SQLite 和开发工作流示例,说明定制界面可减少重复调用代理、降低 token 消耗,并支持在研究、原型、实现和迭代阶段使用更适合任务的交互方式。

    推荐理由:文章以 Connect 4、Winget、SQLite 和开发工作流为例,说明如何用 canvas 构建可操作的应用界面,减少重复对话,并为代理协作提供更贴合任务形态的交互方式。

  4. Google Research Blog64

    Google Research 提出连贯长视频生成多代理框架

    Google Research 提出 AI video co-director 统一多代理框架,并介绍 CANVAS、A²RD 与 VQQA。其方法分别处理多镜头创意规划、视觉状态连续性、分钟级视频生成和视觉瑕疵反馈优化。

    推荐理由:将长视频生成拆分为全局创意规划、视觉连续性、长程生成与闭环优化,框架、评测集和量化结果可供研究与原型验证参考。

  5. Grafana Blog55

    如何为AI代理行为设置SLO与错误预算

    Grafana Labs提出用评估将AI代理行为转化为可测量指标,再为目标设定SLO,将未达标比例作为错误预算。团队可在预算内测试提示词和模型,通过真实对话回放检查目标达成情况,并让Grafana Assistant协助创建评估、推荐目标和建立SLO。

  6. Docker Blog77

    Docker 发布 Sandbox Kit Specification v3

    Docker 发布开源的 Docker Sandbox Kit Specification v3,并以 Apache 2.0 许可提供。Kit 现在是普通 OCI 镜像,清单通过 vnd.docker.sandbox.kit.descriptor 注解携带声明,镜像层承载内容。规范要求权限由宿主决定,并提供制品与运行时一致性测试;Docker Sandboxes 是文中所述的首个符合规范的运行时。

    推荐理由:将代理运行所需的网络、凭据、卷等权限声明纳入OCI镜像,便于构建、审查、签名及跨运行时一致执行,为代理隔离与权限治理提供可复用规范。

9月24日周四
  1. NVIDIA Developer Blog13

    生物基础模型的高效 MoE 训练

    生物基础模型采用 Mixture-of-experts(MoE)架构进行高效训练,通过让每个 token 仅激活一部分专家子网络来扩展模型。随着模型规模增长,稠密 Transformer 中每个 token 都会经过所有层,增加能力会同步提高训练和推理的计算成本。

  2. Hugging Face Blog66

    Liquid AI 发布实验性 LFM2.5-VL-3B-DSpark 视觉语言模型草稿器

    Liquid AI 发布实验性 DSpark 草稿模型,为 LFM2.5-VL-3B 增加推测解码路径,以约 280M 参数换取视觉语言推理加速。测试显示,设备端解码最高加速 3.13 倍,H100 解码最高加速 2.66 倍,但视觉编码和 prefill 不受该路径加速;模型支持 llama.cpp、MLX-VLM 和 SGLang。

    推荐理由:文章提供 LFM2.5-VL-3B 的实验性 DSpark 草稿模型及 CPU、GPU 测试数据,并说明接入方式、内存代价和视觉任务中的加速边界,适合评估端侧或自托管部署方案。

  3. NVIDIA Blog65

    NVIDIA联合发布开放病毒蛋白复合物数据集

    NVIDIA与Google DeepMind、EMBL-EBI等机构发布涵盖2,800多种病毒的预测3D蛋白复合物结构,数据通过AlphaFold Database向全球科学家开放。约30%的蛋白相互作用此前未见于Protein Data Bank;NVIDIA还开放生成该数据集所用的BioNeMo Structure Prediction Pipeline。

    推荐理由:该发布同时提供大规模病毒蛋白复合物预测数据和可复用的GPU加速流程,有助于研究人员生成假设、选择验证目标并提前积累大流行准备所需结构信息。

  4. JetBrains Blog70

    JetBrains设计并交付Kotlin Multiplatform与TeamCity集成

    JetBrains推出Kotlin Multiplatform与TeamCity集成,帮助开发者从IDE中的首次Git推送完成iOS构建测试、签名并上传至TestFlight,再连接GitHub实现自动流水线。流程由TeamCity Cloud托管macOS代理运行,生成的teamcity.yaml、Fastfile、Appfile和Gemfile可先在本地审阅,首次构建成功后由开发者自行提交。

    推荐理由:JetBrains公布面向Kotlin Multiplatform iOS开发的TeamCity集成设计,串联构建、签名、TestFlight发布与GitHub自动化,适合跨平台团队评估CI/CD落地流程。

  5. Ollama 官方发布64

    Ollama v0.34.4 发布:优化思考模型结构化输出与 Apple Silicon 表现

    Ollama v0.34.4 发布,思考模型的结构化输出改为单次处理,以提升速度和可靠性。版本修复大型本地模型库间歇性出现“model not found”错误。

    推荐理由:覆盖思考模型结构化输出、模型识别错误、macOS 无响应及 Apple Silicon 性能与图像处理优化,适合关注本地模型运行稳定性和设备适配的用户参考。

  6. Elastic Blog71

    Elastic 用原子化声明核验降低 LLM 幻觉风险

    Elastic 介绍如何用原子化声明检查降低 LLM 合并知识库文章时的幻觉和遗漏风险。其流程先合并两篇文档,再针对每篇来源单独提取事实、步骤、版本和指令,生成覆盖表与冲突记录,最后由工程师处理缺失、部分匹配和冲突。该方法以三次模型调用和两张表为核心,并保留人工最终编辑。

  7. Redis Blog65

    官方 FastAPI Redis SDK fastapi-redis-sdk 正式可用

    fastapi-redis-sdk 现已发布,为 FastAPI 提供官方 Redis 集成。它按 FastAPI 依赖模型管理连接生命周期,并提供同步、异步依赖注入、缓存、HTTP 缓存控制与限流功能。该 SDK 支持所有 FastAPI 形态、自管部署和处于公测阶段的 FastAPI Cloud,后者原生集成 Redis Cloud。

    推荐理由:把 Redis 连接生命周期、依赖注入式缓存与限流整合进 FastAPI,适合需要减少自行集成工作的小团队评估生产接入。

  8. PostgreSQL News69

    PostgreSQL 19 Beta 4 发布

    PostgreSQL 19 第四个测试版 Beta 4 已开放下载,包含正式发布前的功能预览,细节在测试期仍可能变化。项目计划于10月初进入候选版本阶段,PostgreSQL 19 GA 也可能于10月推出;本版回退 SQL/PGQ、数据校验和在线启停等多项功能,并修复 REPACK、WAIT FOR、逻辑复制及 autovacuum 等问题。

    推荐理由:本次发布列出 Beta 4 的回退与修复范围,可供用户评估升级风险、兼容性及后续测试重点。

  9. Simon Willison50

    Cloudflare 交付 HTTP Vary 头缓存支持

    Cloudflare 已交付对 HTTP Vary 头的缓存支持,使缓存不再仅限于处理图片,并能依据 Vary 头区分内容格式。此前,用户代理请求 HTML 或 JSON 时可能出现错误缓存,导致响应格式与预期不符;Simon Willison 表示自己最终未采用该模式,而是通过 .json 后缀提供 JSON。

  10. WebKit Blog67

    Safari Technology Preview 253 发布,纳入 WebKit 多领域更新与修复

    Safari Technology Preview 253 已提供 macOS Golden Gate 和 macOS Tahoe 下载,包含 WebKit 主线 320113@main 至 321067@main 之间的变更。

    推荐理由:这份发布说明覆盖 WebKit、CSS、JavaScript、WebGPU、Web API 与 WebDriver 等大量变更和修复,适合前端、浏览器及 Web API 开发者评估兼容性回归与测试重点。

  11. GitHub Blog69

    GitHub 重构 GitHub Copilot app 的超大拉取请求视图

    GitHub 重构了 GitHub Copilot app 的拉取请求视图,以支持超大代码差异和大量评论。团队测试了包含 2,200 个文件、超过 100 万行变更和 400 多条行内评论的开源拉取请求,并通过双几何模型、延迟批量测量、滚动锚定及差分缓存维持交互性能。

    推荐理由:详细拆解超大拉取请求界面的虚拟化、动态高度测量、滚动锚定和数据缓存机制,并用自动化性能循环验证改动,对大型代码审查界面的优化有参考价值。

  12. Simon Willison21

    Shadow roots:交互示例解析

    Shadow roots 工具通过交互示例讲解 Shadow DOM,涵盖样式封装、继承、slots、parts 和 JavaScript 访问。内容说明 shadow roots 可创建隔离的 DOM 树,使用私有样式表和元素,并以特定、受控的方式与页面 DOM 交互;任务要求 Fable 5.1 Medium 构建相关 artifact。

9月23日周三
  1. Google DeepMind Blog71

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别用于深度创意控制与大规模语音生成。

    推荐理由:两款模型分别面向创意控制与大规模成本敏感场景,并提供声音复制、逐句表演和多语言支持;文章还说明发布渠道、可用范围及声音授权与水印机制,便于评估落地条件。

  2. Ubuntu Blog72

    使用Charmed Kubeflow与Feast微调并部署自定义LLM

    文章提供使用Canonical Charmed Kubeflow和Feast微调自定义LLM的端到端教程,目标是构建可通过OpenAI-like REST API聊天的模型服务。

    推荐理由:文章提供从环境搭建、数据摄取、特征注册、LoRA微调到KServe部署与对话测试的完整流程,并明确硬件、权限和持久化要求,适合希望在小规模Kubernetes环境中验证自定义LLM流程的读者。

  3. PortSwigger Research66

    Burp Suite 与 Turbo Intruder 新增 HTTP/3 支持及高速测试工具包

    Burp Suite Turbo Intruder 新增 HTTP/3 支持,官方称其通过 Wi-Fi 可超过每秒 100,000 个请求,并支持自动调优与 HTTP/3 竞态条件测试。文章还介绍 HTTP/3 Adapter,可将请求转换为 HTTP/3 并处理响应,用于测试仅支持 HTTP/3 的站点;相关扩展提供 GitHub 链接和 BAPP 商店获取方式。

    推荐理由:为安全测试人员提供明确的引擎配置、竞态技术与降级测试用法,并给出吞吐量实测数据,便于评估和部署 HTTP/3 测试流程。

  4. JetBrains Blog39

    JetBrains 对话 Oppex AI 创始人 Prasun Kumar:用 AI agents 加速处理生产故障

    Oppex AI 创始人兼 CEO Prasun Kumar 介绍,其 AI agents 会在开发者被叫醒前汇总生产故障信息并提出处理建议,目标将平均恢复时间降至 10 分钟以内。团队通过 chaos monkey 在测试环境中制造故障,强化 agent 的可靠性。约 15 人的团队已推出产品并服务首批企业客户,90% 的工作使用 IntelliJ IDEA。

  5. GitHub Blog65

    GitHub用户寻求更高效的软件:调查需求与Daily Efficiency Improver实践

    GitHub与Yale Program on Climate Change Communication调查了1,039名GitHub用户,80%希望使用工具编写更节能的代码,78%希望学习降低软件环境影响的最佳实践,74%希望衡量软件或开发过程的环境影响。

    推荐理由:文章结合1,039名GitHub用户调查与可复现工作流,说明如何寻找代码、数据、网络和前端浪费,并用基准、测试及草稿Pull Request让维护者审核效率改进。

  6. Machine Learning Mastery65

    领域适配中如何选择RAG与微调

    RAG通过在推理时检索外部文档补充知识,微调则通过训练权重改变模型行为,两类技术解决不同问题。文中提供基于TF-IDF、余弦相似度和Anthropic API的RAG管道,以及使用LoRA进行投诉分类结构化输出的微调示例,并给出六点选择框架:RAG适合变化或庞大的知识、来源追溯和快速上线,微调适合稳定遵循特定语气、结构或词汇。

  7. Ubuntu Blog40

    Anbox Cloud如何以共享容量扩展Android开发工作负载

    Anbox Cloud通过共享基础设施按需提供Android环境,减少工程团队对固定手机、开发板和硬件台的依赖。团队可按工作流请求预定义镜像、配置和资源配置,并在任务完成后释放实例;容器适合应用级测试、串流、自动化和游戏,虚拟机适合需要完整Android系统及系统级验证的工作负载。