跳到正文
10月3日 · 周六

最新精选

10月2日周五
  1. Hugging Face Blog64

    ServiceNow CoreAI推出AutoSynthData以生成企业智能体训练数据

    ServiceNow CoreAI构建了AutoSynthData,利用目标模型的失败和更强教师模型的成功案例生成并验证企业智能体训练任务。系统在EnterpriseOps Gym的Hybrid和ITSM环境中进行SFT实验,Hybrid的Pass@1提升7.2个百分点,ITSM从18.77%升至27.18%。

    推荐理由:文章公开了企业智能体训练数据的生成、验证与迭代流程,并通过两个ITSM环境实验提供量化结果,便于团队评估其实现方法与训练价值。

9月29日周二
  1. Cloudflare Blog70

    Cloudflare 介绍用 AI 工具 CryptoLabe 推进后量子迁移

    Cloudflare 正开发内部工具 CryptoLabe,以两阶段扫描发现代码中的密码学用法、评估迁移分类,并生成面向产品经理和工程师的报告。该工具依托 Workers、Durable Objects、Workflows、AI Gateway 等组件,但仍在演进,尚未提供客户使用;Cloudflare 也强调扫描结果需由相关工程师复核,公开的提示词只是起点。

    推荐理由:披露 CryptoLabe 的分阶段扫描、分类、编排与人工复核方法,并说明缺少 ground-truth 数据集和完整覆盖,可供团队设计后量子迁移盘点流程时参考。

9月10日周四
  1. Hugging Face Blog70

    使用 Gradio Workflow 重建 AUTOMATIC1111

    Hugging Face 用单个 Gradio Workflow 画布重建了 AUTOMATIC1111 大部分功能,集成了 11 条媒体管线和 73 个节点。示例涵盖文生图、高清修复、图像编辑、提示词生成、检测与重绘、图像转视频等流程,并展示将输出生成 REST API 与 MCP 工具的方法。

    推荐理由:通过可运行示例解析 Gradio Workflow 的节点编排、模型调用、并行执行与接口生成方法,适合评估多模型媒体工作流的实现路径。

9月2日周三
  1. Docker Blog62

    使用 Docker Sandboxes 构建可复现的 AI 评估工作流

    Jennifer Kohl 介绍开源 SBX AI Evaluation Kit,用 Docker Sandboxes 统一执行 AI 评估命令并保存运行证据。工具不会运行模型或自动生成评估判断,而是通过执行器抽象、YAML 定义、结构化 JSON 记录和配置摘要,让本地与沙箱工作流更易重跑、检查和比较。

    推荐理由:通过执行器抽象、YAML 定义、JSON 运行记录和配置摘要,帮助个人与小团队在本地或 Docker Sandboxes 中重跑、比较并检查 AI 评估流程。

8月12日周三
  1. Google Research Blog65

    Google推进AMIE实时视听临床问诊研究

    Google Research与Google DeepMind提出AMIE (Video),基于Gemini和Project Astra进行实时视频临床问诊,并通过异步多智能体架构处理对话、临床推理及视听信息。

    推荐理由:该研究展示了实时视听临床AI的架构、评测方法与随机对照结果,同时明确模拟场景和技术限制,为个人及小团队评估医疗AI原型提供了清晰边界。

7月6日周一
  1. Hugging Face Blog78

    PRX 数据策略:用 Lance 构建训练语料并流式输出 MDS

    PRX 团队将公开与内部数据集混合,用 VLM 重新生成图像长描述,再把经过筛选和去重的数据转换为可流式读取的 MDS 语料。团队以 Lance 完成数据构建、查询和探索,并选择 Qwen3-VL-8B 进行描述生成;同时记录了 7B 训练中动态计算文本潜变量、使用质量 92 的 JPEG 以及分片跳过列表等实践。

    推荐理由:系统介绍 PRX 训练数据策略及 Lance、MDS、Ray Data 等工具的分工,并给出长描述、JPEG 存储、过滤和去重等可复用的工程取舍。

5月28日周四
  1. Google Research Blog66

    Google提出结合密码协议与TEE的零信任私人分析方案

    Google提出一种面向私人分析的新型安全聚合方案,将单次消息的密码协议与可信执行环境结合,用于在保护原始设备数据的同时获取汇总洞察。Google表示,该方案已用于评估AI系统在Pixel Recorder中的表现,Android SafetyCore也将利用相关指标改进分类器,同时保持用户内容仅留在设备上。

    推荐理由:文章说明了零信任聚合如何结合新型密码协议与TEE,并说明其在SafetyCore中的具体评估用途,便于团队理解大设备规模隐私分析与安全设计的取舍。

6月28日周五
  1. Mozilla Hacks61

    Mozilla 将快照模糊测试用于 Firefox 的 IPC 安全测试

    Mozilla 宣布已在生产环境运行多种用于 IPC 的快照模糊测试目标,以发现和修复 IPC 层中的潜在问题。该方法源自 2021 年实验原型,后来发展为开源工具 Nyx,旨在解决 IPC 接口依赖完整浏览器且错误使用会触发重启所带来的测试延迟。

    推荐理由:文章说明 Mozilla 已将基于快照回滚的 IPC 模糊测试投入生产,介绍其应对浏览器重启延迟与隔离测试困难的技术路径,并披露已发现和修复多项潜在问题,对安全测试实践有参考价值。

6月1日周六
  1. Mozilla Hacks73

    Mozilla 在 Firefox Nightly 试验本地生成图片替代文本

    Mozilla 正在 Firefox Nightly 内置 PDF 编辑器中试验用完全本地的端侧 AI 模型自动生成图片替代文本,推理引擎已作为新的 ml 组件合入。

    推荐理由:文章披露Firefox本地图像转文本实验的模型、推理架构、缓存与训练代码,并明确当前范围和后续计划,对无障碍技术研究与浏览器端侧AI实现有参考价值。

已经到底了