OpenAI Academy 两周年:面向更多社区开展 AI 技能培养
OpenAI Academy 迎来两周年,并面向更多社区开展 AI 技能培养。原文未说明具体新增项目、课程、时间安排或参与资格。
OpenAI Academy 迎来两周年,并面向更多社区开展 AI 技能培养。原文未说明具体新增项目、课程、时间安排或参与资格。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别用于深度创意控制与大规模语音生成。
推荐理由:两款模型分别面向创意控制与大规模成本敏感场景,并提供声音复制、逐句表演和多语言支持;文章还说明发布渠道、可用范围及声音授权与水印机制,便于评估落地条件。
文章提供使用Canonical Charmed Kubeflow和Feast微调自定义LLM的端到端教程,目标是构建可通过OpenAI-like REST API聊天的模型服务。
推荐理由:文章提供从环境搭建、数据摄取、特征注册、LoRA微调到KServe部署与对话测试的完整流程,并明确硬件、权限和持久化要求,适合希望在小规模Kubernetes环境中验证自定义LLM流程的读者。
NVIDIA 验证工程师 Sakeena Fiza 与跨学科团队在产品量产前测试数据中心系统,覆盖固件、硬件、软件、机械设计、热能与制造环节。她回忆曾见证 NVIDIA Rubin GPU 首次在系统级完成枚举,并形容团队发现产品首个运行迹象时集体欢呼。验证团队还会在多种现实条件下让硬件运行至极限,以便在客户使用前发现并解决潜在问题。
Oppex AI 创始人兼 CEO Prasun Kumar 介绍,其 AI agents 会在开发者被叫醒前汇总生产故障信息并提出处理建议,目标将平均恢复时间降至 10 分钟以内。团队通过 chaos monkey 在测试环境中制造故障,强化 agent 的可靠性。约 15 人的团队已推出产品并服务首批企业客户,90% 的工作使用 IntelliJ IDEA。
GitHub与Yale Program on Climate Change Communication调查了1,039名GitHub用户,80%希望使用工具编写更节能的代码,78%希望学习降低软件环境影响的最佳实践,74%希望衡量软件或开发过程的环境影响。
推荐理由:文章结合1,039名GitHub用户调查与可复现工作流,说明如何寻找代码、数据、网络和前端浪费,并用基准、测试及草稿Pull Request让维护者审核效率改进。
Workera 2026年调查显示,67.8%的员工每周至少几天使用ChatGPT之外的AI工具,高于上年的39.9%。但56.4%的员工没有工作时间用于技能提升,42.5%缺少相关学习材料;调查还指出,持续技能测量可能帮助组织推进AI培训。
RAG通过在推理时检索外部文档补充知识,微调则通过训练权重改变模型行为,两类技术解决不同问题。文中提供基于TF-IDF、余弦相似度和Anthropic API的RAG管道,以及使用LoRA进行投诉分类结构化输出的微调示例,并给出六点选择框架:RAG适合变化或庞大的知识、来源追溯和快速上线,微调适合稳定遵循特定语气、结构或词汇。
OpenAI CEO Sam Altman在联合国安全理事会发言,讨论AI安全、人类控制与国际合作。相关讲话聚焦人工智能安全风险及人类控制,并提及各国开展国际合作的重要性。
Harvey 使用 GPT-6 Astra 生成更结构化、能够结合上下文的法律文件草案,帮助律师将精力转向策略制定。
Ringg利用GPT-5.6部署多语言AI客服,最高可解决65%的客户来电。与GPT-4.1相比,Ringg通过语音、聊天、WhatsApp和网页渠道提供服务的成本降低90%。
invideo计划使用GPT‑6 Astra更精准地规划视频编辑,将颜色校正与调色效率提升至三倍。该系统还计划在一天内生成50种自定义效果。
MentalHealthBench 是一项由专家参与设计的基准,用于评估 AI 在真实心理健康对话中的回复是否有用且安全。该基准聚焦对话回复质量与安全性评估。
MediaTek Dimensity CX C10 Max 将用于即将推出的高端轻便 Googlebook 设备,配备 3nm 八核 CPU、NPU 890 和 11 核 Immortalis-G925 MC11 GPU,AI 算力最高 55 TOPS。它目前仅列出支持 Googlebook OS;该系统主要基于 Android 17,并提供 Google 最多 10 年的操作系统更新。
vLLM v0.30.1rc0 的提交为 ROCm 和 CI 新增 MI355 dense NVFP4 与 MoRI kernel mirrors。该提交已在 GitHub.com 创建,并通过 GitHub 的 verified signature 验证,提交者为 Andreas Karatzas,Co-authored-by 为 OpenAI Codex。
Simon Willison 将与 Jesse Vincent 于 10 月 14 日星期三在旧金山主持一场 Agentic Engineering 主题的 Birds of a Feather 活动。参与者可围绕 coding agents 及其上层项目分享实验、经验与尚未解决的问题。活动采用非正式展示与连续对话形式,鼓励分享进行中的工作,但无需准备演讲,重点不是产品推介。
NVIDIA 与合作伙伴在新加坡 AI Day 展示面向东南亚的 AI 进展与应用案例。HTX 正研究 Nemotron 3 Super 和 Nemotron 3 Nano Omni,多国机构与企业正探索本地化模型、智慧城市和公共安全应用;Sea 将采用 NVIDIA Vera Rubin 平台扩展 AI 部署。
Airbnb扩大对GPT-6 Astra及OpenAI前沿模型的访问权限,以帮助工程团队解决漏洞、设计系统并加快交付。这些模型将面向相关工程工作提供支持,具体访问范围与可用条件原文未说明。
韩国初创公司 Soulart 推出 Soulart Station 是一款面向 VR、VTubing 和动作捕捉的无标记全身动作追踪设备,采用 ToF 传感器和设备端 NPU 输出 23 关节 6DoF 动作数据。
OpenAI与Grab启动GO Forward with AI区域项目,帮助东南亚地区的3万名合作伙伴培养实用AI技能。项目聚焦区域合作伙伴的AI能力建设,具体实施细节未在材料中说明。
Anthropic发布Claude Opus 5.5,OpenAI随后发布GPT-6 Sol和GPT-6 Luna,GPT-6两款模型价格较GPT-5.6对应版本减半。
Amazon CloudWatch now offers CloudWatch Omni, an AI-powered observability experience for applications and AI agents. It provides a dedicated URL with enterprise SSO。
AWS正式发布Amazon CloudWatch Omni,为生成式AI和AI智能体提供统一的观测、评估与实验体验,支持在VS Code、Kiro及独立网页界面中使用。该方案支持结构化追踪、17项内置评估器、提示词对比、实验和回滚管理,并可通过OpenTelemetry相关标准接入多种框架;IDE扩展可免费使用,无需AWS账户即可开始,云端连接为可选。
GPT-6 改进提示缓存,提供更高的缓存命中率、新的诊断功能、显式断点与控制机制。OpenAI 表示,这些改进有助于开发者降低提示处理的延迟与成本。
Simon Willison 于2026年9月22日发布 llm 0.36,材料未提供该版本的具体内容。llm 月度简报提供当月重要 LLM 发展的精选邮件摘要,月度赞助与订阅费用为10美元。
一则署名 @therealcornpop 的 TikTok 文字指出,使用 AI 编写 TikTok 和 YouTube 脚本时,机械化的表达痕迹很容易被辨认。这些痕迹包括“不是 X,而是 Y”、三项式结构、异常断句和大量标点,更关键的问题是内容缺乏鲜明的声音,以及对所谈话题真正明确的意见。
Kubernetes SIG Apps 负责 Deployments、StatefulSets、DaemonSets、Jobs 和 CronJobs 等核心工作负载 API,并正推进节点生命周期、分布式训练和 AI 推理相关的韧性模式。
GPT-6 Sol 和 GPT-6 Luna 是两款面向日常工作的模型,旨在提供前沿智能。两者在能力与成本之间采取不同的平衡方式。
NVIDIA Confidential Computing(CC)通过采用内存加密的机密虚拟机(CVM)和机密 GPU,为大语言模型推理工作负载提供安全运行路径。该方案面向处理敏感信息及专有模型上下文的个人、企业和受监管环境,使数据在可信环境内完成处理。
NVIDIA Topograph 聚焦于 AI factory 中基于拓扑的 GPU 工作负载调度,旨在优化工作负载放置。内容指出,不当放置会切分拓扑域、迫使流量经过共享链路,从而降低吞吐量并增加作业成本。
Simon Willison 于 9 月 22 日发布了一期关于 llm-anthropic 0.29 的内容简报,页面列出 llm 635、anthropic 343 等条目。内容同时提供每月 10 美元的赞助订阅选项,可获取当月重要 LLM 发展的人工精选邮件摘要。
Anthropic 发布 Claude Opus 5.5,称其在多数工作中可提供 Fable 5.1 级性能,运行成本较 Opus 5 低约 40%。公司还称其生成速度快于 Opus 5、输出更简洁,并提升订阅用户五小时用量上限;Box、GitHub 和 Deloitte Consulting 等机构分享了测试结果。
Anthropic Python SDK v1.8.0 于 2026-09-22 发布,新增对 claude-opus-5-5、内联工具定义和 MCP 工具列表固定(beta)的支持。该版本还修复 Python 3.13 退出时未关闭流的崩溃、add_tools() 延迟生效及工具压缩请求参数等问题。
推荐理由:明确列出 SDK 新增的模型、内联工具定义与 MCP 工具列表固定支持,并修复流处理、工具调用和参数转换问题,便于用户评估升级影响。
Simon Willison 构建了 llm-typesafe 0.1a0 插件,为 LLM 添加 TypeSafe AI 新 Jev 模型支持。安装插件并设置 API key 后,可通过 Jev 回答“noul”是非题、选择题和评分题。示例显示,退款请求的“noul”输出为 0.99。
Docker将在9月23日至25日的WeAreDevelopers上,展示合作伙伴和客户共同呈现的AI agent生态。议程涵盖边缘部署、支付API、企业知识与agent memory、安全响应和生成代码验证;9月24日,Spectro Cloud与J.P. Morgan Payments等分享实践,9月25日,多家伙伴展示隔离、沙箱、治理和审计方案。
Cactus Compute 展示了 Needle 2 如何在 Raspberry Pi 5 仅使用 CPU 将英文指令转换为本地 Python 操作。示例中“Turn the LED on”在 78 毫秒后点亮 LED,完整进程占用峰值 43MB 至 46.4MB;模型权重和代码以 Apache 2.0 许可发布。
推荐理由:文章提供可复现的 Raspberry Pi 5 CPU 端函数调用示例、Python 接口和性能数据,能帮助开发者评估小模型执行本地工具调用的可行性。
NVIDIA DLSS 5 引入 DLSS 3D-Guided Neural Rendering 和细粒度控制,用于为游戏加入更逼真的光照与材质细节,同时保留开发者的艺术意图。文章还介绍 NVIDIA ACE、RTX Mega Geometry 2.0 和 RTX Kit 的更新,涉及角色 AI、高密度几何与渲染工作流。
NVIDIA发布免费的GPU加速开源套件Isaac ROS 5.0,新增代理式工作流,并支持ROS Lyrical与Ubuntu 24.04。新版本提供面向AI代理的设置、操作、立体视觉微调、抓取和放置等技能,FoundationPose推理库可实现最高5.5倍速度的对象位姿估计与跟踪,套件支持从Jetson Orin Nano到Jetson Thor的部署。
推荐理由:正式发布支持ROS Lyrical与Ubuntu 24.04的ROS 5.0,新增面向AI代理的技能、工作流和文档,适合评估机器人应用开发与部署路径。
教程演示如何用 scikit-learn 在生产级 Scikit-LLM 管线中检测嵌入漂移。内容以模拟的384维嵌入和真实文本嵌入为样本,介绍领域分类器与质心距离两种实现,同时概述降维后结合统计检验的方法。
AI Agent 可结合 NVIDIA Isaac ROS 加速 ROS 2 节点,但高速 CUDA kernel 并不保证整个 ROS 2 graph 更快。节点间传递消息时,数据仍可能被序列化或复制到 CPU memory,从而削弱感知与 AI 工作负载运行在 GPU 上的收益。