GPT-6 Astra 在《魔兽世界》盲操作,40分钟零死亡完成兽人新手区
agent-wow开发者称,OpenAI的GPT-6 Astra未观看任何渲染画面,仅依据网络流量、服务器任务文件和寻路数据,在40分钟内零死亡完成《魔兽世界》兽人新手区。该实验通过Codex中的单次提示驱动开源客户端,在本地私有服务器运行,任务目标是按顺序完成试炼谷任务并抵达Sen’jin Village。
agent-wow开发者称,OpenAI的GPT-6 Astra未观看任何渲染画面,仅依据网络流量、服务器任务文件和寻路数据,在40分钟内零死亡完成《魔兽世界》兽人新手区。该实验通过Codex中的单次提示驱动开源客户端,在本地私有服务器运行,任务目标是按顺序完成试炼谷任务并抵达Sen’jin Village。
Just4Fun的68k-MBC以68008、SRAM和充当ROM的PIC微控制器构成三颗IC的“lite”配置,可运行CP/M68K或独立可执行程序。该配置最高支持512 KB内存和单个串口,并可配置I2C、SD“硬盘”或RTC模块;参赛作品征集截至10月27日。
Andy 为侄子制作了一个电子 Busy Board,用按钮、开关和 LED entertaining 儿童,也提供硬件黑客动手实践。该项目采用双层 PCB 和 LED multiplex,并利用定时器与中断运行软件,以延长 PIC18F67K40 在 3 节 AAA 电池上的运行时间。
Circuit Breaker Labs以模拟不同年龄、背景、语言和文化用户的AI代理,对模型进行红队测试,排查危险及心理伤害互动。其专有评分方法可生成可审计、可解释的分数,每日运行数万至数十万次模拟交互。该初创公司目前聚焦AI教练、日记和心理健康支持等高风险应用,团队仅有5人。
How-To Geek 整理了 7 种适合本周末尝试的 3D 打印错觉模型,包括 Penrose 三角、无限立方体、不可能上坡双锥、Jastrow 弧线错觉和 Ames 房间。清单还涵盖可通过旋转呈现动画的 Zoetrope,以及移动上层画面形成循环动画的 Scanimations;部分模型支持缩放、简化或替换动画内容。
systemd 正在起草新组件 systemd-appd,并准备将其首个拉取请求提交评审。该机制旨在集中跟踪用户应用,目前仍处于开发与草案阶段。
再生成能力改变了 UI 复用经济:模型可基于成熟设计系统按需生成多数标准界面,使维持规范组件包的理由更难成立。设计系统、tokens、 guidelines 与 tests 应继续作为核心,以保障界面一致性。
Apex Compute 正为其硬件开发一款基于 Mesa 的开源 Vulkan 驱动。这家2024年成立于加州的公司旨在生产用于实时边缘 AI 推理的高能效加速器,目前拥有可授权和部署的 FPGA 原型。其原型宣称速度为 NVIDIA Jetson 的20倍,功耗低于10W,成本仅为其五分之一。
3D all Workshop设计并3D打印出一款可运行的掌上机械计算器,采用纯塑料耗材制作,可输入1至999。它通过Leibniz stepped drum实现加法和以重复加法完成的乘法,但不支持减法和除法。该装置包含109个独立零件,打印耗时17小时、使用90克耗材;历经两个月约100次设计迭代后仍未公开设计或出售。
Google 工程师本周向 Linux 内核邮件列表提交提案,建议让 ARM64 Linux 在启动时配置内核栈大小,以降低系统内存消耗。该提案旨在简化 ARM64 Linux 调整内核栈大小的过程。
OpenAI硬件负责人Richard Ho介绍,团队借助Codex等内部模型和AI辅助工程流程,将Jalapeño ASIC从初始RTL推进至流片仅用九个月。AI还参与了内核编写与优化,但签核阶段仍使用Synopsys、Cadence等工具的静态时序与信号完整性分析。报道同时提到,B0版本每瓦性能据称较A0提升最高25%,但Richard Ho强调九个月并非所有芯片都能达到的固定周期。
Nuvacore宣布以Core First策略开发WarpCore,先在不确定指令集架构的情况下设计部分CPU核心IP,再为合作伙伴系统选择ISA。该路线拟重点面向AI基础设施和现代数据中心的持续性能与能效需求,但ISA、项目进度、制程、功耗和性能目标均未披露。
NVIDIA TensorRT Model Connect 是一个基于 NVIDIA TensorRT 构建、使用 C++ 编写的开源 AI 模型参考实现集合,围绕 coding agents 设计。其开发经验表明,并行工作、模型族隔离、可逆变更和 GPU 支持的验证是项目的核心实践。
FOSS Force 作者所在的网站托管公司因商业平台限制,放弃原有网站并迁移到 MIT 许可的 Astro 静态网站框架。迁移解决了性能和后续维护困难,但也带来非程序员无法独立编辑发布的缺口;作者随后借助 AI 自行开发替代内容管理系统。文章还区分了开源框架与专有部署托管服务:前者便于迁移,后者仍可能成为依赖。
Simon Willison用Claude Opus 5.5将三张鸦鹉照片制作为可交互的Kākāpō Party像素动画,点击或按键可触发派对效果。随后,他让本地Claude Code会话调用Playwright加载HTML、按预定位置点击并录制15秒视频,用于Keynote演示最后一页。
Unboxed STEM Club 使用 Raspberry Pi 3 Model B+、Raspberry Pi Camera Module 3 和温度传感器制作了低成本水下相机 Sensea,用于探测本地池塘与河流的水质和生物。
推荐理由:文章完整拆解低成本水下相机的结构、密封、供电、浮力与数据记录方案,并给出可复用的构建和测试思路,适合个人创客及 STEM 团队参考。
Simon Willison表示,使用编程代理的时间越长,他越确信这些工具让软件工程变得更加困难。编程代理能够完成令人惊叹的工作,但要充分发挥其潜力,需要非凡的自律与知识。
Google Envisioning Studio与Jane Wade、Sergio Hudson共创Styling Suite和Runway Visualization两款Google Flow工具,服务纽约时装周筹备。
Framework 宣布,经过约三年的设计与原型开发及今年的 Developer Program,One Key Module 无法成为可售产品。公司称,较高的单键成本、复杂制造带来的良率问题,以及开发者和 DIY 者在组装时遇到的实际困难,促使其停止该项目;剩余模块将免费提供给项目参与者。
推荐理由:Framework 说明 One Key Module 因材料、组装成本、良率及可靠性问题停止产品化,并公开开发者反馈与设计文件,对相关扩展项目的取舍有参考价值。
Hugging Face 用单个 Gradio Workflow 画布重建了 AUTOMATIC1111 大部分功能,集成了 11 条媒体管线和 73 个节点。示例涵盖文生图、高清修复、图像编辑、提示词生成、检测与重绘、图像转视频等流程,并展示将输出生成 REST API 与 MCP 工具的方法。
推荐理由:通过可运行示例解析 Gradio Workflow 的节点编排、模型调用、并行执行与接口生成方法,适合评估多模型媒体工作流的实现路径。
Google DeepMind与Primordial Soup合作创作纪录片短片《Love, Rendered》,借助生成式AI重现Burt与Ethelle未曾记录的过去,并连接他们年轻时期与当下的记忆。
MIT研究人员使用GPT-5.6 Sol与Codex自主运行量子计算实验。该组合可分析实验结果并校准量子比特,展示了大模型辅助量子计算实验的流程。
Fimo 提出让网站通过智能体在上线后持续改进,避免其逐渐落后于市场与公司变化。自主权应从小范围授权开始,团队可查看运行记录、日志及变更前后对比,再根据表现逐步放宽限制,让智能体处理已委派任务,而非将整个网站完全交由其接管。
Google Research与Google DeepMind提出AMIE (Video),基于Gemini和Project Astra进行实时视频临床问诊,并通过异步多智能体架构处理对话、临床推理及视听信息。
推荐理由:该研究展示了实时视听临床AI的架构、评测方法与随机对照结果,同时明确模拟场景和技术限制,为个人及小团队评估医疗AI原型提供了清晰边界。
MacPaw在赞助文章中介绍了主动式AI助手Eney,尝试以更具个性且易用的角色交互融入用户工作流,而非采用传统文本框界面。Eney通过粉色圆形形象、简洁表情和克制的情绪动作传达任务状态;设计团队强调,技术虽能加快流程,但风格、艺术方向、完整性判断与情感敏感度仍由人类设计师掌控。
Google提出一种面向私人分析的新型安全聚合方案,将单次消息的密码协议与可信执行环境结合,用于在保护原始设备数据的同时获取汇总洞察。Google表示,该方案已用于评估AI系统在Pixel Recorder中的表现,Android SafetyCore也将利用相关指标改进分类器,同时保持用户内容仅留在设备上。
推荐理由:文章说明了零信任聚合如何结合新型密码协议与TEE,并说明其在SafetyCore中的具体评估用途,便于团队理解大设备规模隐私分析与安全设计的取舍。
Mozilla 宣布已在生产环境运行多种用于 IPC 的快照模糊测试目标,以发现和修复 IPC 层中的潜在问题。该方法源自 2021 年实验原型,后来发展为开源工具 Nyx,旨在解决 IPC 接口依赖完整浏览器且错误使用会触发重启所带来的测试延迟。
推荐理由:文章说明 Mozilla 已将基于快照回滚的 IPC 模糊测试投入生产,介绍其应对浏览器重启延迟与隔离测试困难的技术路径,并披露已发现和修复多项潜在问题,对安全测试实践有参考价值。
Mozilla 正在 Firefox Nightly 内置 PDF 编辑器中试验用完全本地的端侧 AI 模型自动生成图片替代文本,推理引擎已作为新的 ml 组件合入。
推荐理由:文章披露Firefox本地图像转文本实验的模型、推理架构、缓存与训练代码,并明确当前范围和后续计划,对无障碍技术研究与浏览器端侧AI实现有参考价值。