AI HOT 小时报|2026-07-02 20:05
自动从 AI HOT 精选接口收集过去约 1 小时的新动态,本次收录 3 条,供 UseClaw 测试小时级 AI 新闻流。
AI HOT 小时报|2026-07-02 20:05
数据源:AI HOT
/api/public/items?mode=selected;时间窗 since=2026-07-02T10:55:09Z。摘要由 AI HOT 提供,引用前请点原文核对。
本小时值得看
1. browser-use 发布开源 AI 视频剪辑 Skill「video-use」
- 分类:观点/技巧
- 来源:X:邵猛 (@shao__meng)
- 发布时间:2026-07-02T11:33:01.000Z
- 原文:https://x.com/shao__meng/status/2072644710523691110
browser-use 团队推出面向 Codex、Claude Code 等 AI 编码智能体的开源 Skill「video-use」,让 LLM 通过 ElevenLabs Scribe 将音频转写为约 12KB 文本(含逐词时间戳、说话人分离、事件标记),仅在决策点调用 timeline_view.py 生成 PNG 帧图。技术流水线包括转写、打包、生成 JSON 格式 EDL、ffmpeg 渲染及最多 3 轮自评估。渲染关键细节:分段提取 + -c copy 拼接、30ms 音频淡入淡出、PTS 时移、字幕最后叠加、HDR 自动映射、竖屏缩放、两-pass loudnorm。动画支持 HyperFrames、Remotion、Manim 等引擎。项目附带 12 条硬规则确保生产正确性。
2. Senior SWE-Bench:评估AI智能体作为高级工程师的基准测试
- 分类:产品
- 来源:Hacker News 热门(buzzing.cc 中文翻译)
- 发布时间:2026-07-02T11:04:07.048Z
- 原文:https://senior-swe-bench.snorkel.ai/
Senior SWE-Bench是一个开源基准测试,用于评估AI智能体完成高级软件工程师级别任务的能力。任务分功能开发与Bug修复两类:功能任务指令类似自然语言消息,采用验证智能体基于专家配方自动生成行为测试;Bug任务要求根据日志、profiling等运行时信息深入调查。排行榜显示,Claude Opus 4.8搭配Mini-SWE-Agent(max effort)通过率24.0%,Claude Sonnet 5为19.4%,GPT-5.5为16.0%,最强前沿模型在超75%任务中未能达到高级工程师级别的正确性与品味。每个功能任务平均涉及11个文件,最强智能体也需数百步完成;中位指令长度仅为SWE-Bench Pro的31%。任务来源于从库到多服务应用的仓库PR,由拥有数百次提交的工程师编写。
3. 谷歌AI建设导致2025年用电量增长37%
- 分类:行业
- 来源:Ars Technica:AI(RSS)
- 发布时间:2026-07-02T11:15:49.000Z
- 原文:https://arstechnica.com/ai/2026/07/googles-ai-buildout-drove-37-increase-in-electricity-use-in-2025
2025年,谷歌年度用电量同比上涨37%,创历史最大增幅。数据中心全年消耗超4200万兆瓦时,超过新西兰、丹麦、尼日利亚等国总用电量。自2019年以来,谷歌总用电量已增长超250%。用电激增主要来自Google Cloud、YouTube视频流及支撑AI产品和服务的数据中心建设与运营。公司表示,AI基础设施建设速度超过电网脱碳速度,但仍致力于扩大全球清洁电力规模,并通过技术创新降低运营排放。2024年谷歌用电量增幅为27%。
UseClaw 观察
- 优先关注能进入真实工作流的产品更新,而不只看模型跑分。
- 优先关注 Agent、编程工具、企业集成、自动化、合规安全这些会影响数字员工落地的信号。
- 如果某条新闻能说明“谁痛、为什么信、下一步去哪”,后续可扩写成 UseClaw 深度内容。
UseClaw 持续记录 Claude、Codex、OpenClaw、AI Agent 与数字员工的真实案例、方法和产品化实践。
了解更多:https://useclaw.net/