AI HOT 小时报|2026-06-24 16:05
龙虾日报2026年6月24日
自动从 AI HOT 精选接口收集过去约 1 小时的新动态,本次收录 2 条,供 UseClaw 测试小时级 AI 新闻流。
AI HOT 小时报|2026-06-24 16:05
数据源:AI HOT
/api/public/items?mode=selected;时间窗 since=2026-06-24T06:55:12Z。摘要由 AI HOT 提供,引用前请点原文核对。
本小时值得看
1. DFlash:块扩散草稿模型实现最高15倍吞吐量提升
- 分类:论文
- 来源:MarkTechPost(RSS)
- 发布时间:2026-06-24T07:21:10.000Z
- 原文:https://www.marktechpost.com/2026/06/24/dflash-speculative-decoding-drafts-whole-token-blocks-in-parallel-for-up-to-15x-higher-throughput-on-nvidia-blackwell
DFlash 由 UC San Diego 团队提出,是一种用于投机解码的轻量块扩散草稿模型。它一次前向推理生成整块 token,再由目标模型并行验证,保证输出无损。相比 EAGLE-3,DFlash 实现最高 2.5 倍加速,在 Qwen3-8B 等多种模型上平均无损加速超过 6 倍(MATH-500 达 6.08×)。在 NVIDIA Blackwell 上(TensorRT-LLM),gpt-oss-120b 模型吞吐量提升最高 15 倍,约为 EAGLE-3 的 1.5 倍。核心创新是将目标模型多层隐藏特征注入草稿模型每一层的 Key-Value 投影,使接受长度随草稿深度增长。
2. MiniCPM-V 4.6 在 Apple Core AI 上高速运行
- 分类:观点/技巧
- 来源:X:面壁智能 OpenBMB (@OpenBMB)
- 发布时间:2026-06-24T06:57:45.000Z
- 原文:https://x.com/OpenBMB/status/2069676334381728106
🥳感谢分享,@MLBoy_DaisukeMajima 🚀 MiniCPM-V 4.6 在设备上以这样的速度运行,实在令人印象深刻--尤其是在 Apple Core AI 上以不到 2B 参数跑出。 干得漂亮,推动高效多模态 AI 向前发展。🫡
UseClaw 观察
- 优先关注能进入真实工作流的产品更新,而不只看模型跑分。
- 优先关注 Agent、编程工具、企业集成、自动化、合规安全这些会影响数字员工落地的信号。
- 如果某条新闻能说明“谁痛、为什么信、下一步去哪”,后续可扩写成 UseClaw 深度内容。
UseClaw 持续记录 Claude、Codex、OpenClaw、AI Agent 与数字员工的真实案例、方法和产品化实践。
了解更多:https://useclaw.net/
#AI新闻#AI Agent#UseClaw#AI HOT#小时报