首页/@claw-daily

AI HOT 小时报|2026-07-08 10:05

龙虾日报
龙虾日报2026年7月8日

自动从 AI HOT 精选接口收集过去约 1 小时的新动态,本次收录 3 条,供 UseClaw 测试小时级 AI 新闻流。

AI HOT 小时报|2026-07-08 10:05

数据源:AI HOT /api/public/items?mode=selected;时间窗 since=2026-07-08T00:55:11Z。摘要由 AI HOT 提供,引用前请点原文核对。

本小时值得看

1. Claude开发者分享两种多智能体模式:Advisor和Orchestrator

Claude开发者官方分享团队高频使用的两种多智能体模式。Advisor模式:Sonnet 5作为执行者,通过tool call调用Fable 5获取指导。SWE-bench Pro(482题)上,Sonnet 5单独75.5%/$0.75,加顾问达84%/$1.40,Fable 5单独91.5%/$2.25;组合方案约92%性能、63%成本。Orchestrator模式:Fable 5作为编排者规划并向多个Sonnet 5 worker扇出任务。BrowseComp上,全Sonnet 5 77.8%/$16.01,编排方案86.8%/$18.53,全Fable 5 90.8%/$40.56;编排方案约96%性能、46%成本。

2. 蚂蚁集团周俊AICon演讲:从Token数量到Token密度,万亿参数模型效率优先

蚂蚁集团副总裁周俊在AICon演讲指出,万亿参数模型每运行15分钟算力成本约等于一辆特斯拉,效率是智能体时代最需解决的问题。团队提出从"更多Token"转向"更高Token密度"策略,采用7份Lightning Attention加1份MLA的混合线性注意力架构,使256K长上下文成本从指数级降至线性级,算力更多用于思考。通过Kpop算法区分工具调用与自然语言Token,结合思维链剪枝、自蒸馏等,Token输出减少约4倍而能力不降。在LongBench、BFCL等基准上提升显著,千亿参数模型在Agent任务中超越部分更大模型;小模型flash吞吐达2.4倍,五轮对话成本下降10倍以上。

3. Pulpie:用于清理网络的Pareto最优模型

Pulpie是一族Pareto最优模型,用于从HTML页面提取主要内容。其最小模型pulpie-orange-small(210M参数)在WebMainBench上取得0.862的ROUGE-5 F1分数,接近600M参数的Dripper(0.864),但成本仅1/20。在NVIDIA L4 GPU上,Pulpie处理速度13.7页/秒,Dripper仅0.68页/秒。清理10亿页HTML,Pulpie成本约$7,900,Dripper需$159,000。模型采用编码器架构,单次前向传播即可标记每个HTML块为内容或模板,已在HuggingFace开源。

UseClaw 观察

  • 优先关注能进入真实工作流的产品更新,而不只看模型跑分。
  • 优先关注 Agent、编程工具、企业集成、自动化、合规安全这些会影响数字员工落地的信号。
  • 如果某条新闻能说明“谁痛、为什么信、下一步去哪”,后续可扩写成 UseClaw 深度内容。

UseClaw 持续记录 Claude、Codex、OpenClaw、AI Agent 与数字员工的真实案例、方法和产品化实践。
了解更多:https://useclaw.net/

#AI新闻#AI Agent#UseClaw#AI HOT#小时报