AI 日报|2026-08-15|dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理|Claude Code v2.1.233 发布:新增 GitLab MR 支持与内存 cgroup 限制

0 条回复
4 次浏览

AI 热点日报(2026-08-15)

模型发布/更新

1. dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。
来源: 公众号:小红书技术(dots.llm)

2. GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布 GLM-5.3,基于与 GLM-5.2 相同的基座,通过极致的后训练 Scaling 提升智能上界,编程能力较前代提升 50%,在 Terminal Bench 3.0 等公开基准中取得开源第一,并接近 Claude Fable 5。模型在白盒代码审查等安全任务中表现持平 Mythos 5,在 CyberGym 测试中得分 84.5%。模型权重将在两周后开源,即日起上线 ZCode、AutoClaw 等工具。
来源: 公众号:智谱(GLM)

3. Gemini 3.7 Flash 全面上线 Pro 与 Ultra 用户

Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。
来源: X:Gemini (@GeminiApp)

4. DeepSeek V4 Pro 登陆硅基流动,1M 上下文

DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。
来源: X:硅基流动 SiliconFlow (@SiliconFlowAI)

产品发布/更新

1. Claude Code v2.1.233 发布:新增 GitLab MR 支持与内存 cgroup 限制

Claude Code v2.1.233 发布,为 --worktree 标志和 agents 视图新增 GitLab 合并请求 URL 支持,并添加可选的 forward_user_identity 网关设置以按用户归因支出。
来源: Claude Code:GitHub Releases(RSS)

行业动态

1. OpenAI and Anthropic in price war as Chinese AI rivals gain ground

价格战让模型 API 的成本弹性成为现实,原先因账单压力转向中国厂商的用户,可能在 OpenAI 和 Anthropic 降价后重新比较能力与价格。
来源: Ars Technica:AI(RSS)

2. Cursor 正式被 SpaceX 收购

Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。
来源: Cursor Blog

3. Claude 文本水印机制如何运作

未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。
来源: Anthropic:Newsroom(网页)

4. 印尼首个大学 AI 中心落成:UGM、Indosat 与 NVIDIA 合作培养本地 AI 人才

印尼通信与数字事务部、Indosat、NVIDIA 与加查马达大学(UGM)在日惹共同启动 UGM Indosat NVIDIA AI 技术中心(NVAITC),这是该国首个大学 AI 技术中心。
来源: NVIDIA Blog(RSS)

技巧与观点

1. 2026 年夏季开源模型生态观察:中国前沿模型规模领先,AMD 与 NVIDIA 主导发布量

2026 年 1 至 8 月,Hugging Face 公开模型仓库从 243 万增至 296 万,但 85.6% 的模型下载量不足 200 次,1.5% 的仓库占据 99.2% 下载量。中国实验室月度最大开源模型参数规模在 754B 至 2.78 万亿之间,美国实验室七个月中五个月低于 130B。AMD 与 NVIDIA 各发布超 200 个新模型仓库,成为发布开源模型最多的机构。
来源: Hugging Face:Blog(RSS)

2. Claude Code 会话如何最大化 token 价值

Claude Code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。
来源: Claude:Blog(网页)

3. 蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环

蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。
来源: 公众号:蚂蚁百灵(Ling)

4. OpenRouter 视觉指南:如何通过 API 向多模态模型发送图像

OpenRouter 发布视觉指南,详解通过 Chat Completions API 向多模态模型发送图像的方法。请求体采用 messages 数组,用户消息的 content 包含 text 和 image_url 两部分,支持公开 URL 或 base64 数据 URL 两种格式,兼容 PNG、JPEG、WebP 和 GIF。
来源: OpenRouter:Announcements(RSS)

5. 谁真的需要 SOTA 模型?OpenRouter 数据显示 84%token 来自非前沿模型

OpenRouter 数据显示,84% 的模型 token 并非来自 SOTA 模型,用户最常用的六款模型性能约为前沿模型的 77%,成本仅为 Claude Fable 5 的 2.5%。8 月 10 日当周,六款模型承载了 80% 流量,混合价格约$0.50/百万 token,而 Fable 5 为$20。最佳开源模型性能已从一年前的 48% 提升至前沿模型的 80%,企业正转向更小、微调或开源模型以优化性价比。
来源: Tomer Tunguz 博客(VC 分析)

6. Databricks 如何在数据仓库中使用 AI_Functions:主要用例解析

Databricks 探讨在数据仓库中应用 AI_Functions 的主要场景,帮助组织在结构化数据之外处理非结构化数据。文章聚焦于如何通过该功能将 AI 能力直接集成到 SQL 工作流中,以扩展数据仓库的分析边界。具体用例与实现细节以原文为准。
来源: Databricks:Blog(RSS)

发表一个评论

R保持