1. Qwen3.8 开放 2.4T 参数模型权重
阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级模型首次走向开放权重。模型总参数 2.4T,每个 Token 激活 95B 参数,原生上下文 262,144Token,并可扩展至约 101 万 Token。官方将重点放在编程、办公、科研和长周期智能体任务上,云端 Qwen3.8-Max 也建立在这套权重之上。
2. DeepSeek V4 Pro 正式版上线
DeepSeek API 文档新增 DeepSeek-V4-Pro-0813 正式版,提供 1M 上下文、最大 384K 输出,并同时支持思考与非思考模式、JSON 输出、工具调用、Responses API 及 Anthropic API。国内定价为缓存命中输入 0.025 元、未命中输入 3 元、输出 6 元 / 百万 Token,并发上限 500。官方页面还提示 API 服务近期计划整体调价,具体方案以后续通知为准。
3. Grok 4.6 强化长程智能体任务
SpaceXAI 发布 Grok 4.6,重点强化长时间运行的智能体、交互式项目和视觉工作,已经接入 Cursor、Grok Build、API、OpenRouter 等平台。官方 API 起价为输入 2 美元、输出 6 美元 / 百万 Token,快速版价格翻倍。独立评测机构 Artificial Analysis 给出 61 分,与 GPT-5.6 Sol 同档;不过模型能力仍需结合真实任务继续观察。
4. Claude Cowork 进入 Chrome 侧边栏
Claude in Chrome 侧边栏升级为完整的 Claude Cowork 会话,浏览器中的对话、Skills 和 Connectors 可与 Claude 桌面端、网页端及移动端衔接。会话也会保存在历史记录中,用户可以在浏览网页、调用连接器和继续复杂任务之间切换。Anthropic 同时强调浏览器智能体可能受到网页隐藏指令影响,因此高风险操作仍需保留人工确认。
5. LTX-2.5 开放权重并原生接入 ComfyUI
LTX 推出 LTX-2.5 开放权重视频模型,面向视频生成、实时应用和 Physical AI,可在本地部署并原生接入 ComfyUI。官方资料显示,模型在两张 NVIDIA GB200 上生成 10 秒 720P 视频约需 6.8 秒,同时支持文本生成视频、图生视频和多镜头一致性。它把高性能视频生成进一步推向本地工作流,但真实速度仍取决于硬件、分辨率和具体配置。
6. FastFlowLM 加入 AMD ROCm 生态
FastFlowLM 1.0 进入 AMD ROCm 开源组织,为搭载 XDNA2 NPU 的 Ryzen AI 平台提供本地大模型推理运行时。项目安装包约 17MB,官方称约 20 秒可完成安装,支持最高 256K 上下文、OpenAI 兼容 API 以及文本、视觉、音频、嵌入和 MoE 模型。其编排代码和 CLI 采用 MIT 许可证,NPU 二进制内核可免费用于商业场景。
7. 腾讯确认微信 AI 助手小微灰度测试
腾讯在 2026 年第二季度业绩沟通中确认,最近数周已在微信内启动 AI 智能体 " 小微 " 的小范围测试。小微由面向隐私、微信场景和推理效率定制的 WeLM 模型驱动,入口正在从微信首页侧滑扩展到朋友圈、公众号和视频号等场景。此次确认说明微信原生 AI 助手仍处于灰度阶段,功能范围和开放节奏尚未全面公布。
关注鸭鸭,
了解最新 AI 动态!


登录后才可以发布评论哦
打开小程序可以发布评论哦