极新 3小时前
李飞飞WorldLabs发布全球首个多模态世界模型Atlas;Meta发布首个实时音频感知AI 模型;Anthropic发布ClaudeFable5.1和Mythos5.1
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

—— ·要点速览· ——

1 、豆包工作上新,支持多 Agents 并行与 Mac 操作电脑

2 、李飞飞 World Labs 发布全球首个多模态世界模型 Atlas

3、谷歌 AI 图片设计工具 Pics 上线,Docs / Slides 办公套件可直接调用修图

4、WorkBuddy 开放平台上线,面向智能硬件与行业应用开放 Agent 能力

5、Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写

6、阿里云企业级 Agent 协作平台万有无界开启公测

7、Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1:性能超越前代,缓存降价 75%

8、智谱首家官方旗舰店落地天猫

9、恒指收跌 0.07%,恒生科技指数跌 0.74%

10、科创 50 指数收跌 1.82% 军工概念局部逆势活跃

更聚焦的科技行业交流群,捕捉每一条科技动态,诚挚邀请创业者、发烧友加入我们。微信扫码进群:

进群后,你有机会得到:

最新、最热的科技资讯;

最精准的行业资源对接;

论坛、沙龙、企业游学门票。

1商业货运飞船及无人空间站研制运营商「紫微科技」完成数亿元股权投资,投资方为东方富海云晖资本上海弘晖博源资本中关村科学城公司四川发展成都经开产投基金合信方册

紫微科技是一家商业货运飞船及无人空间站研制运营商,聚焦商业航天 " 船 " 赛道,专注于太空飞船的设计制造、飞行运行及在轨服务,致力于通过降低太空探索成本实现太空飞船应用的在轨运营和商业闭环。公司主要产品为 " 迪迩 "(DEAR)系列飞船,可为客户提供留轨、返回、可定制、可拼船的多元化太空体验与返回服务。

23D 工业相机和 3D 视觉系统供应商「迁移科技」完成数千万元Pre-C资,投资方为海愿资本

迁移科技是一家 3D 工业相机及视觉引导系统供应商,聚焦机器视觉与工业机器人引导领域,专注于 3D 工业相机和 3D 视觉机械臂引导系统的研发与应用,致力于通过 AI+3D 视觉技术为全球工业制造和仓储物流自动化提供技术赋能。公司主要产品包括 Epic Eye 系列工业 3D 相机及 Epic Pro 图形化视觉软件,产品应用于上下料、拆码垛、定位装配等场景,服务新能源、汽车、化工、家电、金属制造等多个行业。

3、新型电力系统投资管理和运营服务商「碧澄能源」完成数亿元 C1 轮融资,由中海基金领投,成都交投兖矿资本跟投

碧澄能源是一家新型电力系统投资管理和运营服务商,也是全球领先的工商业分布式清洁能源电站投资运营商之一。致力于为企业、园区、城市提供经济、智慧、可靠的绿色能源一站式解决方案,以新能源光储电站投建为战略支点,整合电力资产运营、综合能源服务、电力交易、碳资产管理与能源物联网科技创新等全价值链业务模块。

4特种伺服驱动系统与机器人关节研发商「乐恩自动化」完成股权投资,投资方为成都科创投集团

乐恩自动化是一家特种伺服驱动系统与机器人关节研发商,公司以伺服驱动技术为核心,产品覆盖伺服驱动器、伺服电机、伺服控制器等,致力于为客户提供严苛环境下的伺服系统整体解决方案。公司核心产品包括伺服驱动器、伺服电机、伺服控制器等,产品具有体积小、功率密度高、动态响应快、软硬件全国产化、环境适应性强等特点。目前,公司产品已广泛应用于航空航天、卫星通信、医疗器械、轨道交通、机器人、船舶、核工业等领域。

5AI 新材料设计研发商「鼎犀智创」完成数亿元Pre-A 轮融资,由鼎晖投资领投,九合创投彬复资本龙芯中科 ( 688047 ) 顺禧基金中关村资本跟投

鼎犀智创是一家 AI 新材料设计研发商,致力于打造 AI for Materials 的新一代智能研发基础设施平台,融合高通量实验表征、智能谱学分析、大模型预测、结构性能分析以及自主实验设计与规模化制备全栈技术,从数据到应用,从实验到设计、生产,打造新材料研发全生命周期解决方案。公司依托 "AI 材料科学家 " 自演化科研系统及 RDMCA 五大智能体的自驱动闭环,帮助客户在材料研发向着智能化精准设计跃升,缩短材料研发周期、提升开发效率,实现从科研构想到产业落地的全链条加速。

1豆包工作上新,支持多 Agents 并行与 Mac 操作电脑

9 月 2 日消息,豆包工作发布两项新功能:一是多 Agents 并行,在多 Agents 并行的机制中,负责组织的主 Agent 会先行拆解,将比较垂直、专业的任务则交由不同的子 Agent 分别处理。二是 Mac 系统的操作电脑功能,可让豆包实现本地 GUI 操作,在没有 MCP、API、插件和 CLI 的情况下也能看懂界面并完成相应操作。(广角观察)

2李飞飞 World Labs 发布全球首个多模态世界模型 Atlas

9 月 2 日消息,"AI 教母 " 李飞飞的创企 World Labs 今日发布了 " 全球首个多模态世界模型 " —— Atlas,宣称该模型能够以像素级精确的相机控制生成图像和视频帧,并将其在 3D 中重建。World Labs 官方介绍,其从头开始对 Atlas 进行预训练,使其能够接受多模态输入,并将其转化为 3D 视图。(科创板日报)

3谷歌 AI 图片设计工具 Pics 上线,Docs / Slides 办公套件可直接调用修图

9 月 2 日消息,谷歌昨日(9 月 1 日)发布博文,宣布正式上线 AI 图像设计与编辑工具 Google Pics。用户可通过 pics.new 使用网页版,也可在 Google Docs 和 Google Slides 中直接调用编辑器。

在 2026 年 I/O 开发者大会上,谷歌推出 AI 图像生成与设计工具 Google Pics,主要用途包括制作活动邀请函、海报等视觉内容。

该工具由 Nano Banana 图像生成模型驱动,个人用户可通过 Google AI Pro、Google AI Ultra 和 Google AI Pro for Education 账户使用该工具。

企业用户则可在 Workspace Business Standard、Business Plus、Enterprise Standard 和 Enterprise Plus 套餐中陆续获得访问权限。

编辑方式上,Google Pics 不要求用户从空白画布开始设计。用户可输入提示词生成图片,也可上传已有素材后继续修改,支持导入本地文件、Google Drive 和 Google Photos 素材。

在 Google Docs 或 Google Slides 中,用户点击现有图片即可打开 Pics 的覆盖式编辑界面,无需离开当前标签页。谷歌表示,未来数周推出的更新还将允许用户从 Google Drive 直接拖放文件至 Pics。

Google Pics 内置精确对象分割功能。用户可在图片中选定某一物体,并单独移动、缩放或调整样式,同时尽量不改变周围背景。

该工具还可处理图像中的文字元素。用户可修改文字内容,或翻译为其他语言,并保留原有字体和视觉排版。Google Pics 同时支持批量编辑、实时协作,以及将图像增强至 2K 或 4K 分辨率。(IT 之家)

4WorkBuddy 开放平台上线,面向智能硬件与行业应用开放 Agent 能力

9 月 2 日消息,腾讯公司公关总监张军表示,WorkBuddy 宣布开放平台 ( open.WorkBuddy.cn)正式上线,首批引入超百家生态伙伴,面向智能硬件、行业应用与开发者等开放底层 Agent 能力。9 款联名智能硬件在发布会上亮相,合作方包括 Plaud、Rokid、影石、科大讯飞、安克、猛玛、京东京造等。有 30 余个行业应用同步接入,覆盖金融、法律、医疗、教育、公益等 20 多个领域。(广角观察)

5Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写

9 月 2 日消息,科技媒体 9to5Mac 昨日(9 月 1 日)发布博文,报道称 Meta 公司推出 Muse Voice Transcribe,这是其首个实时音频感知模型。

开发者可通过 Meta Model API 调用该能力,定价为每 1000 分钟音频 3 美元(现汇率约合 20.2 元人民币),等同每小时 0.18 美元(现汇率约合 1.2 元人民币)。

该模型在同一流程中整合流式自动语音识别、说话人分离与端点检测,用户说话时,系统可同步输出文字,无需等待完整录音结束后再单独处理。

" 流式 " 就是边说边转写,模型不必等整段音频说完才出结果,而是会一小段一小段持续输出文字,所以延迟更低,适合实时听写、会议记录、通话字幕。

Muse Voice Transcribe 可在包含 20 余名说话者的录音中分离不同发言者,还能识别说话是否结束,从而自动确定一段输入的边界。

模型训练覆盖 70 余种语言,其中 25 种语言在发布时完成验证。该模型支持长度超过 1 小时的音频,也支持句内或句间的自然语言切换。开发者还可通过语言、关键词和上下文偏置,提高特定语言、术语或场景下的识别效果。

在技术方面,Meta 为兼顾实时响应和识别准确度,引入名为自适应延迟(adaptive delay)的动态决策机制。系统不会为所有词语采用固定的速度与准确度取舍,而是针对每个词判断需要额外接收多少音频后再输出识别结果。

对于较容易识别的语音,系统可更快提交转写结果。对于发音不清、术语较多或语境复杂的词语,系统会调用更多前后文音频信息。这种机制旨在兼顾。

Meta 称,截至 2026 年 9 月 1 日,Muse Voice Transcribe 位列 Artificial Analysis 流式语音转文本排行榜第 1 名。(IT 之家)

6阿里云企业级 Agent 协作平台万有无界开启公测

9 月 2 日 消 息,阿里云旗下企业级人与 Agent 协作平台 " 万有无界 " 开启公测。企业用户和个人用户均可通过官网注册体验,可调用阿里最新旗舰模型 Qwen3.8-Max。万有无界是一个多角色 Agent 协作工作台。与让单一 AI Agent 大包大揽不同,它把一件复杂的事拆解给多位有不同职责的 Agent ——在 " 项目空间 " 里组织成员和资产,通过群聊让多位 Agent 围绕同一个任务接力推进,过程中的产出沉淀到资产库,成为企业可复用的数字资产。(广角观察)

7Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1:性能超越前代,缓存降价 75%

9 月 2 日消息,当地时间 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 模型。该公司称这两款模型为 " 全球最先进的编程与知识工作模型 "。

Fable 5.1 与 Mythos 5.1 采用相同的基础模型,区别在于安全防护等级不同 —— Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域的机构提供。

性能方面,Anthropic 披露的基准测试数据显示,Fable 5.1 在多项测试中超过了前代 Fable 5、Opus 5 以及 OpenAI 的 GPT-5.6 Sol。

(IT 之家)

1智谱首家官方旗舰店落地天猫

9 月 2 日消息,国产大模型厂商智谱正式入驻天猫开设官方旗舰店,将售卖 Coding Plan 套餐等产品。目前在售商品包括个人版的 Lite、Pro、Max 等类别,可按月 / 季 / 年购买订阅。(广角观察)

2、恒指收跌 0.07%,恒生科技指数跌 0.74%

9 月 2 日消息 ,恒指收跌 0.07%,恒生科技指数跌 0.74%;电气设备板块领跌,宁德时代跌超 4%,钧达股份跌超 3%;传媒板块跌幅居前,阅文集团跌超 5%;房地产板块领涨,中国海外发展涨超 4%,建发国际集团涨超 2%,恒隆集团涨超 1%;银行板块走强,青岛银行、汇丰控股涨超 1%;南向资金净买入 40.93 亿港元。(36 氪)

3科创 50 指数收跌 1.82% 军工概念局部逆势活跃

9 月 2 日消息, 今日,科创 50 指数收跌 1.82%。盘面热点稀少,仅 19 只个股涨跌幅度大于 5%。权重股普遍走势较弱,中微公司、澜起科技、源杰科技均跌超 3%。军工概念局部活跃,国科军工涨超 9%,晶品特装涨超 8%。医疗器械板块部分个股上涨,奥精医疗、浩欧博涨超 6%。个股表现上,路德科技涨超 12%。 (科创板日报)

"Agent 可以做选品,跨境卖家真正得到什么。"

更多干货分享敬请注我们的公众号与视频号 ~ 超多精彩对话内容等待您的解锁!

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 李飞飞 空间站 成都
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论