腾讯混元推出Hy ASR3.0preview模型,语音识别升级语境理解能力
8月4日,腾讯混元正式发布新一代语音识别模型Hy ASR3.0preview,创新性融合Hy3大模型语义理解能力与高精度语音识别技术,打破传统语音工具仅能逐字转写的局限,迈入懂语境、适配多场景的智能识别新阶段,大幅提升复杂场景语音交互体验。
该模型综合识别精度行业领先,开源评测数据显示,其中文普通话、英语、粤语词错误率分别低至3.34%、2.62%、3.12%。同时适配十余种方言、专业术语、高噪音、耳语等复杂场景,多维度评测指标均稳居行业前列。技术层面采用高效MoE架构,搭载自研无监督语音编码器,依托数千万小时语音数据训练,通过联合预训练与多阶段强化学习,解决方言识别、语义纠错、漏识别等行业痛点。
目前模型已上线腾讯云开放API调用,广泛适配智能客服、语音搜索、内容转写等商用场景。腾讯AI助手元宝已首发接入,免费向用户开放方言识别、语境智能纠错等功能,WorkBuddy等办公产品也在陆续适配上线。
此次全链路技术升级,让语音识别不再是简单文字转换,而是贴合用户真实意图的智能交互,为全行业语音智能化升级提供有力技术支撑。
工具地址:腾讯混元官网

商汤开源U1.5-Lite轻量多模态模型,8B参数支持4K图像生成编辑
商汤科技正式开源SenseNova U1.5-Lite-Preview轻量统一多模态模型,基于前代U1架构全面迭代,以仅8B-MoE的轻量化参数规模,实现4K高清图像生成、精细化视觉编辑、精准文字排版等高阶能力,用架构创新突破小参数模型的性能上限。
相较于旧版模型,U1.5-Lite在四大核心能力全面升级,原生支持4K超高清生成,优化画面纹理质感与真实度,精准实现中英文文字生成和复杂版式排版,同时强化图像编辑稳定性,修改画面时可完好保留原图主体、结构与未改动区域。技术团队重构生成头结构,解决高分辨率图像网格伪影问题,优化训练数据集与任务逻辑,大幅提升指令遵循精度。
多项权威基准测试成绩大幅跃升,Qwen-Image-Bench得分从47.14提升至55.20,多平台图像编辑评测分数均显著上涨。
该模型摒弃盲目扩大参数的迭代思路,通过全链路技术优化实现能力突破,为轻量化多模态模型商用落地提供全新方案,适配设计创作、电商美工、视觉修图等轻量化商用场景,助力降低行业AI视觉创作门槛。
模型地址:商汤SenseNova官网

面壁智能开源ForgeStencil系统,AI可全自动优化工业计算软件
面壁智能联合OpenBMB开源社区,正式推出全球首款Stencil智能优化系统ForgeStencil并全面开源,依托双智能体架构,实现工业核心计算软件全自动优化部署,无需人工介入,一周即可完成100余款工业软件迭代升级,破解高性能计算行业技术瓶颈。
Stencil模板计算是气象预测、地震勘探、电磁仿真、材料模拟等核心领域的基础算力模式,但传统计算方式访存密集、算力损耗大,且高度依赖稀缺的HPC专业人才。过往软件优化需要人工适配场景、调试参数、迭代代码,无法实现规模化批量优化,严重制约工业与科研软件运行效率。
ForgeStencil的落地彻底改变这一现状,依靠双Agent智能协作机制,可自动完成算法研究、代码优化、场景适配、批量部署全流程工作,摆脱对人工专家的依赖。
该系统打通自动研究与落地部署链路,能够适配不同硬件、不同应用场景,大幅降低工业高性能软件的优化成本,提升核心算力利用率,为国产工业仿真、科研算力迭代提供开源技术支撑,助力高端工业软件国产化升级。

CodeBuddy与WorkBuddy延期Hy3免费活动,持续开放至8月31日
CodeBuddy、WorkBuddy官方联合宣布,将Hy3大模型免费体验活动延期至2026年8月31日。此前该免费体验活动用户参与热度极高,为满足更多开发者与普通用户的测试需求,平台决定延长福利周期,持续开放免费调用权限。
据官方介绍,Hy3是专注文本任务的大语言模型,不具备多模态生成能力。用户若通过两大平台调用该模型执行图片、视频生成等多模态任务,系统会自动切换适配的多模态模型,并按照标准规则扣除积分,保障任务正常完成。为应对激增的访问流量,平台优化了每日免费额度分配机制,高峰期会开启排队模式并提示额度恢复时间。
官方建议用户可选择23点至次日8点错峰使用,获取更流畅的体验。
本次延期不仅让更多用户深度测试Hy3文本处理、逻辑推理、内容创作等核心能力,也能帮助官方持续收集海量真实场景使用反馈,持续迭代优化模型性能,进一步提升AI办公、AI编程场景的落地适配效果,完善平台整体AI服务能力。
工具地址:WorkBuddy官网

北京AGI Bar推出算力畅饮服务,到店可免费调用DeepSeek V4 Flash
北京主打开发者交流的AGI创新酒吧,推出特色“Token免费畅饮”服务,用户到店消费并连接店内Wi-Fi,即可不限量免费调用DeepSeek V4 Flash模型算力,所有推理任务均在本地设备完成,为开发者提供便捷的线下AI调试体验。
门店搭载英伟达DGX Spark AI工作站提供算力支撑,顾客获取专属Base URL与API Key后,可直接在Claude Code、Cursor、Cherry Studio等主流开发工具中接入模型,使用体验与云端商用API基本一致。该品牌在北京、上海均设有门店,凭借优质的AI开发者交流氛围,曾吸引Midjourney创始人到访交流,在行业内颇具知名度。
这一创新玩法实现了AI算力场景破圈,让算力从纯线上技术服务,转变为线下实体消费场景的基础设施。随着大模型推理成本持续降低,未来咖啡厅、共享办公、商圈门店或将陆续普及免费AI算力服务。这种轻量化、接地气的算力普惠模式,大幅降低了普通开发者的模型测试门槛,成为AI技术民用化、场景化的全新探索方向。

OpenAI ChatGPT Atlas浏览器将于8月9日停服,用户需及时迁移数据
OpenAI正式官宣,旗下ChatGPT Atlas浏览器将于2026年8月9日全面停止服务,届时将终止所有功能更新与安全漏洞修复,网页端服务也将同步关停。该产品2025年10月登陆macOS平台,上线不足十个月便正式落幕,是OpenAI试水浏览器赛道的短期产品。
官方提醒用户尽快迁移数据,Atlas浏览器书签、浏览记录需手动导出为HTML文件,再导入其他主流浏览器。目前产品暂不支持Cookies导出,迁移后所有网站账号需重新登录,存在一定的数据迁移成本。停服后老旧版本存在大量安全隐患,官方明确建议用户停止使用,规避网络安全风险。
此次停服并非放弃流量入口布局,而是产品策略调整。OpenAI将舍弃独立浏览器形态,转而依托Chrome扩展程序、ChatGPT桌面客户端等轻量化形态,持续渗透用户上网场景。
Atlas的落幕是一次产品试错,也标志着OpenAI的流量布局更加轻量化、生态化,贴合用户日常使用习惯,持续巩固AI交互入口优势。
工具地址我就不放了,要停服了!

MiniMax H3开源限制部分海外地区,源于版权诉讼风险防控
稀宇科技正式开源MiniMax H3多模态视频大模型,模型能力对标字节Seedance系列,具备优质的视频生成与编辑能力。本次开源协议设置地域限制,美国、欧盟、英国、韩国等地区用户无法直接下载使用,引发行业广泛讨论。
官方负责人公开回应限制原因,并非地缘技术封锁,而是出于海外版权诉讼风险的自保举措。此前好莱坞迪士尼、环球影业等多家影视巨头起诉MiniMax,指控其AI产品未经授权使用版权影视内容训练模型,生成影视IP相关内容侵权。今年5月美国法院驳回撤诉申请,案件仍在持续推进。
为规避海外法律风险,平台划定开源使用边界,受限地区用户可通过正式合规申请渠道,搭建符合当地法规的内容审核机制后授权使用。
这一举措让行业看清,海外AI版权监管日趋严格,国内AI企业出海需优先完善合规体系。该限制是企业应对海外版权纠纷的合理风控手段,也为国产大模型出海合规运营提供了重要参考范本。
工具地址:MiniMax官网

AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










