Mistral发布Shieldstral轻量审核模型,3B参数实现多模态SOTA能力
8月4日,Mistral AI正式开源全新内容审核模型Shieldstral,仅30亿参数的轻量化体量,却实现开源领域多模态内容审核顶尖水准,适配中小算力设备落地,大幅降低AI内容安全风控门槛。该模型基于Apache2.0开源协议发布,已正式上线Hugging Face平台供开发者免费使用。
相较于传统大体积审核模型,Shieldstral最大优势是轻量化、高性能、低门槛部署,仅需单张16GB显存显卡即可完成完整运行,无需高端算力集群支撑,非常适配个人开发者、中小型企业的日常风控场景。模型支持12种语言识别审核,覆盖多语种图文内容合规检测需求,适配全球化AI产品风控场景。
官方实测数据显示,该模型安全审核性能,能够媲美参数规模高出自身7倍的主流开源审核模型,一举拿下当前开源多模态内容审核领域SOTA级别表现。
在AI内容乱象频发、合规监管趋严的当下,轻量化高性能审核模型的落地,能够帮助各类AI应用快速搭建合规风控体系,兼顾部署成本与审核精准度,为行业轻量化合规发展提供优质技术方案。
Hugging Face模型地址:https://huggingface.co/mistralai/Shieldstral-1.0-3B

字节SeedRealtime全双工大模型落地豆包,实现实时音视频自然交互
字节跳动Seed团队推出全新全双工音视频大模型SeedRealtime,依托统一端到端架构,融合音频、视频、文本多模态能力,实现边看、边听、边说的实时自然交互体验,目前已在豆包APP全量上线,完成规模化商业落地。
传统实时AI交互多采用级联拼接方案,识别、理解、回应分模块运行,容易出现抢话、停顿生硬、答非所问等问题,对话割裂感明显。SeedRealtime彻底重构技术架构,将多模态感知与内容生成整合至同一模型,同步处理画面、声音信息并即时生成回应,有效减少半数以上的对话节奏问题。
该模型高度贴合真人对话逻辑,可自主适配对话节奏,灵活自然停顿、适时提醒互动,告别机械生硬的AI应答模式。区别于多模型拼接的传统方案,单模型统一处理全链路任务,大幅降低延迟与算力损耗。
小编认为字节SeedRealtime落地意味着实时多模态交互技术走出实验室,让普通用户在日常AI对话、视频互动中,体验到更流畅、自然、拟人化的智能交互效果,推动消费级AI交互体验全面升级。
详情查看: https://www.aitop100.cn/infomation/details/34400.html

阿里千问Qwen-Image-3.0图像模型上线,低价开放商用API服务,单张低至0.18元
8月5日,阿里千问正式上线Qwen-Image-3.0图像生成大模型,标准版与旗舰Pro版同步开放商用API,国内用户可直接接入千问平台,海外用户依托Qwen Cloud即可调用,基础文生图单价低至0.18元/张,性价比优势突出
该模型综合实力稳居国内第一梯队,在Arena.ai国际文生图榜单中位列国产模型榜首。核心优势集中在超长文本理解与精细化渲染,最高支持4.5k超长指令输入,可一次性完成分镜脚本、学术图表、九宫格知识海报等复杂版式创作,精准还原10px小字、完整LaTeX公式,人像发丝、皮肤质感贴近实拍效果,同时支持古画修复、多风格创作
模型原生支持12国语言渲染,内置海量世界知识与联网检索能力,覆盖上百种艺术创作风格。商用定价十分亲民,1K/2K分辨率标准版仅0.18元/张,Pro版1K、2K分别为0.25元、0.5元/张,图像编辑低至0.02元/张
目前已广泛适配电商出图、影视分镜、广告设计、建筑渲染等场景,助力降低企业视觉创作成本,提升商业出图效率
小编目前在千问AI官网测试,效果很不错。
体验地址:千问AI官网

DeepSeek重启第二轮大额融资,投前估值升至5000亿元
据快科技消息,国产头部大模型企业DeepSeek正式重启第二轮融资,计划募资500亿元,投前估值达5000亿元,预计8月下旬完成签约交割。本轮融资落地后,公司两轮累计募资将突破千亿,估值较首轮提升43%,持续刷新国内AI行业融资纪录。
今年4月DeepSeek启动首轮融资,6月顺利完成交割,以3500亿估值募资500亿元,吸引国字号AI基金、腾讯、宁德时代、京东等顶级产业资本与机构入局,当时意向资金超千亿,大量资金顺延至本轮跟投。该轮融资曾于7月底短暂暂停,目前低调重启推进,稳步对接投资方。
在大模型算力竞争、技术迭代加速的行业背景下,千亿级资金加持,将为DeepSeek的模型研发、算力储备、商业化落地提供充足支撑。
顶级资本持续加码,充分认可国产大模型的技术实力与商业化潜力,也将进一步拉开行业梯队差距,加速国内AI产业规范化、规模化高质量发展,巩固国产大模型在全球赛道的竞争优势。
工具地址:DeepSeek官网

京东开源JoyAI-Video-Edit模型,实现视频实时流式编辑能力
京东科技正式开源自研JoyAI-Video-Edit实时流式视频编辑模型,打破传统视频创作“先成片、后修改”的固有模式,实现边播放、边预览、边修改的实时交互式创作,重构短视频、商用视频生产流程,综合性能达到世界一流水平
传统AI视频编辑需要先生成完整素材,再进行剪辑、替换、修图等操作,流程繁琐、耗时较长,很难满足实时创作需求。京东全新开源模型支持30帧秒级高速推理,依托流式编辑架构,用户可实时修改视频人物形象、场景画面、画面元素,即时预览修改效果,大幅压缩视频创作周期
官方实测对比显示,JoyAI-Video-Edit在实时编辑精度、画面稳定性、推理速度等核心指标上,全面领先业内主流同类模型。
此次开源面向全行业开发者开放,免费提供技术能力与底层架构参考,能够广泛适配短视频创作、电商视频剪辑、广告素材制作等场景,有效降低视频创作门槛,推动AI实时视频编辑技术普及,助力内容行业提质增效

DeepSeek-V4-Flash登顶OpenRouter调用榜,国产大模型热度持续领跑全球
8月4日OpenRouter最新算力统计数据显示,国产大模型整体热度持续领跑全球,连续14周调用量超越美国模型。7月27日至8月2日期间,全球大模型总调用量56.8万亿Token,其中中国模型28.13万亿Token,是美国4.38万亿Token的14.1倍,榜单前五席位全部被国产模型包揽。
具体榜单中,DeepSeek-V4-Flash以7.22万亿Token周调用量稳居全球第一(这太厉害了),单日峰值算力消耗远超海外数百款模型总和。紧随其后的是小米MiMo-V2.5、腾讯HY3、DeepSeek-V4-Pro、智谱GLM-5.2,充分展现国产大模型的市场认可度。该模型凭借极致性价比,缓存命中输入低至0.02元/百万Token,被海外开发者誉为高性能、低成本的优质模型。
此次数据直观印证国产大模型的技术成熟度与商用优势,摆脱以往海外模型主导市场的格局。
DeepSeek-V4-Flash兼顾性能、速度与成本,适配海量开发者商用场景,成为全球AI算力生态的核心力量,标志着中国大模型产业已实现技术、落地、商业化的全方位领跑。
工具地址:DeepSeek官网

影石Insta360相机接入阿里千问,搭载AI语音助手Kira升级体验
影石Insta360官宣硬件AI能力重磅升级,旗下Go Ultra口袋相机即将搭载全新AI语音助手Kira,采用自研技术融合阿里千问大模型能力,实现智能问答、模式切换、多语言翻译等功能,8月5日正式上线更新。
本次升级采用端云协同架构,声纹识别、意图判断等基础能力在设备端自研完成,保障响应速度与使用稳定性;复杂问答、智能翻译、功能调控等高阶任务,交由阿里千问云端大模型处理,兼顾智能化与精准度。同时产品采用差异化模型适配策略,中国大陆地区接入千问,港澳台及海外地区调用谷歌Gemini,适配不同区域合规要求。
根据小编打听到的消息,Go Ultra作为影石主打便携口袋相机,售价是2598元,本次AI赋能让传统拍摄硬件升级为智能影像设备,拍摄、调控、翻译全流程语音可控。硬件+国产大模型的融合模式,大幅提升普通用户的拍摄体验,也为智能影像硬件的AI升级、国产模型终端落地提供了成熟的合作范本。

AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










