DeepSeek-V4.1-Flash登陆千问AI平台,低成本长文本推理能力升级
近日,DeepSeek新一代轻量旗舰模型V4.1-Flash正式上线千问AI平台,同步开放标准API服务与Token Plan订阅服务,面向全品类开发者与企业用户开放调用。该模型主打高吞吐、低延迟、低成本的核心优势,进一步降低了长上下文智能体开发与批量推理的落地门槛。
据平台披露,V4.1-Flash采用552B参数MoE架构,搭配独特的Causal-Encoder-Decoder非对称结构,输入激活约8B、输出激活约16B,兼顾模型性能与运行效率。模型原生支持文本、图像多模态理解,最长上下文可达100万token,平台最大输出长度约393K,可充分满足长文档解析、多轮工具调用等复杂场景需求。
本次更新最大亮点为成本优化,通过新一代缓存压缩技术,模型KV Cache对HBM的需求降至前代四分之一,SSD存储需求缩减至八分之一,大幅减少长文本、多轮交互的资源消耗。平台推出分时定价机制,闲时输入1元/百万token、输出4元/百万token,忙时价格翻倍,性价比优势显著。
部署层面,阿里云百炼联合vLLM开源社区完成全维度适配,国内外多地域节点均可稳定调用。模型支持函数调用、上下文缓存、结构化输出、联网搜索等全功能,高速率限制可适配企业批量业务,适合客服知识库、代码仓库问答、多模态审单等场景落地,为中小团队AI原型迭代提供低成本方案。
模型地址:DeepSeek官网

Suno v6音乐模型正式上线,联合头部唱片公司优化AI音乐创作体验
海外AI音乐创作平台Suno正式推出全新v6音乐模型,本次迭代联合华纳音乐、BMG、Believe等主流唱片公司联合打磨,在创作精度、可控性与音乐专业性上实现全面升级,成为平台面向大众化音乐创作的重要升级。
不同于以往单一模型更新,Suno v6以模型套件形式推出,包含三款差异化模型。旗舰版v6适配专业创作者,可稳定产出多流派精修音乐成品;v6-wild主打即兴探索,风格更具随机性与质感,适合灵感创作;免费开放的v6-mini兼顾速度与质量,普惠普通用户,整体创作效果优于市面多数免费音乐模型。
新版模型重点强化创作可控性,支持自然语言精准改词、分段修改、多曲目混音、多素材采样拼接。用户可通过文字、音频、图片、视频多模态素材生成原创音乐,仅修改单句歌词即可完成局部优化,无需重构整首曲目,大幅降低精细化创作门槛。
版权合规方面,Suno建立常态化艺术家反馈机制,通过内容筛查规避侵权创作,杜绝恶意滥用行为。平台还规划艺术家专属合作模式,助力音乐人依托AI创作生态实现收益变现。
目前Suno已全面推进模型迭代,旧版模型逐步下线,全平台正式迈入v6创作时代
模型地址:SunoAI官网

宇树科技G1+人形机器人发布,性能全面升级定价9.5万元
国内人形机器人企业宇树科技官宣推出G1+升级版人形机器人,围绕运动、感知、交互、续航四大核心维度完成六项核心升级,在延续初代G1高性价比优势的基础上,全面提升整机智能化与实用性,标准版定价9.5万元。
运动性能是本次升级重点,G1+新增2DOF灵活颈部结构,俯仰、偏航活动范围大幅提升,适配多角度场景交互。整机电机系统完成迭代,肩腰、手臂、大腿电机峰值扭矩显著提升,同工况下发热大幅降低,搭配低惯量高速电机与双编码器,设备响应速度、负载能力与持续运行稳定性全面优化。
感知与交互层面,设备搭载双目+广角单目双视觉系统,搭配3D激光雷达,空间深度感知能力更强。头部集成多点触控模块,六麦克风阵列支持精准声源定位与降噪处理,搭配双扬声器,远场语音交互体验大幅提升,适配复杂人机互动场景。
续航与拓展性方面,G1+配备9000mAh快拆电池,标准续航可达2小时,新增外部供电接口支持长时间在线作业。同时推出EDU专业版本,自由度、手臂负载、可拓展模组全面升级,保修期大幅延长,可满足科研开发、深度定制等专业场景需求。
公司官网:宇树科技官网

ElevenLabs Music v2.5音频模型更新,合规化AI音乐创作能力升级
知名AI语音音频技术企业ElevenLabs正式推出Music v2.5音乐生成模型,同步上线移动端APP与开发者API接口,面向全球用户开放使用,本次迭代重点优化音频质感与多流派适配能力,同时强化版权合规体系。
据官方测试数据显示,基于近4.8万组样本的盲测对比中,用户对Music v2.5的认可度远超旧版模型。该模型在R&B、嘻哈、摇滚、管弦乐等主流及复杂曲风的生成效果大幅优化,音频饱满度、自然度显著提升,有效改善了过往AI音乐生硬、失真的问题。
商业化服务采用梯度模式,保留免费版与专业版双体系。免费版用户每日可享受5次无损下载权限,商用需标注出处;专业版提供高额下载额度,满足创作者高频使用需求。平台明确用户拥有生成曲目完整所有权,同时严格禁止模仿知名艺人声线、复刻版权曲目,规避侵权风险。
相较于行业竞品,Music v2.5依托全合规训练数据集研发,规避了版权诉讼隐患。尽管品牌与环球音乐的授权合作未应用于本次版本,但合规化的研发模式,使其在AI音乐赛道中建立起差异化竞争壁垒,进一步推动行业规范化发展。
工具地址:ElevenLabs官网 (海外网站需要科学上网)
OpenAI上线Agents API服务,降低AI智能体开发落地门槛
人工智能企业OpenAI近期完成多项产品迭代,其中全新上线的Agents API服务成为行业焦点。该服务将Codex核心能力拆解为云端托管服务,简化AI智能体搭建流程,让智能体开发实现轻量化接口调用,大幅降低中小开发者落地门槛。
此前开发者搭建AI智能体,需自主完成框架搭建、上下文管理、工具适配、任务调度等复杂工作,技术门槛与研发成本较高。而Agents API将智能体编排、任务执行、云端托管等核心能力整合,用户仅需一次接口调用,即可快速部署可用的托管式智能体,无需自主搭建底层架构。
本次更新是OpenAI从单一模型售卖转向开发者生态搭建的关键布局,核心聚焦AI执行框架赛道。当前行业头部企业均在布局智能体执行技术,竞争核心已从模型算力、理解能力,转向实际任务执行与落地能力。
办公智能体成为当前竞争核心场景,谷歌凭借全栈生态占据优势,国内科技企业也持续贴身布局。OpenAI本次API开放,进一步盘活全球智能体开发生态,推动AI从被动问答工具,升级为可自主调度、执行复杂任务的生产力工具。

京东JDD大会发布EchoWM世界模型,开源可交互长视频生成技术
在9月9日举办的京东全球科技探索者大会上,京东探索研究院公布两项音视频AI技术重磅进展,全新可交互视听世界模型EchoWM正式开源,迭代后的JoyAI-Echo1.5模型,实现10分钟以上超长稳定音视频生成。
超长视频生成领域,JoyAI-Echo1.5依托创新的音视频记忆架构,可在长时程、多镜头创作中稳定保留人物形象、声线与故事逻辑,避免内容跑偏。通过专项后训练优化,模型推理速度最高提升7.5倍,仅需两张H200显卡即可实现480P画质1:1等时生成,搭配智能导演模块可自主完成分镜、生成、审核、成片全流程。
开源的EchoWM模型打通了交互与音视频生成壁垒,可原生产出720P高清视频、配套音效与人声,支持第一、第三人称多视角连续交互探索。在权威导航评测榜单中,EchoWM及其极速版本包揽综合排名前两位,交互稳定性行业领先。
依托JoyAI完整基础模型矩阵,京东已实现多模态生成、世界建模、具身智能的技术闭环,并落地零售、物流、医疗、工业、政务五大行业AI方案,推动AI技术从数字内容创作向物理场景智能化应用延伸。

月之暗面Kimi2.8Preview模型全量上线,综合性能对标旗舰K3
国内AI企业月之暗面正式上线K2.8Preview主力模型,已在Kimi Code、Kimi Work两大平台全量开放,综合性能大幅提升,整体实力无限接近品牌旗舰K3模型,重点强化编程与智能体核心能力。
据官方介绍,K2.8Preview全面支持100万超长上下文窗口,且对所有会员档位开放权限,降低了长文本解析、批量代码处理、复杂智能体任务的使用门槛。相较于前代模型,本次迭代针对性优化代码编写、调试、场景适配能力,可更好满足开发者编程作业、企业知识库梳理、自动化任务调度等需求。
回顾月之暗面2026年产品迭代节奏,品牌保持高频更新态势,从年初K2.5登顶全球榜单,到年中Kimi Work内测、K2.7高速版上线,再到本次K2.8Preview落地,技术迭代速度持续领跑行业。此前旗舰K3模型的预热,也为系列产品奠定了高端技术基础。
随着K2.8Preview全量落地,月之暗面进一步完善产品矩阵,以亲民的开放权限、旗舰级的性能表现,兼顾普通用户与开发者需求,持续巩固其在长文本、编程、智能体赛道的核心竞争力。
模型地址:kimi AI官网

AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










