阶跃星辰发布StepAudio3系列模型,五款同步上线开放平台
阶跃星辰今日正式发布StepAudio3系列模型,一次性推出五款新品,覆盖语音交互全链路。其中,StepAudio3Realtime支持原生全双工实时对话,能同时理解语义、语气、情绪及环境音,在Artificial Analysis榜单中综合得分98.9%,位列全球第一。
StepAudio3ASR融合大模型上下文理解,支持方言、中英混说及医疗、法律等专业场景,WER低至1.7%,并列全球第一
- StepAudio3TTS强化副语言表现,支持流式生成;
- StepAudio3Gen可统一生成角色人声、音效与环境音;
- StepAudio3Music则支持歌曲创作、翻唱及基于ABC记谱法的多轮创作
整体来看,该系列将语音模型能力从单一识别或生成,拓展至完整音频内容生产与实时智能交互。
此举标志着国内语音AI从“单点突破”迈向“全栈自研”。但挑战同样明显:全双工交互对延迟极为敏感,弱网环境下体验或大打折扣;多角色、多音效的精准控制,对普通用户门槛较高;音乐创作涉及版权边界,如何界定AI生成内容的版权归属,仍是悬而未决的问题。
更关键的是,这些模型虽在榜单上“屠榜”,但真实场景中的鲁棒性、抗干扰能力,仍需大规模商用验证。若仅停留在“实验室第一”,而未能真正落地到客服、教育、娱乐等高频场景,则技术优势难以转化为商业壁垒。
阶跃星辰的野心值得肯定,但语音AI的终局,不是参数竞赛,而是场景渗透。唯有在真实世界中跑通闭环,才能让技术真正“开口说话”。
模型地址:阶跃星辰官网

DeepSeek官方桌面端Harness即将上线,性能与安全双升级
DeepSeek官方桌面客户端Harness即将正式推出,支持macOS(Apple Silicon/Intel)和Windows x64三大平台,暂不支持Linux。与社区第三方版本不同,官方版采用自定义dsh-app://协议传输数据,不依赖本地端口,安全性更高。
同时,官方将运行时、后端等打包为整体,版本维护更省心,避免了第三方客户端前后端分离易出bug的问题。性能方面,DeepSeek V4.1 Flash模型与DSH联合优化,官方测试显示DSH minimal模式下性能最佳,缓存命中率常态达95%以上,体感速度更快。
这标志着DeepSeek从“模型开放”迈向“产品闭环”。但需注意:暂不支持Linux,可能流失部分开发者用户;第三方客户端虽不稳定,但功能更灵活,官方版若过于封闭,或影响生态活力。更深层看,官方客户端的推出,也意味着DeepSeek在构建自己的“护城河”——通过性能与安全绑定用户,减少对第三方渠道的依赖。
但此举也可能引发“封闭生态”争议。若未来仅优化自家客户端体验,而弱化API开放性,则可能背离开源初衷。Harness的上线是进步,但DeepSeek需在“产品化”与“开放性”之间找到平衡,否则可能从“开发者之友”变成“围墙花园”。
工具地址:DeepSeek Harness官网

字节跳动全力整合豆包、飞书、火山引擎,加码企业AI市场
在9月15日的飞书未来无限大会上,字节跳动CEO梁汝波宣布,将豆包、飞书、火山引擎三方力量整合,聚焦企业AI市场。豆包提供智能与Agent,处理写案、拆任务等日常;飞书作为协作平台,承载聊天、文档、会议等上下文,让AI嵌入工作流;
火山引擎提供模型、算力与开发工具,支持企业搭建专属Agent。梁汝波强调,Agent不能孤立存在,必须与人、环境及其他Agent协作,三者融合才能产生真实价值。
目前该举措直指企业AI落地的“最后一公里”——场景割裂。过去,AI工具常是“外挂式”存在,难以融入真实工作流。字节的整合,试图打通“模型-平台-应用”全链路。
但挑战同样严峻:飞书在企业市场占有率仍远低于钉钉、企业微信,生态势能有待提升;豆包的Agent能力虽强,但在复杂业务流程中的稳定性、可解释性仍待验证;火山引擎的算力成本,对中小企业是否友好,也是关键。
更深层看,企业AI不是技术堆砌,而是组织变革。若仅靠工具升级,而忽视流程重构与员工培训,则AI仍难真正“落地生根”。字节的整合是正确方向,但能否跑通,取决于能否真正理解企业痛点,而非仅展示技术肌肉。

Anthropic内部“核武级”模型Model 2曝光,已接管85%代码编写
Anthropic新旗舰Opus 5.2已在Claude Code中悄然灰度测试,后端模型slug已指向5.2版本。更劲爆的是,内部风险报告披露,公司正使用一款未发布的“核武级”Model 2,已接管大部分代码编写工作,据称将替代85%的研究团队。这意味着Anthropic不仅在对外输出AI,更在用AI重构自身研发体系。
这揭示了AI发展的“暗线”——大厂正用自家AI“吃掉”自家岗位。但需冷静看待:85%的替代率,可能仅针对重复性编码,而非创造性研究;内部模型的性能,未必能直接复制到外部产品;过度依赖AI写代码,可能导致技术债累积,长期维护成本上升。
更深层看,Anthropic的“自我革命”,也暴露了AI行业的“内卷”本质——不自我颠覆,就被对手颠覆。但对开发者而言,这既是机遇也是警示:AI正在从“辅助工具”变为“替代者”,唯有掌握AI无法替代的系统设计、业务理解能力,才能立于不败之地。Model 2的曝光,不是终点,而是AI重塑研发范式的起点。
工具地址:Claude官网 (海外网站需要科学上网)

腾讯WorkBuddy升级PPT能力,一句话生成可编辑演示文稿
腾讯WorkBuddy于9月14日升级PPT生成能力,主打“一句话出初稿、原文件续改”。用户输入主题,系统可自动补问汇报对象、场景,再搭建“问题—论证—结论”主线;支持上传PDF、Word压缩长文、提取关键结论并转图表;可套用公司或学校模板,保留配色、字体与结构;甚至可借鉴参考PPT的版式。改稿支持“人机双写”,可点选元素下达“拆页”“转图”“重排”等指令,产出为标准.pptx,可在PowerPoint、WPS或腾讯文档继续编辑。
这解决了职场人“做PPT难”的痛点。但需注意:AI生成的逻辑主线,是否符合专业汇报要求,仍需人工校准;模板套用虽方便,但可能陷入“千篇一律”;复杂数据图表的准确性,依赖源文件质量,若原始数据混乱,AI也难“无中生有”。
更关键的是,PPT不仅是信息载体,更是思维表达。若过度依赖AI生成,可能导致思维惰性,丧失独立构建逻辑的能力。WorkBuddy的升级是提效工具,但职场人需警惕:工具越智能,越要保持“人”的思考主导权,否则可能从“做PPT”变成“被PPT做”。
工具地址:腾讯WorkBuddy官网

蓝虫具身发布模块化人形机器人“小白”,起售价0.98万元
西安交大的科技成果转化企业蓝虫具身发布模块化人形机器人“小白”,起售价仅0.98万元。整机高1.4米,22个自由度,单臂负载7kg,臂展663mm,底盘支持3自由度全向移动,前进速度3m/s,续航3小时。各模块采用快装接口,支持灵活扩展。已接入主流具身开发生态,提供开发教程与技术支持。
小编认为这个举措是将人形机器人价格拉下“神坛”(当前人形机器人市场价格普遍虚高)。但需理性看待:0.98万元或为“基础版”价格,完整功能模块或需额外购买;7kg负载、3小时续航,在真实场景中是否够用,仍待验证;模块化虽提升可玩性,但也可能增加故障点,维护成本上升。
进一步看,低价策略旨在抢占开发者市场,但若生态不完善、应用匮乏,则机器人易成“高级玩具”。蓝虫的突破在于“democratization”(大众化),但人形机器人的终局,不是价格战,而是场景战。唯有在家庭、教育、服务等真实场景中跑通,才能让“小白”真正“活”起来。

OpenAI被曝雇佣合同工审核用户对话,隐私争议再起
据404Media调查,OpenAI雇佣数百名合同工审核真实ChatGPT用户对话,以改进模型。审核人员对回复按1至7分评分,重点减少过度奉承与拟人化。合同工由Crossing Hurdles招募,Mercor支付薪酬,北美地区时薪超50美元。OpenAI默认开启“为所有人改进模型”设置,用户可关闭;临时聊天模式则不用于训练。
这暴露了AI优化的“暗面”——人类在“教”AI,也在“看”你。尽管OpenAI称数据经匿名化处理,但过滤器可能误判,敏感信息仍有泄露风险。更深层看,这是AI效率与隐私的永恒博弈。用户享受免费服务,实则“用数据付费”。
Anthropic、谷歌也有类似机制,说明这是行业通病。对用户而言,需清醒认知:与AI的对话,不是“私密聊天”,而是“公开训练数据”。
若涉及敏感信息,务必关闭数据共享或使用临时模式。OpenAI的审核机制是必要的“安全阀”,但透明度与用户控制权,仍需加强。否则,信任一旦崩塌,再强的模型也难挽回。
模型地址:ChatGPT官网(海外网站需要科学上网)

AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:











