DeepSeek-V4-Flash正式版开放公测,V4-Pro模型将于8月初上线
7月31日,DeepSeek正式上线V4-Flash模型正式版API公测服务,定位高效低成本推理场景,同时官宣迭代旗舰模型DeepSeek-V4-Pro将于8月初正式发布。本次更新距离V4预览版上线间隔三个月,通过精细化后训练优化,全面提升模型智能体作业与代码处理能力,适配各类商用开发场景。
DeepSeek-V4-Flash采用轻量化MoE混合专家架构,总参数284B,单次激活仅13B参数,支持百万级超长上下文,可自由切换思考与非思考双模式,模型基础结构与预览版保持一致,仅优化后训练逻辑。该模型原生适配OpenAI Responses API格式,兼容Codex、Claude Code等主流AI智能体,开发者无需修改基础配置即可无缝迁移使用。
官方基准测试数据显示,新版模型在全栈开发、自动化任务、长文本推理等多项核心榜单中,成绩远超此前预览版本,多项指标跻身开源模型第一梯队。
同时模型大幅优化长上下文算力损耗,百万Token场景下单Token计算量仅为前代的27%,显存占用降至10%。定价方面极具性价比,Flash模型缓存命中输入仅0.2元/百万Token,大幅降低企业大模型落地的算力成本。
模型地址:DeepSeek官网

火山引擎公布Seedance 2.5定价规则,新增长视频生成与局部编辑能力
7月31日,火山引擎正式公布豆包视频大模型Seedance 2.5商用定价标准,明确不同分辨率、创作模式的计费规则,标志着这款升级版视频生成模型正式迈入可量化、规模化的商业落地阶段。相比上一代模型,新版本能力全面升级,同时定价略有上浮,主打专业级AI视频创作场景。
计费模式区分有无参考视频两类场景,无参考视频生成单价70元/百万Token,带参考视频创作单价42元/百万Token。按官方测算,5秒720P成品视频单次生成费用约7.56元,每秒成本1.51元,最长可一次性生成30秒完整视频,相比前代15秒上限大幅提升,满足长叙事视频创作需求。虽然整体价格较2.0版本上涨45%至52%,但成品质量与创作效率大幅提升。
功能层面,Seedance 2.5最多支持50个多模态参考素材,涵盖图片、视频、音频三类素材,新增音频驱动画面、视频局部重绘、视频延长续写、多语言生成等实用能力,可高效完成电商多SKU视频批量制作、镜头过渡补帧、画面风格替换等专业操作。
同时优化光影、运镜与人物表演效果,弱化AI生成感,更贴近实拍画质,适配各类商业短视频、跨境广告制作场景。
详情查看: https://www.aitop100.cn/infomation/details/34378.html

Anthropic巴拿马计划细节曝光,破坏性扫书行为引发AI伦理争议
近期,Anthropic隐秘项目“巴拿马计划”完整细节曝光,这家AI巨头为搭建Claude大模型训练数据集,长期采用破坏性方式扫描海量纸质书籍,完成数据采集后直接销毁实体书籍,引发全球科技伦理与文化传承层面的激烈争议。此前该公司已因盗版图书训练问题,与美国作家达成15亿美元巨额和解协议。
据悉,Anthropic的训练数据来源分为两类,一是批量抓取盗版网站超700万册电子图书,搭建BOOK3大型数据集;二是斥资采购数百万本二手实体书,通过裁切书脊的方式高速扫描,获取干净训练文本后直接销毁原书,累计超200万本实体书籍遭不可逆损毁。该项目属于公司隐秘工程,内部明确要求对外严格保密。
该行为存在极大文化隐患,无差别扫描销毁机制,可能误毁二手市场流通的绝版书、批注孤本,切断书籍的社会流转与文化传承价值。
行业观点指出,这本质是AI企业对公共知识资源的商业圈地,将人类公共文化遗产转化为私有算法资源。马斯克近期公开表态,反对破坏性扫书模式,倡导无损扫描、留存珍稀书籍,也为行业AI数据采集的合规化、文明化发展划定底线。

字节跳动完成飞书与豆包团队整合,强化AI办公场景协同能力
字节跳动近期发布内部组织调整邮件,正式宣布整合飞书产品团队与豆包产品团队,组建全新的一体化豆包产品团队,进一步打通通用AI能力与协同办公场景,补齐企业AI办公生态短板,应对行业竞品的快速迭代冲击。
本次架构调整权责划分清晰,全新豆包团队由原有负责人赵祺全权统筹,原飞书业务负责人谢欣向其汇报。团队整合核心目的是打破部门技术与业务壁垒,将豆包大模型的智能交互、内容生成、智能体执行能力,深度融入飞书协同办公全链路,实现AI技术与办公场景的深度绑定。
业内分析认为,本次调整是字节针对AI办公赛道竞争的关键布局。当前WorkBuddy等竞品持续迭代人机协同办公功能,抢占职场用户市场。
字节通过团队整合,能够集中产品、技术、研发资源,优化AI文档协作、智能办公、企业自动化办公能力,实现C端智能交互与B端协同办公的双向赋能,进一步提升字节在国内AI办公赛道的综合竞争力,加速商业化场景落地。
模型地址:豆包AI官网

谷歌地球接入Nano Banana 2模型,上线AI场景生成与历史风貌复原功能
谷歌地球正式落地全新AI图像生成功能,底层搭载Nano Banana 2大模型,结合卫星测绘、3D实景地理数据与生成式AI技术,支持用户自定义重塑地理场景、复原历史风貌,为教育、规划、文旅等行业提供全新可视化解决方案,目前已面向全球网页端用户开放。
该功能操作门槛极低,用户只需锁定目标地理区域,输入自然语言指令,即可依托真实地形地貌数据,生成高精度、贴合地理特征的定制画面。依托Gemini检索能力,系统可同步匹配地标历史资料,生成完整的场景信息解读,完美适配历史教学场景,可一键复原古城、古遗址的原始繁华风貌,解决传统教学画面抽象、可视化不足的问题。
同时,该功能广泛应用于城市规划、地产设计、文旅创作等领域,可提前模拟地块改造效果、建筑落地场景,降低前期设计演示成本。
普通用户也可自由创作科幻、国风等风格的定制地理场景,解锁趣味可视化体验。此次AI功能升级,让谷歌地球从单纯的地图工具,升级为地理可视化、历史复原、创意创作一体化的综合服务平台。
模型地址: https://www.aitop100.cn/tools/imgdrawai/nano-banana
大家可以直接在我们AITOP100平台在线使用

MiniMax发布H3全模态模型,高性价比支持2K音视频生成即将开源
7月31日,MiniMax稀宇科技在官网微信公众号发文正式推出全新全模态生成模型MiniMax H3,主打跨模态融合、高性价比商用内容生成能力,打破传统AI模型的任务与模态边界,适配广告、电商、UI设计、游戏等全品类商业创作场景,同时计划合规开放模型权重。
该模型具备全维度多模态理解与生成能力,可统一解析文本、图片、视频、音频内容,原生支持双声道音视频输出,最高支持15秒2K高清分辨率生成。依托多项自研核心技术,模型在视频动作迁移、指令精准执行、品牌内容还原等方面表现突出,可实现精细化视频编辑与定制化内容创作,满足专业商用标准。
性价比是H3核心优势,2K分辨率生成单价不足主流竞品三分之一,768P分辨率成本仅为行业半数。为推动国产AI生态发展,模型研发阶段已适配多款国产芯片,后续将合规开源权重与基础代码,助力开发者自主定制迭代。
该模型的落地,弥补了开源领域高端视频生成模型的短板,推动国产多模态模型从可用向好用、低成本商用全面升级。
模型地址:MiniMax官网

华为开源openPangu-2.0-Pro大模型,5050亿参数赋能国产AI生态
7月31日,华为在微信公众号宣布正式开源openPangu-2.0-Pro旗舰大模型,同步开放模型权重、推理代码与完整技术报告,持续推进盘古大模型开源计划,完善昇腾AI国产软硬件生态,为国内大模型研发、落地、迭代提供优质开源底座。
该模型为昇腾NPU原生训练的MoE混合专家模型,总参数达5050亿,单次Token激活参数18B,支持512K超长上下文,训练数据体量达34T Tokens。经过多轮监督微调、强化学习与在线蒸馏优化,模型在长文本理解、逻辑推理、复杂任务处理等核心能力大幅提升,推理效率与稳定性适配商用高频场景。
小编认为本次开源是华为HDC2026开发者大会规划的重要环节,此前92B参数的openPangu-2.0-Flash已率先开源。华为聚焦模型推理效率优化,兼顾算力成本与落地实用性,通过持续开源核心技术,降低国内企业与开发者的大模型研发门槛,助力国产AI摆脱海外技术依赖,推动国内通用大模型产业规模化、规范化高质量发展。

AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










