该事件追踪线聚焦Flash系列大模型的密集发布与市场动态,涵盖GLM、Gemini、DeepSeek等多家厂商的迭代与竞争。最新进展显示,GLM 5.3 Flash多平台上线并登顶基准测试,谷歌Gemini 3.7 Flash发布并快速替换前代,同时低价Flash模型正冲击旗舰格局。整体走向呈现Flash模型迭代加速、价格下探的明显趋势。
谷歌为Gemini 3.7 Flash、3.6 Flash和3.5 Flash-Lite引入基于代理的视频分析功能。该功能不再按固定帧率扫描视频,而是由模型自主决定检查哪些片段及分辨率,据称可将令牌使用量最高减少88%,同时提升准确性,尤其适用于数小时长的视频。
The Decoder据BAI_AGI公告,自2026年9月3日17:00(新加坡时间)起,DeepSeek V4 Flash和DeepSeek V4 Flash Vision Exp将结束免费使用,转为折扣定价。高峰时段(工作日09:00–12:00、14:00–18:00)为官方标准价5折,非高峰时段(其他工作日时段及周末)为官方标准价7.5折(即高峰价的5折)。BAI_AGI表示完全对齐DeepSeek官方峰谷定价。免费替代方案包括GLM 5.3 Flash(即Ox Alpha,320B总参数/18B激活,1M上下文),以及Qwen3.8 Flash、Hy3、MiMo V2.5。
Coinness谷歌最早将于周三发布Gemini 3.8 Flash AI模型。该模型为谷歌最新一代AI模型,具体功能与性能细节尚未公布。
雪球Phala Network宣布,GLM 5.3 Flash已在其平台上线,运行于TDX认证的GPU TEE环境中,提供私有、可验证的推理能力,支持编码、长时程智能体及视觉理解等场景。
Coinness智谱AI的GLM-5.3-Flash和阿里巴巴的Qwen3.8-Flash以低价策略迅速进入市场,正在重新定义中国大模型旗舰产品的标准。这两款模型通过大幅降价,在价格战中凸显了性价比优势,对现有高端模型构成竞争压力。此举可能促使其他厂商调整定价策略,加速行业价格竞争。
Pandaily谷歌员工已开始测试下一代Gemini Flash AI模型。尽管前沿模型发布持续延迟,但公司正以更快速度推出更便宜、更高效的模型。
Businessinsider智谱AI(Z.ai)推出的GLM 5.3和GLM 5.3 Flash模型现已上线Theta EdgeCloud平台,开发者可立即使用该平台进行模型构建与应用开发。
Coinness在包含12项任务的Editorial Craft评测中,Z.ai的GLM 5.3 Flash以0.94分排名第一,每任务预估成本为0.0002美元。Step-3.7-flash以0.92分紧随其后,Qwen3.8 Flash、Claude Opus 5 (Fast)、Gemini 3.7 Flash和DeepSeek-V4-Flash-0731分列其后。
RuntimewireDeepSeek V4 Flash免费API活动自启动以来,累计token吞吐量已正式突破3500亿。平台持续承载高并发工作负载,创下新纪录,基础设施经受住大规模调用考验。该API支持重度编码、长上下文、多智能体工作流及大规模API调用,保持零成本、无限制使用。
CoinnessLing-3.0 tiny和flash基础模型现已正式开源,开发者可获取使用。此次开源旨在推动AI模型生态发展,为相关应用提供更轻量化的选择。具体技术细节和性能参数尚未公布,后续将陆续披露。
网易科技谷歌旗下廉价AI模型Gemini 3.7 Flash性能大幅提升,现已能根据单一提示生成可玩游戏,而三周前尚无法完成这一任务。不过,该模型仍缺乏高级推理能力,免费27B版本在推理表现上依然有限。
RWA Daily谷歌正式推出Gemini 3.7 Flash模型。该模型在流程自动化和文档处理能力上实现显著提升,有望让Spark智能体在实际应用中更加高效。此次更新聚焦于自动化工作流,旨在优化用户的任务处理体验。
Digitaltrends谷歌近日用新版替换了发布仅三周的Gemini 3.6 Flash,并将价格下调持续至今年年底。据团队负责人Tulsee Doshi介绍,新版本在编程和工作流基准上有所提升,但谷歌完整评估表显示改进并不均衡。
Runtimewire谷歌发布新款Gemini Flash模型,该模型将先于Gemini 3.5 Pro亮相。具体发布安排与性能参数尚未公布。
Yahoo Tech谷歌最快今日推出Gemini 3.7 Flash,API价格可能降至每百万Token输入0.75美元、输出3.75美元,较Gemini 3.6 Flash的1.50美元和7.50美元接近砍半。此前谷歌官方Python GenAI SDK曾短暂出现gemini-3.7-flash标识,引发社区关注。另有消息称,谷歌已内部取消Gemini 3.5 Pro旗舰模型,团队转向规模更大的Gemini 4。
区块律动Vercel网关数据显示,开放权重模型的令牌流量已超越闭源模型,DeepSeek V4 Flash和Step 3.7 Flash领衔这一转变。不过,该数据仅覆盖Vercel自身网关,不能代表整个AI市场。
RuntimewireARC Prize的外部评测显示,深度求索创始人梁文锋的开源权重模型DeepSeek V4 Flash,在Max努力级别下准确率为61.4%,在Low级别下则为46.0%;Max级别下每个任务成本为0.04美元。
RuntimewireDeepSeek V4 Flash在OpenRouter周度全球token使用量排行榜上以7.1万亿token位居第一,前五名中有四席为中国模型。OpenAI因此将GPT-5.6 Luna价格下调80%。
Pandaily最新AI模型调用量排行榜显示,DeepSeek V4 Flash单周调用量超过7万亿Token,位列全球第一。榜单前五名中,国产模型占据四席,显示中国AI模型正在快速崛起。
RWA DailyDeepSeek V4 Flash API因访问量激增出现性能下降,目前问题已解决,服务已恢复。
华尔街见闻DeepSeek-V4-Flash正式版API开启公测,国家超算互联网上线该模型API调用与下载服务。
ReadhubDeepSeek V4-Flash正式版在相同任务上仅用40秒,比GPT最强模型的1分47秒快得多,价格低数十倍至百倍。
和讯科技DeepSeek发布更新,率先推出Flash模型,但并非重大版本升级。
HuxiuDeepSeek上线DeepSeek-V4-Flash正式版API公测,并预告V4-Pro正式版即将发布。
脚本之家DeepSeek-V4-Flash正式版API上线公测,V4-Pro正式版将尽快发布。
新浪财经硅谷大模型领域从炫耀性消费转向成本效益优先的消费降级模式。
Tmtpost中国一开源模型引发硅谷科技巨头震动,全球AI产业格局或生变。
中国多家企业连续发布开源模型,DeepSeek创始人梁文锋推出最新模型。
月之暗面开源Kimi K3模型权重和技术报告,并公开三大关键Infra技术。
模型开源被指有力打破西方偏见,推动AI领域公平竞争。
硅谷科技公司在大模型领域转向削减开支,采用更经济实惠的解决方案。
谷歌推出更快更高效的Gemini Flash 3.6模型,Meta扩展AI自主能力,英伟达、微软和Meta支持开源权重AI模型。
大模型企业呈现K型分化,头部与尾部公司差距持续扩大。
大模型企业呈现K型分化,头部公司加速领先,长尾企业面临淘汰风险。
海看股份全媒体风控大模型入选山东首批重点推广垂直领域大模型,获行业认可。
Kimi K3模型再受关注,瑞银认为中国AI模型的结构性成本优势有望长期保持。
谷歌发布Nano Banana 2 Lite和Gemini Omni Flash模型
谷歌发布低成本文本转图像模型Nano Banana 2 Lite,4秒生成输出,并向开发者推出Gemini Omni Flash
The Keyword中国AI大模型API调用量连续九周全球领先,DeepSeek-V4-Flash、MiMo-V2.5和MiniMax M3位居前三,美国市场份额从72%骤降至33%。
微软在GitHub Copilot上推出MAI-Code-1-Flash,提供低延迟代码生成。
Google发布Gemini 3.5 Flash,增强模型直接操控电脑界面、执行多步骤任务的智能体能力,定位从问答工具转向执行型AI。
谷歌更新Gemini速率限制并部署新模型Gemini 3.5 Flash。
androidauthority.com{"content":":"Anthropic递交IPO申请并发布Claude Opus 4.8,NVIDIA推出Cosmos 3等新品,谷歌停用Gemini 2.0 Flash,加州通过AI聊天机器人禁令。","category":"人工智能"}
aiweekly.co谷歌推出Gemini 3.5 Flash Low版本以减少简单任务消耗token限额。
androidauthority.comGoogle I/O 2026大会上,一个技能文件成为真正亮点,热度超过Gemini 3.5 Flash。
dev.to09:00-10:00 关键词:AI芯片、加密货币、谷歌I/O、股市波动、地缘局势 1. 谷歌在I/O大会上发布Gemini 3.5 Flash,定价大幅提升,同时DeepMind CEO批评AI裁员论,强调应提升生产力而非裁员。 2. 特朗普签署行政令要求解除对加密货币公司的银行限制,同时下令军队准备攻击伊朗,比特币勉强维持在76000美元。 3. 比特币ETF在24小时内流出近10亿美元,Solana期货资金费率转负,市场担忧SOL价格或跌至78美元。 4. A股开盘三大指数集体低开,沪指跌0.4%,黄金及小金属板块跌幅居前;央行净投放495亿元。 5. 千亿“玻璃女王”周群飞折价45%入主巨腾国际,后者股价跌超25%;振芯科技股东会冲突,内斗升级。 6. AI芯片应用从云端向终端设备下沉,带动AI硬件市场全面扩展,市场低估Google全模态AI商业化潜力。 7. 宇树科技计划批量生产人形机器人,进入工厂场景;腾砥生物完成750万美元融资,整合AI到环肽药物发现。 8. 美国SEC批准加密平台代币化股票,苹果和特斯拉股票将可交易;MetaMask新增代币化美股功能,但不对美国用户开放。
RecodeX AI谷歌在I/O大会上发布Gemini 3.5 Flash,定价为每百万输入令牌1.50美元、输出令牌9美元,是Gemini 3 Flash Preview的3倍和Gemini 3.1 Flash-Lite的6倍。
Simon Willison's Weblog谷歌发布Gemini 3.5 Flash AI模型,面向所有用户,速度快四倍且安全措施增强。
testingcatalog.com谷歌发布Gemini 3.5 Flash,在代理和编程基准测试上超越旧版Pro模型。
androidauthority.comGoogle 发布专为代理型 AI 优化的 Gemini 3.5 Flash 及通用模型 Omni。
arstechnica.com谷歌I/O 2026将于5月19日开幕,预计将发布Gemini 3.5 Flash、Gemini Omni、全新Gemini UI以及Spark、AI Studio应用等AI工具。
testingcatalog.comGoogle推出Gemini 3.1 Flash-Lite通用版本,支持低延迟高吞吐处理及工具调用能力
testingcatalog.comDeepSeek发布V4 Pro和V4 Flash,定价分别为1.74/3.48美元和0.14/0.28美元每百万token,均为同类最便宜。
Simon Willison's Weblog深度求索发布DeepSeek V4 Pro(1.6T参数)和V4 Flash(284B参数),均支持百万token上下文,称成本效益领先OpenAI和谷歌DeepMind。
scmp.com谷歌Gemini 3.1 Flash TTS技术旨在解决AI语音生成缺乏情感和人性化的问题,提升语音应用的自然度。
analyticsvidhya.com谷歌推出Gemini 3.1 Flash TTS文本转语音模型,支持超70种语言和音频标签,为开发者提供精细语音控制,号称其迄今最自然、富有表现力的语音输出。
The Decoder谷歌发布Gemini 3.1 Flash TTS预览版,专注于提升语音质量、表达控制和多语言生成,支持超过70种语言和原生多说话人对话。
marktechpost.com谷歌发布Gemini 3.1 Flash TTS模型,通过精细音频标签实现精准控制,提升AI语音生成的表达能力。
deepmind.google谷歌发布llm-gemini 0.30,新增gemini-3.1-flash-lite-preview、gemma-4-26b-a4b-it和gemma-4-31b-it等模型,专注于大型语言模型更新。
simonwillison.netGemini 3.1 Flash Live AI模型使对话体验更接近人类,提升了互动真实感。
analyticsvidhya.com谷歌发布Gemini 3.1 Flash Live预览版,这是一个针对开发者的低延迟多模态语音模型,专注于实时音频、视频和工具交互,旨在提升AI代理的自然对话体验。
marktechpost.com谷歌今日推出对话式音频AI Gemini 3.1 Flash Live,已整合至搜索、Gemini和开发者工具中。
arstechnica.com谷歌发布Gemini 3.1 Flash Live AI语音模型,号称速度更快、对话更自然,定价与Gemini 2.5持平。
the-decoder.com谷歌推出Gemini 3.1 Flash Live音频模型,提升音调理解和降低延迟,用于实时对话并集成SynthID水印技术。
The Keyword谷歌发布Gemini 3.1 Flash Live语音模型,提升精度和降低延迟,使语音交互更流畅自然。
deepmind.google谷歌DeepMind展示Gemini 3.1 Flash-Lite模型,能近乎实时生成完整网站,速度快且成本低,但实用性待验证。
the-decoder.comFlash-Moe项目实现在仅48GB内存的Mac电脑上运行3970亿参数模型,大幅降低大模型部署门槛。
github.comKioxia推出新型AI SSD,作为Nvidia AI GPU的二级缓存,采用XL-Flash SLC技术,性能超1000万IOPS,加速AI工作负载。
tomshardware.com研究人员利用苹果的'LLM in a Flash'技术,在48GB MacBook Pro M3 Max上通过量化与流式加载,成功以5.5+ tokens/秒的速度本地运行Qwen3.5-397B-A17B模型。
simonwillison.net谷歌AI产品经理开源Always On Memory Agent,利用Gemini 3.1 Flash-Lite模型实现持久记忆,无需向量数据库,旨在简化代理系统开发并引发企业治理讨论。
Iffy谷歌发布Gemini 3.1 Flash-Lite预览版,定价为Pro的1/8,在多项基准测试中超越GPT-5 mini和Claude 4.5 Haiku,主打高速低成本AI模型。
m.theblockbeats.info谷歌发布Gemini 3.1 Flash-Lite模型,定价为每百万输入令牌0.25美元、输出令牌1.50美元,即日起通过Gemini API和Vertex AI向开发者及企业客户推出预览版。
36kr.com谷歌发布Gemini 3.1 Flash-Lite模型,作为其低成本Flash-Lite系列的最新更新,输入和输出价格分别为每百万令牌0.25美元和1.5美元,是Gemini 3.1 Pro价格的八分之一,并支持四种不同思维级别。
simonwillison.net谷歌发布Gemini 3.1 Flash Lite模型,定价更低。
investing.com谷歌发布Gemini 3.1 Flash-Lite AI模型,成本仅为旗舰Pro版的八分之一,主打高速推理与多模态能力,面向企业大规模智能应用。
venturebeat.com谷歌DeepMind发布Gemini 3.1 Flash-Lite预览版,作为Gemini 3系列中最快且最便宜的模型,其能力显著提升,但输出成本增长超过三倍。
the-decoder.com谷歌发布Gemini 3.1 Flash-Lite,这是Gemini 3系列中成本效益最高的模型,专为大规模AI生产设计,优化高容量任务,注重低延迟和每令牌成本,现已通过Gemini API和Vertex AI提供公共预览。
marktechpost.com谷歌推出Gemini 3.1 Flash-Lite,声称以低成本提供增强性能,超越2.5 Flash版本。
The Keyword谷歌发布Gemini 3.1 Flash-Lite模型,作为Gemini 3系列中最快且成本效益最高的AI模型。
deepmind.googleNano Banana 2推出基于谷歌Gemini 3.1 Flash Image模型的AI图像生成平台,主打精准文本渲染、4K输出和角色一致性,提供四种定价模型。
ainanobanana2.pro谷歌发布Nano Banana 2图像模型,基于Gemini 3.1 Flash Image构建,支持4K输出并修复中文字符乱码问题。
cn.technode.com谷歌发布最新AI图像生成模型Nano Banana 2(Gemini 3.1 Flash Image),提升图像质量至工作室级别。
analyticsvidhya.com谷歌发布新一代图像模型Nano Banana 2(Gemini 3.1 Flash Image),提升图像生成质量。
analyticsvidhya.com谷歌推出Gemini 3.1 Flash Image图像生成模型,具备先进世界知识、精准文本渲染和翻译功能,并已整合至其产品中。
The Keyword独立开发者推出1.99美元私人AI助手,基于Telegram集成Gemini 3 Flash,支持自定义API密钥,提供自动化部署和WebSocket配置。
personalassistantdeploy.com谷歌在Vertex AI模型目录中正式推出Gemini 3.1 Flash Image模型,即Nano Banana 2,作为低成本、高速度的替代方案,专为大规模生产场景设计,如图像生成和视频模型支持。
news.ycombinator.com开发者推出Quill,一款系统级技术词典工具,利用AI模型(如Gemini Flash)为编程术语提供即时解释,支持多级详细程度和跨应用使用。
github.com研究表明,Gemini Flash 3和GPT-5在深度研究任务中,增加努力反而会降低准确性。
futuresearch.aiAnthropic发布Claude Opus 4.6,在基准测试和实际性能上超越Google Gemini 3 Flash,成为当前最佳AI聊天机器人。
tomsguide.com蚂蚁集团开源全模态大模型Ming-flash-omni 2.0,在多项基准测试中表现突出,部分指标超越Gemini 2.5 Pro,并成为业界首个全场景音频统一生成模型。
36kr.com研究人员提出“Flash Freezing Flash Boys”方案,通过每笔交易加密来防止恶意MEV和抢先交易。
cointelegraph.com中国Step 3.5 Flash LLM模型在智能密度上达到最高水平,引发科技界关注。
static.stepfun.comStep 3.5 Flash LLM模型在代理编码任务中速度比GLM 4.7和Kimi K2.5快约18倍。
huggingface.co一款名为Step-3.5-Flash-int4的新本地大型语言模型在128GB设备上表现突出,成为新标杆。
old.reddit.com