该追踪线聚焦AI模型发布与迭代动态,覆盖大厂及创业公司最新成果。最新进展包括Suno V6、DeepSeek V4.1 Flash、蚂蚁百灵多模态模型及字节空间视频模型等密集发布,并伴随剽窃指控与开源竞争。趋势上,模型发布节奏明显加快,多模态与垂直领域应用成为竞争焦点。
OpenAI的GPT-6 Astra在面向开放数学问题的ErdosBench基准测试中排名第一。OpenAI首席科学家Jakub Pachocki表示,数学并非公司刻意优先发展的方向,公司资源主要投向递归自我改进与对齐研究。这一情况被认为印证了AI发展路径日益“尖峰化”的观点,即在部分领域表现极强,而非全面均衡进步,前提是AI尚无法自我改进、仍需借助人类生成数据进行针对性优化。
The DecoderIoTeX 旗下 Rapid-MLX 推出 0.14.0 版本。该版本主打解码性能大幅提升,并支持复杂的本地工具调用,目标是让用户现有电脑成为完全私有的本地 AI 系统。官方称此次更新在解码速度上有显著增强,可支撑更复杂的本地智能体任务。
CoinnessAI音乐生成公司Suno宣布推出新模型套件V6,该模型基于与华纳音乐集团、BMG和Believe达成的授权协议构建。Suno数月来持续达成音乐授权合作,此次发布标志着其向主流音乐市场进军的重要一步。
VarietyOpenAI发布的新模型在数学领域取得突破,成功破解一道困扰学界90年的难题。然而,该成果随即遭到大学教授公开炮轰,指控其存在剽窃行为。目前OpenAI尚未就剽窃指控作出正式回应,事件引发学术界与AI行业广泛关注。
搜狐科技DeepSeek计划在9月10日前后正式发布V4.1 Flash。官方称,经内部和外部测试,新模型在性能、费用、速度和总用时等指标上全面超过V4 Pro。V4.1 Flash上线后,在V4.1 Pro发布前,所有发往V4 Pro的请求将自动切换至V4.1 Flash,并按更便宜的Flash价格计费,用户无需修改原有调用方式。
区块律动蚂蚁集团宣布开源其百灵系列首个原生多模态模型Ling-3.0-flash-VL。该模型拥有124B参数,支持256K上下文,可处理图像、文本和视频输入。此次开源将推动多模态AI技术的应用与生态发展。
DonewsCosmosMind联合多校研究者发布MetaRSI-v1,提出全球首个统一Model-RSI、Data-RSI、Harness-RSI的元递归自我改进架构,将递归自我改进作用于RSI自身。在无外部教师模型参与下,该架构使30亿激活参数的小模型在四项基准上平均提升10.9分,多款前沿旗舰模型平均提升7.3分。架构包含统一Loop Kernel范式、三种算子、横向编排与纵向优化策略、四种Agent协同的三层RSI嵌套,并提炼出五条定律。团队同时开源RSI-Harness并搭建Genome开放社区。
ReadhubDeepSeek开始内测V4.1 Flash中间版本。官方微信群通知显示,新模型采用全新架构,原生支持多模态,能力更强、速度更快、成本更低。当前计费与V4 Flash相同,单账号最多20并发。用户可直接调用,base_url无需更改,仅需将原模型ID替换为deepseek-v4.1-flash-expires-on-0910。
区块律动字节跳动正在开发一款新AI模型,能够实时生成空间视频,该项目由创始人张一鸣亲自负责。该模型目前处于曝光阶段,具体发布时间和产品细节尚未公布。
搜狐科技独立开发者cozyblaze将OpenAI的GPT-6 Astra接入Valve的3D解谜游戏《传送门》,仅凭一条指令让AI自行通关至片尾字幕,全程约23小时43分钟,消耗约4.35亿token,按API价格折算约571美元。Astra在思考时暂停游戏,观察画面、角色位置和视角后决定下一步操作。途中OpenAI服务出现容量问题,作者手动恢复并切换至Fast模式,但未提供任何游戏提示。该实验并非严格基准测试,因《传送门》发布近20年,相关攻略可能已进入训练数据。
区块律动腾讯微信视觉团队正式开源通用多模态嵌入模型WeMM-Embedding,支持文本、图像等多模态输入,推出2B、4B、9B三个版本,采用统一架构及两阶段训练、知识蒸馏技术。该模型已大规模部署于微信推荐与搜索系统,线上日调用量达十亿量级,将为AI应用开发者提供技术支撑,推动AI在垂直领域创新应用。
Readhub阿里巴巴达摩院研发的肝癌AI模型登上国际顶级期刊,该模型在临床应用中成功发现15例此前被漏诊的肝癌病例。研究显示,AI辅助诊断可显著提升早期肝癌检出率,减少漏诊风险。
网易财经OpenAI首席执行官萨姆·奥特曼透露,GPT-6模型早已完成训练,并预告更强大的模型即将发布。这一表态引发业界对新一代AI能力提升的广泛关注。
凤凰科技微信视觉团队正式开源通用多模态嵌入模型WeMM-Embedding,支持文本、图像等多模态输入,提供2B、4B、9B三个版本。该模型通过统一架构、两阶段训练及知识蒸馏等技术提升能力与部署效率,目前线上日调用量达十亿量级,可为AI应用开发提供技术支撑。
Readhub小米公司发布并开源了结构化数据大模型Xiaomi-TabLDM,该模型号称“一个模型、全任务通用”,旨在处理表格等结构化数据任务。此次发布标志着小米在AI大模型领域进一步拓展,从通用文本模型延伸至结构化数据处理。
新浪科技OpenAI发布的GPT-6模型在孪生素数猜想研究中取得突破,将素数间距最佳上界从246压缩至186,刷新了保持十二年的纪录。该模型通过构建特殊可容许集合、应用三重稠密可除性条件突破GPY筛法瓶颈,并引入动态权重分配机制。其证明经Lean 4验证,自动生成数万行代码及数值证书。思维链文档显示其具备自我修正能力,能动态调整策略。此次突破整合多位数学家成果,展现AI在知识整合与理论创新方面的能力,为解析数论开辟新路径。
Readhub蚂蚁集团正式开源金融模型Ling-3.0-flash-Fin,总参数1240亿,激活参数51亿,支持256K上下文,BF16权重约255GB,采用MIT许可证,可通过vLLM和SGLang部署。同时开源金融搜索基准FinFIRST,由蚂蚁集团开发,中金公司投行团队支持,50多名金融专业人士参与出题,最终保留123道题,其中61.8%需计算,32.5%需多源查询。题目、参考答案及评分标准均公开,采用Apache 2.0许可证。
区块律动OpenAI公布GPT-6 Astra在ChatGPT中的用量限制。Astra在普通聊天中称为GPT-6 Pro,100美元Pro会员每周50条,并与GPT-5.6 Sol Pro共享;200美元Pro会员每周200条Astra,GPT-5.6 Sol Pro另有每天170条,但两个Pro模型合计每天最多200条。Business Standard每月15条,Business Premium每周50条,同样与Sol Pro共享。Plus用户在普通Chat中无GPT-6 Pro,但可在Work和Codex中使用有限额度Astra,超出可购买credits。Chat、Work和Codex额度分别计算。Astra目前分批开放,符合套餐不代表立即可用。
区块律动英伟达发布官方大模型推理指南《用投机解码做 AI 模型协同设计》,核心为一张主流推理加速方案选型表,其中核心方案几乎全由华人团队主导。投机解码通过小模型前置预测、大模型验证实现无损加速,加速比取决于预期接受长度和耗时。指南中技术演进主线的四代方案包括:北大等团队的 EAGLE-3、DeepSeek-V3 完善的 MTP、含英伟达研究院学者的并行架构 DFlash(实现 6 倍无损加速)、DeepSeek 和北大团队的 DSpark。指南还揭示硬件物理常数会反向锁死模型架构,大模型竞赛重心转向对硅片物理极限的挖掘。
Readhub星尘智能(Astribot)基座模型团队近日发布在线强化学习框架SmoothRL,该框架支持异步执行,适配大模型异步推理成为常态后的部署场景。SmoothRL首次将异步在线强化学习应用于真实高动态投掷任务验证,证明在线学习不仅能用于高精度修正,也能适配连续加速、精确释放等动态操作。
新浪财经OpenAI今日正式发布其最新AI模型,号称“地球最强大模型”,并宣称“欢迎来到AGI时代”。该模型在多项基准测试中表现优异,但具体性能参数尚未完全公开。此次发布被视为AI领域的重要里程碑,可能加速AGI相关技术的研发与应用。
凤凰财经OpenAI官方发布视频,预告即将推出Astra模型。视频中展示“ASTRA”与“A6TRA”切换画面,暗示新模型可能命名为GPT-6-Astra。目前官方尚未公布具体发布时间及技术细节。
区块律动实时语音AI公司Inworld正式推出Realtime TTS-2。在Artificial Analysis最新Controlled Voice Arena盲测中,该模型以1123 Elo评分排名第一,较Cartesia Sonic 3.6的1119分高出4分。该评测通过让不同模型克隆同一组8个声音进行盲测,评估发音、停顿、语调和节奏的自然度。 TTS-2可将前几轮真实语音作为上下文,感知用户语气、节奏和情绪以调整回应,并支持自然语言指令如“低声说”或“像刚下班一样疲惫但温暖”,还能模拟笑、叹气、呼吸等声音。模型支持跨语言保持同一声线,并可用短录音克隆声音。Inworld表示,该模型专为实时对话设计,充分利用完整语音交流中的语调、节奏和情绪状态。
区块律动OpenAI官方GitHub仓库出现GPT-6相关痕迹。一名开发者向Computer Use示例项目提交PR,新增gpt6-js-image和gpt6-py-image两套环境,分支名为codex/gpt6-computer-use-images,分别面向JavaScript和Python,配置了Playwright、Chromium及PyAutoGUI等工具,用于Agent操作浏览器和桌面。PR尚未合并,且不含GPT-6的API调用,仅准备运行环境。CEO Sam Altman近期表示,Astra模型在操作电脑方面已达到接近人类水平,他个人已开始让模型跨应用查找消息。
区块律动西班牙AI公司Multiverse Computing宣传的“欧洲最强AI模型”Quasar 438B,被社区发现与智谱GLM-5.2存在关联。Artificial Analysis页面已将其标注为“Quasar 438B (max, based on GLM-5.2)”,Multiverse旧文档也显示其能力与GLM-5.2“完全相同”。Quasar 438B总参数438B,智能指数43分,输出速度约174 Token/s;GLM-5.2总参数约753B,激活40B,智能指数53分,速度约68 Token/s。Multiverse未公布架构及训练方式,其FAQ仍将Quasar列为“Original Models”。
区块律动欧洲研究机构发布其最强AI大模型Quasar,旨在缩小与中美在人工智能领域的差距。该模型被视为欧洲在AI竞赛中的重要一步,但分析指出其尚未具备与中国和美国顶级模型同台竞争的资格。
凤凰科技Tether AI推出高精度AI翻译模型TranslatePsy-AfriSLM,支持18种非洲语言,可完全在智能手机和笔记本电脑上本地运行,无需联网。该模型仅含8亿参数,却在FLORES-200、BOUQuET和SMOL翻译基准测试中超越了Qwen3.5-122B-A10B、TranslateGemma-27B和NLLB-3.3B等更大模型。Tether CEO Paolo Ardoino表示,AI普惠是Tether扩张的下一个前沿,数十亿人不应被排除在科技革命之外。
Coinness沙特AI公司HUMAIN发布HUMAIN M3模型,最初宣称其为“100%沙特模型”,遭质疑后,发布者Sultan Alfaifi澄清该模型基于中国AI公司MiniMax的M3模型开发。HUMAIN M3与MiniMax M3均采用混合专家架构,总参数4280亿,激活参数230亿。HUMAIN称使用超1万亿阿拉伯语Token进行后训练,强化阿拉伯语、当地文化、智能代理、工具调用及电脑操作能力,在7项阿拉伯语基准测试中平均得分89.37%,计划后续开放模型权重并部署于沙特本土服务器。
区块律动Tether AI Research宣布推出开源翻译模型TranslatePsy,该模型可在手机、笔记本等设备本地离线运行,无需联网即可完成翻译。模型支持19种非洲语言、8种非洲语言轻量版本及9种欧洲语言,翻译数据无需上传至云端,保障用户隐私。
Wublock123腾讯AngelSlim团队开发名为Sherry的1.25比特量化方法,将7700亿参数的Hy4模型从1.5TB压缩至214GB,体积缩减86%,在SWE-bench Pro基准上性能损失仅0.7%。压缩后的模型可在单张RTX 4090游戏笔记本上运行,挑战了前沿AI需依赖高端硬件的传统认知。
Startupfortune压缩AI模型公司Multiverse Computing宣布推出其首款大型模型Quasar 438B,专为企业级智能体与编程设计,支持英语和西班牙语。该模型在Artificial Analysis Intelligence Index v4.1.1上得分43,为迄今最高分。
Theaiinsider9月2日,酷哇科技发布并开源世界模型框架RISE(Refining Imagination through SElective Rollout)。该架构采用推演门控机制,摒弃传统固定算力推演模式,可根据场景复杂度动态调节计算资源。测试显示,RISE平均推理延迟压缩至287ms。
新浪财经斯坦福大学教授李飞飞团队发布Atlas世界模型,标志着世界模型进入新阶段。该模型旨在提升AI对物理世界的理解与交互能力,具体技术细节及性能表现尚未完全公开。
网易科技马斯克确认,Grok 4.7 将在 10 天后发布。新模型参数量将从 Grok 4.6 的 1.5T 提升至 2.1T(约 2.1 万亿参数)。初始训练已完成,目前正使用大量 SpaceX 公司数据进行补充训练。
区块律动OpenAI宣布其最强模型Astra首次具备关键网络能力,可自主寻找未知漏洞并开发利用方式。该功能将很快公开发布,但完整版网络能力仅先向审核后的合作伙伴开放。
金十数据Anthropic今日发布新模型,OpenAI同日预告其新品将安全优先。两家AI巨头同日动作引发市场关注。
凤凰科技该模型可通过几张照片生成完整场景,大幅减少拍摄所需机位数量。这一技术突破有望降低影视制作成本,提升内容创作效率。
凤凰科技人工智能公司World Labs宣布推出新一代“世界模型”Atlas,称其为世界上第一个多模态世界模型,能够以像素级精确的相机控制生成图像和视频帧,并在3D中重建场景。联合创始人李飞飞表示,Atlas可从单张输入图像重建大型场景,通过重新构图视频模拟时空,并原生输出3D空间,为视觉特效和机器人学等应用打开大门。World Labs此前已推出3D世界生成产品Marble。
新浪财经OpenAI宣布即将推出新AI模型Astra,但因模型性能过强,将限制其在网络安全方面的能力。此举旨在防止模型被滥用,确保安全可控。具体发布时间和功能细节尚未公布。
凤凰科技Qtum宣布其AI路由器即将集成Fable 5.1模型。该版本在多项基准测试中表现优异,尤其在代理编码和终端任务方面。Terminal Bench 4.0得分从Fable 5的42%提升至52.6%,Terminal-Bench-Science 0.1同样达到52.6%。Fable 5.1在多小时或多天循环任务中表现更佳,减少了对人工干预的需求,被视为构建者最可靠的模型之一。
CoinnessOpenAI即将发布其首款具备“关键”网络能力的AI模型Astra,公司将向部分合作伙伴提供早期访问权限,以便他们有时间加强防御。
WiredAnthropic PBC发布其Fable人工智能模型的新版本,公司称该模型在编程和科学任务上表现更出色,同时更加经济实惠。公司还降低了用户调用AI模型处理先前已处理信息的费用,此类调用在某些任务中可能占token总量的一半以上。此外,Anthropic计划允许企业客户在使用其最强AI模型时,将数据保留在自有云计算基础设施上,而非存储在Anthropic服务器。
华尔街见闻HuggingFace推出Kernels项目,包含200个WebGPU内核,旨在提升浏览器端本地AI推理性能。该项目允许开发者在浏览器中直接运行AI模型,减少对云端依赖,降低延迟并增强数据隐私。
HnrssVisko推出新AI视频模型Orbis,支持实时生成4K视频,并能在视频流持续运行的同时响应提示词修改。该模型主打实时交互式视频生成能力。
TestingcatalogPerplexity发布Hybrid Compute功能,允许用户在云端与本地模型之间分配任务,以兼顾隐私与性能。该功能旨在让敏感任务在本地处理,其余任务交由云端完成。
EngadgetAI公司Runway推出Solaris,这是其称为“界面世界模型”新类别的首个模型。该系统不运行代码,而是在用户交互时逐帧生成用户界面。
The Decoder影眸科技今日发布世界生成模型Hyper3D WorldGen,该模型面向具身智能仿真训练、影视制作、游戏开发与空间计算等真实核心生产场景设计。
新浪财经海信日前正式发布行业首个家庭智能伴侣级AIOS——海信JUOS,原生适配电视、投影、智能家电等多终端,以“超级小聚”为AI载体,实现家庭AI从被动指令响应到主动服务全家的跃迁。JUOS搭载自研星海大模型及四大原生引擎,意图识别及工具执行准确率超95%,获中国信通院大模型4+认证、大屏AI智能化L3最高等级证书。海信视像科技总裁李炜表示,个人AI重在读懂个体需求,而家庭AI需要识别不同家庭成员、理解家庭里的多元场景。
雪球Amazon Bedrock对疑似Anthropic Fable 5.1的模型ID开始返回404“Model not found”,而乱填的模型名仍报400。按AWS错误码定义,这暗示Fable 5.1已进入Bedrock后台,上线准备正在推进。
区块律动耀速科技正式发布DeepInsight™ AI平台。该平台围绕生命科学AI从看见数据走向理解机制、形成预测并获得验证的发展方向,连接人源化实验、生物数据、生命世界模型、AI推理与实验验证,推动AI应用于生命科学研究全过程。
新浪财经Perceptron AI推出Isaac 0.5,这是一个拥有360亿参数的开源具身基础模型,旨在提升机器人在物理世界中的感知与交互能力。该模型面向具身智能领域,支持多种机器人应用场景,其开源特性有望推动行业研究与开发。
HnrssDeepSeek今日宣布开源其最新多模态模型DeepSeek-V4,该模型支持文本、图像等多种模态输入,性能较前代显著提升。开发者现可通过官方渠道获取模型权重及技术文档,用于学术研究和商业应用。此次开源延续了DeepSeek推动AI技术普惠的路线,有望加速多模态AI在各行业的落地。
凤凰科技DeepSeek开放DeepSeek-V4-Flash-Vision-Exp权重,这是基于V4-Flash的实验性视觉模型,新增图片理解能力,可识别截图、读取图表,并结合工具完成Agent任务。在纯文本Agent任务上,其表现与V4-Flash相当。此前该模型仅通过API使用,现开发者可下载权重自行部署。
区块律动StartLux的270亿参数本地模型在CAICT MCP测试中排名第二,超越DeepSeek-V4-Flash,性能达到万亿参数模型水平。
PandailyOpenAI的GPT-6模型灰测demo近日在社交媒体刷屏,引发广泛关注。据知情人士透露,GPT-6将于本周四正式发布。此次灰测展示了模型在复杂推理和多模态任务上的显著提升,但具体参数和功能细节尚未完全公开。
凤凰科技OpenClaw发布2.0版本,为项目迄今最大规模更新。933名开发者参与,合入超过1.6万个PR,约占项目历史全部已合并PR的一半。新版本重点降低使用门槛,安装时自动识别ChatGPT、Claude订阅、API Key和本地模型,减少手动配置。浏览器端重做,支持直接聊天、继续任务、管理会话,并支持多人加入或接手同一任务。更新还涉及消息、记忆、Skills、模型、自动化、插件、安全和原生App。团队承认此前发版过快,底层架构和发布流程已跟不上,未来将降低更新频率。
区块律动Haiku R1/beta6已正式发布。该版本为Haiku R1系列的最新测试版,具体更新内容暂未披露。
Buzzing京东物流正式发布“超脑”大模型3.0,该版本在物流场景中进一步强化AI驱动能力,旨在提升供应链效率与智能化水平。此次升级聚焦于物流全链路优化,包括路径规划、仓储管理和预测调度等环节。
新浪科技Band Protocol宣布推出开源AI模型Band Open Thoughts,该模型专为理解蛋白质生物学而设计,目前正瞄准癌症和免疫系统研究领域。任何人都可以基于该模型进行开发,体现了开源AI在专业科研领域的应用潜力。
CoinnessGLM-5.3模型现已在Qtum AI路由器上可用。该模型此前以0xAlpha代号“免费”发布,已处理数万亿token。多项基准测试显示其性能显著优于GLM-5.2。
CoinnessAgnes AI宣布推出其最新AI模型Agnes 2.5 Pro的测试版本。该版本在性能与功能上进行了升级,旨在为用户提供更强大的AI能力。目前测试版已开放,具体技术细节和正式发布时间尚未公布。
Hnrss腾讯控股发布了一款基础模型,声称在内部测试中性能优于智谱AI和月之暗面AI,并以此宣称跻身中国顶尖人工智能企业之列。
Bloomberg智谱AI宣布其GLM-5.3-Flash模型完全基于国产AI芯片运行,并在基准测试和使用量排名中表现突出,目前位居OpenRouter平台使用量榜首。该模型部署于10万颗国产芯片之上,标志着国产算力在AI推理领域的规模化应用取得进展。
PandailyAnthropic以研究预览形式发布模型硬件标准(MHS),首次公开进军具身智能与物理AI领域。MHS作为统一控制与通信标准,可让AI智能体操控带可编程接口的设备。在生物医药、量子计算等领域测试中,MHS展现出显著提速能力,如基因泰克借助其使全自动剂量反应曲线实验速度缩短至原来的三分之一。
Readhub高德地图发布3D重建模型ABot-Recon,该模型仅需12帧输入即可重建包含万帧的3D场景,显著提升重建效率。
凤凰科技蚂蚁集团旗下百灵大模型推出金融增强模型Ling-3.0-flash-Fin,该模型针对金融领域进行了优化,计划于下周开源。
凤凰科技小鹏汽车发布第二代VLA(视觉语言动作)模型的全新版本,首次将时间维度纳入模型,使其从3D时代跨越到4D时代。新版本具备记忆30秒和预测6秒的能力,提升了模型对动态场景的理解与响应。
LeikejiIntron Voice AI推出其语音人工智能平台新版本Sahara v2.5,旨在更好地支持非洲语言混合语音。该版本新增对63种非洲语言的支持,增强了多语言语音识别与合成能力,有助于提升非洲地区用户的语音交互体验。
Techafricanews该模型具备自主决策与规划能力,可应用于机器人操作任务。此次发布标志着公司在具身智能领域的技术进展。
网易科技8月27日,小鹏宣布第二代VLA首次模型重大升级,其物理世界基座模型首次将“时间”纳入模型,AI理解世界的维度从“3D空间”跃迁至“4D时空”。小鹏X-Foresight预测世界模型首次上车,可预判未来6秒内周边交通参与者的可能行为。
新浪财经群核科技正式发布自主研发的3D生成模型Lux3D,提供标准版与极速版两种模式。用户上传一张图片或输入一段文字,即可快速生成网格、材质与3D高斯等多种形式的3D资产。材质表现是该版本的核心亮点,极速版模式下单个模型最快可在20秒内生成,并支持通过Harness模式集成到AI编码与3D建模工具中,解决3D内容批量生成难题。
新浪财经智谱今日发布轻量级旗舰模型,该模型支持10万张国产芯片训练,性能对标DeepSeek。此次发布标志着国产AI模型在算力适配和性能上取得新进展,进一步推动国产AI生态发展。
凤凰科技英伟达发布文章称,阿里巴巴最新预览模型Qwen3.8-Flash-Next已获得GB300 NVL72平台支持。该模型总参数1760亿,每Token激活约60亿参数,原生支持26.2万Token上下文,可通过YaRN扩展至100万Token,面向智能编程、文档处理及工具调用等长上下文Agent应用。 该模型采用Gated DeltaNet与Qwen Sparse Attention混合架构,降低长上下文场景下的计算和KV缓存开销。测试显示,在GB300 NVL72上单GPU吞吐量超1.6万Token/秒,单用户吞吐超200Token/秒,支持SGLang、vLLM及TensorRT-LLM等推理框架。
区块律动智谱确认,其匿名模型Ox Alpha在OpenRouter上线6个完整自然日处理了23.2万亿Token,是同期DeepSeek-V4-Flash的2倍多,且全部推理算力由中国国产AI芯片提供。智谱称,在相同国产硬件上将端到端推理性能优化至最初的3倍,硬件效率和单Token成本已接近主流英伟达GPU。OpenCode此前称后台有能力提供每天100万亿Token的免费额度。SemiAnalysis特别指出,这一规模此前被认为只有顶级实验室和英伟达GPU才能支撑,而此次全程使用国产芯片。
区块律动由前Meta科学家创立的Perceptron公司发布了一款AI模型,宣称可帮助机器在环境中导航,同时提供深入的视觉智能。该模型旨在将视觉AI引入工厂车间等工业场景,提升机器对周围环境的理解与操作能力。
TechCrunch阿里巴巴推出新一代AI模型Wan 3.0,紧随其完成102亿美元股票出售之后。此次发布标志着阿里在AI领域的持续投入,而大规模股票出售则引发市场关注。分析人士认为,阿里正通过AI创新与资本运作双轮驱动,以应对竞争并推动业务增长。
Yahoo Finance京东正式发布“超脑”大模型3.0,标志着其在人工智能领域的最新进展。该模型预计将提升京东在智能客服、供应链优化等场景的应用能力,进一步推动电商与AI技术的深度融合。
网易科技面壁智能联合创始人李大海、刘知远等发布全员信,宣布端侧智能将成为通用智能时代的主战场,并提出三项重点:以「密度定律」推进端侧智能技术、推动垂直行业标杆规模化、用AI改造公司内部协作流程。信中透露,MiniCPM系列开源模型全球累计下载量超5000万次,端侧模型已进入多场景应用。未来智能将沿感知流式全模态、计算更高密度、行动自主决策演进,公司计划打造端侧具身大脑,以「端侧模型+智能体」推动千行百业万端智能化,并目标成为通用智能时代的定义者和基础设施。
ReadhubModelBest推出Pinea Pi桌面AI边缘节点,售价2999美元,内置MiniCPM模型,可选Intel或Nvidia计算平台,并集成传感器。该公司计划在Kickstarter上发起众筹活动。
Runtimewire据知情人士透露,OpenAI已开始预训练代号为“Bel”的新模型,参数量超过10万亿,旨在推动通用人工智能(AGI)发展。该模型规模远超现有主流大模型,标志着AI竞赛进一步升温。目前OpenAI尚未官方确认此消息。
凤凰科技Megaton公司推出V<Benchmark>,用于衡量视频AI性能。该基准旨在为视频AI领域提供标准化评估工具,帮助开发者比较不同模型的性能表现。
Hnrss阿里在ModelScope上线Qwen3.8-Flash-Next预告页,该模型基于Qwen4架构,为多模态MoE模型,预计8月26日23:00公开发布。官方称提前放出架构是为社区准备后续完整Qwen4家族。此前阿里本月初发布2.4T参数的Qwen3.8-Max,不到一个月即公开下一代架构。
区块律动具身智能公司光象科技今日发布物理原生世界模型,该模型旨在提升机器人在真实物理环境中的感知与交互能力。此次发布标志着公司在具身智能领域的技术进展,具体技术细节和应用场景尚未完全披露。
网易科技由前英伟达科学家Anima Anandkumar和Benedikt Jenik创立的Accelerated Understanding公司,推出了一款旨在预测物理现象而非语言的AI模型。该公司称,该模型在一次提示中处理了5万亿个数据点,远超典型AI上下文规模。该技术采用神经算子而非Transformer架构,目标应用包括芯片设计、机器人、极端天气和能源领域,初期聚焦企业客户。
Coinness该模型支持图像与文本联合处理。据实测反馈,其综合表现一般,未达到预期水平。目前官方尚未公布详细技术参数及性能基准。
虎嗅汤森路透宣布推出其自主研发的“前沿”AI模型,旨在提升法律、金融等专业领域的信息处理能力。该模型将整合公司丰富的行业数据,为用户提供更精准的分析与洞察。此举标志着汤森路透在AI技术领域的进一步布局,有望增强其产品竞争力。
BuzzingTerminal-bench 发布,为终端环境中的 AI 代理提供基准测试。该基准测试旨在评估 AI 代理在终端环境中的性能,为相关研究和开发提供参考。
HnrssOpenAI Codex负责人Tibo Sottiaux提前透露,今年9月29日在旧金山举行的DevDay开发者大会将是公司历史上最好的一届,且“遥遥领先”于往届。开场主题演讲将进行直播。回顾历届,2023年首届DevDay发布了GPT-4 Turbo、GPTs和Assistants API;2024年推出Realtime API、Prompt Caching等工具;2025年则带来ChatGPT Apps、AgentKit、Sora 2 API、GPT-5 Pro API,并全面铺开Codex。Tibo未透露具体内容,但社群猜测届时可能发布下一代模型Astra。
区块律动Qtum AI路由器宣布新增deepseek-v4-flash-vision-exp和glm-5.3-volc模型,并正在开发Wan 3.0视频功能,预计很快推出。
CoinnessGeneralist AI推出机器人基础模型GEN-1.5,该模型能从单次演示中学习新物理任务。用户只需将3至12秒的传感器运动数据输入其30秒上下文窗口,机器人即可执行任务,无需梯度更新、微调或特定任务编程。在10项多样化操作任务中,该一次性上下文提示平均成功率达59%。
Marktechpost一个名为“神秘AI模型”的推理工具于8月20日由匿名第三方发布,专为编程和软件工程设计,提供免费访问。该模型迅速吸引开发者关注,但发布方身份至今未公开。目前尚不清楚其技术细节或背景,引发社区猜测。
Qz小米宣布其开源原生多模态旗舰模型MiMo V2.5现通过官方API完全免费开放。该模型采用310B稀疏MoE架构,支持1M token上下文,可处理文本、图像、视频和音频,适用于多模态智能体、音视频分析及编程等场景。
Coinness8月20日,OpenRouter悄然上线匿名免费模型stealth/ox-alpha,其真实世界编程成绩超越多款闭源前沿模型,引发行业猜测潮,并凸显中国隐身模型策略。
Pandaily8月24日,月之暗面宣布,其第一代万亿参数多模态模型Kimi K2.5将于本月底结束服役。该模型是公司早期旗舰产品,退役后或将由后续版本接替。
华尔街见闻8月24日,阿里巴巴视频生成大模型Wan3.0正式上线。该模型在生成时长、万能创作、全能参考及真实世界还原等维度全面升级,单次可生成30秒视频,并首次支持doc、xls、ppt、pdf、md等文档格式输入,力求准确还原真实世界。Wan3.0在角色、道具、声音、空间关系、风格等细粒度维度均可稳定保持。
华尔街见闻开发者发现Anthropic两款早期访问版本的Claude模型,代号分别为claude-marshmallow-eap(Marshmallow)和claude-melon-eap(Melon)。测试者称,Marshmallow整体表现强于Melon,但两者均未达到Fable 5水平,部分测试者认为Marshmallow对话体验优于Opus 5。此前,Anthropic曾于7月初短暂上线Claude Honeycomb EAP,随后撤下,并于7月24日正式发布Opus 5。
区块律动8月21日,一个名为Ox Alpha的AI模型悄然出现在OpenRouter和OpenCode平台上,免费开放一周。该模型支持1M上下文,可处理文本、图片和视频。其来历不明,引发AI圈热议,有猜测称与Google有关,但未获官方证实。
Cnbeta总部位于旧金山的法律AI初创公司Harvey于当地时间8月20日宣布,已基于中国AI公司月之暗面的Kimi K3模型构建其首个内部模型Harvey Tenet,取代此前使用的Anthropic、OpenAI和谷歌等美国公司的封闭专有模型。Harvey称,新模型在复杂法律工作中达到“最先进”性能。此举凸显西方科技公司在开发成本飙升背景下,日益转向中国开源权重系统。
新浪财经社区开发者Chetaslua通过OpenCode向Ox Alpha发送故意写错的API请求,后端返回的Java堆栈中出现paas/v4/chat路径,与智谱官方API路径一致。对照实验显示,智谱托管的GLM模型均返回1214 Incorrect role information报错,而DeepInfra托管同一权重时报错格式不同。此前指纹测试中,Ox Alpha的Token数与GLM-5.3固定相差75个,视觉Token消耗与GLM-5V-Turbo完全一致。目前高度确信Ox Alpha服务端来自智谱,模型疑似GLM系列,但具体版本尚未确认。
区块律动阿里云MaaS平台扩充模型服务矩阵,智谱GLM-5.3与DeepSeek-V4-Pro正式版已接入千问AI平台并开放API服务。两款模型重点覆盖编程和智能体应用场景,前者强化编程、长程任务处理和网络安全能力,后者增强智能体能力,可用于代码开发、复杂任务处理等。目前千问AI平台已接入多款国内主力模型,部分热门模型加入Token Plan,用户订阅后可在相关AI工具中按需切换模型。
Readhub