起于小站,终于生活。
现实之外,一个普通人的思考。

博客地址:ygxz.in
讨论组:https://t.me/ygxz_group
一个小站的自留地
MinIO 社区版 11 万行代码被删除,Web 管理功能全面移除 2025 年 5 月 24 日,知名开源对象存储项目 MinIO 发布了一个引发社区强烈争议的版本更新。此次更新以「简化控制台」为名,删除了 114,736 行代码,将原本功能完整的 Web 管理界面大幅精简为仅具备对象浏览功能的基础界面。 被移除的功能包括用户账户管理、访问策略配置、存储桶 (Bucket) 管理工具以及系统配置等核心管理功能。用户现在无法通过 Web 界面执行任何管理员级别的操作,所有管理任务被强制转移到 mc 命令行工具。…
RustFS 发布 1.0 GA

开源对象存储 RustFS 于 9 月 16 日发布 1.0 GA。官方称项目 2024 年 2 月起步,2025 年 7 月开源,历经 Beta、RC 后进入 GA;开源约 14 个月累计逾 6600 次提交、135 个版本、180 多位贡献者,GitHub 星标约 3.2 万,并称全球安装量约 270 万、Docker Hub 拉取逾 1000 万。

RustFS 由中国公司研发,以 Apache 2.0 许可证开源,官方称功能已基本追平 MinIO 开源版,且保持了与 MinIO 良好的兼容性。

RustFS
一个小站的自留地
OpenAI 宣布,由于对 Astra 模型的需求激增,将临时暂停接受新增 ChatGPT Pro 20x 订阅。已付费的订阅用户不受影响。
OpenAI 正灰度 gpt-6-sol 和同代更小模型。

市场认为 OpenAI 将于周内发布这些模型,以缓解 gpt-6-astra 带来的计算压力激增。
Homebrew 发布 7.0.0

Homebrew 于 9 月 13 日发布 7.0.0。新版本提供原生 macOS 图形应用 BrewUI,可通过 brew install homebrew-app 安装,需 macOS Tahoe 26 或更新。

包安全性方面,新版本新增 brew vulns,基于 OSV.dev 检查已安装 formula 的已知漏洞,并维护 Homebrew 自有 advisory 数据库。

(Homebrew)
Cognition 发布 SWE-2

Cognition 于 9 月 10 日发布其迄今最强编码模型 SWE-2。官方称 SWE-2 在 Kimi K3(2.8T 参数)之上做后训练,首次将强化学习扩展到万亿参数量级,并称其 RL 配方在更强基座上仍能继续放大。

FrontierCode 1.1 Main 上 SWE-2 为 50.0%,官方称与 Fable 5.1 相差约 1 个百分点,成本低约 64%;相对 SWE-1.7、Grok 4.6 在分数与成本上均更好,接近 GPT-6 Astra 时成本约为其四分之一。

Cognition
一个小站的自留地
DeepSeek 调整 Flash 系列 API 定价 DeepSeek 宣布,将于北京时间 2026 年 9 月 10 日 12:00 起调整 Flash 系列定价。空闲时段输入缓存命中价为 0.02 元 / 百万 tokens,缓存未命中价为 1 元 / 百万 tokens,输出价为 4 元 / 百万 tokens。 高峰时段价格为上述空闲时段价格的 2 倍。
DeepSeek V4.1 Flash 发布

DeepSeek 正式发布 DeepSeek V4.1 Flash。官方称其为全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解;为 552B 参数 MoE,采用 Causal-Encoder-Decoder 结构,输入激活 8B、输出激活 16B。官方称经更大规模强化学习后训练,基准测试超越包括 DeepSeek V4 Pro 在内的一众旗舰模型。

新架构大幅压缩 KV Cache:相对上一代,HBM 需求降至约 1/4,SSD 需求降至约 1/8;相对初代模型,KV Cache 已缩小约 437 倍。

API 已同步上线,将模型名改为 deepseek-flash 即可调用。官方称 V4.1 Flash 已全面超越 V4 Pro,计划有序下线后者。

DeepSeek
Tailwind Labs 被 Shopify 收购

Tailwind Labs 于 9 月 9 日宣布加入 Shopify。交易金额未披露。

官方称 Tailwind CSS 及其他开源项目保持不变,将继续以 MIT 许可发布,并由原团队在 Shopify 支持下主导维护。

但 Tailwind 商业侧将不再扩展围绕 Tailwind 的业务:Tailwind Plus、ui.sh 等现有客户可继续使用,但已关闭新客户注册,团队将专注于在 Shopify 上的 Tailwind CSS。

Tailwind 框架每周安装量逾 1.1 亿次,已被 ChatGPT、X、Cloudflare、Reddit、Shopify 等产品采用。

(Tailwind CSS)
一个小站的自留地
DeepSeek 开放 V4.1 Flash 中间版本内测 DeepSeek 宣布,DeepSeek V4.1 Flash 中间版本开启内测。官方称该版本采用新模型架构,原生多模态,能力更强、速度更快、成本更低。 接入时保持现有 base_url 不变,模型名设为 deepseek-v4.1-flash-expires-on-0910。计费暂与 deepseek-v4-flash 一致,每账号限流 20 并发。 (DeepSeek)
DeepSeek 调整 Flash 系列 API 定价

DeepSeek 宣布,将于北京时间 2026 年 9 月 10 日 12:00 起调整 Flash 系列定价。空闲时段输入缓存命中价为 0.02 元 / 百万 tokens,缓存未命中价为 1 元 / 百万 tokens,输出价为 4 元 / 百万 tokens。

高峰时段价格为上述空闲时段价格的 2 倍。
一个小站的自留地
LLaDA Image 发布 60 亿参数开源图像生成模型 LLaDA 团队于 9 月 4 日正式开源 LLaDA-Image,推出 60 亿参数(6B) 图像生成模型家族,并同步发布 Base 与 Turbo 两个版本,以及模型权重和推理代码。团队表示,LLaDA-Image 是一个统一的图像生成与编辑模型,无需额外编辑模型即可同时完成文生图和指令式图像编辑任务。 LLaDA-Image 包含两个版本: LLaDA-Image Base 采用 50 步采样,面向高质量图像生成与编辑; LLaDA…
OpenAI 发布 ChatGPT Images 2.5

OpenAI 正式发布新一代图像模型 ChatGPT Images 2.5,官方称相比 Images 2.0 生成延迟最高降低 50%,光影和纹理更自然,对参考照片中人物的还原更好。新模型支持只修改指定部分、保持其余细节不变的多轮编辑。

ChatGPT 同步上线 Sketch 草图、海报等模板和图片评论编辑功能;在对话框输入 @Sketch 即可画草图生成图像,分享图片时还可附上所用提示词。目前面向所有 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端。

API 端推出 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst:前者为多数应用的默认选择,后者面向高端创意场景,精度更高但生成时间更长。Arena.ai Text-to-Image 榜上,Sunburst 与 Flare 分列第 1、第 2,Arena Score 分别为 1421 与 1399。

(OpenAI)
一个小站的自留地
深度求索宣布,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。
DeepSeek 开放 V4.1 Flash 中间版本内测

DeepSeek 宣布,DeepSeek V4.1 Flash 中间版本开启内测。官方称该版本采用新模型架构,原生多模态,能力更强、速度更快、成本更低。

接入时保持现有 base_url 不变,模型名设为 deepseek-v4.1-flash-expires-on-0910。计费暂与 deepseek-v4-flash 一致,每账号限流 20 并发。

(DeepSeek)
LLaDA Image 发布 60 亿参数开源图像生成模型

LLaDA 团队于 9 月 4 日正式开源 LLaDA-Image,推出 60 亿参数(6B) 图像生成模型家族,并同步发布 Base 与 Turbo 两个版本,以及模型权重和推理代码。团队表示,LLaDA-Image 是一个统一的图像生成与编辑模型,无需额外编辑模型即可同时完成文生图和指令式图像编辑任务。

LLaDA-Image 包含两个版本:

LLaDA-Image Base 采用 50 步采样,面向高质量图像生成与编辑;

LLaDA-Image-Turbo 则通过 Twin-DMD 蒸馏 技术,将采样步数压缩至 4 步,实现更快的推理速度。两者均支持文生图、参考图编辑、VQ 条件生成以及中英文文字渲染。

团队提出了一套新的训练流程:先通过纯图像预训练(Image-only Pre-training) 学习视觉先验,再引入图文配对数据进行监督训练,最后联合优化图像生成与编辑任务。官方认为,这种训练方式能够提升模型的视觉理解能力,并增强生成质量。

在评测中,官方表示 LLaDA-Image 在 Qwen-Image-Bench 上取得 英文 53.53、中文 53.38 的综合成绩,达到当前公开模型中的领先水平(SOTA)。
开源计划方面,目前团队已开放 模型权重 和 基于 Diffusers 的推理代码,并表示训练代码将在后续发布,进一步完善完整开源生态。

目前 LLaDA 系列已由蚂蚁集团旗下 Inclusion AI 团队维护。Inclusion AI 是蚂蚁集团面向 AGI 研究设立的开源组织,负责持续推进 LLaDA 系列扩散语言模型及多模态模型的发展。

Github)
OpenAI 发布 GPT-6 Astra

OpenAI 于 9 月 3 日发布 GPT-6 Astra,公司称其为「代际跃升」,并表示未来可能被视为通用人工智能(AGI)到来。

官方称 Astra 基于迄今最大规模训练,在得克萨斯州 Stargate 使用逾 10 万块 GPU,并首次让其他模型在监督其训练中扮演重要角色。

模型将先面向 Daybreak Access 计划内有限机构开放,并称「未来几天」面向 ChatGPT Plus、Pro、Business、Enterprise 与 API(gpt-6-astra),并上线 AWS Bedrock 与 Microsoft Azure。

价格方面,API Standard 输入 10 美元 / 百万 Tokens,输出 50 美元;Fast 模式最高约 2.5 倍速度,价格为 Standard 的 2 倍。

OpenAI 此前已将其定为 Preparedness Framework 下首个达到「Critical」网络安全能力阈值的模型。

即日起至模型广泛可用前,OpenAI 将为所有付费用户每天提供一次重置限额的机会。


(综合媒体报道)
一个小站的自留地
据市场消息,OpenAI 计划提前其 Astra 模型到今日(9 月 3 日)发布。 一天前,OpenAI 宣布 Astra 在网络安全能力上实现了重大飞跃,已经触碰到了「严重」(Critical)风险阈值。
据 DownDetector,目前 OpenAI、Claude、Grok 均出现大规模宕机。

其中Grok和Claude的宕机源于SpaceX的Memphis compute center基础设施故障。

今年五月,Anthropic官宣租用了SpaceX(也就是Grok母公司)位于Memphis的SpaceX's Colossus 1算力中心。
一个小站的自留地
Astra 模型
据市场消息,OpenAI 计划提前其 Astra 模型到今日(9 月 3 日)发布。

一天前,OpenAI 宣布 Astra 在网络安全能力上实现了重大飞跃,已经触碰到了「严重」(Critical)风险阈值。
Meta 发布 Muse Spark 1.3

Meta 发布 Muse Spark 1.3,面向更长程的代理式工作与编码,已上线 Muse Code 与 Meta Model API。官方称 max reasoning 仍在完成额外安全测试后即将上线。相对 Muse Spark 1.2,官方称约减少 20% 的工具调用与 25% 的 token 用量。上下文约 1M token。

官方对比中,Muse Spark 1.3(max)在 DeepSWE v1.1 取得 75.4%,Terminal-Bench 2.1 为 88.8%,与 GPT-5.6 Sol 并列。长上下文 MRCR(256K–512K / 512K–1M)分别为 98.5% 与 98.1%,较 1.2 大幅跃升。知识工作与计算机使用等项(如 GDPVal-AA v2、JobBench、OSWorld 2.0)多贴近但略逊 Claude Opus 5。

API 分为两档价格:Standard(muse-spark-1.3)输入 1.25 美元 / 百万 Tokens,输出 4.25 美元,缓存读取 0.15 美元,数据不用于训练;Contributor(muse-spark-1.3-contributor)输入 0.10 美元,输出 0.20 美元,缓存读取 0.002 美元,允许用请求数据训练后续模型。

Meta
一个小站的自留地
Google 推出 Gemini 3.7 Flash Google 正式发布了 Gemini 3 系列的最新迭代模型 Gemini 3.7 Flash。该模型对其核心推理基础进行了算法改进,并支持自定义思考配置,允许用户灵活控制质量、成本和延迟之间的平衡。 基准测试结果显示,Gemini 3.7 Flash 在代理工具使用、长上下文处理、代码编写和知识工作等方面表现出色。安全方面,该模型接受了最新的前沿安全框架评估,未触及任何受追踪或关键能力阈值。针对化学、生物、放射性与核领域的潜在风险以及网络安全攻…
Google 发布 Gemini 3.8 Flash

Google 发布 Gemini 3.8 Flash。该模型基于 Gemini 3.7 Flash,面向软件工程与代理式知识工作流,并支持可调 effort。支持文本、图像、音频与视频输入,上下文最长 1M token,最大输出 64K token。

官方评测中,相对 3.7 Flash 全面抬升:DeepSWE v1.1 从 65.3% 到 73.7%,Terminal-Bench 2.1 从 85.8% 到 89.4%;Vals Finance Agent v2(61.4%)、Harvey Legal Agent 全通过率(10.0%)与 HLE-Verified(54.9%)均为对比表内最高。相对 Claude Opus 5,金融、法律、长视频与 Terminal-Bench 2.1 等项可压过或持平,但 Terminal-Bench 4.0(19.1% vs 51.8%)、OSWorld-2.0(59.0% vs 75.4%)仍明显落后。

API 输入 0.75 美元 / 百万 Tokens,输出 3.75 美元 / 百万 Tokens,与 3.7 Flash 现行优惠价相同,适用至 2026 年 12 月 31 日;2027 年 1 月 1 日起为 1.5 / 7.5 美元。

Google
一个小站的自留地
据市场消息,Anthropic 计划在本周发布 Claude Fable 5.1。 此前 OpenAI 员工多次预热其由下一代基座模型训练而来的 Astra 模型,市场预计 OpenAI 更倾向于 9 月 29 日在旧金山举行的 OpenAI DevDay 2026 活动上发布其重大进展。
Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1

Anthropic 于 9 月 2 日发布 Claude Fable 5.1 与 Claude Mythos 5.1。二者为同一底层模型、不同安全护栏:Fable 5.1 全面开放;Mythos 5.1 仅通过受信准入计划,面向网络安全与生命科学相关用户。上下文长度 1M token,最大输出 128K token。

API 输入仍为 10 美元 / 百万 Tokens,输出 50 美元 / 百万 Tokens;缓存读取降至 0.25 美元 / 百万 Tokens,较 Fable 5 降 75%。官方称典型工作负载费用约降 25%,高代理类任务最高约降 45%。

(Anthropic

——————

与此同时,市场预计 Google 即将发布 Gemini Flash 3.8,而马斯克也预告 Grok 4.7 将于十天内发布。
腾讯混元发布并开源 Hy4 preview

腾讯混元发布并开源新一代大语言模型 Hy4 preview。总参数量 770B,每 token 激活 49B 参数,上下文长度 1M。官方称其在代码、办公、科学等真实生产力任务上表现突出,进入开源模型第一梯队。

混元
Back to Top