
DeepSeek V4.1 Flash 发布:552B MoE,输入激活 8B
DeepSeek V4.1 Flash 正式发布!这是 DeepSeek 全新模型结构系列中尺寸最小的一个,原生支持多模态视觉理解。这套结构的设计出发点是:能力上限更高、推理更快、吞吐更大,也能扩展到参数量更大的模型。 DeepSeek V...

DeepSeek V4.1 Flash 正式发布!这是 DeepSeek 全新模型结构系列中尺寸最小的一个,原生支持多模态视觉理解。这套结构的设计出发点是:能力上限更高、推理更快、吞吐更大,也能扩展到参数量更大的模型。 DeepSeek V...

ChatGPT Images 2.5 新一代旗舰图像模型正式发布,为创意工作流带来了更清晰的细节还原、更精准的定向编辑能力,以及更快的生成速度。 相比 Images 2.0,Images 2.5 生成的光影更加自然,材质纹理质感也更强,不仅...

Gemini 3.8 Flash 和 3.8 Flash Cyber 正式发布,推理和代码能力都进行了升级,同时保留了 3.7 Flash 系列的低延迟和低成本优势。 两个版本面向不同的场景,但共用了同一套底层权重,都靠长时间运行的 Age...

Anthropic 正式发布了 Claude Fable 5.1 和 Claude Mythos 5.1,主打代码、知识工作与科研计算。两款模型基于同一个底层基础模型,区别主要在于安全防护策略的分级。Fable 5.1 现已全面开放商用;M...

腾讯混元新一代旗舰模型 Hy4 preview 开源并上线,总参数 770B,激活参数 49B,上下文长度 1M,重点优化了在代码、办公和科研等真实生产力场景中的表现。 新一代旗舰模型 Hy4 preview 扩大了模型尺寸、上下文长度和训...

智谱正式发布了 GLM-5 系列的首款原生多模态模型——GLM-5.3-Flash,模型总参数量 320B,激活参数 18B。推理成本只有 GLM-5.2 的十分之一,各项基准测试和实际工作负载表现都超过后者,代码和 AI Agent 相关...

阿里千问开源了多模态 MoE 模型 Qwen3.8-Flash-Next 的权重,它同时也是 Qwen4 架构的先导预览。定位和当年 Qwen3-Next 之于 Qwen3.5 一样:那一次引入的 Gated DeltaNet + Gate...

DeepSeek API 平台上线了全新多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp。这是一个实验性版本,设置model='deepseek-v4-flash-vision-exp'就能调用。 除了文本,模型...

GLM-5.3 的所有提升都来自后训练扩展。GLM-5.2 版本已经搭好整套工程栈:面向长上下文处理的 IndexShare、服务长程任务强化学习的 SAO、支撑大规模异步训练的 slime,底层跑在持续积累的长程任务环境上。过去一个月,智...

Gemini 3.7 Flash 正式发布!它在软件工程、知识类工作、Web 开发流程上的表现都有明显提升,首发价格仅为 3.6 Flash 单价的一半,是 Google 目前在代码编写和 Agent 场景中最强的主力模型。 更强的复杂工作...

DeepSeek Harness 开发者预览版发布,这是一套 Agent 运行底座,官方口号是「一切皆插件」。模型、工具、技能、会话、沙箱、文件系统、循环、编排和 UI,都可以当成插件来装、换、扩。 DeepSeek Harness(DSH...

Claude Opus 5 正式发布!新模型推理能力扎实,主动性很强,能力表现很接近 Claude Fable 5,但价格只有它的一半。 在代码编写、知识工作等领域的评估基准上(比如 Frontier-Bench 和 GDPval-AA),...
最新评论
提供snap包没意见,但是移除deb,还把deb改成虚包指向snap,实在是让人作呕
为什么关机关电源后,开机时打开电源就开机了。对电脑有损伤吗?
有多亮,是blingbling的吗🤣
这个网站眼前一亮