通义千问开源 Qwen3.8 系列:27B 原生多模态模型超越 3.7 Plus
AI HOT/X:通义千问 / Qwen (@Alibaba_Qwen) · 昨天 23:02
27B 参数即超越前代 Plus,MoE 路线把成本压到极低。与 DeepSeek V4 Pro、GLM-5.3 同期发布,中国开源模型进入'周更'节奏,性能对齐前沿。
每日摘要 · Daily Brief · No.041
今日 AI 圈由中国开源模型主导:Qwen3.8、GLM-5.3、DeepSeek V4 Pro 相继发布,性能对齐 OpenAI/Anthropic,且成本极低,迫使后者开启价格战。OpenAI 的 Ultrafast 模式与 IBM 合作标志巨头以速度和渠道应对。多智能体协调与安全仍是痛点,社区热议揭示智能体实用化瓶颈。今日主线:中国开源模型的规模化崛起正在重塑竞争格局,推理成本与性能的平衡成为新焦点。
AI HOT/X:通义千问 / Qwen (@Alibaba_Qwen) · 昨天 23:02
27B 参数即超越前代 Plus,MoE 路线把成本压到极低。与 DeepSeek V4 Pro、GLM-5.3 同期发布,中国开源模型进入'周更'节奏,性能对齐前沿。
AI HOT/公众号:智谱(GLM) · 昨天 13:31
后训练 Scaling 提升智能上界,Terminal Bench 开源第一,并意外涌现网络安全能力。对标 Claude Fable 5,中国模型在 Agent 场景加速追平。
AI HOT/X:Gemini (@GeminiApp) · 今天 02:06
Google 用性价比换份额,Flash 定位推理与多步任务。与 Qwen/DeepSeek 价格战形成'中美双线',推理成本持续下探。
TechCrunch AI · 昨天 03:22
14 倍速度若保持质量,等于把推理成本打下一个量级。Cerebras 硬件合作是关键,与 IBM 渠道合作呼应,巨头用速度和生态防守。
AI HOT/公众号:小红书技术(dots.llm) · 昨天 19:25
280B 总参/16B 激活,512K 上下文,直接对标轻量级智能体场景。中国创业公司差异化策略:不做通用,做垂直 Agent 优化。
AI HOT/Ars Technica:AI(RSS) · 昨天 22:27
中国开源模型以低价高性能挤压利润空间,迫使美国巨头降价。这是'模型即服务'的价格战,生态卡位比技术代差更关键。
AI HOT/Cursor Blog · 昨天 20:00
SpaceX 收购 Cursor,Grok 4.6 是合作产物。编程工具绑定算力与模型,AI 编程竞争升级为基础设施战。
TechCrunch AI · 昨天 04:14
Databricks 融资规模缩水,但 190B 估值仍为 AI 基础设施定调。数据+AI 平台是确定性赛道,资本持续涌入。
TechCrunch AI · 昨天 03:19
IBM 将 GPT-5.6 嵌入咨询平台,是'模型即服务'的渠道战。巨头靠渠道,创企靠模型,企业市场格局生变。
TechCrunch AI · 昨天 05:13
Writer 用 Harness 管理 token 成本,与企业写作场景绑定。成本控制成为企业采用 AI 的生死线,Harness 模式或成标配。
AI HOT/公众号:数字生命卡兹克 · 昨天 07:58
DeepSeek Harness 教程补全了本地跑的路径,与 V4 Pro 上线形成配套。社区对'如何自己跑'的热情高于'跑多快'。
Hacker News · 今天 00:15
HN 热帖,讨论配置分层与上下文管理。与你的 Claude Code 方法论文档呼应:会话价值源于结构化配置而非模型本身。
Reddit r/LocalLLaMA · 昨天 13:23
社区实测确认编程能力与安全能力,但质疑'涌现'真实性。热度证明中国模型已进入主流讨论。
Reddit r/LocalLLaMA · 昨天 21:10
量化技术让 280B 模型在单块 DGX Spark 上跑,本地部署可行性大增。与 Qwen3.8 的 0.8 tok/s 对照,硬件优化是落地关键。
Reddit r/LocalLLaMA · 昨天 23:51
社区用 Qwen3.8 等 30B 级模型的性能验证了预测:开源小模型正逼近闭源旗舰。这是开源生态的里程碑信号。
Interconnects · 今天 05:23
Interconnects 长文解析 GLM-5.3 的后训练策略。中国实验室用极致的后训练 Scaling 换取智能上界,是成本效益最优路径。
The Decoder · 今天 00:06
实证研究戳破'AI 做研究'的激进预测,与代码 Agent 的高效形成对照。虚火 vs 实绩,任务级突破更值得跟踪。
TechCrunch AI · 昨天 02:28
多智能体协调成本实证:任务竞争而非协作。Zawinski 定律再验证,多 Agent 系统仍缺协调机制。
Reddit r/LocalLLaMA · 昨天 08:13
水印是欧盟 AI 法案的合规要求,SynthID-Text 是 DeepMind 的技术路线。可检测性是监管落地的第一步,第三方 API 随之而来。