跳到正文
世傲命的技术观测站 PERSONAL TECHNOLOGY OBSERVATORY
科技信号记录

科技日报 — 2026-07-20

阿里巴巴发布 Qwen 3.8,2.4T 海量参数,声称仅次于 Fable 5,预览版已上线 Token Plan / Qoder,即将开源权重。

发布时间
分类
科技日报
来源状态
15 条原始来源
导入记录
wiki/tech-daily/2026-07-20.md

自动汇总,数据来源:AIHOT / HN / GH Trending / 少数派 等 采集时间:2026-07-20 凌晨

🔥 今日头条(5 个最重磅)

1. Qwen 3.8 开源发布:2.4T 参数模型上线,仅次于 Claude Fable 5

  • 一句话:阿里巴巴发布 Qwen 3.8,2.4T 海量参数,声称仅次于 Fable 5,预览版已上线 Token Plan / Qoder,即将开源权重。
  • 为什么重要:3T 级开源模型竞赛白热化——Kimi K3(2.8T)刚发布,Qwen 3.8(2.4T)紧随其后,开源大模型能力正在逼近闭源前沿。
  • 来源:X:通义千问 / Hacker News(778 points,当天 HN 最高)

2. Kimi K3 发布:2.8T 参数开源模型,Moonshot AI 因需求过大暂停新订阅

  • 一句话:月之暗面发布 Kimi K3,2.8T 参数、原生视觉、百万 token 上下文,发布后因需求激增暂停新订阅。
  • 为什么重要:首个开源 3T 级模型,架构创新(KDA + AttnRes),超长程编码和知识工作比肩闭源,权重两周后放出。
  • 来源:AIHOT(18 家信源报道)/ Hacker News(217 points)

3. Anthropic 用 Claude Code 将 Bun 百万行 Zig 迁移至 Rust,两周完成

  • 一句话:Anthropic 工程师用 Claude Code 在两周内将 Bun 的百万行 Zig 代码迁移至 Rust,测试全部通过,编译时间从八分钟降至两秒,API 成本约 $165K。
  • 为什么重要:展示了 AI 驱动的代码库重构可行性,为被遗留代码困扰的团队提供了实操范本。
  • 来源:Hacker News(382 points)/ Simon Willison / Anthropic Blog

4. 欧盟裁定 Google 必须向竞争对手开放 Android 和 Search,影响 Gemini 等 AI 服务

  • 一句话:欧盟依据 DMA 裁定 Google 开放 Android 和 Search 关键部分,允许第三方 AI 助手获得更大访问权限。
  • 为什么重要:直接撬开谷歌两大核心平台围墙,对 Gemini 等 AI 助手及搜索创业公司是结构性利好。
  • 来源:The Verge / AIHOT / Ars Technica / IT之家

5. ChatGPT 内置文档/表格/幻灯片,原生工作区上线

  • 一句话:ChatGPT 工作区原生支持创建和编辑文档、电子表格和幻灯片,不再是插件而是内置功能。
  • 为什么重要:对轻办公用户而言,可能直接替代 Google Docs 打开习惯,AI 原生办公体验更进一步。
  • 来源:X:ChatGPT / AIHOT

🤖 AI 进展(5 个)

1. 面壁智能开源 MiniCPM-Robot 具身智能模型 + MiniCPM5-2B 端侧模型

  • 一句话:面壁智能开源首个具身 AI 模型系列 MiniCPM-Robot(VLA 模型 + 目标跟踪),同时发布 MiniCPM5-2B,4B 以下全球性能第一,适配 9 款芯片。
  • 为什么重要:端侧+具身双线出击,2B 参数超越 Qwen3.5-2B 等竞品,国内端侧 AI 格局在加速。

2. 昆仑万维宣布 2026 为”世界模型元年”,发布 Matrix-Game 3.5 等模型

  • 一句话:昆仑万维发布 Matrix-Game 3.5 世界模型(5B 参数单卡 20FPS 实时生成)、Mureka v9.5 与 O3 音乐模型,核心架构已开源。
  • 为什么重要:世界模型赛道中国玩家快速跟进,5B 参数实现 720p 实时生成值得关注。

3. Moonshot AI 发布 PerceptionBench:多模态视觉感知诊断基准

  • 一句话:从 40+ 现有基准中归纳出 10 项原子感知能力和 3000 道验证题,所有测试模型准确率均未超过 60%。
  • 为什么重要:发现模型”猜测而非真正感知”的问题,为多模态 AI 视觉理解提供了精准诊断工具。

4. 54% 企业已遭遇 AI 智能体安全事件,多数仍共享凭证

  • 一句话:VentureBeat 调查 107 家企业发现半数已出事,仅 32% 为每个智能体分配独立身份凭证,专用安全产品渗透率极低。
  • 为什么重要:AI agent 安全从「未来风险」变成「当下事故」,缺口巨大。

5. 企业 AI 智能体评估存在”现实对齐”缺口:半数组织曾部署通过内部测试但导致客户故障的智能体

  • 一句话:157 家企业调查显示 50% 曾部署通过内部评估但导致客户故障的 AI 智能体,仅 5% 完全信任自动化评估。
  • 为什么重要:暴露了 AI agent 评估与生产环境之间的巨大鸿沟,66% 企业仍计划推进全自动部署。

💻 开发者/工具(5 个)

1. transcribe.cpp 发布:基于 ggml 的跨平台语音转录库

  • 支持 16 个 ASR 模型族(60+ 模型),通过 Vulkan/Metal/CUDA/TinyBLAS 实现硬件加速。

2. Decoy 字体:用空间频率混淆让 AI 看不清你输入的文字

  • TTF 字体,利用视错觉让人眼和 AI 识别不同的文字,装字体即用,对抗 AI 文本抓取的新思路。

3. OpenAI 将 Codex 的模型上下文大小从 372K 降至 272K

  • Hacker News 307 points,社区热议上下文压缩对实际编码的影响。
  • GitHub Copilot SDK 和 MoonshotAI/kimi-cli 均进入 GitHub 每日 Trending,开发者工具生态活跃。

5. HYPIC:小红书联合北大、上交提出混合注意力大模型缓存系统

  • 实现位置无关缓存,首 token 延迟降低 3.25 倍,同 SLO 下 QPS 提升 1.66 倍,对长上下文推理服务的加速意义重大。

💬 社区热议

HN 热门讨论

  • “I replaced a $120k bowling center system with $1,600 in ESP32s” (1451 points) — 典型 hacker spirit 项目,用 ESP32 替代 12 万美元保龄球馆计分系统。
  • “Claude Code uses Bun written in Rust now” (382 points) — 紧随 Anthropic 大迁移话题,535 条评论讨论 AI 辅助代码迁移的未来。
  • “AI advice made people less accurate but more confident” (269 points) — 研究显示 AI 建议让人更不准确但更自信,149 条评论讨论 AI 依赖症。
  • “Qwen 3.8” (778 points) — 545 条评论,开源 vs 闭源大模型竞赛热议。
  • “Ask HN: What are your favorite blogs not about AI?” (36 points) — 社区对 AI 疲劳的有趣反应。

📊 一句话快讯

  1. 🟢 Blender 5.2 LTS 发布 — 361 points on HN,开源 3D 创作工具重要更新。
  2. 🟢 Google Vids 上线 Gemini Omni 与个人数字分身 — 面向 AI Pro/Ultra 订阅者开放。
  3. 🟢 世界人工智能合作组织在上海签署协定 — 29 国创始成员国,总部设在上海。
  4. 🟢 百度秒哒 3.5 发布 iOS App 打包能力 — 无代码开发可一键上架 App Store。
  5. 🟢 面壁智能开源企业 AI 数字员工平台 StaffDeck — SOP+决策规则驱动的数字员工。
  6. 🟢 Minecraft Java Edition 迁移至 SDL3 — 267 points on HN,技术架构升级。
  7. 🟢 最后一项 MPEG-4 Visual 专利已过期 — 168 points on HN,多媒体编解码进入新阶段。
  8. 🟢 黄仁勋访日:联手日本打造物理 AI,建设 Vera Rubin AI 工厂 — 配备 13,750 颗 Vera CPU 和 27,500 颗 Rubin GPU。

COMMUNITY DISCUSSION

评论

使用 GitHub 账号登录后参与讨论,评论会同步到 GitHub Discussions。