技术前沿
聚焦人工智能、大模型、开源框架、DevOps 与企业软件工程创新,跟踪技术演进与工程实践,服务研发团队技术选型与架构升级参考。
最新动态
Rio 3.5 技术规格解读:SwiReasoning MoE 与 101 万 Token 上下文
即便权重来源存争议,Rio 3.5 Open 397B 在模型卡上公布的 SwiReasoning、MoE 17B 激活、多模态与多语言配置仍代表 2026 年超大规模开源模型的一种工程范式,值得技术团队拆解评估。
Nex-AGI 指控 Rio 3.5 权重为 0.6/0.4 融合:开源模型「血缘审计」成刚需
Nex-AGI 称里约市政 Rio 3.5 Open 397B 权重实为 Nex-N2-Pro 与 Qwen 3.5 的元素级合并,非独立训练;提供张量级统计与身份测试证据。事件推动社区讨论开源模型 provenance 与许可证合规。
中关村具身智能产业园:45 家企业构建「上下楼即上下游」闭环
6月13–15日媒体调研显示,全国首家具身智能主题产业园已集聚 45 家科创企业,覆盖算法、零部件、整机与场景应用,形成「上下楼就是上下游」产业生态,2026 年被业界视为工业人形机器人量产元年。
深度解读 MiniMax MSA:稀疏注意力如何支撑 428B 多模态长上下文
MiniMax M3 采用自研 MSA(MiniMax Sparse Attention)架构,在 428B 参数、100 万 Token 上下文下保持可Serving 性能;M3 为首个 Step 0 多模态混合训练的开源旗舰,TPS 已从 30 提升至 80。
GLM-5.2 开源引发 Hacker News 热议:626 分背后的「开放路线战」
智谱 GLM-5.2 在 Hacker News 获 626 分、353 条评论,支持 100 万 Token 与 MIT 开源。社区讨论焦点从性能转向:当闭源模型可被政策随时收回时,开源是否成为 AI 供应链保险。
LongCat「重思考」架构:8 路并行推理单元如何提升工具调用可靠性
美团 LongCat-Flash-Thinking-2601 采用重思考模式,可并行启动 8 个推理单元,在 τ²-Bench 88.2 分、VitaBench 29.3 分;本文解析其工具泛化与在线免费体验机制。
Perplexity 发布 Computer:19 个大模型协同的通用 Agent 平台
Perplexity 推出 Perplexity Computer,由 Claude Opus 编排将子任务分配给最多 19 个模型(推理用 Claude、研究用 Gemini、速度用 Grok 等),可在后台自主运行数小时乃至数天,一键构建媲美 Bloomberg 的金融终端 Demo。
腾讯开源混元 3D 2.1:首个全链路工业级 3D 生成大模型
6月14日 CVPR 2025 上,腾讯宣布混元 3D 2.1 大模型对外开源,Hugging Face 下载量已超 180 万,覆盖游戏、影视、工业设计、数字孪生等场景,为首个全链路开源的工业级 3D 生成模型。
Google DeepMind 发布 Gemini Robotics 1.5:机器人「会思考」且跨形态迁移
Google DeepMind 发布 Gemini Robotics 1.5 系列,包含视觉-语言-行动模型与 Gemini Robotics-ER 1.5 推理模型,支持任务前思考、自然语言解释决策过程,并展现跨不同机器人形态的 skill 迁移能力。
百度启动 2026 届 AIDU 计划:顶尖 AI 人才招聘扩增超 60%
6月14日百度宣布 2026 届 AIDU 计划正式启动,岗位招聘扩增超 60%,覆盖 23 个核心业务与 11 类研究方向,含大模型算法、基础架构、智能体等,为百度史上最大规模顶尖 AI 人才招聘。
智谱宣布 GLM-5.2 下周开源:MIT 协议、100 万 Token 上下文
6月13日智谱宣布 GLM-5.2 将于下周正式开源,采用 MIT 协议、支持 100 万 Token 上下文,在美国限制 Anthropic 最新模型外国人访问后,国产开源模型成为可替代选项之一。
智源大会发布「悟界·Physis」:全球首个通用世界基座模型
6月12日北京智源大会上,智源研究院发布全球首个通用世界基座模型悟界·Physis-v0.1,AI 范式从「预测下一个词」转向「预测下一个物理状态」,同步发布具身大脑 RoboBrainOrca 与 FlagOS 2.1 智算软件栈。