Reflection 发布 Beam:501B-A23B 美国开放模型
Reflection 宣布推出 Beam,这是一个面向 coding、agentic 和科学工作的纯文本 MoE,拥有 501B 总参数和 23B 激活参数,模型从零训练。
Reflection 宣布推出 Beam,这是一个面向 coding、agentic 和科学工作的纯文本 MoE,拥有 501B 总参数和 23B 激活参数,模型从零训练。
Cowork 的新版本将模型推理和 VM 都运行在云端,每个会话使用独立沙箱。用户设备仅在需要访问文件等本地资源时,由桌面应用执行对应工具调用,以支持手机使用、持续运行并减少本地磁盘、电池和性能开销。
AWS介绍了如何在 AWS GovCloud (US) 中通过 Amazon Bedrock 配置 Claude Code,为具备监管或合规要求的工作负载提供 AI 辅助开发。
推荐理由:文章给出了在 AWS GovCloud (US) 配置 Claude Code 的具体步骤,并比较两个 Bedrock 端点在审计与 API 能力上的适用场景。
Amazon SageMaker AI 推出 aws-ai-ml 技能,可接入支持 MCP 的编码代理,生成 SageMaker Python SDK v3 代码来压测端点、推荐部署配置并比较基准结果。
推荐理由:文章展示了技能如何把端点压测、实例推荐与多次结果对比串成可执行工作流,并说明基于真实负载的指标如何辅助部署配置选择。
AWS 介绍了基于 Amazon Bedrock AgentCore 的 Amazon Quick Resource Migrator MCP server,可在开发、QA 和生产账户之间自动迁移 agents、action connectors、knowledge bases、flows 和 spaces。
推荐理由:文章给出了跨账户迁移的完整架构与部署路径,涵盖权限复制、幂等更新、备份恢复和预览审批,便于复用到企业治理流程。
AWS 介绍了如何在 LangChain 与 Amazon Bedrock Knowledge Bases 中对比 Retrieve 和 AgenticRetrieveStream 两种检索路径。
推荐理由:文章对比了单次检索与 Agentic retrieval 的覆盖率、成本和延迟,并给出按问题复杂度路由两条路径的工程方法。
AWS 介绍如何使用 Amazon Bedrock AgentCore Evaluations 构建并评估多智能体供应链决策系统,覆盖有用性、任务成功、业务约束和可解释性。
推荐理由:文章给出从内置评估器到业务自定义评估器和可解释性评估器的实施路径,并配套多智能体供应链系统的部署与测试步骤。
PyTorch 加速器集成工作组总结了 2026 年上半年的硬件支持进展,涵盖跨仓库 CI Relay(CRCR)、测试重构、OpenReg 参考后端、性能分析、分布式支持和编译器后端集成。工作组还推进了硬件分类测试机制,并为新后端接入 torch.compile、分布式训练和 profiling 提供参考实现与文档。
推荐理由:文章梳理了测试、CI、中间件和编译器接入的参考实现,呈现 PyTorch 如何为不同硬件后端提供可复用的集成路径。
本地模型 Qwen3.8-27B-Q4_K_M.gguf 在关闭推理时测试正整数相加并仅用英文单词表达结果,5,070 个案例的数字准确率为 23.57%,格式合规率为 96.17%。准确率随操作数位数增加而下降:一至三位数为 97.04%,十至十三位数为 6.44%;开启 medium reasoning 后,169 次对比中答对 167 次。
NVIDIA cuObject 与 NVIDIA SCADA Server SDK 面向 AI 基础设施工程师、存储开发者和云服务提供商,扩展对大容量文件与对象存储的快速、安全访问。AI 工作负载需要高速访问训练、微调、推理上下文、工具调用、搜索和数据库查询所需的数据,这些数据存放在本地及其他环境中的文件与对象中。
NVIDIA NeMo Relay 用于追踪 Agent Harness 的行为,揭示任务虽已完成、执行路径却低效的情况。失败的搜索可能引发重复搜索,文件读取被截断后也可能再次获取相同内容,增加延迟和 token 消耗,并带来更多失败机会。
Apache TVM 发布 v0.27.0.post1,修复 CUDA-host bundles 对低精度、tensor-map 和 cluster kernels 的支持问题。完整变更记录见 https://github.com/apache/tvm/compare/v0.27.0.rc1...v0.27.0.post1。
NVIDIA Metropolis Blueprint for Video Search and Summarization(VSS)3.3 面向视觉 AI agents,旨在降低其构建与运行成本。该 Blueprint 及其 agent skills 支持将视频摄取、流处理、事件检测、检索、摘要和报告整合为可维护的生产级系统。
Apache TVM 发布 v0.23.0,重点改进 Relax、TIR、PyTorch frontend、运行时和编译流程。Relax 新增动态输出裁剪、动态布局规范及多项 PyTorch ExportedProgram frontend 支持,TIR 增加 FuseReductionEpilogue 等调度能力。
推荐理由:Apache TVM v0.23.0 汇总了 Relax、TIR、PyTorch frontend 与运行时等方向的改进,适合用于判断升级对模型导入和编译流程的影响。
Apache TVM 发布 v0.22.0,版本更新涵盖 Relax、FFI、TVMScript 及多个前端和后端的改进。FFI 部分包含独立拆分 tvm-ffi 仓库、接口与 ABI 调整;Relax 增加对 PyTorch ExportedProgram 中 GRU、LSTM 和 MatrixMultiply 算子的支持。
推荐理由:版本记录集中呈现 FFI 重构与 Relax 前端进展,并涵盖 PyTorch 导入支持及多项后端修复,便于了解 TVM 的主要工程变化。