
今日精选
Needle 2 发布:14MB 开放权重模型面向廉价 IoT 设备
Cactus Compute 推出开放权重模型 Needle 2,参数量 45M,压缩为 14MB 二进制,运行时仅需 28MB 内存。该模型剔除聊天与通用知识,专注工具调用、物理设备控制和结构化数据提取,瞄准单价...

今日精选
Cactus Compute 推出开放权重模型 Needle 2,参数量 45M,压缩为 14MB 二进制,运行时仅需 28MB 内存。该模型剔除聊天与通用知识,专注工具调用、物理设备控制和结构化数据提取,瞄准单价...
Docker 官方宣布在 Docker Desktop v4.86 推出第一方虚拟化层 Docker VMM 公测版,替代第三方虚拟化技术运行 Linux 内核的方案。新引擎宣称提升容器启动和宿主机文件 I/O,并...
智谱8月14日发布GLM-5.3,基座模型未变,主要依靠后训练Scaling提升智能上界。官方称内部编程评测较GLM-5.2提升50%,并在TerminalBench3.0、Agents'LastExam(CLI)...
阿里千问团队于8月14日晚间以 Apache 2.0 协议开源 Qwen3.8-27B。该模型为 270 亿参数的原生多模态稠密模型,支持 262K tokens 上下文,可经 YaRN 外推至 1M,并新增 re...
PromptCache 是 Go 语言编写的开源语义缓存代理,托管于 GitHub。它用 Embedding 识别相似 Prompt,并通过小模型校验确保意图一致,支持主流接口与流式输出。项目方称理想环境可抵消 8...
按时间排序,聚焦近期更新。
Hermes Agent 推出 Bot Mode,作为现有 sessions 之外的新运行方式。每个 agent 档案对应一个独立机器人,可设置任务、描述和头像,机器人之间还能互相通信。该功能通过 GitHub 插...

苹果向法院提交美国 App Store 外部购买抽成方案,标准应用 15%、合作项目与订阅续费 10%、小型企业计划 5%。最高法院此前拒绝暂停审理,Epic 将回应,苹果预计 9 月 14 日前提交书面意见,该方...
X 宣布将“为你推荐”时间线与核心排名引擎发布到 GitHub,采用 Apache 2 许可证,代码规模约为此前 10 至 15 倍。同时在设置中推出透明度工具,近一个月发帖 10 次以上用户可下载 JSON 查看...

OpenAI 首次展示 Ultrafast 模式,GPT-5.6 Sol 在 Cerebras 驱动下最高比标准处理快 14 倍,每秒输出 750 个 token,率先通过 OpenAI API 向少数客户限量预览...
Google 发布 Gemini 3.7 Flash 模型,年底前限时优惠,输入价格 $0.75/1M tokens,输出价格 $3.75/1M tokens。输出单价约为输入的 5 倍,可能显著影响生成式应用的...
通过标签快速进入细分技术话题。