模型发布 08/14 11:39 · Hacker News
Qwen 在 Hugging Face 发布了 Qwen3.8-27B 的模型权重与配置文件,定位为继 Qwen3.5/3.6 之后的更强一代。模型为 27B 参数的因果语言模型,带视觉编码器,原生支持图像与视频理解,默认启用“思考模式”,原生上下文长度 262,144,最高可扩展到 1,000,000。对开发者来说,Qwen3.8-27B 可在多种推理框架中部署,并提供官方云端托管与 API 支持,适合需要长上下文与多模态理解的场景。
对需要长上下文、多模态理解或代理执行的开发者来说,Qwen3.8-27B 值得关注:它提供原生图像/视频能力与超长上下文,但应按推荐推理框架和服务部署以获得最佳效率。
模型发布 08/14 17:21 · The Verge AI
路透报道,Apple 与阿里巴巴合作,为中国市场训练了一款定制大型语言模型。该模型在阿里巴巴支持下训练,旨在配合 Apple 在华推出的本地化 on-device 生成式 AI 服务 Apple Intelligence。对中国用户而言,这意味着 Apple 将使用自有定制模型替代此前依赖的国内模型,从而在监管和产品控制上获得更多主动权。
对中国开发者和用户来说,Apple 使用自家定制模型并与阿里合作推进本地化部署,值得关注;如果你依赖 Apple 生态的生成式 AI,可以开始关注 Apple Intelligence 在华上线情况。
模型发布 08/14 05:13 · TechCrunch AI
Writer 发布了新旗舰模型 Palmyra X6,这是在 Z.ai 开源模型 GLM-5.2 基础上进行的后训练变体。公司同时对其 agentic harness 进行了重要升级,称结合两项改动可将客户基础任务成本最多降低 50%。这意味着 Writer 客户可在同一平台上选择 Palmyra X6 或通过 Azure、Amazon Bedrock 导入外部模型,并有望在多步复杂任务上减少 token 使用和执行时间。
如果你是依赖多步 agent 工作流的开发者或使用者,Writer 的 Palmyra X6 与 harness 优化值得关注——它承诺在同一平台上降低运行成本并减少 token 使用,可考虑评估是否迁移或并行试用。
#Writer #开源 #GLM-5.2 #成本优化 原文 ↗ 模型发布 08/14 03:22 · TechCrunch AI
OpenAI 推出名为 Ultrafast 的新模式,预览版已上线。公司称该模式可让最新模型 GPT-5.6 Sol 达到标准处理速度的 14 倍,最多每秒输出 750 个 token。OpenAI 表示此模式可用于事故响应、客服、金融市场分析和电商等企业工作流,当前与芯片商 Cerebras 合作,并仅向少数客户开放预览。
对需要极低延迟和高吞吐量的企业应用值得关注,但当前仅为少数客户的预览,是否可广泛使用还取决于后续扩展情况。
模型发布 08/14 01:23 · Hacker News
Google 推出 Gemini 3.7 Flash,这是针对编码和代理工作流的新版 Flash 系列模型。官方称其在代码调试、生产就绪代码、网页开发和知识密集领域上比 3.6 Flash 有显著提升,并给出多个基准对比数据。3.7 Flash 在 Gemini Spark(Google AI Pro/Ultra 订阅)中现已启用,并以介绍价对开发者和企业开放。
如果你是构建编码代理或复杂知识工作流的开发者,3.7 Flash 提供了更高准确率和更低成本的选项,值得尽快在测试环境评估是否能减少监控与重试。
模型发布 08/13 00:37 · Hacker News
DeepSeek 在其 API 文档中宣布对 OpenAI Responses API 格式的兼容,基础地址为 https://api.deepseek.com,可通过简单配置在 Codex 中调用 DeepSeek 模型。文档列出示例代码、流式 SSE 事件类型列表,以及与 Responses API 的兼容性表(支持的模型包含 deepseek-v4-flash 和 deepseek-v4-pro)。这意味着开发者可以用 OpenAI 风格的 Responses 接口调用 DeepSeek 模型并接收增量事件流。
如果你用 OpenAI Responses API 或在 Codex 中集成模型,值得尝试将请求指向 DeepSeek 的 base_url 来调用 deepseek-v4-flash / deepseek-v4-pro 并测试流式事件处理。
#DeepSeek #V4 Pro #产品发布 原文 ↗ 模型发布 08/12 23:01 · Hacker News
Hacker News 上有人分享了 Hugging Face 上的模型页面 Qwen/Qwen3.8-2.4T-A95B。页面内容为模型模板或推理相关的 Jinja 模板和指令片段,包含工具调用格式、消息渲染逻辑和特殊标记(如 <tool_call>、<|im_start|> 等)。这对开发者意味着该页面主要提供模型集成与调用的格式规范,可用于构建或适配对话式推理流程。
该页面主要是 Qwen 模型的调用与消息渲染模板,值得关注如果你要按该格式集成对话式工具调用;不包含性能或部署细节。
模型发布 08/12 22:00 · Hugging Face Blog
LiquidAI 发布了 LFM2.5-VL-3B,一款可在用户自有硬件上运行的视觉-语言模型。它在屏幕/UI 理解、对象定位(grounding)、多图输入和函数调用四方面有明显改进,训练使用了约34T Token 和更多视觉数据,并扩展了词表以支持非拉丁文字。对开发者和产品方而言,该模型在CPU/GPU及移动端均有日常可用的推理速度,适合需要本地、实时视觉理解与工具调用的场景。
如果你需要在本地或移动设备上实现实时视觉理解与工具调用,LFM2.5-VL-3B 值得优先试用;对于高并发输出场景也具备性能优势。
模型发布 08/12 22:01 · Google DeepMind
DeepMind 发布了大规模多语手语到文字模型 SL2T,并将其用于 Gboard 和 Pixel 11 的 Live Transcribe,首批支持从美式手语(ASL)到英语的手语到文字输入。SL2T 在超过50种手语、约10万小时数据上训练,约四分之一为 ASL,模型以人体关键点(pose landmarks)作为输入并直接翻译为文本以保护隐私。对开发者和使用者而言,这意味着可在手机上用手语完成搜索、起草文本或与 Gemini 交互,更多设备和语言将陆续跟进。
对开发者和手机用户来说,这项工作值得关注:SL2T 已在手机端实现手语到文本的实时输入,适合想用手语替代打字的场景,可以考虑尽早体验和集成。
模型发布 08/11 07:56 · TechCrunch AI
OpenAI 宣布扩展其网络防护服务 Daybreak,并在其中推出专为防御任务训练的新模型 GPT‑5.6 Cyber。Daybreak 现在分为 Blue 与 Red 两个层级,Blue 提供事件响应、恶意软件分析和补丁验证等服务,Red 则提供用于安全测试和漏洞研究的“purpose‑trained cybersecurity models”,并独占 GPT‑5.6 Cyber。该模型暂时仅向“受信任客户合作伙伴”开放。
如果你是企业安全团队或专业安全厂商,值得关注 Daybreak 的 Red 层和 GPT‑5.6 Cyber,但该模型当前只对受信任合作伙伴开放,短期内无法直接试用。
#OpenAI #Daybreak #网络安全 原文 ↗ 模型发布 08/11 07:56 · Simon Willison
Meta 推出 Muse Glimmer,一款 30B 参数的开源模型,采用 Apache 2.0 许可证。开发者称模型在端到端任务完成、工具调用和多步推理等基准上表现良好,并支持视觉输入。对本地运行者意味着可在有充足内存的机器上尝试这款模型并进行代码与工具交互。
对想在本地做端到端代理任务和代码探索的开发者来说,Muse Glimmer 是一个值得试用的 Apache 2.0 开源 30B 模型,适合内存充足的机器上运行。
#Meta #开源模型 #Muse Glimmer 原文 ↗