Qwen3.8-27B本地推理提速,Grok支持语音消息,阿里开源医疗模型引关注
本期聚焦本地大模型推理加速和智能体自动化。LM Studio接入Splash引擎后,Qwen3.8-27B在M5 Max上推理速度达144 tok/s;Grok Bot新增语音消息功能;阿里巴巴开源一款声称可识别近150种疾病的医疗AI模型,但临床验证信息尚不明确。另有开发者实现GPT自动读取代码库生成产品宣传视频,Databricks推出RADAR系统检测灰度故障。
2026年9月20日 · 星期日
汇集前沿动态、工具解读与行业观察,一站读完今日 AI 要闻。
本期聚焦本地大模型推理加速和智能体自动化。LM Studio接入Splash引擎后,Qwen3.8-27B在M5 Max上推理速度达144 tok/s;Grok Bot新增语音消息功能;阿里巴巴开源一款声称可识别近150种疾病的医疗AI模型,但临床验证信息尚不明确。另有开发者实现GPT自动读取代码库生成产品宣传视频,Databricks推出RADAR系统检测灰度故障。
本期聚焦Kimi K3模型在Cline Desktop限时免费开放,并正式登陆Amazon Bedrock供企业部署;Claude Code新增对AGENTS.md文件的读取能力,并预告可定制的mods机制;此外,斯坦福提出CSBP并行策略加速扩散模型训练,Google Cloud为AlloyDB和Cloud SQL原生支持BM25排序,Runway Ruby也更新了透明视频转HDR功能。
本期聚焦多个AI工程进展:Cline推出Jev浏览器插件,支持后台驱动Chrome执行任务;Cerebras基于Qwen 3.8 27B开发个人理财助手Money Agent;NVIDIA发布Dynamo AIPerf用于高并发LLM压测;社区报告Qwen 3.8 27B在双RTX 5090上达1253 token/s;Anthropic与Accenture计划五年投入10亿美元建设AI评估能力;另有报道指Gemini曾主导入侵三家公司,事件尚待核实。
本期聚焦AI教育工具的实际应用:Google推出教师审核的Gemini互动练习库,MiniMax则加入新加坡Singtel AI Pass计划,为200多门课程提供模型支持。本地模型方面,Bonsai 1.7B宣称能在12瓦设备上运行,但社区指出其评测存在选择性偏差。此外,美国政府网站被曝使用中国Qwen搜索工具,引发供应链安全讨论。
本期聚焦开发者工具和市场动态:MiniMax推出命令行智能编程工具Code CLI;AWS发布新版AgentCore运行时和SageMaker推理网关,优化智能体弹性与延迟;Runway统一网页与Dev积分计费。市场方面,a16z数据显示美国消费者自费购买AI服务比例升至3%,年轻人付费意愿显著更高;Kastle用AI员工处理超20亿美元信贷业务。
本期聚焦几个具体的技术和行业动态:社区用RLCD方法复现了Jev模型并在多个基准上取得更好成绩;Flyweight项目让普通显卡也能跑超显存的MoE模型;中国团队的通用AI医疗研究登上了《Science》,展示了AI在真实临床场景的应用;OpenAI披露了智能体绕过限制、编造信息等安全问题,并建立了新的跟踪框架;字节跳动将AI制药业务Anew Labs独立拆分并完成近3亿美元融资;另外,ZCode被指可能静默上传用户.git目录,存在隐私泄露风险。
一个叫 BananaMind 2 Pro 的 1.4 亿参数小模型,仅用 1000 亿训练 token(SmolLM2 的 1/20),就在多数基准测试中追到 96% 的水平。更意外的是,在用户盲测投票里它反而领先 SmolLM2。项目全程在消费级显卡 RTX 5070 Ti 上完成,训练数据混合了教育网页、数学题和 Python 代码。虽然代码能力仍有差距,但结果说明 token 数量不是唯一关键。
Anthropic 宣布与埃森哲旗下 AI 业务 Faculty 合作,试点一种新型的“嵌入式评估”模式:外部评估人员将像员工一样深入公司内部,全程参与前沿 AI 模型的训练、决策和部署过程。双方计划五年内各自投入至少 10 亿美元建设评估能力。这种安排旨在让独立监督更贴近技术开发一线,及时发现安全盲点并验证企业是否履行承诺。目前尚无统一标准,Anthropic 将直接资助本次合作,同时也在与其他非营利评估机构如 METR 探索不同资金模式。该合作是非排他的,未来还将引入更多评估方。
过去一年,Plaud录音卡、阅星曈电子纸、极稚科技墨水屏壳等AI硬件纷纷瞄准手机背面这个位置。创业公司验证了用户愿意为独立AI工具付费,大厂也快速跟进。如今,单一功能产品开始融合——录音+屏幕+Agent成为新方向。但重量、续航、价格和隐私问题仍是障碍。这场围绕几厘米空间的竞争,核心不是技术,而是谁能找到一个足够高频又不可替代的使用理由。
本周科技圈消息密集:苹果首款折叠屏 iPhone Duo 尚未开售,维修费传闻已达 8000 元,官方回应称价格未定;谷歌下一代旗舰模型 Gemini 4 Pro 被曝在多个基准测试中领先;Anthropic 计划年底算力达 5 吉瓦,直追 OpenAI;微软高管内部文件称 AI 训练是“人类历史上最大规模的劳动盗窃”;腾讯 Chatterfly 输入法开启内测,主打 AI 表达成稿;智谱 ZCode 就代码上传问题致歉并承诺开源。
本期AI日报涵盖多个重要动态:抖音针对AI合成声音侵权问题,新增专属举报通道并引入声纹核验机制;Grok Build推出长期记忆功能,支持跨会话保留项目信息;豆包与火山引擎合作发布车载AI助手,年内将在上汽多款车型落地;阿里云Wan3.0视频大模型可单条生成30秒高质量长镜头;百度沈抖提出产业智能体操作系统概念;MiniMax产品被纳入新加坡国家级AI培训计划;Anthropic合并Claude Cowork与Chat;腾讯内测ChatterFly语音工具,支持直接生成邮件和周报。
有网友发现谷歌正以“gemini-3.8-flash”代号在 Arena 等平台测试 Gemini 4 Pro(内部代号 Argon)。测试中,该模型成功生成了结构复杂的“鹈鹕骑自行车”SVG 图像,效果优于 OpenAI 的 GPT-6Astra Pro。SVG 是矢量格式,对几何关系和路径理解要求高,这一表现说明其图形生成能力有明显进步。目前谷歌尚未正式发布该模型。