智讯精选

精选

2026年9月14日 · 周一

·DeepSeek今日必读精选
92/100

DeepSeek:V4.1-Flash 上线,V4-Pro 流量今日起切到 Flash

DeepSeek 于 9 月 10 日发布 DeepSeek-V4.1-Flash(552B MoE,原生多模态),API 可用 deepseek-flash。官方称多方测试下其性能、成本、速度已全面超过 V4-Pro,并开始淘汰 Pro。自 2026-09-14 04:00 UTC 起,deepseek-v4-pro 请求将按 Flash 费率路由到 V4.1-Flash,直至 V4.1-Pro 发布。

推荐理由:今天就是路由切换日。不改代码也可能「模型行为 + 账单」同时变;需要确认兼容别名、评测质量回归,并重新核算峰谷调度是否划算。

#DeepSeek#模型#API#成本

2026年9月13日 · 周日

·TechCrunch今日必读精选
88/100

Anthropic 呼吁「给前沿定节奏」,Altman、马斯克表态跟进

Anthropic CEO Dario Amodei 发文呼吁行业主动放缓前沿能力提升速度,提出第三方嵌入式评估、行业协调、全球协调的「三步走」。OpenAI CEO Sam Altman 转发并表示也将引入接近员工权限的独立评估员;马斯克公开称「达里奥说得对」。

推荐理由:头部实验室罕见同频谈「减速」,可能影响新模型发布时间表与对外能力开放边界,也会把「第三方评估、安全检查站」推成行业话术——产品对外沟通要提前准备口径。

#Anthropic#安全#OpenAI#xAI
·光明网 / 科技部转载今日必读精选
85/100

最高法发布首部涉 AI 纠纷裁判意见,点名幻觉、换脸、训练数据

最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》(24 条),覆盖 AI 换脸拟声、AI 幻觉侵权、开源软件责任、模型训练与个人信息、自动驾驶相关责任等,并明确「以人为本、支持创新、筑牢安全」三项原则。

推荐理由:国内尚无专门《人工智能法》时,这是最高审判机关给出的首份系统裁判规则信号。产品设计里的免责声明、内容审核、训练数据来源证明,会更快变成「出事时法院怎么看」的问题。

#合规#司法#幻觉#训练数据
·智讯解读一条拆开讲精选
84/100

一条拆开讲|DeepSeek 用 Flash 换掉 Pro,图的是什么?

过去一年开发者侧最明显的变化不是「又一个榜一模型」,而是单位智能的价格被持续打穿。DeepSeek 官方明确:V4.1-Flash 在性能、成本、速度上全面超过 V4-Pro,并开始淘汰 Pro——这一代里,更小的 Flash 已经足够当默认生产模型。

推荐理由:理解「Flash 反超 Pro」叙事,才能改对路由表与对外卖点:别再把「我们用的是 Pro」当亮点,用户要的是稳定效果与成本。

#DeepSeek#解读#产品策略
·智讯实用能上手精选
90/100

能上手|小团队一周内能落地的多模型路由(成本 × 效果)

你不是在训练模型,你是在用模型做产品。全程用最贵模型账单吓人,全程用最便宜又容易翻车。目标:用一张路由表,让 80% 流量走性价比档,20% 按需升级——七天内可以落地。

推荐理由:月调用已经让你开始看账单、且有两种以上任务类型时,这套「先打标签再定三档」比继续改 .env 换模型更可复盘。

#多模型#成本#工程实践#Agent

2026年9月12日 · 周六

·Reuters本周AI精选
79/100

OpenAI:Altman 同意 pace the frontier,并称 2026 不会 IPO

Altman 表态同意 pace the frontier,认为独立评估员「是个好主意,我们也会这么做」。同期对媒体表示 OpenAI 2026 年不会 IPO,理由是安全。ChatGPT 功能侧本窗口几乎无新增。

推荐理由:安全叙事同时打到「评估机制」和「上市时间表」两头:产品没发新功能,但公司层面信号很强,适合当作本周主叙事。

#OpenAI#IPO#安全

2026年9月11日 · 周五

·智讯实用能上手精选
81/100

能上手|Agent 质量别只靠体感:半天能搭的最小评测集

很多团队上线 Agent 后用「感觉还行」当验收。最小可行做法:固定 20–40 条真实任务、定义成功判据(格式 / 工具调用 / 人工偏好),每次改 prompt 或换模型只看三列数字。

推荐理由:没有评测集,多模型路由和 prompt 迭代都会变成吵架;半天搭起来的最小集,比完美基准更重要。

#Agent#评测#工程实践

7 条 · 智讯 MVP 本地草稿