大家已经给DeepSeek装上了啥
DeepSeek
共 137 条相关资讯 · 来自历史归档
DeepSeek Harness (dsh) Windows / Linux desktop client - bundled Node.js + dsh CLI, one-click launch, 10 built-in UI skins. EAC: Embracing All Creation 揽尽万象
Near-native image understanding for DeepSeek Harness
阿里千问开放平台上线菜鸟智能体,Brave 和 Firefox 浏览器宣布将继续支持 uBlock Origin 扩展程序等。 查看全文
Eyes for text-only DeepSeek Harness agents: built-in free vision chain (no key) + pixel-level vision tools (Q&A, grounding, crop, pixel diff, colors, OCR, SVG t…

Deepseek has moved its flagship V4-Pro out of the testing phase and released its agent software, Harness v0.1, under the MIT license. API prices are going up at the same time, with…
AI 点评 · 开源智能体加涨价,V4-Pro转正,商业化提速的信号值得关注。
欢迎,为后人种点树
AI 点评 · 深度体验揭示真实价值,涨价合理性获实证,值得开发者关注。
https://github.com/deepseek-ai/deepseek-harness https://deepseek-harness.github.io/deepseek-harness/en/guide...
https://twitter.com/deepseek_ai/status/2087864589895798968 , https://xcancel.com/deepseek_ai/status/2087864589895798968
DeepSeek V4 Pro 0813 (on OpenRouter) The latest DeepSeek Pro model is now available, via API only. I had to link to OpenRouter because DeepSeek don't have any obvious announcement…
AI 点评 · 开源大模型竞争白热化,后发者能否撼动头部格局值得紧盯。

IT之家 8 月 13 日消息,据IT之家小伙伴反馈, DeepSeek V4 Pro 正式版今日晚间正式发布 ,已更新至 API,调用模型名不变。 新版本增强了 Agent 能力,支持 Responses API 和 Codex 接入。 从官方群放出的评测对比表可以看到,DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813)在多…
AI 点评 · 深夜升级API,Agent能力强化,或搅动大模型竞争格局。
https://api-docs.deepseek.com/ https://artificialanalysis.ai/models/deepseek-v4-pro https://twitter.com/ChrisGPT/status/2087572834650407024 , https://xcancel.com/ChrisGPT/status/20…
AI 点评 · 模型迭代速度惊人,性能或再破纪录,值得开发者紧盯。

IT之家 8 月 12 日消息,今天(12 日)晚间,DeepSeek 官网“API 文档”上的“模型 & 价格”页面中,模型版本新增了 DeepSeek-V4-Pro-0813 ,其支持非思考与思考模式。 不过截至IT之家发稿,官方尚未发布 DeepSeek-V4-Pro-0813 的更新日志。 值得一提的是,就在不久前的 7 月 31 日,DeepSee…

Microsoft has released MAI Code 1.1 Flash, a code model for GitHub Copilot that's said to be 25 percent more token-efficient at a quarter of the cost of its predecessor. In benchma…
AI 点评 · 推理速度与成本再突破,模型迭代加速,AI应用门槛持续降低。

IT之家 8 月 7 日消息,宇树科技 8 月 6 日晚发布公告称, 公司首次公开发行股票并在科创板上市 ,发行价格为 150.80 元 / 股。本次发行数量为 4044.6434 万股,占发行后总股本 10%。 根据发行公告中给出的最终战略配售数量结果, DeepSeek 开发商杭州深度求索人工智能基础技术研究有限公司出现在战略配售名单中 ,获配股数为 9…
AI 点评 · AI巨头跨界入股机器人独角兽,产业协同信号强烈。
此后模型、算力、数据中心都在合作范围内
AI 点评 · 杭州双子星联手,AI与机器人产业协同将重塑生态,战略意义远超投资本身。

Composio tested Deepseek V4 Flash across four agent frameworks on 30 real-world tasks. Success rates were mostly similar, but costs varied by nearly 3x: OpenCode came in cheapest a…
那还说啥了梁圣,我订阅费全给你就是了呗
文 | 李炤锋 编辑 | 张雨忻 “长链任务如果只通过代��层面的反馈,误差可能会不断累积,最终效果会非常差。”谈及原生多模态的意义,一位多模态研究员表示,“视觉是一种更准确的反馈,也更贴近用户意图。” 过去一年,Coding与Agent能力不断改写大模型的排名,也成为AI最快兑现商业价值的场景之一。与此同时,随着Agent开始接管更多长链任务,越来越多的通…
今日热点导览 OpenAI下一代模型Astra曝光,以2000美元算力成本破解十项数学难题 江小白起诉东方甄选结果公布:东方甄选构成商业诋毁判赔30万 iPhone被曝最高或涨价超千元,折叠屏iPhone至少2000美元起售 多平台牛蛙抽检抗生素超标,有样本检测出禁用兽药 王思聪卸任万达产业投资公司董事 TOP3大新闻 宗馥莉同父异母兄弟出任新公司董事长,实…
AI 点评 · 命令行与AI结合,开启高效编程新体验。
Codex Skill:让纯文本模型(DeepSeek)借助 StepFun step-3.7-flash 获得看图能力 | Give text-only Codex models (DeepSeek) image understanding via StepFun step-3.7-flash
今日热点导览 马斯克关注了DeepSeek的X账号 祥鹏航空回应航班误发过期方便面 OpenAI或将IPO推迟到明年 SpaceX首份财报即将发布 小米多款手机正式涨价 每月10万美元,特朗普“真实社交”售卖“优先访问权” TOP3大新闻 蔡崇信宣布离婚,不涉及出售阿里股份 8月1日,阿里巴巴集团董事会主席、美国职业篮球队布鲁克林篮网主要所有者蔡崇信与妻子吴…
DeepSeek V4 Flash 正式版发布 特朗普向科技公司频繁索要捐款 马斯克称从未讨论过出售特斯拉中国业务 国补调整后终端销售承压 风投机构重新涌入中国科技领域 统计显示实体光盘并不能保证游戏长期可玩 看看就行的简讯 少数派的近期动态 你可能错过的好文章 查看全文

IT之家 8 月 1 日消息,关注科技公司 CEO 和高管动态的账号 Big Tech Alert 今早发布提醒消息, 埃隆 · 马斯克刚刚关注了 DeepSeek 的 X 账号 。 DeepSeek 昨日(7 月 31 日)通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测, 凭借超高性价比再次引爆 AI 圈 。…
AI 点评 · 马斯克关注DeepSeek,或预示AI竞争格局生变。
让纯文本模型在 Codex 中无障碍看图(view_image)的更优方案,附为纯文本 LLM 设计的视觉工具包&skill | A superior approach for enabling text-only models to seamlessly use Codex’s built-in view_imag…
AI 点评 · 突破纯文本模型视觉瓶颈,让Codex看图能力平民化,开发效率倍增。
A low-token visual evidence compiler for text-only coding agents. Convert images into compact Visual Evidence Packets (VEP) for DeepSeek, Codex, Claude Code, an…
从AlphaGo称霸围棋界到ChatGPT面世,美国在算法大模型领域积累了显著的先发优势。但近年中国大模型的崛起对AI格局有所冲击。美国《华尔街日报》等多家媒体提到,中国大模型独角兽月之暗面新一代开源大模型Kimi K3撼动资本市场,并称其与DeepSeek在2025年发布时引发的市场恐慌如出一辙,连马斯克都赞其“令人印象深刻”。一些大型美国公司也开始转向中…

apart from DeepSeek V4-Flash 0731, a quiet day.
deepseek-ai/DeepSeek-V4-Flash-0731 The latest release in DeepSeek's V4 family, "with substantially enhanced agentic capabilities". It's 304 billion parameters - 167GB on Hugging Fa…

Deepseek's budget model V4 Flash gets a major boost with the "0731" update, jumping ten points to 50 on the Artificial Analysis Intelligence Index. That puts it just one point behi…
AI 点评 · 性价比冲击高端,平价模型逼近顶级性能,行业格局或将重塑。
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
**DeepSeek** launched the public-beta of **DeepSeek-V4-Flash API**, boasting a significant post-training performance leap without architecture or size changes, achieving a **Termin…

IT之家 7 月 31 日消息,在 GPT-5.6 系列发布(7 月 9 日发布)约 3 周后, OpenAI 公司今天(7 月 31 日)宣布下调 GPT-5.6 Terra 和 GPT-5.6 Luna 两款模型的调用费用 ,本次调整暂不影响 GPT-5.6 Sol 模型。 IT之家援引博文介绍,附上 GPT-5.6 Terra 调整费用如下: GPT-…
AI 点评 · OpenAI大幅降价,性价比反超强劲对手,AI模型价格战白热化。
We recently used DeepSeek V4 Flash as a teacher for finance tasks with GPT-OSS-120B. Distillation works well on this problem. At a constrained 8k token budget, our self-distilled 1…
AI 点评 · 将顶尖模型知识蒸馏到开源模型,突破审查限制,为金融领域提供低成本高效方案。
AI 点评 · AI行业高管动态频繁,融资与离职背后揭示竞争白热化,日本拆机认输更显中国AI硬件实力。
这轮融资计划至少募资100亿元
AI 点评 · 泄露的会议记录显示DeepSeek暂缓融资,揭示中美算力差距的真实影响。
DeepSeek的答案,不是只仰望星空,也不是只脚踏实地,而是用现实问题去支撑一个足够远的目标。 撰文 | 李嘉星 刘辰艺 编辑 | 张薇 头图来源 | DeepSeek 封面来源 | DeepSeek DeepSeek又一次被推到聚光灯下。 这家公司一度几乎是AI圈最神秘的存在:工程师文化、低调,创始人很少公开露面,团队也不像典型互联网公司那样频繁讲故事、…
AI 点评 · 揭示AI公司如何平衡理想与现实,为行业提供务实创新的新思路。
大公司: DeepSeek今年已增资65% 36氪获悉,据媒体报道,近日,DeepSeek创始人梁文锋一场4小时的投资人闭门会议实录在科技与创投圈刷屏,他明确表示“DeepSeek只有一条主线,即通往通用人工智能(AGI)”,相关话题引发关注。天眼查App显示,DeepSeek关联公司杭州深度求索成立于2023年7月,法定代表人为裴湉,经营范围含工程和技术研…
AI 点评 · DeepSeek增资与马斯克押注FSD,揭示AI大模型与自动驾驶两大赛道资本与战略双重加码。
a quiet day lets us highlight a new neolab win.
Full-parameter post-training of trillion-parameter-scale MoE models introduces substantial system-level challenges for large-scale distributed training, including severe memory pressure, non-overlappe…
AI 点评 · 国产算力集群完成万亿参数模型全参微调,突破分布式训练瓶颈,验证自主生态链成熟度。
3500亿估值曝光
今日热点导览 澳洲将设AI办公室,限制数据中心能源消耗 巴菲特宣布8年内清仓伯克希尔股票 前高通自动驾驶工程副总裁将加入英伟达自动驾驶团队 长鑫科技:上市后仍将保持无实际控制人的控制权架构 谷歌参与建设美国最大太阳能项目,总规模达2.5GW TOP 3大新闻 阿里、百度分别为苹果智能提供AI相关能力支撑 36氪获悉,网信办公布7款端侧生成式AI服务备案,苹果…
距首轮估值上涨37%

IT之家 7 月 15 日消息,@PrismML 官方账号今天(7 月 15 日)发布博文,宣布推出 Bonsai 27B 模型,基于 Qwen 3.6 27B 模型微调, 在保留 90% 智能水平的情况下,可以在 12GB 内存的 iPhone 上原生运行。 Qwen 3.6 27B 模型进一步提升本地 AI 的能力,重点涵盖多步推理、结构化工具使用、长上…
AI 点评 · 端侧大模型突破内存瓶颈,iPhone变身AI终端,本地智能体验迎来质变。

IT之家 7 月 15 日消息,据彭博社昨日援引知情人士消息,中国人工智能公司 DeepSeek(深度求索)已开始筹备 IPO(首次公开募股),最快可能在今年内提交上市申请。 据知情人士透露,DeepSeek 正在规划中国内地上市,以便最早于 2027 年完成上市。 公司目前正在与会计师事务所 、 投行顾问展开合作 , 计划在今年 12 月底前完成财务报告…
AI 点评 · 看点:CEO让利激励团队,机器人上Nature,AI人才争议,多维度折射行业活力与乱象。
崔添翼:这个方向很容易出成果
已与芯片设计公司、晶圆代工厂和存储器供应商展开接洽
今日热点导览 网传“7月1日新规:新车智驾芯片自主化率不低于70%”系谣言 商业银行不良处置仍在加速,上半年全行业转让核销合计至少5000亿 国家外汇管理局:截至2026年6月末,中国外汇储备规模为34163亿美元 汇丰暂停向风险较高的私募信贷客户提供贷款 SpaceX公布AI数据中心计划,同步推进星链卫星脱轨 TOP3大新闻 前华为天才少年吐槽DeepSe…

It's early, but the plan is to reduce dependency on Nvidia and Huawei.

IT之家 7 月 7 日消息,据路透社今日援引三位知情人士消息,中国人工智能初创公司 DeepSeek(深度求索)正在研发自有 AI 芯片。如果消息属实,此举有望降低其对英伟达、华为的依赖。 知情人士透露, DeepSeek 自研的 AI 芯片主要面向 AI 推理场景 。此处的“推理”指的是大模型训练完成后,应用学到的知识分析新数据、生成内容。 如果该项目成…
难怪DeepSeek要着重强调招HR(doge)
好消息是V4正式版能力有升级
少数派的近期动态少数派×AKKO联合共创带屏键盘计划于7月9日开启。预约直播WWDC26专题页已全部更新完成。点击回顾尝鲜27系列新系统的朋友,你的满意度如何?来一派投票你可能错过的文章让音乐「更好听 ... 查看全文
DeepSeek不储备弹药根本没法打下去了
今日热点导览 OpenAI官宣推出GPT-5.6 亚洲“果链”股价几乎全线大幅下跌 SpaceX计划为美国消费者推出新的星链移动服务 美团股价低迷,王兴回应 小鹏机器人调整:新设九部门,何小鹏兼任产品部负责人 微信回应朋友圈互动规则:单删原封不动,互删清空对方全部痕迹 TOP3大新闻 苹果涨价引山姆代购潮,部分门店已卖断货 近日,社交媒体上多名网友反馈,多地…
AI 点评 · 苹果涨价催生代购商机,彰显消费心理博弈与市场连锁反应。
大公司: 五粮液:曾从钦无法正常履职离任,选举邓敏为公司董事长 36氪获悉,五粮液公告,因曾从钦无法正常履职,公司于2026年6月26日召开2025年度股东会,审议通过《关于免去董事及补选第七届董事会非独立董事的议案》,自本次股东会审议通过之日起,曾从钦不再担任公司董事职务,其担任的董事长、董事会专门委员会主任委员及委员职务一并自动解除(原定任期至公司第七届…
文|王毓婵 编辑|张雨忻 微信AI助手“小微”正在灰度内测,36氪智能涌现拿到了首批测试资格。 先说结论:一些简单操作,小微做得没那么好;一些复杂操作,小微反而做得比较好。 小微入口 小微的服务主要基于微信自研模型WeLM,部分回答可能会调用DeepSeek来处理。主入口在微信首页左上角,默认交互方式是语音转文字,亦可直接手动打字输入。 小微会默认开启记忆能…
DeepSeek正在全力押注
36氪获悉,中信建投研报称,国内模型持续迭代,GLM-5.2、Kimi K2.7 Code强化1M上下文、长程Agent、Agentic Coding和真实工程交付能力,推动国产模型从通用问答转向开发者工具和企业级工作流。Kimi补强国际化运营能力,DeepSeek融资强化头部模型产业化预期,微信AI灰度测试则显示AI入口正从独立App走向超级应用生态,有望…
AI 点评 · 国产模型转向企业级应用,算力需求确定性增强,产业链景气度有望持续。
Recently, end-to-end OCR models, exemplified by DeepSeek OCR, have once again thrust OCR into the spotlight. A widely held view is that employing a large language model (LLM) as the decoder allows the…
一个月只要340块
AI 点评 · 用极低成本搭建千级AI团队,颠覆了游戏运维的人力与算力门槛。
Local coding-agent orchestrator — DAG of auto-approved, git-worktree-isolated sub-sessions across LLM providers (Claude/Kimi/Grok/DeepSeek/local). AGPL-3.0.

“IT早报”时间,大家好,现在是 2026 年 6 月 18 日星期四,今天的重要科技资讯有: 1、DeepSeek 以 4000 亿元估值完成首轮外部融资:510 亿元到账,投资方含梁文锋、腾讯、宁德时代、京东、网易等 企查查数据显示,杭州深度求索人工智能基础技术研究有限公司已于 6 月 16 日完成首轮外部融资,整体融资规模约 510 亿元,企业估值近…
AI 点评 · DeepSeek高估值融资与SK海力士取消学历门槛,折射AI行业资本与人才竞争新趋势。
https://archive.ph/MlU1U

“IT早报”时间,大家好,现在是 2026 年 6 月 17 日星期三,今天的重要科技资讯有: 1、中国 AI 行业最大单轮融资:消息称 DeepSeek 完成超 70 亿美元融资,腾讯、宁德时代、京东、网易入局但没有投票权 此轮融资采用了一种不寻常的结构,赋予投资者经济权益,但没有投票权,使得 DeepSeek 创始人梁文峰能够通过与国家人工智能产业投资基…
AI 点评 · 70亿美元无投票权融资,揭示中国AI资本博弈新玩法。
AI 点评 · 腾讯、宁德时代等巨头投资却放弃投票权,梁文锋实现绝对控制,这种罕见股权结构揭示AI公司治理新思路。

英伟达昨日(6 月 16 日)发布博文,宣布在 MLPerf Training 6.0 全部 7 项基准测试中, 其 Blackwell 平台拿下最快训练成绩,并成为唯一覆盖全部测试项目的平台。 IT之家注:MLPerf Training 是业界常用的 AI 训练基准测试体系,用来比较不同硬件与系统在模型训练任务中的速度和效率。 而昨日(6 月 16 日)最…

IT之家 6 月 11 日消息,小米 MiMo 官方今日凌晨正式发布并开源 MiMo Code V0.1.0 —— 一款运行在终端里的探索性 AI 编程助手。 据介绍, MiMo Code 基于开源项目 OpenCode 二次开发,发布并开源,采用 MIT 协议 。它还内置限时免费多模态模型 MiMo-V2.5,同时支持接入 DeepSeek、Kimi 和…
AI 点评 · 小米开源AI编程助手,降低开发者门槛,推动生态共建,MIT协议利于广泛商用。
追赶老马与微软
AI 点评 · AI巨头亲自下场搞基建,自建数据中心规模对标国际,行业竞争从算力扩展到基础设施。
Open-source TypeScript terminal coding agent for DeepSeek-V4 — builds on DeepSeek's strong price-performance and ultra-cheap cache pricing, engineering byte-sta…
AI 点评 · 精准度超越GPT-5.5 Pro,国产模型技术突破,或重塑行业格局。
Conventional LLMs keep the full KV cache loaded during decoding, causing a severe GPU memory bottleneck for ultra-long context serving. In this report, we propose Lookahead Sparse Attention (LSA), a n…

IT之家 6 月 7 日消息,华为云现已针对 Agentic AI 时代发布全新云入口“智果园”,新产品支持云码道 CodeArts 代码智能体、华为云 OfficeAce 办公智能体和 WorkAgent 文档智能体。 据介绍,智果园拥有开发、办公等多种关键行业的智能体,可通过智果 AgentArts 平台打造更加实用的智能体,并通过 Skills、AI…
AI 点评 · 华为云整合多模型,降低企业AI应用门槛,凸显生态开放与行业落地潜力。
AI 点评 · AI降低编程门槛,让普通人也能用技术改变命运。
让每个模型都成为 Codex 引擎。 OpenAI 兼容的 Responses API 网关,让 Codex、CLI 工具和开发者 Agent 接入任意模型。 English Documentation · 中文文档 GodeX 让使用 OpenAI Responses API 的客户端,可以通过一个本地网关调用 DeepSeek、Xiaomi、MiniMa…
成立三年、一直靠自有资金运转的 DeepSeek,终于在 2026 年打开了融资大门。媒体日前披露,国家集成电路产业投资基金(大基金)将领投 DeepSeek 首轮对外融资,投前估值达到 450 亿美元,本轮融资规模约 700 亿元人民币。 这个数字放在当前的中国 AI 行业里,称得上是一个分水岭事件。DeepSeek 自 2023 年成立以来,以极...
Turn a production incident into a structured 9-section LLM response (severity, root cause, mitigation, postmortem). Ships with a 5-scenario regression suite + L…
Related ongoing thread: DeepSeek makes the V4 Pro price discount permanent - https://news.ycombinator.com/item?id=48237663 - May 2026 (384 comments)
Related ongoing thread: DeepSeek makes the V4 Pro price discount permanent - https://news.ycombinator.com/item?id=48237663 - May 2026 (384 comments)
> (3) The deepseek-v4-pro model API pricing will be officially adjusted to 1/4 of the original price after the 75% discount promotion ends on 2026/05/31 15:59 UTC. https://x.com/de…
> (3) The deepseek-v4-pro model API pricing will be officially adjusted to 1/4 of the original price after the 75% discount promotion ends on 2026/05/31 15:59 UTC. https://x.com/de…

An eventful month with one flagship release after another

From Gemma 4 to DeepSeek V4, How New Open-Weight LLMs Are Reducing Long-Context Costs
AI 点评 · 开源模型通过键值共享与压缩注意力等创新,大幅降低长文本推理成本,推动大模型实用化。
AI 点评 · 开源模型挑战行业巨头,揭示前沿实验室的竞争焦虑。
TokenSpeed is a speed-of-light LLM inference engine.
AI 点评 · 光速级推理引擎,大幅降低延迟,将推动实时AI应用突破。

A 2025 review of large language models, from DeepSeek R1 and RLVR to inference-time scaling, benchmarks, architectures, and predictions for 2026.
AI 点评 · 2025年LLM全景透视:从技术突破到行业瓶颈,为2026年发展指明方向。

Understanding How DeepSeek's Flagship Open-Weight Models Evolved
AI 点评 · 揭示DeepSeek开源模型从V3到V3.2的架构演进,稀疏注意力与强化学习更新是关键技术看点。

From DeepSeek-V3 to Kimi K2: A Look At Modern LLM Architecture Design
AI 点评 · 对比DeepSeek与Kimi架构差异,揭示大模型设计路线竞争焦点。