云霞资讯网

蚁工厂的文章

谷歌正式发布Gemini3.8北美大豆包这次发的3.8flash, 跑分看着还行

谷歌正式发布Gemini3.8北美大豆包这次发的3.8flash, 跑分看着还行

谷歌正式发布Gemini3.8北美大豆包这次发的3.8flash, 跑分看着还行

Awesome-ML-SYS-Tutorial地址:github.com/zha

Awesome-ML-SYS-Tutorial地址:github.com/zha
电子书 :强化学习导论 地址:walkinglabs.github.io/han

电子书 :强化学习导论 地址:walkinglabs.github.io/han

电子书 :强化学习导论 地址:walkinglabs.github.io/han

手机涨价是因为AI吗 不然呢。。只要是用到GPU和存储芯片的东西都在涨啊去年Ma

手机涨价是因为AI吗 不然呢。。只要是用到GPU和存储芯片的东西都在涨啊去年Ma
#转发抽奖# 转发抽3本 的新书《记忆工程 智能体记忆系统构建与实践》。9月9日从转发里抽3人各得一本。
本书以“记忆工程”为主线,旨在将记忆从抽象的概念讨论转化为可设计、可验收、可治理的系统能力。本书详细探讨记忆的表征与写入、组织调度、融合更新策略、版本 ​

#转发抽奖# 转发抽3本 的新书《记忆工程 智能体记忆系统构建与实践》。9月9日从转发里抽3人各得一本。 本书以“记忆工程”为主线,旨在将记忆从抽象的概念讨论转化为可设计、可验收、可治理的系统能力。本书详细探讨记忆的表征与写入、组织调度、融合更新策略、版本 ​

#转发抽奖# 转发抽3本 的新书《记忆工程 智能体记忆系统构建与实践》。9月9日从转发里抽3人各得一本。 本书以“记忆工程”为主线,旨在将记忆从抽象的概念讨论转化为可设计、可验收、可治理的系统能力。本书详细探讨记忆的表征与写入、组织调度、融合更新策略、版本 ​
Robonomics做的一个国内AI公司的ARR估算
图上的字节跳动、腾讯、阿里巴巴都包含自己云平台上对外提供大模型API服务收的费用。
作者也说了因为信息缺失,只是粗略估计,仅供参考。
其他信息:
🌟总 ARR(年化经常性收入)约为 100–150 亿美元,其中核心大语言模型(LLM)收入约为 60–80 亿美元,这 ​

Robonomics做的一个国内AI公司的ARR估算 图上的字节跳动、腾讯、阿里巴巴都包含自己云平台上对外提供大模型API服务收的费用。 作者也说了因为信息缺失,只是粗略估计,仅供参考。 其他信息: 🌟总 ARR(年化经常性收入)约为 100–150 亿美元,其中核心大语言模型(LLM)收入约为 60–80 亿美元,这 ​

Robonomics做的一个国内AI公司的ARR估算 图上的字节跳动、腾讯、阿里巴巴都包含自己云平台上对外提供大模型API服务收的费用。 作者也说了因为信息缺失,只是粗略估计,仅供参考。 其他信息: 🌟总 ARR(年化经常性收入)约为 100–150 亿美元,其中核心大语言模型(LLM)收入约为 60–80 亿美元,这 ​
系列技术博文:DeepSeek-V3:从理论极限到现实实践 -- DeepSeek-V3系列性能分析实战
地址:deepseek-v3.ezyang.com/
(该系列作者是Edward Z. Yang,在 Meta 公司从事 PyTorch 相关工作。这个系列目前刚更新了一篇,DeepSeek-V3架构的基础设施导向图)

如果你想学习如何在多GPU上高效训练大语言模型, ​

系列技术博文:DeepSeek-V3:从理论极限到现实实践 -- DeepSeek-V3系列性能分析实战 地址:deepseek-v3.ezyang.com/ (该系列作者是Edward Z. Yang,在 Meta 公司从事 PyTorch 相关工作。这个系列目前刚更新了一篇,DeepSeek-V3架构的基础设施导向图) 如果你想学习如何在多GPU上高效训练大语言模型, ​

系列技术博文:DeepSeek-V3:从理论极限到现实实践 -- DeepSeek-V3系列性能分析实战 地址:deepseek-v3.ezyang.com/ (该系列作者是Edward Z. Yang,在 Meta 公司从事 PyTorch 相关工作。这个系列目前刚更新了一篇,DeepSeek-V3架构的基础设施导向图) 如果你想学习如何在多GPU上高效训练大语言模型, ​
豆包手机二代要来了呀 ​​​

豆包手机二代要来了呀 ​​​

豆包手机二代要来了呀 ​​​

系列博文:vLLM 源代码详解地址:github.com/halfrost/Ha

系列博文:vLLM 源代码详解地址:github.com/halfrost/Ha
350 种排版 · 分类图鉴地址:github.com/nevertoday/3

350 种排版 · 分类图鉴地址:github.com/nevertoday/3

350 种排版 · 分类图鉴地址:github.com/nevertoday/3
350 种排版 · 分类图鉴
地址:github.com/nevertoday/350-layout-compositions

从经典构图、视觉原则,到出版广告、字体网格、网页 UI、影视、中国传统构图和演示文稿:350 种排版,按 8 个一级分类与 33 个二级主题组织成可浏览、可检索、可下载的知识图鉴。

作者陈小东,之前看过他的一些排版prompt非常惊艳

350 种排版 · 分类图鉴 地址:github.com/nevertoday/350-layout-compositions 从经典构图、视觉原则,到出版广告、字体网格、网页 UI、影视、中国传统构图和演示文稿:350 种排版,按 8 个一级分类与 33 个二级主题组织成可浏览、可检索、可下载的知识图鉴。 作者陈小东,之前看过他的一些排版prompt非常惊艳

350 种排版 · 分类图鉴 地址:github.com/nevertoday/350-layout-compositions 从经典构图、视觉原则,到出版广告、字体网格、网页 UI、影视、中国传统构图和演示文稿:350 种排版,按 8 个一级分类与 33 个二级主题组织成可浏览、可检索、可下载的知识图鉴。 作者陈小东,之前看过他的一些排版prompt非常惊艳
Understanding ChatGPT Work  Simon Willis

Understanding ChatGPT Work Simon Willis

Understanding ChatGPT Work Simon Willis
Understanding ChatGPT Work  
Simon Willison写了篇介绍ChatGPT Work的文章。
如果简单的说Chat 用来回答问题,Work 用来完成任务没什么意义,因为普通 ChatGPT 过去其实也能写报告、做分析。Simon Willison更关心的是 Work 到底多了哪些底层能力。根据他的实际测试,主要包括:

🌟一个能够访问互 ​

Understanding ChatGPT Work Simon Willison写了篇介绍ChatGPT Work的文章。 如果简单的说Chat 用来回答问题,Work 用来完成任务没什么意义,因为普通 ChatGPT 过去其实也能写报告、做分析。Simon Willison更关心的是 Work 到底多了哪些底层能力。根据他的实际测试,主要包括: 🌟一个能够访问互 ​

Understanding ChatGPT Work Simon Willison写了篇介绍ChatGPT Work的文章。 如果简单的说Chat 用来回答问题,Work 用来完成任务没什么意义,因为普通 ChatGPT 过去其实也能写报告、做分析。Simon Willison更关心的是 Work 到底多了哪些底层能力。根据他的实际测试,主要包括: 🌟一个能够访问互 ​
人生即模型啊作者​​​

人生即模型啊作者​​​

人生即模型啊作者​​​
HuggingFace那个小鸭子机器人Microduck 的复刻项目地址:git

HuggingFace那个小鸭子机器人Microduck 的复刻项目地址:git

HuggingFace那个小鸭子机器人Microduck 的复刻项目地址:git
腾讯发了张 Sherry 量化方法的技术信息图,介绍如何把一个拥有 7700 亿参数的 MoE 模型从约 1.5TB 的 BF16 权重压缩到 214GB~ ​

腾讯发了张 Sherry 量化方法的技术信息图,介绍如何把一个拥有 7700 亿参数的 MoE 模型从约 1.5TB 的 BF16 权重压缩到 214GB~ ​

腾讯发了张 Sherry 量化方法的技术信息图,介绍如何把一个拥有 7700 亿参数的 MoE 模型从约 1.5TB 的 BF16 权重压缩到 214GB~ ​
HTMX 这家公司开创了“无 AI 星期五”政策。
每到周五就不能用AI工作~同时还提倡大家都来这么搞~
感觉还挺有道理?

"一项又一项研究表明,使用大语言模型(LLM)可能会让你积累认知债务,降低你对工作的投入程度,对你的批判性思维能力产生负面影响,并妨碍你的技能形成。

持续不断地使用 AI 会制造 ​

HTMX 这家公司开创了“无 AI 星期五”政策。 每到周五就不能用AI工作~同时还提倡大家都来这么搞~ 感觉还挺有道理? "一项又一项研究表明,使用大语言模型(LLM)可能会让你积累认知债务,降低你对工作的投入程度,对你的批判性思维能力产生负面影响,并妨碍你的技能形成。 持续不断地使用 AI 会制造 ​

HTMX 这家公司开创了“无 AI 星期五”政策。 每到周五就不能用AI工作~同时还提倡大家都来这么搞~ 感觉还挺有道理? "一项又一项研究表明,使用大语言模型(LLM)可能会让你积累认知债务,降低你对工作的投入程度,对你的批判性思维能力产生负面影响,并妨碍你的技能形成。 持续不断地使用 AI 会制造 ​
《100 个问题》系列丛书

关于 Loop Engineering 的 100 个问题.pdf
关于 Graph Engineering 的100个问题.pdf
关于提示词工程的100个问题.pdf 
关于 Context Engineering 的 100 个问题
关于 Eval Engineering 的 100 个问题

关于 WorkBuddy 的 100 个问题.pdf
关于 Codex 的 10 ​

《100 个问题》系列丛书 关于 Loop Engineering 的 100 个问题.pdf 关于 Graph Engineering 的100个问题.pdf 关于提示词工程的100个问题.pdf 关于 Context Engineering 的 100 个问题 关于 Eval Engineering 的 100 个问题 关于 WorkBuddy 的 100 个问题.pdf 关于 Codex 的 10 ​

《100 个问题》系列丛书 关于 Loop Engineering 的 100 个问题.pdf 关于 Graph Engineering 的100个问题.pdf 关于提示词工程的100个问题.pdf 关于 Context Engineering 的 100 个问题 关于 Eval Engineering 的 100 个问题 关于 WorkBuddy 的 100 个问题.pdf 关于 Codex 的 10 ​
给Agent设计一个遗忘曲线地址:eris-system.dev/blog/fo

给Agent设计一个遗忘曲线地址:eris-system.dev/blog/fo

给Agent设计一个遗忘曲线地址:eris-system.dev/blog/fo
给Agent设计一个遗忘曲线
地址:eris-system.dev/blog/forgetting-curve

“在希腊神话中,亡者饮下忘川之水,方能渡入冥界。遗忘之河。水流涤荡前尘往事,灵魂得以超脱——而我最欣赏的,正是遗忘在此处并非设计缺陷,而是其存在意义。若无此河,万物永无轻松之日。

当我为Eris构建记忆系统时,对这 ​

给Agent设计一个遗忘曲线 地址:eris-system.dev/blog/forgetting-curve “在希腊神话中,亡者饮下忘川之水,方能渡入冥界。遗忘之河。水流涤荡前尘往事,灵魂得以超脱——而我最欣赏的,正是遗忘在此处并非设计缺陷,而是其存在意义。若无此河,万物永无轻松之日。 当我为Eris构建记忆系统时,对这 ​

给Agent设计一个遗忘曲线 地址:eris-system.dev/blog/forgetting-curve “在希腊神话中,亡者饮下忘川之水,方能渡入冥界。遗忘之河。水流涤荡前尘往事,灵魂得以超脱——而我最欣赏的,正是遗忘在此处并非设计缺陷,而是其存在意义。若无此河,万物永无轻松之日。 当我为Eris构建记忆系统时,对这 ​