众力资讯网

蚁工厂的文章

又要重置了?用不完,疲了已经,没啥感觉了。。 ​​​

又要重置了?用不完,疲了已经,没啥感觉了。。 ​​​

又要重置了?用不完,疲了已经,没啥感觉了。。 ​​​
老书电子化项目:上海科技出版社的《数理化自学丛书》,也是刚恢复高考时,人们用于自

老书电子化项目:上海科技出版社的《数理化自学丛书》,也是刚恢复高考时,人们用于自

老书电子化项目:上海科技出版社的《数理化自学丛书》,也是刚恢复高考时,人们用于自
Google 的消费级硬件真不咋地。。拿着最先进的工艺,很可能要打不过9月份要发

Google 的消费级硬件真不咋地。。拿着最先进的工艺,很可能要打不过9月份要发

Google 的消费级硬件真不咋地。。拿着最先进的工艺,很可能要打不过9月份要发
Google 的消费级硬件真不咋地。。拿着最先进的工艺,很可能要打不过9月份要发布的麒麟了[睡] ​

Google 的消费级硬件真不咋地。。拿着最先进的工艺,很可能要打不过9月份要发布的麒麟了[睡] ​

Google 的消费级硬件真不咋地。。拿着最先进的工艺,很可能要打不过9月份要发布的麒麟了[睡] ​
大模型训练的中场叙事:从 Reasoning Thinking 转向 Agent

大模型训练的中场叙事:从 Reasoning Thinking 转向 Agent

大模型训练的中场叙事:从 Reasoning Thinking 转向 Agent
[中文翻译万字完整版] Anthropic 官方 Agent Skills 构建

[中文翻译万字完整版] Anthropic 官方 Agent Skills 构建

[中文翻译万字完整版] Anthropic 官方 Agent Skills 构建
同行是冤家OpenAI终止与Cursor的合作关系 ​​​

同行是冤家OpenAI终止与Cursor的合作关系 ​​​

同行是冤家OpenAI终止与Cursor的合作关系 ​​​
[卡皮巴拉] ​​​

[卡皮巴拉] ​​​

[卡皮巴拉] ​​​
MiniTorch,一个面向机器学习工程师的教学项目,帮助学生理解深度学习系统背

MiniTorch,一个面向机器学习工程师的教学项目,帮助学生理解深度学习系统背

MiniTorch,一个面向机器学习工程师的教学项目,帮助学生理解深度学习系统背
DHH搞的Linux发行版Omarchy最近蛮火雷电芽衣做了个中文版出来,默认集

DHH搞的Linux发行版Omarchy最近蛮火雷电芽衣做了个中文版出来,默认集

DHH搞的Linux发行版Omarchy最近蛮火雷电芽衣做了个中文版出来,默认集

2009年8月28日,新浪微博上线并向公众开放测试。生日快乐~[蛋糕]今天满17

2009年8月28日,新浪微博上线并向公众开放测试。生日快乐~[蛋糕]今天满17
用 GLM-5.3 Flash,似乎不用把推理强度调到max。相比于high提升

用 GLM-5.3 Flash,似乎不用把推理强度调到max。相比于high提升

用 GLM-5.3 Flash,似乎不用把推理强度调到max。相比于high提升
用 GLM-5.3 Flash,似乎不用把推理强度调到max。
相比于high提升不大,但token消耗量高了很多。 ​

用 GLM-5.3 Flash,似乎不用把推理强度调到max。 相比于high提升不大,但token消耗量高了很多。 ​

用 GLM-5.3 Flash,似乎不用把推理强度调到max。 相比于high提升不大,但token消耗量高了很多。 ​
GLM-5.3-Flash的DFlash2版本已发布(Inco AI做的,不是G

GLM-5.3-Flash的DFlash2版本已发布(Inco AI做的,不是G

GLM-5.3-Flash的DFlash2版本已发布(Inco AI做的,不是G
Hugging Face的新机器人玩具Microduck,399美元一个 ​​​

Hugging Face的新机器人玩具Microduck,399美元一个 ​​​

Hugging Face的新机器人玩具Microduck,399美元一个 ​​​
#家电三巨头集体杀入具身智能赛道# 
没毛病,机器人就是未来的家电。。赛道上必然要去抢的。当然短期内真把机器人当家电卖还不现实~ 现在还是长期布局。

当然对家电巨头来说还有一层现实意义:这些大家电厂本身就在厂子里大量应用机器人。
之前的机器人主要是机械臂等形态,现在具身起来了,慢慢的一 ​

#家电三巨头集体杀入具身智能赛道# 没毛病,机器人就是未来的家电。。赛道上必然要去抢的。当然短期内真把机器人当家电卖还不现实~ 现在还是长期布局。 当然对家电巨头来说还有一层现实意义:这些大家电厂本身就在厂子里大量应用机器人。 之前的机器人主要是机械臂等形态,现在具身起来了,慢慢的一 ​

#家电三巨头集体杀入具身智能赛道# 没毛病,机器人就是未来的家电。。赛道上必然要去抢的。当然短期内真把机器人当家电卖还不现实~ 现在还是长期布局。 当然对家电巨头来说还有一层现实意义:这些大家电厂本身就在厂子里大量应用机器人。 之前的机器人主要是机械臂等形态,现在具身起来了,慢慢的一 ​
#曝英伟达129亿美元收购HuggingFace# 
苟富贵~勿相忘[皱眉]
据 The Information 最新报道,知情人士透露,英伟达已经同意以 129 亿美元收购 Hugging Face。
当然另一家businessinsider今天的报道说是“双方近几周一直在就收购事宜进行磋商,该交易对Hugging Face的估值将超过130亿美元。 ​

#曝英伟达129亿美元收购HuggingFace# 苟富贵~勿相忘[皱眉] 据 The Information 最新报道,知情人士透露,英伟达已经同意以 129 亿美元收购 Hugging Face。 当然另一家businessinsider今天的报道说是“双方近几周一直在就收购事宜进行磋商,该交易对Hugging Face的估值将超过130亿美元。 ​

#曝英伟达129亿美元收购HuggingFace# 苟富贵~勿相忘[皱眉] 据 The Information 最新报道,知情人士透露,英伟达已经同意以 129 亿美元收购 Hugging Face。 当然另一家businessinsider今天的报道说是“双方近几周一直在就收购事宜进行磋商,该交易对Hugging Face的估值将超过130亿美元。 ​
技术博文:AI 芯片架构:主流技术路线全景解析
地址:www.jacobpeake.com/ai-chip-architectures

对大模型应用场景来说,不同 AI 芯片架构的核心区别可以归结为:数据存在哪里、怎样移动、由什么单元计算,以及多颗芯片如何连接成大规模系统。

这是一篇技术密度很高的 AI 芯片架构全景综述。作者系统 ​

技术博文:AI 芯片架构:主流技术路线全景解析 地址:www.jacobpeake.com/ai-chip-architectures 对大模型应用场景来说,不同 AI 芯片架构的核心区别可以归结为:数据存在哪里、怎样移动、由什么单元计算,以及多颗芯片如何连接成大规模系统。 这是一篇技术密度很高的 AI 芯片架构全景综述。作者系统 ​

技术博文:AI 芯片架构:主流技术路线全景解析 地址:www.jacobpeake.com/ai-chip-architectures 对大模型应用场景来说,不同 AI 芯片架构的核心区别可以归结为:数据存在哪里、怎样移动、由什么单元计算,以及多颗芯片如何连接成大规模系统。 这是一篇技术密度很高的 AI 芯片架构全景综述。作者系统 ​
Sebastian Raschka绘制的GLM-5.3-Flash架构图越来越复

Sebastian Raschka绘制的GLM-5.3-Flash架构图越来越复

Sebastian Raschka绘制的GLM-5.3-Flash架构图越来越复
Sebastian Raschka绘制的GLM-5.3-Flash架构图
越来越复杂了。
----
相比 GLM-5.2,这个新的 GLM-5.3-Flash 模型采用了:
1️⃣一种类似 Kimi Linear 的 3:1“超级混合”注意力模式:包含 34 层 Kimi Delta Attention(KDA),以及 11 层 Multi-head Latent Attention(MLA,多头潜在注意力)/ DeepSeek ​

Sebastian Raschka绘制的GLM-5.3-Flash架构图 越来越复杂了。 ---- 相比 GLM-5.2,这个新的 GLM-5.3-Flash 模型采用了: 1️⃣一种类似 Kimi Linear 的 3:1“超级混合”注意力模式:包含 34 层 Kimi Delta Attention(KDA),以及 11 层 Multi-head Latent Attention(MLA,多头潜在注意力)/ DeepSeek ​

Sebastian Raschka绘制的GLM-5.3-Flash架构图 越来越复杂了。 ---- 相比 GLM-5.2,这个新的 GLM-5.3-Flash 模型采用了: 1️⃣一种类似 Kimi Linear 的 3:1“超级混合”注意力模式:包含 34 层 Kimi Delta Attention(KDA),以及 11 层 Multi-head Latent Attention(MLA,多头潜在注意力)/ DeepSeek ​