关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
你问他第一门编程语言应该学什么,他告诉人生第一门语言必须只能是lisp,入门编程书必须是SICP,告诉你这才是学计算机的正道;
你问他操作系统应该是macOS、windows还是ubuntu,他告诉你必须选择arch linux,每个人都应该且只用这一个;
你问他你用vscode还是notepad++还是jetbrains系列, 他告诉你必须用emacs,他告诉你高手只用emacs,然后邪魅一笑;
你问他对deep learning有什么意见,他说pytorch是个巨大的灾难,torch完全应该由lua转向haskell重写一遍,而绝对不应该用python写成pytorch,他认为所有做deep learning的人都是大傻逼,都应该回去从本科catagory theory开始回炉重造。
现在他来告诉你们,他认为AI Agent harness必须全部插件化,否则都是路线错误……
AI探索 | Hermes/OpenClaw|优质资源|优质信息
你问他操作系统应该是macOS、windows还是ubuntu,他告诉你必须选择arch linux,每个人都应该且只用这一个;
你问他你用vscode还是notepad++还是jetbrains系列, 他告诉你必须用emacs,他告诉你高手只用emacs,然后邪魅一笑;
你问他对deep learning有什么意见,他说pytorch是个巨大的灾难,torch完全应该由lua转向haskell重写一遍,而绝对不应该用python写成pytorch,他认为所有做deep learning的人都是大傻逼,都应该回去从本科catagory theory开始回炉重造。
现在他来告诉你们,他认为AI Agent harness必须全部插件化,否则都是路线错误……
AI探索 | Hermes/OpenClaw|优质资源|优质信息
DeepSeek V4.1 Flash 已超前上线 Cola
欢迎体验
目前资源比较紧张
属于 beta 状态
DeepSeek 首次支持原生多模态
可以试试
Astra 已经证明了原生多模态的价值
@aigc1024
欢迎体验
目前资源比较紧张
属于 beta 状态
DeepSeek 首次支持原生多模态
可以试试
Astra 已经证明了原生多模态的价值
@aigc1024
上传照片或输入地址,专属像素地图和NPC立刻生成。画地图、搭建世界、驱动NPC行为,全由Gemini操刀,而且竟然没用LangGraph。
NPC就像活物:感知环境、自己做决定、记日记、还能陪你聊天。你甚至可以化身“上帝”,改写记忆、注入新事件,看这些小人不被玩坏。
三种玩法:传照片、逛纽约地标,或者随便填个地址。打工人的精神避难所。
🔗 https://github.com/tensor2023/OpenPixel-RPG
AI探索 | Hermes/OpenClaw|优质资源|优质信息
我真的看不懂了!
宇树这是要干嘛?为啥要教人形机器人自主格斗呢?
就在昨天,宇树科技发布了全新的世界模型UnifoLM-X2-1.0,同时亮出了全球首个完全由实时世界模型驱动的全自主人形机器人格斗演示。
很多人可能没概念,人形机器人格斗这事,放在以前,本质就是个大型真人遥控玩具。
因为是有后台操作员盯着画面,手动操控机器人出拳、移动,延迟高、反应慢,稍微被碰一下就容易失去平衡倒地。
之前宇树也出过G1-Boxing版本,说到底还是预设动作加人工修正,算不上真的自主对战。
但这次完全不一样。
整个格斗过程没有任何人类远程操控,全靠机器人自己的AI系统实时判断、实时反应。
对手出拳它能立刻预判轨迹,要么格挡要么躲闪,被打中了还能自动调整重心保持平衡,甚至还能主动找机会反击。
区别在哪里呢?
之前的格斗机器人,就像刚学打球的新手,别人喊你往左你就往左,喊你挥拍你就挥拍,所以永远慢半拍;而这次宇树的机器人,就像职业运动员,眼睛盯着对手的动作,大脑提前算好落点、力道、身体重心,自动调整步伐和动作,全程都是自主决策。
核心就是这个世界模型UnifoLM-X2-1.0。
它能在动作做出来之前,就提前预判物理交互的结果——对手这一拳打过来角度是多少、力道有多大、打中自己哪个位置、身体会往哪边歪,全都能实时推演出来,然后立刻调整动作指令。
之前为什么人形机器人在动态场景里总是拉胯,本质就是延迟问。
等传感器把外界信息传回去,处理器再算完发出指令,早就晚了。
而世界模型相当于给机器人装了个“预知大脑”,不等变化发生,提前就把应对方案算好了,整个控制回路延迟压到极低,真正做到实时反应。
比如之前我们在春晚武BOT看到的那套动作全是提前编好的程序,对手也是配合演出的,相当于“演”给你看,所有动作都是固定的。
但这次是开放的动态对战,对手的动作完全不可控,机器人要临场应变、自主决策,难度根本不是一个量级。
不过我更好奇地是,这次的模型有没有DeepSeek的技术参与?毕竟DeepSeek战略投资了宇树嘛。
查了一下,目前官方没有明确说联合研发,但大模型领域的世界建模思路,肯定对宇树的技术路线有启发。
因为大语言模型的世界模型,预判的是文字、逻辑、信息的走向,是在数字世界里做推理;而人形机器人的世界模型,预判的是物理世界的运动、力的变化、物体的交互,是在真实空间里做推演。
底层都是预测逻辑,但训练数据、落地场景完全不同,就像一个是围棋高手在棋盘上算步数,一个是格斗高手在擂台上算拳脚,底层逻辑是相通的。
不过,最容易引起质疑的就是搞机器人格斗对普通家庭用户有什么用?难道以后真要上战场吗?
我想,这倒不至于。
格斗场景其实是人形机器人运动能力的试金石。
因为如果能在高速、高动态的对战里保持平衡、精准反应、自主决策,那放到日常场景里,不管是走路避开突发障碍物,还是工业作业应对突发状况,能力都是降维打击。
就像F1赛车的技术最终会用到家用车上,格斗机器人的技术积累,最后都会落地到通用人形机器人的产品里。
目前来看,全球能拿出全自主人形机器人格斗实机演示的,宇树是独一份。
其他同行要么还停留在预设动作阶段,要么只能做简单的推拉对抗,这种实时动态的全自主对战,确实是走到了全球最前面。
@aigc1024
宇树这是要干嘛?为啥要教人形机器人自主格斗呢?
就在昨天,宇树科技发布了全新的世界模型UnifoLM-X2-1.0,同时亮出了全球首个完全由实时世界模型驱动的全自主人形机器人格斗演示。
很多人可能没概念,人形机器人格斗这事,放在以前,本质就是个大型真人遥控玩具。
因为是有后台操作员盯着画面,手动操控机器人出拳、移动,延迟高、反应慢,稍微被碰一下就容易失去平衡倒地。
之前宇树也出过G1-Boxing版本,说到底还是预设动作加人工修正,算不上真的自主对战。
但这次完全不一样。
整个格斗过程没有任何人类远程操控,全靠机器人自己的AI系统实时判断、实时反应。
对手出拳它能立刻预判轨迹,要么格挡要么躲闪,被打中了还能自动调整重心保持平衡,甚至还能主动找机会反击。
区别在哪里呢?
之前的格斗机器人,就像刚学打球的新手,别人喊你往左你就往左,喊你挥拍你就挥拍,所以永远慢半拍;而这次宇树的机器人,就像职业运动员,眼睛盯着对手的动作,大脑提前算好落点、力道、身体重心,自动调整步伐和动作,全程都是自主决策。
核心就是这个世界模型UnifoLM-X2-1.0。
它能在动作做出来之前,就提前预判物理交互的结果——对手这一拳打过来角度是多少、力道有多大、打中自己哪个位置、身体会往哪边歪,全都能实时推演出来,然后立刻调整动作指令。
之前为什么人形机器人在动态场景里总是拉胯,本质就是延迟问。
等传感器把外界信息传回去,处理器再算完发出指令,早就晚了。
而世界模型相当于给机器人装了个“预知大脑”,不等变化发生,提前就把应对方案算好了,整个控制回路延迟压到极低,真正做到实时反应。
比如之前我们在春晚武BOT看到的那套动作全是提前编好的程序,对手也是配合演出的,相当于“演”给你看,所有动作都是固定的。
但这次是开放的动态对战,对手的动作完全不可控,机器人要临场应变、自主决策,难度根本不是一个量级。
不过我更好奇地是,这次的模型有没有DeepSeek的技术参与?毕竟DeepSeek战略投资了宇树嘛。
查了一下,目前官方没有明确说联合研发,但大模型领域的世界建模思路,肯定对宇树的技术路线有启发。
因为大语言模型的世界模型,预判的是文字、逻辑、信息的走向,是在数字世界里做推理;而人形机器人的世界模型,预判的是物理世界的运动、力的变化、物体的交互,是在真实空间里做推演。
底层都是预测逻辑,但训练数据、落地场景完全不同,就像一个是围棋高手在棋盘上算步数,一个是格斗高手在擂台上算拳脚,底层逻辑是相通的。
不过,最容易引起质疑的就是搞机器人格斗对普通家庭用户有什么用?难道以后真要上战场吗?
我想,这倒不至于。
格斗场景其实是人形机器人运动能力的试金石。
因为如果能在高速、高动态的对战里保持平衡、精准反应、自主决策,那放到日常场景里,不管是走路避开突发障碍物,还是工业作业应对突发状况,能力都是降维打击。
就像F1赛车的技术最终会用到家用车上,格斗机器人的技术积累,最后都会落地到通用人形机器人的产品里。
目前来看,全球能拿出全自主人形机器人格斗实机演示的,宇树是独一份。
其他同行要么还停留在预设动作阶段,要么只能做简单的推拉对抗,这种实时动态的全自主对战,确实是走到了全球最前面。
@aigc1024
Better‑Fullstack说白了就是让你开局省心的工具。它全栈支持TypeScript、Rust、Python、Go,270多种组合任你挑选,前后端、数据库、认证、支付、AI、运维,选一遍就能拿到一个可以直接跑的骨架。
它不光是快一点,而是彻底把你从配置泥潭里拽出来,让注意力能全部放回业务本身。
不管你是独立开发者、想规范流程的团队,还是赶工期的外包,谁先上手谁就先跑——现在这节奏,慢一步就等于掉队。先用它把地基敲定,再交给AI去填充业务逻辑,效率已经不是提速,是直接换了条赛道在冲刺。
🔗 GitHub:https://github.com/Marve10s/Better-Fullstack
🔗 官网:https://better-fullstack.dev/
AI探索 | Hermes/OpenClaw|优质资源|优质信息
PPT Master这次确实让我刮目相看——不是因为它能凭空变出演示文稿,而是它产出的成果可以在PowerPoint里继续加工:原生形状、过渡动画、数据图表、表格,甚至还能套用你自己的模板。
它不是把内容拍扁成图片再套个pptx后缀糊弄人,而是真正写入了PowerPoint的原生对象模型,相当于AI替你完成了最繁琐的搭建工作,但把最终修改权和判断权留给了你。
🔗 https://github.com/hugohe3/ppt-master
AI探索 | Hermes/OpenClaw|优质资源|优质信息
这套课程我直说,含金量在线:
1️⃣ 503节课,横跨20个阶段,从数学根基一路延伸到多智能体和生产级部署
2️⃣ 不是看demo图个乐子,是顺着工程师的真实成长路径一步步碾过去
3️⃣ 1w+星标是无数人踩坑之后用脚投出来的认可
🔗 https://github.com/rohitg00/ai-engineering-from-scratch
AI探索 | Hermes/OpenClaw|优质资源|优质信息
没有人讨论DeepSeek Harness了,没有人讨论Fable 5.1了,甚至讨论WorkBuddy的人也少了。
Kimi K3?
那是好久以前的事了。
嗯,模型和产品面临的自然选择比人类牛马残酷多了。
人类牛马35岁之后会被淘汰。
模型和产品一般是3.5天之后被遗忘。
没有模型能被连续讨论超过35天,今天最一线的超模也不行。
不对,DeepSeek R1曾经做到过!
记性真好,上古时代的历史就不要提了……
我们以为自己生活在一个创新爆炸的时代,其实也生活在一个遗忘爆炸的时代。
@aigc1024
Kimi K3?
那是好久以前的事了。
嗯,模型和产品面临的自然选择比人类牛马残酷多了。
人类牛马35岁之后会被淘汰。
模型和产品一般是3.5天之后被遗忘。
没有模型能被连续讨论超过35天,今天最一线的超模也不行。
不对,DeepSeek R1曾经做到过!
记性真好,上古时代的历史就不要提了……
我们以为自己生活在一个创新爆炸的时代,其实也生活在一个遗忘爆炸的时代。
@aigc1024
聚焦社交场景语言运用,涵盖交际原则、礼仪规范、各类场合沟通术,提供实用表达方法与技巧,助力读者提升语言表达、人际沟通与社交应变能力,轻松应对日常社交与职场交流。
🔗:https://pan.quark.cn/s/3fe0b0e960a4
@meiriyishu