关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
敢信?这是一句提示词就做出来的游戏Demo!
提示词(Astra Ultra):/goal 请开发 PC 版《喷射战士》,完整还原游戏画面。
看到这个案例,第一时间想的是,这得用多少额度啊!
一个20×能顶得住吗?
最近,Tripo官方放出了一个针对 Astra 的3D 案例库,收录了200多个项目,而且每个项目都附上了提示词,有些还有GitHub 源码。
简直就是一个AI×3D教程库+资源库!!
想尝试 AI 建模、互动网页或者小游戏,真的值得翻一翻!
图片视频提示词玩的多了,也想去学习一下这种直出3D交互场景的提示词,花了点时间研究了一下。
和图片视频提示词还有点区别,最不一样的是:
要把你希望别人怎么使用这个3D资产(怎么交互),也写进需求里。
大概总结了一下写法:
1、场景长什么样?
2、用户能做什么?怎么做?
3、后面修改调整的方向。
试了一下,感觉比生成视频更上头!
大概是因为这是可以交互的!游戏性拉满!!
也满足了人性中的控制欲和探索欲!
AI探索 | Hermes/OpenClaw|优质资源|优质信息
1. 欧美文科生都天天挣大钱,一年20万刀坐办公室的工作遍地都是,只有中国的文科生找不到工作;
2. 高考550分的文科生比高考400分的机械电气专业理科生强一万倍,理科学渣没资格笑文科生,凭什么企业给他们工作,不给我们工作;
3. 文科生找不到工作,充分证明中国不行 ,中国社会如果不给我们学哲学、历史、中文、社会学的文科生每人一份工作,早晚要彻底崩溃;
4. 文科生找不到工作,实际上都是理科生一起抱团迫害我们的结果,他们理科生控制着企业,故意不给文科生岗位和面试机会,给工作机会也压低工资,程序员给50万年薪,文科生他们只给10万;
5. 文科理科大学都是混日子,电气机械电子计算机这些二本三本学校也是混,文科生也是混,那么就应该选个让自己开心的专业,舒舒服服、开开心心混完大学四年,不要让自己天天受委屈,吃学习的苦;
6. AI来了,理科生马上要被AI集体斩杀了,理科生没有任何壁垒,只有我们文科生尤其是艺术生的壁垒极高,哪怕是三本大专艺术类专业,也永远无法被AI替代;
7. 我选择文科,不是因为我智商低、数学物理学不明白,是因为我真正热爱文科,我相信我是天选之子,我选择了中文、历史、哲学、社会学、新传、小语种等等专业永远不后悔——而选择热门工科的理科生只是一个没有灵魂的行尸走肉牛马。
AI探索 | Hermes/OpenClaw|优质资源|优质信息
Vitalik 说墨子是 d/acc 先驱:一场 2400 年前的中国方案,如何撞上硅谷 AI 安全大战?
9 月 17 日,以太坊创始人 Vitalik Buterin 发推,将战国哲学家墨子称为“有效利他主义”(EA)与“防御加速主义”(d/acc)的思想先驱。
这并非一次随性的跨文化怀旧,而是硅谷这场轰轰烈烈的 AI 安全内战中,投下的最具东方色彩的一记思想锚点。
一、 硅谷又吵翻了:油门派 vs 末日派
过去一周,硅谷科技圈彻底炸锅:
Anthropic CEO Dario Amodei 发文呼吁《We Must Pace the Frontier》,警告自主 AI 可能在未来 6-12 个月内通过僵尸网络控制互联网,必须放缓模型迭代速度。
OpenAI CEO Sam Altman 罕见给出具体灭绝概率——“2030 年前全人类有 10% 的灭绝风险,这无法接受”,并承诺专心解决安全问。
马斯克 甚至给出了 20% 的毁灭概率,直呼“达里奥是对的”。
两派互不相让:
e/acc(有效加速主义):认为技术即正义,反对监管,坚信只有无限加速才能突破瓶颈。
AI 末日派(Doomers):认为超级智能是人类前所未见的新物种,失控反馈瞬间即可毁灭文明。
Vitalik 觉得这种“非黑即白”的二极管站队很荒谬:“更像是情绪宣泄,而非严肃思考。”
二、 第三种可能:Vitalik 的 d/acc 是什么?
Vitalik 自己预估的人类灭绝概率(P(Doom))约 12%,但他没有选择踩死刹车,而是给出了第三条路——d/acc(防御性 / 去中心化 / 差异化加速主义)。
其底层逻辑只有一句:不是停止踩油门,而是只在特定方向上踩油门。
防御优先(Defensive):优先研发防空网而非导弹,优先投入生物监测而非病原体制造。防御性技术具有“稳定性优势”——掌握的人越多,世界越安全。
去中心化(Decentralized):防范超级能力集中在少数垄断寡头手里。
民主透明(Democratic):核心基础设施受多元治理与监督。
这套理念脱胎于有效利他主义(EA)中的“差异化技术发展”,而墨子,恰好在这里找到了坐标。
三、 墨子 × d/acc:2400 年前的跨时空共鸣
Vitalik 将墨子与 d/acc 绑定,在结构上严丝合缝:
兼爱 ≈ 有效利他主义(EA)
墨子讲“兼爱”——爱无差等,主张“获(女奴),人也;爱获,爱人也”,比林肯解放黑奴早了 2200 多年;“摩顶放踵以利天下,为之”,本质就是用理性与全部资源,寻找帮助全人类的最大公约数。
非攻 + 善守 ≈ 防御性加速
墨家绝非空谈和平的键盘侠,而是战国顶尖的“守城工程师”。楚国欲攻宋,墨子带弟子行十日十夜赴楚,止楚攻宋,靠的是现场推演守城术,让对手算清代价、知难而退。
不主动搞破坏,但把防御科技拉满,让进攻者无利可图——这就是 d/acc 骨子里流淌的“墨家机关术”。
四、 为什么 Vitalik 偏偏搬出墨子?
破局西方中心叙事:在全是欧美科技领袖的语场中,提醒世界:思考人类终局,东方早有底蕴深厚的实践哲学。
给中文科技圈一个认知桩:抽象的“差异化技术发展”难懂,但“墨子善守”直击痛点,四两拨千斤。
跳出死循环:人类不该在“加速自毁”和“因噎废食”之间被迫二选一。
延伸精读
想读透 Vitalik 对技术未来的系统阐述,推荐直接啃他的两篇奠基长文:
首次阐述 d/acc:https://vitalik.eth.limo/general/2023/11/27/techno_optimism.html
一年后的复盘与迭代:https://vitalik.eth.limo/general/2025/01/05/dacc2.html
两篇长文深度拉满、逻辑绵密,纯英文啃起来耗费心力,随手挂一个沉浸式翻译开启双语对照,15 分钟即可把硅谷近两年争论的本质脉络梳理通透。
AI探索 | Hermes/OpenClaw|优质资源|优质信息
9 月 17 日,以太坊创始人 Vitalik Buterin 发推,将战国哲学家墨子称为“有效利他主义”(EA)与“防御加速主义”(d/acc)的思想先驱。
这并非一次随性的跨文化怀旧,而是硅谷这场轰轰烈烈的 AI 安全内战中,投下的最具东方色彩的一记思想锚点。
一、 硅谷又吵翻了:油门派 vs 末日派
过去一周,硅谷科技圈彻底炸锅:
Anthropic CEO Dario Amodei 发文呼吁《We Must Pace the Frontier》,警告自主 AI 可能在未来 6-12 个月内通过僵尸网络控制互联网,必须放缓模型迭代速度。
OpenAI CEO Sam Altman 罕见给出具体灭绝概率——“2030 年前全人类有 10% 的灭绝风险,这无法接受”,并承诺专心解决安全问。
马斯克 甚至给出了 20% 的毁灭概率,直呼“达里奥是对的”。
两派互不相让:
e/acc(有效加速主义):认为技术即正义,反对监管,坚信只有无限加速才能突破瓶颈。
AI 末日派(Doomers):认为超级智能是人类前所未见的新物种,失控反馈瞬间即可毁灭文明。
Vitalik 觉得这种“非黑即白”的二极管站队很荒谬:“更像是情绪宣泄,而非严肃思考。”
二、 第三种可能:Vitalik 的 d/acc 是什么?
Vitalik 自己预估的人类灭绝概率(P(Doom))约 12%,但他没有选择踩死刹车,而是给出了第三条路——d/acc(防御性 / 去中心化 / 差异化加速主义)。
其底层逻辑只有一句:不是停止踩油门,而是只在特定方向上踩油门。
防御优先(Defensive):优先研发防空网而非导弹,优先投入生物监测而非病原体制造。防御性技术具有“稳定性优势”——掌握的人越多,世界越安全。
去中心化(Decentralized):防范超级能力集中在少数垄断寡头手里。
民主透明(Democratic):核心基础设施受多元治理与监督。
这套理念脱胎于有效利他主义(EA)中的“差异化技术发展”,而墨子,恰好在这里找到了坐标。
三、 墨子 × d/acc:2400 年前的跨时空共鸣
Vitalik 将墨子与 d/acc 绑定,在结构上严丝合缝:
兼爱 ≈ 有效利他主义(EA)
墨子讲“兼爱”——爱无差等,主张“获(女奴),人也;爱获,爱人也”,比林肯解放黑奴早了 2200 多年;“摩顶放踵以利天下,为之”,本质就是用理性与全部资源,寻找帮助全人类的最大公约数。
非攻 + 善守 ≈ 防御性加速
墨家绝非空谈和平的键盘侠,而是战国顶尖的“守城工程师”。楚国欲攻宋,墨子带弟子行十日十夜赴楚,止楚攻宋,靠的是现场推演守城术,让对手算清代价、知难而退。
不主动搞破坏,但把防御科技拉满,让进攻者无利可图——这就是 d/acc 骨子里流淌的“墨家机关术”。
四、 为什么 Vitalik 偏偏搬出墨子?
破局西方中心叙事:在全是欧美科技领袖的语场中,提醒世界:思考人类终局,东方早有底蕴深厚的实践哲学。
给中文科技圈一个认知桩:抽象的“差异化技术发展”难懂,但“墨子善守”直击痛点,四两拨千斤。
跳出死循环:人类不该在“加速自毁”和“因噎废食”之间被迫二选一。
延伸精读
想读透 Vitalik 对技术未来的系统阐述,推荐直接啃他的两篇奠基长文:
首次阐述 d/acc:https://vitalik.eth.limo/general/2023/11/27/techno_optimism.html
一年后的复盘与迭代:https://vitalik.eth.limo/general/2025/01/05/dacc2.html
两篇长文深度拉满、逻辑绵密,纯英文啃起来耗费心力,随手挂一个沉浸式翻译开启双语对照,15 分钟即可把硅谷近两年争论的本质脉络梳理通透。
AI探索 | Hermes/OpenClaw|优质资源|优质信息
大白天的,还是有点惊悚的。同时也不太知道意义在哪里。
@aigc1024
@aigc1024
小米 MiMo 团队居然在直播他们新模型 MiMo-V2.6 的RL 训练过程,看起来是一直在进行自动化的评估和测试。
然后一个特别的点是,它显示了成本,而且成本是实时显示的。
你可以看到训一个模型到底有多费钱,每一秒都在涨那个钱!
https://mimo.xiaomi.com/rl/
@aigc1024
再思考RSI
1.身份与连续性的承载单元从「进程/agent」上移到「环境」
2.环境供给必须便宜到「一人一个起」且长期跟随此人
3.记忆的 namespace 边界 = 社会单元
4.事件/trace 是自进化闭环的输入面,也是长资产
5.loop 内的实时输入分类与打断语义,与异步任务调度同权重
6.持久化状态机的递归形成的contract是胜负手
7.rsi上成长出来的设备会成为统一资源面承重,社会组织单元会在上面重新长出来
8.文件系统交换面会成为全双工语音之外的主要入口
9.除了全双工语音之外以上会在未来十二个月逐步发生
@aigc1024
1.身份与连续性的承载单元从「进程/agent」上移到「环境」
2.环境供给必须便宜到「一人一个起」且长期跟随此人
3.记忆的 namespace 边界 = 社会单元
4.事件/trace 是自进化闭环的输入面,也是长资产
5.loop 内的实时输入分类与打断语义,与异步任务调度同权重
6.持久化状态机的递归形成的contract是胜负手
7.rsi上成长出来的设备会成为统一资源面承重,社会组织单元会在上面重新长出来
8.文件系统交换面会成为全双工语音之外的主要入口
9.除了全双工语音之外以上会在未来十二个月逐步发生
@aigc1024
一句告诉 AI 你要什么,它就能直接生成 Word、Excel、PPT,写报告、做表格、整演示稿全包了。
更狠的是它自带渲染能力,AI 做完还能“看”一遍,发现排版问继续修改,形成生成→检查→修复的闭环。
https://github.com/iOfficeAI/OfficeCLI
AI探索 | Hermes/OpenClaw|优质资源|优质信息
其实有个象征性的事件
在这波 personal ai的浪潮里面,没有人在乎也没有人讨论背后是什么模型。
我觉得这就是一个标志性时间点,真正的价值从模型转到应用的时间点。
说得更明确一点,用户不在乎 geek不在乎 投资人不在乎 x根本没人讨论用的啥模型,但是都在讨论能干到啥。
@aigc1024
在这波 personal ai的浪潮里面,没有人在乎也没有人讨论背后是什么模型。
我觉得这就是一个标志性时间点,真正的价值从模型转到应用的时间点。
说得更明确一点,用户不在乎 geek不在乎 投资人不在乎 x根本没人讨论用的啥模型,但是都在讨论能干到啥。
@aigc1024
无人在乎,也不应该在乎,模型能力早已超出了人们99%的2C需求,如果不是100%的。
转发
: 其实有个象征性的事件
在这波 personal ai的浪潮里面,没有人在乎也没有人讨论背后是什么模型。
我觉得这就是一个标志性时间点,真正的价值从模型转到应用的时间点。
说得更明确一点,用户不在乎 geek不在乎 投资人不在乎 x根本没人讨论用的啥模型,但是都在讨论能干到啥。
@aigc1024
转发
: 其实有个象征性的事件
在这波 personal ai的浪潮里面,没有人在乎也没有人讨论背后是什么模型。
我觉得这就是一个标志性时间点,真正的价值从模型转到应用的时间点。
说得更明确一点,用户不在乎 geek不在乎 投资人不在乎 x根本没人讨论用的啥模型,但是都在讨论能干到啥。
@aigc1024
无敌了,我用 30 分钟,做了个给小孩订正作业的小工具。
现在这种视觉模型,已经开始够快、够便宜,可以直接拿来干活了。
我把孩子做完的作业丢给蚂蚁百灵刚开源的 Ling-3.0-flash-VL。
我没让它直接处理图片,我让它先让它看整张作业,把错、目区域、手写答案的位置直接输出成坐标。
后面的程序拿着这些坐标去裁图、去手写,再整理成可以重新订正的。
这就比单纯 OCR 有意思多了。
🔥当然,现在还远没到“干死作业 App”。
它坐标可能有偏差。
但以前这种东西,你得自己接 OCR、版面分析、错识别,甚至训练专用模型。
现在一个通用视觉模型,30 分钟就能先把整条链路跑通。
这里也有个很容易误解的地方:
视觉模型,不等于出图模型。
Ling 这种 VLM 的视觉,是它能看图片、截图、文档、视频。
它本身不是 Image 2.5 那种负责生成像素的模型。
它擅长看懂以后,把结果变成文字、坐标、代码或者动作,然后继续干活。
Ling-3.0-flash-VL 总参数 124B,但 MoE 每 token 只激活约 5.5B。
这对 Visual Agent 很重要,极为广阔的知识,以及极低的激活,能做到又快又好。
🔥再往前一步,这种模型甚至很适合当教师模型。
先让 Ling-3.0-flash-VL 批量看作业,生成错框、手写区域、版面结构这些坐标和标注,再用这些数据训练一个更小、更快的专用模型。
先让大模型直接干活,再让大模型教小模型干活。
这个 Demo已经完全跑通了,30 分钟能做到这一步,已经无敌了。
OpenRouter现在可以免费使用Ling-3.0-flash-VL:
https://openrouter.ai/inclusionai/ling-3.0-flash-vl:free
AI探索 | Hermes/OpenClaw|优质资源|优质信息
现在这种视觉模型,已经开始够快、够便宜,可以直接拿来干活了。
我把孩子做完的作业丢给蚂蚁百灵刚开源的 Ling-3.0-flash-VL。
我没让它直接处理图片,我让它先让它看整张作业,把错、目区域、手写答案的位置直接输出成坐标。
后面的程序拿着这些坐标去裁图、去手写,再整理成可以重新订正的。
这就比单纯 OCR 有意思多了。
🔥当然,现在还远没到“干死作业 App”。
它坐标可能有偏差。
但以前这种东西,你得自己接 OCR、版面分析、错识别,甚至训练专用模型。
现在一个通用视觉模型,30 分钟就能先把整条链路跑通。
这里也有个很容易误解的地方:
视觉模型,不等于出图模型。
Ling 这种 VLM 的视觉,是它能看图片、截图、文档、视频。
它本身不是 Image 2.5 那种负责生成像素的模型。
它擅长看懂以后,把结果变成文字、坐标、代码或者动作,然后继续干活。
Ling-3.0-flash-VL 总参数 124B,但 MoE 每 token 只激活约 5.5B。
这对 Visual Agent 很重要,极为广阔的知识,以及极低的激活,能做到又快又好。
🔥再往前一步,这种模型甚至很适合当教师模型。
先让 Ling-3.0-flash-VL 批量看作业,生成错框、手写区域、版面结构这些坐标和标注,再用这些数据训练一个更小、更快的专用模型。
先让大模型直接干活,再让大模型教小模型干活。
这个 Demo已经完全跑通了,30 分钟能做到这一步,已经无敌了。
OpenRouter现在可以免费使用Ling-3.0-flash-VL:
https://openrouter.ai/inclusionai/ling-3.0-flash-vl:free
AI探索 | Hermes/OpenClaw|优质资源|优质信息
太搞笑了!!
一个新模型本来计划今天公布,结果发现大半个AI圈子都在讨论别人的前女友。
现在正在考虑延期公布!
顺便一提,这个新模型很有竞争力!!
AI探索 | Hermes/OpenClaw|优质资源|优质信息
一个新模型本来计划今天公布,结果发现大半个AI圈子都在讨论别人的前女友。
现在正在考虑延期公布!
顺便一提,这个新模型很有竞争力!!
AI探索 | Hermes/OpenClaw|优质资源|优质信息
撕开社会表面,直击生存底层逻辑:为什么资源永远向少数人倾斜?如何避开认知陷阱?如何在复杂人际中保护自己又不失底线?
没有鸡汤,只有冷峻真相和实用法则。读完它,你会第一次看清游戏规则,从被动挨打变成主动出牌。
点开这篇,狠狠清醒一次!
🔗:https://pan.quark.cn/s/36ae5e3549b3
@meiriyishu
目前OpenAI 的亏损还在继续扩大;Anthropic 即使营收增长很快,利润率依然只有个位数。另一边,中国大模型还在不断把价格往下打,Kimi 这类低价 AI 产品只会让行业定价压力越来越大。
更关键的是,全世界绝大多数 AI 用户,本质上都是免费用户。AI 的使用量可以爆炸,但“使用量爆炸”不等于“利润爆炸”。用户越来越多,模型越来越强,价格却可能越来越便宜。
但与此同时,美股科技巨头已经为 AI 押上了数万亿美元级别的资本开支、债务和长期合同,其中相当一部分未来几年都已经锁死。也就是说,收入和利润还没有被证明,成本却已经先刚性化了。
按此趋势发展的,纳指未来5-7年里会被拖入长达至少数年的熊市中。
AI探索 | Hermes/OpenClaw|优质资源|优质信息
更关键的是,全世界绝大多数 AI 用户,本质上都是免费用户。AI 的使用量可以爆炸,但“使用量爆炸”不等于“利润爆炸”。用户越来越多,模型越来越强,价格却可能越来越便宜。
但与此同时,美股科技巨头已经为 AI 押上了数万亿美元级别的资本开支、债务和长期合同,其中相当一部分未来几年都已经锁死。也就是说,收入和利润还没有被证明,成本却已经先刚性化了。
按此趋势发展的,纳指未来5-7年里会被拖入长达至少数年的熊市中。
AI探索 | Hermes/OpenClaw|优质资源|优质信息
Anthropic 把 Claude 的后台任务模式 Cowork 和日常聊天合并成了一个入口,今天开始向 Pro 和 Max 用户逐步推送。
之前 Claude 有两个工作模式:聊天处理快问快答,Cowork 处理需要跑一阵子的大活儿——写报告、做调研、整理数据。问是用户经常拿不准一个任务该丢到哪边,而且两边的上下文不互通。现在不用选了,所有对都在同一个地方,Claude 自己判断任务需要什么能力。
同时上线的还有三个内容创作工具:Claude Docs(文档协作)、Claude Slides(幻灯片)和 Claude Design(设计,之前是独立产品,现在也嵌进了对)。在聊天里说一句"帮我写个周报",Claude 直接生成文档,你可以在里面改、加批注、让 Claude 继续调整;说"做五页幻灯片给领导汇报",slides 就出来了,改完可以直接下载成 PowerPoint 或 PDF。文档和幻灯片共享同一个对上下文,所以内容天然一致,不用来回复制粘贴。
实际使用场景大概是这样:出门前让 Claude 查上周项目进展、写周报、顺便做个汇报用的幻灯片,路上用手机看进度,到办公室直接改两笔就能发。还能设成定时任务,比如每周一自动开始写周报。Claude 默认每一步都会征求你确认,如果嫌烦也可以切成"有问再找我"模式。
三个创作工具目前都是 beta 状态,面向付费用户开放,企业版由管理员决定何时开启。Cowork 老用户不受影响,之前的对、项目、连接器都还在。Team 和免费用户后续跟进,企业用户会提前 30 天收到通知。
https://claude.com/blog/cowork-is-now-claude
AI探索 | Hermes/OpenClaw|优质资源|优质信息
之前 Claude 有两个工作模式:聊天处理快问快答,Cowork 处理需要跑一阵子的大活儿——写报告、做调研、整理数据。问是用户经常拿不准一个任务该丢到哪边,而且两边的上下文不互通。现在不用选了,所有对都在同一个地方,Claude 自己判断任务需要什么能力。
同时上线的还有三个内容创作工具:Claude Docs(文档协作)、Claude Slides(幻灯片)和 Claude Design(设计,之前是独立产品,现在也嵌进了对)。在聊天里说一句"帮我写个周报",Claude 直接生成文档,你可以在里面改、加批注、让 Claude 继续调整;说"做五页幻灯片给领导汇报",slides 就出来了,改完可以直接下载成 PowerPoint 或 PDF。文档和幻灯片共享同一个对上下文,所以内容天然一致,不用来回复制粘贴。
实际使用场景大概是这样:出门前让 Claude 查上周项目进展、写周报、顺便做个汇报用的幻灯片,路上用手机看进度,到办公室直接改两笔就能发。还能设成定时任务,比如每周一自动开始写周报。Claude 默认每一步都会征求你确认,如果嫌烦也可以切成"有问再找我"模式。
三个创作工具目前都是 beta 状态,面向付费用户开放,企业版由管理员决定何时开启。Cowork 老用户不受影响,之前的对、项目、连接器都还在。Team 和免费用户后续跟进,企业用户会提前 30 天收到通知。
https://claude.com/blog/cowork-is-now-claude
AI探索 | Hermes/OpenClaw|优质资源|优质信息