关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
今日份的AI作业,复现了Coser和Cos角色的拼接构图。
提示词:
竖幅近距离写实摄影,一位【角色】(出自【作品】)风格的女性 cosplayer 正面看向镜头。
她将一部智能手机横向但明显顺时针倾斜约25度,举在脸部正前方。手机必须覆盖真人的整个鼻子、嘴巴、左眼以及大部分右侧面部;手机上边框斜着穿过真人双眼所在的水平线。真人只能露出一只眼睛,这只眼睛位于手机左上角外侧,与手机边框紧密相邻。严禁在手机上方同时露出真人的两只眼睛。
手机屏幕不是显示一张居中的完整动漫肖像,而是显示经过精确放大、移动和裁切的同一人物动漫面部局部。动漫头部必须与手机后方真人头部保持完全相同的尺寸、角度和透视。屏幕里的动漫刘海从手机上边缘接续真人刘海,发束方向和发色连续;屏幕里的动漫眼睛位于被手机遮住的真人眼睛原本所在的位置;动漫鼻子和嘴位于真人被遮挡后的正确解剖位置;动漫下巴被手机下边缘裁切,不要在屏幕中显示完整头部。
最终效果必须像手机屏幕是一扇“动漫滤镜窗口”:手机外是同一个人的真人形态,手机覆盖的区域变成同一个人的动漫形态,两者合起来只能形成一张脸,而不是上下排列的两张脸。single composite face, one continuous head, one facial coordinate system, anime region replacing the occluded real facial region, seamless hair continuation across the phone bezel.
手机距离脸非常近,屏幕内动漫脸的宽度与后方真人脸的实际宽度一致。手机采用近景斜角构图,不要水平居中。背景为暖色日式动漫咖啡店,浅景深,真实手机摄影质感。The result contains only one perceived face and one pair of eyes in total. One real eye is visible outside the phone; the other eye is represented by the anime eye inside the screen. The phone’s upper bezel intersects the natural eye line. Do not place both real eyes above the phone. Do not show a complete, centered anime portrait. Crop and offset the anime image so it occupies the exact facial coordinates hidden behind the phone. The phone screen functions as a replacement window for the occluded portion of the same face.
@aigc1024
DeepSeek 是 AI 应用之光
今天是创业以来最开心的时刻
梁圣是真圣人
目前用过最实用的一条 PPT 提示词。
把资料发给 AI 后,补上这段:
“先判断这次汇报最需要听众记住什么,再围绕这个目标设计整套 PPT。不要按照原文顺序分页,也不要机械压缩内容。请逐页给出标、核心信息、建议图表、页面结构和口播重点。每页只承担一个任务,页面之间要有明确的因果、递进或转折关系。”
这段提示词解决了一个常见问:
很多 AI 做 PPT,本质上只是把长文切碎,再分别放到不同页面。
结果页数很多,信息很多,听众却不知道你到底想说明什么。
真正有效的 PPT,应该先确定结论,再安排证据和顺序。
先解决逻辑,再处理排版。
这才是 AI 生成 PPT 时最关键的一步。
@aigc1024
😀😀😀😀😀😀
😀😀😀😀😀😀😀
世界杯官方指定平台
😍开云集团旗下亚洲最顶级娱乐平台

😍体育 H5版 WEB端入口
😍体育 PC端 网页版入口
😍体育 全站APP APP下载

🔤🔤小程序,免实名-免绑卡-不限IP-U存U取
😍😍😍😍😍😍😀😀😀😀😀😀😀
📱小飞机飞投入口 匿名首选

新用户首存加赠2⃣5⃣🔣,复存加增1⃣0⃣🔣
体育足球单首单包赔1⃣0⃣0⃣🔣

易换支付钱包,1⃣0⃣亿🔤资金池储备
线上5⃣0⃣0⃣0⃣🔤担保,拒绝野鸡台
千万域名,豪客之
https://mk.bet
代理分润 5⃣5⃣🔣 @MKFT888

@MKFT777
@MKFTYZ

关注😀😀😀😀😀😀😀😀 t.me/rdsjo
掌握东南亚一线动态,看清风向料定先机。每周抽取100名TG会员,发言积分兑8⃣8⃣8⃣🔤
发现了 Codex 一个非常牛逼的更新,好像没见他们宣传!
Codex 现在有专门给图像 Agent 做的 UI 模式了:
生成图片后,点击图片会单独弹出一个侧边栏预览窗口。在这里面,你可以直接对图片进行评论、擦除和调整大小。这完全是专门给 GPT Image 2.0 做的。
左上角有一个切换按钮,切换以后,聊天流里就只显示图像,不显示那些文案了。
这样你就可以专注于调整图像,快速看到聊天里生成的所有大图。
你可以多选图片,一并添加到输入框里,然后让 GPT 给你进行批量修改。
这个更新感觉要把设计 Agent 的活吃掉一大半了。
这种方式我觉得是要比现在主流的无限画布等复杂的交互逻辑,要更容易理解的。
@aigc1024
DeepSeek V4 Flash 模型智能水平竟然超过 GLM 5.2 ,接近 GPT 5.6 Luna (Max)
现已上架 Cola 的 Token Plan 和积分模型。
梁圣威武,我们终于可以做免费计划了。
欢迎大家来免费体验!
http://ColaOS.AI
@aigc1024
AI 代理自己写代理应用的框架,说一句就给你生成一个完整应用。
开源的 AI 代理构建框架,代理自动创建和优化其他代理。工具集极简、token 省、对 DeepSeek 等开源模型深度优化。说一句就生成完整应用,代理能跑基准测试自我优化,内置办公、开发、AI 应用、代理调优四大类技能。
https://github.com/Prism-Shadow/penguin-harness

AI探索 | Hermes/OpenClaw优质资源优质信息
Deepseek V4 Flash 更新到正式版了,Agent 能力大幅提升,超过了 V4 Pro 的 Preview 版本!
官方测评成绩:
Terminal Bench 2.1: 82.7
NL2Repo: 54.2
Cybergym: 76.7
DeepSWE: 54.4
Toolathlon verified: 70.3
Agent Last Exam: 25.2
Automation Bench (Public): 25.1
DSBench-FullStack: 68.7
DSBench-Hard: 59.6
目前已经在官方 API 上线,同时还支持了 Codex 的 API 格式,可以快速配置。
Mac 一键配置脚本:bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)
Windows 一键配置脚本:irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex
DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。
详情:api-docs.deepseek.com/zh-cn/updates/
@aigc1024
一个 UI 视觉词典的中英双语对照网站,让你看见界面元素和视觉风格就知道它们叫什么真名,好精准地指挥 AI 编程代理。
https://github.com/joeseesun/learnui

AI探索 | Hermes/OpenClaw优质资源优质信息
WorkBuddy 有可能会拿下国内大部分 Agent 市场,只是因为傻人有傻福。。。
Trae 第一波用户拿了 Codex、Claude Code 的这批人,我觉得是个败笔,我觉得只能看后面慢慢转型了,
这批程序员虽然贡献的数据质量高,但是,挑剔、忠诚度低、做的核心是 toB,字节大概率会有段难受的时光
WorkBuddy 这傻东西,傻人有傻福,程序员们看不上,然后最近慢慢能力上来了,吃到了白领,不太懂技术那批人,那群人能学会一个东西,基本也不会想换另外一个东西了,我觉得长期看好
看起来是比产品,最后比的是用户,Trae 代表的是专业的用户、WorkBuddy 代表的是小白用户
以我对国内这逼仄的 toB 市场,应该还是拿下小白的白领用户群体能保证付费意愿、长期稳定性
@aigc1024
万众期待,DeepSeek V4 Flash 正式版终于降临
Flash 正式版直接大幅远超 Pro-Preview
新的模型基线
让人人都能用得起 Agent
@aigc1024
港大出品 DeepTutor,开源终身个性化辅导系统,近3万星。
它不是简单的问答机器人,而是一套完整的个性化学习系统。
你可以导入教材、论文和笔记,让 AI 基于自己的资料:
深度解,拆解完整推理过程
自动出、批改,并生成针对性练习
调研复杂主,整理成结构化报告
把抽象概念转成图表、动画和互动内容
记录学习进度与知识薄弱点,持续调整学习路径
它还支持多种 RAG 引擎、本地模型、Skills 和长期记忆,可用 Docker 自托管,Apache 2.0 开源。
相比直接问通用 AI,DeepTutor 更像一个会使用你的资料、了解你学习状态,并陪你长期推进的学习工作台。

AI探索 | Hermes/OpenClaw优质资源优质信息
七月买的性价比最高的东西就是这个 keep 手环了
本来是买来用于骑行的时候监测心率的
但到手之后发现还能游泳的记录心率和距离
而且健身,散步都能记录到 Keep 里
相比苹果表,这手环轻若无物,毫无压力
这玩意儿200块钱...真的太值了...
也就一个手串的钱
科学还是比佛学划算
@aigc1024
麻烦问下,您是**本人吗?
麻烦问下,您是**本人吗?
麻烦问下,您是**本人吗?
……
如今,这400电的机器人真的是
@aigc1024
理光是我买过的质量最差的相机了
发热问很严重,拍不到100张就发烫
300块钱的原装电池,用了不到十次就无法充电
感觉他们选了个非常糟糕的代工厂
这相机的质量完全对不起溢价
这就是网红产品的代价吧
还是富士香
@aigc1024
马斯克:最可能的结果是“极度富足时代”
只要不发生第三次世界大战等灾难性事件,AI与机器人将带来前所未有的丰裕:任何人都能轻易获得自己能想到的任何东西。
风险依然存在,但他选择乐观面对
杀手机器人、AI毁灭人类的概率仍在10%-20%,风险并非为零。

AI探索 | Hermes/OpenClaw优质资源优质信息
Media is too big
VIEW IN TELEGRAM
Google DeepMind's Kanishka Rao on the Road to Physical AGI:https://youtu.be/CrudsEeyS6k?si=tGjPPHAqa_JX9LJu
@aigc1024
价值几万的各种小吃教程
🔗

@meiriyishu
输入一张照片,输出一个用代码生成的3D模型。
img2threejs 拿一张参考图,把里面的物体或角色,用基础形状和程序着色,一步步搭成高质量、能直接动画的 Three.js 模型。
不扫模、不下载素材、不导入现成网格。
全程分阶段把关,AI 边渲边对比检查,不过关就自己改。
带关节、碰撞体,随时能动。浏览器直接打开就能看,省 token,干净利落。

AI探索 | Hermes/OpenClaw优质资源优质信息
深研:3分钟速览Kimi K3技术报告:是怎么让模型造得更大、训得更聪明、用得足够便宜的?
https://mp.weixin.qq.com/s/7tO5SytGXKyHu88n-wczTA
Kimi K3刚发布了47页的技术报告,信息量极大。
如果把大模型比作一家医院,上一代Kimi K2是一家有384位专科医生、每次会诊请8位的医院。
而K3则把医院扩建成896位专家、每次请16位会诊,还新招了一批"能看片子"的医生(原生视觉),并把病历本(上下文)从12.8万字加厚到100 万字,而且全部"医术"免费开放。
@aigc1024
Back to Top