24/09

Thứ Năm · 2 tin
WeChat: Ant Ling
Mô hìnhĐiểm AI 67/100

Tinh chọnAnt Group ra mắt Ming-Image-0.1-Design: Bộ đôi mô hình 6B đột phá trong thiết kế và chỉnh sửa layer

Ant Group vừa mã nguồn mở dòng mô hình Ming-Image-0.1-Design, bao gồm hai model 6B chuyên biệt: Design giúp tạo UI, poster từ văn bản và Layer hỗ trợ tách ảnh thành các lớp RGBA có thể chỉnh sửa độc lập.


Vì sao đáng đọc: Bài viết cung cấp sự phân chia năng lực, kết quả đánh giá và hiệu quả tích hợp thực tế của hai mô hình 6B, giúp độc giả đánh giá giá trị triển khai của chuỗi quy trình tạo hình ảnh kết hợp chỉnh sửa layer.

23/09

Thứ Tư · 4 tin
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnKhi AI 'nuốt chửng' quảng cáo tìm kiếm: Nghiên cứu LAMA đưa đấu giá vào từng Token

Khi AI thay đổi cách người dùng tiếp nhận thông tin, các nhà nghiên cứu từ ĐH Nhân dân Trung Quốc và Stanford đã đề xuất LAMA, một phương pháp tích hợp đấu giá quảng cáo trực tiếp vào quá trình tạo văn bản theo từng Token.


Vì sao đáng đọc: Bài viết phân tích sâu sắc sự chuyển dịch của mô hình quảng cáo trong kỷ nguyên AI, kết hợp giữa thực trạng thị trường và giải pháp kỹ thuật đột phá từ giới học thuật.
Tencent Hunyuan@TencentHunyuan
Sản phẩmĐiểm AI 57/100

Cùng sự kiệnMô hình tạo ảnh Tencent Hunyuan Hy Image 3.5 Preview đã hỗ trợ ComfyUI

ComfyUI ✖️ Hy Image3.5 preview

DịchTencent vừa ra mắt bản preview của Hy Image 3.5 trên ComfyUI, cải thiện 30% hiệu suất so với bản cũ. Mô hình hỗ trợ tạo ảnh từ văn bản và hình ảnh với độ phân giải 2K, khả năng hiển thị văn bản đa ngôn ngữ chính xác và giữ vững đặc điểm nhân vật trong nhiều phong cách nghệ thuật.

Cùng sự kiện, bài đại diện «Tencent Hunyuan ra mắt bản preview Hy Image 3.5 trên ComfyUI»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

RULER: Phương pháp đánh giá và tối ưu hóa mới cho việc tạo hình ảnh vector (SVG) bằng AI

RULER giải quyết vấn đề thiếu tiêu chuẩn đánh giá trong tạo mã SVG bằng cách sử dụng hệ thống chấm điểm đa tiêu chí dựa trên mô hình ngôn ngữ thị giác, giúp tối ưu hóa mô hình học tăng cường hiệu quả hơn so với các chỉ số truyền thống.

PixVerse@PixVerse
Mô hìnhĐiểm AI 40/100

PixVerse R2: Mô hình thế giới thời gian thực cho phép tương tác và kiến tạo môi trường

Take the wheel and drive across open terrain. #PixVerseWorldModel Change the world without stopping….

DịchPixVerse R2 là mô hình thế giới thời gian thực mới, cho phép người dùng điều khiển, chỉnh sửa môi trường và tương tác với các nhân vật có khả năng ghi nhớ thông qua câu lệnh.

22/09

Thứ Ba · 3 tin
Runway: News (Web)
Sản phẩmĐiểm AI 39/100

Runway ra mắt DIFFUSE: Nền tảng tuyển dụng chuyên biệt cho nhân tài sáng tạo AI

Runway vừa giới thiệu DIFFUSE, nền tảng kết nối các thương hiệu với những chuyên gia sáng tạo sử dụng công cụ AI. Đây là giải pháp đón đầu xu hướng khi nhu cầu tuyển dụng nhân sự có kỹ năng AI trong ngành sáng tạo đang tăng mạnh.

Diễn biến sự kiện · 2 bài →
Tencent Hunyuan: Research (API)
Mô hìnhĐiểm AI 60/100

Tinh chọnTencent Hunyuan ra mắt mô hình tạo ảnh Hy Image 3.5 Preview

Hy Image 3.5 hỗ trợ tạo ảnh từ văn bản và hình ảnh, cho phép sử dụng tối đa 5 ảnh tham chiếu, chỉnh sửa đa vòng và xuất ảnh độ phân giải 2K. Mô hình đạt hiệu suất vượt trội hơn 30% so với thế hệ trước trong các bài kiểm tra mù của chuyên gia.

Diễn biến sự kiện · 4 bài →Thêm 5 nguồn khác đưa tinX: X.PIN (@thexpin)IT HomeX: Tencent Hunyuan (@TencentHunyuan)X: Rohan Paul (@rohanpaul_ai)WeChat: Tencent Hunyuan

Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ một ông lớn công nghệ, cải thiện đáng kể khả năng kiểm soát hình ảnh và chất lượng đầu ra, rất đáng chú ý trong cộng đồng AI.

21/09

Thứ Hai · 4 tin
Pandaily
Mô hìnhĐiểm AI 85/100

Cùng sự kiệnAlibaba ra mắt Qwen-Image-2.1: Mô hình 7B hỗ trợ tạo và chỉnh sửa ảnh với kênh màu RGBA

Alibaba vừa phát hành Qwen-Image-2.1, mô hình 7B mã nguồn mở cho phép tạo và chỉnh sửa ảnh với độ trong suốt RGBA gốc, hỗ trợ tới 10 ảnh tham chiếu. Lưu ý: giấy phép nghiên cứu hiện chưa cho phép sử dụng thương mại.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint»
TechNode
Mô hìnhĐiểm AI 85/100

Cùng sự kiệnAlibaba ra mắt Qwen-Image-2.1: Mô hình mã nguồn mở tích hợp tạo và chỉnh sửa ảnh chuyên sâu

Đội ngũ Qwen của Alibaba vừa phát hành Qwen-Image-2.1, mô hình 7 tỷ tham số hỗ trợ tạo ảnh, chỉnh sửa cục bộ và xử lý ảnh trong suốt với khả năng kết hợp lên tới 10 ảnh tham chiếu.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint»
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 69/100

Cùng sự kiệnAlibaba Cloud ra mắt mô hình tạo ảnh Qwen-Image-2.1 và công khai mã nguồn

Meet Qwen-Image-2.1, the most balanced and cost-effective image generation model in the Qwen-Image s…

DịchĐội ngũ Qwen của Alibaba Cloud vừa giới thiệu Qwen-Image-2.1, phiên bản cân bằng nhất trong dòng mô hình tạo ảnh với hiệu năng cao, hỗ trợ toàn diện cả tính năng tạo mới và chỉnh sửa hình ảnh.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint»
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 69/100

Tinh chọnAlibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint

Qwen-Image-2.1 × @HuggingApps: live demo on Spaces! 🖼 One single checkpoint for generation and edit…

DịchQwen-Image-2.1 là mô hình 7B mới từ Alibaba, hỗ trợ tạo và chỉnh sửa ảnh linh hoạt với tối đa 10 ảnh tham chiếu. Mô hình tích hợp sẵn LLM tăng cường gợi ý, hỗ trợ ComfyUI và có bản demo trực tuyến trên Hugging Face.

Diễn biến sự kiện · 9 bài →Thêm 11 nguồn khác đưa tinMarkTechPostPandailyTechNodeX: Alibaba Cloud (@alibaba_cloud)X: Arena (@arena)The Decoder: AI NewsX: Kim (@kimmonismus)X: AK (@_akhaliq)Hacker News: AI bài nổi bậtIT HomeX: X.PIN (@thexpin)

Vì sao đáng đọc: Đây là bước tiến quan trọng của Qwen trong lĩnh vực đa phương thức, tối ưu hóa hiệu năng với mô hình 7B gọn nhẹ và khả năng chỉnh sửa ảnh thực tế.

20/09

Chủ Nhật · 2 tin
Hacker News: AI bài nổi bật
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnQwen-Image-2.1 ra mắt: Mô hình mã nguồn mở hỗ trợ tạo và chỉnh sửa ảnh trong suốt

Qwen-Image-2.1 là mô hình 7B tối ưu, tích hợp khả năng tạo và chỉnh sửa ảnh chuyên sâu với hỗ trợ gốc cho ảnh trong suốt, cho phép kiểm soát chi tiết qua tham chiếu và mặt nạ.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint»
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnAlibaba ra mắt Qwen-Image-2.1: Mô hình tạo và chỉnh sửa ảnh hiệu năng cao

Meet Qwen-Image-2.1, the most balanced and cost-effective image generation model in the Qwen-Image s…

DịchQwen-Image-2.1 là mô hình 7B tối ưu, hỗ trợ tạo và chỉnh sửa ảnh chuyên sâu với khả năng xử lý lớp trong suốt RGBA, điều khiển cục bộ chính xác và hỗ trợ đa tham chiếu.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint»

17/09

Thứ Năm · 1 tin
Alibaba Cloud@alibaba_cloud
Sản phẩmĐiểm AI 52/100

Alibaba Cloud ra mắt Wan3.0: Tạo video 30 giây với khả năng kiểm soát chuyên sâu

This is where Wan3.0 starts fitting into real production. A year ago: 5-second clips. Then: 15 secon…

DịchWan3.0 nâng cấp khả năng tạo video dài 30 giây với tính năng tham chiếu đa video, cho phép các nhà sáng tạo sản xuất nội dung theo kịch bản chuyên nghiệp mà không cần ghép nối nhiều đoạn ngắn.

16/09

Thứ Tư · 1 tin
Viggle AI@ViggleAI
Mô hìnhĐiểm AI 50/100

Viggle AI ra mắt mô hình video Meridian, cho phép tùy chỉnh góc quay và hiệu ứng thời gian

Meet Meridian by Viggle AI: a video model that lets you change the camera angle and timing of an exi…

DịchViggle AI vừa phát hành mô hình Meridian, hỗ trợ thay đổi góc máy, điều chỉnh tốc độ hoặc đóng băng khung hình trong video có sẵn. Người dùng hiện có thể tải xuống trọng số của mô hình này trên Hugging Face.

15/09

Thứ Ba · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 43/100

Vibe Design Agents: Bước tiến mới trong việc tự động hóa thiết kế sáng tạo

Nghiên cứu giới thiệu kiến trúc suy luận tách biệt quá trình khám phá ý tưởng và thực thi thiết kế, giúp AI tạo ra các giao diện có tính thẩm mỹ cao thông qua việc chuẩn hóa quy trình ra quyết định.

14/09

Thứ Hai · 4 tin
Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 16/100

Alibaba Cloud trình diễn khả năng tạo ảnh món ăn chân thực từ mô hình Qwen

You can't eat these food, but they look just as gorgeous. More API access: • Qwen Cloud: https://cl...

DịchAlibaba Cloud vừa giới thiệu loạt ảnh món ăn được tạo ra bởi mô hình Qwen với độ chi tiết và chân thực đáng kinh ngạc. Người dùng có thể trải nghiệm công nghệ này thông qua nền tảng Qwen Cloud hoặc Model Studio.

13/09

Chủ Nhật · 2 tin
JiQiZhiXin
NgànhĐiểm AI 92/100

Tinh chọnTối ưu hóa MiniMax H3 trên vLLM-Omni: Đột phá tốc độ tạo video thời gian thực

Bài viết phân tích cách vLLM-Omni và FastVideo FastH3 giải quyết các nút thắt hệ thống trong MiniMax H3, giúp rút ngắn thời gian tạo video 10 giây xuống dưới 9 giây thông qua tối ưu hóa toàn diện từ DiT đến đóng gói MP4.


Vì sao đáng đọc: Nội dung chuyên sâu về kỹ thuật tối ưu hóa hạ tầng cho mô hình video tạo sinh, giải quyết bài toán thực tế về độ trễ hệ thống, rất có giá trị cho kỹ sư AI.
The Decoder: AI News
Sản phẩmĐiểm AI 60/100

ElevenLabs ra mắt Music v2.5: Nâng cấp chất lượng âm nhạc, hỗ trợ API và gói miễn phí

ElevenLabs vừa cập nhật Music v2.5 với khả năng tạo nhạc tự nhiên, giàu cảm xúc hơn. Theo kết quả thử nghiệm mù, phiên bản này vượt trội ở các thể loại R&B, Hip-Hop và nhạc giao hưởng, hiện đã mở cho người dùng trải nghiệm qua ứng dụng và API.

12/09

Thứ Bảy · 1 tin
ZHO@ZHO_ZHO_ZHO
Hướng dẫnĐiểm AI 66/100

Cùng sự kiệnTrải nghiệm thực tế GPT Images 2.5: Phân tích từ 730 ảnh và 5 vấn đề cốt lõi

Tác giả Zho đã thực hiện bài test cường độ cao với 730 ảnh tạo bởi GPT Images 2.5, đạt tỷ lệ thành công 96,6% và đánh giá chi tiết về khả năng chỉnh sửa chuyên sâu.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt ChatGPT Images 2.5: Tạo ảnh nhanh hơn, sắc nét và thông minh hơn»

11/09

Thứ Sáu · 3 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 41/100

World in World: Bước tiến mới trong việc điều khiển và tương tác với mô hình thế giới video

World in World (WiW) là phương pháp đột phá cho phép tương tác và điều khiển video thời gian thực mà không cần huấn luyện lại mô hình, thông qua việc tích hợp trực tiếp dữ liệu hình ảnh vào các mô hình thế giới có sẵn.

Suno@suno
NgànhĐiểm AI 35/100

Suno ra mắt mô hình v6-wild: Tái hiện chất âm mộc mạc và đầy ngẫu hứng

If you kept going back to an older Suno model because you liked the variation, grit, personality, or…

DịchSuno vừa giới thiệu v6-wild, mô hình được thiết kế dành riêng cho những người dùng yêu thích sự phá cách, nét thô mộc và những biến tấu bất ngờ trong âm nhạc. Bạn có thể tận dụng tính năng Variety để tinh chỉnh các đặc tính độc đáo này ngay từ câu lệnh đầu vào.

10/09

Thứ Năm · 2 tin
Suno@suno
NgànhĐiểm AI 32/100

Suno v6 miễn phí tạo nhạc trong 48 giờ tới

For the next 48 hours, v6 songs cost zero credits on any paid plan. Go explore what v6 can do.

DịchTrong vòng 48 giờ tới, người dùng Suno trên mọi gói trả phí có thể tạo nhạc bằng mô hình v6 mà không tốn bất kỳ điểm tín dụng nào. Đây là cơ hội tốt để trải nghiệm khả năng sáng tạo của phiên bản mới nhất.

09/09

Thứ Tư · 13 tin
ZHO@ZHO_ZHO_ZHO
NgànhĐiểm AI 39/100

Đánh giá thực tế GPT Images 2.5: Bước tiến vượt bậc về chất liệu và độ chi tiết

ZHO đánh giá cao khả năng tái tạo chất liệu và giữ vững đặc điểm hình ảnh của GPT Images 2.5. Phiên bản mới không chỉ xử lý xuất sắc các chi tiết phức tạp như lông hay sợi thừng mà còn loại bỏ hoàn toàn hiện tượng nhiễu hạt so với thế hệ trước.

Suno@suno
NgànhĐiểm AI 46/100

Kỷ nguyên Suno v6 chính thức bắt đầu: Mô hình tạo nhạc mạnh mẽ nhất từ trước đến nay

Welcome to the v6 era. Our best models yet, built in partnership with artists and producers. Here's …

DịchSuno vừa ra mắt phiên bản v6, mô hình âm nhạc tiên tiến nhất được phát triển thông qua sự hợp tác chặt chẽ với các nghệ sĩ và nhà sản xuất chuyên nghiệp.

Elvis Saravia@omarsar0
Mô hìnhĐiểm AI 58/100

Ra mắt LTX-2.5: Mô hình video thế giới mã nguồn mở với khả năng chỉnh sửa mạnh mẽ

Open video models are having their moment. The previous generation of LTX alone reached 18M downloa…

DịchLTX-2.5 là mô hình video thế giới mã nguồn mở mới, cho phép triển khai cục bộ với khả năng tạo và chỉnh sửa video vượt trội. Phiên bản này cải thiện độ sắc nét khuôn mặt, tính nhất quán giữa các cảnh quay và hỗ trợ các kỹ thuật như IC-LoRA để tùy chỉnh đối tượng và môi trường chuyên sâu.

IT Home
Mô hìnhĐiểm AI 65/100

Cùng sự kiệnSuno ra mắt bộ ba mô hình AI âm nhạc v6: Đột phá tốc độ và khả năng sáng tạo

Suno vừa trình làng dòng mô hình v6 với ba phiên bản chuyên biệt, hỗ trợ chỉnh sửa bằng ngôn ngữ tự nhiên và tạo nhạc từ đa phương thức. Dịch vụ này cũng đã thiết lập quan hệ đối tác chiến lược với các ông lớn như Warner Music và BMG.

Cùng sự kiện, tinh chọn hiển thị «Suno v6 ra mắt: Biến hình ảnh, video và ghi âm thành âm nhạc chuyên nghiệp»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 48/100

AuK: Mô hình nền tảng mã nguồn mở đột phá trong tạo và chỉnh sửa giọng nói

AuK là mô hình nền tảng đa năng cho phép tạo và chỉnh sửa giọng nói thông qua ngôn ngữ tự nhiên, được huấn luyện trên quy mô dữ liệu khổng lồ. Phiên bản AuK-Flash tối ưu hóa tốc độ suy luận nhanh gấp 4.5 lần, mở ra tiềm năng ứng dụng lớn cho các nhà phát triển.

IT Home
Mô hìnhĐiểm AI 71/100

Cùng sự kiệnOpenAI ra mắt ChatGPT Images 2.5: Tốc độ nhanh gấp đôi, hỗ trợ vẽ phác thảo

OpenAI vừa trình làng mô hình tạo ảnh ChatGPT Images 2.5 với độ chi tiết và ánh sáng chân thực hơn, đồng thời giảm 50% độ trễ so với phiên bản tiền nhiệm cùng tính năng vẽ phác thảo mới.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt ChatGPT Images 2.5: Tạo ảnh nhanh hơn, sắc nét và thông minh hơn»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (78 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Generative AI” | AIHOT.vn